Conceptio
›
parallel-computing
Topic
parallel-computing
Knowledge-graph topic
· documents ABOUT parallel-computing across the archive
1,734
Documents about parallel-computing
Documents about parallel-computing
SiDP: Memory-Efficient Data Parallelism for Offline LLM Inference
#238580
arXiv CS
Addressing Variable Heterogeneity in Distributed Multimodal Training with Entrain
#238581
arXiv CS
SOLANET: Distributed Neighbor Graph Construction on GPU-Accelerated Systems
#238582
arXiv CS
Carbon-Aware Mapping and Scheduling for Deadline-Constrained Workflows
#238584
arXiv CS
Parallelizing Large-Scale Tensor Network Contraction on Multiple GPUs
#246509
arXiv CS
TwinQuant: Learnable Subspace Decomposition for 4-Bit LLM Quantization
#246515
arXiv CS
Schedule-Level Shared-Prefix Reuse for LLM RL Training
#246524
arXiv CS
A Datalog Framework for Conflict-Free Replicated Data Types
#246535
arXiv CS
PithTrain: A Compact and Agent-Native MoE Training System
#246536
arXiv CS
Clownfish: Scaling DAG-based BFT Consensus via Sparse Edges
#259429
arXiv CS
Ekka: Automated Diagnosis of Silent Errors in LLM Inference
#259431
arXiv CS
Deterministic Distance Approximation in MPC via Improved Hitting Sets
#259441
arXiv CS
Libra: Efficient Resource Management for Agentic RL Post-Training
#259447
arXiv CS
Twelve quick tips for designing AI-driven HPC workflows
#266141
arXiv CS
StageFrontier: Synchronization-Aware Stage Accounting for Distributed ML Training
#266149
arXiv CS
Coupling Complementary Simulations for Combined Performance and Energy Optimization
#267611
arXiv CS
Auditable Graph-Guided Root Cause Analysis for Kubernetes Incidents
#267625
arXiv CS
Simple-IT: Practical Low-Latency Signature-Free BFT Consensus
#271775
arXiv CS
M*: A Modular, Extensible, Serving System for Multimodal Models
#271801
arXiv CS
Sovereign Assurance Boundary: Certificate-Bound Admission for Agentic Infrastructure
#271815
arXiv CS
A performance portable fast Ewald summation for Stokes flow
#287093
arXiv CS
From Specification to Execution: AI Assisted Scientific Workflow Management
#287107
arXiv CS
Online Dynamic Batching with Formal Guarantees for LLM Training
#290550
arXiv CS
BatchGen: An Architecture for Scalable and Efficient Batch Inference
#299901
arXiv CS
Efficient Domain Decomposition for the Helmholtz Equation on GPUs
#299902
arXiv CS
Process-Reward Tactic Evolution for Long-Horizon Bioinformatics Workflows
#299910
arXiv CS
Solvability of Approximate Agreement on Graphs and Simplicial Complexes
#303176
arXiv CS
Memory Layouts for GPU-Data Transfer Buffering in SPH
#303188
arXiv CS
TwoStepDemocracy: Prototyping of self-evolving, democratic, and decentralized systems
#306990
arXiv CS
Programmable Probabilistic Computer with 1,000,000 p-bits
#306994
arXiv CS
DMuon: Efficient Distributed Muon Training with Near-Adam Overhead
#310782
arXiv CS
FinWhale: An Optimally Resilient Two-Round Terminating DAG Protocol
#310792
arXiv CS
DiStash: A Disaggregated Multi-Stash Transactional Key-Value Store
#319645
arXiv CS
W4A4 Quantization for Inference on Wan2.2-I2V-A14B
#321807
arXiv CS
Improved Scaling for Fast Mode of Ozaki Scheme II
#321809
arXiv CS
MALOQ: Massively Accelerated Learning of Operators for Quantum Transport
#321813
arXiv CS
FlintKV: A Fast Durable Storage Engine for Modern Databases
#332486
arXiv CS
Towards Compute-Aware In-Switch Computing for LLMs Tensor-Parallelism on Multi-GPU Systems
#168277
arXiv CS
Multi-objective application placement in fog computing using graph neural network-based reinforcement learning
#187283
arXiv CS
Heterogeneous Tasks Offloading in Vehicular Edge Computing: A Federated Meta Deep Reinforcement Learning Approach
#200447
arXiv CS
Scheduling Coflows in Multi-Core OCS Networks with Performance Guarantee
#2538
arXiv CS
Administrative Decentralization in Edge-Cloud Multi-Agent for Mobile Automation
#2542
arXiv CS
Scheduling the Unschedulable: Taming Black-Box LLM Inference at Scale
#2550
arXiv CS
CodecSight: Leveraging Video Codec Signals for Efficient Streaming VLM Inference
#2564
arXiv CS
Analyzing Persistent Alltoallv RMA Implementations for High-Performance MPI Communication
#2570
arXiv CS
TensorHub: Scalable and Elastic Weight Transfer for LLM RL Training
#5936
arXiv CS
Finding Nemo-Nemo: CFT DAG-based Consensus in the WAN
#5939
arXiv CS
Nanvix: A Multikernel OS Design for High-Density Serverless Deployments
#10307
arXiv CS
Record-Remix-Replay: Hierarchical GPU Kernel Optimization using Evolutionary Search
#10312
arXiv CS
Leveraging Mathematical Reasoning of LLMs for Efficient GPU Thread Mapping
#10319
arXiv CS
← Previous
Page 7 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.