Conceptio
›
parallel-computing
Topic
parallel-computing
Knowledge-graph topic
· documents ABOUT parallel-computing across the archive
1,734
Documents about parallel-computing
Documents about parallel-computing
Pulse: Training Acceleration for Large Diffusion Models with Automatic Pipeline Parallelism
#287091
arXiv CS
FoMoE: Breaking the Full-Replica Barrier with a Federation of MoEs
#287094
arXiv CS
Mixed-Precision Communication-Avoiding SGD for Generalized Linear Models on GPUs
#287105
arXiv CS
Quantum ring all-reduce: communication and privacy advantages for distributed learning
#290548
arXiv CS
The Bi-Channel Networking Paradigm for Database Systems in the Cloud
#290551
arXiv CS
SAC: Disaggregated KV Cache System for Sparse Attention LLMs with CXL
#290553
arXiv CS
Mesh Inference: A Formal Model of Collective Intelligence Without a Center
#290555
arXiv CS
Kamera: Unified Position-Invariant Multimodal KV Cache for Training-Free Reuse
#299875
arXiv CS
Concordia: JIT-Compiled Persistent-Kernel Checkpointing for Fault-Tolerant LLM Inference
#299877
arXiv CS
Decentralized Operations of Decarbonized Chemical Plants with Renewable-driven Transmission Systems
#299886
arXiv CS
Fed-CausalDiff: Decoupled Synchronization for Federated Do-Simulation and Policy Evaluation
#299893
arXiv CS
FeLoG: Scalable and Efficient Distributed Graph Embedding with Feedback Loop Mechanism
#299896
arXiv CS
DPIFrame: A Dual-Level Parallelism Acceleration Framework for CTR Model Inference
#299908
arXiv CS
Sovereign Execution Broker: Enforcing Certificate-Bound Authority in Agentic Control Planes
#299912
arXiv CS
A Natively Blocked, Device-Resident Algebraic Multigrid GPU Path in PETSc
#303175
arXiv CS
Semi-asynchronous Federated Learning in Flower: Framework Extension and Performance Assessment
#303183
arXiv CS
Aquifer: Hierarchical Memory Pooling with CXL and RDMA for MicroVM Snapshots
#303184
arXiv CS
Dynamic Load Balancing for Uncertainty Quantification with Applications in Bayesian Inversion
#306988
arXiv CS
EmuGEMM: Fused Tensor Core Kernels for Precision Emulation in Matrix Multiplication
#306992
arXiv CS
Moebius: Serving Mixture-of-Expert Models with Seamless Runtime Parallelism Switch
#310786
arXiv CS
A Distributed Quantum Approximate Optimization Algorithm Simulator for Engineering Design Optimization
#310791
arXiv CS
Optimizing Teacher-Student Partitioning for Scalable Knowledge Distillation on HPC Systems
#319646
arXiv CS
HSAP: A Hierachical Sequence-aware Parallelism for Hybrid-Context Generative Models
#321796
arXiv CS
HSAP: A Hierarchical Sequence-aware Parallelism for Hybrid-Context Generative Models
#324870
arXiv CS
Modeling and Chasing the Energy-Efficiency Sweet Spots in Modern GPUs
#329053
arXiv CS
ELDR: Expert-Locality-Aware Decode Routing for PD-Disaggregated MoE Serving
#329057
arXiv CS
WattGPU: Predicting Inference Power and Latency on Unseen GPUs and LLMs
#332487
arXiv CS
CROWDio: A Practical Mobile Crowd Computing Framework with Developer-Oriented Design, Adaptive Scheduling, and Fault Resilience
#124023
arXiv CS
AlignedServe: Orchestrating Prefix-aware Batching to Build a High-throughput and Computing-efficient LLM Serving System
#224488
arXiv CS
Predictive Autoscaling in Cloud-Native and Federated Cloud-Edge Computing Environments: A Taxonomy and Future Directions
#266144
arXiv CS
HI-HCQC: A Tightly-Coupled Hardware Interface with High-Efficiency Communication for Hybrid Classical-Quantum Computing
#287101
arXiv CS
YAIFS: Yet (not) Another Intelligent Fog Simulator: A Framework for Agent-Driven Computing Continuum Modeling & Simulation
#124028
arXiv CS
Reduced-Mass Orbital AI Inference via Integrated Solar, Compute, and Radiator Panels
#2543
arXiv CS
Autopoiesis: A Self-Evolving System Paradigm for LLM Serving Under Runtime Dynamics
#2549
arXiv CS
NestPipe: Large-Scale Recommendation Training on 1,500+ Accelerators via Nested Pipelining
#2551
arXiv CS
Optimizing OpenFaaS on Kubernetes: Comparative Analysis of Language Runtimes and Cluster Distributions
#2568
arXiv CS
OpenDT: Exploring Datacenter Performance and Sustainability with a Self-Calibrating Digital Twin
#10309
arXiv CS
A Full Compression Pipeline for Green Federated Learning in Communication-Constrained Environments
#10311
arXiv CS
NimbusGuard: A Novel Framework for Proactive Kubernetes Autoscaling Using Deep Q-Networks
#10313
arXiv CS
Icicle: Scalable Metadata Indexing and Real-Time Monitoring for HPC File Systems
#10320
arXiv CS
ConfigSpec: Profiling-Based Configuration Selection for Distributed Edge--Cloud Speculative LLM Serving
#10329
arXiv CS
Beyond Pre-Training: The Full Lifecycle of Foundation Models on HPC Systems
#13058
arXiv CS
BlazingAML: High-Throughput Anti-Money Laundering (AML) via Multi-Stage Graph Mining
#13063
arXiv CS
PipeLive: Efficient Live In-place Pipeline Parallelism Reconfiguration for Dynamic LLM Serving
#13064
arXiv CS
Predictive Bayesian Arbitration: A Scalable Noisy-OR Model with Service Criticality Awareness
#13068
arXiv CS
A Full Compression Pipeline for Green Federated Learning in Communication-Constrained Environments
#13072
arXiv CS
Robust Synchronisation for Federated Learning in The Face of Correlated Device Failure
#31240
arXiv CS
Continuous benchmarking: Keeping pace with an evolving ecosystem of models and technologies
#31243
arXiv CS
New Kids: An Architecture and Performance Investigation of Second-Generation Serverless Platforms
#31244
arXiv CS
Breaking the Training Barrier of Billion-Parameter Universal Machine Learning Interatomic Potentials
#31245
arXiv CS
← Previous
Page 12 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.