Conceptio
›
parallelcomputing
Topic
parallelcomputing
Knowledge-graph topic
· documents ABOUT parallelcomputing across the archive
164
Documents about parallelcomputing
Documents about parallelcomputing
EdgeFlow: Fast Cold Starts for LLMs on Mobile Devices
#5937
arXiv CS
Watt Counts: Energy-Aware Benchmark for Sustainable LLM Inference on Heterogeneous GPU Architectures
#5938
arXiv CS
Finding Nemo-Nemo: CFT DAG-based Consensus in the WAN
#5939
arXiv CS
Sensor Placement for Tsunami Early Warning via Large-Scale Bayesian Optimal Experimental Design
#5940
arXiv CS
Fine-Grained Power and Energy Attribution on AMD GPU/APU-Based Exascale Nodes
#5941
arXiv CS
ALTO: Adaptive LoRA Tuning and Orchestration for Heterogeneous LoRA Training Workloads
#5942
arXiv CS
Nanvix: A Multikernel OS Design for High-Density Serverless Deployments
#10307
arXiv CS
CUTEv2: Unified and Configurable Matrix Extension for Diverse CPU Architectures with Minimal Design Overhead
#10308
arXiv CS
OpenDT: Exploring Datacenter Performance and Sustainability with a Self-Calibrating Digital Twin
#10309
arXiv CS
Characterizing the Impact of Congestion in Modern HPC Interconnects
#10310
arXiv CS
A Full Compression Pipeline for Green Federated Learning in Communication-Constrained Environments
#10311
arXiv CS
Record-Remix-Replay: Hierarchical GPU Kernel Optimization using Evolutionary Search
#10312
arXiv CS
NimbusGuard: A Novel Framework for Proactive Kubernetes Autoscaling Using Deep Q-Networks
#10313
arXiv CS
QuMod: Parallel Quantum Job Scheduling on Modular QPUs using Circuit Cutting
#10314
arXiv CS
Understanding Communication Backends in Cross-Silo Federated Learning
#10315
arXiv CS
Workload composition smooths aggregate power demand while sustaining short-horizon ramps in AI data centers
#10316
arXiv CS
FEDBUD: Joint Incentive and Privacy Optimization for Resource-Constrained Federated Learning
#10317
arXiv CS
CIR: Lightweight Container Image for Cross-Platform Deployment
#10318
arXiv CS
Leveraging Mathematical Reasoning of LLMs for Efficient GPU Thread Mapping
#10319
arXiv CS
Icicle: Scalable Metadata Indexing and Real-Time Monitoring for HPC File Systems
#10320
arXiv CS
Verifying In-Network Computing Systems for Design Risks
#10321
arXiv CS
RF-LEGO: Modularized Signal Processing-Deep Learning Co-Design for RF Sensing via Deep Unrolling
#10322
arXiv CS
Tessera: Unlocking Heterogeneous GPUs through Kernel-Granularity Disaggregation
#10323
arXiv CS
FlexVector: A SpMM Vector Processor with Flexible VRF for GCNs on Varying-Sparsity Graphs
#10324
arXiv CS
LoDAdaC: a unified local training-based decentralized framework with adaptive gradients and compressed communication
#10325
arXiv CS
Rebooting Microreboot: Architectural Support for Safe, Parallel Recovery in Microservice Systems
#10326
arXiv CS
A-IO: Adaptive Inference Orchestration for Memory-Bound NPUs
#10327
arXiv CS
SMART: When is it Actually Worth Expanding a Speculative Tree?
#10328
arXiv CS
ConfigSpec: Profiling-Based Configuration Selection for Distributed Edge--Cloud Speculative LLM Serving
#10329
arXiv CS
DySkew: Dynamic Data Redistribution for Skew-Resilient Snowpark UDF Execution
#13053
arXiv CS
An Engineering Journey Training Large Language Models at Scale on Alps: The Apertus Experience
#13054
arXiv CS
Towards a Linear-Algebraic Hypervisor
#13055
arXiv CS
EPAC: The Last Dance
#13056
arXiv CS
Intelligent resource prediction for SAP HANA continuous integration build workloads
#13057
arXiv CS
Beyond Pre-Training: The Full Lifecycle of Foundation Models on HPC Systems
#13058
arXiv CS
Three Birds, One Stone: Solving the Communication-Memory-Privacy Trilemma in LLM Fine-tuning Over Wireless Networks with Zeroth-Order Optimization
#13059
arXiv CS
Local-Splitter: A Measurement Study of Seven Tactics for Reducing Cloud LLM Token Usage on Coding-Agent Workloads
#13060
arXiv CS
Decentralized Learning via Random Walk with Jumps
#13061
arXiv CS
A Periodic Space of Distributed Computing: Vision & Framework
#13062
arXiv CS
BlazingAML: High-Throughput Anti-Money Laundering (AML) via Multi-Stage Graph Mining
#13063
arXiv CS
PipeLive: Efficient Live In-place Pipeline Parallelism Reconfiguration for Dynamic LLM Serving
#13064
arXiv CS
Aethon: A Reference-Based Replication Primitive for Constant-Time Instantiation of Stateful AI Agents
#13065
arXiv CS
Evaluating Cross-Architecture Performance Modeling of Distributed ML Workloads Using StableHLO
#13066
arXiv CS
Accelerating Microswimmer Simulations via a Heterogeneous Pipelined Parallel-in-Time Framework
#13067
arXiv CS
Predictive Bayesian Arbitration: A Scalable Noisy-OR Model with Service Criticality Awareness
#13068
arXiv CS
GitFarm: Git as a Service for Large-Scale Monorepos
#13069
arXiv CS
Understanding Large-Scale HPC System Behavior Through Cluster-Based Visual Analytics
#13070
arXiv CS
ResBM: Residual Bottleneck Models for Low-Bandwidth Pipeline Parallelism
#13071
arXiv CS
A Full Compression Pipeline for Green Federated Learning in Communication-Constrained Environments
#13072
arXiv CS
Taming GPU Underutilization via Static Partitioning and Fine-grained CPU Offloading
#2534
arXiv CS
← Previous
Page 2 of 4
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.