Conceptio
›
parallel-computing
Topic
parallel-computing
Knowledge-graph topic
· documents ABOUT parallel-computing across the archive
1,734
Documents about parallel-computing
Documents about parallel-computing
SwarmHarness: Skill-Based Task Routing via Decentralized Incentive-Aligned AI Agent Networks
#238574
arXiv CS
Scaling LLM Inference Beyond Amdahl`s Limits via Eliminating Non-Scalable Overheads
#246507
arXiv CS
Night-Window Batching versus Carbon-Aware Scheduling for Clinical AI GPU Workloads
#246511
arXiv CS
Residual-Weighted Randomized Jacobi: Sharpened Bounds via Residual Concentration and Asynchronous Extension
#246521
arXiv CS
S$^3$LDBO: A Snapshot Single-Loop Algorithm for Decentralized Bilevel Optimization
#246538
arXiv CS
Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized User Preferences
#246539
arXiv CS
LLM-Based Porting of Optimized C++ to CUDA Through Deoptimization and Reoptimization
#259419
arXiv CS
Predicting Lakehouse Performance in Clouds: An Empirical Exploration of Query Runtime Variance
#259444
arXiv CS
STREAM: Multi-Tier LLM Inference Middleware with Dual-Channel HPC Token Streaming
#271783
arXiv CS
Maestro: Workload-Aware Cross-Cluster Scheduling for LLM-Based Multi-Agent Systems
#271795
arXiv CS
DRIFT: Risk-Constrained Diffusion with Imitation Priors for Mixed-Autonomy Traffic Generation
#280161
arXiv CS
Tropical: Enhancing SLO Attainment in Disaggregated LLM Serving via SLO-Aware Multiplexing
#280165
arXiv CS
A RAG-Enhanced Bi-Level Cognitive Orchestration Framework for LEO Satellite Networks
#280181
arXiv CS
From GPU to Microcontroller: Online Ridge Regression for Edge-Deployable Traffic Prediction
#282765
arXiv CS
Spotlight: Synergizing Seed Exploration and Spot GPUs for DiT RL Post-Training
#287095
arXiv CS
The Energy Consumption of Transformer Fine-Tuning: A Roofline-Inspired Scaling Model
#299876
arXiv CS
When Staking Rewards Compound: Measuring the Impact of Ethereum's Pectra Upgrade
#299880
arXiv CS
Efficient Network Inference via Hardware-Aware Architecture Search, Model Pruning & Quantization
#299883
arXiv CS
Nautilus: A Verifiable Hierarchical Federated Learning Framework for Vehicular-Edge-Cloud Systems
#299884
arXiv CS
Clutch: High Performance Vector-Scalar Comparison using DRAM via Chunked Temporal Coding
#299888
arXiv CS
StickyInvoc: Rethinking Task Models for High-throughput Workflows in the LLM Era
#299897
arXiv CS
KineticSim: A Lightweight, High-Performance Execution Engine for Real-Time Market Simulators
#299900
arXiv CS
Towards Global Multi-Cloud Strategies: Insights into AWS and Alibaba Cloud Synergy
#299903
arXiv CS
Semantic Lock: Synchronization Based on the Analysis of the Operation Conflict Graph
#303182
arXiv CS
An Efficient Construction of Completely Independent Spanning Trees in Dense Gaussian Networks
#303187
arXiv CS
NEURON-Fabric: Architecture-Runtime Co-Design for Controlled Low-Bit Gradient Communication
#306986
arXiv CS
Endeavor: Efficient PairHMM for Detection of DNA Variants in Genome-Scale Datasets
#306987
arXiv CS
Latency-Aware Service Placement using Neural Combinatorial Optimisers for Edge--Cloud Systems
#306991
arXiv CS
CV-Rules: Serializability Verification of Concurrency Control Protocols via Explicit Transaction Ordering
#306993
arXiv CS
Power-Flexible AI Data Centers: A New Paradigm for Grid-Responsive Compute
#306996
arXiv CS
Speculation at a Distance: Where Edge-Cloud Speculative Decoding Actually Pays Off
#306997
arXiv CS
CHAMB-GA: A Containerized HPC Scalable Microservice-Based Framework for Genetic Algorithms
#310781
arXiv CS
Priceless: An examination of Serverless Functions-as-a-Service (FaaS) pricing models
#310790
arXiv CS
Spandana: Reconciling Strict SLOs with Low Cost under Fine-Grained Load Fluctuations
#321794
arXiv CS
SMART-MIG: A Learning Framework for Scalable and Energy-Efficient GPU Scheduling
#321802
arXiv CS
MosaicKV: Serving Long-Context LLM with Dynamic Two-D KV Cache Compression
#329055
arXiv CS
SmoothAgent: Efficient Long-Horizon LLM-Based Agent Serving with Lookahead Context Engineering
#329061
arXiv CS
Parallel Schwarz Alternating Methods Implemented on Cloud Architecture for Solving the Coupled Problem of Electrophoresis
#239154
HAL (France)
NL-CPS: Reinforcement Learning-Based Kubernetes Control Plane Placement in Multi-Region Clusters
#2535
arXiv CS
Making Room for AI: Multi-GPU Molecular Dynamics with Deep Potentials in GROMACS
#2547
arXiv CS
Foundry: Template-Based CUDA Graph Context Materialization for Fast LLM Serving Cold Start
#2559
arXiv CS
ForkKV: Scaling Multi-LoRA Agent Serving via Copy-on-Write Disaggregated KV Cache
#2562
arXiv CS
Fine-Grained Power and Energy Attribution on AMD GPU/APU-Based Exascale Nodes
#2563
arXiv CS
DeepStack: Scalable and Accurate Design Space Exploration for Distributed 3D-Stacked AI Accelerators
#2572
arXiv CS
MATCHA: Efficient Deployment of Deep Neural Networks on Multi-Accelerator Heterogeneous Edge SoCs
#5935
arXiv CS
Watt Counts: Energy-Aware Benchmark for Sustainable LLM Inference on Heterogeneous GPU Architectures
#5938
arXiv CS
Sensor Placement for Tsunami Early Warning via Large-Scale Bayesian Optimal Experimental Design
#5940
arXiv CS
Fine-Grained Power and Energy Attribution on AMD GPU/APU-Based Exascale Nodes
#5941
arXiv CS
Prefill-as-a-Service: KVCache of Next-Generation Models Could Go Cross-Datacenter
#18981
arXiv CS
CoCoDiff: Optimizing Collective Communications for Distributed Diffusion Transformer Inference Under Ulysses Sequence Parallelism
#18988
arXiv CS
← Previous
Page 14 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.