Conceptio
›
reinforcement-learning
Topic
reinforcement-learning
Knowledge-graph topic
· documents ABOUT reinforcement-learning across the archive
165
Documents about reinforcement-learning
Documents about reinforcement-learning
A novel intelligent hybrid reinforcement learning framework for autonomous decision making in complex health cognitive systems
#253710
Europe PMC
Model & Locomotion Dynamics of a Goat Bio-Inspired Quadruped Robot Through Reinforcement Learning
#345640
Repositorio institucional Séneca
Enhancing deep reinforcement learning with expert demonstrations for mobile robot navigation in unstructured off-road environments
#336325
Research Online
A survey on deep learning and deep reinforcement learning in robotics with a tutorial on deep reinforcement learning.
#489642
DBLP
Using Deep Reinforcement Learning to Decide Test Length.
#151433
NCBI PubMed Central
EXPO: Stable Reinforcement Learning with Expressive Policies
#183274
arXiv (OAI)
OPID: On-Policy Skill Distillation for Agentic Reinforcement Learning
#316296
Papers With Code
Reinforcement Learning for Chemical Ordering in Alloy Nanoparticles.
#360609
NCBI PubMed Central
d3rlpy: An Offline Deep Reinforcement Learning Library
#478114
CiNii
ChainerRL: A Deep Reinforcement Learning Library
#478164
CiNii
Agent Lightning: Train ANY AI Agents with Reinforcement Learning
#483535
Papers With Code
Le Critique: Privileged Value Functions for LLM Reinforcement Learning
#623025
arXiv (OAI Expanded)
Le Critique: Privileged Value Functions for LLM Reinforcement Learning
#625298
arXiv (All)
Intelligent Covert ISAC via RIS: A Reinforcement Learning Approach
#264731
DR-NTU (Digital Repository of NTU)
Reinforcement Learning-Based Self-Healing Mechanisms for Autonomous Cybersecurity Systems
#402300
HAL (France)
TTVS: Boosting Self-Exploring Reinforcement Learning via Test-time Variational Synthesis
#2589
arXiv CS
Hierarchical Reinforcement Learning with Runtime Safety Shielding for Power Grid Operation
#14015
arXiv CS
Task-specific Subnetwork Discovery in Reinforcement Learning for Autonomous Underwater Navigation
#126527
arXiv CS
TSN-Affinity: Similarity-Driven Parameter Reuse for Continual Offline Reinforcement Learning
#141470
arXiv CS
Augmented Lagrangian Multiplier Network for State-wise Safety in Reinforcement Learning
#151736
arXiv CS
Events as Triggers for Behavioral Diversity in Multi-Agent Reinforcement Learning
#178885
arXiv CS
CO-MAP: A Reinforcement Learning Approach to the Qubit Allocation Problem
#180681
arXiv CS
Global Convergence of Wasserstein Policy Gradient for Entropy-Regularized Reinforcement Learning
#224500
arXiv CS
RL2ML: Finite-Rollout Surrogate Objectives from Reinforcement Learning to Maximum Likelihood
#238630
arXiv CS
UBP2: Uncertainty-Balanced Preference Planning for Efficient Preference-based Reinforcement Learning
#287111
arXiv CS
Direct Advantage Estimation for Scalable and Sample-efficient Deep Reinforcement Learning
#290585
arXiv CS
A Model-Driven Approach for Developing Families of Reinforcement Learning Environments
#290597
arXiv CS
Hierarchical Reinforcement Learning for Neural Network Compression (HiReLC): Pruning and Quantization
#307009
arXiv CS
Memory-Efficient Policy Libraries with Low-Rank Adaptation in Reinforcement Learning
#307039
arXiv CS
State Representation Matters in Deep Reinforcement Learning: Application to Energy Trading
#310835
arXiv CS
Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning
#361452
arXiv CS
Constraint-Aware Aggregation for Federated Reinforcement Learning in Microgrid Energy Coordination
#366259
arXiv CS
WorldCycle: Self-Verifiable Reinforcement Learning for Long-Horizon Video World Models
#429369
arXiv CS
SpecRoll: Fast-Slow Verifier-Feedback Adaptation for Speculative Reinforcement Learning Rollouts
#429370
arXiv CS
Designing Reinforcement Learning for Diffusion Models: A Unified Path-Space View
#458271
arXiv CS
Multi-Agent Off-Policy Deep Reinforcement Learning for Smart Campus Coverage
#467125
arXiv CS
NashDreamer: Model-Based Reinforcement Learning for Zero-Sum Imperfect-Information Games
#627679
arXiv CS
Expert Behavior Prior Reinforcement Learning
#664374
arXiv (OAI Expanded)
Expert Behavior Prior Reinforcement Learning
#665874
arXiv (All)
Optimal Control of Unknown Nonlinear Systems via a Multimodel-Based Multistep Reinforcement Learning Framework
#173975
Digital Commons @ Michigan Tech
Reinforcement Learning-Based Joint Reliability and Performance Optimization for Hybrid-Cache Computing Servers
#448962
Infoscience
Plasticity Loss in Deep Reinforcement Learning: A Survey
#153007
arXiv (OAI)
GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment
#209746
Papers With Code
Learning Coordinated Preference for Multi-Objective Multi-Agent Reinforcement Learning
#271868
arXiv CS
FlowAWR: Online Adaptive Flow Reinforcement via Advantage-Weighted Rectification
#321856
arXiv CS
SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning
#379037
Papers With Code
Toward Efficient Program Synthesis for Intelligent Systems
#397000
RUcore, Rutgers University Community Repository
A Modular Approach to Multi-agent Reinforcement Learning
#478175
CiNii
A Modular Approach to Multi-agent Reinforcement Learning
#478176
CiNii
A Modular Approach to Multi-agent reinforcement Learning
#478182
CiNii
← Previous
Page 4 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.