Conceptio
›
software-testing
Topic
software-testing
Knowledge-graph topic
· documents ABOUT software-testing across the archive
17
Documents about software-testing
Documents about software-testing
Designing Adaptive Digital Nudging Systems with LLM-Driven Reasoning
#10422
arXiv CS
Ambiguity Detection and Elimination in Automated Executable Process Modeling
#10427
arXiv CS
From Helpful to Trustworthy: LLM Agents for Pair Programming
#10449
arXiv CS
Log-based vs Graph-based Approaches to Fault Diagnosis
#14085
arXiv CS
Learned or Memorized ? Quantifying Memorization Advantage in Code LLMs
#14086
arXiv CS
Figma2Code: Automating Multimodal Design to Code in the Wild
#14093
arXiv CS
HintPilot: LLM-based Compiler Hint Synthesis for Code Optimization
#19073
arXiv CS
GraphQLify: Automated and Type Safety-Preserving GraphQL API Adoption
#31346
arXiv CS
Proxics: an efficient programming model for far memory accelerators
#120579
arXiv CS
Agentic Education: Using Claude Code to Teach Claude Code
#120599
arXiv CS
Precise Debugging Benchmark: Is Your Model Debugging or Regenerating?
#120602
arXiv CS
DeepParse: Hybrid Log Parsing with LLM-Synthesized Regex Masks
#124114
arXiv CS
Hallucination Inspector: A Fact-Checking Judge for API Migration
#124119
arXiv CS
Absorber LLM: Harnessing Causal Synchronization for Test-Time Training
#126600
arXiv CS
Measuring the Unmeasurable: Markov Chain Reliability for LLM Agents
#138989
arXiv CS
Diffusion Templates: A Unified Plugin Framework for Controllable Diffusion
#138995
arXiv CS
Vulnerability Identification by Harnessing Inter-connected Multi-Source Information
#139002
arXiv CS
Constraint-Guided Multi-Agent Decompilation for Executable Binary Recovery
#139003
arXiv CS
Deep Graph-Language Fusion for Structure-Aware Code Generation
#155362
arXiv CS
Multi-Agent Systems for Root Cause Analysis in Microservices
#155366
arXiv CS
ARGUS: Defending LLM Agents Against Context-Aware Prompt Injection
#155368
arXiv CS
POSTCONDBENCH: Benchmarking Correctness and Completeness in Formal Postcondition Inference
#155369
arXiv CS
Kerncap: Automated Kernel Extraction and Isolation for AMD GPUs
#155374
arXiv CS
Lightweight Vulnerability Detection from Code Metrics and Token Features
#168416
arXiv CS
Separation Logic for Verifying Physical Collisions of CNC Programs
#175322
arXiv CS
Formal Verification of Imperative First-Class Functions in Move
#175328
arXiv CS
Trajectory Supervision for Continual Tool-Use Learning in LLMs
#175333
arXiv CS
Evaluating LLM-Generated Code: A Benchmark and Developer Study
#175345
arXiv CS
Semantic Voting: Execution-Grounded Consensus for LLM Code Generation
#175351
arXiv CS
Read, Extract, Classify: A Tool for Smarter Requirements Engineering
#178952
arXiv CS
Agentic AI in Industry: Adoption Level and Deployment Barriers
#187372
arXiv CS
Documentation-Guided Agentic Codebase Migration from C to Rust
#187373
arXiv CS
In-IDE Toolkit for Developers of AI-Based Features
#187374
arXiv CS
MemRepair: Hierarchical Memory for Agentic Repository-Level Vulnerability Repair
#200563
arXiv CS
Task Abstention for Large Language Models in Code Generation
#200576
arXiv CS
CriterAlign: Criterion-Centric Rationale Alignment for Code Preference Judging
#204844
arXiv CS
DRReduce: Enhancing Syntax-Guided Program Reduction with Dependency Reconstruction
#204850
arXiv CS
On-the-Fly Input Adaptation for Reliable Code Intelligence
#204852
arXiv CS
MOCHA: Multi-Objective Chebyshev Annealing for Agent Skill Optimization
#204853
arXiv CS
Prompt Optimization for LLM Code Generation via Reinforcement Learning
#204858
arXiv CS
VeriScale: Adversarial Test-Suite Scaling for Verifiable Code Generation
#216886
arXiv CS
SpecBench: Measuring Reward Hacking in Long-Horizon Coding Agents
#216902
arXiv CS
RSE of a Quantum Transport Code and its Effects
#216905
arXiv CS
Verus-SpecGym: An Agentic Environment for Evaluating Specification Autoformalization
#229570
arXiv CS
PR-Aware Automated Unit Test Generation: Challenges and Opportunities
#229587
arXiv CS
Converted, Not Equivalent: Benchmarking Codebase Conversion via Observational Equivalence
#241571
arXiv CS
A Minimal Executable Proof for Multi-Language Contract Traceability
#241573
arXiv CS
Towards Demystifying and Repairing LLM-in-the-Loop Vulnerabilities
#241581
arXiv CS
SWE-InfraBench: Evaluating Language Models on Cloud Infrastructure Code
#259561
arXiv CS
Latent Anchor-Driven Test Generation for Deep Neural Networks
#259574
arXiv CS
← Previous
Page 7 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.