Conceptio
›
computer-vision-and-pattern-recognition
Topic
computer-vision-and-pattern-recognition
Knowledge-graph topic
· documents ABOUT computer-vision-and-pattern-recognition across the archive
4,969
Documents about computer-vision-and-pattern-recognition
Documents about computer-vision-and-pattern-recognition
A Versatile Foundation Model for AI-enabled Mammogram Interpretation
#609819
arXiv (All)
RMR-P: Road Metadata-Aware Restoration for Pavement Inspection
#610034
arXiv (All)
Perspective-Invariant Attack with Enhanced Transferability of Adversarial Examples
#611065
arXiv (OAI Expanded)
PersonaDrive: Controllable Trajectory Prediction with Multi-Dimensional Driving Personas
#611173
arXiv (OAI Expanded)
HTTM: Head-wise Temporal Token Merging for Faster VGGT
#611406
arXiv (OAI Expanded)
Perspective-Invariant Attack with Enhanced Transferability of Adversarial Examples
#612542
arXiv (All)
PersonaDrive: Controllable Trajectory Prediction with Multi-Dimensional Driving Personas
#612650
arXiv (All)
HTTM: Head-wise Temporal Token Merging for Faster VGGT
#612883
arXiv (All)
Feed-Forward Hierarchical Gaussian Diffusion for Extreme CT Reconstruction
#614346
arXiv (OAI Expanded)
Feed-Forward Hierarchical Gaussian Diffusion for Extreme CT Reconstruction
#615313
arXiv (All)
BASeg: Boundary-Aware Remote Sensing Segmentation with Structural Penalties
#616328
arXiv (OAI Expanded)
From Generation to Matching: A Development Report on Personalized Chinese Handwriting
#616448
arXiv (OAI Expanded)
Geometry of Forgetting: Representation Flux in Continual Learning
#616486
arXiv (OAI Expanded)
BASeg: Boundary-Aware Remote Sensing Segmentation with Structural Penalties
#616828
arXiv (All)
From Generation to Matching: A Development Report on Personalized Chinese Handwriting
#616948
arXiv (All)
Geometry of Forgetting: Representation Flux in Continual Learning
#616986
arXiv (All)
Detector-Augmented SAMURAI for Long-Duration Drone Tracking
#617430
arXiv (OAI Expanded)
ExpertEdit: Learning Skill-Aware Motion Editing from Expert Videos
#617524
arXiv (OAI Expanded)
VisDom: Sparse Novel View Synthesis with Visible Domain Constraint
#617620
arXiv (OAI Expanded)
Detector-Augmented SAMURAI for Long-Duration Drone Tracking
#617930
arXiv (All)
ExpertEdit: Learning Skill-Aware Motion Editing from Expert Videos
#618024
arXiv (All)
VisDom: Sparse Novel View Synthesis with Visible Domain Constraint
#618120
arXiv (All)
Joint Flow Matching Enables Continuous Dose-Conditioned Cell Morphing
#619137
arXiv (OAI Expanded)
Joint Flow Matching Enables Continuous Dose-Conditioned Cell Morphing
#620816
arXiv (All)
SQuad: Sub-Quadratic Attention Distillation for Efficient Video Generation
#622889
arXiv (OAI Expanded)
Interactive Whole Slide Images for RL-based Tumour Segmentation
#622909
arXiv (OAI Expanded)
GenRouter: Unified Workflow Routing for Agentic Image Generation
#623009
arXiv (OAI Expanded)
Revisiting Classifier-Free Guidance Methods in Latent Diffusion Models
#623069
arXiv (OAI Expanded)
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
#128337
arXiv (OAI)
Benchmarking Large Vision-Language Models on Fine-Grained Image Tasks: A Comprehensive Evaluation
#139152
arXiv (OAI)
ForceU-VLA: A Force-Aware Vision-Language-Action Model for Embodied Ultrasound Scanning
#610966
arXiv (OAI Expanded)
Do Visual Grounding Decoders Need Feed-Forward Networks? A Controlled Study over Frozen Vision-Language Features
#611014
arXiv (OAI Expanded)
ForceU-VLA: A Force-Aware Vision-Language-Action Model for Embodied Ultrasound Scanning
#612443
arXiv (All)
Do Visual Grounding Decoders Need Feed-Forward Networks? A Controlled Study over Frozen Vision-Language Features
#612491
arXiv (All)
Don't Look at the Camera: Achieving Perceived Eye Contact
#179061
arXiv (OAI)
Don't Look at the Camera: Achieving Perceived Eye Contact
#179259
arXiv (OAI Expanded)
Don't Look at the Camera: Achieving Perceived Eye Contact
#179654
arXiv
Don't Look at the Camera: Achieving Perceived Eye Contact
#180516
arXiv Biology
Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
#173254
arXiv (OAI)
GuideDog: A Real-World Egocentric Multimodal Dataset for Blind and Low-Vision Accessibility-Aware Guidance
#183216
arXiv (OAI)
Vision-Language Models Mistake Head Orientation for Gaze Direction: Nonverbal Conversation Cues
#183256
arXiv (OAI)
RISE: Roadside Infrastructure Sequence Understanding across 3D Tracking and Structured Vision-Language Reasoning
#622796
arXiv (OAI Expanded)
Embedding Non-Distortive Cancelable Face Template Generation
#131212
arXiv (OAI)
KiseKloset for Fashion Retrieval and Recommendation
#139199
arXiv (OAI)
Image Score: Learning and Evaluating Human Preferences for Mercari Search
#189205
arXiv (OAI)
Open Vocabulary Panoptic Segmentation With Retrieval Augmentation
#609861
arXiv (All)
Underwater Color Restoration with Vanishing Uncertainty
#616251
arXiv (OAI Expanded)
Automated Fetal Brain MRI Biometry in Healthy and Pathological Cases
#616337
arXiv (OAI Expanded)
Underwater Color Restoration with Vanishing Uncertainty
#616751
arXiv (All)
Automated Fetal Brain MRI Biometry in Healthy and Pathological Cases
#616837
arXiv (All)
← Previous
Page 4 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.