Conceptio
›
computer-vision-and-pattern-recognition
Topic
computer-vision-and-pattern-recognition
Knowledge-graph topic
· documents ABOUT computer-vision-and-pattern-recognition across the archive
4,969
Documents about computer-vision-and-pattern-recognition
Documents about computer-vision-and-pattern-recognition
LightLoc++: Sensor-Robust Representation Learning for Efficient Outdoor LiDAR Localization
#615289
arXiv (All)
ArtLang: Structured Language-to-Kinematics Grounding for Articulated 3D Actuation
#616087
arXiv (OAI Expanded)
Spatially-Grounded Flow Matching: Structured Source Distributions for Image Generation
#616118
arXiv (OAI Expanded)
Gaussian-JEPA: Joint-Embedding Predictive Learning for 3D Gaussian Splats
#616301
arXiv (OAI Expanded)
PixelControl: Fine-Grained Condition Fidelity in Text-to-Image Diffusion
#616349
arXiv (OAI Expanded)
ES3D: Embedding Semantics into 3D Space for Component-Aware Editing
#616390
arXiv (OAI Expanded)
ArtLang: Structured Language-to-Kinematics Grounding for Articulated 3D Actuation
#616587
arXiv (All)
Spatially-Grounded Flow Matching: Structured Source Distributions for Image Generation
#616618
arXiv (All)
Gaussian-JEPA: Joint-Embedding Predictive Learning for 3D Gaussian Splats
#616801
arXiv (All)
PixelControl: Fine-Grained Condition Fidelity in Text-to-Image Diffusion
#616849
arXiv (All)
ES3D: Embedding Semantics into 3D Space for Component-Aware Editing
#616890
arXiv (All)
Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning
#617363
arXiv (OAI Expanded)
PickStyle: Video-to-Video Style Transfer with Context-Style Adapters
#617374
arXiv (OAI Expanded)
Focusing by Contrastive Attention: Enhancing VLMs' Visual Reasoning
#617863
arXiv (All)
PickStyle: Video-to-Video Style Transfer with Context-Style Adapters
#617874
arXiv (All)
Audio-Visual Segmentation via Depth-Guided Collaborative Modeling
#619009
arXiv (OAI Expanded)
Self-Routed Tensor Adapters for Parameter-Efficient Universal Visual Adaptation
#619102
arXiv (OAI Expanded)
Audio-Visual Segmentation via Depth-Guided Collaborative Modeling
#620688
arXiv (All)
Self-Routed Tensor Adapters for Parameter-Efficient Universal Visual Adaptation
#620781
arXiv (All)
AnchorScore: A CLIP-Based Diagnostic of MLLM Annotation Difficulty
#622980
arXiv (OAI Expanded)
VicEdit: Learning to Edit Videos from Visual In-Context Examples
#623031
arXiv (OAI Expanded)
Calibration-Free Vehicle Speed Estimation: A Monocular Keypoint-Template Approach
#623068
arXiv (OAI Expanded)
Revisiting CroPA: A Reproducibility Study and Enhancements for Cross-Prompt Adversarial Transferability in Vision-Language Models
#189293
arXiv (OAI)
Vision-Based Calorie Estimation for Bangladeshi Street Food: A Comparative Study of Detection and Regression Models
#611346
arXiv (OAI Expanded)
Vision-Based Calorie Estimation for Bangladeshi Street Food: A Comparative Study of Detection and Regression Models
#612823
arXiv (All)
jina-vlm: Small Multilingual Vision Language Model
#617406
arXiv (OAI Expanded)
jina-vlm: Small Multilingual Vision Language Model
#617906
arXiv (All)
Griffin: Aerial-Ground Cooperative Detection and Tracking Dataset and Benchmark
#131296
arXiv (OAI)
A Survey on 3D Gaussian Splatting Applications: Segmentation, Editing, and Generation
#139228
arXiv (OAI)
Data, Depth, and Design: Learning Reliable Models for Skin Lesion Analysis
#152942
arXiv (OAI)
Re:Verse -- Can Your VLM Read a Manga?
#158767
arXiv (OAI)
Uncertainty Quantification Framework for Aerial and UAV Photogrammetry through Error Propagation
#183280
arXiv (OAI)
DanceOPD: On-Policy Generative Field Distillation
#614110
arXiv (OAI Expanded)
DanceOPD: On-Policy Generative Field Distillation
#615077
arXiv (All)
The Limits of Binding in Dual Encoders
#617147
arXiv (OAI Expanded)
The Limits of Binding in Dual Encoders
#617647
arXiv (All)
TRACE-Bench: Decomposing and Diagnosing Multi-Reference Image Generation
#623049
arXiv (OAI Expanded)
V-MAGE: A Game Evaluation Framework for Assessing Vision-Centric Capabilities in Multimodal Large Language Models
#163115
arXiv (OAI)
DiffMI: Breaking Face Recognition Privacy via Diffusion-Driven Training-Free Model Inversion
#189259
arXiv (OAI)
RectifiedHR: Enable Efficient High-Resolution Synthesis via Energy Rectification
#128352
arXiv (OAI)
Hierarchical Feature Learning for Medical Point Clouds via State Space Model
#128370
arXiv (OAI)
Wildfire spread forecasting with Deep Learning
#128397
arXiv (OAI)
The Monado SLAM Dataset for Egocentric Visual-Inertial Tracking
#139221
arXiv (OAI)
CountLoop: Training-Free High-Instance Image Generation via Iterative Agent Guidance
#139231
arXiv (OAI)
FieldWorkArena: Agentic AI Benchmark for Real Field Work Tasks
#144300
arXiv (OAI)
Edge-preserving noise for diffusion models
#147022
arXiv (OAI)
VADv2: End-to-End Vectorized Autonomous Driving via Probabilistic Planning
#152982
arXiv (OAI)
MathFlow: Enhancing the Perceptual Flow of MLLMs for Visual Mathematical Problems
#153041
arXiv (OAI)
MSLAU-Net: A Hybrid CNN-Transformer Network for Medical Image Segmentation
#158720
arXiv (OAI)
Information Bottleneck-Guided Heterogeneous Graph Learning for Interpretable Neurodevelopmental Disorder Diagnosis
#160859
arXiv (OAI)
← Previous
Page 6 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.