Conceptio
›
computer-vision-and-pattern-recognition
Topic
computer-vision-and-pattern-recognition
Knowledge-graph topic
· documents ABOUT computer-vision-and-pattern-recognition across the archive
4,969
Documents about computer-vision-and-pattern-recognition
Documents about computer-vision-and-pattern-recognition
Rodrigues Network for Learning Robot Actions
#158727
arXiv (OAI)
EMCompress: Video-LLMs with Endomorphic Multimodal Compression
#173352
arXiv (OAI)
Test-Time Distillation for Continual Model Adaptation
#183253
arXiv (OAI)
Color Conditional Generation with Sliced Wasserstein Guidance
#189248
arXiv (OAI)
PIEDet: Prototype-Driven Intrinsically Explainable Object Detection
#609914
arXiv (All)
Generation of Synthetic Fingerphotos with GANs
#610983
arXiv (OAI Expanded)
Generation of Synthetic Fingerphotos with GANs
#612460
arXiv (All)
Scalable Black-Box Model Attribution for Images
#616302
arXiv (OAI Expanded)
Scalable Black-Box Model Attribution for Images
#616802
arXiv (All)
Depth-Dominant Skeleton Detection for Natural Scenes
#619088
arXiv (OAI Expanded)
Depth-Dominant Skeleton Detection for Natural Scenes
#620767
arXiv (All)
Sterilizable Scene Graph Generation for Operating Rooms
#622787
arXiv (OAI Expanded)
Remote-Sensing City Layout Extraction with MLLM
#622799
arXiv (OAI Expanded)
Easy Ensemble: Simple Deep Ensemble Learning for Sensor-Based Human Activity Recognition
#172160
arXiv Biology
Easy Ensemble: Simple Deep Ensemble Learning for Sensor-Based Human Activity Recognition
#173176
arXiv (OAI)
Easy Ensemble: Simple Deep Ensemble Learning for Sensor-Based Human Activity Recognition
#173426
arXiv (OAI Expanded)
Easy Ensemble: Simple Deep Ensemble Learning for Sensor-Based Human Activity Recognition
#174004
arXiv
SCOUT: Semantic Concept Discovery for Open-Vocabulary Editing of face Recognition Templates
#618978
arXiv (OAI Expanded)
SCOUT: Semantic Concept Discovery for Open-Vocabulary Editing of face Recognition Templates
#620657
arXiv (All)
FLARE: Fully Integration of Vision-Language Representations for Deep Cross-Modal Understanding
#179145
arXiv (OAI)
Braided Vision Transformer for Stroke Detection in Multi-view Retinal Fundus Imaging
#609155
arXiv (OAI Expanded)
Imagining Recovery: Inference-Time Counterfactual Realignment for Vision-Language-Action Models
#609245
arXiv (OAI Expanded)
RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion
#611291
arXiv (OAI Expanded)
RedDiffuser: Auditing Multimodal Safety Failures in Vision-Language Models via Reinforced Diffusion
#612768
arXiv (All)
VFIG: Vectorizing Complex Figures in SVG with Vision-Language Models
#614000
arXiv (OAI Expanded)
VFIG: Vectorizing Complex Figures in SVG with Vision-Language Models
#614967
arXiv (All)
US-VLA: An Ultrasound Vision-Language-Action Model for Embodied Abdomina
#618814
arXiv (OAI Expanded)
Seeing Before Answering: Training-Free Visual Layer Profiling for Vision-Language Models
#618989
arXiv (OAI Expanded)
US-VLA: An Ultrasound Vision-Language-Action Model for Embodied Abdomina
#620493
arXiv (All)
Seeing Before Answering: Training-Free Visual Layer Profiling for Vision-Language Models
#620668
arXiv (All)
EventCrab: Harnessing Frame and Point Synergy for Event-based Action Recognition and Beyond
#149202
arXiv (OAI)
Real-Time Hand Gesture Recognition: Integrating Skeleton-Based Data Fusion and Multi-Stream CNN
#147010
arXiv (OAI)
A Camera-Native Talking-Head Video Dataset for Various Computer Vision Tasks
#617506
arXiv (OAI Expanded)
A Camera-Native Talking-Head Video Dataset for Various Computer Vision Tasks
#618006
arXiv (All)
Towards Real-Time and Adaptable LiDAR Scene Completion
#622804
arXiv (OAI Expanded)
Binarized High-Efficiency RAW Video Restoration and Beyond
#623042
arXiv (OAI Expanded)
How Well Does GPT-4o Understand Vision? Evaluating Multimodal Foundation Models on Standard Computer Vision Tasks
#189297
arXiv (OAI)
SignX: Continuous Sign Recognition in Compact Pose-Rich Latent Space
#149265
arXiv (OAI)
AlloEgo-VLM: Disambiguating Allocentric and Egocentric Reference Frames in Vision-Language Models
#616258
arXiv (OAI Expanded)
AlloEgo-VLM: Disambiguating Allocentric and Egocentric Reference Frames in Vision-Language Models
#616758
arXiv (All)
Distilling Specialized Orders for Visual Generation
#128374
arXiv (OAI)
Learning Parallax for Stereo Event-based Motion Deblurring
#139056
arXiv (OAI)
Non-Uniform Exposure Imaging via Neuromorphic Shutter Control
#139070
arXiv (OAI)
Interactive Interface For Semantic Segmentation Dataset Synthesis
#139198
arXiv (OAI)
PILOT: A Promptable Interleaved Layout-aware OCR Transformer
#149248
arXiv (OAI)
DyTact: Capturing Dynamic Contacts in Hand-Object Manipulation
#149288
arXiv (OAI)
GenHSI: Controllable Generation of Human-Scene Interaction Videos
#149301
arXiv (OAI)
SCASeg: Strip Cross-Attention for Efficient Semantic Segmentation
#160838
arXiv (OAI)
ReSim: Reliable World Simulation for Autonomous Driving
#177075
arXiv (OAI)
StreamAgent: Towards Anticipatory Agents for Streaming Video Understanding
#179211
arXiv (OAI)
← Previous
Page 2 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.