Conceptio
›
computer-vision-and-pattern-recognition
Topic
computer-vision-and-pattern-recognition
Knowledge-graph topic
· documents ABOUT computer-vision-and-pattern-recognition across the archive
4,969
Documents about computer-vision-and-pattern-recognition
Documents about computer-vision-and-pattern-recognition
Nexus: Structured Synergy for Efficient Text-to-Image Generation using Rectified Flow Model
#618840
arXiv (OAI Expanded)
Unlocking Motion in Expressions: Temporal Calibration for Referring Video Object Segmentation
#619053
arXiv (OAI Expanded)
DriveCache: Action-Aware Caching for Driving World Model Inference
#619075
arXiv (OAI Expanded)
Nexus: Structured Synergy for Efficient Text-to-Image Generation using Rectified Flow Model
#620519
arXiv (All)
Unlocking Motion in Expressions: Temporal Calibration for Referring Video Object Segmentation
#620732
arXiv (All)
DriveCache: Action-Aware Caching for Driving World Model Inference
#620754
arXiv (All)
MLLM-Guided Semantic Correction for Text-to-Video Generation
#622825
arXiv (OAI Expanded)
Concept-based explanation of gene expression prediction from H&E images
#622959
arXiv (OAI Expanded)
PersonaShot: Benchmarking Person-Centric Narrative Continuity in Multi-Shot Video Generation
#623005
arXiv (OAI Expanded)
PixelCAM: Pixel Class Activation Mapping for Histology Image Classification and ROI Localization
#141719
arXiv (OAI)
LiveVLM: Efficient Online Video Understanding via Streaming-Oriented KV Cache and Retrieval
#160885
arXiv (OAI)
CryoSplat: Gaussian Splatting for Cryo-EM Homogeneous Reconstruction
#189318
arXiv (OAI)
Modality-Invariant Coarse-to-Fine Retinal Image Registration
#609251
arXiv (OAI Expanded)
Exclusivity-Guided Mask Learning for Semi-Supervised Crowd Instance Segmentation and Counting
#613988
arXiv (OAI Expanded)
Amnesia: A Stealthy Replay Attack on Continual Learning Dreams
#614089
arXiv (OAI Expanded)
StreamTTT: Reconciling Real-Time Perception and Long-Term Memory in Streaming VLMs
#614245
arXiv (OAI Expanded)
FMReward: Aligning and Evaluating Audio-Driven 3D Facial Animation with Human Preferences
#614303
arXiv (OAI Expanded)
Exclusivity-Guided Mask Learning for Semi-Supervised Crowd Instance Segmentation and Counting
#614955
arXiv (All)
Amnesia: A Stealthy Replay Attack on Continual Learning Dreams
#615056
arXiv (All)
StreamTTT: Reconciling Real-Time Perception and Long-Term Memory in Streaming VLMs
#615212
arXiv (All)
FMReward: Aligning and Evaluating Audio-Driven 3D Facial Animation with Human Preferences
#615270
arXiv (All)
FlowDance: Music-Driven Dance Video Generation with Parallel Pose and RGB Streams
#616454
arXiv (OAI Expanded)
SEER: Long-Context Reasoning via Selective Visual-Text Compression
#616574
arXiv (OAI Expanded)
FlowDance: Music-Driven Dance Video Generation with Parallel Pose and RGB Streams
#616954
arXiv (All)
SEER: Long-Context Reasoning via Selective Visual-Text Compression
#617074
arXiv (All)
Benchmarking Foundation and Large Language Models for Few-Shot Medical Image Segmentation
#618717
arXiv (OAI Expanded)
Benchmarking Foundation and Large Language Models for Few-Shot Medical Image Segmentation
#620396
arXiv (All)
Unlocking the Potential of Image Editing via Concept Scaling and Dense Supervision
#623090
arXiv (OAI Expanded)
Copula-enhanced Vision Transformer for high myopia diagnosis through OU UWF fundus images
#189235
arXiv (OAI)
Zero-Shot Adaptation of Medical Vision Foundation Models for High-Frequency Micro-Ultrasound Prostate Segmentation
#609220
arXiv (OAI Expanded)
CM-MAE: A Physics-Guided Cross-Modal Self-Supervised Learning Framework for Vision-Wireless Applications
#617148
arXiv (OAI Expanded)
CM-MAE: A Physics-Guided Cross-Modal Self-Supervised Learning Framework for Vision-Wireless Applications
#617648
arXiv (All)
Helios 2.0: A Robust, Ultra-Low Power Gesture Recognition System Optimised for Event-Sensor based Wearables
#609770
arXiv (All)
Steering the Flow: Inverting Face Recognition Models via Gradient-Guided Flow Matching
#623072
arXiv (OAI Expanded)
SA-GEM: Scale-Adaptive and Geospatial Evidence-Modulated Token Pruning for Efficient Remote Sensing Large Vision-Language Models
#611026
arXiv (OAI Expanded)
SA-GEM: Scale-Adaptive and Geospatial Evidence-Modulated Token Pruning for Efficient Remote Sensing Large Vision-Language Models
#612503
arXiv (All)
Pattern Recognition for Machine Vision
#66980
MIT OpenCourseWare
A Geometric Algorithm for Blood Vessel Reconstruction from Skeletal Representation
#128278
arXiv (OAI)
SVGFusion: A VAE-Diffusion Transformer for Vector Graphic Generation
#128332
arXiv (OAI)
Reason-SVG: Enhancing Structured Reasoning for Vector Graphics Generation with Reinforcement Learning
#128403
arXiv (OAI)
OmniPrism: Learning Disentangled Visual Concept for Image Generation
#131272
arXiv (OAI)
Sat2Sound: A Unified Framework for Zero-Shot Soundscape Mapping
#139168
arXiv (OAI)
CPAM: Context-Preserving Adaptive Manipulation for Zero-Shot Real Image Editing
#139190
arXiv (OAI)
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
#141746
arXiv (OAI)
Scalable Unseen Objects 6-DoF Absolute Pose Estimation with Robotic Integration
#149230
arXiv (OAI)
An Empirical Study of Validating Synthetic Data for Text-Based Person Retrieval
#149244
arXiv (OAI)
Exploring Mutual Cross-Modal Attention for Context-Aware Human Affordance Generation
#153029
arXiv (OAI)
EmbodiTTA: Resource-Efficient Test-Time Adaptation for Embodied Visual Systems
#153053
arXiv (OAI)
A VLM-based Method for Visual Anomaly Detection in Robotic Scientific Laboratories
#153081
arXiv (OAI)
Variational Visual Question Answering for Uncertainty-Aware Selective Prediction
#158713
arXiv (OAI)
← Previous
Page 8 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.