Conceptio
›
computer-vision-and-pattern-recognition
Topic
computer-vision-and-pattern-recognition
Knowledge-graph topic
· documents ABOUT computer-vision-and-pattern-recognition across the archive
4,969
Documents about computer-vision-and-pattern-recognition
Documents about computer-vision-and-pattern-recognition
ReGATE: Learning Faster and Better with Fewer Tokens in MLLMs
#179208
arXiv (OAI)
Growing a Multi-head Twig via Distillation and Reinforcement Learning to Accelerate Large Vision-Language Models
#131299
arXiv (OAI)
COMODO: Cross-Modal Video-to-IMU Distillation for Efficient Egocentric Human Activity Recognition
#155544
arXiv (OAI)
A Vision Transformer for ECG-Based Detection of Left Ventricular Systolic Dysfunction Across Multiple Clinical Sites
#609156
arXiv (OAI Expanded)
Evidence of Absence: Cross-Modal Abductive Risk Perception to Sustain World Models When Vision Fails
#610914
arXiv (OAI Expanded)
Evidence of Absence: Cross-Modal Abductive Risk Perception to Sustain World Models When Vision Fails
#612391
arXiv (All)
DC-TTA: Divide-and-Conquer Framework for Test-Time Adaptation of Interactive Segmentation
#141772
arXiv (OAI)
Synthetic Data Augmentation for Enhanced Chicken Carcass Instance Segmentation
#144331
arXiv (OAI)
CSNR and JMIM Based Spectral Band Selection for Reducing Metamerism in Urban Driving
#147148
arXiv (OAI)
Data Leakage Detection and De-duplication in Large Scale Geospatial Image Datasets
#155451
arXiv (OAI)
PSI: A Benchmark for Human Interpretation and Response in Traffic Interactions
#163002
arXiv (OAI)
PSI: A Benchmark for Human Interpretation and Response in Traffic Interactions
#163961
arXiv (OAI Expanded)
SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning
#177071
arXiv (OAI)
FA-Seg: A Fast and Accurate Diffusion-Based Method for Open-Vocabulary Segmentation
#179192
arXiv (OAI)
Adapting Large VLMs with Iterative and Manual Instructions for Generative Low-light Enhancement
#189308
arXiv (OAI)
Local Gains and Fixed-Assignment Set Losses in Shared Set Decoders
#609150
arXiv (OAI Expanded)
Frequency and Edge-Guided Segment Anything Model for Remote Sensing Image Semantic Segmentation
#611007
arXiv (OAI Expanded)
MEDR: Query-Independent Frame Selection via Multi-Signal Event Modeling and Dynamic Rescoring
#611011
arXiv (OAI Expanded)
ProjFormer: Point Cloud Completion via Geometric-Projective Transformer and Cross-Modal Semantic Constraints
#611054
arXiv (OAI Expanded)
Prompt Engineering in Segment Anything Model: Methodologies, Applications, and Emerging Challenges
#611333
arXiv (OAI Expanded)
Frequency and Edge-Guided Segment Anything Model for Remote Sensing Image Semantic Segmentation
#612484
arXiv (All)
MEDR: Query-Independent Frame Selection via Multi-Signal Event Modeling and Dynamic Rescoring
#612488
arXiv (All)
ProjFormer: Point Cloud Completion via Geometric-Projective Transformer and Cross-Modal Semantic Constraints
#612531
arXiv (All)
Prompt Engineering in Segment Anything Model: Methodologies, Applications, and Emerging Challenges
#612810
arXiv (All)
Tropical Cyclone Forecasting via Latent Rectified Flow using Satellite Imagery and Atmospheric Fields
#614191
arXiv (OAI Expanded)
Tropical Cyclone Forecasting via Latent Rectified Flow using Satellite Imagery and Atmospheric Fields
#615158
arXiv (All)
A Plug-and-Play 2D Motion Interface for Real-World Motion Language Models
#617160
arXiv (OAI Expanded)
A Plug-and-Play 2D Motion Interface for Real-World Motion Language Models
#617660
arXiv (All)
KeyID: Decoupled Drafting and Keyframe Editing for Identity-Preserving Video Generation
#618887
arXiv (OAI Expanded)
KeyID: Decoupled Drafting and Keyframe Editing for Identity-Preserving Video Generation
#620566
arXiv (All)
Handoff-H1: An Orchestrated Vision-Agent System for Material Quantity Takeoff from Construction Blueprints
#610986
arXiv (OAI Expanded)
Handoff-H1: An Orchestrated Vision-Agent System for Material Quantity Takeoff from Construction Blueprints
#612463
arXiv (All)
A Survey of Body and Face Motion: Datasets, Performance Evaluation Metrics and Generative Techniques
#613914
arXiv (OAI Expanded)
A Survey of Body and Face Motion: Datasets, Performance Evaluation Metrics and Generative Techniques
#614881
arXiv (All)
MsEdF: A Multi-stream Encoder-decoder Framework for Remote Sensing Image Captioning
#183199
arXiv (OAI)
Improving Image Coding for Machines through Optimizing Encoder via Auxiliary Loss
#128274
arXiv (OAI)
DMin: Scalable Training Data Influence Estimation for Diffusion Models
#128331
arXiv (OAI)
Physically Plausible Human-Object Rendering from Sparse Views via 3D Gaussian Splatting
#128354
arXiv (OAI)
Estimating the Diameter at Breast Height of Trees in a Forest from RGB
#147083
arXiv (OAI)
Assessing the Generalizability of Deep Neural Networks-Based Models for Black Skin Lesions
#152974
arXiv (OAI)
On the Generalizability of Foundation Models for Crop Type Mapping
#155503
arXiv (OAI)
Learn2Synth: Learning Optimal Data Synthesis Using Hypergradients for Brain Image Segmentation
#158649
arXiv (OAI)
OnSiteVRU: A High-Resolution Trajectory Dataset for High-Density Vulnerable Road Users
#179139
arXiv (OAI)
TranSplat: Instant Object Relighting in Gaussian Splatting via Spherical Harmonic Radiance Transfer
#183224
arXiv (OAI)
APCoTTA: Continual Test-Time Adaptation for Semantic Segmentation of Airborne LiDAR Point Clouds
#189265
arXiv (OAI)
MAD-HOI: Masked Autoregressive Diffusion for Generating Articulated Hand Object Interactions from Text
#608974
arXiv (OAI Expanded)
LUNG-KGMM: Knowledge-Guided Multimodal Learning for Lung Cancer Incidence Prediction
#609094
arXiv (OAI Expanded)
Equilibrium Forcing: Adaptive Video Generation Without Noise Conditioning
#609139
arXiv (OAI Expanded)
PolyComp: A Polycube-based Benchmark for Compositional 3D Spatial Reasoning in Multimodal Models
#609172
arXiv (OAI Expanded)
Designing Reinforcement Learning for Diffusion Models: A Unified Path-Space View
#609600
arXiv (All)
← Previous
Page 10 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.