Conceptio
›
computer-vision-and-pattern-recognition
Topic
computer-vision-and-pattern-recognition
Knowledge-graph topic
· documents ABOUT computer-vision-and-pattern-recognition across the archive
4,969
Documents about computer-vision-and-pattern-recognition
Documents about computer-vision-and-pattern-recognition
Geometrically Constrained and Token-Based Probabilistic Spatial Transformers
#617368
arXiv (OAI Expanded)
Geometrically Constrained and Token-Based Probabilistic Spatial Transformers
#617868
arXiv (All)
EyeTheia: A Lightweight and Accessible Eye-Tracking Toolbox
#431859
Springer Nature OA
BAH Dataset for Ambivalence/Hesitancy Recognition in Videos for Digital Behavioural Change
#141747
arXiv (OAI)
Zero-MELO: Test-Time Evidence Calibration with Multimodal LLMs for Zero-Shot Micro-Gesture Recognition
#609275
arXiv (OAI Expanded)
DirMixE: Harnessing Test Agnostic Long-tail Recognition with Hierarchical Label Variations
#617252
arXiv (OAI Expanded)
DirMixE: Harnessing Test Agnostic Long-tail Recognition with Hierarchical Label Variations
#617752
arXiv (All)
LOOPE: Learnable Optimal Patch Order in Positional Embeddings for Vision Transformers
#139151
arXiv (OAI)
Advances in Compliance Detection: Novel Models Using Vision-Based Tactile Sensors
#177081
arXiv (OAI)
SpIn-ViT: Designing a Sparsity-Induced Vision Transformer That Is Mechanistically Interpretable
#609337
arXiv (OAI Expanded)
UC-VLM: Consistency-Driven Learning for AI-Generated Image Detection with Vision-Language Large Models
#611180
arXiv (OAI Expanded)
UC-VLM: Consistency-Driven Learning for AI-Generated Image Detection with Vision-Language Large Models
#612657
arXiv (All)
NumerosityVLM: A Cognitively Inspired Benchmark for Interpreting Numerosity Representations in Vision-Language Models
#616092
arXiv (OAI Expanded)
NumerosityVLM: A Cognitively Inspired Benchmark for Interpreting Numerosity Representations in Vision-Language Models
#616592
arXiv (All)
A Survey on 3D Gaussian Splatting
#128272
arXiv (OAI)
ChangeBridge: Spatiotemporal Image Generation with Multimodal Controls for Remote Sensing
#128431
arXiv (OAI)
Listener-Rewarded Thinking in VLMs for Image Preferences
#131348
arXiv (OAI)
SpotFormer: Multi-Scale Spatio-Temporal Transformer for Facial Expression Spotting
#139082
arXiv (OAI)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
#139134
arXiv (OAI)
PrefPaint: Enhancing Medical Image Inpainting through Expert Human Feedback
#139193
arXiv (OAI)
SIRI-Bench: Challenging VLMs' Spatial Intelligence through Complex Reasoning Tasks
#141762
arXiv (OAI)
FADPNet: Frequency-Aware Dual-Path Network for Face Super-Resolution
#147112
arXiv (OAI)
Combating the Elsagate phenomenon: Deep learning architectures for disturbing cartoons
#152944
arXiv (OAI)
AlignedCut: Visual Concepts Discovery on Brain-Guided Universal Feature Space
#155489
arXiv (OAI)
FCVSR: A Frequency-aware Method for Compressed Video Super-Resolution
#158665
arXiv (OAI)
SynSpill: Improved Industrial Spill Detection With Synthetic Data
#158770
arXiv (OAI)
Beyond the Frame: Generating 360 Panoramic Videos from Perspective Videos
#160870
arXiv (OAI)
Efficient Multi-Source Knowledge Transfer by Model Merging
#160940
arXiv (OAI)
FOCUS: Fused Observation of Channels for Unveiling Spectra
#173329
arXiv (OAI)
Real-time Global Illumination for Dynamic 3D Gaussian Scenes
#179134
arXiv (OAI)
RetroMotion: Retrocausal Motion Forecasting Models are Instructable
#179171
arXiv (OAI)
GhostPoint: Self-Supervised Representation Learning by Hallucinating Occluded LiDAR Structure
#609598
arXiv (All)
Marionette: Predicting World States, Rendering Geometry, Painting Appearance
#609686
arXiv (All)
Benchmarking Frontier Text-to-Image Models on Image-Description Prompts
#610936
arXiv (OAI Expanded)
HOIMask: Towards Generative Masked Modeling for Human Object Interaction Generation
#611090
arXiv (OAI Expanded)
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
#611276
arXiv (OAI Expanded)
World-in-World: World Models in a Closed-Loop World
#611380
arXiv (OAI Expanded)
Benchmarking Frontier Text-to-Image Models on Image-Description Prompts
#612413
arXiv (All)
HOIMask: Towards Generative Masked Modeling for Human Object Interaction Generation
#612567
arXiv (All)
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
#612753
arXiv (All)
World-in-World: World Models in a Closed-Loop World
#612857
arXiv (All)
Boundary-Aligned Contribution Routing for Robust Optical--SAR Object Detection
#614272
arXiv (OAI Expanded)
On the Adversarial Robustness of Remote Sensing Semantic Change Detection
#614277
arXiv (OAI Expanded)
Geometry-Aware Spatio-Temporal Context Modeling for 4D Occupancy Forecasting
#614287
arXiv (OAI Expanded)
SOS! : A Streamlined Object-Conditional Transformer for Model-free Segmentation
#614302
arXiv (OAI Expanded)
LightLoc++: Sensor-Robust Representation Learning for Efficient Outdoor LiDAR Localization
#614322
arXiv (OAI Expanded)
Boundary-Aligned Contribution Routing for Robust Optical--SAR Object Detection
#615239
arXiv (All)
On the Adversarial Robustness of Remote Sensing Semantic Change Detection
#615244
arXiv (All)
Geometry-Aware Spatio-Temporal Context Modeling for 4D Occupancy Forecasting
#615254
arXiv (All)
SOS! : A Streamlined Object-Conditional Transformer for Model-free Segmentation
#615269
arXiv (All)
← Previous
Page 5 of 20
Next →
Topic record
· derived from the Conceptio knowledge graph (shared subject terms across the corpus)
Conceptio Open Knowledge Archive — topic hubs link to canonical document pages with full provenance.