🔥
热榜聚合
· arXiv 视觉
← 返回首页
arXiv 视觉实时榜单
更新于 09-15 09:43
共 30 条
收录至热榜聚合 · 全网 30+ 平台
1
Feature Recovery for Object Understanding After Irreversible Fire Damage
不可逆火灾损伤后物体理解的特征恢复
2
Does Video Memory Use What It Retrieves? A Causal Audit of Memory Specificity
视频记忆是否使用了它所检索的内容?记忆特异性的因果审计
3
Beyond Argmax: A Mechanistic Study of Semantic Retention in Frozen Foundation-Model Composition for Generalized Few-Shot 3D Segmentation
超越Argmax:冻结基础模型组合中语义保留的机制研究及其在广义少样本3D分割中的应用
4
HSI-Road Relabeled: Surface-Aware Road-Scene Segmentation
HSI-Road重标注:表面感知的道路场景分割
5
Single-Query Person-Centric Bimanual Hand-Object Interaction Detection
单查询以人为中心的双手工物体交互检测
6
USPLIT-VQA: U-Shaped Split Learning for Visual Question Answering with Contribution-Aware Weighted Aggregation
USPLIT-VQA:面向视觉问答的U型拆分学习与贡献感知加权聚合
7
When Ground-Truth Fidelity Matters: An Orchestrated UAS Framework for Wheat Streak Mosaic Virus Detection Using Vision Transformers and Machine Learning
当地面真值保真度至关重要时:基于视觉Transformer与机器学习的小麦条纹花叶病毒检测协同UAS框架
8
Physics as the label for measuring and correcting materials reasoning in multimodal models
以物理为标签:测量与校正多模态模型中的材料推理
9
QuPAINT: Physics-Aware Multimodal Reasoning for Quantum Material Characterization
QuPAINT:面向量子材料表征的物理感知多模态推理
10
Revisiting Multi-Object Tracking Baselines: Hyperparameter Optimization with Multi-Fidelity Greedy Coordinate Search
重新审视多目标跟踪基线:多保真度贪心坐标搜索的超参数优化
11
UniMo: Unifying Human and Animal Motion Generation
UniMo:统一人类与动物动作生成
12
VS-Splat: Voxel-Selective feed-forward Gaussian Splatting for end-to-end 3D object reconstruction from sparse-views
VS-Splat:面向稀疏视角端到端3D物体重建的体素选择前馈高斯泼溅
13
EgoMaize: A First-Person Maize Instance Segmentation Benchmark under Severe Field Occlusion
EgoMaize:严重田间遮挡下的第一人称玉米实例分割基准
14
Context-Aware Causal Gaze Forecasting for Human-Vehicle Interaction During In-Cabin Tracking Dropouts
车内跟踪中断期间人车交互的上下文感知因果注视预测
15
UFO: Chain-of-Evaluation for Omni-Condition Alignment in Multi-Modal Image Generation
UFO:多模态图像生成中全条件对齐的评估链
16
GSO-Net: Visual State Machines for Hazardous Freight Transfer Compliance at Petrochemical Logistics Nodes
GSO-Net:石化物流节点危险货运转运合规的视觉状态机
17
OphBiWSSD: Scaling Temporal Action Localization in Ophthalmic Surgeries with Bidirectional Weight-tied State Space Duality
OphBiWSSD:以双向权重绑定状态空间对偶扩展眼科手术中的时序动作定位
18
A Multimodal Explainable Deep Learning Framework for Alzheimer's Disease Diagnosis using 3D Magnetic Resonance Imaging and Clinical Data
基于3D磁共振成像与临床数据的阿尔茨海默病诊断多模态可解释深度学习框架
19
DERA: Detached Edge-Residual Adaptation for Prohibited item Detection
DERA:面向违禁品检测的解耦边缘残差自适应
20
Spectral Consistency-Guided Multiview Point Cloud Registration for Low-Overlap Scenes
光谱一致性引导的低重叠场景多视角点云配准
21
An End-to-End Automated Pipeline for Controllable Crack Data Synthesis
面向可控裂缝数据合成的端到端自动化流水线
22
Bridging Vision Foundation Model Priors with CLIP for Spatial-aware Few-shot Anomaly Detection in Medical Images
融合视觉基础模型先验与CLIP实现医学图像空间感知小样本异常检测
23
Partition-Invariant Tuning for 3D Scene Understanding
面向3D场景理解的划分不变调优
24
PhysioAI: Clinical Knowledge-Guided Semantic Supervision for Skeleton-Based Physiotherapy Action Recognition
PhysioAI:临床知识引导的语义监督用于基于骨架的物理治疗动作识别
25
RoES: Rotational Equivariant Selective-frequency Fusion for Multimodal Images
RoES:面向多模态图像的旋转等变选择性频率融合
26
LettuceVisSim: A Simulator That Generates Lettuce Image Time-series for Vision-Based Reinforcement Learning
27
ChitraMiti: Benchmarking Visual Grounding and Modality Reliance in Bengali Geometric Reasoning
28
One Skill Does Not Fit All: Automatic Discovery and Taxonomy-Guided Routing of Frame-Selection Skills for Long-Video Question Answering
29
Aligned Radiometric RGB-Thermal Fusion for UAV Facade Anomaly Screening
30
Earth-Agent-Pro: Towards Real-World Full-Chain Earth Observation with Agents
← 返回热榜聚合首页
· 数据每日更新 · 热榜聚合 500+ 平台
已经到我的底线了