| 1 |
An Evaluation of Decentralized Group Formation Techniques for Flying Light Specks
Hamed Alimohammadzadeh, Heather Culbertson, Shahram Ghandeharizadeh
|
|
cs.MM
|
0 |
2 months ago |
| 2 |
CARA: Concept-Aware Risk Attention for Interpretable Collision Anticipation
Zhishan Tao, Ruoyu Wang, ... (+7 more)
|
|
cs.MM
|
0 |
1 month ago |
| 3 |
Unsupervised Multimodal Intent Discovery via MLLM-Guided Concept Generation and Semantic Propagation
Yunjin Gu, Qianrui Zhou, Hua Xu
|
|
cs.MM
|
0 |
1 month ago |
| 4 |
Decoupling Cross-Modality Manifold Discrepancy: Leveraging Visible Diffusion Priors for Infrared Super-Resolution
Yunpeng Hua, Hongwei Yu, ... (+4 more)
|
|
cs.CV
|
0 |
1 month ago |
| 5 |
HalluScope: Fine-grained Hallucination Diagnosis for Multimodal Large Language Models
Weilin Jin, Mingyu Wang, ... (+6 more)
|
|
cs.CV
|
0 |
1 month ago |
| 6 |
Visual Token Compression Enhances Robustness of MLLMs
Shishen Gu, Jiequan Cui, ... (+4 more)
|
|
cs.CV
|
0 |
1 month ago |
| 7 |
Open-Vocabulary Gaze Object Prediction: Benchmark and Method
Binglu Wang, Sensen Niu, ... (+2 more)
|
|
cs.CV
|
0 |
1 month ago |
| 8 |
Same Semantics, Different Paths: Self-Improving Alignment for Vision-Text Compression
Tianyu Liang, Xiangxi Zheng, ... (+2 more)
|
|
cs.CV
|
0 |
1 month ago |
| 9 |
DynActiveGS: Active Gaussian Splatting for Dynamic Scene Reconstruction
Hongbo Duan, Pengting Luo, ... (+4 more)
|
|
cs.CV
|
0 |
1 month ago |
| 10 |
Hybrid-Domain Posterior Sampling for Inverse Problems via Latent Flow Matching
Hongjie Wu, Yiping Xie, Jiancheng Lv
|
|
cs.CV
|
0 |
1 month ago |
| 11 |
OASIS: Occlusion-aware Single-image Hand Avatar Reconstruction via 3D Gaussian Splatting
Zhisheng Han, Shiyao Wu, ... (+7 more)
|
|
cs.CV
|
0 |
1 month ago |
| 12 |
One Patch Is Enough: Reinforcement-Optimized Visual Token Grounding for MLLM-Based Scene Text Spotting
Rui Tang, Wentao Yang, ... (+5 more)
|
|
cs.CV
|
0 |
1 month ago |
| 13 |
Prosody-driven Jailbreaks in Audio LLMs: A Controlled Study and Mechanistic Analysis
Jiachen Qian, Junyu Li
|
|
cs.SD
|
0 |
1 month ago |
| 14 |
LaP-Forensics: Latent-Pixel Consistency Guided Multimodal Reasoning for Deepfake Detection
Can Wang, Yuhao Wang, ... (+3 more)
|
|
cs.CV
|
0 |
1 month ago |
| 15 |
From Semantic Grounding to Decision Optimization: A Unified Framework for Long-Horizon UAV Vision-Language Navigation
Zeyuan Ma, Jiaxin Chen, Di Huang
|
|
cs.CV
|
0 |
27 days ago |
| 16 |
EmoS: A Theory-Grounded Framework for Evaluating and Aligning Emotional Intelligence in Spoken Language Models
Junyu Wang, Siyuan Zhang, ... (+12 more)
|
|
cs.CL
|
0 |
27 days ago |
| 17 |
EvBS: Event-guided Blur Synthesis for Domain-adaptive Motion Deblurring
Junsik Jung, Seokryun Choi, ... (+4 more)
|
|
cs.CV
|
0 |
29 days ago |
| 18 |
I Seek You in Videos: Identity-Conditioned Queries for Person-Centric Video Reasoning
Shibo Gao, Chongxiao Wang, ... (+11 more)
|
|
cs.CV
|
0 |
1 month ago |
| 19 |
H2AL: Hyperbolic Hierarchy-aware Aggregative Learning for Registration-based Few-shot Medical Image Segmentation
Jia Wang, Jiaming Cai, ... (+5 more)
|
|
cs.CV
|
0 |
1 month ago |
| 20 |
Local Epistemic Uncertainty Guided Active Sampling for Plug-and-play Diffusive Image Restoration
Jiaqi Zhang, Zheng Pang, ... (+3 more)
|
|
cs.CV
|
0 |
1 month ago |
| 21 |
Depth-Guided Video Object Counting in Crowded Scenes
Yuanjing Xu, Xinyan Liu, ... (+6 more)
|
|
cs.CV
|
0 |
1 month ago |
| 22 |
Flow-Map Distillation on Relation Manifolds for Image Restoration
Zihao He, Songhua Liu
|
|
cs.CV
|
0 |
1 month ago |
| 23 |
TRACE-Bench: Decomposing and Diagnosing Multi-Reference Image Generation
Haoran Wang, Chaofan Ma, ... (+2 more)
|
|
cs.CV
|
0 |
20 days ago |
| 24 |
TR-GS: High-Fidelity Sparse-View CT Volumetric Rendering via t-Distribution Gaussian Splatting and Ray-Confidence Modeling
Zedong Xiao, Yiren Wang, ... (+3 more)
|
|
cs.CV
|
0 |
20 days ago |
| 25 |
MASCOT: Model-Aware Submodular Coverage for Composite-Attribute Text-to-Image Retrieval
Aaryan Sharma, Vishak Prasad C, ... (+2 more)
|
|
cs.MM
|
0 |
25 days ago |
| 26 |
JieZi: A Large-Scale Expert-Audited Dataset and Benchmark for Ancient Chinese Character Exegesis
Ran Li, Huiguo He, ... (+4 more)
|
|
cs.CV
|
0 |
25 days ago |
| 27 |
Embodied Multimodal Grounding for Open-Vocabulary Mobile Manipulation via Semantic 3D Gaussian Splatting
Huosen Ou, Dongni Song, ... (+3 more)
|
|
cs.RO
|
0 |
26 days ago |
| 28 |
UniMod: Enhancing Multi-Modal Medical Diagnosis through Cross-Modality and Within-Modality Alignment
Zijian Gu, Weikai Lin, ... (+3 more)
|
|
cs.CV
|
0 |
27 days ago |
| 29 |
From Multimodal Observation to Interpretable Suggestions: Counterfactual Time-Expanded Relational Modeling of Surgical Teams
Vincenzo Marco De Luca, Antonio Longa, ... (+2 more)
|
|
cs.LG
|
0 |
13 days ago |
| 30 |
StateTrace: An Object-Centric Framework for Hidden-State Spatiotemporal Reasoning in Long Videos
Yu Han, Wenhao Li, ... (+5 more)
|
|
cs.CV
|
0 |
18 days ago |
| 31 |
SpeechSense: A Paralinguistic-Focused Dataset for Fine-Grained Speech Sentiment Analysis
Shicheng Ma, Wenqian Cui, Irwin King
|
|
cs.CL
|
0 |
19 days ago |
| 32 |
HiRS-Agent: A Hierarchical Multi-Agent System for Reliable Long-Horizon Remote Sensing Task Solving
Boyang Mu, Zhiwei Wei, ... (+2 more)
|
|
cs.AI
|
0 |
6 days ago |
| 33 |
DEFUSE: Generalizable Backdoor Defense for Self-Supervised Encoders with Generative Priors
Tuo Chen, Jie Gui, ... (+5 more)
|
|
cs.CV
|
0 |
11 days ago |