| 301 |
One Form to Transfer Them All: Pretraining Multilingual Language Models Beyond Native Orthography
Muge Zhang, Aaron Jencks, ... (+3 more)
|
|
cs.CL
|
0 |
27 days ago |
| 302 |
From Passive Response to Proactive Correction: Enhancing LLM Robustness Against Input Fact Perturbations
Ping Wang, Xiangguo Sun, ... (+3 more)
|
|
cs.CL
|
0 |
27 days ago |
| 303 |
Unlocking Multimodal Protein Language Models at Inference Time
Yi Zhou, Qipeng Wang, ... (+4 more)
|
|
cs.CE
|
0 |
27 days ago |
| 304 |
Localize-Then-Decide Guarantees for LLM Judgments
Xinyu Li, Yi Zhou, ... (+4 more)
|
|
cs.CL
|
0 |
27 days ago |
| 305 |
Learning New Facts with QLoRA: An Acquisition-Retention Frontier
Estelle Zheng, Sébastien Warichet, ... (+2 more)
|
|
cs.CL
|
0 |
27 days ago |
| 306 |
Think-Probe-Respond: Improving Large Language Models as Judges of Research Idea Novelty
Tim Schopf, Tobias Schreieder, Akiko Aizawa
|
|
cs.CL
|
0 |
27 days ago |
| 307 |
Reconstructing the Right Episode: Evaluating Interleaved Conversational Memory Beyond Long Context
Zhexi Feng, Ruiyi Zhang, ... (+2 more)
|
|
cs.CL
|
0 |
27 days ago |
| 308 |
RetrievalRouter: Joint Modality and Architecture Selection for Document Retrieval
Emre Kuru, Mehmet Onur Keskin, ... (+2 more)
|
|
cs.IR
|
0 |
27 days ago |
| 309 |
AWM: Answerable Working Memory for Long-Document VQA Agents
Dongzhuoran Zhou, Yuqicheng Zhu, ... (+6 more)
|
|
cs.CL
|
0 |
27 days ago |
| 310 |
MLLMCLIP: Feature-Level Distillation of MLLM for Robust Vision-Language Representations
Jongsuk Kim, Qiyu Wu, ... (+4 more)
|
|
cs.CV
|
0 |
27 days ago |
| 311 |
EgoArgus: Benchmarking VLMs as Situational Assistants for Modality-Grounded User Supports
Yu-Chien Tang, Yu-Hsiang Liu, An-Zi Yen
|
|
cs.CL
|
0 |
27 days ago |
| 312 |
PonsRAG: A Pons-Inspired RAG Bridging Cognitive Islands for Coordinated Long Narrative Reasoning
Rongchen Zhao, Yu Chen, ... (+5 more)
|
|
cs.AI
|
0 |
27 days ago |
| 313 |
Distance Is Not Enough: Forget-Retain Alignment Gap Predicts LLM Relearning Robustness
Yi Chen, Hanna Hsieh, ... (+5 more)
|
|
cs.AI
|
0 |
27 days ago |
| 314 |
OmniPhys: A Unified Multimodal Benchmark for Physics Understanding and Generation from Chinese Educational Corpora
Hao Chen, Yumin Lin, ... (+3 more)
|
|
cs.CL
|
0 |
27 days ago |
| 315 |
GGSS: Geodesic-Gated Spherical Steering for Inference-Time Debiasing of Generative Vision-Language Models
Yiqun Sun, Junyu Chen, ... (+2 more)
|
|
cs.CY
|
0 |
27 days ago |
| 316 |
GUIDE: Generative Unsupervised Chinese Query Correction via Phonetic and Visual Shared-ID Encoding
Lei Yang, Binbin Huang, ... (+5 more)
|
|
cs.CL
|
0 |
27 days ago |
| 317 |
Routed Graph Handoff: Adaptive Format Selection for Multi-Agent LLM Delegation
Pratyay Banerjee, Ankit Chadha
|
|
cs.CL
|
0 |
27 days ago |
| 318 |
Groundhog Bit-Flip Attack: Seeding Infinite Generation Loops in Mixture-of-Experts LLMs through Bit Flips
Huakang Lin, Tiancheng Zheng, ... (+5 more)
|
|
cs.CL
|
0 |
27 days ago |
| 319 |
MoPLEx: Estimating Plackett-Luce Mixture Models for Multi-Objective Alignment
Dongyue Li, Ziniu Zhang, ... (+2 more)
|
|
cs.LG
|
0 |
28 days ago |
| 320 |
Apples to Apples? Towards Comparable Crosslingual Language Model Evaluation
Xiulin Yang, Ethan Gotlieb Wilcox, Catherine Arnett
|
|
cs.CL
|
0 |
28 days ago |
| 321 |
DataKernelBench: Can LLMs Optimize Database Queries on GPUs?
Gokul Karthik Kumar, Yotam Perlitz, ... (+3 more)
|
|
cs.CL
|
0 |
28 days ago |
| 322 |
Padamitra: Grounded Glossary Generation for Classical Sanskrit
Manoj Balaji Jagadeeshan, Sai Pragnaan Marala, Pawan Goyal
|
|
cs.CL
|
0 |
28 days ago |
| 323 |
Does Fine-Tuning Undo Activation Steering? Behavioural Recovery Without Weight-Edit Reversal
Philipp E. Glass, Allan Tucker, ... (+2 more)
|
|
cs.CL
|
0 |
28 days ago |
| 324 |
Unsupervised Post-Training of Foundation Models: A Survey
Yijie Xu, Qianyi Cai, ... (+10 more)
|
|
cs.CL
|
0 |
28 days ago |
| 325 |
Retrieved But Not Reliable: A Survey on Attacks, and Defenses in Retrieval-Augmented Generation
Minh Tran, Cuong Dang, ... (+11 more)
|
|
cs.CR
|
0 |
28 days ago |
| 326 |
StepGuard: Learning Step-Level Guardrails with Scalable Supervision and Safety-Utility Balancing
Zhijie Zheng, Yu Li, ... (+6 more)
|
|
cs.AI
|
0 |
28 days ago |
| 327 |
Expectation, Backlash, Recovery, and Excitement: How Model Releases Shape Reddit Perceptions of Conversational AI Systems
Vahid Rahimzadeh, Yury Zhauniarovich, Savvas Zannettou
|
|
cs.CL
|
0 |
28 days ago |
| 328 |
Who is the Agent to Blame? Localizing Faithfulness and Citation Mistakes in Agentic Deep Research
Eran Hirsch, David Wan, ... (+4 more)
|
|
cs.CL
|
0 |
28 days ago |
| 329 |
SENSESHIFT: Continuous Sentiment-Controlled Text Generation via Encoder-based Mask Infilling
Shahed Masoudian, Markus Frohmann, ... (+3 more)
|
|
cs.CL
|
0 |
28 days ago |
| 330 |
ReproAgent: Contract-Guided Paper-to-Code Reproduction
Xue Hu, Zewei Pan, ... (+4 more)
|
|
cs.AI
|
0 |
28 days ago |
| 331 |
SA-Bench: Evaluating Semantic Alignment in LLM-Based Paper Reproduction
Xue Hu, Zewei Pan, ... (+3 more)
|
|
cs.AI
|
0 |
28 days ago |
| 332 |
TRACE: An Evidence-Grounded Benchmark for Safety Evaluation of Large Reasoning Models
Zhenyu Wu, Siyuan Chen, ... (+9 more)
|
|
cs.AI
|
0 |
28 days ago |
| 333 |
MetaRAG: Belief-Action Aligned Policy Optimization for Agentic RAG
Qiuyi Qi, Tian Liang, ... (+8 more)
|
|
cs.AI
|
0 |
28 days ago |
| 334 |
MemUse: Moving Memory Evaluation from Direct QA to Natural Integration in Long-Term Human-AI Conversation
Ryuichi Sumida, Koji Inoue, Tatsuya Kawahara
|
|
cs.CL
|
0 |
28 days ago |
| 335 |
Robust Code RL via Faulty-Code-Driven Test case Synthesis and Dense Reward Shaping
Yiwen Zhang, Xiaodong Yan, ... (+7 more)
|
|
cs.AI
|
0 |
28 days ago |
| 336 |
MC-CXR: A Multi-Context Chest X-ray Benchmark for Context-Induced Disruption in Vision-Language Models
Junhyeok Lee, Songsoo Kim, Kyu Sung Choi
|
|
cs.CL
|
0 |
28 days ago |
| 337 |
ACE: A Self-Correcting Agentic Canvas Editor for Multi-Slide Presentation Automation
JooYoung Jang, Taegyeong Lee, ... (+2 more)
|
|
cs.AI
|
0 |
28 days ago |
| 338 |
When Less Is More: An Empirical Study of Minimal Responses in Counseling Dialogues and the Behavior of LLMs
Zhiyang Qi
|
|
cs.CL
|
0 |
28 days ago |
| 339 |
Beyond Confidence: Test-Time Scaling for Multi-Turn Search Agents via Retrieval Grounding
Hyunho Kook, Junhyuk So, ... (+3 more)
|
|
cs.AI
|
0 |
28 days ago |
| 340 |
AgentSpec: Speculative Decoding for Batch Inference of LLM Agents
Xin Wang, Ziming Miao, ... (+5 more)
|
|
cs.CL
|
0 |
28 days ago |
| 341 |
When Seeing Is Not Enough: Benchmarking Interactive Visual Grounding in LVLMs
Zhengxiang Wang, Owen Rambow
|
|
cs.AI
|
0 |
28 days ago |
| 342 |
RAGSentinel: Certifiable Geometric Consensus for Robust Retrieval-Augmented Generation
Yueyang Quan, Anjun Gao, ... (+3 more)
|
|
cs.CR
|
0 |
28 days ago |
| 343 |
NeuronGuard: Robust LLM Safety Alignment via Ablation-Aware Safety Signal Redistribution
Anjun Gao, Yueyang Quan, ... (+3 more)
|
|
cs.CR
|
0 |
28 days ago |
| 344 |
HAP: Head-Adaptive Visual Token Pruning via Cross-Modal Alignment
Yuanhao Sun, Huawei Ji, ... (+4 more)
|
|
cs.CV
|
0 |
29 days ago |
| 345 |
MARS: Multi-Specialist LLM Relay System for Competitive Programming
Andrei Mikhailov, Mikhail Burtsev, Alsu Sagirova
|
|
cs.AI
|
0 |
29 days ago |
| 346 |
The Dialect Tax: Dialectal Biases Persist throughout the Language Modeling Pipeline
Elle
|
|
cs.CL
|
0 |
29 days ago |
| 347 |
SyPS: Measuring Sycophancy Prompt Sensitivity in Large Language Models
Lijia Huang, Yao Fu, Sihao Ren
|
|
cs.AI
|
0 |
29 days ago |
| 348 |
Mitigating Exploration Bias in RL for Multi-Instruction Following
Mian Zhang, Yueqin Yin, ... (+5 more)
|
|
cs.CL
|
0 |
29 days ago |
| 349 |
EmoTra-TTS: Smooth Intra-Utterance Emotion Transitions for Speech Synthesis
Tianchi Liu, Zeyang Song, ... (+4 more)
|
|
eess.AS
|
0 |
29 days ago |
| 350 |
ADE: Agentic Data Evolution Framework for Human-Centered Objectives
Yang Yu, Yilin Jiang, ... (+7 more)
|
|
cs.CL
|
0 |
29 days ago |