| 51 |
LLMs Are Not Good Strategists, Yet Memory-Enhanced Agency Boosts Reasoning
Yi Wu, Zhimin Hu
|
|
cs.CL
|
0 |
25 days ago |
| 52 |
Preference Tree Optimization: Enhancing Goal-Oriented Dialogue with Look-Ahead Simulations
Lior Baruch, Moshe Butman, ... (+2 more)
|
|
cs.CL
|
0 |
25 days ago |
| 53 |
Procedural Fairness Failures in RLHF from Preference Averaging
M P V S Gopinadh, Karthik Kamuju, ... (+3 more)
|
|
cs.LG
|
0 |
27 days ago |
| 54 |
Spiking Neural Networks for Continuous Control: Neuromorphic Reinforcement Learning in Conventional Computing
Jessica Hunter, Md Maruf Hossain Shuvo, Krishna Roy
|
|
cs.LG
|
0 |
13 days ago |
| 55 |
SSDi8: Accurate and Efficient 8-bit Quantization for State Space Duality
Hyunwoo Kim, Byoungchan Ko, ... (+6 more)
|
|
cs.AI
|
0 |
15 days ago |
| 56 |
Learning Dynamics of Logits Debiasing for Long-Tailed Semi-Supervised Learning
Yue Cheng, Jiajun Zhang, ... (+3 more)
|
|
cs.LG
|
0 |
6 days ago |
| 57 |
sRGB Real Noise Modeling via Noise-Aware Sampling with Normalizing Flows
Dongjin Kim, Donggoo Jung, ... (+2 more)
|
|
cs.CV
|
0 |
8 days ago |
| 58 |
Towards Large-Scale Heterogeneous Data Organization for Scientific Foundation Models: A Nuclear Fusion Case Study
Nathaniel Chen, Kouroche Bouchiat, ... (+4 more)
|
|
physics.plasm-ph
|
0 |
10 days ago |
| 59 |
Towards Expert Financial QA via Self-Improving RAG
Junjie Xiong, Shawheen Ghezavat, Aum Hirpara
|
|
cs.CL
|
0 |
10 days ago |
| 60 |
Diff Mining: Logit Differences Reveal Finetuning Objectives
Greg Kocher, Robert West, ... (+2 more)
|
|
cs.LG
|
0 |
11 days ago |
| 61 |
MnemoDyn: Learning Resting State Dynamics from 40K FMRI sequences
Sourav Pal, Viet Luong, ... (+6 more)
|
|
cs.LG
|
0 |
12 days ago |