未来已来,只是尚未均匀分布

073

大语言模型在线安全监测

arXiv: 2607.02510v1

074

程序即权重:一种面向模糊函数的编程范式

arXiv: 2607.02512v1

075

LACUNA:一个评估大语言模型遗忘中定位精度的测试平台

arXiv: 2607.02513v1

076

持久状态 AI 控制中的分布式攻击

arXiv: 2607.02514v1

077

布朗棘轮与泵普遍模拟多体活性动力学

arXiv: 2607.01231v1

078

一层就够了吗?训练单个 Transformer 层可媲美全参数强化学习训练

arXiv: 2607.01232v1

079

测量人类与大型语言模型研究思路之间的差距

arXiv: 2607.01233v1

080

QVal: 低成本评估长时域 LLM 智能体的密集监督信号

arXiv: 2606.32034v1

081

内省耦合:尽管监督固定,自我解释训练仍能追踪行为改变

arXiv: 2606.32038v1

082

用于 LLM 智能体规划的自进化世界模型

arXiv: 2606.30639v1

083

LeVo 2:通过层次化表示建模与渐进式后训练实现稳定且悦耳的歌曲生成

arXiv: 2606.30642v1

084

VLK:从重建场景的合成交互中学习人形机器人移动操控

arXiv: 2606.30645v1

085

纯正例学习中的意外发现

arXiv: 2606.28309v1

086

直径截断算子演化

arXiv: 2606.28313v1

087

DexCompose:利用单手复用灵巧策略实现多任务操作

arXiv: 2606.28323v1

088

时变模型下美式期权与灵活远期合约的定价

arXiv: 2606.27335v1

089

确定性 Floquet-PXP 模型中的精确子系统动力学

arXiv: 2606.27337v1

090

理解预算约束实体匹配中领域感知的分布对齐

arXiv: 2606.27342v1

091

误差条件下的神经求解器

arXiv: 2606.27354v1

092

培育容错二元相位旋转的逻辑催化剂

arXiv: 2606.27358v1

093

可能的答案何时正确?论大语言模型中的序列概率与正确性

arXiv: 2606.27359v1

094

自回归玻尔兹曼生成器

arXiv: 2606.27361v1

095

基于无真实解强化学习提升大语言模型

arXiv: 2606.27369v1

096

DanceOPD:同策生成场蒸馏

arXiv: 2606.27377v1