未来已来,只是尚未均匀分布
073
大语言模型在线安全监测
074
程序即权重:一种面向模糊函数的编程范式
075
LACUNA:一个评估大语言模型遗忘中定位精度的测试平台
076
持久状态 AI 控制中的分布式攻击
077
布朗棘轮与泵普遍模拟多体活性动力学
078
一层就够了吗?训练单个 Transformer 层可媲美全参数强化学习训练
079
测量人类与大型语言模型研究思路之间的差距
080
QVal: 低成本评估长时域 LLM 智能体的密集监督信号
081
内省耦合:尽管监督固定,自我解释训练仍能追踪行为改变
082
用于 LLM 智能体规划的自进化世界模型
083
LeVo 2:通过层次化表示建模与渐进式后训练实现稳定且悦耳的歌曲生成
084
VLK:从重建场景的合成交互中学习人形机器人移动操控
085
纯正例学习中的意外发现
086
直径截断算子演化
087
DexCompose:利用单手复用灵巧策略实现多任务操作
088
时变模型下美式期权与灵活远期合约的定价
089
确定性 Floquet-PXP 模型中的精确子系统动力学
090
理解预算约束实体匹配中领域感知的分布对齐
091
误差条件下的神经求解器
092
培育容错二元相位旋转的逻辑催化剂
093
可能的答案何时正确?论大语言模型中的序列概率与正确性
094
自回归玻尔兹曼生成器
095
基于无真实解强化学习提升大语言模型
096