未来已来,只是尚未均匀分布
每日精选 arXiv 新论文,用中文讲清核心问题、方法、结果与局限。
已收录 721 篇解读
CodeRescue:面向编程智能体的预算校准恢复路由
CodeRescue: Budget-Calibrated Recovery Routing for Coding Agents
提出预算校准的恢复路由方法,通过一致风险控制无需重新训练即可适配不同预算,仅用升级方法 35% 的平均恢复成本即达到同等解决率
外观指针——扩散 Transformer 的多模态区域控制
Appearance Pointers -- Multimodal Region Control of Diffusion Transformers
外观指针以无重训练的模态无关接口,首次让扩散 Transformer 能根据掩码精确对齐文本与图像的多模态区域控制
少复制,重依据:基于证据感知的强化学习克服长上下文推理中的重复复制
Copy Less, Ground More: Overcoming Repetitive Copying in Long-Context Reasoning via Evidence-Aware Reinforcement Learning
发现长上下文推理中重复复制源于证据接地不足,提出结合接地奖励与干扰惩罚的强化学习方法显著提升性能并减少冗余复制
自动化发现没有普遍优越的框架
Automated Discovery Has No Universally Superior Harness
论文通过分解框架并大量实验发现无固定框架普遍优越,框架选择应视为超参数,且早期表现可预测最终性能以支持自适应
补丁策略:通过密集视觉表示实现高效具身控制
Patch Policy: Efficient Embodied Control via Dense Visual Representations
利用预训练 ViT 密集块特征与块因果注意力,仅用 0.7% 参数取得比全局池化策略高 40% 的性能,并超越微调视觉语言动作模型 18%
视觉相似性的多重感知:一种文本提示的图像感知度量
The Many Senses of Visual Similarity: A Text-Prompted Image Perceptual Metric
该论文提出文本提示的图像感知相似度指标,通过收集多感官相似度数据微调模型,依据指定方面衡量相似度,更符合人类感知
基于拉普拉斯最优传输的聚类感知匹配
Cluster-Aware Matching via Laplacian Optimal Transport
该论文提出基于拉普拉斯最优传输的聚类感知匹配方法,直接将簇结构融入点云对齐过程,实现稳健的区域到区域匹配和一致划分
基于平衡态的可微分连续变量热力学计算蓝图
A Blueprint for Equilibrium-Based Differentiable Continuous-Variable Thermodynamic Computing
它提出了基于平衡态的可微连续变量热力学计算栈蓝图,并通过超导电路原型实现了热噪声驱动下的概率建模与采样
分页权重:通过动态质量感知权重量化实现高效混合专家大语言模型推理服务
PagedWeight: Efficient MoE LLM Serving with Dynamic Quality-Aware Weight Quantization
PagedWeight 通过运行时动态质量感知量化 MoE 权重,最高节省 72% GPU 内存并提升 1.94 倍吞吐,同时保持 FP16 等效精度
面向多用户与多协议量子网络的动态纠缠分发
Dynamic Entanglement Distribution for Multi-User and Multi-Protocol Quantum Networking
该论文首次实验展示利用量子 ROADM 在城域光纤中动态分发纠缠,实现稳定六用户全互联和协议可切换的量子网络
超越成功率:进攻性与防御性安全智能体的成本感知评估
Beyond Success Rate: Cost-Aware Evaluation of Offensive and Defensive Security Agents
这篇论文通过成本-成功视角评估攻防安全代理,揭示进攻性能随推理预算提升而防御性能受工具纪律约束,为基准测试补充了经济效率维度
SceneBind:跨视觉、音频与语言绑定“什么”与“哪里”
SceneBind: Binding What and Where Across Vision, Audio and Language
构建了联合语义和空间的全模态场景表示,通过对象槽绑定是什么与在哪里,实现跨模态检索与零样本定位
预训练数据可通过计算宣传被毒化
Pretraining Data Can Be Poisoned through Computational Propaganda
证实第三方公共评论等网页内容注入可毒化预训练数据,并提出半衰期分析法量化其经爬取过滤后的存活率
在线神经时空记忆用于动态新颖视图合成
Online Neural Space Time Memory for Dynamic Novel View Synthesis
该论文解耦记忆更新与合成频率并引入记忆损失和缓存策略,使动态场景实时新视图合成得以保留分钟级历史记忆
SciDiagramEdit:从论文修订中学习编辑科学图表
SciDiagramEdit: Learning to Edit Scientific Diagrams from Paper Revisions
从 arXiv 论文修订历史中挖掘图表编辑对,并利用技能演化框架学习复杂图表编辑,显著提升指令编辑质量
MeanFlowNFT:将前向过程强化学习引入平均速度生成器
MeanFlowNFT: Bringing Forward-Process RL to Average-Velocity Generators
提出 MeanFlowNFT 方法,用速度恒等式构造诱导预测器,将前向过程 RL 用于平均速度生成器,保持少步采样高效奖励对齐并超越多步 RL 基线
RoboTTT:机器人策略的上下文缩放
RoboTTT: Context Scaling for Robot Policies
RoboTTT 通过测试时训练将机器人视觉运动上下文扩展至 8000 时间步,无需增加推理延迟,首次实现单次人类视频模仿和在线策略自我提升
透过纠缠隐形传态视角看深度热化的定域性
Locality of deep thermalisation through the lens of entanglement teleportation
发现深度热化时标由测量诱导的纠缠传态决定,通常随距离对数增长,但特殊电路出现有限时标的真正非局域性
利用无标签数据实现可泛化的神经群体解码
Leveraging unlabelled data for generalizable neural population decoding
该论文提出 MOJO 框架,通过掩码自编码联合监督学习利用无标签数据,显著提升脉冲神经解码的跨任务和跨物种泛化性能
用于光机械加速度计的帆形薄膜
Sail membranes for optomechanical accelerometry
贝叶斯优化发现帆形膜使频率降低十倍且 Q·m 积不变,制成热噪声仅 40 纳 g 每根号赫兹的加速度计
基于 CPM 的量子 LDPC 码的对划分构造
Pair-Partition Constructions for CPM-Based Quantum LDPC Codes
该论文利用对划分与循环置换矩阵构造出确知距离超过行重的高码率量子 LDPC 码实例
TerraZero:面向大规模零示范自我博弈的程序化驾驶仿真
TerraZero: Procedural Driving Simulation for Zero-Demonstration Self-Play at Scale
该论文实现了一个零人类演示的自动驾驶自博弈训练系统,凭借程序化场景生成和每秒百万步的仿真,首次训练出在长尾安全基准上击败所有学习型方法的策略,且零样本跨城泛化
视频扩散模型中的串行性差距
The Seriality Gap in Video Diffusion Models
该论文发现视频扩散模型存在串行性差距,去噪步骤不增加串行计算,导致依赖事件链预测退化,而自回归生成和更深架构可有效缓解
AI 智能体是否知道任务何时简单?迈向复杂度感知的推理与执行
Do AI Agents Know When a Task Is Simple? Toward Complexity-Aware Reasoning and Execution
它发现 AI 代理无任务复杂度感知,提出先估算难度后最小执行方法,保持成功率同时削减成本 85% 以上