未来已来,只是尚未均匀分布
每日精选 arXiv 新论文,用中文讲清核心问题、方法、结果与局限。
已收录 721 篇解读
诺特对称性生成确定性能量收集协议
Noether Symmetries Generate Deterministic Energy-Harvesting Protocols
论文利用诺特对称性证明,确定性能量采集可行的量子源态可通过连续对称轨道生成无穷多个同样可行的源态,并推广至广义概率论
通过归一化流进行含冗余参数的无似然推断
Likelihood-free inference with nuisance parameters through normalizing flows
该论文提出基于归一化流的分解方法,仅靠模拟器即可在含冗余参数时发现近似枢轴统计量,几乎重现单样本 t 检验并优于剖面似然比方法
贝尔不等式对谁成立?
For Whom Does Bell Hold?
论文证明闭合哈密顿系统中量子真空涨落的关联具有时间无关性且由能隙控制,而经典系统在共振频率出现极点,从而可区分量子与经典演化
OmniMed-FL:一种用于临床诊断的鲁棒多模态联邦学习框架
OmniMed-FL: A Robust Multimodal Federated Learning Framework for Clinical Diagnosis
该论文提出联邦多模态诊断框架,融合胸片与临床文本,分类 F1 达 0.956 和 0.906,显著超越单模态并量化偏斜与通信成本
学习长度可外推的循环模型
Learning Length-Extrapolatable Recurrent Models
该论文提出状态信用稳定化方法 CST,在反向传播中直接重缩放状态信用信号,使循环模型在受控任务和语言建模上外推至 128 倍训练长度仍显著提升
TANGO:基于全身视觉-语言-动作模型的杂乱环境中人形机器人导航
TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model
提出全身视觉语言导航框架,首次让语言引导人形机器人直接输出二十九自由度关节动作,零样本在真实杂乱环境完成三十米导航
无辅助比特的低深度随机酉
Low-Depth Random Unitaries without Ancillae
该论文首次在不使用辅助量子比特的情况下实现了最优深度的近似酉 k 设计和指数级更优的精确酉 k 设计,适用于有限维和全连接架构
双腔光力学中参量与反馈控制的多参数量子估计:稳态与动力学状态
Parametric and feedback-controlled multiparameter quantum estimation in a double cavity optomechanics: steady and dynamical state
该论文在双腔光力学系统中证明参量放大能降低多参数测量不相容性并提升灵敏度,而相干反馈对精度呈非单调可调作用
RegionFed:异构零售环境中个性化查询理解的联邦学习
RegionFed: Federated Learning for Personalized Query Understanding in Heterogeneous Retail Environments
提出 RegionFed 框架,以梯度冲突为信号实现架构鲁棒的个性化联邦学习,解决 Transformer 上参数级方法崩溃并以差分隐私逼近中心化性能
Diffusion TV:通过有形与具身交互体验扩散模型
Diffusion TV: Experiencing Diffusion Models through Tangible, Embodied Interaction
该论文实现了一个改装 CRT 电视互动装置,让观众用天线旋钮直接操控扩散模型去噪过程,把生成中间态变成可触摸体验
迈向基础时间序列模型分类量子微调的可扩展性
Towards Scaling Quantum Fine-Tuning of Foundational Time Series Models for Classification
该论文提出翼模块向固定量子核心注入额外输入,使电力事件分类准确率从 83.6% 提升至 85.2%,证明扩大量子比特需伴随新增信息才有效
UniMate:一个用于驱动多样化骨架的统一模型
UniMate: One Unified Model to Animate Diverse Skeletons
该论文提出首个统一动画基础模型,无需测试优化或逐骨架重训练,单次前向即可根据文本提示驱动任意异构骨骼拓扑生成关节运动
量子通信与贝尔非定域性需要无限经典通信来模拟
Quantum communication and Bell nonlocality require infinite classical communication to simulate
该论文证明从四维起量子通信与贝尔非定域性无法用有限经典通信精确模拟,并给出三维用三百五十七比特的显式协议
先看后合成:面向弱监督密集视频描述的 VLM 引导过渡事件发现
Seeing Before Synthesizing: VLM-Guided Transition Event Discovery for Weakly-Supervised Dense Video Captioning
提出先用视觉语言模型观察事件间隙、检测真实语义过渡,仅在有根据处生成过渡描述并优化时间定位,在两项基准上取得领先性能
并发随机博弈的鲁棒 PAC 学习
Robust PAC Learning of Concurrent Stochastic Games
提出首个并发随机博弈的鲁棒概率近似正确学习算法,在转移概率未知时返回福利近优的ε纳什均衡,或给出不存在精确均衡的可靠证明
一个编辑器,多种编辑:面向多样化视频编辑的统一免训练框架
One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing
提出无需训练的 EditVid 统一视频编辑框架,以稀疏因果记忆、长程对应注入和软混合同时支持指令与主体引导编辑,在 FiVE 上准确率 78.16,远超最强免训练基线 58.95
轴突延迟离散度决定神经元检测的是事件还是序列,并可预测皮层柱直径
Axonal delay dispersion decides whether a neuron detects an event or a sequence, and predicts cortical column diameter
发现轴突传导延迟的离散度这一单一物理量决定神经元检测事件还是有序序列,并据此预测皮层柱直径
可读性并不等于可解释性:比较思维链推理中判断的重要性和实际重要性
Legibility is Not Interpretability: Comparing Judged and Actual Importance in Chain-Of-Thought Reasoning
该论文用蒙特卡洛优势量化思维链步骤重要性,发现语言模型评判只能部分从文本恢复真实重要性,表明可读性不等于可解释性
ESPO:通过诊断、多样化与稳定化实现基于错误结构的提示词优化
ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize
该论文提出三阶段提示优化框架 ESPO,通过全量错误诊断、多策略生成和自举稳定性选择,在七个基准上比 GEPA 准确率平均提升 3.76 个百分点且提示缩短 47%
工程无瑕,测量不稳:黑盒 LLM 观察者在共享端点上的预注册信度失败
Clean Engineering, Unstable Measurement: A Preregistered Reliability Failure of Black-Box LLM Observers on Shared Endpoints
该论文预注册审计发现,共享端点上的黑盒 LLM 评判器同窗口重复排名一致性仅 0.400、次日字节一致重放仅 0.78,工程无误却测量失稳
训练式编译:将自然语言规范转化为本地神经函数
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions
提出编译即训练方法,将自然语言规格训练成可复用局部神经函数,在困难基准上达 83.6% 语义准确率且运行时无需大模型
Graph Machine:通过边实现更好的预训练
Graph Machine: Towards Better Pretraining via Edges
该论文提出图机器架构,用可微更新的边实现线性状态与常数稀疏访问,替换 75% 稠密层后每头仅检索 2 个令牌仍几乎不降损失
面向 Web 智能体的判别式世界模型
Discriminative World Models for Web Agents
该工作提出预测状态匹配训练目标,使世界模型生成的表示能区分真实后续状态与替代动作结果,从而提升网页智能体动作排序与任务成功率
语音脑机接口的通用通信度量
A Common Measure of Communication for Speech Brain-Computer Interfaces
提出开放词汇互信息 OVMI 作为语音脑机接口统一通信度量,发现常用指标会高估实际可通信内容,优化词汇可提升准确率最高 16.3%