未来已来,只是尚未均匀分布

每日精选 arXiv 新论文,用中文讲清核心问题、方法、结果与局限。

已收录 721 篇解读

049

诺特对称性生成确定性能量收集协议

Noether Symmetries Generate Deterministic Energy-Harvesting Protocols

论文利用诺特对称性证明,确定性能量采集可行的量子源态可通过连续对称轨道生成无穷多个同样可行的源态,并推广至广义概率论

arXiv: 2609.10533v1

050

通过归一化流进行含冗余参数的无似然推断

Likelihood-free inference with nuisance parameters through normalizing flows

该论文提出基于归一化流的分解方法,仅靠模拟器即可在含冗余参数时发现近似枢轴统计量,几乎重现单样本 t 检验并优于剖面似然比方法

arXiv: 2609.10534v1

051

贝尔不等式对谁成立?

For Whom Does Bell Hold?

论文证明闭合哈密顿系统中量子真空涨落的关联具有时间无关性且由能隙控制,而经典系统在共振频率出现极点,从而可区分量子与经典演化

arXiv: 2609.10535v1

052

OmniMed-FL:一种用于临床诊断的鲁棒多模态联邦学习框架

OmniMed-FL: A Robust Multimodal Federated Learning Framework for Clinical Diagnosis

该论文提出联邦多模态诊断框架,融合胸片与临床文本,分类 F1 达 0.956 和 0.906,显著超越单模态并量化偏斜与通信成本

arXiv: 2609.10364v1

053

学习长度可外推的循环模型

Learning Length-Extrapolatable Recurrent Models

该论文提出状态信用稳定化方法 CST,在反向传播中直接重缩放状态信用信号,使循环模型在受控任务和语言建模上外推至 128 倍训练长度仍显著提升

arXiv: 2609.09157v1

054

TANGO:基于全身视觉-语言-动作模型的杂乱环境中人形机器人导航

TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model

提出全身视觉语言导航框架,首次让语言引导人形机器人直接输出二十九自由度关节动作,零样本在真实杂乱环境完成三十米导航

arXiv: 2609.09158v1

055

无辅助比特的低深度随机酉

Low-Depth Random Unitaries without Ancillae

该论文首次在不使用辅助量子比特的情况下实现了最优深度的近似酉 k 设计和指数级更优的精确酉 k 设计,适用于有限维和全连接架构

arXiv: 2609.06528v1

056

双腔光力学中参量与反馈控制的多参数量子估计:稳态与动力学状态

Parametric and feedback-controlled multiparameter quantum estimation in a double cavity optomechanics: steady and dynamical state

该论文在双腔光力学系统中证明参量放大能降低多参数测量不相容性并提升灵敏度,而相干反馈对精度呈非单调可调作用

arXiv: 2609.05402v1

057

RegionFed:异构零售环境中个性化查询理解的联邦学习

RegionFed: Federated Learning for Personalized Query Understanding in Heterogeneous Retail Environments

提出 RegionFed 框架,以梯度冲突为信号实现架构鲁棒的个性化联邦学习,解决 Transformer 上参数级方法崩溃并以差分隐私逼近中心化性能

arXiv: 2609.05403v1

058

Diffusion TV:通过有形与具身交互体验扩散模型

Diffusion TV: Experiencing Diffusion Models through Tangible, Embodied Interaction

该论文实现了一个改装 CRT 电视互动装置,让观众用天线旋钮直接操控扩散模型去噪过程,把生成中间态变成可触摸体验

arXiv: 2609.05404v1

059

迈向基础时间序列模型分类量子微调的可扩展性

Towards Scaling Quantum Fine-Tuning of Foundational Time Series Models for Classification

该论文提出翼模块向固定量子核心注入额外输入,使电力事件分类准确率从 83.6% 提升至 85.2%,证明扩大量子比特需伴随新增信息才有效

arXiv: 2609.05408v1

060

UniMate:一个用于驱动多样化骨架的统一模型

UniMate: One Unified Model to Animate Diverse Skeletons

该论文提出首个统一动画基础模型,无需测试优化或逐骨架重训练,单次前向即可根据文本提示驱动任意异构骨骼拓扑生成关节运动

arXiv: 2609.05415v1

061

量子通信与贝尔非定域性需要无限经典通信来模拟

Quantum communication and Bell nonlocality require infinite classical communication to simulate

该论文证明从四维起量子通信与贝尔非定域性无法用有限经典通信精确模拟,并给出三维用三百五十七比特的显式协议

arXiv: 2609.04182v1

062

先看后合成:面向弱监督密集视频描述的 VLM 引导过渡事件发现

Seeing Before Synthesizing: VLM-Guided Transition Event Discovery for Weakly-Supervised Dense Video Captioning

提出先用视觉语言模型观察事件间隙、检测真实语义过渡,仅在有根据处生成过渡描述并优化时间定位,在两项基准上取得领先性能

arXiv: 2609.04183v1

063

并发随机博弈的鲁棒 PAC 学习

Robust PAC Learning of Concurrent Stochastic Games

提出首个并发随机博弈的鲁棒概率近似正确学习算法,在转移概率未知时返回福利近优的ε纳什均衡,或给出不存在精确均衡的可靠证明

arXiv: 2609.04189v1

064

一个编辑器,多种编辑:面向多样化视频编辑的统一免训练框架

One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing

提出无需训练的 EditVid 统一视频编辑框架,以稀疏因果记忆、长程对应注入和软混合同时支持指令与主体引导编辑,在 FiVE 上准确率 78.16,远超最强免训练基线 58.95

arXiv: 2609.04190v1

065

轴突延迟离散度决定神经元检测的是事件还是序列,并可预测皮层柱直径

Axonal delay dispersion decides whether a neuron detects an event or a sequence, and predicts cortical column diameter

发现轴突传导延迟的离散度这一单一物理量决定神经元检测事件还是有序序列,并据此预测皮层柱直径

arXiv: 2609.04195v1

066

可读性并不等于可解释性:比较思维链推理中判断的重要性和实际重要性

Legibility is Not Interpretability: Comparing Judged and Actual Importance in Chain-Of-Thought Reasoning

该论文用蒙特卡洛优势量化思维链步骤重要性,发现语言模型评判只能部分从文本恢复真实重要性,表明可读性不等于可解释性

arXiv: 2609.04194v1

067

ESPO:通过诊断、多样化与稳定化实现基于错误结构的提示词优化

ESPO: Error-Structured Prompt Optimization via Diagnose, Diversify, and Stabilize

该论文提出三阶段提示优化框架 ESPO,通过全量错误诊断、多策略生成和自举稳定性选择,在七个基准上比 GEPA 准确率平均提升 3.76 个百分点且提示缩短 47%

arXiv: 2609.04197v1

068

工程无瑕,测量不稳:黑盒 LLM 观察者在共享端点上的预注册信度失败

Clean Engineering, Unstable Measurement: A Preregistered Reliability Failure of Black-Box LLM Observers on Shared Endpoints

该论文预注册审计发现,共享端点上的黑盒 LLM 评判器同窗口重复排名一致性仅 0.400、次日字节一致重放仅 0.78,工程无误却测量失稳

arXiv: 2609.04198v1

069

训练式编译:将自然语言规范转化为本地神经函数

Compile by Training: Turning Natural-Language Specifications into Local Neural Functions

提出编译即训练方法,将自然语言规格训练成可复用局部神经函数,在困难基准上达 83.6% 语义准确率且运行时无需大模型

arXiv: 2609.04199v1

070

Graph Machine:通过边实现更好的预训练

Graph Machine: Towards Better Pretraining via Edges

该论文提出图机器架构,用可微更新的边实现线性状态与常数稀疏访问,替换 75% 稠密层后每头仅检索 2 个令牌仍几乎不降损失

arXiv: 2609.02881v1

071

面向 Web 智能体的判别式世界模型

Discriminative World Models for Web Agents

该工作提出预测状态匹配训练目标,使世界模型生成的表示能区分真实后续状态与替代动作结果,从而提升网页智能体动作排序与任务成功率

arXiv: 2609.02885v1

072

语音脑机接口的通用通信度量

A Common Measure of Communication for Speech Brain-Computer Interfaces

提出开放词汇互信息 OVMI 作为语音脑机接口统一通信度量,发现常用指标会高估实际可通信内容,优化词汇可提升准确率最高 16.3%

arXiv: 2609.02887v1