未来已来,只是尚未均匀分布

每日精选 arXiv 新论文,用中文讲清核心问题、方法、结果与局限。

已收录 721 篇解读

217

大语言模型中的元认知:基础、进展与机遇

Metacognition in LLMs: Foundations, Progress, and Opportunities

首次全面综述大语言模型的元认知研究,系统梳理了评估方法、增强技术及应用,并指明了当前挑战与未来方向

arXiv: 2607.11881v1

218

近似影子哈密顿模拟的高效算法

An efficient algorithm for approximate shadow Hamiltonian simulation

提出基于算子修剪的近似暗影哈密顿模拟算法,将相互作用系统模拟的量子比特需求大幅降低

arXiv: 2607.11882v1

219

重序编码:利用自生成训练数据突破模型压缩的极限

Requential Coding: Pushing the Limits of Model Compression with Self-Generated Training Data

该文提出 requential coding,以学生自生成数据配合教师选择实现编码长度独立于参数量和熵,将大模型的泛化界提升至最优并随规模收紧

arXiv: 2607.11883v1

220

穿越 Rindler 火墙的非线性粒子探测器

Nonlinear particle detectors across the Rindler firewall

该研究揭示非线性粒子探测器在穿越林德勒防火墙时动量平方耦合引发δ(0)发散,表明尖锐防火墙模型与非线性局域可观测量不相容

arXiv: 2607.09660v1

221

PHINN-EEG:梦境状态脑电的拓扑时间序列分析——用于梦境内容分类的动态贝蒂曲线与拓扑条件神经信号合成

PHINN-EEG: Topological Time-Series Analysis of Dream-State EEG -- Dynamic Betti Curves for Dream Content Classification and Topology-Conditioned Neural Signal Synthesis

首次将持续同调引入梦境脑电分析,通过动态贝蒂曲线捕捉神经活动几何构型,将梦境检测 AUC 从约 0.70 突破至 0.82–0.90

arXiv: 2607.09662v1

222

环形腔光磁力学中基于磁振子压缩的相位可切换非互易纠缠

Phase-switchable nonreciprocal entanglement via magnon squeezing in ring-cavity optomagnomechanics

通过磁振子压缩的相位控制,在环形腔光磁力力学中实现二分与三方纠缠的可切换非互易特性,并借助相位反转获得高对比度

arXiv: 2607.09663v1

223

SLORR:简单高效的训练中低秩正则化

SLORR: Simple and Efficient In-Training Low-Rank Regularization

提出 SLORR 框架,无需 SVD 与状态缓存且不改变架构,利用 GPU 友好近似实现训练中低秩正则化,以极小开销显著提升模型压缩后性能

arXiv: 2607.08754v1

224

MulTTiPop:一个面向流行音乐的多轨转录数据集

MulTTiPop: A Multitrack Transcription Dataset for Pop Music

创建了对齐商业流行音乐与多轨 MIDI 的 MulTTiPop 数据集并发现最佳自动转录模型起始点 F1 仅 38% 留巨大改进空间

arXiv: 2607.08756v1

225

前向扩散过程中的得分精度无法保证扩散采样的数值稳定性

Score Accuracy Along the Forward Diffusion Does Not Certify Numerical Stability in Diffusion Sampling

该文发现前向扩散得分误差任意小也无法保证扩散采样数值稳定,反而导致所有正阶矩发散,但提出投影去噪器可保证稳定性

arXiv: 2607.08757v1

226

思想拥有基因组:面向科学谱系推理与基于谱系的思想生成的基准测试

Ideas Have Genomes: Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation

该工作将科学想法抽象为可演化基因组并构建谱系推理基准发现最强模型准确率仅百分之二十七点三暴露了人工智能的组合瓶颈

arXiv: 2607.08758v1

227

冰球杆 f-散度

Hockey stick $f$-divergences

奈曼-皮尔逊错误概率表示、信道可逆性检测及雷尼散度等价,系统拓展了量子曲棍球棒 f 散度理论

arXiv: 2607.08760v1

228

高阶关联子族的不可约几何

Irreducible Geometry of Higher-Order Correlator Families

该论文通过几何框架揭示高阶关联子族中的不可约信息,并区分出自由费米子、可积与混沌动力学产生定性不同的关联几何结构

arXiv: 2607.08761v1

229

两量子比特态导引的典型性

Typicality of Steering for Two-qubit States

解析给出两量子比特维尔纳态导向概率,并发现随机态在大量设置下导向几乎必然出现,且概率远超贝尔非定域性

arXiv: 2607.08762v1

230

OpenCoF:通过视频生成学习推理

OpenCoF: Learning to Reason Through Video Generation

这份工作构建了多任务视频推理数据集并微调模型,显著提升了链式帧推理性能,并揭示了视觉与文本推理令牌的作用

arXiv: 2607.08763v1

231

Plaquette:用于容错量子计算机的硬件感知设计平台

Plaquette: A hardware-aware design platform for fault-tolerant quantum computers

Plaquette 平台直接从开放系统物理导出容错量子计算机逻辑性能,并证实对于泄漏、散射等噪声,Pauli 模型模拟不够准确

arXiv: 2607.08767v1

232

迈向线性的关键:分析驱动的 Transformer 线性化

The Key to Going Linear: Analysis-Driven Transformer Linearization

证明了软最大化注意力实质上通过键依赖的秩一正交投影运作,故德尔塔式更新优于门控累积,并采用汇令牌等干预弥补线性化差距

arXiv: 2607.07706v1

233

Co-LMLM:连续查询有限记忆语言模型

Co-LMLM: Continuous-Query Limited Memory Language Models

连续查询 LMLM 用向量查询替代关系查询,将知识外化扩展至任意文本,获得更低困惑度与顶尖事实精度

arXiv: 2607.07707v1

234

通过深度原生结构推理实现准确、跨学科且透明的结构-性质理解

Accurate, Interdisciplinary and Transparent Structure-property Understanding with Deep Native Structural Reasoning

该论文提出的 SciReasoner 模型将蛋白质、分子和晶体的结构转化为可推理证据单元,在 67 项任务中领先并生成专家级推理痕迹

arXiv: 2607.07708v1

235

波导量子电动力学中的连续窄线宽超辐射

Continuous Narrow-Linewidth Superradiance in Waveguide QED

波导 QED 中选择性泵浦部分发射体,利用长程偶极作用实现连续窄线宽超辐射且二阶关联接近 1,为芯片级光频标开辟无腔新径

arXiv: 2607.06556v1

236

量子信道多项式处理

Quantum Channel Polynomial Processing

该论文用概率混合酉通道实现厄米算符多项式变换,提供查询样本复杂度灵活折衷,电路复杂度低于奇异值变换块编码,可从含噪量子计算扩展至容错

arXiv: 2607.06557v1

237

ELSA3D:面向统一三维理解与生成的弹性语义锚定

ELSA3D: Elastic Semantic Anchoring for Unified 3D Understanding and Generation

该论文提出弹性语义锚定,显式匹配语言语义与多尺度几何,实现统一 3D 理解与生成,取得最优结果且计算量减半

arXiv: 2607.06565v1

238

可解释且无需人工标注的深度学习真假分类与不确定性量化

Interpretable Human-Label-Free Deep Learning for Real-Bogus Classification with Uncertainty Quantification

它通过模拟注入与不对称协同训练,在无人工标注下实现稳健的真假分类,并提供校准的不确定性量化

arXiv: 2607.05393v1

239

通过直接同策略蒸馏实现弱到强泛化

Weak-to-Strong Generalization via Direct On-Policy Distillation

发现弱模型 RL 前后的对数概率比蕴含训练奖励,将其作为隐式奖励在线蒸馏强模型,高效实现弱到强泛化且避免性能下降

arXiv: 2607.05394v1

240

从固定到自由相机:免标定视角鲁棒视觉语言动作模型

From Fixed to Free Cameras: Calibration-Free View-Robust Vision-Language-Action Model

提出相机中心 VLA 通过预测相机系末端动作和手眼矩阵实现无需相机标定的视角鲁棒操控

arXiv: 2607.05396v1