未来已来,只是尚未均匀分布

每日精选 arXiv 新论文,用中文讲清核心问题、方法、结果与局限。

已收录 721 篇解读

073

基于大语言模型的智能合约自动化漏洞注入

Automated Vulnerability Injection in Smart Contracts Using Large Language Models

该研究用大语言模型自动向智能合约注入漏洞,经多步验证得到覆盖 25 类漏洞的 32 个合约,揭示可行性与扩展性局限

arXiv: 2609.02624v1

074

酉群上的深度 1 扩展器及其应用

Depth-1 expanders on the unitary group and applications

构造出可由深度 1 电路实现的常数间隙量子扩展器,并由此首次实现一维体系的最优纠缠-间隙关系

arXiv: 2609.01605v1

075

可观测量和状态选择性的预热化及预热寿命界限

Observable- and state-selective prethermalization and bounds on prethermal lifetimes

该论文证明能量尺度分离不自动导致预热平台,预热出现与否由观测量和初态决定,并给出洛施密特回波作为预热寿命下界

arXiv: 2609.01606v1

076

SUN:面向语言引导的控制-学习-现实策略的持久程序

SUN: Persistent Programs For Language-Grounded Control-to-Learning-to-Real Policies

提出 SUN 语义统一程序,将几何接触关系一次编译为 MPC 代价、奖励和转移条件,经仿真筛选后训练策略,九任务成功率达 82% 且无需手工稠密奖励

arXiv: 2608.31167v1

077

一般博弈中的常数个体遗憾

Constant Individual Regret in General Games

该论文提出基于指数移动平均级联高阶乐观的 ECHO-OFTRL 算法,在一般有限博弈中首次将每个玩家个体遗憾上界降至与时间无关的常数级

arXiv: 2608.31166v1

078

重离子碰撞中马尔可夫与非马尔可夫开放量子动力学的量子模拟

Quantum Simulation of Markovian and Non-Markovian Open Quantum Dynamics in Heavy-Ion Collisions

在量子计算机上引入辅助二能级赝模携带记忆,实现重离子碰撞中非马尔可夫开放量子动力学模拟并平滑收敛到马尔可夫极限

arXiv: 2608.31173v1

079

基于 Wasserstein 梯度流的一步生成模型奖励引导微调

Reward-guided Fine-Tuning of One-Step Generative Models via Wasserstein Gradient Flow

提出基于瓦瑟斯坦梯度流的单步生成模型奖励微调方法,借助 JKO 离散化与重要性采样免去奖励梯度,提升奖励对齐并抑制奖励黑客与模式崩溃

arXiv: 2608.29647v1

080

Aero Hand Open:一种面向灵巧操作学习的仿真就绪型肌腱驱动机器人手

Aero Hand Open: A Simulation-Ready Tendon-Driven Hand for Dexterous Manipulation Learning

该论文发布了一款 314 美元、374 克的腱绳驱动仿人机械手,配套仿真模型与驱动映射,实现仿真训练策略零微调直接部署到真实硬件并完成全部 33 种 GRASP 抓取

arXiv: 2608.28578v1

081

QGPINNs:一种用于量子图上非局部微分方程的物理信息神经网络框架

QGPINNs: A Physics-Informed Neural Network Framework for Nonlocal Differential Equations on Quantum Graphs

实现 QGPINNs 框架,用边级神经网络与图损失函数在量子图上求解分数阶微分方程并反演物理参数,在 IEEE 14 母线等网络验证有效

arXiv: 2608.28589v1

082

COVER:可识别的联盟路由评估

COVER: Identifiable Evaluation of Coalition Routing

COVER 通过固定下游栈与合法团队族,使有限基准 oracle 遗憾可精确识别,并证明比较冻结策略仅需路由并集而绝对遗憾需全族

arXiv: 2608.28475v1

083

面向高效量子综合的因式分解布尔表示

Factorized Boolean representations for efficient quantum synthesis

该论文提出因子化布尔表示,从最小化表达式中提取共享因子,用多个窄控制门替代少数宽门,从而降低执行成本且表示层面代价不增

arXiv: 2608.27430v1

084

RedEvoAgent:经验驱动技能演化的自动红队智能体

RedEvoAgent: Automatic Red-Teaming Agent with Experience-Driven Skill Evolution

提出一种自动红队代理,把跨案例攻击轨迹蒸馏为可读攻击技能,并以工具有效性画像和验证棘轮持续进化,于多基准超越固定与代理式基线

arXiv: 2608.27439v1

085

随机幺正电路中局域量子信息的动力学

Dynamics of local quantum information in random unitary circuits

该论文将随机幺正电路中的局域信息动力学映射为经典随机过程,发现信息所在长度尺度的分布呈特雷西-威德姆形式并以 t 的 1/3 次方展宽

arXiv: 2608.27440v1

086

从静态到动态:基于 MCR-Bench 的真实世界代码审查基准测试

From Static to Dynamic: Benchmarking Real-World Code Review with MCR-Bench

该论文提出了首个缺陷状态感知的多轮代码审查基准 MCR-Bench,并揭示主流大模型在缺陷检测和生命周期状态跟踪上随轮次增加性能显著下降

arXiv: 2608.27442v1

087

Fock 空间碎裂下的精确刚度与动力学响应

Exact Stiffness and Dynamical Responses from Fock-Space Fragmentation

该论文证明量子几何嵌套模型的福克空间碎片化使激发按粒子-空穴数解耦,并证明自发破缺连续对称性的刚度严格等于高斯流形变分值

arXiv: 2608.27446v1

088

SWE-Prime:轨迹更少,性能更优

SWE-Prime: Fewer Trajectories, Better Performance

SWE-Prime 提出轨迹级与语义段级两阶段数据筛选,仅用 10% 轨迹训练即超越全量数据,在两个基准上最高相对提升 12.2% 和 24.2%

arXiv: 2608.27449v1

089

WikiSkill:将智能体经验编纂为持久知识以实现技能演化

WikiSkill: Compiling Agent Experience into Persistent Knowledge for Skill Evolution

该框架将智能体经验持续沉淀为持久知识库并与技能协同进化,在多个基准上稳定超越现有方法且技能可跨模型迁移

arXiv: 2608.27454v1

090

量子计算机上规范理论的谱指纹

Spectral Fingerprints of Gauge Theories on a Quantum Computer

该论文用超导量子硬件和动态电路将所需量子比特减半,提取了一加一维 SO(3)非阿贝尔规范理论的完整能谱指纹

arXiv: 2608.27457v1

091

四分之一磁通 Harper-Hofstadter 模型的精确解析能谱、本征态与量子几何

Exact analytical spectrum, eigenstates, and quantum geometry of the quarter-flux Harper-Hofstadter model

这篇论文首次给出四分之一磁通 Harper-Hofstadter 模型全部能带的解析能谱、本征态与量子几何张量,并证明最低带近乎理想陈带

arXiv: 2608.26099v1

092

VBVR-Pro:一个可扩展且可验证的原生视觉推理套件

VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning

构建含三百个程序生成任务和可验证奖励的闭环测试平台,发现视觉原生轨迹比语言思维链对视觉推理更关键,并实现跨七个外部基准的迁移

arXiv: 2608.26105v1

093

面向长程智能体框架的递归经验-工作记忆演化

Recursive Experiential-Working Memory Evolution for Long-Horizon Agent Harnesses

Recuris 用工作记忆跟踪任务状态并选择技能,通过验证门控局部更新记忆形成递归进化,在 35/37 个模型基准对提升长时程成功率且最长任务增益达 32.2 分

arXiv: 2608.24876v1

094

FID 隐藏了什么:生成式评估中偏差的检测、排序与诊断

What FID Hides: Detecting, Ranking, and Diagnosing Deviations in Generative Evaluation

该文提出综合六项位置与离散统计量的 ZID 并用排列校准,发现 FID 会被仅匹配均值协方差的噪声图像欺骗,且能区分欠离散与过离散

arXiv: 2608.24881v1

095

SWE Refactor Bench:编码智能体能否完成长周期、全仓库技术栈迁移?

SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?

该论文提出 SWE Refactor Bench 基准,用三阶段评估 20 项全仓库迁移任务,发现 8 个前沿编码模型仅 5.4% 能完成迁移并保持行为正确

arXiv: 2608.23564v1

096

ReWorld:一种具有长时程记忆的交互式世界模型

ReWorld: An Interactive World Model with Long-Horizon Memory

ReWorld 通过混合注意力窗口分离控制与记忆训练,配合位姿索引地标库和有界键值缓存,在 64 秒往返后仍能重建起始视图并实时生成视频

arXiv: 2608.23565v1