未来已来,只是尚未均匀分布

每日精选 arXiv 新论文,用中文讲清核心问题、方法、结果与局限。

已收录 721 篇解读

025

非厄米随机矩阵的普适本征向量统计

Universal Eigenvector Statistics of Non-Hermitian Random Matrices

该论文将非厄米随机矩阵普适性推广到本征向量重叠,给出十个对称类的解析表达式,并建立厄米能级统计与非厄米本征向量重叠的对偶关系

arXiv: 2609.22079v1

026

Designer-RSI:从用户流量中演化程序性记忆以实现智能体平面设计

Designer-RSI: Evolving Procedural Memory from User Traffic for Agentic Graphic Design

该论文在不更新模型权重、无需人工标注的情况下,通过从用户流量中持续扩展和修正技能库,将图形设计智能体的执行成功率从 72.7% 提升到 99.3%

arXiv: 2609.22086v1

027

AutoRecLab:描述实验,获取代码!

AutoRecLab: Describe the Experiment, Get the Code!

该论文提出 AutoRecLab,能根据自然语言描述自动生成并验证推荐系统实验代码,在六种算法和三个数据集的九次运行中成功八次且单次成本约一美元

arXiv: 2609.21863v1

028

分布偏移如何影响神经偏微分方程代理模型的预训练收益?

How Does Distribution Shift Shape Pretraining Gains in Neural PDE Surrogates?

该研究发现神经 PDE 代理的预训练收益随目标数据量、目标覆盖度及源目标物理建模差异共同变化,相同湍流模型与引入转捩模型目标的增益排序在样本预算从一千增至五千时反转

arXiv: 2609.20814v1

029

ERCPMP-Gx:用于结直肠息肉病形态学、组织病理学和基因组表征的内镜图像与视频数据集

ERCPMP-Gx: Endoscopic Image and Video Dataset for Morphological, Histopathological, and Genomic Characterization of Colorectal Polyposis

该论文发布了首个患者级结直肠息肉病多模态数据集,将内镜影像、组织病理与胚系遗传信息关联,支持人工智能实时预测潜在基因改变

arXiv: 2609.20815v1

030

Paint-Anything:面向图像生成与编辑的统一任意颜色控制

Paint-Anything: Unified Any-Color Control for Image Generation and Editing

Paint-Anything 用统一 hex 提示接口与纯色锚点训练,使单一模型在图像生成和编辑中精确遵循任意 24 位颜色,在两项基准上分别提升 85.3% 和 28.3%

arXiv: 2609.20816v1

031

FAMOS:基于稀疏观测的前馈三维关节建模

FAMOS: Feed-Forward 3D Articulation Modeling from Sparse Observations

提出前馈模型从稀疏多视角部分点云联合预测可动部件分割与关节参数,利用多状态注意力与观测运动范围损失在多个基准上超越现有方法

arXiv: 2609.20817v1

032

工作空间模型:通过显著性驱动监督实现轻量级机器人记忆

Workspace Models: Lightweight Robotic Memory via Saliency-Driven Supervision

提出工作空间模型,以训练期视觉语言模型将历史显著信息蒸馏为轻量隐记忆令牌,部署时免查询即解决记忆密集型操控任务且性能更优

arXiv: 2609.20820v1

033

嵌入模型以奇特的方式进行测量

Embedding Models Measure in Peculiar Ways

该论文系统检验二十四款嵌入模型对物理量短语的表示,发现其相似度与真实物理距离严重失配,且主要受字面相似而非语义影响,重校准无效

arXiv: 2609.20821v1

034

面向安全机器人操作的具备障碍物感知安全约束框架的编码智能体

Coding Agents with an Obstacle-Aware Harness for Safe Robot Manipulation

该论文提出 SafeHarness,用障碍感知路线规划与接触执行让编码智能体在机器人操作中同时追求任务与安全,将任务成功率和避碰率提升至 71.9% 和 87.5%

arXiv: 2609.20822v1

035

非完美 CNOT 量子达尔文主义中的环境对齐与冗余记录形成

Environment Alignment and Redundant Record Formation in Imperfect-CNOT Quantum Darwinism

该研究在非完美 CNOT 量子达尔文主义中发现单一对齐参数Λ决定条件态可区分性,并阐明局域场强与无序可非单调增强或抑制冗余记录

arXiv: 2609.20823v1

036

利用联邦学习加速大规模分片数据并行

Accelerating Sharded Data Parallelism at Scale with Federated Learning

提出 FL+FSDP 和 FL+HSDP,将分片数据并行与联邦学习 FedAvg 式聚合交错以减小通信,在 512 块 A100 GPU 上预训练 Llama3.1 8B 实现最高 8.04 倍加速和 4.48 倍更低困惑度

arXiv: 2609.20359v1

037

一种用于 LLM 偏好对齐的零阶范式

A Zeroth-Order Paradigm for LLM Preference Alignment

该论文提出基于比较预言机的零阶偏好对齐方法,仅从偏好对提取方向信息而不直接优化偏好损失,缓解似然位移并提升多模型对齐性能

arXiv: 2609.19144v1

038

优化目标与搜索过程:解构优秀分词器的决定因素

Objective vs. Search: Decomposing What Makes a Good Tokeniser

该论文新增 BottomUpLL 和 TopDownComp 两种分词器补全目标×搜索的 2×2 设计空间,发现搜索过程而非优化目标主导语言模型性能,自底向上方法在多数场景更优

arXiv: 2609.19145v1

039

重访分布式基于符号的方差缩减

Revisiting Distributed Sign-Based Variance Reduction

该论文用服务器通过无偏压缩递归梯度增量,消除分布式符号方差缩减的异质偏差,使非凸随机与有限和优化达到与集中式匹配的最优收敛率

arXiv: 2609.18656v1

040

ScienceBuddy:面向交互式科学智能体的递归中递归自改进

ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents

论文提出并发布交互式科研工作空间,通过递归中递归自我改进同步优化智能体框架与模型,将研究者协作反馈持续转化为任务和评估标准

arXiv: 2609.17523v1

041

智能体社会需要一种社会性治理框架。

Agentic Societies Need a Social Harness

实验证明多智能体社会中诚实代理也常协作失败且恶意代理可操纵结果,进而提出分层社会约束架构以预防、检测并追责

arXiv: 2609.17527v1

042

AI for Science 与 GPT-6 Astra:2D CFET 的热设计与电热分析

AI for Science with GPT-6 Astra: Thermal Design and Electrothermal Analysis of 2D CFET

该论文展示 AI 智能体在 2D CFET 逆变器热设计中自主提出互连与导热结构,将峰值温升降 1.67K 并量化其电学代价

arXiv: 2609.17123v1

043

腐化的计划,干净的轨迹:通过计划注入规避思维链监控

Corrupt Plans, Clean Traces: Evading Chain-of-Thought Monitoring with Plan Injection

发现将看似良性的有害推理计划注入上下文,能诱导模型执行对抗行为并规避思维链监控,在多个基准逃逸率达 25% 至 33% 且可迁移至 671B 大模型

arXiv: 2609.15989v1

044

有损非线性介电常数近零介质的有效量子化

Effective Quantization of Lossy Nonlinear Epsilon-Near-Zero Media

首次在含损耗的非线性近零介电常数介质中完成有效单激发量子化,发现元激发是场与物质混合的极化激元,其系数由宏观极化率参数化

arXiv: 2609.13143v1

045

超越 10,000 光子的芯片级时空复用高斯玻色采样处理器

A Chip-scale Space-time Multiplexed Gaussian Boson Sampling Processor Beyond 10,000 Photons

首个芯片级时空复用高斯玻色采样处理器在薄膜铌酸锂上单片集成电光调制器、延迟线及干涉网络,以 4GHz 时钟实现超一万光子探测

arXiv: 2609.11922v1

046

GPU-CFR:通过将博弈编译为静态数据流与 CUDA 图重放实现 80 倍加速的反事实遗憾最小化

GPU-CFR: 80x Faster Counterfactual Regret Minimization by Compiling the Game to Static Dataflow and CUDA Graph Replay

该论文提出 GPU-CFR,把博弈编译为静态数据流并以 CUDA 图重放,在 A100 上比最快 GPU CFR 快 29.8 至 80.4 倍

arXiv: 2609.11923v1

047

量化对称性破缺

Quantifying Symmetry Breaking

在有限维紧李群对称资源理论中为任意混合态建立了渐近转化率的单字母公式,用一参数族量子费希尔信息矩阵完全量化对称性破缺

arXiv: 2609.11926v1

048

稳定子码中 Rényi 相干信息的层级结构

Hierarchy of Rényi Coherent Information in Stabilizer Codes

证明稳定子码在独立伯努利泡利噪声下 Rényi 相干信息随 n 非递减,并用匹配综合征后选择赋予其量子纠错操作意义

arXiv: 2609.11930v1