未来已来,只是尚未均匀分布
529
视频模型是否已具备零样本推理能力?基于 MME-CoF 基准的实证研究
530
生成模型输出(不)正确性评估的 E 分数
531
Gaperon:一款多功能的英法生成式语言模型套件
532
单循环一阶算法求解线性约束双层优化问题
533
生成式视图拼接
534
追踪、修复、重绘:基于渐进纹理填充的主体驱动 3D 与 4D 生成
535
变分掩码扩散模型
536
对比等变性:从未标记有限群作用中识别等变嵌入
537
论 LLM 生成文本的可检测性:究竟何为 LLM 生成文本?
538
微末草稿,重大裁决:基于推测的信息密集型视觉推理
539
GSWorld:机器人操作闭环照片级真实感仿真套件
540
KL 正则化强化学习旨在应对模式崩溃问题
541
VAMOS:一种能力可调与可控导航的分层视觉-语言-行为模型
542
迈向通用模态转换:基于对比与预测潜在扩散桥的研究
543
Pico-Banana-400K:面向文本引导图像编辑的大规模数据集
544
哈勃:推进大语言模型记忆研究的一套模型
545