每日速览 · 9月29日
AI圈大事记 · 09月29日速览
9月29日 周二8 条
AI 聚合
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
本期涵盖:多模态模型原生反思与文生图指令遵循能力提升;强化学习提升LLM科研创意;连续潜空间扩散推理与图神经网络不确定性表示新模型;预测Agent耗Token量方法;OpenAI将发智能体平台;AI科学发现标准引争议。
- 01
UMM-Reflection让统一多模态模型学会原生反思,GenEval提升1…
无需外部评判器即可实现跨轮次信用分配,让统一模型内生反思闭环,显著提升生成质量与泛化能力。
9月29日 周二·arXiv cs.AI·AI 72 - 02
AI Night-Scientist框架用强化学习提升LLM科研创意
突破LLM低熵同质化局限,用RL让模型学会非预测性推理,大幅提升科研构思多样性与原创性。
9月29日 周二·arXiv cs.AI·AI 72 - 03
LFRM模型用连续潜空间扩散做推理,小骨干刷新数学与代码评测
仅638M参数的扩散模型在推理任务上超越同规模基线,为小模型做复杂推理提供新范式。
9月29日 周二·arXiv cs.AI·AI 68 - 04
新方法TokenCast可预测LLM Agent执行耗Token量
解决Agent运行Token消耗难预测问题,实现动态预算控制,显著降低开销与预测误差。
9月29日 周二·arXiv cs.AI·AI 65 - 05
NeurIPS 2026 论文提出 DSS-GNN 统一图神经网络不确定性表示
用单一框架同时解决 GNN 的校准、OOD 检测与分布偏移鲁棒性,并在多项基准测试中取得领先表现。
9月29日 周二·arXiv cs.AI·AI 65 - 06
新框架VVR提升文生图指令遵循能力,SD3.5准确率升至28.3%
提供可编程验证的视觉奖励,显著解决文生图空间/数量指令不跟问题,提升模型泛化与人类偏好。
9月29日 周二·arXiv cs.AI·AI 68 - 07
OpenAI被曝将发Aeon智能体平台,追赶持续运行代理赛道
头部厂商入局持续运行智能体,需整合竞品优势并攻克安全痛点,影响代理赛道格局。
9月29日 周二·The Verge·AI 92 - 08
AI科学发现标准引争议:破解难题仍遭质疑
揭示AI科学突破面临的信任危机与标准争议,关乎从业者如何客观评估AI科研价值。
9月29日 周二·MIT Technology Review·AI 65
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。