AI 圈大事记
每日速览 · 9月29日

AI圈大事记 · 09月29日速览

9月29日 周二8 条
AI 聚合

本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。

本期涵盖:多模态模型原生反思与文生图指令遵循能力提升;强化学习提升LLM科研创意;连续潜空间扩散推理与图神经网络不确定性表示新模型;预测Agent耗Token量方法;OpenAI将发智能体平台;AI科学发现标准引争议。

  1. 01

    UMM-Reflection让统一多模态模型学会原生反思,GenEval提升1…

    无需外部评判器即可实现跨轮次信用分配,让统一模型内生反思闭环,显著提升生成质量与泛化能力。

    9月29日 周二·arXiv cs.AI·AI 72
  2. 02

    AI Night-Scientist框架用强化学习提升LLM科研创意

    突破LLM低熵同质化局限,用RL让模型学会非预测性推理,大幅提升科研构思多样性与原创性。

    9月29日 周二·arXiv cs.AI·AI 72
  3. 03

    LFRM模型用连续潜空间扩散做推理,小骨干刷新数学与代码评测

    仅638M参数的扩散模型在推理任务上超越同规模基线,为小模型做复杂推理提供新范式。

    9月29日 周二·arXiv cs.AI·AI 68
  4. 04

    新方法TokenCast可预测LLM Agent执行耗Token量

    解决Agent运行Token消耗难预测问题,实现动态预算控制,显著降低开销与预测误差。

    9月29日 周二·arXiv cs.AI·AI 65
  5. 05

    NeurIPS 2026 论文提出 DSS-GNN 统一图神经网络不确定性表示

    用单一框架同时解决 GNN 的校准、OOD 检测与分布偏移鲁棒性,并在多项基准测试中取得领先表现。

    9月29日 周二·arXiv cs.AI·AI 65
  6. 06

    新框架VVR提升文生图指令遵循能力,SD3.5准确率升至28.3%

    提供可编程验证的视觉奖励,显著解决文生图空间/数量指令不跟问题,提升模型泛化与人类偏好。

    9月29日 周二·arXiv cs.AI·AI 68
  7. 07

    OpenAI被曝将发Aeon智能体平台,追赶持续运行代理赛道

    头部厂商入局持续运行智能体,需整合竞品优势并攻克安全痛点,影响代理赛道格局。

    9月29日 周二·The Verge·AI 92
  8. 08

    AI科学发现标准引争议:破解难题仍遭质疑

    揭示AI科学突破面临的信任危机与标准争议,关乎从业者如何客观评估AI科研价值。

    9月29日 周二·MIT Technology Review·AI 65

本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。