每日速览 · 10月2日

AI圈大事记 · 10月02日速览

10月2日 周五10 条
AI 聚合

本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。

本期涵盖视觉框架提升Claude ARC成绩、网安工具调用与少步视觉生成新基准及SOTA、评估检索启发论文基准、拟牛顿法优化与全同态加密下强化学习新框架、连续控制RL与3D空间推理新算法及架构、脑MRI评估协议发布,以及零售企业采用Cha…

  1. 01

    VISTA视觉框架让Claude Opus 5.0在ARC-AGI-3达满分

    以极简设计实现无损视觉记忆与主动检索,显著提升多模态模型在复杂交互环境中的长程推理与动作效率。

    10月2日 周五·arXiv cs.AI·AI 88
  2. 02

    KaliBench发布:专测LLM网安工具调用,8B模型微调后比肩685B

    揭示当前LLM网安CLI生成能力极弱,并证明用可验证奖励训练小模型可逼近685B级大模型。

    10月2日 周五·arXiv cs.AI·AI 78
  3. 03

    DMAD对抗蒸馏法实现少步视觉生成SOTA

    免辅助模型的对抗蒸馏新范式,在图像与音视频少步生成评测中全面超越多步教师与已有蒸馏法。

    10月2日 周五·arXiv cs.AI·AI 75
  4. 04

    学者提出ScholarCatalyst基准,评估检索启发新研究论文能力

    揭示当前AI智能体在科研灵感检索上不及传统嵌入检索,指明提升模型专家直觉的训练方向。

    10月2日 周五·arXiv cs.AI·AI 65
  5. 05

    SoftServe:可扩展拟牛顿法优化深度学习

    提供可扩展至大网络的拟牛顿法,在病态任务上优于Adam等基线,为深度学习优化提供新路径。

    10月2日 周五·arXiv cs.AI·AI 65
  6. 06

    新框架HAO解决全同态加密下强化学习多项式发散问题

    解决FHE在RL部署中的核心发散难题,实现零边界突破与策略准确率大幅提升,对隐私保护云端RL落地极具价值。

    10月2日 周五·arXiv cs.AI·AI 68
  7. 07

    FERPO算法提出:用正向KL替代动作微分提升连续控制RL可靠性

    解决连续控制RL中Critic动作微分不可靠痛点,以正向KL促探索并提升采样与计算效率。

    10月2日 周五·arXiv cs.AI·AI 62
  8. 08

    GeoLatent提出新空间推理架构,刷新两项3D基准成绩

    解决连续潜变量表征空间关系易坍缩难题,显著提升3D空间推理准确率并刷新基准。

    10月2日 周五·arXiv cs.AI·AI 65
  9. 09

    MIRTO脑MRI无监督异常分割评估协议发布

    揭示评估管线隐性选择对模型排名的巨大影响,提供更严谨的脑MRI异常分割评估框架。

    10月2日 周五·arXiv cs.AI·AI 62
  10. 10

    Albertsons采用ChatGPT Enterprise与OpenAI A…

    展示大模型企业版在零售行业的实际落地,兼顾内部提效与外部体验优化。

    10月2日 周五·OpenAI 官方博客·AI 65

本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。