每日速览 · 10月2日
AI圈大事记 · 10月02日速览
10月2日 周五10 条
AI 聚合
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
本期涵盖视觉框架提升Claude ARC成绩、网安工具调用与少步视觉生成新基准及SOTA、评估检索启发论文基准、拟牛顿法优化与全同态加密下强化学习新框架、连续控制RL与3D空间推理新算法及架构、脑MRI评估协议发布,以及零售企业采用Cha…
- 01
VISTA视觉框架让Claude Opus 5.0在ARC-AGI-3达满分
以极简设计实现无损视觉记忆与主动检索,显著提升多模态模型在复杂交互环境中的长程推理与动作效率。
10月2日 周五·arXiv cs.AI·AI 88 - 02
KaliBench发布:专测LLM网安工具调用,8B模型微调后比肩685B
揭示当前LLM网安CLI生成能力极弱,并证明用可验证奖励训练小模型可逼近685B级大模型。
10月2日 周五·arXiv cs.AI·AI 78 - 03
DMAD对抗蒸馏法实现少步视觉生成SOTA
免辅助模型的对抗蒸馏新范式,在图像与音视频少步生成评测中全面超越多步教师与已有蒸馏法。
10月2日 周五·arXiv cs.AI·AI 75 - 04
学者提出ScholarCatalyst基准,评估检索启发新研究论文能力
揭示当前AI智能体在科研灵感检索上不及传统嵌入检索,指明提升模型专家直觉的训练方向。
10月2日 周五·arXiv cs.AI·AI 65 - 05
SoftServe:可扩展拟牛顿法优化深度学习
提供可扩展至大网络的拟牛顿法,在病态任务上优于Adam等基线,为深度学习优化提供新路径。
10月2日 周五·arXiv cs.AI·AI 65 - 06
新框架HAO解决全同态加密下强化学习多项式发散问题
解决FHE在RL部署中的核心发散难题,实现零边界突破与策略准确率大幅提升,对隐私保护云端RL落地极具价值。
10月2日 周五·arXiv cs.AI·AI 68 - 07
FERPO算法提出:用正向KL替代动作微分提升连续控制RL可靠性
解决连续控制RL中Critic动作微分不可靠痛点,以正向KL促探索并提升采样与计算效率。
10月2日 周五·arXiv cs.AI·AI 62 - 08
GeoLatent提出新空间推理架构,刷新两项3D基准成绩
解决连续潜变量表征空间关系易坍缩难题,显著提升3D空间推理准确率并刷新基准。
10月2日 周五·arXiv cs.AI·AI 65 - 09
MIRTO脑MRI无监督异常分割评估协议发布
揭示评估管线隐性选择对模型排名的巨大影响,提供更严谨的脑MRI异常分割评估框架。
10月2日 周五·arXiv cs.AI·AI 62 - 10
Albertsons采用ChatGPT Enterprise与OpenAI A…
展示大模型企业版在零售行业的实际落地,兼顾内部提效与外部体验优化。
10月2日 周五·OpenAI 官方博客·AI 65
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。