简体中文 English 日本語 Русский язык 한어

36

主题

15

回帖

60

修为

创始合伙人

积分
112
QQ
赵图图 2026-8-25 11:52:40 | 显示全部楼层 | 阅读模式


作者:@天选嘉鲤敦赵图图

ARC-AGI-3 公开集满分?拆解英伟达 AVO:智能体系统≠新大模型

ARC-AGI-3 公开集满分?拆解英伟达 AVO:智能体系统≠新大模型


一句话导读:有人说某系统把 ARC-AGI-3 公开测从约 30% 拉到 100%;视频拆解英伟达 AVO,并提醒:满分公开集 ≠ 已证明 AGI。

核心内容:
1. 背景:AVO 相关成绩覆盖大量陌生环境/关卡;AGI 强调跨领域未见问题的适应,学界并无统一「过线即诞生」标准。
2. ARC 思路:重视学习新事物的效率而非背知识;ARC-AGI-3 把静态题变成陌生互动小游戏——无规则说明,需探索、推断、记忆并以更少操作通关;评分兼顾完成率与操作效率,并与新手人类对比。
3. AVO 实质:不是新底座大模型,而是套在模型外的智能体操作系统——长期记忆、工具调用、执行反馈、监督智能体复盘换路,可连续工作多日。
4. 冷静点:公开集满分不等于私有正式集;系统工程加成 ≠ 单一模型已达通用智能。先看评测设定与可复现边界,再谈「AGI 来了」。

适用:关注 AGI 评测与智能体系统进展的读者。
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

简体中文
繁體中文
English(英语)
日本語(日语)
Deutsch(德语)
Русский язык(俄语)
بالعربية(阿拉伯语)
Türkçe(土耳其语)
Português(葡萄牙语)
ภาษาไทย(泰国语)
한어(朝鲜语/韩语)
Français(法语)
QQArchiver手机版小黑屋粤ICP备2026002389号-1粤ICP备2026002389号-1 简体中文 English 日本語 Русский язык 한어 |网站地图