英伟达 AVO Agent 在 ARC-AGI-3 基准取得满分:系统架构完胜模型能力
英伟达 AVO 智能体架构在 ARC-AGI-3 交互推理基准取得 100.00 分,完成全部 183 个关卡、共执行 6624 次环境动作;证明系统级架构能把模型能力转化为持续自主推进,呼应「真正的英雄是 harness 而非模型」的行业判断。
英伟达 AVO 智能体架构在 ARC-AGI-3 交互推理基准取得 100.00 分,完成全部 183 个关卡、共执行 6624 次环境动作;证明系统级架构能把模型能力转化为持续自主推进,呼应「真正的英雄是 harness 而非模型」的行业判断。