AI资讯文章2026-7-27Anthropic Opus 5 震撼登场:在 ARC-AGI-3 真实智力基准测试中碾压 GPT-5.6 SolAnthropic 最新发布的 Claude Opus 5 模型在 ARC-AGI-3 真实智力基准测试中取得了 30.2% 的惊人成绩,远超 OpenAI 的 GPT-5.6 Sol。本文深入解析 Opus 5 在逻辑推理、自主规划等方面的突破,以及独立测试带来的模型泛化争议。
Anthropic Opus 5 震撼登场:在 ARC-AGI-3 真实智力基准测试中碾压 GPT-5.6 Sol
Anthropic 最新发布的 Claude Opus 5 模型在 ARC-AGI-3 真实智力基准测试中取得了 30.2% 的惊人成绩,远超 OpenAI 的 GPT-5.6 Sol。本文深入解析 Opus 5 在逻辑推理、自主规划等方面的突破,以及独立测试带来的模型泛化争议。