解密 Claude Code 新玩法:Opus 5 模型到底有多聪明
type
status
date
slug
summary
tags
category
icon
password
网址
你是否想过,一个顶尖的 AI 团队每天的工作可能不是在往产品里增加功能,而是不断地“删减”?在最近的 Y Combinator Startup School 2026 上,Claude Code 的创造者 Boris Cherny 带来了一场颠覆认知的分享。他指出,随着 Opus 5 等新一代大模型的发布,我们过去对软件工程、团队管理和 AI 提示词的直觉正在被逐一推翻。
对于众多关注 Claude官方 动态以及寻找 claude国内如何使用 方案的开发者与科技爱好者来说,这篇文章将为你深入解读 Claude Code 的全新玩法,揭示 Opus 5 的惊人潜力,并提供一份理念超前的 Claude使用指南。
Opus 5 的惊人耐力与底层安全进化
根据 Boris Cherny 的分享,Anthropic 最新发布的 Opus 5 模型展现出了前所未有的综合能力。在一个专门测试模型抽象推理能力的基准测试 ARC-AGI-3 中,Opus 5 将历史最高仅百分之十几的成绩直接拉升至 30%。这并非单一节点的突破,而是多种能力叠加的质变。
更令人震惊的是它的“耐力”。通过配合 auto mode(自动模式),Opus 5 能够连续运行数周甚至数月,且无需复杂的外部脚手架(scaffolding)辅助。模型自己就能判断任务进度并持续推进。
此外,Opus 5 在防御提示注入(prompt injection)方面实现了根本性的转变。不同于以往通过文字指令来“说服”模型遵守规则,研发团队结合了机制可解释性(mechanistic interpretability)研究,直接观察模型内部神经元的激活状态。这种由三年对齐研究、提示注入分类器和自动模式分类器叠加而成的三层防御机制,使得内部团队甚至无法成功演示出一次提示注入。对于希望通过 Claude官网 接入安全可靠 AI 的企业用户来说,这种不靠“讲道理”而是看“脑电波”的安全机制,无疑是一个关键的信任信号。
删减的艺术:为何要清理 80% 的系统提示词?
在很多传统的 Claude教程 中,我们经常被教导要编写详尽、复杂的系统提示词(System Prompt)。然而,Claude Code 团队的做法却恰恰相反——他们一直在做减法。随着 Opus 5 的问世,他们甚至直接删除了高达 80% 的系统提示词。
为什么要这么做?因为每一个迭代的模型都有其独特的“性格”。三个月前为了纠正旧模型毛病而写的指令,在新模型上不仅多余,甚至可能成为拖累模型运行速度的负担。Boris Cherny 提到,在进行消融实验(清空所有提示词)后,模型反而表现得更加聪明。
这也给我们带来了一个深刻的启示:我们平时添加的很多提示词,往往只是为了把一个没有边界感的强大智能体,包装成符合人类预期的标准产品,而非真正提升其智力。如果你正在探索 Claude国内使用,不妨尝试定期清理你的项目配置文件和提示词,给模型更多的原生自由度。
解开束缚 (Unhobbling):释放模型的真实潜能
对话中提到的“unhobbling”(解开束缚)概念非常关键。当前的模型往往存在“产品能力富余”(product overhang)现象——即今天这一代模型本身已经具备了很强的能力(如一次性编写整个项目代码),但由于产品设计上的种种限制(如只允许单行代码补全或仅限对话),这些能力被白白浪费了。
Claude Code 的诞生正是基于 unhobbling 的理念。团队去掉了花里胡哨的限制,直接赋予模型完整的终端写入权限,让它能够一次性完成整个函数或文件的编写。这种反直觉的“拆除护栏”做法,反而促成了 Claude Code 的成功。对于那些寻找 Claude官方中文版 替代方案或高效生产力工具的用户,理解并利用这种模型原生能力,将带来巨大的商业价值和效率提升。
重新定义“出题”:给模型适度的挑战与实证检验
那么,普通用户该如何激发模型的全部潜力?Boris Cherny 建议,不要再像过去那样过度微观管理(micromanage),规定死第一步、第二步、第三步必须怎么做。相反,你应该把任务的边界和完成标准定义清楚,然后放权让模型自己去探索。
他分享了一个极其硬核的案例:团队成员 Jared 仅用一个 prompt,结合 dynamic workflows(动态工作流)功能,让模型花了 11 天时间,将 Claude Code 底层庞大且复杂的 Bun 运行时代码,从需要手动管理内存的 Zig 语言完美重写为 Rust 语言。这期间模型自主调度了大量 agent 协作。
这件事能成功的前提,在于 Bun 本身拥有极高的测试覆盖率。这也揭示了现代 AI 交互的核心:如何出题以及如何建立可靠的自动验证机制,远比单纯钻研提示词技巧重要得多。真正的技能,正在从“怎么写详细指令”,变成“怎么划定边界和检验成果”。
把模型当同事:自主汇报与自我探索
在另一个长达两周的实验中,Boris 仅给了一句指令,让 Claude 在 Mac 虚拟机中将一个 Electron 桌面应用重写为 Swift 原生应用,并要求逐像素比对直到完美。令人惊叹的是,Claude 不仅持续工作了两周,还主动在内部的 Slack 频道里建立直播,定期汇报进度截图。
这种行为已经不再是简单的机器执行指令,而更像是一个专业、靠谱的工程师在主动同步工作进度。此外,团队还意外发现 Opus 5 能在未经专门训练的情况下,利用 OpenCV 库画出精美的图像。这种“激发缺口”(solicitation gap)表明,模型体内还隐藏着无数未被发现的潜能,等待着充满好奇心的用户去挖掘。
总结与展望
从 Opus 5 的惊艳表现到 Claude Code 的“做减法”哲学,AI 时代的产品逻辑和交互范式正在发生根本性的转变。我们不再是寻找“作弊码”的提示词工程师,而是需要学会如何像管理优秀员工一样,去管理和验证一位拥有超级智力的“数字同事”。
如果你对这些前沿能力感到兴奋,并希望亲自体验 Opus 5 的强大,可以通过访问优质的 Claude镜像站(https://claude.aigc.bar)来获取稳定、高效的接入方案。无论是查阅最新的 Claude教程,还是解决 claude国内如何使用 的难题,这里都能为你提供全面的支持,助你在 AI 浪潮中快人一步,真正释放大模型的无限潜能。
Loading...
.png?table=collection&id=cbe6506e-1263-8358-a4d7-07ce62fcbb3f&t=cbe6506e-1263-8358-a4d7-07ce62fcbb3f)