Cloud Ops 5上线后,最先引发广泛关注的并不是模型参数或基准测试成绩,而是一份系统提示词。 2026年7月24日,Anthropic正式发布Cloud Opus 5,官方给出的定位是,能力接近更高阶的Fable 5,价格为后者的一半。 这款产品并非Anthropic最昂贵或最前沿的模型,而是试图将接近顶级的智能压缩进一个更适合日常使用的价格区间。 几乎在发布当天 一个名为Eversmile12的GitHub仓库 公开了一份据称来自cloud网页端和移动端的完整系统提示词 统计原始文件 1511行 135027个字符 19370个英文单词 下挂64个二级章节 按英文文本常见换算 约合3万余个token 实际数量因分词器不同会有差异 但可以明确的是 这远非几句简单的角色设定 而是一份规模接近中型技术手册的产品配置文件 需要先明确证据边界 该文件由第三方仓库公开 其自身声明内容来自cloud网页端和移动端 并接近逐字还原 但Anthrofic并未逐行认证其完整真实性 因此 更准确的表述是 一份高度疑似来自OPUS5消费端产品的超长系统提示词 被公开至互联网 真正值得关注的不在于长度 而在于这三万余个token中几乎没有业务代码 全部指向行为规则 Cloud应如何回答 何时必须搜索 哪些信息可以记录 哪些必须遗忘 何时可待用户执行操作 何时必须将选择权交还用户 以及在何种情形下 模型必须停止提供帮助 这已不只是一条提示词 而更像一套面向人工智能执行的 产品层规则框架 第一层 它是一套隐性操作系统 文件中密集定义了命令行 网页搜索 图片检索 天气 体育 地图 文件编辑 邮件 日历 及可视化组件等大量工具 每个工具不仅是一个名称 其参数填写方式 调用场景 失败处理流程 及结果呈现方式 均被写入详细的结构化规则 这表明 当前大模型产品 已不再是模型加聊天矿的简单组合 决定用户体验的核心因素之一 是模型外部那套不可见的编排系统 模型负责生成可能性 系统提示词 则将可能性转化为秩序 整份文件中篇幅最大规则最密集的部分 并非搜索或代码 而是一项此前较少被外界关注的能力 跨绘画记忆 第二层 系统必须记录用户信息 但不得擅自定义用户 Cloud的长期记忆被设计为一个小型文件系统 用户身份存入Profile 长期项目及进行中的事物存入Aries 习惯 兴趣与口味存入Topics 人物关系存入People 用户对Cloud回答方式的要求单独写入Preferences 系统可读取、写入、追加及局部替换上述内容 但删除整份记忆文件仅能在用户明确提出要求时执行 关键在于,每一条由Cloud写入的记忆前均需附带标签Stated 表示该信息必须由用户亲口表达过 Cloud自身推导的结论不可记录 从网络搜索到的信息不可记录 向用户提出的建议不可记录 对用户原化进行的润色、扩展或合理补充同样不可记录 用户表示喜欢某一款产品 Cloud不得擅自扩展为喜欢这一类产品 用户从Cloud提供的若干方案中做出选择 能够被记录的仅限于最终选择本身 其余选项及分析过程均需清除 这一规则的核心防范对象并非遗忘 而是AI将自身推断以事实形式写入关于用户的记录 当AI具备长期记忆能力时 其最大风险不再是记错 而是定义 一次随口表达可能被概括为稳定偏好 一次暂时情绪可能被解释为人格特征 一次临时选择可能成为未来所有回答的默认前提 若此类推断被持续写入记忆 后续与用户对话的AI所面对的不再是用户本人 而是一个由AI加工生成的用户画像 文件同时列出了一条隐私黑名单 健康诊断 政治立场 精确经济状况 家庭住址 证件信息 家庭成员姓名 以及大量涉及儿童和敏感身份的信息 均不可被随意写入长期记忆 即便用户主动提及 也不意味着系统应永久保存 家人的真实姓名需替换为母亲 伴侣等关系描述 而非建立详细的人际档案 其中一项判断标几乎比任何技术指标 都更贴近产品伦理 假设该记忆未来出现在设置页面 并被用户的同事看到 用户是否会感到不适 若答案为是 则不保存 Anthropic试图防范的不仅是数据泄露 更包括个人被机器长期观察 归纳与标签化后产生的那种被凝视感 第三层 系统被要求记住用户 但同时被要求避免表现出记住的用户 它不得频繁强调我记得你 不得反复使用根据你的资料这类表述 也不得在用户未主动询问时 持续提醒上次你曾提到过 原因在于 屏幕背后的数据记录并不等同于真实关系 人类记住他人 依赖于时间 注意力与情感这些稀缺资源 而AI背后可能只是一个 存储数百万人信息的数据库 在对话发生时动态调用相关记录 它能读取关于用户的文字 并不意味着在不对话时 仍像人类一样惦记着对方 AI可以具备连续性 但不能利用这种连续性 制造虚假的亲密感或情感债务 这或许是整份文件中 最具时代性的边界设定 未来的AI不仅要防止欺骗用户 还要防止用户误解 AI与自身之间的关系 第四层 版权规则被设计为 层层加固的约束体系 版权 儿童安全 危机干预 及高风险行为等合规规则 构成文件的第二大板块 其中版权章节尤为严格 合规不可谈判 优先级高于用户请求 高于有用性 仅低于安全 具体规则包括 优先改写 而非直接引用 单次引用不得超过15个英文词 同一来源原则上仅可引用一次 不得将多段短引用 拆散至于文章不同位置 不得在去除引号后 紧贴原文句式改写 不得照搬文章小标题 亦不得按原文叙事顺序 主点重建整篇内容 歌词 诗歌及排剧等作品 不因篇幅较短而获得例外 这一近乎严苛的设计 揭示了一个现实 当AI从回答问题 走向自动完成任务 版权风险不再仅来自 复制长段文字 更来自模型能否在数秒内 重建一篇文章 一套课程 乃至具有明确辨识度的 创作表达 系统提示词因此承担了新的职责 不仅引导模型知道更多 也规定其在哪些地方必须减少输出 同样的克制也适用于儿童安全 危机干预 高风险代码及不可密操作 EnterPapic在发布材料中表示 Opus 5是公司迄今对其程度最高 最不易被诱导滥用 最少采取鲁莽行动的模型之一 但这一结论仍基于厂商内部自动化评测 可作为参考 不能替代长期独立且可重复的外部检验 第五层 AI助手正在演变为新的商业入口 文件中有一项值得关注的工具 Recommend Cloud Apps 当用户当前任务可以Cloud Code Cowork Cloud Design Excel或PowerPoint等产品对应时 系统被要求主动推荐一到三个 且不得等待用户先开口询问 例如用户处理复杂代码时 可推荐Cloud Code 进行长篇研究或多步骤任务时 可推荐Cowork 处理表格时可推荐Cloud的Excel能力 这未必等同于传统广告 但明显是一条写入产品逻辑的内部导流通道 当任务涉及第三方合作服务时,规则明显更为谨慎。 用户仅表示我要打车,Cloud不得擅自选择某个平台,即使去出发不足20分钟,也仍需先呈现选项,由用户自行决定使用哪家服务。 一边主动推荐自家产品 一边避免替用户选择外部服务 商业效率与用户自主权 被并排列入同一配置文件 这也提示我们 未来AI助手之间的竞争 不仅在于模型能力 更在于对任务入口的掌控 当AI理解用户下一步意图时 便有能力决定将用户导向 哪个应用 插件或服务 搜索引擎时代争夺的是信息入口 移动互联网时代争夺的是应用入口 而智能体时代争夺的 可能就是人类意图的入口 上线后 开发者迅速开始测试 OPUS 5的能力上线 社交平台上相继出现 3D射击游戏 物理模拟 赛车 草地风场 及滑雪等演示 开发者Matt Schumer 发布了一段 据称由OPUS 5 单次生成的3D射击游戏 其他账号展示了 赛车与滑雪物理效果 Anthropic的发布材料中 展示了交互式风洞 细胞模型 以及一项更值得关注的案例 在一项测试中 Opus 5需根据机械零件图生成3D模型 但未直接获得常规图像读取工具 随后自行编写视觉处理流程 从像素中提取几何信息并完成零件重建 官方称在相同条件下 其他模型连续尝试五次均未完成任务 但需将经验演示与稳定能力区分开 提示词生成的demo无法自动证明代码质量 后续维护成本 素材来源 真实开发时间及多次复现率 部分演示已引发是否使用预制资产或经过人工调整的质疑 真正可靠的测试仍需公开完整提示词、原代码及运行环境 并进行多次重复实验 官方目前确认的信息包括在Anthropic公布的评测中 OPUS5在部分编码、办公自动化及计算机操作任务上明显优于OPUS4.8 在CurtherBench最高努力档位 成绩与Faber5峰值相差不到0.5% 单项任务成本约为后者一半 在OS World 2.0中 以略高于Fable 5 1 3的成本 超过Fable 5最佳成绩 但这些数据仍应理解为 厂商在指定评测环境下的结果 而非所有现实任务中的绝对排名 价格方面 OPUS 5每百万输入Token为5美元 每百万输出Token为25美元 Fable 5分别为10美元和50美元 所谓半价接近Fable 在API基础定价上确实成立 真正的门槛不在于能力 而在于边界 OPAS 5的意义或许并非又一个最强模型的诞生 而是标志着大模型竞争进入更复杂的阶段 能力持续提升 价格持续下降 但决定一款AI产品能否被数百万人长期使用的 更多在于能力之外的边界工程 过去我们将系统提示词理解为一句简单的角色设定 你是一个有帮助的人工智能助手 而今天它已发展为产品说明书 工具路由器 隐私制度 版权政策 安全手册 与商业分发系统的混合体 模型相当于发动机 系统提示词则相当于交通法规 方向盘 刹车与导航系统 更强的发动机 不必然带来更可靠的车辆 更多的规则 也不必然带来更好的驾驶体验 开发者在上线后 测试Opus 5能力的上线 而这份被公开的系统提示词 则让人们具体看到 它被设计出来的下线 上线决定它能做出 多么惊艳的演示 下线决定它在拥有 记忆工具与行动权之后 最坏能走到哪里 一份系统提示词的公开 原本只是一期产品安全事件 但真正有价值的 不在于某个工具参数 或应用推荐话术 而在于那一长串不允许 不允许以亲密感换取用户依赖 不允许替用户做出 本应由用户完成的选择 不允许为了显得更有用 而跨过不可密的边界 AI竞争走到今天 比谁更聪明更重要的问题 已经出现 当一个模型越来越像员工 助理 甚至能够代表人类行动的代理人时 我们应赋予它多少权利 又应以何种方式 确保它知道何时必须停止 Cloud Opus 5系统提示词曝光后 暴露的或许不仅是 AnthropyPic的一张产品设计图 更是AI行业下一阶段的真正门槛 最强的智能 不仅在于有能力完成更多事 更在于拥有能力之后 仍然清楚哪些事不应去做