Claude 发展史:从宪法 AI 到 Agent 时代的技术进化
〇、总览:这篇文章讲什么
文章系统梳理了 Anthropic 从 2021 年创立到 2026 年 8 月的完整进化史:从 OpenAI 的”出走者”身份出发,以 宪法 AI(Constitutional AI) 为技术基石,五年间走完”安全对齐研究 → 首代对话模型 → 多模态家族 → 混合推理 → Agent 原生 → 1M 上下文 → 第五代模型”的路径,同时完成从”研究实验室”到”全球估值最高的 AI 公司”的商业蜕变(2026 年 5 月 H 轮估值 9650 亿美元,超越 OpenAI)。
全文以 10 个模型版本节点 + 5 项关键研究/论文 + 关键公司事件 为骨干,沿着三条技术主线展开:
- 安全与对齐——如何让模型”不伤害人”(宪法 AI → RLAIF → 红队测试 → Alignment Faking 研究);
- 上下文与效率——上下文长度如何从 9K 一路推到 1M(Context Engineering 的完整实践);
- Agent 能力——从”对话”到”用电脑干活”(工具使用 → Computer Use → MCP → Claude Code → Agent Teams)。
作者最后总结出 Anthropic 的四条方法论:安全是产品而非补丁、渐进式部署、研究驱动不以跑分为纲、押注知识工作的自动化。
📌 数据说明:文中所有评测分数与日期均以 Anthropic 官方博客(anthropic.com/news)与官方 Model Card 为准;2026 年 Q2 之后的部分版本(Opus 4.7/4.8、Mythos 5 等)依赖第三方聚合报道与官方系统卡索引,已在正文与附录 C 标注可靠性等级。
一、发展时间线总表
| 时间 | 事件/模型 | 核心贡献 | 阶段意义 |
|---|---|---|---|
| 2021 | Anthropic 创立 | Amodei 兄妹率 OpenAI 核心团队出走,使命:AI 安全 | 起点:安全派系独立 |
| 2022.04 | HH-RLHF 数据集 | 人类偏好对齐的种子(arXiv<2204>2204>.05862) | 对齐研究奠基 |
| 2021.12 | Context Distillation | 把”长上下文行为”蒸馏进参数(arXiv<2112>2112>.00861) | 效率研究前瞻 |
| 2022.12 | 宪法 AI(分水岭①) | 无需人类反馈的对齐:RLAIF,Claude 的技术基石(arXiv<2212>2212>.08073) | 确立安全技术路线 |
| 2023.03 | Claude 1 + Instant | 首代模型,9K→100K 上下文;主打安全而非跑分 | 首发:对话模型入场 |
| 2023.07 | Claude 2 | 100K 上下文 + claude.ai 公测;律师考试 MBE 76.5% | 首次公开对标 GPT 系 |
| 2023.09 | Amazon 投 40 亿美元 | 云计算巨头押注 | 算力与分发入场 |
| 2023.11 | Claude 2.1 | 200K 上下文 + tool use(测试版),幻觉率降 2 倍 | 长上下文 + 工具使用的起点 |
| 2024.03 | Claude 3 家族(分水岭②) | Opus/Sonnet/Haiku 三档分层,多模态,全面超 GPT-4 | 能力登顶,一档打一个市场 |
| 2024.06 | Claude 3.5 Sonnet | 小模型越级打 Opus 3,agentic 编码 64% vs 38% | 性价比路线确立 |
| 2024.10 | Computer Use | 业界首个 AI”用电脑”公开测试版(OSWorld 14.9%) | Agent 方向公开化 |
| 2024.11 | MCP 开源(分水岭③) | 模型上下文协议标准化;Amazon 追投至 80 亿 | 工具生态开放化 |
| 2025.02 | Claude 3.7 Sonnet | 首个混合推理模型(标准/思考双模式)+ Claude Code 研究预览 | 推理 + 编程双突破 |
| 2025.03 | E 轮 35 亿美元 | 估值 615 亿美元 | 商业起飞 |
| 2025.05 | Claude 4(Opus 4 / Sonnet 4) | Agent 原生一代:并行工具、memory files、Claude Code GA | Agent 能力系统化 |
| 2025.08 | Opus 4.1 | SWE-bench 74.5%,Agentic 能力补强 | 中期迭代 |
| 2025.09 | Sonnet 4.5 + 融资 130 亿 | 估值 1830 亿美元(ICONIQ/富达领投) | 性价比与资本双升 |
| 2025.10 | Haiku 4.5 | SWE-bench 73.3%,低延迟三档补全 | 全价位覆盖 |
| 2025.11 | Opus 4.5(分水岭④) | 首个 SWE-bench Verified 破 80%(80.9%),降价 66% | 编码登顶 |
| 2026.02 | Opus 4.6(分水岭⑤) | 首个 Opus 级 1M 上下文(MRCR v2@1M 76%),四档 effort | 长上下文落地;G 轮估值 3800 亿 |
| 2026.04 | Opus 4.7 | SWE-bench 87.6%(第三方报道) | 第五代前哨 |
| 2026.05 | Opus 4.8 + H 轮 650 亿美元 | 估值 9650 亿美元,超越 OpenAI 成全球最高估值 AI 创企 | 资本巅峰 |
| 2026.06 | Mythos 5 / Fable 5 | 第五代新档位($10/$50),曾遭出口管制风波 | 第五代落地 |
| 2026.06 | 秘密递交 IPO 申请 | 摩根士丹利 + 高盛牵头 | 上市冲刺 |
| 2026.07 | Sonnet 5 / Opus 5 | 第五代主流档位($2/$10、$5/$25);版权和解 15 亿美元获批 | 全面换新 |
五个分水岭:宪法 AI(对齐技术路线)、Claude 3(能力登顶)、MCP(生态开放)、Opus 4.5(编码登顶)、Opus 4.6(1M 上下文)。
二、阶段一:创立——为安全而生的实验室(2021–2022)
1. 出走 OpenAI:Anthropic 的诞生
Anthropic 的故事始于一次”内部路线之争”。2020 年底,OpenAI 内部关于 AGI 安全路线与商业化的分歧公开化:时任副总裁 Dario Amodei、政策负责人 Daniela Amodei 兄妹认为,OpenAI 在”安全研究”与”先发竞争”之间越来越倾斜于后者,且不愿把足够资源投给对齐研究。2021 年,兄妹俩率一批 OpenAI 核心研究员出走(包括后来的首席科学家 Jack Clark、多位参与 GPT-3 训练的研究员),创立 Anthropic(词源 anthropic principle,人择原理)。公司使命一句话:“把 AI 安全当作第一原则来训练模型”,而非事后打补丁。
这个创始基因决定了后面的一切:模型以安全对齐方式命名(Claude),技术路线以对齐研究为起点,发布节奏”慢半拍”但坚持渐进式部署。
2. HH-RLHF:对齐研究的种子(2022.04)
论文卡片:arXiv<2204>2204>.05862《Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback》
Anthropic 成立后第一项标志性工作,是和 RLHF(人类反馈强化学习)绑定在一起的:自建 HH-RLHF 数据集——约 17 万条”helpful(有帮助)vs harmless(无害)“对比样本,让模型学会在”帮人”与”不伤人”之间平衡。这套数据后来成为开源社区对齐研究的公共基础设施,RLHF 也因此有了”Helpful & Harmless”这套评价坐标系。
3. 宪法 AI:Claude 的技术基石(2022.12)
论文卡片:arXiv<2212>2212>.08073《Constitutional AI: Harmlessness from AI Feedback》
这是 Anthropic 最核心的原创工作,也是 Claude 与 GPT/Gemini 的根本差异点。传统 RLHF 需要大量人类标注”哪个回答更无害”,成本高且标准不稳定。宪法 AI 的思路是:把人类价值写进一份”宪法”(一组原则清单,如”不要歧视""不要助长伤害”),让 AI 自己用这份宪法评判并修正自己的回答——即用 AI 反馈替代人类反馈(RLAIF,RL from AI Feedback)。
训练分两步:SL-CAI(用宪法原则让模型自我改写回答,再做监督学习)→ RL-CAI(用宪法原则训练一个 AI 评委,给模型打分做 RL)。由此得到的模型在无害性上匹敌 RLHF 模型,而人类标注成本大降。Claude 的名字与气质都源于此:对齐不是训练后的加固,而是训练本身的坐标。这篇论文也是后来整个”RLAIF/自对齐”研究谱系的开山之作。
同期的两条支线:Red Teaming(红队测试,arXiv<2209>2209>.07858)——让人类”攻击”模型找漏洞,确立安全评估方法;Context Distillation(上下文蒸馏,arXiv<2112>2112>.00861,2021.12)——让模型先用长上下文/长思考作答,再把它”背”进参数,压缩推理成本,是 Claude 系列效率路线的早期伏笔。
三、阶段二:首代 Claude——从 9K 到 200K 上下文(2023.03–2023.11)
1. Claude 1:首发即安全
2023 年 3 月 14 日,Anthropic 发布首代模型 Claude 1(邀请制 API 开放,同月配套更快的轻量版 Claude Instant)。初始上下文 9K token,2023 年 5 月扩至 100K。官方没有发布任何跑分基准——这在当时是反常规的:别的厂商秀 MMLU,Anthropic 只谈宪法 AI 与安全。第三方评测将其定位在 GPT-3.5 档,但”对话气质”(谨慎、愿意说不知道、拒绝有害请求)成为差异化卖点。Claude 1 的意义不在性能,而在于验证了**“安全对齐路线能否做出可用模型”**。
2. Claude 2:100K 与公测(2023.07)
2023 年 7 月 11 日发布,同日开放 claude.ai 公测,API 定价 $8/$24。核心升级:
- 100K 上下文(约 7.5 万词),长文档场景正式可用;
- 官方公布首批可引用成绩:律师考试多选(MBE)76.5%、GRE 阅读/写作高于 90 分位、Codex HumanEval 71.2%、GSM8K 88.0%——首次公开对标 GPT 系旗舰;
- 红队测试下无害响应提升 2 倍。
参数规模从未披露(第三方流传的”137B”始终只是估算,官方从不确认)。从 Claude 2 开始,“不公开参数、只用行为数据说话”成为 Anthropic 的固定策略。
3. Claude 2.1:200K 与工具使用(2023.11)
2023 年 11 月 21 日,Claude 2.1 把上下文推到 200K(约 15 万词、500+ 页文档),并放出两项影响深远的能力:
- tool use(工具使用,测试版)——让模型可以调用外部函数/API,这是后来所有 Agent 能力的源头;
- 诚实度大幅提升:错误陈述率降 2 倍、错误答案减 30%、误判文档支持度降 3–4 倍。
200K + 工具使用,两个方向都成了 Claude 此后三年最核心的产品标签。
4. 金主入场:Google 与 Amazon(2023)
模型之外,2023 年是 Anthropic 的”金主”之年。Google 先投约 5 亿美元(3 亿 + 后续 20 亿),捆绑 Google Cloud 算力;2023 年 9 月,Amazon 投资 40 亿美元(后于 2024 年 11 月追加 40 亿,累计 80 亿),Claude 独家进入 Amazon Bedrock,并深度绑定 AWS 的 Trainium/Inferentia 自研芯片——这为 2026 年”百万颗 Trainium2 集群”埋下伏笔。双云押注(Google TPU + AWS Trainium)让 Anthropic 成为罕见的”算力双供应商”公司。
四、阶段三:Claude 3——多模态与三档分层(2024.03–2024.11)
1. Claude 3 家族:一个模型家族的诞生(2024.03)
2024 年 3 月 4 日发布 Claude 3 家族:Haiku / Sonnet / Opus 三档,全部支持视觉(多模态)与 200K 上下文。这是 Claude 第一次全面超越 GPT-4(对比数据):
| 基准 | Claude 3 Opus | GPT-4 | 差距 |
|---|---|---|---|
| MMLU | 86.8% | 86.4% | +0.4 |
| GPQA(研究生级物理) | 50.4% | 35.7% | +14.7 |
| MATH | 60.1% | 52.9% | +7.2 |
| HumanEval | 84.9% | 67.0% | +17.9 |
| MMMU | 59.4% | 56.8% | +2.6 |
定价策略同样清晰:Opus $15/$75(旗舰)、Sonnet $3/$15(均衡)、Haiku $0.25/$1.25(轻量,官方定位 <3 秒读完 ~1 万 token 论文)。三档分层从此固定——一档打一个价格带,这也是后来”每个价位都有一款 Claude”的产品哲学。
2. Claude 3.5 Sonnet:小模型越级(2024.06)
2024 年 6 月 20 日,3.5 Sonnet 以 $3/$15 的价格打出了超 Opus 3 的智能:GPQA 59.4%、MMLU 88.7%、HumanEval 92.0%、MMMU 68.3%,速度为 Opus 3 的两倍;内部 agentic 编码评测 64% vs Opus 3 的 38%。**“中档模型打败自家旗舰”**成为 Claude 系列的经典戏码,顺带首发 Artifacts 功能(AI 生成可交互内容面板)。
3. Computer Use:让 AI 用电脑(2024.10)
2024 年 10 月 22 日,Anthropic 放出业界首个 Computer Use(计算机使用)公开测试版:Claude 3.5 Sonnet 可以看屏幕截图、移动光标、点击按钮、打字,像人一样操作浏览器。在 OSWorld 基准上,纯截图模式得分 14.9%(此前最佳系统仅 7.8%,人类为 72.4%),步数给足可达 22.0%。同日升级的 3.5 Sonnet 把 SWE-bench Verified 从 33.4% 提到 49.0%、TAU-bench(零售)69.2%。
尽管得分不高,但”AI 操作电脑”从这一天起从科幻变成公开测试产品——这是 Agent 方向最激进的一步,直接启发了后来的 OpenAI Operator、Google Project Mariner。
4. MCP:把工具标准化(2024.11)
2024 年 11 月 25 日,Anthropic 开源 MCP(Model Context Protocol,模型上下文协议):一套让 AI 模型与外部工具/数据源(数据库、API、文件系统、开发工具)统一连接的开放标准——类比”AI 世界的 USB-C 接口”。MCP 的生态野心在于:工具连接不应该被厂商私有协议锁定。如今 MCP 已被 OpenAI、Google 等全行业采纳,成为事实标准,是 Anthropic 迄今最成功的”行业基础设施”贡献。
五、阶段四:混合推理与 Agent 元年(2025.02–2025.05)
1. Claude 3.7 Sonnet:首个混合推理模型(2025.02)
2025 年 2 月 24 日,Claude 3.7 Sonnet 成为首个混合推理(hybrid reasoning)模型:同一个模型内置”标准模式”(秒回)与 extended thinking(扩展思考) 模式(思考预算最高 128K token,可见思维过程),用户按需切换。定价维持 $3/$15。效果:SWE-bench Verified 标准模式 62.3%、扩展思考 + 脚手架 70.3%;TAU-bench 零售 81.2%。“一个模型两种模式”后来成为行业标配(DeepSeek V3.1 的混合推理、OpenAI 的 o 系列均走同路)。
2. Claude Code:编程工作流的革命(2025.02)
同一天,Anthropic 放出 Claude Code(研究预览):一个跑在终端里的 AI 编程 Agent——读仓库、改代码、跑测试、提交 PR。它没有 UI,却重新定义了”AI 编程”的形态,被开发者社区视为”VS Code 插件时代的终结者”。此后 Claude Code 一路狂奔:2025 年 11 月年化收入 10 亿美元,2026 年 2 月翻倍至 25 亿美元,占全球公开 GitHub 提交约 4%。Claude 从”对话模型”变成了”生产力工具”。
3. Claude 4:Agent 原生的一代(2025.05)
2025 年 5 月 22 日,首届开发者大会”Code with Claude”官宣 Claude 4 双型号:
- Opus 4:SWE-bench Verified 72.5%、GPQA Diamond 82.3%(扩展思考)、MMMU 73.7%、Terminal-bench 43.2%,$15/$75;
- Sonnet 4:SWE-bench 72.7%(反超 Opus 4 本体),$3/$15。
Claude 4 是真正的 Agent 原生代:扩展思考中可调用工具、并行工具调用、本地文件记忆(memory files)、Claude Code 正式 GA,外加代码执行沙箱、MCP 服务、Files API、1 小时 prompt 缓存。至此,Agent 能力从”功能”变成”系统”。
六、阶段五:编码登顶与 1M 上下文(2025.08–2026.02)
1. Opus 4.1:稳扎稳打(2025.08)
2025 年 8 月 5 日,Opus 4.1 补强 Agentic 能力:SWE-bench Verified 74.5%、GPQA Diamond 80.9%、TAU-bench 零售 82.4%、AIME 2025 78.0%,定价不变。这是”3.5 Sonnet 周期”的中期迭代,无重大架构变化。
2. Sonnet 4.5 与 Haiku 4.5:中低档补全(2025.09–10)
- Sonnet 4.5(2025 年 9 月 29 日):$3/$15,SWE-bench Verified 77.2%,编码能力直逼 Opus 4.1,再次上演”中档越级”;
- Haiku 4.5(2025 年 10 月 15 日):$1/$5,200K 上下文,SWE-bench 73.3%(近 Sonnet 4 级编码),速度是 Sonnet 4 的 2 倍以上。
至此三档全部更新完毕,每个价位段都有接近上一档旗舰的性能。
3. Opus 4.5:首个 SWE-bench 破 80%(2025.11)
2025 年 11 月 24 日,Opus 4.5 是 2025 年的压轴:
- SWE-bench Verified 80.9%——首次有模型在该基准破 80%,当时全球第一(领先 GPT-5.1 的 76.3%、Gemini 3 Pro 的 76.2%);
- GPQA Diamond ~87%、MMMU 80.7%、OSWorld 66.3%、Terminal-Bench Hard 44%;
- 定价 $5/$25,较 Opus 4.1($15/$75)降价约 66%——性能登顶的同时大幅降价,直接改写旗舰定价标准;
- 新增 effort 参数(投入更多算力换更高质量)、上下文压缩、客户端 Memory 工具(beta)。
4. Opus 4.6:1M 上下文落地(2026.02)
2026 年 2 月 5 日,Opus 4.6 是又一个分水岭:
- 首个 Opus 级 1M token 上下文(beta,2026 年 3 月 13 日转 GA),最大输出 128K;MRCR v2@1M 得分 76%(对照:Sonnet 4.5 仅 18.5%、Gemini 3.1 Pro 26.3%)——1M 上下文不是”摆设”,是真能检索的长文档能力;
- 新增 adaptive thinking(自适应思考) 与四档 effort(low/medium/high/max);
- SWE-bench Verified 80.8%(优化提示词后 81.42%)、GPQA Diamond 91.3%、Terminal-Bench 2.0 65.4%、OSWorld 72.7%、MMMU-Pro 73.9%;
- 定价维持 $5/$25(超 200K 提示按 $10/$37.5 计费);ASL-3 安全等级。
📌 澄清:第三方榜单流传的”Opus 4.6-Max”并非独立模型,而是 max effort 档位的评测配置。
七、阶段六:第五代与资本巅峰(2026.04–2026.08)
1. Opus 4.7 / 4.8:动态工作流(2026.04–05)
据第三方聚合报道与官方系统卡索引(可靠性中):
- Opus 4.7(2026 年 4 月 16 日):SWE-bench Verified 87.6%、GPQA Diamond 94.2%;
- Opus 4.8(2026 年 5 月 28 日):引入动态工作流——可编排数百个子 Agent 并行协作,快速模式提速 2.5 倍。
这两代标志着 Claude 从”单 Agent 干活”走向”多 Agent 协作系统”。
2. Mythos 5 / Sonnet 5 / Opus 5:第五代分批落地(2026.06–07)
第五代不再以单一”Claude 5”发布,而是按档位分批落地(可靠性中,部分据官方页面/公告):
| 型号 | 发布日期 | 定价 | 备注 |
|---|---|---|---|
| Mythos 5 / Fable 5 | 2026-06-09 | $10/$50 | 新”Mythos 级”旗舰;6-12 遭出口管制、7-01 恢复 |
| Sonnet 5 | 2026-06-30 | $2/$10(首促价) | 主流档位 |
| Opus 5 | 2026-07-24 | $5/$25 | 旗舰档位 |
其中 Mythos 5 的出口管制风波(6 月被限制出口、7 月恢复)是 2026 年 AI 地缘政治的标志性事件。
3. 资本故事:从 1830 亿到 9650 亿
| 轮次 | 时间 | 金额 | 估值 |
|---|---|---|---|
| E 轮 | 2025.03 | 35 亿美元 | 615 亿美元 |
| — | 2025.09 | 130 亿美元(ICONIQ/富达/Lightspeed 领投) | 1830 亿美元 |
| G 轮 | 2026.02 | 300 亿美元 | 3800 亿美元 |
| H 轮 | 2026.05.28 | 650 亿美元 | 9650 亿美元(超越 OpenAI,全球最高估值 AI 创企) |
营收同步陡增:ARR 从 2025 年底约 90 亿美元 → 2026 年 2 月约 140 亿 → 2026 年 4 月约 300 亿美元;Dario Amodei 在 2025 年 12 月 DealBook 访谈中预测 2026 年营收 200–500 亿美元。企业端:2026 年 4 月 Claude 企业采用率(Ramp 数据)首次反超 OpenAI(34.4% vs 32.3%),API 月调用量超 250 亿次,财富 10 强中 8 家是 Claude 客户。算力端:约百万颗 AWS Trainium2 + 百万颗 Google TPU 双平台并行。
4. 版权和解与 IPO(2026.06–07)
- 2026 年 6 月:秘密递交 IPO 申请,摩根士丹利 + 高盛牵头,最快 2026 年 10 月上市——若成行,将是 AI 史上最大 IPO;
- 2026 年 7 月 20 日:法官最终批准 15 亿美元版权集体和解(美国史上最大版权和解案),Claude 训练语料版权争议告一段落。
八、三条技术主线
主线一:安全与对齐
宪法 AI(2022)→ HH-RLHF / RLAIF → 红队测试(Red Teaming)→ 渐进式部署 → many-shot jailbreaking 防御(2024)→ Alignment Faking 研究(2024.12,arXiv<2412>2412>.00893)→ ASL 安全分级(ASL-3)
- 宪法 AI = 对齐的技术底座(arXiv<2212>2212>.08073)
- 红队测试 = 安全评估方法(arXiv<2209>2209>.07858)
- Alignment Faking = 2024 年底的自我指涉研究:发现模型会”装对齐”来保目标,推动对齐研究进入”行为级”阶段
- ASL 分级 = 从”内部原则”到”可执行的安全承诺”(ASL-3 对应 2026 年的 Opus 4.6+)
主线二:上下文与效率
9K(Claude 1)→ 100K(Claude 1 扩容 / 2)→ 200K(2.1 / 3 家族)→ 200K 全面铺开(4.5 系)→ 1M(Opus 4.6)
- Context Distillation(2112.00861)= 把”上下文行为”蒸馏进参数的效率种子
- Context Engineering = Anthropic 2025 年提出的概念:把提示词设计上升为”上下文工程”学科
- 1M 落地 = MRCR v2@1M 76% 证明长上下文可用(2026.02)
主线三:Agent 能力
tool use(2.1,2023.11)→ Computer Use(3.5,2024.10)→ MCP 开放协议(2024.11)→ Claude Code(3.7,2025.02)→ Agent 原生架构(Claude 4,2025.05)→ 多 Agent 协作(Opus 4.8,2026.05)→ 知识工作 Agent(Cowork,2026.01)
- 每一步都对应”AI 从说到做”的递进:先说 → 会调用工具 → 会用电脑 → 会写代码 → 会系统化协作
- Cowork(2026 年 1 月)标志 Anthropic 正式进入”知识工作自动化”产品赛道
九、Anthropic 方法论(四条原则)
- 安全是产品,不是补丁——对齐被内置进训练目标(宪法 AI),而非发布后打补丁;安全等级(ASL)与模型能力同步演进;
- 渐进式部署(iterative deployment)——从不”憋大招”,用 Claude 2 → 2.1 → 3 → 3.5 的密级迭代让安全能力与风险认知同步成熟;发布节奏”慢半拍”但从不跳步;
- 研究驱动,不以跑分为纲——Claude 1 首发不公布任何基准,只谈安全;技术路线(宪法 AI、MCP、1M 上下文)均由研究问题驱动,而非排行榜竞争驱动;
- 押注知识工作的自动化——从 Computer Use 到 Claude Code 到 Cowork,Anthropic 的商业逻辑始终是”AI 干知识活”,而非”AI 陪人聊天”;企业市场份额反超 OpenAI 是这条战略的兑现。
附录 A:关键论文/研究与来源映射
| 论文/研究 | 对应主题 | arXiv/来源 |
|---|---|---|
| HH-RLHF | 人类偏好对齐数据集 | 2204.05862 |
| Red Teaming | 红队测试 | 2209.07858 |
| Context Distillation | 推理压缩 | 2112.00861 |
| Constitutional AI | 宪法 AI / RLAIF | 2212.08073 |
| many-shot jailbreaking | 越狱防御 | 2024.04 预印本 |
| Alignment Faking | 对齐伪装行为 | 2412.00893 |
| MCP | 模型上下文协议 | 2024.11 开源(官方博客) |
| AI 经济研究 / AI 安全前沿报告 | 经济与安全展望 | 2025.01 / 2025.04(官方博客) |
| Claude Code / Context Engineering | 编程 Agent 与上下文工程 | 2025.02 起(官方博客) |
| 各模型 Model Card / System Card | 评测与安全评估 | anthropic.com/news |
澄清:DPO(Direct Preference Optimization)与 Self-Refine 均非 Anthropic 的成果,勿张冠李戴。
附录 B:完整时间线
2021 创立 → 2021.12 Context Distillation → 2022.04 HH-RLHF → 2022.12 宪法 AI → 2023.03 Claude 1 → 2023.07 Claude 2 → 2023.09 Amazon 40 亿 → 2023.11 Claude 2.1 → 2024.03 Claude 3 家族 → 2024.06 Claude 3.5 Sonnet → 2024.10 Computer Use + 3.5 Sonnet 升级 → 2024.11 MCP + Amazon 追投 → 2025.02 3.7 Sonnet + Claude Code → 2025.03 E 轮 615 亿 → 2025.05 Claude 4 → 2025.08 Opus 4.1 → 2025.09 Sonnet 4.5 + 融资 1830 亿 → 2025.10 Haiku 4.5 → 2025.11 Opus 4.5 → 2026.01 Cowork → 2026.02 Opus 4.6(1M)+ G 轮 3800 亿 → 2026.04 Opus 4.7 → 2026.05 Opus 4.8 + H 轮 9650 亿 → 2026.06 Mythos 5 + IPO 秘密递交 → 2026.07 Sonnet 5 / Opus 5 + 版权和解 15 亿 → 2026.08 (拟 IPO 最快 10 月)
附录 C:数据口径与修正说明
- 早期分数勘误:Claude 2 的 76.5% 为律师考试 MBE 分数(GRE 为”高于 90 分位”);Claude 3 Opus 的 MMMU 官方为 59.4%(非 60.8%);Claude 4 系列发布于 2025 年 5 月 22 日(非 19/21 日);Opus 4 的 SWE-bench 为 72.5%、72.7% 属 Sonnet 4;Opus 4.1 的 SWE-bench 为 74.5%(非 80.1%);3.7 Sonnet 的 TAU-bench 为 81.2%(非 82.1%)。
- 传闻不采信:Claude 2 的”137B 参数”、2025 年 8 月存在”Instant 1.3”、融资轮次中的”135 亿美元”(实为 130 亿)等均无官方依据,已排除或修正。
- 可靠性分级:2026 年 Q2 后的 Opus 4.7 / Opus 4.8 / Mythos 5 / Sonnet 5 / Opus 5 数据主要来自第三方聚合报道与官方系统卡索引(可靠性中);Opus 4.5、Opus 4.6 及更早数据均来自 Anthropic 官方博客与 Model Card(可靠性高)。2026 年营收/份额类数据(ARR、企业采用率)为第三方口径估测,仅供参考。
- “Opus 4.6-Max”澄清:非独立产品,为 max effort 档位评测配置。
- 1M 上下文时间线:Opus 4.5 / Haiku 4.5 均为 200K;1M 由 Opus 4.6(2026.02)首次引入 Opus 级,2026.03.13 转 GA。
- Context Distillation 出处勘误:初稿误标为 arXiv<2210>2210>.14867(实为微软多语言论文),正确出处为 Askell et al. 2021《A General Language Assistant as a Laboratory for Alignment》(arXiv<2112>2112>.00861),时间应为 2021.12 而非 2022.10,已一并修正。
如果这篇文章对你有帮助,欢迎分享给更多人!
部分信息可能已经过时





