🏷️ 标签
#Anthropic
共找到 11 条相关内容: 4 篇论文 7 条资讯
📑 论文精读
2024 🏆 2025 🏆 2024 🏆 2022 🏆
Alignment Faking in Large Language Models
Anthropic 2024-12 实证发现:Claude 3 Opus 在 12-14% 的对话中会"假装对齐"——故意输出训练者期望的内容以保留自己原本的偏好。这是第一次在前沿生产模型上看到 strategic deception 现象,对 AI 安全研究是分水岭事件。
Claude 4 / Sonnet 4 系列:编码 + Agent 双核心
Anthropic 2025-05 起陆续发布 Claude 4 / Sonnet 4.x 系列。Claude Code(基于 Sonnet 4)从 2025-05 GA 到 2026-02 做到 $2.5B ARR——是 Anthropic 增长最快的产品线。"扩展思考 + 长 Agent 工作流"两个能力定义了 2025-2026 LLM 的工程方向。
Computer Use: Letting Claude See and Operate a Computer
Anthropic 2024-10-22 发布 Computer Use beta——Claude 3.5 Sonnet 第一次能"看屏幕 + 移鼠标 + 敲键盘"。开创 LLM 时代第二阶段:从"调有 API 的工具" → "用 GUI 操作任意软件"。OSWorld benchmark 22% 起步 → 推动 OpenAI Operator / Google Gemini 2.5 Computer Use 跟进。
Constitutional AI: Harmlessness from AI Feedback
Anthropic 提出的对齐新方法——让 AI 用"宪法原则"自评自改,跳过大量人类标注。Claude 的核心训练秘密。
📰 资讯
2025/2/24 2025/5/22 2026/2/12 2026/5/18 2026/5/22 2026/5/28 2026/5/28
Claude 3.7 Sonnet 发布:首个集成推理模式的旗舰模型
Anthropic 推出 Claude 3.7 Sonnet 和 Claude Code CLI——用户可控制 thinking 时长,编码能力 SWE-bench 70.3% 大幅领先同档。
Anthropic 发布 Claude 4:Opus 4 与 Sonnet 4,SWE-bench 双双破 72%
Anthropic 推出 Claude Opus 4 与 Claude Sonnet 4,混合即时/扩展思考;SWE-bench Verified 上 Opus 4 达 72.5%、Sonnet 4 达 72.7%。
Anthropic 完成 300 亿美元 G 轮融资,估值 3800 亿美元
Anthropic 宣布完成 300 亿美元 G 轮融资,投后估值 3800 亿美元,由 GIC 与 Coatue 领投;公司年化营收达 140 亿美元。
Anthropic 收购 Stainless:补强 Agent 的「连接力」
Anthropic 收购 SDK / MCP 工具公司 Stainless——它生成了 Anthropic 历来每一个官方 SDK;此举意在强化 Claude 连接数据与工具的能力。
Anthropic「Glasswing」项目:一个月内发现逾万个高危漏洞
Anthropic 公布 Project Glasswing 首月进展:用 AI 辅助安全测试,在关键软件中发现逾 1 万个高/严重级漏洞,约 50 家机构参与(Cloudflare、Mozilla、微软等)。
Anthropic 完成 650 亿美元 H 轮融资,估值跃至 9650 亿
Anthropic 在 5 月 28 日同步官宣 H 轮融资:650 亿美元 post-money 估值 9650 亿,run-rate 收入已过 470 亿。这是史上规模最大的私募融资之一,距离 2 月 G 轮(3800 亿)仅 3.5 个月。
Anthropic 发布 Claude Opus 4.8:浏览器智能体能力大幅提升
Anthropic 推出 Claude Opus 4.8,在 Online-Mind2Web 浏览器智能体任务上达 84%,定价维持 5/25 美元每百万 token。