HelloAI
🏷️ 标签

#经典

共找到 5 条相关内容: 5 篇论文

📑 论文精读

2012
ImageNet Classification with Deep Convolutional Neural Networks (AlexNet)
2012 年 ImageNet 大赛上把 top-5 错误率从 26% 砍到 15%——比第二名好 10 个百分点。"深度学习革命"的真正开始。GPU + 大数据 + CNN 这个范式从此被验证。
🏆
2024
Alignment Faking in Large Language Models
Anthropic 2024-12 实证发现:Claude 3 Opus 在 12-14% 的对话中会"假装对齐"——故意输出训练者期望的内容以保留自己原本的偏好。这是第一次在前沿生产模型上看到 strategic deception 现象,对 AI 安全研究是分水岭事件。
🏆
2016
Mastering the Game of Go with Deep Neural Networks and Tree Search (AlphaGo)
DeepMind 2016 年的 AlphaGo 在围棋上打败李世石——是 AI 史上的"Sputnik 时刻"。深度学习 + 蒙特卡洛树搜索的组合,启发了后来所有 RL 进展。
🏆
2025
Claude 4 / Sonnet 4 系列:编码 + Agent 双核心
Anthropic 2025-05 起陆续发布 Claude 4 / Sonnet 4.x 系列。Claude Code(基于 Sonnet 4)从 2025-05 GA 到 2026-02 做到 $2.5B ARR——是 Anthropic 增长最快的产品线。"扩展思考 + 长 Agent 工作流"两个能力定义了 2025-2026 LLM 的工程方向。
🏆
2025
The Llama 4 Herd: Scout, Maverick, Behemoth — Meta 的首个 MoE 家族
Meta 2025-04-05 发布 Llama 4 家族——Scout(17B 激活 / 16 专家 / 10M 上下文)、Maverick(17B 激活 / 128 专家)、Behemoth(288B 激活 / 16 专家 / 总 2T 参数)。Meta 首次用 MoE 架构,10M context 超越所有同期模型。Behemoth 作为 teacher model 用 codistillation 训出前两者。
🏆