跳转到主要内容
HelloAI
beta
资讯
学习路径
可视化
论文
工具箱
zh
zh
中文
✓
en
English
资讯
学习路径
可视化
论文
工具箱
所有标签
›
#Scaling Laws
🏷️ 标签
#Scaling Laws
共找到
2
条相关内容:
2 篇论文
📑 论文精读
2022
Training Compute-Optimal Large Language Models (Chinchilla)
DeepMind 证明 GPT-3 等大模型"参数太多、数据太少"。给出了"算力如何在参数和数据间最优分配"的新法则——重塑了大模型训练。
🏆
2020
Scaling Laws for Neural Language Models
OpenAI 2020 年的奠基性发现——"模型损失随参数、数据、算力呈幂律下降"。这条曲线是 GPT-3、GPT-4 等大模型投资的理论基础。
🏆
← 回到所有标签
⌨️ 键盘快捷键
×
唤起搜索
/
回首页
g
然后
h
学习路径
g
然后
l
可视化画廊
g
然后
v
论文精读
g
然后
p
工具箱
g
然后
t
资讯
g
然后
n
显示这个面板
?
关闭面板 / 弹窗
Esc
💡 输入框聚焦时快捷键自动失效。