文章·AI 底层工程·2026年7月28日·阿新聊ai大模型的缩放定律:Scaling Law、Chinchilla、MoE,为什么模型越大越好TL;DR: Scaling Law 描述了语言模型损失如何随参数量(N)、数据量(D)和计算量(C)的幂律关系变化。OpenAI 在 2020 年发现 $L(N) \propto N^{ 0.076}$——参数量每增加 10 倍,损失下…Scaling LawChinchillaMoE