跳到正文
Hugging Face Blog·· 2021-10-26AI 评分28

大语言模型:新的摩尔定律?

Large Language Models: A New Moore's Law?

AI 导读

微软和 NVIDIA 发布 Megatron-Turing NLG 530B,号称全球最大最强的生成式语言模型,但训练需数百台 DGX A100 服务器、成本近 1 亿美元。作者质疑这类超大模型趋势:基准提升有限,却带来高昂成本、复杂度和碳足迹,并建议改用预训练模型、更小模型(如 DistilBERT 保留 97% 语言理解、体积小 40%、速度快 60%)和微调。

来源:Hugging Face Blog · huggingface.co