ModelLlama 3.1
Llama 3.1 405B
Llama 3.1 405B是Meta AI发布的大规模开源语言模型,拥有4050亿参数,是Llama系列中规模最大的版本。该模型支持多语言文本理解与生成、复杂推理、代码编写及长上下文处理等任务,面向研究者和开发者开放权重,可用于学术研究、商业应用及二次微调开发,在多项基准测试中与主流闭源大模型性能相当。
Timeline (last 90 days)
Sep 7
到2024年底,Llama 3.1 405B、Qwen2.5-72B等开源模型在多项评测中已接近甚至部分超越GPT-4水平
Unverified50%
Sep 7
Llama 3.1 405B在MMLU上的得分已接近GPT-4o的水平,Qwen 2.5 72B在数学和代码生成基准上某些指标超越了GPT-4 Turbo
Unverified50%
Sep 4
Meta训练Llama 3.1 405B使用了超过16,000块H100 GPU,训练耗时数月,成本可能超过1亿美元
Unverified50%
Jul 19
Llama 3.1 405B、DeepSeek V3等优质开源模型在许多通用任务上已与商业旗舰模型高度接近
Unverified50%
All Facts (4)
Unverified
到2024年底,Llama 3.1 405B、Qwen2.5-72B等开源模型在多项评测中已接近甚至部分超越GPT-4水平
50%UnverifiedLlama 3.1 405B在MMLU上的得分已接近GPT-4o的水平,Qwen 2.5 72B在数学和代码生成基准上某些指标超越了GPT-4 Turbo
50%UnverifiedMeta训练Llama 3.1 405B使用了超过16,000块H100 GPU,训练耗时数月,成本可能超过1亿美元
50%UnverifiedLlama 3.1 405B、DeepSeek V3等优质开源模型在许多通用任务上已与商业旗舰模型高度接近
50%