News brief
正文
Meta今日正式宣布,向全球开发者开源Llama-4系列大语言模型,包含8B、70B和400B三个参数版本。此次更新的最大亮点是原生支持高达100万Token的上下文窗口,这意味着模型能够一次性处理数千页的文档或数十万行的代码库。在性能方面,Llama-4在HumanEval代码生成基准测试中得分达到89.2%,在GSM8K数学推理测试中达到94.5%,全面超越了上一代产品。Meta首席科学家杨立昆在博客中透露,Llama-4采用了全新的稀疏MoE(混合专家)架构,使得400B模型在推理时仅激活约50B参数,大幅降低了部署门槛。该系列模型采用Llama 4 Community License协议发布,允许月活用户低于7亿的企业免费商用。据Hugging Face平台数据显示,开源发布仅12小时内,Llama-4的下载量已突破200万次,社区已迅速涌现出数十个针对特定垂直领域的微调版本,再次证明了开源路线在推动AI技术普惠方面的巨大潜力。