News brief
正文
今日,Meta公司正式开源了新一代大语言模型Llama-4系列。此次开源的模型包含8B和70B两个参数版本,其最大的技术突破在于原生支持高达100万Token的超长上下文窗口。在Meta官方公布的长文本评测基准中,Llama-4在信息检索测试中实现了99.9%的准确率,能够轻松处理数百页的PDF文档或完整的代码仓库。技术博客指出,Llama-4采用了创新的环形注意力机制与优化的缓存管理策略,使得在处理超长文本时的显存占用降低了60%,推理速度提升了2.5倍。该模型采用与上一代相同的宽松开源协议,允许商业免费使用。消息发布后,全球开源社区反响热烈,首日下载量即突破五十万次。多位知名AI研究员表示,百万级上下文窗口的开源,将彻底改变检索增强生成技术的应用范式,使得构建基于企业全量知识库的超级AI助手成为可能。Meta此举再次巩固了其在开源AI领域的领导地位,推动了全球大模型技术的普惠化进程。