News brief
正文
阿里云今日在GitHub开源Qwen2.5-VL视觉语言大模型,提供7B至72B多种参数版本。该模型突破传统分辨率限制,原生支持4K超高清图像与长视频帧级解析,在DocVQA与MathVista基准测试中刷新开源记录。项目采用Apache 2.0协议,允许商业免费使用。技术团队透露,模型引入动态稀疏注意力机制,推理成本降低35%,已吸引全球超2000名开发者提交PR,生态活跃度位居开源社区前列。
News brief
阿里云今日在GitHub开源Qwen2.5-VL视觉语言大模型,提供7B至72B多种参数版本。该模型突破传统分辨率限制,原生支持4K超高清图像与长视频帧级解析,在DocVQA与MathVista基准测试中刷新开源记录。项目采用Apache 2.0协议,允许商业免费使用。技术团队透露,模型引入动态稀疏注意力机制,推理成本降低35%,已吸引全球超2000名开发者提交PR,生态活跃度位居开源社区前列。