News brief
正文
阿里巴巴通义实验室今日在GitHub开源72B参数视觉语言模型Qwen-VL-72B。该模型采用全参数开源策略,支持高分辨率图像解析与长文档OCR识别,在MMBench与DocVQA榜单中分别位列开源模型第一。项目发布24小时内GitHub星标数突破1.2万,Hugging Face下载量超50万次。开发团队表示,模型已适配消费级显卡推理,显著降低科研机构使用门槛。
News brief
阿里巴巴通义实验室今日在GitHub开源72B参数视觉语言模型Qwen-VL-72B。该模型采用全参数开源策略,支持高分辨率图像解析与长文档OCR识别,在MMBench与DocVQA榜单中分别位列开源模型第一。项目发布24小时内GitHub星标数突破1.2万,Hugging Face下载量超50万次。开发团队表示,模型已适配消费级显卡推理,显著降低科研机构使用门槛。