News brief
正文
今日Meta AI在GitHub开源Llama-3.1-Vision多模态对齐工具包,包含图像-文本对比学习框架与轻量化微调脚本。该工具包支持在单张80GB显存GPU上完成7B模型视觉适配,训练成本降低70%。基准测试显示,其在OCR识别与图表理解任务上准确率达89.6%,发布12小时内Star数已突破5000。
News brief
今日Meta AI在GitHub开源Llama-3.1-Vision多模态对齐工具包,包含图像-文本对比学习框架与轻量化微调脚本。该工具包支持在单张80GB显存GPU上完成7B模型视觉适配,训练成本降低70%。基准测试显示,其在OCR识别与图表理解任务上准确率达89.6%,发布12小时内Star数已突破5000。