匿
匿名用户
发布于 2026/08/02 09:31
最近AI圈真是热闹,多模态模型一个接一个发布。我自己做内容创作的,试了GPT-4o和Gemini,处理图文混合任务确实省了不少事,比如自动生成配图和文案。不过有时候响应速度不太稳定,特别是晚上高峰期,等得有点着急。另外,开源的Llama 3虽然参数大,但多模态支持还不够完善,社区插件也少。大家在实际项目中有用过这些模型吗?哪些场景真正能落地?还是说现在更多是技术秀肌肉?另外,国内的大模型像通义千问、文心一言最近也在发力,有没有人对比过和国外模型的差距?欢迎分享经验,顺便求推荐好用的工具或技巧!