article

多模态模型横评:中文理解谁最强?

2 min read

多家高校联合发布的中文多模态评测基准 CMMU-Eval 覆盖 12 个头部模型、5 大任务域。核心结论:

关键发现

对开发者的建议

文档密集型业务(票据、合同、档案)可以放心选用国产开源模型;视频理解相关需求建议做好人工兜底设计。

该基准已全部开源,支持一键复现。