2026主流AI绘画模型横向测评:谁更适合日常创作?

最近几个月,AI绘画领域异常热闹。谷歌的Banana PRO刚上线华为应用市场不久,阿里和字节也相继发布新模型:字节推出CJUN 5.0,阿里发布Image2.0;再加上老牌厂商MidJourney(简称MJ)和号称“什么都能画”的Groq,当前AI绘画工具的选择已多到令人眼花缭乱。

为帮助普通用户在不同绘画需求下做出更理性的选择,本期我们对六款主流AI绘画模型展开实测。参与评测的模型包括:Banana PRO、腾讯混元3.0、阿里Image2.0、MidJourney V6、Kling和Groq。

需要说明的是:原计划将字节最新发布的CJUN 5.0纳入本次测试,但截至视频录制完成时,我们的账号尚未获得该模型的使用权限。若用其旧版模型参赛,有失公平,因此本次暂不纳入评分。相关提示词与案例已整理成文档,将在权限开通后更新完整结果,供参考。

第一关:人像生成

统一使用同一套提示词,要求绘制一位穿印有“BANANA”Logo牛仔裤、戴耳机、双手插兜站立的青年男性。

  • MidJourney V6:服装与背景基本准确,但未遵循指定姿势,裤子缺少Logo细节,人物质感略显生硬,面部略油腻。评分:3分
  • 腾讯混元3.0:整体结构正确,手机细节略有瑕疵,人物真实感偏弱,接近游戏建模风格。评分:3分
  • 阿里Image2.0:造型、姿势、服装及裤子Logo全部符合要求,真实感优于前两者。评分:4分
  • Banana PRO:所有细节精准还原,Logo甚至做了镜像处理,质感高度自然。若非明确告知,极难分辨是否为AI生成。评分:5分
  • Kling:服装不符,裤子无Logo,人脸过度磨皮,缺乏自然感。评分:3分
  • Groq:裤子文字实现镜像,整体完成度较高。评分:4分

第二关:真实人物还原

以成龙为原型,要求呈现其标志性大胡子、破旧皮夹克及手臂补丁等特征。

  • MidJourney V6:紧身衣与材质表现尚可,但人物完全失真,仅为全新生成形象。评分:3分
  • 腾讯混元3.0:细节基本具备,但质感与还原度明显逊于MidJourney,人物辨识度低。评分:2分
  • 阿里Image2.0:胡须、皮夹克、补丁等关键特征高度还原,一眼可识别。评分:5分
  • Banana PRO:人物还原精准,背景加入虚化处理,画面层次丰富。评分:5分
  • Kling:光影表现良好,但服装与表情细节不足,辨识度中等。评分:3分
  • Groq:画面油腻感明显,细节粗糙,难以确认人物身份。评分:1分

第三关:物品写实表现

绘制一张阳光照射下的玻璃杯,杯身缠绕丝绸,背景含漂浮尘埃。

  • MidJourney V6:光影与丝绸质感达T0水准,仅阳光穿透效果稍弱。评分:4分
  • 腾讯混元3.0:尘埃与丝绸质感合格,但阳光被表现为强光手电效果,失真明显。评分:2分
  • 阿里Image2.0:杯子光影、丝绸质感、空气尘埃均表现优秀。评分:5分
  • Banana PRO:整体完成度高,阳光细节略逊于阿里模型。评分:4分
  • Kling:画面添加无意义闪光,干扰主体表达。评分:2分
  • Groq:阳光效果抽象,其余部分尚可。评分:3分

第四关:图文混合生成(黑板字)

在黑板上用粉笔书写中文数学公式:“当K>5时,函数f(x)单调递增”,需体现粉笔灰质感与正确排版。

  • MidJourney V6:文字生成能力一贯薄弱,无法满足基础要求。评分:1分
  • 腾讯混元3.0:黑板背景正确,但内容存在错误。评分:3分
  • 阿里Image2.0:粉笔灰效果逼真,仅“K>5”中数字“5”缺失,整体准确性与质感俱佳。评分:4分
  • Banana PRO:文字完全准确,但粉笔质感略逊于阿里模型。评分:4分
  • Kling:框架存在,但内容错误,背景不符合黑板设定。评分:2分
  • Groq:具备黑白背景与粉笔痕迹,但文字错误。评分:3分

第五关:复杂信息卡片设计

生成一张含三大视觉区域、九大功能模块、配图与文字说明的信息卡片,主题为“智能办公助手”。要求排版严谨、内容准确、视觉协调。

  • MidJourney V6:配色尚可,但文字与语义理解严重不足。评分:1分