评测基础信息

  1. 评测目标:测试主流文生图模型对「克制隐忍、强忍痛苦,牙关紧咬、眼含水光但无泪珠滑落」精细化面部微表情的还原实现能力
  2. 基准提示词 电影感侧颜面部特写,16:9,五官精致,样貌绝美,东亚女性,自然暗角,牙关紧紧咬合,下颌僵硬紧绷,眼眸水光闪烁,强忍内心痛苦,没有泪珠滑落,安静克制隐忍,清瘦长方脸型,立体突出骨相,狭长锐利眉眼,眉型纤细利落,棱角分明的下颌,冷艳疏离大女主气场,民国黑色手推波纹复古盘发,发丝油润服帖,精致侧分波纹造型,冷调细腻白皙皮肤,真实皮肤肌理,可见细微毛孔,低饱和复古淡妆,暗黑色刺绣亮片改良旗袍,珍珠垂坠式耳环,安静压抑痛苦的情绪,暗调侧逆光轮廓光,微弱柔和侧面补光,阴影沿着下颌自然沉降过渡,柔和渐变阴影,无死黑区域,浅景深,8K 原片照片,超写实,复古旁轴相机拍摄,Kodak Portra400 胶片,细腻细微胶片颗粒
  3. 参评模型:KREA 2 TURBO、Z-Image-Turbo、Qwen-Image-2512
  4. 参考样图:3 张民国旗袍女性实拍参考(分别为落泪悲伤、隐忍落泪、平静冷感三种表情基准,用于区分「含泪强忍无泪」目标表情边界)

分项评测结果

1. KREA 2 TURBO

  • 表情实现结论未实现目标微表情
  • 问题描述:模型仅还原了人物造型、服饰、民国场景、胶片光影质感等外观要素;面部表情趋于平淡中性,无法生成「牙关紧咬、下颌紧绷、眼眸含水光强忍悲痛」的细微面部肌肉状态,情绪表现力缺失,人物神态偏静态写真感,没有传递出压抑隐忍的痛苦。
  • 优势:画面构图、服装旗袍细节、手推波纹发型、Kodak Portra400 胶片颗粒、侧逆光光影渲染完成度较高,画面质感贴近复古电影写真标准。

2. Z-Image-Turbo

  • 表情实现结论目标表情实现效果最优
  • 表现描述:可以精准捕捉提示词内克制类微表情,下颌线条紧绷、眼部带有水光感,整体神态贴合 “安静隐忍、压抑痛苦” 的核心情绪;能够区分「强忍情绪」和「落泪痛哭」的表情边界,不会过度渲染悲伤。同时兼顾服装、发型、胶片质感、光影层次等配套画面要素,画面写实度较高。
  • 不足:极个别生成样本会出现面部肌肉过渡生硬,细微皮肤肌理、毛孔还原弱于专业商业写实模型。

3. Qwen-Image-2512

  • 表情实现结论可生成痛苦情绪表情,但表情幅度失控,表现过头
  • 问题描述:模型成功识别痛苦类情绪指令,能够生成悲伤神态,但无法约束 “克制隐忍” 的边界,极易过度渲染悲伤,出现泪珠滑落、面部肌肉大幅扭曲、眼眶红肿等强悲伤表情,偏离提示词 “无泪珠滑落、安静克制” 的硬性要求,表情张力溢出。
  • 优势:整体画面写实精度高,服饰、环境、光影、胶片风格还原完整,皮肤肌理、细节纹理表现力优秀。

综合对比总结

表格

模型 精细化微表情还原 表情幅度可控性 造型 / 光影 / 胶片质感还原 综合得分
KREA 2 TURBO ❌ 未实现目标表情 —— ✅ 优秀 ★★☆☆☆
Z-Image-Turbo ✅ 较好实现 ✅ 可控 ✅ 良好 ★★★★☆
Qwen-Image-2512 ✅ 可实现情绪,幅度超标 ❌ 不可控,易过度 ✅ 优秀 ★★★☆☆

最终评测结论

  1. 针对低幅度、克制型精细化面部微表情生成场景:Z-Image-Turbo 在三者中表现最优;KREA 2 TURBO 不适合依赖微表情情绪表达的创作;Qwen-Image-2512 适合强情绪画面,不适合 “隐忍克制” 这类边界精细的表情需求。
  2. 三款开源 / 本地部署可用模型,在微表情细节控制、面部肌肉精准调节、情绪幅度约束层面,和闭源专业商业写实文生模型仍存在明显差距:商业模型对细微咬合肌肉、眼部水光、情绪边界的理解更加精准,表情失真、溢出、失效问题更少。
  3. 落地建议:若使用上述三款模型制作影视剧照、短剧分镜类写实素材,针对克制隐忍类微表情,优先选用 Z-Image-Turbo;使用 Qwen-Image-2512 需要额外增加负面提示词约束表情幅度;KREA 2 TURBO 更适合无强情绪表达的静态人物肖像创作。
Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐