模型实验记录 · Image experiments

Qwen 图片分镜实测:4 格、12 格与 Pro 版的取舍

一次生成 12 格分镜并非必然失败;更容易被忽略的是,每格承担了多少人物、动作和文字任务。我们回看两组图片实验,比较版式、指令遵循与逐格可读性。

黄果制片编辑组 · 发布 · 实验

Read in English on Porncut

两个小实验,不是一张模型排行榜

第一组是 2026 年 8 月 24 日的四张图 A/B,对照较早的标准版结果;第二组包含三张 3×4、共 12 格的结果。本文只总结这些样本,不计算通用成功率。

记录中的“3.0”和“3 Pro”是第三方服务当时使用的 Qwen Image 版本标签。本文没有独立核实它们与官方权重的映射,因此不把这组数据包装成官方型号的基准。

原始创作素材不在本文发布。以下是当时人工检查的文字摘要;没有展示可公开的配对样片之前,不要求读者仅凭文字认定哪版画质更好。

Pro 的改进与退步出现在不同维度

同一组任务中,写实人物和服装指令有所改善,并不意味着格数、编号和留白也改善。把这些维度合成一句“更强”,会掩盖实际选择。

Pro 的改进与退步出现在不同维度
检查维度四图 A/B 的观察对工作流的意义
四格线稿版式Pro 出现额外说明条或底栏先检查模板是否仍可直接使用
编号部分结果出现字母或错误数字编号可以留到后期统一添加
写实人物与服装Pro 在部分样本更遵循指令可作为单镜精修候选
单关键帧主体改善时也可能多出分格同时检查主体和整页结构

12 格能排对,但格数只是第一道检查

12 格实验使用 1536×2048、3 列×4 行的页面。三张输出分别为标准版线稿、Pro 线稿和 Pro 写实,报告记录三张都排成了 12 格。

逐格检查仍发现指定动作没有完整执行。排对 12 个框不等于完成 12 个镜头,更不等于可以直接把整页当作可靠的人物参考输入。

这组样本支持继续测试较疏的动作分配:交替使用单人、双人和环境特写,避免每格都塞满复杂交互。它不能证明这种写法对所有故事或 seed 都有效。

把总览页与真正开拍的关键帧分开

总览分镜回答镜头顺序、空间关系和节奏;关键帧回答一镜中的人物、动作起点和构图。让一张图同时解决所有任务,往往使检查更困难。

  1. 先用四格建立镜头顺序,只检查人物数量、景别和动作是否可读。
  2. 如果扩展到 12 格,保持故事相同,固定种子与参数,单独记录新增的排版失败。
  3. 逐格记录格数、编号、人物、服装、动作与背景,不只给整张图一个分数。
  4. 对有问题的单格独立生成关键帧,而不是要求模型反复重画整页。
  5. 重要文字和编号在后期添加,保留可编辑的源文件。

下一次应怎样做更公平的比较

这两组历史记录不是严格的 4 格对 12 格受控实验。下一次需要相同故事、多个配对 seed、一致的评分规则,并把模型与提示词改动分别测试。

更高价格也不应直接解释为更高可用率。此次没有重查实时价格,所以不把历史账单写成当前套餐建议。先根据你的目标选择版式总览还是写实精修,再比较完成一张可用图的总成本。