模型实验记录 · Image experiments
Qwen 图片分镜实测:4 格、12 格与 Pro 版的取舍
一次生成 12 格分镜并非必然失败;更容易被忽略的是,每格承担了多少人物、动作和文字任务。我们回看两组图片实验,比较版式、指令遵循与逐格可读性。
Read in English on Porncut两个小实验,不是一张模型排行榜
第一组是 2026 年 8 月 24 日的四张图 A/B,对照较早的标准版结果;第二组包含三张 3×4、共 12 格的结果。本文只总结这些样本,不计算通用成功率。
记录中的“3.0”和“3 Pro”是第三方服务当时使用的 Qwen Image 版本标签。本文没有独立核实它们与官方权重的映射,因此不把这组数据包装成官方型号的基准。
原始创作素材不在本文发布。以下是当时人工检查的文字摘要;没有展示可公开的配对样片之前,不要求读者仅凭文字认定哪版画质更好。
Pro 的改进与退步出现在不同维度
同一组任务中,写实人物和服装指令有所改善,并不意味着格数、编号和留白也改善。把这些维度合成一句“更强”,会掩盖实际选择。
| 检查维度 | 四图 A/B 的观察 | 对工作流的意义 |
|---|---|---|
| 四格线稿版式 | Pro 出现额外说明条或底栏 | 先检查模板是否仍可直接使用 |
| 编号 | 部分结果出现字母或错误数字 | 编号可以留到后期统一添加 |
| 写实人物与服装 | Pro 在部分样本更遵循指令 | 可作为单镜精修候选 |
| 单关键帧 | 主体改善时也可能多出分格 | 同时检查主体和整页结构 |
12 格能排对,但格数只是第一道检查
12 格实验使用 1536×2048、3 列×4 行的页面。三张输出分别为标准版线稿、Pro 线稿和 Pro 写实,报告记录三张都排成了 12 格。
逐格检查仍发现指定动作没有完整执行。排对 12 个框不等于完成 12 个镜头,更不等于可以直接把整页当作可靠的人物参考输入。
这组样本支持继续测试较疏的动作分配:交替使用单人、双人和环境特写,避免每格都塞满复杂交互。它不能证明这种写法对所有故事或 seed 都有效。
把总览页与真正开拍的关键帧分开
总览分镜回答镜头顺序、空间关系和节奏;关键帧回答一镜中的人物、动作起点和构图。让一张图同时解决所有任务,往往使检查更困难。
- 先用四格建立镜头顺序,只检查人物数量、景别和动作是否可读。
- 如果扩展到 12 格,保持故事相同,固定种子与参数,单独记录新增的排版失败。
- 逐格记录格数、编号、人物、服装、动作与背景,不只给整张图一个分数。
- 对有问题的单格独立生成关键帧,而不是要求模型反复重画整页。
- 重要文字和编号在后期添加,保留可编辑的源文件。
下一次应怎样做更公平的比较
这两组历史记录不是严格的 4 格对 12 格受控实验。下一次需要相同故事、多个配对 seed、一致的评分规则,并把模型与提示词改动分别测试。
更高价格也不应直接解释为更高可用率。此次没有重查实时价格,所以不把历史账单写成当前套餐建议。先根据你的目标选择版式总览还是写实精修,再比较完成一张可用图的总成本。