先给结论:不要把“Seedream 5”当成一个选项。 BytePlus 当前有 Lite 与 Pro 两份不同合同,再加上 Nano Banana 2,实际要比较三条路线。需要 3K/4K、流式输出或更多参考图时,先核对 Seedream 5.0 Lite;需要 0.5K 到 4K、Web/图片搜索 grounding 或多轮编辑时,先核对 Nano Banana 2;Seedream 5.0 Pro 则是 1K/1.5K/2K、非流式且按像素区间计价的另一份合同,不能借用 Lite 的 4K 和低价,也不能仅凭“Pro”推定成片更好。
这些条件只决定谁有资格进入测试,不是画质排名。中文文字、人物一致性、商品细节、版式和返修时间都要用自己的资产验收。测试上限也不该固定成 8 张或任何统一数字:先写预算、截止时间与最贵失败项,再决定需要覆盖多少素材和方差。
先写下“绝对不能错”的交付条件
模型能力很多,但采购时只需要先回答一个问题:这次成品最不能接受哪种错误?
| 交付硬条件 | 有资格进入首测的路线 | 仍需自己验收的风险 |
|---|---|---|
| 需要 3K/4K 输出或流式返回 | Seedream 5.0 Lite | 文字、人物、商品与系列一致性 |
| 需要 1K/1.5K/2K,且能接受非流式返回 | Seedream 5.0 Pro | 质量是否足以抵消像素档位与参考图费用 |
| 需要 0.5K 草案、最高 4K、grounding 或多轮编辑 | Nano Banana 2 | 成图事实、编辑漂移、接受率与总支出 |
| 中文文字、品牌身份或复杂版式不能错 | 三者都不能仅凭文档胜出 | 逐字、逐对象验收及返修时间 |
表格只用当前接口事实排除明显不合格的合同。若核心问题是中文文案、人物脸型或品牌商品是否稳定,三者都必须用同一批真实素材验收,不能从模型名称、第三方首图或供应商定位推断。
“Seedream 5”必须拆成 Lite 和 Pro
“Seedream 5”不是一个足够精确的调用对象。BytePlus 当前公开的是两份不同的生产合同:
- Seedream 5.0 Lite:模型 ID
seedream-5-0-260128,也支持别名seedream-5-0-lite-260128;输出 2K、3K、4K,支持流式图像输出,最多 14 张参考图。 - Seedream 5.0 Pro:模型 ID
dola-seedream-5-0-pro-260628;输出 1K、1.5K、2K,不支持流式图像输出,最多 10 张参考图。BytePlus 说明 1.5K 与 1K 同价,并把 1.5K 作为更合适的质量档位。 - Nano Banana 2:Google 模型 ID
gemini-3.1-flash-image;输出 0.5K、1K、2K、4K,支持 Web 与图片搜索 grounding、多轮编辑,最多 10 个高保真对象参考和 4 个角色参考。不要与 Nano Banana 2 Lite、Nano Banana Pro 或旧版 Nano Banana 混用。
因此,任何采购页或聚合平台都应先确认四项:模型 ID、输出尺寸、流式/标准/Batch 调用方式,以及“成功输出”和“通过业务验收”分别如何计费。只写“Seedream 5.0”或“Banana”的套餐,无法与官方价格直接对齐。

三条路线各自凭什么进入首测
Nano Banana 2:grounding、多轮编辑与尺寸跨度是入场理由
Google 当前文档列出 Web 与图片搜索 grounding(检索增强)、多轮图像编辑,以及 0.5K、1K、2K、4K 输出。需要先用低分辨率确认方向,再把少量候选升到交付尺寸,或需要把搜索信息带入图像工作时,这些接口条件能让 Nano Banana 2 进入首测。
Google 还给出最多 10 个高保真对象参考和 4 个角色参考的能力范围,但这些是输入上限,不是身份一定保持一致的承诺。参考图较多时,也要先区分对象与角色,而不是只比较“最多几张”。
如果画面依赖搜索信息,仍要逐项核对事实;如果画面包含准确文案,先锁定文字,再生成视觉。检索增强和文本生成能力都不能替代成品校对。
Seedream 5.0 Lite:4K、流式输出与参考图容量是入场理由
Lite 的当前合同列出 2K、3K、4K、流式图像输出和最多 14 张参考图。若交互过程中需要逐步收到图像结果,或 4K 与较多参考图是硬门槛,这条路线有明确的入场理由。
BytePlus 当前公布的价格是每张成功输出 0.035 美元。这里的关键词是“输出”,不是“通过验收”。只要成功返回却未满足文字、人物或商品要求,它仍可能产生 API 支出,因此预算必须包含所有成功输出,而不是只数最终留下的成品。
Seedream 5.0 Pro:1.5K 与非流式合同合适才入场
Pro 的当前输出档位是 1K、1.5K、2K,不支持流式图像输出,参考图上限为 10 张。BytePlus 说明 1.5K 与 1K 同价,并推荐 1.5K 获得更好的生成质量;这是一项供应商说明,不是与 Lite 或 Nano Banana 2 的匹配画质结论。
BytePlus 当前列出的输出价格为:不超过 261 万像素(页面描述为 1.5K 或更低)每张 0.045 美元,超过该阈值每张 0.09 美元;第一张输入参考图免费,从第二张起每张 0.003 美元。只有当尺寸、非流式返回、参考图费用和你的实际验收结果都合适时,Pro 才是可用路线;名称本身不构成升级证据。
价格必须换算到同一张成品
Nano Banana 2 在 Gemini Developer API 的标准图像输出价格为:0.5K 0.045 美元、1K 0.067 美元、2K 0.101 美元、4K 0.151 美元;Batch 对应为 0.022、0.034、0.050、0.076 美元。输入、文本或 thinking 输出、grounding、税费与供应商加价可能另计。Batch 各档接近半价,但四舍五入后并非每档都精确等于一半。
所以,不能拿 Lite 的 0.035 美元直接对比 Nano Banana 2 的 4K 0.151 美元。先统一:
- 成品实际需要的像素尺寸;
- 实时还是批处理;
- 参考图数量与输入费用;
- 每个成品允许的重试次数;
- 聚合平台的加价与失败计费;
- 人工修字、修脸、修商品所需时间。
若团队已有人工时薪,可以统一成货币:每张合格成品成本 =(全部 API 支出 + 返修分钟 × 每小时人工成本 ÷ 60)÷ 合格成品数。若暂时没有人工费率,就分开记录 API 支出/合格成品 与 返修分钟/合格成品,不要把美元、分钟、总额和单张数值直接相加。
先用预算倒推测试上限,再覆盖最贵的失败
测试数量没有通用答案。先为本轮写出三项上限:最多可花多少 API 费用、最多可投入多少返修时间、最晚何时必须停止。再选择足以覆盖最高风险的真实资产,而不是先规定每个模型生成同一个固定数量。
候选测试题应来自你要交付的文件,而不是通用审美词,例如:
- 一张含中文标题、价格和说明文字的广告;
- 一张必须保持 logo、材质和视角的商品图;
- 一个角色的初始画面和两次连续修改;
- 一张数字、标签、图标必须逐一对应的信息图;
- 一次只允许改变指定区域的局部编辑。
不需要机械执行全部示例:中文电商团队可以优先文字与商品,角色项目可以优先身份与连续编辑。若同类素材本身方差很大,就增加代表样本;若一次致命错误已经触发法规、品牌或尺寸硬门槛,则没有必要为了凑数继续生成。
每个结果分别记录文字、人物、数量、位置和品牌元素是否通过;同时记录真实模型 ID、输出尺寸、调用方式、API 支出、重新生成次数和人工修复分钟数。保留失败记录,也不要只留下最好看的一张。

停止条件要在测试前写明,并与业务风险对应:达到费用或时间上限就停;实际模型 ID、尺寸或调用方式与计划不符就停并先修配置;同一种致命错误达到团队事先设定的容忍次数,也应停下来换路线或拆分任务。这个次数由失败代价和可接受方差决定,不是固定两次。
什么时候该换模型
- Nano Banana 2 的 grounding 或多轮编辑是入场理由,但成图事实仍不合格:停止堆重试,把数字、标签和版式交给确定性排版流程。
- Lite 满足 4K、流式或参考图门槛,但系列一致性达不到验收:根据已记录的失败成本换候选,不因单价低继续无限生成。
- Pro 的 1.5K/2K 合同与非流式返回不符合交付:直接排除;若合同符合但成片未通过,也要靠实际记录决定是否继续,而不是相信“Pro”名称。
- 三条路线都在文字或品牌细节上失败:把文字、价格、Logo 等确定性元素留给排版工具,模型只负责背景和视觉主体。
最终不是“选一个模型永久使用”,而是让每个环节只承担它能通过验收的任务。采购前可核对 BytePlus 图像生成文档、BytePlus 模型价格、Google 图像生成文档 与 Gemini API 价格。模型入口和价格会变化,应以实际模型 ID、调用方式与账单为准。



