推理 · 编码 · 代理
通用模型:先看工作方式,再看厂商
六款模型分别偏向深度推理、长时自主执行、速度与成本平衡、结构化输出或跨工具生产。先按任务缩小候选,再进入官方资料核对接口、价格和限制。
官方资料复核:2026 年 8 月 6 日
图像 · 视频 · 实时语音
创作与交互模型:按输出形态选择
图像看生成与精修,视频看时长、声音和参考控制,语音则要区分实时代理与高表现力合成。这里先给出选择轴和当前产品阶段。
01
生成一张图,还是持续精修
比较生成质量、文字、参考图、分辨率与局部修改。
02
短片、声音与镜头控制
比较成片时长、同步声音、参考素材、镜头与编辑方式。
03
实时代理,还是表现力语音
比较低延迟对话、推理与工具,以及配音和多角色表达。
从选型到落地
把模型选择变成可复现的结果
需要比较成本、接入 API、复现创作流程或定位错误时,指南库会把一个具体问题拆成可以执行和验证的步骤。
先用模型索引缩小范围
通用推理、图像、视频和语音模型已按任务分组;更深入的价格、接口、工作流与排错指南会在文章库持续补充。