腾讯混元上线多轮对话生图

腾讯混元发布 Hy Image 3.5 Preview,支持文生图、图生图、多轮对话创作和最多 5 张参考图,已陆续接入元宝、ima 等应用,腾讯云 2K 图像定价 0.15 元/张。
腾讯混元上线多轮对话生图,Hy Image 3.5 Preview 进入元宝与 ima
腾讯混元今天发布了 Hy Image 3.5 Preview,重点不是再增加一个单轮文生图模型,而是把生图流程推进到“连续对话创作”阶段。该模型支持文生图、图生图、多轮对话编辑、最多 5 张参考图输入,以及最高 2K 分辨率输出,目前已经陆续上线元宝、ima、WorkRally、OnSolo、Miora、WorkBuddy 等应用。
从产品定位看,Hy Image 3.5 Preview 是腾讯混元面向专业级视觉创作推出的预览模型。腾讯给出的内部 GSB 盲测结果显示,它相较 Hy Image 3.0 提升 30%,整体表现与 Seedream 5.0 Pro 持平,略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。不过,这些数据来自腾讯内部数百名专业设计师的对比测试,尚不是统一公开基准,结论更适合被理解为产品竞争力信号,而不是最终行业排名。

一句话看懂:它把生图从“一次生成”变成“持续修改”
多轮对话创作是指模型能够记住当前图片、历史指令和上下文,在连续对话中逐步完成生成与编辑。 用户不需要每次重新上传图片,也不必把此前的全部要求重新描述一遍,而是可以像和设计师沟通一样,继续提出“把背景换成夜景”“保留人物姿势但更换服装”“标题再放大一点”等修改要求。
这项能力解决的是当前图像模型最常见的工作流问题:第一张图可能不错,但第二轮开始就容易丢失主体、改变构图,或者把已经确认的元素重新生成一遍。传统模型更像一次性出稿工具,Hy Image 3.5 Preview 则试图让模型扮演一个能持续记稿的视觉助手。
对于普通用户,这意味着修图和创作的门槛降低了。对于设计师、电商运营和影视团队,更重要的是它减少了反复整理提示词、重复上传素材和手动记录版本的成本。模型是否真的能在长轮次修改中保持人物身份、品牌元素和版式稳定,将是它从“好玩的生图工具”走向“可用生产工具”的关键。
核心能力:文生图、图生图和多图参考同时覆盖
Hy Image 3.5 Preview 是一个同时支持文生图与图生图的视觉生成模型。 文生图适合从零开始制作海报、插画、信息图和概念设计;图生图则更适合基于已有照片、草图、产品图或风格参考进行再创作。
模型单次最多支持上传 5 张参考图,这个数量对于商业创作尤其重要。用户可以分别提供人物参考、服装参考、场景参考、产品参考和风格参考,让模型在一次任务中理解多个视觉约束。相比只上传一张风格图,多图参考更接近真实设计需求:品牌方往往需要同时锁定 Logo、产品外观、模特形象和整体色调。
模型还支持多种画幅比例和最高 2K 分辨率输出。2K 并不等于直接替代专业设计软件,但足以覆盖社交媒体配图、电商主图、活动海报初稿、知识卡片和分镜草图等场景。需要注意的是,生成式图像的文字排版、品牌 Logo 精确还原和复杂表格仍然是高难度环节,2K 分辨率也不能自动解决这些问题。
Hy Image 3.5 Preview 的主要能力
| 能力 | 具体表现 | 更适合的场景 | |---|---|---| | 文生图 | 根据文字描述生成图片 | 海报、插画、概念图、封面 | | 图生图 | 基于已有图片进行重绘和编辑 | 人像修图、产品视觉、风格迁移 | | 多图参考 | 单次最多上传 5 张参考图 | 人物、服装、产品和场景组合创作 | | 多轮对话 | 基于历史上下文连续修改 | 迭代设计、局部调整、版本打磨 | | 多尺寸输出 | 支持多种比例和画幅 | 手机封面、社交媒体、电商和演示文稿 | | 高分辨率生成 | 最高支持 2K 输出 | 商业物料、知识信息图和影视前期设计 |
腾讯给出的成绩:对比 Hy Image 3.0 提升 30%
GSB 盲测是一种成对比较评测方法,评测者在不知道模型来源的情况下判断两张生成图片哪一张更好。 与单独打分相比,GSB 更适合评估两个模型在审美、构图、细节和指令遵循上的相对差异,但它仍然会受到测试样本、评测者构成和提示词分布的影响。
腾讯称,Hy Image 3.5 Preview 经过内部数百名专业设计师 GSB 盲测,相比 Hy Image 3.0 提升 30%;与 Seedream 5.0 Pro 持平,略优于 Nano-Banana Pro 和 Qwen-Image-3.0 Pro。
| 对比对象 | 腾讯披露的结果 | 解读 | |---|---:|---| | Hy Image 3.0 | Hy Image 3.5 Preview 提升 30% | 体现腾讯自家版本迭代幅度 | | Seedream 5.0 Pro | 整体表现持平 | 说明其目标是国内专业生图第一梯队 | | Nano-Banana Pro | Hy Image 3.5 Preview 略优 | 仍需更多公开测试验证 | | Qwen-Image-3.0 Pro | Hy Image 3.5 Preview 略优 | 对比结果来自腾讯内部 GSB 盲测 |
这组数据最值得关注的地方,不是“超过了谁”,而是腾讯开始用专业设计师盲测来描述模型能力。生图模型的真实体验很难只用通用视觉问答或文字准确率衡量,最终用户关心的是人物是否稳定、构图是否能改、文字是否可读、风格是否统一,以及一张图能不能真正进入工作流程。
但这组结果也不能直接等价为公开排行榜。腾讯没有在参考资料中披露完整测试集、提示词、评测轮数和胜率区间,因此外部用户仍需要通过元宝、ima 或其他接入产品自行体验。尤其在中文文字生成、复杂信息图和多轮编辑这几个维度,模型之间可能出现明显的场景差异。
元宝和 ima:腾讯把模型能力直接放进应用入口
元宝是腾讯面向普通用户的 AI 助手应用,也是 Hy Image 3.5 Preview 获取真实反馈的主要入口之一。 腾讯表示,该模型已经提前 2 个月在元宝 App 中逐步灰度上线和内测,生图整体请求量提升超过 50%。
元宝目前可免费体验人像编辑、智能 P 图、旅游规划图、知识信息图等场景,用户可以进入“创作”功能使用。对于普通用户来说,最大的变化不是模型名称,而是编辑过程更接近日常表达:先上传照片,再说“把背景换成海边”,接着要求“人物保持不变,光线改成日落”,最后再让模型“裁成适合小红书封面的比例”。
ima 的定位更偏向知识库驱动的内容生产工具。 用户可以通过 copilot 将知识库内容转换为可视化网页、PPT 和图片。这个场景把图像生成从“凭空创作”连接到已有资料,适合会议纪要、行业报告、课程内容、产品说明和内部知识整理。
如果说元宝更像面向大众的创作入口,ima 更接近企业和个人知识工作流里的视觉化模块。两者共同说明腾讯没有把 Hy Image 3.5 Preview 只当成一个独立模型发布,而是试图通过已有应用分发能力,把模型直接嵌入内容生产链路。
专业应用接入:从修图走向商业物料
WorkRally、OnSolo 和 Miora 更强调专业美学与影视物料创作。 这几个应用目前提供限时两周免费体验,覆盖商业海报、剧集分镜、影视宣传物料、UI 设计、创意插画、品牌视觉和电商素材等场景。
这些场景对模型的要求与普通头像生成不同。商业物料需要明确的版式、稳定的主体、可控的色彩和较高的修改效率;剧集分镜需要在多个镜头之间维持人物、服装和场景关系;品牌视觉则要求模型尽量遵守既定的 Logo、产品结构和视觉规范。
Hy Image 3.5 Preview 的多轮上下文能力,理论上更适合这类任务。设计师可以先让模型提出三版构图,再确定其中一版,随后继续调整人物位置、背景氛围、字体区域和画幅比例。模型不再只是负责“出一张图”,而是参与从草稿到定稿的连续过程。
不过,专业创作对可控性的要求通常高于审美效果。一个模型即使第一张图非常漂亮,如果第二轮修改会改变产品外观,或者无法保持人物脸部和服装一致,就很难直接用于生产。因此,Hy Image 3.5 Preview 的真正竞争力,最终要看多轮编辑的稳定性,而不只是盲测中的首图质量。
价格:2K 图像每张 0.15 元,按输出图片计费
腾讯云 API 的 2K 图像价格为 0.15 元/张,国际版价格为 0.024 美元/张,并且只对输出图片收费。 企业和开发者可以通过腾讯云 TokenHub 调用该模型,具体可用区域、调用限制和服务条款仍应以腾讯云官方页面为准。
这个价格在国内专业生图服务中具备一定竞争力,尤其适合需要批量生成电商素材、营销图片和内容配图的场景。按输出图片收费,也让成本核算比复杂的输入输出 Token 计费更直观:生成 1000 张 2K 图片,对应模型调用成本约为 150 元,不包括后续存储、审核、工作流编排和其他云服务费用。
但低单价不等于最终生产成本低。企业还需要考虑失败重试、人工筛选、版权审核、敏感内容拦截、图片存储、后期排版和品牌一致性检查。如果一个项目平均需要生成 5 张候选图才能选出 1 张可用图,实际图片生成成本还要乘以候选次数。多轮对话虽然可能减少重复生成,但也可能因为频繁修改带来更多调用量。
接入腾讯云媒体服务,意味着它不只面向聊天应用
腾讯混元已将 Hy Image 3.5 Preview 接入腾讯云媒体处理 MPS 和云点播 VOD 平台。 这一步的意义在于,图像生成能力开始进入腾讯云原有的媒体处理链路,而不是停留在独立聊天窗口里。
对于内容平台和企业客户而言,真实需求往往是“上传素材—处理—生成—审核—发布”的完整流程。接入 MPS 和 VOD 后,Hy Image 3.5 Preview 可以更容易参与封面制作、视频配图、栏目视觉、内容包装和营销素材生产。未来如果与视频生成、数字人、素材检索和内容审核进一步打通,图像模型就可能成为媒体工作流中的一个标准节点。
这也是腾讯相较纯模型公司的优势所在:腾讯已经拥有元宝、ima、腾讯视频、腾讯云和企业协同产品,能够把同一个模型放入多个真实业务场景。模型效果当然重要,但应用入口、数据反馈和工作流整合,决定了模型能否形成持续使用。
腾讯混元正在加快“预览版先行”的迭代节奏
腾讯混元表示,自 2026 年 2 月重建基础设施以来,混元大模型保持平均每两个月迭代一次大版本的节奏。 Hy Image 3.5 Preview 延续了“preview 先行、正式版跟进”的发布方式,先让真实用户使用,再将反馈带回研发流程。
这种节奏与传统模型发布方式不同。过去,模型往往要等到指标、产品和服务都准备完成后才对外发布;现在,预览版本身成为研发闭环的一部分。腾讯先在元宝中灰度测试两个月,再逐步扩展到更多应用和云服务,实际上是在用大规模真实请求验证模型的稳定性、成本和用户偏好。
这条路线的风险也很明确。Preview 模型可能存在输出波动、服务限制、风格变化和版本不兼容问题,企业在正式投入生产前需要评估模型版本是否稳定、生成结果是否可追溯,以及后续正式版是否会改变效果或价格。
OpenAI Hub 观察:生图模型的竞争已经从“首图质量”转向“工作流能力”
Hy Image 3.5 Preview 的发布,说明国内生图模型的竞争重点正在发生变化。单纯比较谁生成的第一张图片更漂亮,已经不足以判断模型的产品价值;真正拉开差距的,是能否理解多张参考图、能否记住历史上下文、能否在局部修改时保护已确认元素,以及能否以合理成本接入企业生产流程。
腾讯给出的 30% 迭代提升和与 Seedream 5.0 Pro 持平的盲测结果,说明 Hy Image 3.5 Preview 至少已经把目标放在第一梯队。但要判断它是否真的适合专业生产,还需要观察三个指标:第一,多轮编辑超过 3 至 5 轮后主体是否稳定;第二,中文文字、表格和信息图的可读性是否达到商用要求;第三,在批量生成和高并发场景下,实际成功率、延迟与成本是否可控。
对个人用户来说,元宝提供了低门槛体验入口;对知识工作者来说,ima 把知识库转成图片、PPT 和网页;对企业和开发者来说,腾讯云提供了按输出图片计费的服务。三条路径覆盖了从个人创作到商业生产的不同需求。
总体来看,Hy Image 3.5 Preview 不是一次单纯的模型升级,而是腾讯混元将图像生成能力嵌入应用和云服务体系的一次扩展。它是否能真正挑战 Seedream、Nano-Banana 和 Qwen-Image 等产品,还要等待更透明的第三方评测和更多真实案例;但从多轮对话、多图参考、应用首发和云端定价这几个动作看,腾讯已经把它从“会生成图片的模型”推进到“参与视觉工作流的产品组件”。
参考来源
- IT之家:腾讯混元 Hy Image3.5 preview 发布:本文关于发布时间、模型能力、内部 GSB 盲测、应用上线和定价信息的主要来源。
- IT之家:腾讯混元发布 Hy ASR 3.0 preview:用于补充腾讯混元近期持续采用 Preview 版本推进产品迭代的背景信息。
- 腾讯混元官网:用于了解腾讯混元模型与产品生态,具体服务能力和版本信息以官方页面为准。



