
智东西9月22日报道,今日,腾讯混元正式发布新一代图像生成模型Hy Image3.5 preview,支持文生图、图生图和多轮对话创作,最高可输出2K分辨率图像。
距离今年1月混元Hy Image 3.0图生图版本开源过去近8个月,腾讯再次升级图像生成能力,也在多模态方向继续加快更新。

在由内部数百名专业设计师参与的GSB盲测中,Hy Image3.5 preview相比Hy Image3.0的综合表现提升30%,与字节Seedream 5.0 Pro表现相当,并略高于Nano-Banana Pro和Qwen-Image-3.0 Pro。
目前,该模型已经接入腾讯元宝、AI知识管家ima、专业影视智能平台WorkRally、专业剧集及游戏内容制作工具OnSolo、创意智能体Miora、办公智能体工作台WorkBuddy等多款原生AI应用。
其中,用户可以在元宝免费体验人像编辑、智能P图等功能,Miora、WorkRally和OnSolo则将开启为期两周的免费体验。
面向企业和开发者,Hy Image3.5 preview也已上线腾讯云TokenHub,2K图像API价格为0.15元/张,仅对最终输出图片收费。
基于各家官方公开定价整理的对比,在13款主流生图模型中,Hy Image3.5 preview的单张2K图片生成成本最低;作为对比,GPT Image 2.5 low约为0.162元/张,Qwen-Image-3.0约为0.2元/张。

体验地址:
混元官网:https://aistudio.tencent.com/
腾讯云TokenHub:https://console.cloud.tencent.com/tokenhub/models/detail?modelId=hy-image-v3.5-preview
一、最多参考5张图,支持连续对话改图
相比此前的Hy Image3.0,Hy Image3.5 preview重点提升了语言与视觉理解,以及文本渲染与布局、真实感、风格表现和编辑一致性等能力。
具体来看,模型同时支持文生图和图生图,单次最多可上传5张图片作为参考。
它还支持基于历史上下文进行多轮创作。例如,用户生成一张图片后,可以继续通过自然语言修改其中的人物、背景、构图或者其他细节,而无需每次重新描述完整需求。
输出方面,Hy Image3.5 preview支持多种图片比例,最高分辨率达到2K。
其应用场景主要划分为两类。
一类是日常修图、人像美化、知识卡片等普通用户场景;

▲换装试穿

▲局部风格化
另一类则面向商业海报、剧集分镜、影视物料、UI设计、创意插画、品牌视觉和电商物料等专业创作需求。

▲影视场景

▲电商场景

▲海报设计场景
二、元宝已灰度测试两个月,生图请求量增超50%
实际上,在正式公布前,Hy Image3.5 preview已经提前约两个月在腾讯元宝中逐步灰度上线。
据腾讯披露,灰度测试期间,元宝端内生图整体请求量提升超过50%。
目前,这款模型已经进入腾讯旗下多款AI产品。
普通用户可以通过元宝体验人像编辑、智能P图、旅游规划图和知识信息图等能力;
ima则可以结合Copilot,将知识库内容转化为网页、PPT和图片。

面向影视和专业视觉创作的Miora、WorkRally、OnSolo也已接入新模型,并将提供两周限时免费体验。

此外,Hy Image3.5 preview还接入了腾讯云媒体处理MPS、云点播VOD等服务。
三、混元基础模型团队整合,多模态人才持续补强
今年以来,腾讯对混元模型团队也进行了多轮调整。
7月23日,腾讯将混元大语言模型部门与多模态模型部门合并,组建基础模型部,由腾讯首席AI科学家姚顺雨统一负责。
在此之前,前OpenAI研究员田永龙(Yonglong Tian)已于7月加入腾讯大语言模型部,后续参与VLM(视觉语言模型)相关研发。田永龙长期从事视觉表征学习、对比学习等研究,也曾参与GPT-5研发。
今年年初,腾讯还引入了前Sea AI Lab研究员庞天宇,担任混元多模态强化学习首席研究员及技术负责人。
此前,腾讯在多模态生成方向还引入了原阿里通义实验室应用视觉团队负责人薄列峰、微软亚洲研究院原首席研究员胡瀚等研究人员。
从此次Hy Image3.5 preview来看,腾讯正在将混元图像模型更深地嵌入元宝、办公、影视制作和云服务等内部产品中,通过实际业务反馈继续迭代模型。
结语:生图能力之外,产品入口也在变重要
从元宝里的日常P图,到影视、电商和商业设计,腾讯把Hy Image3.5 preview同步铺进了旗下多款AI产品。
在生图模型能力差距不断缩小的情况下,除了模型本身的生成效果,调用价格、产品入口以及能否进入真实创作流程,也正在成为厂商竞争的另一层重点。