腾讯混元AI放出“终极P图神器”,网友疯狂体验

智东西
作者 王涵
编辑 云鹏
免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈
智东西1月28日报道,今天,腾讯混元图像3.0图生图版本正式开源。在最新的LMArena图片编辑榜单上,腾讯混元图像3.0图生图位列全球第七,也是前七名里面唯一开源的模型。

▲LMArena图片编辑榜单(来源:LMArena)
LMArena最新X祝贺混元图像3.0图生图“在图片编辑榜单中与Nano-Banana和Seedream-4.5等表现相当”。

▲LMArena最新祝贺推文(来源:X)
混元图像3.0图生图支持增、删、改、风格变换、老照片修复、人物与文字修改等图片编辑功能,还可以将多张照片中的元素提取出来合成新图片。
1月26日,该模型在元宝上线,已经被网友玩出“花”了:

智东西也第一时间上手体验,发现该模型可以保持前后素材元素风格的一致性,对照片细节把握准确,思考响应速度也较快,可玩性确实很高。

▲混元图像3.0图生图开源页面(来源:Hugging Face)
开源地址:
Github:
https://github.com/Tencent-Hunyuan/HunyuanImage-3.0
Hugging Face:
https://huggingface.co/tencent/HunyuanImage-3.0-Instruct
Hugging Face(蒸馏版):
https://huggingface.co/tencent/HunyuanImage-3.0-Instruct-Distil
一、融合理解、推理与生成:混元图像3.0图生图“先思考后编辑”
据最新介绍,混元图像3.0图生图采用混合专家原生多模态架构,总参数规模达80B,激活参数约13B。
训练过程中,混元团队构建了千万量级的图生图数据,覆盖80多个任务,并注入了思维链数据,使模型能够学会先分析用户图像和意图,再输出详细编辑指令。
后训练阶段则采用自研MixGRPO算法,对齐用户偏好,大幅提升了指令响应和非编辑区域保持一致的效果。

▲混元图像3.0图生图架构
在多模态方面,混元图像3.0图生图版本基于混元图像3.0的原生多模态架构构建,将文本理解、视觉理解与图像生成融合于同一模型中。
作为原生多模态模型,混元图像3.0图生图核心创新在于其“先思考,后编辑”的工作流程。
当接收到用户输入的图片和提示词后,模型会首先理解图像内容,然后基于提示词进行推理,确定需要编辑的区域、详细步骤以及需要保留的区域,最终形成更加详细的编辑指令。

▲混元图像3.0图生图思考过程
混元图像3.0图生图支持增、删、改、风格变换、老照片修复、人物与文字修改等图片编辑功能,还可以将多张照片中的元素提取出来合成新图片。
对于普通用户,该模型可用于制作表情包、虚拟人物合拍、社交分享等日常场景。对于专业用户,它能够助力电商海报设计、游戏角色定制、创意图片制作等专业领域,提升创作效率。
二、体验混元图像3.0图生图:一句话快速P图、一键实现产品实穿效果
1月26日,混元图像3.0图生图版已经上线元宝,可以在元宝中直接对话使用。
智东西第一时间上手体验,发现该模型可以保持前后素材元素风格的一致性,对照片细节把握准确,思考响应速度也较快。
例如,我们上传一张《蒙娜丽莎的微笑》的图片和一只小猫的照片,让元宝把这只小猫P到蒙娜丽莎的怀里:

不到一分钟,元宝就完成了P图,P后的图片中的小猫元素和蒙娜丽莎与原图保持一致,且手臂部分的前后透视关系也十分准确。
我们还可以让元宝给我们换一套妆造,替我们去颐和园滑冰:

可以看到,仅凭借“颐和园”三个字,该模型就准确地生成了颐和园的佛香阁作为背景。冰面的裂纹和在冰上滑冰的人群都十分逼真。
此外,在电商领域,用户还可以直接用豆包生成产品图。该模型可以参考指定风格,快速生成所需的电商海报,且可以自由更换海报背景:

用户还能直接将产品合成到模特身上,生成自然真实的产品上身效果图,能够大幅减少电商设计的工作量:

结语:腾讯混元开源家族再壮大,“视觉生成时代”加速到来
据腾讯混元最新分享,截止目前,腾讯混元的图像、视频衍生模型数量总数达到3000个,视频模型社区下载量超过500万,混元3D系列模型社区下载量超过300万。
混元图像3.0图生图模型的开源,在壮大了腾讯开源家族的同时,也为全球开发者社区提供了一个图像生成的新选择,或许将加速AI图像编辑向更广泛日常应用的落地。
一个功能更全面、创作更便捷、人人可参与的视觉生成时代正在加速到来。
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
工信部发布防范 OpenClaw(“龙虾”)开源智能体安全风险“六要六不要”建议
工信部发布“六要六不要”,为OpenClaw(“龙虾”)开源智能体安全风险划出红线 近日,工业和信息化部网络安全威胁和漏洞信息共享平台发布了一份重磅文件,针对当前热门的OpenClaw(因其图标酷似龙虾,业内常昵称为“龙虾”)开源智能体,提出了清晰的安全使用指引——“六要六不要”。这份建议可不是空穴
荣耀 CEO 李健:荣耀机器人全栈自研,将聚焦消费市场
荣耀CEO李健详解机器人战略:全栈自研,聚焦三大核心消费场景 荣耀春季旗舰新品发布会圆满结束后,关于公司未来发展的蓝图更加清晰。在随后的媒体沟通会上,荣耀CEO李健不仅公布了年度销售目标,更首次系统性地阐述了荣耀在机器人领域的完整战略规划与市场布局。 在探讨机器人业务发展方向时,李健明确了荣耀的坚定
别只盯着“上门装龙虾赚26万”!看懂OpenClaw背后的“意图入口”大战
别再只关注“上门装龙虾赚26万”!深度解读OpenClaw背后的“意图入口”新战争 最近科技行业的热潮,充满了戏剧性的现实色彩。一只“红色龙虾”AI智能体搅动了整个市场:有人通过提供安装服务,收取每次五百元,短短几天就赚取二十六万元收入;腾讯大厦前甚至排起长队,大家竞相领取免费的安装体验权限。这场全
openclaw安装配置
一、系统要求 在开始安装 OpenClaw 之前,请务必确认您的计算机满足以下最低配置要求。这如同搭建房屋前检查地基,是确保后续安装流程顺利、软件稳定运行的前提。更高的硬件配置将为复杂任务处理和流畅体验提供有力保障。 操作系统:支持 Windows 10 及以上版本、macOS 最新稳定版,以及主流
自研第一个SKILL-openclaw入门
自研第一个SKILL:手把手教你开发openclaw自定义技能 当你成功构建好openclaw之后,如何让它真正“智能”起来?关键在于为其开发SKILL——这些技能是openclaw的“内功心法”,决定了它能帮你做什么、做多好。 本文将带你亲自动手,从零开始开发你的第一个openclaw自定义技能,
- 日榜
- 周榜
- 月榜
相关攻略
2015-03-10 11:25
2015-03-10 11:05
2021-08-04 13:30
2015-03-10 11:22
2015-03-10 12:39
2022-05-16 18:57
2025-05-23 13:43
2025-05-23 14:01
热门教程
- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程

