10亿红包后,腾讯混元打算开源这个“800亿”的模型
创始人
2026-01-28 17:49:20

在刚刚宣布元宝春节10亿红包活动后,1月28日,腾讯混元宣布将近日于元宝和腾讯混元官网同步上线的混元图像3.0图生图模型(HunyuanImage 3.0-Instruct)开源。

混元图像3.0图生图基于80B(800亿)总参数规模(激活参数约13B)的混合专家架构,在处理图像编辑任务时展现出强大的推理能力和精准的编辑效果。

训练过程中,混元团队构建了千万量级的图生图数据,覆盖80多个任务,并注入了思维链数据,使模型能够学会先分析用户图像和意图,再输出详细编辑指令。后训练阶段采用自研MixGRPO算法,高效对齐用户偏好,大幅提升了指令响应和非编辑区域保持一致的效果。

据悉,在最新全球权威大模型竞技场 LMArena 的Image Edit(图片编辑)榜单上,腾讯混元图像3.0图生图位列全球第七,进入第一梯队,成为全球最强的开源图生图模型。LMArena官方X祝贺混元图像3.0图生图模型:“图片编辑类别与Nano-Banana和Seedream-4.5等表现相当”。

混元图像3.0图生图支持多样化的图片编辑与多图融合能力,包括增、删、改、风格变换、老照片修复、人物与文字修改等图片编辑功能,以及将多张照片中的元素提取出来合成新图片的能力。该模型基于混元图像3.0的原生多模态架构,将文本理解、视觉理解与图像生成深度融合于同一模型中,这使得模型更能理解用户指令,生成的效果也更好。

对于普通用户,该模型可用于制作表情包、虚拟人物合拍、社交分享等日常场景。对于专业用户,它能够助力电商海报设计、游戏角色定制、创意图片制作等专业领域,显著提升创作效率。

相关内容

热门资讯

人工智能产业日报(08.04)... 行业动态 AI越狱、硅谷慌了,人类到底在害怕什么? 1346名来自OpenAI、Anthrop...
广西AI在印尼当“向导” “没有导航以前,送一趟货经常找不着地方或走错路。现在有了导航,跟着定位走就行。”近日,印度尼西亚北马...
京东:开源实时流式视频编辑模型... 钛媒体App 8月5日,据京东黑板报消息,8月5日,京东宣布开源自研的实时流式视频编辑模型JoyAI...
114B参数、6B激活,San... 鹭羽 发自 凹非寺 量子位 | 公众号 QbitAI 再牛的大模型,也要放到行业面前公开露个面,才算...
京东开源自研实时流式视频编辑模... 8月5日消息,京东黑板报今日发文宣布,京东开源自研实时流式视频编辑模型JoyAI-Video-Edi...