2025-05-12 11:17:30 | 来源: AICG工具箱
10月27日报道丨10月26日,“鹅厂技术派”(腾讯产品技术官方发布账号)发布消息称,腾讯混元大模型近日迎来全新升级,并正式对外开放“文生图”功能。官方宣称,升级后的腾讯混元中文效果整体超过 GPT-3.5,代码能力大幅提升 20%,大模型能力已经达到了业界领先水平。
据介绍,大模型文生图的难点体现在对提示词的语义理解,生成内容的合理性以及生成图片的效果,针对这三个技术难点,腾讯进行了专项的技术研究,提出了一系列原创算法:
在语义理解方面,腾讯混元采用了中英文双语细粒度的模型,模型同时建模中英文实现双语理解,而不是通过翻译,通过优化算法提升了模型对细节的感知能力与生成效果,有效避免多文化差异下的理解错误。
在内容合理性方面,AI 生成人体结构和手部经常容易变形。混元文生图通过增强算法模型的图像二维空间位置感知能力,并将人体骨架和人手结构等先验信息引入到生成过程中,让生成的图像结构更合理,减少错误率。
在画面质感方面,混元文生图基于多模型融合的方法,提升生成质感。经过模型算法的优化之后,混元文生图的人像模型,包含发丝、皱纹等细节的效果提升了 30%,场景模型,包含草木、波纹等细节的效果提升了 25%。
如果用户想生成一张更接近真人感的照片,或接近实拍的图片,可以加上“真实感”或“摄影风”等描述;如果用户想要特定风格的图片,建议在提示词中加入该风格的描述,如油画风、赛博朋克风等。此外,用户还可以对画面进行尽可能详细地描述,以获得满意的效果。
以下为官方发布的更多示例图:
目前,超过180个腾讯内部业务已接入腾讯混元,包括腾讯会议、腾讯文档、企业微信、腾讯广告和微信搜一搜等。任何用户都可以腾讯混元大模型官网或“腾讯混元助手”微信小程序申请内测体验。
热门榜单
Valideo,亚马逊购物助手
常用AIVisual Electric
常用AI千鹿AI
常用AICanva可画
常用AI即梦AI
常用AIHi Echo — 网易有道
常用AI讯飞绘文
常用AIGlow AI
常用AI堆友AI反应堆
常用AI热门资讯
周鸿祎×朱啸虎的创业圆桌会:中国AI大模型反超美国的机会来了,OpenAI很快就会遇到发展瓶颈
04-18iPhone 16新品将在9月10日发布丨云知声推出「山海」多模态模型丨商汤科技推出「元萝卜」国际象棋AI下棋机器人
02-08字节跳动发布豆包视频生成模型,这效果让我分不清AI虚拟与现实的边界
12-25首批85个ChatGPT Plus插件全面测评:能打“五星”的插件只有6个
01-07WPS AI表格教程丨Excel办公软件函数公式怎么使用_WPS AI表格公式快速生成!
01-15AI数字人越来越强了!推荐一款最新本地部署生成AI数字人工具:栩栩如生,以假乱真!
01-15手机怎么运行stable diffusion
01-24ChatGPT年度更新曝光:免费用户升级GPT-4丨华为Pura 70修复「AI消除衣服」BUG丨商汤日日新5.0官网上线
04-14Stability AI宣布全球裁员10%以应对财务困境:此前合伙人CEO与核心研发骨干已离职
04-15重磅!今起ChatGPT(GPT-3.5)取消用户注册制,全网可直接白嫖
04-17