腾讯混元能画画了！大模型对外开放文生图能力_乡兴融媒网

首页 > 数字AI

腾讯混元能画画了！大模型对外开放文生图能力

作者：李政葳发布时间：2023-10-29来源：光明网

文生图是AIGC领域的核心技术之一，也是体现通用大模型能力的试金石，对模型算法、训练平台、算力设施都有较高的要求。

　　10月26日，腾讯腾讯混元大模型迎来全新升级，并正式对外开放“文生图”功能，展示了其在图像自动生成领域的领先能力。升级后的腾讯混元中文能力整体超过GPT3.5，代码能力大幅提升20%，达到业界领先水平。

　　我们可以看到，腾讯混元大模型可以很好地理解提示词中提到的“棉质连衣裙”“汉服”等内容，同时在风格上，也通过建筑和风景等衬托，很好地展示了“古代中国”的风格要求。

　　在语义理解方面，腾讯混元采用了中英文双语细粒度的模型。模型同时建模中英文实现双语理解，并通过优化算法提升了模型对细节的感知能力与生成效果，有效避免多文化差异下的理解错误。

　　在内容合理性方面，AI生成人体结构和手部经常容易变形。混元文生图通过增强算法模型的图像二维空间位置感知能力，并将人体骨架和人手结构等先验信息引入到生成过程中，让生成的图像结构更合理，减少错误率。

　　在画面质感方面，混元文生图基于多模型融合的方法，提升生成质感。经过模型算法的优化之后，混元文生图的人像模型，包含发丝、皱纹等细节的效果提升了30%，场景模型，包含草木、波纹等细节的效果提升了25%。

　　作为实用级的通用大模型，腾讯混元大模型的应用场景丰富多样。目前，超过180个腾讯内部业务已接入腾讯混元，包括腾讯会议、腾讯文档、企业微信、腾讯广告和微信搜一搜等。最近，QQ浏览器还基于腾讯混元推出了“PDF阅读助手”，具备智能摘要、智能问答和多轮提问等功能。

　　据了解，目前已有来自零售、教育、金融、医疗、传媒、交通、政务等多个行业的客户，通过腾讯云调用腾讯混元大模型API，应用领域涉及智能问答、内容创作、数据分析、代码助手等多个场景。今年9月首批通过备案后，腾讯混元大模型也已经面向C端用户陆续开放体验，用户通过小程序或网页端，就能与腾讯混元对话。

（责编：韩红红）

相关阅读

全球数字贸易产业联盟DTU“百城之旅”重

乡兴中国-乡兴融媒网讯（记者李艳彬通讯员郑小华）2026年5月12日—14日，以拥抱人工智能+，我们在行动为主题的全球数字贸易产业联盟DTU“百城之旅”[详细]
当AI成为“搭子”，如何乘“智”而上

　　工人通过AI视觉检测设备对产品进行质检。　　刘志勇摄　　观众试戴AI翻译眼镜。　　新华社记者高咏薇摄　　学生在“AI智慧操场”跑步。　　杨潇摄　　当下，[详细]
词元与数字资产：智能体经济的新价值范式

当人工智能从辅助工具进化为独立的经济主体，人类社会的价值创造与交换体系正在经历一场根本性的重构。在这场变革中，“词元”与“数字资产”作为两个关键概念，构成了理解[详细]

推荐

特写：预见未来出行

热门

寒假来临，众多电子“陪娃神器

旧手机，如何物尽其用为数字经济塑造良好发展格局 “数字引擎”加速上合示范区国家战以数字之光点亮演艺之美数字化带来消费新体验

推荐图文

田间送技！黑龙江硬核赋能甜瓜

策湖湿地护清波 “潮汐菜场”背后的基层治理智慧百亩高山杜鹃迎客来小辣椒撬动亿元产业链 2026北京亦庄半程马拉松暨人形

微视频

黑土地保护与粮食高产有了绿色

满目嫣红！云南蒙自凤凰花缀满枝头云南瑞丽迎来绣球花盛放佳期愿每一位妈妈，都被岁月温柔以待数字贸易与现实数据资产融合发展会菏泽牡丹瓷：留住花开之美

即时新闻