腾讯宣布升级混元大模型,中文能力整体超过 GPT3.5,新增的“文生图”功能

2025-02-20 0 439

腾讯宣布升级混元大模型,中文能力整体超过 GPT3.5,代码能力提升 20%。并正式对外开放“文生图”功能。 针对新增的“文生图”功能。腾讯表示进行了专项的技术研究,提出了一系列原创算法:

在语义理解方面,腾讯混元采用了中英文双语细粒度的模型,模型同时建模中英文实现双语理解,而不是通过翻译。这样做通过优化算法提升了模型对细节的感知能力与生成效果,有效避免了多文化差异下的理解错误。

在内容合理性方面,AI生成的人体结构和手部经常容易出现变形。为了解决这个问题,混元文生图通过增强算法模型的图像二维空间位置感知能力,并将人体骨架和人手结构等先验信息引入到生成过程中。这让生成的图像结构更加合理,同时也减少了错误率。

在画面质感方面,混元文生图采用了基于多模型融合的方法来提升生成质感。经过模型算法的优化,人像模型在发丝、皱纹等细节方面的效果提升了30%,而场景模型在草木、波纹等细节方面的效果提升25%。

目前超过 180 个腾讯内部业务已接入腾讯混元,包括腾讯会议、腾讯文档、企业微信、腾讯广告和微信搜一搜等。最近,QQ 浏览器还基于腾讯混元推出了「PDF 阅读助手」,具备智能摘要、智能问答和多轮提问等功能。

若非本站原创的文章,特别作如下声明:
本文刊载所有内容仅供提供信息交流和业务探讨而非提供法律建议目的使用,不代表任何监管机构的立场和观点。
不承担任何由于内容的合法性及真实性所引起的争议和法律责任。
凡注明为其他媒体来源的信息,均为转载,版权归版权所有人所有。
如有未注明作者及出处的文章和资料等素材,请版权所有者联系我们,我们将及时补上或者删除,共同建设自媒体信息平台,感谢你的支持!

AI老司机 AI行业动态 腾讯宣布升级混元大模型,中文能力整体超过 GPT3.5,新增的“文生图”功能 https://www.ailsj.cn/318.html

相关文章

发表评论
暂无评论