首页> 游戏资讯> 腾讯升级自研混元大模型:中文效果超越GPT3.5

腾讯升级自研混元大模型:中文效果超越GPT3.5

时间:2023-10-27 17:04:49 来源:7天玩

腾讯混元大模型于今年9月正式发布,1个多月后,该大模型今天迎来重磅升级。据“鹅厂技术派”公众号介绍,腾讯混元大模型迎来全新升级,并正式对外开放“文生图”功能。

12b80db8bee11ceae4316ac934bd687b_small_202310261654283115.png

升级后的腾讯混元中文效果整体超过GPT3.5,代码能力大幅提升20%,达到业界领先水平。

据介绍,相比其他大模型,腾讯混元的文生图应用,在人像真实感、场景真实感上有比较明显的优势。同时,在中国风景、动漫游戏等场景等生成上有较好的表现。

1a4a07b023a44354051922a0cd9b9ec2_small_202310261654355858.png

大模型文生图的难点体现在对提示词的语义理解,生成内容的合理性以及生成图片的效果。针对这三个技术难点,腾讯进行专项的技术研究,提出一系列原创算法,来保证生成图片的可用性和画质。 

具体来说,在语义理解方面,腾讯混元采用了中英文双语细粒度的模型,模型同时建模中英文实现双语理解,而不是通过翻译。通过优化算法提升了模型对细节的感知能力与生成效果,有效避免多文化差异下的理解错误。

c66ca2a58d2e187ed7bdc8996fb39ff9_small_202310261654416361.png

为了解决AI生成人体结构和手部经常容易变形的问题,混元文生图增强了算法模型的图像二维空间位置感知能力。并将人体骨架和人手结构等先验信息引入到生成过程中,让生成的图像结构更合理,减少错误率。

质感方面,经模型算法优化后,混元文生图的人像模型,包含发丝、皱纹等细节的效果提升了30%,场景模型,包含草木、波纹等细节的效果提升25%。

10fe8451c4860727830d862830a50f75_small_202310261654556726.png

据悉,混元大模型为腾讯全链路自研大语言模型,参数规模超千亿,预训练语料超2万亿tokens(大语言模型文本单位),具有中文创作能力、任务执行能力和复杂语境下的逻辑推理能力。

该模型能在多种场景下处理超长文本,通过位置编码优化,提升长文处理效果和性能,结合指令跟随优化,让产出内容更符合字数要求。

dbf7f4df83997ac0011689c9359d14dc_small_202310261655041851.png


混元大模型已在腾讯云、腾讯广告、微信搜一搜等多个腾讯内部业务和产品经过测试。同时也服务产业场景,客户可基于API调用混元,也可基于混元做专属的行业大模型。

8b2bef426393f57960f81036b764a39d_small_202310261655131286.png

adace2019535ee789d42a05c0e649577_small_202310261655153364.png

b968fb15f6afb3c1f9c4a87bb61346d3_small_202310261655165869.png

X