腾讯混元大模型升级:中文能力超GPT-3.5, 正式对外开放“文生图”功能
今年9月,腾讯混元大模型正式发布,1个多月后,该大模型近日迎来重磅升级。
据“鹅厂技术派”公众号介绍,10月26日上午,腾讯混元大模型迎来全新升级,并正式对外开放“文生图”功能。官方宣称,升级后的腾讯混元中文效果整体超过GPT3.5,代码能力大幅提升 20%,达到业界领先水平。
据介绍,相比其他大模型,腾讯混元的文生图应用,在人像真实感、场景真实感上有比较明显的优势。
大模型文生图的难点体现在对提示词的语义理解,生成内容的合理性以及生成图片的效果。
针对这三个技术难点,腾讯进行专项的技术研究,提出一系列原创算法,来保证生成图片的可用性和画质。
具体来说,在语义理解方面,腾讯混元采用了中英文双语细粒度的模型,模型同时建模中英文实现双语理解,而不是通过翻译。
在内容合理性方面,为了解决AI生成人体结构和手部经常容易变形的问题,混元文生图增强了算法模型的图像二维空间位置感知能力。并将人体骨架和人手结构等先验信息引入到生成过程中,让生成的图像结构更合理,减少错误率。
在画面质感方面,经模型算法优化后,混元文生图的人像模型,包含发丝、皱纹等细节的效果提升了30%,场景模型,包含草木、波纹等细节的效果提升25%。
据悉,混元大模型为腾讯全链路自研大语言模型,参数规模超千亿,预训练语料超2万亿tokens(大语言模型文本单位),具有中文创作能力、任务执行能力和复杂语境下的逻辑推理能力。
(综合自IT之家、快科技)
责任编辑:赵苗苗
猜你喜欢
华网
共202篇文章
追踪数字金融发展动向,探索金融科技融合之道,解读传统金融机构转型创新。
最近更新文章
-
佳都科技:2023年公司扭亏为盈靠“炒股”,交通大模型生意成色几何?|看财报
2024-04-10 10:02:19
-
2024-04-03 09:55:25
-
2024-04-01 09:38:08
-
字节AI教育平台海外人气火爆,AI人工智能ETF(512930.SH)上涨1.65%
2024-03-28 10:25:01
-
2024-03-27 09:23:30
24小时热榜