当前位置：首页 > 文章列表 > 科技周边 > 人工智能 > 腾讯自研混元大模型正式亮相，通过腾讯云对外开放

腾讯自研混元大模型正式亮相，通过腾讯云对外开放

来源：51CTO.COM 2023-09-07 16:03:16 0浏览收藏

亲爱的编程学习爱好者，如果你点开了这篇文章，说明你对《腾讯自研混元大模型正式亮相，通过腾讯云对外开放》很感兴趣。本篇文章就来给大家详细解析一下，主要介绍一下，希望所有认真读完的童鞋们，都有实质性的提高。

国产大模型进入长跑期，从参数至上转向实用优先。

9月7日，在2023腾讯全球数字生态大会上，腾讯混元大模型正式亮相，并宣布通过腾讯云对外开放。

腾讯混元大模型是由腾讯全链路自研的通用大语言模型，拥有超千亿参数规模，预训练语料超2万亿tokens，具备强大的中文创作能力，复杂语境下的逻辑推理能力，以及可靠的任务执行能力。

腾讯自研混元大模型正式亮相，通过腾讯云对外开放

值得关注的是，腾讯混元大模型是“从实践中来，到实践中去”的实用级大模型。腾讯云、腾讯广告、腾讯游戏、腾讯金融科技、腾讯会议、腾讯文档、微信搜一搜、QQ浏览器等超过50个腾讯业务和产品，已经接入腾讯混元大模型测试，并取得初步效果。

据了解，混元大模型将作为腾讯云MaaS服务的底座，客户不仅可以直接通过API调用混元，也可以将混元作为基底模型，为不同产业场景构建专属应用。

腾讯集团高级执行副总裁、云与智慧产业事业群CEO汤道生表示：“以大模型生成技术为核心，人工智能正在成为下一轮数字化发展的关键动力，也为解决产业痛点带来了全新的思路。大模型需要基于产业场景，与企业数据融合，才能释放出最大的价值。”

久为功，全链路技术自研

据腾讯集团副总裁蒋杰介绍，腾讯混元大模型从第一个token开始从零训练，掌握了从模型算法到机器学习框架，再到AI基础设施的全链路自研技术。

腾讯自研混元大模型正式亮相，通过腾讯云对外开放

腾讯集团副总裁蒋杰

从2021年开始，腾讯先后推出千亿和万亿参数的NLP稀疏大模型，打破CLUE三大榜单记录，实现在中文理解能力上的新突破。

目前，业界大模型在场景中的应用依然有限，主要集中在容错率高、任务简单的休闲场景。腾讯在算法层面进行了一系列自研创新，提高了模型可靠性和成熟度。

针对大模型容易“胡言乱语”的问题，腾讯优化了预训练算法及策略，让混元大模型的幻觉相比主流开源大模型降低了30%至50%；通过强化学习的方法，让模型学会识别陷阱问题；通过位置编码优化，提高了超长文的处理效果和性能；提出思维链的新策略，让大模型能够像人一样结合实际的应用场景进行推理和决策。

此外，腾讯还自研了机器学习框架Angel，使训练速度相比业界主流框架提升1 倍，推理速度比业界主流框架提升1.3倍。

腾讯自研混元大模型正式亮相，通过腾讯云对外开放

腾讯混元大模型全链路自研

得益于全链路自研技术，腾讯混元大模型能够理解上下文的含义，并且有长文记忆能力，可以流畅地进行专业领域的多轮对话。除此之外，它还能进行文学创作、文本摘要、角色扮演等内容创作，做到充分理解用户意图，并高效、准确的给出有时效性的答复。

在中国信通院《大规模预训练模型技术和应用的评估方法》的标准符合性测试中，混元大模型共测评66个能力项，在“模型开发”和“模型能力”两个重要领域的综合评价均获得了当前的最高分。在主流的评测集MMLU、CEval和AGI-eval上，混元大模型均有优异的表现，特别是在中文的理科、高考题和数学等子项上表现突出。

上海财经大学校长刘元春认为：“借助于全链路自研，中国将不断积累大模型相关人才和技术，逐渐形成体系化的产业链、人才链、技术链和创新链，最终走出一条发展通用人工智能的中国路径，助力我们在数字技术的创新上取得突破性进展。”

腾讯全面拥抱大模型

蒋杰表示：“我们研发大模型的目标不是在评测上获得高分，而是将技术应用到实际场景中。腾讯将全面拥抱大模型。”

腾讯自研混元大模型正式亮相，通过腾讯云对外开放