新浪科技讯 3月22日下午消息,腾讯宣布推出自研深度思考模型混元T1正式版,目前已上线腾讯云官网,并即将在腾讯元宝灰度上线。 该模型以腾讯于 2 月底发布的新一代快思考模型混元Turbo S为基座打造,是一款能秒回、吐字快、擅长超长文处理的强推理模型,性能保持业界领先。 通过大规模强化学习,并结合数学、逻辑推理、科学和代码等理科难题的专项优化,混元T1正式版进一步提升了推理能力。与此前已上线腾讯元宝的混元T1-preview模型相比,综合效果明显提升。 在体现推理模型基础能力的常见benchmark上,如大语言模型评估增强数据集MMLU-PRO中,混元T1取得87.2分,仅次于o1。在CEval、AIME、Zebra Logic等中英文知识及竞赛级数学、逻辑推理的公开基准测试中,混元T1的成绩也达到业界领先推理模型的水平。 此外,T1还在多项对齐任务、指令跟随任务和工具利用任务中展现出了非常强的适应性。 混元T1正式版沿用了混元Turbo S的创新架构,采用Hybrid-Mamba-Transformer融合模式。这是工业界首次将混合Mamba架构无损应用于超大型推理模型。 这一架构有效降低了传统Transformer结构的计算复杂度,减少了KV-Cache的内存占用,从而显著降低了训练和推理成本,让混元T1实现首字秒出,吐字速度达到最快80 tokens/s。 目前,混元T1正式版已在腾讯云官网上线,输入价格为每百万tokens 1元,输出价格为每百万tokens 4元。(罗宁) 责任编辑:常福强 【免责声明】本文仅代表作者本人观点,与和讯网无关。和讯网站对文中陈述、观点判断保持中立,不对所包含内容的准确性、可靠性或完整性提供任何明示或暗示的保证。请读者仅作参考,并请自行承担全部责任。邮箱:news_center@staff.hexun.com |
家是碎片化的拼图,有人带着岁月裂痕而来,有人捧着真心莽撞...
中新网杭州2月22日电(张煜欢)22日,首届低空经济创业者年会暨资...
雨水,一年之中第二个节气。此时,苍龙七宿从地平线上昂然上...
嗨!这里是娱乐寡姐,为你带来最新娱乐资讯。网传李现将与导...
2月17日中午,琼瑶官方微博发布声明,称:我们发现市场上存在...