关闭广告

腾讯一口气开源4款模型!最小仅0.5B,增强agent能力,手机就能跑

智东西2025-08-05 00:00:018324人阅读


智东西
作者 王涵
编辑 漠影

智东西8月4日报道,今天,腾讯混元一口气开源4款小尺寸模型,参数分别为0.5B、1.8B、4B、7B,消费级显卡即可运行

在性能上,Hunyuan 7B在不仅在数学能力上超越了OpenAI o1-mini和Qwen 3-8B,在除IFEVal榜单外,均超越OpenAI o1-mini。

模型原生上下文256k,可以一次读完3本《哈利波特》。目前已在微信读书、腾讯会议等多个腾讯应用中落地。

这4款小尺寸模型单卡就可以部署,适用于笔记本电脑、手机、智能座舱、智能家居等低功耗场景,且支持垂直领域低成本微调。

目前,4个模型均在Github和Hugging Face等开源社区上线,Arm、高通、Intel、联发科技等多个消费级终端芯片平台也都宣布支持部署。


腾讯混元官网体验地址:https://hunyuan.tencent.com/

Github地址:https://github.com/Tencent-Hunyuan

Hugging Face地址:https://huggingface.co/tencent

一、数学能力超越Qwen3-8B,能一口气读3本《哈利波特》

腾讯新开源的4个模型属于融合推理模型,并且具备快思考和慢思考两种模式。其中快思考模式提供简洁、高效的输出;而慢思考涉及解决复杂问题,具备更全面的推理步骤。

效果上,4个模型均实现了跟业界同尺寸模型的对标,其中Hunyuan 7B在数学推理测试DROP上取得85.9分的成绩,在AIME2024和AIME2025两个数学榜单上得分分别为81.1分和75.3分,均排名第一,超过OpenAI o1-miniQwen3-8B


对比Hunyuan 0.5B、1.8B和4B,在推理能力BBH测评中,1.8B的模型的成绩只与4B的成绩相差0.9分,推理能力不相上下。


这四个模型的亮点在于agent和长文能力,跟此前开源的Hunyuan-A13B模型一样,腾讯团队在技术上通过数据构建和强化学习奖励信号设计,提升了模型在任务规划、工具调用和复杂决策以及反思等agent能力上的表现,让模型实际应用中可以更好地完成深度搜索、Excel操作、旅行攻略规划等任务。

此外,模型原生长上下文窗口达到了256k,意味着模型可以一次性记住并处理相当于40万中文汉字或50万英文单词的超长内容,相当于一口气读完3本《哈利波特》,并且能记住所有人物关系、剧情细节,还能根据这些内容讨论后续故事发展。

部署上,4个模型均只需单卡即可部署,部分PC、手机、平板等设备可直接接入。并且,模型具有较强的开放性,主流推理框架(例如,SGLang,vLLM and TensorRT-LLM)和多种量化格式均能够支持。

二、已应用到微信读书、智能座舱和金融AI助手

应用层面,这4款小尺寸模型都能够满足从端侧到云端、从通用到专业的多样化需求,并且已经在腾讯多个业务中应用。

例如,依托模型原生的超长上下文能力,腾讯会议AI小助手、微信读书AI问书AI助手均实现对完整会议内容、整本书籍的一次性理解和处理。

在端侧应用上,腾讯手机管家利用小尺寸模型提升垃圾短信识别准确率,实现毫秒级拦截,保护用户隐私;腾讯智能座舱助手通过双模型协作架构解决车载环境痛点,充分发挥模型低功耗、高效推理的特性。

在高并发场景中,搜狗输入法基于模型的多模态联合训练机制使嘈杂环境下提升识别准确率;腾讯地图采用多模型架构,利用意图分类和推理能力提升了用户交互体验;微信输入法「问AI」基于模型实现输入框与AI即问即答的无缝衔接。

在垂直行业应用中,金融AI助手通过Prompt优化和少量数据微调实现超95%意图识别准确率。依托模型的理解能力,腾讯游戏翻译和QQ飞车手游NPC,在多语言理解能力、方言翻译和智能对话方面,有明显优化,这些能力在专业客服、内容出海以及电商直播等场景有较大应用潜力。

三、腾讯开源活跃,覆盖多模态

最近,全球开源领域异常热闹,中国大模型表现抢眼。腾讯混元大语言模型也在持续推进开源,其开源模型已覆盖文本、图像、视频和3D生成等多个模态。

在大语言模型领域,腾讯混元此前陆续开源了激活参数量达52B的Hunyuan large和混合推理MoE(混合专家)模型Hunyuan-A13B,这些模型凭借架构上的创新以及在性能和效果上的不错表现,在开源社区受到广泛关注。

多模态方面,混元还开放了完整多模态生成能力及工具集插件,陆续开源了文生图、视频生成和3D生成能力,提供接近商业模型性能的开源基座,方便社区基于业务和使用场景定制,图像、视频衍生模型数量达到3000个。

上周,腾讯发布并开源混元3D世界模型1.0,这一模型一经发布即迅速登上Hugging Face趋势榜第二,下载量飙到近9k,混元3D世界模型技术报告还拿下了Hugging Face论文热榜第一。

结语:腾讯开源、应用两手抓

当前全球AI开源生态持续升温,各大科技公司都在加码模型开源,腾讯此次动作是其开源战略的延续。

腾讯混元此次开源4款小尺寸模型,覆盖了从0.5B到7B的参数范围,为不同算力需求的场景提供了适配方案,为AI开发者社区提供了更多选择。

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

国产恐怖片也就网大能看,妥妥的“阴间狠货”,人心远比鬼怪可怕

最爱酷影视 浏览 1087 07-16

与OPPO并肩、以半固态破局:全新MG4的冷静突围

网易汽车 浏览 17 08-24

创想三维冲刺港股:靠3D打印年营收23亿 派息8140万 腾讯是股东

雷递 浏览 5685 08-18

奉劝50+的女人,夏季穿衣谨记3个技巧,不装嫩也不显老

静儿时尚达人 浏览 467 06-06

开业首日人满为患!小米深圳总部开园,热情米粉挤爆小米之家

雷科技 浏览 9078 07-19

超30人自述患癌,顶流主播卖的卫生巾又出事了

花朵财经 浏览 8161 07-25

记者:维萨加盟纽卡难度很大,他在观望拜尔是否会来布伦特福德

直播吧 浏览 12 08-30

关于俄罗斯电影节开幕活动的温馨提示

幕味儿 浏览 14 09-02

以色列驻荷兰大使馆门口被泼红漆 以外交部发声

看看新闻Knews 浏览 7802 08-14

连签海外10亿美金量级大单,中国eVTOL的iPhone时刻来了?

时代周报 浏览 8719 07-27

就差你了,美媒:利拉德和保罗都回家了,那么威少也该回雷霆

懂球帝 浏览 8021 07-22

斯基拉:米兰21岁后卫达莱西奥将转会至意丙球队诺瓦拉

懂球帝 浏览 608 07-27

C位换人,华人统治AI时代?!

华商韬略 浏览 3031 07-25

许倬云在美去世:儿时看见满城尸首 "看见"阴兵过境

上游新闻 浏览 1821 08-05

除了库克,特朗普昨天还见了老黄,所以市场不怕“半导体关税”?

华尔街见闻官方 浏览 6097 08-07

长沙一盲道被护栏分割成"迷宫" 街道:为人车分流安装

潇湘晨报 浏览 3093 08-09

阅兵训练场上女民兵英姿飒爽

人民网-人民日报 浏览 13 08-23

王思聪现身日本被偶遇,和新女伴逛街举止亲密,与懒懒恋情引猜测

扒虾侃娱 浏览 7296 08-20

昔日"水果贵族"价格大跳水 从300元一斤跌至9.9元3斤

极目新闻 浏览 16 08-25

OpenAI发布综合代理ChatGPT Agent,能自动写代码+做PPT+订酒店

DeepTech深科技 浏览 7039 07-18

记者:森林接近与博洛尼亚就恩多耶达协议,转会费3400万镑

直播吧 浏览 9739 07-29
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除沪ICP备20017958号-3