再来认识一下微信大语言模型:WeLM
之前写过一篇文章:是在微信自研大语言模型 WeLM 信息很少的情况下写的。
现在过去 2 个月了,WeLM 开始抛头露脸、崭露头角。
更新几个关于 WeLM 的关键信息。
1、财报露脸
WeLm登上了腾讯2026年第二季财报,财报中提到:
我们最近数周启动了微信内 AI 智能体小微的小范围灰度测试。
小微由专注于用户隐私、微信场景和推理效率的定制化模型 WeLM 驱动。

这是微信大语言模型 WeLM 第一次在腾讯财报中露脸。
2、核心特征
从财报中关于 WeLM 的信息,可以知道WeLM的几个核心特征:
1)保护用户隐私
你的所有信息和秘密,基本都在微信上。
微信里用 AI 小微太敏感,对于隐私的保护太重要。
2)微信场景
朋友圈 AI 帮写、AI 评价,查看朋友圈,AI 转账,AI 发消息,自动调用微信小程序办事等。
这些都是微信特有场景,WeLM 专注于微信中使用。
3)推理效率
使用其他产品的 AI 助手,用户有耐心等待。微信中用 AI 不一样,用户耐心很有限。
哪怕等个三五秒,用户就离开了。
所以推理效率,响应速度非常关键。
4)定制化模型
闭环模型,定制化模型,微信专属。
3、WeLM 当前的2 个版本
目前内测中的微信小微,用的是 WeLM-80B 的版本,3B 激活。
支持用户进行对话与搜索、操作微信原生功能、调用小程序服务等。
WeLM还有给总参更大的版本WeLM-617B,23B激活。
这个版本在中等激活规模下实现了更强的通用理解、推理能力。
后续将应用于微信生态中的复杂任务,比如小程序智能开发、“微信小微”小工具生成等场景等。

分场景,用不用的模型,是为了兼顾效率与能力的。
简单场景,用总参 800 亿的 中小模型WeLM-80B。
复杂任务,用总参 6170 亿的前沿模型 WeLM-617B。
4、和混元并行
WeLM,已成为混元 Hy 后的腾讯第二款大语言模型。
不同于其他大厂,腾讯是 2 个基础大语言模型并行。
这是业内,甚至放眼全球,都是独一个的存在。
这是因为,微信场景的特殊性要求,和嗯哼哼嗯嗯,微信的强话语权。
5、和混元Hy赛马?
WeLM,闭源模型,应用于微信,属于WXG(微信事业群)。
混元 Hy,开源模型,应用于腾讯内部产品和对外提供AI 能力,属于TEG(技术工程事业群)。
1 个公司,2 个基础大模型。
算力资源有限的情况下,都在抢算力资源。
目前看,混元 Hy 的开源、应用于腾讯内部个产品、对外提供 API,更加耗资源。
战略意义更强,资源肯定更多。
微信 WeLM 只能在有限的资源在突破、找最优解。
这算得上另一种形式的赛马。
6、WeLM已在多个方面领先混元 Hy
WeLM 主打成本效益路线。
因为微信小微一旦开放,将是数亿级的用户量,成本控制异常关键。
在有限算力下,满足数亿级用户的需求。
微信 WeLM 被逼着做创新,
WeLM 博客中的技术创新,都是围绕成本效益进行。
https://welm.weixin.qq.com/
WeLM采用的也是主打成本效益的MoE路线。
但是从外部测试数据看,WeLM-617B,多个方面已领先 Hy3,是不是有点惊讶。

翻译过来看这个。

7、这才是腾讯内部最大赛马
混元 Hy 和微信 WeLM,两个基础模型。
这才是腾讯内部最大赛马项目。
不仅是产品技术层面,更多的是资源、人才的层面。
但也真实这种内部的赛马和竞争。
才跑出了微信、王者荣耀、WorkBuddy 等产品。
赛马短期内,会浪费资源;长期,会赢得市场。
当然,因为2 个模型的定位不懂。
混元 Hy ,通用,开源。
微信 WeLM,专用,闭源,封闭差异化场景。
短期无合并可能,长期也存在并存大概率。
随着微信小微的内测,和放大灰测范围。
WeLM 从寂寂无闻,到崭露头角。
后面的故事,应该会很精彩。
