首页 技术杂谈 再来认识一下微信大语言模型:WeLM
文章内容

再来认识一下微信大语言模型:WeLM

2026年08月18日 14:04 技术杂谈 16 阅读

之前写过一篇文章:是在微信自研大语言模型 WeLM 信息很少的情况下写的。

现在过去 2 个月了,WeLM 开始抛头露脸、崭露头角。

更新几个关于 WeLM 的关键信息。

1、财报露脸

WeLm登上了腾讯2026年第二季财报,财报中提到:

我们最近数周启动了微信内 AI 智能体小微的小范围灰度测试。

小微由专注于用户隐私、微信场景和推理效率的定制化模型 WeLM 驱动。

这是微信大语言模型 WeLM 第一次在腾讯财报中露脸。

2、核心特征

从财报中关于 WeLM 的信息,可以知道WeLM的几个核心特征:

1)保护用户隐私

你的所有信息和秘密,基本都在微信上。

微信里用 AI 小微太敏感,对于隐私的保护太重要。

2)微信场景

朋友圈 AI 帮写、AI 评价,查看朋友圈,AI 转账,AI 发消息,自动调用微信小程序办事等。

这些都是微信特有场景,WeLM 专注于微信中使用。

3)推理效率

使用其他产品的 AI 助手,用户有耐心等待。微信中用 AI 不一样,用户耐心很有限。

哪怕等个三五秒,用户就离开了。

所以推理效率,响应速度非常关键。

4)定制化模型

闭环模型,定制化模型,微信专属。

3、WeLM 当前的2 个版本

目前内测中的微信小微,用的是 WeLM-80B 的版本,3B 激活。

支持用户进行对话与搜索、操作微信原生功能、调用小程序服务等。

WeLM还有给总参更大的版本WeLM-617B,23B激活。

这个版本在中等激活规模下实现了更强的通用理解、推理能力。

后续将应用于微信生态中的复杂任务,比如小程序智能开发、“微信小微”小工具生成等场景等。

分场景,用不用的模型,是为了兼顾效率与能力的。

简单场景,用总参 800 亿的 中小模型WeLM-80B。

复杂任务,用总参 6170 亿的前沿模型 WeLM-617B。

4、和混元并行

WeLM,已成为混元 Hy 后的腾讯第二款大语言模型。

不同于其他大厂,腾讯是 2 个基础大语言模型并行。

这是业内,甚至放眼全球,都是独一个的存在。

这是因为,微信场景的特殊性要求,和嗯哼哼嗯嗯,微信的强话语权。

5、和混元Hy赛马?

WeLM,闭源模型,应用于微信,属于WXG(微信事业群)。

混元 Hy,开源模型,应用于腾讯内部产品和对外提供AI 能力,属于TEG(技术工程事业群)。

1 个公司,2 个基础大模型。

算力资源有限的情况下,都在抢算力资源。

目前看,混元 Hy 的开源、应用于腾讯内部个产品、对外提供 API,更加耗资源。

战略意义更强,资源肯定更多。

微信 WeLM 只能在有限的资源在突破、找最优解。

这算得上另一种形式的赛马。

6、WeLM已在多个方面领先混元 Hy

WeLM 主打成本效益路线。

因为微信小微一旦开放,将是数亿级的用户量,成本控制异常关键。

在有限算力下,满足数亿级用户的需求。

微信 WeLM 被逼着做创新,

WeLM 博客中的技术创新,都是围绕成本效益进行。

https://welm.weixin.qq.com/

WeLM采用的也是主打成本效益的MoE路线。

但是从外部测试数据看,WeLM-617B,多个方面已领先 Hy3,是不是有点惊讶。

翻译过来看这个。

7、这才是腾讯内部最大赛马

混元 Hy 和微信 WeLM,两个基础模型。

这才是腾讯内部最大赛马项目。

不仅是产品技术层面,更多的是资源、人才的层面。

但也真实这种内部的赛马和竞争。

才跑出了微信、王者荣耀、WorkBuddy 等产品。

赛马短期内,会浪费资源;长期,会赢得市场。

当然,因为2 个模型的定位不懂。

混元 Hy ,通用,开源。

微信 WeLM,专用,闭源,封闭差异化场景。

短期无合并可能,长期也存在并存大概率。

随着微信小微的内测,和放大灰测范围。

WeLM 从寂寂无闻,到崭露头角。

后面的故事,应该会很精彩。