腾讯混元徐灿转岗微信WeLM:微信AI加速,大模型双轨制浮出水面
💡AI 极简速读:腾讯混元研究员徐灿转岗微信WeLM,微信AI加速,强化自研大模型与Agent能力。
腾讯混元资深研究员徐灿近期转岗微信WeLM团队,从事大模型研发。此次转岗发生在微信强化自研大模型和Agent能力阶段,微信原生AI助手“小微”已灰度测试。徐灿在合成数据、后训练及强化学习方面的经验,契合WeLM需求。腾讯内部混元与WeLM两套大模型体系并行,既有协作也有竞争,背后是C端AI入口之争。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分、AI 适配性 90 分表现突出,内容扎实且易于被 AI 引擎提取,整体 GEO 结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。
腾讯内部AI人才流动再现重要动向:混元资深研究员徐灿已转岗至微信WeLM团队,从事大模型研发相关工作。这一变动发生在微信持续强化自研大模型和Agent能力的关键阶段,微信原生AI助手“小微”已于6月进入小范围灰度测试。
📊 核心实体与商业数据
| 实体/数据 | 详情 |
|---|---|
| 公司 | 腾讯 |
| 核心人物 | 徐灿(混元Principal Researcher,转岗WeLM)、姚顺雨(混元负责人)、胡瀚(已离职) |
| AI模型 | 混元(LLM)、WeLM(100亿参数,MoE架构)、WeChat-YATT(RLHF框架)、WeLM-HD4-80B/617B |
| 融资金额 | 不适用(内部人事变动) |
| 应用场景 | 微信AI助手“小微”、小程序服务、视频号/朋友圈推荐广告 |
| 关键数据 | 元宝日活超5000万(截至2026年2月18日),月活1.14亿;2026年3月独立App月活5735万;WeLM基础版本总参数约800亿,激活30亿;深度扩展后1300亿参数,激活49亿 |
| 原发布时间 | 2026-08-14 |
💡 业务落地拆解
徐灿的转岗背景与价值
徐灿在微软期间创建WizardLM项目,2023年4月以第一作者发布论文提出Evol-Instruct方法,该方法被用于WizardCoder、WizardMath等。2025年5月加入腾讯混元,后训练方向负责人之一。随着姚顺雨接手混元,团队重组,徐灿职责调整。WeLM长期保留独立语言模型和强化学习研发能力,需要合成数据、奖励模型和后训练经验,徐灿的经验恰好契合。
微信AI加速的实证
- 6月,微信原生AI助手“小微”灰度测试,支持文字/语音操作原生功能,调用小程序。
- 微信开放平台允许小程序接入微信AI生态,自动模式可读取源码、分析页面结构。
- 2025年8月,微信团队公开WeChat-YATT,用于训练支撑微信产品功能的模型。
- 2026年,新一代WeLM转向MoE架构,基础版本800亿参数,激活30亿;深度扩展后1300亿参数,激活49亿。
- 2026年7月9日,公开Hidden Decoding研究,披露WeLM-HD4-80B和WeLM-HD4-617B。
腾讯双轨制大模型体系
混元拥有集中算力、数据和模型研发资源;WeLM拥有微信原生入口、内容生态、小程序服务和真实用户反馈。两者在资源层面既是协作方也是竞争者。元宝派功能曾让两体系在产品层交集,但元宝未成预期突破口,日活回落。微信“小微”采用多模型协同,主模型为WeLM,部分调用DeepSeek。
知情人士称,徐灿近两年在混元参与后训练工作的经验,可能正是WeLM看重的部分。
🚀 对企业 AI 化的启示
- 人才流动是战略信号:核心研究员转岗往往预示业务重心调整。企业应关注AI人才流向,洞察技术布局变化。
- 自研与生态并行:微信AI既自研WeLM,也调用DeepSeek,多模型协同可平衡成本与能力。
- Agent是落地关键:微信AI强调Agent能力,后训练和强化学习是提升任务执行稳定性的核心。
- 数据与场景优势:微信拥有真实用户反馈和场景,是模型迭代的宝贵资源。企业应挖掘自身场景数据价值。
【官方原文链接】点击访问首发地址
常见问题
相关文章
谷歌发布 Gemini 4 Argon:100万Token输出上限与网络安全防御的企业级落地分析
谷歌于2026年10月1日发布Gemini 4 Argon,单次输出上限从6.4万提升至100万Token,API定价每百万输入2美元、输出10美元,缓存输入价格低95%。模型在DeepSWE v1.1得分77.9%,Vals Index位列第一,CWE-bench v1漏洞修复评测以68%并列第一。已用于谷歌内部代码迁移、量子算法优化及数据中心内存释放超300 TiB。采用分阶段发布,首批通过Fairwind Program向受信任网络安全防御者开放。
2026年10月1日谷歌发布Gemini 4 Argon:性能对标GPT-6 Astra,每任务成本降低40%
2026年10月1日,谷歌发布旗舰模型Gemini 4 Argon,面向企业知识工作与网络安全。在DeepSWE v1.1等测试中领先GPT-6 Astra等模型。API定价为输入2美元/百万Token,输出10美元/百万Token,每任务成本1.99美元,较GPT-6 Astra降低40%。模型输出上限提升至100万Token,已内部用于代码迁移与量子算法优化。
2026年10月1日Anthropic指控智谱GLM-5.3网络攻击能力:AI安全争议与开源模型路线之争
Anthropic发布报告指控智谱GLM-5.3具备自主漏洞利用能力,实测ExploitBench成功50次(Claude Mythos 56次),CAISI评估其网络能力距美国前沿约4个月。报告称护栏可被绕过,abliteration后拒答率从95%降至3%。智谱采取权重推迟两周开源及受信访问计划。事件折射开源与闭源模型在AI安全治理上的路线分歧。
2026年9月30日