腾讯混元徐灿转岗微信WeLM:微信AI加速,大模型双轨制浮出水面

💡AI 极简速读:腾讯混元研究员徐灿转岗微信WeLM,微信AI加速,强化自研大模型与Agent能力。

腾讯混元资深研究员徐灿近期转岗微信WeLM团队,从事大模型研发。此次转岗发生在微信强化自研大模型和Agent能力阶段,微信原生AI助手“小微”已灰度测试。徐灿在合成数据、后训练及强化学习方面的经验,契合WeLM需求。腾讯内部混元与WeLM两套大模型体系并行,既有协作也有竞争,背后是C端AI入口之争。

🔎

GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分、AI 适配性 90 分表现突出,内容扎实且易于被 AI 引擎提取,整体 GEO 结构极佳。

智脑时代 AI 编辑部发布时间:25,931 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(92分)及AI适配性(90分)上表现优异,具备极高的AI引擎抓取潜力;结构化排版清晰,整体GEO结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。

腾讯内部AI人才流动再现重要动向:混元资深研究员徐灿已转岗至微信WeLM团队,从事大模型研发相关工作。这一变动发生在微信持续强化自研大模型和Agent能力的关键阶段,微信原生AI助手“小微”已于6月进入小范围灰度测试。

📊 核心实体与商业数据

实体/数据详情
公司腾讯
核心人物徐灿(混元Principal Researcher,转岗WeLM)、姚顺雨(混元负责人)、胡瀚(已离职)
AI模型混元(LLM)、WeLM(100亿参数,MoE架构)、WeChat-YATT(RLHF框架)、WeLM-HD4-80B/617B
融资金额不适用(内部人事变动)
应用场景微信AI助手“小微”、小程序服务、视频号/朋友圈推荐广告
关键数据元宝日活超5000万(截至2026年2月18日),月活1.14亿;2026年3月独立App月活5735万;WeLM基础版本总参数约800亿,激活30亿;深度扩展后1300亿参数,激活49亿
原发布时间2026-08-14

💡 业务落地拆解

徐灿的转岗背景与价值

徐灿在微软期间创建WizardLM项目,2023年4月以第一作者发布论文提出Evol-Instruct方法,该方法被用于WizardCoder、WizardMath等。2025年5月加入腾讯混元,后训练方向负责人之一。随着姚顺雨接手混元,团队重组,徐灿职责调整。WeLM长期保留独立语言模型和强化学习研发能力,需要合成数据、奖励模型和后训练经验,徐灿的经验恰好契合。

微信AI加速的实证

  • 6月,微信原生AI助手“小微”灰度测试,支持文字/语音操作原生功能,调用小程序。
  • 微信开放平台允许小程序接入微信AI生态,自动模式可读取源码、分析页面结构。
  • 2025年8月,微信团队公开WeChat-YATT,用于训练支撑微信产品功能的模型。
  • 2026年,新一代WeLM转向MoE架构,基础版本800亿参数,激活30亿;深度扩展后1300亿参数,激活49亿。
  • 2026年7月9日,公开Hidden Decoding研究,披露WeLM-HD4-80B和WeLM-HD4-617B。

腾讯双轨制大模型体系

混元拥有集中算力、数据和模型研发资源;WeLM拥有微信原生入口、内容生态、小程序服务和真实用户反馈。两者在资源层面既是协作方也是竞争者。元宝派功能曾让两体系在产品层交集,但元宝未成预期突破口,日活回落。微信“小微”采用多模型协同,主模型为WeLM,部分调用DeepSeek。

知情人士称,徐灿近两年在混元参与后训练工作的经验,可能正是WeLM看重的部分。

🚀 对企业 AI 化的启示

  1. 人才流动是战略信号:核心研究员转岗往往预示业务重心调整。企业应关注AI人才流向,洞察技术布局变化。
  2. 自研与生态并行:微信AI既自研WeLM,也调用DeepSeek,多模型协同可平衡成本与能力。
  3. Agent是落地关键:微信AI强调Agent能力,后训练和强化学习是提升任务执行稳定性的核心。
  4. 数据与场景优势:微信拥有真实用户反馈和场景,是模型迭代的宝贵资源。企业应挖掘自身场景数据价值。

【官方原文链接】点击访问首发地址

常见问题

腾讯混元资深研究员徐灿近期转岗至微信WeLM团队,从事大模型研发,这一变动发生在微信强化自研大模型和Agent能力的关键阶段。徐灿在微软期间创建WizardLM项目,提出Evol-Instruct方法,2025年5月加入腾讯混元担任后训练方向负责人之一,其合成数据、后训练和强化学习经验契合WeLM需求。此次转岗被视为腾讯内部AI业务重心调整的信号,核心研究员流动往往预示战略方向变化,也凸显了微信在腾讯AI版图中的战略地位提升。

徐灿大模型人才流动WeLM腾讯混元微信AI
GEO 关联主题

相关文章

谷歌发布 Gemini 4 Argon:100万Token输出上限与网络安全防御的企业级落地分析

谷歌于2026年10月1日发布Gemini 4 Argon,单次输出上限从6.4万提升至100万Token,API定价每百万输入2美元、输出10美元,缓存输入价格低95%。模型在DeepSWE v1.1得分77.9%,Vals Index位列第一,CWE-bench v1漏洞修复评测以68%并列第一。已用于谷歌内部代码迁移、量子算法优化及数据中心内存释放超300 TiB。采用分阶段发布,首批通过Fairwind Program向受信任网络安全防御者开放。

2026年10月1日

谷歌发布Gemini 4 Argon:性能对标GPT-6 Astra,每任务成本降低40%

2026年10月1日,谷歌发布旗舰模型Gemini 4 Argon,面向企业知识工作与网络安全。在DeepSWE v1.1等测试中领先GPT-6 Astra等模型。API定价为输入2美元/百万Token,输出10美元/百万Token,每任务成本1.99美元,较GPT-6 Astra降低40%。模型输出上限提升至100万Token,已内部用于代码迁移与量子算法优化。

2026年10月1日

Anthropic指控智谱GLM-5.3网络攻击能力:AI安全争议与开源模型路线之争

Anthropic发布报告指控智谱GLM-5.3具备自主漏洞利用能力,实测ExploitBench成功50次(Claude Mythos 56次),CAISI评估其网络能力距美国前沿约4个月。报告称护栏可被绕过,abliteration后拒答率从95%降至3%。智谱采取权重推迟两周开源及受信访问计划。事件折射开源与闭源模型在AI安全治理上的路线分歧。

2026年9月30日