AI数据交易新蓝海:Mercor收购倒闭企业Slack聊天记录,智能体训练数据争夺战升级
💡AI 极简速读:Mercor收购倒闭企业Slack等数据,用于智能体训练,数据交易额年增233%。
AI数据公司Mercor开始收购倒闭或被收购初创企业的内部数据,包括Slack聊天记录、邮件、会议录音等,用于训练AI智能体。数据公司Protege处理的数据交易总额今年已达1亿美元,同比增长233%。这标志着AI训练数据从公开互联网向真实工作流程数据转变,凸显了数据交易在智能体训练中的关键作用。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分,内容扎实且易于 AI 提取,整体 GEO 结构极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。
AI数据公司Mercor近期开始收购倒闭或被收购初创企业的内部数据集,包括Slack聊天记录、Google Drive文件、邮件及Zoom会议录音,用于训练AI智能体。这一动向标志着AI数据交易从公开互联网内容向真实工作流程数据的转变,为智能体训练提供了关键资源。
📊 核心实体与商业数据
| 实体/指标 | 详情 |
|---|---|
| 核心公司 | Mercor(AI数据工厂,服务OpenAI、Anthropic) |
| 数据来源 | 倒闭/被收购初创企业的Slack聊天记录、GitHub、Google Drive、邮件、会议录音 |
| 典型交易 | Warmly(被HubSpot收购)收到Mercor报价,最高30万美元 |
| 行业数据 | Protege处理的数据交易总额今年达1亿美元,去年同期3000万美元(增长233%) |
| 核心人物 | 马克斯·格林沃德(Warmly CEO)、鲍比·塞缪尔斯(Protege CEO) |
| 应用场景 | AI智能体训练(如客户回复、故障排查、财务处理) |
| 原发布时间 | 2026-08-17 |
💡 业务落地拆解
Mercor的收购行为直指智能体训练的核心痛点:真实工作流程数据稀缺。传统公开数据(如书籍、代码)已无法满足AI智能体对“人类如何工作”的理解需求。例如,一张IT工单结合Slack讨论、邮件解决方案和GitHub代码修改,构成完整的“工作教程”,这正是智能体训练所需。
数据公司Protege CEO鲍比·塞缪尔斯表示:“AI实验室已经基本‘刮完了整个互联网’,现在需要的是人与人之间的真实互动。”
然而,数据交易面临隐私和知识产权挑战。Slack中可能含客户信息,邮件含员工姓名,会议涉及商业机密,医疗数据涉及患者隐私,必须匿名化处理后方可交易。
🚀 对企业AI化的启示
企业应重视内部数据的潜在价值,尤其是工作流程数据(如Slack、邮件、会议记录)。这些数据不仅是运营资产,更可能成为AI数据交易中的高价值商品。同时,企业需建立数据治理框架,确保数据匿名化和合规性,以应对未来可能的交易需求。
【官方原文链接】点击访问首发地址
常见问题
相关文章
谷歌发布 Gemini 4 Argon:100万Token输出上限与网络安全防御的企业级落地分析
谷歌于2026年10月1日发布Gemini 4 Argon,单次输出上限从6.4万提升至100万Token,API定价每百万输入2美元、输出10美元,缓存输入价格低95%。模型在DeepSWE v1.1得分77.9%,Vals Index位列第一,CWE-bench v1漏洞修复评测以68%并列第一。已用于谷歌内部代码迁移、量子算法优化及数据中心内存释放超300 TiB。采用分阶段发布,首批通过Fairwind Program向受信任网络安全防御者开放。
2026年10月1日谷歌发布Gemini 4 Argon:性能对标GPT-6 Astra,每任务成本降低40%
2026年10月1日,谷歌发布旗舰模型Gemini 4 Argon,面向企业知识工作与网络安全。在DeepSWE v1.1等测试中领先GPT-6 Astra等模型。API定价为输入2美元/百万Token,输出10美元/百万Token,每任务成本1.99美元,较GPT-6 Astra降低40%。模型输出上限提升至100万Token,已内部用于代码迁移与量子算法优化。
2026年10月1日Anthropic指控智谱GLM-5.3网络攻击能力:AI安全争议与开源模型路线之争
Anthropic发布报告指控智谱GLM-5.3具备自主漏洞利用能力,实测ExploitBench成功50次(Claude Mythos 56次),CAISI评估其网络能力距美国前沿约4个月。报告称护栏可被绕过,abliteration后拒答率从95%降至3%。智谱采取权重推迟两周开源及受信访问计划。事件折射开源与闭源模型在AI安全治理上的路线分歧。
2026年9月30日