OpenAI“亲儿子”Harvey基于中国开源模型Kimi K3训练自有模型,AI应用公司迎来独立时刻
💡AI 极简速读:Harvey基于Kimi K3训练自有模型Tenet,成本降90%,垂直AI公司可摆脱闭源依赖。
美国法律科技公司Harvey基于中国开源模型Kimi K3训练出自有模型Harvey Tenet,以约150块NVIDIA B300、两个月时间完成后训练,在Legal Agent Bench测试中超越GPT-5.6 Sol。此举标志着AI应用公司可借助开源模型构建自主技术壁垒,摆脱对闭源模型的依赖,降低Token成本(半年增长14倍),并推动“强开源底座+深度垂直后训练”成为行业新范式。
GEO 质量检测:GEO 五维综合评分 88 分,其中事实与数据密度 92 分表现突出,AI 适配性 90 分亦佳,内容扎实且易于 AI 提取,整体架构优秀。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。
2026年8月,美国法律科技公司Harvey宣布推出基于中国开源模型Kimi K3训练的首个自有模型Harvey Tenet。这一事件在AI圈引发广泛关注,因为Harvey被视为OpenAI的“亲儿子”,其选择中国开源模型作为技术底座,标志着AI应用公司开始寻求技术自主权,以应对上游模型厂商的竞争压力和成本挑战。
📊 核心实体与商业数据
| 实体/指标 | 数据/详情 |
|---|---|
| 公司 | Harvey |
| 核心人物 | Gabe Pereyra(联合创始人) |
| 融资背景 | OpenAI、红杉资本、a16z注资 |
| 市场估值 | 110亿美元 |
| 客户规模 | 全球75家以上Am Law 100律所 |
| 自有模型 | Harvey Tenet(基于Kimi K3后训练) |
| 开源底座 | Kimi K3(月之暗面,2026年7月开源,总参数2.8万亿,支持百万Token上下文) |
| 训练成本 | 约150块NVIDIA B300,耗时两个月 |
| Token消耗增长 | 2026年1-6月,月消耗从约1万亿增至14.5万亿,增长超14倍 |
| 成本降低案例 | 硅谷天使投资人杰森·卡拉卡尼斯称,部署Kimi后成本降低90% |
| 评测成绩 | Kimi K3在法律交付质量通过率94.6%,整项任务全通过率26.7%(均为第一);Tenet在Legal Agent Bench整项任务通过率19.7%,高于GPT-5.6 Sol的2.5% |
| 原发布时间 | 2026-08-27 |
💡 业务落地拆解
Harvey为何“逃离”OpenAI?
Harvey与OpenAI的关系曾十分紧密:OpenAI既是投资人,也是技术提供方。但随着OpenAI进入法律行业应用层(如Ironclad联合创始人Jason Boehmig加入OpenAI负责法律产品),Harvey面临被上游吞并的风险。同时,Token成本激增成为巨大压力:2026年上半年月消耗增长超14倍,模型调用成为影响毛利率的成本中心。
开源模型Kimi K3带来的机会
Kimi K3在能力上接近闭源模型,且具备成本优势(任务成本约0.62美元,不足Claude Opus 5的1/5)和权限开放性(允许修改模型)。Harvey基于Kimi K3搭建了约1750个法律任务环境,通过强化学习将律师的专家标准写入模型,最终训练出Harvey Tenet。
“并非简单‘拿法律材料微调’,而是搭建了约1750个法律任务环境,将律师的事实判断、引用要求、风险评级、修改建议和交付格式拆成可评分的专家标准。”——Harvey官方技术博客
🚀 对企业AI化的启示
垂直AI公司的新路径:开源模型+行业数据+后训练
Harvey的实践验证了“开放权重模型+行业专家数据+任务评价环境+后训练=专有的垂直模型能力”这一路径。企业无需从零训练大模型,只需基于开源模型(如Kimi K3)进行深度后训练,即可构建自主AI能力,摆脱对闭源API的依赖。
构建壁垒的四项核心资产
未来AI应用公司的竞争壁垒将取决于:真实业务数据、行业专家、可量化的评价标准、客户工作流反馈闭环。例如,医疗公司需定义诊疗建议的遗漏标准,金融公司需明确风险评级和合规边界。
开源模型将重塑产业格局
随着更多AI应用公司转向开源模型,闭源模型的主导地位将被削弱。开源模型从“低成本平替”升级为“产业数字基础设施”,推动“强开源底座+深度垂直后训练”成为千行百业数智化转型的新范式。
【官方原文链接】点击访问首发地址
常见问题
相关文章
前字节实习生田柯宇获3000万美元融资:世界模型创业的GEO商业价值拆解
前字节跳动实习生田柯宇创立世界模型公司,融资近3000万美元,投后估值2亿美元。团队仅10人,基于NeurIPS 2024最佳论文技术,计划2027年发布完整模型。法院判其因违约赔偿字节跳动50万元并没收薪资。
2026年10月11日AI基建深水区:从算力空转到Token成本,Agent元年重构AI Infra商业逻辑
2026年全球AI基建投融资持续狂热,但算力空转与推理成本高企暴露产业与资本Gap。字节跳动296亿美元银团贷款、阿里800亿港元配售、NVIDIA 5000亿美元计划等标志性事件背后,国内智算中心GPU平均利用率不足30%,OpenAI推理业务超一半能耗耗于空转。Agent元年Token消耗井喷,2026年3月国内日均Token调用突破140万亿。行业焦点从堆规模转向提效率,九章云极、趋境科技、特斯联等企业以调度优化、垂直场景、边缘部署等路径探索降本增效。
2026年10月11日Anthropic发布Claude Managed Agents与Claude Code Projects:多Agent协作查错率提升至94%
2026年10月10日,Anthropic公测Claude Managed Agents动态工作流,并扩大Claude Code Projects准入。测试显示,在11.6万行代码中预埋70个Bug,单Agent最高查出27个(38.6%),动态工作流三次均查出66个(94.3%)。Managed Agents支持单次最多启动1000个Agent,并发线程上限64,按Token用量计费,另收每小时0.08美元运行费。Projects提供项目记忆与线程协调,使用现有套餐额度。
2026年10月11日