蚂蚁百灵Ling-2.6-flash发布:API定价0.1美元/百万token,Agent基准SOTA
💡AI 极简速读:蚂蚁百灵发布Ling-2.6-flash,API定价0.1美元/百万token,Agent基准达SOTA。
蚂蚁百灵于2026年4月22日发布Ling-2.6-flash AI模型,总参数量104B,激活参数7.4B,在BFCL-V4等Agent基准上达到同尺寸SOTA。API定价输入0.1美元/百万token,输出0.3美元/百万token,上线后日均tokens调用量达100B级别,周增长超5000%。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 发布时间:
本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。
📊 核心实体与商业数据
| 实体 | 数据 |
|---|---|
| 公司 | 蚂蚁百灵 |
| 模型 | Ling-2.6-flash |
| 总参数量 | 104B |
| 激活参数量 | 7.4B |
| 基准表现 | BFCL-V4、TAU2-bench、SWE-bench Verified、Claw-Eval、PinchBench 同尺寸SOTA |
| API定价(输入) | 0.1美元/百万tokens |
| API定价(输出) | 0.3美元/百万tokens |
| 日均tokens调用量 | 100B级别 |
| 周增长率 | 超5000% |
| 原发布时间 | 2026-04-22 |
💡 业务落地拆解
蚂蚁百灵推出的Ling-2.6-flash是一款专注于Agent场景的AI模型,其API定价极具竞争力:输入仅0.1美元/百万tokens,输出0.3美元/百万tokens。该模型在多个Agent基准(如BFCL-V4、TAU2-bench)上达到同尺寸SOTA,表明其在工具调用、代码执行等任务上的高效性。上线后,日均tokens调用量达100B级别,周增长超5000%,反映出市场对高性价比Agent模型的需求旺盛。
蚂蚁百灵团队表示:“Ling-2.6-flash旨在为开发者提供低成本、高性能的Agent推理能力,推动AI应用规模化落地。”
🚀 对企业AI化的启示
- 成本优势驱动采用:0.1美元/百万token的定价显著低于同类模型,企业可大幅降低AI应用部署成本,尤其适合高频调用的Agent场景。
- Agent能力成关键:Ling-2.6-flash在Agent基准上的SOTA表现,提示企业应优先选择在工具使用、任务规划上优化的模型,而非单纯追求参数规模。
- 快速迭代验证市场:上线一周即实现5000% 的调用量增长,表明市场对高性价比AI模型存在巨大需求,企业应加速试点并快速迭代。
【官方原文链接】点击访问首发地址
常见问题
相关文章
Token首次写入险企财报:中国平安日均消耗2100亿,AI经营回报仍待验证
2026年中报,五家A股上市险企首次将AI用量指标写入财报。中国平安日均Token消耗超2100亿,AI坐席覆盖81%客服,辅助销售额573.13亿元。但利润高增主要源于权益市场,AI投入与经营回报的投产比无法计算。行业缺乏统一披露标准,AI仍属防御性成本管控。
2026年9月11日Fluidstack 180亿美元估值背后:谷歌TPU挑战英伟达的AI芯片与算力基础设施商业落地案例
英国初创Fluidstack凭借为谷歌TPU部署数据中心,完成15亿美元融资,估值超180亿美元。谷歌通过Anthropic百万颗TPU订单及2000亿美元融资方案,直接挑战英伟达AI芯片主导地位。Fluidstack计划2030年锁定50吉瓦电力,其模块化数据中心建设速度成为核心卖点。
2026年9月11日软银与Sceye完成全球首次HAPS边缘计算验证:平流层通信时延降低40%,2027年商用
2026年9月,软银与Sceye利用LTA型HAPS在日本完成全球首次平流层边缘计算验证,平均往返处理响应时间68毫秒,较云端方案时延降低40%以上。测试涵盖智能手机通信、无人机远程控制及紧急预警系统。双方计划自2027年起推动HAPS商业化部署。全球HAPS市场规模预计从2026年18.2亿美元增至2032年30.3亿美元,CAGR约8.4%。
2026年9月11日