跳至正文
-
Subscribe to our newsletter & never miss our best posts. Subscribe Now!
众乐讯
众乐讯
关

搜索

  • https://www.facebook.com/
  • https://twitter.com/
  • https://t.me/
  • https://www.instagram.com/
  • https://youtube.com/
Subscribe
科技

蚂蚁集团百灵开源 Ling-3.0-flash 模型:124B 总参数、5.1B 激活参数

作者 bolin
2026年8月8日 1 分钟阅读
0

IT之家 8 月 8 日消息,蚂蚁集团旗下百灵大模型官方昨日宣布,新一代原生混合推理模型 Ling-3.0-flash 现已正式开源。

Ling-3.0-flash 采用 124B 总参数、5.1B 激活参数的 MoE 架构。官方同步提供基础版本以及 FP8、FP4、INT4 等多个版本,提供三种不同的落地选择:

  • API 调用:面向希望快速接入、无需自建推理服务的开发者,Ling-3.0-flash 可通过云端 API 直接调用;

  • 单机私有化:面向数据不能出域的企业和团队,MXFP4 与 INT4 版本可在单台 NVIDIA DGX Spark 上完成端到端推理;

  • 高性能部署:面向单请求时延敏感的高性能服务,在指定 GPU 测试配置下,平均输出速率突破 1100 tokens/s。

对于希望快速验证产品、上线 Agent 应用的开发者和产品团队,API 是门槛最低的接入方式。在 Artificial Analysis 榜单中,Ling-3.0-flash 输出速度达到 353 tokens/s。

在 AA Intelligence Index 榜单中,Ling-3.0-flash 每项任务的加权平均调用成本约为 0.04 美元(现汇率约合 0.27 元人民币),加权平均解码时间约为 1.4 分钟,同时进入“智能水平 — 任务成本”和“智能水平 — 任务耗时”的优势区域。

官方表示,2026 年 8 月 7 日 00:00 至 8 月 31 日 24:00,Ling-3.0-flash 在 Ling Studio 限时享受 2.5 折优惠;自 9 月 1 日 00:00 起恢复原价。

IT之家附开源链接:

  • Hugging Face:https://huggingface.co/inclusionAI/Ling-3.0-flash

  • ModelScope:https://modelscope.cn/models/inclusionAI/Ling-3.0-flash

相关阅读:

  • 《蚂蚁集团发布百灵原生混合推理模型 Ling-3.0-flash:124B 总参数量,能力对标上一代旗舰 Ring-2.6-1T》

作者

bolin

关注我
其他文章
上一个

零跑 Lafa5 纯电新车申报:提供三种不同配置版本,可选激光雷达

下一个

万志强:PANDAER LOGO 不会改,DreamGoGo 是公司和平台 LOGO

暂无评论!成为第一个。

发表回复 取消回复

您的邮箱地址不会被公开。 必填项已用 * 标注

Copyright 2026 — 众乐讯. All rights reserved. Blogsy WordPress Theme