蚂蚁集团百灵开源 Ling-3.0-flash 模型:124B 总参数、5.1B 激活参数
AI 解读 整体概述
蚂蚁集团旗下百灵大模型官方宣布,新一代原生混合推理模型Ling-3.0-flash现已正式开源。该模型采用124B总参数、5.1B激活参数的MoE架构,并提供基础版本及FP8、FP4、INT4等多个版本。官方提供三种落地选择:API调用、本地部署和端侧部署,满足不同开发者需求。
核心要点
- Ling-3.0-flash采用124B总参数、5.1B激活参数的MoE架构
- 提供FP8、FP4、INT4等多个版本
- 支持API调用、本地部署和端侧部署三种落地方式
- 面向开发者提供灵活选择,降低使用门槛
深度分析 影响与意义
蚂蚁集团开源Ling-3.0-flash模型,展示了其在AI领域的技术实力和开放态度。MoE架构和多种量化版本的选择,有助于降低推理成本,促进大模型在各行业的应用。此举可能加剧大模型开源生态的竞争,推动行业技术迭代和成本优化,对中小企业和开发者尤为有利。