CPU3D3D、视频与音频的 AI 工具

Ling-3.0-flash-Fin:蚂蚁集团1275亿参数金融模型上线HuggingFace

2026年9月3日,HuggingFace 上发布了模型 inclusionAI/Ling-3.0-flash-Fin,任务为 text-generation。这是 Ant Ling 家族中首个强化金融专业化的模型:其与专业机构和专家合作,在金融数据上进行了微调。据作者描述,该模型支持端到端的金融研究场景——从信息检索和来源核对,到计算、建模和报告准备。

这意味着什么

该模型拥有 1275 亿个参数,许可证为 mit。safetensors 格式的完整权重仓库占用 237.5 GB,最大的文件为 5.7 GB。平台上提供了三个用于本地运行的量化 GGUF 构建版本;最紧凑的可用版本是 mradermacher 的 IQ4_XS,重 63.8 GB。这仍然是服务器级硬件水平:要加载这样的构建版本,需要具备相应内存容量的系统或多个 GPU。作者提到共有 124B 参数,激活参数为 5.1B,上下文窗口为 256K,这表明其采用了 MoE 架构,但模型的参数表中并未披露这些细节。 该模型并非为在普通工作站上本地运行而设计,但开放的许可证和量化构建版本的存在,为在自己的服务器上部署提供了可能。要关注更紧凑版本的出现以及其他关于在自己的硬件上运行模型的新闻,可以关注 CPU3D 动态
Ling-3.0-flash-Fin:蚂蚁集团的金融模型 输入 金融数据 与专家知识 微调 金融专业化 与机构合作 Ling-3.0-flash-Fin 1275亿参数 MoE:124B共享 / 5.1B激活 256K上下文窗口 端到端场景 信息检索 来源核对 计算与报告 部署 safetensors:237.5 GB GGUF IQ4_XS:63.8 GB 服务器硬件 / 多GPU 许可证:MIT 在自己的服务器上开源部署 HuggingFace 2026年9月3日
方法的工作原理。示意图根据这篇简讯绘制。

相关阅读