CPU3D3D、视频与音频的 AI 工具

K2-Horizon-MoVA-36B-A4B:开放 MoE 模型,36B 参数,4B 激活

HuggingFace 上发布了模型 IFM/K2-Horizon-MoVA-36B-A4B,任务为 text-generation。这是 K2-Horizon 系列中的稀疏模型:采用 Mixture-of-Experts 架构,搭配 Mixture-of-Values attention,存储 360 亿参数,每个 token 激活 40 亿。据作者描述,原生支持 512K token 上下文,并承诺将发布中间检查点、数据和训练代码。

这意味着什么

仓库中的完整权重以 safetensors 格式占用 69.7 GB,最大的文件为 3.9 GB。许可证为 apache-2.0,可通过 transformers 运行。平台上已有 15 个量化版本可供本地使用:GGUF、FP8、MLX、NVFP4、GPTQ。最紧凑的可运行版本是 NANI-Nithin 提供的 IQ4_XS,大小为 18.7 GB。 每个 token 激活 40 亿参数的模型,对本地运行来说负载适中,尤其是量化版本。完整权重需要较大的显存,但量化版本可以将模型放入单张消费级 GPU。开发者未明确不同格式的最低内存要求。 关注新模型和量化版本,可查看 CPU3D 动态
K2-Horizon-MoVA-36B-A4B:稀疏 MoE 模型 K2-Horizon 模型 360 亿参数 40 亿激活 架构 Mixture-of-Experts MoVA attention 上下文 512K 令牌 原生支持 完整权重 69.7 GB safetensors 文件最大 3.9 GB 量化版本 15 个版本:GGUF、FP8、 MLX, NVFP4, GPTQ 本地运行 IQ4_XS — 18.7 GB 单张消费级 GPU 许可证 apache-2.0 · 通过 transformers 运行 · 关注 CPU3D 动态
方法原理示意图。此图根据该简讯绘制。

相关阅读