Whistle:面向 CPU 的语音识别模型已在 HuggingFace 发布
2026 年 9 月 30 日,HuggingFace 上发布了模型 Cactus-Compute/whistle,任务为 automatic-speech-recognition。作者将其描述为一款 speech-to-text 模型,面向移动设备、可穿戴电子设备、机器人、智能家居、汽车和微控制器。
该方法的构造。示意图根据这篇简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
HuggingFace 上线 LTX-2.5 模型,支持 text-to-video 任务HuggingFace 上发布了模型 yuvraj108c/LTX-2.5,支持 text-to-video 任务。发布日期为 2026 年 8 月 12 日。截至本简讯发布时,该模型有 1445 次下载和零个“喜欢”标记。代码已开源。这意味着什么 在指南
UniMoCa 将人体运动与相机控制统一为单一视觉表示研究人员推出了 UniMoCa——一种将人体运动和相机轨迹都转换为统一视觉表示(称为 Motion-Camera Visual Proxy,MCVP)的方法。该方法不再向模型输入异构信号
HuggingFace 发布用于 image-to-video 的新模型 H3_HD_2K_Detailer2026 年 8 月 24 日,HuggingFace 上发布了模型 zuanfilm/H3_HD_2K_Detailer,任务为 image-to-video。截至发布时,该模型有 26 个“喜欢”标记,暂无下载量。开发者未说明架构细节、运行要求等。