神经网络新闻:3D、视频及可在自己硬件上运行的语言模型
关于工具变化的简讯:发布了新版本、许可证变更、新增对其他平台的支持。不转述新闻稿:如果某个说法无法关联到代码仓库、模型页面或官方网站,就不会发布简讯。
文章
93 篇文章
FreqForcing 将自回归视频生成延长至两分钟,无需微调2026 年 7 月 29 日,arXiv 上发布了论文 FreqForcing: Autoregressive Long Video Generation via Spectral Self-Anchoring。作者研究了自回归视频扩散模型的问题:在逐帧生成时,误差会累积,
VoxelModel-v1:HuggingFace 上新的开源 text-to-3d 模型HuggingFace 上发布了 bench-labs/VoxelModel-v1 模型,用于解决 text-to-3d 任务。该模型于 2026 年 7 月 26 日出现,代码已开源。开发者未说明显存要求、导出格式、许可证及其他信息
Lightricks 发布带 image-to-video 任务的 LTX-2.5Lightricks 在 HuggingFace 上发布了带 image-to-video 任务的 LTX-2.5 模型。发布时间为 23.07.2026,该模型有 39 次下载和 124 个「喜欢」标记。代码已开源,详情见模型页面。这意味着什么