BubbleID:用于沸腾分析的图像分割模型已在 HuggingFace 发布
2026年9月14日,HuggingFace 上发布了模型 UARK-NED3/BubbleID,任务为 image-segmentation。这是一个用于分析高速气泡沸腾视频序列中液—汽边界的科研包。
方法的结构。示意图根据本简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
SUV:将未来场景理解视为视频生成,实现端到端驾驶2026年8月4日,arXiv上发布了SUV——一个端到端驾驶框架,将未来场景理解视为视频生成任务。作者没有使用专门的预测模块,而是采用预训练视觉
ROAD 通过迁移判别模型知识降低 3D 生成训练成本ROAD(Reciprocal-Objective Alignment of Discriminative Semantics for 3D Shape Generation)论文作者提出一种方法,仅在训练阶段使用判别式 3D 模型,以降低生成的计算成本。关键
音视频生成获得兼顾音画同步的加速方法论文《Efficient Audio-Visual Generation via Synchrony-Aware Cross-Modal Sparse Attention》的作者提出了一种加速推理的方法,适用于同时生成视频和音频的模型。他们发现,双向 cross-attenti
HuggingFace 上新模型 Minimax_h3_hybrid 解决 image-to-video 任务HuggingFace 上发布了模型 abakanai/Minimax_h3_hybrid,用于根据图像生成视频(image-to-video)。该模型于 2026 年 8 月 9 日上线,截至发布时已有 2111 次下载和 6 个“喜欢”标记。开发