Ling-3.0-flash-Fin:蚂蚁集团1275亿参数金融模型上线HuggingFace
2026年9月3日,HuggingFace 上发布了模型 inclusionAI/Ling-3.0-flash-Fin,任务为 text-generation。这是 Ant Ling 家族中首个强化金融专业化的模型:其与专业机构和专家合作,在金融数据上进行了微调。据作者描述,该模型支持端到端的金融研究场景——从信息检索和来源核对,到计算、建模和报告准备。
方法的工作原理。示意图根据这篇简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
SpatialCrafter 通过生成式代理将单张图像转化为可探索的 3D 场景研究人员推出了 SpatialCrafter——一个两阶段框架,用于从单张图像生成可探索的 3D 场景。该工作于 2026 年 8 月 27 日发布在 arXiv 上。它没有直接使用带有不完整信号的 video diffusion model,而是……
MoRoute 提出用于多模态视频生成的动态层路由方案MoRoute 的研究人员发表了一篇论文,提出通过动态层路由将冻结的视觉-语言模型(VLM)与预训练的视频扩散 Transformer(DiT)相结合。该方法允许每个块
SQuad 加速 Wan 2.2 视频生成,注意力机制缩减 67 倍SQuad 的作者提出了一种用于视频扩散 Transformer 的 sub-quadratic attention 蒸馏方法。他们不是从头训练模型,而是分两个阶段蒸馏现成的完整尺寸模型 Wan 2.2 5B:Flow-Matching 监督微调和
VGI-Bench 用 810 个任务评估视频生成器的视觉推理能力arXiv 发布了 VGI-Bench 论文——一个包含 27 个任务和 810 个示例的基准测试,用于检验视频生成模型的视觉推理能力。作者构建了领域和技能的两级分类体系,要求模型不仅输出看似合理的