Nex-AGI 发布 Nex-N2.5-mini,350 亿参数的智能体模型
HuggingFace 上发布了模型 nex-agi/Nex-N2.5-mini,任务类型为 text-generation。这是新系列 Nex-N2.5 中的较小模型,该系列面向真实环境中的长程智能体任务:控制计算机、浏览器,自主运行和检查程序。作者指出,这里的视觉不仅仅是一种输入模态,更是智能体用来检查结果并推动任务继续推进的接口。
方法的工作原理。示意图根据这篇简讯绘制。
Switch to the English version? It is the same page at the same address, with a language prefix.
Other languages: Русский
LeFlow 通过生成式潜在先验将 world models 中的规划速度提升一个数量级研究人员推出了 LeFlow——一种将 latent world models 中的迭代轨迹优化替换为生成式规划的方法。LeFlow 不再为每一对“状态—目标”从头运行优化器,而是学习
MiniMax-H3-slim 已在 HuggingFace 发布,用于文本生成视频2026年8月24日,模型 fkyyy/MiniMax-H3-slim 已在 HuggingFace 上发布,任务为 text-to-video。截至发布时,该模型有 508 次下载,且没有任何“喜欢”标记。详情请见模型页面。这意味着什么 该模型属于
SUV:将未来场景理解视为视频生成,实现端到端驾驶2026年8月4日,arXiv上发布了SUV——一个端到端驾驶框架,将未来场景理解视为视频生成任务。作者没有使用专门的预测模块,而是采用预训练视觉
MoRoute 提出用于多模态视频生成的动态层路由方案MoRoute 的研究人员发表了一篇论文,提出通过动态层路由将冻结的视觉-语言模型(VLM)与预训练的视频扩散 Transformer(DiT)相结合。该方法允许每个块