模型发布·EASYHUB 选读
Reka 发布 Rho-1 研究预览:19B 单一网络统一文本、图像、视频生成与机器人动作

这次有什么变化
Reka AI 10 月 5 日发布 Rho-1 研究预览。Rho-1 是从零训练的 19B omni-reasoning 模型,把文本、视觉和机器人动作都表示为同一上下文中的 token,在一套权重中完成理解、文本/图像/视频生成、连续世界模拟和动作输出,而不是把任务路由给多个专用模型。官方称该 checkpoint 仅使用 320 张 H100 训练约三个月;蒸馏版把去噪从 99 步降到 8 步。Reka 同时明确其仍是 proof-of-concept:长时 rollout 会结构漂移、视频时间维度 grounding 不稳定、编辑较脆弱,原生视频最高 672×384。
- 原文标题
- Rho-1: Collapsing the multimodal stack
- 来源
- Reka AI · reka.ai
- 主题
- 模型发布
- 原文月份
- 2026-10
本页是 EasyHub 根据所列来源整理的简短选读,不是完整报道或原创采访。预览、计划开放与正式可用以摘要及原文说明为准。
本站摘要页面发布 · 内容说明