AI for Data🔥7.0
Reka发布Rho-1:一个19B全模态推理模型,可同时理解、生成视频并输出机器人动作
原标题: Reka发布Rho-1:一个19B全模态推理模型,可同时理解、生成视频并输出机器人动作
📋总体概括
AI公司Reka发布从零训练的19B全模态推理模型Rho-1,单一网络基于共享KV缓存实现文本、图像、视频的理解与生成,并可直接输出机器人动作,形成感知-推理-行动一体的架构。蒸馏版模型可在约1秒内返回一段5.3秒的视频片段。目前该模型仅为研究预览版,尚未公开权重。这标志着全模态模型向具身智能输出端延伸的重要尝试。
⚡关键信息
- ▸Reka发布从零训练的19B全模态推理模型Rho-1
- ▸单一网络通过共享KV缓存处理文本、图像、视频并输出机器人动作
- ▸蒸馏版模型约1秒即可返回5.3秒的视频片段
- ▸模型目前为研究预览版,尚未开放公开权重
🔥犀利点评
从视频理解跨到直接输出机器人动作,Rho-1踩在了VLA融合的风口上,但无公开权重让这更像一场技术宣言而非产品发布。约1秒生成5.3秒视频的蒸馏成绩单亮眼,可真伪与实用性都无从验证。全模态+具身叙事好听,落地还得看权重何时开放、谁敢在生产环境接机器人动作输出。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 MarkTechPost 阅读全文 →