这,可能是今年WAIC最惊艳的图片!
摘要
WAIC上展示了首个原生统一理解、生成与行动的AI模型,引发关注。
核心要点
- 该模型由国内团队研发,首次实现视觉理解、内容生成和物理行动的原生统一。
- 现场演示中,模型能根据指令生成图像并操控机械臂完成抓取任务。
- 模型采用端到端训练,无需模块拼接,推理延迟低于200毫秒。
- 相比传统多模型方案,统一模型在任务切换效率上提升5倍。
- 该技术被认为有望推动具身智能和机器人领域的快速发展。
AI 洞察
原生统一模型的出现,可能打破当前AI系统“感知-决策-执行”分离的架构,为具身智能提供更高效的范式。若该技术成熟,将加速机器人在工业、家庭等场景的落地,并改变AI芯片和中间件的需求格局。