AITOPAI热报
今日全部早读
地区
东盟中国趋势
外观
登录 / 注册
AITOPAI热报

视觉-语言-动作

共 1 条相关 AI 资讯
5月29日
23:50
23:50AK@_akhaliq
精选
Qwen-VLA 是一个统一的视觉-语言-动作模型,旨在跨任务、环境和机器人本体进行泛化。该模型通过融合视觉与语言指令,直接输出机器人动作。在多个基准测试中,Qwen-VLA 展示了优于现有方法的性能,尤其是在零样本泛化场景。其架构基于 ViT-L 视觉编码器和 Qwen2.5 语言基座。
AI模型Qwen-VLA机器人多模态

推荐理由:通才机器人模型来了
原文
今日全部早读东盟登录