返回行业动态

Robbyant 开源 6B 跨实体机器人视觉-语言-动作模型 LingBot-VLA 2.0

2026/07/09 04:29
查看原文

OmniTools 7月9日消息,Robbyant 正式发布 LingBot-VLA 2.0,一款参数量为 6B 的开源视觉-语言-动作(VLA)基础模型。该模型以 Qwen3-VL-4B-Instruct 为骨干架构,采用 MoE 动作专家设计,并通过 55 维规范向量统一表征多种机器人状态与动作。

训练数据涵盖约 60,000 小时高质量多模态数据,包括 50,000 小时机器人轨迹数据和 10,000 小时第一人称人类视频,覆盖 20 种不同机器人配置。在 GM-100 双机械臂基准测试中,LingBot-VLA 2.0 在多个平台表现优于 π0.5 及前代版本。

目前,模型权重、训练代码与技术报告已按 Apache-2.0 许可协议开源。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部