OmniTools 7月9日消息,Robbyant 正式发布 LingBot-VLA 2.0,一款参数量为 6B 的开源视觉-语言-动作(VLA)基础模型。该模型以 Qwen3-VL-4B-Instruct 为骨干架构,采用 MoE 动作专家设计,并通过 55 维规范向量统一表征多种机器人状态与动作。
训练数据涵盖约 60,000 小时高质量多模态数据,包括 50,000 小时机器人轨迹数据和 10,000 小时第一人称人类视频,覆盖 20 种不同机器人配置。在 GM-100 双机械臂基准测试中,LingBot-VLA 2.0 在多个平台表现优于 π0.5 及前代版本。
目前,模型权重、训练代码与技术报告已按 Apache-2.0 许可协议开源。