智生万物携手顶尖高校,开源 VLA-Foundation 具身大模型
开源共建,繁荣实体 AI 生态
具身智能(Embodied AI)的突破,离不开整个开源社区与学术界的共同努力。今天,我们在 GitHub 与 HuggingFace 平台上,正式对外开源了经过深度优化的 VLA-Foundation 模型(包含 7B 与 13B 两个版本)。
跨越物理法则的认知大脑
该模型是我们过去两年在研发远征 X1 与 VisionArm 系列产品时积累的核心技术底座。它在超过 100 万小时的真实家庭服务视频、实验室精细操作录像以及高逼真仿真环境中进行了大规模预训练。VLA-Foundation 不仅具备极强的零样本泛化能力,更内化了大量的物理常识(例如:玻璃杯掉在地上会碎,水杯必须保持向上等)。
降低科研门槛,加速技术普惠
“我们深知,仅仅依靠一家公司的力量是无法穷尽所有长尾场景的。”智生万物首席科学家在开源发布会上提到。通过免费提供这一强大的基础模型权重与微调框架,我们希望帮助更多的高校实验室、创客团队乃至个人开发者,大幅降低研发具身智能机器人的门槛,共同探索物理世界的 AI 觉醒之路。