
具身智能这条路上,VLA真的死了吗?
北京人形的表征分析背后,发现的是视觉语言与动作没打通,模型在学"记忆"而非"理解"。
世界模型会是具身智能的新童话吗?
缺数据、缺统一语言、缺时序建模……鸡生蛋蛋生鸡的循环里,这条具身智能的新方向,能走向具身ChatGPT时刻吗?
Unify才是正解?
北京人形的Pelican-Unify完成了VLM理解+Diffusion 融合,实现了视频怎么动、动作就怎么动,并能回答视频/动作为什么应该这么动——比Cosmos3融合更好、更难,但从第一性原理来看更合理。
具身智能行业还在BERT时代?
具身智能尚未迎来 ChatGPT 式 GPT 时刻,技术路线尚未收敛,但真的还远吗?
关于具身智能的未来
作为全球具身智能领导者,更作为具身智能国家队,从WRC到第二届世界人形机器人运动会,北京人形围绕「慧思开物」最强大小脑平台给出了自己的答卷,从Pelican- Unify的发布到运动会上大小脑协同的夺金、摘银、揽铜,完整地展现出了北京人形的技术理念。
具身智能需要向上探索技术无人区,也需要埋头钻研每一个现有技术的可能性未来,我们也希望和更多伙伴一同脚踏实地、仰望星空!
京公网安备11011202100775号