摘要
作者|华卫“过去是人定义机器人,接下来则是AI定义机器人。”在星海图办的第一届全球开发者大会上,CEO高继扬与CTO赵行首次完整披露了公司具身智能技术路线,提出具身智能正经历“本能智能—作业智能—进化智能”的三重跃迁。高继扬认为,今天机器人的身体仍由人类工程师设计,而未来AI将围绕应用场景与任务,去定义和设计机器人自己的身体。本能智能直接作用于本体,让机器人像人一样天然学会驾驭身体,保持平衡、行走、奔跑;作业智能建立在本能智能之上,解决像人一样有序作业和操作的问题,语言是它的重要接口,星海图的G系列模型正是作业智能模型;进化智能则指向更深的问题:AI能不能定义最优生产力形态。会上,星海图发布新一代VLA基础模型G0.5并宣布开源,公布世界模型Fast-WAM与全身控制基础模型,自研双足人形机器人Kengo(行客)现场首秀。它身高1.4米,以高性能运动小脑与具身大脑为核心,既能完成四连踢等高难度全身动作,也能胜任递物、搬箱、叠衣等贴近真实场景的双臂作业。不同于大部分具身智能大脑企业从智能开始,星海图第一天就从整机做起,开辟了轮式双臂品类。做整机后发现制约性能的关键在于动力模组,于是自研动力模组,到今天80%的动力单元是自研或与产业链共研的。再后来发现光做整机不够,又决定在2025年春节前后启动双足人形项目。同时,星海图联合北京亦庄共建的数据公司“亦数智能”正式揭牌,启动“100万小时超高质量真实数据计划”规划今年完成百万小时、未来三年迈向千万小时。星海图是行业内最早押注真实数据的公司。2025年8月开源的数据集GOD是全球第一个开放场景具身操作数据集,下载量接近60万次。“在百万小时到千万小时之间的数据量训练出来的具身基础模型,会带来非常突破性的改变。”高继扬算了一笔账:一个人从0到18岁,醒着和物理世界交互的总时长约12万小时。也就是说,人的大脑用了12万小时学会了怎么驾驭自己的身体。100万小时相当于约8.3个人的学习总时长,1000万小时相当于约83个人。而GPT等大语言模型的训练Token数,转换到具身基础模型训练上,大概就落在百万小时到千万小时之间。之后他做出一个明确判断:依托数据供应链与整机供应链的叠加优势,未来两到三年,中国的具身基础模型能力有望整体超过美国,拿到世界第一的位置。整机、模型、数据之外,星海图打出的第四张牌是生态。