关灯
护眼
字体:大 中 小
上一页
目录
下一章
”
“而未来,能把这两者真正打通、实现闭环的,是一种多模态融合的智能模型 :VLA模型。”
台下多位院士,齐齐开动小脑瓜子,在脑海里急速搜索“VLA”词条。
很陌生,连他们都没听说过这个概念。
司雨没卖关子,马上给出解释:
“VLA ,指 Vision-Language-Action——视觉、语言、动作。”
“视觉,让机器人 看见,映射感知;
语言 ,让机器人听懂人话、理解意图,映射理解决策;
动作 ,让机器人做出动作、控制身体。”
“VLA 模型 ,就是让机器人看懂、听懂、会动作的大脑。”
“它把视觉感知、触觉反馈,和机器人的动作控制、决策判断,彻底绑定在一起。不用人工干预,机器人就能自主应对复杂的现实场景。”
这个来自未来2023年的概念一提出来,硕大的光谷体育场,鸦雀无声。
很快,响起一片低沉的嗡嗡声,大家都在轻声交流看法,互通有无。
根叔嘴里反复念叨着“视觉、语言、动作”的词语,越念越觉得这个概念精妙。
仅仅几个词语,就把机器人控制的要义,描述的简单明白。
吴院士和丁院士坐在隔壁,两人对视一眼,均从对方眼里看出同一个疑问:“你听过这个概念吗?”
答案是没有。
这个玩意在2023年大模型爆发后才诞生,现在连鬼影子都没有。
但不可否认,一旦概念入耳,立马就能明白它的意思。
院士们心里大为奇怪:
司雨为何懂这些?难道是硅谷新冒出来的学术概念?
果然人的名儿树的影儿,不愧是敢在华清大学放大炮的人,不愧是做出AI七大预判的人。
真不知道他哪里学的这么多东西,干企业厉害,搞学术也厉害。
湖音一帮校领导都无语:这踏马还是艺术生吗?
居然敢在华理工,大谈特谈机器人学术理论,关键是,那些个院士还深以为然!
湖音大力扶持思雨文化,起初是想在文艺领域做出成绩和贡献。
好嘛,技能树越点越偏,变成纯纯的科技树了。
台上的司雨,等大家消化完概念后,把话题拉回来:
“我以为,具身智能,是未来十年必将爆发的万亿赛道。”
“我理解的具身智能,内核就一句话:智能源于具身。”
“它不是把AI算法装进机器人里,智能不在云端,不在芯片里,而在在身体与环境的实时交互中。”
“没有身体,就没有这种智能;不跟现实世界交互,就产生不了这种智能。”
“而VLA模型,是具身智能的中枢神经和大脑。”
“它负责把机器人看到的、理解到的、要执行的动作,统一成一套行为逻辑。
让机器人真正做到:能感知、能理解、能动作、能适应真实世界。”
司雨最后用一句话总结:
“具身智能是方向,VLA是实现它的内核钥匙。”
“华科在这方面,有得天独厚的条件,如果大家想创业,尽管朝这方面努力。”
“选择大于努力,方向比速度更重要。”
前排教授局域里,率先响起掌声,继而迅疾扩张到全体育馆,掌声如雷似鼓,在体育馆里反复回荡......
『加入书签,方便阅读』
上一页
目录
下一章