用户名:  密码:   
网站首页即时通讯活动公告最新消息科技前沿学人动向两岸三地人在海外历届活动关于我们联系我们申请加入
栏目导航 — 美国华裔教授专家网科技动向科技前沿
关键字  范围   
 
给机器人配AI大脑!谷歌发布视觉语言行动模型
2023/7/29 2:34:55 | 浏览:3082 | 评论:0

给机器人配AI大脑!谷歌发布视觉语言行动模型

谷歌正在把先进的人工智能(AI)模型植入机器人,给机器人配一个AI大脑。

美东时间7月28日周五,谷歌公司宣布推出应用于机器人领域的新产品——名为Robotics Transformer 2(RT-2)的AI模型。它是一种全新的“视觉-语言-行动”(VLA)模型,可以帮助训练机器人理解扔垃圾等任务。

谷歌介绍,RT-2基于Transformer模型,根据互联网上的文本和图像进行训练,直接指示机器人执行动作。就像用语言模型通过网络文本训练AI学习人类社会的思想和概念一样,RT-2也可以通过网络数据,将相关知识告知机器人,指导机器人的行为。

谷歌举例称,如果我们要让以前的机器人系统做出扔垃圾的动作,就必须明确训练机器人懂得区分何为垃圾,以及捡起垃圾、扔掉它这些动作。而RT-2能将网上的相关知识传给机器人,让机器人无需明确的训练,就懂得垃圾是什么,甚至即便从未受过如何扔垃圾的训练,也知道怎么扔垃圾。

谷歌表示,RT-2具有将信息转化动作的能力,借助它,机器人有望更快适应全新的情形和环境。

因为在6000多次测试RT-2 模型的机器人试验后,谷歌的团队发现,面对训练数据中已有的任务、或者说“见过”的任务,RT-2和它的前代RT-1一样发挥功能,没有差别。而在新颖的、之前从未见过的任务情形中,RT-2的性能几乎提高一倍,成功率达到62%,远超RT-1的32%。

换句话说,通过RT-2,机器人能像人类一样学习更多内容,将学到的概念应用于全新的情境中。

谷歌称,RT-2显示出超越其所接触机器人数据的推广应用能力和语义、视觉理解能力,包括解释新的命令,并通过基本的推理响应用户的指令,比如关于物体的类别和高层次描述的推理。

谷歌的研究还表明,通过结合思维链的推理,RT-2能执行多阶段的语义推理,比如判断哪种物体可以临时用作锤子,哪一类饮料最适合疲劳的人。

有媒体周五称,谷歌目前没有立即计划大规模发布或者出售应用RT-2的机器人,但最终,这些机器人可能用在仓库或者用作家庭助理。

相关栏目:『科技前沿
AI不是思维的替代品,而是思辨能力的放大器 2026-05-05 [128]
刚刚,美国AI霸主换了!Anthropic年收300亿,碾压OpenAI 2026-05-05 [120]
超过人类状元,ChatGPT以最高分通过日本顶尖大学入学考试 2026-05-05 [119]
斯坦福HAI最新报告出炉:中国模型追平美国,95%企业AI投资零回报 2026-04-27 [315]
中层的坍塌:两千年管理史,终结于一个AI循环 2026-04-27 [330]
“输入电子,输出Token”:黄仁勋重写AI投资坐标系 2026-04-27 [314]
拒绝清北、负债千万、全身缝了400多针,95后深圳青年“手搓”廉价火箭,叫板马斯克! 2026-04-19 [593]
美国智库布鲁金斯学会2026年报告:《AI时代学生新方向:繁荣、准备、守护》 2026-04-08 [1138]
索尼的汽车梦,碎在了一个最坏的年景 2026-03-29 [1221]
美国宇航局公布雄心勃勃的200亿美元计划,拟在月球南极附近建造月球基地 2026-03-29 [1224]
相关栏目更多文章
最新图文:
:摄影师苏唐诗与寂寞百年的故宫对话6年,3万张照片美伦美奂 :大数据分析图解:2019中国企业500强 张梦然:英国惠康桑格研究所:人体内的微生物与出生方式有关 :美众议院将调查华裔部长赵小兰“利用职权为家族谋利“ :UCLA CCS 2019 Fall Quarter Lecture Series Overview 谭晶晶:美国科技界高度关注中国科技创新进展 :推荐:2019年底前中国高校重要学术论坛(10月 - 12 月) :黄奇帆:今后10年,中国经济将发生5个历史性变化
更多最新图文
更多《即时通讯》>>
 
打印本文章
 
您的名字:
电子邮件:
留言内容:
注意: 留言内容不要超过4000字,否则会被截断。
未 审 核:  是
  
关于我们联系我们申请加入后台管理设为主页加入收藏
美国华裔教授专家网版权所有,谢绝拷贝。如欲选登或发表,请与美国华裔教授专家网联系。
Copyright © 2026 ScholarsUpdate.com. All Rights Reserved.