在当地时间周一揭幕的行业顶级会议SIGGRAPH(国际计算机协会计算机图形学和交互技术特别兴趣小组年度会议)上,“全球股王”英伟达推出一系列面向机器人开发者的世界模型 、应用库和基础设施。
其中 ,最引人关注的是参数量只有70亿的开源物理AI应用和机器人视觉推理模型Cosmos Reason 。
英伟达介绍称,自从OpenAI多年前发布CLIP模型以来,视觉语言模型已经改变了计算机视觉任务 ,例如物体与模式的识别等。然而,此前的模型无法解决多步骤任务,也难以应对模糊或新颖的现实体验。
凭借记忆和理解能力 ,Cosmos Reason能够使机器人和AI具身代理“像人类一样推理 ”,并在真实世界中采取行动 。
在英伟达给出的案例中,运行视觉推理模型的机器人手臂 ,成功根据“面包+烤面包机”的场景,推断出最合理的下一步动作是将面包放进烤面包机进行烘烤,并将思考逻辑转化成机器手臂的操作指令。
(来源:英伟达)
这项功能叫做“机器人规划与推理”。Cosmos Reason能够作为机器人的“大脑 ”,负责有意识、条理化的决策 。视觉推理模型能够解释环境 ,并在面对复杂指令时将其分解为任务并利用常识执行。
除此之外,这个模型还能用于一系列AI应用。例如自动化对大规模、多样化训练数据集进行整理 、标注,也能从海量视频数据中提取有价值的信息并进行归因分析 。
目前这个模型已经投入商业化运营。英伟达披露 ,公司内部的机器人和自动驾驶团队正使用这个模型进行数据整理与过滤、标注以及VLA(视觉语言动作)后训练。优步(Uber)也在使用该模型为自动驾驶训练数据进行标注与生成说明。
除此之外,麦格纳国际正在使用该模型开发全自动即时配送解决方案City Delivery,用来帮助车辆更快适应新城市环境 。VAST Data、Milestone Systems也在交通监控自动化 、视觉检测等领域应用该模型。
除了Cosmos Reason ,英伟达也在Cosmos世界模型中新增了Cosmos Transfer-2,用来加速从3D仿真等场景生成合成数据,以及一个经过蒸馏、更为注重速度优化的Cosmos Transfers版本。
英伟达也在周一更新了Omniverse软件开发工具包 ,并公布了新的神经重建库 。其中包括一种渲染技术库,允许开发者使用传感器数据在三维中模拟现实世界。
这一系列发布标志着AI芯片巨头正在加码进军机器人领域,试图将其培养成AI数据中心之外的下一个重要应用场景。
炒股股票开户流程:手机用的股票软件-五年大赚293% 主动权益基金最新业绩出炉
可以挑选股票的炒股软件:股票软件app网站-3个月薪资2万!苹果手机生产旺季 每天上千人进入富士康
怎样在手机买股票:下载app股票软件-华泰证券:建议关注新疆板块投资机会
股票如何融资:如何下载股票软件到手机-两大芯片巨头官宣并购!条款亮了:不盈利不减持 低于发行价不减持!
看股票什么手机好用:天津股票账户开户-国家能源局:新型电力系统建设试点启动 协同布局算力与电力项目
股票多少钱可以加杠杆操作:手机股票软件推荐-A股三大指数涨跌不一 沪指再创十年新高 数字货币概念股大涨
无人机最好的股票排名:股票活跃账户-英伟达否认H100/H200芯片短缺传闻
最好的手机股票软件:怎么样在手机上开户买股票-从“规模扩张”转向“创新驱动+产业协同” 资本市场并购重组浮现出三大新特点
高开网配资提示:文章来自网络,不代表本站观点。
界面新闻记者|冯赛琪12月20日,在MM艺术品指数媒体发布会上,MM全球印象派价格指数及全球当代艺术品价格指...
2025年3月8日,东鹏饮料(605499.SH)发布2024年年度报告。截至2025年3月07日,共有1...
界面新闻记者|邹文榕政策引导叠加企业融资需求旺盛,界面新闻记者关注到,开年以来,产业债一级市场发行量较往年明...
文丨财联社目前共有18家上市券商发布了半年报。其中,浙商证券上半年实现营收84.56亿元,光大证券、东方...
2025年3月11日,春秋电子(603890.SH)披露了关于控股股东部分股份解除质押的公告。截至本公告披露之日,公司控...
2025年3月11日,龙星科技(002442.SZ)公告称,公司与 CSRC(SINGAPORE) PTE LTD(中...