在当地时间周一揭幕的行业顶级会议SIGGRAPH(国际计算机协会计算机图形学和交互技术特别兴趣小组年度会议)上,“全球股王”英伟达推出一系列面向机器人开发者的世界模型、应用库和基础设施。
其中 ,最引人关注的是参数量只有70亿的开源物理AI应用和机器人视觉推理模型Cosmos Reason 。
英伟达介绍称,自从OpenAI多年前发布CLIP模型以来,视觉语言模型已经改变了计算机视觉任务 ,例如物体与模式的识别等。然而,此前的模型无法解决多步骤任务,也难以应对模糊或新颖的现实体验。
凭借记忆和理解能力 ,Cosmos Reason能够使机器人和AI具身代理“像人类一样推理 ”,并在真实世界中采取行动 。
在英伟达给出的案例中,运行视觉推理模型的机器人手臂 ,成功根据“面包+烤面包机”的场景,推断出最合理的下一步动作是将面包放进烤面包机进行烘烤,并将思考逻辑转化成机器手臂的操作指令。
(来源:英伟达)
这项功能叫做“机器人规划与推理”。Cosmos Reason能够作为机器人的“大脑 ” ,负责有意识、条理化的决策 。视觉推理模型能够解释环境,并在面对复杂指令时将其分解为任务并利用常识执行。
除此之外,这个模型还能用于一系列AI应用。例如自动化对大规模 、多样化训练数据集进行整理、标注,也能从海量视频数据中提取有价值的信息并进行归因分析 。
目前这个模型已经投入商业化运营。英伟达披露 ,公司内部的机器人和自动驾驶团队正使用这个模型进行数据整理与过滤、标注以及VLA(视觉语言动作)后训练。优步(Uber)也在使用该模型为自动驾驶训练数据进行标注与生成说明 。
除此之外,麦格纳国际正在使用该模型开发全自动即时配送解决方案City Delivery,用来帮助车辆更快适应新城市环境。VAST Data 、Milestone Systems也在交通监控自动化、视觉检测等领域应用该模型。
除了Cosmos Reason ,英伟达也在Cosmos世界模型中新增了Cosmos Transfer-2,用来加速从3D仿真等场景生成合成数据,以及一个经过蒸馏、更为注重速度优化的Cosmos Transfers版本。
英伟达也在周一更新了Omniverse软件开发工具包 ,并公布了新的神经重建库 。其中包括一种渲染技术库,允许开发者使用传感器数据在三维中模拟现实世界。
这一系列发布标志着AI芯片巨头正在加码进军机器人领域,试图将其培养成AI数据中心之外的下一个重要应用场景。
股票配资网站:正规杠杆炒股公司-英伟达、宇树、银河通用问答全文:未来10年机器人如何改变世界
炒股平台配资:十大股票网站-广州结束15年楼市限制政策 其他一线城市会跟进吗?
股票配资平台网站:网上配资知识网首选-全球市场:美股三大指数均跌超1% 国际油价涨逾7% 国际黄金结算价创新高
正规实盘股票配资平台:配资炒股首选平台-超20家机构竞逐!星巴克的“谈判桌”:中国市场业绩添筹码
配资炒股网站:全国10大股票配资平台-飞天茅台电商促销价跌破1850元:经销商称线下影响有限 高端白酒如何破局?
股票配资平台网站:正规配资线上炒股门户-基孔肯雅热防控效果正在显现 广东省委:全力把疫情控制住
股票:配资炒股平台网站-再鼎医药将于今年在国内递交艾加莫德预充式皮下注射剂型上市申请
北京正规股票配资平台:炒股配资网站-青岛一小米SU7 Ultra起火?小米汽车副总裁紧急回应:系正常直行中与旁边突然窜出的车辆发生碰撞
广瑞网配资提示:文章来自网络,不代表本站观点。
记者辛圆据央视新闻周四发布消息,中国中小企业协会周四发布数据显示,2025年一季度,中国中小企业发展指...
埃隆·马斯克的SpaceX发射的“星链”卫星,正在加速坠落。 近日,美国马里兰大学和美国航空航天局(NASA)戈达...
央行公告,为保持银行体系流动性充裕,更好满足不同参与机构差异化资金需求,自本月起中期借贷便利(MLF)将采用固定数量、利...
记者|赵阳戈年初,证监会就修改《证券发行与承销管理办法》部分条款向社会公开征求意见,市场也将注意力投向了...
记者王珍中国国际经济交流中心副理事长、国务院发展研究中心原副主任王一鸣周一在“中国发展高层论坛2025...