华为UCM、英伟达Cosmos Reason、达摩院开源“三大件”……一周AI大事记
8月14日,三大件智元推出面向真实世界机器人操控的英院开源周统一世界模型平台Genie Envisioner(GE)。 与传统“数据-训练-评估”的伟达割裂流水线模式相比,GE将未来帧预测、达摩大事策略学习与仿真评估整合,三大件以视频生成为核心形成闭环架构。英院开源周 基于约3000小时的伟达真实机器人操控视频数据,GE建立了从语言指令到视觉空间的达摩大事直接映射,保留了机器人与环境交互的三大件完整时空信息,让机器人在同一世界模型中完成从“看”到“想”再到“动”的英院开源周端到端推理与执行。 • 点评:当前,伟达机器人学习系统普遍采用分阶段开发模式,达摩大事这种碎片化架构增加了开发的三大件繁琐度,延长了迭代周期,英院开源周限制了系统的伟达可扩展性。不同于主流VLA(视觉-语言-动作)模型利用视觉-语言进行间接建模,GE可以直接在视觉空间中建模,让机器人完成“想象-验证-行动”的完整闭环。(曹妍) 8月11日,英伟达发布机器人视觉语言模型(VLM)Cosmos Reason,它拥有70亿参数,用于机器人等具身智能,让机器人和AI代理能够像人类一样进行推理,利用先验知识、常识来理解现实世界,并在现实世界中行动。 同时,现有Cosmos世界模型系列将新增Cosmos Transfer-2,能加速从3D模拟场景或空间控制输入中生成合成数据。此外,英伟达还推出了一系列面向机器人开发者的数据库及相关基础设施。 • 点评:Cosmos Reason的突破在于解决多步骤任务,有望应用于数据管理、机器人规划和视频分析等领域。这一系列动作,标志着英伟达正在加码进军机器人赛道,拓展AI数据中心之外的下一个重要应用场景。(曹妍) 8月11日,阿里达摩院宣布开源自研的VLA模型RynnVLA-001-7B、世界理解模型RynnEC,以及机器人上下文协议RynnRCP,推动数据、模型与机器人的兼容适配,打通具身智能开发的全流程。 达摩院将MCP(Model ContextAI与机器人
01 智元发布机器人世界模型平台Genie Envisioner
02 英伟达发布Cosmos Reason
03 达摩院开源具身智能“三大件”
- 最近发表
- 随机阅读
-
- 特朗普:也门胡塞武装同意不与美国交战
- 12亿美元!百胜中国拿下必胜客品牌中国大陆所有权
- 卡普空确认参加科隆游戏展!鬼武者、维罗妮卡有望亮相
- 50天狂偷200套乐高!德州男子因盗窃被判45年重刑!
- U20女足世界杯:中国队不敌西班牙 以小组第三晋级
- 《星际宝贝》真人版续集定档 原班人马强势回归!
- 特朗普:关我们啥事?就是卖卖武器
- 钟祥市2026年防范非法金融活动宣传月正式启动
- 武汉一医院被指未经家属同意转移患者遗体?院方通报
- 朱一龙在长城击日本鼓?品牌方和工作室接连回应
- 马斯克身家超140国GDP 可购9403吨黄金
- 今年7月中国将在上海举办2026世界人工智能大会
- 中国男篮大胜菲律宾队 以小组头名晋级亚运会八强
- “AI+影视”跑出产业加速度 AI进入片场将迎这些挑战→
- 美元/日元临近关键拐点,160关口背后藏着三重定价冲突
- 特朗普:关我们啥事?就是卖卖武器
- 青海西宁欢乐康健跑点燃全民健身活力
- 38岁梅西刷新无数纪录:唯一5届进球+助攻 射手榜升第1
- 男性给女性朋友送花有哪些忌讳?
- 京山市应急管理局“零点行动”保平安
- 搜索
-