400 128 6709

行业新闻

字节 Seed 发布 GR-RL,首次实现真机强化学习穿鞋带

发布时间:2025-12-02点击次数:

字节跳动 seed 团队近日公布了其在视觉-语言-动作(vla)模型领域的最新进展——gr-rl,该研究致力于突破机器人在长时程、高精度灵巧操作任务中的能力极限。

字节 Seed 发布 GR-RL,首次实现真机强化学习穿鞋带

GR-RL 构建了一个融合离线数据筛选与在线真实环境微调的强化学习框架,在业内首次实现了“机器人自主为整只鞋连续穿入鞋带”的复杂操作。相比此前基于监督学习的 GR-3 模型,GR-RL 将任务成功率从 45.7% 显著提升至 83.3%,失败率降低近 70%。

据技术介绍,GR-RL 在原有 VLA 架构基础上引入了一个额外的判别器网络(Critic Transformer),用于评估机器人每一步动作的质量,并对整个动作序列中的每个时间步进行打分。具体实现中,采用了值分布强化学习方法,将判别器的输出建模为离散概率分布,从而更有效地应对现实环境中存在的各类噪声干扰。

字节 Seed 发布 GR-RL,首次实现真机强化学习穿鞋带

依托这一结构,GR-RL 设计了一套“从经验中学习、在实践中进化”的多阶段训练流程,包含三大核心模块:离线强化学习、数据增强和在线强化学习。

独响 独响

一个轻笔记+角色扮演的app

独响 249 查看详情 独响

实验在双臂轮式机器人平台 ByteMini-v2 上展开,以“穿鞋带”作为典型精细操作任务进行全面验证。该机器人具备独特的球形腕关节设计,可实现类似人类手腕的自由旋转,在执行高精度操作时展现出显著优势。

测试结果显示,仅依赖模仿学习的基线模型 GR-3 成功率仅为 45.7%,难以完成复杂穿引任务。而 GR-RL 通过阶段性优化逐步提升性能,各模块均发挥关键作用:

  • 数据过滤:去除低质量轨迹后,离线阶段的成功率提升至 61.6%;
  • 数据增强:通过镜像翻转等方式扩充数据集,使成功率进一步提高到 72.7%;
  • 在线强化学习:以增强后的模型为起点,在真实机器人上进行约 150 条轨迹的闭环探索与策略修正,最终 GR-RL 的成功率达到了 83.3%。

字节 Seed 发布 GR-RL,首次实现真机强化学习穿鞋带

源码地址:点击下载

以上就是字节 Seed 发布 GR-RL,首次实现真机强化学习穿鞋带的详细内容,更多请关注其它相关文章!


# 字节跳动  # 首次  # 离线  # 淘宝  # 可由  # 字节  # 鄂州网站建设很棒的公司  # 江苏口碑好的seo  # 简单的深圳动画营销推广  # 美容院怎么做营销号推广  # 锦州营销网站优化有哪些  # 蛇口搜索网站优化  # 淄博网站优化建设  # 郑州抖音seo底层逻辑  # 某网站推广文案  # 上海企业网站seo优化  # 这一  # 向高  # 端到  # 变黑  # 高通  # 拨打电话 


相关栏目: 【 行业新闻62819 】 【 科技资讯67470


相关推荐: 奥比中光子公司和斯坦德机器人深度合作,共同推进新一代激光雷达的研发  BLIP-2、InstructBLIP稳居前三!十二大模型,十六份榜单,全面测评「多模态大语言模型」  到中国科技馆体验“一滴油的奇妙旅行”,线上元宇宙展厅同步开启  GPT-4 模型架构泄露:包含 1.8 万亿参数、采用混合专家模型  音乐制作元工具AudioCraft发布开源AI工具  吉林首例!机器人辅助下搭桥手术成功实施  华为发布两款AI存储新品  人工智能框架生态峰会即将召开,聚焦AI大模型技术与科学智能探索!  亚马逊确认今年不会举办 re:MARS 机器人和人工智能大会  人形机器人概念大热!这些产业链标的或受提振  美图公司吴欣鸿:AI技术重构影像产业  2025VR&AR显示技术峰会展示歌尔光学最新一代光学模组  美图设计室2.0使用教程  国内首款大尺寸仿鸵双足机器人“大圣”亮相,穿戴红色战袍  “直击”AI新世界,智能机器人再次“火出圈”了  “木头姐”:特斯拉的人工智能训练——“赢家通吃”的机会  北京市元宇宙产业创新中心筹建工作正式启动  Midjourney创始人:AI应该成为人类思想的延伸  联合国秘书长称支持建立全球人工智能监管机构  对话式论文阅读工具PaperMate上线,综述细节AI告诉你  AI大模型紫东太初已被注册商标 中科院已注册紫东太初大模型商标  IBM 与 NASA 携手开源地理空间 AI 模型,促进气候科学研究进步  解决导航“最后50米”难题 高德地图升级AR步行导航找终点功能  金山办公:AI是重要的产品战略之一  DeepMind推惊世排序算法,C++库忙更新!  谷歌推出RT-2视觉语言动作模型,使机器人能够掌握垃圾丢弃技能  微软 Azure AI 文本转语音服务升级:新增男性声音和扩展语言支持  马斯克称未来机器人数量将多于人类,特斯拉愿共享自动驾驶技术  重塑未来生活的五项技术趋势  “图壤·阅读元宇宙”亮相北京国际图书博览会  鸿蒙OS 4将实现AI大模型集成,余承东表示坚持AI辅助而非AI取代  智能机器人正在彻底改变客户服务  Spotify计划推出AI驱动的音乐播放器功能  Meta 人工智能业务落后竞争对手,研究人员大量离职成重要原因  本届人工智能大会上的这个“镇馆之宝”,来自长宁企业西井科技!  学而思网校推出首个基于自研大模型的《人工智能第一课》  创作音乐/音频的Meta开源AI工具AudioCraft,让用户通过文本提示实现  这款在《自然通讯》发表的机器人,为变形金刚来到现实创造可能性  给小朋友最好的科技礼物:乐天派桌面机器人  人工智能的变革之路:通过OpenAI的GPT-4漫游  此「错」并非真的错:从四篇经典论文入手,理解Transformer架构图「错」在何处  广州团建公司方案 | 绝密飞行 → X-PLANE无人机团建主题团建  彭博社:苹果Vision Pro曾测试VR手柄追踪方案  售价14.99万起!小米汽车部分信息疑遭AI曝光,内部人士回应:网传图片明显经过处理,不可轻信  周鸿祎:用超级AI实现室温超导和核聚变,实现能源自由  首个算网生态体!中国移动元宇宙产业联盟正式成立  【|直播|预告】人工智能高峰论坛将于7月2日13:30准时开播!  联通发布鸿湖图文AI大模型1.0,可实现以文生图  人脸识别+全景双摄+AI算法 萤石推动智能锁行业革新  引领AI变革,九章云极DataCanvas公司重磅发布AIFS+DataPilot 

400 128 6709
E-mail

contact@tlftec.cn

扫一扫,添加微信

©  云南淘乐房科技有限公司 版权所有  滇ICP备2025071560号  

云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司