云南淘乐房科技有限公司

400 128 6709

行业新闻

当前位置：首页 > 新闻中心 > 行业新闻

字节 Seed 发布 GR-RL，首次实现真机强化学习穿鞋带

发布时间：2025-12-02

点击次数：

字节跳动 seed 团队近日公布了其在视觉-语言-动作（vla）模型领域的最新进展——gr-rl，该研究致力于突破机器人在长时程、高精度灵巧操作任务中的能力极限。

字节 Seed 发布 GR-RL，首次实现真机强化学习穿鞋带

GR-RL 构建了一个融合离线数据筛选与在线真实环境微调的强化学习框架，在业内首次实现了“机器人自主为整只鞋连续穿入鞋带”的复杂操作。相比此前基于监督学习的 GR-3 模型，GR-RL 将任务成功率从 45.7% 显著提升至 83.3%，失败率降低近 70%。

据技术介绍，GR-RL 在原有 VLA 架构基础上引入了一个额外的判别器网络（Critic Transformer），用于评估机器人每一步动作的质量，并对整个动作序列中的每个时间步进行打分。具体实现中，采用了值分布强化学习方法，将判别器的输出建模为离散概率分布，从而更有效地应对现实环境中存在的各类噪声干扰。

字节 Seed 发布 GR-RL，首次实现真机强化学习穿鞋带

依托这一结构，GR-RL 设计了一套“从经验中学习、在实践中进化”的多阶段训练流程，包含三大核心模块：离线强化学习、数据增强和在线强化学习。

独响

一个轻笔记+角色扮演的app

249 查看详情

实验在双臂轮式机器人平台 ByteMini-v2 上展开，以“穿鞋带”作为典型精细操作任务进行全面验证。该机器人具备独特的球形腕关节设计，可实现类似人类手腕的自由旋转，在执行高精度操作时展现出显著优势。

测试结果显示，仅依赖模仿学习的基线模型 GR-3 成功率仅为 45.7%，难以完成复杂穿引任务。而 GR-RL 通过阶段性优化逐步提升性能，各模块均发挥关键作用：

数据过滤：去除低质量轨迹后，离线阶段的成功率提升至 61.6%；
数据增强：通过镜像翻转等方式扩充数据集，使成功率进一步提高到 72.7%；
在线强化学习：以增强后的模型为起点，在真实机器人上进行约 150 条轨迹的闭环探索与策略修正，最终 GR-RL 的成功率达到了 83.3%。

字节 Seed 发布 GR-RL，首次实现真机强化学习穿鞋带

源码地址：点击下载

以上就是字节 Seed 发布 GR-RL，首次实现真机强化学习穿鞋带的详细内容，更多请关注其它相关文章！

# 字节跳动 # 首次 # 离线 # 淘宝 # 可由 # 字节 # 鄂州网站建设很棒的公司 # 江苏口碑好的seo # 简单的深圳动画营销推广 # 美容院怎么做营销号推广 # 锦州营销网站优化有哪些 # 蛇口搜索网站优化 # 淄博网站优化建设 # 郑州抖音seo底层逻辑 # 某网站推广文案 # 上海企业网站seo优化 # 这一 # 向高 # 端到 # 变黑 # 高通 # 拨打电话

相关栏目：【行业新闻62819 】【科技资讯67470 】

相关推荐：奥比中光子公司和斯坦德机器人深度合作，共同推进新一代激光雷达的研发 BLIP-2、InstructBLIP稳居前三！十二大模型，十六份榜单，全面测评「多模态大语言模型」到中国科技馆体验“一滴油的奇妙旅行”，线上元宇宙展厅同步开启 GPT-4 模型架构泄露：包含 1.8 万亿参数、采用混合专家模型音乐制作元工具AudioCraft发布开源AI工具吉林首例！机器人辅助下搭桥手术成功实施华为发布两款AI存储新品人工智能框架生态峰会即将召开，聚焦AI大模型技术与科学智能探索！亚马逊确认今年不会举办 re:MARS 机器人和人工智能大会人形机器人概念大热！这些产业链标的或受提振美图公司吴欣鸿：AI技术重构影像产业 2025VR&AR显示技术峰会展示歌尔光学最新一代光学模组美图设计室2.0使用教程国内首款大尺寸仿鸵双足机器人“大圣”亮相，穿戴红色战袍 “直击”AI新世界，智能机器人再次“火出圈”了 “木头姐”：特斯拉的人工智能训练——“赢家通吃”的机会北京市元宇宙产业创新中心筹建工作正式启动 Midjourney创始人：AI应该成为人类思想的延伸联合国秘书长称支持建立全球人工智能监管机构对话式论文阅读工具PaperMate上线，综述细节AI告诉你 AI大模型紫东太初已被注册商标中科院已注册紫东太初大模型商标 IBM 与 NASA 携手开源地理空间 AI 模型，促进气候科学研究进步解决导航“最后50米”难题高德地图升级AR步行导航找终点功能金山办公：AI是重要的产品战略之一 DeepMind推惊世排序算法，C++库忙更新！谷歌推出RT-2视觉语言动作模型，使机器人能够掌握垃圾丢弃技能微软 Azure AI 文本转语音服务升级：新增男性声音和扩展语言支持马斯克称未来机器人数量将多于人类，特斯拉愿共享自动驾驶技术重塑未来生活的五项技术趋势 “图壤·阅读元宇宙”亮相北京国际图书博览会鸿蒙OS 4将实现AI大模型集成，余承东表示坚持AI辅助而非AI取代智能机器人正在彻底改变客户服务 Spotify计划推出AI驱动的音乐播放器功能 Meta 人工智能业务落后竞争对手，研究人员大量离职成重要原因本届人工智能大会上的这个“镇馆之宝”，来自长宁企业西井科技！学而思网校推出首个基于自研大模型的《人工智能第一课》创作音乐/音频的Meta开源AI工具AudioCraft，让用户通过文本提示实现这款在《自然通讯》发表的机器人，为变形金刚来到现实创造可能性给小朋友最好的科技礼物：乐天派桌面机器人人工智能的变革之路：通过OpenAI的GPT-4漫游此「错」并非真的错：从四篇经典论文入手，理解Transformer架构图「错」在何处广州团建公司方案 | 绝密飞行 → X-PLANE无人机团建主题团建彭博社：苹果Vision Pro曾测试VR手柄追踪方案售价14.99万起！小米汽车部分信息疑遭AI曝光，内部人士回应：网传图片明显经过处理，不可轻信周鸿祎：用超级AI实现室温超导和核聚变，实现能源自由首个算网生态体！中国移动元宇宙产业联盟正式成立【|直播|预告】人工智能高峰论坛将于7月2日13:30准时开播！联通发布鸿湖图文AI大模型1.0，可实现以文生图人脸识别+全景双摄+AI算法萤石推动智能锁行业革新引领AI变革，九章云极DataCanvas公司重磅发布AIFS+DataPilot

上一篇：今年全国第 1800 亿件快件由京东物流送达，智狼分拣、无人

下一篇：韩国类魂《遗迹：第一守卫》受外媒好评：完美结合巫师和黑魂！

400 128 6709

E-mail

contact@tlftec.cn

扫一扫，添加微信

© 云南淘乐房科技有限公司版权所有滇ICP备2025071560号