发布时间:2025-12-02
点击次数: 字节跳动 seed 团队近日公布了其在视觉-语言-动作(vla)模型领域的最新进展——gr-rl,该研究致力于突破机器人在长时程、高精度灵巧操作任务中的能力极限。

GR-RL 构建了一个融合离线数据筛选与在线真实环境微调的强化学习框架,在业内首次实现了“机器人自主为整只鞋连续穿入鞋带”的复杂操作。相比此前基于监督学习的 GR-3 模型,GR-RL 将任务成功率从 45.7% 显著提升至 83.3%,失败率降低近 70%。
据技术介绍,GR
-RL 在原有 VLA 架构基础上引入了一个额外的判别器网络(Critic Transformer),用于评估机器人每一步动作的质量,并对整个动作序列中的每个时间步进行打分。具体实现中,采用了值分布强化学习方法,将判别器的输出建模为离散概率分布,从而更有效地应对现实环境中存在的各类噪声干扰。

依托这一结构,GR-RL 设计了一套“从经验中学习、在实践中进化”的多阶段训练流程,包含三大核心模块:离线强化学习、数据增强和在线强化学习。
独响
一个轻笔记+角色扮演的app
249
查看详情
实验在双臂轮式机器人平台 ByteMini-v2 上展开,以“穿鞋带”作为典型精细操作任务进行全面验证。该机器人具备独特的球形腕关节设计,可实现类似人类手腕的自由旋转,在执行高精度操作时展现出显著优势。
测试结果显示,仅依赖模仿学习的基线模型 GR-3 成功率仅为 45.7%,难以完成复杂穿引任务。而 GR-RL 通过阶段性优化逐步提升性能,各模块均发挥关键作用:

源码地址:点击下载
以上就是字节 Seed 发布 GR-RL,首次实现真机强化学习穿鞋带的详细内容,更多请关注其它相关文章!
# 字节跳动
# 首次
# 离线
# 淘宝
# 可由
# 字节
# 鄂州网站建设很棒的公司
# 江苏口碑好的seo
# 简单的深圳动画营销推广
# 美容院怎么做营销号推广
# 锦州营销网站优化有哪些
# 蛇口搜索网站优化
# 淄博网站优化建设
# 郑州抖音seo底层逻辑
# 某网站推广文案
# 上海企业网站seo优化
# 这一
# 向高
# 端到
# 变黑
# 高通
# 拨打电话
相关栏目:
【
行业新闻62819 】
【
科技资讯67470 】
相关推荐:
奥比中光子公司和斯坦德机器人深度合作,共同推进新一代激光雷达的研发
BLIP-2、InstructBLIP稳居前三!十二大模型,十六份榜单,全面测评「多模态大语言模型」
到中国科技馆体验“一滴油的奇妙旅行”,线上元宇宙展厅同步开启
GPT-4 模型架构泄露:包含 1.8 万亿参数、采用混合专家模型
音乐制作元工具AudioCraft发布开源AI工具
吉林首例!机器人辅助下搭桥手术成功实施
华为发布两款AI存储新品
人工智能框架生态峰会即将召开,聚焦AI大模型技术与科学智能探索!
亚马逊确认今年不会举办 re:MARS 机器人和人工智能大会
人形机器人概念大热!这些产业链标的或受提振
美图公司吴欣鸿:AI技术重构影像产业
2025VR&AR显示技术峰会展示歌尔光学最新一代光学模组
美图设计室2.0使用教程
国内首款大尺寸仿鸵双足机器人“大圣”亮相,穿戴红色战袍
“直击”AI新世界,智能机器人再次“火出圈”了
“木头姐”:特斯拉的人工智能训练——“赢家通吃”的机会
北京市元宇宙产业创新中心筹建工作正式启动
Midjourney创始人:AI应该成为人类思想的延伸
联合国秘书长称支持建立全球人工智能监管机构
对话式论文阅读工具PaperMate上线,综述细节AI告诉你
AI大模型紫东太初已被注册商标 中科院已注册紫东太初大模型商标
IBM 与 NASA 携手开源地理空间 AI 模型,促进气候科学研究进步
解决导航“最后50米”难题 高德地图升级AR步行导航找终点功能
金山办公:AI是重要的产品战略之一
DeepMind推惊世排序算法,C++库忙更新!
谷歌推出RT-2视觉语言动作模型,使机器人能够掌握垃圾丢弃技能
微软 Azure AI 文本转语音服务升级:新增男性声音和扩展语言支持
马斯克称未来机器人数量将多于人类,特斯拉愿共享自动驾驶技术
重塑未来生活的五项技术趋势
“图壤·阅读元宇宙”亮相北京国际图书博览会
鸿蒙OS 4将实现AI大模型集成,余承东表示坚持AI辅助而非AI取代
智能机器人正在彻底改变客户服务
Spotify计划推出AI驱动的音乐播放器功能
Meta 人工智能业务落后竞争对手,研究人员大量离职成重要原因
本届人工智能大会上的这个“镇馆之宝”,来自长宁企业西井科技!
学而思网校推出首个基于自研大模型的《人工智能第一课》
创作音乐/音频的Meta开源AI工具AudioCraft,让用户通过文本提示实现
这款在《自然通讯》发表的机器人,为变形金刚来到现实创造可能性
给小朋友最好的科技礼物:乐天派桌面机器人
人工智能的变革之路:通过OpenAI的GPT-4漫游
此「错」并非真的错:从四篇经典论文入手,理解Transformer架构图「错」在何处
广州团建公司方案 | 绝密飞行 → X-PLANE无人机团建主题团建
彭博社:苹果Vision Pro曾测试VR手柄追踪方案
售价14.99万起!小米汽车部分信息疑遭AI曝光,内部人士回应:网传图片明显经过处理,不可轻信
周鸿祎:用超级AI实现室温超导和核聚变,实现能源自由
首个算网生态体!中国移动元宇宙产业联盟正式成立
【|直播|预告】人工智能高峰论坛将于7月2日13:30准时开播!
联通发布鸿湖图文AI大模型1.0,可实现以文生图
人脸识别+全景双摄+AI算法 萤石推动智能锁行业革新
引领AI变革,九章云极DataCanvas公司重磅发布AIFS+DataPilot