- 论文公开站arXiv
通过STL引导的Stein变分策略梯度从稀疏成功信号学习机器人策略
Learning Robot Policies from Sparse Success Signals via STL-Guided Stein Variational Policy Gradient
摘要显示,该研究针对稀疏成功信号下机器人策略学习难题,提出STL-SVPG方法:以平滑的信号时序逻辑(STL)鲁棒性作为轨迹级训练目标,通过动力学求导将信用按对完整任务规范的影响分配给策略动作,而非仅依据局部进展。在六项四旋翼与机械臂任务(含事件触发、严格顺序、截止时间响应与物理接触)中,该方法在五项取得最高平均成功率,且仿真训练策略可迁移到真实世界。
意义:为稀疏奖励与多条件时序任务提供可微轨迹级目标,利于机器人策略的信用分配与仿真到现实迁移。
- 资讯公开站IEEE Spectrum Robotics
视频周五:两个双旋翼组成四旋翼
Video Friday: Two Birotors Make a Quadrotor
摘要显示,IEEE Spectrum Robotics 的 Video Friday 栏目本周精选了多段机器人视频,包括 CLIMB Lab 用两个双旋翼组合成四旋翼的演示、ETH Zurich 机器人系统实验室的视频(最后 30 秒被评价为精彩),以及 Figure 人形机器人的展示。文中还列出 Humanoids Summit Seoul、IROS 2026、CoRL 2026 等会议日程,但未提供具体技术细节或数据。
意义:为开发者提供机器人领域最新演示与会议动态的快速入口,便于跟踪双旋翼/四旋翼、人形机器人等方向的实际进展。