中文读懂 AI 与全技术今天发生了什么
← 返回首页
站内快照 · 国内可打开。外网原文可能无法访问。
Vision--Language Signals in Constrained RL: Safety Gains Without Anticipation
安全强化学习寻求在满足安全约束的同时最大化任务性能的策略。然而在驾驶基准中,碰撞成本通常仅在碰撞时出现,无法提前预警逼近的危险。冻结的视觉-语言模型被用于提供信号。
原文链接