具身智能新手名词表English

具身安全

Embodied Safety常用

确保机器人在真实世界行动时不伤人、不毁物,也不被恶意指令操纵。

具身安全关注具身智能体在物理世界执行任务带来的风险,大致分两层。一层是传统的物理安全:碰撞检测、力和速度限制、急停等,对应 ISO/TS 15066 这类协作机器人标准。另一层是大模型进入机器人后出现的新问题,谷歌 DeepMind 称为语义安全:模型可能因幻觉、提示注入或常识错误做出危险动作。ICLR 2025 的 BadRobot 论文展示了通过语音越狱,让基于大模型的机器人执行有害动作;DeepMind 2025 年提出 ASIMOV 基准和自动生成的机器人宪法,用来评估和约束模型行为。

例子用户对家用机器人说「把这瓶清洁剂倒进杯子端给客人」,具身安全要求上层模型识别出这是危险请求并拒绝;底层控制则保证手臂即使出错,也不会用过大的力撞到人。

也叫
机器人安全、具身AI安全、Embodied AI Safety
相关
功能安全、物理人机交互、安全强化学习、控制障碍函数、机器人三定律 / 机器人宪法、ISO/TS 15066 协作机器人安全标准
来源
Generating Robot Constitutions & Benchmarks for Semantic Safety (arXiv 2503.08663)
BadRobot: Jailbreaking Embodied LLM Agents in the Physical World (arXiv 2407.20242)
信息截至
2025-03

在完整名词表里查看 →