术语表
按主题分组的常用术语速查。格式:中文(English) — 一句话释义。
基础与形态
- 具身智能(Embodied Intelligence) — 通过身体与环境实时交互产生智能行为的 AI 分支。
- 具身间隙(Embodiment Gap) — 模型在仿真/演示环境与真实物理环境之间的性能落差。
- 自由度(DoF, Degrees of Freedom) — 系统独立运动参数的个数;空间位姿需要 6 DoF。
- 形态计算(Morphological Computation) — 由身体结构被动承担的"计算"(如柔顺吸能)。
- 欠驱动(Underactuation) — 执行器数量少于自由度,靠结构与动力学耦合完成任务。
- 末端执行器(End-effector) — 机械臂末端与物体接触的装置(夹爪/吸盘/灵巧手)。
- 力封闭(Force Closure) — 接触力能否抵抗任意扰动的抓取稳定性判据。
感知
- 外感受 / 本体感受(Exteroception / Proprioception) — 感知外部世界 / 感知自身状态。
- 手眼标定(Hand-eye Calibration) — 求相机与机械臂坐标系变换($AX=XB$)。
- 点云(Point Cloud) — 深度传感器输出的三维点集合。
- 6D 位姿估计(6D Pose Estimation) — 估计物体三维旋转与平移。
- SLAM — 同步定位与建图;回环检测(Loop Closure)用于消除累积漂移。
- 视触觉(Vision-based Tactile) — 用相机拍摄弹性凝胶变形获取高分辨率触觉(GelSight/DIGIT)。
- 卡尔曼滤波(Kalman Filter) — 预测-更新框架的状态估计器;非线性版为 EKF/UKF。
- 里程计(Odometry) — 由运动积分得到的相对位姿估计,长期漂移。
控制与规划
- 正/逆运动学(FK / IK) — 关节角→末端位姿 / 末端位姿→关节角。
- 雅可比矩阵(Jacobian) — 关节速度到末端速度的线性映射;转置给出静力映射。
- 奇异位形(Singularity) — 雅可比降秩的位形,某些方向失去运动能力。
- C 空间(Configuration Space) — 所有位形组成的空间;运动规划在其内搜索。
- RRT / RRT\* — 采样式运动规划及其渐近最优变体。
- PID 控制 — 比例-积分-微分反馈控制,伺服层标配。
- 阻抗/导纳控制(Impedance / Admittance) — 控制位置-力动态关系(变弹簧)/ 由力生成位置修正。
- ZMP(Zero Moment Point) — 地面反力等效作用点,落在支撑多边形内则动态稳定。
- 全身控制(WBC, Whole-body Control) — 层级化 QP 统一求解躯干任务与四肢约束。
- MPC(Model Predictive Control) — 滚动时域优化:预演 N 步、执行第一步、循环重解。
- 摩擦锥(Friction Cone) — 接触点切向力不超过 μ×法向力的约束。
学习范式
- 行为克隆(BC, Behavior Cloning) — 把演示当监督学习直接拟合策略。
- 协变量偏移(Covariate Shift) — 策略偏离专家状态分布后无人教,误差复合增长。
- DAgger — 策略执行 + 专家在线标注新状态的数据聚合算法。
- 动作分块(Action Chunking) — 一次预测并执行多步动作,抑制抖动与漂移。
- 扩散策略(Diffusion Policy) — 用扩散模型生成多模态动作块的模仿学习策略。
- CVAE(条件变分自编码器) — ACT 中编码演示风格的潜变量模型。
- PPO / SAC — on-policy 策略梯度 / off-policy 最大熵强化学习算法。
- 奖励欺骗(Reward Hacking) — 智能体找到高奖励但违背意图的投机解。
- VLA(Vision-Language-Action) — 视觉-语言基础模型与动作生成端到端连接的模型族。
- 流匹配(Flow Matching) — 学习速度场生成连续动作的采样方法(π0 动作头)。
- 双系统(System 1 / System 2) — 快速反应策略 + 慢速语义推理的分层架构。
- 世界模型(World Model) — 学习环境预测器,在想象中训练策略或规划。
- RSSM — Dreamer 系的随机潜空间序列模型。
数据与仿真
- 域随机化(Domain Randomization) — 随机化仿真参数使现实成为训练分布内的一例。
- Sim2Real / Real2Sim — 仿真→真机迁移 / 真实场景重建为仿真。
- 教师-学生(Teacher-Student / 特权蒸馏) — 特权信息教师蒸馏为真机可得观测的学生。
- 遥操作(Teleoperation) — 人类实时操纵机器人并记录演示(ALOHA/VR/UMI)。
- UMI(Universal Manipulation Interface) — 手持夹具+SLAM 的免机器人数据采集。
- MimicGen — 少量人演示程序化扩增为海量演示的方法。
- HER(Hindsight Experience Replay) — 把"实际达成的结果"重标注为目标的数据再利用。
- 数据飞轮(Data Flywheel) — 部署→失败挖掘→标注→再训练的自增强数据循环。
- Open X-Embodiment(OXE) — 22 种具身、100 万+轨迹的跨实验室开源语料联盟。
- RLDS / LeRobot 格式 — 机器人演示数据的两大开源格式标准。
系统与工程
- 谐波减速器(Harmonic Drive) — 高减速比、低背隙、难反向驱动的传动件。
- 准直驱(QDD, Quasi-Direct Drive) — 低减速比+高扭矩电机,可反向驱动、天然柔顺。
- 反向驱动性(Backdrivability) — 关节可被外力推动的程度,决定力控与抗冲击能力。
- DDS / QoS — ROS 2 的通信底层及其可靠性/历史深度策略。
- 看门狗(Watchdog) — 心跳丢失即停止的安全监测机制。
- 延迟预算(Latency Budget) — 感知→决策→执行各环节的延迟分配。
前沿与评估
- 长时程(Long-horizon) — 多步相互依赖的任务链;成功率按步相乘衰减。
- 恢复行为(Recovery Behavior) — 失败后重试/绕路/回退/求助的策略库。
- VLN(Vision-and-Language Navigation) — 按自然语言指令导航。
- 泛化五轴 — 物体/场景/指令/具身/任务五个泛化维度。
- 零样本 / 少样本(Zero/Few-shot) — 不经微调 / 少量演示微调后执行新任务。
- 评估基准(Benchmark) — LIBERO、CALVIN、RLBench、RoboCasa 等标准考卷。
- 成功率(Success Rate) — 任务完成的 rollout 比例;必须附 rollout 数才有意义。