推理(前向计算)
Inference入门必知用训练好的模型对新输入算出输出,只做前向计算、不更新参数。
Inference 指使用训练好的模型:输入新数据,跑一遍前向计算得到输出,不算梯度、不更新参数,与「训练」相对。中文「推理」同时对应 Inference 和 Reasoning(模型分步思考),读论文要看上下文区分。对机器人来说,推理速度决定控制跟不跟得上:π0 论文报告,在一块 RTX 4090 上处理 3 路相机图像、生成一段动作约需 73 毫秒。推理太慢,机器人会在两段动作之间停顿,所以才有动作分块、异步推理、量化和 TensorRT 加速等手段。推理可以在机器人本体上跑,也可以放在远程服务器上再经网络回传,后者要多算网络延迟。
例子π0 控制 50Hz 的机器人时,每 0.5 秒推理一次、输出一段动作,执行完 25 步后再推理下一段。
- 也叫
- 模型推理、前向推理、推断
- 相关
- 推理(思考)、推理延迟、动作分块、异步推理、推理部署、训练后量化
- 来源
- What is AI inference? (IBM)
π0: A Vision-Language-Action Flow Model for General Robot Control (arXiv:2410.24164) - 信息截至
- 2024-10