如何用低比特量化让 NeRF 推理速度大幅提升? NeRF 推理为什么这么慢?每条射线要经过几十到上百个采样点,每个点都要执行一次 MLP 前向,粗网络与细网络叠加后,单张图像的浮点计算量非常高。低比特量化把 FP32 权重和激活压缩到 INT8 或 INT4,从访存带宽和计算密度两个层面降低延迟,是部署阶段很实用的加速手段。但 NeRF 不... 栏目:3D模型 时间:09-28 NeRF量化 低比特推理 量化感知训练