Вернуться к статье
Двухмодельная ансамблевая архитектура автоматического обнаружения утопающих с алгоритмами межкадрового трекинга и адаптивной калибровки порогов решающего правила
Производительность пайплайна в различных режимах вычислений (GPU NVIDIA RTX 4080)
Режим | Время на кадр, мс | Снижение точности, п.п. | Применимость |
PyTorch FP32 (baseline) | 16,8 | 0,0 | Разработка, отладка |
PyTorch FP16 (AMP) | 9,1 | 0,2 | Стандартная продуктивная среда |
TensorRT FP32 | 11,3 | 0,0 | Высокоточные применения |
TensorRT FP16 | 5,4 | 0,3 | Оптимально для RTX-серии |
TensorRT INT8 | 3,1 | 1,8 | Максимальная производительность |
ONNX Runtime CPU | 412,7 | 0,0 | Резервный режим без GPU |
