Вернуться к статье

Двухмодельная ансамблевая архитектура автоматического обнаружения утопающих с алгоритмами межкадрового трекинга и адаптивной калибровки порогов решающего правила

Производительность пайплайна в различных режимах вычислений (GPU NVIDIA RTX 4080)

Режим

Время на кадр, мс

Снижение точности, п.п.

Применимость

PyTorch FP32 (baseline)

16,8

0,0

Разработка, отладка

PyTorch FP16 (AMP)

9,1

0,2

Стандартная продуктивная среда

TensorRT FP32

11,3

0,0

Высокоточные применения

TensorRT FP16

5,4

0,3

Оптимально для RTX-серии

TensorRT INT8

3,1

1,8

Максимальная производительность

ONNX Runtime CPU

412,7

0,0

Резервный режим без GPU