Inference Benchmarks
Measured throughput for RF-DETR, YOLOv8, ResNet, and ViT models on NVIDIA L4 and Jetson Orin NX, comparing ONNX and TensorRT.
NVIDIA L4 GPU
Object detection
Model Type
Size
Inference/sec (ONNX)
Inference/sec (TRT)
Improvement Multiplier
Segmentation
Model Type
Size
Inference/sec (ONNX)
Inference/sec (TRT)
Improvement Multiplier
Classification
Model Type
Size
Inference/sec (ONNX)
Inference/sec (TRT)
Improvement Multiplier
Jetson Orin NX
Object detection
Model Type
Size
Inference/sec (ONNX)
Inference/sec (TRT)
Improvement Multiplier
Benchmark methodology
Last updated
Was this helpful?