VLM Inference Benchmark Explorer

Qwen3-VL-4B-Instruct op Jetson Orin NX 16GB — FP8, vLLM vision-language-inferentiebenchmark

Deze configuratie openen in de VLM Inference Benchmark Explorer

ModelQwen3-VL-4B-Instruct
Parameters4.4B
ApparaatJetson Orin NX 16GB
KwantisatieFP8
Beeldformaat720p
Beelden per camera1
Max. camera's (respons ≤ 3 s)2
EnginevLLM
Camera'sRespons (s)TPS (tok/s)Status
11.6714.2PASS
22.5913.1PASS
44.7413.1FAIL

Qwen3-VL-4B-Instruct (4.4B parameters), geserveerd in FP8-formaat met vLLM op Jetson Orin NX 16GB, begint één camera die één 720p-beeld stuurt na 1.67 s te antwoorden en schrijft daarna 14.2 tok/s.

Met 3 beelden per camera op 720p begint het antwoord na 4 s. Met één beeld op 1080p na 4.34 s.

Bij het standaarddoel van een antwoord dat binnen 3 s begint (720p, één beeld per camera) houdt het 2 camera's tegelijk bij.