VLM Çıkarım Benchmark Gezgini

Qwen3-VL-4B-Instruct, Jetson AGX Orin 32GB üzerinde — Q8_0, llama.cpp görüntü-dil çıkarım benchmark'ı

Bu yapılandırmayı VLM Çıkarım Benchmark Gezgini'nde açın

ModelQwen3-VL-4B-Instruct
Parametre4.4B
CihazJetson AGX Orin 32GB
KuantizasyonQ8_0
Görüntü boyutu720p
Kamera başına görüntü1
Maks. kamera (yanıt ≤ 3 sn)2
Inference Enginellama.cpp
KameraYanıt (sn)TPS (tok/s)Durum
11.3128.4PASS
21.9619.7PASS
43.9810.2FAIL
86.6114.3FAIL

Qwen3-VL-4B-Instruct (4,4B parametre), Q8_0 biçiminde llama.cpp ile Jetson AGX Orin 32GB üzerinde sunuldu; bir 720p görüntü gönderen tek bir kameraya 1,31 sn sonra yanıt vermeye başlar, ardından 28,4 tok/s hızla yazar.

Kamera başına 720p boyutunda 5 görüntüyle yanıt 6,4 sn sonra başlar. Tek bir 2K görüntüyle 8,32 sn sonra.

Yanıtın 3 sn içinde başlaması varsayılan hedefinde (720p, kamera başına bir görüntü) aynı anda 2 kameraya yetişir.