VLM Çıkarım Benchmark Gezgini

Qwen3-VL-4B-Instruct, Jetson Orin NX 16GB üzerinde — Q8_0, llama.cpp görüntü-dil çıkarım benchmark'ı

Bu yapılandırmayı VLM Çıkarım Benchmark Gezgini'nde açın

ModelQwen3-VL-4B-Instruct
Parametre4.4B
CihazJetson Orin NX 16GB
KuantizasyonQ8_0
Görüntü boyutu720p
Kamera başına görüntü1
Maks. kamera (yanıt ≤ 3 sn)0
Inference Enginellama.cpp
KameraYanıt (sn)TPS (tok/s)Durum
13.0414.3FAIL
24.4514.1FAIL
49.259.4FAIL
818.07.2FAIL

Qwen3-VL-4B-Instruct (4,4B parametre), Q8_0 biçiminde llama.cpp ile Jetson Orin NX 16GB üzerinde sunuldu; bir 720p görüntü gönderen tek bir kameraya 3,04 sn sonra yanıt vermeye başlar, ardından 14,3 tok/s hızla yazar.

Kamera başına 720p boyutunda 5 görüntüyle yanıt 14,62 sn sonra başlar. Tek bir 2K görüntüyle 18,39 sn sonra.

Yanıtın 3 sn içinde başlaması varsayılan hedefinde (720p, kamera başına bir görüntü) tek bir kamera bile zamanında yanıt almaz.