VLM Çıkarım Benchmark Gezgini

Qwen3-VL-8B-Instruct, RTX PRO 6000 üzerinde — Q8_0, llama.cpp görüntü-dil çıkarım benchmark'ı

Bu yapılandırmayı VLM Çıkarım Benchmark Gezgini'nde açın

ModelQwen3-VL-8B-Instruct
Parametre8.8B
CihazRTX PRO 6000
KuantizasyonQ8_0
Görüntü boyutu720p
Kamera başına görüntü1
Maks. kamera (yanıt ≤ 3 sn)16+
Inference Enginellama.cpp
KameraYanıt (sn)TPS (tok/s)Durum
10.33153.8PASS
20.39101.8PASS
40.6162.0PASS
81.2975.2PASS
162.0356.3PASS

Qwen3-VL-8B-Instruct (8,8B parametre), Q8_0 biçiminde llama.cpp ile RTX PRO 6000 üzerinde sunuldu; bir 720p görüntü gönderen tek bir kameraya 0,33 sn sonra yanıt vermeye başlar, ardından 153,8 tok/s hızla yazar.

Kamera başına 720p boyutunda 5 görüntüyle yanıt 1,04 sn sonra başlar. Tek bir 2K görüntüyle 1,79 sn sonra.

Yanıtın 3 sn içinde başlaması varsayılan hedefinde (720p, kamera başına bir görüntü) aynı anda en az 16 kameraya yetişir: ölçülen en yüksek kamera sayısında bile hedefi karşıladı, gerçek sınır daha yüksektir.