VLM Çıkarım Benchmark Gezgini

Qwen3-VL-30B-A3B-Instruct, RTX PRO 6000 üzerinde — FP8, vLLM görüntü-dil çıkarım benchmark'ı

Bu yapılandırmayı VLM Çıkarım Benchmark Gezgini'nde açın

ModelQwen3-VL-30B-A3B-Instruct
Parametre30B
CihazRTX PRO 6000
KuantizasyonFP8
Görüntü boyutu720p
Kamera başına görüntü1
Maks. kamera (yanıt ≤ 3 sn)16+
Inference EnginevLLM
KameraYanıt (sn)TPS (tok/s)Durum
10.16194.4PASS
20.26153.3PASS
40.32127.4PASS
80.42100.6PASS
160.5582.3PASS

Qwen3-VL-30B-A3B-Instruct (30B parametre), FP8 biçiminde vLLM ile RTX PRO 6000 üzerinde sunuldu; bir 720p görüntü gönderen tek bir kameraya 0,16 sn sonra yanıt vermeye başlar, ardından 194,4 tok/s hızla yazar.

Kamera başına 720p boyutunda 5 görüntüyle yanıt 1,04 sn sonra başlar. Tek bir 2K görüntüyle 0,58 sn sonra.

Yanıtın 3 sn içinde başlaması varsayılan hedefinde (720p, kamera başına bir görüntü) aynı anda en az 16 kameraya yetişir: ölçülen en yüksek kamera sayısında bile hedefi karşıladı, gerçek sınır daha yüksektir.