VLM Çıkarım Benchmark Gezgini

Llama-3.1-Nemotron-Nano-VL-8B, RTX PRO 6000 üzerinde — BF16, vLLM görüntü-dil çıkarım benchmark'ı

Bu yapılandırmayı VLM Çıkarım Benchmark Gezgini'nde açın

ModelLlama-3.1-Nemotron-Nano-VL-8B
Parametre8.7B
CihazRTX PRO 6000
KuantizasyonBF16
Görüntü boyutu720p
Kamera başına görüntü1
Maks. kamera (yanıt ≤ 3 sn)16+
Inference EnginevLLM
KameraYanıt (sn)TPS (tok/s)Durum
10.2994.9PASS
20.3284.6PASS
40.4373.2PASS
80.7459.4PASS
161.2746.5PASS

Llama-3.1-Nemotron-Nano-VL-8B (8,7B parametre), BF16 biçiminde vLLM ile RTX PRO 6000 üzerinde sunuldu; bir 720p görüntü gönderen tek bir kameraya 0,29 sn sonra yanıt vermeye başlar, ardından 94,9 tok/s hızla yazar.

Kamera başına 720p boyutunda 5 görüntüyle yanıt 1,79 sn sonra başlar. Tek bir 2K görüntüyle 0,49 sn sonra.

Yanıtın 3 sn içinde başlaması varsayılan hedefinde (720p, kamera başına bir görüntü) aynı anda en az 16 kameraya yetişir: ölçülen en yüksek kamera sayısında bile hedefi karşıladı, gerçek sınır daha yüksektir.