Vergleich der Generierungszeit von Qwen 3.8 und 3.5 auf der RTX 3090 (Test 3, Profil Heavy 16K, NoThink-Modus)

Balkendiagramm-Benchmark der Textgenerierungszeit für Qwen 3.8 9B, Qwen 3.5 27B und Qwen 3.8 27B im NoThink-Modus auf einer RTX 3090 mit 24GB VRAM für eine kurze Nachricht, einen Longread und eine Vision-Aufgabe

Das Diagramm vergleicht die Ausführungszeit für drei Aufgabenarten – eine kurze Nachricht, einen Longread und eine Fotobeschreibung – für drei Qwen-Konfigurationen im NoThink-Modus. Auf der RTX 3090 24GB ist das Qwen 3.8 27B-Modell am langsamsten, während die kompakte 9B-Variante deutlich schneller ist, ein entscheidender Faktor für den Aufbau einer Artikel-Generierungspipeline.

← Zurück zum Artikel