Сравнение времени генерации Qwen 3.8 и 3.5 на RTX 3090 (Тест 3, профиль Heavy 16K, режим NoThink)
Диаграмма показывает время выполнения трёх типов задач — короткой новости, длинного лонгрида и описания фото — для трёх конфигураций Qwen в режиме NoThink. На RTX 3090 24GB модель Qwen 3.8 27B оказывается самой медленной, а компактная 9B-версия заметно быстрее, что важно для построения конвейера массовой генерации статей.