Qwen3.8-27B — редкая локальная модель, чьи компромиссы совпадают с реально доступным железом: один плотный чекпойнт на 27B для текста, изображений, видео, кода и агентов с инструментами. 4-битная версия помещается на GPU класса 24 ГБ, а Apache 2.0 позволяет хранить работу локально и применять модель коммерчески.
Qwen заявляет 61,7 в SWE-bench Pro, 73,0 в Terminal Bench 2.1, 42,2 в DeepSWE 1.1, 84,3 в OSWorld-Verified и 70,7 в CoWorkBench. Нативный контекст — 262 144 токена, есть YaRN до 1M, уровни усилия рассуждения, сохранение мышления между ходами, нативное понимание изображений и видео.
Это данные первого дня, а не устоявшийся факт. Большинство громких чисел взято из таблицы Qwen; часть получена с Claude Code, исправленными задачами, специальными промптами или внутренними наборами. Типичный Q4_K_M вместе с визуальным проектором занимает около 18 ГБ, однако служебная память и KV-кэш всё равно ограничивают контекст на карте 24 ГБ.