TL;DR — кратко
- Qwen 3.8 27B — открытая плотная модель Alibaba на 27 млрд параметров, лицензия Apache 2.0
- Понимает текст, изображения и видео; родное окно — 262 тысячи токенов, до 1 млн с расширением
- Сильна в коде: SWE-bench Pro — 61,7, LiveCodeBench v6 — 90,3 (данные карточки модели)
- Для локального запуска нужна видеокарта с большим объёмом памяти или сжатая версия
Qwen 3.8 27B — самая «народная» модель новой линейки Alibaba: достаточно умная для серьёзной работы и достаточно компактная, чтобы запустить её у себя. Отсюда и спрос: «qwen 3.8 27b» ищут почти 10 тысяч раз в месяц, а рядом — «gguf», «скачать», «локально». Разбираемся по порядку.
Что такое Qwen 3.8 27B
Это открытая языковая модель: Alibaba выложила её веса на Hugging Face, и любой может скачать их бесплатно. Главное о модели:
- 27 млрд параметров, плотная архитектура — все параметры работают на каждом токене (в отличие от моделей «смесь экспертов»);
- визуальный энкодер — понимает изображения и видео, не только текст;
- окно контекста — 262 144 токена нативно, до 1 млн с расширением;
- рассуждение включено по умолчанию, его можно отключить или настроить глубину;
- лицензия Apache 2.0 — разрешено коммерческое использование.
Что умеет модель: результаты тестов
По карточке модели на Hugging Face:
| Тест | Что проверяет | Результат |
|---|---|---|
| SWE-bench Pro | исправление реальных ошибок в коде | 61,7 |
| LiveCodeBench v6 | задачи по программированию | 90,3 |
| Terminal Bench 2.1 | работа в терминале | 73,0 |
| GPQA Diamond | научные вопросы уровня аспирантуры | 89,2 |
| OSWorld-Verified | работа с компьютером | 84,3 |
| MathVision | математика по картинкам | 94,6 |
Это заявления разработчика, но для модели на 27 млрд параметров такие цифры — уровень флагманов прошлого поколения.
Как скачать Qwen 3.8 27B
Официальные веса лежат на Hugging Face в репозитории Qwen/Qwen3.8-27B. Для запуска на обычном компьютере сообщество выкладывает сжатые (квантованные) версии в формате GGUF — например, q4. Они весят в несколько раз меньше и работают в программах вроде llama.cpp, LM Studio и Ollama.
Осторожно с «uncensored» и «abliterated»-версиями: это неофициальные переделки, в которых сняты защитные ограничения. Качество у них часто ниже, а происхождение не проверить.
Какое железо нужно для локального запуска
Точные требования зависят от степени сжатия, поэтому ориентируйтесь на принцип:
- Полная точность — нужна профессиональная видеокарта или несколько карт: модель на 27 млрд параметров в 16-битном формате занимает больше 50 ГБ памяти.
- Сжатие до 4 бит (q4) — модель помещается примерно в 16–20 ГБ, это уровень одной мощной игровой видеокарты или Mac с большим объёмом памяти.
- На слабом ноутбуке запуск возможен, но ответ будет идти очень медленно.
Если такого железа нет, локальный запуск теряет смысл — проще пользоваться моделью онлайн.
Как пользоваться Qwen 3.8 27B онлайн
Без установки и видеокарты модель доступна в LeanTech:
- Зарегистрируйтесь в LeanTech — по почте, без VPN.
- Подключите тариф Light и оплатите российской картой.
- Выберите Qwen 3.8 27B в списке моделей — можно сразу прикладывать скриншоты и изображения.
Для сравнения в том же окне есть старший Qwen 3.8 Max и бесплатные Qwen 3.8 Flash и Omni Flash.
Qwen 3.8 27B или Qwen 3.8 Max
- 27B — открытая, её можно запустить у себя, данные не уходят в облако. Дешевле в облаке Alibaba: $0,50 за миллион входных токенов против $2 у Max.
- Max — сильнее на самых сложных задачах и держит 1 млн токенов по умолчанию, но работает только через облако.
Для кода и анализа средних проектов 27B часто хватает. Для больших проектов и длинных документов лучше Max.
