Инструкция

Как скачать Qwen3.8 и запустить локально на компьютере

Глубокий гид по локальному Qwen3.8: официальные веса, GGUF, квантование, память, Transformers, llama.cpp, локальные интерфейсы и Apple Silicon.

Главное: Qwen3.8 можно запускать локально, но скачивать нужно конкретную открытую модель, а не абстрактный «Qwen 3.8 для Windows». В официальной серии опубликованы открытые веса, включая Qwen3.8-27B. Дальше выбор зависит от оборудования и программы запуска: Transformers, llama.cpp/GGUF, совместимый локальный интерфейс или серверный рантайм.

Что именно скачивать

Официальный репозиторий Qwen3.8 перечисляет открытые модели и способы локального запуска: https://github.com/QwenLM/Qwen3.8 Для большинства домашних компьютеров первым кандидатом будет Qwen3.8-27B, а не крупнейший MoE-вариант. Исходные веса и производные форматы отличаются размером, требованиями и назначением.

Если нужен официальный мобильный Qwen Studio, также скачать Qwen через vSofte можно на странице приложения. vSofte — независимый навигационный каталог: он не хранит установочные файлы Qwen, не размещает APK или другие установщики у себя и не запрашивает пароли, коды подтверждения или платёжные данные.

Qwen3.8-27B и Qwen3.8-Max — не одно и то же

Название Max может относиться к облачной модели/сервису, тогда как локально скачивают те веса, которые опубликованы как open-weight модель. Не следует считать любое имя с «Max» отдельным файлом для домашнего ПК. Перед установкой всегда сверяйте модель с официальным репозиторием и карточкой весов.

Где брать официальные веса

Qwen указывает Hugging Face и ModelScope как основные источники открытых весов. Карточка Qwen3.8-27B на Hugging Face: https://huggingface.co/Qwen/Qwen3.8-27B Если Hugging Face недоступен или неудобен, официальный README рекомендует ModelScope как альтернативный источник.

Почему не стоит искать случайный архив

У локальной модели важно происхождение: вместе с весами нужны корректные конфигурационные файлы, токенизатор и информация о лицензии. Случайный архив может быть неполным или переупакованным. Для GGUF также проверяйте автора сборки, основу модели и уровень квантования.

Выбор формата: исходные веса или GGUF

Исходные веса удобны для Transformers и серверных фреймворков. GGUF предназначен для экосистемы llama.cpp и часто используется в локальных настольных приложениях. Квантование уменьшает требования к памяти и размер файлов, но не превращает крупную модель в «лёгкую программу» — ресурсы всё равно нужно оценивать заранее.

Что означает Q4, Q5, Q8

Это разные уровни квантования. Чем сильнее сжатие, тем меньше память и диск, но тем выше риск потери части качества. Для первого запуска разумно выбирать распространённый вариант, рекомендованный вашим рантаймом, а не самый маленький файл любой ценой.

Способ 1: Transformers

Официальный README показывает запуск Qwen3.8 через современный Transformers и даже серверный режим с OpenAI-совместимым API. Этот путь подходит разработчикам, которым нужен Python, контроль параметров, интеграция в собственный код или дальнейшая настройка.

Когда Transformers не лучший первый выбор

Если вам нужен только локальный чат, а не программная интеграция, полноценная Python-среда может оказаться избыточной. В таком случае проще использовать готовый интерфейс, который сам управляет GGUF или другим поддерживаемым форматом.

Способ 2: llama.cpp и GGUF

Официальный репозиторий Qwen отмечает поддержку семейства в llama.cpp и рекомендует искать совместимые GGUF-модели. Этот вариант удобен для CPU/GPU-гибридного запуска и большого числа локальных интерфейсов. Конкретные команды зависят от сборки llama.cpp и файла модели.

Как проверить, что GGUF относится к нужной модели

Сверьте базовую модель, размер, контекст, квантование и дату публикации. Не ориентируйтесь только на имя файла. Если файл создан сообществом, страница должна явно указывать, что он получен из официальной Qwen3.8-27B и каким способом.

Способ 3: локальный интерфейс

Программы наподобие LM Studio могут упрощать загрузку и запуск совместимых моделей. Здесь важно помнить: LM Studio — не Qwen Studio. Первая программа запускает локальные веса, а Qwen Studio — официальный облачный ассистент. Эта разница подробно разобрана в статье про Qwen Studio.

Как выбирать модель по памяти

Сначала посмотрите размер файла и требования вашего рантайма. Для GPU учитывайте видеопамять, для CPU — оперативную память и скорость. Если модель не помещается целиком, некоторые рантаймы позволяют распределить нагрузку между GPU и RAM, но скорость может значительно снизиться.

Apple Silicon и MLX

В официальной документации семейства Qwen упоминается MLX как один из вариантов для Apple Silicon. Для Mac важно выбирать сборку, предназначенную для MLX или совместимого рантайма, а не пытаться использовать Windows-инструкцию. Объём унифицированной памяти остаётся главным ограничением при выборе размера модели.

Ollama и готовые каталоги

Если используете Ollama, проверяйте, существует ли именно нужная модель и соответствует ли она официальной базе. Каталог Ollama может содержать разные сборки и теги. Название команды не должно подменять проверку версии, размера и происхождения.

Почему версии Qwen2.5, Qwen3, Qwen3.5 и Qwen3.8 нельзя смешивать

Это разные поколения и ветки моделей. Инструкция, написанная для Qwen2.5, может использовать другие имена моделей, требования или шаблоны работы. Для нового локального развёртывания начинайте с документации именно той модели, которую скачали.

Какой путь выбрать новичку

  1. Если нужен только чат — сначала попробуйте Qwen Studio.
  2. Если нужна локальная работа — оцените RAM/VRAM и свободный диск.
  3. Выберите Qwen3.8-27B или другой официально опубликованный размер.
  4. Для простого интерфейса используйте совместимый локальный рантайм и подходящий квантованный формат.
  5. Для разработки и API используйте Transformers, vLLM, SGLang или другой поддерживаемый серверный инструмент.

Общая развилка между веб-чатом, локальной моделью и Qwen Code есть в статье «Qwen на компьютере».

Типичные ошибки

Модель не загружается в память

Выберите более компактное квантование или меньшую модель. Закройте приложения, которые занимают RAM/VRAM, и уменьшите контекст, если это поддерживает рантайм.

Ответы идут очень медленно

Скорость зависит от оборудования, квантования, длины контекста и степени переноса вычислений на GPU. Большая модель на CPU может работать значительно медленнее облачного сервиса.

Модель запускается, но не понимает изображения

Проверьте возможности именно выбранной модели и поддержку мультимодального режима вашим рантаймом. Наличие Qwen в названии само по себе не гарантирует одинаковый набор модальностей.

Безопасное обновление

Не удаляйте рабочую модель до проверки новой. Скачайте новую версию в отдельную папку, проверьте запуск и только после этого освобождайте место. Если используется приложение-каталог, сохраните сведения о выбранном файле и квантовании — это упростит возврат.

Проверка после первого запуска

После старта задайте модели несколько коротких задач: простой диалог, небольшую логическую проверку и, если модель мультимодальная, тест с изображением. Затем постепенно увеличивайте контекст. Такой порядок позволяет понять, где проблема: в базовом запуске, в памяти, в мультимодальном процессоре или в слишком длинном контексте.

Как сравнивать квантования

Используйте одинаковые короткие тесты и одинаковые настройки. Сравните скорость, пиковое потребление памяти и качество ответа. Если более тяжёлое квантование почти не улучшает нужные вам задачи, компактный вариант может быть практичнее.

Контрольный список перед завершением

Проверьте, что используете официальный адрес или репозиторий, понимаете разницу между облачным сервисом и локальной моделью и выбрали способ под свою задачу. Зафиксируйте рабочие настройки перед обновлением и не удаляйте рабочую конфигурацию, пока новая не проверена.

Если результат отличается от ожидаемого

Вернитесь к предыдущему шагу и уточните конкретный компонент: браузер, приложение, веса, рантайм, модель или авторизацию. Такое разделение быстрее выявляет причину, чем одновременная переустановка нескольких инструментов.

Контрольный список перед завершением

Проверьте, что используете официальный адрес или репозиторий, понимаете разницу между облачным сервисом и локальной моделью и выбрали способ под свою задачу. Зафиксируйте рабочие настройки перед обновлением и не удаляйте рабочую конфигурацию, пока новая не проверена.

Если результат отличается от ожидаемого

Вернитесь к предыдущему шагу и уточните конкретный компонент: браузер, приложение, веса, рантайм, модель или авторизацию. Такое разделение быстрее выявляет причину, чем одновременная переустановка нескольких инструментов.

Контрольный список перед завершением

Проверьте, что используете официальный адрес или репозиторий, понимаете разницу между облачным сервисом и локальной моделью и выбрали способ под свою задачу. Зафиксируйте рабочие настройки перед обновлением и не удаляйте рабочую конфигурацию, пока новая не проверена.

Если результат отличается от ожидаемого

Вернитесь к предыдущему шагу и уточните конкретный компонент: браузер, приложение, веса, рантайм, модель или авторизацию. Такое разделение быстрее выявляет причину, чем одновременная переустановка нескольких инструментов.

Контрольный список перед завершением

Проверьте, что используете официальный адрес или репозиторий, понимаете разницу между облачным сервисом и локальной моделью и выбрали способ под свою задачу. Зафиксируйте рабочие настройки перед обновлением и не удаляйте рабочую конфигурацию, пока новая не проверена.

Если результат отличается от ожидаемого

Вернитесь к предыдущему шагу и уточните конкретный компонент: браузер, приложение, веса, рантайм, модель или авторизацию. Такое разделение быстрее выявляет причину, чем одновременная переустановка нескольких инструментов.

Контрольный список перед завершением

Проверьте, что используете официальный адрес или репозиторий, понимаете разницу между облачным сервисом и локальной моделью и выбрали способ под свою задачу. Зафиксируйте рабочие настройки перед обновлением и не удаляйте рабочую конфигурацию, пока новая не проверена.

Если результат отличается от ожидаемого

Вернитесь к предыдущему шагу и уточните конкретный компонент: браузер, приложение, веса, рантайм, модель или авторизацию. Такое разделение быстрее выявляет причину, чем одновременная переустановка нескольких инструментов.

Контрольный список перед завершением

Проверьте, что используете официальный адрес или репозиторий, понимаете разницу между облачным сервисом и локальной моделью и выбрали способ под свою задачу. Зафиксируйте рабочие настройки перед обновлением и не удаляйте рабочую конфигурацию, пока новая не проверена.

Если результат отличается от ожидаемого

Вернитесь к предыдущему шагу и уточните конкретный компонент: браузер, приложение, веса, рантайм, модель или авторизацию. Такое разделение быстрее выявляет причину, чем одновременная переустановка нескольких инструментов.

Частые вопросы

Можно ли скачать Qwen3.8 бесплатно?

Открытые веса публикуются на официальных площадках. Условия использования определяются лицензией конкретной модели, поэтому перед коммерческим применением прочитайте её карточку.

Есть ли один установщик Qwen3.8.exe?

Нет универсального установщика для всех локальных сценариев. Обычно скачиваются веса модели и выбирается отдельный рантайм.

Что лучше: Qwen Studio или локальный Qwen3.8?

Qwen Studio проще и не требует мощного компьютера. Локальный вариант даёт больше контроля, но требует диска, памяти и настройки.

Нужно ли скачивать Qwen3.8 для Qwen Code?

Не обязательно. Qwen Code может работать через настроенного провайдера модели; локальный запуск — отдельный вариант конфигурации.

Статья была полезна?
Оценка поможет нам делать материалы точнее и полезнее.
Qwen Studio
Приложение
Qwen Studio
Скачать Qwen Studio

Что ещё может пригодиться