О чём урок
Последний урок курса посвящён двум практическим вопросам, которые рано или поздно встают перед любой компанией, использующей Qwen: можно ли обойтись без облака и что происходит с данными, которые вы туда всё-таки отправляете. Вы разберётесь, какую модель реально запустить на своём железе, чем Ollama отличается от llama.cpp и vLLM, какие лицензии позволяют коммерческое использование, а какие нет, и что говорит 152-ФЗ о передаче персональных данных в зарубежный сервис. В конце урока и курса в целом вас ждёт чек-лист внедрения Qwen в компании.
Неофициальный курс AI University. Тексты, примеры и задания написаны нашей командой по открытой документации Qwen, QwenCloud и Alibaba Cloud Model Studio и опыту разработчиков на 04.10.2026; курс не связан с компанией Alibaba Cloud и не одобрен ею. Модели и цены меняются, сверяйтесь с документацией.
Линейка открытых весов на 04.10.2026 устроена так, что в блоке «text» есть модели почти на любой бюджет: от 0.8B до 397B параметров (Qwen3.5), плюс более новые плотные и MoE-варианты Qwen3.6 и Qwen3.8. Для практических задач компании обычно интересны три точки:
- 9B (Qwen3.5-9B): в 4-битном кванте занимает около 6,6 ГБ. Подходит для ноутбука с 16 ГБ оперативной памяти, Mac с 16 ГБ единой памяти или видеокарты с 8 ГБ. Качество базовое, но для простых задач, суммаризации и черновых ответов достаточно.
- 27B (Qwen3.8-27B, Qwen3.6-27B): по данным Unsloth, 4-битный квант требует 16-19 ГБ суммарной памяти (RAM плюс VRAM или единая память на Mac), 8-битный уже около 30-31 ГБ. Это основная рабочая модель для локального запуска: по отзывам пользователей на Hacker News и Habr, она воспринимается как лучшая локальная модель, которую непросто запустить без хорошей видеокарты.
- 35B-A3B (Qwen3.6-35B-A3B): MoE-архитектура с активными около 3B параметров, квант Q4 занимает примерно 22-24 ГБ. Особенность MoE в том, что веса «экспертов» можно выгрузить на процессор, оставив на видеокарте остальные…
План урока
- Какой размер модели выбрать под своё железо
- Как запустить: Ollama, llama.cpp, vLLM
- Параметры генерации и выключение размышлений
- Квантование: где проходит граница
- Лицензии для коммерческого запуска
- Цензура, смещения и Qwen3Guard
- Данные в облаке: Сингапур, обучение и 152-ФЗ
- Чек-лист внедрения Qwen в компании
Урок входит в полный доступ. Полный текст и видео открываются после оплаты. Первые уроки каждого курса бесплатны.