Этот курс посвящён DeepSeek: китайской компании, которая за последние пару лет стала одним из главных игроков на рынке больших языковых моделей. После урока вы будете понимать, чем модели DeepSeek отличаются друг от друга, какими способами с ними можно работать и чем они интересны специалисту или предпринимателю на фоне более привычных ChatGPT, Claude или российских аналогов. Урок не требует технической подготовки: он задаёт карту, по которой курс будет двигаться дальше.
Неофициальный курс AI University. Тексты, примеры и задания написаны нашей командой по открытой документации DeepSeek на 03.10.2026; курс не связан с DeepSeek и не одобрен ею. Модели и цены меняются, сверяйтесь с документацией.
Кто такая DeepSeek и почему о ней говорят
DeepSeek, компания из Ханчжоу, вышла на мировой уровень внимания благодаря сочетанию трёх вещей, редко встречающихся вместе. Во-первых, открытые веса: модели можно скачать с Hugging Face и запускать на своих серверах под лицензией MIT, которая почти не ограничивает коммерческое использование. Во-вторых, низкие цены на доступ через API: по сравнению с моделями сопоставимого уровня от OpenAI или Anthropic счёт за те же задачи получается в разы меньше. В-третьих, сами модели по качеству рассуждений, работы с кодом и длинным контекстом стабильно оказываются в числе лучших открытых решений в мире, а иногда приближаются к закрытым лидерам рынка.
Для бизнеса это означает, что мощный ИИ перестаёт быть привилегией компаний с большими бюджетами на подписки. Можно подключить API за несколько минут и платить по факту использования, а можно развернуть модель у себя, если важна полная изоляция данных. Как пользоваться этим открытием в деталях, курс разберёт позже, а пока стоит разобраться, что именно предлагает DeepSeek на 03.10.2026.
Линейка моделей: V4.1-Flash и V4-Pro
Сейчас в API доступны две модели: deepseek-flash и deepseek-v4-pro. Это не вопрос вкуса, а вопрос задачи, и разница между ними заметна как в возможностях, так и в цене.
deepseek-flash (версия DeepSeek-V4.1-Flash, вышла 10 сентября 2026 года) это модель с архитектурой смеси экспертов (Mixture of Experts, MoE) на 552 миллиарда параметров. Устроена она как энциклопедия, разбитая на отдельные «специализации»: при обработке конкретного запроса включается не вся энциклопедия целиком, а только нужные разделы. Поэтому у модели есть понятие «активных параметров»: это те параметры, которые реально работают при обработке одного токена. У V4.1-Flash для входных данных активируется всего 8 миллиардов параметров, а для генерации ответа 16 миллиардов. Благодаря этому модель отвечает быстро и дёшево, при этом удерживая качество рассуждений, близкое к старшей модели. Flash умеет работать с изображениями: это единственная из двух моделей с поддержкой зрения.
deepseek-v4-pro (версия DeepSeek-V4-Pro-0813) это модель с 1,6 триллиона параметров и 49 миллиардами активных на каждый токен, без поддержки изображений. Исторически это была флагманская модель компании, рассчитанная на самые сложные задачи: агентное программирование, математику, глубокие рассуждения. По отдельным тестам более новая и компактная Flash не уступает Pro, а по скорости и стоимости обходит её, поэтому для большинства практических задач в курсе будет достаточно deepseek-flash, а к Pro имеет смысл обращаться, если нужно сравнить результат на более тяжёлой модели.
Обе модели работают с контекстом до 1 миллиона токенов и могут выдавать ответ длиной до 384 тысяч токенов, что на практике означает: можно загрузить в диалог целую книгу или крупную кодовую базу и получить осмысленный ответ. Обе поддерживают режим размышлений, когда модель сначала выстраивает цепочку рассуждений, а затем даёт итоговый ответ. Про это подробно поговорим в уроке 3.
Цены на 03.10.2026 за 1 миллион токенов (в пиковые часы и вне пика, вне пика вдвое дешевле):
| deepseek-flash | deepseek-v4-pro | |
|---|---|---|
| Вход, кэш | $0.006 / $0.003 | $0.044 / $0.022 |
| Вход без кэша | $0.3 / $0.15 | $1.32 / $0.66 |
| Выход | $1.2 / $0.6 | $3.96 / $1.98 |
Pro в несколько раз дороже Flash, причём разница заметнее на входе с кэшем, чем на выходе, так что точный выигрыш зависит от характера задачи. Актуальные цены и правила пиковых часов стоит всегда проверять на сайте, поскольку компания оставляет за собой право их менять.
Три способа пользоваться DeepSeek
DeepSeek можно встретить в трёх принципиально разных форматах, и важно сразу понимать, какой выбрать под свою задачу.
Чат на сайте chat.deepseek.com и в мобильных приложениях это самый простой вход: ничего настраивать не нужно, регистрация занимает пару минут, в интерфейсе доступны режимы «Expert» (на базе V4-Pro) и «Instant» (быстрый режим). Подходит для разовых задач, личной работы с текстом, экспериментов без программирования. Этому способу посвящены уроки 2 и 3.
API на platform.deepseek.com это способ встроить DeepSeek в свои программы, скрипты или сервисы. Оплата идёт по факту использования токенов, баланс пополняется заранее. API совместим с форматом OpenAI (базовый адрес https://api.deepseek.com) и с форматом Anthropic (https://api.deepseek.com/anthropic), а также поддерживает OpenAI Responses API. Это значит, что если в вашем коде уже используется один из этих SDK, для перехода на DeepSeek достаточно поменять пару параметров. Подходит разработчикам, предпринимателям, которые автоматизируют процессы, и всем, кому нужна интеграция в собственные инструменты. Этому посвящена большая часть курса, начиная с урока 4.
Свои серверы с открытыми весами: модели DeepSeek выложены на Hugging Face под лицензией MIT, и их можно скачать и запустить на собственном оборудовании. Это путь для организаций с требованиями к полной изоляции данных или с собственной инфраструктурой, но он требует мощных GPU и совсем не подходит для запуска на ноутбуке или обычном сервере. Подробно об этом говорим в уроке 10.
Коротко: для знакомства и разовых задач достаточно чата, для автоматизации и интеграций нужен API, а для специфических требований к данным остаётся вариант с собственным развёртыванием.
DeepSeek на фоне ChatGPT, Claude, GigaChat и YandexGPT
DeepSeek не единственный игрок на рынке, и честный разговор о нём требует сравнения с альтернативами, без перекоса в любую сторону.
Главное преимущество DeepSeek, которое отмечают почти все, кто пробовал API, это цена. Запросы к deepseek-flash обходятся заметно дешевле, чем сопоставимые по качеству запросы к моделям OpenAI или Anthropic, а при развёртывании открытых весов стоимость владения ограничивается только оборудованием. Вторая сильная сторона это длинный контекст на 1 миллион токенов в сочетании с качественной работой с кодом и рассуждениями: по открытым тестам модели DeepSeek стабильно входят в число лучших открытых решений, а иногда приближаются к закрытым лидерам рынка. Третья сторона, важная для разработчиков, это открытость весов: ни ChatGPT, ни Claude, ни российские GigaChat и YandexGPT не дают возможности скачать модель и развернуть её у себя под лицензией, настолько разрешающей коммерческое использование, как MIT.
Слабые стороны тоже стоит назвать прямо. DeepSeek, китайская компания, обрабатывает запросы на серверах, физически расположенных в Китае, а значит данные пользователей уходят туда же. Для части организаций, особенно работающих с персональными данными или коммерческой тайной, это существенное ограничение. Кроме того, в России нет официальных корпоративных договоров с DeepSeek и локальной поддержки: всё взаимодействие идёт напрямую с зарубежным сервисом на общих условиях для частных лиц и бизнеса. На определённые политические темы модель может давать уклончивые или ограниченные ответы: это особенность любых моделей с цензурой на чувствительные темы, и DeepSeek не исключение. Наконец, как и у большинства быстро развивающихся продуктов, у DeepSeek случаются перебои и нестабильность ответов в периоды высокой нагрузки, хотя для этого и предусмотрены пиковые и внепиковые тарифы.
Российские GigaChat и YandexGPT выигрывают там, где критична локализация: данные остаются на серверах в России, есть официальная поддержка и договоры для юрлиц, лучше адаптация под русский язык в узких доменах. Но по открытости весов, гибкости цен при больших объёмах и по позициям в открытых рейтингах по коду и рассуждениям они пока уступают DeepSeek. Выбор между этими вариантами не универсален: он зависит от требований к данным, бюджета и задачи, и часто разумно использовать разные модели для разных частей одного проекта.
Доступность из России
На 03.10.2026 чат на chat.deepseek.com и мобильные приложения работают из России без VPN: это один из факторов, почему DeepSeek быстро набрала популярность у русскоязычной аудитории. Для работы с API потребуется способ оплаты, принимаемый платформой platform.deepseek.com, и конкретные варианты оплаты стоит проверять непосредственно на сайте в момент регистрации, поскольку условия для международных пользователей могут меняться. Не стоит заранее рассчитывать на привычные российские карты: платформа работает по международным правилам оплаты, и актуальный список способов лучше уточнить на месте.
Что будет в курсе
Курс состоит из 12 уроков, которые постепенно ведут от знакомства к практике. Начинается он с этого обзорного урока и знакомства с чатом: урок 2 разберёт режимы, работу с файлами и поиск в интерфейсе, а урок 3 объяснит режим размышлений и то, когда он действительно нужен. С урока 4 курс переходит к API: первый запрос, ключ и стоимость, затем диалог, потоковая выдача ответа и кэширование контекста в уроке 5, структурированные JSON-ответы в уроке 6, вызовы инструментов и основы агентов в уроке 7, работа с изображениями и файлами через Vision и Files API в уроке 8. Урок 9 покажет, как подключить DeepSeek в Claude Code и похожие инструменты разработчика. Урок 10 посвящён открытым весам и развёртыванию на своих серверах, урок 11 собирает всё в практикум на примере ассистента для обработки заявок, а урок 12 закрывает курс разговором о данных, безопасности и правовых вопросах использования DeepSeek.
Попробуйте сами
Зарегистрируйтесь в чате на chat.deepseek.com (через сайт или мобильное приложение). Критерий результата: вы вошли в аккаунт и видите переключатель между режимами «Expert» и «Instant».
Сформулируйте одну рабочую задачу, актуальную для вас: например, составить план письма клиенту, объяснить сложный термин из вашей отрасли простыми словами или написать небольшой фрагмент кода. Задайте её сначала в режиме «Instant», затем в режиме «Expert». Критерий результата: у вас есть два ответа на один и тот же запрос, и вы можете сформулировать словами, в чём разница между ними по глубине, скорости и полезности.
Найдите на platform.deepseek.com раздел с ценами и актуальными способами оплаты для вашей страны. Критерий результата: вы знаете, какая модель дешевле для вашей задачи и что нужно для старта работы с API, даже если сам ключ вы ещё не создавали.
Итоги
- DeepSeek, компания из Ханчжоу, известна открытыми весами моделей, низкими ценами на API и высоким качеством рассуждений и работы с кодом.
- На 03.10.2026 в API доступны две модели: deepseek-flash (DeepSeek-V4.1-Flash, экономичная и быстрая, с поддержкой изображений) и deepseek-v4-pro (DeepSeek-V4-Pro, более тяжёлая модель без поддержки изображений, заметно дороже Flash).
- Архитектура MoE означает, что из огромного числа параметров модели на каждый запрос реально работает лишь небольшая часть, что снижает стоимость и ускоряет ответ без заметной потери качества.
- Пользоваться DeepSeek можно тремя способами: через чат для простых задач, через API для интеграций и автоматизации, через открытые веса на своих серверах для полного контроля над данными.
- Сильные стороны DeepSeek на фоне ChatGPT, Claude, GigaChat и YandexGPT это цена, длинный контекст и открытость весов, слабые стороны это хранение данных на серверах в Китае, отсутствие корпоративных договоров в России и ограничения на некоторые темы.
- Чат доступен из России без VPN, а для работы с API нужен способ оплаты, актуальные варианты которого стоит проверять непосредственно на сайте платформы.