Как получить доступ к API

Урок 3 из 100 курса «Claude в Google Vertex AI»: официальный курс Anthropic Academy (Антропик) на русском языке. Этот урок бесплатный.

Accessing the API

Что вы узнаете

  • Приложения Anthropic - Claude Code и использование компьютера
  • Настройка Claude Code
  • Claude Code в действии
  • Улучшения с серверами MCP
  • Параллелизация Claude Code
  • Автоматическая отладка
  • Как работает использование компьютера
  • Агенты и рабочие процессы
  • Рабочие процессы параллелизации
  • Цепочки рабочих процессов
  • Маршрутизация рабочих процессов
  • Агенты и инструменты
  • Инспекция среды
  • Рабочие процессы против агентов

Тест по агентам и рабочим процессам

Итоговая оценка

Тест итоговой оценки

Это видео все еще обрабатывается. Пожалуйста, зайдите позже и обновите страницу.

Ой! Что-то пошло не так, пожалуйста, попробуйте еще раз.

При создании приложений с Claude понимание полного жизненного цикла запроса помогает лучше проектировать системы и эффективнее отлаживать проблемы. Давайте рассмотрим, что происходит, когда пользователь отправляет сообщение в ваше чат-приложение на базе ИИ.

Полный поток запроса

Путь от пользовательского ввода до ответа ИИ включает пять отдельных шагов: Запрос к серверу, Запрос к Vertex, Обработка моделью, Ответ серверу и Ответ клиенту. Каждый шаг играет решающую роль в предоставлении того "волшебного" ответа, который ожидают пользователи.

Почему вам нужен сервер

Никогда не делайте API-запросы напрямую из клиентского кода. Вот почему:

  • API-запросы требуют секретных учетных данных, которые должны оставаться в безопасности
  • Раскрытие учетных данных в клиентском коде делает их видимыми для любого
  • Ваш сервер действует как безопасный посредник между вашим приложением и Vertex

Всегда направляйте запросы через ваш собственный сервер, который вы контролируете и защищаете.

Выполнение API-запроса

Ваш сервер взаимодействует с Vertex, используя либо SDK Anthropic, либо официальные SDK Google Vertex. Anthropic предоставляет официальные SDK для Python, TypeScript, Go и Ruby.

Каждый запрос должен включать следующие ключевые поля:

  • Идентифицирует ваш запрос к Anthropic
  • Имя конкретной модели для использования
  • Список, содержащий введенный пользователем текст
  • Ограничивает количество токенов, которые может сгенерировать модель

Ввод пользователя помещается в сообщение "user", которое затем отправляется в список сообщений, отправляемых в API.

Внутри Claude: Процесс генерации текста

Как только Vertex получает ваш запрос, Claude обрабатывает его в четыре этапа: Токенизация, Встраивание (Embedding), Контекстуализация и Генерация.

Claude сначала разбивает входной текст на более мелкие части, называемые токенами. Это могут быть целые слова, части слов, пробелы или символы. Для простоты, думайте о каждом слове как об одном токене.

Каждый токен преобразуется во встраивание (embedding) — длинный список чисел, который представляет все возможные значения этого слова. Думайте о встраиваниях как об определениях на основе чисел.

Контекстуализация

Поскольку слова могут иметь несколько значений, Claude использует контекст для определения правильной интерпретации. Слово "квантовый" может относиться к физике, вычислениям или просто означать "очень маленький" — контекст из окружающих слов проясняет предполагаемое значение.

Во время контекстуализации каждое встраивание корректируется на основе его соседей, выделяя значение, которое имеет наибольший смысл в данном контексте.

Контекстуализированные встраивания проходят через выходной слой, который производит вероятности для каждого возможного следующего слова. Claude не всегда выбирает слово с наибольшей вероятностью — он использует смесь вероятности и случайности для создания более естественных, разнообразных ответов.

После выбора слова Claude добавляет его в последовательность и повторяет весь процесс для следующего слова.

Когда генерация останавливается

После генерации каждого токена Claude проверяет несколько условий, чтобы решить, продолжать ли:

  • Достигнуто максимальное количество токенов
  • Достигнут ли установленный вами лимит?
  • Был ли сгенерирован токен конца последовательности?
  • Встретилась ли предопределенная стоп-фраза?

Токен конца последовательности — это специальный сигнал (невидимый текст), который Claude использует для обозначения того, что он достиг естественного завершения.

После завершения генерации Vertex отправляет ответ обратно на ваш сервер, содержащий:

  • Сгенерированный текст
  • Количество входных и выходных токенов
  • Причину остановки генерации моделью

Затем ваш сервер пересылает сгенерированный текст в ваше клиентское приложение, где он появляется в интерфейсе чата.

Полная картина

Весь этот процесс — от пользовательского ввода через токенизацию, встраивание, контекстуализацию, генерацию и обратно к пользователю — происходит за секунды. Понимание этого потока помогает вам создавать более надежные приложения и устранять проблемы, когда они возникают.

Ключевой вывод: всегда используйте сервер в качестве посредника, понимайте, что генерация текста — это итеративный процесс, и обращайте внимание на метаданные ответа для мониторинга использования и понимания поведения модели.

  • Обзор моделей Claude

Полезные гиды