Accessing the API
Что вы узнаете
- Приложения Anthropic - Claude Code и использование компьютера
- Настройка Claude Code
- Claude Code в действии
- Улучшения с серверами MCP
- Параллелизация Claude Code
- Автоматическая отладка
- Как работает использование компьютера
- Агенты и рабочие процессы
- Рабочие процессы параллелизации
- Цепочки рабочих процессов
- Маршрутизация рабочих процессов
- Агенты и инструменты
- Инспекция среды
- Рабочие процессы против агентов
Тест по агентам и рабочим процессам
Итоговая оценка
Тест итоговой оценки
Это видео все еще обрабатывается. Пожалуйста, зайдите позже и обновите страницу.
Ой! Что-то пошло не так, пожалуйста, попробуйте еще раз.
При создании приложений с Claude понимание полного жизненного цикла запроса помогает лучше проектировать системы и эффективнее отлаживать проблемы. Давайте рассмотрим, что происходит, когда пользователь отправляет сообщение в ваше чат-приложение на базе ИИ.
Полный поток запроса
Путь от пользовательского ввода до ответа ИИ включает пять отдельных шагов: Запрос к серверу, Запрос к Vertex, Обработка моделью, Ответ серверу и Ответ клиенту. Каждый шаг играет решающую роль в предоставлении того "волшебного" ответа, который ожидают пользователи.
Почему вам нужен сервер
Никогда не делайте API-запросы напрямую из клиентского кода. Вот почему:
- API-запросы требуют секретных учетных данных, которые должны оставаться в безопасности
- Раскрытие учетных данных в клиентском коде делает их видимыми для любого
- Ваш сервер действует как безопасный посредник между вашим приложением и Vertex
Всегда направляйте запросы через ваш собственный сервер, который вы контролируете и защищаете.
Выполнение API-запроса
Ваш сервер взаимодействует с Vertex, используя либо SDK Anthropic, либо официальные SDK Google Vertex. Anthropic предоставляет официальные SDK для Python, TypeScript, Go и Ruby.
Каждый запрос должен включать следующие ключевые поля:
- Идентифицирует ваш запрос к Anthropic
- Имя конкретной модели для использования
- Список, содержащий введенный пользователем текст
- Ограничивает количество токенов, которые может сгенерировать модель
Ввод пользователя помещается в сообщение "user", которое затем отправляется в список сообщений, отправляемых в API.
Внутри Claude: Процесс генерации текста
Как только Vertex получает ваш запрос, Claude обрабатывает его в четыре этапа: Токенизация, Встраивание (Embedding), Контекстуализация и Генерация.
Claude сначала разбивает входной текст на более мелкие части, называемые токенами. Это могут быть целые слова, части слов, пробелы или символы. Для простоты, думайте о каждом слове как об одном токене.
Каждый токен преобразуется во встраивание (embedding) — длинный список чисел, который представляет все возможные значения этого слова. Думайте о встраиваниях как об определениях на основе чисел.
Контекстуализация
Поскольку слова могут иметь несколько значений, Claude использует контекст для определения правильной интерпретации. Слово "квантовый" может относиться к физике, вычислениям или просто означать "очень маленький" — контекст из окружающих слов проясняет предполагаемое значение.
Во время контекстуализации каждое встраивание корректируется на основе его соседей, выделяя значение, которое имеет наибольший смысл в данном контексте.
Контекстуализированные встраивания проходят через выходной слой, который производит вероятности для каждого возможного следующего слова. Claude не всегда выбирает слово с наибольшей вероятностью — он использует смесь вероятности и случайности для создания более естественных, разнообразных ответов.
После выбора слова Claude добавляет его в последовательность и повторяет весь процесс для следующего слова.
Когда генерация останавливается
После генерации каждого токена Claude проверяет несколько условий, чтобы решить, продолжать ли:
- Достигнуто максимальное количество токенов
- Достигнут ли установленный вами лимит?
- Был ли сгенерирован токен конца последовательности?
- Встретилась ли предопределенная стоп-фраза?
Токен конца последовательности — это специальный сигнал (невидимый текст), который Claude использует для обозначения того, что он достиг естественного завершения.
После завершения генерации Vertex отправляет ответ обратно на ваш сервер, содержащий:
- Сгенерированный текст
- Количество входных и выходных токенов
- Причину остановки генерации моделью
Затем ваш сервер пересылает сгенерированный текст в ваше клиентское приложение, где он появляется в интерфейсе чата.
Полная картина
Весь этот процесс — от пользовательского ввода через токенизацию, встраивание, контекстуализацию, генерацию и обратно к пользователю — происходит за секунды. Понимание этого потока помогает вам создавать более надежные приложения и устранять проблемы, когда они возникают.
Ключевой вывод: всегда используйте сервер в качестве посредника, понимайте, что генерация текста — это итеративный процесс, и обращайте внимание на метаданные ответа для мониторинга использования и понимания поведения модели.
- Обзор моделей Claude