Claude в Google Vertex AI

Подключение Claude через Google Cloud — авторизация, регионы, биллинг.

100 уроков, первые 3 бесплатно. Полный доступ: 1490 руб.

Уроки курса

  1. Welcome to the course
  2. Overview of Claude models
  3. Accessing the API
  4. Vertex AI Setup
  5. Making a request
  6. Multi-turn conversations
  7. Chat exercise
  8. System prompts
  9. System prompts exercise
  10. Temperature
  11. Course satisfaction survey
  12. Response streaming
  13. Controlling model output
  14. Structured data
  15. Structured data exercise
  16. Quiz on accessing Claude with the API
  17. Prompt evaluation
  18. A typical eval workflow
  19. Generating test datasets
  20. Running the eval
  21. Model based grading
  22. Code based grading
  23. Exercise on prompt evals
  24. Quiz on prompt evaluation
  25. Prompt engineering
  26. Being clear and direct
  27. Being specific
  28. Structure with XML tags
  29. Providing examples
  30. Exercise on prompting
  31. Quiz on prompt engineering techniques
  32. Introducing tool use
  33. Project overview
  34. Tool functions
  35. Tool schemas
  36. Handling message blocks
  37. Sending tool results
  38. Multi-turn conversations with tools
  39. Implementing multiple turns
  40. Using multiple tools
  41. The batch tool
  42. Tools for structured data
  43. The text edit tool
  44. The web search tool
  45. Quiz on tool use with Claude
  46. Introducing Retrieval Augmented Generation
  47. Text chunking strategies
  48. Text embeddings
  49. The full RAG flow
  50. Implementing the RAG flow
  51. BM25 lexical search
  52. A Multi-index RAG pipeline
  53. Reranking results
  54. Contextual retrieval
  55. Quiz on Retrieval Augmented Generation
  56. Extended thinking
  57. Image support
  58. PDF support
  59. Citations
  60. Prompt caching
  61. Rules of prompt caching
  62. Prompt caching in action
  63. Quiz on features of Claude
  64. Introducing MCP
  65. MCP clients
  66. Project setup
  67. Defining tools with MCP
  68. The server inspector
  69. Implementing a client
  70. Defining resources
  71. Accessing resources
  72. Defining prompts
  73. Prompts in the client
  74. MCP review
  75. Quiz on Model Context Protocol
  76. Anthropic apps
  77. Claude Code setup
  78. Claude Code in action
  79. Enhancements with MCP servers
  80. Parallelizing Claude Code
  81. Automated debugging
  82. Computer use
  83. How computer use works
  84. Agents and workflows
  85. Parallelization workflows
  86. Chaining workflows
  87. Routing workflows
  88. Agents and tools
  89. Environment inspection
  90. Workflows vs agents
  91. Quiz on agents and workflows
  92. Final assessment quiz
  93. Course Wrap Up
  94. Course Description
  95. Course Description
  96. Course Description
  97. Course Description
  98. Course Description
  99. Course Description
  100. Course Description

Введение в курс: Claude с Google Vertex AI

Добро пожаловать на курс, посвященный глубокому изучению и практическому применению моделей искусственного интеллекта Claude от Anthropic через платформу Google Cloud Vertex AI. Этот курс разработан для разработчиков, инженеров и архитекторов, стремящихся интегрировать передовые возможности больших языковых моделей (LLM) в свои приложения и сервисы. Мы предоставим всестороннюю техническую подготовку по интеграции и развертыванию моделей Claude, охватывая как базовые принципы работы с API, так и продвинутые функции, такие как использование инструментов, генерация с дополненным поиском (RAG) и протокол контекста модели (MCP).

В ходе обучения вы освоите практические паттерны реализации, методы оптимизации производительности и готовые к продакшену рабочие процессы для создания мощных AI-приложений. Для успешного прохождения курса рекомендуется иметь уверенные знания в программировании на Python, опыт работы с Google Cloud Platform и понимание структур данных JSON.

Доступ к Claude через API и управление диалогами

Первым шагом к освоению Claude является понимание того, как взаимодействовать с моделью через её программный интерфейс. Мы начнем с настройки и конфигурирования моделей Claude в среде Google Cloud Vertex AI, а затем перейдем к основам выполнения запросов к API. Вы узнаете, как отправлять сообщения модели и получать ответы, а также как управлять контекстом в многоходовых диалогах. Это критически важно для создания интерактивных и последовательных бесед с AI.

Особое внимание будет уделено использованию системных промптов (system prompts), которые позволяют задавать общие инструкции, роль или личность модели на протяжении всего диалога, обеспечивая более предсказуемое и управляемое поведение. Кроме того, вы изучите потоковую передачу ответов (response streaming), которая позволяет получать частичные ответы от модели по мере их генерации, улучшая пользовательский опыт и отзывчивость приложений.

Инженерия промптов и контроль вывода модели

Качество взаимодействия с LLM напрямую зависит от качества промптов. В этом разделе мы погрузимся в техники инженерии промптов (prompt engineering), которые помогут вам создавать эффективные и точные запросы. Вы научитесь быть максимально ясным и прямым в своих инструкциях, избегая двусмысленности.

Мы рассмотрим, как структурировать промпты с помощью XML-тегов (XML tags), что позволяет четко разделять различные части запроса (например, инструкции, примеры, данные) и помогает модели лучше понимать вашу цель. Предоставление конкретных примеров желаемого вывода (few-shot prompting) также является мощным инструментом для направления модели. Вы также узнаете, как контролировать формат и содержание вывода модели, например, запрашивая структурированные данные (structured data) в формате JSON, что упрощает дальнейшую обработку ответов в ваших приложениях. Будут рассмотрены параметры, такие как temperature (для контроля случайности) и top-k/top-p (для контроля разнообразия генерируемых токенов), позволяющие тонко настраивать поведение модели.

Оценка промптов и тестирование моделей

Разработка эффективных промптов — это итеративный процесс, требующий систематической оценки. Этот раздел посвящен методологиям оценки промптов (prompt evaluation). Вы узнаете о типичном рабочем процессе оценки, который включает генерацию репрезентативных тестовых наборов данных.

Мы рассмотрим различные подходы к автоматизированной оценке ответов модели: оценка на основе модели (model-based grading), где другая LLM используется для анализа и оценки качества ответов, и оценка на основе кода (code-based grading), где используются скрипты и регулярные выражения для проверки соответствия ответа заданным критериям. Эти методы позволяют объективно измерять производительность промптов и итеративно улучшать их.

Использование инструментов с Claude (Tool Use)

Одной из наиболее мощных возможностей современных LLM является способность взаимодействовать с внешними инструментами и API. В этом разделе мы представим концепцию использования инструментов (tool use) с Claude. Вы узнаете, как Claude может вызывать внешние функции для получения актуальной информации, выполнения расчетов или взаимодействия с другими системами.

Мы рассмотрим, как обрабатывать блоки сообщений (message blocks), которые содержат запросы модели на использование инструментов, и как отправлять результаты выполнения этих инструментов обратно в модель. Вы научитесь реализовывать многоходовые диалоги, в которых Claude последовательно использует несколько инструментов для достижения сложной цели. Будут рассмотрены примеры конкретных инструментов, таких как инструмент для редактирования текста (text edit tool) для модификации содержимого или инструмент веб-поиска (web search tool) для получения информации из интернета, а также как создавать собственные инструменты для специфических задач.

Генерация с дополненным поиском (Retrieval Augmented Generation - RAG)

Модели LLM обладают обширными знаниями, но их информация ограничена данными, на которых они были обучены. Генерация с дополненным поиском (Retrieval Augmented Generation - RAG) позволяет моделям получать доступ к внешней, актуальной или специфической для предметной области информации. Вы познакомитесь с принципами RAG, которые позволяют Claude генерировать более точные, обоснованные и актуальные ответы.

Мы изучим различные стратегии разбиения текста на фрагменты (text chunking strategies) для эффективного индексирования больших объемов данных. Вы освоите полный цикл RAG, от получения запроса до поиска релевантных фрагментов информации и их интеграции в промпт для Claude. Будут рассмотрены методы поиска, такие как лексический поиск BM25 (BM25 lexical search) и создание конвейеров RAG с несколькими индексами (multi-index RAG pipeline). Также вы узнаете о техниках переранжирования результатов (reranking results) для повышения релевантности найденных фрагментов и о контекстном поиске (contextual retrieval), который учитывает контекст всего диалога при извлечении информации.

Расширенные возможности Claude и протокол контекста модели (MCP)

Claude предлагает ряд продвинутых функций, которые значительно расширяют его возможности. Мы рассмотрим концепцию расширенного мышления (extended thinking), позволяющую модели выполнять более сложные рассуждения. Вы также изучите правила и применение кэширования промптов (prompt caching), что позволяет оптимизировать производительность и снизить затраты при повторных запросах.

Кроме того, мы углубимся в протокол контекста модели (Model Context Protocol - MCP). MCP — это мощный фреймворк для определения пользовательских инструментов, ресурсов и шаблонов промптов, позволяющий создавать высокоспециализированные и модульные AI-системы. Вы научитесь определять инструменты и ресурсы с помощью MCP, использовать инспектор сервера (server inspector) для отладки, а также реализовывать клиентские приложения, которые эффективно взаимодействуют с этими определениями. Это позволяет разработчикам создавать сложные, настраиваемые рабочие процессы для Claude.

Приложения Anthropic: Claude Code и Computer Use

Курс также охватывает специализированные приложения Anthropic, такие как Claude Code и Computer Use. Claude Code предназначен для автоматизации задач разработки, включая генерацию кода, отладку и рефакторинг. Вы узнаете, как настроить и использовать Claude Code в действии, а также как повысить его эффективность с помощью серверов MCP и параллелизации задач для ускорения процессов разработки.

Computer Use позволяет Claude взаимодействовать с пользовательскими интерфейсами, автоматизируя задачи, которые обычно выполняются человеком. Мы рассмотрим, как работает эта функция и как её можно использовать для создания агентов, способных выполнять сложные операции в различных приложениях. В рамках этого раздела вы также изучите проектирование агентов и рабочих процессов (agents and workflows), включая параллелизацию (parallelization workflows), цепочки (chaining workflows) и маршрутизацию (routing workflows) для создания комплексных, многошаговых AI-систем. Вы научитесь инспектировать окружение и понимать различия между рабочими процессами и агентами, что позволит вам создавать надежные и масштабируемые решения.