О чём урок
Оптическое распознавание символов (OCR) преобразует текстовые документы и изображения в чистый текстовый вывод и markdown. Используя эту функцию, вы можете позволить любой большой языковой модели (LLM) надёжно понимать документы эффективно и экономично. В этом руководстве мы покажем, как использовать OCR с нашими моделями для обсуждения любого текстового документа, будь то PDF, фотография или скриншот, по URL. Мы будем использовать Tool Usage, чтобы открывать любой URL по запросу пользователя. У нас также есть встроенная функция для понимания документов, использующая нашу OCR модель; чтобы узнать о ней больше, посетите нашу Document Understanding docs Для этого мы сначала отправим наш вопрос, который может содержать или не содержать URL, указывающие на документы, для которых мы хотим выполнить OCR. Mistral Small затем решит, используя инструмент open_urls (извлекая URL напрямую), нужно ли ему выполнять OCR для какого-либо URL или он может ответить на вопрос напрямую.
План урока
- Метод
- Другие методы
- Tool Usage
Урок входит в полный доступ. Полный текст и видео открываются после оплаты. Первые уроки каждого курса бесплатны.