О чём урок
Оптическое распознавание символов (OCR) преобразует текстовые документы и изображения в чистый текстовый output и markdown. Используя эту функцию, вы можете позволить любой Large Language Model (LLM) надёжно понимать документы эффективно и экономично. В этом руководстве мы покажем, как использовать OCR с нашими моделями для обсуждения любого текстового документа, будь то PDF, фотография или скриншот, с помощью URL и нашей встроенной функции. Этот метод будет использовать нашу встроенную функцию, которая задействует OCR, мы будем извлекать URL с помощью regex и вызывать наши модели с этой функцией. Mistral предоставляет встроенную функцию, которая задействует OCR со всеми моделями. Предоставив URL, указывающий на документ, вы можете извлечь текстовые данные, которые будут переданы модели.
План урока
- Используйте нашу встроенную функцию Document QnA
- Метод
- Встроенная функция
Урок входит в полный доступ. Полный текст и видео открываются после оплаты. Первые уроки каждого курса бесплатны.