О чём урок
Теперь мы узнаем, как экспортировать и использовать аннотированные данные, которые у нас есть в Argilla. Сначала нам нужно убедиться, что мы подключены к нашему экземпляру Argilla, как и на предыдущих шагах: А теперь загрузим набор данных, с которым будем работать: Загрузки набора данных и вызова его записей с помощью dataset.records достаточно, чтобы начать использовать ваш набор данных и записи для ваших собственных целей и пайплайнов. Однако мы также узнаем, как выполнить несколько необязательных операций, таких как фильтрация записей и экспорт вашего набора данных в Hugging Face Hub. Иногда вы хотите использовать только завершенные записи, поэтому сначала мы отфильтруем записи в нашем наборе данных по их статусу: [!СОВЕТ] ⚠️ Обратите внимание, что записи со статусом completed (т.е. записи, которые соответствуют минимальному количеству отправленных ответов, настроенному в параметрах распределения задач) могут иметь более одного ответа, и каждый ответ может иметь любой статус из submitted, draft или discarded. Узнайте больше о запросах и фильтрации записей в документации Argilla. Теперь мы можем экспортировать наши аннотации в Hugging Face Hub, чтобы поделиться ими с другими. Для этого нам потребуется преобразовать записи в 🤗 Dataset, а затем отправить его в Hub: В качестве альтернативы мы можем экспортировать полный набор данных Argilla (включая ожидающие записи) следующим образом: Это интересный вариант, если другие захотят открыть набор данных в своих экземплярах Argilla, так как настройки автоматически сохраняются, и они могут просто импортировать полный набор данных, используя одну строку кода:
План урока
- Загрузка набора данных
- Фильтрация набора данных
- Экспорт в Hub
Урок входит в полный доступ. Полный текст и видео открываются после оплаты. Первые уроки каждого курса бесплатны.