Загрузка документов

Если у вас уже есть документы, их можно загрузить напрямую, а не переписывать вручную. HaveAI автоматически обрабатывает файл, извлекает текст, разбивает на фрагменты и добавляет в базу знаний ассистента.

Поддерживаемые форматы

HaveAI может обрабатывать широкий набор форматов документов и текста:

  • Документы: PDF, DOCX, DOC
  • Текст: TXT, MD (Markdown)
  • Ограничение размера: до 25 МБ на файл

Извлечение текста — ключевое

HaveAI извлекает текст из документов. Поэтому отсканированные (в виде изображений) PDF или документы только из изображений могут дать плохой результат. Лучше всего подходят текстовые документы с выделяемым содержимым.

Загрузка документа

1

Перейдите в раздел документов

Откройте Обучение ИИ → Загрузка документов в панели.
2

Выберите или перетащите файл

Выберите документ для загрузки. Обработка начинается автоматически после завершения загрузки.
3

Дождитесь обработки

Документ проходит извлечение текста, затем этап эмбеддинга (векторизации). Статус меняется с обработка → завершено. После завершения ассистент может использовать содержимое.

Этапы обработки

Каждый загруженный документ проходит два этапа:

  • Извлечение текста: текст извлекается в зависимости от формата.
  • Эмбеддинг: текст разбивается на фрагменты и векторизуется для семантического поиска.

В списке документов видно, на сколько фрагментов разбит каждый документ и его статус обучения.

Структурированные документы дают лучший результат

Документы с заголовками, списками и чёткими абзацами дают более точные ответы, чем беспорядочные или сплошные.

Секретные ключи автоматически маскируются

Если в загруженных документах есть API-ключи, пароли или закрытые ключи, HaveAI автоматически обнаруживает и маскирует их до обработки содержимого. Секреты не сохраняются в базе и не появляются в ответах ассистента — вы защищены даже при случайной загрузке.

Связанные темы

Эта страница была полезна?