Загрузка документов
Если у вас уже есть документы, их можно загрузить напрямую, а не переписывать вручную. HaveAI автоматически обрабатывает файл, извлекает текст, разбивает на фрагменты и добавляет в базу знаний ассистента.
Поддерживаемые форматы
HaveAI может обрабатывать широкий набор форматов документов и текста:
- Документы: PDF, DOCX, DOC
- Текст: TXT, MD (Markdown)
- Ограничение размера: до 25 МБ на файл
Извлечение текста — ключевое
HaveAI извлекает текст из документов. Поэтому отсканированные (в виде изображений) PDF или документы только из изображений могут дать плохой результат. Лучше всего подходят текстовые документы с выделяемым содержимым.
Загрузка документа
1
Перейдите в раздел документов
Откройте Обучение ИИ → Загрузка документов в панели.
2
Выберите или перетащите файл
Выберите документ для загрузки. Обработка начинается автоматически после завершения загрузки.
3
Дождитесь обработки
Документ проходит извлечение текста, затем этап эмбеддинга (векторизации). Статус меняется с обработка → завершено. После завершения ассистент может использовать содержимое.
Этапы обработки
Каждый загруженный документ проходит два этапа:
- Извлечение текста: текст извлекается в зависимости от формата.
- Эмбеддинг: текст разбивается на фрагменты и векторизуется для семантического поиска.
В списке документов видно, на сколько фрагментов разбит каждый документ и его статус обучения.
Структурированные документы дают лучший результат
Документы с заголовками, списками и чёткими абзацами дают более точные ответы, чем беспорядочные или сплошные.
Секретные ключи автоматически маскируются
Если в загруженных документах есть API-ключи, пароли или закрытые ключи, HaveAI автоматически обнаруживает и маскирует их до обработки содержимого. Секреты не сохраняются в базе и не появляются в ответах ассистента — вы защищены даже при случайной загрузке.
Связанные темы
Эта страница была полезна?