AiHummer
Русский
ВойтиЛичный кабинет
v1.0.x
{ }Swagger

База знаний

v1.0.x · обновлено 2026-07-21

База знаний — это хранилище документов, из которых агенты берут факты при ответе (поиск по базе знаний с добавлением найденных фрагментов в контекст — RAG). Вы загружаете материалы компании, AiHummer извлекает из них текст, разбивает на фрагменты и индексирует; затем агент находит нужные фрагменты и отвечает на их основе.

Что можно загрузить

Три способа добавления:

  • + Файл — выбор одного или нескольких файлов. Поддерживаются PDF, Word (.docx), Excel (.xlsx), CSV, .txt, .md, .rtf; ограничение — 20 МиБ на файл. Сервер извлекает текст и сообщает число полученных фрагментов по каждому файлу.
  • + Текст — вставить текст напрямую: заголовок, источник и содержимое.
  • + URL — указать ссылку, содержимое страницы будет загружено.

Как устроен список

Каждый документ показывает заголовок/источник, число фрагментов и время добавления. Есть поиск и сортировка по имени или дате, а в шапке — общий счётчик фрагментов.

Как пользоваться

  1. Загрузите документы (лучше — структурированные и без лишнего оформления).
  2. Проверьте, что число фрагментов ненулевое — это значит, что текст успешно извлечён.
  3. Убедитесь, что агенту разрешено пользоваться знаниями (секции capabilities) и что подобранный эмбеддер подходит вашему языку.
  4. Обязательная проверка поиска после загрузки: задайте агенту тестовый вопрос по свежезагруженному документу (например, в новой сессии на экране «Сессии»). Убедитесь, что в ответе использованы найденные фрагменты и есть ссылка на источник — только это подтверждает, что документ реально ищется.

Настройка

Параметры извлечения, эмбеддинга и размера фрагментов относятся к движку RAG — см. Знания и RAG. Модель эмбеддингов по умолчанию подобрана мультиязычной; для больших объёмов можно вынести её на GPU.

Советы

  • Дробите крупные документы по смыслу — так поиск точнее.
  • Указывайте осмысленный «источник»: он помогает и людям, и агенту ссылаться на происхождение факта.

Что дальше