Tas Žinių bazė yra dokumentų saugykla, iš kurios agentai pasitelkia faktus atsakydami (RAG, informacijos paieškomis papildyta generacija). Jūs įkeliate įmonės medžiagą, AiHummer ištraukia tekstą, padalija jį į dalis ir indeksuoja; agentas tada randa atitinkamas dalis ir atsako iš jų.
Ką galite įkelti
Trys būdai pridėti turinį:
+ Byla — pasirinkite vieną ar daugiau failų. Palaikoma: PDF, Word (.docx), Excel
(.xlsx), CSV, .txt, .md, .rtf; apribojimas yra 20 MB vienam failui. Serveris išskleidžia
tekstas ir praneša apie kiekviename faile sukurtų fragmentų skaičių.
+ Tekstas — įklijuokite tekstą tiesiai: pavadinimas, šaltinis ir turinys.
+ URL — spustelėkite nuorodą; puslapio turinys yra gaunamas.
Sąrašas
Kiekvienas dokumentas rodo savo pavadinimą/šaltinį, dalių skaičių ir pridėjimo laiką. Yra paieška ir rūšiavimas pagal pavadinimą arba datą, o antraštėje yra bendras dalių skaitiklis.
Kaip tai naudoti
Įkelkite dokumentus (geriausiai tinka švarus, struktūruotas tekstas).
Patikrinkite, ar blokų skaičius nėra nulis — tai reiškia, kad tekstas buvo išgautas.
Įsitikinkite, kad agentui leidžiama naudoti žinias (capabilities skyrius)
ir pasirinktas įterpėjas tik jūsų
kalba.
Konfigūracija
Ištraukimo, įterpimo ir dalies dydžio nustatymai priklauso RAG varikliui — žr. Žinios ir RAG. Numatytoji įterpimo (embedding) modelis yra daugialypis (multilingual); dideliems kiekiams jis gali būti perkeltas į GPU.
Patarimai
Didelius dokumentus skaidykite pagal prasmę – tokiu būdu paieška yra tikslesnė.
Pateikite prasmingą „šaltinį“: tai padeda tiek žmonėms, tiek agentui nurodyti, iš kur paimta informacija
atėjo iš.
Tas **Žinių bazė** yra dokumentų saugykla, iš kurios agentai pasitelkia faktus atsakydami (RAG, informacijos paieškomis papildyta generacija). Jūs įkeliate įmonės medžiagą, AiHummer ištraukia tekstą, padalija jį į dalis ir indeksuoja; agentas tada randa atitinkamas dalis ir atsako iš jų.
## Ką galite įkelti
Trys būdai pridėti turinį:
- **+ Byla** — pasirinkite vieną ar daugiau failų. Palaikoma: **PDF, Word (.docx), Excel
(.xlsx), CSV, .txt, .md, .rtf**; apribojimas yra 20 MB vienam failui. Serveris išskleidžia
tekstas ir praneša apie kiekviename faile sukurtų fragmentų skaičių.
- **+ Tekstas** — įklijuokite tekstą tiesiai: pavadinimas, šaltinis ir turinys.
- **+ URL** — spustelėkite nuorodą; puslapio turinys yra gaunamas.
## Sąrašas
Kiekvienas dokumentas rodo savo pavadinimą/šaltinį, dalių skaičių ir pridėjimo laiką. Yra paieška ir rūšiavimas pagal pavadinimą arba datą, o antraštėje yra bendras dalių skaitiklis.
## Kaip tai naudoti
1. Įkelkite dokumentus (geriausiai tinka švarus, struktūruotas tekstas).
2. Patikrinkite, ar blokų skaičius nėra nulis — tai reiškia, kad tekstas buvo išgautas.
3. Įsitikinkite, kad agentui leidžiama naudoti žinias (`capabilities` skyrius)
ir pasirinktas [įterpėjas](/lt/v1.0/concepts/knowledge-rag) tik jūsų
kalba.
## Konfigūracija
Ištraukimo, įterpimo ir dalies dydžio nustatymai priklauso RAG varikliui — žr. [Žinios ir RAG](/lt/v1.0/concepts/knowledge-rag). Numatytoji įterpimo (embedding) modelis yra daugialypis (multilingual); dideliems kiekiams jis gali būti perkeltas į GPU.
## Patarimai
- Didelius dokumentus skaidykite pagal prasmę – tokiu būdu paieška yra tikslesnė.
- Pateikite prasmingą „šaltinį“: tai padeda tiek žmonėms, tiek agentui nurodyti, iš kur paimta informacija
atėjo iš.
## Kitas
- [Žinios ir RAG](/lt/v1.0/concepts/knowledge-rag) — kaip veikia semantinis paieška.
- [Einšteino atmintis](/lt/v1.0/webui/memory) — kaip faktai skiriasi nuo dokumentų.
- [Agentai](/lt/v1.0/webui/agents) — kur įjungti žinių naudojimą.