Klasická databáze hledá přesné shody: „Najdi záznamy, kde jméno = 'Novák'." Vektorová databáze hledá podobnost: „Najdi dokumenty, které se tématem podobají této otázce."
Jak to funguje? Každý text (větu, odstavec, dokument) systém převede na vektor, tedy seznam čísel, který zachycuje jeho význam. Podobné texty mají podobné vektory.
Vektorové databáze jsou základem RAG systémů. Když zákaznický agent hledá potřebnou informaci ve vašich pěti stech interních dokumentech, dělá to právě přes vektorovou databázi. Najde tematicky související části, i když otázka neobsahuje přesně ta slova, která jsou v dokumentech.
Mezi běžné vektorové databáze patří Pinecone, Weaviate, Chroma a pgvector (rozšíření PostgreSQL).
U většiny firemních AI projektů běží vektorová databáze v pozadí. Jako klient ji nevidíte, ale je součástí každého spolehlivého RAG řešení.