0
Prejsť na obsah

Vloženie

Embedding je číselné reprezentácie významov obsahu, ktoré umožňujú porovnávať podobnosť textov, obrázkov alebo iných údajov.

Čo je začlenenie

V tom priestore sa objekty s podobným významom nachádzajú v blízkosti seba, takže sa dá hľadať podľa smyslu, nie len podľa presného zhody slov.

Ako to funguje v praxi

Otázka na nepriepadnú tmavo modrú kabátku môže nájsť produkt opísaný inými slovami, ak model rozpozná podobný význam.

Model a rozdeľovanie obsahu

Model sa vyberá podľa jazyka, typu údajov, kvality a nákladov. Dlhý dokument sa rozdelí na logické časti, ktoré musia udržať význam a potrebný kontext. Príliš malé časti strata sú súvisiace, príliš veľké zhoršujú presnosť a zvyšujú náklady.

Index a podobnosť

Vektory sa uložia do indexu spolu s metadátami a oprávnením. Výsledky ovplyvňujú zvolené metriky podobnosti, filtry a počet kandidátov. Prístup k dokumentu sa kontroluje pred vrátením výsledku, aby semantický vyhľadávanie neodhalilo cudzie údaje.

Testovanie a aktualizácia

Preveruje sa presnosť prvých výsledkov, pokrytie dôležitých otázok, rýchlosť a falošná podobnosť. Pri zmene modelu je zvyčajne potrebné znovu vytvoriť index. Testovací súbor obsahuje bežné otázky, ťažké výnimky a prípady, keď sa výsledok nemá vrátiť.

Prístup PAR HOUSE Agency

Vkladame do aplikácie až po definovaní konkrétneho procesu a merateľných hodnôt. Vyčistíme zdroje, vyberáme logické rozdelenie, metadaty a bezpečnostné pravidlá. Porovnávame výsledky s bežnými vyhľadávaním a rozširujeme ich iba vtedy, ak prinášajú preukázané lepšie odpovede.