V mnogih podjetjih se sčasoma nabere na tisoče dokumentov – ponudbe, pogodbe, zapisniki, računi, tehnična dokumentacija. Če datoteka ob nalaganju ni ustrezno poimenovana, jo je v klasičnem upravljanju datotek pozneje težko najti, tudi če se še natančno spomnite določenega stavka ali izraza iz njene vsebine. Iskanje po imenu datoteke tu hitro naleti na meje, zlasti kadar dokumente nalaga veliko različnih zaposlenih, vsak s svojimi pravili poimenovanja. Zato 1Tool ubere drugo pot in omogoči iskanje ne le po imenu, temveč po dejanski vsebini vsake naložene datoteke. Kako to deluje v ozadju in kakšno razliko to prinese pri vsakdanjem delu, prikazuje ta prispevek.
Od datoteke do besedila, po katerem je mogoče iskati
Takoj ko je datoteka naložena v 1Tool, se v ozadju samodejno izvede prepoznava besedila. Tehnično za to poskrbi Apache Tika, programska oprema, ki prebere vsebino najrazličnejših oblik datotek – na primer dokumentov PDF ali Word – in jo pretvori v golo besedilo. Ta korak se samodejno izvede ob vsakem nalaganju, ne da bi uporabniki morali karkoli storiti ali sprožiti dodatno dejanje. Rezultat je besedilna predstavitev vsebine dokumenta, ki služi kot osnova za nadaljnjo obdelavo. Za uporabnike to pomeni: ni pomembno, ali se datoteka imenuje »Ponudba_koncna.pdf« ali »Dokument_23.pdf« – odločilno je, kaj dejansko piše v dokumentu. Tako ni več treba ob nalaganju paziti na premišljena, opisna imena datotek samo zato, da bi dokument pozneje lahko našli. Prav v podjetjih, ki so rasla skozi leta in v katerih so različne osebe in oddelki dolgo odlagali datoteke, je ta neodvisnost od imena datoteke opazna razlika v primerjavi s klasično strukturo map.
Lasten iskalni indeks za vsakega najemnika
Besedilo, pridobljeno iz datoteke, se nato ne shrani kar nekam, temveč v lasten iskalni indeks, ki je specifičen za posameznega najemnika (tenant). Ta indeks temelji na Meilisearch, iskalniku, zasnovanem za hitrost. Tako ostanejo iskalni podatki vsakega najemnika 1Tool čisto ločeni, iskalne poizvedbe pa tudi pri večjih količinah podatkov zelo hitro vrnejo rezultate. Celotno infrastrukturo za to upravlja 1Tool sam – uporabnikom ni treba skrbeti za nič, in ni dodatnega dela z nastavitvijo, delovanjem ali vzdrževanjem tega iskalnika. Indeks se v ozadju sproti posodablja, tako da so na novo naloženi ali spremenjeni dokumenti hitro najdljivi. Za podjetja, ki delajo z občutljivimi ali zaupnimi dokumenti, je pomembno tudi, da indeksiranje vsebine poteka izključno znotraj lastnega, ločenega območja najemnika in se ne deli z drugimi strankami 1Tool. Ker je bil Meilisearch razvit posebej za hitre odzivne čase, ostane iskanje udobno tudi takrat, ko je bilo sčasoma naloženih in indeksiranih zelo veliko dokumentov.
Praktična korist pri vsakdanjem delu
Konkreten učinek se pokaže v globalnem iskanju 1Tool: če tam vnesete izraz, ki se pojavi kjerkoli v besedilu naloženega dokumenta, se ustrezna datoteka najde – ne glede na to, ali je ta izraz tudi v imenu datoteke. To prihrani dolgo klikanje po strukturah map ali odpiranje več dokumentov na slepo, samo da bi našli pravo informacijo. Še posebej se obrestuje pri poizvedbah strank, ko se morate hitro sklicevati na določen dogovor, ceno ali odstavek iz starejšega dokumenta, saj zaposlenim ni treba najprej razmišljati, kako je bila iskana datoteka morda poimenovana. Iskanje po celotnem besedilu vsebine deluje neodvisno od modula, v katerem je datoteka shranjena, in se brezhibno vključuje v obstoječe iskanje. Tako preprosto odlagališče datotek postane prava baza znanja, po kateri je mogoče iskati in do katere lahko dostopa vsak pooblaščeni zaposleni v podjetju. Še posebej koristi novim zaposlenim, saj jim ni treba najprej osvojiti navad odlaganja, ki so jih sodelavci razvijali leta, da bi našli določen dokument.
Pogosta vprašanja
Ali moram ob nalaganju datoteke nastaviti kaj dodatnega, da bo po njej mogoče iskati?
Ne, prepoznava besedila in indeksiranje se samodejno izvedeta v ozadju, takoj ko je datoteka naložena.
Ali se po vsebini preiskujejo tudi skenirani dokumenti ali dokumenti v obliki slike?
Prepoznava besedila poteka prek Apache Tika in obdela besedilne informacije, ki jih vsebuje datoteka; katere oblike so podrobno podprte, je odvisno od vrste datoteke.
Ali drugi najemniki 1Tool prek iskanja vidijo vsebino mojih dokumentov?
Ne, vsak najemnik ima lasten, ločen iskalni indeks, zato so rezultati iskanja prikazani izključno znotraj lastnih podatkov.
Koliko dokumentov v vašem podjetju bi danes našli hitreje, če bi lahko iskali ne le po imenu datoteke, temveč tudi po vsebini?
