Con il tempo, in molte aziende si accumulano migliaia di documenti – offerte, contratti, verbali, fatture, documentazione tecnica. Se un file non viene nominato correttamente al momento del caricamento, in una gestione file classica è poi difficile ritrovarlo, anche se si ricorda ancora esattamente una frase o un termine del suo contenuto. La ricerca per nome file mostra presto i suoi limiti, soprattutto quando molti collaboratori diversi caricano documenti seguendo ciascuno le proprie convenzioni di denominazione. Per questo 1Tool percorre un’altra strada e rende ricercabile non solo il nome, ma il contenuto effettivo di ogni file caricato. Questo articolo mostra come funziona dietro le quinte e che differenza fa nel lavoro quotidiano.
Dal file al testo ricercabile
Non appena un file viene caricato in 1Tool, in background viene eseguita automaticamente un’estrazione del testo. Tecnicamente se ne occupa Apache Tika, un software che legge il contenuto dei più diversi formati di file – ad esempio documenti PDF o Word – e lo converte in testo semplice. Questo passaggio avviene automaticamente a ogni caricamento, senza che gli utenti debbano fare nulla o avviare un’azione aggiuntiva. Il risultato è una rappresentazione testuale del contenuto del documento, che funge da base per l’ulteriore elaborazione. Per gli utenti questo significa che non ha importanza se un file si chiama «Offerta_finale.pdf» o «Documento_23.pdf» – ciò che conta è quello che c’è davvero nel documento. Non è quindi più necessario scegliere nomi di file ponderati e descrittivi al momento del caricamento solo per poter ritrovare un documento in seguito. Proprio nelle aziende cresciute nel tempo, in cui per anni persone e reparti diversi hanno archiviato file, questa indipendenza dal nome del file rappresenta una differenza tangibile rispetto alla classica struttura a cartelle.
Un indice di ricerca dedicato per ogni tenant
Il testo estratto da un file non viene semplicemente salvato da qualche parte, ma inserito in un indice di ricerca dedicato e specifico per ogni tenant. Questo indice si basa su Meilisearch, un motore di ricerca progettato per la velocità. In questo modo i dati di ricerca di ogni tenant 1Tool restano nettamente separati e le ricerche restituiscono risultati molto rapidamente anche con grandi volumi di dati. L’intera infrastruttura è gestita da 1Tool stessa – gli utenti non devono occuparsi di nulla e non c’è alcun onere aggiuntivo per configurazione, esercizio o manutenzione del motore di ricerca. L’indice viene mantenuto costantemente aggiornato in background, così che i documenti appena caricati o modificati siano reperibili in breve tempo. Per le aziende che lavorano con documenti sensibili o riservati è inoltre rilevante che l’indicizzazione dei contenuti avvenga esclusivamente all’interno della propria area tenant isolata e non venga condivisa con altri clienti 1Tool. Poiché Meilisearch è stato sviluppato specificamente per tempi di risposta rapidi, la ricerca resta comoda da usare anche quando nel tempo sono stati caricati e indicizzati moltissimi documenti.
Vantaggi pratici nel lavoro quotidiano
L’effetto concreto si vede nella ricerca globale di 1Tool: se si inserisce un termine che compare in qualsiasi punto del testo di un documento caricato, il file in questione viene trovato – indipendentemente dal fatto che il termine compaia anche nel nome del file. Si evita così di cliccare a lungo tra le cartelle o di aprire diversi documenti a caso solo per trovare l’informazione giusta. Questo ripaga soprattutto con le richieste dei clienti, quando occorre risalire rapidamente a un determinato accordo, a un prezzo o a una clausola di un documento più vecchio, perché i collaboratori non devono prima chiedersi come potrebbe essere stato chiamato il file cercato. La ricerca full-text nei contenuti funziona indipendentemente dal modulo in cui un file è stato archiviato e si integra perfettamente nella ricerca esistente. Un semplice archivio di file diventa così una vera base di conoscenza ricercabile, accessibile a ogni collaboratore autorizzato dell’azienda. Ne traggono particolare vantaggio i nuovi assunti, che non devono prima imparare le abitudini di archiviazione dei colleghi consolidate negli anni per trovare un determinato documento.
Domande frequenti
Devo impostare qualcosa di particolare al caricamento di un file perché diventi ricercabile?
No, l’estrazione del testo e l’indicizzazione avvengono automaticamente in background non appena un file viene caricato.
Vengono ricercati nel contenuto anche documenti scansionati o disponibili come immagine?
L’estrazione del testo avviene tramite Apache Tika e analizza le informazioni testuali contenute in un file; quali formati siano supportati nel dettaglio dipende dal tipo di file.
Altri tenant di 1Tool vedono il contenuto dei miei documenti tramite la ricerca?
No, ogni tenant dispone di un proprio indice di ricerca separato, quindi i risultati vengono mostrati esclusivamente all’interno dei propri dati.
Quanti documenti nella vostra azienda verrebbero trovati più velocemente oggi se si potesse cercare non solo nel nome del file, ma anche nel contenuto?
