Gli Agenti di messaggistica IA possono apprendere direttamente dai tuoi contenuti pubblici per fornire risposte accurate, coerenti e in linea con il brand durante le conversazioni con i clienti. Ciò è possibile grazie alle Fonti di conoscenza, che consentono al tuo Agente di messaggistica IA di consultare informazioni attendibili in Tempo reale. Questo articolo spiega che cos'è una Fonte di conoscenza, quali vantaggi offre al tuo Agente di messaggistica IA e quali sono le limitazioni attuali da tenere presenti.
Che cos'è una fonte di conoscenza?
Una fonte di conoscenza è una raccolta centralizzata di informazioni sulla tua azienda, ad esempio su prodotti, servizi e domande frequenti. Consente di trovare e consultare facilmente le informazioni e aiuta il tuo Agente di messaggistica IA a comprenderle.
Aircall utilizza i contenuti che fornisci, ad esempio pagine web pubbliche, per creare una fonte di conoscenza a cui il tuo Agente di messaggistica IA può fare riferimento durante le conversazioni con i clienti.
In che modo le fonti di conoscenza aiutano il tuo Agente di messaggistica IA
Una volta aggiunti i tuoi contenuti come Fonte di conoscenza, il tuo Agente di messaggistica IA può:
- Rispondere alle domande comuni utilizzando informazioni accurate e approvate dal brand
- Mantenere una comunicazione coerente in tutte le conversazioni
- Ridurre le risposte manuali ripetitive
- Consultare immediatamente i tuoi contenuti durante le interazioni con i clienti
In questo modo, i clienti ricevono risposte precise e utili basate direttamente sulle informazioni che hai pubblicato.
Tipi di contenuti supportati
Puoi aggiungere nuove Fonti di conoscenza nei seguenti modi:
- Blocco di contenuti: incolla qualsiasi testo semplice da cui desideri che l'Agente apprenda.
- Pagina web: aggiungi un singolo URL pubblico.
- Sito web: aggiungi un dominio pubblico principale, con sottopagine facoltative.
- Fonti esistenti: riutilizza o aggiorna i contenuti che hai già aggiunto per il tuo Agente vocale IA.
Nota: Tutti i contenuti aggiunti come Fonte di conoscenza devono essere disponibili pubblicamente. Le fonti possono essere condivise tra il tuo Agente vocale IA e il tuo Agente di messaggistica IA. Se una regola o un'informazione si applica a un solo canale, crea una fonte dedicata anziché aggiungerla a una fonte condivisa.
Limitazioni attuali
Per ottenere i migliori risultati, tieni presenti le seguenti limitazioni.
Pagine con accesso limitato o che richiedono l'autenticazione
Le Fonti di conoscenza non possono acquisire contenuti da:
- Pagine che richiedono l'accesso
- Aree protette da password
- Portali interni o Dashboard
- Pagine protette da paywall
Sono supportati solo gli URL pubblici.
Contenuti costituiti esclusivamente da immagini
Se informazioni importanti sono presenti solo sotto forma di immagini, ad esempio testo incorporato in immagini, diagrammi o schermate, l'Agente di messaggistica IA potrebbe non essere in grado di leggerle o utilizzarle.
Caricamento di documenti non ancora supportato
Attualmente non puoi caricare file come PDF, documenti Word o fogli di calcolo.
Nota: Il supporto per il caricamento di documenti è previsto per una versione futura.
Gestire la scansione dei siti web nelle fonti di conoscenza
I contenuti dei siti web appena aggiunti possono integrarsi perfettamente nelle tue fonti di conoscenza. Questa sezione spiega come funziona la scansione dei siti web, come vengono elaborati i contenuti e quali limiti si applicano.
Come funziona la scansione dei siti web
Quando aggiungi l'URL di un sito web alle tue fonti di conoscenza, Aircall elabora automaticamente la pagina fornita, le pagine a cui rimanda e le pagine a cui queste ultime fanno riferimento. Ciò si applica solo se gli URL condividono lo stesso prefisso.
Profondità di scansione
La scansione include la pagina fornita e fino a due livelli successivi, purché gli URL condividano lo stesso prefisso.
Esempio
Se aggiungi https://website.com/depth1/, il crawler può elaborare anche:
https://website.com/depth1/depth2https://website.com/depth1/depth2/depth3
Non eseguirà la scansione di sezioni non correlate, come:
https://website.com/bloghttps://website.com/contact
In questo modo vengono incluse solo le sezioni pertinenti del tuo sito web.
Esaminare e selezionare le pagine dall'URL del sito web
Dopo aver aggiunto l'URL di un sito web, puoi esaminare la mappa del sito generata per quella fonte e vedere quali pagine sono associate. Da lì, puoi selezionare o deselezionare le pagine per controllare esattamente cosa viene incluso nelle tue fonti di conoscenza.
Man mano che aggiungi pagine, puoi monitorare l'indicatore del limite di caratteri per verificare quanto del limite disponibile viene utilizzato dalla tua fonte di conoscenza.
Come vengono estratti e ripuliti i contenuti
Tutti i contenuti dei siti web vengono sottoposti a un'elaborazione in più fasi per garantire conoscenze di alta qualità.
| Categoria | Dettagli | Scopo |
|---|---|---|
| Elementi rimossi | Menu di navigazione, intestazioni e piè di pagina, banner dei cookie, pubblicità, immagini e video, script e codice dannoso, elementi di formattazione superflui e HTML ridondante | Rimuove gli elementi non essenziali e potenzialmente pericolosi, in modo che vengano elaborati solo contenuti pertinenti e puliti. |
| Elementi mantenuti | Titoli, paragrafi, elenchi, contenuti strutturati degli articoli | Conserva i contenuti strutturati e significativi che contribuiscono a un recupero accurato delle conoscenze. |
| Perché è importante | Migliora l'accuratezza delle risposte, impedisce ai contenuti irrilevanti di influenzare le risposte, riduce l'elaborazione non necessaria, aumenta la sicurezza | Garantisce risposte di qualità superiore e una maggiore affidabilità dell'Agente di messaggistica IA. |
Tempi di elaborazione previsti
Il tempo di elaborazione dipende dalle dimensioni della scansione:
- L'elaborazione da 1 a 10 pagine richiede in genere meno di un minuto.
- Le sezioni di medie dimensioni possono richiedere da 5 a 10 minuti.
- Le scansioni estese a livello di root possono richiedere fino a 30 minuti.
Puoi monitorare l'avanzamento tramite l'indicatore di stato del documento.
Best practice per l'acquisizione dei siti web
| Argomento | Consiglio | Dettagli |
|---|---|---|
| Inizia con URL specifici | Aggiungi pagine precise con link diretti anziché domini radice. | Anziché https://website.com/, usa una pagina specifica come https://website.com/help/article-name. Più profondo è il percorso dell'URL, più mirata sarà la scansione. |
| Espandi gradualmente | Se è necessaria una copertura più ampia, risali di un livello di directory alla volta. | Passa da https://website.com/help/article-name a https://website.com/help/. Evita di aggiungere l'URL radice, a meno che tu non abbia bisogno di contenuti provenienti dall'intero sito. |
| Evita scansioni eccessive | Non iniziare con URL a livello radice, a meno che non sia necessario. | Gli URL a livello radice possono acquisire centinaia di pagine, aumentare i tempi di elaborazione, attivare la creazione di riepiloghi e introdurre contenuti irrilevanti. |
| Usa pagine di conoscenza strutturate | Dai priorità a pagine ben organizzate e incentrate sui contenuti. | Le fonti più efficaci includono centri assistenza, portali di documentazione, sezioni FAQ e articoli strutturati con titoli chiari. |
| Evita tipi di contenuti non adatti | Escludi le pagine dinamiche, soggette a restrizioni o non strutturate. | Evita le pagine che richiedono l'accesso, le pagine dei risultati di ricerca, i contenuti dinamici o basati su moduli, i feed di notizie e le pagine ricche di contenuti multimediali. |
| Controlla dopo la scansione | Convalida i risultati al termine dell'elaborazione. | Controlla l'anteprima del documento per verificare che siano state acquisite le pagine corrette, che non siano stati aggiunti URL duplicati e che i contenuti siano strutturati correttamente. Se la pagina di origine viene aggiornata, potrai aggiornare in seguito i contenuti del sito web. |
Suggerimento: Valuta la possibilità di usare FAQ manuali o l'inserimento di testo anziché la scansione del sito web quando i contenuti cambiano frequentemente (ad esempio, notizie o dati in tempo reale), le pagine richiedono l'autenticazione, il sito web è composto principalmente da video o immagini oppure i contenuti non sono strutturati.