Skip links

Voice Lab

Un laboratorio specializzato nell’elaborazione del parlato, che trasforma interazioni vocali e comunicazioni multilingue in informazioni operative, abilitando automazione intelligente, customer engagement e analisi dei dati.

Dove il parlato si trasforma indati di valore per il business.

Il Voice Lab si fonda sull’eredità tecnologica di PerVoice, nata nel 2007 come spin-off della Fondazione Bruno Kessler e specializzata nel riconoscimento automatico del parlato.

Sviluppa tecnologie avanzate per l’elaborazione del parlato e l’analisi conversazionale multimodale, aiutando le organizzazioni a estrarre valore dai dati vocali e a trasformarli in conoscenza operativa scalabile. Combinando riconoscimento automatico del parlato e traduzione, diarizzazione e identificazione del parlante, identificazione della lingua e riconoscimento delle emozioni nel parlato, il laboratorio offre soluzioni affidabili a supporto dell’accesso alle informazioni, dell’analisi dei dati e dell’interazione in tempo reale con agenti AI.

Distinctive Approach

Reliability

Tecnologie vocali di livello enterprise, progettate per garantire prestazioni tracciabili, verificabili e misurabili nei flussi di comunicazione e analisi mission-critical.

Operations Ready

Soluzioni validate in contesti reali, tra cui monitoraggio broadcast, riunioni istituzionali, customer care e analisi conversazionale su larga scala.

Flexibility

Architetture modulari che si integrano con molteplici tecnologie di riconoscimento automatico del parlato, analisi del parlante e analisi linguistica, adattandosi a diversi domini e scenari di deployment.

Focus Areas

Riconoscimento del parlato e trascrizione multilingue
Sviluppo di soluzioni avanzate di riconoscimento automatico del parlato, sistemi di trascrizione adattati a specifici domini e tecnologie di elaborazione multilingue per riunioni, media broadcast, ambienti istituzionali e interazioni con i clienti.
01
Foundation model multimodali per il parlato
VelvetSpeech è un modello multimodale speech-language specializzato in riconoscimento automatico del parlato, traduzione del parlato, comprensione del parlato, sintesi di contenuti vocali, listening comprehension e riconoscimento delle emozioni nel parlato. È progettato per svolgere questi compiti in modo coerente e affidabile in un’ampia varietà di prompt, ambienti acustici e stili di parlato.
02
Speaker analytics e language intelligence
Ricerca e implementazione di tecnologie di diarizzazione del parlante, identificazione del parlante e identificazione della lingua parlata, che abilitano trascrizioni, ricerche e analisi accurate in comunicazioni multilingue e multi-speaker.
03
Riconoscimento delle emozioni nel parlato
Sviluppo di sistemi AI capaci di identificare emozioni e dinamiche di interazione a partire dal parlato, a supporto dell’analisi della customer experience, del monitoraggio della qualità del servizio e di applicazioni avanzate di conversational intelligence.
04