Skip links

Voice Lab

Un laboratorio especializado en procesamiento de voz, transformando interacciones habladas y comunicaciones multilingües en información accionable que permite automatización inteligente, compromiso con el cliente y análisis de datos.

Donde la voz se convierte enconocimiento

The Voice Lab se basa en la herencia tecnológica de PerVoice, fundada en 2007 como una spin-off de la Fondazione Bruno Kessler y especializada en Reconocimiento Automático de Voz.

Desarrolla tecnologías avanzadas para la percepción visual y la IA multimodal, ayudando a las organizaciones a extraer valor de los datos visuales y transformarlos en conocimiento operativo escalable. Combinando visión por ordenador, procesamiento de imágenes, comprensión documental e IA generativa, el laboratorio ofrece soluciones fiables que apoyan la inspección, monitorización, automatización y acceso a la información en entornos empresariales complejos.

Enfoque distintivo

Fiabilidad

Tecnologías de voz de nivel empresarial diseñadas para un rendimiento rastreable, auditable y medible en flujos de trabajo críticos de comunicación y análisis.

Operaciones listas

Soluciones validadas en despliegues reales, incluyendo monitorización de emisiones, reuniones institucionales, atención al cliente y análisis conversacional a gran escala.

Flexibilidad

Arquitecturas modulares que se integran con múltiples ASR, análisis de altavoces y tecnologías de lenguaje adaptándose a diversos dominios y escenarios de despliegue.

Áreas de enfoque

Reconocimiento de voz y transcripción multilingüe
Desarrollo de soluciones avanzadas de reconocimiento automático de voz, sistemas de transcripción adaptados al dominio y tecnologías de procesamiento multilingüe para reuniones, medios de difusión, entornos institucionales e interacciones con clientes.
01
Modelos Fundacionales de Voz Multimodal
Velvet Speech es un modelo multimodal de habla especializado en reconocimiento automático de voz, traducción de voz, comprensión del habla, resumen de contenido hablado, comprensión auditiva y reconocimiento de emociones en el habla. Está diseñado para realizar estas tareas de forma coherente y fiable en una amplia variedad de temas, entornos acústicos y estilos de habla.
02
Análisis de Hablante e Inteligencia del Lenguaje
Investigación y despliegue de tecnologías de diarización del hablante, identificación del hablante y de identificación del idioma hablado que permitan transcripciones, búsquedas y análisis precisos en comunicaciones multilingües y multihablante.
03
Reconocimiento de emociones en el habla
Desarrollo de sistemas de IA capaces de identificar emociones y dinámicas de interacción a partir del habla, apoyar el análisis de la experiencia del cliente, la monitorización de la calidad del servicio y aplicaciones avanzadas de inteligencia conversacional.
04