Skip links

Vision & PerceptionLab

Un laboratorio especializado en comprensión visual impulsada por IA, transformando imágenes, vídeos, documentos y contenido multimodal en información accionable que permite la automatización inteligente, la monitorización operativa y la toma de decisiones empresariales.

Donde las imágenes se convierten  enconocimento

El Vision & Perception Lab desarrolla tecnologías avanzadas para la percepción visual y la IA multimodal, ayudando a las organizaciones a extraer valor de los datos visuales y transformarlos en conocimiento operativo escalable. Combinando visión por ordenador, procesamiento de imágenes, comprensión documental e IA generativa, el laboratorio ofrece soluciones fiables que apoyan la inspección, monitorización, automatización y acceso a la información en entornos empresariales complejos.

Enfoque distintivo

Comprensión Visual Profunda

Un enfoque orientado al detalle que preserva la riqueza contextual, estructural y semántica de la información visual, desde flujos de vídeo hasta complejos diseños de documentos.

Operaciones listas

Tecnologías moldeadas por despliegues reales, que aseguran robustez, escalabilidad y valor empresarial medible en entornos de producción.

Flexibilidad

Una arquitectura modular que permite la adaptación entre industrias, fuentes de datos y escenarios de despliegue, al tiempo que apoya la integración y evolución continuas.

Fiabilidad

Soluciones diseñadas para la fiabilidad de nivel empresarial, ofreciendo resultados rastreables, verificables y auditables que apoyan procesos operativos críticos.

Áreas de enfoque

Tráfico, Infraestructura y Analítica de Movilidad
Desarrollo de soluciones de visión por ordenador para monitorizar intersecciones, activos, vehículos, infraestructuras y eventos críticos en carreteras urbanas y extraurbanas, permitiendo una movilidad más segura, una mejor gestión del tráfico y operaciones de infraestructuras más eficientes.
01
IA de documentos y comprensión de la maquetación
Tecnologías avanzadas de comprensión documental que transforman archivos complejos, escaneos y documentos visuales en conocimiento empresarial estructurado y accionable.
02
Modelos Fundacionales Multimodales
Investigación y desarrollo de sistemas de IA multimodales, incluyendo contribuciones a Velvet, que combinan comprensión visual y lingüística para permitir una interacción más natural con la información empresarial y la automatización inteligente.
03
Salud y Seguridad Ocupacional
Desarrollo de soluciones de monitorización visual impulsadas por IA que apoyan la seguridad laboral identificando condiciones peligrosas, detectando comportamientos inseguros, supervisando el cumplimiento de los procedimientos de seguridad y permitiendo una prevención proactiva de riesgos en entornos industriales y operativos.
04