Skip links

Aviso de privacidad sobre el tratamiento de datos personales - Velvet models

Almawave S.p.A. («Almawave» o el «Controlador») desarrolla modelos de inteligencia artificial para el procesamiento de lenguaje natural pertenecientes a la familia Velvet .

Este aviso describe el tratamiento de datos personales relacionados con el desarrollo y entrenamiento de dichos modelos.

Los modelos Velvet también se entrenan con datos de fuentes públicas o terceros. En tales casos, Almawave generalmente no puede identificar ni contactar con los individuos de los datos; por lo tanto, cuando la provisión individual de este aviso resulta imposible o implicaría un esfuerzo desproporcionado, este aviso se pone a disposición pública en la página web del Responsable, conforme al artículo 14(5)(b) del RGPD.

1. Los modelos de terciopelo

La familia Velvet incluye modelos de lenguaje con varias configuraciones, entre ellas:

  • Velvet 14B: un modelo de lenguaje de gran tamaño de 14.000 millones de parámetros, diseñado para análisis complejos y contextos de aplicación avanzados;
  • Velvet 2B: un modelo compacto, optimizado para entornos y despliegues con recursos limitados en infraestructuras ligeras.

Los modelos comparten los mismos métodos de entrenamiento, las mismas categorías de datos utilizadas y propósitos y lógicas operativas similares.
Sus diferencias se refieren únicamente a aspectos técnicos (tamaño, rendimiento, contexto de uso) y no afectan a cómo se procesan los datos personales.

2. Controlador de datos

El responsable de los datos es: Almawave S.p.A.

Responsable de Protección de Datos (DPO): DPO.GruppoAlmaviva@almaviva.it.

3. Propósitos del tratamiento de datos

Los datos personales se procesan en relación con el desarrollo y operación de los modelos Velvet para:

  • entrenar y optimizar modelos de lenguaje;
  • desarrollar capacidades de procesamiento del lenguaje natural, incluyendo:
    • síntesis automática de texto;
    • extracción de información;
    • la generación de respuestas también mediante la integración con fuentes externas (RAG);
    • reformulación y parafraseo;
    • clasificación y análisis semántico;
    • traducción automática;
    • sistemas de respuesta a preguntas;
    • Completación de texto y gestión de conversaciones con múltiples vueltas;
    • Capacidad para hacer inferencias sobre el contenido del texto.

4. Tipo de datos procesados

En el contexto descrito anteriormente, se pueden procesar los siguientes datos:

  • datos personales comunes (por ejemplo, datos de identificación incluidos en textos);
  • navegación de datos y contenido público;
  • los datos incluidos en los conjuntos de datos utilizados para el entrenamiento;
  • en cierta medida, categorías especiales de datos personales, si son expresamente publicadas por los sujetos de datos relevantes.

El procesamiento implica principalmente datos textuales y no está dirigido a recopilar intencionadamente datos personales.

5. Origen de los datos

Los datos personales pueden proceder de:

fuentes accesibles públicamente (conjuntos de datos licenciados de terceros).

6. Base legal

El procesamiento de datos se basa en:

  • Artículo 6(1)(f) RGPD – interés legítimo del Controlador en el desarrollo y mejora de modelos de inteligencia artificial; divulgado«
  • Artículo 9(2)(e) RGPD – para cualquier dato perteneciente a categorías especiales que se haga público de forma manifiesta.

7. Métodos de procesamiento de datos

Los datos se procesan mediante herramientas electrónicas y automatizadas, incluyendo operaciones como:

  • recogida, registro y organización de datos;
  • almacenamiento, modificación, consulta y recuperación.

Los datos personales no se divulgan públicamente.

8. Alcance del procesamiento de datos y uso por terceros

Este aviso se aplica exclusivamente al tratamiento de datos personales realizado por Almawave en relación con el desarrollo, la formación y la provisión de la familia de modelos Velvet.
Una vez que el modelo está disponible, su uso recae en la responsabilidad de la persona que lo implementa y utiliza. Por regla general, Almawave no determina los propósitos ni métodos de ninguna operación de procesamiento realizada por los usuarios y no es el Responsable en relación con dichas operaciones.
Los usuarios del modelo están obligados a verificar que sus operaciones de procesamiento cumplen con las leyes aplicables sobre la protección de datos personales.

9. Almacenamiento de datos

Los datos personales se almacenan para:

  • hasta 2 años en caso de datos en bruto;
  • hasta 5 años en caso de datos procesados o utilizados en procesos de formación.

10. Destinatarios de datos

Los datos pueden ser procesados por:

  • personal interno autorizado (empleados y colaboradores);
  • proveedores de servicios tecnológicos e infraestructuras.

11. Transferencias fuera de la UE

Los datos personales no se transfieren a países fuera de la UE.

12. Medidas de seguridad

Almawave toma las medidas técnicas y organizativas adecuadas, incluyendo las siguientes:

Medidas organizativas

  • definición de roles y responsabilidades (incluido el DPO);
  • políticas internas y formación del personal;
  • gestión de accesos de necesidad de saber;
  • procedimientos de gestión de incidentes y brechas de datos;
  • Control de proveedores.

Medidas técnicas

  • cifrado de datos en reposo y en tránsito;
  • autenticación multifactor (MFA);
  • sistemas de respaldo y recuperación ante desastres;
  • registro y monitorización continua;
  • protección de endpoints;
  • separación entre entornos de desarrollo, prueba y producción mediante anonimización de datos.

13. Derechos de los sujetos de datos

Los sujetos de datos pueden ejercer los derechos establecidos en los artículos 15–22 del RGPD.

Si el Responsable no puede identificar al sujeto de los datos en los datos procesados, puede que no sea posible tramitar la solicitud del primero.
En cualquier caso, el sujeto podrá presentar una queja ante la Autoridad Italiana de Protección de Datos.

14. Naturaleza del procesamiento de datos y límites de los modelos

Los modelos Velvet son sistemas estadísticos que:

  • aprender patrones lingüísticos a partir de datos de entrenamiento;
  • no están diseñados para identificar individuos específicos;
  • No almacenes información personal intencionadamente.

Sin embargo, ocasionalmente se puede generar contenido que puede rastrearse hasta los datos utilizados durante el entrenamiento.

Almawave toma medidas para reducir estos riesgos, incluyendo controles de conjuntos de datos y técnicas de mitigación.

15. Uso por terceros

Si los modelos Velvet se incorporan en soluciones desarrolladas por terceros, el tratamiento de datos personales dentro de dichas soluciones está regulado por las políticas de privacidad de sus respectivos responsables.

16. Actualizaciones

Este aviso puede actualizarse para tener en cuenta cualquier desarrollo regulatorio o tecnológico.