Skip to content
Fecha límite del CBN, 1 ene 2027: 99d 00h 25m restantes.Hable con nosotros
NuxFamily

Seguros · Una aseguradora europea líder

Un lakehouse gobernado para los datos de siniestros y tarificación de una aseguradora

La analítica de la aseguradora funcionaba sobre un warehouse envejecido y un conjunto de data lakes sin gestión ni linaje. NuxFamily entregó un único lakehouse on-premises con catálogo, linaje y control de acceso que satisfizo a la función de auditoría interna.

  • 100 %

    De los informes regulados con linaje de extremo a extremo en el catálogo

  • Ejecuciones de modelos actuariales más rápidas que en el warehouse heredado

  • 0

    Informes perdidos o reescritos durante la transición

El reto

El reto

Los datos de siniestros, pólizas y tarificación residían en un data warehouse heredado que ya no podía escalar, más varios data lakes departamentales construidos sobre almacenamiento de objetos sin catálogo. Los modelos actuariales dependían de extracciones manuales y nadie podía responder con seguridad de dónde procedía una cifra concreta.

Auditoría interna y la oficina de protección de datos exigían linaje, acceso basado en roles a nivel de columna y una política de retención que pudiera aplicarse de verdad. La aseguradora también quería la plataforma on-premises por razones de coste y de residencia de datos.

La migración debía preservar los informes y modelos existentes durante la transición. Los analistas no aceptarían un periodo sin sus cuadros de mando.

La arquitectura

La arquitectura

La capa de warehouse es Greenplum, migrada después a Apache Cloudberry, desplegada como un clúster multisegmento sobre bare metal con segmentos espejados para disponibilidad. Contiene los datos curados y modelados que usan los equipos actuarial y financiero, y responde a la carga de reporting existente sin reescribir consultas.

Los datos en bruto y semiestructurados aterrizan en almacenamiento de objetos compatible con S3 como tablas Apache Iceberg. Iceberg aporta evolución de esquema, viaje en el tiempo y aislamiento por snapshots, y permite que el warehouse y los pipelines basados en Spark lean las mismas tablas sin copias.

OpenMetadata proporciona el catálogo, el linaje a nivel de columna desde los sistemas origen, pasando por los pipelines, hasta los cuadros de mando, pruebas de calidad de datos y el modelo de propiedad que pidió la función de auditoría. Las políticas de acceso se definen una vez en el catálogo y se aplican en los motores de consulta.

OpenSearch indexa los documentos de siniestros y los logs de los pipelines para búsqueda y monitorización operativa. Toda la plataforma se ejecuta sobre Kubernetes para los componentes de servicio y sobre nodos dedicados para los motores de base de datos, con backups y recuperación ante desastres probados trimestralmente.

Tecnologías

  • Greenplum
  • Apache Cloudberry
  • Apache Iceberg
  • OpenMetadata
  • OpenSearch
  • Apache Spark
  • Kubernetes
Por primera vez pudimos mostrar a los auditores de dónde salía un número, paso a paso, sin una hoja de cálculo.
Responsable de Datos, aseguradora europea

Su entidad puede ser el próximo caso

Cuéntenos su plataforma y su calendario regulatorio; le mostraremos cuál de estos patrones aplica.

Sin listas de correo ni seguimientos automáticos. Respondemos personalmente en un día laborable.