Ingeniero de Datos Mid
Modalidad: A definir según proyecto
Jornada: Tiempo completo
Senioridad: Mid
Sector: Seguros
Misión del puesto
Desarrollar y mantener soluciones de ingeniería de datos que permitan modernizar información proveniente de sistemas legados, transformándola en datos confiables, homologados y consumibles dentro de Google Cloud Platform.
La posición participará en la extracción, transformación e integración de información proveniente principalmente de bases MultiValue hacia BigQuery, colaborando en la construcción de pipelines y reglas de homologación que aseguren la calidad y disponibilidad de los datos.
Objetivos principales
1. Integrar fuentes de datos legadas
Participar en la extracción y transformación de información proveniente de sistemas MultiValue y otras plataformas legacy.
2. Construir pipelines de datos
Desarrollar y mantener procesos ETL/ELT confiables, automatizados y monitoreables.
3. Implementar homologaciones
Analizar estructuras de origen y aplicar reglas de transformación, normalización y homologación de información.
4. Gestionar información en BigQuery
Construir consultas, transformaciones y estructuras de datos que faciliten el consumo eficiente de la información.
5. Orquestar procesos
Desarrollar y mantener workflows mediante Cloud Composer / Apache Airflow.
6. Garantizar calidad de datos
Implementar validaciones para identificar inconsistencias, duplicados, datos incompletos y diferencias entre origen y destino.
7. Automatizar procesos
Utilizar Python y herramientas Cloud para reducir tareas manuales y mejorar la confiabilidad de los pipelines.
8. Colaborar con equipos multidisciplinarios
Trabajar con perfiles de datos, desarrollo y negocio para comprender reglas de información y asegurar que las transformaciones respondan correctamente a las necesidades del proyecto.
Responsabilidades principales
- Extraer información desde bases de datos MultiValue.
- Desarrollar transformaciones y cargas hacia BigQuery.
- Implementar reglas de homologación entre modelos legacy y estructuras modernas.
- Crear consultas SQL avanzadas.
- Desarrollar y mantener Stored Procedures y UDFs.
- Construir y mantener DAGs en Cloud Composer / Apache Airflow.
- Participar en procesos de integración mediante Cloud Data Fusion.
- Utilizar Google Cloud Storage dentro de los flujos de procesamiento.
- Desarrollar automatizaciones y scripts utilizando Python.
- Implementar validaciones y controles de calidad de datos.
- Investigar inconsistencias entre sistemas origen y destino.
- Dar mantenimiento y soporte a pipelines existentes.
- Participar en optimizaciones de rendimiento y consumo de recursos.
- Documentar procesos, transformaciones, reglas de homologación y dependencias.
- Colaborar en revisiones técnicas y sesiones de refinamiento.
Perfil ideal
Buscamos un(a) Ingeniero(a) de Datos Mid con experiencia práctica construyendo pipelines y trabajando con información proveniente de sistemas legados.
Es importante que pueda comprender estructuras de datos complejas, investigar inconsistencias y convertir información histórica en modelos utilizables dentro de plataformas modernas.
No esperamos que sea responsable de definir por sí solo toda la arquitectura de datos del proyecto, pero sí que tenga suficiente experiencia para desarrollar soluciones con autonomía técnica, identificar riesgos, proponer mejoras y ejecutar correctamente las definiciones establecidas por el equipo.
La experiencia práctica con bases de datos MultiValue es indispensable.
RequisitosFormación
- Ingeniería en Sistemas Computacionales.
- Ingeniería de Software.
- Ciencias de la Computación.
- Tecnologías de la Información.
- Ingeniería de Datos.
- Informática o carreras afines.
Experiencia
- 3+ años de experiencia en Ingeniería de Datos o posiciones relacionadas.
- Experiencia comprobable trabajando con bases de datos MultiValue.
- Experiencia desarrollando pipelines de datos.
- Experiencia trabajando con sistemas legacy.
- Experiencia práctica con BigQuery.
- Conocimiento de procesos ETL / ELT.
- Experiencia con herramientas de orquestación.
- Experiencia trabajando con Google Cloud Platform.
- Capacidad para trabajar sobre desarrollos existentes y participar en su evolución.
ConocimientosBases de datos Legacy – Indispensable
- MultiValue Databases.
- Extracción de información desde sistemas MultiValue.
- Interpretación de estructuras de datos legacy.
- Mapeo y homologación de información.
La experiencia real con MultiValue es un requisito crítico para la posición.Google Cloud Platform
- BigQuery.
- Cloud Composer.
- Cloud Data Fusion.
- Google Cloud Storage.
BigQuery / SQL
- SQL avanzado.
- Joins.
- CTEs.
- Window Functions.
- Transformaciones.
- Stored Procedures.
- UDFs.
- Optimización de consultas.
- Particionamiento y clustering.
Orquestación
- Apache Airflow.
- Cloud Composer.
- Desarrollo y mantenimiento de DAGs.
- Scheduling.
- Dependencias.
- Retries.
- Manejo de errores.
- Monitoreo de ejecuciones.
Desarrollo y automatización
- Python.
- Scripting.
- Automatización.
- Manipulación y validación de datos.
Ingeniería de Datos
- ETL / ELT.
- Data Pipelines.
- Data Integration.
- Data Transformation.
- Data Mapping.
- Data Homologation.
- Data Validation.
- Data Quality.
- Data Reconciliation.
- Data Modeling.
- Data Warehousing.
Conocimientos deseables
- Oracle Database.
- dbt.
- Dataform.
- Git.
- CI/CD aplicado a Data Engineering.
- Experiencia en proyectos de migración o modernización hacia GCP.
- Experiencia con grandes volúmenes de información.
Conocimiento de industria
Será especialmente valorada la experiencia en:
- Seguros.
- Insurtech.
- Servicios financieros.
- Banca.
- Organizaciones que trabajen con sistemas core o plataformas legacy.
Competencias
- Pensamiento analítico.
- Resolución de problemas.
- Atención al detalle.
- Proactividad.
- Autonomía.
- Capacidad de investigación.
- Comunicación efectiva.
- Trabajo colaborativo.
- Organización.
- Adaptabilidad.
- Orientación a calidad.
- Aprendizaje continuo.
- Ownership sobre sus entregables.
Lo que valoramos especialmente en rocket code
Buscamos personas que disfruten entender problemas de datos complejos y que no se limiten únicamente a mover información entre plataformas.
En este proyecto será importante comprender cómo está estructurada la información dentro de sistemas legados, detectar inconsistencias y transformarla correctamente hacia un ecosistema moderno de datos.
Valoramos perfiles con curiosidad tecnológica, buenas bases de ingeniería y disposición para seguir desarrollando su experiencia en Google Cloud, Data Engineering y modernización de plataformas legacy.
Sueldo: $25,000.00 - $30,000.00 al mes
Lugar de trabajo: Empleo presencial