🇪🇸 Español
Descripcion del puesto
En #UPC creemos que la innovación nace del ser y pensar diferente, incorporando acciones que promuevan el cambio. ¡Contribuye con el equipo que lidera la transformación del país!Nos encontramos en la búsqueda de: Especialista de Integración de DatosMISIÓN:Responsable del diseño, construcción y mantenimiento de los sistemas de gestión de datos y pipelines dentro del Data Warehouse, para procesar, transformar y almacenar volúmenes de información, reduciendo el impacto en los proyectos de inteligencia de negocios, optimizando el rendimiento del procesamiento de los datos y asegurando la calidad y seguridad de los mismos.FORMACIÓN Y EXPERIENCIABachiller en Ingeniería de Sistemas, Informática, Ciencia de Datos, Administración o carreras afines.Seminario, cursos, talleres de temas relacionados a Inteligencia de NegociosExperiencia en implementación de Soluciones de Inteligencia de Negocios – mínima de 3 años.Experiencia en análisis técnico de carga de información.Experiencia en integración de información de múltiples plataformas - mínimo 3 años.Experiencia en gestión y toma de requerimientos - mínima de 1 año.Experiencia como modelador de datos – mínima de 2 años.Experiencia en Gestión de Base de Datos - mínima de 1 año.CONOCIMIENTOSDominio del lenguaje PL/SQL (Oracle-SQL Server).Conocimiento de herramientas de Inteligencia de Negocios clase mundial.Conocimiento de plataformas de integración de datos, Datastage o Power CenterConocimiento en plataformas ETL/ELT y BI en la nube, preferentemente en Azure Data Factory, Synapse Pipelines y Databricks.Conocimiento profundo de bases de datos relacionales (como PostgreSQL, MySQL) y NoSQL (como MongoDB, Cassandra).Familiaridad con plataformas de nube como AWS, Azure, Google Cloud Platform, y experiencia en despliegue y gestión de infraestructura en la nube.Integración de Spark con Azure Synapse SQL (dedicated/serverless): intercambio de datos vía Parquet/Delta, CETAS, PolyBase y tablas externas.Orquestación de notebooks con Azure Data Factory, Synapse Pipelines o Databricks: paso de parámetros, triggers, reintentos, logging y monitoreo.Manejo de notebooks en Azure Synapse (Spark Pools), Jupyter o Databricks: parametrización, versionamiento con Git y ejecución orquestada.Conocimiento avanzado en Apache Spark y Spark SQL para procesamiento distribuido de grandes volúmenes de datos.FUNCIONES DEL PUESTOResponsables de diseñar y desarrollar arquitecturas de datos escalables y eficientes que puedan manejar grandes volúmenes de datos y satisfacer las necesidades del negocio.Implementar mecanismos de control de calidad de datos para garantizar la integridad, precisión y consistencia de los datos, así como la detección y corrección de errores.Implementar medidas de seguridad para proteger los datos sensibles y garantizar el cumplimiento de las regulaciones de privacidad y seguridad.Colaborar estrechamente con científicos de datos, analistas, ingenieros de software y otros miembros del equipo para comprender los requisitos de datos y proporcionar soluciones técnicas adecuadas.Monitorear el rendimiento y la disponibilidad de los sistemas de datos, así como realizar tareas de mantenimiento preventivo y correctivo para garantizar la continuidad del negocio.Gestionar la automatización de los indicadores de la organización.Plantear proyectos que permitanreforzar , mejorar y ampliar el alcance del Data Warehouse.Construir Notebooks y Jobs distribuidos con Apache Spark ejecutados en Synapse Spark Pools o Databricks, para la ingesta, transformación y almacenamiento en ADLS Gen2, utilizando formatos columnares Parquet y Delta Lake.Integrar fuentes heterogéneas (SQL Server/Oracle, archivos, APIs y servicios en la nube) mediante conectores Spark, asegurando disponibilidad, calidad y trazabilidad.Identificar y resolver cuellos de botella en Jobs Spark aplicando tuningAutomatizar y orquestar notebooks PySpark/Spark SQL desarrollados en Azure Synapse (Spark Pools) o Databricks, mediante Azure Data Factory, Synapse Pipelines o Databricks Workflows; incluyendo parametrización, control de versiones, logging y alertas, así como la aplicación de buenas prácticas de seguridad (Managed Identity, Key Vault, RBAC/ACLs en ADLS).BENEFICIOS:Contrato en planillaTrabajo Remoto (con disponibilidad de asistir 1 vez al mes a oficina o según necesidad)Seguro Vida Ley desde el primer día de inicio de laboresDescuentos CorporativosDescuentos Educativos en toda la red LaureateEPS al 50% y Seguro Oncológico al 100%. Show more Show less