Ingeniero de Datos

Hace 1 semana

Colombia Sofka Technologies Jornada completa $ 90 - $ 180 Por obra

¿Estás buscando nuevos desafíos y un lugar donde puedas disfrutar de un ambiente cercano mientras aprendes constantemente?

Prepárate y únete a esta aventura

Bienvenido a un equipo con un propósito claro: "TRANSFORMAR la vida de las personas siendo el aliado TECNOLÓGICO más confiable"

¿Qué encontrarás?

  • Retos técnicos y personales que te mantendrán en constante crecimiento.
  • Un equipo conectado, enfocado en tu bienestar físico y mental.
  • Cultura de mejora continua, fresca y colaborativa, con oportunidades de aprendizaje y gente dispuesta a apoyarte.
  • KaizenHub, un programa diseñado para potenciar tus talentos, con feedback, mentorías y coaching a través de Sofka U. Será un reto y un juego a la vez
  • Programas como Happy Kaizen y WeSofka que cuidan tu bienestar físico y emocional.

¿Qué buscamos?

A un apasionado/a por la ingeniería moderna que combine un dominio sólido de AWS, Databricks y PySpark con el poder de herramientas de Inteligencia Artificial de vanguardia como Claude Code, Copilot y Cursor AI.

Si te motiva resolver problemas complejos de CDC, diseñar arquitecturas Data Lake resilientes y automatizar flujos con soporte de IA para acelerar el desarrollo de productos de datos, este es tu lugar.

Tus Retos e Impacto

  • Construir y optimizar pipelines de datos: diseñarás e implementarás flujos de ingesta y procesamiento altamente escalables sobre infraestructuras de AWS y Databricks.
  • Liderar estrategias de CDC y deduplicación: definirás mecánicas de refresco de datos mediante claves de auditoría, comparación de hashes y estrategias de merge en Delta Lake para garantizar la integridad y frescura de la información.
  • Acelerar la ingeniería con IA: integrarás asistentes como Cursor AI, Copilot y Claude Code en tu día a día para agilizar la entrega de productos de datos, dashboards y código de alto rendimiento.
  • Modelado e ingesta estratégica: interpretarás modelos de datos complejos para diseñar ciclos de ingesta eficientes alineados con las mejores prácticas de Data Governance.
  • Evolucionar la arquitectura de Data Lake: trabajarás de la mano con frameworks modernos (Delta Lake, Hudi o Iceberg) garantizando un entorno gobernado, rápido y seguro.

¿Qué necesitas?

  • Experiencia sólida: 4 a 6 años de trayectoria comprobada en Ingeniería de Datos y desarrollo de procesos ETL.
  • Stack Principal: dominio profundo de Python, SQL y PySpark.
  • Ecosistema Cloud (AWS): manejo práctico comprobado en Lambda, RDS, EC2 y SQS.
  • Arquitectura moderna de Data Lakes: experiencia sólida trabajando con Delta Lake (o alternativas como Apache Hudi / Iceberg).
  • Conceptos de CDC a nivel experto: capacidad clara para explicar e implementar ciclos de Change Data Capture, comparación de valores hash para deduplicación y estrategias de merge.
  • Ingeniería asistida por IA: uso activo y cómodo de herramientas de desarrollo con IA (Claude Code, Co-Pilot, Cursor AI) para optimizar tus entregables.
  • Idiomas: inglés fluido (C1 / 100%), capaz de comunicarse con precisión técnica en entornos globales.
  • Dominio avanzado de la plataforma Databricks.
  • Experiencia previa diseñando y construyendo Frameworks de ETL desde cero.
  • Familiaridad con herramientas de Gobernanza de Datos impulsadas por IA (ej. Data Galaxy, Databricks AI).

Condiciones

  • Contrato tipo Contractor/Honorarios
  • ¿Buscas crecimiento profesional? En Sofka, te ofrecemos un ecosistema de aprendizaje con múltiples herramientas para cerrar brechas y potenciar tus habilidades. Tú decides cómo quieres crecer