Data Engineer II
职位介绍
Design and build resilient, scalable data pipelines using Spark (PySpark), Hive/Impala, and SQL to move and transform data at scale.
Orchestrate data workflows with Airflow or NiFi, ensuring reliable scheduling, SLAs, retries, and alerting.
Ingest and integrate data from batch and streaming sources (files, APIs, RDBMS, NoSQL) and support bronze/silver/gold data modeling.
Troubleshoot data quality issues, performance bottlenecks, and lineage problems, and modernize legacy pipelines.
Collaborate with data scientists, analysts, and platform teams to enable self-service analytics and downstream consumption in SQL/NoSQL and BI tools.
Operate in a cloud-enabled environment (Databricks) to deliver large-scale analytical capabilities across global business use cases.
Orchestrate data workflows with Airflow or NiFi, ensuring reliable scheduling, SLAs, retries, and alerting.
Ingest and integrate data from batch and streaming sources (files, APIs, RDBMS, NoSQL) and support bronze/silver/gold data modeling.
Troubleshoot data quality issues, performance bottlenecks, and lineage problems, and modernize legacy pipelines.
Collaborate with data scientists, analysts, and platform teams to enable self-service analytics and downstream consumption in SQL/NoSQL and BI tools.
Operate in a cloud-enabled environment (Databricks) to deliver large-scale analytical capabilities across global business use cases.
查看完整职位
工作职责、任职要求、技能与福利 — 免费创建账号即可查看。
已有账户? 登录
相似职位
其他可能适合您的职位。
远程办公no
城市Gurgaon, 印度