Data Engineer
Confidential · NAMER · 2 wk ago
RemoteRemoteAdministrativePart-time
About the role
We are seeking experienced Data Engineers to contribute to projects focused on evaluating and improving next-generation AI coding systems. In this role, you will work with advanced AI coding agents on realistic data engineering tasks and evaluate the quality, correctness, scalability, and reliability of their outputs. You will apply your professional engineering judgment to complex data workflows and provide structured feedback that helps improve AI systems.
Responsibilities
- Use advanced AI coding agents to complete and evaluate complex data engineering tasks.
- Review AI-generated implementations involving ETL/ELT pipelines, data warehouses, analytics platforms, and distributed data systems.
- Identify bugs, edge cases, performance and scalability issues, reliability concerns, and potential failure modes.
- Compare outputs from multiple AI models and assess their technical strengths, weaknesses, and effectiveness.
- Evaluate data engineering solutions against real-world production standards and best practices.
- Apply professional engineering judgment to realistic data architecture, pipeline, processing, and infrastructure scenarios.
- Provide detailed technical feedback to support the improvement of AI coding models.
- Document findings and evaluation results clearly and consistently.
Qualifications
- 2+ years of professional experience in Data Engineering or a closely related field.
- Hands-on experience designing and building ETL/ELT pipelines, data warehouses, analytics platforms, or distributed data systems.
- Experience with modern data engineering technologies, cloud platforms, databases, orchestration tools, or data processing frameworks.
- Regular experience using AI coding agents such as Cursor, Claude Code, Codex, Windsurf, Gemini CLI, or similar tools.
- Ability to critically evaluate AI-generated data infrastructure, pipelines, queries, and implementations.
- Strong understanding of data quality, pipeline reliability, scalability, performance optimization, and distributed systems.
- Experience operating or supporting large-scale data platforms is preferred.
- Strong analytical, troubleshooting, and problem-solving skills.