> Markdown version of [/jobs/ext/3056116-remote-data-engineer](https://www.wearedevelopers.com/jobs/ext/3056116-remote-data-engineer). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Remote | Data Engineer - **Company:** Mag Llc. - **Location:** New York, NY, United States (Remote available) - **Salary:** $140,000.0 - $180,000.0 - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Amazon Web Services, Big Data, Cloud Computing, Cloud Engineering, Databases, Data as a Services, Data Architecture, Information Engineering, Data Files, Data Infrastructure, Data Systems, Data Visualization, Distributed Computing Environment, Distributed Data Store, Distributed Systems, Systems Analysis, Python (Programming Language), Machine Learning, NoSQL, Operational Databases, Performance Tuning, Standard Sql, Requirements Management, Software Engineering, SQL Databases, Unstructured Data, Data Processing, Scripting, Large Language Models, Apache Spark, Matplotlib, Plotly, Data Management, Data Pipelines - **Published:** September 24, 2026 - **Apply:** https://www.careerbuilder.com/job-details/remote-data-engineer-140-000-180-000-year-new-york-ny--9bdeba0c-a789-419b-8013-a02758ca4105 ## About the Role * Strong professional experience in data engineering or distributed data systems * Advanced proficiency in Python and SQL * Hands-on experience with Apache Spark or comparable distributed-processing frameworks * Strong experience with AWS data services and cloud-native architecture * Experience with SQL and NoSQL databases * Demonstrated experience processing large-scale datasets * Strong understanding of partitioning, performance optimisation, and scalable architecture * Familiarity with orchestration, automation, monitoring, and data-quality workflows * Exposure to AI/ML or research environments is advantageous * Familiarity with LLM training, evaluation, or experimentation datasets is beneficial * Experience with data-visualisation tools such as Matplotlib, Seaborn, or Plotly is a plus, Amazon Web Services (AWS), Apache Spark, Artificial Intelligence (AI), Automation, Cloud Architecture, Cloud Computing, Data Management, Data Processing, Data Quality, Data Science, Data Sets, Data Visualization Tools, Database Technology, Distributed Computing, NoSQL, Performance Tuning/Optimization, Product Programs, Project Evaluation, Python Programming/Scripting Language, Requirements Management, SQL (Structured Query Language), SQL Databases, Sales Pipeline, Scientific Research, Software Engineering, Structured Data, Systems Analysis, Technical Consulting, Unstructured Data ## Description We are sharing a full-time opportunity for an experienced Data Engineer with strong expertise in Python, SQL, Apache Spark, AWS, distributed data processing, and scalable data architecture to build and operate infrastructure supporting AI-driven products and research initiatives. The role will focus on designing and scaling distributed data pipelines, managing large datasets across cloud environments, and building reliable systems for analytics, experimentation, and model development., Data Pipelines & Distributed Processing * Design, build, and maintain large-scale pipelines for structured and unstructured data * Develop distributed processing workflows using Apache Spark or comparable frameworks * Optimise transformations, partitioning strategies, and computational workloads * Identify and resolve performance bottlenecks across high-volume data systems * Support downstream analytics, experimentation, and model-development requirements Cloud Architecture & Data Engineering * Design scalable AWS-based data architectures across SQL and NoSQL systems * Build reliable ingestion, transformation, storage, and distribution workflows * Write efficient Python and SQL for production data processing * Evaluate storage and database technologies against workload requirements * Improve scalability, maintainability, accessibility, and operational efficiency Data Quality, Reliability & AI Support * Implement monitoring, validation, and automation across data workflows * Identify failures, anomalies, and data-quality issues * Maintain integrity and reliability throughout pipelines and storage layers * Collaborate with AI researchers, data scientists, and engineering teams * Support data infrastructure for AI/ML training, evaluation, and experimentation ## Related Videos - [Alibaba Big Data and Machine Learning Technology](https://www.wearedevelopers.com/videos/37-alibaba-big-data-and-machine-learning-technology) - [Leveraging Real time data in FSIs](https://www.wearedevelopers.com/videos/806-leveraging-real-time-data-in-fsis) - [Python Data Visualization @ Deepnote (w/ PyViz overview)](https://www.wearedevelopers.com/videos/113-python-data-visualization-deepnote-w-pyviz-overview) - [PySpark - Combining Machine Learning & Big Data](https://www.wearedevelopers.com/videos/44-pyspark-combining-machine-learning-big-data) - [From Messy Queries to Scalable Systems - How Data Engineering actually works](https://www.wearedevelopers.com/videos/100203-from-messy-queries-to-scalable-systems-how-data-engineering-actually-works) - [NoSQL Data Modeling for Front-end Developers](https://www.wearedevelopers.com/videos/297-nosql-data-modeling-for-front-end-developers) ## Related Articles - [Top Big Data Technologies That You Need to Know](https://www.wearedevelopers.com/magazine/108-top-big-data-technologies-that-you-need-to-know) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Fully Remote Software Engineer Jobs](https://www.wearedevelopers.com/magazine/447-fully-remote-software-engineer-jobs) - [Highest Paying Tech Companies for Developers](https://www.wearedevelopers.com/magazine/220-highest-paying-tech-companies-for-developers) - [How to Become an AI Engineer](https://www.wearedevelopers.com/magazine/331-how-to-become-an-ai-engineer) - [Making Data Warehouses Fast: A Developer’s Story](https://www.wearedevelopers.com/magazine/107-making-data-warehouses-fast-a-developer-s-story)