Data Engineer

FinTech LLC
Dallas, TX, United States
1 day ago
Apply on www.indeed.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Compensation
$112,000.0 - $136,000.0
Working hours
Regular working hours
Job source

Tech stack

Java (Programming Language) Adaptable Database Systems Amazon Web Services Business Analytics Applications Application Integration Architecture Bash Shell Big Data Cloud Computing Cloud Database Extract Transform Load (ETL) Data Systems Data Visualization
+30 more
Data Warehousing Database Design Dimensional Modeling Apache Hadoop Hadoop Distributed File System MapReduce Apache Hive Python (Programming Language) Unix Shell Microsoft SQL Server Oracle (Applications) Azure Data Lake Shell Script SQL Databases Data Streaming Systems Integration Talend Unstructured Data Data Storage Technologies Cloud Platform System Informatica Powercenter Apache Spark Backend Integration Frameworks Real Time Data Data Management SQL Server Management Studio (SSMS) Restful APIs Looker Analytics Data Pipelines

Job description

  • Develop, implement, and optimize ETL (Extract, Transform, Load) pipelines to facilitate seamless data flow from diverse sources such as AWS, Azure Data Lake, and on-premises SQL databases.
  • Design and maintain scalable data models and data warehouse architectures using dimensional modeling techniques to support business intelligence and analytics initiatives.
  • Collaborate with cross-functional teams to gather requirements and translate them into efficient data solutions utilizing tools like Informatica, Talend, Apache Hive, Spark, and Hadoop.
  • Manage large-scale big data systems by leveraging technologies such as Hadoop, Spark, and Apache Hive to process vast amounts of structured and unstructured data.
  • Integrate linked data sources and develop RESTful APIs for real-time data access and application integration.
  • Ensure data quality, security, and compliance across all platforms while maintaining optimal query management practices.
  • Support model training, analysis tasks, and business intelligence reporting using Looker or similar visualization tools to deliver clear insights to stakeholders.

Requirements

  • Extensive experience with cloud-based platforms such as AWS, Azure Data Lake, and Public Cloud environments for scalable data storage and processing.
  • Proficiency in programming languages including Java, Python, Bash (Unix shell), and Shell Scripting for automation and pipeline development.
  • Strong knowledge of big data systems like Hadoop ecosystem components (HDFS, MapReduce), Spark, Apache Hive, and related technologies.
  • Expertise in SQL databases such as Microsoft SQL Server, Oracle, SQL Server Management Studio (SSMS), along with experience in SQL query management and database design.
  • Skilled in data management integration tools like Informatica and Talend for efficient ETL pipeline development.
  • Solid understanding of data modeling principles including dimensional modeling for data warehousing design.
  • Familiarity with business intelligence tools such as Looker for creating dashboards and visualizations that support strategic decision-making.
  • Experience with cloud databases like Azure Data Lake or other cloud-native solutions for scalable analytics workloads.
  • Knowledge of RESTful API development for integrating various applications with backend data systems.
  • Strong analysis skills combined with a proactive approach to problem-solving within agile environments to continuously improve data processes.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.indeed.com
Prepare application

Good distractions

Loading talks and stories from around this role…