Hadoop Architect

VDart, Inc.
Plano, TX, United States
about 1 month ago
Apply on www.careerjet.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
7 years minimum
Compensation
$96,021.0 - $124,827.0
Working hours
Regular working hours

Tech stack

Airflow Amazon S3 Apache HTTP Server Batch Processing Big Data Cloud Computing Cloudera Impala Continuous Integration Data Architecture Data Governance Data Security Software Design Patterns
+36 more
Disaster Recovery Memory Management Apache Hadoop Hadoop Distributed File System MapReduce Monitoring of Systems Apache Hive Kerberos (Protocol) Meta-Data Management Node.Js Performance Tuning Cloudera Scala (Programming Language) SQL Databases Data Streaming Backup and Restore Workflow Management Systems Parquet Data Logging Apache Yarn System Availability Apache Spark Software Troubleshooting Change Data Capture Event Driven Architecture Data Lakes Pyspark Data Lineage Optimization Algorithms AWS Glue Real Time Data Apache Kafka Functional Programming Data Pipelines Amazon Elastic Mapreduce (EMR) Databricks

Job description

Seeking a Senior Specialist with 7 to 11 years of experience in Data Architecture to provide data driven solutions, Looking for someone who is familiar with the below areas and Design develop and maintain robust data architecture frameworks to support data requirements and translate them into scalable data solutions Skills: HDFS Architecture, Name Node High Availability HA, HDFS Federation, Rack Awareness, HDFS Read Write Flow, YARN Architecture, Capacity Scheduler, Fair Scheduler, Resource Management Queue Design, Map Reduce Architecture, Shuffle and Sort, Apache Spark Architecture, Spark DAG Execution Plan, Spark Performance Tuning, Memory Management in Spark, Adaptive Query Execution AQE, Hive Architecture, Hive Metastore, Hive Optimization Techniques, Partitioning Bucketing ORC Parquet Internals, Impala Architecture, Apache Kafka Architecture, Kafka Performance Tuning, Kafka Security, Streaming Architectures, CDC Change Data Capture, Apache Airflow Architecture, Workflow Orchestration, Data Lake Architecture, Lakehouse Architecture, Delta Lake Fundamentals, Data Modelling for Big Data, ETLELT Framework Design, Data Governance, Data Lineage, Metadata Management, Kerberos Authentication, Apache Ranger, Apache Knox, Encryption Security Best Practices, Cloudera CDP Architecture, AWS EMR, AWS Glue S3 Architecture Optimization, Databricks Architecture, CICD for Data Pipelines, Monitoring Observability, Logging Frameworks, Cluster Sizing Capacity Planning, Disaster Recovery DR, Backup Recovery Strategies, High Availability Design, Multitenancy Design, Data Quality Frameworks, Performance Troubleshooting, Data Skew Handling Join Optimization Techniques Small File Problem, Cost Optimization, Real-time Data Pipeline Design, Batch Processing Architecture, Event Driven Architecture, Lambda Architecture, End-to-end Solution Architecture, Migration from OnPrem Hadoop to Cloud, Scalability Reliability Design Patterns, System Design for Big Data Platforms, Architecture Trade-offs and Decision Making, SQL, PySpark Scala Coding, Job Description In the assigned Job Role of Architecture Consultant 2, your Area Of Responsibility will be as below: Participate in customer discussions to gather and analyze…

  • 17 hours ago

Requirements

Job Summary Seeking a Senior Specialist with 7 to 11 years of experience in Data Architecture to provide datadriven solutions Job Description Looking for someone who is familia…

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.careerjet.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:15 min

Empowering domain teams with an open data platform

Sandhya Menon Sandhya Menon · World Congress 2026 Europe

1:28 min

Building shared Java modules and analyst targeting platforms

Chris Heilmann +2 · LIVE

2:50 min

How Parquet metadata enables efficient data reading

Matthias Niehoff Matthias Niehoff · World Congress 2026 Europe

4:32 min

Harnessing Spark with Python using PySpark and Py4J

Ayon Roy · LIVE

2:57 min

Core technical practices for robust data engineering

Sandhya Menon Sandhya Menon · World Congress 2026 Europe

2:03 min

Introduction to open table formats built on Parquet

Matthias Niehoff Matthias Niehoff · World Congress 2026 Europe

Videos

See all

Related articles

See all