> Markdown version of [/jobs/ext/3095613-sr-data-scientist-woodlawn-md-onsite-full-time](https://www.wearedevelopers.com/jobs/ext/3095613-sr-data-scientist-woodlawn-md-onsite-full-time). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Sr. Data Scientist Woodlawn, MD (Onsite) Full time - **Company:** TEK INC - **Location:** Woodlawn, MD, United States - **Experience:** Expert - **Salary:** $143,913.0 - $187,093.0 - **Contract:** Permanent contract - **Skills:** Business Analytics Applications, Big Data, Software Quality, Code Review, Encodings, Data Validation, Data Cleansing, Data Integrity, Data Security, Database Queries, Text Processing, Information Extraction, Information Retrieval, Python (Programming Language), Machine Learning, Named Entity Recognition, Pattern Recognition, Performance Tuning, Regular Expressions, SQL Databases, Enterprise Data Management, Data Processing, Freeform SQL, Sql Optimization, Indexer, Scikit Learn, Spacy, Software Version Control - **Published:** September 26, 2026 - **Apply:** https://www.careerjet.com/jobad/usef778601cb867dece97f935f1d18aba2 ## About the Role Master's and 10+ years of experience, Bachelor's and 12+ years of experience or 18+ years in lieu of a degree Strong practical experience with Natural Language Processing (NLP), Text Processing, and Information Extraction including: Practical knowledge of Named Entity Recognition and Address Standardization to extract and clean unstructured text data. Deep understanding of data matching strategies, including Blocking and Indexing, String Distance Metrics, and Phonetic Encoding. Experience applying TD-IDF and Cosine Similarity for text comparisons and information retrieval. Strong Python development skills for building analytics solutions and manipulating data. Advanced SQL proficiency for complex data querying, optimization, and database operations. Practical experience using Regex for advanced text processing, data cleansing, and pattern matching. Familiarity with specialized libraries and frameworks including: Linkage libraries such as Splink / FastLink, Dedupe, or recordlinkage Core Python data science libraries, specifically spaCy for NLP tasks and Scikit-Learn for general machine learning and clustering Familiarity with code reviews, version control, and maintaining data security and reproducibility standards. Excellent communication skills. ## Description Develop Analytics Solutions: Design, implement, and maintain advanced data processing and entity resolution pipelines using Python and SQL on enterprise data platforms. Data Hygiene & Management: Clean, transform, and manage large-scale datasets from diverse, complex sources, ensuring absolute data integrity, reliability, and security. Performance Optimization: Optimize complex SQL queries and database operations to ensure efficient data access, processing, and scalability. Engineering Standards: Actively participate in code reviews, enforce version control, and uphold best practices for code quality, reproducibility, and data privacy. End-to-End Delivery: Support data validation, testing, deployment, and post-implementation monitoring in a fast-paced environment.