FREE ACCESS
5,000–10,000 jobs/day
See all jobs on Scoutfield
Search thousands of fresh jobs every day.
Discover
- Fresh listings
- Fast filters
- No subscription required
Create a free account and start exploring right away.
Core Competencies
Role fitCore Competencies
Use this summary to align your resume positioning with the role.
Demonstrates expertise in building and operating data infrastructure for clinical trial design, including proficiency in Python, SQL, and AWS services. Capable of implementing data quality validation and developing data-serving APIs while ensuring compliance with regulatory standards.
Highest-signal resume keywords
Python DevelopmentPostgreSQL-Compatible SQLGraph Database ExperienceData-Serving API DevelopmentClinical Data Quality Validation
ATS Keywords
Tailor your resumeApplicant Tracking System Keywords
Tip: use these terms in your resume and cover letter to boost ATS matches.
Hard Skills
PDF ParsingText ExtractionRelational Data ModelingKnowledge Graph ModelingETL/ELT WorkflowsSPARQLCypherEmbedding ModelsData Lineage TrackingRegulatory Compliance
Tools & Technologies
Amazon AuroraFastAPILangGraphAirflowTerraformDockerGitAWS LambdaAWS S3AWS Step Functions
Industry Keywords
Clinical Trial DesignBiomedical EntitiesClinical Data Standards21 CFR Part 11EU Annex 11ALCOA+ PrinciplesMeSHMedDRASNOMEDCDISC
Tech Stack
Tools & technologiesAirflowAngularAWSDockerETLNeo4jPostgresPythonSQLTerraform
About the role
Key responsibilities & impact- Design, build, and operate data infrastructure for a clinical trial design platform
- Build ingestion pipelines for clinical trial protocols, ICF documents, SmPCs, CSRs, and published articles from PubMed, CTIS, and ClinicalTrials.gov
- Handle PDF parsing, text extraction, and structured data normalization
- Design and implement relational and knowledge graph data models in Amazon Aurora and GraphDB
- Develop embedding and vectorization pipelines for RAG-based retrieval in LangGraph agentic workflows
- Build and maintain ETL/ELT workflows that transform unstructured clinical content into queryable, linked data
- Implement clinical data quality validation, including protocol section classification, entity extraction completeness, and cross-reference integrity
- Build data-serving APIs with Python/FastAPI for Angular frontend and LangGraph agent-layer integration
- Set up data lineage tracking and audit trails to support regulatory traceability of AI-generated trial design recommendations
Requirements
What you’ll need- Strong Python development experience, including PDF/document parsing libraries such as PyMuPDF, pdfplumber, unstructured.io, or similar
- Advanced PostgreSQL-compatible SQL, including Amazon Aurora; experience with schema design, migrations, query optimization, and indexing strategies for large clinical datasets
- Hands-on experience with Neptune, Neo4j, or similar graph databases
- Proficiency in SPARQL or Cypher
- Experience with ontology and knowledge graph modeling for biomedical entities
- Experience with AWS services including Aurora PostgreSQL, S3, Lambda, Step Functions, SQS/SNS, and IAM
- Experience with PDF text extraction, document section classification, and named entity recognition (NER) for clinical/biomedical text
- Familiarity with embedding models and vector stores such as OpenSearch, pgvector, or Pinecone
- Experience building data-serving APIs using FastAPI, including asynchronous programming patterns and backend integration
- Experience preparing data for LangChain/LangGraph applications and designing RAG pipelines, including chunking, retrieval, reranking, and prompt-data integration
- Experience with Airflow, Prefect, AWS Step Functions, Temporal, or similar workflow orchestration tools
- Ability to design multi-stage DAGs with dependency management, retry logic, monitoring, and error handling
- Experience with Terraform or AWS CDK, Docker, and Git, including automated pipeline testing and deployment on AWS
- Understanding of clinical trial structure, including protocol sections, objectives, endpoints, eligibility criteria, study design, and statistical considerations
- Familiarity with clinical data standards or terminologies such as MeSH, MedDRA, SNOMED, ATC codes, or CDISC is a strong plus
- Awareness of regulatory data integrity requirements, including 21 CFR Part 11, EU Annex 11, and ALCOA+ principles
Benefits
Comp & perks- Accrued vacation
- Medical insurance
- Dental insurance
- Vision insurance
- 401(k) with company matching
- Life insurance
- Flexible spending accounts
- Equal opportunity employment and diversity commitment
