Data Architect
HF Sinclair · Dallas, TX, US, 75219 · United States · On-site
Sign up free: we match you to jobs like this, tailor your application and fill the form. 2 free applications every day.
Basic Function
HF Sinclair's Data Architect designs and governs secure, scalable, trusted, and reusable enterprise data architecture across the oil and gas value chain. The role translates business and technical needs into target-state and transition architectures spanning source systems, integration, data engineering, cloud platforms, governance, analytics, data products, and AI/ML, while partnering with business, engineering, application, security, infrastructure, governance, analytics, and enterprise architecture teams. The role also architects governed data foundations and reusable services for data science, machine learning, generative AI, and enterprise AI agents.
Job Duties
Define enterprise data principles, standards, reference architectures, roadmaps, reusable patterns, and architecture decision guidance; create conceptual, logical, physical, dimensional, relational, canonical, master-data, and semantic models.
Architect data warehouses, lakes, lakehouses, curated layers, data products, and semantic models that support reporting, Power BI, governed self-service analytics, Streamlit or similar data applications, AI agents, intelligent applications, AI/ML, and advanced analytics.
Define architecture standards for data science, AI/ML, feature engineering, model deployment, monitoring, retraining, and MLOps/LLMOps.
Architect secure AI-agent and generative AI solutions using foundation models, RAG, embeddings, vector search, orchestration, APIs, tools, and human oversight.
Establish reusable AI data services, including governed ingestion, indexing, semantic retrieval, evaluation datasets, and source-to-response traceability.
Partner with data science, ML engineering, application, security, risk, and business teams to operationalize AI solutions with measurable value and governance.
Define responsible AI controls covering privacy, security, safety, evaluation, hallucination testing, explainability, auditability, and production monitoring.
Design end-to-end ingestion, ETL/ELT, replication, transformation, orchestration, and delivery of raw, curated, and analytical data from SAP and other enterprise systems to Snowflake, SAP BW, cloud, and analytics platforms; guide performance, observability, reconciliation, restart, recovery, and maintainable pipeline design.
Establish enterprise integration-backbone standards for API-led, event-driven, application-to-application, B2B, batch, near-real-time, and governed file-based exchange with internal systems, vendors, clients, partners, and financial institutions; define canonical models, schema evolution, encryption, identity, monitoring, auditability, retention, error handling, and service levels.
Govern data ownership, stewardship, critical data elements, metadata, lineage, quality, classification, access, privacy, reference data, master data, and MDM operating-model requirements across refining, commercial, logistics, supply chain, trading, finance, and operations.
…