AI/ML Engineer
Remote
Job Summary
Build and maintain reliable ingestion pipelines using Snowflake Openflow, Python, and Snowflake, including API, PostgreSQL, and CDC-based integrations. Develop incremental synchronization, cursor/state management, retry logic, schema-drift handling, and soft-delete propagation to transform raw source data into trusted datasets. Implement monitoring and alerting for ingestion failures, pipeline freshness, schema changes, data-quality failures, model drift, and inference degradation. Establish automated regression testing for dbt models, features, evaluation datasets, prompts, and model outputs. Collaborate with Product and Engineering to ship AI-powered features into the GLOBO platform by building and deploying LLM integrations and agentic workflows. Monitor and optimize Snowflake compute, storage, query performance, dbt execution, and model-inference costs.
Required Qualifications
- Snowflake Openflow
- Python
- Snowflake
- API
- PostgreSQL
- CDC-based integrations
- incremental synchronization
- cursor/state management
- retry logic
- schema-drift handling
- soft-delete propagation
- source-to-target reconciliation
- data-quality checks
- freshness
- completeness
- uniqueness
- referential integrity
- business-rule compliance
- source definitions
- model documentation
- lineage
- metadata
- data contracts
- PII/PHI classification
- masking
- retention
- deletion requirements
- monitoring and alerting
- ingestion failures
- pipeline freshness
- schema changes
- data-quality failures
- transformation errors
- model drift
- inference degradation
- automated regression testing
- dbt models
- features
- evaluation datasets
- prompts
- model outputs
- sensitive data masking
- redaction
- access-control
- PII/PHI safeguards
- redaction and deletion workflows
- AI/ML outputs traceability
- source data
- model version
- prompt version
- feature set
- evaluation results
- recovery procedures
- data-quality escalation paths
- operational runbooks
- human review and approval
- LLM integrations
- AWS Bedrock
- Anthropic Claude
- agentic workflows
- CrewAI
- LangChain
- production-quality code
- tests
- documentation
- error handling
- guardrails
- AI services monitoring
- AI services alerting
- consistent and trustworthy AI outputs
- evaluation datasets
- prompt versioning
- regression testing
- Snowflake compute optimization
- storage optimization
- query performance optimization
- dbt execution optimization
- Openflow runtime usage optimization
- model-inference costs optimization
- incremental models
- CDC pipelines
- materializations
- clustering strategies
- warehouse/task schedules
- ingestion costs optimization
- full refresh reduction
- duplicate processing reduction
- excessive data movement reduction
- inefficient feature recomputation reduction
- model selection optimization
- prompt size optimization
- token usage optimization
- batching optimization
- caching optimization
- inference frequency optimization
- routing between model providers optimization
- model performance measurement
- operational cost measurement
- latency measurement
- throughput measurement
- data-freshness requirements
- service-level targets
Hiring someone like this?
Get your role in front of qualified candidates on Sorce.