Globo Language Solutions logo
Globo Language SolutionsPosted 2 weeks ago

AI/ML Engineer

Remote

Full TimeMid LevelMedium

Job Summary

Build and maintain reliable ingestion pipelines using Snowflake Openflow, Python, and Snowflake, including API, PostgreSQL, and CDC-based integrations. Develop incremental synchronization, cursor/state management, retry logic, schema-drift handling, and soft-delete propagation to transform raw source data into trusted datasets. Implement monitoring and alerting for ingestion failures, pipeline freshness, schema changes, data-quality failures, model drift, and inference degradation. Establish automated regression testing for dbt models, features, evaluation datasets, prompts, and model outputs. Collaborate with Product and Engineering to ship AI-powered features into the GLOBO platform by building and deploying LLM integrations and agentic workflows. Monitor and optimize Snowflake compute, storage, query performance, dbt execution, and model-inference costs.

Required Qualifications

  • Snowflake Openflow
  • Python
  • Snowflake
  • API
  • PostgreSQL
  • CDC-based integrations
  • incremental synchronization
  • cursor/state management
  • retry logic
  • schema-drift handling
  • soft-delete propagation
  • source-to-target reconciliation
  • data-quality checks
  • freshness
  • completeness
  • uniqueness
  • referential integrity
  • business-rule compliance
  • source definitions
  • model documentation
  • lineage
  • metadata
  • data contracts
  • PII/PHI classification
  • masking
  • retention
  • deletion requirements
  • monitoring and alerting
  • ingestion failures
  • pipeline freshness
  • schema changes
  • data-quality failures
  • transformation errors
  • model drift
  • inference degradation
  • automated regression testing
  • dbt models
  • features
  • evaluation datasets
  • prompts
  • model outputs
  • sensitive data masking
  • redaction
  • access-control
  • PII/PHI safeguards
  • redaction and deletion workflows
  • AI/ML outputs traceability
  • source data
  • model version
  • prompt version
  • feature set
  • evaluation results
  • recovery procedures
  • data-quality escalation paths
  • operational runbooks
  • human review and approval
  • LLM integrations
  • AWS Bedrock
  • Anthropic Claude
  • agentic workflows
  • CrewAI
  • LangChain
  • production-quality code
  • tests
  • documentation
  • error handling
  • guardrails
  • AI services monitoring
  • AI services alerting
  • consistent and trustworthy AI outputs
  • evaluation datasets
  • prompt versioning
  • regression testing
  • Snowflake compute optimization
  • storage optimization
  • query performance optimization
  • dbt execution optimization
  • Openflow runtime usage optimization
  • model-inference costs optimization
  • incremental models
  • CDC pipelines
  • materializations
  • clustering strategies
  • warehouse/task schedules
  • ingestion costs optimization
  • full refresh reduction
  • duplicate processing reduction
  • excessive data movement reduction
  • inefficient feature recomputation reduction
  • model selection optimization
  • prompt size optimization
  • token usage optimization
  • batching optimization
  • caching optimization
  • inference frequency optimization
  • routing between model providers optimization
  • model performance measurement
  • operational cost measurement
  • latency measurement
  • throughput measurement
  • data-freshness requirements
  • service-level targets

Hiring someone like this?

Get your role in front of qualified candidates on Sorce.

Get started

Apply to this job in one click with Sorce

Apply on Sorce