logo[мetahunt]
> DOU
middle

Data Engineer

CAS.AI
format:Remotecompany:Product
sqlbigquerysnowflakeredshiftairflowdata modelingetldata pipelinesdata warehousing
pub/subkafkakinesisclickhousedbtfinops
experience2+ years
domainAdTech
> full description

Про компанію

CAS.AI — це універсальна платформа для монетизації та паблішингу мобільних ігор, яка допомагає розробникам і студіям масштабувати додатки та максимізувати дохід від реклами. Компанія поєднує сучасну технологію ad mediation з повноцикловим паблішингом, що дозволяє партнерам оптимізувати user acquisition, покращувати показники ефективності та стабільно зростати.

Про роль

Ми розширюємо Data team у зв’язку з ростом компанії. Шукаємо Middle Data Engineer, який буде допомагати з розробкою та підтримкою DWH, міграцією даних і побудовою data pipelines.

Чим будете займатись

  • Брати участь у міграції DWH за моделлю bronze → silver → gold — розробка pipelines, які об’єднують дані з різних систем-джерел в одну консистентну модель
  • Розробляти та підтримувати ingestion pipelines з урахуванням cost-aware guardrails з самого початку
  • Допомагати з ре-платформінгом ClickHouse у швидкий, read-optimized mart, який живиться з gold layer сховища
  • Будувати автоматизовані перевірки якості даних на межах шарів (layer boundaries)
  • Експлуатувати та вирішувати проблеми production pipelines у кількох бізнес-доменах
  • Будувати надійні ETL-процеси та підтримувати їх SLA
  • Долучатись до крос-доменних проєктів, брати на себе відповідальність за менші задачі end-to-end
  • Писати документацію та runbooks, за якими команда зможе діяти без вашої присутності

Що для нас важливо

  • 2+ роки комерційного досвіду на позиції Data Engineer
  • Впевнений досвід роботи з cloud data warehouse (BigQuery — сильна перевага; Snowflake/Redshift також релевантні)
  • Сильний SQL та практичний досвід з оркестрацією pipelines (Airflow або аналоги)
  • Досвід побудови data pipelines та роботи з міграціями — schema design, backfills
  • Cost-conscious інженерне мислення — розуміння вартості запиту чи pipeline ще до того, як це стане несподіванкою в рахунку
  • Готовність працювати в різних доменах, а не володіти однією фіксованою зоною відповідальності — це shared-pool команда, а не силосна структура

Буде плюсом

  • Досвід з pub/sub або streaming ingestion патернами (Pub/Sub, Kafka, Kinesis або подібні)
  • Досвід роботи з ClickHouse або іншим OLAP engine
  • Знайомство з dbt або подібним transformation framework
  • Досвід у cost optimization/FinOps або легких data governance фреймворках
  • Досвід менторства або крос-навчання колег
  • GCP / AWS сертифікація
Відгукнутись на вакансію