> DOU
middle
CAS.AIData Engineer
format:Remotecompany:Product
sqlbigquerysnowflakeredshiftairflowdata modelingetldata pipelinesdata warehousing
pub/subkafkakinesisclickhousedbtfinops
> full description
Про компанію
CAS.AI — це універсальна платформа для монетизації та паблішингу мобільних ігор, яка допомагає розробникам і студіям масштабувати додатки та максимізувати дохід від реклами. Компанія поєднує сучасну технологію ad mediation з повноцикловим паблішингом, що дозволяє партнерам оптимізувати user acquisition, покращувати показники ефективності та стабільно зростати.
Про роль
Ми розширюємо Data team у зв’язку з ростом компанії. Шукаємо Middle Data Engineer, який буде допомагати з розробкою та підтримкою DWH, міграцією даних і побудовою data pipelines.
Чим будете займатись
- Брати участь у міграції DWH за моделлю bronze → silver → gold — розробка pipelines, які об’єднують дані з різних систем-джерел в одну консистентну модель
- Розробляти та підтримувати ingestion pipelines з урахуванням cost-aware guardrails з самого початку
- Допомагати з ре-платформінгом ClickHouse у швидкий, read-optimized mart, який живиться з gold layer сховища
- Будувати автоматизовані перевірки якості даних на межах шарів (layer boundaries)
- Експлуатувати та вирішувати проблеми production pipelines у кількох бізнес-доменах
- Будувати надійні ETL-процеси та підтримувати їх SLA
- Долучатись до крос-доменних проєктів, брати на себе відповідальність за менші задачі end-to-end
- Писати документацію та runbooks, за якими команда зможе діяти без вашої присутності
Що для нас важливо
- 2+ роки комерційного досвіду на позиції Data Engineer
- Впевнений досвід роботи з cloud data warehouse (BigQuery — сильна перевага; Snowflake/Redshift також релевантні)
- Сильний SQL та практичний досвід з оркестрацією pipelines (Airflow або аналоги)
- Досвід побудови data pipelines та роботи з міграціями — schema design, backfills
- Cost-conscious інженерне мислення — розуміння вартості запиту чи pipeline ще до того, як це стане несподіванкою в рахунку
- Готовність працювати в різних доменах, а не володіти однією фіксованою зоною відповідальності — це shared-pool команда, а не силосна структура
Буде плюсом
- Досвід з pub/sub або streaming ingestion патернами (Pub/Sub, Kafka, Kinesis або подібні)
- Досвід роботи з ClickHouse або іншим OLAP engine
- Знайомство з dbt або подібним transformation framework
- Досвід у cost optimization/FinOps або легких data governance фреймворках
- Досвід менторства або крос-навчання колег
- GCP / AWS сертифікація