Rejoignez Vomela, où notre plus grande richesse, c’est notre équipe
Chez Vomela, entreprise spécialisée en communication visuelle globale, nous recherchons des esprits créatifs et analytiques capables de collaborer avec nos clients pour concevoir des solutions de marque percutantes et créer des liens authentiques. Pendant que vous imaginez des projets ambitieux pour des marques locales et internationales, nous vous accompagnons dans la construction d’une carrière qui vous passionne.
Postulez dès maintenant pour trouver votre place chez Vomela.
Rémunération : 180 000 à 200 000 USD
Votre rôle : Principal Data Engineer
En tant que Principal Data Engineer, vous êtes le pilier technique de notre équipe data. Vous fixez les standards, pilotez la plateforme de données de bout en bout et livrez des solutions exemplaires que vos pairs étudient. Vous définissez et mettez en œuvre la stratégie data à un niveau d’ingénierie avancé, incarnant la référence technique pour la construction, l’évolution et la fiabilité des données au sein de l’entreprise.
Vous codez en production, concevez l’architecture, résolvez les blocages complexes, guidez vos collègues avec influence et autonomie. Véritable catalyseur, vous souhaitez façonner non seulement la plateforme, mais aussi la stratégie data globale de l’entreprise.
Notre plateforme est Microsoft Fabric. Ce poste s’adresse à un passionné de cet écosystème, qui suit son évolution et exploite pleinement ses composantes : Lakehouses, Event Streams, Modèles sémantiques, Notebooks, Pipelines, Direct Lake. Si vous souhaitez que votre expertise technique oriente la trajectoire de toute l’organisation data, ce poste est fait pour vous.
Vos missions principales
- Concevoir et implémenter des modèles dimensionnels rigoureux (star schemas, snowflake schemas)
- Créer et maintenir des modèles sémantiques, véritables sources de vérité pour le reporting métier
- Mettre en place des stratégies Slowly Changing Dimension adaptées à chaque domaine
- Gérer la maîtrise des données : golden records, autorité source, résolution d’identité cross-systèmes
- Définir et appliquer les standards de modélisation des données au sein de l’équipe
- Concevoir et exploiter des pipelines temps réel et quasi temps réel avec Kafka, Confluent Cloud, Fabric Eventstreams, en choisissant judicieusement le streaming
- Réduire la latence des données dans les scénarios non-streaming via planification intelligente et optimisation des chargements incrémentaux
- Optimiser les performances sur toute la stack : requêtes, partitions, indexation, compactage Delta, rafraîchissement des modèles sémantiques, préparation Direct Lake
- Appliquer une rigueur opérationnelle : observabilité, alertes, SLA, gestion des pannes, planification des capacités
- Concevoir des contrôles adaptés aux données sensibles (financières, PII, HIPAA…)
Développement de pipelines ETL / ELT
- Construire des pipelines robustes, scalables et observables (chargements incrémentaux, CDC, batch et streaming)
- Garantir l’idempotence, la résilience et la solidité en production des pipelines
- Être la voix technique senior lors des revues de code, avec un pouvoir d’approbation décisif
Livraison de rapports et analyses
- Transformer les besoins métier en modèles sémantiques et artefacts de reporting accessibles et fiables pour les utilisateurs non techniques
- Être l’interface technique principale de la plateforme auprès des différents utilisateurs : créateurs de rapports Power BI, développeurs AI/ML, développeurs d’applications consommant les données via SQL, API REST ou Direct Lake
- Définir et faire respecter les contrats de données : stabilité des schémas, modes d’accès, SLA selon les profils consommateurs
- Assurer une expérience développeur optimale : découverte, documentation, intégration
Compétences requises
- Maîtrise de Microsoft Fabric : Lakehouses, Notebooks, Dataflows Gen2, Event Streams, Modèles sémantiques, Direct Lake
- Power BI : développement de rapports, conception de datasets/modèles sémantiques, maîtrise de DAX
- SQL Server / Azure SQL / Postgres : optimisation des requêtes, conception de schémas, procédures stockées
- Azure undefined : workflows Git, CI/CD pour pipelines data
- Expérience avérée d’utilisation d’assistants IA pour le codage en environnement de production
- Capacité à évaluer, corriger et améliorer le code généré par IA
- Compréhension claire des bénéfices et limites de l’IA dans les processus de travail
Atouts appréciés
- Connaissance des services Azure Data complémentaires (Data Factory, Synapse Analytics, ADLS Gen2, Event Hubs)
- Expérience en environnement d’entreprise soutenue par capital-investissement ou multi-entités
- Familiarité avec les plateformes MDM (Profisee, Semarchy, Ataccama ou équivalent)
- Expérience avec Confluent Cloud / Apache Kafka pour ingestion streaming vers Fabric ou Synapse
- Connaissance des architectures Azure / Fabric multi-tenant
- Profil en analyse métier, architecture de solutions ou ingénierie avant-vente
- Certifications Microsoft Fabric ou Azure Data Engineer
Avantages
- Couverture santé complète (médical, dentaire, vision)
- Plan de retraite (401k)
- Assurances vie (de base, volontaire, AD&D)
- Congés payés
- Assurances invalidité court et long terme
- Formations et développement professionnel
- Ressources bien-être