Data Engineer — Plateforme agentique / socle data pour agents IA - Freelance
Freelance Paris (Paris)
Description de l'offre
Ever"T — Société de Conseil tech IA-native, innovante et en hypercroissance — cherche un·e Data Engineer pour renforcer une équipe AI Platform qui construit et opère une plateforme agentique à l'échelle d'un grand groupe.
Le contexte
Cette plateforme est le socle unique sur lequel sont créés, déployés et exploités les agents IA de l'organisation : catalogue d'agents, connecteurs, catalogue de skills, interfaces conversationnelles, intégrations aux systèmes internes. Elle sert deux publics : les équipes techniques qui construisent les produits IA, et les tandems métier qui créent des agents et des RAG pour les fonctions support.
Le principe est simple : un agent ne vaut que par les données auxquelles il accède. Ton rôle : construire et fiabiliser toute la couche data du socle — ingestion des sources, préparation, exposition aux agents, contrôle qualité.
Ce sur quoi tu interviens
Ingestion et préparation
Construire et maintenir les pipelines d'ingestion vers la plateforme : bases internes, APIs, fichiers, espaces documentaires
Modéliser et préparer les jeux de données exploités par les agents, avec une maille et des règles de gestion explicites
Industrialiser les chaînes documentaires qui alimentent les RAG : collecte, nettoyage, découpage, enrichissement des métadonnées, rafraîchissement
Gérer les synchronisations récurrentes et les traitements incrémentaux, avec reprise sur erreur
Exposition des données aux agents
Exposer les données via les connecteurs de la plateforme (notamment un connecteur MCP Snowflake)
Travailler avec les équipes data internes pour cadrer et fiabiliser les tables sources dont les agents ont besoin
Documenter les schémas et contrats de données, gérer leurs évolutions sans casser les usages existants
Veiller à ce que seules les données autorisées soient accessibles, en lien avec les règles de sécurité et de conformité
Industrialisation et qualité
Déployer et opérer les traitements sur AWS : orchestration, conteneurisation, CI/CD
Mettre en place les contrôles de qualité et de fraîcheur des données, avec alertes en cas d'anomalie
Assurer l'observabilité des pipelines : logs structurés, suivi des exécutions, métriques, coûts
Participer au run (incidents, optimisation perf et coûts) et contribuer aux revues de code et aux choix d'architecture
Stack
Indispensable : Python, SQL avancé, Snowflake, modélisation de données, traitements incrémentaux, AWS (S3, ECS, DynamoDB), Airflow (ou équivalent), compréhension des chaînes de RAG et des besoins data des agents, tests de données et contrôles de fraîcheur, Docker, Poetry, Git, CI/CD GitLab.
Apprécié : TypeScript, dbt, bases vectorielles, formats de fichiers analytiques, Lambda / Step Functions / Kinesis / Batch / Glue, streaming, MCP, recherche sémantique et embeddings, catalogue de données et suivi des lignages.
Pourquoi Ever"T ?
Chez nous, tu rejoins une communauté IA-native qui repose sur trois piliers fondateurs : Humilité. Progrès. Engagement.
Tu bénéficies d'un suivi fort (ta Community Builder, ton facilitateur de Projet), d'un accès à des formations continues, d'événements réguliers (T"Time, T"Coached, T"Cast) et du programme Salarié Diversifié pour développer tes projets perso ou business en parallèle.
Profil recherché
Solide expérience en data engineering, avec des pipelines réellement exploités en production
À l'aise sur des projets cloud et des volumes significatifs
Exigence forte sur la qualité, les tests et la documentation des traitements
Capable de travailler sur un socle partagé par plusieurs équipes, avec des contraintes de sécurité et de conformité
Aisance relationnelle pour aller chercher la donnée auprès d'équipes réparties
Autonomie, esprit d'équipe, capacité à expliquer un choix technique simplement
Français et anglais courants
À propos de Collective.work
Collective.work est la plateforme de recrutement nouvelle génération pour trouver votre prochain emploi.
Fort d'une grande expertise dans l'IA, Collective.work permet de mieux cibler les offres et leurs candidats correspondants, créant ainsi un système beaucoup plus fluide que les acteurs traditionnels.
Plus de 10,000 recruteurs utilisent Collective, permettant à des dizaines de milliers de candidats de trouver leur futur emploi chaque jours