Techlead IA - Freelance
Freelance Paris (Paris)
Description de l'offre
Contexte & mission
Vous rejoignez l'équipe AI Service, en charge d'une brique technologique stratégique de la plateforme du groupe. Votre mission : mettre en place et fournir des capabilities IA aux produits utilisés quotidiennement par les professionnels du droit. Vous serez au cœur des services IA — la brique qui connecte les modèles de langage, les moteurs de recherche et les produits juridiques.
Concrètement, vous concevez des APIs robustes capables d'orchestrer des appels LLM, des pipelines RAG et des traitements massifs, au service de plusieurs équipes à travers l'Europe, avec des temps de réponse maîtrisés (streaming, faible latence) et une solution multi-tenant (plusieurs pays, mode souverain possible).
Vos missions principales
Conception & développement des services d'indexation et de restitution de données
Architecture des APIs et workers, stratégie de cache, mécanismes de résilience (retries, circuit breakers, fallback modèles)
Chaînes d'inférence LLM (prompting, function calling, RAG, embeddings, agents) et industrialisation via POCs/benchmarks
Arbitrage débit / latence / coût (synchrone et asynchrone)
APIs Web & performance
APIs FastAPI robustes et documentées (contrats clairs, Pydantic, auth unifiée, contexte pays)
Maîtrise asyncio, concurrence et parallélisme
Streaming des réponses LLM, gestion des timeouts, backpressure, annulation des requêtes
Observabilité et sécurité natives (logs, métriques, traces, secrets, Zero Trust)
Leadership technique & gouvernance
Membre influent de la communauté Inner Source
Accompagnement des value stream teams (IA assistant, Search, Édition…)
Promotion du Clean Code, SOLID, tests automatisés
Veille et rayonnement technique (articles, meetups, open-source)
Pourquoi ce poste est unique
Industrialisation de flux d'IA générative sous fortes contraintes de performance, sur des volumes juridiques massifs
Vision long terme : créer le standard industriel du groupe, pas juste livrer une feature
Équipe d'experts soudée et bienveillante, intégration pensée pour durer
Profil recherché
Formation
Master / Ingénieur / Ph.D
Stack technique cible
Langages : Python 3.11+ (maîtrise requise), Go, Java/Spring Boot
Web/APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)
Asynchrone : asyncio, httpx, concurrence et parallélisme (threads, process, workers)
LLM : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock
Cloud : AWS, Azure
Données & infra : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD
Tests : Pytest, pytest-asyncio
Expérience & compétences attendues
Expérience avérée en développement Python backend sur des services en production à grande échelle
Expertise LLM en production (prompting, function calling, RAG) : latence, coût, fiabilité
Culture engineering : contrats d'API, versioning, gestion des dépendances, cycle de vie des tokens
Aisance sous fortes contraintes de performance (streaming, WebSockets, traitements concurrents)
Polyvalence appréciée : Go ou Java en plus
Anglais fluide (contexte européen quotidien)
Soft skills
Vision produit — considère les autres développeurs comme des clients
Leadership technique & pédagogie — évangélise les bonnes pratiques
Obsession de la qualité — rigueur sur la sécurité des données (Legaltech)
Esprit d'innovation — curiosité pour l'écosystème IA/Python
Communication — capacité à vulgariser
À propos de Collective.work
Collective.work est la plateforme de recrutement nouvelle génération pour trouver votre prochain emploi.
Fort d'une grande expertise dans l'IA, Collective.work permet de mieux cibler les offres et leurs candidats correspondants, créant ainsi un système beaucoup plus fluide que les acteurs traditionnels.
Plus de 10,000 recruteurs utilisent Collective, permettant à des dizaines de milliers de candidats de trouver leur futur emploi chaque jours