Techlead IA

Il y a 24 heures

Paris, Ile-de-France Collective.work Temps plein
Contexte & mission Vous rejoignez l'équipe AI Service, en charge d'une brique technologique stratégique de la plateforme du groupe. Votre mission : mettre en place et fournir des capabilities IA aux produits utilisés quotidiennement par les professionnels du droit. Vous serez au cœur des services IA
- la brique qui connecte les modèles de langage, les moteurs de recherche et les produits juridiques. Concrètement, vous concevez des APIs robustes capables d'orchestrer des appels LLM, des pipelines RAG et des traitements massifs, au service de plusieurs équipes à travers l'Europe, avec des temps de réponse maîtrisés (streaming, faible latence) et une solution multi-tenant (plusieurs pays, mode souverain possible). Vos missions principales 1. Conception & développement des services d'indexation et de restitution de données
* Architecture des APIs et workers, stratégie de cache, mécanismes de résilience (retries, circuit breakers, fallback modèles)
* Chaînes d'inférence LLM (prompting, function calling, RAG, embeddings, agents) et industrialisation via POCs/benchmarks
* Arbitrage débit / latence / coût (synchrone et asynchrone) 2. APIs Web & performance
* APIs FastAPI robustes et documentées (contrats clairs, Pydantic, auth unifiée, contexte pays)
* Maîtrise asyncio, concurrence et parallélisme
* Streaming des réponses LLM, gestion des timeouts, backpressure, annulation des requêtes
* Observabilité et sécurité natives (logs, métriques, traces, secrets, Zero Trust) 3. Leadership technique & gouvernance
* Membre influent de la communauté Inner Source
* Accompagnement des value stream teams (IA assistant, Search, Édition.)
* Promotion du Clean Code, SOLID, tests automatisés
* Veille et rayonnement technique (articles, meetups, open-source) Pourquoi ce poste est unique
* Industrialisation de flux d'IA générative sous fortes contraintes de performance, sur des volumes juridiques massifs
* Vision long terme : créer le standard industriel du groupe, pas juste livrer une feature
* Équipe d'experts soudée et bienveillante, intégration pensée pour durer Formation Master / Ingénieur / Ph.
D Stack technique cible
* Langages : Python 3.11+ (maîtrise requise), Go, Java/Spring Boot
* Web/APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)
* Asynchrone : asyncio, httpx, concurrence et parallélisme (threads, process, workers)
* LLM : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock
* Cloud : AWS, Azure
* Données & infra : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD
* Tests : Pytest, pytest-asyncio Expérience & compétences attendues
* Expérience avérée en développement Python backend sur des services en production à grande échelle
* Expertise LLM en production (prompting, function calling, RAG) : latence, coût, fiabilité
* Culture engineering : contrats d'API, versioning, gestion des dépendances, cycle de vie des tokens
* Aisance sous fortes contraintes de performance (streaming, WebSockets, traitements concurrents)
* Polyvalence appréciée : Go ou Java en plus
* Anglais fluide (contexte européen quotidien) Soft skills
* Vision produit
- considère les autres développeurs comme des clients
* Leadership technique & pédagogie
- évangélise les bonnes pratiques
* Obsession de la qualité
- rigueur sur la sécurité des données (Legaltech)
* Esprit d'innovation
- curiosité pour l'écosystème IA/Python
* Communication
- capacité à vulgariser

Experience:
Débutant accepté