Développeur ia générative
Il y a 4 jours
Paris, Île-de-France
Golden Bees
Temps plein
Gratuit avec email ou Google
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Gratuit avec email ou Google
Free-Work est une plateforme qui s'adresse à tous les professionnels des métiers de l'informatique.
Si vous envisagez d'envoyer une candidature, assurez-vous de cliquer sur le bouton "Postuler" ci-dessous après avoir lu toute la description.
Ses contenus et son jobboard IT sont mis à disposition 100% gratuitement pour les indépendants et les salariés du secteur.
Dans le cadre d'un projet stratégique pour l'un de nos clients grands comptes, nous recherchons un(e) Développeur(se) confirmé(e) spécialisé(e) en IA Générative et architectures LLM.
L'objectif de la mission est de concevoir, développer et industrialiser une plateforme d'IA générative dédiée à l'analyse documentaire, en s'appuyant sur des architectures modernes de type LLM open source, RAG et systèmes multi-agents.
La mission couvre l'ensemble du cycle de vie : du cadrage technique à l'intégration en production au sein d'un Système d'Information complexe et sécurisé.
Les missions:
Back-end & InfrastructureConception et développement de l'architecture serveur
Développement Python / FastAPI
Développement et sécurisation d'API REST
Gestion des bases de données, API et performance serveur
Docker, déploiement et industrialisation des composants IA
Gestion des donnéesMise en place de pipelines ETL automatisés (collecte, nettoyage, transformation)
Intégration de bases de données SQL / NoSQL
Traitements asynchrones à grande échelle
Intégration & Modélisation IAIntégration de modèles LLM open source (via Hugging Face ou API)
Mise en ?uvre de pipelines RAG, embeddings et vector stores
Prompt engineering et optimisation des chaînes d'inférence
Intégration dans des applications métier existantes
Optimisation & PerformanceMonitoring, logs et gestion de la latence
Optimisation GPU/CPU, mise en cache, compression
Réduction des coûts xuezdbg d'infrastructure cloud/on-premise
Collaboration & PilotageTraduction des besoins métiers en solutions techniques
Participation active aux ateliers avec les parties prenantes
Contribution à la gestion des risques et au planning projet
Expérience confirmée (5 ans minimum) en développement back-end Python
Expérience démontrée sur des projets IA / LLM en production
Bonne maîtrise des architectures RAG et multi-agents
Capacité à travailler dans un environnement sécurisé et réglementé
Sens de la rigueur, autonomie et esprit de collaboration
Si vous envisagez d'envoyer une candidature, assurez-vous de cliquer sur le bouton "Postuler" ci-dessous après avoir lu toute la description.
Ses contenus et son jobboard IT sont mis à disposition 100% gratuitement pour les indépendants et les salariés du secteur.
Dans le cadre d'un projet stratégique pour l'un de nos clients grands comptes, nous recherchons un(e) Développeur(se) confirmé(e) spécialisé(e) en IA Générative et architectures LLM.
L'objectif de la mission est de concevoir, développer et industrialiser une plateforme d'IA générative dédiée à l'analyse documentaire, en s'appuyant sur des architectures modernes de type LLM open source, RAG et systèmes multi-agents.
La mission couvre l'ensemble du cycle de vie : du cadrage technique à l'intégration en production au sein d'un Système d'Information complexe et sécurisé.
Les missions:
Back-end & InfrastructureConception et développement de l'architecture serveur
Développement Python / FastAPI
Développement et sécurisation d'API REST
Gestion des bases de données, API et performance serveur
Docker, déploiement et industrialisation des composants IA
Gestion des donnéesMise en place de pipelines ETL automatisés (collecte, nettoyage, transformation)
Intégration de bases de données SQL / NoSQL
Traitements asynchrones à grande échelle
Intégration & Modélisation IAIntégration de modèles LLM open source (via Hugging Face ou API)
Mise en ?uvre de pipelines RAG, embeddings et vector stores
Prompt engineering et optimisation des chaînes d'inférence
Intégration dans des applications métier existantes
Optimisation & PerformanceMonitoring, logs et gestion de la latence
Optimisation GPU/CPU, mise en cache, compression
Réduction des coûts xuezdbg d'infrastructure cloud/on-premise
Collaboration & PilotageTraduction des besoins métiers en solutions techniques
Participation active aux ateliers avec les parties prenantes
Contribution à la gestion des risques et au planning projet
Expérience confirmée (5 ans minimum) en développement back-end Python
Expérience démontrée sur des projets IA / LLM en production
Bonne maîtrise des architectures RAG et multi-agents
Capacité à travailler dans un environnement sécurisé et réglementé
Sens de la rigueur, autonomie et esprit de collaboration