Cloud Platform Engineer

Il y a 1 semaine

Marseille, Provence-Alpes-Côte d'Azur, France StackEase Temps plein 65 000 € - 95 000 € Contrat

Contexte

La transition énergétique vers un réseau électrique décarboné pose des défis considérables. L'intégration croissante des énergies renouvelables exige des solutions de stockage performantes et des mécanismes robustes d'équilibrage du réseau. Les batteries permettent d’intégrer les ENR au réseau, mais leur exploitation et leur optimisation sont complexes. En effet, une batterie peut générer des revenus via différents mécanismes, chacun présentant des spécificités propres mais aucun de ces mécanismes, pris isolément, ne garantit la viabilité économique du système. Afin d'assurer la rentabilité et d'accélérer le déploiement de ces technologies, il est nécessaire d’opérer et d’optimiser la batterie dans un contexte global.

StackEase relève ce défi en ayant développé des algorithmes qui maximisent le revenu net des batteries en fonction des prix de marchés et des contraintes physiques de chaque site. Les produits proposés sont du conseil en générant des prévisions de revenus long terme, et des opérations en optimisant en temps réel les actifs qui nous sont confiés.

Les opérations consist ent à définir les ordres correspondant à l’utilisation la plus performante de chaque batterie, puis à les passer sur les marchés de l’électricité. En fonction de l’acceptation des marchés il faut alors piloter la batterie via notre serveur edge installé localement. Nous avons débuté les opérations cette année et nous cherchons à les industrialiser.

À propos de StackEase

StackEase est une spin-off deeptech issue de l'INRIA (Institut National de Recherche en Informatique et en Automatique). Basés à Paris et Marseille, nous réunissons des talents passionnés par l'innovation technologique. Nos valeurs sont l'innovation, l'excellence opérationnelle, la satisfaction client, la méritocratie et un engagement durable.

Missions

Administrer et fiabiliser notre infrastructure AWS

  • Exploiter et optimiser nos clusters ECS sur EC2 : diagnostiquer les problématiques liées aux instances, aux conteneurs et aux ressources disponibles.
  • Gérer et anticiper les besoins de capacité (autoscaling, mémoire, stockage, disponibilité) et analyser les performances de l'infrastructure.
  • Administrer les composants réseau : VPC, subnets, routage, DNS, VPN, security groups.
  • Gérer les services associés : RDS, S3, CloudWatch, IAM, Secrets Manager, etc.
  • Renforcer la sécurité de l'infrastructure et du réseau : segmentation, contrôle des flux, gestion des accès, durcissement des configurations et application du principe de moindre privilège.
  • Participer au dimensionnement de l'infrastructure et à l'optimisation des coûts AWS.

Améliorer l'exploitation, la résilience et l'observabilité

  • Définir et faire évoluer notre stack d'observabilité (métriques, logs, dashboards, alertes) pour détecter, comprendre et diagnostiquer rapidement les dégradations et incidents.
  • Diagnostiquer les incidents en production, mener les analyses de causes racines et mettre en œuvre les actions correctives permettant d'éviter leur récurrence.
  • Définir et améliorer les mécanismes de sauvegarde, restauration et reprise après incident, afin de renforcer la résilience et la continuité de service de la plateforme.
  • Formaliser les procédures d'exploitation, runbooks et outils de diagnostic.

Industrialiser la plateforme et les déploiements

  • Maintenir et améliorer notre Infrastructure as Code (AWS CDK / TypeScript).
  • Maintenir et améliorer nos pipelines GitHub Actions.
  • Développer des scripts et outils d'automatisation, principalement en Bash et Python, pour automatiser les opérations récurrentes et réduire les interventions manuelles.
  • Améliorer les mécanismes de déploiement, rollback et gestion des environnements.
  • Maintenir et faire évoluer notre instance Apache Airflow auto-hébergée sur ECS.

Développer les services et intégrations de la plateforme

  • Développer et maintenir des APIs et services en Python nécessaires au fonctionnement et à l'exploitation de la plateforme.
  • Concevoir des intégrations avec les systèmes d'information de nos clients et partenaires : APIs, échanges de fichiers et autres interfaces automatisées.
  • Développer des jobs et workflows permettant d'orchestrer des traitements internes et externes, notamment des traitements asynchrones sur AWS.
  • Garantir la robustesse de ces intégrations : authentification, gestion des erreurs, retries, timeouts, idempotence, logs, monitoring et tests.
  • Participer à la définition des interfaces et des protocoles d'échange avec nos partenaires.

Profil recherché

Vous disposez d'au moins 5 ans d'expérience sur des problématiques d'infrastructure, systèmes, DevOps ou dans u