Skip to content

Platform & SRE Engineer

  • Hybrid
    • Brussels, Brussels, Belgium
  • Local managed staffing

Job description

Envie de changement ? De nouveaux challenges ?

Vous souhaitez booster votre carrière dans un rôle de Platform & SRE Engineer? Rejoignez notre équipe Local Managed Staffing au sein de KEYES !

 

KEYES, aujourd’hui leader du secteur ICT en Belgique, propose de nombreux services informatiques qui répondent à l’ensemble des besoins en IT, que ce soit en Infrastructure & Cloud, en Software Development, ou encore en Consultance & Managed Staffing.

Vous trouverez plus d'informations ici : www.keyes.eu

Nous recherchons un(e) Platform & SRE Engineer pour rejoindre une équipe en charge d’une plateforme de streaming Event-Driven à grande échelle, assurant la synchronisation en temps réel de données entre des environnements Mainframe legacy et un écosystème cloud-native.

La mission est résolument hands-on : vous serez responsable de l’exploitation et de la stabilisation de la plateforme OpenShift, de l’évolution du socle GitOps, du troubleshooting des pipelines de données et de l’accompagnement des équipes de développement. L’objectif est de résoudre des problématiques d’infrastructure concrètes et d’améliorer la fiabilité et l’efficacité de la plateforme.

Vos responsabilités

  • Opérer et stabiliser l’infrastructure OpenShift multi-cluster et les services partagés.

  • Administrer et sécuriser les clusters OpenShift : workloads, CRDs, secrets, NetworkPolicies, ServiceAccounts, SCCs, RBAC, quotas et LimitRanges.

  • Gérer l’intégration du stockage (PVC/NFS, S3) et de la PKI d’entreprise.

  • Maintenir et faire évoluer le socle GitOps basé sur ArgoCD et Helm, notamment dans un contexte multi-environnement.

  • Développer et debugger des Helm charts complexes.

  • Supporter les pipelines CI/CD, notamment Jenkins, SonarQube et les migrations Flyway.

  • Exploiter les clusters Kafka / IBM EventStreams : configuration des brokers et topics, partitions, retention, rolling restarts, consumer groups et monitoring du lag.

  • Assurer le support opérationnel d’Apache Flink, notamment sur les savepoints/checkpoints, le dimensionnement mémoire, le backpressure et le redémarrage des jobs.

  • Diagnostiquer et résoudre les incidents liés aux pipelines CDC, aux jobs Flink et aux brokers Kafka.

  • Configurer et maintenir les pipelines OpenTelemetry Collector.

  • Créer et maintenir des dashboards Grafana, des règles d’alerte et des runbooks opérationnels.

  • Administrer Grafana Loki et exploiter PromQL / LogQL.

  • Accompagner les équipes applicatives sur leurs problématiques réseau, OAuth2/OIDC, build, intégration et déploiement.

  • Participer à la gestion IAM avec Entra ID / Active Directory, app registrations, MSAL et Azure Key Vault CSI.

#LIAD1

Job requirements

Profil recherché

Infrastructure & Conteneurisation

  • Bonne maîtrise de Linux.

  • Solide expérience de Kubernetes / Red Hat OpenShift.

  • Expérience concrète de l’administration et du troubleshooting d’environnements conteneurisés.

CI/CD & GitOps

  • Bonne maîtrise de Git.

  • Expérience avec ArgoCD ou forte volonté de le maîtriser.

  • Bonne connaissance de Helm.

  • Expérience concrète avec des pipelines CI/CD : Jenkins, GitHub Actions ou équivalent.

  • Une expérience avec ArgoCD ApplicationSets, App-of-Apps, Helm chart authoring ou Kustomize constitue un atout.

Streaming & Data Pipelines

  • Expérience avec Kafka / EventStreams / Strimzi.

  • Connaissance de Kafka Connect et Schema Registry (Apicurio/Avro).

  • Bonne compréhension des concepts CDC.

  • Une expérience avec Apache Flink, notamment Flink Kubernetes Operator, savepoints et state backends, constitue un atout.

Observabilité

  • Expérience avec Prometheus et Grafana.

  • Connaissance des systèmes de logging centralisé tels que Loki, ELK ou équivalent.

  • Une expérience avec OpenTelemetry Collector et la stack LGTM (Loki, Grafana, Tempo, Mimir) constitue un atout.

  • Connaissance de PromQL / LogQL appréciée.

Développement

  • Bonne compréhension de l’écosystème Java / Spring Boot, principalement pour le diagnostic d’applications conteneurisées.

  • Une expérience de développeur pur n’est pas nécessaire.

Bases de données

  • Connaissances de PostgreSQL.

  • Familiarité avec Elasticsearch / Kibana.

Autres compétences appréciées

  • Connaissances d’Angular.

  • Familiarité avec les environnements Mainframe / DB2 / IBM MQ.

  • Connaissances en Infrastructure as Code avec Ansible / Terraform.

  • Automatisation via Bash / Python.

  • Utilisation et forte appétence pour les outils d’intelligence artificielle dans le quotidien : assistants de code, génération de scripts et runbooks, analyse de logs et automatisation.

Langues

  • Anglais obligatoire.

  • Français ou Néerlandais.

Notre Offre

  • Une flexibilité contractuelle, un contrat CDI ou une mission en tant que freelance;

  • Une flexibilité horaire avec des possibilités de télétravail (2 jours par semaine et 3 jours sur site à Liège );

  • Une équipe de collègues enthousiastes, professionnels et talentueux où règne une bonne humeur et une bonne ambiance;

  • Un accompagnement de carrière personnalisé pour vous soutenir dans votre évolution;

  • Une entreprise avec une atmosphère de travail agréable, dynamique et tournée vers l'innovation.

or

Apply with Linkedin unavailable