Make Your Resume Now

Chief Technology Officer, Yelema

Posted August 25, 2026

Job Overview

Abidjan, Côte d'Ivoire. Temps plein, sur place. Rattachement direct au CEO.

À propos de Yelema

Yelema est la société d'intelligence artificielle de Mstudio, venture studio basé à Abidjan. Nous vendons et nous opérons des Experts IA pour les entreprises et les institutions d'Afrique francophone, sur le modèle Build & Operate : nous construisons, puis nous exploitons dans la durée. Le client n'a besoin d'aucune compétence technique en interne.

Un Expert IA n'est pas un assistant conversationnel. C'est une identité de travail qui porte un métier (recrutement, finance, juridique, veille réglementaire), dispose d'une mémoire d'entreprise, accède à des outils autorisés et produit un livrable. On lui parle là où les équipes travaillent déjà, WhatsApp en tête.

Le produit s'appuie sur une couche d'orchestration d'agents de dernière génération (OpenClaw, Hermès), sur une bibliothèque d'environ 200 agents déjà construits par le studio, et sur un socle logiciel en cours de développement.

Ce que ce poste est vraiment

Nous cherchons quelqu'un qui sache faire tourner un parc d'instances d'agents en production, pas quelqu'un qui sache prompter.

Notre difficulté n'est pas de faire fonctionner un agent. Elle est de provisionner à la demande une instance hardened par client, de la configurer entièrement (compétences, mémoire, comportement, droits), de la mettre à jour sans casser les instances déjà en service, et de tenir tout cela pour dix clients comme pour dix mille utilisateurs, avec des coûts prévisibles et des données isolées.

Autrement dit, sur la première année, le poste est à 70 ou 80 % de l'infrastructure et de l'exploitation, adossées à une part de développement logiciel. Un candidat qui n'a jamais mis de système distribué en production ne sera pas à l'aise ici, quelle que soit sa maîtrise des LLM.

Le poste est très concret la première année. Le CTO est face à tout : il construit, il déploie, il tient l'astreinte, et il commence à structurer une équipe. Le management vient ensuite, et il est accompagné (voir plus bas).

Responsabilités

Socle d'exécution et provisioning, le cœur du poste

  • Concevoir et industrialiser le provisioning automatisé d'instances du runtime d'agents : déclenchable par API, reproductible, sans intervention manuelle.

  • Produire une image durcie de ce runtime, duplicable pour cinq clients comme pour plusieurs milliers, et configurable de bout en bout à la création : compétences, mémoire d'entreprise, comportement, identité, droits.

  • Garantir la mise à jour d'un parc en service sans régression : versionner les instances, migrer par vagues, revenir en arrière, prouver qu'une montée de version ne casse rien.

  • Maintenir la compatibilité d'un large ensemble de connecteurs MCP et de composants open source qui évoluent en continu, sans que chaque mise à jour amont devienne un incident.

  • Poser le modèle de multi-tenancy : ce qui est mutualisé, ce qui est isolé, et à quel prix.

Infrastructure, distribution et fiabilité

  • Mettre en place l'exécution asynchrone : files d'attente, workers isolés, reprise sur erreur. Un agent qui lance une recherche ou traite un fichier ne doit jamais bloquer le système, et cela devient nécessaire bien avant d'avoir du trafic.

  • Concevoir l'architecture cloud et son automatisation (infrastructure déclarative, conteneurisation, orchestration), avec une chaîne d'intégration et de déploiement continus.

  • Installer les tests de non-régression, sur le code comme sur la qualité des réponses des agents, et l'observabilité qui va avec.

  • Rendre les coûts prévisibles : suivi par client, par Expert et par conversation, plafonds, alertes, routage entre modèles, détection des boucles. Nous vendons au forfait, donc tout dépassement sort de notre marge.

Sécurité et confiance

  • Durcir les instances et l'infrastructure : isolation, gestion des secrets, cloisonnement réseau, moindre privilège.

  • Traiter la sécurité propre aux agents : injection de prompt, exfiltration de données, garde-fous sur les actions sortantes et irréversibles.

  • Concevoir le partage de mémoire entre agents sous contrôle des droits (RBAC). L'Expert des ressources humaines ne doit pas rendre accessible aux autres ce qu'il détient.

  • Tenir les exigences de souveraineté et de traçabilité attendues par des clients institutionnels et régulés (OHADA, BCEAO), y compris la résidence des données en Côte d'Ivoire.

Couche agents et qualité

  • Faire évoluer l'orchestration multi-agents, la gestion de la mémoire et du contexte, les pipelines de recherche documentaire et l'usage d'outils.

  • Mettre en place l'évaluation continue des agents : qualité des réponses, détection des dérives, scoring, mesure avant et après chaque mise en production.

  • Arbitrer la stratégie de modèles : sélection, routage, coût, latence, qualité, et à terme déploiement de modèles auto-hébergés sur capacité GPU souveraine.

Équipe et roadmap

  • Piloter la roadmap technique au regard des priorités commerciales, avec un lancement visé avant la fin 2026.

  • Structurer, recruter et faire grandir l'équipe technique.

  • Traduire les besoins clients en décisions d'architecture, et assumer ce qu'on ne fait pas.

Notre stack aujourd'hui

Passerelle d'API en Go, dimensionnée pour ne pas devenir un goulot d'étranglement. Backend Node.js et Next.js. Interface client en Next.js. Agents en Python. Orchestration des déclenchements via n8n. Base de données relationnelle avec extension vectorielle. Runtime d'agents OpenClaw et Hermès, considérés comme des briques remplaçables et non comme un choix définitif. Connecteurs MCP.

L'architecture est volontairement modulaire : la partie applicative dialogue par API avec une partie infrastructure qui reçoit une identité et provisionne l'environnement correspondant.

Nous ne cherchons pas la connaissance préalable de ces outils. Nous cherchons quelqu'un capable de les tenir en production, et de dire quand il faut en changer.

Ce que tu trouves en arrivant

Une équipe déjà au travail : développement, design, ingénierie IA et données. Une interface client dessinée en haute fidélité et en cours de développement. Une bibliothèque d'agents éprouvés. Une liste de clients en attente et un vrai intérêt du marché.

Deux appuis techniques réguliers, en plus du CEO : le CTO de Mstudio, qui accompagne les startups du studio et peut prendre en charge la gestion de l'équipe technique, l'organisation des backlogs et le suivi de la livraison, et le CTO de Mafa Holding, qui travaille avec nous sur l'architecture et le provisioning. Le CTO de Yelema n'arrive donc pas seul, mais il est le premier à porter la responsabilité du produit de bout en bout.

Ce qui n'existe pas encore, et qui sera ton chantier : le provisioning industriel, la stratégie de mise à jour du parc, le socle multi-client, la chaîne de non-régression et les garde-fous automatiques de coût en production.

Comment nous recrutons

Un premier échange avec la direction, puis un entretien technique avec le CTO de Mstudio et le CTO de Mafa Holding, puis un business case remis à l'avance et restitué en séance. Le business case demande trois heures de préparation au maximum, et nous tenons à cette limite.

Ready to Apply?

Take the next step in your career journey

Stand out with a professional resume tailored for this role

Build Your Resume – It’s Free!