Des fonctionnalités IA et des automatisations traitées pour ce qu'elles sont : un problème de fiabilité back-end.
Une fonctionnalité IA en production, c'est un appel à un modèle entouré d'ingénierie back-end ordinaire : une file d'attente, des relances, de l'idempotence, des timeouts, un plafond de coût, une évaluation des sorties et un repli quand le fournisseur répond mal ou ne répond pas. Les modèles et les prompts changent vite ; cette plomberie-là ne change pas, et c'est exactement notre terrain : pipelines événementiels, Step Functions, Lambda, SQS, intégration d'API tierces. Nous ne vendons ni modèle maison ni plateforme d'IA. Nous construisons la partie qui doit tenir quand la fonctionnalité rencontre le trafic réel.
Ce qui mérite un modèle, ce qui mérite une simple règle métier, et ce qui ne mérite ni l'un ni l'autre.
File, machine à états, chemins d'échec, plafonds de coût et repli, sur le papier d'abord.
Jeu de cas de référence, sorties mesurées et garde-fous, avant toute mise entre les mains des utilisateurs.
Journalisation des appels, alertes sur les erreurs et sur le coût, itération sur les prompts et les seuils.
Aucun à ce jour, et nous n'allons pas prétendre le contraire. Ce que nous avons livré, ce sont les pipelines événementiels, les files et les intégrations dont une fonctionnalité IA a besoin pour tenir en production.
Celui qui convient au besoin et au budget : Bedrock quand l'infrastructure est déjà sur AWS, une API tierce sinon. Le choix est isolé dans le code pour rester révisable, parce qu'il vieillira.
C'est le cas le plus courant : ingestion, découpage, indexation, recherche et citation des sources. La difficulté est rarement le modèle : elle est dans la qualité de l'index et dans la réponse quand il ne sait pas.
Plafonds par appel et par période, mise en cache des requêtes répétées, un modèle plus petit là où il suffit, et des alertes de coût. C'est du dimensionnement, comme pour n'importe quelle charge.
Dites-nous sur quoi vous travaillez. Réponse sous 24 heures, diagnostic d'une page sous 48.