// Reprise de projet IA

Votre projet IA a dérapé. On le reprend là où il est.

Le POC a convaincu tout le monde, puis la production a tout révélé : réponses fausses, coûts qui s’envolent, code que plus personne n’ose toucher. Nous reprenons l’existant, nous mesurons ce qui casse, et nous le rendons exploitable. Sans repartir de zéro, sans changer de modèle par réflexe.

// Ce qu’on voit arriver

Vous vous reconnaissez dans l'un de ces cas ?

cas 01

Le POC ne passe pas en production

La démo marchait sur vingt exemples choisis. Face aux vraies données et aux vrais utilisateurs, rien ne tient : latence, erreurs silencieuses, cas limites jamais prévus.

cas 02

La facture d’API LLM a triplé

Le coût par requête paraissait négligeable. À l’échelle, il pèse plus que l’hébergement, et personne ne sait quelles fonctionnalités le génèrent.

cas 03

L’agent réussit huit fois sur dix

Suffisant pour une démo, intenable devant un client. Sans jeu d’évaluation, chaque correction en casse une autre et la fiabilité reste une opinion.

cas 04

Le RAG répond à côté

L’assistant documentaire cite des procédures abrogées ou invente. Le problème est presque toujours dans la récupération, jamais dans le modèle qu’on veut remplacer.

cas 05

L’intégration est impossible à maintenir

Prompts dispersés dans le code, dépendances à une version de SDK, aucun test. Le développeur qui l’a écrite est parti, et chaque évolution prend des semaines.

// Comment on travaille

Quatre étapes, chacune avec un livrable et une durée.

  1. 01

    Diagnostic

    Cinq jours

    Lecture du code et de l’architecture, mesure sur vos vrais cas d’usage (jeu d’évaluation constitué avec vous), analyse des coûts par fonctionnalité. Vous recevez un rapport chiffré : ce qui casse, pourquoi, et ce que coûte chaque option.

  2. 02

    Plan de reprise

    Deux jours

    Un périmètre priorisé, un ordre d’attaque et un budget. Nous disons ce que nous gardons, ce que nous réécrivons et ce que nous abandonnons. Vous décidez avec des chiffres, pas avec une intuition.

  3. 03

    Reprise par sprints

    En général quatre à huit semaines

    Chaque sprint corrige une cause mesurée et fait progresser le score sur le jeu d’évaluation. Instrumentation, garde-fous, maîtrise des coûts et tests de non-régression arrivent en même temps que les corrections.

  4. 04

    Transfert

    Une semaine

    Documentation, procédures d’exploitation, formation de votre équipe sur l’évaluation continue. L’objectif est que vous puissiez faire évoluer le système sans nous.

// Le périmètre, noir sur blanc

Ce qui est inclus, et ce qui ne l'est pas.

Inclus

  • +Jeu d’évaluation construit sur vos vraies données et vos vrais logs
  • +Mesure de la récupération, de la génération et des coûts, séparément
  • +Reprise du code existant en TypeScript ou Python, selon votre stack
  • +Instrumentation : traces, coûts par requête, alertes sur la dérive
  • +Garde-fous : validation des sorties, repli, limites de dépense
  • +Tests de non-régression exécutés à chaque changement de prompt ou de modèle
  • +Rapport hebdomadaire chiffré et démonstration sur cas réels

Non inclus

  • Un nouveau POC sur une autre idée : nous reprenons ce qui existe
  • Le fine-tuning de modèles comme réponse par défaut
  • La collecte ou l’annotation de données à grande échelle
  • L’hébergement de modèles open source sur votre infrastructure, sauf besoin démontré
  • La conduite du changement auprès des équipes métier
// Questions fréquentes

Les questions qu'on nous pose avant de signer.

01Faut-il tout réécrire ?

Presque jamais. Dans la majorité des projets repris, le modèle et le prompt principal sont conservés. Ce qui change, c’est ce qui les entoure : la récupération, la validation des sorties, l’instrumentation et les tests. Le diagnostic dit précisément quoi garder.

02Combien coûte la reprise ?

Le diagnostic de cinq jours est au forfait. La reprise est chiffrée à partir du rapport, par sprints, avec un devis envoyé sous 48 heures après le premier échange. Vous pouvez vous arrêter après le diagnostic et exécuter le plan en interne.

03Travaillez-vous avec notre équipe ou à sa place ?

Avec elle. Vos développeurs participent aux sprints, relisent le code et reprennent l’évaluation continue au transfert. Un projet IA que seule une agence sait exploiter n’est pas un projet repris.

04Quels modèles et quelles stacks ?

OpenAI, Anthropic, Mistral, Gemini, et les modèles open source via un fournisseur d’inférence. Côté code : TypeScript et Node.js, Next.js, Python. Bases vectorielles courantes, PostgreSQL avec pgvector, recherche hybride BM25.

05Comment mesurez-vous que ça marche mieux ?

Par un jeu d’évaluation de cinquante à quelques centaines de cas réels, avec des sources attendues et un seuil de mise en production défini avec vous. Le score est publié à chaque sprint. Sans ce chiffre, aucune promesse.

06Et si le problème vient des données ?

C’est fréquent et le diagnostic le montre vite : documents obsolètes non retirés, découpage inadapté, métadonnées absentes. Nous corrigeons le pipeline de préparation, mais nous ne produisons pas de données à votre place.

07Sous quel délai pouvez-vous commencer ?

Un premier échange de trente minutes sous 48 heures. Le diagnostic démarre en général dans les deux semaines suivantes, en fonction des accès que vous pouvez donner au code et aux logs.

Demander un diagnostic ?

Racontez-nous où en est le projet, en trois lignes. Réponse sous 48 heures, un premier échange de trente minutes, puis un devis écrit.