La création d'un prototype d'intelligence artificielle est devenue un processus extrêmement simple: il suffit d'envoyer une requête au modèle, d'obtenir une réponse et de présenter le résultat à l'utilisateur. Tant que chaque requête reste un événement indépendant, toute la chaîne d'interaction est compréhensible, facile à tester et à déboguer.

C'est précisément cette simplicité initiale qui crée l'illusion d'une développement aisé, faisant paraître de nombreuses applications d'IA précoces plus prêtes à l'emploi qu'elles ne le sont réellement. Cependant, la transition des requêtes isolées vers des systèmes de production complexes révèle des difficultés cachées.

Pour construire des systèmes fiables en exploitation réelle, il est nécessaire d'abandonner l'idée de requêtes exclusivement indépendantes au profit de flux de travail durables, capables de gérer les pannes et de préserver l'état de la tâche.