Le ChatGPT qui disait oui. L'API qui disait non.
Un essayage bijou impeccable dans ChatGPT. Même modèle et prompt sur l'API : échec. On a arrêté de prototyper dans ChatGPT et livré un pipeline à trois modèles qui ne réécrit jamais le client.
On construisait un essayage virtuel de collier pour un client bijouterie.
L'idée avait l'air simple. Uploader un selfie, choisir un collier, le voir sur sa propre photo. Même visage. Même lumière. Mêmes vêtements. Seul le bijou change.
Avant d'écrire du code, j'ai testé dans ChatGPT. Portrait uploadé, demande d'ajouter un collier en or simple. Quelques tweaks de prompt pour un avant/après propre.
Ça a claqué.
L'identité tenait. La lumière matchait. Ça faisait vraie photo. Je me suis dit : facile.
Puis on est passés à l'API.
Même modèle. Même prompt. Expérience complètement différente.
Refus de modération. Images à peine changées. Peu importe le reformulage, on n'approchait pas de ce qu'on venait de voir dans ChatGPT.
C'est ça que je n'attendais pas.
Même marque, produit différent
En tant que développeur, tu utilises la même marque, tu appelles le même modèle, tu assumes naturellement que ce que tu as validé dans ChatGPT passera en production.
Ce n'était pas le cas.
Le plus étrange : une retouche collier tout à fait normale autour du cou pouvait être flaguée comme sensible. Mais quand le modèle renvoyait une image, il était content de changer ce qu'on n'avait pas demandé : peau lissée, maquillage différent, parfois même les cheveux.
Ce qu'on voulait éditer était bloqué. Ce qu'on voulait préserver était réécrit.
Je ne dis pas que l'API a besoin de moins de garde-fous. Je voudrais juste que l'écart entre ChatGPT et l'API production soit plus clair. On a perdu beaucoup de temps d'ingénierie à redessiner un système autour de capacités qu'on avait déjà « validées ».
L'architecture qui a marché
Au final, la solution n'était pas un meilleur prompt. C'était une meilleure architecture.
ChatGPT Vision trouvait seulement où placer le collier. Flux rendait seulement le bijou. Puis on composite juste cette petite zone éditée sur la photo originale intacte.
Trois modèles, trois jobs, et personne n'avait le droit de réécrire le client.
Ce projet a complètement changé comment je construis des produits IA. Aujourd'hui je ne prototype plus contre ChatGPT. Je prototype contre l'API que je vais vraiment shipper.
Parce qu'une belle démo ne se traduit pas toujours en un bon système de production.
Curieux de savoir si d'autres ont vécu ça : ChatGPT qui rend ça facile, l'API production qui devient un autre problème d'ingénierie.
