Bloome : J'ai Testé Une Vraie Équipe D'Agents IA (Le Verdict)
La plupart du temps, on ouvre un chatbot, on écrit un gros prompt et on espère qu'il va nous sortir directement le bon résultat. Ça marche parfois sur un coup de chance. Mais sur un vrai projet à plusieurs étapes, cette technique montre vite ses limites. J'ai testé Bloome, une plateforme qui fait travailler plusieurs agents IA ensemble dans la même conversation — un qui construit, un qui critique, un qui améliore, et moi qui garde la décision finale. Voici ce que ça donne sur un vrai projet.
Le problème du prompt unique
Dans un vrai projet, générer la page finale, c'est presque la dernière étape. Avant ça, il faut comprendre ce qu'on construit, à qui on s'adresse, quel message faire passer, quelles objections les gens peuvent avoir, et comment transformer une idée brute en quelque chose de clair et crédible. Une seule IA peut générer vite, mais elle ne prend pas toujours le recul qu'aurait une véritable équipe : elle peut accepter un mauvais angle, écrire un truc qui sonne bien mais qui ne vend rien, ou foncer dans l'exécution avant même que le problème soit posé.
L'idée de Bloome, c'est justement de voir ce qu'il se passe quand plusieurs agents travaillent dans la même conversation avec des rôles différents, plutôt que de tout miser sur un seul prompt.
Comment fonctionne Bloome
Après création du compte, Bloome se télécharge en application sur macOS, Windows, Google Play et iOS. On y connecte ensuite les agents qu'on veut faire travailler ensemble : Codex, OpenCode, Hermes Agent, Claude Code, Gemini CLI, Grok ou l'agent natif de Bloome. Pour ce test, j'ai connecté Codex, puis créé une petite équipe sur mesure : un growth specialist, un brand strategist et un product marketing, en plus de Codex pour l'exécution.
Chaque agent a son propre nom, sa photo de profil, et surtout des règles de collaboration qu'on définit soi-même dans les settings du groupe : qui doit intervenir en premier, ce que chacun doit challenger, et l'interdiction de sortir directement une version finale sans passer par les étapes intermédiaires.
Le test : une équipe produit pour la Nerdy Pocket
Pour tester ça en conditions réelles, j'ai monté un groupe autour d'un faux projet : une landing page pour la Nerdy Pocket, une console portable rétrofuturiste fictive que j'utilise régulièrement pour tester des outils IA. Règle du jeu fixée dans les collaboration rules : le product marketing définit d'abord les cibles, le positionnement et les modèles ; le brand strategist pose ensuite l'univers de marque, le ton premium et la direction visuelle ; le growth specialist arrive en dernier pour challenger tout ce qui est trop vague ou trop marketing, avant validation finale de ma part.
Résultat : au lieu de balancer direct un prompt pour générer le site, l'équipe a d'abord transformé l'idée brute en brief solide. Les agents se sont appelés les uns les autres, ont attendu leur tour, et le growth specialist a même renvoyé une critique en listant noir sur blanc ce qui manquait — "zéro stratégie de conversion" — avant que je valide et qu'on passe à l'exécution.
La boucle critique : V1 → V2 → V3
Une fois le brief posé, Codex a généré un premier prototype en se basant sur le travail de l'équipe. La V1 respectait la structure demandée, mais restait trop simple, presque un placeholder. J'ai demandé une version plus premium visuellement, sans toucher au positionnement ni au copywriting : la V2 est arrivée nettement améliorée. Puis j'ai fait relire le résultat par les trois autres agents, qui ont chacun donné leur avis sur la direction premium, le parcours de conversion et les corrections prioritaires — d'où une V3 intégrant leurs retours.
Ce qui frappe dans ce processus, c'est que ce n'est pas moi qui fais l'aller-retour entre chaque agent : ils se relisent et se critiquent entre eux, et je n'interviens que pour trancher.
Le twist final : remplacer l'agent par Claude Opus 4.8
Même après la V3, je n'étais pas encore satisfait du résultat. J'ai donc pris une décision plus radicale : remplacer l'agent Codex par un agent tournant sous Claude Opus 4.8, en lui demandant de reprendre tout le travail des autres agents, respecter la structure validée, et livrer une version beaucoup plus élaborée avec animations et effet waouh.
Le résultat final — la Nerdy Kings Ultimate Landing — n'a plus rien à voir avec la V1 : style premium et rétro respecté, mini-jeu jouable intégré directement dans la page, deux éditions avec leurs prix (299€ et 499€), une section matériaux détaillant l'aluminium brossé et les boutons en alliage doré, et un dernier call-to-action avec capture d'email. Un sacré écart avec le prototype de départ.
Mon avis
Ce qui m'a le plus marqué, ce n'est pas la qualité du rendu final — n'importe quel bon modèle de code peut produire une belle landing page. C'est le fait que les agents s'appellent, se critiquent et s'ajustent entre eux sans que j'aie à faire l'intermédiaire à chaque étape. Ça change vraiment la nature du travail : on passe de "je prompte et je corrige" à "je supervise une équipe et je tranche".
Soyons honnêtes : si votre but c'est d'envoyer un seul prompt et d'attendre le résultat, Bloome ne sert à rien — autant ouvrir un chatbot classique. Mais si vous avez un vrai workflow, avec plusieurs étapes et le besoin de construire progressivement sur une bonne base, c'est clairement un outil à tester. Des crédits gratuits sont ajoutés chaque jour, ce qui laisse largement de quoi se faire un avis avant de sortir la carte bleue.

🎬 Tu préfères la version vidéo ?
Cet article est tiré de ma vidéo YouTube — clique pour la voir.
Regarder sur YouTube →🛠️ Outils que tu peux tester en lien avec cet article
Une sélection de mes outils testés, pertinents pour aller plus loin.
🛠️ Tu cherches des outils IA testés ?
J'ai testé plus de 20 outils IA en vidéo — résumé, mode d'emploi, mon verdict.
Voir mon annuaire d'outils →



