Dois-je créer mon propre agent marketing IA plutôt qu'acheter un outil ?
Créez-le vous-même quand la tâche est étroite et interne : un script qui lit votre changelog et dépose cinq brouillons de posts dans un fichier tient vraiment en un week-end, et il encode quelque chose qui n'a de sens que chez vous. Achetez dès que l'agent doit toucher des systèmes qui ne vous appartiennent pas. L'appel au modèle est la partie facile ; ce qui coûte cher, c'est l'état qui survit à un redémarrage, les identifiants qui expirent en silence, une étape de validation avant que quoi que ce soit ne sorte, et une mesure qui vous dit ce qu'une exécution a coûté. Presque tout le monde sous-estime cette seconde liste, parce qu'elle n'apparaît nulle part dans la démo.
La partie qui tient en un week-end, et celle qui n'y tient pas
La première version fonctionne, et c'est précisément ce qui trompe. Vous appelez un modèle, vous lui donnez un prompt et deux outils, et il rédige un post ou sort un rapport. Les SDK sont bons, le modèle fait le travail intéressant, et vous apprenez plus en un week-end qu'en un mois de lecture. Rien dans cette expérience n'est trompeur : ce n'est simplement pas la partie qui prend six mois.
L'autre partie n'apparaît que lorsque la chose tourne sans surveillance, sur de vrais comptes, pendant plus de quelques jours. Et c'est la même liste pour tout le monde :
- L'état Un agent qui oublie est un autre produit. Les notes, les brouillons, ce qu'il a déjà essayé : tout cela doit vivre quelque part qui survit à un redémarrage, sinon cela disparaît sans bruit.
- Les identifiants Les jetons expirent, sont révoqués et pourrissent. La panne est silencieuse : votre base contient encore une ligne indiquant "connecté" longtemps après que le fournisseur a cessé de l'honorer.
- La validation La première fois qu'un agent publiera quelque chose de faux sur un vrai compte, vous regretterez qu'une personne ne l'ait pas vu avant. Ajouter cette porte après coup, c'est réécrire le chemin d'exécution, pas cocher une case.
- Le coût La dépense par exécution est invisible tant que vous ne la mesurez pas, et un chiffre que vous n'avez pas ne peut être ni plafonné, ni facturé, ni expliqué.
- La livraison Amener le résultat jusqu'à un humain — Slack, e-mail, un tableau de bord — est un petit système à part entière, avec ses reprises et son problème de doublons.
Un test faire-ou-acheter qui tient en une séance
La bonne question n'est pas "puis-je le construire", car vous le pouvez. C'est : qui s'en occupe dans six mois, et que se passe-t-il la semaine où il casse pendant que vous livrez autre chose ? Notez honnêtement votre idée sur cinq lignes. Si la colonne de gauche domine, construisez. Si c'est la droite, vous vous engagez à maintenir une infrastructure identique dans toutes les entreprises de votre catégorie.
| Question | Plutôt construire | Plutôt acheter |
|---|---|---|
| Touche-t-il des systèmes qui ne sont pas les vôtres ? | Non. Il lit vos données et écrit un fichier | Oui. Il publie, envoie des e-mails ou dépense sur le compte d'un tiers |
| Que se passe-t-il s'il tourne deux fois ? | Rien. Le travail est répétable | Un post en double, un e-mail en double, un débit en double |
| Combien d'intégrations lui faut-il ? | Une ou deux, stables et bien documentées | Plusieurs, chacune avec son flux d'authentification et ses pannes |
| Qui répare à 23 h ? | Vous, et le correctif est un changement de configuration | Vous, et le correctif consiste à décoder le corps d'erreur d'un tiers |
| Le flux vous appartient-il en propre ? | Oui. Il encode quelque chose de spécifique à votre activité | Non. Toute entreprise de votre catégorie a besoin de la même chose |
Cinq choses que nous avons ratées en construisant le nôtre
Nous construisons et exploitons une équipe d'agents pour les entreprises des autres, donc nous avons payé chacun de ces points en production et non dans un article. Ce sont ceux que nous n'avions pas vus venir.
- Un conteneur qui redémarre oublie tout Nos agents tournent dans des conteneurs sans état. Tout ce qu'un agent écrivait sur le disque sans que personne ne l'ait poussé vers un stockage durable disparaissait au déploiement suivant — et l'échec est silencieux : cela se présente comme un agent qui a mystérieusement oublié une décision que vous l'avez vu prendre.
- Une réponse 200 n'est pas un succès Une intégration nous a répondu par un HTTP 200 et une enveloppe affirmant que l'appel avait réussi, alors que le corps en dessous disait que le post avait été rejeté pour un champ manquant. Nous l'avons enregistré comme publié. On a dit au client que son post était en ligne, et il ne l'était pas. Lisez le corps, pas le code de statut.
- Ne réessayez jamais une écriture au résultat inconnu Si l'appel lève une erreur, vous ne savez pas s'il a abouti. Réessayer, c'est exactement ainsi que la même chose est publiée deux fois. Ne réessayez que sur une réponse qui prouve que rien ne s'est produit.
- Les contrôles de santé échouent en silence si vous ne les rendez pas bruyants Nous avions une intégration qui n'avait jamais établi la moindre connexion fonctionnelle, et notre propre alerte est restée muette, parce que la règle exigeait deux échecs dans une fenêtre qui n'en a jamais contenu deux.
- L'étape de validation est la fonctionnalité Toute action sortante — un post, un e-mail à froid, une dépense publicitaire — attend une personne. C'est la seule chose qui rende sûr de pointer un agent vers un vrai compte, et c'est précisément ce qu'un prototype de week-end n'a jamais.
Rien de tout cela ne dit qu'il ne faut pas construire d'agent. Cela dit pour quelle moitié du travail vous vous portez volontaire. Si le flux est interne — résume ceci, rédige cela, surveille ce flux — construisez-le et amusez-vous. Dès qu'il publie, envoie des e-mails ou dépense, vous avez commencé à bâtir une infrastructure au lieu d'écrire un prompt.
Le juste milieu : construire le jugement, acheter la mécanique
La plupart des fondateurs qui s'en sortent contents ont fait ce partage. Ce qu'ils gardent, c'est ce que personne ne peut leur vendre : leur positionnement, leur offre, leur ton, le canal qui compte ce trimestre, ce qu'est un bon post pour leur audience. Ce qu'ils confient, c'est la mécanique du dessous, parce que les reprises, les validations, le stockage des identifiants, la livraison, la mesure et une piste d'audit sont identiques dans toute entreprise qui en a besoin. Construire la seconde coûte cher précisément parce qu'elle ne vous différencie pas.
Si vous achetez, posez les questions auxquelles un prototype ne peut pas répondre. Que se passe-t-il quand une publication échoue ? L'agent voit-il le résultat de sa propre action, ou ne l'apprend-il que d'un humain ? Qu'est-ce qui est journalisé, et pendant combien de temps ? Comment la dépense par exécution est-elle restituée ? Et regardez la facturation, car le coût d'un agent bouge avec ce qu'il fait, ce qui explique qu'une bonne partie de cette catégorie soit passée à la tarification à l'usage. AgentCeres — the AI Growth Officer, sur agentceres.com — est bâti sur ce partage : les agents rédigent, une personne valide tout ce qui sort, et chaque action est journalisée. Si la vraie question porte sur les personnes plutôt que sur le code, recruter un marketeur ou utiliser l'IA est plus proche.
FAQ
- Est-ce moins cher de construire mon propre agent marketing IA ?
- Moins cher sur la facture du modèle, plus cher sur votre agenda. Un agent interne mono-usage tourne pour une dépense de tokens dérisoire. Ce qui surprend, c'est la maintenance : une intégration renomme un champ, un jeton expire, un modèle est retiré, et chacun de ces événements est une soirée que vous n'aviez pas prévue. Mettez un prix réaliste sur vos heures et le calcul s'inverse généralement dès que l'agent touche plus d'un ou deux systèmes externes.
- Quelle est la plus petite version qui vaille la peine d'être construite ?
- Un flux, une entrée, une sortie, aucune écriture externe. Par exemple : lis les commits de la semaine, rédige cinq posts, enregistre-les dans un fichier que je corrigerai. Il tourne à la demande, rien ne casse s'il échoue, et vous apprenez exactement où les modèles sont forts et faibles avant de leur confier un processus visible par vos clients.
- Puis-je simplement l'assembler avec un outil d'automatisation ?
- Souvent oui, et c'est une bonne étape intermédiaire. Un outil de workflow vous offre les reprises, un coffre à identifiants et un historique d'exécution, soit trois des cinq parties difficiles. Ce qu'il ne vous offre pas, c'est le jugement sur ce qui mérite d'être publié, ni une étape de validation à laquelle votre équipe fait réellement confiance. Cela se conçoit avec soin ou s'emprunte à qui l'a déjà conçu.
- Comment empêcher un agent de faire quelque chose d'embarrassant ?
- Placez une personne entre le brouillon et le monde. Une porte de validation — l'agent propose une action, un humain voit exactement ce qui va partir, et l'exécution n'a lieu qu'ensuite — bat n'importe quelle consigne dans le prompt, parce qu'elle est structurelle et non consultative. Un prompt est une demande ; une porte est un mur. Nos actions sortantes n'ont jamais été sans porte, et c'est pour cette raison.
- Dois-je construire mon propre agent si je ne suis pas technique ?
- Non, et c'est la réponse honnête plutôt que commerciale. Le prototype est aujourd'hui vraiment accessible. La moitié opérationnelle, ce sont des bases de données, des files, OAuth et de la gestion d'erreurs, et si vous ne pouvez pas déboguer cela un mauvais jour, un outil résiliable est un meilleur marché qu'un système que vous ne pouvez pas réparer.
Want this done for you?
AgentCeres is a managed AI marketing team — specialists draft the work, you approve what ships. 14-day free trial, from $39/month.