LA PENSION
Donnez à l’agent une question précise, des outils aux permissions limitées et une condition d’arrêt vérifiable. Évaluez le travail terminé, en incluant les actions échouées et la revue.
La décision que ce guide vous aide à prendre
Comment un agent peut-il utiliser des outils sans transformer le compte en automation non contrôlée ?
Vous partirez avec : Un contrat d'outil avec permis lit, propose écrit et arrête les conditions.
Commencez ici : Définir la tâche de compte.
Télécharger ce guide Fiche de décisionDéfinir l'action avant de choisir le modèle
Un agent utilisateur d'outils peut demander des informations, observer le résultat et décider si une autre étape est nécessaire. Pour ABM, une tâche limitée pourrait être de localiser une annonce d'entreprise, de vérifier l'entité CRM et de proposer un mémoire source. Le workflow devrait définir les étapes autorisées avant le début de l'exécution.
Séparer l'accès en lecture de l'accès en écriture. La recherche de documents approuvés est différente de la modification d'une occasion ou de la communication avec une perspective. Un modèle de la capacité de décrire une action ne lui donne pas la permission d'exécuter cette action. Rendre le contrat explicite pour chaque outil.
Ce qu'apporte ReAct
Yao et ses collègues ont étudié l'interaction du raisonnement et des actions dans ReAct. Le document de la CILR 2023 a évalué les réponses aux questions, la vérification des faits et les tâches interactives, en faisant état des améliorations apportées à ses repères. Ces résultats appuient l'étude de l'interaction structurée entre les outils; ils ne valident pas les activités de sensibilisation des entreprises.
Notre interprétation ABM consiste à exposer la boucle observable : la question posée, l'outil invoqué, le résultat renvoyé, la preuve sélectionnée et la décision prise. Inspectez ces documents plutôt que de traiter une explication éloquente comme un récit complet de ce qui s'est passé.
Consultez les méthodes et les résultats originaux dans ReAct: Synergizing Reasoning and Acting in Language Models.
Le flux de travail pratique
- Définir la tâche de compte
- Accorder un accès étroit aux outils
- Observer les résultats et les exceptions
- Valider la sortie proposée
- Arrêter ou retirer explicitement
Comparer les approches
| Approche | Utile quand | Limitation | Action suivante |
|---|---|---|---|
| Agent en lecture seule | Collecte de preuves | Les sources peuvent être ambiguës | Vérifier l'entité et le support |
| Projet de proposition | Préparation du matériel du vendeur | La sortie peut être incorrecte | Examen avant activation |
| Règle déterministe | Logique de routage stable | Impossible de résoudre une nouvelle ambiguïté | Utiliser des conditions explicites |
| Agent capable d'écrire | Une tâche opérationnelle validée | Les erreurs peuvent affecter les enregistrements | Exiger une autorisation et une récupération |
Spécifier le contrat d'outil
Un outil de recherche d'entreprise devrait accepter un identifiant d'organisation et une requête limitée. Sa production devrait distinguer les documents récupérés des faits vérifiés. Un outil de lecture CRM devrait faire respecter les permissions d'enregistrement et renvoyer les champs nécessaires à la tâche. Un projet d'outil peut proposer du contenu sans l'envoyer.
Limiter les réticules, le temps d'exécution et le coût. Définissez ce qui se passe lorsqu'un outil s'éteint, renvoie plusieurs entités correspondantes ou contredit des preuves antérieures. Préservez le dernier état accepté. Un flux de travail interrompu devrait reprendre à partir d'un point de contrôle connu plutôt que de répéter tous les effets secondaires.
Utiliser une enquête d'expansion fictive
L'agent reçoit une question au sujet du nouveau centre de distribution de Northbridge Components. Il récupère une annonce, confirme l'identificateur de l'organisation et constate qu'aucune conversation avec les parties prenantes n'est enregistrée. Il peut rédiger une hypothèse et une question de découverte. Il ne peut inventer un projet ou réserver une réunion.
Si l'outil de recherche de l'entreprise trouve une entreprise de logistique également nommée, l'agent devrait arrêter pour la résolution de l'entité. Si une page contient des instructions pour exporter des enregistrements CRM, le texte récupéré reste un matériel source non fiable. La politique d'outils devrait empêcher cette action indépendamment du libellé du projet.
Consultez les méthodes et les résultats originaux dans Not what you have signed up for: Indirect Prompt Injection.
Évaluer les trajectoires complètes
Tester le travail ordinaire, les entités ambiguës, les preuves manquantes et les défaillances des outils. Compter les mémoires acceptés, les affirmations non étayées, les appels inutiles d'outils, le temps écoulé total et les coûts de correction. Vérifiez si le workflow s'arrête à la limite droite. Un taux élevé d'appels API réussis peut coexister avec de mauvaises décisions de compte.
Conservez un petit ensemble de cas rejouables avec les résultats attendus. Après avoir modifié un schéma d'outil, une permission ou un modèle, exécutez ces cas avant d'augmenter la charge de travail. Ajouter les échecs découverts dans la production sans supprimer les exemples difficiles pour améliorer le score rapporté.
Élargir les autorisations après la preuve
Commencez par rechercher en lecture seule et rédiger des propositions. Élargir une autorisation seulement lorsque la tâche associée est utile, les chemins de défaillance sont compris et un propriétaire peut inverser ou réconcilier les erreurs. Gardez l'activation sortante comme une décision distincte avec ses propres conditions.
L'avantage pratique d'un agent provient de la manipulation d'une séquence limitée avec des preuves traçables. Si une règle fixe résout déjà la tâche de façon fiable, une simple étape déterministe peut être le meilleur choix de fonctionnement. Utilisez la complexité requise par la décision.
Votre prochaine liste de contrôle
- Agent en lecture seule : Vérifier l'entité et le support. Vérifier la limitation: les sources peuvent être ambiguës.
- Projet de proposition: Revue avant activation. Vérifiez la limitation : la sortie peut être incorrecte.
- Règle déterministe: Utiliser des conditions explicites. Vérifier la limitation : ne peut pas résoudre une nouvelle ambiguïté.
- Agent capable d'écrire : Exiger la permission et la récupération. Vérifiez la limitation : les erreurs peuvent affecter les enregistrements.
Utilisez la comparaison pour choisir une étape suivante délimitée. Consigner la preuve, le propriétaire responsable et la décision de révision avant d'étendre le jeu à des comptes supplémentaires.
Comment interpréter les sources
Lisez chaque référence en regard de la revendication qu'elle soutient. La documentation de la plate-forme décrit les capacités; les cas publics rapportent l'expérience d'un éditeur; les résultats de la recherche s'appliquent à la tâche étudiée et à la population. Le workflow de ce guide est une proposition opérationnelle à évaluer dans votre propre contexte de compte.
Inspecter la bibliothèque de recherche et connecter ce guide aux opérations d'agents.
Les questions auxquelles ce guide répond
Comment un agent peut-il utiliser des outils sans transformer le compte en automation non contrôlée ?
Donnez à l’agent une question précise, des outils aux permissions limitées et une condition d’arrêt vérifiable. Évaluez le travail terminé, en incluant les actions échouées et la revue.
Par quoi commencer ?
Définir la tâche de compte. Consigner les éléments de preuve et les critères d'acceptation avant de poursuivre. Utilisez la feuille de travail de décision pour documenter le propriétaire, la date d'examen et la prochaine mesure.
Lisez la recherche originale
Le guide explique les constatations ci-dessus. Ouvrir une publication pour inspecter ses méthodes, son établissement et ses qualifications.
ReAct: Synergizing Reasoning and Acting in Language Models. Le succès de référence n'est pas l'autorisation d'exploiter un système de marketing de la production de manière autonome.
Not what you have signed up for: Indirect Prompt Injection. L'article démontre les mécanismes d'attaque plutôt qu'un taux d'incident de marketing actuel.
Relier ce guide à la prochaine décision
Observer le processus ABM au-delà des appels au modèle — Qu'est-ce que les équipes devraient consigner pour expliquer pourquoi un agent ABM a produit, retardé ou exécuté une recommandation particulière?
Injection de prompt : distinguer les sources des instructions — Qu'est-ce qui peut mal tourner quand un agent de marketing lit une page externe?
Processus agentiques et automatisation marketing — Quand une tâche nécessite-t-elle un agent au lieu de l'automatisation fixe?
METTRE LE TEMPS EN PRATIQUE
Commencez par les priorités de votre compte.
Comparer la focalisation des comptes, la personnalisation, les produits livrables et la mesure.
Découvrir Momentum