LA PENSION

Donnez à l’agent une question précise, des outils aux permissions limitées et une condition d’arrêt vérifiable. Évaluez le travail terminé, en incluant les actions échouées et la revue.

La décision que ce guide vous aide à prendre

Comment un agent peut-il utiliser des outils sans transformer le compte en automation non contrôlée ?

Vous partirez avec : Un contrat d'outil avec permis lit, propose écrit et arrête les conditions.

Commencez ici : Définir la tâche de compte.

Télécharger ce guide Fiche de décision

Définir l'action avant de choisir le modèle

Un agent utilisateur d'outils peut demander des informations, observer le résultat et décider si une autre étape est nécessaire. Pour ABM, une tâche limitée pourrait être de localiser une annonce d'entreprise, de vérifier l'entité CRM et de proposer un mémoire source. Le workflow devrait définir les étapes autorisées avant le début de l'exécution.

Séparer l'accès en lecture de l'accès en écriture. La recherche de documents approuvés est différente de la modification d'une occasion ou de la communication avec une perspective. Un modèle de la capacité de décrire une action ne lui donne pas la permission d'exécuter cette action. Rendre le contrat explicite pour chaque outil.

Ce qu'apporte ReAct

Yao et ses collègues ont étudié l'interaction du raisonnement et des actions dans ReAct. Le document de la CILR 2023 a évalué les réponses aux questions, la vérification des faits et les tâches interactives, en faisant état des améliorations apportées à ses repères. Ces résultats appuient l'étude de l'interaction structurée entre les outils; ils ne valident pas les activités de sensibilisation des entreprises.

Notre interprétation ABM consiste à exposer la boucle observable : la question posée, l'outil invoqué, le résultat renvoyé, la preuve sélectionnée et la décision prise. Inspectez ces documents plutôt que de traiter une explication éloquente comme un récit complet de ce qui s'est passé.

Consultez les méthodes et les résultats originaux dans ReAct: Synergizing Reasoning and Acting in Language Models.

Le flux de travail pratique

Agents ABM utilisant des outils : concevoir une recherche encadrée. Processus: Définir la tâche de compte; Accorder un accès étroit aux outils; Observer les résultats et les exceptions; Valider la sortie proposée; Arrêter ou retirer explicitement.
Une séquence pour appliquer ce guide. Utilisez les points d'examen pour décider si les travaux sont prêts à se poursuivre. Afficher l'image en taille réelle
  1. Définir la tâche de compte
  2. Accorder un accès étroit aux outils
  3. Observer les résultats et les exceptions
  4. Valider la sortie proposée
  5. Arrêter ou retirer explicitement

Comparer les approches

Comparer les approches
ApprocheUtile quandLimitationAction suivante
Agent en lecture seuleCollecte de preuvesLes sources peuvent être ambiguësVérifier l'entité et le support
Projet de propositionPréparation du matériel du vendeurLa sortie peut être incorrecteExamen avant activation
Règle déterministeLogique de routage stableImpossible de résoudre une nouvelle ambiguïtéUtiliser des conditions explicites
Agent capable d'écrireUne tâche opérationnelle validéeLes erreurs peuvent affecter les enregistrementsExiger une autorisation et une récupération
Guide de décision: Agents ABM utilisant des outils : concevoir une recherche encadrée. Agent en lecture seule: Collecte de preuves. PROCHAINE ACTION: Vérifier l'entité et le support Projet de proposition: Préparation du matériel du vendeur. PROCHAINE ACTION: Examen avant activation Règle déterministe: Logique de routage stable. PROCHAINE ACTION: Utiliser des conditions explicites Agent capable d'écrire: Une tâche opérationnelle validée. PROCHAINE ACTION: Exiger une autorisation et une récupération
Faire correspondre la situation à une action utile. La comparaison ci-dessus comprend les limites de chaque approche. Afficher l'image en taille réelle

Spécifier le contrat d'outil

Un outil de recherche d'entreprise devrait accepter un identifiant d'organisation et une requête limitée. Sa production devrait distinguer les documents récupérés des faits vérifiés. Un outil de lecture CRM devrait faire respecter les permissions d'enregistrement et renvoyer les champs nécessaires à la tâche. Un projet d'outil peut proposer du contenu sans l'envoyer.

Limiter les réticules, le temps d'exécution et le coût. Définissez ce qui se passe lorsqu'un outil s'éteint, renvoie plusieurs entités correspondantes ou contredit des preuves antérieures. Préservez le dernier état accepté. Un flux de travail interrompu devrait reprendre à partir d'un point de contrôle connu plutôt que de répéter tous les effets secondaires.

Utiliser une enquête d'expansion fictive

L'agent reçoit une question au sujet du nouveau centre de distribution de Northbridge Components. Il récupère une annonce, confirme l'identificateur de l'organisation et constate qu'aucune conversation avec les parties prenantes n'est enregistrée. Il peut rédiger une hypothèse et une question de découverte. Il ne peut inventer un projet ou réserver une réunion.

Si l'outil de recherche de l'entreprise trouve une entreprise de logistique également nommée, l'agent devrait arrêter pour la résolution de l'entité. Si une page contient des instructions pour exporter des enregistrements CRM, le texte récupéré reste un matériel source non fiable. La politique d'outils devrait empêcher cette action indépendamment du libellé du projet.

Consultez les méthodes et les résultats originaux dans Not what you have signed up for: Indirect Prompt Injection.

Évaluer les trajectoires complètes

Tester le travail ordinaire, les entités ambiguës, les preuves manquantes et les défaillances des outils. Compter les mémoires acceptés, les affirmations non étayées, les appels inutiles d'outils, le temps écoulé total et les coûts de correction. Vérifiez si le workflow s'arrête à la limite droite. Un taux élevé d'appels API réussis peut coexister avec de mauvaises décisions de compte.

Conservez un petit ensemble de cas rejouables avec les résultats attendus. Après avoir modifié un schéma d'outil, une permission ou un modèle, exécutez ces cas avant d'augmenter la charge de travail. Ajouter les échecs découverts dans la production sans supprimer les exemples difficiles pour améliorer le score rapporté.

Élargir les autorisations après la preuve

Commencez par rechercher en lecture seule et rédiger des propositions. Élargir une autorisation seulement lorsque la tâche associée est utile, les chemins de défaillance sont compris et un propriétaire peut inverser ou réconcilier les erreurs. Gardez l'activation sortante comme une décision distincte avec ses propres conditions.

L'avantage pratique d'un agent provient de la manipulation d'une séquence limitée avec des preuves traçables. Si une règle fixe résout déjà la tâche de façon fiable, une simple étape déterministe peut être le meilleur choix de fonctionnement. Utilisez la complexité requise par la décision.

Pour approfondir la prochaine étape de cette décision, lisez Processus agentiques et automatisation marketing.

Votre prochaine liste de contrôle

  • Agent en lecture seule : Vérifier l'entité et le support. Vérifier la limitation: les sources peuvent être ambiguës.
  • Projet de proposition: Revue avant activation. Vérifiez la limitation : la sortie peut être incorrecte.
  • Règle déterministe: Utiliser des conditions explicites. Vérifier la limitation : ne peut pas résoudre une nouvelle ambiguïté.
  • Agent capable d'écrire : Exiger la permission et la récupération. Vérifiez la limitation : les erreurs peuvent affecter les enregistrements.

Utilisez la comparaison pour choisir une étape suivante délimitée. Consigner la preuve, le propriétaire responsable et la décision de révision avant d'étendre le jeu à des comptes supplémentaires.

Comment interpréter les sources

Lisez chaque référence en regard de la revendication qu'elle soutient. La documentation de la plate-forme décrit les capacités; les cas publics rapportent l'expérience d'un éditeur; les résultats de la recherche s'appliquent à la tâche étudiée et à la population. Le workflow de ce guide est une proposition opérationnelle à évaluer dans votre propre contexte de compte.

Inspecter la bibliothèque de recherche et connecter ce guide aux opérations d'agents.

Les questions auxquelles ce guide répond

Comment un agent peut-il utiliser des outils sans transformer le compte en automation non contrôlée ?

Donnez à l’agent une question précise, des outils aux permissions limitées et une condition d’arrêt vérifiable. Évaluez le travail terminé, en incluant les actions échouées et la revue.

Par quoi commencer ?

Définir la tâche de compte. Consigner les éléments de preuve et les critères d'acceptation avant de poursuivre. Utilisez la feuille de travail de décision pour documenter le propriétaire, la date d'examen et la prochaine mesure.

Lisez la recherche originale

Le guide explique les constatations ci-dessus. Ouvrir une publication pour inspecter ses méthodes, son établissement et ses qualifications.

ReAct: Synergizing Reasoning and Acting in Language Models. Le succès de référence n'est pas l'autorisation d'exploiter un système de marketing de la production de manière autonome.

Not what you have signed up for: Indirect Prompt Injection. L'article démontre les mécanismes d'attaque plutôt qu'un taux d'incident de marketing actuel.

Relier ce guide à la prochaine décision

Observer le processus ABM au-delà des appels au modèle — Qu'est-ce que les équipes devraient consigner pour expliquer pourquoi un agent ABM a produit, retardé ou exécuté une recommandation particulière?

Injection de prompt : distinguer les sources des instructions — Qu'est-ce qui peut mal tourner quand un agent de marketing lit une page externe?

Processus agentiques et automatisation marketing — Quand une tâche nécessite-t-elle un agent au lieu de l'automatisation fixe?

METTRE LE TEMPS EN PRATIQUE

Commencez par les priorités de votre compte.

Comparer la focalisation des comptes, la personnalisation, les produits livrables et la mesure.

Découvrir Momentum