Définir la limite de l'agent
Une demande d'agent nécessite des instructions, un contexte pertinent et un ensemble clair d'actions autorisées. Gardez ces entrées explicites dans votre application plutôt que d'attendre qu'un appel de modèle brut hérite de la configuration de l'espace de travail.
Commencez par une tâche en lecture seule, comme répondre à une question à partir de documents récupérés. Cela vous permet d'évaluer l'utilisation des sources avant d'introduire des outils qui modifient les systèmes externes.
Connecter la récupération à la demande de modèle
Récupérez les passages autorisés, attachez des identifiants de source stables et incluez-les avec la question de l’utilisateur. Gardez le contexte dans les limites du modèle sélectionné et de votre budget de latence.
Envoyez la demande via TextCortex en utilisant l'identifiant de modèle disponible. Utilisez la même intégration pour comparer les candidats propriétaires et ouverts sur la qualité des réponses.
Exécuter des outils via les contrôles d'application
Pour un itinéraire modèle prenant en charge les outils, validez le nom de l’outil proposé et les arguments par rapport aux règles de votre application. Appliquez les autorisations avant l’exécution et renvoyez le résultat au modèle uniquement lorsque cela est approprié.
Utilisez des étapes et des délais d'attente limités. Exigez un examen des actions consécutives et empêchez une demande de modèle répétée d’exécuter deux fois la même action externe.
Itinéraire par étape d'agent
Une étape de classification et une étape de synthèse complexe peuvent utiliser des modèles différents. Gardez le mappage configurable et enregistrez quel modèle a produit chaque résultat.
Utilisez le guide d'itinéraire pour organiser ce mappage. Pour les charges de travail de l’UE, limitez chaque étape de l’agent aux déploiements autorisés, y compris les chemins de secours.
