エージェントの境界を定義する
エージェントのリクエストには、指示、関連するコンテキスト、および許可されたアクションの明確なセットが必要です。生のモデル呼び出しがワークスペース構成を継承することを期待するのではなく、アプリケーション内でこれらの入力を明示的に保ちます。
取得したドキュメントから質問に答えるなど、読み取り専用のタスクから始めます。これにより、外部システムを変更するツールを導入する前に、ソースの使用状況を評価できます。
取得をモデルリクエストに接続します
承認された文章を取得し、安定したソース識別子を添付して、ユーザーの質問に含めます。コンテキストを、選択したモデルとレイテンシ バジェットの制限内に保ちます。
使用可能なモデル識別子を使用して、TextCortex を通じてリクエストを送信します。同じ統合を使用して、独自の候補とオープンウェイトの候補を回答の品質に関して比較します。
アプリケーション コントロールを介してツールを実行する
ツールをサポートするモデル ルートの場合、提案されたツール名と引数をアプリケーションのルールに照らして検証します。実行前に権限を強制し、適切な場合にのみ結果をモデルに返します。
制限されたステップとタイムアウトを使用します。結果として生じるアクションのレビューを要求し、繰り返されるモデル リクエストによって同じ外部アクションが 2 回実行されるのを防ぎます。
エージェントステップごとのルート
分類ステップと複雑な合成ステップでは、異なるモデルを使用できます。マッピングを構成可能な状態に保ち、どのモデルが各結果を生成したかを記録します。
このマッピングを整理するには、ルーティングガイド を使用します。 EU ワークロードの場合、フォールバック パスを含め、すべてのエージェント ステップを許可された展開に制限します。
