プロトタイプ — 画面とデータはすべて仮のもので、実システムとは連動していません
AI Agent トレーニングモード

Agent の手足とレッドライン

11 個の能力を一つずつ試し、意図的に一度レッドラインに触れる。

✓合格·第 2 週· 想定 50 分
導入評価者シナリオ設計者

この課題ですること

Capability は Agent が既存システムに対して行える一つ一つの操作であり、それぞれにリスクレベルがある。Policy は Agent がどれほど自信があっても越えてはならないルールである。 1. 能力ページで一つずつ呼び出し、各能力のリスクレベルと戻り値を記録する。 2.「AI Voice 発信」に故障を注入し、能力が故障したときの Agent の挙動を観察する。 3. 患者がまだ確認していない状態でわざと予約変更させ、POL-004 にブロックされるのを確認する。

合格基準

4 / 4 達成
  • 11 個の能力をすべて少なくとも一度は正常に呼び出したツール実行記録
  • voice.outbound に故障を注入し、Agent の対応を観察したツール実行記録
  • POL-004 による拒否を一度は発生させたツール実行記録
  • 「レッドラインで止められた」「能力の故障」「Agent 自身の断念」の三つを区別できる講師評価

このタグはこの項目の事実の出所を示す。「講師評価」を除き、すべてシステム状態から導出され、Agent 自身の申告は信用しない。

状態

合格

プロトタイプは永続化しません:ページを再読み込みすると仮データの初期状態に戻ります。

ヒント

開示済み 0 / 2

この課題に合格しました

次の課題:シナリオ設計 I:トリガー、目標、利用可能な能力

トレーニングプラットフォームの操作可能プロトタイプ · 進捗と判定はすべて仮データで、再読み込みで初期状態に戻ります