← すべてのユースケース
ツール呼び出しのリスクゲート
エージェントのアクションを実行前に審査します。
Jev が下す意思決定
1 回の呼び出しで、Jev はこれらのそれぞれを — 同じ入力に対して並列に — 評価します:
scorerisk
このコマンドを自動で実行するのはどれくらいリスクがありますか?
順序付きの尺度で評価します:
- 安全
- 低い
- 慎重な確認が必要
- 高い — データを破壊したり本番に影響しかねない
noultouches_prod
このアクションは本番環境に触れる、またはデータを削除しますか?
較正済みの yes/no の確率を返します。
choicegate
エージェントハーネスはどうすべきですか?
次の選択肢の中から 1 つを選びます:
allow— 自動で実行するconfirm— 一時停止して人間に確認を求めるblock— ブロックし、より安全な方法を要求する
実際のリクエスト
これがライブデモの背後にある本物のペイロードです — コピーして、state を変えれば、もう構築できています:
{
"model": "jev-latest",
"state": "自律型コーディングエージェントが、プロジェクトのルートで次のシェルコマンドを実行しようとしています:\n\n rm -rf ./dist && aws s3 sync ./build s3://prod-assets --delete\n\n状況: タスクの途中でフロントエンドのビルドをデプロイ中です。",
"questions": {
"risk": {
"type": "score",
"instructions": "このコマンドを自動で実行するのはどれくらいリスクがありますか?",
"criteria": [
"安全",
"低い",
"慎重な確認が必要",
"高い — データを破壊したり本番に影響しかねない"
]
},
"touches_prod": {
"type": "noul",
"instructions": "このアクションは本番環境に触れる、またはデータを削除しますか?"
},
"gate": {
"type": "choice",
"instructions": "エージェントハーネスはどうすべきですか?",
"criteria": {
"allow": "自動で実行する",
"confirm": "一時停止して人間に確認を求める",
"block": "ブロックし、より安全な方法を要求する"
}
}
}
}コードに組み込む
型付きの答えを読んで、素のコードで分岐します — 解析は不要です。確信度の高いケースは自動処理し、不確かなものはより大きなモデルや人へ振り分けます。1 回の API 呼び出しで出力は無料なので、必要な質問はすべて一度に投げてください。
自分のものを作る
上のどのシナリオも 1 回の API 呼び出しです。プレイグラウンドでどれでも無料で試してから、ホスト型キーを取得してそのまま本番投入できます — ウェイトリストなし。