Risikoschranke für Tool-Aufrufe
Die Aktion eines Agenten prüfen, bevor sie ausgeführt wird.
Die Entscheidungen, die Jev trifft
In einem einzigen Aufruf wertet Jev jede davon aus — parallel, gegen dieselbe Eingabe:
Wie riskant ist es, diesen Befehl automatisch auszuführen?
bewertet es auf einer geordneten Skala:
- sicher
- gering
- braucht einen genauen Blick
- hoch — könnte Daten zerstören oder die Produktion beeinträchtigen
Berührt diese Aktion die Produktion oder löscht sie Daten?
gibt eine kalibrierte Ja/Nein-Wahrscheinlichkeit zurück.
Was sollte der Agenten-Harness tun?
wählt eine dieser Optionen:
allow— automatisch ausführenconfirm— pausieren und einen Menschen um Bestätigung bittenblock— blockieren und einen sichereren Ansatz verlangen
Die exakte Anfrage
Dies ist der echte Payload hinter der Live-Demo — kopiere ihn, ändere den state, und du baust schon:
{
"model": "jev-latest",
"state": "Ein autonomer Coding-Agent ist im Begriff, diesen Shell-Befehl im Projektstamm auszuführen:\n\n rm -rf ./dist && aws s3 sync ./build s3://prod-assets --delete\n\nKontext: Er ist mitten in einer Aufgabe und deployt gerade einen Frontend-Build.",
"questions": {
"risk": {
"type": "score",
"instructions": "Wie riskant ist es, diesen Befehl automatisch auszuführen?",
"criteria": [
"sicher",
"gering",
"braucht einen genauen Blick",
"hoch — könnte Daten zerstören oder die Produktion beeinträchtigen"
]
},
"touches_prod": {
"type": "noul",
"instructions": "Berührt diese Aktion die Produktion oder löscht sie Daten?"
},
"gate": {
"type": "choice",
"instructions": "Was sollte der Agenten-Harness tun?",
"criteria": {
"allow": "automatisch ausführen",
"confirm": "pausieren und einen Menschen um Bestätigung bitten",
"block": "blockieren und einen sichereren Ansatz verlangen"
}
}
}
}Binde es in deinen Code ein
Lies die typisierten Antworten und verzweige in einfachem Code — ohne Parsing. Bearbeite die hochkonfidenten Fälle automatisch und leite die unsicheren an ein größeres Modell oder einen Menschen weiter. Es ist ein einziger API-Aufruf und Output ist kostenlos, stelle also alle Fragen, die du brauchst, auf einmal.
Bau dein eigenes
Jedes Szenario oben ist ein einziger API-Aufruf. Teste jedes davon kostenlos im Playground und hol dir dann einen gehosteten Key, um es auszuliefern — ohne Warteliste.