Modell-Routing
Jev entscheiden lassen, welches Modell eine Anfrage bearbeiten soll.
Die Entscheidungen, die Jev trifft
In einem einzigen Aufruf wertet Jev jede davon aus — parallel, gegen dieselbe Eingabe:
Wie komplex ist diese Anfrage?
bewertet es auf einer geordneten Skala:
- trivial
- einfach
- moderat
- schwer
- sehr schwer / architektonisch
Welches Modell sollte sie bearbeiten?
wählt eine dieser Optionen:
fast— schnelles günstiges Modell — triviale Änderungen, Formatierung, Nachschlagenbalanced— mittleres Modell — normale Funktionen und Fixesstrong— Spitzenmodell — Architektur, Migrationen, schweres Reasoning
Wird dies wahrscheinlich Tool-Aufrufe erfordern (Dateien lesen, Befehle ausführen)?
gibt eine kalibrierte Ja/Nein-Wahrscheinlichkeit zurück.
Die exakte Anfrage
Dies ist der echte Payload hinter der Live-Demo — kopiere ihn, ändere den state, und du baust schon:
{
"model": "jev-latest",
"state": "Eingehende Nutzeranfrage an einen KI-Coding-Agenten: \"Refaktoriere unseren Auth-Service, um mandantenfähiges SSO mit SAML und SCIM zu unterstützen, halte die Abwärtskompatibilität und schreibe einen Migrationsplan.\" Verfügbare Modelle: fast (günstig, klein), balanced (mittel), strong (teuer, Spitzenklasse).",
"questions": {
"complexity": {
"type": "score",
"instructions": "Wie komplex ist diese Anfrage?",
"criteria": [
"trivial",
"einfach",
"moderat",
"schwer",
"sehr schwer / architektonisch"
]
},
"route": {
"type": "choice",
"instructions": "Welches Modell sollte sie bearbeiten?",
"criteria": {
"fast": "schnelles günstiges Modell — triviale Änderungen, Formatierung, Nachschlagen",
"balanced": "mittleres Modell — normale Funktionen und Fixes",
"strong": "Spitzenmodell — Architektur, Migrationen, schweres Reasoning"
}
},
"needs_tools": {
"type": "noul",
"instructions": "Wird dies wahrscheinlich Tool-Aufrufe erfordern (Dateien lesen, Befehle ausführen)?"
}
}
}Binde es in deinen Code ein
Lies die typisierten Antworten und verzweige in einfachem Code — ohne Parsing. Bearbeite die hochkonfidenten Fälle automatisch und leite die unsicheren an ein größeres Modell oder einen Menschen weiter. Es ist ein einziger API-Aufruf und Output ist kostenlos, stelle also alle Fragen, die du brauchst, auf einmal.
Bau dein eigenes
Jedes Szenario oben ist ein einziger API-Aufruf. Teste jedes davon kostenlos im Playground und hol dir dann einen gehosteten Key, um es auszuliefern — ohne Warteliste.