Blaue Illustration: Viele kleine Kugeln fließen als Nachrichtenstrom in ein leuchtendes rautenförmiges Tor. Dahinter teilt sich der Weg: Zwei Spuren enden in Häkchen, eine führt zu einer großen Karte mit Textzeilen.

Jev erklärt: Die KI, die nicht schreibt, sondern entscheidet

Jev ist ein neues KI-Modell, das nur entscheidet: Es wählt aus deinen vorgegebenen Antworten und sagt dir, wie sicher es ist. Was dahintersteckt, was es kostet und wie es mit Claude Opus 5.5 im Shop zusammenspielt.

Jev ist die erste KI, die du nicht zum Schreiben einsetzt, sondern zum Entscheiden. Das neue Modell von TypeSafe AI liest eine Kundenmail, ein Ticket oder eine Bewertung und wählt aus deinen vorgegebenen Antworten eine aus, samt Prozentangabe, wie sicher es sich ist.

Für Onlineshops ist das spannender, als es klingt, denn die meisten KI-Aufgaben im Shop-Alltag sind Sortierfragen. Retoure oder Versandfrage, Beschwerde oder Lob, dringend oder nicht: Genau das beantwortet Jev, und zwar für Bruchteile eines Cents.

Seit dem 15. September ist Jev im Early Access, eine Woche später hat Anthropic Claude Opus 5.5 veröffentlicht. Zusammen ergeben die beiden eine Arbeitsteilung, die viele KI-Automationen im Shop erst bezahlbar macht: Jev entscheidet, Claude schreibt.

Was Jev ist und was es bewusst nicht kann

TypeSafe nennt Jev ein System-One-Modell, nach dem schnellen Bauchgefühl-Denken aus der Psychologie. Du schickst ihm einen Zustand, zum Beispiel den Text einer Kundenmail, und dazu eine oder mehrere Fragen.

Jede Frage gehört zu einem von drei Typen. Bei Choice wählt Jev eine Option aus deiner Liste, etwa Versand, Retoure oder Zahlung, und nennt für jede Option eine Wahrscheinlichkeit.

Bei Score ordnet Jev den Fall auf einer Skala mit beschriebenen Stufen ein, zum Beispiel Dringlichkeit von „kann warten“ bis „Kunde droht mit Rückbuchung“. Bei Noul prüft es eine Aussage wie „Der Kunde will seine Bestellung stornieren“ und antwortet mit einer Zahl zwischen 0 und 1.

Genauso wichtig ist, was Jev nicht kann: Es schreibt keinen Text, begründet keine Entscheidung und liest keine Bilder. Wer eine Antwortmail oder eine Erklärung braucht, braucht daneben ein Sprachmodell.

Daraus folgt der größte Vorteil: Jev kann sich keine Antwort ausdenken, die du nicht vorgegeben hast. Falsch wählen kann es trotzdem, und deshalb kommt es auf die Prozentzahl an.

Warum die Prozentzahl der eigentliche Trick ist

TypeSafe trainiert Jev darauf, kalibriert zu sein. Kalibriert heißt: Sagt Jev bei einer bestimmten Art Frage 80 %, liegt es dort im Schnitt in acht von zehn Fällen richtig.

Damit legst du eine Schwelle fest, die zu deinem Risiko passt. Ab 90 % landet die Mail automatisch im richtigen Postfach, alles darunter schaut sich ein Mensch an.

Einen Haken schreibt TypeSafe selbst in seine Anleitung für KI-Assistenten: Die Schwellen musst du an deinen eigenen Daten prüfen, bevor du ihnen vertraust. Nimm dafür hundert anonymisierte Mails, die dein Team schon sortiert hat, und vergleiche, wie oft Jev bei welcher Prozentzahl richtig liegt.

Ein Wert um 50 % bei einer Ja-Nein-Frage bedeutet übrigens nicht „ein bisschen“, sondern „keine Ahnung“. Diese Fälle nimmt dir Jev nicht ab, und genau dafür ist die Schwelle da.

Was Jev kostet und wie schnell es antwortet

Laut TypeSafe kostet Jev 0,042 US-Dollar pro Million Eingabe-Token, die Ausgabe ist kostenlos, und eine Antwort kommt nach 70 bis 500 Millisekunden. Token sind die Textstücke, nach denen KI-Anbieter abrechnen, eine typische Sortierfrage kostet damit einen Bruchteil eines Cents.

Zum Vergleich: Claude Opus 5.5 kostet laut Anthropic 4 US-Dollar pro Million Eingabe-Token, also rund das 95-Fache. Für Aufgaben, bei denen am Ende nur eine Entscheidung steht, ist ein großes Sprachmodell damit schlicht zu teuer.

Bei den Rekordzahlen lohnt sich ein zweiter Blick. TypeSafe spricht von bis zu 193,6-mal schneller und 444,6-mal günstiger als große Sprachmodelle, die Vergleiche hat aber das eigene Team gebaut, was die Firma selbst einräumt.

Die Zahlen von Anwendern fallen kleiner aus, sind aber immer noch deutlich. Vercel hat laut TechCrunch ein OpenAI-Modell, das Kommandos auf Gefahren prüft, durch Jev ersetzt und berichtet von 5- bis 18-mal schnelleren Prüfungen bei höherer Genauigkeit.

Ehrlicher Gegenpunkt aus demselben Bericht: Beim Sortieren von E-Mails war Gemini für die Firma Bryo AI etwas genauer als Jev, kostete aber das 10- bis 20-Fache. Jev gewinnt also nicht jede Disziplin, sondern die, bei der Masse und Preis zählen.

Jev und Claude Opus 5.5: der Reflex und der Kopf

Claude Opus 5.5 ist seit dem 22. September verfügbar. Anthropic hat die Listenpreise gegenüber Opus 5 um 20 % gesenkt, und über einen Regler stellst du ein, wie gründlich das Modell nachdenkt.

Die spannendste Zahl dazu nennt Deloitte in der Ankündigung: Auf der niedrigsten Stufe fand Opus 5.5 in Code-Prüfungen 72 % der bekannten Fehler, der Vorgänger Opus 5 auf der Stufe „high“ nur 56 %. Runterdrehen und trotzdem bessere Arbeit bekommen, das ist der Hebel für jede Automation.

Zusammen mit Jev ergeben sich drei Muster, die in fast jedem Shop passen. Alle drei folgen demselben Prinzip: Das teure Modell rechnet nur dann, wenn das billige sagt, dass es sich lohnt.

Sortieren, dann antworten

Jev ordnet jede eingehende Mail einem Team zu und bewertet, wie dringend sie ist. Opus 5.5 schreibt nur noch dort einen Antwortentwurf, wo wirklich formuliert werden muss, alle Standardfälle landen nie beim teuren Modell.

Schreiben, dann prüfen

Opus schreibt die Antwort, Jev prüft sie mit einer Ja-Nein-Frage wie „Die Mail verspricht eine Erstattung“. Liegt der Wert über deiner Grenze, geht der Entwurf zurück an einen Menschen statt raus zum Kunden.

Das Tor davor

Jev entscheidet, ob überhaupt ein Sprachmodell ran muss. Fragt jemand nur nach dem Bestellstatus, beantwortet das dein Shop-System direkt, erst die kniffligen Fälle gehen an Opus, und zwar auf niedriger Stufe.

Unser Merksatz dafür: Opus ist der Kopf, Jev ist der Reflex. Beide Bausteine sind im selben Monat deutlich günstiger geworden, und damit rechnen sich Automationen, die sich vorher nicht gerechnet haben.

Lohnt sich Jev für deinen Shop schon jetzt?

Zum Ausprobieren ja, für den Dauerbetrieb noch nicht blind. Jev ist erst seit dem 15. September im Early Access, und nach dem Start konnte die Schnittstelle zeitweise keine Anfragen mehr bedienen, weil die Nachfrage zu groß war.

Am 22. September hat TypeSafe neue Anmeldungen sogar vorübergehend gestoppt, bestehende Konten laufen weiter. Über den Modell-Marktplatz OpenRouter ist Jev trotzdem erreichbar.

Dazu kommt: Es gibt kein Paper und keine offenen Modellgewichte, du kannst also nicht nachprüfen, wie Jev gebaut ist. Die Rekordwerte stammen bisher vor allem vom Hersteller selbst.

Der wichtigste Punkt für Shops im DACH-Raum ist der Datenschutz. Jev läuft als Cloud-Schnittstelle eines US-Anbieters, bevor echte Kundenmails dorthin gehen, klärst du das mit deinem Datenschutzberater, inklusive Vertrag zur Auftragsverarbeitung.

Der sinnvolle Einstieg sieht deshalb so aus: Mit ein paar ausgedachten oder anonymisierten Beispielen testen, eine Schwelle festlegen und erst dann über echte Daten nachdenken. Wie du Jev direkt in Claude Code einbindest, zeigt unsere Schritt-für-Schritt-Anleitung im KI-Wissen.

Du willst wissen, wo KI in deinem Shop zuerst Zeit und Geld spart? Conwave steht für KI-gestützte Conversion-Rate-Optimierung für Onlineshops im DACH-Raum, sprich uns einfach an.

Robin Csipke, Gründer von Conwave und Keno Medien.
Geschrieben von Robin Csipke

Robin Csipke ist 2010 mit E-Commerce in Berührung gekommen, seit seiner Ausbildung sammelte er Erfahrung in mehreren Branchen.