Ein kleines Modell für Routinefragen, und wo wir es stoppen
Die meisten Fragen in einer Dokumentenstrecke sind klein. Jev beantwortet sie in etwa einer halben Sekunde, für Teams, die es einschalten, und entscheidet nur, wenn es sich zu mindestens 0,9 sicher ist. Was es sieht, wo es läuft und was es nicht darf.
Bevor sich in Ihrem Portfolio etwas ändert, werden viele kleine Fragen gestellt. Ist dieser Anhang ein Kapitalabruf, ein Fondsbericht oder keins von beidem? Geht es in dieser Schlagzeile um das Unternehmen, dem Sie folgen, oder um eine andere Firma mit ähnlichem Namen? Auf welches Ihrer eigenen Aufwandskonten gehört dieser Beleg?
Ein großes Sprachmodell beantwortet all das gut. Es ist aber langsamer, als die Frage es verdient, und bei uns verbraucht jeder Aufruf Credits Ihres Teams. Deshalb gehen diese Fragen für Teams, die es einschalten, jetzt zuerst an Jev. Jev ist ein Entscheidungsmodell von TypeSafe AI. Es wählt eine Antwort aus einer festen Liste und sagt dazu, wie sicher es sich ist.
Schneller, und günstiger, wo es entscheidet
Eine Antwort von Jev kommt in etwa einer halben Sekunde. Ist Jev sich sicher genug, gilt seine Antwort, und das große Modell wird für diesen Schritt gar nicht aufgerufen. Ein eingehendes Dokument, das Jev einordnet, verbraucht für die Einordnung keine Credits. Dasselbe gilt für einen Stapel Schlagzeilen, den Jev vollständig aussortiert.
Ist Jev sich nicht sicher, ändert sich nichts: Das Modell in der EU entscheidet, genau wie bisher. Im schlechtesten Fall kostet das eine zusätzliche halbe Sekunde.
Die 0,9-Regel
„Sicher genug" ist eine Zahl. Bei eingehenden Dokumenten zählt Jevs Antwort nur ab einer Konfidenz von 0,9. Das gilt, wenn Jev ein Dokument als Fondsbericht oder Kapitalabruf annimmt, und ebenso, wenn es eines als fachfremd verwirft.
Die Zahl haben wir so gewählt: Wir haben 129 frühere Uploads aus zwei Teams noch einmal durch Jev geschickt und seine Antworten damit verglichen, wo jedes Dokument tatsächlich gelandet ist.
- Jeden Fondsbericht und jeden Kapitalabruf, den Jev beantwortet hat, hat es richtig eingeordnet.
- Jeder Fehler war ein Darlehens- oder Zinsauszug, den Jev für einen Fondsbericht hielt. Der sicherste davon lag bei 0,79.
- Jev hat nie ein echtes Dokument verworfen.
- Bei 0,9 entscheidet Jev 108 der 129 Dokumente. Die übrigen 21 gehen an das Modell in der EU.
Annehmen und Verwerfen haben getrennte Schwellen, weil die beiden Fehler Unterschiedliches kosten. Ein falsch angenommenes Dokument importiert etwas, das Sie löschen. Ein falsch verworfenes kann einen Kapitalabruf mit Frist verschwinden lassen. Heute liegen beide bei 0,9. Die Schwelle fürs Verwerfen wird nicht unter die fürs Annehmen sinken, weil im Replay nur wenige fachfremde Dokumente waren.
Das ist eine kleine Stichprobe aus zwei Teams, und wir stellen sie nicht als mehr dar. Für eine vorsichtige Schwelle reicht sie. Der Vergleich bleibt in der App, sodass wir ihn mit neuen Dokumenten wiederholen können.
Dasselbe Muster, ohne den teuren Fehler
Jeder Einsatz von Jev hat seine eigene Regel, gebaut um den Fehler, der dort mehr schaden würde:
- Uploads mit vagem Dateinamen. „Scan_0412.pdf" blieb bisher unklassifiziert, und ein Kapitalabruf erreichte die Extraktion nie. Ab 0,9 kann Jev jetzt den Typ setzen, aber nur Kapitalabruf oder Fondsbericht, und nie über einen Typ, den ein Mensch gewählt hat.
- Belege. Jev belegt ab 0,8 ein Aufwandskonto vor, und zwar nur aus dem eigenen Kontenplan Ihres Buchs. Es bucht nie selbst. Lohnabrechnungen werden ihm nie geschickt.
- Nachrichten. Jev darf eine Schlagzeile nur verwerfen, und nur, wenn es sich zu mindestens 90 % sicher ist, dass es um jemand anderen geht. Jede Schlagzeile, die relevant sein könnte, geht weiterhin an das Modell in der EU.
- Eingaben im Grid. Wirkt eine Änderung ungewöhnlich, gibt Jev einen Info-Hinweis. Es blockiert nie das Speichern und sieht Zeilen nur als „Zeile 1", „Zeile 2", ohne Namen.
Was Jev sieht, und wo
Diesen Teil sollten Sie genau lesen, denn hier weicht Jev vom Rest unserer Verarbeitung ab.
- Jev läuft in den USA. Wir rufen es bei TypeSafe AI, Inc. über das Vercel AI Gateway auf. Jede Anfrage ist fest an TypeSafe gebunden und geht an keinen Anbieter, der die Daten speichern würde. Eine EU-Region hat TypeSafe noch nicht.
- Es bekommt nur maskierten Text. Jev sieht höchstens die ersten 8.000 Zeichen eines Dokuments, mit Platzhaltern statt der Namen aus Ihrem Verzeichnis. Es bekommt nie die Datei oder den Dateinamen. Scans ohne Textebene werden nicht geschickt.
- Es ist standardmäßig aus, für jedes Team. Inhaber oder Team-Admins schalten es in den Team-Einstellungen ein und stimmen dabei TypeSafe als Subunternehmer zu. Jede Änderung steht im Audit-Log Ihres Teams. Nur unser Server kann die Einstellung ändern.
- Die Extraktion bleibt in der EU. Jev beantwortet Routinefragen, Zahlen liest es nicht aus Ihren Dokumenten. Jedes Dokument, das übernommen wird, wird weiterhin in der EU umgewandelt und gelesen, wie unter So funktioniert es beschrieben.
TypeSafe AI, Inc. steht mit unseren anderen Subunternehmern auf der Sicherheitsseite.
Was Jev nicht tut
Es liest keine Zahlen aus, bucht nichts und entscheidet nicht, dass eine Nachricht relevant ist. Es sieht kein Dokument, das es nicht sehen darf, und läuft für kein Team, das es nicht eingeschaltet hat. Schlägt es fehl, braucht es zu lange oder ist es sich nicht sicher, geht die Arbeit den Weg, den sie vor Jev gegangen ist.
Das ist der ganze Gedanke. Ein kleines, schnelles Modell übernimmt die eindeutigen Fälle. Alles andere geht an ein langsameres Modell, das nur in der EU läuft, und dazwischen liegt eine Schwelle, deren Herleitung wir Ihnen zeigen können.