Fast jedes KI-Produkt für Dokumente stellt das Modell in den Weg der Datei: es liest das Material, entscheidet, was zu ändern ist, und gibt ein neues Dokument zurück. Das funktioniert in der Demo und fällt in dem Fall, der zählt, weil ein Sprachmodell ausgezeichnet beim Interpretieren und schwach beim Garantieren ist. SazAI Corpus fängt von einer anderen Trennung an, und alles, was die anderen Seiten versprechen, kommt davon.

Die zwei Schichten

Eine versteht, was du willst; die andere öffnet die Datei nach den Regeln des Formats selbst

Die Sprech-Schicht versteht die Anfrage, wählt die Operation, erklärt das Ergebnis und beantwortet deine Fragen. Sie wird von einem Sprachmodell gemacht, und das ist, wo die KI funktioniert. Die Schicht, die die Datei berührt, ist eine deterministische Engine: sie öffnet das Dokument durch die Regeln seines eigenen Formats, findet die Elemente, die existieren, ändert genau die, die autorisiert sind, und schreibt die Datei zurück. Diese Engine interpretiert nicht Absicht und improvisiert nicht.

deine Anfragein deinen eigenen Worten, die Weise, wie du sprichst
eine gewählte Operationbenannt, geloggt, mit einem Beleg
die Datei geschriebenvon der Engine, nie vom Modell
Das Modell wählt die Operation; die Engine ist, was die Datei öffnet und schreibt.

Die praktische Konsequenz dieser Trennung ist die, die einen Kauf entscheidet: der schlimmste mögliche Fehler in der KI-Schicht ist immer noch ein Konversationsfehler. Wenn das Modell deine Anfrage missversteht, die falsche Operation läuft und das zeigt sich im Beleg, mit dem Namen von dem, das lief und gegen welche Version. Was nicht passiert, ist die Datei, die stillschweigend durch eine Improvisation beschädigt zurückkommt.

Das Dokument kommt aus einer Spezifikation

Du sagst, was du willst; was ausgeführt wird, ist eine Operation auf einer bekannten Struktur

Bevor eine Transformation, wird das Dokument ganz gelesen und in die Elemente aufgelöst, die es bilden: Text, Formen, Tabellen, Zellen, Seiten, Relationen zwischen den Teilen, Eigenschaften und Metadaten. Diese Karte wird aufgezeichnet, und das ist, was alles andere auf ruht. Eine Änderung ist nicht ein Rewrite der Datei: es ist eine Spezifikation, die gegen diese Karte ausgeführt wird, die die autorierten Elemente verändert, den Rest unberührt lässt und das Ergebnis gegen die Quell-Struktur prüft.

Das ist, warum eine Frage über das Dokument beantwortet wird, ohne irgendetwas neu zu verarbeiten, und warum ein Vergleich zwischen zwei Versionen auf Divergenz pro Einheit zeigt statt zwei Texte Seite an Seite zu zeigen. Das Ganze dieses Lesens, mit dem, was es pro Format behält, ist in deine Dokumente.

Wo der Text des Modells wirklich eintritt

In Übersetzung wird die Grenze geprüft, und wenn sie nicht stimmt, schlägt der Schritt fehl

Es lohnt sich, spezifisch zum einen Fall zu sein, wo der Text des Modells wirklich die Datei erreicht, was Übersetzung ist. Dort kommt der übersetzte Text zurück und muss in die richtigen Elemente eingespritzt werden, und die Grenze zwischen dem, das das Modell produzierte, und dem, das die Datei eintritt, wird geprüft, nicht vorausgesetzt. Das Material, das gesendet wird, trägt Marker, die jeden Abschnitt demarkieren, und die Anzahl der zurückkommenden Marker wird gegen die Anzahl verglichen, die rausging. Wenn sie nicht stimmt, weil das Modell einen fallen ließ, einen erfand, oder etwas schrieb, das wie einer aussieht, schlägt der Schritt fehl.

633Rein mit 633, raus mit 633In einem 45-Folie-Übersetzungs-Test ging die Datei rein mit 633 Elementen und raus mit 633, rein mit 971 Formen und raus mit 971, und die Engine berührte genau die 11 Folien, die Text hatten. Die anderen 34 waren nicht verändert, weil nichts drin war zum Verändern.
Eine Zählung ist die ehrliche Weise, das zu sagen; ein Adjektiv ist nicht.

Der Unterschied, den das macht, ist der übliche hier: ein Modell, das hier fehlerhaft ist, produziert nicht ein stille beschädigtes Dokument, es produziert eine Operation, die nicht komplett wurde. Du findest es aus, statt es im Meeting zu entdecken. Der Bereich dieser Garantie variiert mit dem, das jedes Format erlaubt, und die übersetzen-Seite sagt, wo es hält und wo es endet.

Das Sprachmodell ist eine Wahl, nicht eine Abhängigkeit

Was gleich bleibt, wenn das Modell sich ändert, ist die deterministische Schicht

Das Modell, das spricht, und das Modell, das übersetzt, sind unterschiedliche Rollen, separat gewählt durch die Verdienst, die in jeder Funktion gemessen wird, und beide sind austauschbar durch Konfiguration. Ein installierter Klient zeigt auf das Modell, das er für kontrakt hat.

Das zählt für einen Grund jenseits von Preis: ein Werkzeug, das an einen einzelnen KI-Anbieter gebunden ist, altert zusammen mit ihm. Die deterministische Schicht ist die, die sich nicht bewegt, wenn das Modell sich ändert, und das ist, worauf des Übereinkommens Souveränität ruht. Es ist auch, warum der Agent keine Tatsache über dein Dokument erfindet: er antwortet aus dem, das die Engine aufgezeichnet hat, und der Datensatz entweder hält die Information oder nicht.

Das ist die Trennung; was sie ermöglichen, sind die Kanäle, durch die du mit dem Produkt sprichst, in Schnittstellen, und die Menge der Operationen, die der Agent ausführen kann, in Fähigkeiten.