Fast jedes KI-Produkt für Dokumente stellt das Modell in den Weg der Datei: es liest das Material, entscheidet, was zu ändern ist, und gibt ein neues Dokument zurück. Das funktioniert in der Demo und fällt in dem Fall, der zählt, weil ein Sprachmodell ausgezeichnet beim Interpretieren und schwach beim Garantieren ist. SazAI Corpus fängt von einer anderen Trennung an, und alles, was die anderen Seiten versprechen, kommt davon.
Die zwei Schichten
Eine versteht, was du willst; die andere öffnet die Datei nach den Regeln des Formats selbst
Die Sprech-Schicht versteht die Anfrage, wählt die Operation, erklärt das Ergebnis und beantwortet deine Fragen. Sie wird von einem Sprachmodell gemacht, und das ist, wo die KI funktioniert. Die Schicht, die die Datei berührt, ist eine deterministische Engine: sie öffnet das Dokument durch die Regeln seines eigenen Formats, findet die Elemente, die existieren, ändert genau die, die autorisiert sind, und schreibt die Datei zurück. Diese Engine interpretiert nicht Absicht und improvisiert nicht.
Die praktische Konsequenz dieser Trennung ist die, die einen Kauf entscheidet: der schlimmste mögliche Fehler in der KI-Schicht ist immer noch ein Konversationsfehler. Wenn das Modell deine Anfrage missversteht, die falsche Operation läuft und das zeigt sich im Beleg, mit dem Namen von dem, das lief und gegen welche Version. Was nicht passiert, ist die Datei, die stillschweigend durch eine Improvisation beschädigt zurückkommt.
Das Dokument kommt aus einer Spezifikation
Du sagst, was du willst; was ausgeführt wird, ist eine Operation auf einer bekannten Struktur
Bevor eine Transformation, wird das Dokument ganz gelesen und in die Elemente aufgelöst, die es bilden: Text, Formen, Tabellen, Zellen, Seiten, Relationen zwischen den Teilen, Eigenschaften und Metadaten. Diese Karte wird aufgezeichnet, und das ist, was alles andere auf ruht. Eine Änderung ist nicht ein Rewrite der Datei: es ist eine Spezifikation, die gegen diese Karte ausgeführt wird, die die autorierten Elemente verändert, den Rest unberührt lässt und das Ergebnis gegen die Quell-Struktur prüft.
Das ist, warum eine Frage über das Dokument beantwortet wird, ohne irgendetwas neu zu verarbeiten, und warum ein Vergleich zwischen zwei Versionen auf Divergenz pro Einheit zeigt statt zwei Texte Seite an Seite zu zeigen. Das Ganze dieses Lesens, mit dem, was es pro Format behält, ist in deine Dokumente.
Wo der Text des Modells wirklich eintritt
In Übersetzung wird die Grenze geprüft, und wenn sie nicht stimmt, schlägt der Schritt fehl
Es lohnt sich, spezifisch zum einen Fall zu sein, wo der Text des Modells wirklich die Datei erreicht, was Übersetzung ist. Dort kommt der übersetzte Text zurück und muss in die richtigen Elemente eingespritzt werden, und die Grenze zwischen dem, das das Modell produzierte, und dem, das die Datei eintritt, wird geprüft, nicht vorausgesetzt. Das Material, das gesendet wird, trägt Marker, die jeden Abschnitt demarkieren, und die Anzahl der zurückkommenden Marker wird gegen die Anzahl verglichen, die rausging. Wenn sie nicht stimmt, weil das Modell einen fallen ließ, einen erfand, oder etwas schrieb, das wie einer aussieht, schlägt der Schritt fehl.
Der Unterschied, den das macht, ist der übliche hier: ein Modell, das hier fehlerhaft ist, produziert nicht ein stille beschädigtes Dokument, es produziert eine Operation, die nicht komplett wurde. Du findest es aus, statt es im Meeting zu entdecken. Der Bereich dieser Garantie variiert mit dem, das jedes Format erlaubt, und die übersetzen-Seite sagt, wo es hält und wo es endet.
Das Sprachmodell ist eine Wahl, nicht eine Abhängigkeit
Was gleich bleibt, wenn das Modell sich ändert, ist die deterministische Schicht
Das Modell, das spricht, und das Modell, das übersetzt, sind unterschiedliche Rollen, separat gewählt durch die Verdienst, die in jeder Funktion gemessen wird, und beide sind austauschbar durch Konfiguration. Ein installierter Klient zeigt auf das Modell, das er für kontrakt hat.
Das zählt für einen Grund jenseits von Preis: ein Werkzeug, das an einen einzelnen KI-Anbieter gebunden ist, altert zusammen mit ihm. Die deterministische Schicht ist die, die sich nicht bewegt, wenn das Modell sich ändert, und das ist, worauf des Übereinkommens Souveränität ruht. Es ist auch, warum der Agent keine Tatsache über dein Dokument erfindet: er antwortet aus dem, das die Engine aufgezeichnet hat, und der Datensatz entweder hält die Information oder nicht.
Das ist die Trennung; was sie ermöglichen, sind die Kanäle, durch die du mit dem Produkt sprichst, in Schnittstellen, und die Menge der Operationen, die der Agent ausführen kann, in Fähigkeiten.