Presque tous les produits d’IA pour documents mettent le modèle dans le chemin du fichier : il lit le matériel, décide ce qui changer et remet un nouveau document. Cela fonctionne dans la démo et échoue dans le cas qui importe, parce qu’un modèle de langage est excellent pour interpréter et mauvais pour garantir. SazAI Corpus part d’une division différente, et tout ce que les autres pages promettent en vient.
Les deux couches
L'une comprend ce que vous voulez ; l'autre ouvre le fichier par les propres règles du format
La couche parlante comprend la demande, choisit l’opération, explique le résultat et répond à vos questions. Elle est faite d’un modèle de langage, et c’est là que l’IA fonctionne. La couche qui touche le fichier est un moteur déterministe : il ouvre le document par les règles de son propre format, trouve les éléments qui existent, change exactement ceux qui sont autorisés et écrit le fichier. Ce moteur n’interprète pas l’intention et n’improvise pas.
La conséquence pratique de cette division est celle qui décide un achat : la pire erreur possible dans la couche IA est toujours une erreur de conversation. Si le modèle mal interprète votre demande, la mauvaise opération s’exécute et cela apparaît dans le reçu, avec le nom de ce qui s’est exécuté et contre quelle version. Ce qui ne se produit pas est le fichier revenant silencieusement endommagé par une improvisation.
Le document sort d'une spécification
Vous dites ce que vous voulez ; ce qui s'exécute est une opération sur une structure connue
Avant toute transformation, le document est lu entièrement et décomposé dans les éléments qui le composent : texte, formes, tableaux, cellules, pages, relations entre les parties, propriétés et métadonnées. Cette carte est enregistrée, et c’est sur quoi tout le reste repose. Un changement n’est pas une réécriture du fichier : c’est une spécification exécutée contre cette carte, qui altère les éléments autorisés, laisse le reste inchangé et vérifie le résultat contre la structure source.
C’est pourquoi une question sur le document est répondue sans retraiter quoi que ce soit, et pourquoi une comparaison entre deux versions pointe la divergence par unité au lieu de montrer deux textes côte à côte. La totalité de cette lecture, avec ce qu’elle garde pour chaque format, se trouve dans vos documents.
Où le texte du modèle atteint réellement
Dans la traduction la frontière est vérifiée, et quand elle ne correspond pas l'étape échoue
Cela vaut la peine d’être spécifique sur l’unique cas où le texte du modèle atteint réellement le fichier, qui est la traduction. Là le texte traduit revient et doit être injecté dans les bons éléments, et la frontière entre ce que le modèle a produit et ce qui entre dans le document est vérifiée, pas supposée. Le matériel envoyé porte des marqueurs qui délimitent chaque passage, et le nombre de marqueurs qui revient est comparé au nombre qui est parti. Si cela ne correspond pas, parce que le modèle en a abandonné un, en a inventé un, ou a écrit quelque chose qui ressemble à un, l’étape échoue.
La différence que cela fait est la sienne habituelle dans cette maison : un modèle qui se comporte mal ici ne produit pas un document endommagé en silence, il produit une opération qui n’a pas complété. Vous le découvrez, au lieu de le découvrir à la réunion. La portée de cette garantie varie avec ce que chaque format permet, et la page traduire énonce où elle tient et où elle finit.
Le modèle de langage est un choix, pas une dépendance
Ce qui reste le même quand le modèle change est la couche déterministe
Le modèle qui parle et le modèle qui traduit sont des rôles différents, choisis séparément par le mérite mesuré dans chaque fonction, et tous deux sont remplaçables par configuration. Un client installé pointe sur le modèle qu’il a contracté.
Cela importe pour une raison au-delà du prix : un outil attaché à un seul fournisseur d’IA vieillit avec lui. La couche déterministe est celle qui ne bouge pas quand le modèle change, et c’est sur quoi la souveraineté de l’arrangement repose. C’est aussi pourquoi l’agent n’invente pas un fait sur votre document : il répond à partir de ce que le moteur a enregistré, et l’enregistrement soit tient l’information, soit ne la tient pas.
C’est la division ; ce qu’elle rend possible ce sont les canaux par lesquels vous parlez au produit, dans interfaces, et l’ensemble des opérations que l’agent peut exécuter, dans capacités.