Quase todo produto de IA sobre documentos põe o modelo no caminho do arquivo: ele lê o material, decide o que mudar e devolve um documento novo. Funciona na demonstração e falha no caso que importa, porque um modelo de linguagem é ótimo para interpretar e péssimo para garantir. A SazAI Corpus parte de outra divisão, e é dela que vem tudo o que as outras páginas prometem.

As duas camadas

Uma entende o que você quer; a outra abre o arquivo pelas regras do formato

A camada que conversa entende o pedido, escolhe a operação, explica o resultado e responde às suas perguntas. Ela é feita de modelo de linguagem, e é ali que a IA trabalha. A camada que mexe no arquivo é um motor determinístico: abre o documento pelas regras do próprio formato, encontra os elementos que existem, altera exatamente os que foram autorizados e escreve o arquivo de volta. Esse motor não interpreta intenção e não improvisa.

o seu pedidoem português, como você fala
uma operação escolhidanomeada, registrada, com recibo
o arquivo escritopelo motor, nunca pelo modelo
O modelo escolhe a operação; quem abre e escreve o arquivo é o motor.

A consequência prática dessa divisão é a que decide uma compra: o pior erro possível da camada de IA continua sendo um erro de conversa. Se o modelo entender mal o seu pedido, a operação errada é executada e isso aparece no recibo, com o nome do que rodou e sobre qual versão. O que não acontece é o arquivo voltar silenciosamente estragado por uma improvisação.

O documento sai de uma especificação

Você diz o que quer; o que executa é uma operação sobre uma estrutura conhecida

Antes de qualquer transformação, o documento é lido inteiro e desmontado nos elementos que o compõem: textos, formas, tabelas, células, páginas, relações entre as partes, propriedades e metadados. Esse mapa fica registrado, e é ele que sustenta todo o resto. Uma mudança não é uma reescrita do arquivo: é uma especificação executada contra esse mapa, que altera os elementos autorizados, deixa o resto intocado e confere o resultado contra a estrutura de origem.

É por isso que uma pergunta sobre o documento é respondida sem reprocessar nada, e é por isso que a comparação entre duas versões aponta divergência por unidade em vez de mostrar dois textos lado a lado. O inteiro dessa leitura, com o que ela guarda de cada formato, está em seus documentos.

Onde o texto do modelo realmente entra

Na tradução a fronteira é conferida, e quando não bate o passo falha

Vale ser específico sobre o único caso em que o texto do modelo chega mesmo ao arquivo, que é a tradução. Ali o texto traduzido volta e precisa ser injetado nos elementos certos, e a fronteira entre o que o modelo produziu e o que entra no documento é conferida, não presumida. O material enviado carrega marcadores que delimitam cada trecho, e o número de marcadores que volta é comparado com o número que saiu. Se não bater, porque o modelo perdeu um, inventou outro ou escreveu algo parecido com um, o passo falha.

633Entrou com 633, saiu com 633Num teste de tradução de 45 slides o arquivo entrou com 633 elementos e saiu com 633, entrou com 971 formas e saiu com 971, e o motor tocou exatamente os 11 slides que continham texto. Os outros 34 não foram alterados porque não havia o que alterar neles.
Contagem é a forma honesta de dizer isto; adjetivo não é.

A diferença que isso faz é a de sempre nesta casa: um modelo que se comporta mal aqui não produz um documento estragado em silêncio, produz uma operação que não completou. Você fica sabendo, em vez de descobrir na reunião. O escopo dessa garantia varia com o que cada formato permite, e a página de traduzir diz onde ela vale e onde termina.

O modelo de linguagem é uma escolha, não uma dependência

O que continua igual quando o modelo muda é a camada determinística

O modelo que conversa e o modelo que traduz são papéis diferentes, escolhidos separadamente pelo mérito medido em cada função, e ambos são substituíveis por configuração. Um cliente instalado aponta para o modelo que ele contratou.

Isso importa por um motivo que vai além de preço: ferramenta amarrada a um único fornecedor de IA envelhece junto com ele. A camada determinística é a que não se move quando o modelo muda, e é sobre ela que a soberania do arranjo se apoia. É também por isso que o agente não inventa fato sobre o seu documento: ele responde a partir do que o motor registrou, e o registro ou contém a informação ou não contém.

Esta é a divisão; o que ela habilita são os canais por onde você fala com o produto, em interfaces, e o conjunto de operações que o agente pode executar, em capacidades.