Respostas

Por que não rodar RAG sobre o nosso repositório em vez de mais uma ferramenta de memória de IA?

Porque recuperar e sancionar respondem perguntas diferentes. RAG acha as passagens mais parecidas com o que foi perguntado, dentro de tudo que ele indexou — inclusive a decisão que o time reverteu no trimestre passado, o desenho que nunca foi construído e os dois documentos que se contradizem. Ele não tem como dizer qual dos três está vigente, porque nada num índice carrega isso. A Arroway guarda um conjunto muito menor: as regras e decisões que uma pessoa do time sancionou, cada uma com o nome de quem sancionou e a condição que a encerra. O assistente lê esse conjunto antes de agir. RAG continua achando texto pra você; ele não é o que diz ao assistente qual texto ainda vale.

Última atualização 4 de setembro de 2026

Parecido não é a mesma coisa que vigente

Recuperação ordena por semelhança. Pergunte sobre política de retentativa e vêm todas as passagens que falam de retentativa — o runbook atual, a versão anterior, a thread em que alguém argumentou contra, a revisão de incidente que propôs uma quarta saída. As quatro parecem igualmente relevantes pra pergunta, e a errada costuma ser a mais longa e melhor escrita, que é exatamente o que ordena bem. Achar o texto raramente é o problema do time. Saber qual dos quatro textos o assistente deve obedecer é — e essa é uma pergunta sobre autoridade, que semelhança não responde.

Alguém tem que dizer sim

Aqui o assistente pode propor uma regra, e proposta não governa nada. Ela continua proposta até uma pessoa do projeto sancionar — e, se ela recusar, a recusa fica registrada, então a mesma sugestão não volta na semana seguinte como se ninguém a tivesse visto. Essa etapa de sanção é a diferença inteira: o que o assistente lê passou por decisão de uma pessoa e carrega o nome de quem a tomou. Um índice não tem essa etapa nem onde colocá-la, porque nada dentro de um documento diz se o time concordou com ele.

Norma vence; documento continua lendo igual pra sempre

Uma decisão tomada pra um trimestre, um limite que subiu, uma regra que só valia enquanto uma migração rodava — cada uma deixa de ser verdade em algum momento, e o documento que a descreve continua lendo exatamente como antes. Toda memória aqui carrega a condição que a encerra, e regra substituída é trocada pela que a substituiu, em vez de ficar no índice ao lado dela. O que o assistente recebe é a resposta de hoje, não um histórico de respostas com a de hoje em algum lugar dentro.

Como isso aparece na prática

Um time de plataforma mantém a documentação de engenharia no repositório e coloca um índice de recuperação em cima. Funciona bem pra perguntas como em que região um serviço roda. Depois uma pessoa nova pergunta ao assistente dela como tratar uma retentativa de pagamento que falhou. O índice devolve três passagens: um documento de desenho de uma abordagem que o time abandonou, o runbook que a substituiu e uma revisão de incidente que defendia outra coisa. As três estão no repositório, as três falam de retentativa de pagamento, e o documento abandonado é o mais longo e detalhado — então ele volta primeiro. O assistente o segue. Nada quebrou; o índice fez o que índice faz. O que faltava era um lugar onde alguém tivesse escrito que a abordagem abandonada está abandonada, numa forma que o assistente lê antes de responder. É uma frase, e não é o tipo de frase que alguém pensa em colocar num documento — porque todo mundo que abandonou a abordagem já sabe.

Perguntas que as pessoas fazem sobre isso

Então a gente deve desligar a recuperação?
Não, e essa seria a leitura errada disto. Recuperação é boa no que ela serve: localizar uma passagem num volume de texto que ninguém leu recentemente, puxar uma referência, buscar num arquivo. Memória sancionada é pro conjunto curto de coisas que o assistente tem que saber antes de agir, mesmo que ninguém tenha lembrado de perguntar. Time que tem as duas não está duplicando nada — está mantendo busca separada de regra vigente.
Não daria o mesmo resultado filtrando melhor o índice?
Dá pra filtrar um índice, e os times filtram — por pasta, por data, por etiqueta. O que filtro nenhum recupera é quem concordou. Sanção é um fato sobre a decisão de uma pessoa, não uma propriedade do documento, então precisa ser registrada na hora da decisão, por quem a toma. Com esse registro existindo, o assistente não precisa mais que alguém lhe diga em qual passagem confiar: ele lê o conjunto que foi sancionado.
As nossas decisões já estão no repositório. Não basta?
É um bom lugar pras que pertencem ao código, e a comparação entre arquivo de contexto e memória curada é uma resposta própria neste site. O que o repositório não guarda é a decisão que ninguém escreveu como documento — a conversa de uma terça que mudou como o time escopa trabalho, a exceção que um cliente negociou, a abordagem que alguém testou e descartou. Essas nunca viram arquivo, então índice nenhum as acha, e são justamente as que o assistente erra mais.
Instalar o ArrowayVer como funciona →

Onde isto se confere

A documentação do produto neste site (Como funciona, Instalar), a resposta sobre arquivo de contexto contra memória curada, para a comparação com arquivo, e as regras de sanção, proveniência e vencimento na spec sancionada do produto. Tudo descrito aqui é comportamento que as ferramentas aplicam hoje, não roadmap.

https://www.arroway.app/pt-BR/answers/why-rag-doesnt-replace-sanctioned-memory

Continue explorando

Ver todas as respostas