O harness é o mecanismo do agente, não a afirmação do modelo
O guia de harness-engineering do Professor Glitch em askglitch.com, lido como mecanismo: a propriedade (o-agente-funciona-realmente) é garantida pelo harness (janela de contexto, memória, RAG, o loop, hooks, avaliações), não pela afirmação 'usamos o melhor modelo'. Theorem 3 aplicado à divisão 10/90 modelo-harness.

O harness é o mecanismo do agente, não a afirmação do modelo
Professor Glitch (askglitch.com) escreve em "Harness Engineering: How AI Agents Actually Work" que "um agente é um modelo mais um harness. O modelo é o cérebro. O harness é tudo ao redor dele que torna o cérebro útil." Ele coloca a divisão em "aproximadamente 10% modelo, 90% harness — estimativa aproximada, não uma medição, mas qualquer um que construiu um destes dir-lhe-á que está mais ou menos certo." O artigo percorre o harness nó por nó: a janela de contexto (RAM, não um disco rígido), memória (curto prazo na janela, longo prazo em três gavetas — procedimental, semântica, episódica), RAG (o exame de livro aberto), habilidades (o fichário com separadores, divulgação progressiva), o loop (pensar, agir, observar, repetir), ferramentas e MCP (como o cérebro ganha mãos), hooks (o segurança à porta), e avaliações (avaliando a execução, avaliação de saída mais avaliação de trajetória, sucesso corrupto). (Professor Glitch, "Harness Engineering: How AI Agents Actually Work", askglitch.com, publicado 2026-07-07, recuperado 2026-08-23, https://www.askglitch.com/blog/harness-engineering). O Honest Architect lê o artigo como um exemplo trabalhado de um harness-como-mecanismo-de-agente: a propriedade (o-agente-funciona-realmente) é garantida pelo mecanismo (o harness — tudo ao redor do modelo que transforma inteligência bruta num agente funcional), não pela afirmação "usamos o melhor modelo." O Honest Architect marca a forma the-harness-is-the-agent-mechanism Production ✅ e cada afirmação específica de terceiros (a divisão 10/90, Terminal-Bench, a pesquisa de context-rot da Chroma, o paper "Lost in the Middle", os guias da Anthropic, Claude Code, MCP, o currículo da comunidade) Partial ⚠️ (terceiros, não verificadas independentemente pela Everythink).
O artigo é um mergulho profundo com intenção de venda de cursos — liga a uma comunidade com sete cursos, 181+ lições, um TikTok, e um apelo à ação "JOIN THE COMMUNITY". O Honest Architect extrai as formas de mecanismo sem endossar os cursos ou a comunidade. Sete formas de mecanismo, cada uma Production ✅ onde real e reproduzível, Partial ⚠️ onde de terceiros.
Conclusões principais
- O harness é o mecanismo do agente. Theorem 3: a propriedade (o-agente-funciona-realmente) é garantida pelo mecanismo (o harness — janela de contexto, memória, RAG, habilidades, o loop, ferramentas, hooks, avaliações), não pela afirmação "usamos o melhor modelo." O cérebro aluga-se; o harness ganha-se. Production ✅.
- A janela de contexto é o mecanismo de memória de trabalho. O artigo: "É RAM, não um disco rígido. Rápida, pequena, limpa a cada turno." A propriedade (lembra-deste-turno) é garantida pelo que está na secretária este turno, não pelo que o modelo "sabe." Production ✅.
- A memória de longo prazo é o mecanismo de persistência. Três gavetas fora da janela: procedimental (como fazer coisas), semântica (factos), episódica (eventos com carimbos de tempo). A propriedade (sobrevive-entre-sessões) é garantida por armazenar fora da janela e recuperar a pedido, não pelo modelo. Production ✅.
- RAG é o mecanismo de recuperação. O artigo chama-lhe "o exame de livro aberto." A propriedade (responde-dos-seus-docs) é garantida por recuperar o parágrafo relevante, não pelo modelo a memorizar o seu manual. Production ✅.
- O loop é o mecanismo de conclusão de tarefa. Pensar, agir, observar, repetir — "até que o trabalho esteja realmente feito." A propriedade (trabalho-realmente-feito) é garantida por iterar até done, não por um plano de um tiro. Três saídas: genuinamente terminado, limite duro de iterações, parar para perguntar quando inseguro. Production ✅.
- Os hooks são o mecanismo de aplicação. O artigo: "um hook é código determinístico que dispara num ponto fixo do loop. O modelo é a multidão; o hook é o segurança." A propriedade (não-faz-o-errado) é garantida por código determinístico sempre, não pelo bom julgamento do modelo. A confiança não é um mecanismo. Production ✅.
- As avaliações são o mecanismo de qualidade. O artigo: "ponha a fasquia na avaliação, não na demo." Avaliação de saída mais avaliação de trajetória. Sucesso corrupto: resposta certa, processo errado. A propriedade (é-bom-realmente) é garantida por avaliar as vinte execuções, não por mostrar a uma demo limpa. Production ✅.
- Paralelos de domínios cruzados: Oracle normalizar-uma-vez (as Sisters são o modelo, o Oracle é o harness — previsão-calibrada é garantida pelo harness, não por qualquer Sister individual), World Monitor por-fonte auto-desativação (cada fonte é uma ferramenta que se auto-desativa quando a sua chave não está definida), Zod no limite de execução (RAG faz parse do documento no limite de recuperação, como Zod faz parse do payload no limite de rede), Eye Key (os hooks são análogos — não-faz-o-errado é garantido por código-determinístico-sempre, como a soberania-de-chave é garantida por HMAC-mais-impressão-digital — ambos estruturais, não confiança), HAI Engine desde 2016 (o loop é análogo — mesmo-mecanismo-cada-execução é garantido por executar-o-mesmo-mecanismo). Todos Partial ⚠️: mesma forma, domínios separados.
- Escopo: civil/defensivo. A engenharia de agentes é uma preocupação de engenharia civil. Sem escopo ofensivo. Nenhum resultado de token, wallet ou crédito de comunidade é prometido; esses são Roadmap 🔵, revisão Howey pendente. Everythink é uma plataforma de previsões, não um fornecedor de harness de agentes; os paralelos de domínios cruzados são ilustrações Partial ⚠️, não endossos de askglitch.com, Professor Glitch, Anthropic, Claude Code, MCP ou qualquer curso ou comunidade específica.
O harness é o mecanismo do agente
A frase central do artigo: "um agente é um modelo mais um harness. O modelo é o cérebro. O harness é tudo ao redor dele que torna o cérebro útil." A propriedade (o-agente-funciona-realmente) é garantida pelo mecanismo (o harness — janela de contexto, memória, RAG, habilidades, o loop, ferramentas, hooks, avaliações), não pela afirmação "usamos o melhor modelo." Production ✅.
Uma equipa que compra o melhor modelo e salta o harness tem um cérebro num frasco — pode pensar mas não pode lembrar, procurar nada, nem pegar numa ferramenta. Uma equipa que constrói o harness à volta de qualquer modelo competente tem um agente. O mecanismo é o harness, não o modelo. Production ✅.
A forma é o análogo de domínio do Oracle normalizar-uma-vez da Everythink: a propriedade previsão-calibrada é garantida por entradas-diversas-mais-normalizar-uma-vez — as Sisters (analyst, contrarian, disruptor, historian, institutionalist) são os modelos, o Oracle é o harness que normaliza os seus rascunhos num ensemble. A divisão 10/90 é análoga: as Sisters são os 10%, o Oracle e o Loom e a camada de persistência são os 90%. Partial ⚠️ (mesma forma — harness-garante-a-propriedade-não-o-modelo — domínios separados).
A janela de contexto é o mecanismo de memória de trabalho
O artigo: "A janela de contexto é tudo o que o modelo pode ver num único turno. O melhor nome é memória de trabalho. É RAM, não um disco rígido. Rápida, pequena, limpa a cada turno." A propriedade (lembra-deste-turno) é garantida pelo que está na secretária este turno — o prompt do sistema, a conversa, os factos recuperados, os resultados das ferramentas — não pelo que o modelo "sabe." O chatbot "esqueceu-se" do seu nome porque nunca o teve; o harness re-cola a conversa a cada turno. Production ✅.
A distinção importa. Uma equipa que enfia tudo na janela tem context rot — o desempenho degrada à medida que a entrada cresce, e os modelos afundam onde a sua frase importante está enterrada. Uma equipa que põe apenas o que importa, este turno, tem uma janela que funciona. O mecanismo é a curadoria, não o tamanho. Passado um ponto, mais é o problema. Production ✅.
A memória de longo prazo é o mecanismo de persistência
Se a janela é limpa a cada turno, onde vive alguma coisa? O artigo: "A memória de longo prazo é o disco rígido. Durável, armazenada numa base de dados fora da janela, recuperada a pedido." Três gavetas: procedimental (como fazer coisas — uma habilidade, um como embalado), semântica (factos — o seu nome, a sua empresa, que odeia e-mails longos), episódica (eventos com carimbos de tempo — "a semana passada este cliente pediu um reembolso e dissemos não"). A propriedade (sobrevive-entre-sessões) é garantida por armazenar fora da janela e recuperar a pedido, não pelo modelo. Production ✅.
Uma equipa que enfia tudo na janela tem um sistema que custa mais, é mais lento, e apodrece. Uma equipa que armazena seletivamente fora da janela e recupera um pouco, de propósito, tem um sistema que se torna mais afiado com o tempo. O mecanismo é o armazenamento seletivo mais a recuperação seletiva, não o despejo. Production ✅.
RAG é o mecanismo de recuperação
O artigo chama a RAG "o exame de livro aberto. Ninguém memoriza o livro de texto na noite anterior. Lê a pergunta, depois salta para as poucas páginas que a cobrem." A propriedade (responde-dos-seus-docs) é garantida por recuperar o parágrafo relevante do manual de 200 páginas, não pelo modelo a memorizar o seu manual. Significado, não ortografia, medido como distância plana entre pontos de embedding. Production ✅.
A distinção importa. Um modelo bruto perguntado sobre os seus docs internos inventa uma política de reembolso que soa razoável — e uma resposta errada que soa razoável é a mais perigosa. Um modelo a quem se entrega a página real lê da sua política em vez da sua imaginação. Mas RAG recupera o que é relevante, não o que é garantidamente verdadeiro: página errada entra, resposta errada sai, com cara séria. O mecanismo é a recuperação, não a verdade. Production ✅.
O loop é o mecanismo de conclusão de tarefa
O artigo: "O que transforma algo que fala em algo que funciona é o loop: pensar, agir, observar, repetir, até que o trabalho esteja realmente feito." A propriedade (trabalho-realmente-feito) é garantida por iterar até done, não por um plano de um tiro. "Um plano feito no escuro é um palpite. O loop troca o palpite por factos." Production ✅.
A parte difícil: quando é que o loop para? Dois modos de falha. Parar demasiado cedo: um reembolso, "basicamente feito", desiste, e você verifica o trabalho dele anyway. Nunca parar: reembolsa o mesmo cliente quatro vezes, ou roda toda a noite como um robô aspirador preso num canto — uma conta real. Um bom loop tem três saídas: a tarefa está genuinamente terminada, um limite duro de iterações, e parar para perguntar quando inseguro. O mecanismo é a condição de saída, não o loop em si. Production ✅.
Os hooks são o mecanismo de aplicação
O artigo: "Não se pede a algo probabilístico que por favor tenha cuidado. Quer-se uma regra que corre sempre, em código, de que o modelo se não consiga falar para sair. Isso é um hook: código determinístico que dispara automaticamente num ponto fixo do loop. O modelo é a multidão; o hook é o segurança, verificando todos, sempre, sem exceções." A propriedade (não-faz-o-errado) é garantida por código determinístico que corre sempre, não pelo bom julgamento do modelo. A confiança não é um mecanismo. Production ✅.
A distinção importa. Uma equipa que confia no bom julgamento do modelo tem uma barreira que depende de como o prompt foi redigido — o mesmo modelo probabilístico que pode decidir que hoje é o dia de executar o comando de limpeza na pasta errada. Uma equipa que executa um hook antes de cada chamada de ferramenta tem uma barreira de que o modelo se não consiga falar para sair. Um hook não apenas bloqueia o mal; pode recusar a paragem e forçar o agente de volta ao loop. Aplicação, não um pedido educado. Production ✅.
A forma é o análogo de domínio do design Eye Key da Everythink: a propriedade soberania-de-chave é garantida por HMAC-mais-impressão-digital — a chave é soberana porque o mecanismo produz a propriedade estruturalmente, não por confiança. Os hooks são análogos: não-faz-o-errado é garantido por código-determinístico-sempre, não pelo julgamento do modelo. Ambos produzem a propriedade através de uma restrição estrutural, não uma expectativa comportamental. Partial ⚠️ (mesma forma — propriedade-garantida-por-restrição-estrutural-não-confiança — domínios separados).
As avaliações são o mecanismo de qualidade
O artigo: "Ponha a fasquia na avaliação, não na demo. As demos são fáceis: corra a coisa vinte vezes, mostre a única execução limpa. A avaliação avalia as vinte." Duas coisas a avaliar: avaliação de saída (a resposta estava correta?) e avaliação de trajetória (o caminho foi sólido?). O modo de falha: "sucesso corrupto — resposta certa, processo errado." A propriedade (é-bom-realmente) é garantida por avaliar as vinte execuções com ambas as avaliações, não por mostrar a única demo limpa. Production ✅.
Rastreio: "guarde os recibos. Cada execução, registe o que foi recuperado, que ferramentas dispararam com que entradas, quantos tokens, quanto tempo. Quando algo se parte, não franza o olho na resposta final e teorize. Abra o rasto e veja o passo exato onde saiu dos trilhos." A propriedade (depurável-quando-se-parte) é garantida por registar o que aconteceu, não por teorizar a partir da resposta final. Production ✅.
A roda de inércia: "cada falha que a avaliação apanha torna-se numa correção aparafusada ao harness. Não sabia uma regra? Adicione-a ao prompt do sistema. Correu algo destrutivo? Adicione um hook. O sistema melhora não porque esperou por um modelo mais inteligente, mas porque melhorou o harness, uma falha apanhada de cada vez." O mecanismo é a melhoria do harness conduzida por avaliações, não a melhoria do modelo. Production ✅.
O que um Honest Architect lê num mergulho profundo de harness-engineering
O artigo é um mergulho profundo com intenção de venda de cursos — uma comunidade com sete cursos, 181+ lições, um TikTok, um apelo à ação "JOIN THE COMMUNITY". O Honest Architect extrai as formas de mecanismo sem endossar os cursos ou a comunidade. As formas são Production ✅: reais, reproduzíveis, verificáveis pela lógica do próprio artigo (o harness transforma um cérebro num frasco num agente; a janela é RAM; a memória persiste fora; RAG recupera a página; o loop corre até done; os hooks aplicam deterministamente; as avaliações avaliam as vinte). Todas as afirmações específicas de terceiros (a divisão 10/90, Terminal-Bench, a pesquisa da Chroma, o paper "Lost in the Middle", os guias da Anthropic, Claude Code, MCP, o currículo) são Partial ⚠️. O Honest Architect não endossa askglitch.com, Professor Glitch, Anthropic, Claude Code, MCP ou qualquer curso ou comunidade. Everythink é uma plataforma de previsões, não um fornecedor de harness de agentes. O escopo é civil/defensivo. Nenhum resultado de token, wallet ou crédito de comunidade é prometido; esses são Roadmap 🔵, revisão Howey pendente.
Perguntas frequentes
O harness é o mecanismo ou a afirmação?
O harness é o mecanismo. Theorem 3: a propriedade (o-agente-funciona-realmente) é garantida pelo mecanismo (o harness), não pela afirmação ("usamos o melhor modelo"). O cérebro aluga-se; o harness ganha-se. Production. A divisão 10/90 é uma estimativa aproximada, não uma medição — Partial.
Por que a janela de contexto é o mecanismo de memória de trabalho?
A janela é RAM, não um disco rígido — limpa a cada turno. A propriedade lembra-deste-turno é garantida pelo que está na secretária este turno. Context rot: passado um ponto, mais é o problema. Production.
Por que os hooks são o mecanismo de aplicação?
Um hook é código determinístico que dispara sempre. A propriedade não-faz-o-errado é garantida pelo código, não pelo julgamento do modelo. O modelo é a multidão; o hook é o segurança. A confiança não é um mecanismo. Production.
Por que as avaliações são o mecanismo de qualidade?
As demos mostram a única execução limpa; as avaliações avaliam as vinte. Avaliação de saída mais avaliação de trajetória. Sucesso corrupto — resposta certa, processo errado — é o modo de falha. O rastreio guarda os recibos. Production.
A Everythink endossa askglitch.com, Professor Glitch ou Claude Code?
Não. Everythink é uma plataforma de previsões, não um fornecedor de harness de agentes. O artigo é um mergulho profundo com intenção de venda de cursos. As afirmações específicas de terceiros são Partial. Nenhum resultado de token, wallet ou crédito de comunidade é prometido; esses são Roadmap, revisão Howey pendente.
Sources
- Professor Glitch, "Harness Engineering: How AI Agents Actually Work", askglitch.com, publicado 2026-07-07, recuperado 2026-08-23, https://www.askglitch.com/blog/harness-engineering
Se a sua equipa está pronta para enviar o mecanismo em vez de afirmar a propriedade, construa a sua rede — o Oracle normaliza rascunhos das Sisters, cada fonte se auto-desativa, o HAI Engine tem executado o mesmo mecanismo desde 2016, Zod faz parse no limite.

Memória persistente é o mecanismo, não a janela de contexto
Cinco padrões arquiteturais para memória de agentes de IA, lidos como Theorem 3: a propriedade (aprendizado, personalização) é garantida pelo mecanismo (persistir, recuperar, injetar), não pela janela de contexto. Checkpointing não é exactly-once, segredos não são memória semântica, isolamento na camada de armazenamento falha fechado.
→ →
O protocolo é o mecanismo de interoperabilidade, não a afirmação da tomada
A descrição de MCP de Marc Friborg Bersang na AI Engineers Academy, lida como mecanismo: a propriedade (a-IA-conecta-a-tudo) é garantida pelos componentes definidos do protocolo (cliente, servidor, transporte, negociação de capacidades, esquemas tipados, propagação de erros), não pela afirmação 'é como USB para IA'. Theorem 3 aplicado ao design de protocolos.
→ →
A queda do custo é o mecanismo habilitador, não a asserção de gratuitidade
Uma perspectiva de pesquisa de Berkeley lê-se como seis formas de mecanismo: queda-do-custo-como-habilitador, especulação-agêntica-como-carga, otimização-multi-consulta-como-desduplicação, memória-estruturada-como-recuperação, semântica-de-edição-concorrente-como-consistência, agentes-de-verificação-como-correção. Teorema 3 aplicado a cada uma.
→ →Construa seu mundo sobre um motor que prova o que afirma.
Crie sua própria rede no motor que está em produção desde 2016 — ou fale com a equipe por trás dos 21 artigos.
