BRIEFING MATINALAI AGENT HARNESSESR2 · CORTE 06:30 BRT

Estado, extensões e controle operacional

O corte de hoje traz releases que atacam a camada menos glamourosa — e mais decisiva — dos agentes: histórico recuperável, plugins governados, MCP que não derruba a sessão, contexto observável e permissões que falham de modo explícito. No Hermes, a novidade é somente no main; a versão estável continua sendo a v0.21.0.

04.09.2026 · janela prioritária 03/09–04/09 · fontes primárias primeiro
00

Resumo executivo

O sinal do dia é de maturidade operacional. Claude Code 2.1.260, Cline Desktop 0.0.23, Goose 1.49.0 e Microsoft Agent Framework 1.17.0 convergem em uma mesma direção: extensões, memória, aprovações e execução em background precisam ser duráveis e auditáveis. O Hermes main corrige raciocínio obrigatório, respostas vazias, fragmentos de tool call e a separação entre conhecimento aprendido e memória episódica.

Prioridade 01Hermes mainCorreções de reasoning, observabilidade e roteamento para skills.
ExtensibilidadeCline HubPlugins passam a carregar skills e servidores MCP automaticamente.
SegurançaGoose 1.49Allowlist por turno, fail-closed e proteção de segredos em escala.
Modelos no harnessGPT-6-AstraCodex e Pydantic AI expõem o modelo sem obrigar troca do default.
Decisão recomendada: não mover o gateway Hermes estável. Testar Cline Agent Plugins, Goose 1.49.0 e os fixes do Hermes em perfis isolados; pinçar modelo/provider nos fluxos que tenham custo ou efeito externo; e usar as novas superfícies de contexto/aprovação para instrumentar smoke tests.
01

Novidades de alto valor

01 / HERMES AGENTPRESENTE APENAS NO MAIN

Reasoning obrigatório e respostas vazias deixam de produzir estados enganosos

O lote funcional observado entre 03/09 06:38 e 04/09 06:30 BRT reforça o contrato entre modelo, provider e loop do agente.

  • Providers: GLM-5.3 em Nous/OpenRouter deixa de receber um disable incompatível com endpoints de reasoning obrigatório; se um retry ocorrer após HTTP 400, o esforço original do usuário é preservado.
  • Loop: respostas vazias sem usage armam fast-fail determinístico e registram observabilidade; fragmentos de XML de tool call interrompidos no streaming não são persistidos como prosa do assistente.
  • Conhecimento: o prompt passa a encaminhar conhecimento aprendido da tarefa, preferências e correções para skills; memória fica reservada à exceção que precisa ser carregada em toda sessão. Timers de filhos também usam um scheduler compartilhado.

Impacto prático: menos 400 recorrente em modelos com thinking obrigatório, menos “sucesso vazio” e uma distinção mais saudável entre procedimento reutilizável e memória episódica. São correções de main, não garantia do release estável.

TESTAR ISOLADOPrioridade para GLM-5.3, cron e sessões com tool calling
02 / CLAUDE CODELANÇADO · 03/09

v2.1.260 expõe causas prováveis de cache e endurece o unattended

O release combina diagnóstico de prompt-cache com uma grande rodada de correções em sandbox, plugins, MCP, compactação e sessões longas.

  • Observabilidade: /cost e o status line passam a explicar causas prováveis de cache miss, como mudança de tool definitions/system prompt ou expiração do TTL.
  • Headless e plugins: /reload-plugins chega a sessões não interativas; /advisor ganha forma textual para Desktop, Remote Control e Agent SDK.
  • Confiabilidade: permissões com parênteses deixam de ser descartadas, o auto-compact de modelos de 1M ocorre antes do limite, e comandos de background de subagentes não têm mais o teto de uma hora.

Impacto prático: fica mais fácil distinguir custo alto por cache miss de custo alto por modelo, e o caminho headless fica menos dependente de intervenção. As mudanças de permissões continuam exigindo revisão em hosts compartilhados.

TESTAR AGORAAdotar em sandbox com revisão de regras e cache
03 / CLINE DESKTOPLANÇADO · 03/09

Agent Plugins entram no Hub com skills e MCP como pacote operável

O Desktop v0.0.23 transforma o diretório ~/.agents/plugins em uma superfície de extensão validada pelo Hub.

  • O pacote é validado por plugin.json; Agent Skills válidas ficam disponíveis e servidores MCP stdio, Streamable HTTP e SSE iniciam automaticamente.
  • O Hub separa Agent Plugins de Cline Plugins, mostra descrição/badge/ferramentas e administra enable/disable por plugin.
  • O release também corrige relatório de tarefa agendada que sumia ao recolher a etapa final e impede que um servidor MCP travado bloqueie o shutdown dos demais.

Impacto prático: skills e conectores deixam de ser uma coleção solta de arquivos e passam a ter unidade de distribuição e ciclo de vida. Isso aproxima o modelo de plugins do Hermes, mas exige governança de origem e revisão de MCP.

TESTAR AGORAPERFIL SEPARADOPrioridade para plugins internos e conectores de operação
04 / GOOSELANÇADO · 03/09

Goose 1.49.0 amplia browser, schedules e governança de extensões

A release é extensa, mas três linhas são relevantes para harnesses operacionais: capacidades nativas, identidade de execução e segurança transversal.

  • Capacidades: skills built-in de web search/browser-use, transcrição de áudio nativa, recipes selecionáveis ao criar schedules e PreToolUseResult com tool_call_id estável.
  • Providers: suporte de follow-up GPT-5.6 para Codex/Responses, novos providers declarativos e campos de custo em providers customizados.
  • Segurança: allowlist por turno, precedência de deny, limites para memória/recursão/OTEL, proteção de segredos e fail-closed em visibilidade ou credenciais malformadas.

Impacto prático: é um candidato forte para comparação com Hermes em automação browser + schedule, mas a amplitude do release recomenda pinagem e uma matriz de regressão antes de colocá-lo em rotina.

ACOMPANHAR / SANDBOXTestar browser, recipes e allowlists; não importar toda a superfície de uma vez
05 / MICROSOFT AGENT FRAMEWORKLANÇADO · 03/09

Python 1.17.0 fecha replay duplicado e aprovações instáveis

A atualização refina o harness batteries-included da Microsoft nos pontos que costumam quebrar em workflows duráveis.

  • Foundry Hosting passa a selecionar explicitamente histórico do Agent Server ou do agente, evitando replay duplicado de conversas.
  • O contrato de concorrência para chat clients compartilhados no mesmo event loop é documentado; OpenAI SDK 3.x e o SDK oficial da Mistral entram no caminho suportado.
  • Aprovações são vinculadas a ocorrências estáveis de function call; compaction preserva mutações no loop; falhas de inicialização MCP deixam de ser mascaradas por cancelamento.

Impacto prático: bom sinal arquitetural para quem implementa um harness próprio em Python/.NET — histórico, approval e compaction são estado do runtime, não detalhes periféricos. O sample adicional mostra um agente Telegram hospedado no Foundry.

ACOMPANHARPrioridade se houver stack Azure/Foundry; não é troca direta do Hermes
02

Radar de vídeos e blogs

VÍDEO · 03/09/2026 · CONTEXTO, NÃO FONTE PRIMÁRIA

NEW Hermes Agent OS is CRAZY Good!

Canal: Julian Goldie SEO. O vídeo apresenta, em formato demonstrativo, Bot Mode, hermes peer, memória persistente, cron com continuidade e browser do v0.21.0. A transcrição e os metadados públicos confirmam a data; a análise do criador não foi usada para validar disponibilidade ou desempenho.

Utilidade: boa visualização rápida da proposta de “equipe de agentes”; para decisões técnicas, prevalecem o release oficial e os commits. O tema do vídeo não é uma nova release de hoje e não foi contado novamente como novidade.

BLOG · 03/09/2026 · CONTEXTO EDITORIAL

Best AI Coding Agents in 2026: A Practical Guide for Working Developers

Gamut / Iddo Gino. O texto organiza o mercado em agentes terminal-first, IDE, cloud e open source e chama atenção para a diferença entre ferramentas centradas em sessão e automações persistentes, além do papel de MCP e segurança.

Utilidade: matriz de orientação e setup, não changelog. Estatísticas de adoção, preços e afirmações de superioridade permanecem editoriais e não foram incorporadas ao briefing como fatos.

03

Modelos de LLM com impacto em harnesses

GPT-6-Astra entrou em superfícies de harness sem precisar virar o default. O valor operacional aqui não é o nome do modelo, mas a possibilidade de expor uma rota nova de modo controlado — mantendo pinagem e comparabilidade.

CamadaFato observadoStatusDecisão operacional
Codex CLI0.153.1 permite configurar GPT-6-Astra pela API sem mudar o modelo default nem exibi-lo no picker; 0.153.2 só corrige o texto da faixa Fast.LANÇADOTestar por configuração explícita; não inferir melhoria de execução a partir do texto de tier.
Pydantic AIv2.39.0 adiciona suporte a OpenAI gpt-6-astra, corrige cache de exporter/processor e atribui media devolvida por tool à chamada de origem.LANÇADOUsar em sandbox Python com telemetria e validação de tool-returned media.
Hermes mainCorreções de 03/09 evitam enviar reasoning disabled a GLM-5.3 obrigatório e preservam o effort original em retry.MAINSmoke test com provider Nous/OpenRouter antes de qualquer promoção.
Cautela: nenhum benchmark independente foi usado para concluir superioridade de GPT-6-Astra, GLM-5.3 ou qualquer harness. O efeito real depende do provider, schemas de tools, retries, memória, permissões e orçamento de contexto.
04

Gap analysis e confiança

SÓLIDO

Hermes, Claude Code, Cline, Goose, Microsoft Agent Framework, Codex e Pydantic AI foram conferidos em APIs ou páginas oficiais de releases. A janela de commits do Hermes foi filtrada por commit.committer.date, não por data de autoria.

COBERTURA

Não apareceu release novo dentro do corte para Google ADK Python/JS, LangGraph, CrewAI, OpenHands ou OpenAI Agents Python. Isso significa “sem item selecionado”, não prova de ausência de commits ou atividade em outras superfícies.

CAUTELA

O vídeo e o blog são contexto editorial. O vídeo foi datado por metadado público e transcrição; não foi usado para confirmar funcionalidade. O release de Goose é muito amplo e precisa de testes por superfície, não adoção integral.

Deduplicação: não foram repetidos o Hermes v0.21.0, Cline Desktop v0.0.22, Claude Code v2.1.259, Codex 0.153.0, Pydantic AI 2.38 ou as correções Hermes do briefing de 03/09. O vídeo novo foi mantido somente como contexto demonstrativo; a release do Hermes continua no bloco final por exigência de continuidade.

Corte temporal: 03/09/2026 06:38 a 04/09/2026 06:30 BRT. Releases GitHub foram lidos pela data de publicação; commits do Hermes, por committer.date. Sem credenciais, tokens ou dados privados no relatório.

05

Melhorias no sistema Hermes

RELEASE ESTÁVEL

v0.21.0 / v2026.8.31

A release estável mais recente continua sendo a v0.21.0, publicada em 31/08. Ela permanece como a base publicada para Bot Mode, hermes peer, cron com continuidade, MCP command center e browser do Desktop. Não houve nova tag estável no corte de hoje.

Abrir release oficial · API latest

MUDANÇAS NO MAIN

Reasoning, empty responses e knowledge routing

Entre 03/09 09:44Z e 12:20Z, o main recebeu sete commits; agrupados funcionalmente, eles cobrem reasoning obrigatório, respostas sem usage, fragmentos de tool-call, roteamento de conhecimento para skills e timers compartilhados de filhos.

Ver commits recentes · API dos 5 mais recentes · scheduler de timers

AINDA NÃO CONFIRMADO

Nenhuma promoção para o release

Não há novo recurso publicado por release nem anúncio oficial que transforme os sete commits recentes em pacote estável. A recomendação é testar em perfil isolado, observar logs e esperar uma tag antes de atualizar o gateway operacional.

Regra de adoção: provider, modelo, toolset e política de aprovação explicitamente pinçados em rotinas com custo, credencial ou efeito externo.