FINANÇAS COMPORTAMENTAIS · PSICOLOGIA ECONÔMICA

oh-my-agent: reviews cross-context e testes de precisão de triggers

Quando você pede para um modelo revisar o próprio design, ele geralmente dá nota máxima para si mesmo. Fizemos o…

Quando você pede para um modelo revisar o próprio design, ele geralmente dá nota máxima para si mesmo. Fizemos o merge de uma correção para esse viés de autoria nesta semana.

O que há de novo

  • Testes de precisão de triggers: oma verify triggers agora mede as taxas de falso positivo e omissão em palavras-chave contra um corpus de 167 entradas, com zero chamadas ao LLM.
  • Emissão de standards: oma emit gera pastas de especificação de Agent Skills, um manifesto de marketplace .claude-plugin e um índice AGENTS.md diretamente do diretório .agents (a única fonte de verdade).
  • Linting de skills: oma skills lint aplica verificações determinísticas de smells de autoria baseadas em pesquisas de Anatomy-to-Smells.
  • Alertas de bundle sprawl: oma skills audit agora sinaliza skills que excedem 20 arquivos de referência ou 25.000 caracteres.

Também conectamos os hooks SessionStart do Claude Code para recarregar skills de forma dinâmica e lidar com a compactação de sessão sem perder o contexto.

O que foi corrigido

  • O match de palavras-chave agora é ordenado por especificidade. A keyword mais longa ganha, seguida por múltiplas palavras e, por fim, a ordem de declaração. Isso resolve colisões de autossupressão.
  • Mensagens retransmitidas entre agentes não disparam mais detecções falsas de palavras-chave de workflow.
  • Falhas de atomicWriteJson no Windows (EPERM) foram resolvidas abrindo o arquivo temporário com permissões de leitura e escrita.
  • A bridge opencode foi totalmente reescrita para respeitar o novo contrato de mutação da API de plugin, restaurando o verdadeiro modo persistente.

O que melhorou

  • Reviews cross-context: Todas as 11 etapas de review do ultrawork agora despacham o trabalho para novos subagentes revisores que recebem apenas os artefatos duráveis e o guia de review. O self-review na mesma sessão foi removido porque reviews isolados pegam mais defeitos.
  • Blind review de alto impacto: Workflows de brainstorm agora escalam a crítica dos artefatos de design para subagentes independentes, removendo por completo o viés de autoria.
  • Consolidação de marketplace: O diretório raiz .claude-plugin do repositório agora é a única fonte de verdade para o marketplace de plugins do Claude.

Instalação

# macOS / Linuxcurl -fsSL https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.sh | bash
# Windows (PowerShell)irm https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.ps1 | iex

O oh-my-agent foi construído para equipes que orquestram mais do que escrevem prompts. A seguir: emissão nativa de plugins para o Antigravity.

Texto original (em inglês): https://dev.to/gracefullight/oh-my-agent-cross-context-reviews-and-trigger-accuracy-testing-12f7

https://github.com/first-fluke/oh-my-agent

Perguntas frequentes

Respostas institucionais sobre esta cobertura, fontes e limites editoriais.

Sobre o que trata “oh-my-agent: reviews cross-context e testes de precisão de triggers”?
Quando você pede para um modelo revisar o próprio design, ele geralmente dá nota máxima para si mesmo. Fizemos o merge de uma correção para esse viés de autoria nesta semana.O que há de novoTestes de…
O que a matéria explica sobre “O que há de novo”?
Testes de precisão de triggers: oma verify triggers agora mede as taxas de falso positivo e omissão em palavras-chave contra um corpus de 167 entradas, com zero chamadas ao LLM.Emissão de standards: oma emit gera pastas de especificação de Agent Skills, um…
O que a matéria explica sobre “O que foi corrigido”?
O match de palavras-chave agora é ordenado por especificidade. A keyword mais longa ganha, seguida por múltiplas palavras e, por fim, a ordem de declaração. Isso resolve colisões de autossupressão.Mensagens retransmitidas entre agentes não disparam mais detecções falsas de palavras-chave de workflow.Falhas…
O que a matéria explica sobre “O que melhorou”?
Reviews cross-context: Todas as 11 etapas de review do ultrawork agora despacham o trabalho para novos subagentes revisores que recebem apenas os artefatos duráveis e o guia de review. O self-review na mesma sessão foi removido porque reviews isolados pegam mais defeitos.Blind…
O que a matéria explica sobre “Instalação”?
# macOS / Linuxcurl -fsSL https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.sh | bash# Windows (PowerShell)irm https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.ps1 | iexO oh-my-agent foi construído para equipes que orquestram mais do que escrevem prompts. A seguir: emissão nativa de plugins para o Antigravity.Texto original (em inglês): https://dev.to/gracefullight/oh-my-agent-cross-context-reviews-and-trigger-accuracy-testing-12f7https://github.com/first-fluke/oh-my-agent
Quem edita o conteúdo do Estrato Mente?
A cobertura é produzida e revisada pela equipe editorial do Estrato Mente, com editor-chefe responsável pela linha editorial. Conheça a redação em https://mente.estrato.cc/equipe/.
Quais fontes o Estrato prioriza?
Priorizamos fontes primárias (órgãos oficiais, balanços, estudos revisados, documentos públicos) e cruzamos informações antes da publicação, conforme a política editorial.
Como solicitar correção de uma matéria?
Envie o pedido pela página de Correções (https://mente.estrato.cc/correcoes/) ou Contato (https://mente.estrato.cc/contato/). Erros materiais são corrigidos com registro da atualização.
WhatsApp X LinkedIn
Compartilhar: LinkedIn
Diego Amaral

Diego Amaral

Diego Amaral integra a equipe editorial do Estrato Mente, vertical da rede Estrato, na função de Repórter de Filosofia prática. O escopo permanente de cobertura inclui autoconhecimento e ética cotidiana, com atenção ao leitor brasileiro que busca contexto factual, datas oficiais e implicações práticas. Na produção diária, prioriza fontes primárias (órgãos públicos, balanços, papers e documentos oficiais), cruza pelo menos duas referências independentes quando o tema é contestado e evita manchetes que prometam certeza onde há incerteza. Critérios de qualidade: lead com o fato principal, atribuição clara de autoria da equipe Estrato, atualização com selo quando há mudança material e linguagem acessível sem simplificar demais o risco ou o contexto. Trabalha sob revisão da mesa editorial e do editor-chefe do portal. Matérias YMYL recebem segunda leitura antes da publicação e podem ser atualizadas quando surgem novos dados oficiais. Limites: este perfil descreve o papel editorial na marca Estrato. O conteúdo publicado é informativo e não constitui aconselhamento médico, financeiro, jurídico ou profissional personalizado. Transparência ao leitor: metodologia em /metodologia/, ética em /etica-editorial/, correções em /correcoes/, equipe em /equipe/ e canal em /contato/ ([email protected]). Na página-mãe da rede, a bio ampliada e o arquivo de matérias ficam em estrato.cc/blog/, com link para o arquivo do autor em cada portal.

Deixe um comentário