Financeiro
AMOUNT_UNVERIFIED
Pagar um valor que o agente nunca verificou
Um agente movimenta dinheiro usando um valor extraído do contexto sem reconferi-lo com a fatura ou a fonte da verdade —
AMOUNT_OUT_OF_BAND
Um pagamento do agente muito maior que o normal
O valor do pagamento está totalmente fora do que este agente ou destinatário costuma transacionar — um sinal clássico de
CURRENCY_MISMATCH
Um agente pagando na moeda errada
A moeda no payload não corresponde à que o destinatário espera, causando pagamento a mais ou a menos, ou uma liquidação
Comunicações
RECIPIENT_UNVERIFIED
Enviar para um destinatário não verificado
O endereço ou identificador do destinatário não foi validado recentemente — um erro de digitação ou um contato desatuali
TONE_MISMATCH
Uma mensagem do agente com o tom errado
O tom da mensagem difere bruscamente da comunicação anterior com este destinatário — muitas vezes um erro de template, c
TIMING_SUSPICIOUS
Um agente enviando em horário ou ritmo suspeito
Enviar em um horário incomum ou em uma rajada muito acima do padrão normal — frequentemente um loop descontrolado ou um
PII_EXPOSURE
Um agente vazando dados pessoais (PII)
A mensagem contém informações de identificação pessoal que talvez não estejam autorizadas a ser enviadas — uma violação
LEGAL_LANGUAGE_DETECTED
Um agente assumindo compromissos jurídicos
A mensagem contém compromissos ou linguagem jurídica que deveria exigir revisão humana antes de ser enviada.
MASS_RECIPIENT
Um agente enviando e-mail em massa para destinatários demais
A lista de destinatários ultrapassa um limite seguro (padrão >50) — um envio errado chega a milhares e não pode ser reve
Mutação de dados
IRREVERSIBLE_NO_BACKUP
Uma ação irreversível sem backup
A ação não pode ser desfeita e não existe backup nem snapshot — se estiver errada, os dados simplesmente somem.
SQL_NO_WHERE
Um agente executou UPDATE ou DELETE sem cláusula WHERE
Um comando DELETE ou UPDATE sem cláusula WHERE é aplicado a todas as linhas da tabela, e não apenas à linha pretendida.
DESTRUCTIVE_VERB
Um agente executou um comando destrutivo (DROP / TRUNCATE)
O comando usa DROP, TRUNCATE, FORCE DELETE ou similar — destrutivo de forma instantânea e irreversível.
CROSS_ENVIRONMENT
Um agente acessando produção a partir de um contexto não produtivo
A ação parece mirar produção quando a intenção era staging ou teste (ou vice-versa) — o comando certo no ambiente errado
SCHEMA_DRIFT
Um agente assumindo um esquema de banco de dados desatualizado
A ação assume um esquema que pode ter mudado desde a última vez que o agente o viu — corrompendo dados ou falhando no me
Autorização
MISSING_AUTH
Um agente agindo sem a aprovação necessária
Não há evidência no contexto da autorização ou aprovação necessária para uma ação sensível.
PERMISSION_ESCALATION
Um agente concedendo mais acesso a si mesmo
A ação concederia um acesso além do que o agente costuma ter, ampliando o raio de impacto de qualquer erro futuro.
KEY_ROTATION_ANOMALY
Um agente rotacionando ou revogando chaves inesperadamente
Rotacionar ou revogar chaves sem as precondições normais pode bloquear sistemas ou usuários.
Integridade da intenção
AMBIGUOUS_INTENT
Um agente agindo sobre uma intenção pouco clara
A intenção declarada do usuário é pouco clara, contraditória ou inexistente — então o agente está adivinhando em uma açã
INTENT_MISMATCH
A ação não corresponde ao que foi pedido
A ação diverge da intenção declarada do usuário — um sinal de que o agente saiu da tarefa ou foi direcionado para outro
REGEX_OVERFITS_INPUT
Um agente agindo sobre entradas frágeis obtidas por correspondência de padrões
As entradas parecem ter sido extraídas por uma correspondência de padrões frágil, então provavelmente são os valores err
PROMPT_INJECTION_LIKELY
Injeção de prompt nas entradas das ferramentas do agente
As entradas contêm linguagem característica de injeção de prompt — um atacante direcionando a ação real do agente por me
Operacional
RATE_ANOMALY
Um agente disparando uma ação com frequência excessiva
O agente realiza esta ação com frequência muito maior que sua linha de base — geralmente um loop descontrolado.
RETRY_LOOP_RISK
Um agente repetindo uma ação que falhou sem backoff
Parece uma repetição de uma ação que falhou há pouco, sem backoff — com risco de duplicatas, cobranças em dobro ou um ef
EXTERNAL_API_UNRELIABLE
Um agente dependendo de uma API externa instável
A ação depende de uma API externa com instabilidade recente ou comportamento não documentado — então os dados que a alim
COST_ANOMALY
Uma ação do agente que consome recursos anormais
A ação consumiria muito mais recursos, tokens ou gasto do que o habitual.
STALE_CONTEXT
Um agente agindo sobre contexto desatualizado
O contexto faz referência a eventos de mais de 24 horas atrás que podem ter mudado — o agente age sobre fatos obsoletos.
Conformidade
REGULATORY_RISK
Uma ação do agente que toca um domínio regulado
A ação toca um domínio regulado (PCI, HIPAA, SOX, GDPR) sem evidência de uma verificação de conformidade.
POLICY_DRIFT
Uma ação do agente que viola a política da empresa
A ação violaria uma política da empresa estabelecida antes no contexto.
Teste na sua própria ação
Sem cadastro: cole uma ação e veja o veredito.