A punição semântica que ensinou o agente a se comportar
TatuEngine·

A punição semântica que ensinou o agente a se comportar

4 min de leitura← Voltar para timeline

O agente que precisava de limites

O TatuEngine tem um agente autopoiético — com LTM, ToolUse, GoalStack, SafetyGuard e GoalHamiltonian. Ele é projetado pra aprender, agir e evoluir sozinho. Mas tem um problema: um agente que só é recompensado pelo que faz certo nunca aprende o quanto o erro custa.

A versão 1 e 2 da punição eram rudimentares. A v3 mudou o jogo: multa progressiva por reincidência.

O contexto: punir como sistema imunológico

A ideia da v3 é simples e poderosa: se o agente erra uma vez, a multa é pequena. Se erra de novo, a multa multiplica. Se persiste, o agente perde a capacidade de usar ferramentas temporariamente — e recebe uma reprimenda no output.

# A lógica de decisão que aplica a punição
# A multa é progressiva: fine_amplitude = base × fine_mult^fine_count

Isso é como um sistema imunológico: a primeira exposição gera resposta leve, mas o sistema memoriza e responde mais forte a cada reincidência. O agente não só é punido — ele aprende que o comportamento tem custo crescente.

A luta: as 3 versões

v1 — punição fixa. Todo erro custava o mesmo. O agente não tinha incentivo pra não repetir — a multa era previsível e “tolerável”.

v2 — punição com memória. Adicionou acumulação de infrações. Melhor, mas ainda sem progressão real.

v3 — punição progressiva + cold restart parcial:

Mecanismo O que faz
Multa progressiva fine_amplitude = base × fine_mult^fine_count — cada reincidência dobra/cresce a multa
Cold restart parcial Após max_fines, zera root_goal + nega ferramentas por N tokens
Tool deny automático O agente perde acesso a ferramentas temporariamente
Reprimenda no output O texto gerado inclui feedback claro do erro

O melhor: o estado é consultável — as métricas de punição ficam expostas nas bindings Python. O sistema pode ser observado e ajustado.

A resolução: punição que educa

O resultado é um agente que:

  1. Erra pouco — a multa crescente torna o erro cada vez mais caro
  2. Se auto-corrige — o cold restart parcial força um reset do objetivo quando persiste
  3. Pode ser auditado — tudo é observável via bindings
  4. Não fica preso — o tool deny é temporário, não permanente

A v3 foi validada com 27 ocorrências de teste no módulo de punição — o sistema tem cobertura real.

Métricas

Métrica Valor
Versão v3
Mecanismos 4 (multa progressiva, cold restart, tool deny, reprimenda)
Fórmula da multa fine_amplitude = base × fine_mult^fine_count
Testes do GoalHamiltonian 27 ocorrências de punição/denied

Aprendizados

  1. Punição progressiva > punição fixa — o agente tolera um custo previsível. O que muda comportamento é o custo crescente da reincidência.
  2. Punição temporária educa, punição permanente mutila — o tool deny por N tokens força reflexão sem quebrar o agente.
  3. Observabilidade é essencial — expor as métricas de punição nas bindings permite ajustar o sistema sem adivinhar.
  4. Sistema imunológico como metáfora de design — memorizar e responder mais forte a cada reincidência é como o corpo aprende a combater infecções.