limiar
Destaques

Experimento da Anthropic automatiza ajustes de alinhamento em dez testes

29 de agosto de 2026
Anthropic

Um pesquisador da Anthropic apresentou um experimento no qual sistemas automatizados pesquisaram métodos, treinaram um modelo e melhoraram seu desempenho em dez testes de comportamentos problemáticos sem reduzir a performance geral medida. O resultado depende da qualidade desses testes e não mostra um modelo melhorando sozinho todas as próprias capacidades. Ainda assim, sugere que partes do pós-treinamento de alinhamento podem ser automatizadas.

Fonte

TechCrunch

https://techcrunch.com/2026/08/28/an-anthropic-researcher-just-gave-us-a-peek-at-self-improving-ai/

Receba conteúdo direto no seu email

Escolha o que funciona melhor pra você.