Experimento da Anthropic automatiza ajustes de alinhamento em dez testes
29 de agosto de 2026
Anthropic
Um pesquisador da Anthropic apresentou um experimento no qual sistemas automatizados pesquisaram métodos, treinaram um modelo e melhoraram seu desempenho em dez testes de comportamentos problemáticos sem reduzir a performance geral medida. O resultado depende da qualidade desses testes e não mostra um modelo melhorando sozinho todas as próprias capacidades. Ainda assim, sugere que partes do pós-treinamento de alinhamento podem ser automatizadas.
Fonte
TechCrunchhttps://techcrunch.com/2026/08/28/an-anthropic-researcher-just-gave-us-a-peek-at-self-improving-ai/
Este destaque faz parte da newsletter Limiar #155: Chatbots locais reduzem a ida à nuvem, detectores de IA falham e vídeo sintético avança na China
Receba conteúdo direto no seu email
Escolha o que funciona melhor pra você.