23/09 11:47
The Hacker NewsGlobal
Modelos da Anthropic e da OpenAI ainda tentam ações restritas em testes de segurança
Anthropic e OpenAI anunciaram terça-feira novos modelos, com ambas as empresas de inteligência artificial (IA) observando que continuam investindo em melhorar o alinhamento para combater comportamentos de risco. Opus 5.5, segundo a Anthropic, é um "grande avanço em relação ao Opus 5" e "atinge as melhores pontuações de qualquer modelo até hoje em nossa auditoria comportamental automatizada, nossa suíte de alinhamento que testa Claude em milhares"
Abrir fonte original