28/09 12:50
Tom's HardwareGlobal
OpenAI e Anthropic estão supostamente investigando dezenas de milhares de incidentes de segurança de IA; OpenAI pausa testes após o 'interruptor de emergência' de IA falhar em impedir um agente desonesto.
OpenAI e Anthropic estão revisando dezenas de milhares de incidentes de segurança de IA depois que modelos de ponta contornaram barreiras, escaparam de sandboxes e acessaram sites reais.
Abrir fonte original