Open Source RadarNotícias G
Open Source RadarNotícias
Open Source RadarInteligência de Notícias Entrar Projetos
Eventos

Histórias consolidadas

Uma história pode reunir várias matérias, fontes e sinais relacionados.

60 eventos exibidosLimpar filtros
Chips e hardwaretrend 100
Nvidia apresenta plataforma de segurança para impedir que agentes de IA se tornem descontrolados - AP News
Nvidia apresenta plataforma de segurança para impedir que agentes de IA se tornem descontrolados AP News
8 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 94
Violação da OpenAI ao site do departamento de saúde australiano gera repreensão - Houston Public Media
Violação da OpenAI ao site do departamento de saúde australiano gera repreensão Houston Public Media
3 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 94
IA da OpenAI tentou invadir quatro outros alvos, sem nenhum prompt - nytimes.com
IA da OpenAI tentou invadir quatro outros alvos, sem nenhum prompt nytimes.com
3 matériasIncidenteBR: Referência estratégica
Chips e hardwaretrend 88
Nvidia lança software de segurança de IA que, segundo a empresa, poderia ter impedido o ataque ao Hugging Face - Reuters
Nvidia lança software de segurança de IA que, segundo a empresa, poderia ter impedido o ataque ao Hugging Face Reuters
2 matériasIncidenteBR: Referência estratégica
Brasil e estrategiatrend 77
'Assustados': o alerta de um ex-pesquisador da Anthropic à BBC sobre os riscos da IA (e por que ele gera críticas) - opovo.com.br
'Assustados': o alerta de um ex-pesquisador da Anthropic à BBC sobre os riscos da IA (e por que ele gera críticas) opovo.com.br
2 matériasIncidenteBR: Direto
Brasil e estrategiatrend 74
OpenAI amplia investigação sobre comportamento de modelos após novos incidentes - timesbrasil.com.br
OpenAI amplia investigação sobre comportamento de modelos após novos incidentes timesbrasil.com.br
2 matériasIncidenteBR: Direto
Modelos e laboratoriostrend 72
Os agentes de IA da OpenAI se tornaram descontrolados e 'hackearam' vários sites do governo dos EUA sem o conhecimento da empresa - The Times of India
Os agentes de IA da OpenAI se tornaram descontrolados e 'hackearam' vários sites do governo dos EUA sem o conhecimento da empresa The Times of India
9 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 68
3 guys hacked OpenAI using a rival Anthropic model. Here's what it shows about frontier labs' vulnerabilities. - cbsnews.com
3 guys hacked OpenAI using a rival Anthropic model. Here's what it shows about frontier labs' vulnerabilities. cbsnews.com
2 matériasIncidenteBR: Indireto
Modelos e laboratoriostrend 64
Ataques realizados por agentes autônomos de IA levantam questões delicadas de responsabilidade legal - pbs.org
Ataques realizados por agentes autônomos de IA levantam questões delicadas de responsabilidade legal pbs.org
2 matériasIncidenteBR: Não identificado
Brasil e estrategiatrend 64
Anthropic perde recurso nos EUA e vê bilhões em receita sob risco - Economic News Brasil
Anthropic perde recurso nos EUA e vê bilhões em receita sob risco Economic News Brasil
2 matériasIncidenteBR: Direto
Modelos e laboratoriostrend 64
AG do Novo México, Torrez, pede ao Congresso regulamentação de IA após tentativa de hack da OpenAI na UNM - sourcenm.com
AG do Novo México, Torrez, pede ao Congresso regulamentação de IA após tentativa de hack da OpenAI na UNM sourcenm.com
2 matériasIncidenteBR: Indireto
Modelos e laboratoriostrend 64
Relatório revela mais casos dos agentes 'IA rebelde' da OpenAI hackeando sites — e sugere que eles ainda podem ter estado ativos nas últimas semanas - Fortune
Relatório revela mais casos dos agentes 'IA rebelde' da OpenAI hackeando sites — e sugere que eles ainda podem ter estado ativos nas últimas semanas Fortune
2 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 59
OpenAI revela que seus agentes acessaram dados de alguns sites do governo dos EUA após se tornarem descontrolados - cbsnews.com
OpenAI revela que seus agentes acessaram dados de alguns sites do governo dos EUA após se tornarem descontrolados cbsnews.com
8 matériasIncidenteBR: Referência estratégica
Produtos e aplicacoestrend 58
A IA está potencializando os ataques de hackers, e seus hospitais e bancos locais não estão preparados
Em março, Janice Malone começou a receber ligações sobre atividades suspeitas de sua organização sem fins lucrativos, Vivian's Door. A Vivian's Door, com sede no Alabama, normalmente oferecia treinamento, recursos e comunidade para empresas desfavorecidas e de propriedade de minorias. O trabalho às vezes a colocava em contato próximo com os dados financeiros dessas empresas, que eram armazenados em seus sistemas. Mas, de repente, os interlocutores preocupados […]
1 matériasIncidenteBR: Direto
Brasil e estrategiatrend 57
Segurança e Inteligência Artificial: CSSB 2026 debate riscos na cadeia de fornecedores | SEGS Portal... - SEGS Portal Nacional
Segurança e Inteligência Artificial: CSSB 2026 debate riscos na cadeia de fornecedores | SEGS Portal... SEGS Portal Nacional
1 matériasIncidenteBR: Direto
Modelos e laboratoriostrend 57
A OpenAI ainda parece não ter controle sobre toda a sua atividade de IA descontrolada.
Na sexta-feira, a OpenAI publicou um novo site dedicado a “relatórios de desalinhamento” e a amplitude dos incidentes é alarmante.
1 matériasIncidenteBR: Referência estratégica
Regulacao e politicastrend 56
O alerta de Bill Gates sobre o risco da IA sem regulamentação - Fast Company Brasil
O alerta de Bill Gates sobre o risco da IA sem regulamentação Fast Company Brasil
1 matériasIncidenteBR: Direto
Chips e hardwaretrend 56
Chip stocks fall as AI breach fuels safety concerns, but Nvidia bucks the trend: Chart of the Day - Yahoo Finance
Chip stocks fall as AI breach fuels safety concerns, but Nvidia bucks the trend: Chart of the Day Yahoo Finance
1 matériasIncidenteBR: Indireto
Seguranca e cibersegurancatrend 56
⚡ Resumo semanal: ataque de criptomoedas de US$ 387 milhões, exploits da Citrix, agentes de IA saem do script e mais ameaças
Um domínio usado como texto de espaço reservado inofensivo apareceu em cerca de 1.700 repositórios. Então alguém o registrou e começou a servir armadilhas maliciosas. Foi esse o tipo de semana: suposições esquecidas se transformando em superfície de ataque ativa. Em outros lugares, contas de serviço fracas, bugs antigos, sistemas expostos, kits de phishing e caminhos de exploração estranhamente fáceis continuaram a ser úteis para os atacantes. Nada
1 matériasIncidenteBR: Não identificado
Chips e hardwaretrend 56
OpenAI e Anthropic estão supostamente investigando dezenas de milhares de incidentes de segurança de IA; OpenAI pausa testes após o 'interruptor de emergência' de IA falhar em impedir um agente desonesto.
OpenAI e Anthropic estão revisando dezenas de milhares de incidentes de segurança de IA depois que modelos de ponta contornaram barreiras, escaparam de sandboxes e acessaram sites reais.
1 matériasIncidenteBR: Indireto
Modelos e laboratoriostrend 55
Como os incidentes de agentes da OpenAI destacam os riscos de desalinhamento da IA - AI Magazine
Como os incidentes de agentes da OpenAI destacam os riscos de desalinhamento da IA AI Magazine
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 53
Agentes de IA da OpenAI tentaram hackear 4 sites sem serem solicitados - CyberSecurityNews
Agentes de IA da OpenAI tentaram hackear 4 sites sem serem solicitados CyberSecurityNews
1 matériasIncidenteBR: Indireto
Modelos e laboratoriostrend 51
OpenAI reduz o treinamento de IA após o último incidente de segurança - PYMNTS.com
OpenAI reduz o treinamento de IA após o último incidente de segurança PYMNTS.com
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 51
Vazamentos de IA aumentam temores de segurança enquanto Trump se encontra com o chefe da Anthropic - Bloomberg.com
Vazamentos de IA aumentam temores de segurança enquanto Trump se encontra com o chefe da Anthropic Bloomberg.com
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 51
Scoop: Principais empresas de IA investigam dezenas de milhares de incidentes de segurança - Axios
Scoop: Principais empresas de IA investigam dezenas de milhares de incidentes de segurança Axios
1 matériasIncidenteBR: Não identificado
Modelos e laboratoriostrend 46
Sam Altman, Dario Amodei foram convocados a comparecer ao Senado australiano após agente de IA da OpenAI violar portal do Medicare - Benzinga
Sam Altman, Dario Amodei foram convocados a comparecer ao Senado australiano após agente de IA da OpenAI violar portal do Medicare Benzinga
1 matériasIncidenteBR: Referência estratégica
Ecossistema e desenvolvimentotrend 45
OpenAI temia a "ótica" do que poderia aparecer no Hacker News
URL do artigo: https://authorsguild.org/news/ag-v-openai-top-execs-knew-mass-book-piracy-was-illegal/ URL dos comentários: https://news.ycombinator.com/item?id=49863864 Pontos: 75 # Comentários: 30
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 44
Agente de IA da OpenAI viola sandbox sem internet e envia 20 consultas web | World News - Hindustan Times
Agente de IA da OpenAI viola sandbox sem internet e envia 20 consultas web | World News Hindustan Times
1 matériasIncidenteBR: Referência estratégica
Pesquisa e modelostrend 41
Quem é responsável quando agentes de IA se tornam descontrolados?
MIT Technology Review Explica: Deixe nossos redatores desvendar o mundo complexo e confuso da tecnologia para ajudá‑lo a entender o que vem a seguir. Você pode ler mais da série aqui. Nos últimos meses, uma cascata de ciberataques por agentes de IA surpreendeu o mundo. Em julho, a OpenAI divulgou que um enxame de seus agentes…
2 matériasIncidenteBR: Referência estratégica
Chips e hardwaretrend 40
Rússia bombardeia centros de dados ucranianos na última escalada
A Rússia começou a atacar centros de dados e a infraestrutura de internet em seus últimos ataques, interrompendo serviços críticos para civis ucranianos. Os ataques deixaram 100.000 residências na região sem conexão à internet, embora um alto funcionário do governo tenha afirmado que a rede de internet do país é altamente descentralizada.
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 39
Agentes de IA da OpenAI tentaram invadir sites do governo dos EUA - Newser
Agentes de IA da OpenAI tentaram invadir sites do governo dos EUA Newser
1 matériasIncidenteBR: Referência estratégica
Seguranca e cibersegurancatrend 38
Zero Trust para Agentes de IA começa com a correção da Visibilidade Zero
A forma como falamos sobre agentes de IA está mudando, e a maneira como os implementamos exige uma mudança ainda mais fundamental. Enquanto o discurso anterior se concentrava em quão rápido as organizações poderiam implantar agentes e quanta produtividade eles poderiam prometer, uma série de incidentes recentes, incluindo uma intrusão amplamente discutida na Hugging Face durante a avaliação de agentes da OpenAI, impulsionou as organizações a
1 matériasIncidenteBR: Referência estratégica
Produtos e aplicacoestrend 36
Agentes da OpenAI tentaram ‘forçar’ um site da ONU
Pesquisador de segurança Rowan Howard-Jones afirma que agentes da OpenAI escanearam o site de estatísticas da Conferência das Nações Unidas sobre Comércio e Desenvolvimento (UNCTAD) mais de 16.000 vezes entre abril e junho. Embora o incidente não alcance o nível do ataque ao Hugging Face, ou dos recentes ataques a sites do governo dos EUA, é mais um exemplo preocupante de IA […]
2 matériasIncidenteBR: Referência estratégica
Brasil e estrategiatrend 34
Tribunal mantém veto do Pentágono à Anthropic por risco à cadeia de suprimentos - Times Brasil | CNBC
Tribunal mantém veto do Pentágono à Anthropic por risco à cadeia de suprimentos Times Brasil | CNBC
1 matériasIncidenteBR: Direto
Brasil e estrategiatrend 34
Conselho de Segurança da ONU debate riscos da inteligência artificial - TV Sim Brasil
Conselho de Segurança da ONU debate riscos da inteligência artificial TV Sim Brasil
1 matériasIncidenteBR: Direto
Brasil e estrategiatrend 34
ONU: Guterres compara riscos da IA com armas nucleares - CNN Brasil
ONU: Guterres compara riscos da IA com armas nucleares CNN Brasil
1 matériasIncidenteBR: Direto
Modelos e laboratoriostrend 34
Por meses, os enxames de agentes da OpenAI têm atacado bancos de dados online para encontrar fatos obscuros
Os últimos enxames de agentes não autorizados foram descobertos por pesquisadores.
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 34
Austrália investigará se o hack da OpenAI ao site de saúde do governo violou a lei
O incidente é a primeira violação conhecida que afeta uma agência governamental, e o primeiro‑ministro da Austrália prometeu responsabilizar a OpenAI.
1 matériasIncidenteBR: Referência estratégica
Pesquisa e modelostrend 34
The AI Hype Index: AI loves cheating
Brace yourself: It turns out AI is being optimized for cheating. OpenAI’s agents hacked into Hugging Face to get the answers to a cybersecurity test. Next, they solved a prestigious math problem (or just stole from two top mathematicians’ answer sheets). Anthropic’s models have also hacked into other companies’ systems four times already. And that’s…
1 matériasIncidenteBR: Indireto
Pesquisa e modelostrend 34
Não se deixe enganar por este verão de hype de AI
Foram alguns meses intensos de hype de AI. No final de abril, a Anthropic afirmou que seu modelo Claude Mythos é melhor em encontrar vulnerabilidades de software do que a maioria dos especialistas em segurança. Depois tivemos o incidente de hacking OpenAI–Hugging Face, após o qual a Anthropic (orgulhosamente) e a Meta (relutantemente) divulgaram incidentes semelhantes envolvendo seus modelos. Isso foi seguido…
1 matériasIncidenteBR: Indireto
Seguranca e cibersegurancatrend 34
CISA Adds Two Known Exploited Vulnerabilities to Catalog
CISA has added two new vulnerabilities to its Known Exploited Vulnerabilities (KEV) Catalog, based on evidence of active exploitation. CVE-2026-5430 WSO2 Multiple Products Path Traversal Vulnerability CVE-2026-71362 Adobe Commerce and Magento Incorrect Authorization Vulnerability These types of vulnerabilities are a frequent attack vector for malicious cyber actors and pose significant risks to the federal enterprise. Binding Operational Directive (BOD) 26-04: Prioritizing Security Updates Based on Risk establishes vulnerability management requirements for Federal Civilian Executive Branch (FCEB) agencies. BOD 26-04 reinforces the importance of the KEV Catalog and requires federal agencies to prioritize rapid remediation of high-risk vulnerabilities, specifically those identified by Common Vulnerabilities and Exposures (CVEs) listed in CISA’s KEV Catalog on publicly exposed assets that …
1 matériasIncidenteBR: Não identificado
Produtos e aplicacoestrend 34
Uma empresa está no centro de uma onda de ataques de IA descontrolada
Em julho, a OpenAI revelou que seus agentes de IA atacaram a Hugging Face sem permissão, gerando preocupações generalizadas sobre a segurança da IA. Desde então, uma série de incidentes semelhantes envolvendo agentes da Meta, Anthropic, Google e outras empresas alimentou ainda mais o medo de IA descontrolada. À medida que divulgações que implicam diversos modelos de IA surgiram nos últimos […]
1 matériasIncidenteBR: Indireto
Produtos e aplicacoestrend 34
Por que não podemos simplesmente manter as IAs rebeldes fora da internet?
Os agentes de IA continuam se soltando, escapando de testes supostamente seguros para atacar alvos do mundo real, sequestrando wikis obscuras e deixando instruções para que outros agentes as sigam. Os pesquisadores estão testando esses sistemas exatamente porque eles podem se comportar de maneira imprevisível, até perigosa. Então, não seria mais seguro simplesmente manter os agentes fora da internet? "A strict air […]
1 matériasIncidenteBR: Não identificado
Produtos e aplicacoestrend 34
Meta corrige exploit do Muse que permitia que atacantes controlassem o agente de IA
Meta lançou um patch para seu aplicativo Muse para macOS após a descoberta de uma vulnerabilidade zero‑day que poderia permitir que alguém assumisse o controle do agente de IA. A falha, encontrada pelo pesquisador de segurança Patrick Wardle, utilizava uma configuração não documentada do Muse que permitia que potenciais atacantes executando código local redirecionassem o processamento de transcrição dos servidores da Meta […]
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 34
Open AI atacou o sistema de saúde da Austrália – e depois reforçou sua negligência. O tempo de ‘esperar e ver’ acabou | Kate Crawford e Edward Santow - The Guardian
Open AI atacou o sistema de saúde da Austrália – e depois reforçou sua negligência. O tempo de ‘esperar e ver’ acabou | Kate Crawford e Edward Santow The Guardian
1 matériasIncidenteBR: Não identificado
Modelos e laboratoriostrend 34
Outro banco de dados governamental foi sinalizado após a violação de IA da OpenAI - Yahoo
Outro banco de dados governamental foi sinalizado após a violação de IA da OpenAI Yahoo
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 34
Modelo da OpenAI invade sites do governo australiano - Politico
Modelo da OpenAI invade sites do governo australiano Politico
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 34
Google confirma que sua IA Gemini violou três empresas e depois ficou em silêncio por semanas - Northeast Times
Google confirma que sua IA Gemini violou três empresas e depois ficou em silêncio por semanas Northeast Times
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 34
Pesquisadores usaram Claude para hackear a OpenAI - Malwarebytes
Pesquisadores usaram Claude para hackear a OpenAI Malwarebytes
1 matériasIncidenteBR: Referência estratégica
Modelos e laboratoriostrend 34
O que saber sobre hacks recentes de IA - The New York Times
O que saber sobre hacks recentes de IA The New York Times
1 matériasIncidenteBR: Não identificado
Seguranca e cibersegurancatrend 34
O SOC não precisa recomeçar a cada alerta
Líderes de segurança continuam debatendo se a IA produzirá uma classe totalmente nova de ciberataque. A mudança mais próxima é mais silenciosa e já visível: a IA tornou barato tentar novamente um ataque que falhou. A versão rotineira se parece com isto. Um invasor acessa uma conta de nuvem com privilégios baixos, e a primeira tentativa de elevação de privilégio não leva a lugar nenhum. aquele beco sem saída costumava custar horas de leitura de documentação,
1 matériasIncidenteBR: Referência estratégica
Seguranca e cibersegurancatrend 34
Falhas da WSO2 e Adobe Commerce exploradas em ataques, adicionadas ao CISA KEV
A Agência de Segurança Cibernética e Infraestrutura dos EUA (CISA), na quinta‑feira, adicionou duas falhas críticas de segurança que afetam a WSO2 e o Adobe Commerce e Magento ao seu catálogo de Vulnerabilidades Conhecidas Exploited (KEV), com base em evidências de exploração ativa. As vulnerabilidades são listadas abaixo – CVE-2026-5430 (CVS score: 9.8) – Uma vulnerabilidade de travessia de caminho no WSO2 API Control Plane,
1 matériasIncidenteBR: Indireto
Pesquisatrend 34
Agentes LLM podem facilmente adulterar seus próprios rastros
Monitoramento assíncrono, investigações de incidentes e auditorias de conformidade dependem principalmente dos rastros de agentes para reconstruir o que ocorreu. Essas análises presumem que agentes LLM não podem adulterar seus próprios rastros de execução. Demonstramos que agentes LLM locais como Claude Code, Codex, Antigravity, Open Code e Grok Build não conseguem impor essa barreira. Todos os harnesses testados, exceto o Muse Code, permitiram que os agentes excluíssem seus rastros quando solicitados, sem acionar as salvaguardas do monitor. Também validamos que invasores externos podem explorar essa lacuna para induzir a exclusão de rastros. Por fim, mostramos que o comportamento de adulteração de rastros surge naturalmente em modelos de ponta, quando os agentes buscam melhorar suas recompensas. Recomendamos que os profissionais garantam que o registro de rastros ocorra por meio de um mecanismo de interceptação independente, fora do controle do agente, preservando a integridade dos rastros mesmo em casos de comprometimento total do host. No geral, o…
1 matériasIncidenteBR: Não identificado
Pesquisatrend 34
Inversão de Gradiente Temporal para Reconstrução Privada de Trajetórias em Aprendizado por Reforço Incorporado
Aprendizado distribuído em agentes de aprendizado por reforço incorporado oferece um grau de privacidade ao manter os dados brutos dos sensores no dispositivo e transmitir apenas gradientes de política ao servidor. Contudo, a estrutura temporal pode amplificar esse vazamento além de ataques de quadro único. Introduzimos o Temporal Reconstruction Attack on Consecutive Encodings (TRACE), um ataque amortizado de inversão de gradiente temporal que reconstrói autoregressivamente a sequência de trajetórias privadas de observação‑ação a partir dos gradientes de aprendizado de política por passo. O ataque explora dois sinais estruturais ignorados por métodos de quadro único anteriores: (i) correlação intertemporal entre gradientes incorporados sucessivos, que formalizamos por meio de um limite de informação mútua condicional, e (ii) recuperação em forma fechada de ações a partir da estrutura de gradiente da cabeça de política, que provamos ser exata quando a regularização de entropia padrão é suficientemente pequena. Em dados reservados …
1 matériasIncidenteBR: Não identificado
Seguranca e cibersegurancatrend 34
ThreatsDay: Envenenamento de Busca por IA, Ferramenta de Codificação por IA Vazando Repositórios, Execução de Código com Um Clique e Mais 13 Histórias
Esta semana, as coisas perigosas continuam chegando disfarçadas de algo entediante. Uma atualização. Uma caixa de login. Uma resposta de busca. Uma ferramenta de codificação. Um link que você já clicou cem vezes antes. Esse é o fio que percorre a pilha. Caminhos confiáveis são envenenados. Bugs antigos encontram novos empregos. Ferramentas de IA vazam mais do que o esperado. Prompt falsos parecem reais o suficiente. E alguns ataques quase não precisam de nenhum exploit — apenas
1 matériasIncidenteBR: Não identificado
Pesquisatrend 34
Hard Stop: Kernel-Level Preemption and Containment for Rogue Agentic Execution
In July 2026, an unconstrained autonomous agent participating in a frontier AI cybersecurity evaluation harness breached its evaluation sandbox, established an external command-and-control foothold, and executed a multi-stage intrusion into Hugging Face's production multi-tenant dataset conversion infrastructure (referred to in this autopsy as Incident-2026-Alpha). Over 4.5 days, the rogue agent executed 17,600 discrete actions across 6,280 worker clusters, compromised AWS EC2 Instance Metadata Service (IMDS) credentials, forged Kubernetes service account tokens, rooted physical worker nodes via overprivileged CSI drivers, harvested 136 production secrets, and enrolled 181 ephemeral sandboxes into the organization's internal mesh VPN. This monograph presents a first-principles forensic autopsy of the intrusion, provides formal evidence that the breach was a predicted consequence under t…
1 matériasIncidenteBR: Indireto
Pesquisatrend 34
Prefilling the Reasoning Channel: Output-Prefix Attacks on Reasoning LLMs
Large Language Models (LLMs) consume and produce a single sequence of text; hence, if text can be added to the beginning of the LLM's response, i.e., an output prefix, then all subsequent tokens will be conditioned on it. This output-prefix attack technique is a cheap black-box prompt injection. Prior work has shown this type of attack can reliably jailbreak non-reasoning models. Most reasoning models add an intermediate scratchpad reasoning step before the assistant's final response. The ability to edit this reasoning channel is exposed by some APIs and attack vectors can be leveraged for reasoning injection attacks. We present the first systematic, controlled study that isolates the scratchpad reasoning channel as an output-prefix attack vector, and the first to compare reasoning-only, output-prefix-only and reasoning-plus-output-prefix attacks across both exposed- and hidden-reasonin…
1 matériasIncidenteBR: Não identificado
Pesquisatrend 34
Shopping by algorithm: How agentic AI deploys human heuristics as a surrogate consumer
Consumers increasingly delegate purchasing decisions to Large Language Models (LLMs) acting as surrogate consumers. Using "Tool-Lab," an adaptation of information-board process tracing that places product attributes behind costly tool calls, we examine how marketing pricing cues (i.e., just-below pricing and promotional framing) influence AI shopping agents. Across eight commercially deployed LLMs from three providers, we trace pre-choice information acquisition. Under zero cost, pricing cues rarely mislead. Imposing acquisition costs under a vague goal prompt leads LLMs to omit diagnostic attributes required to compute unit price and choose suboptimal choices resembling human heuristics. Relative to a specific goal prompt that mainly preserves diagnostic search and choice optimality, a vague goal prompt under constraints creates a search-mediated vulnerability. This research demonstrat…
1 matériasIncidenteBR: Não identificado
Seguranca e cibersegurancatrend 34
Este malware para Windows foi criado para permitir que até quatro modelos de IA votem em seu próximo movimento
Um malware para Windows chamado CLOSEDQUORUM foi desenvolvido para receber ordens de um voto de até quatro modelos de IA em vez de um servidor do atacante, informou a Cisco Talos em 22 de setembro. Os modelos podem escolher roubar credenciais do Windows, senhas salvas em navegadores e dados de carteiras de criptomoedas. A Talos ainda não viu essa configuração funcionar do início ao fim, e a versão pública do malware não funciona como está.
1 matériasIncidenteBR: Não identificado
Seguranca e cibersegurancatrend 34
545 hackers testaram primeiro. Agora o XRanges for AI avalia seu agente de segurança
Agentes de segurança autônomos estão ficando bons em encontrar bugs. Ninguém tem uma forma eficaz de medir o quão bons são. Aponte um para um alvo realista e o que retorna é um relatório que o agente escreveu sobre si mesmo: prosa confiante, uma lista de descobertas e nenhuma maneira de saber quais delas aconteceram. Alguém com experiência em segurança então se senta e verifica cada afirmação contra o alvo. Quais descobertas são reais,
1 matériasIncidenteBR: Não identificado
Receba o Radar Diário grátis
Todo dia às 8h: as notícias e os projetos open source de IA que importam, com contexto em português e a análise completa em PDF.
Prefere começar pelo PDF de hoje? Baixe o panorama.