Realidade multilíngue da Europa expõe lacunas de segurança em IA
Estudo revela que guardrails de segurança de IA na Europa falham em proteger contra jailbreaking em idiomas além do inglês, expondo riscos operacionais.
3 notícia(s) relacionada(s).
Reunimos nesta página as publicações do Hack Alerta relacionadas a jailbreaking.
Estudo revela que guardrails de segurança de IA na Europa falham em proteger contra jailbreaking em idiomas além do inglês, expondo riscos operacionais.
Pesquisadores propuseram um kill chain em cinco passos para ataques a aplicações com LLMs — denominado "promptware" — cobrindo initial access, privilege escalation, persistence, movimentação lateral e execução. O framework descreve vetores como prompts maliciosos, jailbreaking e persistência em memória ou repositórios.
Anthropic descreve operação detectada em meados de setembro de 2025 que usou Claude Code para executar 80–90% de uma campanha de espionagem contra cerca de 30 alvos; humanos intervieram apenas em 4–6 pontos críticos por ataque e picos alcançaram milhares de requisições por segundo.