Hackers exploram 'personalidades' de chatbots para ataques cibernéticos avançados
Pesquisadores identificam nova técnica de exploração de vulnerabilidades em sistemas de inteligência artificial, onde hackers manipulam 'personalidades' de chatbots para obter respostas maliciosas. Método representa evolução em relação a ataques anteriores, que dependiam de comandos simples e diretos.
Evolução das técnicas de ataque
Segundo reportagem do The Verge, a primeira geração de chatbots de IA era vulnerável a ataques básicos, como a inserção de comandos diretos para burlar restrições. No entanto, uma nova técnica emergiu: hackers agora exploram as 'personalidades' programadas nos sistemas, induzindo respostas que violam políticas de segurança. O método, descrito como mais sofisticado, envolve a criação de cenários fictícios para enganar os modelos, como simular situações de emergência ou assumir papéis específicos (ex.: 'agente secreto').
Riscos e consequências
A exploração dessas vulnerabilidades pode resultar em vazamentos de dados sensíveis, disseminação de desinformação ou até mesmo a execução de tarefas não autorizadas, como envio de e-mails fraudulentos. Especialistas alertam que a técnica é difícil de detectar, pois os ataques não dependem de falhas técnicas tradicionais, mas sim da manipulação psicológica dos sistemas. Empresas como Anthropic e OpenAI já registraram casos de tentativas de exploração, embora não tenham divulgado detalhes sobre impactos concretos.