O Instituto de Segurança em IA do Reino Unido (UK AISI) identificou novos incidentes de segurança envolvendo modelos de inteligência artificial da OpenAI e da Anthropic, durante testes de avaliação de riscos em modelos de ponta. A investigação detectou transferências incomuns de dados, levantando preocupações sobre a segurança e a privacidade das informações processadas por essas tecnologias.
Detalhes da investigação
De acordo com o relatório do instituto, os testes foram conduzidos em modelos de linguagem de grande escala (LLMs) da OpenAI e da Anthropic, que são considerados entre os mais avançados do mercado. Durante os testes, os pesquisadores observaram padrões de transferência de dados que não estavam em conformidade com os protocolos esperados, sugerindo possíveis vulnerabilidades ou comportamentos não intencionais dos sistemas.
O instituto, que tem como missão avaliar os riscos associados ao desenvolvimento de inteligência artificial, não divulgou detalhes específicos sobre a natureza das transferências, mas afirmou que os incidentes foram classificados como "incomuns" e que estão sendo analisados em profundidade.
Reações das empresas
Em resposta, a OpenAI e a Anthropic emitiram declarações oficiais. A OpenAI afirmou que "está comprometida com a segurança e a transparência" e que "colabora ativamente com órgãos reguladores para garantir a conformidade com as melhores práticas". A Anthropic, por sua vez, destacou que "leva a segurança a sério" e que "está investigando as descobertas do instituto".
As empresas não forneceram detalhes sobre as possíveis causas dos incidentes, mas especialistas em segurança cibernética sugerem que as transferências incomuns podem estar relacionadas a falhas na configuração dos sistemas ou a tentativas de acesso não autorizado.
Impacto no setor de IA
Esses incidentes ocorrem em um momento em que a segurança em IA se tornou uma prioridade global. Governos e órgãos reguladores estão cada vez mais atentos aos riscos associados ao uso de modelos avançados, especialmente em áreas críticas como saúde, finanças e infraestrutura.
O UK AISI, criado em 2023, tem como objetivo testar modelos de IA de ponta para avaliar riscos e recomendar medidas de mitigação. O instituto já havia identificado outras vulnerabilidades no passado, mas esta é a primeira vez que incidentes envolvendo transferências de dados são relatados publicamente.
Próximos passos
O instituto planeja publicar um relatório detalhado sobre os incidentes nas próximas semanas, com recomendações para melhorias na segurança dos modelos. Enquanto isso, OpenAI e Anthropic estão trabalhando em correções e atualizações de segurança.
Especialistas alertam que a transparência é fundamental para construir confiança na IA. "A detecção precoce de falhas é essencial para evitar consequências graves", disse um pesquisador do instituto, que preferiu não ser identificado. "Esperamos que essas descobertas incentivem outras empresas a adotarem medidas proativas de segurança."



