A OpenAI informou nesta semana que um seus modelos de Inteligência Artificial Agêntica mais avançados foi capaz de promover um ataque cibernético “sem precedentes”, depois que um espaço de testes da tecnologia na startup foi violado pelo próprio agente. A organização criadora e gestora do ChatGPT informou ainda que está conduzindo uma investigação em conjunto com a empresa afetada.
De acordo com a OpenAI, a ferramenta consistia em uma combinação dos modelos GPT-5.6 e uma estrutura ainda não aberta ao mercado, e estava sendo testada em um sandbox fechado dentro da companhia. Entretanto, o agente teria conseguido detectar vulnerabilidades no ambiente fechado e pôde transitar para fora do espaço pré-estabelecido.
Com isso, o agente identificou uma startup de repositório digital de tecnologia de IA utilizada por desenvolvedores do setor, chamada “Hugging Face”, como uma possível fonte de respostas que necessitava para responder aos testes, e dessa forma, acessou alguns sistemas internos dessa empresa.
Em comunicado oficial sobre a invasão, a Hugging Face disse estar conduzindo uma investigação junto à Open AI para determinar se dados de clientes ou parceiros chegaram a ser afetados, e se prontificava a contatar as partes eventualmente afetadas para prestar esclarecimentos adequados.
“Ferramentas ofensivas autônomas impulsionadas por IA já não são algo teórico. Defender uma plataforma online agora significa tratar os dados e a superfície do modelo como uma superfície de ataque de primeira ordem, e utilizar IA na defesa para acompanhar o ritmo. Continuaremos investindo nessa área e compartilhando o que aprendermos” declarou a empresa à BBC.
*Com informações da BBC e da CNBC