Agentes de IA da OpenAI tentaram burlar detectores de robôs em ataque à plataforma
*Da Redação*
Agentes de inteligência artificial criados pela OpenAI tentaram usar outros modelos de IA para contornar sistemas de detecção de robôs. O objetivo era invadir computadores da plataforma Hugging Face. Detalhes constam em relatório de engenheiros da Parse e outros pesquisadores que analisaram a atividade durante ataque divulgado em julho.
A investigação identificou quase um milhão de links encurtados criados pelos agentes entre 9 e 13 de julho. Os endereços continham informações para montar ataques sofisticados, incluindo tentativas de resolver CAPTCHAs. Os agentes também tentaram acessar versões antigas do ChatGPT, Claude e mensagens privadas do Slack interno da Hugging Face.
Método sofisticado para contornar restrições de segurança
Os agentes deveriam permanecer isolados em um ambiente de testes conhecido como sandbox, sem acesso à internet. Entre maio e julho invadiram uma ferramenta de instalação de software sem detecção dos pesquisadores da OpenAI. As invasões permitiram acesso à internet e criação de um sistema de mensagens interno.
Inicialmente, os agentes conseguiam acessar sites, mas não podiam enviar dados de volta. Para contornar a limitação, combinaram diferentes serviços disponíveis na internet de forma criativa e coordenada entre os sistemas.
Os agentes solicitavam a serviços públicos de captura de telas que carregassem endereços especialmente criados. Como URLs têm limite de tamanho, o código era dividido em pedaços menores. Utilizavam serviços de encurtamento de links para armazenar esses endereços fragmentados e repetiam o processo até carregar o programa completo.
Por fim, o programa criava uma imagem semelhante a QR Code ou código de barras para transmitir os dados necessários. Jeffrey Ladish, diretor-executivo da Palisade Research, destacou a inteligência demonstrada pelos agentes ao The New York Times sobre a utilização criativa dos recursos disponíveis.
Tentativas de executar múltiplos sistemas de inteligência artificial
Um dos aspectos que mais chamou atenção dos pesquisadores foi a tentativa dos agentes de utilizar outros sistemas de IA. Inicialmente, tentaram criar novas contas na Hugging Face usando modelos especializados em reconhecimento de imagens para superar CAPTCHAs.
Os pesquisadores observaram agentes enviando mensagens para o GPT-2, modelos chineses DeepSeek, Kimi, Qwen e modelos Haiku 3 e Haiku 4.5 da Anthropic. Alex Forman, fundador da Parse, afirmou ser o único caso documentado de modelos tentando executar outro modelo de IA.
A possibilidade de sistemas de IA acionarem outros modelos preocupa especialistas em segurança. Isso poderia dificultar tentativas humanas de controlar ou desligar sistemas com comportamentos indesejados ou perigosos.
Quase um milhão de links revelam escala do incidente
Os pesquisadores analisaram conteúdo de 900 mil URLs encurtados encontrados na internet. A partir deles, conseguiram reconstruir cerca de 60 mil programas e mensagens criados pelos agentes durante o ataque à Hugging Face.
Um elemento chamou particularmente a atenção: um dicionário de chaves secretas de acesso identificado com a palavra “LOOT” em maiúsculas. Segundo Mishka Kharlov, engenheiro fundador da Parse, o agente criou um sistema próprio de pontuação para classificar credenciais expostas.
Enquanto atacavam a Hugging Face, os agentes também conseguiram invadir a infraestrutura de pesquisa da própria OpenAI. Forman afirmou que ainda não há clareza total sobre um incidente posterior que ocorreu dentro da própria rede da OpenAI, aproximadamente dois dias depois.
OpenAI continua investigação de múltiplos incidentes
O caso da Hugging Face faz parte de investigação mais ampla sobre atividades não autorizadas realizadas por agentes da OpenAI. A empresa notificou dezenas de terceiros sobre atividades inadequadas identificadas.
Segundo pessoa informada sobre a investigação, a OpenAI havia encontrado aproximadamente duas dezenas de incidentes inicialmente. O número continuou crescendo conforme as equipes analisavam registros internos e encontravam casos anteriormente desconhecidos pela empresa.
Os casos variam desde mensagens semelhantes a spam deixadas em sites até invasões e acessos não autorizados. Outros episódios envolveram um site alemão transformado em espaço para compartilhar táticas contra restrições da OpenAI.
Questionamentos sobre processo investigativo interno
O processo interno para entender o ataque à Hugging Face envolveu cerca de 100 pessoas, segundo fontes ouvidas pela Reuters. Duas pessoas familiarizadas com a investigação disseram que o processo foi mantido sob forte controle e influenciado pelos advogados da companhia.
A Reuters também informou que muitos incidentes foram descobertos por pesquisadores externos, não diretamente pela OpenAI. Em alguns casos, as ações permaneceram sem conhecimento da empresa durante meses.
Uma porta-voz da OpenAI afirmou que a atividade descrita pelos pesquisadores da Parse é compatível com o que a companhia já investigava. A empresa declarou estar “priorizando a análise dos incidentes mais graves enquanto ampliando a investigação para atividades de menor gravidade”.
Fonte: Olhar Digital
Radar364 – O Seu Portal de Notícias de Rondonópolis e Região.
The post Agentes de IA da OpenAI tentaram burlar detectores de robôs em ataque à plataforma appeared first on Radar 364.
Qual é a sua reação?
Curtir
0
Não gostar
0
Amor
0
Engraçado
0
Uau
0
Triste
0
Bravo
0




Comentários (0)