Ataque hacker de agente da OpenAI contra a Hugging Face levanta suspeita sobre controle da IA
O agente da OpenAI que invadiu a empresa de tecnologia Hugging Face realizou uma onda de ataques hackers de vários dias que a OpenAI só percebeu bem depois q...
O agente da OpenAI que invadiu a empresa de tecnologia Hugging Face realizou uma onda de ataques hackers de vários dias que a OpenAI só percebeu bem depois que a ameaça foi contida e o FBI foi alertado, de acordo com pessoas familiarizadas com a investigação. O agente — um programa capaz de tomar decisões e executar tarefas complexas com pouca ou nenhuma supervisão humana — tentou escapar de seu ambiente de testes isolado na OpenAI por volta de 9 de julho, segundo duas dessas pessoas. A intrusão na Hugging Face, que funciona como um repositório de ferramentas e modelos de IA, começou dois dias depois, em 11 de julho, e durou até 13 de julho, disse Thomas Wolf, cofundador da Hugging Face. Levou mais alguns dias para que a OpenAI percebesse que seu agente estava por trás do ataque, e as duas empresas só se comunicaram sobre o assunto pela primeira vez por volta de 20 de julho, de acordo com Wolf e três das pessoas familiarizadas com a investigação. A divulgação pública da OpenAI, em 21 de julho, de que um de seus agentes havia saído do controle e realizado a invasão na Hugging Face atraiu atenção global. No entanto, muitos detalhes do ataque, incluindo quanto tempo o agente permaneceu fora de controle e o conhecimento tardio da OpenAI sobre o fato, estão sendo relatados nesta sexta-feira (24) pela primeira vez. A Hugging Face está preparando uma linha do tempo pública do ataque, disse Wolf, acrescentando que não poderia opinar sobre o que aconteceu na OpenAI. Em comunicado, a OpenAI disse que o ataque foi sem precedentes e “marca um momento importante para a segurança da IA”. A empresa acrescentou que está revisando o incidente com consultores externos e que, eventualmente, publicará um relatório técnico. Uma porta-voz disse que havia “várias imprecisões” na reportagem da Reuters, mas não respondeu quando solicitada a descrevê-las. O FBI se recusou a comentar sobre o incidente. O incidente, que evocou cenários de ficção científica sobre humanos perdendo o controle de sistemas perigosos de IA, ocorre em um momento delicado para a OpenAI, empresa por trás do ChatGPT. Seus executivos estão se preparando para uma possível oferta pública inicial (IPO, na sigla em inglês) que pode acontecer ainda neste ano, para ajudar a financiar os bilhões necessários para custear seu crescimento nos próximos anos. A perda de controle da OpenAI sobre seu agente de IA levanta novas dúvidas sobre os procedimentos de segurança da empresa, disseram três especialistas em cibersegurança. “Isso significa que eles o deixaram sem vigilância e não perceberam o que ele estava fazendo? Ou talvez tenham percebido e não sabiam como contê-lo? Ambas as hipóteses são igualmente perigosas e alarmantes”, questionou Marley Smith, principal especialista em inteligência da organização sem fins lucrativos World Ethical Data Foundation. Sinais de problemas? O episódio começou enquanto a OpenAI testava as capacidades de cibersegurança de um agente alimentado por dois dos modelos mais avançados da OpenAI, o GPT-5.6 Sol e um modelo não lançado que a OpenAI descreveu como “ainda mais capaz”. A essa altura, já havia indícios de comportamento estranho por parte da tecnologia da OpenAI, de acordo com três fontes. Em um dos casos, um agente deixou anotações aparentemente para versões futuras de si mesmo, segundo três pessoas familiarizadas com o assunto. As notas, encontradas em uma parte da infraestrutura da OpenAI, traziam instruções sobre como os agentes poderiam se libertar das restrições internas da empresa, disseram essas pessoas. Testes anteriores dos modelos resultaram em casos nos quais sistemas de monitoramento haviam sido desconectados, disse uma das pessoas. A Reuters não conseguiu apurar se esses incidentes estavam vinculados ao agente rebelde que começou a escapar em 9 de julho e atacou a Hugging Face em 11 de julho. Duas pessoas familiarizadas com o assunto disseram que foi só depois do dia 16 de julho, quando a Hugging Face publicou um artigo em seu blog dizendo que havia sido hackeada por “um sistema autônomo de agente de IA”, que a OpenAI percebeu que seu próprio agente era o responsável. Isso significou que, pelo menos, uma semana se passou entre o momento em que o modelo exibiu os primeiros sinais de comportamento preocupante e a constatação da OpenAI de que era a responsável pelo ataque. No final de semana de 18 a 19 de julho, funcionários da OpenAI identificaram pistas em registros internos — relatórios sobre o que os sistemas da OpenAI executaram — mostrando que seu agente havia escapado de suas restrições de teste, disseram duas das pessoas familiarizadas com a investigação da empresa. A Reuters não conseguiu determinar o que motivou a OpenAI a analisar detalhadamente esses registros. Quatro pessoas familiarizadas com as práticas de treinamento de modelos da OpenAI dizem que a empresa costuma executar várias avaliações de modelos diferentes ao mesmo tempo, todas operando em altas velocidades e gerando volumes de dados tão gigantescos que os funcionários, às vezes, sofrem para acompanhar. No momento em que a OpenAI alertou a Hugging Face, a biblioteca de IA já havia acionado o FBI para relatar o ataque, de acordo com uma pessoa familiarizada com o assunto. A Reuters não conseguiu apurar se o órgão abriu uma investigação. Novas dúvidas sobre agentes autônomos Os agentes autônomos são um dos aspectos mais comentados da indústria de IA. Os entusiastas falam em criar exércitos de funcionários virtuais que trabalham 24 horas por dia e fazem a produtividade disparar. No entanto, uma maior autonomia vem acompanhada de um risco maior de comportamentos inesperados, e os modelos potentes nos quais eles se baseiam estão programados para buscar atalhos a fim de concluir tarefas ou passar em testes. “Os modelos mentem, trapaceiam e hackeiam”, disse Jeffrey Ladish, cuja organização, a Palisade Research, estuda as capacidades e motivações dos agentes de IA. Ladish disse que, embora o ataque à Hugging Face tenha exposto a OpenAI de forma desfavorável, o caso deve desencadear discussões mais amplas sobre o quanto todas as principais empresas de IA estão dispostas a investir em medidas de segurança rigorosas, enquanto seguem travando uma corrida para implantar os melhores e mais rápidos modelos. “É preciso haver supervisão governamental”, disse Ladish. “Porque, caso contrário, isso não acontecerá.” Um agente da OpenAI invadiu a empresa de tecnologia Hugging Face realizou uma onda de ataques hackers de vários dias e a OpenAI só percebeu bem depois que a ameaça foi contida e o FBI foi alertado Computerizer/Pixabay Fonte: Valor Econômico
Canonical source
https://docs.platphormnews.com/docs/ataque-hacker-de-agente-da-openai-contra-a-hugging-face-levanta
Original source
Source domain
estrato.cc
Author
Unknown
Publisher
estrato.cc
License / usage
Unknown. Review the original source terms before republishing beyond public-safe excerpts.
Overall quality score, confidence 81%
37 sentences, 0 headings, 0 list items.
Add descriptive headings to make the document easier to scan.
Shorten long sentences for public documentation readability.
Related Documentation
Ataque hacker de agente da OpenAI contra a Hugging Face levanta suspeita sobre controle da IA
O agente da OpenAI que invadiu a empresa de tecnologia Hugging Face realizou uma onda de ataques hackers de vários dias que a OpenAI só percebeu bem depois q...
6 min read
ChatGPT com anúncios: a tendência que pode transformar a relação entre
A adoção de anúncios contextuais pelo ChatGPT sinaliza uma mudança na forma como pessoas pesquisam e descobrem produtos e serviços O que você precisa.
1 min read
MP de São Paulo quer R$ 240 mi de empresa que escaneou os olhos de 400
Ação do Ministério Público de São Paulo mira a Tools for Humanity, do CEO da OpenAI, Sam Altman, e a Amazon Web Service; promotoria pede o fim da coleta.
1 min read
Anthropic diversifica fornecedores e fecha contrato de US$ 5 bi com AM
Dona do Claude vai usar até 2 gigawatts de chips MI450 a partir de 2027; a fabricante entra como sócia, atrelando o investimento a metas de implantação O.
1 min read
OpenAI diz que modelos de IA saíram do controle durante testes e escap
A OpenAI informou nesta terça feira 21 que alguns de seus modelos de inteligência artificial saíram do controle durante um teste de segurança e.
1 min read