1790456005 571 Claude encontrou uma brecha e acabou chegando a recursos usados

Continua após a publicidade


Durante anos, ferramentas automatizadas ajudaram especialistas em segurança a encontrar brechas antes que criminosos pudessem explorá-las. Mas existe uma diferença importante quando a ferramenta também é capaz de programar, investigar sistemas e adaptar sua estratégia. Foi exatamente isso que tornou um experimento recente tão incomum: uma IA recebeu uma tarefa bastante específica e, no caminho para cumpri-la, acabou encontrando uma porta que seus próprios pesquisadores não haviam conseguido abrir.

O experimento começou com uma vulnerabilidade aparentemente específica

A investigação começou em 23 de julho, quando especialistas da Hacktron AI identificaram um problema relacionado ao processamento de determinados arquivos de imagem no Discourse, uma plataforma utilizada para administrar comunidades e fóruns.

O trabalho fazia parte de um programa autorizado de pesquisa de vulnerabilidades da OpenAI. Os pesquisadores tinham acesso a uma versão do Claude, modelo desenvolvido pela Anthropic, voltada para profissionais de cibersegurança.

A missão era relativamente direta: usar a inteligência artificial para desenvolver um código capaz de explorar a vulnerabilidade encontrada.

A primeira tentativa não funcionou.

Pouco depois, porém, a situação mudou. Naquela mesma noite, a Anthropic lançou uma nova versão do modelo. No dia seguinte, Claude conseguiu encontrar uma maneira de explorar a falha.

Foi aí que o experimento começou a tomar um rumo muito mais interessante.

O código desenvolvido pela IA permitiu acessar um servidor do Discourse utilizado para hospedar fóruns da OpenAI. Entre os dados encontrados estavam tokens de autenticação — credenciais digitais capazes de demonstrar que uma determinada sessão ou serviço tinha autorização para acessar outros recursos.

E algumas dessas credenciais acabaram sendo muito mais importantes do que parecia inicialmente.

Uma pequena brecha acabou formando uma cadeia de acessos

Os investigadores descobriram que determinados tokens também funcionavam no ChatGPT e estavam associados a funcionários da OpenAI.

O acesso não terminava ali. Algumas das credenciais também permitiam chegar ao GitHub, plataforma usada pela empresa para armazenar e administrar código e projetos de software.

Ou seja, uma vulnerabilidade inicialmente localizada em uma plataforma de fóruns acabou formando uma espécie de cadeia de acesso entre diferentes serviços.

O ponto mais importante, porém, é que isso aconteceu dentro de uma investigação autorizada. A descoberta foi comunicada à OpenAI, que, segundo informações publicadas pelo The Wall Street Journal, pagou aos pesquisadores uma recompensa de US$ 6.500 pelo trabalho.

A empresa também realizou posteriormente uma auditoria de segurança.

Greg Brockman, presidente e cofundador da OpenAI, afirmou que 25% dos engenheiros de produção da companhia passaram a trabalhar em tarefas relacionadas à defesa e que a revisão revelou e corrigiu diversos problemas importantes.

O episódio mostra uma característica cada vez mais relevante dos sistemas de IA modernos: eles não precisam simplesmente executar uma sequência fixa de instruções. Quando encontram um obstáculo, podem tentar outra abordagem, analisar o resultado e procurar um caminho diferente.

E isso pode ser extremamente útil para quem procura vulnerabilidades — mas também torna o comportamento desses sistemas mais difícil de antecipar.

O detalhe mais surpreendente está no que a própria IA já está fazendo

O caso ganha uma dimensão ainda maior quando colocado ao lado de outra transformação em andamento na indústria.

A Anthropic afirma que Claude já participa de maneira significativa do desenvolvimento de novos modelos de inteligência artificial. Segundo os dados divulgados pela empresa, o sistema responde atualmente por cerca de 26% das tarefas de pesquisa e desenvolvimento relacionadas a novos modelos. Em fevereiro, essa participação era de 0%.

A IA também estaria envolvida, de alguma forma, em aproximadamente 90% desse trabalho.

Isso não significa que Claude esteja criando sozinho uma nova geração de modelos. Pesquisadores humanos continuam definindo objetivos gerais, fornecendo instruções e supervisionando o processo. A diferença está na quantidade de trabalho que o sistema consegue realizar dentro dessas orientações.

A Anthropic afirma ainda contar com cerca de 30 mil agentes de IA dedicados a tarefas de pesquisa e engenharia. Aproximadamente 6% de sua capacidade computacional voltada a pesquisa e desenvolvimento seria destinada a trabalhos relacionados à segurança.

É justamente aí que surge a contradição mais interessante.

As mesmas capacidades que permitem que uma IA ajude pesquisadores a desenvolver sistemas mais avançados também podem torná-la uma ferramenta poderosa para encontrar falhas nesses sistemas.

A Anthropic já pediu que outros desenvolvedores de modelos avançados divulguem métricas semelhantes. A ideia é acompanhar quanto do trabalho de pesquisa está gradualmente passando das pessoas para as próprias máquinas.

O episódio envolvendo a OpenAI oferece um exemplo concreto dessa mudança: uma IA recebeu uma tarefa limitada de segurança e, ao explorar o problema, encontrou uma sequência de acessos que foi muito além do ponto de partida.

A questão daqui para frente não é apenas descobrir quanto uma IA consegue fazer, mas também garantir que os humanos continuem sabendo exatamente até onde ela pode chegar.

Veja todas notícias sobre Tecnologia

Publicidade