domingo, 20 setembro, 2026
HomeTECNOLOGIAINTELIGÊNCIA ARTIFICIALOpenAI corrige falha após pesquisadores usarem Claude, da Anthropic, para invadir sistemas...

OpenAI corrige falha após pesquisadores usarem Claude, da Anthropic, para invadir sistemas da empresa

Equipe de segurança recebeu recompensa de US$ 6.500 após demonstrar que vulnerabilidades em serviços conectados podiam abrir caminho para acesso a sistemas privados da criadora do ChatGPT

A OpenAI corrigiu duas vulnerabilidades de segurança identificadas por pesquisadores independentes que usaram o Claude, da Anthropic, para obter acesso a contas de funcionários e a um repositório interno de código da empresa. A invasão ocorreu em julho dentro de um programa oficial de recompensa por bugs, e expõe como ferramentas de inteligência artificial estão acelerando a descoberta e a exploração de falhas cibernéticas.

O caso foi revelado pelo Wall Street Journal, e acontece em um momento de crescente preocupação com a segurança dos sistemas de IA. Nas últimas semanas, empresas do setor têm relatado novos incidentes envolvendo agentes autônomos e vulnerabilidades em plataformas amplamente utilizadas por desenvolvedores.

Como funcionou a ‘invasão’

A investigação foi conduzida pela Hacktron AI, uma pequena empresa de pesquisa em segurança. O grupo recebeu uma recompensa de US$ 6.500 (em torno de R$ 33.500, na cotação atual) pelos seus serviços.

Segundo os pesquisadores, o ataque começou quando eles identificaram uma falha no Discourse, plataforma de fóruns utilizada pela OpenAI para hospedar discussões da comunidade. A equipe usou uma versão especializada do Claude, disponibilizada para profissionais de cibersegurança, para criar um código capaz de explorar a vulnerabilidade.

Depois de uma primeira tentativa sem sucesso, uma atualização do modelo da Anthropic permitiu que a ferramenta encontrasse uma forma funcional de explorar a brecha. Com isso, os pesquisadores obtiveram acesso a tokens de autenticação de usuários do fórum.

Para surpresa da equipe, alguns desses tokens também funcionavam em serviços da OpenAI, incluindo contas do ChatGPT pertencentes a funcionários da empresa.

Essas credenciais abriram caminho para acesso a um repositório privado hospedado no GitHub, identificado pelos pesquisadores como “Monorepo”. De acordo com pessoas familiarizadas com a arquitetura da OpenAI ouvidas pelo jornal, o sistema reúne parte significativa do código e dos segredos de engenharia que tornam os modelos da empresa mais eficientes. O ambiente, entretanto, não conteria os chamados “pesos” dos modelos de IA, considerados o ativo mais valioso da companhia.

Os pesquisadores afirmam que interromperam os testes assim que perceberam que poderiam acessar informações sensíveis. Antes disso, porém, conseguiram demonstrar o alcance da invasão criando uma solicitação de alteração em um arquivo de documentação do repositório. A mudança sugerida não chegou a ser aprovada.

Em nota ao Wall Street Journal, a OpenAI informou que as duas falhas identificadas já foram corrigidas. Segundo a empresa, o problema envolvia tanto configurações do Discourse quanto permissões de autenticação dentro de seus próprios sistemas. A companhia afirmou ainda que restringiu permissões de login, revogou tokens afetados e encerrou sessões potencialmente comprometidas.

Hackers turbinados

Para Mohan Pedhapati, diretor de tecnologia da Hacktron AI, o incidente sugere que grupos patrocinados por governos podem ter condições reais de explorar vulnerabilidades semelhantes. “Somos só três caras com assinaturas do Claude e do Codex”, afirmou ao jornal.

Especialistas consultados pela reportagem avaliam que a proliferação de agentes de IA está reduzindo a barreira de entrada para a descoberta de falhas de software. Joshua Saxe, diretor de tecnologia da Abundant Security, disse que os sistemas digitais já acumulavam milhares de vulnerabilidades, mas que agora ferramentas de IA permitem que um número muito maior de pessoas as encontre e explore.

A preocupação não se restringe a pesquisadores legítimos. Segundo a empresa de cibersegurança ThreatDown, citada pelo WSJ, acessos a contas com recursos avançados de IA voltados a operações ofensivas já podem ser encontrados em fóruns clandestinos por valores a partir de US$ 800 (aproximadamente R$ 4.130).

Após esse episódio e o incidente recente envolvendo a plataforma Hugging Face, a OpenAI iniciou uma revisão abrangente de sua infraestrutura de segurança. Em declaração pública, o presidente e cofundador da empresa, Greg Brockman, afirmou que cerca de 25% dos engenheiros responsáveis por sistemas de produção foram temporariamente deslocados para atividades de defesa e auditoria. Segundo ele, a iniciativa identificou diversos problemas considerados graves, que já foram corrigidos.

*Com supervisão de Daniel Pinheiro

Por: Felipe Medeiros*

RECOMENDADOS

MAIS POPULAR