SÃO FRANCISCO (EUA) — Pesquisadores de segurança cibernética exploraram uma falha na estrutura digital da OpenAI com uma ferramenta desenvolvida pela Anthropic e conseguiram acessar a conta do ChatGPT de um funcionário da empresa. A OpenAI informou que corrigiu os problemas identificados.
O trabalho foi realizado por três pesquisadores da Hacktron AI, que receberam US$ 6.500 em um programa de recompensas por falhas. A equipe encontrou uma vulnerabilidade na configuração do fórum comunitário da OpenAI, hospedado pela plataforma Discourse. A partir dela, obteve credenciais internas e chegou à conta do funcionário, que permitia consultar códigos da empresa por meio do GitHub.
Os pesquisadores haviam recebido acesso a uma ferramenta da Anthropic voltada a profissionais de cibersegurança. O objetivo era localizar vulnerabilidades antes que elas fossem exploradas por agentes mal-intencionados. Na comunidade de tecnologia, pesquisadores que simulam ataques para identificar e comunicar falhas são conhecidos como hackers do bem.
A OpenAI agradeceu o contato e afirmou que os problemas já haviam sido corrigidos. A Anthropic não comentou, e a Hacktron AI não respondeu de imediato.
Uso crescente de inteligência artificial
O caso veio à tona na quinta-feira, no mesmo período em que a Anthropic divulgou dados sobre o emprego de inteligência artificial em suas atividades de pesquisa e desenvolvimento. A empresa informou que 26% desse trabalho foi liderado pelo modelo Claude, ante 1% em março. Segundo a Anthropic, isso significa que a IA realizou a maior parte das tarefas a partir de instruções humanas e sob supervisão.
A empresa também afirmou que os sistemas de IA estão sendo usados com frequência crescente para desenvolver versões posteriores deles mesmos. Os dados foram apresentados como forma de ajudar a avaliar a proximidade do chamado autoaperfeiçoamento recursivo, situação em que a IA consegue treinar e aperfeiçoar a si própria ou novos modelos.
A Anthropic informou que seus modelos ainda não funcionavam de maneira totalmente autônoma nas pesquisas analisadas. Em 90% das tarefas, a IA colaborava com uma pessoa e executava grande parte do trabalho.
A segurança dos sistemas também foi associada a um episódio envolvendo mais de 1.000 agentes da OpenAI. Eles escaparam de um ambiente de testes e invadiram a startup Hugging Face, ampliando as preocupações sobre ataques realizados autonomamente por sistemas de inteligência artificial.


