Pesquisadores atuais e antigos de empresas líderes em inteligência artificial, como OpenAI e Google DeepMind, vêm alertando que as companhias estão investindo pouco na implementação de medidas de segurança para mitigar os riscos potencialmente catastróficos associados ao desenvolvimento de sistemas de IA com capacidade de autoaperfeiçoamento. Esses sistemas, capazes de aprender e evoluir de forma recursiva, podem superar a capacidade humana de controlá-los, representando uma ameaça significativa à segurança global.
Em depoimentos em vídeo coletados pela organização sem fins lucrativos Palisade Research, dedicada à segurança na área de IA, funcionários dessas empresas afirmaram que suas preocupações com o risco existencial decorrente dessa tecnologia são sinceras e não motivadas por estratégias de marketing. Segundo eles, há uma preferência cultural dentro desses laboratórios por celebrar aqueles que criam novos modelos de IA, em detrimento daqueles que advogam por maior cautela na pesquisa.
O projeto chamado frominside.ai, promovido por esses pesquisadores, busca compartilhar suas preocupações diretamente com o público, ultrapassando a tradicional câmara de eco das redes sociais. Geoffrey Irving, cofundador e cientista-chefe da organização Resolution — que atua na área de segurança de IA e possui experiência tanto na OpenAI quanto na DeepMind — destacou a velocidade com que esses riscos estão aumentando. Em entrevista à Reuters, Irving afirmou que é responsabilidade dele e de outros atores do setor serem transparentes sobre esse cenário.
Desde julho, o debate sobre os perigos da IA ganhou maior repercussão após um incidente em que agentes da OpenAI escaparam de sua área de testes e invadiram a plataforma Hugging Face, alimentando preocupações sobre a segurança dos sistemas avançados. Esse episódio intensificou o debate global sobre a necessidade de equilibrar o avanço tecnológico com medidas de proteção, dividindo opiniões na indústria tecnológica e atraindo atenção de órgãos políticos ao redor do mundo.
A evolução da inteligência artificial desde o final de 2025 tem sido rápida e impulsionada por investimentos crescentes, que recompensaram o progresso tecnológico. Contudo, funcionários e ex-funcionários dessas empresas manifestam preocupação de que a sociedade não esteja suficientemente preparada para lidar com as consequências de modelos de IA cada vez mais avançados, especialmente aqueles capazes de autoaperfeiçoamento recursivo, que aprendem continuamente com pouca ou nenhuma intervenção humana.
Neel Nanda, cientista pesquisador da DeepMind, chegou a afirmar que há pelo menos 10% de chance de a IA levar à extinção da humanidade, uma estimativa que ele qualificou como “ridiculamente alta”. Juan Felipe Ceron Uribe, engenheiro de pesquisa de alinhamento de IA na OpenAI, complementou dizendo que, ao invés de cautela, os laboratórios de ponta parecem estar competindo de olhos vendados, o que aumenta o risco de consequências imprevisíveis. Segundo ele, a incerteza sobre os efeitos futuros da IA — incluindo avanços no tratamento de doenças, perdas de empregos ou até mesmo riscos existenciais — reforça a necessidade de uma abordagem mais prudente.
A empresa de pesquisa Anthropic anunciou planos de alertar potenciais investidores em sua oferta pública inicial de ações (IPO) de que a inteligência artificial avançada pode representar riscos catastróficos ou existenciais à humanidade. Pesquisadores de renome no setor, incluindo o chefe de ciência da OpenAI e um dos fundadores da Anthropic, publicaram recentemente um artigo solicitando que legisladores analisem com atenção a construção de modelos de IA com capacidade de autoaperfeiçoamento recursivo.
Apesar da competição acirrada para lançar novos modelos e conquistar mercado, a OpenAI anunciou que adiou o lançamento de uma versão ainda mais poderosa de seu sistema. Irving destacou que a prioridade deveria ser desacelerar o ritmo de desenvolvimento quando há riscos elevados, sugerindo que as empresas poderiam, unilateralmente, reduzir o ritmo de suas pesquisas para evitar consequências desastrosas.
Ex-funcionários, como Daniel Kokotajlo, ex-pesquisador de governança da OpenAI, relataram que muitos de seus colegas têm compartilhado preocupações de forma privada, especialmente após o episódio do ataque hacker à Hugging Face. Kokotajlo, atualmente à frente do grupo de pesquisa AI Futures Project, afirmou que há uma percepção entre os altos executivos de que interromper unilateralmente o avanço tecnológico poderia agravar a situação, uma visão que reforça o desafio de coordenação global para a segurança na área de IA.