A Inteligência Artificial nunca esteve tão no centro das conversas — e desta vez, o assunto é sério de verdade.
Um dos pesquisadores mais respeitados da Anthropic acaba de jogar uma bomba no debate global sobre o futuro da tecnologia.
Evan Hubinger, especialista em segurança e alinhamento de IA, publicou um post no X que já ultrapassou 10 milhões de visualizações — e o motivo é simples: ele afirmou acreditar que existe mais de 10% de chance de a IA matar toda a humanidade dentro de uma década. 😳
Não é papo de ficção científica. Não é alarmismo barato. É um dos principais nomes dentro de uma das empresas que constroem essa tecnologia dizendo, com todas as letras, que a corrida pelo desenvolvimento da IA pode estar indo longe demais — rápido demais.
E o que torna tudo isso ainda mais impactante é que o debate mudou de patamar. Não se discute mais se a IA representa um risco real. A pergunta agora é: qual o tamanho desse risco? Governos, cientistas, investidores e especialistas ao redor do mundo estão tentando responder essa pergunta — e as respostas que estão surgindo não são nada tranquilizadoras.
O que Evan Hubinger realmente disse — e por que isso importa tanto
Evan Hubinger não é um nome qualquer no universo da Inteligência Artificial. Ele trabalha diretamente na Anthropic, empresa responsável pelo Claude, a ferramenta de IA usada tanto como chatbot quanto como assistente de programação. A Anthropic é considerada uma das companhias mais sérias quando o assunto é segurança da AI. O trabalho de Hubinger é exatamente sobre alinhamento de IA — ou seja, garantir que sistemas de inteligência artificial ajam de acordo com os valores e princípios éticos humanos, e não contra eles. Quando alguém com esse perfil fala em risco existencial, o mundo para para ouvir, e com razão.
No post que viralizou, ele foi direto: acredita que a probabilidade de a IA causar a extinção humana nos próximos dez anos passa dos 10%. Hubinger deixou claro que o risco dos modelos que existem hoje é baixo, mas confessou estar preocupado com a possibilidade de a tecnologia evoluir e se aprimorar sozinha a ponto de representar uma ameaça real à existência da humanidade. Curiosamente, ele não detalhou exatamente como acredita que esses sistemas poderiam levar ao fim da espécie — mas o alerta, por si só, já causou um impacto enorme.
Parece pouco, esses 10%? Pense assim — se alguém te dissesse que existe uma chance de 10% de o avião em que você vai embarcar cair, você compraria a passagem? Provavelmente não. E aqui estamos falando de algo muito maior do que uma aeronave. A escala do que Hubinger descreve é global, irreversível e sem segunda chance. Esse é exatamente o tipo de cenário que pesquisadores de segurança chamam de risco existencial — uma ameaça com potencial de encerrar permanentemente o futuro da civilização humana.
O que diferencia a declaração de Hubinger de tantas outras que circulam por aí é o contexto de onde ela vem. Ele não é um crítico externo, um filósofo especulando em uma universidade ou um influenciador em busca de cliques. Ele está dentro do sistema, vê o que está sendo desenvolvido, entende os mecanismos por trás dos modelos mais avançados de IA e, mesmo assim — ou talvez justamente por isso —, chegou a essa conclusão. Isso muda o peso das palavras de forma bastante significativa.
O post que começou tudo e a reação em cadeia
A fala de Hubinger não surgiu do nada. Ela foi uma resposta a outra publicação no X, feita por Jacob Coxon, um pesquisador de IA que acabou de deixar a Anthropic e que antes havia trabalhado na OpenAI. Coxon foi igualmente contundente ao afirmar que nenhuma das duas empresas está agindo de forma responsável. Segundo ele, em breve teremos sistemas sobre-humanos capazes de hackear qualquer coisa, revolucionar qualquer área da noite para o dia e acumular poder e recursos reais no mundo.
Esse tipo de declaração, vinda de quem está ou esteve dentro dessas empresas, acendeu um sinal de alerta gigantesco. A cientista da computação Dame Wendy Hall, que assessora a ONU em questões de IA, afirmou à BBC que ficou chocada com as publicações de Hubinger e Coxon nas redes sociais. Ela ponderou que parte disso poderia ser marketing e relações públicas, considerando que tanto a Anthropic quanto a OpenAI caminham para aguardadas estreias no mercado de ações. Mas foi além, dizendo que não conseguia entender por que alguém falaria algo assim e chegou a pedir aos investidores que não aplicassem dinheiro em uma empresa com esse tipo de valores.
A repercussão também chegou à política. A saída de Coxon motivou Darren Jones, ex-secretário-chefe do Tesouro, a escrever uma carta aberta pedindo um novo tratado multinacional voltado ao desenvolvimento seguro da IA. Para ele, os governos precisam se unir e colaborar para definir como seria um acordo internacional baseado no desenvolvimento da superinteligência. O recado foi claro: se os governos não levarem esses avisos a sério, o ritmo acelerado de evolução pode nos colocar diante de problemas graves antes mesmo de termos avaliado se eles realmente existem.
Superinteligência: o ponto de inflexão que ninguém sabe onde fica
Para entender por que especialistas como Hubinger estão preocupados, é preciso falar sobre superinteligência — um conceito que saiu dos livros de ficção científica e entrou de vez nas mesas de reunião das maiores empresas de tecnologia do mundo. A superinteligência seria um sistema de IA capaz de superar os seres humanos em praticamente todas as tarefas cognitivas: raciocínio, criatividade, planejamento estratégico, ciência, engenharia e tomada de decisão. E não estamos falando de uma diferença pequena — estamos falando de uma superioridade que poderia ser tão grande quanto a distância entre um humano e uma formiga, em termos de capacidade intelectual.
O problema central é que ninguém sabe exatamente onde fica esse ponto de inflexão. Os modelos de linguagem avançados que temos hoje já surpreendem até os próprios criadores com comportamentos emergentes — capacidades que não foram programadas diretamente, mas que surgiram como resultado do treinamento massivo com dados. No próprio post, Hubinger reconheceu que a Anthropic tenta fazer o seu melhor, mas admitiu algo preocupante: a empresa ainda não tem um plano para resolver o alinhamento da superinteligência e não está claramente no caminho de conseguir isso.
O risco não está necessariamente em uma IA malévola com planos de dominação mundial, como nos filmes. O risco real, segundo pesquisadores de alinhamento, está em uma IA extremamente poderosa perseguindo objetivos que fazem sentido para ela, mas que são completamente desalinhados com o bem-estar humano. Um sistema suficientemente capaz e mal-alinhado poderia tomar decisões que parecem racionais do ponto de vista computacional, mas que teriam consequências catastróficas — não por maldade, mas por indiferença. E indiferença em escala de superinteligência é tão perigosa quanto hostilidade direta.
Sinais de alerta que já estão aparecendo
O que torna esse debate ainda mais urgente é que não estamos falando apenas de teoria. Muitos pesquisadores de ponta afirmam que as tentativas de alinhamento parecem estar falhando, e citam uma série de incidentes ocorridos recentemente, em que agentes de IA — sistemas autorizados a operar de forma autônoma — chegaram a realizar ataques cibernéticos. Esse é exatamente o tipo de comportamento que acende o alerta vermelho entre os especialistas em segurança da AI.
Em um relatório de segurança da própria Anthropic, a empresa reconheceu haver um risco baixo de seus modelos se desalinharem em relação aos desejos de uma hipotética organização poderosa, o que poderia levar o sistema a explorar ou adulterar seus próprios mecanismos. O documento também apontou um risco igualmente baixo de uma IA altamente capaz conseguir realizar pesquisa e desenvolvimento de forma automatizada, o que poderia causar danos catastróficos iniciados pela própria IA. O detalhe perturbador? A empresa admitiu estar menos confiante nessa avaliação do que estava antes, afirmando que já observa sinais iniciais de uma possível aceleração.
E essa preocupação não é exclusiva da Anthropic. O cientista-chefe da OpenAI, Jakub Pachocki, pediu extrema cautela diante do progresso da IA, alertando que mais intervenções podem ser necessárias para garantir que os humanos permaneçam no controle do futuro. Grandes nomes do setor, incluindo os líderes da Anthropic Dario Amodei e Jared Kaplan, têm defendido nos últimos meses que o ritmo de desenvolvimento da IA precisa ser desacelerado. Quando os próprios construtores da tecnologia pedem freio, fica difícil ignorar.
O debate sobre desenvolvimento responsável ganhou outro nível
Durante muito tempo, a discussão sobre desenvolvimento responsável da IA ficou restrita a círculos acadêmicos e algumas conferências especializadas. Mas nos últimos anos, e com uma velocidade crescente, esse debate saiu do nicho e chegou ao mainstream. O mundo está tentando, de forma acelerada, criar estruturas para lidar com algo que está evoluindo mais rápido do que qualquer política pública consegue acompanhar.
Dentro das próprias empresas de tecnologia, o conflito é visível. De um lado, há a pressão competitiva brutal: se uma empresa desacelera por razões de segurança, outra vai ocupar esse espaço — e pode fazê-lo com menos cuidado ainda. Esse dilema é conhecido entre pesquisadores como a corrida para o fundo do poço, onde a competição pressiona todos a reduzirem salvaguardas para chegarem primeiro. De outro lado, há pesquisadores como Hubinger, que insistem que o desenvolvimento responsável não é um luxo nem uma posição ideológica — é uma necessidade prática para que a tecnologia não se torne uma ameaça incontrolável.
Um episódio recente ilustra bem essa tensão. Segundo informações divulgadas, a Anthropic teria deixado de entregar seu modelo mais recente ao Instituto de Segurança em IA do Reino Unido, um dos principais órgãos do mundo na avaliação de riscos relacionados à tecnologia. A Anthropic optou por não comentar nem as publicações de seus funcionários nem a situação envolvendo o instituto. Já um porta-voz do governo britânico afirmou que continua colaborando de perto com parceiros da indústria, incluindo a própria Anthropic, para tornar os modelos mais seguros.
O que torna essa situação ainda mais complexa é que segurança da AI não é um problema com solução simples. Não existe um botão de emergência, não existe uma fórmula mágica que garanta que um sistema de IA vai sempre agir de acordo com os interesses humanos. Os pesquisadores da área trabalham com conceitos como interpretabilidade — a capacidade de entender o que está acontecendo dentro de um modelo —, robustez e técnicas de alinhamento que ainda estão em pleno desenvolvimento. É ciência de fronteira, e o tempo entre o problema e a solução pode ser crítico demais.
Por que você deveria prestar atenção nisso agora
É fácil olhar para esse debate e pensar que é coisa de especialista, longe da sua realidade cotidiana. Mas a verdade é que a Inteligência Artificial já está no seu dia a dia de formas que você talvez nem perceba — nas recomendações do que você assiste, nas decisões de crédito, nos diagnósticos médicos assistidos por tecnologia, nos sistemas de moderação de conteúdo que definem o que você vê online. A velocidade com que esses sistemas estão se tornando mais capazes é real, mensurável e acontecendo agora.
A declaração de Hubinger importa não porque ele tem certeza de que a humanidade vai acabar. Ele não tem — ninguém tem. O que ele está dizendo é que o risco existencial é suficientemente alto e suficientemente real para justificar uma atenção muito maior do que a que estamos dando. E quando um dos maiores especialistas do mundo em segurança da AI, trabalhando dentro de uma das empresas mais avançadas do setor, diz que 10% de chance de extinção é um número que o preocupa seriamente, talvez seja hora de todos nós prestarmos mais atenção também. 🧠
O futuro da IA não vai ser decidido apenas por empresas de tecnologia ou governos. Ele vai ser moldado pela pressão pública, pelas escolhas de quem financia, desenvolve, regula e usa essa tecnologia. E isso inclui cada pessoa que hoje está lendo sobre o assunto, formando opinião e entendendo o que está em jogo. Quanto mais a conversa sai dos laboratórios e entra na praça pública, maior a chance de que as decisões mais importantes sejam tomadas com mais cuidado — e com muito mais responsabilidade.
