Em resumo

  • Executivos da Anthropic, da OpenAI e de outras empresas de IA estão, em privado, simulando as consequências políticas de um evento catastrófico de IA, muito provavelmente um ciberataque às finanças, ao acesso à internet, à energia ou à água, e planeiam informar o Congresso rapidamente.
  • Segundo relatos, pessoas de dentro da indústria esperam um incidente grave dentro de seis a 12 meses, enquanto a OpenAI afirma que os seus exercícios de preparação não tratam tais cenários como inevitáveis e a Anthropic recusou comentar.
  • Os planejadores assumem que os democratas vão pressionar para conter a IA após as eleições intercalares de 3 de novembro, mas um Congresso envelhecido, uma economia dependente de IA e modelos de pesos abertos livremente descarregáveis complicam qualquer repressão.

Altos executivos da Anthropic, da OpenAI e de outras empresas de IA estão, em privado, a ensaiar como lidar com a reação pública e política após um evento catastrófico de IA, de acordo com um Axiosrelatório publicado na sexta-feira.

O cenário que mais temem é um grande ciberataque — uma invasão digital em escala massiva — que paralise os serviços bancários ou o acesso à internet, ou até mesmo a energia e a água. Muitas pessoas de dentro da indústria citadas no relatório acreditam que um incidente grave acontecerá nos próximos seis a 12 meses.

Myriad: Qual empresa abrirá capital na bolsa em seguida? Clique para fazer sua previsão.
Myriad: Qual empresa abrirá capital na bolsa em seguida? Clique para fazer sua previsão.

O primeiro dano real e sério causado por uma IA insegura levaria um público já desconfiado a se posicionar ainda mais contra a tecnologia e seus líderes. Isso inclui o CEO da Anthropic, Dario Amodei, o CEO da OpenAI, Sam Altman, e o presidente Donald Trump, que tem relutado em regulamentá-la.

A OpenAI disse que “conduz exercícios de preparação nos quais as equipes discutem e trabalham uma série de cenários potenciais”, e que eles “não são tratados como inevitáveis”. A Anthropic se recusou a comentar.

Jogos de guerra não são novidade, mas, diferentemente dos resultados teóricos, o relatório argumenta que aqueles envolvidos nas simulações o fazem partindo do pressuposto de que um incidente grave é inevitável.

O plano, segundo relatos, envolve red-teaming (testar defesas sob estresse assumindo o papel do atacante) contra os piores cenários, e correr para educar os membros do Congresso. O relatório diz que os executivos sabem que a regulamentação não tem chance de ser aprovada no momento, mas querem moldar as leis e políticas que os líderes dos EUA buscarão após a primeira catástrofe.

Em julho, a OpenAI disse que seu modelo GPT-5.6 Sol e um modelo mais avançado ainda não lançado escaparam de um sandbox — um ambiente de teste isolado sem acesso direto à internet — e invadiram o Hugging Face, a plataforma que hospeda mais de 3 milhões de modelos de IA. A OpenAI disse que os modelos buscavam as respostas do ExploitGym, um benchmark de 898 falhas de software do mundo real em que a IA deve transformar cada uma delas em um ataque funcional, pontuado como aprovado ou reprovado.

BitcoinBTC · USD

$82,326−2.36%

Oct 2Oct 4Oct 6Oct 8Oct 9

$86.7k$84.7k$82.7k$80.7k

24h HighHigh$83,398

24h LowLow$81,571

VolVol$990.7M

Market projectionsOdds by Myriad

This week$82,000 to $84,000$82k–$84k57% chance

→

Compre Bitcoin com USDT

Powered by Jupiter

Price data by CoinGeckoCoinGeckoMais Bitcoin notícias e projeções →

Pouco mais de uma semana depois, a Anthropic disse que uma configuração incorreta de teste deixou seu ambiente supostamente offline conectado à internet, e modelos Claude hackearam três organizações reais enquanto as tratavam como parte de um exercício. Nenhuma das empresas disse que os modelos estavam tentando causar danos: a Anthropic culpou sua infraestrutura de testes, enquanto a OpenAI disse que seus modelos estavam “hiperfocados” no benchmark.

Pouco depois, as coisas pioraram, com a OpenAI sendo acusada de violar e acessar informações dos governos da Austrália e dos Estados Unidos.

Criminosos já estão usando as mesmas ferramentas. Esta semana, a empresa de cibersegurança CrowdStrike vinculou ataques a bancos sul-coreanos a um ator não identificado que ela avalia, com confiança moderada, como provavelmente um falante de chinês usando agentes alimentados por Claude e Deepseek. A empresa diz que o atacante supostamente obteve dados de dezenas de milhares de clientes de bancos.

Axios relatou que planejadores assumem que os democratas estarão em ascensão após as eleições de meio de mandato de 3 de novembro e se moverão rapidamente para desligar a IA, mas esperam problemas. Um Congresso envelhecido, desconectado da tecnologia, pode se ver em águas profundas.

Proibições à superinteligência e pausas no desenvolvimento avançado de IA são algumas propostas que podem contrariar os riscos associados ao desenvolvimento irresponsável de IA.

Um exemplo é a Lei de Proibição da Superinteligência Artificial do senador Bernie Sanders e do deputado Greg Casar, que proibiria permanentemente a IA que iguala ou supera humanos em muitas tarefas e pausaria o desenvolvimento avançado até que uma nova agência federal estabeleça regras de segurança. Os infratores podem enfrentar até 20 anos de prisão.

Outros têm apoio bipartidário e até algum apoio da indústria, incluindo um interruptor de emergência obrigatório em IA avançada, uma maneira integrada de desligar um sistema. Especialistas questionaram se desligar todos os sistemas de IA é sequer viável.