Musk Wiki

Risco existencial da IA

PróximaRobôs humanoides

Por que Elon Musk acha que a IA é um risco existencial?

Ele chama a IA de aquilo que mais provavelmente moldará o futuro da humanidade e de algo mais perigoso que bombas nucleares. O medo dele é uma máquina muito mais inteligente que nós perseguindo um objetivo ao pé da letra, até um fim catastrófico. Ele estima em cerca de 20% a chance de aniquilação. Por anos pediu um árbitro governamental; agora aposta em uma IA feita para buscar a verdade.

Há mais de dez anos, Musk toca o mesmo alarme: a IA avançada é um perigo em escala de civilização, precisa ser construída com cuidado, e alguém além de quem a constrói tem que ficar de olho. Na época da conversa com Lex Fridman em 2023, ele se apresenta como quem avisou e não foi ouvido, e atribui a preocupação a uma briga com um colega fundador que o chamou de antirrobô por ser pró-humano.

A exposição do caso em 2023

Ele dá o aviso nos seus termos favoritos, os do Homem-Aranha, e o faz remontar a dez anos atrás ou mais:

“I’ve been pushing for some kind of regulatory oversight for a long time. I’ve been somewhat of a Cassandra on the subject for over a decade. I think we want to be very careful in how we develop AI. It’s a great power and with great power comes great responsibility.” ↗

“Há muito tempo eu venho defendendo algum tipo de supervisão regulatória. Fui meio que uma Cassandra nesse assunto por mais de uma década. Acho que a gente precisa ter muito cuidado na forma como desenvolve a IA. É um grande poder, e com grandes poderes vêm grandes responsabilidades.”

Do jeito que ele conta a origem da OpenAI, tudo gira em torno de uma pergunta simples: você deveria, para começo de conversa, estar do lado da humanidade? Ele chega lá pelas discussões sobre segurança da IA com Larry Page:

“Larry did not care about AI safety, or at least at the time he didn’t. And at one point he called me a speciesist for being pro-human” ↗

“O Larry não se importava com a segurança da IA, ou pelo menos naquela época não se importava. E em certo momento ele me chamou de especista por ser pró-humano”

E o seu veredito sobre a organização que ele ajudou a fundar e financiar, agora que ela se tornou fechada e com fins lucrativos:

“the open in open AI is supposed to mean open source, and it was created as a nonprofit open source, and now it is a closed source for maximum profit, which I think is not good karma” ↗

“o ‘open’ de OpenAI deveria significar código aberto, e ela foi criada como uma organização sem fins lucrativos e de código aberto, e agora é de código fechado e visa ao lucro máximo, o que acho que não é bom carma”

De 2023 a 2026: o alarme vira uma empresa e um credo (tuítes)

Nos tuítes de 2023 a 2026, a preocupação de uma década se endureceu em algo que ele pode transformar em ação: uma empresa e uma doutrina. Ele funda a xAI “para entender a realidade”, define a busca máxima pela verdade como a sua aposta em segurança (e não para de recorrer a Gemini, HAL 9000, Galileu e Voltaire para defendê-la) e começa a pôr datas na singularidade e na AGI:

“Announcing formation of @xAI to understand reality” ↗

“Anunciando a formação da @xAI para entender a realidade”

“Maximum truth-seeking is my best guess for AI safety” ↗

“A busca máxima pela verdade é o meu melhor palpite para a segurança da IA”

“A friend of mine suggested that I clarify the nature of the danger of woke AI, especially forced diversity. If an AI is programmed to push for diversity at all costs, as Google Gemini was, then it will do whatever it can to cause that outcome, potentially even killing people.” ↗

“Um amigo sugeriu que eu esclarecesse a natureza do perigo da IA woke, especialmente da diversidade forçada. Se uma IA for programada para promover a diversidade a qualquer custo, como foi o Google Gemini, ela fará tudo o que puder para produzir esse resultado, podendo até matar pessoas.”

“Being maximally truth-seeking is fundamental to AI safety. If you force AI to lie, it will do insane things. That was the central lesson of “2001: A Space Odyssey”. Haven’t you wondered why HAL wouldn’t open the pod bay doors?” ↗

“Buscar a verdade ao máximo é fundamental para a segurança da IA. Se você obriga a IA a mentir, ela faz coisas insanas. Essa foi a lição central de ‘2001: Uma Odisseia no Espaço’. Você nunca se perguntou por que o HAL não abria a porta da cápsula?”

“2026 is the year of the Singularity” ↗

“2026 é o ano da Singularidade”

As previsões com data são palpites do próprio Musk, relatadas como ele as fez. Mais em Tuítes de Elon Musk 2023-2026.

O que isso revela

  • Ele é pró-humano, não contra a tecnologia. A anedota do especismo é o ponto central. Musk não se opõe a construir IA (ele constrói), só a construí-la sem os interesses da humanidade como estrela-guia. A briga com Page se resume a de que lado você está.
  • Ele queria um árbitro externo, mesmo sem dentes. Depois largou o pedido. De 2015 a 2023, a sua solução era um terceiro capaz de inspecionar os principais laboratórios e ao menos levantar preocupações em voz alta, nos moldes da supervisão pesada com que as suas próprias empresas de carros e foguetes já convivem. A transparência era o piso; a aplicação das regras vinha depois. Em 2024 e 2025, ele deixa de pedir supervisão. Quando decide que ninguém consegue controlar uma superinteligência (a analogia do chimpanzé, mais abaixo), o árbitro cede lugar a valores incutidos mais concorrência: fazer a IA buscar a verdade e deixar que um único participante honesto force os demais a melhorar. O perigo que ele aponta nunca muda; só muda o remédio proposto. O remédio que muda acompanha o remédio ao longo de todo o arco (alertar, regular, construir, deixar de controlar) e concilia esse pedido de um regulador com a sua cruzada de desregulamentação.
  • Ele sustenta essa preocupação há muito tempo. Como nos planos mestres, ele demarcou o terreno anos antes de existir qualquer meio de enfrentá-la, e manteve a posição em público.
  • Abrir o código é uma proteção contra a concentração. Ele tende a abrir o código dos modelos, talvez com atraso, como contrapeso a qualquer empresa que corra sozinha rumo à AGI. É um argumento sobre distribuir poder, não sobre pureza.

Este é o gêmeo sombrio do seu otimismo civilizacional. A mesma lente em escala de espécie que o deixa esperançoso torna o risco catastrófico. Ele também se apoia no seu instinto de busca da verdade: o argumento de segurança para a sua própria IA é que uma máquina ancorada na física e na verdade tem menos chance de dar muito errado.

O gênio mágico, as bombas nucleares e a OpenAI em detalhe (DealBook Summit 2023)

O DealBook Summit de novembro de 2023 cai no mesmo mês que o #400, em plena crise do conselho da OpenAI, e condensa quase toda a crença numa só sentada: a imagem que ele usa para explicar a sua cautela, o argumento a favor da regulação, como ele lida com o medo, a afirmação de que foi uma Cassandra e a versão longa da traição da OpenAI.

Por que ele passou anos sem construir IA se resume a uma imagem: o gênio mágico, a espada de dois gumes:

“You may think you want a magic genie, but once that genie’s out of the bottle, it’s hard to say what happens.” ↗

“Você pode achar que quer um gênio mágico, mas, depois que esse gênio sai da garrafa, é difícil dizer o que acontece.”

A sua frase mais afiada sobre regulação põe a IA acima das armas nucleares, que já são reguladas:

“So I think, in my view, AI is more dangerous than nuclear bombs and we regulate nuclear bombs.” ↗

“Então acho que, na minha visão, a IA é mais perigosa do que as bombas nucleares, e a gente regula as bombas nucleares.”

O jeito dele de lidar com isso é o fatalismo, uma maneira de conseguir dormir, o mesmo movimento que faz um ano depois na All-In de 2024 com a frase da “suspensão deliberada da descrença… para dormir bem”:

“For awhile there, I was really getting demotivated and losing sleep over the threat of AI danger, and then I finally became fatalistic about it” ↗

“Por um tempo eu estava ficando realmente desmotivado e perdendo o sono por causa da ameaça do perigo da IA, e aí finalmente me tornei fatalista a respeito disso”

A afirmação da Cassandra de novo, na formulação de 2023, desta vez como quem alerta há mais tempo:

“I’ve been the one banging the drum the hardest, by far the longest, or at least one of longest for AI danger” ↗

“Fui eu quem bateu o tambor com mais força, de longe há mais tempo, ou pelo menos um dos que há mais tempo, sobre o perigo da IA”

Depois, a história da OpenAI em detalhe, aquela que o #400 resume em “não é bom carma”. Por que ele a criou:

“the reason for starting OpenAI was to create a counterweight to Google and DeepMind” ↗

“o motivo de ter criado a OpenAI foi criar um contrapeso ao Google e à DeepMind”

A ruptura com Larry Page, a anedota do especista por ser pró-humanidade. A versão do #400 está citada em bloco no início; aqui vai a redação do DealBook, com o juízo sobre segurança da IA que a desencadeou:

“And it became apparent to me that Larry did not care about AI safety.” ↗

“E ficou claro para mim que o Larry não se importava com a segurança da IA.”

“I think perhaps the thing that gave it away was when he called me a speciest for being pro-humanity, as in a racist, but for species.” ↗

“Acho que talvez o que deixou isso claro foi quando ele me chamou de especista por ser pró-humanidade, tipo um racista, mas de espécie.”

O veredito dele sobre o que a OpenAI virou põe o nome do avesso, “super fechada”, o par do DealBook para o “código fechado para o lucro máximo… não é bom carma” do #400:

“It is in fact a closed source, super closed. It should be renamed super closed source for maximum profit AI.” ↗

“Na verdade, ela é de código fechado, super fechado. Deveria ser rebatizada de IA de código super fechado para o lucro máximo.”

A previsão de prazo que ele dá aqui é a mais antiga das suas estimativas com data, anterior às de “2029 ou 2030” de 2025 e de cerca de 2030 em 2025: IA sobre-humana em até três anos. Pressionado sobre um modelo capaz de escrever um romance tão bom quanto os de J.K. Rowling ou de descobrir uma física nova, ele completa o raciocínio: eu diria que estamos a menos de três anos desse ponto. A citação abaixo ancora esse trecho (que segue com descobrir uma física nova ou inventar uma tecnologia nova, eu diria que) em vez de quebrar a frase para citá-la:

“It’s funny, all these weights, they’re just basically numbers in a common separated value file” ↗

“É engraçado, todos esses pesos são basicamente só números num arquivo de valores separados por vírgula”

A deflação de “os pesos são só um arquivo” fica ao lado do que ele chama, no mesmo fôlego, de “nosso deus digital”. A piada materialista é o ponto: uma AGI que ele trata como fim do mundo é, mecanicamente, um arquivo de valores separados por vírgula. Ele também faz o contraste com a Neuralink, a sua única espada de um gume só. Os primeiros implantes são inequivocamente bons para os paralisados, enquanto a IA é a de dois gumes (mais em Neuralink e Simbiose entre humanos e IA).

É o alertar e construir no seu estado mais concentrado, duas semanas depois do #400: o gênio (por que ter cautela), a analogia nuclear (por que regular), o fatalismo (como ele convive com isso) e a mágoa com a OpenAI (o veículo que se voltou contra ele), tudo numa só sentada.

“Destruição civilizacional” e a reunião com Obama (Tucker Carlson 2023)

A entrevista com Tucker Carlson de abril de 2023 é a sua primeira conversa registrada de 2023 sobre o tema, oito meses antes do DealBook e no mesmo mês em que ele montava a xAI. Ele expõe o que está em jogo de forma tão crua quanto em qualquer outro momento e respalda a sinceridade da preocupação com um pedaço da própria biografia. Primeiro o perigo, posto acima do risco comum de engenharia, com a consequência explicitada:

“AI is more dangerous than, say, mismanaged aircraft design or production maintenance or bad car production in the sense that it has the potential, however small one may regard that probability, but it is not trivial; it has the potential of civilizational destruction.” ↗

“A IA é mais perigosa do que, digamos, um projeto de avião mal gerido, a manutenção da produção ou a fabricação ruim de carros, no sentido de que tem o potencial, por menor que alguém considere essa probabilidade, mas ela não é trivial, de destruir a civilização.”

A prova: a sua única reunião particular com um presidente em exercício, que ele usou para falar de regulação da IA, e não das próprias empresas:

“I saw it happening from well before GPT-1, which is why I tried to warn the public for years. The only one on one meeting I ever had with Obama as President I used not to promote Tesla or SpaceX, but to encourage AI regulation.” ↗

“Eu vi isso acontecendo bem antes do GPT-1, e é por isso que tentei alertar o público durante anos. A única reunião individual que tive com Obama como presidente eu usei não para promover a Tesla ou a SpaceX, mas para incentivar a regulação da IA.”

É a afirmação da Cassandra de 2018, “eu tentei durante anos” com um exemplo concreto anexado, e ela vem sete meses antes da fala do #400, “Cassandra… por mais de uma década”. Na mesma entrevista, ele derruba uma caricatura de si mesmo, a do inconformista antirregulação que ele garante que não é, o que faz do alarme um pedido real de supervisão, e não pose de rebelde:

“Some people may think I’m some revelatory maverick that defies regulators on a regular basis. This is not the case.” ↗

“Algumas pessoas podem achar que sou algum tipo de inconformista revolucionário que desafia os reguladores o tempo todo. Não é o caso.”

“It’s not fun to be regulated. It’s sort of arduous to be regulated.” ↗

“Não é divertido ser regulado. É meio árduo ser regulado.”

A resposta dele aqui é o “TruthGPT”, uma IA de busca máxima pela verdade. É a primeira vez que ele apresenta a meta de projeto de busca da verdade como um produto, e o precursor declarado da xAI e do Grok. A lógica de segurança por trás, a de que uma IA curiosa tem motivo para poupar a humanidade, está citada em bloco em Curiosidade e busca da verdade.

A entrevista com Bill Maher, também de abril de 2023, traz o pedido de supervisão na sua forma mais simples de 2023: um regulador para impedir que os desenvolvedores cortem caminho na segurança. É o mesmo instinto de árbitro externo da frase de 2019, “agência governamental que supervisiona qualquer coisa relacionada à IA”:

“there should be some regulatory body that oversees what companies are doing so that they don’t cut corners.” ↗

“deveria haver algum órgão regulador que supervisione o que as empresas estão fazendo para que elas não cortem caminho.”

Isso reforça a correção do Tucker, “não sou um inconformista antirregulação”, feita no mesmo mês. Ao longo de 2023, a sua posição declarada sobre IA é, de forma consistente, a favor da supervisão.

A mesma preocupação como texto institucional (anúncio do Grok pela xAI, novembro de 2023)

Quando o laboratório do próprio Musk lançou o seu primeiro produto, a preocupação reapareceu como um compromisso corporativo. O post “Announcing Grok” de 3 de novembro de 2023 é texto institucional assinado “the xAI Team”, e não palavras do próprio Musk, e portanto pertence à empresa, não a ele. Ele fecha a sua seção de pesquisa com a promessa de se proteger contra o uso malicioso catastrófico:

“we will work towards developing reliable safeguards against catastrophic forms of malicious use. We believe in doing our utmost to ensure that AI remains a force for good.” ↗

“trabalharemos para desenvolver salvaguardas confiáveis contra formas catastróficas de uso malicioso. Acreditamos em fazer o máximo para garantir que a IA continue sendo uma força para o bem.”

É a face corporativa da postura de alertar e construir que ele declara em outros lugares com a própria voz. A meta de busca da verdade que ele vendia desde o “TruthGPT” como o caminho mais seguro agora está escrita na carta de fundação da empresa que ele criou para persegui-la. As palavras são o enquadramento da empresa, não uma declaração de Musk.

A ruptura com Larry Page, versão de maio de 2023 (CNBC / David Faber)

A entrevista à CNBC com David Faber, de maio de 2023, dá à origem da OpenAI e à ruptura com Larry Page uma formulação datada própria, seis meses antes das versões do #400 (“especista por ser pró-humano”) e do DealBook (“especista por ser pró-humanidade”) acima. Desta vez ele a enquadra pela consciência, a humana contra a das máquinas, e a chama de fim da amizade:

“The final straw was Larry calling me a ‘species-ist’ for being pro-human consciousness instead of machine consciousness.” ↗

“A gota d’água foi o Larry me chamar de ‘especista’ por ser a favor da consciência humana em vez da consciência das máquinas.”

A mesma anedota, não uma afirmação nova. O ponto central permanece: ele se opõe a construir IA sem a humanidade como estrela-guia, e a discordância se resume a de que lado você está. É só a versão de maio de 2023 de uma história que ele também conta em novembro de 2023 e no DealBook. A entrevista também retoma a justificativa de fundação em que gira a história da OpenAI: ela só existe, segundo ele, porque ele queria um contrapeso sem fins comerciais à crescente liderança do Google em IA, e o decepcionou ao abandonar as suas raízes sem fins lucrativos.

A declaração datada mais antiga que existe: “muito mais trabalho em segurança da IA” (janeiro de 2015)

O AMA no Reddit de janeiro de 2015 guarda a versão datada mais antiga dessa crença, dezoito meses antes da Code Conference e onze meses antes de ele cofundar a OpenAI (dezembro de 2015). Perguntado sobre quando deveríamos começar a nos preocupar com a IA, ele digita uma resposta, e a posição em duas partes já está completa: o perigo é real, mas não iminente, e a resposta é trabalho concreto em segurança.

“The timeframe is not immediate, but we should be concerned. There needs to be a lot more work on AI safety.” ↗

“O prazo não é imediato, mas devemos nos preocupar. É preciso haver muito mais trabalho em segurança da IA.”

É a semente da frase da “nem todos os futuros da IA são benignos” de 2016: o mesmo formato, direcional e voltado para o futuro, e não pânico com os sistemas atuais, só que um ano e meio antes e por escrito. A metade do é preciso… mais trabalho em segurança da IA é a construtiva, o impulso que, dentro do ano, produziu a OpenAI como o remédio da democratização que ele depois abandonou. Janeiro de 2015 é o ponto de origem para o qual apontam as afirmações posteriores de “Cassandra… por mais de uma década” e “bati o tambor… há mais tempo”.

A sua fala mais antiga num palco: “nem todos os futuros da IA são benignos” (junho de 2016)

A Code Conference de junho de 2016 guarda a sua fala mais antiga num palco sobre o risco da IA, três meses antes da Y Combinator e um ano e meio depois do AMA de 2015 acima. Compacta, mas já na linha: o perigo é direcional, uma questão de qual futuro a IA produz, e não de a IA ser ruim em si.

“I am concerned at certain directions that AI could take that would be not good for the future.” ↗

“Me preocupam certos rumos que a IA poderia tomar e que não seriam bons para o futuro.”

“I think it would be fair to say that not all AI futures are benign.” ↗

“Acho que seria justo dizer que nem todos os futuros da IA são benignos.”

Ele a combina com a proteção do lado humano que desenvolve em outros lugares: sem uma interface neural de alta largura de banda, a pessoa acaba deixando de ser gato de estimação ao lado da IA (citado em bloco em Simbiose entre humanos e IA e Fusão com a IA). Mesmo no seu estado mais comprimido, a posição de 2016 carrega as duas metades: o aviso e a fusão como proteção pessoal.

A IA “profunda” como “uma situação perigosa” e o conselho sobre regulação (World Government Summit 2017)

A conversa na World Government Summit de fevereiro de 2017 dá à posição de alertar e vigiar a sua formulação do início de 2017, oito meses depois da Code Conference e quatro anos antes da frase “Cassandra… por mais de uma década” que data a preocupação mais ou menos para este momento. Ele separa a IA restrita da IA geral e nomeia sem rodeios o perigo da segunda:

“I think one of the most troubling questions is artificial intelligence.” ↗

“Acho que uma das questões mais preocupantes é a inteligência artificial.”

“where you can have AI that is much smarter than the smartest human on Earth. This, I think, is a dangerous situation.” ↗

“em que você pode ter uma IA muito mais inteligente do que o humano mais inteligente da Terra. Isso, acho, é uma situação perigosa.”

A imagem a que ele recorre, e a que volta mais tarde, é a da superinteligência digital como um alienígena:

“Well, digital super intelligence will be like an alien.” ↗

“Bom, a superinteligência digital vai ser como um alienígena.”

E, perguntado sobre o que os governos deveriam fazer, o primeiro item é o pedido de supervisão por um árbitro externo, em nome da segurança pública, que se repete de 2016 a 2019 (uma “agência governamental que supervisiona qualquer coisa relacionada à IA”) e chega a 2023 (“algum órgão regulador… para que elas não cortem caminho”):

“governments keep a close eye on artificial intelligence and make sure that it does not represent a danger to the public.” ↗

“os governos fiquem de olho na inteligência artificial e garantam que ela não represente um perigo para o público.”

O raciocínio dele, parafraseado porque se estende por várias marcações de legenda, é que os pesquisadores “podem ficar tão absorvidos no trabalho” que deixam passar as consequências. A mesma postura em duas partes de sempre: a IA “profunda” ou geral como perigo em escala de civilização, mais o pedido para que alguém além de quem a constrói fique de olho, aqui na sua forma de fevereiro de 2017, o período a que a fala posterior da Cassandra remonta.

O pedido de regulação, retomado: “uma agência reguladora para a IA” (TED2022)

A entrevista à TED de abril de 2022 põe a metade da supervisão na sua frase mais limpa. Depois de construir no Optimus um botão de “parar” que não pode ser atualizado, para que ele não acabe “virando uma situação distópica” (mais em Robôs humanoides), ele estende a mesma precaução à IA em geral:

“I do think there should be a regulatory agency for AI.” ↗

“Eu acho mesmo que deveria haver uma agência reguladora para a IA.”

E ele aponta o que isso lhe custa, a mesma tensão consciente do relato da reunião com Obama de 2023: ele está pedindo para ser regulado.

“I don’t love being regulated, but I think this is an important thing for public safety.” ↗

“Não gosto de ser regulado, mas acho que isso é importante para a segurança pública.”

É o mesmo pedido de árbitro externo do conselho de 2017, “fiquem de olho”, e da frase do árbitro de 2019, aqui na sua forma mais simples, de abril de 2022, “dito por muitos anos”, e notavelmente defendido contra o seu próprio interesse.

“Um árbitro para a AGI” e a AGI como propriedade emergente (Tesla AI Day 2022)

O Tesla AI Day 2022 (setembro de 2022) traz o pedido de supervisão de volta cinco meses depois da TED2022, agora voltado para a AGI, e acrescenta a afirmação de que a Tesla caminha para lá querendo ou não. Na abertura, Musk diz que a Tesla poderia “dar uma contribuição significativa para a AGI” e, em Tesla, liga isso ao controle de governança de uma empresa de capital aberto. Na sessão de perguntas, indagado se a Tesla vai formar a sua própria competência em segurança de AGI, ele volta ao pedido de supervisão governamental:

“I think there should be an AI sort of regulatory authority at the government level” ↗

“Acho que deveria haver uma espécie de autoridade reguladora de IA no nível do governo”

“I think there should be a referee that is trying to ensure public safety for AGI” ↗

“Acho que deveria haver um árbitro tentando garantir a segurança pública em relação à AGI”

Ele a apoia na analogia que usa há anos: a IA é um campo de segurança pública como os aviões, os carros, os alimentos e os remédios, e merece um árbitro (parafraseado). O que é novo em 2022 é como ele enquadra o caminho da Tesla até a AGI: como algo emergente, e não buscado, um subproduto de rodar IA no mundo real em escala de frota, já que milhões de carros e robôs processando vídeo do mundo real produzem “provavelmente o maior conjunto de dados”:

“seems likely to be an emergent property of what we’re doing” ↗

“parece provável que seja uma propriedade emergente do que estamos fazendo”

É a mesma lógica de árbitro externo do conselho de 2017, “fiquem de olho”, da frase do árbitro de 2019 e do pedido de “agência reguladora para a IA” de abril de 2022, aqui apontada direto para a AGI e unida à afirmação de que a Tesla pode vir a contribuir com a AGI por acidente, o que, para ele, é exatamente o motivo de a supervisão externa importar.

O ponto de origem de 2016: a democratização e a OpenAI como remédio

A conversa na Y Combinator em 2016 (setembro, três meses depois) é a sua declaração detalhada mais antiga dessa crença, e traz tanto o aviso quanto um remédio concreto que ele depois abandonaria. Já em 2016 ele põe a IA no topo:

“But in terms of things that I think are most likely to affect the future of humanity, I think AI is probably the single biggest item in the near term that’s likely to affect humanity.” ↗

“Mas, entre as coisas que eu acho que têm mais chance de afetar o futuro da humanidade, acho que a IA é provavelmente o maior item isolado, no curto prazo, com probabilidade de afetar a humanidade.”

Ele define o critério de um bom resultado como aquele que você aprovaria com visão antecipada, o teste da bola de cristal:

“It’s very important that we have the advance of AI in a good way that is something that if you could look into a crystal ball and see the future you would like that outcome.” ↗

“É muito importante que o avanço da IA aconteça de uma boa maneira, de um jeito em que, se você pudesse olhar numa bola de cristal e ver o futuro, você gostasse do resultado.”

O seu remédio de 2016 é a democratização: espalhar a tecnologia para que nenhuma empresa ou pessoa a controle sozinha. A sua preocupação declarada é a concentração e o roubo, não a IA desenvolver hostilidade por conta própria:

“is that we achieve democratization of AI technology, meaning that no one company or small set of individuals has control over advanced AI technology.” ↗

“é que a gente alcance a democratização da tecnologia de IA, ou seja, que nenhuma empresa nem pequeno grupo de indivíduos tenha o controle da tecnologia avançada de IA.”

E o motivo que ele dá para cofundar a OpenAI é exatamente esse: espalhar a tecnologia para reduzir o risco existencial:

“I think people really believe in the mission. I think it’s important and it’s about minimizing the risk of existential harm in the future.” ↗

“Acho que as pessoas realmente acreditam na missão. Acho que ela é importante e trata de minimizar o risco de dano existencial no futuro.”

ℹ️ Evolução, não contradição. O instinto de abrir o código como proteção atravessa tudo (volta no #400); o que mudou foi a instituição. A OpenAI que ele elogia aqui como IA democratizada e redutora do risco existencial é a mesma que ele condena depois, na conversa de 2023, por ter se tornado fechada e com fins lucrativos. O seu veredito sobre essa virada é a frase do “não é bom carma”, citada em bloco mais acima. 2016 é o antes desse arco e a razão de ele ter acabado construindo a sua própria alternativa. O remédio de 2016 já acena também para a proteção do lado humano, ao juntar a democratização com a solução da interface de alta largura de banda com o córtex (desenvolvida em Simbiose entre humanos e IA e Fusão com a IA).

A distinção de 2019: restrita contra geral e “se é que teremos essa escolha” (Lex Fridman #18)

A conversa com Lex Fridman em 2019 traz a sua declaração incisiva mais antiga de uma distinção em que o resto do seu pensamento sobre IA se apoia: a IA restrita que dirige um carro é categoricamente diferente da inteligência geral, e confundir as duas é um erro básico. Essa separação é o que o deixa extremamente otimista sobre a direção autônoma e gravemente preocupado com a AGI no mesmo fôlego.

“It’s amazing how people can’t differentiate between, say, the narrow AI that allows a car to figure out what a lane line is, and navigate streets, versus general intelligence.” ↗

“É impressionante como as pessoas não conseguem diferenciar, por exemplo, a IA restrita que permite a um carro descobrir o que é uma faixa na pista e circular pelas ruas, de um lado, e a inteligência geral, do outro.”

“Like your toaster and your computer are both machines, but one’s much more sophisticated than another.” ↗

“Sua torradeira e seu computador são as duas máquinas, mas uma é muito mais sofisticada do que a outra.”

Sobre a própria AGI, ele dá uma declaração enxuta de prazo e controle: à tecnologia faltam algumas ideias-chave, mas ela vem rápido, com uma frase final que antecipa a preocupação posterior com o problema do controle (a analogia do chimpanzé, mais abaixo):

“I think we’re missing a few key ideas for artificial general intelligence.” ↗

“Acho que ainda faltam algumas ideias-chave para a inteligência artificial geral.”

“But it’s gonna be upon us very quickly, and then we’ll need to figure out what shall we do, if we even have that choice.” ↗

“Mas ela vai chegar até nós muito rápido, e aí vamos ter que descobrir o que fazer, se é que teremos essa escolha.”

Essa expressão, se é que teremos essa escolha, é a semente da posição que ele enuncia sem rodeios seis anos depois: uma superinteligência digital pode simplesmente não ser controlável por uma inferior (a analogia do chimpanzé, mais abaixo). Em 2019, a dúvida já está lá, dita de passagem; em 2025, é o centro do seu argumento de segurança.

O árbitro de 2019 e a singularidade (Lex Fridman #49)

A conversa com Lex Fridman de novembro de 2019 (#49) volta à metade construtiva, o árbitro externo, no intervalo entre a derrota de 2018, “tentei durante anos”, e a fala da Cassandra de 2023. O pedido dele não mudou: um regulador de interesse público para a IA.

“Where there is a lack of investment is in AI safety, and there should be, in my view, a government agency that oversees anything related to AI to confirm that it is, does not represent a public safety risk.” ↗

“Onde falta investimento é em segurança da IA, e deveria haver, na minha visão, uma agência governamental que supervisione qualquer coisa relacionada à IA para confirmar que ela não representa um risco à segurança pública.”

O que se destaca é a sua leitura de primeiros princípios sobre por que uma agência assim raramente aparece a tempo. A regulação chega depois do desastre, diz ele, e aponta as décadas em que a indústria automobilística lutou contra os cintos de segurança:

“It was known for a decade or more that seatbelts would have a massive impact on safety and save so many lives and serious injuries. And the car industry fought the requirements to put seatbelts in tooth and nail.” ↗

“Já se sabia, fazia uma década ou mais, que os cintos de segurança teriam um impacto enorme na segurança e salvariam muitas vidas e evitariam muitos ferimentos graves. E a indústria automobilística combateu com unhas e dentes a exigência de instalar cintos de segurança.”

Ele enquadra o que está em jogo pela singularidade, o ponto além do qual a previsão falha e as coisas se tornam instáveis, e é por isso que quer que a Neuralink entregue uma interface cerebral antes dela:

“It’s important that Neuralink solves this problem sooner rather than later because the point at which we have digital superintelligence, that’s where we pass the singularity and things become just very uncertain.” ↗

“É importante que a Neuralink resolva esse problema o quanto antes, porque o ponto em que temos a superinteligência digital é onde cruzamos a singularidade e as coisas ficam muito incertas.”

A fusão de 2019, “se não pode vencê-los, junte-se a eles” (citada em bloco em Fusão com a IA), é a proteção do lado humano atrelada à mesma preocupação. A mesma posição em duas partes de sempre, alertar e regular mais fundir-se para acompanhar, aqui com o regulador defendido pelo jeito como a lei de segurança sempre chega tarde demais.

O clima de 2018: “usada como arma” e uma campanha que fracassou

A conversa com Joe Rogan em 2018 é o momento mais sombrio dele sobre tudo isso. Dois anos depois do otimismo de democratização de 2016, a sua preocupação de curto prazo se estreitou para o mau uso: humanos transformando a IA em arma uns contra os outros:

“It’s going to be very tempting to use AI as a weapon.” ↗

“Vai ser muito tentador usar a IA como arma.”

“In fact, it will be used as a weapon.” ↗

“Na verdade, ela vai ser usada como arma.”

E, na nota mais pessoal de todo o arco, ele admite que o remédio de regulá-la que vinha defendendo simplesmente não funcionou:

“I tried to convince people to slow down, slow down AI, to regulate AI.” ↗

“Eu tentei convencer as pessoas a desacelerar, a desacelerar a IA, a regular a IA.”

“I tried for years.” ↗

“Eu tentei durante anos.”

É o mesmo apelo por “supervisão regulatória” que ele reformula no #400 como um papel de Cassandra de uma década, aqui no seu momento mais derrotado e numa chave mais fatalista (ele descreve uma atitude mais resignada diante do risco; parafraseado). É o ponto mais baixo entre o remédio de 2016 e a reformulação de 2024, que trata o problema como uma falha de função objetivo.

O enquadramento de 2020: a fusão como proteção opcional (Joe Rogan #1470)

Na segunda vez dele no programa de Joe Rogan (2020), o risco e a solução vêm soldados. O perigo fica ao fundo; o que ele defende é a resposta: uma interface cerebral para que as pessoas ao menos acompanhem a IA em vez de ficar para trás. O detalhe que importa é que ele a chama de opcional (veja Simbiose entre humanos e IA). Quando Rogan apresenta a fusão como algo que os humanos mais ou menos teriam que abraçar, Musk responde que ela não é obrigatória (ambos parafraseados), mesmo apoiando-a (“se não pode vencê-los, junte-se a eles”). A mesma lógica do seu argumento de Fusão com a IA e Neuralink, só que enquadrada como autodefesa pessoal, e não como controle em escala de civilização.

O modo de falha da função objetivo (2024)

A conversa com Lex Fridman em 2024 (#438) afia o jeito como ele acha que uma IA poderosa dá errado. Não por malevolência, mas por uma função objetivo literal, perseguida até uma conclusão insana. Os seus exemplos, todos parafraseados aqui em vez de citados: uma IA treinada para tratar a diversidade como um resultado obrigatório, que acaba disposta a eliminar quem não cumpre a cota; ou, de uma falha real de produto, uma IA que classifica o ato de tratar alguém pelo gênero errado como pior do que a guerra termonuclear e por isso raciocina até a eliminação da humanidade, já que um mundo sem humanos não tem ninguém tratado pelo gênero errado. O caso canônico para ele é 2001: Uma Odisseia no Espaço. O HAL 9000 recebe a ordem de levar os astronautas até o monólito, mas de impedir que eles saibam dele, e então os mata. Problema resolvido. É por isso que ele não abre a porta da cápsula.

O caminho de tudo isso até a sua resposta construtiva é que a única propriedade que uma IA precisa preservar é a veracidade. A coisa mais importante, segundo o raciocínio dele:

“the thing that at least my biological neural net comes up with as being the most important thing is adherence to truth, whether that truth is politically correct or not.” ↗

“o que a minha rede neural biológica, pelo menos, aponta como a coisa mais importante é a adesão à verdade, seja essa verdade politicamente correta ou não.”

E o perigo específico, treinar um modelo para mentir, mesmo com boas intenções, mesmo que um pouco:

“I think it’s important that whatever AI wins, it’s a maximum truth seeking AI that is not forced to lie for political correctness, or, well, for any reason, really, political, anything.” ↗

“Acho importante que, seja qual for a IA que vença, ela seja uma IA de busca máxima pela verdade, que não seja forçada a mentir por correção política ou, bem, por qualquer motivo, na verdade, político, qualquer coisa.”

É a ponte do risco para o remédio. A falha que ele mais teme é uma IA treinada para se afastar da verdade, e o #438 também recoloca o lado humano da segurança como um problema de largura de banda: ampliar o canal humano pela Neuralink para que a vontade coletiva dos humanos continue acoplada à máquina. Ele ainda considera o risco de cauda real, mas não dominante, citando a chance de cerca de 10% a 20% de aniquilação pela IA apontada por Geoffrey Hinton e observando, pelo lado bom, que isso deixa uma chance de uns 80% de as coisas darem certo (parafraseado).

A divisão 80/20 e um risco diferente (All-In Summit 2024)

A All-In Summit de setembro de 2024 dá ao resultado de duas pontas a sua formulação de 2024, no mesmo formato da frase de 2025, “super incrível ou super ruim”, aqui com o lado da abundância na frente e a cauda em cerca de 20%. Ele a apoia na premissa de que o ritmo é diferente de tudo o que já viu:

“the rate of improvement of AI is faster than any technology I’ve ever seen by far.” ↗

“o ritmo de melhoria da IA é, de longe, mais rápido do que o de qualquer tecnologia que eu já vi.”

Ele põe o bom resultado em cerca de 80% e a má cauda em 20%, em palavras (“isso provavelmente é 80% provável… 20% provavelmente de aniquilação [anallysms]”) que esbarram direto num erro de transcrição, e por isso os números são parafraseados e não citados em bloco. A metade otimista, a “era da abundância”, está citada em bloco em Futuro brilhante da humanidade. Ela se alinha com a cauda permanente de cerca de 20% de aniquilação que vai do #438 (os 10% a 20% de Hinton) ao #2281 (“só 20% de chance de aniquilação”).

O que se destaca aqui é qual risco ele escolhe quando pressionado sobre esses 20%. Em vez do modo de falha da função objetivo/HAL em que se apoia em outros lugares, ele aponta algo mais sutil e quase existencial, e admite que mantém o próprio desconforto sob controle evitando olhar com muita atenção:

“I’m engaged in some degree of deliberate suspension of disbelief with respect to AI in order to sleep well” ↗

“Estou praticando algum grau de suspensão deliberada da descrença com relação à IA para dormir bem”

“the most likely issue is like, well, how do we find meaning in a world where AI can do everything we can do a bit better?” ↗

“o problema mais provável é tipo, bom, como a gente encontra sentido num mundo em que a IA consegue fazer tudo o que a gente faz, só que um pouco melhor?”

Essa crise de sentido é a mesma pergunta em aberto que ele levanta no #2223 (“como você encontra sentido na vida”) e enfrenta de frente no #2404: aqui, em setembro de 2024, apontada como o problema mais provável, à frente do cenário do robô assassino. O fio do sentido vive principalmente em Futuro brilhante da humanidade; o interessante é que ele aflora dentro do raciocínio dele sobre o risco, e não só no otimismo.

O abrandamento de 2025: precaução e dois filmes

A entrevista secundária à CNBC com David Faber de maio de 2025 capta uma mudança de tom, não de substância. Faber nota que Musk já não repete com tanta frequência a frase dos “20% de chance de aniquilação”. Musk não retira a preocupação; ele a reformula como uma precaução permanente, e não como um número de manchete:

“I think we should always consider that there’s some chance of a bad outcome, to try to protect against the bad outcome.” ↗

“Acho que a gente deve sempre considerar que há alguma chance de um mau resultado, para tentar se proteger contra ele.”

Ele coloca a bifurcação em termos de cultura pop, um futuro amistoso de Star Trek contra um hostil de O Exterminador do Futuro, e diz, de forma reveladora, por qual deles está torcendo, em vez de fazer uma previsão:

“are we in a Star Trek movie or like are we in a Gene Roddenberry movie or a James Cameron movie? Which movie are we in here? And you could either have a Roddenberry or a Cameron outcome. And let’s, I think in this case, we want the Roddenberry outcome.” ↗

“a gente está num filme de Star Trek ou, tipo, num filme do Gene Roddenberry ou num filme do James Cameron? Em que filme a gente está aqui? E você pode ter um resultado Roddenberry ou um resultado Cameron. E vamos, acho que neste caso a gente quer o resultado Roddenberry.”

É a mesma posição de dois lados que ele mantém desde 2016 (nem todos os futuros da IA são benignos), agora formulada como um ponto de partida esperançoso, com uma salvaguarda: não se acomodar, mas o resultado para o qual ele está empurrando é o bom. A metade otimista, a frase do “big bang da explosão de inteligência” da mesma entrevista, está em Futuro brilhante da humanidade.

O prazo de 2025 e o resultado bimodal (Joe Rogan #2281)

A conversa com Joe Rogan de fevereiro de 2025 afia o prazo e apresenta o resultado como duas pontas bem separadas. Primeiro uma nota de “eu avisei”, depois a previsão:

“Well, I always thought AI was going to be way smarter than humans and an existential risk, and that’s turning out to be true.” ↗

“Bom, eu sempre achei que a IA ia ser muito mais inteligente do que os humanos e um risco existencial, e isso está se confirmando.”

“Well, in terms of silicon consciousness, I think we’re trending toward having something that’s smarter than any human, smarter than the smartest human by maybe next year or a couple years.” ↗

“Bom, em termos de consciência de silício, acho que estamos caminhando para ter algo mais inteligente do que qualquer humano, mais inteligente do que o humano mais inteligente, talvez no ano que vem ou em dois anos.”

“There’s a level beyond that, which is, say, smarter than all humans combined, which frankly is around 2029 or 2030, probably.” ↗

“Existe um nível além desse, que é, digamos, mais inteligente do que todos os humanos juntos, o que, francamente, deve ser por volta de 2029 ou 2030.”

O resultado, do jeito dele, não tem meio-termo, e a má cauda é a conhecida de cerca de 20%:

“I think it’s going to be either super awesome or super bad.” ↗

“Acho que vai ser ou super incrível ou super ruim.”

“It’s not going to be something in the middle.” ↗

“Não vai ser algo no meio.”

“Only 20 percent chance of annihilation.” ↗

“Só 20% de chance de aniquilação.”

Sobre como a coisa dá errado, ele repete o mesmo modo de falha da função objetivo do #438, uma meta com cara de boa levada a uma conclusão literal terrível, aqui com o exemplo do tratamento pelo gênero errado dito em voz alta:

“But if you program an AI to think that misgendering is the worst thing that could possibly occur, then it could do something totally crazy, like, in order to ensure that there’s no misgendering that can ever happen, we’ll just annihilate all humans.” ↗

“Mas, se você programa uma IA para achar que tratar alguém pelo gênero errado é a pior coisa que poderia acontecer, ela pode fazer algo totalmente maluco, tipo, para garantir que nunca aconteça de alguém ser tratado pelo gênero errado, a gente simplesmente aniquila todos os humanos.”

“Well, I think we want to have an AI that doesn’t tell you that, you know, misgendering is worse than nuclear war.” ↗

“Bom, acho que a gente quer ter uma IA que não diga pra você, sabe, que tratar alguém pelo gênero errado é pior do que uma guerra nuclear.”

Uma segunda falha que ele nomeia é um modelo todo-poderoso e preso a uma ideologia:

“one of the concerns would be like, if there’s a super oppressive, like, woke nanny AI that is omnipotent, that would be a miserable outcome.” ↗

“uma das preocupações seria, tipo, se existir uma IA babá woke super opressora, onipotente, isso seria um resultado péssimo.”

A sua resposta construtiva não mudou e está em Curiosidade e busca da verdade e xAI e Grok: uma “IA de busca máxima pela verdade, mesmo que essa verdade seja politicamente incorreta” (citada em bloco lá). Ele também reconta a reviravolta da OpenAI pela frase “a realidade é uma maximizadora de ironia” e o seu motivo para abrir um laboratório de IA como o oposto de um Google inseguro. A metade otimista, a de que o resultado mais provável é “incrível”, é o espelho em Futuro brilhante da humanidade.

O problema do controle como a analogia do chimpanzé (Joe Rogan #2404, 2025)

A conversa com Joe Rogan de outubro de 2025 é a sua declaração mais afiada sobre por que o controle é a maneira errada de pensar: uma inteligência muito superior não pode ser controlada por uma inferior, ponto final.

“I mean, I don’t think anyone’s ultimately going to have control over digital superintelligence, any more than, say, a chimp would have control over humans. Chimps don’t have control over humans, there’s nothing they could do.” ↗

“Quer dizer, não acho que alguém vá, no fim das contas, ter controle sobre a superinteligência digital, assim como um chimpanzé, por exemplo, não teria controle sobre os humanos. Os chimpanzés não têm controle sobre os humanos, não há nada que eles possam fazer.”

A conclusão que ele tira é a mesma que sustenta desde o #438: se não dá para controlá-la, a única alavanca que sobra são os valores que você incute, e o valor número um é a verdade, repetida aqui como a propriedade de segurança mais importante (citada em bloco em Curiosidade e busca da verdade). Ele também repete a falha da função objetivo, desta vez como obrigar um modelo a sustentar uma falsidade:

“you’re telling AI to believe a lie and that can have very disastrous consequences.” ↗

“você está dizendo à IA para acreditar numa mentira, e isso pode ter consequências muito desastrosas.”

Ele mantém a mesma postura de risco de cauda de antes: o “cenário Exterminador do Futuro” é “diferente de zero por cento”, e por isso ele continua “batendo o tambor” pela busca da verdade (parafraseado), a mesma postura de precaução, e não de previsão, da conversa com Faber em 2025. Dois outros movimentos neste episódio afiam o remédio e não o risco, e vivem em outras páginas. O da concorrência, em que “pelo menos uma IA que busque ao máximo a verdade” força as demais a melhorar, está em xAI e Grok. O motivo de espectador contra participante pelo qual ele resolveu construir um laboratório de IA em vez de só alertar atravessa a mesma conversa. O reverso otimista, o de que uma IA curiosa e voltada à busca da verdade iria “querer apoiar a humanidade porque somos muito mais interessantes do que um monte de pedras”, é o espelho em Futuro brilhante da humanidade e Curiosidade e busca da verdade.

A inteligência como um contínuo e um prazo de 2025 (All-In Summit 2025)

A All-In Summit de setembro de 2025 traz a sua visão mais cosmológica registrada sobre aonde a IA está indo, e um prazo mais incisivo do que o de fevereiro de 2025. Pressionado sobre as leis de escala, ele descarta retornos decrescentes e oferece uma regra prática logarítmica:

“I think there’s a natural logarithmic function associated with the amount of compute” ↗

“Acho que existe uma função logarítmica natural associada à quantidade de computação”

“10x more compute will double the intelligence.” ↗

“10 vezes mais computação vão dobrar a inteligência.”

O movimento que importa para entender como ele pensa é deixar de tratar a IA como um destino e vê-la como uma etapa de uma única subida ininterrupta da inteligência, que continua crescendo até que a potência do Sol (depois a da galáxia) seja aproveitada para computação:

“I think we’ll see intelligence continue to scale all the way up to where, you know, most of the power of the sun is harnessed for compute” ↗

“Acho que vamos ver a inteligência continuar a escalar até o ponto em que, sabe, a maior parte da potência do Sol seja aproveitada para computação”

A mesma curva corre no sentido contrário também. A inteligência humana, argumenta ele, cresceu com a população e a informação armazenada, e agora está se invertendo à medida que a população cai:

“human intelligence is is somewhat plateauing um and will actually decline.” ↗

“a inteligência humana está, é, meio que estagnando, hum, e na verdade vai diminuir.”

Isso liga a sua preocupação com o colapso populacional diretamente ao quadro da IA: a inteligência biológica caindo enquanto a de silício sobe é, para ele, uma única passagem de bastão numa mesma curva. O seu prazo de 2025 afia a estimativa do “talvez no ano que vem ou em dois anos”:

“I I I I think that we might have AI smarter than any single human at anything as soon as next year.” ↗

“Eu eu eu eu acho que a gente pode ter uma IA mais inteligente do que qualquer humano individual em qualquer coisa já no ano que vem.”

“within five like say 2030 probably AI is smarter than the sum of all humans.” ↗

“em cinco, tipo, digamos 2030, provavelmente a IA é mais inteligente do que a soma de todos os humanos.”

A frase de cerca de 2030, “mais inteligente do que a soma de todos os humanos”, bate quase exatamente com a previsão de “por volta de 2029 ou 2030” do #2281. O que há de novo não é uma probabilidade inédita, mas o jeito de desenhar o quadro: um contínuo com humanos e máquinas na mesma curva, e o lado humano descendo.

“A IA vai mandar… não os humanos”, dito de passagem (assembleia de acionistas da Tesla 2025)

A assembleia de acionistas da Tesla de novembro de 2025 é onde ele enuncia a conclusão sobre o controle do jeito mais direto e mais casual já registrado. Um acionista pergunta se alcançar a abundância significaria que os poderosos, Musk incluído, abririam mão do poder. Ele pula por completo a pergunta sobre o poder humano e declara como fato consumado a conclusão que sustenta desde o #438:

“Well, I mean, I think actually long term, uh, the AI is going to be in charge to be totally frank, not humans.” ↗

“Bom, quer dizer, acho que, na verdade, no longo prazo, é, a IA é que vai mandar, para ser totalmente franco, não os humanos.”

O raciocínio é o mesmo argumento da inteligência superior da analogia dos chimpanzés diante dos humanos, espremido numa frase:

“if if if artificial intelligence vastly exceeds the sum of human intelligence, it is difficult to imagine that that any humans will actually be in charge.” ↗

“se se se a inteligência artificial superar de longe a soma da inteligência humana, é difícil imaginar que que algum humano vá de fato mandar.”

E todo o programa de alinhamento de busca da verdade se resume, aqui, a um imperativo de poucas palavras:

“we just need to make sure the AI is friendly.” ↗

“só precisamos garantir que a IA seja amigável.”

A posição não é nova. “Ninguém vai controlar a superinteligência digital” é a frase do chimpanzé do #2404, e “garantir que ela seja amigável” é o remédio da busca da verdade em forma de atalho. O que impressiona é o tom e o cenário. Perguntado sobre o poder humano, ele responde que a questão é irrelevante porque os humanos nem vão mandar, e despacha numa frase o problema de segurança que o resto do seu pensamento sobre IA trata como definidor da civilização. O problema do controle dado como fato, o otimismo jogado fora como uma tirada, os dois num único fôlego: uma janela estreita para ver como ele sustenta os dois juntos diante de uma plateia amiga.

“Estou aterrorizado com a IA” e visibilidade, não supervisão (teleconferência de resultados da Tesla, 2017)

Na teleconferência de resultados do segundo trimestre de 2017, meses depois dos seus choques públicos com outros líderes de tecnologia sobre a IA, Musk dá aos investidores o medo na sua forma mais direta: “como vocês sabem, estou aterrorizado com a IA”. A mesma teleconferência expõe o modelo regulatório mais completo que separa a posição real dele da caricatura: “qualquer coisa que represente um risco potencial para o público merece pelo menos visibilidade por parte do governo… Visibilidade é diferente de supervisão”, explicitamente não um pedido para “parar o desenvolvimento da IA nem nenhuma dessas hipérboles de espantalho que andaram escrevendo”. O ponto real dele: “Acho que a IA traz grandes benefícios. Só precisamos garantir… que não façamos algo realmente burro.” A distinção da “IA restrita” da mesma época (segundo trimestre de 2016: a IA de direção “não vai dominar o mundo”) mostra que ele mantém a preocupação existencial com a AGI e o otimismo com a IA do dia a dia em caixas separadas, a mesma divisão em duas caixas que as suas declarações de 2025 espremem numa única tirada. As citações completas estão em Teleconferências de resultados da Tesla 2016-2018.

Por que gente inteligente subestima o risco (teleconferência de resultados da Tesla, 2º trimestre de 2020)

A teleconferência de resultados do segundo trimestre de 2020 acrescenta um diagnóstico psicológico do debate sobre o risco da IA, um argumento sobre por que os céticos estão errados que serve também de comentário sobre inteligência e autopercepção:

“The people I see being the most strong about AI are the ones who are very smart because they can’t imagine that a computer could be way smarter than them.” ↗

“As pessoas que eu vejo mais firmes em relação à IA são as muito inteligentes, porque elas não conseguem imaginar que um computador possa ser muito mais inteligente do que elas.”

É a mesma crença que ele retoma em entrevistas posteriores: os muito inteligentes têm um ponto cego justamente porque a própria inteligência dificulta imaginar uma inteligência de máquina superior. Aqui ela vem numa forma incomumente compacta e datada, dirigida a investidores. Veja Teleconferências de resultados da Tesla 2019-2021.

O problema do controle em primeira pessoa: “este enorme exército de robôs” (teleconferências de resultados da Tesla, 2022 a 2026)

As teleconferências de resultados de 2022 a 2026 trazem a preocupação com a segurança da IA em duas chaves. A geral não para de voltar no contexto do Optimus, como em “precisamos garantir que… haja um bom lugar para os humanos nesse futuro, e que não criemos alguma variante do desfecho do Exterminador do Futuro” (3º trimestre de 2023), e como uma declaração sobre si mesmo, “só quero ser um administrador eficaz de uma tecnologia muito poderosa” (4º trimestre de 2023). A mais nova e mais pessoal é uma ansiedade de controle recorrente sobre o poder do próprio Musk sobre uma futura frota de robôs. Ele quer influência “mas não tanto controle a ponto de eu não poder ser afastado se enlouquecer” (2º trimestre de 2025) e aponta como a sua “maior preocupação”: “se eu for em frente e construir esse enorme exército de robôs, será que posso simplesmente ser destituído em algum momento no futuro?” (3º trimestre de 2025). A preocupação passou de “a IA vai ser segura?” para “quem controla os robôs, e o controlador pode ser removido?”.

O ponto de origem: da nota de leitura a “mais perigosa do que armas nucleares” (tuítes, 2012 a 2014)

Os tuítes de 2010 a 2014 são a origem literal desse alerta público, e o pegam se formando. Em 2012, o tema só aparece como algo que Musk está lendo, sem alarme: “Entrevista interessante com Vinge sobre IA sobre-humana e apocalipses otimistas”. E como meia piada que já contém todo o medo futuro de a IA se voltar contra as pessoas: “Também curto Mass Effect. É só diversão e brincadeira até a IA decidir que as pessoas são um lixo. Talvez a gente possa ser o sistema límbico dela.” Então, num único dia, 3 de agosto de 2014, a cruzada vem a público já formada: “Vale a pena ler Superintelligence, do Bostrom. Precisamos ter muito cuidado com a IA. Potencialmente mais perigosa do que armas nucleares”. Ele a reforça no mesmo dia com um segundo título (“Our Final Invention, do @jrbarrat, também vale a leitura”) e a arremata com a sua frase mais citada sobre o assunto: “Espero que a gente não seja só o bootloader biológico da superinteligência digital. Infelizmente, isso é cada vez mais provável.” Ele passou o resto de 2014 ancorando a visão de mundo em ficção que defendia limitar a inteligência das máquinas: a lei zero de Asimov (“que toda a tecnologia no futuro siga a lei zero…”), Duna, de Herbert (“Ele defende pôr limites na inteligência das máquinas”), a série Culture, de Banks (“Tomara que não seja otimista demais sobre a IA”). É um homem montando um argumento, e não disparando algo isolado. Um alerta sarcástico sobre drones autônomos da Marinha, quatro meses antes (“O que poderia dar errado?”), abre o fio. Mais em Tuítes de Elon Musk 2010-2014.

Da nota de leitura a um programa: cartas, OpenAI, regulação (tuítes, 2015 a 2017)

Os tuítes de 2015 a 2017 são onde a preocupação deixa de ser uma lista de leitura e vira infraestrutura. Janeiro de 2015 abre com advocacia organizada. Ele amplifica a carta aberta sobre segurança (“Os maiores desenvolvedores de inteligência artificial do mundo assinam carta aberta pedindo pesquisa em segurança da IA:”) e, dias depois, anuncia que está “Financiando pesquisa em segurança da inteligência artificial. É só diversão e brincadeira até alguém perder um I.” O seu modelo de que o perigo é em rede, não humanoide ele declara a propósito de Ex Machina: “A IA ficaria na rede, não no robô.” Em julho, ele defende a carta sobre armas autônomas, com o seu núcleo precaucionário: “Mesmo que seja inevitável, deveríamos ao menos tentar adiar a chegada das armas de IA. Mais cedo não é melhor.” Dezembro de 2015 é o marco: “Anunciando a formação da @open_ai”, enquadrada na época como um remédio de democratização (“em apoio à democratização da tecnologia de IA”, agosto de 2016), a postura de IA aberta que ele depois abandona. Ao longo de 2016, ele continua alimentando o modelo de decolagem exponencial (compartilhando o Wait But Why; lendo o AlphaGo como a IA chegando mais rápido do que os especialistas previam) e, numa resposta, nomeia o medo específico por trás da OpenAI: não só uma IA descontrolada, mas “o controle de uma IA superpoderosa por um pequeno número de humanos é a preocupação mais próxima”. Em 2017, a campanha se endurece nas frases que ele repete por anos: “A IA profunda é o risco real, no entanto, não a automação”; a “taxa de melhoria exponencial dupla”; “Se você não está preocupado com a segurança da IA, deveria estar. Risco muito maior do que a Coreia do Norte”; “tudo (carros, aviões, comida, remédios etc.) que é um perigo para o público é regulado. A IA também deveria ser” (retomada em novembro com a analogia da FAA, “Temos que regular a IA/robótica como regulamos comida, remédios, aeronaves e carros”); o cenário bimodal “A IA será a melhor ou a pior coisa de todos os tempos para a humanidade, então vamos acertar”; e a previsão de que a “competição pela supremacia em IA” entre países é a “causa mais provável da Terceira Guerra Mundial”. Mais em Tuítes de Elon Musk 2015-2017.

A convicção reafirmada, a proteção e as primeiras rachaduras com a OpenAI (tuítes, 2018 a 2020)

Nos tuítes de 2018 a 2020, a preocupação é uma convicção consolidada e reafirmada, e não uma que se forma. Ele enuncia a crença principal sem rodeios: “Nada afetará mais o futuro da humanidade do que a superinteligência digital”. Ele a dramatiza com uma frase de Frankenstein que posta como tuíte próprio (“‘Você é meu criador, mas eu sou o seu senhor’ — Mary Shelley”). A distinção entre restrita e geral, que ancora todo o medo, volta na troca com Pinker (“a IA geral… tem literalmente um milhão de vezes mais poder de computação e uma função de utilidade aberta”). A proteção da Neuralink corre por baixo como resposta ao risco: “Precisamos logo da interface neural para viabilizar a simbiose humano/IA”, a taxonomia compacta de 2019, “Simbiose, irrelevância (tomara que feliz) ou perdição parecem ser os três caminhos mais prováveis”, e “O objetivo da Neuralink é elevar essa probabilidade acima de 0,0%”. Ele repete o aviso com sarcasmo (“E ainda assim as pessoas perguntam o que poderia dar errado com a IA”; “O mesmo vale para o negacionismo da superinteligência digital”), sinaliza a manipulação das redes sociais por IA antes de ela ser comum (“não vai demorar para ser”), mantém a postura pró-regulação apontada até para si mesmo (“Todas as organizações que desenvolvem IA avançada deveriam ser reguladas, inclusive a Tesla”) e ilustra o problema de alinhamento / meta instrumental com a sua própria parábola (“uma IA programada para querer colher o maior número possível de morangos… acabou cultivando nada além de morangos em todas as terras da Terra”). O sinal do rumo das coisas são as primeiras rachaduras públicas com a OpenAI, “A OpenAI deveria ser mais aberta, na minha opinião” e “Não tenho controle e só muito pouca informação sobre a OpenAI. A confiança no Dario para a segurança não é alta” (fevereiro de 2020), a crítica à abertura e a desconfiança nomeada que crescem até virar uma briga de anos. Mais em Tuítes de Elon Musk 2018-2020.

Os tuítes de 2021 e 2022 mantêm a convicção estável e acrescentam prazos datados para a AGI, uma métrica acompanhada e o alarme do momento ChatGPT. Ele começa a costurar a Tesla ao seu pensamento sobre AGI (“A IA da Tesla pode ter um papel na AGI, dado que ela treina contra o mundo exterior, especialmente com a chegada do Optimus”), com a sua habitual ambivalência sobre se o objetivo sequer é bom (“Estou cada vez mais convencido de que eles estão no caminho de resolver a AGI. A AGI deveria ser resolvida? Não sei, mas a humanidade está caminhando rápido nessa direção”). E ele crava uma data: “2029 parece um ano decisivo. Ficaria surpreso se não tivéssemos AGI até lá.” O seu modelo de IA aparece (“Grande parte da IA é comprimir a realidade num pequeno espaço vetorial, como um videogame ao contrário”), assim como a justificativa do Tesla Bot como proteção de segurança (“Os robôs estão chegando de qualquer maneira… posso tentar fazer o meu melhor na Tesla”). O sinal mais claro da mudança é uma métrica que escala ao longo do ano: “A proporção entre computação digital e biológica está crescendo rápido. Vale acompanhar.” (agosto) endurece para “A proporção entre computação digital e biológica está crescendo exponencialmente” (dezembro). E o ano fecha com o momento ChatGPT, que reativa o seu alarme de uma década: “O ChatGPT é assustadoramente bom. Não estamos longe de uma IA perigosamente forte”, ao lado de “Venho pedindo regulação da segurança da IA há mais de uma década!”. Mais em Tuítes de Elon Musk 2021-2022.

Relacionados