Musk Wiki

Direção autônoma

PróximaEficiência governamental

Qual é a visão de Elon Musk para os carros autônomos?

Carros que dirigem como as pessoas, só com câmeras e redes neurais, porque as ruas foram feitas para os olhos. Ele chama o LiDAR de “missão de tolo”. Ele promete duas vantagens: uma autonomia dez vezes mais segura que um motorista humano e carros que ganham dinheiro em uma frota compartilhada de robotáxis. Já os prazos que deu para a direção totalmente autônoma escorregaram ano após ano.

Musk apresentou pela primeira vez, de forma oficial, o seu argumento a favor da autonomia no plano mestre de 2016, e ele se apoia em duas pernas. Uma é um argumento de segurança com número: a direção autônoma pode ser uma ordem de grandeza mais segura do que um humano, e os dados em escala de frota vão provar isso. A outra é econômica: um carro autônomo pode ser compartilhado, o que transforma um bem que se desvaloriza num bem que gera renda. Em 2025, toda a visão já tinha sido absorvida pela aposta mais ampla na IA física da Abundância sustentável. E, na entrevista à CNBC de maio de 2025, ela finalmente virou um lançamento concreto de robotáxis, com data marcada.

Os dois pilares

  1. Segurança por meio de dados. A autonomia não é um gadget; é uma forma de salvar vidas, e o argumento é puramente estatístico. Prove com bilhões de milhas rodadas pela frota antes de chamar de segura.
  2. Frotas compartilhadas. Essa mesma autonomia permite que os donos aluguem seus carros para uma rede, o que Musk chama de “exatamente o motivo” de o sistema de direção autônoma estar sendo construído. O robotáxi nasce direto daí.

O plano de 2016 é incomumente honesto num ponto: hardware “pronto para direção autônoma” não é a mesma coisa que software “capaz de direção autônoma”, e boa parte desse software ainda não está resolvida. Esse tipo de ressalva é raro num documento que, de resto, é supremamente confiante. A frase que diz isso está citada abaixo.

Evidências

A meta de segurança quantificada:

“We are currently developing the technology to enable self-driving cars that can be 10x safer than manually driven cars.” ↗

“Estamos desenvolvendo a tecnologia que permitirá carros autônomos 10 vezes mais seguros do que carros dirigidos manualmente.”

O propósito declarado de construir a autonomia, as frotas compartilhadas:

“Let me emphasize this point: autonomous cars can be shared. We believe that owners of Tesla vehicles will be empowered with the option to share their car with a network of other drivers, thus significantly offsetting the monthly loan or lease cost. This is exactly why we’re building the self-driving system.” ↗

“Deixe-me enfatizar este ponto: carros autônomos podem ser compartilhados. Acreditamos que os donos de veículos Tesla poderão escolher compartilhar o carro com uma rede de outros motoristas, o que reduz bastante a parcela mensal do financiamento ou do aluguel. É exatamente por isso que estamos construindo o sistema de direção autônoma.”

A ressalva honesta sobre quanto ainda está por resolver:

“It is important to note that self-driving ready hardware does not mean that the car is self-driving capable. The software required to make the car fully self-driving is complex.” ↗

“É importante observar que hardware pronto para direção autônoma não significa que o carro seja capaz de dirigir sozinho. O software necessário para tornar o carro totalmente autônomo é complexo.”

O enquadramento de 2025 da autonomia como benefício para todos:

“Autonomous vehicles have the capacity to dramatically improve the affordability, availability and safety of transportation while reducing pollution, particularly in our increasingly dense global cities.” ↗

“Os veículos autônomos têm capacidade de melhorar drasticamente o preço acessível, a disponibilidade e a segurança do transporte e, ao mesmo tempo, reduzir a poluição, principalmente nas cidades do mundo todo, cada vez mais densas.”

2014–2015 — o Autopilot chega e o prazo começa a se afinar (teleconferências de resultados da Tesla)

As previsões mais antigas dele sobre autonomia, com data, são faladas, e não escritas: as teleconferências de resultados da Tesla de 2014 e 2015, em que o Autopilot aparece como produto e Musk se compromete pela primeira vez, em público, com um prazo de autonomia total. Depois, trimestre a trimestre, dá para ver o prazo se apertando. A primeira teleconferência, a do 3º trimestre de 2014, é cautelosa e cheia de ressalvas quanto aos reguladores:

“it’s probably no sooner than 7 years from now and could be up to 10, I think.” ↗

“provavelmente não antes de 7 anos a partir de agora, e podendo chegar a 10, eu acho.”

Ele junta essa cautela à plena confiança de que a Tesla vai liderar a corrida (“é bem provável que a Tesla seja a líder na fabricação de carros assim”). No 2º trimestre de 2015, com o Autopilot prestes a ser lançado, aparecem duas convicções de projeto. Uma é a aposta em ter o próprio conjunto de dados (“não temos muita escolha a não ser criar o nosso próprio conjunto de dados de direção”). A outra é a analogia com a aviação, que ele usa para pôr a responsabilidade no motorista no lançamento, uma visão que ele revê de forma radical nos anos seguintes:

“it’s much like the Autopilot in a plane where you turn the Autopilot on in a plane, but there’s still an expectation that the pilot will pay attention to what the plane is doing, and, you know, won’t sort of go to sleep or just disappear from the cockpit.” ↗

“é muito parecido com o piloto automático de um avião: você liga o piloto automático no avião, mas continua havendo a expectativa de que o piloto preste atenção no que o avião está fazendo e, sabe, não vá dormir nem simplesmente sumir da cabine.”

No 3º trimestre de 2015, ele reafirma o prazo para a indústria inteira, e agora a convicção é total. Um carro sem autonomia passa a ser “como ter um cavalo”, a mesma imagem a que ele recorre quatro anos depois no Lex #18:

“I think it will be quite unusual to see cars that don’t have full autonomy, let’s say, in for new car production in the 15 to 20 year time frame. And for Tesla, it will be a lot sooner than that.” ↗

“Acho que vai ser bem incomum ver carros sem autonomia total, digamos, na produção de carros novos num horizonte de 15 a 20 anos. E, para a Tesla, vai ser bem antes disso.”

“any cars that are being made that don’t have full autonomy full autonomy will have negative value. It will be like owning a horse.” ↗

“qualquer carro que esteja sendo fabricado sem autonomia total vai ter valor negativo. Vai ser como ter um cavalo.”

Assim, o fio da autonomia nasce aqui, em voz alta. O hábito das previsões com data, a metáfora do “cavalo”, a estratégia de ser dono de toda a pilha tecnológica: tudo isso já está no lugar dois e três anos antes das reafirmações de 2017 e 2019 que vêm depois. As teleconferências de 2014 não trazem identificação de falante; a do 2º trimestre de 2015 identifica Musk de forma explícita. Mais sobre ambas em Teleconferências de resultados da Tesla 2013-2015.

2016–2018 — o prazo chega ao auge e depois escorrega: de costa a costa e o fosso de dados (teleconferências de resultados da Tesla)

As teleconferências de resultados de 2016 a 2018 são o trecho mais passível de refutação de todo o fio. O otimismo chega ao auge e depois recua, trimestre após trimestre, no mesmo registro datado. Abre em 2016 com puro otimismo de prazo (“a autonomia total vai chegar muito mais rápido do que qualquer um pensa”, 2º trimestre de 2016) e com o enquadramento moral que ele mantém por anos (“seria… moralmente errado não permitir a direção autônoma”, 3º trimestre de 2016). O 1º trimestre de 2017 traz a afirmação mais agressiva do registro: o hardware “para pelo menos o Nível 4, o atual Nível 5 de autonomia, está em todos os Teslas”, então “é uma questão de atualizar o software e podemos alcançar o Nível 5.”

Aí vem o prazo da demonstração de costa a costa e o seu colapso em câmera lenta. Cada data nova chega embrulhada em humor autoirônico: “posso acabar com cara de bobo nesse ponto” (2º trimestre de 2017), depois “três meses, seis meses no máximo” (4º trimestre de 2017), depois a admissão de que fazer isso numa rota fixa “seria meio que burlar o sistema” (2º trimestre de 2018). A teleconferência do 4º trimestre de 2017 é também onde a crença contra o lidar aparece pela primeira vez numa teleconferência de resultados. O lidar é “uma muleta que vai levar as empresas a um máximo local”, e a visão é o caminho para “o máximo global”, dois anos antes da versão de 2019, da “missão de tolo”. A mesma teleconferência recorre ao AlphaGo para explicar por que ele espera um progresso exponencial repentino e chega à sua marca registrada, a dúvida seguida da convicção: “talvez eu esteja errado… tenho bastante certeza de que não estou”. Em 2018, o argumento sai da tecnologia e vai para o fosso. A Tesla tem “milhões de carros em campo com capacidade de autonomia total”, os rivais têm “5%… das milhas que a Tesla tem”, e a única coisa que resta no caminho é a “aprovação regulatória”. Depois ele volta bem ao ponto de partida, “até o fim deste ano” (4º trimestre de 2018), um encerramento quase perfeito do otimismo com que tudo começou. Dez das doze transcrições identificam Musk; as do 3º trimestre de 2017 e do 2º trimestre de 2018 não. Veja Teleconferências de resultados da Tesla 2016-2018.

2019–2021 — a mesma previsão, todo trimestre, sem nunca se resolver (teleconferências de resultados da Tesla)

Ao longo das teleconferências de resultados de 2019 a 2021, a previsão de autonomia faz o que faz de melhor nesse meio. Volta quase todo trimestre e nunca se resolve. 2019 abre com o esqueleto da ideia: um relato em três níveis do que “funcionalidade completa” realmente quer dizer (“achamos que o carro é seguro o bastante para ser dirigido sem supervisão… Aí o 3º nível seria os reguladores também ficarem convencidos”, 3º trimestre de 2019). Ao lado disso, o valor é vendido como “de longe, o maior salto de valor de um ativo da história” (3º trimestre de 2019). Depois a data é repetida no auge da confiança, quase todo trimestre. O carro vai dirigir “da sua casa até o seu trabalho… sem nenhuma intervenção até o fim do ano” (1º trimestre de 2020); “estou muito confiante de que o [carro] vai dirigir sozinho, com responsabilidade superior à dos humanos, este ano” (4º trimestre de 2020); “estou muito confiante de que vamos conseguir” (1º trimestre de 2021).

A teleconferência do 4º trimestre de 2021 traz as frases mais fortes de todo o registro: “meu palpite pessoal é que vamos alcançar a Direção Totalmente Autônoma este ano” e “eu ficaria chocado se não alcançássemos a Direção Totalmente Autônoma mais segura do que um humano este ano. Eu ficaria chocado.” O raciocínio se afia junto com a data, mas o otimismo nunca se dobra. A direção autônoma vira “uma parte bem significativa da inteligência artificial, especificamente da inteligência artificial do mundo real” (1º trimestre de 2021). Ele diz que “ser mais seguro do que um humano é um padrão baixo, não alto”, porque as pessoas são “muito, muito falhas” (4º trimestre de 2021). A inversão do ascensorista chega completa: “A autonomia vai ficar tão segura que será inseguro operar o carro manualmente” (2º trimestre de 2021), com a aposta de longo prazo de que “todo o transporte vai ser autônomo” (3º trimestre de 2020). E a alavanca do valor é levada ao limite: “uma das coisas mais valiosas já feitas na história da civilização” (2º trimestre de 2021), “o maior aumento de valor de ativo de qualquer classe de ativos da história” (4º trimestre de 2021). Esse trecho é a demonstração mais limpa de que o prazo da autonomia é uma postura recorrente de confiança, e não uma estimativa que converge. A explicação do próprio Musk para isso está na mesma teleconferência do 1º trimestre de 2020, no autorretrato do 50º percentil. Alguns trimestres identificam Musk; as teleconferências de 2019 e do 2º trimestre de 2021 têm poucos rótulos, e Musk é reconhecido pela abertura e pelo lugar nas perguntas e respostas. Veja Teleconferências de resultados da Tesla 2019-2021.

2017 — “em cerca de 10 anos” e o elevador (Cúpula Mundial de Governos)

Dois meses antes do TED2017, a conversa na Cúpula Mundial de Governos de fevereiro de 2017 começa não pela segurança nem pela visão, mas por uma previsão de prazo. A previsão dele:

“it will be very unusual for cars to be built that are not fully autonomous.” ↗

“vai ser muito incomum fabricar carros que não sejam totalmente autônomos.”

Ele põe o horizonte em “cerca de 10 anos” e recorre à mesma imagem que usa com o Lex em 2019. Entrar num carro vira entrar num elevador, e o ascensorista já é coisa do passado há muito tempo:

“So, getting in a car will be like getting in an elevator.” ↗

“Então, entrar num carro vai ser como entrar num elevador.”

Por trás está a distinção entre IA estreita e IA geral em que o resto do pensamento dele sobre IA se apoia. A autonomia veicular é “IA estreita … tentando de forma restrita cumprir uma certa função”, uma categoria totalmente diferente da IA “profunda” sobre a qual ele alerta (parafraseado; a distinção atravessa várias falas). Em 2017, ele ainda vende a autonomia como uma conveniência de curto prazo, “níveis extremos de segurança”, elevadores “tidos como garantidos”, e ainda não como a cruzada pela segurança em que a frase da “máquina da morte de duas toneladas” de 2019 a transforma. Mas a previsão de prazo e o elevador já estão aqui, dois anos antes do #18 e oito antes da data dos robotáxis de 2025. Veja World Government Summit 2017.

2017 — só visão, e a autonomia piora o trânsito (TED)

A conversa no TED de 2017 é a declaração falada mais antiga dele da tese de câmera em primeiro lugar, oito anos antes de a frase de 2025, “o sistema viário é projetado para a IA”, dizer a mesma coisa. O argumento é biológico. A estrada é construída para ser lida com os olhos, então o sensor de máquina equivalente é uma câmera, e o problema inteiro se reduz à visão:

“This is just using passive optical, which is essentially what a person uses.” ↗

“Isso é só usar óptica passiva, que é essencialmente o que uma pessoa usa.”

“and so once you solve cameras or vision, then autonomy is solved. If you don’t solve vision, it’s not solved.” ↗

“e aí, quando você resolve as câmeras ou a visão, a autonomia está resolvida. Se você não resolve a visão, não está resolvida.”

“You can absolutely be superhuman with just cameras.” ↗

“Dá, sim, para ser sobre-humano só com câmeras.”

É o diagnóstico do espaço vetorial de 2019 (“a coisa mais difícil é ter uma representação precisa … no espaço vetorial”) dois anos antes e em forma de semente, com toda a dificuldade posta na percepção a partir da visão. Aqui ele a enuncia como uma redução seca: resolva a visão e a autonomia vem junto.

O modelo de segurança dele é o probabilístico que usa em toda parte. Não existe uma linha de base de risco zero, só uma taxa de acidentes humanos a superar:

“The thing to appreciate about vehicle safety is this is probabilistic.” ↗

“O que é preciso entender sobre a segurança dos veículos é que ela é probabilística.”

“So really the key threshold for autonomy is how much better does autonomy need to be than a person before you can rely on it?” ↗

“Então, o limiar fundamental para a autonomia é: quanto melhor do que uma pessoa ela precisa ser para que você possa confiar nela?”

E a frota de autonomia compartilhada, a semente do robotáxi que viria depois, é dada como certeza, com só o prazo em aberto:

“That’s 100 percent what will occur. It’s just a question of when.” ↗

“Isso é 100% o que vai acontecer. É só uma questão de quando.”

A autonomia piora o trânsito — a reviravolta da demanda induzida

O movimento mais característico da palestra de 2017 é contraintuitivo. Muita gente supõe que a direção autônoma alivia o congestionamento. Musk argumenta o contrário. A autonomia compartilhada barata sai mais em conta do que um ônibus, então induz muito mais viagens, e o trânsito na superfície fica pior. É exatamente por isso que ele precisa dos túneis:

“A lot of people think that when you make cars autonomous, they’ll be able to go faster and that will alleviate congestion.” ↗

“Muita gente acha que, quando você torna os carros autônomos, eles vão conseguir andar mais rápido, e isso vai aliviar o congestionamento.”

“the affordability of going in a car will be better than that of a bus.” ↗

“o custo de andar de carro vai ser mais vantajoso do que o de um ônibus.”

“So the amount of driving that will occur will be much greater with shared autonomy, and actually traffic will get far worse.” ↗

“Então a quantidade de deslocamentos de carro vai ser muito maior com a autonomia compartilhada e, na verdade, o trânsito vai ficar muito pior.”

É um caso pequeno, mas revelador, do reflexo de primeiros princípios trabalhando sobre um efeito de segunda ordem. Em vez de supor que a autonomia simplesmente faz bem às cidades, ele raciocina sobre a resposta da demanda e chega ao oposto da resposta popular.

2019 — um carro sem autonomia é “um cavalo” (Lex Fridman #18)

A conversa com Lex Fridman em 2019 enuncia a crença em sua forma mais pura. Não como um recurso, mas como uma afirmação sobre obsolescência. Os dois pilares do plano mestre escrito estão aqui, segurança e frotas compartilhadas, mas a versão de 2019 é mais afiada. A autonomia agora decide se um carro é útil ou não.

A tese da obsolescência, dita sem rodeios:

“in the future, any car that does not have autonomy would be about as useful as a horse.” ↗

“no futuro, qualquer carro que não tenha autonomia vai ser tão útil quanto um cavalo.”

O modelo mental dele de como a frota aprende: toda intervenção humana é, por definição, um sinal de falha do qual se aprende.

“the way to look at this is view all input as error.” ↗

“o jeito de ver isso é encarar toda entrada como erro.”

Logo depois, ele diz sem rodeios. Se o usuário precisou tocar nos controles, algo já está errado, então toda entrada é erro (parafraseado; a frase se divide em duas falas da legenda, ↗).

E depois a inversão pela qual ele é mais conhecido nesse assunto: o padrão perigoso, que logo ficará arcaico, é a direção manual, e não a autonomia.

“Frankly it’s pretty crazy letting people drive a two-ton death machine manually.” ↗

“Francamente, é bem maluco deixar as pessoas dirigirem manualmente uma máquina da morte de duas toneladas.”

“it’s gonna seem like a mad thing in the future that people were driving cars.” ↗

“no futuro, vai parecer uma loucura que as pessoas dirigissem carros.”

Ele fixa a ideia com uma analogia do elevador, a que volta duas vezes. Ninguém mais quer um ascensorista puxando uma alavanca entre os andares, porque o elevador automático é mais seguro. E, quando um sistema é drasticamente mais seguro do que uma pessoa, recolocar um humano nele pode até diminuir a segurança (parafraseado; a passagem do elevador se espalha por muitas falas da legenda). O motivo que ele dá, numa frase, para confiar que o software vai chegar lá é a mesma intuição de progresso não linear que a entrevista de 2025 resume em “devagar, mas depois tudo de uma vez”:

“The rate of improvement is exponential.” ↗

“O ritmo de melhoria é exponencial.”

Essa base de 2019 importa para a história da evolução das opiniões. Seis anos antes de pôr uma data de robotáxi no calendário, a crença já está totalmente formada e dita quase com as mesmas palavras: a autonomia como a linha entre um carro útil e um cavalo, com a segurança provada ao tratar toda intervenção humana como erro.

2019 — o argumento contra o lidar: “uma missão de tolo” (Tesla Autonomy Day)

O primeiro evento da Tesla para investidores sobre direção autônoma, o Autonomy Day de abril de 2019, veio dois meses depois do Lex #18, e é onde a posição contra o lidar que ancora a tese de câmera em primeiro lugar é dita em voz alta. Perguntado se o novo computador de direção totalmente autônoma também poderia processar a entrada de um lidar, Musk não recorre a uma ponderação de engenharia. Ele descarta o sensor de cara, por princípio:

“lidar is is a fool’s errand” ↗

“o lidar é é uma missão de tolo”

Ele acrescenta que quem depende dele está “condenado” e que esse tipo de sensor é caro e desnecessário (a legenda embaralha a frase como “anyone luck relying on orb lidar is doomed doomed expensive expensive sensors”, então ela é parafraseada; “condenado” é a palavra amplamente noticiada do evento, ↗). Depois ele recorre à imagem pela qual é lembrado, os sensores extras como órgãos cirurgicamente inúteis:

“it’s like having a whole bunch of a expensive appendices that compact one appendix is bad well now don’t put a whole bunch of them that’s ridiculous” ↗

“é como ter um monte de apêndices caros que compactam um apêndice é ruim então agora não coloque um monte deles isso é ridículo”

É o movimento de primeiros princípios que corre por baixo de toda a postura de só câmeras: construir o projeto a partir da estrutura do problema, uma estrada feita para ser lida com os olhos, em vez de empilhar hardware. É o mesmo argumento do “resolva a visão e você resolve a autonomia” do TED de 2017 e do “o sistema viário é projetado para a IA” de 2025, aqui na forma mais afiada e mais citada. A engenharia mais profunda contra o lidar nesse evento, a “confusão” da fusão de sensores, a profundidade a partir da visão, “o lidar é uma muleta”, é da palestra de visão de Karpathy, e não de Musk, e não é atribuída a ele.

A previsão pública do robotáxi — “mais de um milhão de robotáxis … no ano que vem, com certeza”

O Autonomy Day é também onde Musk pela primeira vez põe uma data pública na ideia de frota compartilhada. A Tesla vai ter robotáxis autônomos rodando no ano seguinte e, em cerca de um ano, mais de um milhão deles nas ruas, ativados por uma atualização remota de software.

“we expect to have the first operating Robo taxis next year with no one in them next year” ↗

“esperamos ter os primeiros robotáxis em operação no ano que vem, sem ninguém dentro, no ano que vem”

“but next year for sure we will have over a million Robo taxis on the road” ↗

“mas no ano que vem, com certeza, vamos ter mais de um milhão de robotáxis nas ruas”

A razão dele é a mesma intuição de progresso não linear a que volta várias e várias vezes (o “o ritmo de melhoria é exponencial” do #18, o “devagar, mas depois tudo de uma vez” de 2025). Dados e software melhoram de forma exponencial, enquanto as pessoas extrapolam em linha reta (parafraseado; várias falas da legenda, ↗).

Nota de tom (o prazo não se cumpriu). Registrado como o enquadramento declarado de Musk, e não como fato. A previsão de “mais de um milhão de robotáxis … no ano que vem [2020]” não se realizou no prazo. Nenhuma frota de robotáxis Tesla sem motorista foi lançada em 2020; um piloto pequeno, com área geográfica delimitada e monitor de segurança, só começou em Austin em 2025. É um dos dados mais claros de otimismo e prazo no histórico dele: a crença declarada anos antes da capacidade, com o cronograma escorregando por uma boa margem. E ele mesmo acrescenta a ressalva no mesmo fôlego (“às vezes eu não chego na hora, mas faço acontecer”). O enquadramento e o atraso é que ficam no registro, sem veredito sobre a previsão em si.

2019 — a autonomia como problema de espaço vetorial (Lex Fridman #49)

Sete meses depois do #18, a conversa com Lex Fridman de novembro de 2019 (#49) traz a parte que o #18 deixou implícita: qual parte da direção autônoma é a difícil. A resposta dele é a percepção como representação. Construir um modelo preciso do mundo, e não decidir o que fazer com ele:

“The hardest thing is having accurate representation of the physical objects in vector space.” ↗

“A coisa mais difícil é ter uma representação precisa dos objetos físicos no espaço vetorial.”

“Once you have an accurate vector space representation, the planning and control is relatively easier.” ↗

“Quando você tem uma representação precisa no espaço vetorial, o planejamento e o controle são relativamente mais fáceis.”

É a decomposição por primeiros princípios que fica por baixo da postura posterior de só câmeras. Se a restrição determinante é reconstruir a cena no espaço vetorial a partir da visão, então o problema de engenharia é a percepção, e o planejamento vem depois e é comparativamente fácil. É a semente de 2019 do argumento de 2025 de que “o sistema viário é projetado para a IA”: os dois põem toda a dificuldade em transformar imagens num modelo de mundo preciso. Veja Lex Fridman #49 (2019).

2021 — o objetivo numa regra só: “não bata” (Tesla AI Day)

Na sessão de perguntas do Tesla AI Day (agosto de 2021), Musk espreme todo o objetivo da autonomia numa única regra e embute nela uma afirmação de primeiros princípios sobre aquilo que a percepção não deve exigir. A diretriz principal:

“the prime directive is ‘don’t crash’” ↗

“a diretriz principal é ‘não bater’”

E a consequência que ele tira disso. A prevenção de colisões não pode depender da classificação; o carro tem de desviar de um objeto quer consiga dar nome a ele ou não:

“Even if it’s a UFO that crash-landed on the highway – still don’t hit it. It should not need to recognize it in order to not hit it” ↗

“Mesmo que seja um óvni que caiu na estrada, continue sem bater nele. O carro não deveria precisar reconhecê-lo para não bater nele”

É o mesmo raciocínio de construir o projeto a partir do problema do “resolva a visão e a autonomia está resolvida” de 2017 e da recusa do “o lidar é uma missão de tolo” de 2019, agora apontado para a função objetivo. Defina a segurança como “não bata” e mantenha essa regra logicamente anterior a tudo o que o sistema de percepção consiga rotular, e independente disso. A engenharia de visão e planejamento nesse evento foi de Karpathy e Ashok; a contribuição de Musk aqui é o objetivo. Veja Tesla AI Day 2021.

2021 — visão biológica em silício: “recriar o que os humanos fazem” (Lex Fridman #252)

A conversa com Lex Fridman em 2021 (#252) leva o diagnóstico do espaço vetorial à sua forma mais explícita de mimetismo biológico, e é tanto uma janela para como Musk pensa o cérebro humano quanto para os carros. O problema inteiro, no relato dele, é reconstruir a percepção humana em silício. A estrada foi feita para olhos e redes neurais, então a resposta tem de ser câmeras e redes neurais:

“to solve self-driving you have to solve. You basically need to recreate what humans do to drive, which is humans drive with optical senses, eyes, and biological neural nets.” ↗

“para resolver a direção autônoma você tem que resolver. Basicamente, é preciso recriar o que os humanos fazem para dirigir, que é: os humanos dirigem com sentidos ópticos, olhos e redes neurais biológicas.”

O que torna a conversa incomum é o longo trecho em que ele raciocina sobre o próprio cérebro. O olho preenche a cor e o ponto cego. O cérebro está “constantemente tentando esquecer o máximo possível” porque a memória é cara, reduzindo a percepção ao “menor espaço vetorial possível, só com os objetos relevantes”, e dirigir com segurança exige permanência do objeto, lembrar da criança escondida atrás do caminhão, a mesma “memória no tempo e no espaço” de que os carros precisam. Isso está parafraseado, já que se espalha por longas trocas com várias falas, mas mostra o hábito recorrente dele: tratar a mente como hardware a ser decifrado por engenharia reversa, o reflexo do cérebro como máquina voltado para a percepção. Ele também define o patamar para a implantação, não a paridade com os humanos, mas ser “duas ou três vezes” mais seguro, e prevê que o carro acabará fazendo manobras “muito além do que … James Bond conseguia fazer” (parafraseado). Veja Lex Fridman #252 (2021).

2023 — “o maior aumento de valor de ativo da história” (assembleia de acionistas da Tesla)

A assembleia de acionistas da Tesla em 2023 é onde o argumento econômico da frota compartilhada recebe sua declaração datada mais forte até então. É o segundo pilar, escrito no plano de 2016 e reformulado no Autonomy Day de 2019 como um salto de “cinco vezes” em utilidade. A lógica dele é a do ativo ocioso. Um carro particular fica parado cerca de 90% da semana, então torná-lo autônomo multiplica o quanto ele é usado, e ligar a frota existente por software é, no relato dele, algo histórico:

“I think will be the single biggest asset value increase in history.” ↗

“Acho que vai ser o maior aumento de valor de ativo da história.”

De volta ao tema na sessão de perguntas, ele leva a afirmação um passo adiante. Um carro que custa o mesmo, mas é usado cerca de cinco vezes mais, poderia render “margens de 80%”, então o momento da virada é:

“it’s probably going to be the biggest asset value step change in in history of Earth.” ↗

“provavelmente vai ser a maior mudança de patamar de valor de ativo na na história da Terra.”

A mesma ideia de frota compartilhada, a autonomia transformando um bem que se desvaloriza num bem que gera renda, repetida em maio de 2023 em pleno volume, a crença mantida e amplificada enquanto a capacidade ainda não foi entregue. É um dado limpo de otimismo e prazo. Em 2023, a formulação de 2019 das “cinco vezes” e a previsão de “mais de um milhão de robotáxis no ano que vem” não tinham se concretizado, e mesmo assim a convicção é declarada maior aqui, e não menor, o mesmo padrão que a Nota de tom do Autonomy Day registra. A “marcha dos noves” do FSD, a rede neural de ponta a ponta da V12 e o raciocínio de “máximo local / curva logarítmica” da mesma sessão de perguntas são engenharia de autonomia, tratada na página da fonte. Veja Assembleia de acionistas da Tesla 2023.

2024 — o robotáxi vira produto: “transporte coletivo individualizado” (We, Robot)

O evento “We, Robot” de outubro de 2024 é onde o robotáxi, por tanto tempo abstrato, ganha finalmente um objeto físico, o Cybercab de dois lugares, sem volante e sem pedais, e onde Musk chega à expressão que usa para a economia. A ideia de frota compartilhada do plano de 2016, amplificada na assembleia de 2023, volta aqui como nome de categoria:

“The cost of autonomous transport would be so low, you can think of it as individualized mass transit.” ↗

“O custo do transporte autônomo seria tão baixo que dá para pensar nele como transporte coletivo individualizado.”

O ganho com que ele abre é aquele que o plano mestre de 2025 depois transforma em meta de otimização. Não velocidade, não custo, mas tempo recuperado:

“With autonomy, you’ll get your time back.” ↗

“Com a autonomia, você recupera o seu tempo.”

E o argumento da segurança chega seco e absoluto, a meta de “10 vezes mais seguro” de 2016 dita como fato simples:

“Autonomous cars will be ten times safer than human drivers.” ↗

“Os carros autônomos serão dez vezes mais seguros do que os motoristas humanos.”

O raciocínio não se moveu. A conta do ativo ocioso (um carro usado cerca de 10 das 168 horas da semana e parado no resto, valendo “cinco vezes, dez vezes mais” se for autônomo) repete o argumento do “maior aumento de valor de ativo” de 2023, e a analogia do ascensorista volta mais uma vez, vinda do #18. O que 2024 acrescenta é o produto. O preço do Cybercab (abaixo de US$ 30.000), o prazo de produção (“2026 … antes de 2027”), o custo operacional de cerca de 20 centavos de dólar por milha, o Robovan, o carregamento por indução e o FSD sem supervisão “no Texas e na Califórnia no ano que vem” são especificações de produto e de prazo, tratadas na página da fonte. Veja We, Robot (2024).

2025 — o lançamento do robotáxi e o argumento da visão, e não do lidar (CNBC)

A entrevista à CNBC de maio de 2025 é onde a autonomia prometida há tanto tempo encontra um lançamento de verdade, com robotáxis pagos em Austin no mês seguinte. Duas coisas se destacam: a leitura dele sobre o prazo e a sua filosofia de sensores.

A visão não linear do progresso, o motivo de ele estar confiante agora, depois de anos de datas perdidas:

“these things happen slowly but then all at once” ↗

“essas coisas acontecem devagar, mas depois tudo de uma vez”

Um plano de lançamento realmente cauteloso, começar com cerca de 10 carros e escalar para 20, 30, 40, apresentado como contenção deliberada, e não como corrida por território:

“we want to deliberately take it slow” ↗

“queremos ir devagar de propósito”

E a defesa dele, por primeiros princípios, da abordagem só com câmeras da Tesla contra o lidar e o radar da Waymo. A estrada foi construída para a visão biológica, então a resposta de máquina é a visão, e não os lasers:

“the way that the road system is designed is for AI” ↗

“o jeito como o sistema viário é projetado é para a IA”

Ele leva isso a um argumento de redundância. Com vários tipos de sensor rodando ao mesmo tempo (câmera mais lidar e radar), os sistemas “tendem a ficar confusos” sobre em qual deles acreditar, então a Tesla “desligou os radares”. No relato dele, a divergência entre sensores é, por si só, uma causa de acidentes. É o mesmo movimento de primeiros princípios que atravessa o resto do pensamento dele: construir o projeto a partir da estrutura do problema, uma estrada feita para os olhos, em vez de uma pilha de hardware.

2022–2026 — o menino que gritou FSD, com as palavras dele (teleconferências de resultados da Tesla)

As teleconferências de resultados de 2022 a 2026 mantêm a previsão quase trimestral do FSD no auge da confiança: “acho que vamos alcançar isso este ano” (1º trimestre de 2022), “A nossa probabilidade de isso acontecer é de 100%. Acho que, sabe, estamos quase lá” (3º trimestre de 2022), “A nossa estimativa interna é o 2º trimestre do ano que vem para ser mais seguro do que um humano” (3º trimestre de 2024), “milhões de Teslas operando de forma totalmente autônoma na segunda metade do ano que vem” (1º trimestre de 2025). O que há de novo é que a repetição sem resolução se torna visível para o próprio Musk. Ele diz isso abertamente: “sei que sou o menino que gritou FSD” (2º trimestre de 2023), “sei que as pessoas já disseram, bom, o Elon é o menino que gritou lobo… dessa vez tem um lobo, caramba” (4º trimestre de 2024), “as minhas previsões sobre isso foram otimistas demais no passado” (2º trimestre de 2024). Ele chega a nomear o mecanismo de por que as datas escorregam: “vai se curvar de forma logarítmica”, “uma série de curvas logarítmicas empilhadas” (2023). E segue baixando a barra (“marcha dos noves”; “parar a autonomia significa matar gente”, 1º trimestre de 2024; “é só uma questão de tempo até superarmos a confiabilidade dos humanos”, 1º trimestre de 2024).

O marco mais claro de evolução de opinião é o recuo do 1º trimestre de 2026 sobre uma antiga promessa de hardware: “O Hardware 3 simplesmente não tem capacidade de alcançar o FSD sem supervisão. Chegamos a achar, num certo momento, que teria”. É a admissão seca de que uma afirmação confiante anterior estava errada. A mesma teleconferência redefine o gargalo do robotáxi como a timidez do próprio carro: “o carro basicamente fica paranoico e trava… às vezes ele tem medo de fazer as coisas.” E ele cita a si mesmo, ano após ano, sobre a inevitabilidade do cavalo e do celular de abrir e fechar (“eu disse isso muitos anos atrás…”, 1º trimestre de 2025), até chegar a “o único carro dirigido manualmente vai ser o novo Tesla Roadster” (1º trimestre de 2026). Todos os trimestres aqui identificam Musk de forma explícita. Veja Teleconferências de resultados da Tesla 2022-2026.

2015 — a meta e a previsão (tuítes)

Os tuítes de 2015 a 2017 acrescentam dois marcos iniciais datados. Em novembro de 2015, ele nomeia a meta que organiza todo o programa: “Ampliando a equipe de software do Autopilot na Tesla para alcançar a autonomia total generalizada.” E, em março de 2015, ele enuncia o par de valor e previsão a que volta sempre. Primeiro o valor, sobre a liberdade humana: “A Tesla é muito a favor de que as pessoas possam dirigir seus carros e sempre será”. Logo depois, a previsão social de que a autonomia segura pode um dia proibir justamente isso: “quando os carros autônomos ficarem mais seguros do que os dirigidos por humanos, o público pode proibir estes últimos. Espero que não”. Veja Tuítes de Elon Musk 2015-2017.

2021 — a virada para só visão, em tempo real (tuítes)

Os tuítes de 2021 e 2022 flagram o ponto de virada da filosofia de direção autônoma dele enquanto acontece: a decisão de 2021 de tirar o radar e apostar tudo nas câmeras, argumentada a partir de primeiros princípios. A tese é que o sistema viário é construído para a visão, então a visão é o que precisa ser resolvido:

“What has become absolutely clear is that the plethora of self-driving corner cases can only be solved with real-world optical intelligence. This is how humans designed the road system to work. Once you have that in silicon form, everything else is just icing on the cake.” ↗

“O que ficou absolutamente claro é que a infinidade de casos extremos da direção autônoma só pode ser resolvida com inteligência óptica do mundo real. Foi assim que os humanos projetaram o sistema viário para funcionar. Quando você tem isso em forma de silício, o resto é só a cereja do bolo.”

A rejeição da fusão de sensores que justificou apagar o radar: quando os dois sensores discordam, confie no mais preciso em vez de fundi-los.

“When radar and vision disagree, which one do you believe? Vision has much more precision, so better to double down on vision than do sensor fusion.” ↗

“Quando o radar e a visão discordam, em qual você acredita? A visão tem muito mais precisão, então é melhor apostar mais na visão do que fazer fusão de sensores.”

E a frase que liga o FSD diretamente ao pensamento dele sobre IA geral, de que resolver a direção é resolver a IA do mundo real, a tese por trás da Tesla como empresa de IA:

“A major part of real-world AI has to be solved to make unsupervised, generalized full self-driving work, as the entire road system is designed for biological neural nets with optical imagers” ↗

“Uma parte importante da IA do mundo real precisa ser resolvida para fazer funcionar a direção totalmente autônoma, generalizada e sem supervisão, já que todo o sistema viário é projetado para redes neurais biológicas com sensores ópticos”

“Tesla is solving a major real-world AI problem.” ↗

“A Tesla está resolvendo um grande problema de IA do mundo real.”

É um dado limpo de evolução de opinião: a mesma lógica de visão biológica em silício que ele dá ao Lex Fridman no mesmo ano, aqui nos tuítes datados dele, no exato momento em que decidiu tirar o radar. Veja Tuítes de Elon Musk 2021-2022.

Relacionados