Musk Wiki

Tesla AI Day 2021

PróximaTesla AI Day 2022
  • Local / ocasião: o primeiro AI Day da Tesla, realizado na sede de Palo Alto em 19 de agosto de 2021, uma vitrine técnica voltada à contratação. Musk abre o evento e passa a palavra para palestras de engenharia aprofundadas de Andrej Karpathy (visão), Ashok Elluswamy (planejamento), Milan Kovac (rotulagem automática) e Ganesh Venkataramanan (o supercomputador Dojo). O encerramento traz o anúncio-surpresa do Tesla Bot / Optimus (uma pessoa fantasiada no palco) e uma longa sessão de perguntas da plateia.
  • Formato: transmissão ao vivo de cerca de 2h44; o conteúdo relevante vai de 47:09 a 2:31:13 (os primeiros 47 minutos foram uma tela de espera).
  • Data: 19 de agosto de 2021 (transmissão ao vivo).
  • Nível de confiança: transcrição completa de menor confiança (Nível 3), conforme o registro de confiança das fontes. O texto é uma transcrição manual feita por fãs (elonmuskinterviews.wordpress.com, transcrita em três partes) que traz identificação explícita dos falantes e marcações de tempo do vídeo; ainda assim, as citações são tratadas como de Nível 3 e precisam de conferência com o vídeo, e onde a redação é incerta ela foi parafraseada.
  • Citações: da transmissão ao vivo da Tesla, cada uma ligada ao seu momento no vídeo do YouTube.
  • ⚠️ Ressalva de atribuição: este é um evento com vários apresentadores, e a transcrição identifica cada falante. As palestras de engenharia sobre visão, planejamento, rotulagem automática e o Dojo são de Karpathy, Elluswamy, Kovac, Venkataramanan e outros integrantes da equipe de IA, não de Musk, e não são citadas como falas dele. Só as falas identificadas como de Musk estão em bloco de citação aqui; na sessão de perguntas, usam-se apenas as respostas do próprio Musk, nunca as perguntas da plateia.

⚠️ Ressalva de Nível 3. A transcrição é uma transcrição manual feita por fãs (de alta qualidade, com identificação dos falantes e marcações de tempo, mas não é uma transcrição oficial da Tesla). A revelação do Tesla Bot é uma única fala de cerca de 4 minutos (2:06:49), então várias citações desse monólogo apontam para o mesmo momento do vídeo. O grosso da engenharia pesada (HydraNets, transformers, espaço vetorial, planejamento por MCTS, rotulagem automática, o chip D1 e a arquitetura do Dojo) é trabalho de outros palestrantes e fica totalmente de fora. Só o material da mente de Musk é citado.

Resumo

A manchete é o Optimus. O AI Day 2021 é a primeira vez que a Tesla anunciou um robô humanoide, meses antes da conversa do Lex #252 de dezembro de 2021, que até aqui era o registro mais antigo do Optimus que tínhamos. Quase todo o resto no palco é engenharia aprofundada de Karpathy, Elluswamy e do restante da equipe de IA, e fica fora da contribuição do próprio Musk. O tempo dele no microfone se resume a quatro ideias.

Ele abre redefinindo a empresa. A Tesla, insiste, “é muito mais do que uma empresa de carros elétricos”: tem “atividade profunda em IA” e é “possivelmente a líder em IA do mundo real”. É o discurso de IA e robótica anos antes de o Plano Mestre de 2025 torná-lo oficial.

Depois vem o robô. A lógica é de continuidade, não de novidade: os carros já são “robôs semiconscientes sobre rodas”, então “faz sentido, de certa forma, levar isso para uma forma humanoide” e “eliminar tarefas perigosas, repetitivas e chatas”. Ele o projeta para ser lento e fraco o bastante para que você “possa fugir dele e, muito provavelmente, dominá-lo”. E recorre à mesma linha que usa para a IA: construir com cuidado, porque “se a gente não fizer, outro vai fazer” (futuro dos robôs humanoides).

Do robô ele passa direto para a economia. Pergunta “o que é a economia? … é trabalho”, de modo que um mundo sem escassez de mão de obra é um mundo em que “o trabalho físico será uma escolha”. Daí tira as conclusões a que sempre volta: “vai ser preciso haver renda básica universal” e, indo mais longe, “existe algum limite real para a economia? Talvez não” (abundância sustentável). Por fim, na sessão de perguntas, dois princípios compactos de engenharia. Um é uma regra de autonomia: “a diretriz principal é ‘não bater’”, mesmo diante de um objeto que o carro não sabe nomear (“um OVNI”). O outro é o argumento de sempre sobre a velocidade de iteração, aqui aplicado ao Dojo.

A Tesla como “muito mais do que uma empresa de carros elétricos”: a virada para IA e robótica (Tesla)

A abertura de Musk é um discurso de recrutamento, e ela se apoia numa afirmação sobre o que a empresa realmente é. Não uma montadora, mas uma empresa de IA que por acaso vende carros:

“Tesla is much more than an electric car company, that we have deep AI activity in hardware” ↗

“A Tesla é muito mais do que uma empresa de carros elétricos, temos uma atividade profunda de IA em hardware”

“I think arguably the leaders in real world AI as it applies to the real world” ↗

“Acho que, dá para dizer, somos os líderes em IA do mundo real, aplicada ao mundo real”

“IA do mundo real” é a IA que percebe e age no espaço físico, e é o fio que amarra o carro, o Dojo e o robô que ele está prestes a revelar numa empresa só. O Plano Mestre de 2025 viria a enunciar essa mesma ideia, “IA no mundo físico”, em linguagem corporativa formal. Aqui, em 2021, ela chega como um discurso para engenheiros, anos antes, e já traz o germe da frase de 2025 em “as únicas coisas que importam … são a autonomia e o Optimus”.

A revelação do Optimus: a lógica do carro como robô e o “garantir que seja seguro” (Robôs humanoides)

A revelação se apoia num argumento de continuidade. A Tesla já construiu uma máquina de IA do mundo real, o carro, então o humanoide é o mesmo cérebro em outro corpo. A premissa:

“Tesla is arguably the world’s biggest robotics company because our cars are like semi-sentient robots on wheels” ↗

“A Tesla é, dá para dizer, a maior empresa de robótica do mundo, porque nossos carros são como robôs semiconscientes sobre rodas”

O propósito que ele dá ao robô é assumir o trabalho que as pessoas não querem, num corpo que se encaixa no mundo humano:

“it’s intended to be friendly, of course, and navigate through a world built for humans, and eliminate dangerous, repetitive, and boring tasks” ↗

“a ideia é que seja amigável, claro, e se mova por um mundo construído para humanos, e elimine tarefas perigosas, repetitivas e chatas”

O mais revelador é que ele trata os limites físicos do robô como um recurso de segurança. Quer que seja lento e fraco o bastante para que uma pessoa consiga escapar dele ou dominá-lo:

“you can run away from it and most likely overpower it” ↗

“você pode fugir dele e, muito provavelmente, dominá-lo”

E ele justifica construí-lo com a mesma lógica que usa para a IA: se vai acontecer de qualquer jeito, melhor que quem o faça seja alguém preocupado com a segurança.

“if we don’t, someone else would, will, and so I guess we should make it” ↗

“se a gente não fizer, outro faria, vai fazer, então acho que a gente deve fazer”

Este é o primeiro anúncio do Optimus que temos e a raiz, em agosto de 2021, de um conjunto de crenças que cresce nos anos seguintes. Dele partem o fio do “trabalho vai se tornar opcional” e da companhia no Lex #252 de dezembro de 2021, e os discursos do “maior produto de todos os tempos” de 2024 e 2025. As especificações do robô (1,73 m, oito câmeras, computador do FSD, cerca de 8 km/h) são detalhe de produto, anotado aqui na prosa.

“O que é a economia? … é trabalho”: a conclusão da abundância (Abundância sustentável)

Ao lado do robô, Musk raciocina a partir dele até a economia e chega à conclusão de pós-escassez a que sempre volta. Ele parte do trabalho e tira a primeira consequência:

“what is the economy? It is, at the foundation, it is labor. So, what happens when there is, you know, no shortage of labor? That’s why I think long term that there will need to be universal basic income” ↗

“o que é a economia? Ela é, na base, trabalho. Então, o que acontece quando não há, sabe, falta de mão de obra? É por isso que eu acho que, a longo prazo, vai ser preciso haver renda básica universal”

O estado final que ele projeta é o trabalho como escolha, e não como necessidade:

“physical work will be a choice. If you want to do it, you can, but you won’t need to do it” ↗

“o trabalho físico será uma escolha. Se você quiser fazer, pode, mas não vai precisar fazer”

E a afirmação mais ousada de todas: quando o trabalho deixa de ser escasso, a economia talvez não tenha teto:

“capital equipment is just distilled labor, then, is there any actual limit to the economy? Maybe not” ↗

“equipamento de capital é só trabalho destilado, então, existe algum limite real para a economia? Talvez não”

Aqui a tese da abundância fica ligada diretamente ao robô no palco. É daqui que nasce a frase de 2024 sobre “nenhum limite real para a economia”, e é aqui que a cadeia de 2017, da automação à renda básica e à abundância, ganha o Optimus como causa concreta. O “trabalho físico será uma escolha” é a ideia do “trabalho vai se tornar opcional” de 2021, dita no mesmo ano, e a forma inicial, de “renda básica”, do fio da “renda alta universal” de 2025.

A diretriz principal da autonomia: “não bater”, reconhecendo o objeto ou não (Direção autônoma)

Na sessão de perguntas, questionado sobre multimodalidade e linguagem, Musk reduz o objetivo da autonomia a uma única regra e a um único modo de falha. A diretriz principal:

“the prime directive is ‘don’t crash’” ↗

“a diretriz principal é ‘não bater’”

Depois vem o movimento de primeiros princípios. Evitar uma colisão não exige classificar o objeto antes; o carro tem de desviar dele, saiba nomeá-lo ou não:

“Even if it’s a UFO that crash-landed on the highway – still don’t hit it. It should not need to recognize it in order to not hit it” ↗

“Mesmo que seja um OVNI que fez um pouso forçado na estrada, ainda assim não bata nele. O carro não deveria precisar reconhecê-lo para não bater”

É o mesmo raciocínio de câmeras e visão, derivado do próprio problema, que vai de 2017 (“resolva a visão e a autonomia está resolvida”) até a frase de 2019 sobre o lidar ser “coisa de tolo”. Aqui ele o aponta para a função objetivo. Defina segurança como “não bater” e você deixa de depender da capacidade da percepção de rotular o mundo.

Velocidade de iteração: a razão de ser do Dojo (O algoritmo de engenharia)

Perguntado sobre o Dojo, Musk explica por que o supercomputador importa com o seu argumento de sempre sobre a taxa de inovação. O progresso é o número de iterações vezes o avanço por iteração, então a alavanca a puxar é o tempo de cada iteração:

“if you can reduce the time between iterations, the rate of improvement is much better” ↗

“se você consegue reduzir o tempo entre as iterações, a taxa de melhoria é muito melhor”

Ele também dá ao Dojo um teste de fogo característico: será um sucesso, diz, se a equipe de software quiser desligar o cluster de GPUs (parafraseado). É o instinto conhecido de julgar uma coisa pelo fato de as pessoas realmente migrarem para ela. A arquitetura do Dojo em si (o chip D1, os módulos de treinamento, o ExaPOD) é engenharia de Venkataramanan e fica fora do escopo. A lógica de “acelerar o tempo de ciclo” é a mesma por trás da frase da Mars Society 2020 sobre a “melhoria exponencial na nossa taxa de inovação”, aqui aplicada ao treinamento de redes neurais.

Conexões (páginas afetadas)

  • Tesla — ampliada com a virada do AI Day 2021 para “muito mais do que uma empresa de carros elétricos” / “líderes em IA do mundo real” (a Tesla como empresa de IA e robótica), datada de agosto de 2021, entre os Planos Mestres de 2016 e 2023.
  • Robôs humanoides — ampliada com o primeiro anúncio do Optimus (agosto de 2021): a lógica de continuidade do carro como robô (“robôs semiconscientes sobre rodas” → forma humanoide), o propósito de eliminar tarefas chatas, a segurança de um robô projetado para ser dominável e o enquadramento de inevitabilidade com responsabilidade: “se a gente não fizer, outro faria … com segurança”.
  • Abundância sustentável — ampliada com a conclusão de economia do trabalho ligada à revelação do robô (“o que é a economia? … é trabalho”; “o trabalho físico será uma escolha”; “renda básica universal”; “existe algum limite real para a economia? Talvez não”), a origem, em 2021, do enquadramento de “economia sem limite”.
  • Direção autônoma — ampliada com a regra da “diretriz principal é ‘não bater’” e o princípio de segurança de primeiros princípios: não é preciso reconhecer o objeto para evitá-lo.
  • Elon Musk — ampliada com a seção “Tesla AI Day 2021: a empresa de IA, o robô e a conclusão da abundância”, que costura o enquadramento como empresa de IA, a revelação do Optimus, a conclusão da abundância, a diretriz principal da autonomia e a razão da velocidade de iteração.
  • O algoritmo de engenharia — reafirmação registrada: velocidade de iteração e taxa de inovação como razão de ser do Dojo (citada em bloco em Elon Musk).
  • Risco existencial da IA — reafirmação registrada: a lógica de inevitabilidade com responsabilidade, “se a gente não fizer, outro faria … com segurança”, a mesma que ele aplica à IA (citada em bloco em Robôs humanoides).