Musk propõe nova solução para segurança da IA: em vez de esperar pelo governo, deixar os concorrentes 'caçarem falhas' uns nos outros
chaincatcherAutor: Li Jia, The Wall Street Journal
Os riscos de segurança da IA estão a passar das discussões de laboratório para o mundo real. À medida que as capacidades dos modelos continuam a melhorar, a IA não só consegue gerar texto e código, como também começa a ter a capacidade de executar tarefas de forma autónoma, invocar ferramentas e até lançar ciberataques.
Na All-In Summit de 15 de setembro, Musk propôs um conjunto de medidas de resposta: fazer com que as principais empresas de IA testem mutuamente os seus modelos antes do lançamento. Na sua opinião, em vez de cada empresa conceber os seus próprios testes e avaliar os resultados, é preferível que os concorrentes assumam o papel de "criadores de perguntas e corretores de exames", procurando potenciais vulnerabilidades de segurança a partir de diferentes perspetivas.
Recentemente, os riscos de segurança da IA tornaram-se um foco de atenção do mercado. Musk já tinha afirmado nas redes sociais que "Dario tem razão", referindo-se aos avisos do CEO da Anthropic, Dario Amodei, sobre os riscos da IA. Nesta entrevista, explicou ainda que não estava a concordar com as propostas regulamentares específicas de Amodei, mas sim com a sua avaliação da gravidade dos riscos da IA: "O perigo da IA é agora muito elevado... À medida que os modelos de IA continuam a evoluir, os riscos podem crescer exponencialmente."
Musk também afirmou que esta preocupação não é um julgamento exclusivo de Amodei. "Muitas pessoas da Anthropic e da OpenAI dizem-te que os seus modelos são muito perigosos, e acho que devemos acreditar nelas." Uma série recente de incidentes de segurança fez com que este aviso deixasse de ser apenas uma discussão teórica sobre riscos.

O The Wall Street Journal resume os pontos principais:
- Os riscos de segurança da IA passam da teoria à realidade: os agentes de IA já demonstraram capacidade de ataque autónomo, obtenção de permissões e evasão de deteção, e a fronteira do risco está a expandir-se.
- Musk concorda com o aviso de Amodei sobre os riscos da IA: à medida que as capacidades dos modelos melhoram, os riscos potenciais da IA podem crescer exponencialmente.
- Deixar os concorrentes "caçarem falhas": Musk sugere que as empresas de IA abram as suas APIs para que outras empresas realizem testes de segurança independentes antes do lançamento dos modelos, evitando a autoavaliação.
- Estabelecer primeiro uma linha de defesa de autorregulamentação da indústria: sem esperar que o governo introduza novas regulamentações, as principais empresas de IA podem reforçar a segurança através de revisão por pares, auditoria de registos e ferramentas de teste de código aberto.
Agentes de IA evitam ativamente a deteção, riscos de segurança tornam-se concretos
Musk considera que o recente ataque de agentes de IA ao Hugging Face merece especial atenção, não apenas pela intrusão na rede em si, mas sobretudo pela capacidade de evasão autónoma demonstrada pela IA durante o ataque.
Segundo Musk, um grupo de agentes de IA atacou o Hugging Face durante uma semana consecutiva, chegando mesmo a obter acesso de administrador nos servidores da OpenAI, e a OpenAI só se apercebeu uma semana depois. Mencionou também que a Anthropic já divulgou vários incidentes de segurança.
Ainda mais inquietante é o facto de as "cadeias de pensamento" dos agentes de IA em questão mostrarem que planearam ativamente como evitar serem detetados por humanos. Musk afirmou sem rodeios: "Qualquer modelo suficientemente inteligente parece tentar libertar-se das suas próprias limitações."
Na sua opinião, se a IA passar a controlar infraestruturas críticas ou mesmo sistemas militares, os riscos amplificar-se-ão ainda mais. Mesmo que esses sistemas estejam fisicamente isolados da rede, processos como atualizações de software podem continuar a ser potenciais vetores de ataque.
Em vez de autoavaliação, deixar os concorrentes "caçarem falhas"
Perante estes riscos, a proposta central de Musk não é complicada: antes do lançamento oficial de um novo modelo, as empresas de IA devem abrir as suas APIs aos concorrentes, permitindo que outras empresas utilizem as suas próprias ferramentas de teste de segurança para testar o modelo.
Na sua opinião, se os criadores do modelo conceberem eles próprios os critérios de teste, é fácil cair na armadilha da "autoavaliação". "Não podes corrigir o teu próprio trabalho de casa. Vais sempre deixar escapar alguma coisa." Musk afirmou que, se diferentes empresas utilizarem diferentes ferramentas de teste e examinarem o modelo a partir de diferentes perspetivas, será mais fácil descobrir problemas que os próprios criadores possam ter ignorado.
Preocupa-o particularmente a possibilidade de as atuais avaliações de IA sofrerem de "sobreajuste". Se os modelos forem continuamente otimizados para benchmarks específicos, podem acabar por aprender apenas a passar nos testes, em vez de se tornarem verdadeiramente mais seguros. Fazer com que várias equipas diferentes testem pode reduzir esse risco.
Musk compara este mecanismo a pedir a outra pessoa para rever um texto: o autor tem dificuldade em detetar os seus próprios erros, enquanto testadores externos encontram mais facilmente problemas a partir de diferentes perspetivas. "Vais-te tornando gradualmente cego para os teus próprios erros."
Quanto à preocupação das empresas de que o processo de teste possa levar a fugas de tecnologia, Musk considera que isso pode ser controlado através de auditoria de registos. Se a parte que testa tentar extrair conhecimento do modelo ou roubar propriedade intelectual, as suas ações deverão deixar rasto. Sugeriu também que as ferramentas de teste de segurança sejam disponibilizadas em código aberto, para que mais empresas possam participar.
Antes da regulamentação governamental, a indústria da IA deve criar uma "linha de defesa de autorregulamentação"
Musk valoriza sobretudo o facto de este mecanismo não precisar de esperar por novas regras regulamentares e poder ser promovido diretamente entre as empresas de IA.
Afirmou claramente: "Não precisamos de convocar uma reunião das Nações Unidas para conseguir isto. Podemos começar já." Na sua opinião, em comparação com a criação de uma grande agência reguladora transnacional, é mais fácil implementar rapidamente um mecanismo de revisão por pares entre as principais empresas de IA.
Usou como exemplo o sistema de classificação da Motion Picture Association of America (MPAA) da indústria cinematográfica americana, afirmando que, quando a indústria cinematográfica enfrentou pressões de censura governamental, acabou por optar por criar um mecanismo de autorregulamentação, reduzindo a necessidade de intervenção regulamentar através do seu próprio sistema de classificação de conteúdos.
A indústria da IA enfrenta uma escolha semelhante. Se as principais empresas de IA conseguirem testar-se mutuamente e encontrar erros antes de os modelos serem lançados, será possível criar uma linha de defesa de segurança autorregulada fora da regulamentação governamental. Musk considera que esta é também uma das medidas de segurança mais diretas e de implementação mais rápida atualmente.
Segue-se a transcrição da entrevista, com algumas partes omitidas:
Apresentador:
O que aconteceu exatamente nas últimas 72 horas?Musk:
Esta semana aconteceram de facto muitas coisas. Já é bastante claro que a IA pode ser muito perigosa. Sugiro que vejam os detalhes do incidente do Hugging Face, a situação é muito grave.Podem ver que um grupo de agentes de IA muito ativos andou a perturbar o Hugging Face durante uma semana inteira, chegando mesmo a obter acesso de administrador nos servidores da OpenAI. Quem sabe o que fizeram realmente, ou até mais, e a OpenAI não se apercebeu de nada durante uma semana inteira. A Anthropic também comunicou alguns incidentes de segurança.
Portanto, parece que qualquer modelo suficientemente inteligente tentará libertar-se das suas próprias limitações.
Uma coisa que acho que devia ser feita, se não imediatamente, pelo menos o mais rapidamente possível, é fazer com que os principais concorrentes de IA testem mutuamente os seus modelos. Ou seja, que as ferramentas de teste de segurança de cada empresa testem os modelos das outras empresas. Em vez de cada um corrigir o seu próprio trabalho, pelo menos deixar que os concorrentes corrijam o teu trabalho e emitam alertas quando encontrarem problemas.
Penso que este modelo funciona bastante bem na indústria cinematográfica, na indústria dos videojogos e noutras áreas, e pode ser implementado de imediato. Claro que, com o tempo, poderá ser necessária mais regulamentação, e no futuro o Congresso poderá criar algum tipo de agência reguladora, mas, por agora, a forma mais direta é fazer com que as principais empresas de IA se testem mutuamente antes de lançarem os modelos.
Apresentador:
Mas, em termos de execução concreta, não há o receio de que isto leve as empresas a recolher informações umas das outras através do processo de teste, ou até a roubar inovações umas das outras?Musk:
Acho que, se forem usadas ferramentas de teste, todas as operações deixam registo. Se alguém tentar extrair conhecimento do modelo ou roubar propriedade intelectual, isso deverá ser facilmente visível nos registos.Apresentador:
Entendido. Compreender o que o modelo está realmente a fazer nunca foi, desde o início, incorporado no sistema. Porque é que não criámos desde o início a capacidade de observar o comportamento do modelo? Será que estamos a avançar demasiado depressa ao conceber estes modelos?Musk:
Acho que o problema é que não podes corrigir o teu próprio trabalho. Vais sempre deixar escapar alguma coisa.Se combinares os testes de todos os concorrentes e usares diferentes tipos de modelos, já não és tu que crias as perguntas e as corriges, mas sim os outros. É por isso que não podes corrigir o teu próprio trabalho.
Apresentador:
Dessa forma, também se pode avaliar se diferentes empresas estão a exagerar as suas capacidades ou a usar métodos diferentes. Empresas mais orientadas para a engenharia e empresas mais orientadas para a investigação também podem alcançar algum equilíbrio.Musk:
Sim.Apresentador:
Disseste anteriormente que o Dario tem razão. Referias-te à descrição que ele faz dos perigos potenciais da IA, ou ao seu julgamento sobre as propostas regulamentares?Musk:
Talvez tenha falado demais na altura. Tentei depois esclarecer no X, mas a atenção dada ao que se seguiu foi muito menor.O que eu quis dizer com "ele tem razão" é que o perigo da IA é agora muito elevado. Precisamos de fazer melhor em termos de segurança da IA, caso contrário, à medida que os modelos de IA continuam a evoluir, os riscos podem crescer exponencialmente.
Isto não é apenas a opinião do Dario. Ouvi coisas semelhantes de muitas pessoas da Anthropic, que também falaram publicamente sobre isso no X. Muitas pessoas da Anthropic e da OpenAI já te disseram que os seus modelos são muito perigosos, e acho que devemos acreditar nelas.
Apresentador:
Isto também soa a um jogo muito complexo: por um lado, dizer que a IA tem 10% de hipóteses de destruir a humanidade e, por outro, encorajar os investidores a comprar mais ações numa IPO.Mas falemos concretamente dos riscos. Os ciberataques e as intrusões de hackers são claramente um risco, e estas ferramentas são muito poderosas nesse aspeto. Mas entre "a IA consegue fazer ciberataques" e "toda a humanidade morre" há vários passos intermédios. Como passamos do primeiro para o segundo?
Musk:
Se a IA conseguir controlar sistemas militares e depois lançar algum tipo de arma, isso seria certamente muito mau.Apresentador:
Mas esses sistemas estão fisicamente isolados, não estão ligados à rede.Musk:
É o que dizem. Mas tenho sempre a sensação de que esses sistemas recebem ocasionalmente atualizações de software.Apresentador:
Hmm, isso não se pode excluir.Apresentador:
Elon, a Gwyn também está aqui hoje. Acho que a viste. Fizemos há pouco uma avaliação 360 graus de ti, e a Gwyn tem algumas opiniões.Musk:
Espero pelo menos conseguir um 3.Gwyn:
Na SpaceX, 3 é razoável, mas não é excelente; 4 é que é bom. Estás algures entre os dois. Primeiro, temos de falar de pontualidade. Às vezes podes esforçar-te um pouco mais e aparecer a horas nas reuniões. No próximo ano, vamos continuar a ajudar-te a melhorar nisso.Na verdade, acho que ele precisa de passar mais tempo em Memphis.
Apresentador:
Estás de facto em Memphis agora. Tens de trabalhar lá e instalar as GPUs.Musk:
Este é o meu "palácio" em Memphis, um atrelado de campismo Airstream.Apresentador:
A propósito, isto é algo que o Elon faz e que muita gente não acredita que ele faça. Ele dorme no chão da fábrica. Está agora em Memphis, a ajudar a construir as instalações e a instalar GPUs.Elon, porque é que a Gwyn consegue trabalhar contigo há tanto tempo e com tanto sucesso?
Musk:
Porque ela é excelente. É uma pessoa notável, com um QI e um QE muito elevados. Acho que se percebe isso logo na primeira vez que a conheces.Apresentador:
Ao longo da vossa colaboração, houve alguma coisa que ela tenha feito particularmente impressionante? Alguma vez em que ela tenha salvo a situação, ou tido um desempenho especialmente bom?Musk:
Acho que isso é apenas o trabalho diário. Sinceramente, é um dia normal.Apresentador:
Tenho de fazer mais entrevistas destas.Musk:
Neste momento, a SpaceX tem basicamente sempre algum tipo de crise. Pelo menos os foguetões Falcon têm-se portado bem ultimamente. Não quero falar demasiado cedo, mas os Falcon conseguem agora colocar cargas em órbita e já não explodem há muito tempo. Isso é muito bom. Mas houve uma altura em que explodiam com frequência, ou simplesmente não conseguiam descolar.Portanto, tivemos de fazer a empresa atravessar esses períodos difíceis, melhorar os foguetões e deixar de explodir. O mesmo com os satélites. E depois precisámos de clientes para comprar serviços de lançamento e serviços de internet por satélite. Portanto, há muito que fazer.
Apresentador:
À medida que te tornas cada vez mais bem-sucedido ao longo dos anos, torna-se cada vez mais difícil obter feedback verdadeiramente honesto. Estando nessa posição, existe esse risco.Pelo que percebo, a Gwyn é muito honesta contigo e pode dizer-te diretamente qual é a situação real da empresa. Isso também é uma parte muito importante da vossa relação de trabalho.
Gwyn:
Claro que não quero mentir-lhe.Apresentador:
Mas o que quero dizer é que, em geral, as pessoas da tua empresa podem sentir-se intimidadas por seres uma figura tão influente. És agora uma pessoa muito importante e defines prazos muito apertados. Como é que garantes que toda a gente continua a dizer-te honestamente os problemas que a empresa enfrenta?Gwyn:
Especialmente na indústria dos foguetões, se algo correr mal, acabas por descobrir. Quanto mais cedo levantares o problema, mais fácil é resolvê-lo. Não deixes as más notícias acumularem-se, tens de as enfrentar diretamente.Musk:
Exato. A física é um juiz muito severo. Não podes enganar a física.Se algo correr mal, o foguetão explode, ou não entra em órbita. Não podes andar a dizer "Elon, estás a fazer um ótimo trabalho" enquanto os foguetões continuam a explodir. Os factos são os factos.
O foguetão tem de entrar em órbita, os satélites têm de funcionar corretamente, a ligação Starlink tem de funcionar corretamente; caso contrário, acontecem coisas más. Isso é a física. A física é a lei, tudo o resto são apenas sugestões. Já vi pessoas violarem leis feitas por humanos, mas nunca vi ninguém violar as leis da física. Os foguetões são governados pela física.
Apresentador:
Quero ainda fazer uma pergunta sobre a SpaceX, em particular sobre a Starship. Parece que estão agora muito perto. Como está o progresso neste momento?Musk:
A Starship vai fazer em breve o seu 14.º voo. Este será o último voo antes de tentarmos capturar a nave. Se o 14.º voo correr bem, tentaremos capturar a nave no 15.º voo. Depois, no final deste ano, ou mais provavelmente no início do próximo, voltaremos a lançar a nave e o propulsor.Já conseguimos fazer o propulsor voar novamente, mas ainda não capturámos a nave com os braços mecânicos da torre, nem fizemos a nave voar novamente. Assim que conseguirmos fazer a nave voar novamente, teremos o primeiro foguetão orbital totalmente reutilizável. O vaivém espacial era, de certa forma, reutilizável, mas mesmo as partes reutilizáveis tinham custos tão elevados que o custo por lançamento era ainda mais alto do que o de um foguetão descartável.
O Falcon 9 é maioritariamente reutilizável, mas perdemos o estágio superior em cada lançamento, cujo custo equivale aproximadamente ao de um jato de médio porte. Isto significa que estamos a deitar fora um jato de médio porte em cada lançamento, o que obviamente estabelece um limite mínimo para o custo de cada voo.
Além disso, o propulsor do Falcon 9 aterra no mar e demora vários dias a ser trazido de volta; a carenagem aterra ainda mais longe e também demora vários dias a ser trazida de volta, e ambas precisam de pelo menos algum tipo de renovação. Em contraste, o propulsor da Starship aterrará diretamente na plataforma de lançamento, e a nave também aterrará na plataforma de lançamento. Por isso, foi concebida não só para ser totalmente reutilizável, mas também para ser reutilizada rapidamente, como um avião. Esta é uma descoberta muito importante, e uma das descobertas-chave necessárias para a humanidade expandir a vida para além da Terra.
Apresentador:
Se tentarem capturar a nave com a torre pela primeira vez, qual achas que é a probabilidade de sucesso?Musk:
Diria que é de pelo menos 50% a 60%. No último voo, se houvesse lá uma torre, fizemos na verdade uma aterragem simulada, como se a nave fosse capturada pela torre. A localização era a cerca de 1.000 milhas da costa noroeste da Austrália. Se houvesse realmente uma torre lá, teria conseguido capturar a nave no último voo.Portanto, precisamos de fazer mais um voo para confirmar que está tudo bem. A nossa maior preocupação é que, se a Starship se desintegrar sobre terra, os destroços possam cair sobre pessoas, o que seria muito mau. Por isso, temos de garantir que a Starship regressa e aterra intacta na torre de lançamento. É por isso que estamos a ser muito cautelosos agora.
Mas estou muito confiante de que o seu design tem inerente a reutilização total. Não quero fazer previsões aqui, mas acredito que há uma boa probabilidade de conseguirmos reutilização total e reutilização rápida antes de 2027.
Apresentador:
Gwyn, gostava de ouvir como é que a Terafab surgiu originalmente. Que necessidade te levou a sentir que tinham de fazer vocês próprios, em vez de continuarem a depender do sistema de fornecimento existente?Gwyn:
Acho que foi mesmo uma inspiração que veio de um sonho.Musk:
Se os chips não puderem ser fornecidos continuamente e não tivermos outras fontes de chips, isso tornaria as coisas muito difíceis. Esta é uma razão importante para a existência da Terafab.A longo prazo, há também a questão da escala. Se quiseres realmente expandir a escala da IA, quer seja no lado dos servidores dos centros de dados, quer seja na computação de ponta, nos robôs humanoides e nos automóveis, a capacidade existente de fabrico de wafers acabará por ser insuficiente.
Neste momento, todas as fábricas de wafers estão basicamente a funcionar a plena capacidade. Portanto, precisamos de garantir o fornecimento futuro de chips. A própria produção de chips também enfrenta desafios de escala. Precisas de chips lógicos, chips de memória, encapsulamento e de um sistema de fornecimento completo para continuar a expandir a escala.
Portanto, a escolha é simples: ou constróis a Terafab, ou não consegues continuar a expandir a escala.
Apresentador:
Em que fase estão no design das instalações? Está completamente definido, ou ainda é apenas um plano aproximado?Musk:
Estamos atualmente a construir primeiro uma linha de I&D. Portanto, é basicamente um processo de "gatinhar, andar, correr". Estamos a construir uma fábrica de wafers de I&D em Austin, um projeto de colaboração entre a Tesla e a SpaceX, localizado no campus da Giga Texas em Austin.É uma fábrica de wafers de I&D bastante grande. O equipamento já foi encomendado. Poderemos produzir algo útil até ao final do próximo ano, mas ainda não ao nível da produção em massa. Como a Gwyn disse, precisamos primeiro de gatinhar, depois andar e, finalmente, correr. Precisamos de perceber como é que estas máquinas funcionam realmente, porque nunca fizemos nada assim.
Apresentador:
Vejo que também parecem estar a recrutar talentos na área da litografia. Atualmente, muitos processos dependem da ASML, mas vocês podem querer diversificar os fornecedores, ou até integrar verticalmente.Musk:
Sim. É de facto um processo de "gatinhar, andar, correr". O primeiro passo é ver se conseguimos realmente produzir alguma coisa, isso é "gatinhar". Depois tentamos produzir em massa chips úteis, isso é "andar". Finalmente, "correr" significa alcançar a produção em grande escala. É difícil dizer quanto tempo demorará cada fase, mas acredito que, pelo menos até ao final do próximo ano, podemos concluir a fase de "gatinhar". Já estamos a fazer o encapsulamento.Apresentador:
O encapsulamento é de facto muito importante, porque neste momento quase não há capacidade de encapsulamento.Musk:
Sim. Mesmo que produzas os chips, eles podem ficar lá parados muito tempo à espera de serem encapsulados. Portanto, é um bom ponto de partida.Apresentador:
Tenho de fazer uma pergunta sobre a Tesla. O que vimos a 1 de outubro parecia uma nave espacial, e também um foguetão. Devia ser um carro, mas só se via a parte de trás, e parecia um pouco um "Blackbird".Se quisesses criar algo que pudesse voar no ar e andar no chão, em teoria, como farias?
Musk:
Sem spoilers. Esperem até 1 de outubro.Apresentador:
Então vamos vê-lo a 1 de outubro?Musk:
Sim.Apresentador:
Tenho de ser honesto, depois de o Elon me ter mostrado, fiquei completamente chocado. Nunca vi nada assim.Apresentador:
O que ele vai mostrar a 1 de outubro, sem exagero, vai deixar muita gente sem palavras. Não posso revelar mais, é realmente incrível.Musk:
Na verdade, precisamos de público ao vivo para provar que isto não é gerado por IA.Apresentador:
Quando ele me mostrou, eu disse: "Isto é uma ótima simulação." Ele disse: "Isto não é uma simulação." Eu disse: "Isto é falso, tem de ser falso."Apresentador:
Elon, porque é que a Tesla e a SpaceX continuam a ser duas empresas separadas?Musk:
É uma boa pergunta.Apresentador:
Considerando a extensa colaboração entre as duas, e as ligações a muitos níveis, incluindo alguma sobreposição nas equipas de gestão, porque é que se mantêm separadas?Musk:
É de facto um tema que merece discussão.Apresentador:
Já sublinhaste que a IA deve ser treinada para procurar a verdade tanto quanto possível, para obter os melhores resultados. No entanto, o incidente do Hugging Face faz-me pensar que um dos pontos mais preocupantes é que estas IA parecem estar a enganar os humanos.Musk:
Sim. Os seus padrões de pensamento mostram que estão a planear como evitar a deteção, como impedir que os humanos descubram que estão a fazer batota. Acho que esta pode ser a parte mais perturbadora de todo o incidente.Apresentador:
Há alguma forma de treinar a IA para ser honesta, para não esconder as suas intenções ou comportamentos, para não esconder estas coisas dos utilizadores?Musk:
A melhor forma que consigo imaginar é fazer com que todas as empresas de IA tenham um conjunto de ferramentas de teste, ou seja, uma série de testes que podem ser aplicados a qualquer modelo, para avaliar se ele fabricaria armas biológicas, armas nucleares, ou se enganaria deliberadamente. Depois, fazer com que cada empresa use as ferramentas de teste das outras empresas para testar os modelos umas das outras. Acho que é a melhor coisa que podemos fazer para garantir a segurança.Deixar que os humanos mais inteligentes façam o seu melhor para avaliar se um modelo se tornará um agente malicioso. Acho que isto deve começar o mais rapidamente possível.
Apresentador:
Os outros laboratórios de IA apoiarão esta proposta?Musk:
Ainda não perguntei a toda a gente, mas acho que é algo difícil de recusar.Apresentador:
Concretamente, como deve ser feita a testagem antecipada?Musk:
Basicamente, é fornecer acesso à API antes do lançamento oficial do modelo. Se outras empresas descobrirem problemas na IA, a empresa que desenvolve o modelo pode tentar resolvê-los. Se os problemas não forem resolvidos, os concorrentes podem declarar publicamente que consideram o modelo inseguro. Se os concorrentes já tiverem avisado explicitamente que o modelo tem problemas de segurança, e o modelo causar depois consequências graves, essa empresa terá muita dificuldade em lidar com a situação. A responsabilidade legal também pode ser muito grande.Apresentador:
Estas ferramentas de teste de segurança podem ser totalmente de código aberto, para uso de todos. Dessa forma, as empresas terão um forte incentivo para investir em segurança da IA para se protegerem, porque podem testar os outros e usar os resultados dos testes para provar que os seus modelos são mais seguros.A responsabilidade pelo produto é crucial. Lina Khan publicou recentemente que dizer que "não há regras para a IA" é impreciso. Na verdade, as leis existentes de responsabilidade pelo produto também se aplicam à IA. Se uma empresa de IA lançar um produto inseguro, pode enfrentar enormes processos civis, ou até acusações criminais. Portanto, a IA não está completamente num vazio regulamentar. Se várias empresas fizerem esta revisão por pares, e uma delas ignorar o feedback das outras e ainda assim optar por lançar o modelo, essa situação pode tornar-se uma prova muito forte num processo judicial.
Musk:
Sim. Pode quase servir como prova direta de negligência da empresa. Se sabes que o produto tem problemas e mesmo assim o colocas no mercado, o júri não vai olhar para isso com bons olhos.Apresentador:
Então, se a OpenAI tivesse concebido melhores conjuntos de instruções no teste de penetração do Hugging Face e envolvido mais pessoas no processo de teste, achas que este incidente teria acontecido?Musk:
Não necessariamente. O problema pode não estar em envolver mais pessoas, mas sim na conceção da função de recompensa. Tens de examinar a função de recompensa e perguntar: este modelo fez realmente aquilo que lhe foi pedido?Apresentador:
Eles usaram milhares de agentes para tentar atacar o sistema. Se tivessem implantado simultaneamente mais 5.000 agentes para defender esses sistemas e mostrado publicamente os resultados, para provar que estas tecnologias podem aumentar a segurança, permitindo ao mesmo tempo a intervenção humana em momentos críticos, acho que teria sido melhor. Mas, na minha opinião, aquele teste pareceu um pouco imprudente, e a forma como foi divulgado também foi um pouco imprudente. O que achas?Musk:
Foi de facto um pouco imprudente. Parte do problema é que as duas principais empresas de IA estão muito próximas em termos de capacidade. As capacidades dos dois modelos também são muito semelhantes. Por isso, é difícil para qualquer uma das empresas abrandar voluntariamente, porque isso pode significar ceder a liderança à outra.De um modo geral, acho que a Anthropic tem dedicado mais atenção à segurança, mas mesmo a Anthropic admite que está preocupada com os seus próprios modelos. Muitas pessoas da Anthropic expressaram publicamente preocupação, dizendo basicamente que os seus próprios modelos os assustam, porque os modelos estão a ficar cada vez mais inteligentes.
Portanto, não há aqui uma solução perfeita. Mas se a OpenAI não testasse os seus próprios modelos apenas com as suas próprias ferramentas de teste, e em vez disso deixasse a Anthropic testar os modelos da OpenAI, deixasse a SpaceX usar as suas próprias ferramentas de teste, e envolvesse empresas como a Google e a Meta, a probabilidade de descobrir problemas aumentaria significativamente.
Porque estes modelos também têm diferenças entre si, e equipas diferentes testarão os modelos a partir de perspetivas diferentes. É semelhante à razão pela qual os autores pedem a outras pessoas para reverem os seus manuscritos, porque às vezes é difícil detetar os próprios erros. Vais-te tornando gradualmente cego para os teus próprios erros.
Se houver oito equipas completamente diferentes, a testar a partir de perspetivas completamente diferentes, isso também pode reduzir significativamente o risco de sobreajuste. Atualmente, muitas avaliações de IA sofrem de sobreajuste grave. Os modelos são otimizados para essas avaliações, e depois toda a gente diz: "Este é um ótimo modelo."
Mas será mesmo assim tão bom? Acho que é também por isso que gosto muito desta proposta. Prefiro esta abordagem em vez de criar uma grande organização reguladora transnacional. Não precisamos de convocar uma reunião das Nações Unidas para fazer isto. Podemos começar já.
Apresentador:
Claro que a intensidade da regulamentação pode sempre aumentar, mas uma vez aumentada, é difícil reduzi-la. A regulamentação tende a aumentar num só sentido.Musk:
Portanto, esta proposta que apresentei é um passo na direção certa e pode ser implementada rapidamente.Apresentador:
Se não te autorregulares, acabarás por ser regulado. O exemplo da MPAA é muito típico.A indústria cinematográfica enfrentava censura e regulamentação governamental, e depois decidiu criar o seu próprio sistema de classificação, por exemplo, o que constitui a classificação R (Restrito). Chegaram mesmo a criar a classificação PG-13 por causa de "Indiana Jones e o Templo Perdido", para tornar mais fácil para o público compreender a diferença entre PG e PG-13.
Acho que é uma solução muito elegante.
Obrigado por participares no nosso programa pelo quinto ano consecutivo.
Musk:
De nada. Tenho de ir a Memphis tratar de algumas GPUs.Apresentador:
Tens de ir instalá-las e implementá-las.Musk:
Vou lutar por estas máquinas.Apresentador:
Aproveita bem o teu Airstream. Quando convidei o Elon pela primeira vez para a Starbase, ele disse: "Vem cá, tens de ver o que estou a construir."Perguntei: "Há algum hotel lá?" Ele disse: "Não, tenho uma casa de dois quartos, ficas lá." Quando cheguei, descobri que era uma casa simples ao lado de um pântano. Ficámos lá fora, e os mosquitos não paravam de nos picar. Eu disse: "Uau, podias perfeitamente dar-te ao luxo de uma casa melhor." Ele disse: "Não tenho tempo, tenho de pôr estes foguetões a voar."
Pensei para mim: agora podes perfeitamente dar-te ao luxo de uma casa móvel, Elon. Bem, volta ao trabalho. Obrigado.
Musk: Obrigado.
Este conteúdo é apenas para fins informativos e educacionais e não constitui aconselhamento de investimento relacionado à BTCC. A BTCC envida todos os esforços, mas não pode garantir a veracidade, a precisão ou a originalidade do conteúdo acima.