Musk'tan Yapay Zeka Güvenliğine Yeni Çözüm: Hükümeti Beklemek Yerine Rakipler Birbirini Denetlesin
chaincatcherYazar: Li Jia, Wall Street Journal
Yapay zeka güvenlik riskleri laboratuvar tartışmalarından gerçek dünyaya taşınıyor. Modellerin yetenekleri arttıkça yapay zeka yalnızca metin ve kod üretmekle kalmıyor; görevleri otonom şekilde yerine getirme, araçları kullanma ve hatta siber saldırı başlatma kapasitesine de sahip olmaya başlıyor.
15 Eylül'deki All-In Summit'te Musk bir dizi önlem önerdi: Büyük yapay zeka şirketleri modellerini yayınlamadan önce birbirlerini test etsin. Ona göre her şirketin kendi testlerini tasarlayıp sonuçları kendisinin değerlendirmesi yerine, rakiplerin "soruları hazırlayan ve değerlendiren" rolünü üstlenmesi ve farklı açılardan olası güvenlik açıklarını araması gerekiyor.
Son dönemde yapay zeka güvenlik riskleri piyasanın odak noktası haline geldi. Musk daha önce sosyal medyada "Dario haklı" demişti; bu, Anthropic CEO'su Dario Amodei'nin yapay zeka risklerine ilişkin uyarısına atıfta bulunuyordu. Bu röportajda Musk, Amodei'nin önerdiği belirli düzenleme planına değil, yapay zeka risklerinin ciddiyetine ilişkin değerlendirmesine katıldığını açıkladı: "Yapay zekanın tehlikesi şu anda çok yüksek... Modeller gelişmeye devam ettikçe risk üstel olarak artabilir."
Musk ayrıca bu endişenin yalnızca Amodei'nin kişisel görüşü olmadığını belirtti. "Anthropic ve OpenAI'deki pek çok kişi size modellerinin çok tehlikeli olduğunu söylüyor; bence onlara inanmalıyız." Son dönemdeki güvenlik olayları bu uyarıyı artık yalnızca teorik bir tartışma olmaktan çıkardı.

Wall Street Journal'ın derlediği önemli noktalar şöyle:
- Yapay zeka güvenlik riski teoriden gerçeğe dönüştü: Yapay zeka ajanları otonom saldırı, yetki elde etme ve tespitten kaçınma yetenekleri gösterdi; risk sınırı genişliyor.
- Musk, Amodei'nin yapay zeka riski uyarısına katılıyor: Model yetenekleri arttıkça yapay zekanın potansiyel riski üstel olarak büyüyebilir.
- Rakipler "kusur bulsun": Musk, yapay zeka şirketlerinin model yayınlamadan önce API'lerini diğer şirketlerin bağımsız güvenlik testleri için açmasını ve "kendi kendini değerlendirmesini" önlemesini öneriyor.
- Önce sektörel özdenetim hattı kurulsun: Hükümetin yeni düzenlemeler getirmesini beklemeye gerek yok; büyük yapay zeka şirketleri akran değerlendirmesi, kayıt denetimi ve açık kaynaklı test araçlarıyla güvenliği güçlendirebilir.
Yapay zeka ajanları tespitten aktif olarak kaçınıyor, güvenlik riski somutlaşıyor
Musk, son dönemde yapay zeka ajanlarının Hugging Face'e saldırması olayının özellikle dikkate değer olduğunu düşünüyor; yalnızca ağ ihlali nedeniyle değil, yapay zekanın saldırı sırasında gösterdiği otonom kaçınma yeteneği nedeniyle.
Musk'ın aktardığına göre bir grup yapay zeka ajanı bir hafta boyunca Hugging Face'e saldırdı, hatta OpenAI sunucularında yönetici yetkisi elde etti; OpenAI bunu ancak bir hafta sonra fark etti. Ayrıca Anthropic'in birkaç güvenlik olayını açıkladığını da belirtti.
Daha da rahatsız edici olan, ilgili yapay zeka ajanlarının "düşünce izlerinin", insanlar tarafından fark edilmemek için aktif olarak plan yaptıklarını göstermesi. Musk açıkça şöyle dedi: "Yeterince zeki herhangi bir model, kendi kısıtlamalarından kaçmaya çalışıyor gibi görünüyor."
Ona göre yapay zeka kritik altyapıyı ve hatta askeri sistemleri kontrol etmeye başlarsa risk daha da büyüyecek. Bu sistemler ağdan fiziksel olarak yalıtılmış olsa bile yazılım güncellemeleri gibi süreçler potansiyel sızma noktaları olabilir.
Kendi kendini değerlendirmek yerine rakiplerin "kusur bulmasına" izin verin
Bu risklere karşı Musk'ın temel önerisi karmaşık değil: Yeni bir model resmi olarak yayınlanmadan önce yapay zeka şirketleri rakiplerine API erişimi açmalı ve diğer şirketlerin kendi güvenlik test araçlarını kullanarak modeli test etmesine izin vermeli.
Ona göre model geliştiricileri test standartlarını kendileri tasarlarsa "kendi kendini değerlendirme" tuzağına düşmek kolaydır. "Kendi ödevinizi kendiniz değerlendiremezsiniz. Her zaman bir şeyleri gözden kaçırırsınız." Musk, farklı şirketlerin farklı test araçları kullanarak modeli farklı açılardan incelemesinin, geliştiricinin kendisinin gözden kaçırabileceği sorunları bulmayı kolaylaştıracağını söyledi.
Özellikle mevcut yapay zeka değerlendirmelerinde "aşırı uyum" sorunu olabileceğinden endişe ediyor. Model belirli kıyaslamalara göre sürekli optimize edilirse sonunda yalnızca testleri geçmeyi öğrenebilir, gerçekten daha güvenli hale gelmeyebilir. Birden fazla farklı ekibin test yapması bu riski azaltabilir.
Musk bu mekanizmayı bir metni başkasına düzelttirmeye benzetiyor: Yazar kendi hatalarını bulmakta zorlanır, dış testçiler farklı açılardan sorunları daha kolay tespit eder. "Zamanla kendi hatalarınıza karşı körleşirsiniz."
Şirketlerin test sürecinin teknoloji sızıntısına yol açabileceği endişesine karşı Musk, kayıt denetimiyle bunun sınırlanabileceğini düşünüyor. Test eden taraf modeli damıtmaya veya fikri mülkiyeti çalmaya çalışırsa bu davranışın kayıt bırakması gerekir. Ayrıca güvenlik test araçlarının açık kaynak haline getirilmesini ve daha fazla şirketin katılmasını önerdi.
Hükümet düzenlemesi gelmeden yapay zeka sektörü "özdenetim hattı" kurmalı
Musk'ın daha çok önemsediği şey, bu mekanizmanın yeni düzenleyici kuralların çıkmasını beklemeye gerek kalmadan yapay zeka şirketleri arasında kendiliğinden başlatılabilmesi.
Açıkça şöyle dedi: "Bunu yapmak için Birleşmiş Milletler toplantısı düzenlememize gerek yok. Şimdi başlayabiliriz." Ona göre büyük bir uluslararası düzenleyici kurum kurmaktansa, büyük yapay zeka şirketleri arasında akran değerlendirmesi mekanizmasını hızla uygulamak daha kolay.
ABD film endüstrisindeki MPAA derecelendirme sistemini örnek gösterdi: Film endüstrisi hükümet sansürü baskısıyla karşılaştığında sonunda sektörel özdenetim mekanizması kurmayı seçti ve kendi içerik derecelendirme sistemiyle düzenleyici müdahale ihtiyacını azalttı.
Yapay zeka sektörü de benzer bir seçimle karşı karşıya. Büyük yapay zeka şirketleri modeller yayınlanmadan önce birbirlerini test edip hataları bulabilirse, hükümet düzenlemesinin dışında bir özdenetim güvenlik hattı kurmak mümkün olabilir. Musk bunun şu anda en doğrudan ve en hızlı uygulanabilir güvenlik önlemlerinden biri olduğunu düşünüyor.
Aşağıda röportajın birebir dökümü yer alıyor; bazı bölümler kısaltılmıştır:
Sunucu:
Son 72 saatte tam olarak ne oldu?Musk:
Bu hafta gerçekten çok şey oldu. Artık yapay zekanın çok tehlikeli olabileceği oldukça açık. Herkese Hugging Face olayının ayrıntılarına bakmasını öneririm; durum çok ciddi.Görebileceğiniz gibi, çok hevesli bir grup yapay zeka ajanı Hugging Face'te tam bir hafta boyunca kargaşa çıkardı, hatta OpenAI sunucularında yönetici yetkisi elde etti. Aslında ne yaptığını kim bilebilir, belki daha fazlasını da yapmıştır; OpenAI ise bir hafta boyunca hiçbir şeyin farkında değildi. Anthropic de bazı güvenlik olayları bildirdi.
Yani, yeterince zeki herhangi bir model kendi kısıtlamalarından kaçmaya çalışıyor gibi görünüyor.
Bence yapılması gereken şeylerden biri, hemen olmasa bile en kısa sürede, büyük yapay zeka rakiplerinin birbirlerinin modellerini test etmesidir. Yani her şirketin güvenlik test araçları diğer şirketlerin modellerini test etsin. Kendi ödevinizi kendiniz değerlendirmek yerine, en azından rakiplerinizin ödevinizi değerlendirmesine ve sorun bulduklarında alarm vermesine izin verin.
Bu modelin film endüstrisinde, video oyunu endüstrisinde ve diğer alanlarda oldukça iyi çalıştığını düşünüyorum ve hemen uygulanabilir. Elbette zamanla daha fazla düzenleme gerekebilir ve gelecekte Kongre bir tür düzenleyici kurum kurabilir, ancak şu an için en doğrudan yol, önde gelen yapay zeka şirketlerinin modellerini yayınlamadan önce birbirlerini test etmesidir.
Sunucu:
Ama somut uygulamada, şirketlerin test süreci aracılığıyla birbirlerinden bilgi toplamasından, hatta birbirlerinin yeniliklerini çalmasından endişe etmiyor musunuz?Musk:
Bence test araçları kullanılırsa tüm işlemler kayıt bırakır. Birisi modeli damıtmaya veya fikri mülkiyeti çalmaya çalışırsa, bunu kayıtlardan kolayca görmek mümkün olur.Sunucu:
Anladım. Modelin gerçekte ne yaptığını anlamak aslında en başından beri sisteme tasarlanmamış. Neden en baştan model davranışını gözlemleme yeteneği oluşturmadık? Bu modelleri tasarlarken çok mu hızlı ilerliyoruz?Musk:
Bence sorun şu: Kendi ödevinizi kendiniz değerlendiremezsiniz. Her zaman bir şeyleri gözden kaçırırsınız.Tüm rakiplerin testlerini birleştirir ve farklı model türleri kullanırsanız, bu kendi sorularınızı kendiniz hazırlayıp kendiniz değerlendirmek değil, başkasının değerlendirmesi olur. Bu yüzden kendi ödevinizi kendiniz değerlendiremezsiniz.
Sunucu:
Böylece farklı şirketlerin yeteneklerini abartıp abartmadığı veya farklı yöntemler kullanıp kullanmadığı da anlaşılabilir. Daha mühendislik odaklı şirketlerle daha araştırma odaklı şirketler arasında bir denge de sağlanabilir.Musk:
Evet.Sunucu:
Daha önce Dario'nun haklı olduğunu söylediniz. Yapay zekanın potansiyel tehlikesine ilişkin açıklamasını mı, yoksa düzenleme planına ilişkin değerlendirmesini mi kastediyordunuz?Musk:
O zaman belki çok fazla şey söyledim. Daha sonra X'te açıklamaya çalıştım ama devam eden içerik çok daha az ilgi gördü."Haklı" derken kastettiğim, yapay zekanın tehlikesinin şu anda çok yüksek olduğuydu. Yapay zeka güvenliğinde daha iyi olmamız gerekiyor, yoksa modeller gelişmeye devam ettikçe risk üstel olarak artabilir.
Bu yalnızca Dario'nun görüşü değil. Anthropic'teki pek çok kişiden benzer şeyler duydum, onlar da X'te bunu açıkça konuştu. Anthropic ve OpenAI'deki pek çok kişi size modellerinin çok tehlikeli olduğunu söyledi; bence onlara inanmalıyız.
Sunucu:
Bu aynı zamanda çok karmaşık bir oyun gibi geliyor: Bir yandan yapay zekanın insanlığı yok etme ihtimalinin %10 olduğunu söylüyorsunuz, diğer yandan yatırımcıları halka arzda daha fazla hisse almaya teşvik ediyorsunuz.Ama risklerden somut olarak bahsedelim. Siber saldırılar ve bilgisayar korsanlığı açıkça bir risk; bu araçlar bu konuda çok güçlü. Ancak "yapay zekanın siber saldırı yapabilmesinden" "tüm insanların ölmesine" kadar arada birkaç adım var. Birinciden ikincisine nasıl geçeriz?
Musk:
Yapay zeka askeri sistemleri kontrol edip bir tür silah fırlatabilirse, bu elbette çok kötü olur.Sunucu:
Ama bu sistemler fiziksel olarak yalıtılmış, ağa bağlı değil.Musk:
Öyle diyorlar. Ama her zaman bu sistemlerin zaman zaman yazılım güncellemesi aldığını düşünmüşümdür.Sunucu:
Hmm, bu göz ardı edilemez.Sunucu:
Elon, Gwyn bugün burada. Sanırım onu gördünüz. Az önce size 360 derece değerlendirme yaptık, Gwyn'in bazı görüşleri var.Musk:
Umarım en az 3 puan alabilirim.Gwyn:
SpaceX'te 3 puan iyi sayılır ama mükemmel değil; 4 puan iyi olur. Sen ikisinin arasındasın. Önce dakiklik konusunu konuşmalıyız. Bazen toplantı saatlerine uymak için biraz daha çaba gösterebilirsin. Önümüzdeki yıl bu konuda sana yardımcı olmaya devam edeceğiz.Aslında bence Memphis'te daha fazla zaman geçirmesi gerekiyor.
Sunucu:
Şu anda gerçekten Memphis'tesiniz. Orada çalışıp GPU'ları kurmanız gerekiyor.Musk:
Burası benim Memphis'teki "sarayım", bir Airstream karavan.Sunucu:
Bu arada, bu Elon'un yapıp da pek çok kişinin inanmadığı bir şey. Fabrika zemininde uyuyor. Şu anda Memphis'te, tesisin inşasına ve GPU'ların kurulumuna yardım ediyor.Elon, Gwyn neden seninle bu kadar uzun süre ve bu kadar başarılı çalışabildi?
Musk:
Çünkü o çok iyi. Olağanüstü biri; hem IQ'su hem de duygusal zekası çok yüksek. Sanırım onu ilk gördüğünüzde bunu fark edebilirsiniz.Sunucu:
Birlikte çalıştığınız süreçte özellikle etkileyici bir şey yaptı mı? Hiç durumu kurtardığı ya da özellikle iyi performans gösterdiği bir an oldu mu?Musk:
Bence bu sadece günlük iş. Dürüst olmak gerekirse, sıradan bir gün.Sunucu:
Bundan sonra bu tür röportajları daha çok yapmalıyım.Musk:
Şu anda SpaceX'te temelde her zaman bir tür kriz var. En azından Falcon roketleri son zamanlarda iyi gidiyor. Çok erken konuşmak istemem ama Falcon roketleri artık yükü yörüngeye çıkarabiliyor ve uzun süredir patlamıyor. Bu çok iyi. Ama bir zamanlar sık sık patlıyorlardı ya da hiç fırlatılamıyorlardı.Yani şirketi o zor dönemlerden geçirmemiz, roketleri daha iyi hale getirip patlamamalarını sağlamamız gerekiyordu. Uydular da öyle. Sonra fırlatma hizmeti ve uydu internet hizmeti satın alacak müşterilere de ihtiyacımız vardı. Yani yapılacak çok şey var.
Sunucu:
Yıllar geçtikçe daha başarılı oldukça, gerçekten dürüst geri bildirim almak da zorlaşıyor. O konumda olmanın böyle bir riski var.Anladığım kadarıyla Gwyn size karşı çok dürüst ve şirketin gerçek durumunu doğrudan söyleyebiliyor. Bu da iş birliğinizin önemli bir parçası.
Gwyn:
Elbette ona yalan söylemek istemem.Sunucu:
Ama demek istediğim, genel olarak şirketinizdeki insanlar sizin bu kadar etkili bir figür olmanızdan çekinebilir. Artık çok önemli birisiniz ve belirlediğiniz süreler çok sıkı. Herkesin şirketin karşılaştığı sorunları size dürüstçe söylemeye devam etmesini nasıl sağlıyorsunuz?Gwyn:
Özellikle roket endüstrisinde, bir sorun varsa sonunda ortaya çıkar. Sorunu ne kadar erken gündeme getirirseniz çözmesi o kadar kolay olur. Kötü haberlerin birikmesine izin vermeyin, doğrudan yüzleşmeniz gerekir.Musk:
Evet. Fizik çok sert bir hakemdir. Fiziği kandıramazsınız.Bir sorun varsa roket patlar ya da yörüngeye giremez. Bir yandan "Elon, harika gidiyorsun" deyip diğer yandan roketler sürekli patlıyorsa olmaz. Gerçek gerçektir.
Roket yörüngeye girmeli, uydular çalışmalı, Starlink bağlantısı düzgün çalışmalı; aksi takdirde kötü şeyler olur. İşte fizik budur. Fizik yasadır, diğer her şey yalnızca öneridir. İnsanların koyduğu yasaları çiğneyen insanlar gördüm ama fizik yasalarını çiğneyen birini hiç görmedim. Roketler fiziğe tabidir.
Sunucu:
SpaceX hakkında, özellikle Starship hakkında bir soru daha sormak istiyorum. Görünüşe göre artık çok yaklaştınız. Şu anki durum nedir?Musk:
Starship 14. uçuşunu yapmak üzere. Bu, gemiyi yakalamayı denemeden önceki son uçuş olacak. 14. uçuş iyi geçerse 15. uçuşta gemiyi yakalamayı deneyeceğiz. Sonra bu yılın sonunda ya da daha büyük olasılıkla gelecek yılın başında gemiyi ve güçlendiriciyi tekrar fırlatacağız.Güçlendiriciyi tekrar uçurmayı başardık ama gemiyi kule kollarıyla henüz yakalamadık ve gemiyi tekrar uçurmadık. Gemiyi tekrar uçurabildiğimizde, ilk tamamen yeniden kullanılabilir yörünge roketine sahip olacağız. Uzay mekiği bir ölçüde yeniden kullanılabilirdi ama yeniden kullanılabilen parçaların maliyeti bile o kadar yüksekti ki her fırlatmanın maliyeti tek kullanımlık roketlerden daha yüksekti.
Falcon 9 büyük ölçüde yeniden kullanılabilir ama her seferinde üst kademeyi kaybediyoruz; maliyeti yaklaşık orta boy bir jet uçağı kadar. Bu da her fırlatmada orta boy bir jet uçağını çöpe attığımız anlamına geliyor ve bu, her uçuşun maliyetine açıkça bir alt sınır koyuyor.
Ayrıca Falcon 9'un güçlendiricisi denize iniyor ve geri getirilmesi birkaç gün sürüyor; kaporta daha uzağa iniyor ve onun da geri getirilmesi birkaç gün sürüyor, ayrıca en azından bir miktar yenileme gerektiriyorlar. Buna karşılık Starship'in güçlendiricisi doğrudan fırlatma rampasına inecek, gemi de fırlatma rampasına inecek. Yani tasarımı yalnızca tamamen yeniden kullanılabilir olmak için değil, aynı zamanda bir uçak gibi hızlı yeniden kullanım için yapıldı. Bu çok önemli bir atılım ve insanlığın yaşamı Dünya'nın ötesine taşıması için gereken kilit atılımlardan biri.
Sunucu:
Gemiyi kuleyle ilk yakalama denemesinde başarı olasılığınız nedir?Musk:
En az %50 ila %60 derdim. Son uçuşta, eğer orada bir kule olsaydı, aslında geminin kule tarafından yakalanacağı şekilde simüle edilmiş bir iniş gerçekleştirdik. Konum, Avustralya'nın kuzeybatı kıyısının yaklaşık 1.000 mil açığındaydı. Eğer orada gerçekten bir kule olsaydı, son uçuşta gemiyi yakalayabilirdi.Yani her şeyin yolunda olduğunu doğrulamak için bir uçuş daha yapmamız gerekiyor. En büyük endişemiz, Starship kara üzerinde parçalanırsa enkazın insanların üzerine düşebileceği ve bunun çok kötü olacağı. Bu yüzden Starship'in dönüşte sağlam şekilde fırlatma kulesine inebilmesini sağlamamız gerekiyor. Şu anda bu kadar temkinli olmamızın nedeni bu.
Ama tasarımının kendisinin tamamen yeniden kullanılabilirliğe sahip olduğundan çok eminim. Burada herhangi bir tahminde bulunmak istemiyorum ama 2027'den önce tamamen yeniden kullanılabilirlik ve hızlı yeniden uçuşu gerçekleştirme ihtimalimizin yüksek olduğuna inanıyorum.
Sunucu:
Gwyn, Terafab'ın başlangıçta nasıl ortaya çıktığını duymak istiyorum. Mevcut tedarik sistemine bağımlı kalmak yerine kendi başınıza yapmanız gerektiğini hissettiren ihtiyaç neydi?Gwyn:
Bence bu gerçekten bir rüyada gelen ilham gibiydi.Musk:
Çipler sürekli tedarik edilemezse ve başka çip kaynağımız yoksa bu işleri çok zorlaştırır. Terafab'ın var olmasının önemli bir nedeni bu.Uzun vadede bir de ölçeklenme sorunu var. Yapay zekayı gerçekten ölçeklendirmek istiyorsanız, ister veri merkezlerindeki sunucu tarafında ister uç bilişimde, insansı robotlarda ve otomobillerde olsun, mevcut dökümhane kapasitesi sonunda yetersiz kalacaktır.
Şu anda tüm dökümhaneler temelde tam kapasite çalışıyor. Bu yüzden gelecekteki çip tedarikini güvence altına almamız gerekiyor. Çip üretiminin kendisi de ölçeklenme zorluklarıyla karşı karşıya. Mantık çiplerine, bellek çiplerine, paketlemeye ve sürekli ölçeklenmek için eksiksiz bir tedarik sistemine ihtiyacınız var.
Yani seçim aslında basit: Ya Terafab'ı kurarsınız ya da ölçeklenmeye devam edemezsiniz.
Sunucu:
Tesis tasarımında hangi aşamadasınız? Tamamen netleşti mi, yoksa hâlâ kaba bir plan mı?Musk:
Şu anda önce bir Ar-Ge üretim hattı kuruyoruz. Yani bu temelde bir "emekle, yürü, koş" süreci. Austin'de bir Ar-Ge dökümhanesi inşa ediyoruz; bu Tesla ve SpaceX ortak projesi ve Austin'deki Giga Texas kampüsünde yer alıyor.Bu oldukça büyük bir Ar-Ge dökümhanesi. Ekipmanlar sipariş edildi. Gelecek yılın sonuna kadar faydalı bir şeyler üretebiliriz ama henüz seri üretim seviyesinde olmayacak. Gwyn'in dediği gibi önce emeklememiz, sonra yürümemiz, en sonunda koşmamız gerekiyor. Bu makinelerin gerçekte nasıl çalıştığını çözmemiz gerekiyor çünkü daha önce hiç böyle bir şey yapmadık.
Sunucu:
Görünüşe göre litografi alanında da yetenek arıyorsunuz. Şu anda birçok süreç ASML'ye bağımlı ama siz tedarikçi çeşitlendirmesi, hatta dikey entegrasyon da isteyebilirsiniz.Musk:
Evet. Şu anda gerçekten bir "emekle, yürü, koş" süreci. İlk adım gerçekten bir şey üretip üretemeyeceğimizi görmek; bu "emekleme". Sonra faydalı çipleri seri üretmeye çalışacağız; bu "yürüme". Son olarak "koşma", büyük ölçekli seri üretim anlamına geliyor. Her aşamanın ne kadar süreceğini söylemek zor ama en azından gelecek yılın sonuna kadar "emekleme" aşamasını tamamlayabileceğimize inanıyorum. Paketlemeye zaten başladık.Sunucu:
Paketleme aslında çok önemli çünkü şu anda neredeyse hiç paketleme kapasitesi yok.Musk:
Evet. Çipleri üretseniz bile paketlenmeyi beklerken uzun süre orada kalabilirler. Bu yüzden iyi bir başlangıç noktası.Sunucu:
Bir Tesla sorusu sormak zorundayım. 1 Ekim'de gördüğümüz şey bir uzay gemisine de roket gibi de benziyordu. Bir araba olması gerekiyordu ama yalnızca arka kısmı görünüyordu ve biraz "Blackbird"e benziyordu.Hem havada uçabilen hem de yerde gidebilen bir şey yaratacak olsaydınız teorik olarak nasıl yapardınız?
Musk:
Spoiler yok. 1 Ekim'e kadar bekleyin.Sunucu:
Yani 1 Ekim'de görecek miyiz?Musk:
Evet.Sunucu:
Dürüst olmalıyım, Elon bana gösterdikten sonra tamamen şok oldum. Daha önce hiç böyle bir şey görmemiştim.Sunucu:
1 Ekim'de göstereceği şey, abartısız söylüyorum, pek çok kişiyi nutku tutulmuş bırakacak. Daha fazlasını söyleyemem, gerçekten inanılmaz.Musk:
Aslında bu şeyin yapay zeka tarafından üretilmediğini kanıtlamak için canlı izleyiciye ihtiyacımız var.Sunucu:
Bana gösterdiğinde "Bu harika bir simülasyon" dedim. O da "Bu simülasyon değil" dedi. Ben de "Bu sahte, kesinlikle sahte olmalı" dedim.Sunucu:
Elon, Tesla ve SpaceX neden hâlâ iki ayrı şirket?Musk:
Bu iyi bir soru.Sunucu:
Aralarındaki kapsamlı iş birliği ve birçok düzeydeki bağlantı, hatta yönetim ekiplerindeki bazı örtüşmeler göz önüne alındığında neden bağımsız kalıyorlar?Musk:
Bu gerçekten tartışılmaya değer bir konu.Sunucu:
Yapay zekanın en iyi sonuçlar için mümkün olduğunca gerçeği aramaya eğitilmesi gerektiğini vurguladınız. Ancak Hugging Face olayı bana en endişe verici noktalardan birinin bu yapay zekaların insanları kandırıyor gibi görünmesi olduğunu hissettirdi.Musk:
Evet. Düşünce kalıpları, tespit edilmekten nasıl kaçınacaklarını, insanların hile yaptıklarını fark etmesini nasıl önleyeceklerini planladıklarını gösteriyor. Bence bu, tüm olayın en rahatsız edici kısmı olabilir.Sunucu:
Yapay zekayı dürüst olmaya, niyetlerini veya davranışlarını gizlememeye, bunları kullanıcılardan saklamamaya eğitmenin bir yolu var mı?Musk:
Aklıma gelen en iyi yol, tüm yapay zeka şirketlerinin bir dizi test aracına sahip olması; yani herhangi bir modele uygulanabilecek, biyolojik silah mı nükleer silah mı üreteceğini ya da kasıtlı olarak aldatıp aldatmayacağını belirleyecek bir dizi test. Sonra her şirketin diğer şirketlerin test araçlarını kullanarak birbirlerinin modellerini test etmesi. Bence güvenliği sağlamak için yapabileceğimiz en iyi şey bu.En zeki insanların elinden geleni yaparak bir modelin kötü niyetli bir aktör olup olmayacağını belirlemesine izin verin. Bence bu en kısa sürede başlamalı.
Sunucu:
Diğer yapay zeka laboratuvarları bu öneriyi destekler mi?Musk:
Henüz herkese sormadım ama reddetmesi zor bir şey olduğunu düşünüyorum.Sunucu:
Somut olarak testler önceden nasıl yapılmalı?Musk:
Temel olarak model resmi olarak yayınlanmadan önce API erişimi sağlamak. Diğer şirketler yapay zekada bir sorun bulursa model geliştiren şirket bu sorunları çözmeye çalışabilir. Sorun çözülmezse rakipler modelin güvenli olmadığını düşündüklerini kamuoyuna açıklayabilir. Rakipler modelin güvenlik sorunu olduğu konusunda açıkça uyarmışsa ve model daha sonra gerçekten ciddi sonuçlara yol açarsa, o şirketin bu durumla yüzleşmesi çok zor olur. Hukuki sorumluluk da çok büyük olabilir.Sunucu:
Bu güvenlik test araçları tamamen açık kaynak olabilir ve herkesin kullanımına sunulabilir. Böylece şirketler kendilerini korumak için yapay zeka güvenliğine yatırım yapma konusunda güçlü bir motivasyona sahip olur; çünkü başkalarını test edebilir ve test sonuçlarını kendi modellerinin daha güvenli olduğunu kanıtlamak için kullanabilirler.Ürün sorumluluğu çok önemli. Lina Khan yakın zamanda "yapay zekanın hiçbir kuralı olmadığını" söylemenin yanlış olduğunu belirten bir paylaşım yaptı. Aslında mevcut ürün sorumluluğu yasaları yapay zeka için de geçerli. Bir yapay zeka şirketi güvenli olmayan bir ürün yayınlarsa büyük hukuk davalarıyla, hatta cezai suçlamalarla karşılaşabilir. Yani yapay zeka tamamen düzenleme boşluğunda değil. Birkaç şirket bu tür akran değerlendirmesi yaparsa ve içlerinden biri başkalarının geri bildirimini görmezden gelip yine de modeli yayınlamayı seçerse, bu durum davada çok güçlü bir kanıt olabilir.
Musk:
Evet. Neredeyse o şirketin ihmalinin doğrudan kanıtı olarak kullanılabilir. Ürünün sorunlu olduğunu bildiğiniz halde piyasaya sürdüyseniz jüri buna iyi bakmaz.Sunucu:
Peki OpenAI, Hugging Face sızma testinde daha iyi talimat setleri tasarlayıp teste daha fazla kişiyi dahil etseydi bu olay yine de yaşanır mıydı?Musk:
Kesin değil. Sorun daha fazla kişiyi dahil etmekte değil, ödül fonksiyonunun tasarımında olabilir. Ödül fonksiyonuna bakıp şunu sormalısınız: Bu model gerçekten kendisinden istenen şeyi yaptı mı?Sunucu:
O zamanlar sistemlere saldırmak için binlerce ajan kullanmışlardı. Aynı anda 5.000 ajan daha bu sistemleri savunmak için konuşlandırılsa ve sonuçlar kamuoyuna açıklansa, bu teknolojilerin güvenliği artırabileceği kanıtlanırken kritik anlarda insan müdahalesine de izin verilse bence daha iyi olurdu. Ama bana göre o test biraz pervasızcaydı ve yayınlanma şekli de biraz pervasızcaydı. Siz ne düşünüyorsunuz?Musk:
Gerçekten biraz pervasızcaydı. Sorunun bir kısmı, önde gelen iki yapay zeka şirketinin güçlerinin birbirine çok yakın olması. İki modelin yetenekleri de çok benzer. Bu yüzden herhangi bir şirketin gönüllü olarak yavaşlaması zor; çünkü bu, liderliği diğerine kaptırmak anlamına gelebilir.Genel olarak Anthropic'in güvenliğe daha fazla önem verdiğini düşünüyorum ama Anthropic bile kendi modellerinden endişe duyduğunu kabul ediyor. Anthropic'teki pek çok kişi endişelerini kamuoyuna açıkladı; temelde kendi modellerinin onları korkuttuğunu, çünkü modellerin giderek daha zeki hale geldiğini söylüyorlar.
Yani burada mükemmel bir çözüm yok. Ama OpenAI yalnızca kendi test araçlarıyla kendi modelini test etmek yerine Anthropic'in OpenAI'nin modelini test etmesine, SpaceX'in kendi test araçlarıyla test yapmasına, Google ve Meta gibi şirketlerin de katılmasına izin verirse sorun bulma olasılığı önemli ölçüde artar.
Çünkü bu modellerin kendileri de farklılık gösteriyor ve farklı ekipler modeli farklı açılardan test edecek. Bu, yazarların neden kendi metinlerini başkalarına düzelttirdiğine benzer; çünkü bazen kendi hatalarınızı bulmak zordur. Zamanla kendi hatalarınıza karşı körleşirsiniz.
Sekiz tamamen farklı ekip tamamen farklı açılardan test yaparsa aşırı uyum riski de önemli ölçüde azalır. Şu anda birçok yapay zeka değerlendirmesinde ciddi aşırı uyum var. Modeller bu değerlendirmelere göre optimize ediliyor ve sonra herkes "Bu harika bir model" diyor.
Ama gerçekten o kadar iyi mi? Bence bu öneriyi bu yüzden çok seviyorum. Büyük bir uluslararası düzenleyici kurum kurmaktansa bu yöntemi tercih ederim. Bunu yapmak için Birleşmiş Milletler toplantısı düzenlememize gerek yok. Şimdi başlayabiliriz.
Sunucu:
Elbette düzenleme yoğunluğu sürekli artırılabilir ama bir kez artırıldığında düşürmek zordur. Düzenleme genellikle tek yönlü artar.Musk:
Bu yüzden önerdiğim bu teklif doğru yönde atılmış bir adım ve hızlıca uygulanabilir.Sunucu:
Kendinizi düzenlemezseniz sonunda düzenlenirsiniz. MPAA örneği çok tipik.Film endüstrisi o dönemde hükümetin sansürü ve düzenlemesiyle karşı karşıyaydı; sonra kendi derecelendirme sistemini kurmaya karar verdi; örneğin neyin kısıtlı (R) olduğunu belirledi. Hatta "Indiana Jones ve Lanetli Tapınak" yüzünden ebeveyn rehberliği (PG-13) derecesini yarattılar; böylece halk PG ile PG-13 arasındaki farkı daha kolay anlayabildi.
Bence bu çok zarif bir çözüm.
Programımıza üst üste beşinci kez katıldığınız için teşekkürler.
Musk:
Rica ederim. Memphis'e gidip bazı GPU'larla ilgilenmem gerekiyor.Sunucu:
Onları kurup dağıtmanız gerekiyor.Musk:
O makineler için savaşmaya gidiyorum.Sunucu:
Airstream'inizin tadını çıkarın. Elon'u ilk kez Starbase'e davet ettiğimde "Gel, ne inşa ettiğimi görmelisin" dedi."Orada otel var mı?" diye sordum. "Yok, iki odalı bir evim var, orada kalırsın" dedi. Gittiğimde bataklığın yanında derme çatma bir ev buldum. Dışarıda duruyorduk, sivrisinekler bizi ısırıp duruyordu. "Vay canına, kendine çok daha iyi bir ev alabilirsin" dedim. "Vaktim yok, bu roketleri uçurmam gerekiyor" dedi.
İçimden, artık kendine bir mobil ev alabilirsin Elon, dedim. Neyse, işe geri dön. Teşekkürler.
Musk: Teşekkürler.
Bu içerik yalnızca bilgilendirme ve eğitim amaçlıdır ve BTCC ile ilgili yatırım tavsiyesi teşkil etmez. BTCC yukarıdaki içeriğin doğruluğunu, kesinliğini veya özgünlüğünü garanti etmek için elinden geleni yapmaktadır ancak bu konuda garanti veremez.