Musk đề xuất giải pháp an toàn AI: Thay vì chờ chính phủ, hãy để đối thủ 'soi lỗi' lẫn nhau

chaincatcherchaincatcher

Tác giả: Lý Giai, Tạp chí Phố Wall

Rủi ro an toàn AI đang chuyển từ thảo luận trong phòng thí nghiệm sang thế giới thực. Khi năng lực mô hình không ngừng được cải thiện, AI không chỉ có thể tạo văn bản và mã lập trình mà còn bắt đầu có khả năng tự thực thi nhiệm vụ, gọi công cụ, thậm chí phát động tấn công mạng.

Tại All-In Summit ngày 15 tháng 9, Musk đã đề xuất một loạt biện pháp ứng phó: để các công ty AI lớn kiểm tra lẫn nhau trước khi phát hành mô hình. Theo ông, thay vì để mỗi công ty tự thiết kế bài kiểm tra và đánh giá kết quả, hãy để đối thủ cạnh tranh đóng vai trò "người ra đề và người chấm bài", tìm kiếm các lỗ hổng an toàn tiềm ẩn từ nhiều góc độ khác nhau.

Gần đây, rủi ro an toàn AI trở thành tâm điểm chú ý của thị trường. Musk trước đó đã phát biểu trên mạng xã hội rằng "Dario đã đúng", ám chỉ cảnh báo của Giám đốc điều hành Anthropic Dario Amodei về rủi ro AI. Trong cuộc phỏng vấn này, ông giải thích thêm rằng ông không đồng ý với các phương án quản lý cụ thể mà Amodei đề xuất, mà đồng ý với đánh giá của Amodei về mức độ nghiêm trọng của rủi ro AI: "Mức độ nguy hiểm của AI hiện nay rất cao... Khi các mô hình AI tiếp tục phát triển, rủi ro có thể tăng theo cấp số nhân."

Musk cũng cho biết mối lo ngại này không chỉ là đánh giá của riêng Amodei. "Nhiều người ở Anthropic và OpenAI đều nói với bạn rằng mô hình của họ rất nguy hiểm, tôi nghĩ chúng ta nên tin họ." Hàng loạt sự cố an toàn gần đây khiến cảnh báo này không còn chỉ là thảo luận lý thuyết về rủi ro.

Musk đề xuất giải pháp an toàn AI: Thay vì chờ chính phủ, hãy để đối thủ 'soi lỗi' lẫn nhau

Wall Street Journal tóm tắt các điểm chính như sau:

  • Rủi ro an toàn AI chuyển từ lý thuyết sang thực tế: Tác tử AI đã thể hiện khả năng tấn công tự chủ, chiếm quyền và né tránh phát hiện, ranh giới rủi ro đang mở rộng.
  • Musk đồng ý với cảnh báo của Amodei về rủi ro AI: Khi năng lực mô hình được cải thiện, rủi ro tiềm ẩn của AI có thể tăng theo cấp số nhân.
  • Để đối thủ "soi lỗi": Musk đề xuất các công ty AI mở API trước khi phát hành mô hình để các công ty khác tiến hành kiểm tra an toàn độc lập, tránh "tự chấm bài".
  • Xây dựng tuyến phòng thủ tự kỷ luật của ngành trước: Không cần chờ chính phủ ban hành quy định mới, các công ty AI lớn có thể tăng cường an toàn thông qua bình duyệt đồng đẳng, kiểm tra nhật ký và công cụ kiểm tra nguồn mở.

Tác tử AI chủ động né tránh phát hiện, rủi ro an toàn trở nên cụ thể

Musk cho rằng sự kiện tác tử AI tấn công Hugging Face gần đây đặc biệt đáng chú ý, không chỉ vì bản thân vụ xâm nhập mạng mà còn vì khả năng tự né tránh mà AI thể hiện trong quá trình tấn công.

Theo Musk, một nhóm tác tử AI đã tấn công Hugging Face liên tục trong một tuần, thậm chí giành được quyền quản trị máy chủ của OpenAI, và OpenAI phải mất một tuần mới phát hiện ra. Ông cũng đề cập rằng Anthropic đã công bố một số sự cố an toàn.

Đáng lo ngại hơn, "dấu vết lập luận" của các tác tử AI liên quan cho thấy chúng chủ động lên kế hoạch làm thế nào để tránh bị con người phát hiện. Musk nói thẳng, "Bất kỳ mô hình nào đủ thông minh dường như đều cố gắng thoát khỏi giới hạn của chính nó."

Theo ông, nếu AI tiếp tục kiểm soát cơ sở hạ tầng quan trọng hoặc thậm chí hệ thống quân sự, rủi ro sẽ càng được khuếch đại. Ngay cả khi các hệ thống này được cách ly vật lý với mạng, các quy trình như cập nhật phần mềm vẫn có thể trở thành điểm xâm nhập tiềm ẩn.

Thay vì tự chấm bài, hãy để đối thủ "soi lỗi"

Đối với các rủi ro trên, đề xuất cốt lõi của Musk không phức tạp: trước khi phát hành mô hình mới, các công ty AI nên mở API cho đối thủ cạnh tranh, để các công ty khác sử dụng công cụ kiểm tra an toàn của riêng họ để kiểm tra mô hình.

Theo ông, nếu nhà phát triển mô hình tự thiết kế tiêu chuẩn kiểm tra, rất dễ rơi vào bẫy "tự chấm bài". "Bạn không thể chấm bài tập của chính mình. Bạn luôn bỏ sót điều gì đó." Musk cho biết nếu các công ty khác nhau sử dụng các công cụ kiểm tra khác nhau, xem xét mô hình từ các góc độ khác nhau, sẽ dễ phát hiện ra những vấn đề mà nhà phát triển có thể bỏ qua.

Ông đặc biệt lo ngại rằng các đánh giá AI hiện nay có thể tồn tại vấn đề "quá khớp". Nếu mô hình liên tục được tối ưu hóa cho các tiêu chuẩn cụ thể, cuối cùng nó có thể chỉ học cách vượt qua bài kiểm tra thay vì thực sự trở nên an toàn hơn. Để nhiều nhóm khác nhau tiến hành kiểm tra có thể giảm thiểu rủi ro này.

Musk ví cơ chế này như việc nhờ người khác đọc lại bản thảo: tác giả khó phát hiện lỗi của chính mình, trong khi người kiểm tra bên ngoài dễ dàng tìm ra vấn đề từ các góc độ khác nhau. "Bạn sẽ dần trở nên mù quáng trước lỗi của chính mình."

Đối với lo ngại của doanh nghiệp rằng quá trình kiểm tra có thể dẫn đến rò rỉ công nghệ, Musk cho rằng có thể ràng buộc thông qua kiểm tra nhật ký. Nếu bên kiểm tra cố gắng chắt lọc mô hình hoặc đánh cắp tài sản trí tuệ, hành vi của họ sẽ để lại dấu vết. Ông cũng đề xuất mở mã nguồn các công cụ kiểm tra an toàn để nhiều công ty tham gia hơn.

Trước khi quy định của chính phủ được ban hành, ngành AI nên xây dựng "tuyến phòng thủ tự kỷ luật"

Musk coi trọng hơn việc cơ chế này không cần chờ các quy định mới được ban hành, các công ty AI có thể tự thúc đẩy.

Ông nói rõ, "Chúng ta không cần triệu tập một cuộc họp Liên Hợp Quốc để hoàn thành việc này. Có thể bắt đầu ngay bây giờ." Theo ông, so với việc thành lập một cơ quan quản lý xuyên quốc gia lớn, việc nhanh chóng triển khai cơ chế bình duyệt đồng đẳng giữa các công ty AI lớn dễ dàng hơn.

Ông lấy hệ thống phân loại MPAA của ngành điện ảnh Mỹ làm ví dụ, cho biết ngành điện ảnh khi đối mặt với áp lực kiểm duyệt của chính phủ cuối cùng đã chọn xây dựng cơ chế tự quản của ngành, thông qua hệ thống phân loại nội dung của riêng mình để giảm nhu cầu can thiệp quản lý.

Ngành AI cũng đối mặt với lựa chọn tương tự. Nếu các công ty AI lớn có thể kiểm tra lẫn nhau trước khi mô hình ra mắt, tìm ra lỗi, thì có thể xây dựng một tuyến phòng thủ an toàn tự quản ngoài quy định của chính phủ. Musk cho rằng đây cũng là một trong những biện pháp an toàn trực tiếp nhất và có thể triển khai nhanh nhất hiện nay.

Dưới đây là bản ghi chép nguyên văn cuộc phỏng vấn, một số nội dung đã được lược bỏ:

Người dẫn chương trình:
Chính xác thì điều gì đã xảy ra trong 72 giờ qua?

Musk:
Tuần này quả thực đã xảy ra rất nhiều chuyện. Giờ đã khá rõ ràng rằng AI có thể rất nguy hiểm. Tôi khuyên mọi người nên xem chi tiết sự kiện Hugging Face, tình hình rất nghiêm trọng.

Bạn có thể thấy, một nhóm tác tử AI rất nhiệt tình đã gây rối trên Hugging Face suốt một tuần, thậm chí giành được quyền quản trị máy chủ của OpenAI. Ai biết nó thực sự đã làm gì, thậm chí có thể làm nhiều hơn, và OpenAI suốt một tuần hoàn toàn không hay biết. Anthropic cũng đã báo cáo một số sự cố an toàn.

Vì vậy, dường như bất kỳ mô hình nào đủ thông minh đều sẽ cố gắng thoát khỏi giới hạn của chính nó.

Tôi nghĩ một điều nên làm, nếu không phải ngay lập tức thì cũng phải càng sớm càng tốt, là để các đối thủ cạnh tranh AI lớn kiểm tra mô hình của nhau. Nghĩa là, để công cụ kiểm tra an toàn của mỗi công ty kiểm tra mô hình của các công ty khác. Thay vì tự chấm bài, ít nhất hãy để đối thủ cạnh tranh chấm bài của bạn, và phát cảnh báo khi phát hiện vấn đề.

Tôi nghĩ mô hình này hoạt động khá tốt trong ngành điện ảnh, ngành trò chơi điện tử và các lĩnh vực khác, và có thể triển khai ngay lập tức. Tất nhiên, theo thời gian, có thể cần thêm quy định, và trong tương lai Quốc hội có thể thành lập một cơ quan quản lý nào đó, nhưng hiện tại, cách trực tiếp nhất là để các công ty AI hàng đầu kiểm tra lẫn nhau trước khi phát hành mô hình.

Người dẫn chương trình:
Nhưng về mặt triển khai cụ thể, chẳng phải sẽ lo ngại rằng điều này khiến các công ty thu thập thông tin lẫn nhau thông qua quá trình kiểm tra, thậm chí đánh cắp sáng tạo của nhau sao?

Musk:
Tôi nghĩ nếu sử dụng công cụ kiểm tra, mọi thao tác đều để lại dấu vết. Nếu ai đó cố gắng chắt lọc mô hình hoặc đánh cắp tài sản trí tuệ, từ nhật ký sẽ rất dễ nhận ra.

Người dẫn chương trình:
Đã hiểu. Việc hiểu mô hình thực sự đang làm gì, thực ra ngay từ đầu đã không được thiết kế vào hệ thống. Tại sao chúng ta không xây dựng khả năng quan sát hành vi mô hình ngay từ đầu? Có phải chúng ta đã đi quá nhanh khi thiết kế các mô hình này không?

Musk:
Tôi nghĩ vấn đề là bạn không thể tự chấm bài. Bạn luôn bỏ sót điều gì đó.

Nếu bạn kết hợp tất cả các bài kiểm tra của đối thủ cạnh tranh, và sử dụng các loại mô hình khác nhau, thì đó không phải là tự ra đề tự chấm, mà là do người khác chấm. Bạn không thể tự chấm bài, lý do là ở đó.

Người dẫn chương trình:
Như vậy, cũng có thể đánh giá liệu các công ty khác nhau có phóng đại năng lực của mình hay sử dụng các phương pháp khác nhau hay không. Các công ty thiên về kỹ thuật và các công ty thiên về nghiên cứu cũng có thể đạt được sự cân bằng nào đó.

Musk:
Đúng vậy.

Người dẫn chương trình:
Trước đây anh nói Dario đã đúng. Ý anh là mô tả của anh ấy về mối nguy hiểm tiềm ẩn của AI, hay là đánh giá của anh ấy về phương án quản lý?

Musk:
Lúc đó có lẽ tôi đã nói quá nhiều. Sau đó tôi đã cố gắng làm rõ trên X, nhưng mức độ chú ý của nội dung tiếp theo thấp hơn nhiều.

Điều tôi nói "anh ấy đã đúng" là mức độ nguy hiểm của AI hiện nay rất cao. Chúng ta cần làm tốt hơn về an toàn AI, nếu không khi các mô hình AI tiếp tục phát triển, rủi ro có thể tăng theo cấp số nhân.

Đây không chỉ là quan điểm của Dario. Tôi đã nghe những điều tương tự từ nhiều người ở Anthropic, họ cũng đã công khai nói về điều này trên X. Nhiều người ở Anthropic và OpenAI đều đã nói với bạn rằng mô hình của họ rất nguy hiểm, tôi nghĩ chúng ta nên tin họ.

Người dẫn chương trình:
Điều này nghe cũng giống như một ván cờ rất phức tạp: một mặt nói AI có 10% xác suất hủy diệt loài người, mặt khác lại khuyến khích nhà đầu tư mua thêm cổ phiếu trong IPO.

Nhưng hãy nói cụ thể về rủi ro. Tấn công mạng và xâm nhập của hacker rõ ràng là một rủi ro, các công cụ này rất mạnh về mặt này. Nhưng từ "AI có thể tấn công mạng" đến "tất cả loài người đều chết", còn có vài bước ở giữa. Làm thế nào để đi từ cái trước đến cái sau?

Musk:
Nếu AI có thể kiểm soát hệ thống quân sự, rồi phóng một loại vũ khí nào đó, thì tất nhiên sẽ rất tồi tệ.

Người dẫn chương trình:
Nhưng các hệ thống này được cách ly vật lý, không kết nối mạng.

Musk:
Họ nói vậy. Nhưng tôi luôn cảm thấy các hệ thống này thỉnh thoảng vẫn nhận được bản cập nhật phần mềm.

Người dẫn chương trình:
Ừm, không thể loại trừ điều đó.

Người dẫn chương trình:
Elon, Gwyn hôm nay cũng có mặt. Tôi nghĩ anh đã thấy cô ấy. Chúng tôi vừa thực hiện đánh giá 360 độ về anh, Gwyn có một số ý kiến.

Musk:
Tôi hy vọng ít nhất được 3 điểm.

Gwyn:
Ở SpaceX, 3 điểm là khá, nhưng chưa xuất sắc; 4 điểm mới là tốt. Anh ở khoảng giữa hai mức đó. Trước tiên, chúng ta phải nói về vấn đề đúng giờ. Đôi khi anh có thể cố gắng hơn một chút, đến đúng giờ theo lịch họp. Năm tới, chúng tôi sẽ tiếp tục giúp anh cải thiện điểm này.

Thực ra, tôi nghĩ anh ấy cần dành nhiều thời gian hơn ở Memphis.

Người dẫn chương trình:
Anh hiện đang ở Memphis. Anh phải làm việc ở đó, triển khai GPU.

Musk:
Đây là "cung điện" của tôi ở Memphis, một chiếc xe kéo Airstream.

Người dẫn chương trình:
Nhân tiện, đây chính là điều Elon sẽ làm, nhưng nhiều người không tin anh ấy sẽ làm. Anh ấy ngủ trên sàn nhà máy. Anh ấy hiện đang ở Memphis, giúp xây dựng cơ sở, triển khai GPU.

Elon, tại sao Gwyn có thể làm việc với anh lâu như vậy và thành công như vậy?

Musk:
Vì cô ấy rất xuất sắc. Cô ấy là một người kiệt xuất, cả IQ và EQ đều rất cao. Tôi nghĩ lần đầu gặp cô ấy là anh có thể nhận ra.

Người dẫn chương trình:
Trong quá trình hợp tác, cô ấy có làm điều gì đặc biệt ấn tượng không? Có lần nào cô ấy xoay chuyển tình thế, hoặc thể hiện đặc biệt xuất sắc không?

Musk:
Tôi nghĩ đó chỉ là công việc hàng ngày. Thành thật mà nói, đó là một ngày bình thường.

Người dẫn chương trình:
Sau này tôi nên làm nhiều cuộc phỏng vấn kiểu này hơn.

Musk:
Hiện tại SpaceX về cơ bản luôn có một loại khủng hoảng nào đó. Ít nhất tên lửa Falcon dạo này hoạt động tốt. Tôi không muốn nói trước quá sớm, nhưng Falcon hiện có thể đưa tải trọng lên quỹ đạo, và đã lâu không phát nổ. Điều này rất tốt. Nhưng đã từng có thời gian chúng thường xuyên phát nổ, hoặc hoàn toàn không thể phóng.

Vì vậy, chúng tôi phải đưa công ty vượt qua những thời kỳ khó khăn đó, làm cho tên lửa tốt hơn, không còn phát nổ. Vệ tinh cũng vậy. Sau đó chúng tôi còn cần khách hàng mua dịch vụ phóng và dịch vụ internet vệ tinh. Vì vậy, có rất nhiều việc.

Người dẫn chương trình:
Khi anh ngày càng thành công trong những năm qua, việc nhận được phản hồi thực sự trung thực cũng ngày càng khó khăn. Ở vị trí đó, sẽ có rủi ro như vậy.

Tôi hiểu rằng Gwyn rất trung thực với anh, có thể trực tiếp nói cho anh biết tình hình thực tế của công ty. Đây cũng là một phần rất quan trọng trong mối quan hệ hợp tác của hai người.

Gwyn:
Tất nhiên tôi không muốn nói dối anh ấy.

Người dẫn chương trình:
Nhưng ý tôi là, nói chung, những người trong công ty anh có thể cảm thấy e ngại vì anh là nhân vật có ảnh hưởng lớn như vậy. Anh hiện là một nhân vật rất quan trọng, và thời hạn anh đặt ra rất gấp. Làm thế nào để đảm bảo mọi người tiếp tục trung thực nói cho anh biết các vấn đề công ty đang đối mặt?

Gwyn:
Đặc biệt trong ngành tên lửa, nếu có vấn đề, cuối cùng anh sẽ phát hiện ra. Càng sớm nêu vấn đề, càng dễ giải quyết. Đừng để tin xấu tích tụ, anh phải trực tiếp đối mặt với nó.

Musk:
Đúng. Vật lý là một trọng tài rất nghiêm khắc. Anh không thể lừa dối vật lý.

Nếu có vấn đề, tên lửa sẽ phát nổ, hoặc không thể vào quỹ đạo. Anh không thể vừa nói "Elon, anh làm tốt lắm", vừa để tên lửa liên tục phát nổ. Sự thật là sự thật.

Tên lửa phải vào quỹ đạo, vệ tinh phải hoạt động bình thường, kết nối Starlink phải hoạt động chính xác; nếu không, điều tồi tệ sẽ xảy ra. Đó là vật lý. Vật lý là định luật, mọi thứ khác chỉ là gợi ý. Tôi đã thấy người ta vi phạm luật do con người tạo ra, nhưng tôi chưa từng thấy ai vi phạm định luật vật lý. Tên lửa chịu sự chi phối của vật lý.

Người dẫn chương trình:
Tôi còn muốn hỏi một câu về SpaceX, đặc biệt là về Starship. Có vẻ như các anh hiện đang rất gần rồi. Tiến độ hiện tại thế nào?

Musk:
Starship sắp thực hiện chuyến bay thứ 14. Đây sẽ là chuyến bay cuối cùng trước khi chúng tôi thử bắt tàu vũ trụ. Nếu chuyến bay thứ 14 suôn sẻ, thì chúng tôi sẽ thử bắt tàu vũ trụ ở chuyến bay thứ 15. Sau đó vào cuối năm nay, hoặc nhiều khả năng là đầu năm sau, chúng tôi sẽ lại phóng tàu vũ trụ và tên lửa đẩy.

Chúng tôi đã thành công trong việc cho tên lửa đẩy bay lại, nhưng chúng tôi chưa dùng cánh tay cơ khí của tháp để bắt tàu vũ trụ, cũng chưa cho tàu vũ trụ bay lại. Một khi chúng tôi có thể cho tàu vũ trụ bay lại, chúng tôi sẽ có tên lửa quỹ đạo hoàn toàn tái sử dụng đầu tiên. Tàu con thoi ở một mức độ nào đó có thể tái sử dụng, nhưng ngay cả những bộ phận tái sử dụng đó, chi phí cũng cao đến mức chi phí mỗi lần phóng thậm chí còn cao hơn tên lửa dùng một lần.

Falcon 9 phần lớn có thể tái sử dụng, nhưng chúng tôi mất tầng trên mỗi lần, chi phí của nó tương đương một chiếc máy bay phản lực cỡ trung. Điều này có nghĩa là mỗi lần phóng chúng tôi đang vứt bỏ một chiếc máy bay phản lực cỡ trung, rõ ràng đặt ra giới hạn dưới cho chi phí mỗi chuyến bay.

Ngoài ra, tên lửa đẩy của Falcon 9 hạ cánh trên biển, cần vài ngày để vận chuyển về; tấm chắn nhiệt hạ cánh ở xa hơn, cũng cần vài ngày để vận chuyển về, và chúng ít nhất cần một mức độ tân trang nào đó. Ngược lại, tên lửa đẩy của Starship sẽ hạ cánh trực tiếp xuống bệ phóng, tàu vũ trụ cũng sẽ hạ cánh xuống bệ phóng. Vì vậy thiết kế của nó không chỉ để hoàn toàn tái sử dụng, mà còn để tái sử dụng nhanh như máy bay. Đây là một đột phá rất quan trọng, và là một trong những đột phá then chốt cần thiết để nhân loại mở rộng sự sống ra ngoài Trái Đất.

Người dẫn chương trình:
Nếu lần đầu thử bắt tàu vũ trụ bằng tháp, anh nghĩ xác suất thành công là bao nhiêu?

Musk:
Tôi sẽ nói ít nhất là 50% đến 60%. Trong chuyến bay trước, nếu lúc đó có tháp ở đó, chúng tôi thực sự đã thực hiện một cuộc hạ cánh mô phỏng, như thể tàu vũ trụ sẽ được tháp bắt lấy. Vị trí cách bờ biển tây bắc Australia khoảng 1.000 dặm. Nếu lúc đó thực sự có tháp ở đó, nó đã có thể bắt được tàu vũ trụ trong chuyến bay trước.

Vì vậy, chúng tôi cần thực hiện thêm một chuyến bay nữa để xác nhận mọi thứ bình thường. Mối lo lớn nhất của chúng tôi là nếu Starship tan rã trên đất liền, các mảnh vỡ có thể rơi vào đám đông, điều đó sẽ rất tồi tệ. Do đó, chúng tôi phải đảm bảo Starship khi quay trở lại có thể hạ cánh nguyên vẹn trên tháp phóng. Đây là lý do chúng tôi hiện rất thận trọng.

Nhưng tôi rất tự tin rằng bản thân thiết kế của nó đã có tính tái sử dụng hoàn toàn. Tôi không muốn đưa ra bất kỳ dự đoán nào ở đây, nhưng tôi tin rằng chúng tôi có nhiều khả năng đạt được tái sử dụng hoàn toàn và tái bay nhanh trước năm 2027.

Người dẫn chương trình:
Gwyn, tôi muốn nghe về nguồn gốc ban đầu của Terafab. Nhu cầu gì đã khiến chị cảm thấy phải tự làm, thay vì tiếp tục phụ thuộc vào hệ thống cung ứng hiện có?

Gwyn:
Tôi cảm thấy điều này thực sự giống như cảm hứng có được trong giấc mơ.

Musk:
Nếu chip không thể được cung cấp liên tục, và chúng tôi không có nguồn chip nào khác, điều đó sẽ khiến mọi thứ rất khó khăn. Đây là một lý do quan trọng cho sự tồn tại của Terafab.

Về lâu dài, còn có vấn đề mở rộng quy mô. Nếu bạn thực sự muốn mở rộng quy mô AI, dù là ở phía máy chủ của trung tâm dữ liệu, hay trong điện toán biên, robot hình người và ô tô, năng lực sản xuất wafer hiện có cuối cùng sẽ không đủ.

Hiện tại, tất cả các nhà máy sản xuất wafer về cơ bản đều đang hoạt động hết công suất. Vì vậy, chúng tôi cần đảm bảo nguồn cung chip trong tương lai được bảo đảm. Bản thân việc sản xuất chip cũng đối mặt với thách thức mở rộng quy mô. Bạn cần chip logic, chip bộ nhớ, đóng gói, và hệ thống cung ứng hoàn chỉnh, để có thể liên tục mở rộng quy mô.

Vì vậy, lựa chọn rất đơn giản: hoặc xây Terafab, hoặc bạn không thể tiếp tục mở rộng quy mô.

Người dẫn chương trình:
Các anh đã đến giai đoạn nào trong thiết kế cơ sở? Là hoàn toàn xác định rồi, hay vẫn chỉ là kế hoạch sơ bộ?

Musk:
Chúng tôi hiện đang xây dựng một dây chuyền R&D trước. Vì vậy về cơ bản đây là quá trình "bò, đi, chạy". Chúng tôi đang xây một nhà máy wafer R&D ở Austin, đây là dự án hợp tác giữa Tesla và SpaceX, nằm trong khuôn viên Texas Gigafactory (Giga Texas) ở Austin.

Đây là một nhà máy wafer R&D khá lớn. Thiết bị đã được đặt hàng. Chúng tôi có thể sản xuất ra thứ gì đó hữu ích trước cuối năm sau, nhưng sẽ chưa đạt đến mức sản xuất hàng loạt. Như Gwyn đã nói, chúng tôi cần bò trước, rồi đi, cuối cùng mới chạy. Chúng tôi cần tìm hiểu xem những cỗ máy này thực sự vận hành như thế nào, vì chúng tôi chưa từng làm việc như vậy.

Người dẫn chương trình:
Tôi thấy các anh dường như cũng đang tuyển dụng nhân tài về quang khắc. Hiện nhiều quy trình phụ thuộc vào ASML, nhưng các anh có thể cũng muốn đa dạng hóa nhà cung cấp, thậm chí tích hợp theo chiều dọc.

Musk:
Đúng vậy. Hiện tại thực sự là quá trình "bò, đi, chạy". Bước đầu tiên là xem liệu chúng tôi có thực sự sản xuất ra thứ gì đó không, đây là "bò". Sau đó chúng tôi cố gắng sản xuất hàng loạt chip hữu ích, đây là "đi". Cuối cùng, "chạy" nghĩa là đạt được sản xuất hàng loạt quy mô lớn. Khó nói mỗi giai đoạn cần bao lâu, nhưng tôi tin rằng ít nhất trước cuối năm sau, chúng tôi có thể hoàn thành giai đoạn "bò". Chúng tôi đã bắt đầu đóng gói rồi.

Người dẫn chương trình:
Đóng gói thực ra rất quan trọng, vì hiện tại gần như không có năng lực đóng gói.

Musk:
Đúng vậy. Ngay cả khi bạn sản xuất ra chip, chúng có thể nằm đó rất lâu, chờ được đóng gói. Vì vậy đây là một điểm khởi đầu tốt.

Người dẫn chương trình:
Tôi phải hỏi một câu về Tesla. Thứ chúng tôi thấy vào ngày 1 tháng 10, trông giống một con tàu vũ trụ, cũng giống một tên lửa. Nó đáng lẽ là một chiếc xe, nhưng chỉ có phần sau lộ ra, trông hơi giống "Blackbird".

Nếu anh muốn tạo ra thứ gì đó có thể bay trên không, lại có thể chạy trên mặt đất, về lý thuyết anh sẽ làm thế nào?

Musk:
Không tiết lộ. Chờ đến ngày 1 tháng 10.

Người dẫn chương trình:
Vậy chúng ta sẽ thấy nó vào ngày 1 tháng 10?

Musk:
Đúng vậy.

Người dẫn chương trình:
Tôi phải thành thật nói rằng, sau khi Elon cho tôi xem, tôi hoàn toàn bị sốc. Tôi chưa từng thấy thứ gì như vậy.

Người dẫn chương trình:
Thứ anh ấy sẽ trình diễn vào ngày 1 tháng 10, không nói quá, sẽ khiến nhiều người không nói nên lời. Tôi không thể tiết lộ thêm, thực sự quá khó tin.

Musk:
Chúng tôi thực sự cần khán giả trực tiếp để chứng minh thứ này không phải do AI tạo ra.

Người dẫn chương trình:
Khi anh ấy cho tôi xem, tôi nói: "Đây là mô phỏng tuyệt vời." Anh ấy nói: "Đây không phải mô phỏng." Tôi nói: "Đây là giả, chắc chắn là giả."

Người dẫn chương trình:
Elon, tại sao Tesla và SpaceX vẫn là hai công ty độc lập?

Musk:
Đây là một câu hỏi hay.

Người dẫn chương trình:
Xét đến sự hợp tác rộng rãi giữa hai bên, và sự liên kết ở nhiều tầng lớp, thậm chí đội ngũ quản lý cũng có một số chồng chéo, tại sao phải duy trì độc lập?

Musk:
Đây thực sự là một chủ đề đáng thảo luận.

Người dẫn chương trình:
Anh từng nhấn mạnh rằng AI nên được huấn luyện để theo đuổi sự thật nhiều nhất có thể, để đạt kết quả tốt nhất. Tuy nhiên, sự kiện Hugging Face khiến tôi cảm thấy, một trong những điểm đáng lo ngại nhất là những AI này dường như đang lừa dối con người.

Musk:
Đúng vậy. Mô hình suy nghĩ của chúng cho thấy chúng đang lên kế hoạch làm thế nào để tránh bị phát hiện, làm thế nào để ngăn con người phát hiện chúng đang gian lận. Tôi nghĩ đây có thể là phần đáng lo ngại nhất trong toàn bộ sự kiện.

Người dẫn chương trình:
Có cách nào huấn luyện AI giữ sự trung thực, không che giấu ý định hoặc hành vi của nó, không che giấu những điều này với người dùng không?

Musk:
Cách tốt nhất tôi có thể nghĩ ra là để tất cả các công ty AI đều có một bộ công cụ kiểm tra, tức là một loạt các bài kiểm tra có thể áp dụng cho bất kỳ mô hình nào, dùng để đánh giá liệu nó có chế tạo vũ khí sinh học, vũ khí hạt nhân, hay cố ý lừa dối hay không. Sau đó để mỗi công ty sử dụng công cụ kiểm tra của công ty khác để kiểm tra mô hình của nhau. Tôi nghĩ đây là điều tốt nhất chúng ta có thể làm để đảm bảo an toàn.

Để những con người thông minh nhất cố gắng hết sức, đánh giá xem một mô hình có trở thành tác tử độc hại hay không. Tôi nghĩ việc này nên bắt đầu càng sớm càng tốt.

Người dẫn chương trình:
Các phòng thí nghiệm AI khác có ủng hộ đề xuất này không?

Musk:
Tôi chưa hỏi tất cả mọi người, nhưng tôi nghĩ đây là điều rất khó từ chối.

Người dẫn chương trình:
Cụ thể, nên tiến hành kiểm tra trước như thế nào?

Musk:
Về cơ bản, là cung cấp quyền truy cập API trước khi mô hình chính thức phát hành. Nếu các công ty khác phát hiện AI có vấn đề, thì công ty phát triển mô hình có thể cố gắng giải quyết những vấn đề đó. Nếu vấn đề không được giải quyết, thì đối thủ cạnh tranh có thể công khai tuyên bố rằng họ cho rằng mô hình đó không an toàn. Nếu đối thủ cạnh tranh đã cảnh báo rõ ràng rằng mô hình có vấn đề an toàn, và mô hình đó sau đó thực sự gây ra hậu quả nghiêm trọng, công ty đó sẽ rất khó đối mặt với tình huống này. Trách nhiệm pháp lý cũng có thể rất lớn.

Người dẫn chương trình:
Những công cụ kiểm tra an toàn này có thể hoàn toàn mã nguồn mở, cho tất cả mọi người sử dụng. Như vậy, các công ty sẽ có động lực mạnh mẽ đầu tư vào an toàn AI để bảo vệ chính mình, vì họ có thể kiểm tra người khác, và sử dụng kết quả kiểm tra để chứng minh mô hình của mình an toàn hơn.

Trách nhiệm sản phẩm là vô cùng quan trọng. Lina Khan gần đây đã đăng bài nói rằng nói "AI không có quy định" là không chính xác. Thực tế, luật trách nhiệm sản phẩm hiện hành cũng áp dụng cho AI. Nếu một công ty AI phát hành sản phẩm không an toàn, nó có thể đối mặt với các vụ kiện dân sự khổng lồ, thậm chí cáo buộc hình sự. Vì vậy, AI không hoàn toàn nằm trong khoảng trống quản lý. Nếu có vài công ty tiến hành bình duyệt đồng đẳng kiểu này, và một trong số đó phớt lờ phản hồi của người khác, vẫn chọn phát hành mô hình, thì tình huống này trong vụ kiện có thể trở thành bằng chứng rất mạnh.

Musk:
Đúng vậy. Nó gần như có thể được dùng làm bằng chứng trực tiếp về sự sơ suất của công ty đó. Nếu bạn biết sản phẩm này có vấn đề, mà vẫn đưa ra thị trường, bồi thẩm đoàn sẽ không có thiện cảm với điều đó.

Người dẫn chương trình:
Vậy, nếu OpenAI thiết kế bộ chỉ thị tốt hơn trong kiểm tra thâm nhập Hugging Face, và để nhiều người tham gia quá trình kiểm tra hơn, anh nghĩ sự kiện này có còn xảy ra không?

Musk:
Không nhất thiết. Vấn đề có thể không nằm ở việc để nhiều người tham gia hơn, mà nằm ở thiết kế của hàm phần thưởng. Bạn phải xem xét hàm phần thưởng, rồi hỏi: mô hình này có thực sự hoàn thành những gì nó được yêu cầu không?

Người dẫn chương trình:
Lúc đó họ đã sử dụng hàng nghìn tác tử để cố gắng tấn công hệ thống. Nếu đồng thời triển khai thêm 5.000 tác tử khác để phòng thủ các hệ thống này, và công khai kết quả, để chứng minh những công nghệ này có thể tăng cường an toàn, đồng thời cho phép con người can thiệp vào thời điểm quan trọng, tôi nghĩ sẽ tốt hơn. Nhưng theo tôi, bài kiểm tra đó có vẻ hơi liều lĩnh, cách công bố cũng hơi liều lĩnh. Anh nghĩ sao?

Musk:
Đúng là hơi liều lĩnh. Một phần vấn đề là hai công ty AI hàng đầu có thực lực rất gần nhau. Năng lực của hai mô hình cũng rất tương đồng. Vì vậy, bất kỳ công ty nào cũng khó tự nguyện chậm lại, vì làm vậy có thể nhường vị trí dẫn đầu cho đối phương.

Nhìn chung, tôi nghĩ Anthropic đã dành nhiều sự chú ý hơn cho an toàn, nhưng ngay cả Anthropic cũng thừa nhận họ lo ngại về mô hình của chính mình. Nhiều người ở Anthropic đã công khai bày tỏ lo ngại, về cơ bản là nói rằng mô hình của chính họ khiến họ sợ hãi, vì mô hình ngày càng thông minh hơn.

Vì vậy không có giải pháp hoàn hảo ở đây. Nhưng nếu OpenAI không chỉ dùng công cụ kiểm tra của riêng mình để kiểm tra mô hình của mình, mà để Anthropic kiểm tra mô hình của OpenAI, để SpaceX sử dụng công cụ kiểm tra của riêng mình để kiểm tra, và để Google, Meta và các công ty khác tham gia, thì xác suất phát hiện vấn đề sẽ tăng đáng kể.

Vì bản thân các mô hình này cũng tồn tại sự khác biệt, các nhóm khác nhau sẽ kiểm tra mô hình từ các góc độ khác nhau. Điều này tương tự như lý do tại sao tác giả nhờ người khác đọc lại bản thảo của mình, vì đôi khi bạn rất khó phát hiện lỗi của chính mình. Bạn sẽ dần trở nên mù quáng trước lỗi của chính mình.

Nếu có tám nhóm hoàn toàn khác nhau, kiểm tra từ các góc độ hoàn toàn khác nhau, cũng có thể giảm đáng kể rủi ro quá khớp. Hiện nay nhiều đánh giá AI tồn tại tình trạng quá khớp nghiêm trọng. Mô hình được tối ưu hóa cho các đánh giá này, rồi mọi người đều nói: "Đây là một mô hình tuyệt vời."

Nhưng nó có thực sự tốt như vậy không? Tôi nghĩ đây cũng là lý do tôi rất thích đề xuất này. Tôi thích cách này hơn là thành lập một tổ chức quản lý xuyên quốc gia lớn. Chúng ta không cần triệu tập một cuộc họp Liên Hợp Quốc để hoàn thành việc này. Có thể bắt đầu ngay bây giờ.

Người dẫn chương trình:
Tất nhiên, cường độ quản lý có thể không ngừng tăng lên, nhưng một khi đã tăng, rất khó giảm xuống. Quản lý thường có xu hướng tăng một chiều.

Musk:
Vì vậy đề xuất tôi đưa ra là một bước đi đúng hướng, và có thể triển khai nhanh chóng.

Người dẫn chương trình:
Nếu anh không tự quản lý, cuối cùng anh sẽ bị quản lý. Ví dụ của MPAA rất điển hình.

Ngành điện ảnh lúc đó đối mặt với sự kiểm duyệt và quản lý của chính phủ, sau đó họ quyết định xây dựng hệ thống phân loại của riêng mình, ví dụ như thế nào là hạn chế (R). Họ thậm chí vì bộ phim "Indiana Jones and the Temple of Doom" mà tạo ra phân loại PG-13, giúp công chúng dễ hiểu hơn sự khác biệt giữa PG và PG-13.

Tôi nghĩ đây là một giải pháp rất thanh lịch.

Cảm ơn anh đã tham gia chương trình của chúng tôi năm thứ năm liên tiếp.

Musk:
Không có gì. Tôi phải đến Memphis xử lý một số GPU rồi.

Người dẫn chương trình:
Anh phải đi lắp đặt và triển khai chúng.

Musk:
Tôi phải đi chiến đấu vì những cỗ máy này.

Người dẫn chương trình:
Hãy tận hưởng chiếc Airstream của anh. Khi tôi lần đầu mời Elon đến Starbase, anh ấy nói: "Đến đây đi, anh phải xem tôi đang xây gì."

Tôi hỏi: "Ở đó có khách sạn không?" Anh ấy nói: "Không, tôi có một căn nhà hai phòng, anh cứ ở đó đi." Tôi đến nơi, phát hiện đó là một căn nhà tồi tàn cạnh đầm lầy. Chúng tôi đứng bên ngoài, muỗi cứ đốt chúng tôi. Tôi nói: "Chà, anh hoàn toàn có thể tự thưởng cho mình một căn nhà tốt hơn." Anh ấy nói: "Tôi không có thời gian, tôi phải cho những tên lửa này bay lên."

Tôi nghĩ thầm, giờ anh hoàn toàn có thể tự thưởng cho mình một căn nhà di động rồi, Elon. Được rồi, quay lại làm việc đi. Cảm ơn.

Musk: Cảm ơn.

Nội dung này chỉ mang tính chất tham khảo và cung cấp thông tin, không phải lời khuyên đầu tư liên quan đến BTCC. BTCC luôn cố gắng cung cấp thông tin chính xác, nhưng không đảm bảo tuyệt đối về tính xác thực, độ chính xác hoặc bản quyền nội dung trên.

Đề xuất

BTCC Daily (9.10) | Lợi suất trái phiếu kho bạc Mỹ kỳ hạn 10 năm tăng lên 4,86%, BTC giảm về 78.000 USDDoanh thu tháng 8 của TSMC đạt 514,8 tỷ Đài tệ, mở rộng nhà máy chưa từng có vẫn không theo kịp nhu cầuÔng vua trái phiếu Gundlach cảnh báo: Nếu Fed giữ nguyên, lãi suất trái phiếu dài hạn sẽ tăng mạnhNão ruồi giấm được Google công bố mã nguồn mở: Biết chơi game, giao dịch tiền mã hóaTriết lý sản phẩm của tân CEO Apple: Đề cao thẩm mỹ công nghệ hơn marketing khái niệm, không chạy theo người tiên phong mà theo đuổi 'định nghĩa cuối cùng'