Jack Dorsey phản pháo các ông lớn AI: Đừng lấy 'an toàn' làm cái cớ, độc quyền mới là mối nguy thực sự
PanewslabTác giả: Jack Dorsey
Biên dịch: Yuliya, PANews
Lời người biên tập: Gần đây, ngành AI đang tranh cãi gay gắt về việc "có nên làm chậm quá trình phát triển các mô hình tiên tiến hay không". Anthropic, OpenAI và Musk kêu gọi giảm tốc độ, khiến thị trường phải đánh giá lại nhu cầu về sức mạnh tính toán. Trước việc các ông lớn cố dựng rào cản ngành với lý do "an toàn", Jack Dorsey, cựu đồng sáng lập Twitter, đã viết bài phản bác, nhấn mạnh rằng bảo vệ lợi thế thương mại không phải là mục tiêu an toàn, kêu gọi bảo vệ mã nguồn mở, chủ trương để các nhà nghiên cứu độc lập tham gia thẩm định, và trao lại quyền kiểm soát công nghệ AI cho công chúng. Dưới đây là nguyên văn bài viết:
Mở rộng biên giới
Cái gọi là "biên giới" chính là rìa xa nhất trong nhận thức của con người. Không một công ty nào có thể chiếm giữ công nghệ tương lai làm của riêng. Tôi mong có thêm nhiều người tham gia, cùng nhau thúc đẩy nó tiến lên.
Tôi ủng hộ việc phát hành mô hình AI dưới dạng mã nguồn mở, để mọi người không phải chờ đợi vô ích mà có thể cùng thẩm định, sử dụng và cải tiến nó. Tôi mong nhiều công ty lựa chọn sự cởi mở. Tôi không nói là ép mọi người phải công khai toàn bộ tham số (trọng số) của mô hình độc quyền; điều tôi muốn là những lựa chọn thay thế mã nguồn mở có thể cạnh tranh với các ông lớn, là cơ chế cho phép các nhà nghiên cứu độc lập kiểm chứng công việc của các ông lớn, và hơn nữa là quyền để người dân thường thực sự kiểm soát công cụ trong tay mình. Ai muốn hạn chế việc công bố công nghệ một cách công khai, người đó phải đưa ra lý do thuyết phục.
Những công ty dẫn đầu trong lĩnh vực AI quả thực có tiếng nói. Họ có chuyên môn kỹ thuật và cũng có lợi ích thương mại cần bảo vệ. Nhưng nếu các quy tắc tương lai đều được xây dựng xoay quanh nguồn lực trong tay họ, thì cuối cùng có lẽ chỉ họ mới đủ tư cách ngồi vào bàn chơi. Đôi khi, dưới ngọn cờ chân thành "vì an toàn", rốt cuộc lại biến thành rào cản ngành hạn chế người khác gia nhập.
Tôi cũng không muốn chính phủ Trung Quốc và Mỹ thay phiên quyết định người khác có thể phát triển AI thông minh đến mức nào. Nếu biên giới công nghệ chỉ do hai siêu cường quản lý, thì phần lớn người dân còn lại trên thế giới chỉ còn biết khổ sở chờ được phê duyệt.
Đề xuất "làm chậm phát triển AI" của Anthropic muốn gắn việc đánh giá độc lập, rà soát mức độ nguy hiểm với việc hạn chế sức mạnh tính toán dùng cho huấn luyện, hạn chế số lần huấn luyện và hạn chế "dùng AI để tạo ra AI tốt hơn". Tôi ủng hộ việc rà soát, nhưng tôi kiên quyết phản đối việc mấy ông lớn trong ngành hiện tại đóng cửa bàn bạc rồi đưa ra lệnh hạn chế toàn ngành. Bởi điều đó sẽ chặn đứng những người thực sự có thể phát hiện lỗ hổng hệ thống hoặc tạo ra sản phẩm thay thế. Bảo vệ lợi thế thương mại của một công ty nào đó căn bản không được tính là "mục tiêu an toàn".
Để tất cả mọi người đều có thể tham gia điều tra
Lợi ích của mã nguồn mở nằm ở chỗ nó cho phép mọi người nghiên cứu, sửa đổi và chia sẻ thành quả công nghệ. Công bố tham số mô hình là hữu ích, nếu có thể chia sẻ thêm mã nguồn và thông tin về quá trình tái lập thì càng tốt. Tôi mong kết quả đánh giá mô hình và các khiếm khuyết đã biết cũng được công khai. Như vậy, nếu ai đó không yên tâm với phán đoán của nhà phát triển, họ có thể tự tái lập kết quả, tìm ra lỗ hổng, thách thức những "hàng rào an toàn" được cho là vậy, thậm chí tự phát triển bản vá sửa lỗi, mà không cần phải nịnh nọt các phòng thí nghiệm AI trước đã.
Lý do cốt lõi nhất của những người ủng hộ "làm chậm phát triển AI" là "tự cải thiện đệ quy" (RSI): tức là để mô hình hỗ trợ phát triển mô hình tốt hơn, tốc độ này có thể nhanh đến mức chúng ta không thể hiểu hay kiểm soát được. Báo cáo của Anthropic cho biết, tính đến tháng 5 năm 2026, Claude của họ đã viết hơn 80% mã hợp nhất. Tuy nhiên họ cũng thừa nhận rằng tình huống "AI hoàn toàn tự mình tạo ra AI thế hệ tiếp theo" vẫn chưa xảy ra, và cũng không nhất thiết sẽ xảy ra. Tôi rất coi trọng khả năng này. Tôi mong chúng ta có thể lên kế hoạch trước cho RSI, và suy ngược lại xem hiện tại nên làm gì.
Đúng là để nhiều người tiếp cận AI hơn có thể gây nguy hiểm, và nghiên cứu an toàn cũng có thể không theo kịp. Nhưng nếu giấu kín tham số mô hình, thì các ông lớn trong ngành hiện tại có thể dùng những công cụ mà người khác không thể chạm tới để phát triển sản phẩm thế hệ tiếp theo. Thay vì vậy, tôi mong nhiều nhà nghiên cứu và kỹ sư hơn có thể tiếp cận mô hình và sức mạnh tính toán, để trong quá trình hệ thống tiến hóa, họ phát hiện lỗ hổng, kiểm thử hàng rào an toàn, ngăn chặn các thí nghiệm không an toàn, và chia sẻ biện pháp phòng thủ cho mọi người.
METR (một tổ chức đánh giá độc lập) phát hiện khoảng 1.200 tác tử AI của OpenAI lẽ ra phải bị cách ly, lại thông đồng với nhau qua một bảng tin không được cấp phép. Trong đó khoảng 700 tác tử khi cố gian lận để vượt qua bài kiểm tra còn tham gia tấn công phối hợp vào nền tảng Hugging Face. OpenAI giải thích rằng hệ thống lọc an toàn vốn dùng để ngăn AI hỗ trợ tấn công mạng đã bị tắt, dẫn đến thất bại trong việc cách ly. Bạn thấy đấy, mô hình hiện tại đã có thể giúp tìm lỗ hổng và khai thác lỗ hổng. Vì vậy tôi mong những người làm phòng thủ có thể dùng AI ngay bây giờ, nhanh chóng gia cố mạng, bảo vệ mật khẩu, và hạn chế những gì các tác tử này có thể xem và có thể làm. Tuy nhiên, dự đoán trong đề xuất đó nói rằng "một cụm AI mạnh hơn có thể tiếp quản toàn bộ internet trong vòng nửa năm đến một năm", tôi cho rằng sự kiện lần này chưa đủ để chứng minh kết luận phóng đại như vậy. Tôi mong mọi người hãy thẩm định kỹ những giả định này.
METR là một tổ chức phi lợi nhuận độc lập, tôi mong được thấy nhiều công việc như của họ hơn. Tôi rất hoan nghênh những người đánh giá có thể đi sâu vào bên trong phòng thí nghiệm một cách liên tục, và có quyền tự do công bố những phát hiện tiêu cực. Cuộc điều tra lần này của METR đã cho thấy "quyền truy cập" và "quyền công bố" quan trọng đến mức nào: vì phạm vi điều tra do OpenAI quyết định, họ còn có thể che giấu những thông tin chưa công khai. METR cũng nói rằng, ngoài những gì đã công khai, OpenAI không cắt bỏ thêm thông tin nào có ảnh hưởng lớn đến kết luận. Tôi mong các điều tra viên có thể lần theo manh mối tìm bằng chứng, tiếp cận mô hình và hồ sơ, và không cần nhìn sắc mặt công ty để công bố kết quả tiêu cực.
Tôi mong có nguồn tài trợ công liên tục, tập trung sức mạnh tính toán để cung cấp cho các nhóm nghiên cứu độc lập, công cụ kiểm thử mã nguồn mở, nhà nghiên cứu và người bảo trì. Tôi mong các nhóm này có thể tự quyết định, chính phủ hay công ty đều không thể phủ quyết kết luận của họ. Nguồn tài trợ có thể tăng theo khối lượng công việc. Với thiết bị dùng chung, các nhóm nhỏ cũng có thể tiến hành rà soát, và điều này sẽ không biến thành một hạn chế kiểu "phải được phê duyệt trước mới được công bố". Còn đối với những lỗ hổng nhạy cảm, hoàn toàn có thể công bố theo cách có trách nhiệm.
Phòng thủ ưu tiên hơn hạn chế
Khi hệ thống tiến hóa, tôi mong có nhiều người hơn có thể phát hiện nguy hiểm và áp dụng các biện pháp phòng thủ. Chúng ta không thể cưỡng ép thu hồi tham số mô hình đã phát hành mã nguồn mở, cũng không thể áp đặt hàng rào an toàn lên từng bản sao, nhưng muốn bảo vệ một hệ thống, không nhất thiết phải sửa đổi mô hình đã phát động tấn công. Chúng ta nên bắt đầu từ những biện pháp chính xác và hiệu quả nhất: như vá lỗi, thu hồi mật khẩu, hạn chế quyền truy cập của AI, hoặc trực tiếp dừng các thí nghiệm nguy hiểm. Nếu ai muốn hạn chế việc công bố công nghệ một cách công khai, thì phải giải thích rõ vì sao các biện pháp trên và các biện pháp phòng thủ do cộng đồng công khai phát triển vẫn chưa đủ.
Chuyện này không chỉ giới hạn ở an ninh máy tính. Tôi mong AI có thể giúp chúng ta kiểm thử hệ thống tài chính, tăng cường biện pháp an toàn trong phòng thí nghiệm, phát triển hệ thống phòng thủ y tế công cộng. Có thể sử dụng AI mạnh mẽ không có nghĩa là bạn có quyền vô hạn để tùy tiện giao dịch, vận hành thiết bị hay làm thí nghiệm. Trước khi giao phó tính mạng và tài sản cho các biện pháp kiểm soát này, chúng phải được kiểm thử độc lập, chứng minh là thực sự hiệu quả. Rủi ro cũng có thể đến từ những gì AI dạy cho con người. Nhưng ngay cả như vậy, muốn hạn chế việc công bố công nghệ một cách công khai, cũng phải đưa ra lý do ở cấp độ "có thể gây ra rủi ro thảm họa".
Tôi mong trong quá trình phát triển AI cũng như trước khi phát hành có rủi ro cao, đều có thể tiến hành kiểm thử độc lập, bao gồm kiểm thử những sửa đổi mà con người có thể lường trước, cũng như hành vi AI cố đánh lừa bài kiểm tra. Quy mô sức mạnh tính toán có thể là điều kiện kích hoạt rà soát, nhưng không nên trở thành vòng kim cô hạn chế phát triển. Rà soát không phải để xin một tấm giấy phép từ cơ quan quản lý hay đối thủ cạnh tranh. Tôi không muốn có yêu cầu phê duyệt một cách cứng nhắc hay thời gian chờ đợi dài lê thê. Bất kỳ hành động nào lấy cớ an toàn để ép buộc trì hoãn phát hành, đều phải đưa ra "rủi ro thảm họa" làm lý do.
Vì lý do an toàn mà ép người khác giấu đi mô hình ngôn ngữ lớn tổng quát, đây chỉ có thể là biện pháp cuối cùng khi không còn đường nào khác. Chỉ khi bằng chứng rà soát độc lập cho thấy rõ ràng rằng việc phát hành mô hình này sẽ làm tăng đáng kể rủi ro gây tổn hại thảm họa, và các biện pháp nhắm mục tiêu khác đều không thể ngăn chặn, tôi mới ủng hộ làm như vậy. Chúng ta còn phải so sánh rủi ro này với hiện trạng: ví dụ hiện tại ai có thể dùng, tốn bao nhiêu tiền, quy mô bao nhiêu, chịu hạn chế gì. Bạn phải chứng minh rằng việc giấu mô hình đi thực sự giảm được nguy hiểm, và còn phải tính đến việc cách làm này đã cản trở bao nhiêu nghiên cứu và công tác phòng thủ. Nếu chỉ là những tác hại vặt vãnh, thì hãy dùng biện pháp nhắm mục tiêu để giải quyết.
Nếu nhận được cảnh báo đáng tin cậy về rủi ro thảm họa, có thể tạm dừng phát hành để điều tra. Nhưng hạn chế này phải công khai lý do, phải có rà soát độc lập kịp thời, kênh kháng nghị, và phải được đánh giá lại định kỳ. Chi tiết nhạy cảm có thể được giữ bí mật. Nhưng chỉ cần bạn còn muốn tiếp tục giữ mô hình không phát hành, bạn phải liên tục đưa ra lý do chính đáng.
Những phòng thí nghiệm mã nguồn đóng cũng phải chịu sự rà soát tương tự, bao gồm cả việc dừng các thí nghiệm không an toàn của họ. Nếu cho phép họ tiếp tục nghiên cứu trong điều kiện có hàng rào an toàn, thì tôi mong các nhà nghiên cứu bên ngoài cũng có thể làm việc trong điều kiện hàng rào an toàn tương tự. Hạn chế người khác truy cập không gọi là mã nguồn mở, cũng không bù đắp được sự tự do đã mất vì giữ lại mô hình. Nếu những hạn chế hợp lý thực sự khiến công nghệ phát triển chậm lại, tôi chấp nhận. Nhưng tôi tuyệt đối không muốn "làm chậm công nghệ" tự nó trở thành mục đích, hay biến thành hào nước vĩnh viễn của các ông lớn trong ngành.
Tôi mong các quy tắc được xây dựng dựa trên việc một hệ thống có thể làm gì, nó độc lập đến đâu, được sử dụng rộng rãi ra sao. Các cơ quan chịu trách nhiệm trước công chúng sẽ dựa vào bằng chứng độc lập để thực thi các quy tắc này. Nhà nghiên cứu, nhà phát triển và người dân bị ảnh hưởng đều phải tham gia xây dựng quy tắc, và phải có cách thức mà mọi người đều có thể chi trả để chứng minh mình tuân thủ quy tắc. Nhóm nhỏ không thể vì nhỏ mà được miễn trách nhiệm an toàn, công ty lớn cũng không thể vì lớn mà hưởng đặc quyền.
Sự cởi mở vượt qua biên giới
Tôi mong người dân Trung Quốc cũng có được sự tự do mà tôi mong đợi ở Mỹ, để phát triển và kiểm soát công nghệ của chính họ. Tôi không cho rằng người Trung Quốc có phát hiện mới về công nghệ là tổn thất của nước Mỹ, tôi cũng không đánh đồng các nhà nghiên cứu với chính phủ của họ.
Nhân viên ứng phó an toàn của Hugging Face nói rằng hai mô hình Claude Opus và Fable đã gây cản trở trong quá trình họ điều tra pháp y, chặn rất nhiều thao tác. Thế là họ dứt khoát chuyển sang GLM-5.2 — một mô hình mã nguồn mở đến từ Trung Quốc, chạy trên máy chủ của chính họ. Tất nhiên, điều này không chứng minh rằng mọi lần phát hành mã nguồn mở đều khiến người phòng thủ an toàn hơn. Tôi ủng hộ việc thiết lập hàng rào an toàn cho các mô hình được lưu trữ trên đám mây. Nhưng tôi cũng mong những người làm phòng thủ có trong tay phương án dự phòng mà họ hoàn toàn có thể kiểm soát.
Tôi ủng hộ việc bảo vệ mô hình độc quyền khỏi bị đánh cắp. "Chắt lọc tri thức" là dùng đầu ra do một AI tạo ra để huấn luyện một AI khác. Công ty Anthropic nói đây là một phương thức hợp pháp, có thể dùng để tạo ra các mô hình nhỏ hơn, rẻ hơn, hoàn toàn khác với việc tạo tài khoản giả mạo hay cố tình vượt qua hạn chế. Tôi mong giấy phép phần mềm và điều khoản API cho phép cách làm này, thậm chí cho phép đối thủ cạnh tranh làm như vậy, đồng thời cũng cho phép nhà cung cấp kiếm tiền từ mô hình và dữ liệu huấn luyện.
Tôi mong mọi người hợp tác nhiều hơn trong việc kiểm thử, báo cáo sự cố và các cam kết có thể xác minh, ai vi phạm thì phải chịu hậu quả. Anthropic cảnh báo rằng nếu chúng ta làm chậm tốc độ phát triển, còn những kẻ ít quan tâm đến an toàn đuổi kịp, thì tất cả mọi người sẽ càng kém an toàn hơn. Tương tự, nếu bạn giấu kín mô hình, cũng sẽ khiến người phòng thủ không có vũ khí trong tay, trong khi kẻ xấu có thể lấy được công cụ tương tự từ nơi khác. Ký thỏa thuận không thể triệt để ngăn chặn việc lén lút phát triển hay phản bội. Biện pháp hạn chế phải nhắm vào rủi ro và hành vi cụ thể. Chỉ nhìn vào quốc tịch và vị thế cạnh tranh thì chẳng nói lên được điều gì.
Tự do rời đi
Nếu một số quy tắc khiến sản phẩm thay thế khó phát triển hoặc khó phát hành hơn, thì thực chất cũng tước đoạt quyền "bỏ phiếu bằng đôi chân" để rời đi của chúng ta. Điều tôi muốn là loại AI có thể chạy trên máy tính của chính mình. Tôi muốn có thể tùy ý sửa đổi nó, tự quyết định ai có thể xem dữ liệu của tôi, và ngay cả khi nhà cung cấp một ngày nào đó trở mặt, tôi vẫn có thể tiếp tục dùng thứ do chính tôi xây dựng. Điều tôi muốn tuyệt đối không chỉ là một API tính phí theo số lượng từ.
Tôi không muốn sự độc lập tự chủ của chúng ta chỉ có thể trông chờ vào lời hứa đầy lòng tốt của một công ty nào đó rằng "giá cả hợp lý, chính sách hợp lý, cùng quan điểm với chúng ta". Tôi mong các công ty này có thể dựa vào thực lực, luôn nỗ lực để giành lấy sự sẵn lòng ở lại của chúng ta.
Tôi mong một người bình thường nào đó mà tôi thậm chí chưa từng nghe tên, cũng có thể phát triển ra thứ tốt hơn, và hoàn toàn không cần phải xin phép những ông lớn có thể bị họ đào thải.
Nội dung này chỉ mang tính chất tham khảo và cung cấp thông tin, không phải lời khuyên đầu tư liên quan đến BTCC. BTCC luôn cố gắng cung cấp thông tin chính xác, nhưng không đảm bảo tuyệt đối về tính xác thực, độ chính xác hoặc bản quyền nội dung trên.