Tiêu đề: Cuộc chiến nội bộ tại Anthropic: Đóng hay mở – Ai quyết định tương lai của blockchain AI?
Tác giả: Lý Hiếu Risk Management Consultant, Tiến sĩ Mật mã học Vienna, Áo
Bạn nghĩ rằng một dự án blockchain AI với lời hứa “an toàn tuyệt đối” thực sự có nội bộ minh bạch? Hãy nhìn vào Anthropic – cái tên được ca ngợi như ngọn hải đăng của AI có trách nhiệm. Nhưng tuần trước, một báo cáo từ Beating Monitoring đã phơi bày vết nứt sâu trong tổ chức này: CEO Dario Amodei tuyên bố “sẽ không bao giờ mở mã nguồn” mô hình mạnh nhất, trong khi một nhóm nhân viên do Shaun dẫn đầu đang tích cực vận động cho một lá thư ngỏ yêu cầu công khai trọng số mô hình. Lỗ hổng? Tôi đã thấy nó từ hôm qua.
Anthropic không phải là một dự án blockchain thông thường. Nó là một mạng lưới AI phi tập trung (decentralized AI network) được xây dựng trên nền tảng blockchain, với mục tiêu cung cấp các mô hình ngôn ngữ lớn (LLM) thông qua cơ chế đồng thuận. Khác với Bitcoin hay Ethereum chỉ xử lý giao dịch, Anthropic lưu trữ và thực thi các trọng số mô hình trên chuỗi, cho phép người dùng truy vấn mà không cần tin tưởng vào một bên thứ ba. Từng gọi mình là “người bảo vệ nhân loại khỏi AI nguy hiểm”, CEO Dario Amodei liên tục nhấn mạnh rằng việc công khai trọng số sẽ tạo ra những bản sao không thể kiểm soát – giống như việc ai đó sao chép toàn bộ mã nguồn của một hợp đồng thông minh đã được audit nhưng bỏ qua lớp bảo vệ.
Nhưng bức tranh không hoàn hảo. Shaun, một nhà nghiên cứu hậu huấn luyện (post-training researcher), đã công khai bày tỏ sự phản đối trên Twitter: “Việc giữ kín trọng số không làm cho AI an toàn hơn – nó chỉ làm cho việc kiểm toán bởi cộng đồng trở nên bất khả thi.” Mâu thuẫn này không chỉ là chuyện nội bộ, mà là cuộc chiến định hình tương lai của toàn bộ hệ sinh thái blockchain AI. Audit bị từ chối? Đã biết trước rồi.
Phân tích kỹ thuật: Hai trường phái bảo mật đối đầu
Trường phái của Amodei: Kiểm soát tập trung thông qua “bảo mật bằng cách che giấu” Amodei tin rằng an toàn của một mô hình AI phụ thuộc vào khả năng không thể loại bỏ các lớp bảo vệ. Trong kiến trúc của Anthropic, các biện pháp an toàn như constitutional AI (AI hiến pháp) và system prompts được thêm vào bên ngoài trọng số chính. Khi trọng số bị công khai, bất kỳ ai cũng có thể loại bỏ các lớp này, tạo ra một phiên bản “trần trụi” mà theo Amodei là cực kỳ nguy hiểm. Ông ủng hộ việc hạn chế xuất khẩu chip tiên tiến và áp đặt các bài kiểm tra an toàn bắt buộc – một lập trường được các cơ quan quản lý Mỹ ủng hộ.
Trường phái của Shaun: Bảo mật thông qua minh bạch và kiểm toán cộng đồng Shaun đại diện cho một nhóm kỹ sư tin rằng sự an toàn thực sự chỉ đến khi cộng đồng có thể nhìn thấy và kiểm tra mọi dòng code. Họ lập luận rằng các lỗ hổng bảo mật thường được phát hiện bởi các nhà nghiên cứu độc lập, không phải bởi đội ngũ nội bộ. Nếu Anthropic công khai trọng số, toàn bộ hệ sinh thái có thể tham gia vào quá trình “red teaming” (tấn công thử nghiệm), giúp vá lỗi nhanh hơn gấp nhiều lần so với một nhóm kín. Quan điểm này phản ánh triết lý của Bitcoin và các blockchain mã nguồn mở: không có bí mật nào có thể tồn tại lâu dài, và sự tin tưởng được xây dựng từ sự minh bạch.
Từ góc nhìn kỹ thuật, tôi thấy cả hai đều có lý. Amodei đúng về mặt lý thuyết: một khi trọng số ra ngoài, không thể thu hồi. Nhưng Shaun cũng đúng: nếu mô hình thực sự an toàn, nó phải chịu được sự soi xét của đám đông. Vấn đề nằm ở chỗ Anthropic chưa bao giờ chứng minh được rằng các biện pháp bảo vệ của họ là không thể tháo rời. Nếu bảo mật chỉ là một lớp sơn phủ bên ngoài, thì việc giấu trọng số chỉ là ảo tưởng.
Góc nhìn ngược chiều: Phe đóng cửa có thể cũng có lý
Trước khi vội vàng chỉ trích Amodei, hãy xem xét một điểm mù mà phe mở cửa thường bỏ qua: chi phí của việc mở mã nguồn không chỉ là rủi ro bảo mật, mà còn là rủi ro kinh tế. Anthropic hiện đang bán quyền truy cập API với giá cao hơn 20% so với các đối thủ nhờ vào “lớp bảo mật” độc quyền. Nếu họ mở trọng số, toàn bộ mô hình kinh doanh sụp đổ – ai sẽ trả tiền cho một thứ có thể tải miễn phí? Hơn nữa, việc mở cửa có thể tạo ra hàng loạt “bản sao lậu” trên các blockchain khác, làm loãng thương hiệu và giảm động lực phát triển.
Shaun và nhóm của anh ta có thể đang lý tưởng hóa quá mức về “cộng đồng kiểm toán”. Thực tế, các dự án blockchain mã nguồn mở lớn như Bitcoin hay Ethereum vẫn tồn tại vô số lỗ hổng được phát hiện nhiều năm sau khi ra mắt. Minh bạch không đồng nghĩa với an toàn; nó chỉ đồng nghĩa với khả năng bị tấn công cao hơn nếu không có cơ chế vá lỗi kịp thời. Trong một mạng lưới AI phi tập trung, việc vá lỗi còn khó hơn vì phải đạt được đồng thuận từ nhiều validator.
Cuộc chiến này thực chất là sự va chạm giữa hai giá trị: tốc độ đổi mới và sự ổn định. Phe đóng cửa muốn bảo vệ thành quả lao động khỏi những kẻ xấu, trong khi phe mở cửa muốn thúc đẩy một hệ sinh thái cởi mở hơn. Cả hai đều đúng trong bối cảnh của họ.
Hệ quả cho ngành blockchain AI
Nếu sự bất đồng này tiếp diễn, nó có thể tạo ra một làn sóng “chia tách” (fork) không chỉ trong Anthropic mà còn trong toàn bộ ngành. Hãy tưởng tượng: một nhóm kỹ sư do Shaun dẫn đầu rời công ty và thành lập một dự án mã nguồn mở mới, sao chép kiến trúc của Anthropic nhưng với trọng số công khai. Điều đó sẽ tạo ra một đối thủ cạnh tranh trực tiếp, giống như SushiSwap đã fork Uniswap vào năm 2020. Nhưng khác biệt ở chỗ: lần này, người fork có kiến thức sâu sắc về bảo mật nội bộ, khiến cho bản fork có thể an toàn hơn cả bản gốc.
Về mặt đầu tư, các quỹ VC đang đổ tiền vào Anthropic ở mức định giá 60 tỷ USD. Nếu nội bộ lộn xộn, các nhà đầu tư sẽ yêu cầu một mức “bảo hiểm rủi ro” cao hơn, làm tăng chi phí vốn. Tôi từng chứng kiến điều tương tự khi một dự án ICO mà tôi audit năm 2017 bị rút thanh khoản sau 3 tuần – lỗ hổng quản trị luôn đáng sợ hơn lỗ hổng code.
Takeaway: Lời kêu gọi trách nhiệm
Khi một dự án tự xưng là “an toàn nhất” lại không thể giải quyết mâu thuẫn nội bộ về bản chất của sự an toàn, bạn có thực sự tin tưởng vào tương lai của nó? Tôi không nói rằng mở mã nguồn là giải pháp duy nhất, nhưng việc giấu đi trọng số và hy vọng không ai tìm ra lỗ hổng là một chiến lược ngây thơ. Cộng đồng blockchain cần đặt ra câu hỏi: Liệu một hệ thống không thể bị kiểm toán bởi công chúng có xứng đáng được gọi là “phi tập trung”? Hãy nhìn vào các Layer 2 Bitcoin tự xưng – tôi đã thấy quá nhiều kẻ mạo danh.
Trong thế giới của tôi, mỗi dòng code đều phải được mổ xẻ. Nếu Anthropic không thể đối mặt với sự thật, thì có lẽ đã đến lúc cộng đồng tự tay xây dựng một giải pháp thay thế thực sự minh bạch.
Prompt hình ảnh: Một bức ảnh kỹ thuật số phong cách tối giản, màu xanh dương và đen, thể hiện một chiếc két sắt mở ra với ánh sáng chói lóa từ bên trong, xung quanh là các dòng code blockchain bay lượn. Phía xa, một nhóm người đứng tranh luận trước một màn hình lớn hiển thị biểu tượng “fork”.