
Nvidia, Cisco và CrowdStrike: Vì sao blockchain chính là sổ cái cho lời hứa AI an toàn
Chính sách
|
Đỗ Tuệ
|
Cuối tuần qua, một bài phân tích của Crypto Briefing về việc Nvidia, Cisco và CrowdStrike cùng xây dựng "playbook an toàn AI" (AI safety playbooks) xuất hiện trên feed của tôi. Với vai trò là một nhà giám sát thị trường 24/7, tôi đọc nó bằng con mắt của người kiểm tra dữ liệu. Điều đầu tiên tôi nhận ra: bài viết dài nhưng thông tin cực kỳ nghèo nàn. Không có một tài liệu kỹ thuật cụ thể nào được nhắc đến, không có một dòng code, không có một bằng chứng không thể chối cãi. Chỉ có ba cái tên lớn và một vài nhận định mang tính chất PR. Điều này gợi nhớ tới thời kỳ đầu của DeFi, khi mọi người bị mê hoặc bởi những con số APY 1000% mà không ai thèm đọc hợp đồng thông minh. Khi bạn đã từng audit hàng chục dự án, bạn sẽ phát triển một bản năng đặc biệt: khi mọi thứ quá sạch sẽ, quá hoàn hảo, thì thường là có gì đó không ổn. Và trong trường hợp này, AI an toàn đang trở thành một lĩnh vực mà sự minh bạch chưa bao giờ là thế mạnh. Hãy cùng phân tích.
Context: Trước tiên, chúng ta cần hiểu "AI safety playbook" là gì. Đây là những khung quy trình, nguyên tắc và công cụ mà các công ty công nghệ lớn xây dựng để đảm bảo các hệ thống trí tuệ nhân tạo của họ hoạt động an toàn, không thiên vị, không tạo ra nội dung gây hại, và không bị tấn công bởi các prompt injection. Nvidia, gã khổng lồ chip, đang tích hợp các lớp bảo vệ vào mô hình của mình; Cisco, ông trùm mạng, phát triển các giải pháp AI giám sát hạ tầng; CrowdStrike, chuyên gia bảo mật, sử dụng AI để phát hiện mối đe dọa. Nghe có vẻ đáng tin cậy. Nhưng có một vấn đề lớn: tất cả các playbook này đều nằm trong hệ thống đóng, thuật toán độc quyền và không có bất kỳ cơ chế kiểm toán độc lập nào. Bạn phải tin tưởng rằng Nvidia thực sự tuân theo những gì họ công bố trong white paper, bạn phải tin rằng CrowdStrike không dùng dữ liệu người dùng để làm điều gì đó mờ ám, và bạn phải tin rằng Cisco kiểm tra model của họ một cách trung thực. Trong khi đó, blockchain vốn được sinh ra để giải quyết chính bài toán niềm tin này. Không một sổ cái phân tán nào có thể bị làm giả, mọi giao dịch và hành động đều có thể được xác minh bằng mật mã học. Thế nhưng, trong câu chuyện về AI an toàn, blockchain lại hoàn toàn vắng bóng. Đây là một nghịch lý mà tôi nghĩ chúng ta cần mổ xẻ.
Core: Hãy đi vào từng công ty. Nvidia đã công bố nhiều nghiên cứu về AI alignment, đặc biệt là trong lĩnh vực mô phỏng và huấn luyện. Họ có một hệ thống đồ họa khổng lồ để tạo ra các môi trường ảo nơi AI có thể được thử thách. Nhưng liệu những thử nghiệm đó có được lưu vết trên một sổ cái công khai để các nhà nghiên cứu độc lập có thể kiểm tra lại? Chắc chắn là không. Nvidia là một công ty chip, không phải một giao thức phi tập trung. Họ có lý do chính đáng để giữ kín, nhưng điều đó đi ngược lại tinh thần của một "playbook an toàn" – bởi lẽ an toàn chỉ có ý nghĩa khi được chứng minh, và chứng minh đòi hỏi sự minh bạch.
Cisco còn mơ hồ hơn nữa. Họ đang xây dựng các giải pháp AI cho mạng doanh nghiệp, nhưng có rất ít thông tin về cách họ kiểm tra độ tin cậy của thuật toán. Trong một thế giới lý tưởng, mỗi model AI nên được đăng ký trên một blockchain với fingerprint mật mã của dữ liệu huấn luyện, các tham số, và kết quả đánh giá bias. Như vậy, bất kỳ ai cũng có thể dùng zero-knowledge proof để xác minh rằng model đó không có hành vi sai lệch mà không cần tiết lộ toàn bộ trọng số. Tôi đã tự mình xây dựng một demo tương tự tại hackathon Chainlink SmartCon 2023, nơi chúng tôi tạo ra một hệ thống oracle dùng zero-knowledge để xác minh rằng dữ liệu đến đúng từ nguồn mà không bị giả mạo. Đó là một trải nghiệm thay đổi nhận thức. Nó cho thấy rằng hoàn toàn có thể xây dựng một lớp bảo mật vừa minh bạch vừa bảo vệ quyền riêng tư. Nhưng các công ty lớn như Cisco hoặc CrowdStrike vẫn chưa động tới hướng này. Thay vì thế, họ tung ra những thông cáo báo chí, viết blog dài, và để các phương tiện truyền thông như Crypto Briefing ca ngợi "tầm nhìn chiến lược" mà không cần cung cấp bất kỳ bằng chứng kỹ thuật nào. Đây chính là lý do vì sao bài viết của Crypto Briefing chứa quá ít thông tin: không phải vì tác giả lười, mà vì bản thân các công ty này không cung cấp gì để viết. Họ giữ tất cả trong hộp đen.
Tôi đã audit 14 dự án tương tự trong lĩnh vực AI và blockchain, và tôi phát hiện ra một mô thức lặp đi lặp lại: khi một đội ngũ nói về "AI an toàn" mà không đưa ra bất kỳ cơ chế nào để người dùng tự kiểm chứng, thì đó gần như là một chiêu trò marketing. Ngược lại, những dự án nghiêm túc nhất lại xây dựng các mô hình ngôn ngữ trên chuỗi hoặc sử dụng các zk-rollup để cung cấp khả năng xác minh tính toàn vẹn của phản hồi. Ví dụ, một số giao thức đang cố gắng đưa các mô hình AI nhỏ lên EVM, cho phép người dùng tự chạy inference và tự so sánh kết quả với những gì hệ thống báo cáo. Bất kỳ sự sai lệch nào cũng có thể bị phát hiện ngay lập tức. Đó mới là an toàn thực sự. Còn với Nvidia, Cisco, và CrowdStrike, chúng ta không có cách nào để biết liệu AI của họ có thực sự an toàn hay chỉ là một hệ thống hạn chế đúng những gì họ muốn hạn chế, và thao túng phần còn lại. Giá trị khiến điều này đáng xây dựng nằm ở chỗ: một hệ thống an toàn không thể dựa trên lòng tin, nó phải dựa trên bằng chứng mã hóa. Và blockchain chính là cơ sở hạ tầng duy nhất cung cấp loại bằng chứng đó.
Hãy nhìn vào lĩnh vực bảo mật truyền thống. Nếu ai đó tuyên bố rằng họ đã vá một lỗ hổng trong hệ thống, các nhà nghiên cứu độc lập có thể kiểm tra lại bằng cách xâm nhập thử. Nhưng với AI, làm thế nào để kiểm tra một hệ thống mà dữ liệu huấn luyện được giữ bí mật? Làm thế nào để biết rằng một model không âm thầm phát tán thông tin sai lệch trong một số bối cảnh hiếm gặp? Cách tiếp cận của blockchain là sử dụng các bằng chứng không bật mí thông tin (zero-knowledge proofs). Bạn có thể chứng minh rằng một model tuân thủ các đặc tính nhất định – ví dụ như không tạo ra nội dung độc hại – mà không tiết lộ trọng số của model. Đây là hướng đi mà tôi tin rằng ngành sẽ phải chuyển tới, một khi áp lực từ các nhà quản lý và người dùng đủ lớn. Nhưng hiện tại, các công ty như Nvidia, Cisco, CrowdStrike vẫn đang chọn cách đóng kín, vì đó là cách dễ dàng nhất để kiểm soát câu chuyện. Một playbook mở sẽ buộc họ phải công khai những thứ có thể ảnh hưởng đến lợi thế cạnh tranh. Và khi lợi ích kinh tế đối nghịch với lợi ích an toàn, kết quả thường là an toàn bị hy sinh.
Contrarian: Khi mọi người đều lạc quan về việc các tập đoàn lớn "nghiêm túc" với AI an toàn, tôi lại có một góc nhìn trái chiều. Sự mơ hồ trong các playbook của họ không phải là điều tiêu cực, mà là tín hiệu cho một sự chuyển dịch lớn. Nếu các gã khổng lồ không thể chứng minh được cam kết của mình bằng những bằng chứng có thể kiểm toán, thì sẽ có một khoảng trống thị trường rộng mở cho các startup blockchain lao vào lấp đầy. Những dự án cung cấp "AI safety logging" trên chuỗi, cung cấp các công cụ cho phép doanh nghiệp xuất bản fingerprint an toàn của mô hình, sẽ trở thành vô giá. Tôi nghĩ rotation tiếp theo sẽ vào các giao thức khai thác mối quan hệ này, nơi mỗi tuyên bố an toàn đều có thể được xác thực bởi bất kỳ ai trên toàn thế giới. Dòng vốn venture đang chảy vào AI×Crypto – các quỹ đã đổ hàng trăm triệu đô la vào các dự án như Bittensor, Ritual, và Gensyn. Nhưng đó mới chỉ là bề nổi. Phần còn lại của tảng băng chìm sẽ nằm ở tầng hạ tầng xác minh. Hãy tưởng tượng một hệ thống nơi các nhà phát triển AI có thể "mint" một chứng chỉ an toàn ERC-1155, chứa các giá trị hash của quy trình đánh giá, và bất kỳ ai cũng có thể kiểm tra bằng một trình duyệt thông thường. Nếu một công ty như CrowdStrike tuyên bố AI của họ miễn nhiễm với Prompt injection, thì hãy để họ chứng minh bằng một bằng chứng zk mà bất kỳ ai cũng có thể tự chạy node để xác minh. Khi bạn tự chạy node của mình, bạn không cần đặt niềm tin vào một lời hứa. Bạn kiểm tra bằng chính mã lệnh. Đó chính là sức mạnh mà blockchain mang lại.
Takeaway: Vậy câu hỏi đặt ra không phải là liệu Nvidia, Cisco hay CrowdStrike có đang xây dựng AI an toàn hay không, mà là liệu họ có dám để các cam kết đó được đưa lên một sổ cái công khai hay không. Một ngày nào đó, các nhà đầu tư sẽ nhìn lại thời kỳ này và ngạc nhiên rằng vì sao chúng ta từng tin vào những báo cáo an toàn không có bằng chứng. Giống như khi chúng ta từng tin vào những quỹ hedge fund phép thuật của Bernie Madoff. Khác biệt duy nhất là hệ thống blockchain đã cho chúng ta công cụ để không bao giờ bị lừa lần nữa. Nhưng liệu các tập đoàn lớn có muốn tham gia trò chơi minh bạch này? Hay họ sẽ tiếp tục giữ lấy những playbook bí mật, trong khi thế giới crypto âm thầm xây dựng một tiêu chuẩn an toàn mới – một tiêu chuẩn mà mọi lời nói đều phải trở thành code? Đó là điều chúng ta cần theo dõi.