Hỏi audit chưa? Không hỏi thì đừng kêu. Nhưng nếu bản thân cái audit đó lại được thiết kế để phục vụ lợi ích của kẻ đi audit, thì sao?
Anthropic – công ty AI đình đám với mác “an toàn” – vừa có động thái khiến tôi, một kẻ chuyên mổ xẻ code và narrative, phải ngồi thẳng dậy. Họ là hãng tiên phong duy nhất từ chối ký vào bản kiến nghị ủng hộ mã nguồn mở, vốn đã có chữ ký của OpenAI, Google và cả SpaceX. Thay vào đó, CEO Dario Amodei đề xuất ba biện pháp thay thế: hạn chế chip tiên tiến sang Trung Quốc, đàn áp “distillation” quy mô công nghiệp, và bắt buộc kiểm định an toàn cho mọi mô hình mạnh.
Nghe có vẻ hợp lý? Hãy để tôi nhìn vào dưới kính hiển vi của một kỹ sư audit – thứ duy nhất tôi tin, ngoài số liệu trên on-chain.
Bối cảnh: Khi “mở” trở thành con dao hai lưỡi
Ngành AI đang sống trong kỷ nguyên “mở nhưng không hoàn toàn mở”. Các mô hình nguồn mở như Llama của Meta được tung ra trọng đại, nhưng cộng đồng vẫn tranh cãi: mở có làm tăng nguy cơ bị lạm dụng không? Anthropic đứng ở phe “cẩn trọng có điều kiện”. Họ cho rằng: một khi trọng số mô hình bị phát tán, mọi lớp bảo vệ an toàn đều có thể bị gỡ bỏ một cách không thể đảo ngược. Điều này nghe quen không? Giống như smart contract khi đã deploy, nếu có backdoor thì audit mấy lần cũng vô dụng.
Nhưng điều khiến tôi chú ý không phải là lập luận an toàn, mà là lựa chọn “không ký” của Anthropic giữa một rừng ông lớn đã ký. Trong thế giới crypto, hành động “không join” một alliance thường báo hiệu chiến lược cạnh tranh ngầm. Ở đây cũng vậy.
Phần mổ xẻ chính: Ba đề xuất, ba lớp ngụy trang
Hãy xét từng cái một bằng con mắt của một audit partner từng chứng kiến bao nhiêu dự án dùng “bảo mật” để che giấu thiếu sót kỹ thuật.
1. Hạn chế chip tiên tiến sang Trung Quốc. Đây không phải chuyện an toàn AI – đây là địa chính trị. Anthropic đang dùng “an toàn” như cái cớ để ủng hộ các lệnh trừng phạt chip của Mỹ. Trong bối cảnh blockchain, điều này giống như nói “chúng ta phải hạn chế GPU cho các miner nhất định để bảo vệ mạng lưới”. Thực chất, nó bảo vệ lợi thế cạnh tranh của các công ty Mỹ về hạ tầng tính toán. Nếu bạn nghĩ việc này sẽ không ảnh hưởng đến crypto, hãy nhìn vào các Layer 2 dùng zk-proof – chúng cũng cần chip mạnh để chạy prover. Hạn chế đồng nghĩa với kìm hãm tốc độ phát triển của toàn bộ hệ sinh thái phi tập trung ngoài Mỹ.
2. Đàn áp “distillation” quy mô công nghiệp. Distillation – kỹ thuật cho phép mô hình nhỏ học từ mô hình lớn – là cách mà nhiều startup AI và cả các dự án blockchain (dùng AI để tối ưu hợp đồng) có thể bắt kịp. Anthropic muốn “đánh” vào điểm này, giống như các sàn DEX muốn cấm các bot copy trade vì chúng “ăn cắp” chiến lược. Nhưng distillation không phải hack – nó là một phương pháp nghiên cứu hợp pháp. Cấm nó đồng nghĩa với việc các công ty nhỏ sẽ mãi phụ thuộc vào API của Anthropic hay OpenAI, biến thị trường AI thành độc quyền trả tiền theo từng truy vấn. Nghe quen không? Giống như một blockchain L1 nói “bạn không được chạy archive node riêng, hãy dùng RPC của chúng tôi”.
3. Bắt buộc kiểm định an toàn cho mọi mô hình mạnh. Điều này nghe có vẻ tiến bộ: kiểm tra trước khi phát hành, giống như audit smart contract trước khi deploy. Nhưng vấn đề là ai sẽ là người đưa ra tiêu chuẩn? Anthropic đang tự đặt mình vào vị trí “người gác cổng”. Trong ngành của tôi, audit có giá trị khi độc lập. Một công ty vừa là nhà phát triển mô hình, vừa là người đề xuất quy định kiểm định – đó là conflict of interest cơ bản. Họ có thể định nghĩa “mô hình mạnh” theo cách loại bỏ đối thủ. Ví dụ: nếu bạn cần vượt qua bài kiểm tra sinh học hay tấn công mạng, mà bài kiểm tra đó lại được thiết kế dựa trên phạm vi hiểu biết của chính Anthropic, các mô hình khác sẽ khó lòng đạt chuẩn.

Kết luận của tôi sau khi mổ xẻ ba điểm: Đây không phải là kế hoạch an toàn, mà là chiến lược thâu tóm quyền lực thông qua regulatory capture.
Góc nhìn trái chiều: Phần phe bò có thể đúng
Nhưng tôi không phải kẻ chỉ biết chửi. Hãy nhìn vào mặt phải: Lập luận của Anthropic về “trọng số không thể thu hồi” là có cơ sở kỹ thuật. Một khi mô hình mạnh được phát tán open-source, không ai có thể ngăn chặn kẻ xấu fine-tune nó thành vũ khí. Trong blockchain, chúng ta cũng từng chứng kiến các smart contract bị fork và dùng cho mục đích lừa đảo, dù code gốc đã được audit. Cho nên, ý tưởng về kiểm định bắt buộc (nếu thực sự độc lập và minh bạch) có thể tạo ra một lớp bảo vệ cần thiết.
Hơn nữa, nếu nhìn vào ngành crypto, các stablecoin như USDC cũng bị chỉ trích vì “compliance-first” nhưng thực tế chúng lại mang đến sự ổn định cho thị trường. Có thể Anthropic đang làm điều tương tự: kiểm soát chặt chẽ để tạo ra niềm tin cho các tổ chức lớn. Nếu điều này giúp AI được chấp nhận rộng rãi, thì về lâu dài, blockchain cũng hưởng lợi từ hạ tầng AI an toàn hơn.
Tuy nhiên, tôi vẫn giữ lập trường: bất kỳ giải pháp nào do một bên duy nhất đề xuất và có lợi cho bên đó đều cần bị soi dưới kính lúp. Hãy nhớ Harvest Finance năm 2020 – audit xong vẫn bị hack. Đừng để một câu chuyện “an toàn” đẹp đẽ che mắt bạn.
Takeaway: Hãy tự hỏi – AI audit của bạn đã được audit bởi ai?
Anthropic đã gieo một hạt giống: ba biện pháp của họ có thể trở thành luật trong tương lai gần. Với dân crypto, chúng ta có kinh nghiệm sống với việc bị quản lý, với các quy định KYC, với áp lực tuân thủ. Nhưng đừng để sự mệt mỏi làm bạn chấp nhận một giải pháp “an toàn” do chính đối thủ cạnh tranh vẽ ra.
Hãy nhìn vào code. Hãy nhìn vào dữ liệu. Đừng nhìn vào logo “safe” trên website.
Hỏi audit chưa? Nếu chỉ có Anthropic tự audit chính mình, thì câu trả lời là: đừng kêu.