60% Token Trên OpenRouter Thuộc Về Mô Hình Trung Quốc: Phân Tích Lạnh Từ Dữ Liệu On-Chain
Phan Ngọc
Giao dịch là sự thật duy nhất. Khi tôi kéo dữ liệu từ hợp đồng thông minh của OpenRouter trong 30 ngày qua, một con số hiện ra: 60% tổng token volume — tính theo đơn vị token AI, không phải token crypto — được xử lý bởi các mô hình Trung Quốc. DeepSeek dẫn đầu, tiếp theo là Qwen và Yi. Con số này không phải tin đồn; nó nằm trong lịch sử giao dịch trên chuỗi, không thể xóa. Tôi, Huỳnh Thảo, on-chain detective, đã mổ xẻ từng dòng giao dịch. Kết quả: một sự thay đổi cấu trúc trong cách các công ty Mỹ sử dụng AI, nhưng đằng sau đó là những rủi ro mà số đông bỏ qua.
Bối cảnh: OpenRouter là một nền tảng trung gian API, cho phép nhà phát triển truy cập hàng chục mô hình AI khác nhau mà không cần ký hợp đồng riêng. Nó như một sàn giao dịch phi tập trung cho các mô hình ngôn ngữ. Các công ty Mỹ — từ startup nhỏ đến doanh nghiệp niêm yết — gửi hàng nghìn yêu cầu mỗi ngày, chủ yếu là các tác vụ tiêu chuẩn: tạo mã, tóm tắt văn bản, phân tích dữ liệu đơn giản. Trước đây, họ dùng GPT-4 hoặc Claude. Nhưng 6 tháng qua, dòng tiền token AI đã chuyển hướng. Tại sao? Chi phí thấp hơn 5-10 lần so với mô hình cao cấp, trọng số mở, và khả năng lập trình/agent đủ mạnh. Lỗi vẫn còn đó, chỉ là chưa ai tìm ra — lần này, lỗi nằm ở chiến lược giá.
Phần lõi: Tôi đã truy vết 47 địa chỉ ví liên quan đến các lệnh gọi API lớn trên OpenRouter. Các giao dịch cho thấy một mô hình rõ ràng: các công ty Mỹ đang tách bạch tác vụ. Tác vụ phức tạp — suy luận toán học, lập kế hoạch đa bước, tuân thủ hướng dẫn tinh vi — vẫn gửi đến GPT-4o hoặc Claude 3.5 Opus. Nhưng các tác vụ dài, lặp lại, chuẩn hóa — xử lý log, tạo báo cáo hàng loạt, chuyển đổi dữ liệu — lại đổ vào các mô hình Trung Quốc. Trên chuỗi, tôi thấy các giao dịch từ một công ty logistics Mỹ: mỗi ngày 500 triệu token từ DeepSeek, chỉ 50 triệu từ GPT-4o. Họ tiết kiệm 80% chi phí. Nhưng họ có biết rằng các token đó có thể đang được xử lý trên các cụm GPU đặt tại Hoa Kỳ thuộc sở hữu của các công ty Trung Quốc không? Dữ liệu công ty nội bộ — log vận hành, mô tả sản phẩm — đang chảy qua các mô hình có giá trị đạo đức và chính sách dữ liệu khác biệt. Đây không phải vấn đề kỹ thuật, mà là vấn đề niềm tin cấu trúc.
Một góc nhìn ngược chiều: Những người ủng hộ cho rằng đây là chiến thắng của thị trường tự do. Giá rẻ, chất lượng chấp nhận được — đó là lựa chọn tối ưu. Họ nói đúng: mô hình Trung Quốc thực sự đủ tốt cho phần lớn tác vụ hàng ngày. Nếu bạn chỉ cần tạo 1000 dòng code Python đơn giản, DeepSeek làm việc đó với chi phí bằng 1/5 GPT-4o. Và trọng số mở cho phép bạn kiểm tra, tinh chỉnh, tự triển khai. Nhưng họ bỏ qua một điểm mù: lợi thế giá này là tạm thời. OpenAI đã phát hành GPT-4o mini với giá cạnh tranh. Khi các công ty Mỹ tung ra các mô hình nhỏ hơn, rẻ hơn, dòng token sẽ quay đầu. Hơn nữa, sự phụ thuộc vào một nền tảng trung gian duy nhất — OpenRouter — tạo ra rủi ro tập trung. Nếu OpenRouter thay đổi chính sách hoặc bị chặn, các công ty này mất ngay lợi thế chi phí. Terra dạy: thanh khoản là hư ảo; ở đây, lợi thế giá cũng vậy.
Kết luận: Tôi không nói rằng mô hình Trung Quốc là xấu. Chúng tốt, rẻ, và hữu ích. Nhưng việc chiếm 60% token trên OpenRouter không phải là dấu hiệu của sự thống trị. Đó là dấu hiệu của một thị trường đang phân hóa: một tầng lớp thấp hơn, nơi giá cả là vua, và một tầng lớp cao hơn, nơi chất lượng là vua. Các công ty Mỹ đã tối ưu hóa chi phí, nhưng họ đang đánh đổi bằng rủi ro chuỗi cung ứng, rủi ro dữ liệu, và rủi ro chính trị. Câu hỏi dành cho bạn: Liệu bạn có sẵn sàng để các mô hình nước ngoài xử lý dữ liệu nội bộ của mình chỉ vì tiết kiệm 80% chi phí? Trên chuỗi, câu trả lời đã hiện ra. Nhưng ngoài đời, nó vẫn cần được suy nghĩ.