BofA vừa nâng mục tiêu giá SanDisk lên 2.500 USD. Lý do: nhu cầu lưu trữ AI đang kéo dài chu kỳ tăng trưởng của ngành NAND. Con số ấy không làm tôi ngạc nhiên.
Nhưng có một câu hỏi. Khi toàn bộ thị trường đổ xô mua cổ phiếu bán dẫn, tại sao các mạng lưới lưu trữ phi tập trung như Filecoin, Arweave vẫn giậm chân tại chỗ? Đội ngũ của họ vẫn nói về tương lai phân quyền. Token vẫn được giao dịch. Nhưng dòng doanh thu thực từ người dùng vẫn là một dấu hỏi lớn.
Hãy để tôi tháo gỡ từng lớp.
Bối cảnh: AI không chỉ cần GPU, nó cần bộ nhớ
AI training cần checkpoint. Inference cần vector database. RAG cần lưu trữ log và truy xuất dữ liệu liên tục. Tất cả những tác vụ này ngốn hàng petabyte dung lượng mỗi ngày. SanDisk hưởng lợi từ chính câu chuyện đó. Họ là nhà sản xuất NAND, nguyên liệu thô của mọi ổ cứng enterprise.
Các mạng lưu trữ phi tập trung cũng cung cấp dung lượng. Nhưng có một khác biệt cơ bản: SanDisk sở hữu sản phẩm vật lý, còn Filecoin, Arweave chỉ sở hữu một lời hứa.
Phần lõi: Mổ xẻ mô hình lưu trữ phi tập trung bằng con mắt kiểm toán
Hãy nhìn vào Filecoin. Giao thức này yêu cầu người khai thác cung cấp bằng chứng lưu trữ qua Proof-of-Replication và Proof-of-Spacetime. Về mặt lý thuyết, hệ thống vận hành ổn định. Nhưng số liệu thực tế phơi bày một thực tế khác: phần lớn dữ liệu được lưu trữ trên Filecoin là dữ liệu rác, dữ liệu được khai thác bởi các quỹ khuyến khích, không phải nhu cầu thực từ doanh nghiệp.
Tôi nhớ một lần audit một giao thức storage. Khi nhìn vào danh sách các nhà cung cấp hàng đầu, tôi phát hiện ba địa chỉ kiểm soát hơn 60% dung lượng. Họ có thể tự do thao túng giá deal, thậm chí tạo ra các deal ảo giữa các ví của chính mình. Hệ thống vẫn ghi nhận là hợp lệ. Vì bằng chứng mật mã không thể phân biệt được dữ liệu thật và dữ liệu được bơm.
Mỗi hợp đồng lưu trữ là một lỗ hổng tiềm ẩn với lớp sơn bóng.
Arweave thì khác. Họ bán lưu trữ vĩnh viễn, trả phí một lần và dùng lãi suất từ endowment để duy trì. Nhưng mô hình này phụ thuộc vào giá AR tăng trưởng dài hạn. Nếu token giảm 70%, endowment sẽ không đủ để trang trải chi phí điện và hạ tầng. Người dùng trả tiền để lưu trữ vĩnh viễn, nhưng sự vĩnh viễn đó chỉ tồn tại nếu thị trường token không sụp đổ.
Nói như một nhà phân tích cấu trúc, đây là một dạng contingent risk: nghĩa vụ được hứa hẹn trước, nhưng nguồn tiền để thực hiện nghĩa vụ vẫn là một ẩn số.
Chi phí tương đối cũng là một cú sốc. Một terabyte trên AWS có chi phí khoảng 25–30 USD mỗi tháng với SLA 99,99%. Filecoin có thể rẻ hơn ba lần, nhưng không có SLA, không có độ trễ đảm bảo, không có hỗ trợ doanh nghiệp. Doanh nghiệp không mua rủi ro vận hành chỉ để tiết kiệm vài chục đô la. Kết quả: thị trường mục tiêu của Filecoin chỉ là những người cần dữ liệu bất biến, không cần kiểm duyệt, và chấp nhận hiệu suất thấp.
Điểm mù của phe bò
Tuy nhiên, nếu chỉ nhìn vào doanh thu hiện tại, tôi sẽ bỏ lỡ một thay đổi mang tính cấu trúc. AI đang tạo ra một lớp dữ liệu mới: dữ liệu đào tạo, dữ liệu mô hình, dữ liệu chứng minh nguồn gốc. Trong tương lai, khi các mô hình AI bắt đầu kiện nhau vì bản quyền, những bằng chứng lưu trữ phi tập trung sẽ trở thành công cụ pháp lý quan trọng. Ai có thể chứng minh một mô hình được huấn luyện trên một bộ dữ liệu cụ thể? Một mạng lưới lưu trữ bất biến có thể trả lời câu hỏi này tốt hơn Amazon S3.
Đó là thị trường ngách, nhưng giá trị lại rất cao.
Những dự án hiểu được điều này không còn bán“dung lượng” mà bán“bằng chứng”. Arweave đã bắt đầu chuyển hướng sang dữ liệu pháp lý. Filecoin gần đây giới thiệu các hợp đồng lưu trữ có thể lập trình cho dữ liệu AI, đòi hỏi tính toàn vẹn cao hơn. Đây là hướng đi đúng.
Nhưng là một người từng nghe quá nhiều câu chuyện “chuyển hướng”, tôi cần nhìn vào số liệu vận hành, không phải lộ trình.
Kết luận: Câu hỏi thay vì câu trả lời
SanDisk có 84,6% biên lợi nhuận gộp. Filecoin có một mạng lưới lưu trữ vận hành tự động. Arweave có một quỹ endowment. Ba mô hình khác nhau, nhưng chỉ một mô hình chứng minh được rằng khách hàng sẵn sàng trả giá cao.
Lưu trữ phi tập trung không phải là câu trả lời cho bài toán AI. Nó là câu hỏi mà chúng ta chưa đủ dũng cảm để hỏi.
Và khi AI cần độ trễ thấp, bảo mật tuyệt đối và khả năng chịu trách nhiệm pháp lý — liệu bạn có thực sự đặt dữ liệu vào một mạng lưới mà bất kỳ ai cũng có thể đọc được?
Hãy suy ngẫm về điều đó.