Hook
Có một nghịch lý đang nuôi một con bẫy thanh khoản trong AI inference. Trong khi mọi fund đều đổ tiền vào “GPU nội địa” như một giải pháp duy nhất, Wang Dong, đồng sáng lập Moore Threads, vừa phát biểu thẳng: “Không có chip vạn năng. Thị trường inference cần tổ hợp giải pháp.”
Tôi mở ba tab: CoinGecko, Etherscan, Dune. Nhìn vào dòng tiền từ các quỹ đầu tư mạo hiểm vào DePIN compute (Akash, Render, io.net) và các layer 2 dùng ZK proof. Tất cả đều đánh cược vào một “chip vạn năng” cho inference. Có gì đó không khớp.
Context
Wang Dong (Moore Threads) nói trong một sự kiện tháng 7/2024: không có một kiến trúc phần cứng duy nhất nào tối ưu cho mọi tác vụ inference. Thay vào đó, cần sự kết hợp linh hoạt giữa các giải pháp (GPU chuyên dụng cho batch size lớn, ASIC cho latency thấp, FPGA cho tác vụ có thể tái cấu hình). Ông dự báo sự xuất hiện của các ISP (Inference Service Provider) – những công ty chuyên cho thuê tổ hợp inference đa chip, tương tự mô hình RaaS (Rollup as a Service) trong blockchain.
Bối cảnh này rất quen. Ba năm trước, tôi ngồi trong một phòng giao dịch nhìn thị trường DeFi mùa hè 2020: mọi người đều tin vào “một giao thức vạn năng” – các đồng farm tổng hợp như YFI. Kết quả: liquidity splintered, hack xảy ra, và kẻ sống sót là những giao thức tập trung vào một niche cụ thể (lending: Aave, DEX: Uniswap).
Core
Phân tích dữ liệu on-chain cho thấy một thực tế: không có “universal chip” cho ZK proof generation cũng như cho AI inference.
- Dự án Cysic (ZK hardware) có ASIC chuyên biệt cho MSM và NTT, nhưng không thể dùng cho verifier.
- Ingonyama tối ưu cho MSM trên FPGA, tốc độ gấp 10 lần GPU, nhưng chỉ chạy được một thuật toán.
- Các GPU hiện tại (NVIDIA, AMD) vẫn là “general purpose”, nhưng để chạy Groth16 proof với latency dưới 1 giây, bạn cần kết hợp nhiều loại chip.
Đặt lệnh: Market có một mảnh ghép rõ ràng. Nhìn vào dòng vốn từ các quỹ: - Trong Q2 2024, các startup phần cứng ZK huy động hơn $150M. - DePIN compute (Akash, io.net) vẫn dùng GPU đa năng, nhưng nếu không có chiến lược kết hợp, họ sẽ bị tụt lại khi nhu cầu chuyên biệt hóa tăng.
Contrarian
Góc nhìn phản trực giác: Chính câu chuyện “kết hợp giải pháp” này lại là con dao hai lưỡi cho các Layer 2 và DePIN đang cố gắng xây dựng một “hub vạn năng”.
Hiện tại, hầu hết các optimistic rollup (Arbitrum, Optimism) đều dùng sequencer tập trung – một “node vạn năng” về mặt chức năng. Họ không dùng chuyên biệt hóa cho từng tác vụ (proof generation vs. transaction ordering). Kết quả: throughput bị giới hạn bởi bottleneck của máy ảo EVM.
Nếu Wang Dong đúng – thị trường AI inference chuyển sang tổ hợp chuyên biệt – thì blockchain cũng sẽ đi theo: sequencer riêng cho từng loại tác vụ (một chain cho NFT mint chuyên biệt, một chain khác cho DEX trading tốc độ cao). Điều này phá vỡ giả định về tính “tổng quát” của rollup hiện nay.
Takeaway
Sàn động, lòng tĩnh. Tôi đã đặt lệnh short YFI sau khi thấy sự phân mảnh thanh khoản. Bây giờ, tôi đang dõi theo Akash và Render: nếu họ không bắt đầu tích hợp chip chuyên biệt (ASIC/FPGA), tôi sẽ giảm vị thế. Mồi ngon luôn đi kèm bẫy.
Lệnh đã vào. Không cần review.