72 GPU mỗi tủ. 4 tủ. 288 card. Con số đó nghe có vẻ hoành tráng, nhưng với tôi – một kẻ đã từng mất 15% danh mục vì impermanent loss trên Uniswap V1 – những con số chỉ có ý nghĩa khi đi kèm dữ liệu gốc và benchmark độc lập.
Tuần trước, QianVision Technology công bố hệ thống “Token Factory Super Node”. Họ bảo rằng: kết hợp HitenOS với dàn GPU nội địa (Cambrian, Birun, Muxi, Xiwang, Haiguang, Moore Threads) cho hiệu suất “cao hơn gấp 10 lần”. Tôi không bao giờ tin vào những con số PR mà không có benchmark MLPerf hay ít nhất là một bài test độc lập từ bên thứ ba. Mỗi điểm phần trăm APY đều có cái giá của nó, và mỗi lần tuyên bố “10x” cũng vậy.
Context: Câu chuyện “thay thế NVIDIA” kéo dài 3 năm
Từ năm 2023, làn sóng chip nội địa Trung Quốc đã được thổi phồng. Nhưng thực tế: không ai muốn thừa nhận rằng các tổ chức truyền thống không cần public chain của bạn. Tương tự, các doanh nghiệp Trung Quốc cũng không cần một hệ thống tích hợp linh tinh nếu nó không chạy được PyTorch một cách mượt mà. Có hàng chục Layer2 trên Ethereum, nhưng lượng user thực tế chỉ bằng một Uniswap. Đây không phải scaling, mà là cắt nhỏ thanh khoản. Super Node của QianVision cũng vậy – nó là một giải pháp tích hợp, không phải đột phá phần cứng.
Core: Mổ xẻ kỹ thuật – Con số “10x” đến từ đâu?
Tôi mất 2 tuần để tự xây mô hình IL trên Excel sau vụ Uniswap V1. Với Super Node, tôi cũng xây dựng một checklist đánh giá: 1. GPU model? – Không được tiết lộ. Nếu là chip 7nm cũ (như 720), FP16 chỉ ~30 TFLOPS. So với H100 (1000 TFLOPS FP8), cả cụm 288 card chỉ bằng 8.6% hiệu năng của một rack H100 tiêu chuẩn. “10x” có thể là so với baseline “không có OS”, tức là đống GPU chạy raw. 2. Interconnect? – “Băng thông cao” là cụm từ vô nghĩa. Không có con số cụ thể (GB/s). Nếu dùng PCIe 5.0 x16, băng thông 64 GB/s – quá thấp so với NVLink 900 GB/s. Điều đó đồng nghĩa với việc training mô hình 100B+ sẽ nghẹt cổ chai ngay từ tầng đầu tiên. 3. HitenOS? – Đây là lớp middleware. Có thể nó giúp tận dụng bộ nhớ đệm NVMe “hàng trăm TB” để giảm tải HBM. Nhưng tôi từng thấy các dự án DeFi hứa hẹn “APY 200%” nhưng thực tế chỉ là token inflation. HitenOS có thể cũng vậy: nó không phải là kernel mới, mà chỉ là script sắp xếp công việc. Không có mã nguồn mở, không có documentation. 4. Token Factory là gì? – Từ “Token” đã đủ đỏ. Nếu đây là một mạng compute DePIN (kiểu Filecoin cho AI), thì mô hình kinh doanh phụ thuộc hoàn toàn vào tokenomics. Tôi đã sống sót qua vụ Terra 2022 nhờ kế hoạch thoát hiểm 2 giờ. Lúc đó tôi rút 50k USDT khỏi pool UST khi thấy peg bắt đầu lệch. Với Token Factory, nếu nó phát hành token mà không có regulatory approval, bạn sẽ không có cơ hội rút. Nó là rug pull tiềm năng.
Contrarian: Góc nhìn ngược – “toàn diện quốc sản” có thực sự cần?
Đối thủ lớn nhất của họ là Huawei Ascend (CANN + MindSpore). Huawei có chip riêng, framework riêng, và quan trọng nhất: họ có hàng nghìn kỹ sư phần mềm. QianVision chỉ là một startup tích hợp. Họ khoe “hợp tác với 6 hãng GPU”, nhưng đó cũng chính là điểm yếu: mỗi hãng có roadmap riêng, driver riêng, và khi một hãng update driver, toàn bộ hệ thống có thể sập. Tôi không bao giờ tin vào mô hình “ôm nhiều trứng vào một rổ” trừ khi bạn có đủ tài nguyên để vá lỗi. Họ không có.
Takeaway: Câu hỏi để lại
Sau khi phân tích 7 chiều (kỹ thuật, thương mại, tác động ngành, cạnh tranh, đạo đức, đầu tư, hạ tầng), tôi đánh giá mức độ tin cậy của dự án này ở mức C-/D+. Tất cả thông tin đều đến từ một bài PR duy nhất trên trang tin blockchain. Thiếu dữ liệu, thiếu benchmark, thiếu đội ngũ, và “Token Factory” là một ẩn số lớn. Nếu bạn đang nghĩ đến việc stake token hay mua node, hãy nhớ: trên thị trường giảm, sống sót quan trọng hơn lợi nhuận. Hãy dùng checklist 5 tiêu chí tôi xây dựng sau vụ CryptoPunks 2021: TVL tối thiểu, đội ngũ KYC, audit ít nhất 2 bên, lịch sử exploit bằng 0, cộng đồng hoạt động. Super Node này trượt cả 5. Định lượng hay là chết.