
Bài học từ AI safety: Đừng tin vào lời hứa, hãy tin vào proof
Huỳnh Quân
Tuần qua, làng AI lại sôi sục với những tranh luận về safety. Dario Amodei, CEO của Anthropic, kêu gọi mandatory testing trước khi phát hành model. Elon Musk đáp lại bằng một câu ngắn gọn: 'I hope AI is nice to us.' Naval Ravikant thì triết lý hơn: 'You can't create God and put him on a leash.'
Nghe quen không? Nếu bạn từng audit smart contract, bạn sẽ thấy mùi quen thuộc của sự thổi phồng. Các CEO nói về tương lai tươi sáng, về '5-10 năm nữa chữa được hầu hết bệnh tật', nhưng chẳng ai đưa ra được bằng chứng kỹ thuật cụ thể. Giống như ICO năm 2017: ai cũng hứa hẹn, nhưng code thì rỗng.
Amodei thừa nhận rằng 'lời chỉ trích chính xác nhất là chúng tôi chưa mang lại lợi ích gì cho thế giới'. Đây là một câu nói chiến lược: hạ thấp kỳ vọng trước khi tung ra sản phẩm. Nhưng trong blockchain, chúng tôi gọi đó là 'pump and dump' – chỉ khác là thời gian dài hơn.
Musk cũng không khá hơn. 'I hope AI is nice to us' – đó là một câu nói vô trách nhiệm. Nó tương đương với việc nói 'Tôi hy vọng hợp đồng thông minh không có lỗi'. Không ai xây dựng hệ thống tài chính dựa trên hy vọng. Vậy tại sao lại xây dựng tương lai nhân loại dựa trên hy vọng?
Naval thì đúng ở một điểm: bạn không thể tạo ra Chúa rồi xích nó lại. Đây là vấn đề cốt lõi của quản trị. Trong DAO, token governance là cổ phiếu không cổ tức – người nắm giữ chỉ hy vọng người mua sau sẽ trả giá cao hơn. AI safety cũng vậy: các công ty kêu gọi regulation, nhưng thực chất là muốn tạo rào cản gia nhập cho đối thủ, không phải bảo vệ nhân loại.
Hãy nhìn vào chi tiết kỹ thuật. Amodei ủng hộ California SB 53, luật miễn trừ cho các công ty có doanh thu dưới 500 triệu USD. Anthropic chưa đạt ngưỡng đó, nên họ ủng hộ luật mà không bị ảnh hưởng. Đây là 'regulatory capture' – một chiến thuật quen thuộc trong ngành tài chính. Họ muốn thiết lập các quy tắc mà chỉ họ mới đủ khả năng tuân thủ, tạo ra lợi thế cạnh tranh.
Còn về mặt kỹ thuật, Amodei nói '5-10 năm nữa chữa được hầu hết bệnh tật'. Nhưng không có paper, không có benchmark, không có model nào được công bố. Điều này giống hệt các dự án Layer2 hiện nay: hàng chục giải pháp, nhưng cùng một lượng người dùng. Không phải scaling, mà là cắt nhỏ thanh khoản.
Tôi đã từng audit hợp đồng ICO EOS năm 2017. Tôi phát hiện lỗ hổng trong cơ chế bỏ phiếu cho phép cá voi thao túng block producer. Kết quả: EOS phải vá lỗi. Tôi học được rằng: đừng tin vào lời hứa, hãy tin vào proof. Code không biết nói dối, nhưng CEO thì có.
Năm 2020, tôi chạy bot trên Uniswap V2 và phát hiện wash trading. Năm 2021, tôi viết script Python để vạch trần NFT wash trading trên OpenSea. Năm 2022, tôi mô phỏng lại sự sụp đổ của Terra/Luna bằng cách khai thác lỗ hổng oracle. Mỗi lần, câu chuyện đều giống nhau: sự thổi phồng che giấu sự thật kỹ thuật.
Bây giờ, AI safety cũng đang trong giai đoạn thổi phồng. Amodei muốn mandatory testing, nhưng ai sẽ kiểm tra người kiểm tra? Trong blockchain, audit chỉ có giá trị nếu auditor độc lập và có trách nhiệm. Nếu auditor là do công ty trả tiền, thì đó là xung đột lợi ích. Tương tự, nếu chính phủ giao việc kiểm tra AI cho các công ty AI, thì đó là tự kiểm tra.
Musk nói 'I hope AI is nice to us' – đó không phải là giải pháp. Đó là sự bất lực. Naval nói 'you can't put God on a leash' – đó là sự thật, nhưng không phải là lý do để từ bỏ. Trong blockchain, chúng tôi có câu: 'Quản trị là nơi rủi ro sống lâu nhất.' Nếu bạn không giải quyết vấn đề quản trị, rủi ro sẽ quay lại.
Vậy giải pháp là gì? Tôi đề xuất một cơ chế giống như 'proof of reserve' nhưng cho AI alignment. Các công ty AI nên công bố không chỉ model weights mà còn cả quy trình alignment, dữ liệu huấn luyện, và các bài kiểm tra an toàn. Nếu họ từ chối, hãy coi họ như các dự án crypto không có audit.
Hãy nhìn vào Anthropic. Họ hợp tác với Pfizer để đưa AI vào y tế. Đó là một tín hiệu tích cực, nhưng cũng là một con dao hai lưỡi. Nếu AI thực sự chữa được bệnh, Pfizer sẽ mất đi doanh thu từ các loại thuốc đắt đỏ. Vậy Pfizer có thực sự muốn AI thành công không? Hay họ chỉ muốn kiểm soát?
Trong blockchain, chúng tôi có một quy tắc: 'Đừng tin vào volume, hãy tin vào proof.' Volume có thể bị làm giả, thanh khoản có thể là ảo. Chỉ có on-chain data mới là sự thật. Tương tự, trong AI, đừng tin vào lời hứa của CEO, hãy tin vào benchmark, vào code, vào các bài kiểm tra độc lập.
Cuối cùng, tôi muốn nhấn mạnh một điều: AI safety không phải là vấn đề kỹ thuật, mà là vấn đề quản trị. Nếu chúng ta không giải quyết được vấn đề quản trị, thì mọi nỗ lực kỹ thuật đều vô ích. Giống như DAO, nếu token governance chỉ là Ponzi, thì không có audit nào cứu được.
Hãy nhìn vào lịch sử. ICO 2017, DeFi 2020, NFT 2021, mỗi lần đều có một câu chuyện mới, nhưng cấu trúc thì cũ: hype, FOMO, sụp đổ. AI safety đang đi theo cùng một kịch bản. Câu hỏi là: bạn sẽ tin vào lời hứa, hay tin vào proof?
Tôi chọn proof. Bởi vì tôi đã thấy quá nhiều lần sự thật bị che giấu bởi những lời hứa đẹp đẽ. Đừng để AI trở thành ICO tiếp theo. Hãy yêu cầu proof. Nếu không, chúng ta sẽ lại hối hận.