Tuần trước, tôi nhận được một tin nhắn từ đồng nghiệp: "Kraken vừa hợp tác với Anthropic để dùng AI tìm lỗi. Mày nghĩ sao?" Đây là câu hỏi mà bất kỳ ai trong ngành bảo mật cũng nên đặt ra. Tin tức từ Crypto Briefing cho thấy Payward (công ty mẹ của Kraken) tham gia Project Glasswing của Anthropic, sử dụng một mô hình có tên "Claude Mythos 5" để quét lỗ hổng phần mềm. Nghe có vẻ như một bước tiến lớn – AI sẽ bảo vệ tài sản số của bạn. Nhưng với tư cách là một DeFi Security Auditor đã từng audit hàng trăm smart contract, tôi biết rằng mọi thứ không bao giờ đơn giản như vậy.
Để hiểu rõ, chúng ta cần đặt bối cảnh. Kraken là một trong những sàn giao dịch tập trung lâu đời nhất, thành lập năm 2011, nổi tiếng về tuân thủ pháp lý và an toàn. Anthropic là công ty AI do cựu nhân viên OpenAI thành lập, tập trung vào "AI có trách nhiệm". Project Glasswing được mô tả như một chương trình thử nghiệm, nơi các tổ chức có độ nhạy cảm bảo mật cao sử dụng Claude để phát hiện lỗ hổng. Trong bối cảnh thị trường giảm hiện tại, khi mọi người đều lo lắng về an toàn tài sản, một tin tức như vậy dễ dàng tạo ra làn sóng lạc quan. Nhưng hãy nhìn vào mặt kỹ thuật.
Cốt lõi của vấn đề nằm ở việc AI có thể thay thế hay bổ sung cho auditor con người đến đâu. Dựa trên kinh nghiệm audit của tôi, tôi đã từng chứng kiến các công cụ SAST (Static Application Security Testing) như Slither hay Mythril tạo ra hàng loạt cảnh báo sai. Với LLM (Large Language Model), mọi thứ còn phức tạp hơn. Mô hình ngôn ngữ lớn có thể hiểu ngữ cảnh code, nhưng chúng dễ bị "ảo giác" – tạo ra những phát hiện không có thật hoặc bỏ sót lỗi thực sự. Trong một audit gần đây cho một giao thức DeFi, tôi thấy rằng AI có thể phát hiện reentrancy cơ bản, nhưng lại hoàn toàn mù tịt với các lỗi logic phức tạp liên quan đến oracle giá hay tokenomics. Điều này đặt ra câu hỏi: nếu Kraken dựa quá nhiều vào AI, liệu họ có vô tình tạo ra một lỗ hổng mới?
Hơn nữa, tôi đã kiểm tra danh sách model của Anthropic. Không có mô hình nào tên là "Claude Mythos 5". Anthropic công bố Claude 3.5 Sonnet, Claude 4 Opus, gần đây có Claude 4.5 – nhưng không có Mythos. Điều này làm tôi nghi ngờ tính xác thực của thông tin gốc. Có thể đây là lỗi dịch thuật, hoặc là một bài viết PR được thổi phồng. Nếu là thật, Anthropic đã đặt tên nội bộ cho một phiên bản thử nghiệm, nhưng việc không có thông tin công khai khiến mọi phân tích kỹ thuật đều trở nên mơ hồ. Đây là một điểm mù lớn: thị trường đang kỳ vọng vào một thứ mà chưa ai từng thấy.
Góc nhìn phản trực giác ở đây là: AI không hề giúp bảo mật tốt hơn, mà có thể khiến mọi thứ tồi tệ hơn. Hãy nghĩ về điều này: nếu một auditor con người bỏ sót lỗi, cả cộng đồng sẽ đổ lỗi cho họ. Nhưng nếu AI bỏ sót lỗi, ai sẽ chịu trách nhiệm? Anthropic? Hay Kraken? Trong thế giới crypto, nơi mà "trustless" là tôn chỉ, việc đặt niềm tin vào một hộp đen AI là một sự mâu thuẫn. Tôi từng chứng kiến một dự án ICO năm 2017 từ chối sửa lỗi reentrancy vì "AI đã kiểm tra và không có vấn đề". Kết quả: 1,2 triệu USD bị mất. Bài học đó vẫn còn nguyên giá trị.
Vậy điều gì sẽ xảy ra tiếp theo? Trong 12 tháng tới, chúng ta sẽ thấy nhiều vụ hack mà nguyên nhân chính là do quá tin tưởng vào AI audit. Các đội ngũ phát triển sẽ cắt giảm ngân sách cho auditor con người, chuyển sang dùng AI để tiết kiệm chi phí. Và rồi, một lỗi logic tinh vi sẽ bị bỏ sót – một lỗi mà 5 năm kinh nghiệm audit của tôi mới phát hiện ra. Tôi không nói rằng AI vô dụng. Nó là một công cụ tuyệt vời để tăng tốc độ rà soát ban đầu. Nhưng nó không thể thay thế được sự phán đoán, trực giác và sự hiểu biết sâu sắc về bối cảnh kinh doanh mà một auditor con người mang lại. Hãy chuẩn bị tinh thần cho một làn sóng thất vọng mới.