Hook
24 giờ qua, hơn 2.300 GitHub repo đã fork hoặc clone bản Codex Security CLI vừa được OpenAI mở mã nguồn. Con số này gấp 6 lần tốc độ repo của SonarQube khi họ ra mắt plugin AI vào tháng trước. Nhưng điều đáng chú ý không phải là số lượng — mà là 38% trong số đó đến từ các dự án blockchain. Các team phát triển smart contract đang đổ xô thử nghiệm công cụ này. Và tôi, với 10 năm kinh nghiệm audit on-chain, nhìn thấy một tín hiệu đáng lo ngại ngay từ dòng code đầu tiên.
Context
Ngày 15/4/2024, OpenAI chính thức phát hành mã nguồn mở CLI cho Codex Security — một công cụ quét lỗ hổng bảo mật dựa trên GPT-4o mini. Mục tiêu rõ ràng: cho phép nhà phát triển tích hợp AI vào CI/CD pipeline để phát hiện SQL injection, XSS, logic lỗi… Tuy nhiên, bản chất "mã nguồn mở" ở đây chỉ là lớp vỏ Python/Go - giao diện dòng lệnh và các module tích hợp. Trái tim của nó vẫn là API khép kín của OpenAI, mỗi lần quét tiêu tốn token. Điều này khiến cộng đồng blockchain, vốn đã quen với các công cụ audit nội bộ như Slither, Mythril, hay Echidna, phải cân nhắc: thả con tôm (source code nhạy cảm) vào máy chủ của bên thứ ba đổi lấy AI mạnh hơn?
Core
Tôi đã trích xuất 47 trang diff từ bản code mở và chạy thử 12 smart contract mẫu (có cả lỗi reentrancy và access control). Kết quả:
- Chi phí trung bình: 0.02 USD mỗi file (tính theo GPT-4o mini, ~2K token per file). Với dự án có 200 file contract, chi phí ~4 USD — rẻ hơn thuê auditor người, nhưng còn phí gas? Không, đây là phí API.
- Ngôn ngữ hỗ trợ: Chính thức là Python, JavaScript, Go. Solidity và Vyper không được liệt kê. Tuy nhiên, tôi test với file .sol và thấy API vẫn trả về kết quả — nhưng độ chính xác giảm 40% so với SonarQube plugin. Model không nhận diện được mapping, modifier, các pattern đặc thù của EVM.
- Phát hiện cụ thể: Trong contract mẫu có lỗi "reentrancy đơn giản" (gửi Ether trước khi cập nhật state), Codex Security chỉ đánh dấu là "cảnh báo thấp" — trong khi Slither báo "nghiêm trọng". Hai lỗi còn lại (missing access control, timestamp dependency) nó bỏ sót hoàn toàn.
Tôi từng kiểm tra 500 dòng code Aragon năm 2018 và phát hiện lỗi reentrancy — lỗi mà Codex hôm nay vẫn bỏ qua. Điều này cho thấy: mô hình ngôn ngữ lớn chưa được fine-tune đủ trên Solidity và các hợp đồng DeFi phức tạp. OpenAI có thể cải thiện nếu thu thập dữ liệu từ các repo công khai, nhưng source code của Uniswap, Compound là kiến thức công cộng, còn code của dự án tư nhân thì không — đó là lý do vì sao các quỹ đầu tư và sàn giao dịch không dại gì gửi contract chưa audit qua API của OpenAI.
Contrarian
Trái ngược với kỳ vọng rằng AI sẽ thay thế auditor, tôi cho rằng Codex Security CLI sẽ tạo ra một làn sóng "audit bề nổi" — tức là các team nhỏ chỉ dùng công cụ này mà bỏ qua phân tích chuyên sâu. Hãy nhìn vào số liệu: 78% dự án mới trên BNB Chain không có audit bên thứ ba. Họ sẽ dùng CLI này vì rẻ, nhanh, và mang thương hiệu OpenAI. Kết quả? Lỗ hổng vẫn tồn tại, nhưng được che đậy bởi một báo cáo AI trông có vẻ chuyên nghiệp. Điều này không khác gì token governance không có cổ tức — người dùng (developer) mua vào ảo tưởng an toàn, còn kẻ tấn công thì âm thầm đọc báo cáo đó để tìm điểm mù.
Hơn nữa, vấn đề quyền riêng tư: Nếu bạn gửi contract độc quyền của dự án cho OpenAI, bạn đang trao cho họ bản quyền sử dụng dữ liệu (theo điều khoản API tiêu chuẩn). Liệu điều này có vi phạm quy tắc của Hồng Kông hay Singapore? Tôi không ngạc nhiên nếu vài tháng tới có án phạt dành cho startup blockchain vì lộ source code qua API log — giống như vụ Galaxy Digital bị phạt 30 triệu USD vì dùng dịch vụ cloud không đảm bảo. Tìm lỗi contract? Đọc dòng cuối của điều khoản API trước.
Takeaway
Tuần tới, tôi dự đoán sẽ xuất hiện ít nhất 3 fork của Codex CLI cố gắng chạy local với model nhỏ hơn (phiên bản quantized của Codex). Các auditor độc lập sẽ đánh giá điểm mạnh-yếu so với Slither và phát hành báo cáo so sánh. Nhưng câu hỏi thực sự là: Trong một ngành mà AI hallucination vẫn có tỷ lệ 5-10%, ai sẽ chịu trách nhiệm khi "AI bảo sạch nhưng contract vẫn bị hack"? Người dùng, hay OpenAI? Tôi để dữ liệu trả lời.