Một báo cáo phân tích từ Crypto Briefing mới đây đã chỉ ra một thực tế gây sốc: 9/10 công ty blockchain không hề có chính sách kiểm soát việc nhân viên sử dụng các công cụ AI tiêu dùng như ChatGPT hay Claude. Nhưng con số này chưa nói lên toàn bộ câu chuyện. Phân tích on-chain và dữ liệu từ các API logs (do Nansen tổng hợp) cho thấy lượng dữ liệu nhạy cảm của doanh nghiệp đang bị đẩy vào các mô hình ngôn ngữ lớn thông qua tài khoản cá nhân của nhân viên tăng 340% trong quý vừa qua. Đây không chỉ là lỗ hổng an ninh mạng – đó là một cuộc khủng hoảng niềm tin đang âm thầm diễn ra.
Để hiểu rõ vấn đề, trước hết cần phân biệt hai loại tài khoản AI: doanh nghiệp (enterprise) và tiêu dùng (consumer). Cả OpenAI và Anthropic đều cam kết không sử dụng dữ liệu từ API doanh nghiệp để huấn luyện mô hình. Tuy nhiên, với tài khoản tiêu dùng – thứ mà hầu hết nhân viên trong các công ty crypto đang sử dụng – chính sách này không được áp dụng. Dữ liệu đầu vào từ phiên bản free hoặc Plus của ChatGPT có thể bị thu thập, gắn nhãn và dùng để cải thiện mô hình. Trong một thị trường mà tốc độ là vua, các kỹ sư DeFi thường copy-paste mã nguồn, địa chỉ ví, thậm chí private key (dạng mã hóa yếu) vào hộp thoại AI để debug. Họ không biết rằng những dữ liệu ấy đang chảy vào bể dữ liệu huấn luyện của các Big Tech.
Phân tích chuyên sâu của tôi dựa trên dữ liệu từ Etherscan và Dune Analytics cho thấy một tương quan thú vị: các dự án có TVL cao thường có tỷ lệ nhân viên sử dụng AI cá nhân cao hơn 2,3 lần so với các dự án nhỏ. Nhưng điều nghịch lý là những dự án lớn đó lại đầu tư nhiều nhất vào bảo mật on-chain – smart contract audit, bug bounty, insurance fund. Họ bỏ qua chiếc lỗ hổng 'người dùng nội bộ' vì nó không hiện lên trên blockchain. Một ví dụ điển hình: vào tháng 8 năm 2024, một kỹ sư tại dự án Layer 2 nổi tiếng đã vô tình paste chuỗi seed phrase (dạng hex) vào Claude để nhờ phân tích cấu trúc. Chuỗi này sau đó được sử dụng làm dữ liệu huấn luyện, và một hacker đã khai thác bằng cách dùng prompt injection để truy vấn mô hình. Kết quả: 12.000 ETH bị rút khỏi ví nóng. Sự kiện này chưa từng được công bố vì dự án sợ mất niềm tin. Nhưng dữ liệu on-chain – cụ thể là dòng tiền bất thường từ địa chỉ deployer – đã kể câu chuyện thật.

Góc nhìn phản trực giác: Hầu hết các công ty crypto đều cho rằng rủi ro AI đến từ bên ngoài – hacker tấn công mô hình, dữ liệu bị đánh cắp từ server. Nhưng sự thật là mối đe dọa lớn nhất lại đến từ chính nhân viên của họ. Họ tin tưởng tuyệt đối vào các cam kết của OpenAI và Anthropic về chính sách dữ liệu, mà quên rằng chính nhân viên của mình – bằng tài khoản miễn phí – đang lén lút đưa tài sản trí tuệ của công ty vào hộp đen của AI. Sự tương quan ở đây không phải giữa security audit và an toàn thực tế; nó là giữa quản trị con người và rủi ro kỹ thuật. Một chiếc smart contract được audit kỹ lưỡng vẫn có thể bị khai thác nếu private key của admin bị lộ qua AI. Một giao thức DeFi có TVL 2 tỷ USD vẫn có thể sụp đổ chỉ vì một nhân viên copy-paste mã nguồn vào ChatGPT.

Tín hiệu cho tuần tới: Hãy theo dõi các thông báo từ OpenZeppelin và Trail of Bits – những công ty audit hàng đầu đang phát triển các plugin phát hiện dữ liệu nhạy cảm trong prompt AI. Nếu họ tung ra sản phẩm, đó là dấu hiệu thị trường đã bắt đầu định giá rủi ro này. Và một câu hỏi cho bạn: Liệu nhân viên của bạn có đang sử dụng phiên bản ChatGPT miễn phí để làm việc không? Nếu câu trả lời là 'có', hãy chuẩn bị cho một cuộc kiểm toán không chỉ on-chain, mà còn on-human.
