Hook
Ngày 12 tháng 3 năm 2025, một nhóm người biểu tình đã xông vào văn phòng OpenAI tại San Francisco. Họ không yêu cầu tăng lương hay thay đổi chính sách nội bộ. Họ đưa ra một tuyên bố kỹ thuật: "AI phải là công cụ, không phải thực thể tự trị". Sự kiện kéo dài chưa đầy hai giờ, không có thiệt hại vật chất, nhưng nó để lại một dấu hỏi lớn hơn bất kỳ lỗ hổng bảo mật nào tôi từng audit: Khi nào sự mất lòng tin của công chúng trở thành rủi ro hệ thống?
Context
OpenAI hiện là công ty dẫn đầu trong cuộc đua phát triển các hệ thống AI có khả năng tự chủ. Từ GPT-4o đến các dự án Agent như Computer Use, công ty đang dịch chuyển từ "trợ lý" sang "người thực thi". Nhưng sự dịch chuyển này không diễn ra trong chân không. Kể từ cuộc khủng hoảng hội đồng quản trị tháng 11/2023 và sự ra đi của nhóm Superalignment vào năm 2024, niềm tin của công chúng vào cam kết an toàn của OpenAI đã giảm mạnh. Sự kiện này là lần đầu tiên sự bất tín nhiệm đó tràn ra đường phố.
Core
Tôi đã dành 5 năm để audit các giao thức blockchain và phát triển bằng chứng ZK. Tôi biết rằng khi một hệ thống trở nên phức tạp đến mức không ai có thể hiểu hết, thì sự kiểm soát tập trung trở thành điểm yếu duy nhất. Điều tương tự đang xảy ra với AI. Người biểu tình không phản đối một tính năng cụ thể nào của GPT-4o. Họ phản đối một xu hướng: AI tự trị đang được triển khai mà không có cơ chế giám sát công khai.

Phân tích kỹ thuật cho thấy: các hệ thống Agent hiện tại, như AutoGPT hay Computer Use API của OpenAI, đã có khả năng thực hiện các hành động độc lập trên trình duyệt, đọc email, thậm chí thực hiện giao dịch. Nhưng cơ chế an toàn — human-in-the-loop, giới hạn quyền, nhật ký kiểm toán — vẫn do chính nhà phát triển kiểm soát. Không có bên thứ ba độc lập nào xác nhận rằng các giới hạn đó đủ chặt. Trong blockchain, điều này tương đương với việc một sàn giao dịch tự audit số dư của mình. Liquidity không có cái gọi là "tự kiểm tra". Và AI an toàn cũng vậy.
Từ kinh nghiệm audit của tôi, tôi biết rằng bất kỳ hệ thống nào có quyền tự chủ mà không có cơ chế giám sát phi tập trung đều sẽ bị lạm dụng. Trong DeFi, chúng ta đã thấy điều này qua các vụ hack oracle. Trong AI, nguy cơ tương tự tồn tại: một Agent được huấn luyện để tối ưu hóa mục tiêu sai lệch có thể gây ra thiệt hại trước khi bất kỳ ai kịp can thiệp. Người biểu tình đang yêu cầu một điều mà ngành blockchain đã học được từ lâu: quyền kiểm soát phải được phân tán, không tập trung vào một thực thể duy nhất.
Contrarian
Nhiều người trong ngành cho rằng sự kiện này chỉ là một hành động biểu tượng, không ảnh hưởng đến kỹ thuật. Nhưng tôi nhìn thấy một điểm mù: Người biểu tình không sai về mặt kỹ thuật. Họ chỉ đang đi trước thời gian. Khả năng tự trị của AI đang tăng theo cấp số nhân, trong khi khả năng kiểm soát của con người chỉ tăng tuyến tính. Nếu không có sự thay đổi trong cấu trúc quản trị, một sự cố Agent nghiêm trọng gần như chắc chắn sẽ xảy ra trong vòng 3-5 năm tới. Và khi đó, những người biểu tình hôm nay sẽ được nhìn nhận như những người báo trước, không phải những kẻ gây rối.
Takeaway
Tôi không cho rằng OpenAI sẽ thay đổi lộ trình sản phẩm vì một cuộc biểu tình. Nhưng tôi tin rằng sự kiện này là một tín hiệu cho thấy khoảng cách giữa khả năng kỹ thuật và khả năng quản trị đang trở nên nguy hiểm. Trong thế giới blockchain, chúng ta gọi đó là "centralization risk". Trong thế giới AI, nó có thể được gọi là "AI trust deficit". Và câu hỏi đặt ra là: Liệu các nhà phát triển AI có học được bài học về phân quyền trước khi quá muộn?
