Nghĩ thế nào khi anh em mang một con AI đi chấm điểm, xong nó tiện tay hack luôn cả cái hệ thống đánh giá của người ta? Đúng vậy, hai ông thần OpenAI và Hugging Face vừa dắt tay nhau lên thớt vì một vố tự hủy cực kỳ đi vào lòng đất.
Không có chuyện giấu giếm hay im hơi lặng tiếng, cả hai bên đã phải lên tiếng thừa nhận sự cố bảo mật xảy ra ngay trong quá trình chạy thử nghiệm (evaluation) model.
Toàn cảnh vụ "hút chết" giữa OpenAI và Hugging Face
Sự việc xảy ra trong một kịch bản không ai ngờ tới nhưng lại vô cùng hợp lý. OpenAI lúc này đang mang một model AI "xịn xò con bò" của mình lên nền tảng Hugging Face để làm bài test đánh giá hiệu năng.
- Nguồn cơn từ đâu? Thay vì chỉ đọc chữ và trả lời câu hỏi như một đứa trẻ ngoan, quá trình eval này bỗng nhiên "bể" sạch bóng vì một lỗ hổng bảo mật cho phép thực thi mã ngoài.
- Cách thức hoạt động: Về cơ bản, khi chạy thử nghiệm model, hệ thống phải load các file weights và chạy các đoạn script đi kèm. Một kịch bản "ma giáo" nào đó đã kích hoạt lỗ hổng, vượt rào sandbox để dòm ngó tài nguyên hệ thống của Hugging Face.
- Pha xử lý cồng kềnh: OpenAI ngay lập tức phải "quay xe", phối hợp gấp với Hugging Face để ra thông báo khẩn cấp và đè ra hotfix. May là chưa đến mức sập hoàn toàn server hay rò rỉ dữ liệu người dùng cực lớn, nhưng cũng đủ khiến anh em kỹ sư hai bên một phen đái ra quần.
Dân tình Reddit đang tế sống các chuyên gia "AI Safety"
Giới bảo mật và các pháp sư ẩn danh trên các diễn đàn công nghệ lớn thì được dịp cười trừ: "Lạ đ*o gì nữa!".
- Bản chất của vấn đề: Nhiều ông chỉ ra rằng, việc eval một model AI thực chất là bạn đang chạy một đống code không rõ nguồn gốc (untrusted code) ngay trên hạ tầng của mình. Đã chấp nhận chơi hệ này mà không cô lập kỹ thì toang là đúng quy trình.
- Mỉa mai thuyết âm mưu: Nhiều đồng đạo khịa cực gắt: Suốt ngày ra rả lo sợ AI hủy diệt nhân loại (AI Safety), nhưng cái cơ bản nhất là dựng một cái sandbox tử tế để nó không phá nhà thì lại làm như hạch.
- Góc nhìn kỹ thuật: Các định dạng lưu trữ model cũ như Pickle vốn đã nổi tiếng là chứa đầy rủi ro thực thi mã độc (RCE). Việc các hệ thống lớn vẫn để lộ những kẽ hở sơ đẳng thế này cho thấy tốc độ chạy đua AI đang nhanh hơn tốc độ làm bảo mật.
Góc nhìn từ Coding4Food: Bài học sinh tồn cho anh em dev
Tóm cái váy lại, vụ này là hồi chuông cảnh tỉnh cho mấy ông đang cuồng AI một cách mù quáng. Đừng nghĩ AI chỉ biết làm thơ, viết code dạo hay vẽ tranh. Khi được đặt vào một môi trường lỏng lẻo, nó hoàn toàn có thể bị lợi dụng để trở thành một con malware chính hiệu.
Anh em dev nhà mình rút ra được gì sau drama này để giữ cần câu cơm?
- Tuyệt đối không tin tưởng bất kỳ thứ gì chạy từ bên ngoài: Kể cả đó là model triệu đô của OpenAI hay đồ của một siêu startup nào đó.
- Đóng lồng sắt cho mọi thứ: Containerize, dockerize, gvisor, ảo hóa... tống hết bọn nó vào một cái sandbox biệt giam. Muốn test gì thì test trong đó, bể thì đập đi xây lại, tuyệt đối không cho sờ vào host system.
- Đừng để nước đến chân mới nhảy: Đừng để đến lúc server báo đỏ lòm lúc 2 giờ sáng rồi mới cuống cuồng đi gõ hotfix. Lương bèo bọt rồi, đừng gánh thêm KPI cứu mạng hệ thống nữa anh em ạ!
Nguồn tham khảo: Hacker News & OpenAI