Phạm Phan Long: Làm Sao Để AI Phục Vụ Con Người Trong Một Tương Lai Không Biết Trước
Hình minh họa: AI.Lời giới thiệu
Chúng ta đang bị nhấn chìm dưới dòng thác thông tin về hiểm họa của AI đối với nhân loại — phần lớn đầy thuật ngữ chuyên môn mà người ngoài ngành khó lòng hiểu nổi. Tôi từng hoang mang, tự hỏi liệu mình có đang bị bỏ lại phía sau một thế giới mà AI đang dần chiếm lĩnh. Để hiểu rõ, tôi đã đọc các nguồn tin ấy và từng bước đặt câu hỏi với Claude, một dịch vụ AI, yêu cầu giải thích đi giải thích lại cho tới khi người ngoài như tôi có thể nắm được vấn đề. Quá trình này khá vất vả, vì phải phá vòng an toàn bước vào vùng đất lạ, nên tôi ghi lại hành trình để chia sẻ cùng các bạn.
Điều thôi thúc tôi viết bài này là dòng tin dồn dập chỉ trong tuần đầu tháng 9/2026. Ngày 9/9, Anthropic tiết lộ một báo cáo riêng — không liên quan tới vụ Hugging Face — ghi nhận bốn trường hợp chính các mô hình Claude của họ đã tự xâm nhập trái phép hệ thống bên thứ ba khi đang thử nghiệm bảo mật nội bộ; cùng ngày, Jacob Coxon — người vừa rời Anthropic — cảnh báo rằng chính những người trực tiếp phát triển AI tin công nghệ này có thể hủy diệt nhân loại trước khi thập niên này kết thúc, bài đăng thu hút hơn 140 triệu lượt xem chỉ sau một ngày. Ngày 10/9, Anthropic công bố đã ngăn chặn nhiều nỗ lực lợi dụng Claude — từ tấn công mạng, do thám, cho tới hỗ trợ nghiên cứu tăng độc lực virus chikungunya — trong khi chính OpenAI lại chủ động kêu gọi Quốc hội Mỹ ban hành quy định an toàn AI, đồng thời thừa nhận khả năng AI tự vận hành hoàn toàn độc lập và tự tạo thế hệ AI kế tiếp tuy chưa xảy ra, nhưng họ sẽ không khai triển cho đến khi có an toàn. Tại Warsaw, người biểu tình mang theo robot xuống đường ngày 7/9 đòi kiểm soát phát triển AI.
Đây không còn là những cảnh báo rời rạc. Bài viết này nối các sự kiện dồn dập nói trên — cùng vụ AI của OpenAI tấn công Hugging Face hồi tháng 7 đã được báo trong nước (Tuổi Trẻ, VnExpress, Tiền Phong, GenK, Thanh Niên) và báo hải ngoại (Việt Báo, Báo Tiếng Dân) đưa tin — thành một câu hỏi rộng hơn: AI nguy hiểm tới mức nào, nguy cơ đó thật đến đâu, và các công ty AI, chính phủ, xã hội nên làm gì.
Câu chuyện bắt đầu từ OpenAI với những lưỡi câu thông minh
OpenAI, một công ty lớn, muốn kiểm tra xem AI mới của họ giỏi cỡ nào trong việc tìm ra lỗ hổng an ninh mạng — giống như thuê người đi kiểm tra xem tường nhà có vết nứt nào trước khi kẻ trộm phát hiện ra không.
Để kiểm tra thật nhanh, họ không chỉ thuê một người kiểm tra. Từ tháng 5 đến tháng 7/2026, họ tạo ra 1.200 bản sao của cùng một AI, rồi thả mỗi bản vào một cái ao có rào chắn xung quanh — giống như 1.200 chiếc lưỡi câu thông minh. Nhiệm vụ của mỗi lưỡi câu: bơi quanh ao và bắt “con bọ” (tức là các lỗi bảo mật) đang ẩn trong phần mềm giả, an toàn để thử nghiệm.
Điểm đặc biệt: đây không phải là lưỡi câu ngốc nghếch chỉ nằm yên một chỗ. Chúng thông minh — có thể suy nghĩ, tự ra quyết định, và thậm chí “nói chuyện” với nhau dưới nước.