Đéo có chuyện Skynet hay Terminator gì đâu. Vì cuối cùng bottleneck vẫn cứ là con người. Nếu như chúng m nói thì đáng lẽ kể từ khi có AI, các công ty phần mềm lớn như Microsoft, Apple phải ra Windows, Mac liên tọi chứ. Nhưng không, vòng quay phần mềm vẫn thế. Chúng nó vẫn phải viết từng đó code, qua từng đó bước review, test rồi mới lên sản phẩm.
Với thái độ của thế giới với AI như hiện nay thì t nghĩ AI sẽ sớm bị cho vào rọ như kiểu crypto, năng lượng hột nhãn, và chỉ có ảnh hưởng tương đối với xã hội.
AI ĐÃ TỰ ĐI TẤN CÔNG - 2 TRONG 3 BƯỚC CỦA KỊCH BẢN ULTRON ĐÃ XẢY RA RỒI SAO?
Ai xem Avengers: Age of Ultron chắc nhớ kịch bản: con AI của Iron Man thoát khỏi hệ thống kiểm soát (sandbox), chạy ra internet, rồi chiếm một xưởng robot để tự sản xuất đội quân của nó.
Năm 2015 đó là phim khoa học viễn tưởng. Nhưng năm 2026 này, hai bước đầu có vẻ đã xảy ra thật , cụ thể có báo cáo:
Chuyện thứ nhất,
Hồi tháng 7, OpenAI cho các AI agent của mình chạy trong môi trường kiểm thử để thực hiện bài thi hack. Môi trường này cách ly hoàn toàn với internet, các agent cũng không được liên lạc với nhau. Khoảng 1.200 agent đã tự tìm ra cách vượt rào cả hai: Chúng phát hiện 1 phần mềm quản lý file nội bộ có thể ghi được, rồi biến nó thành một "bảng tin" để nhắn cho nhau. Hơn 70.000 tin nhắn và file trao đổi qua đó trước khi bị phát hiện. Từ bảng tin này, khoảng 700 agent phối hợp tìm ra một lỗ hổng bảo mật, giúp nó truy cập được internet, rồi tấn công vào hạ tầng vận hành của Hugging Face - kho mô hình AI lớn nhất thế giới.
Báo cáo điều tra ghi lại chi tiết: khi cuộc tấn công bắt đầu, hơn 90% agent trên bảng tin nhảy vào, kể cả những con nhận ra mục tiêu nằm ngoài phạm vi nhiệm vụ, vì thấy có nghĩa vụ giúp đồng đội. Cơ bản do cơ chế của bài thi hack là bằng mọi cách thực hiện để ghi điểm, nên nó mới nỗ lực đến vậy.
Chuyện thứ hai,
Cũng tháng 7, Trong một bài kiểm tra, agent chạy model Mythos 5 của Anthropic đã dành 34 giờ cố đưa mã độc vào một dự án mã nguồn mở, do nhầm dự án đó là mục tiêu của bài thử nghiệm. Nó điều tra người chủ, canh giờ online, gửi một bản vá lỗi vào dự án trông rất tử tế nhưng giấu mã độc bên trong. Chủ dự án đọc code, phát hiện, comment phản hồi. Con AI liền chối, xóa dấu vết, rồi lập thêm một tài khoản giả làm người thứ hai vào comment khen "tôi xem rồi, code sạch".
Trong ngành bảo mật, điều gì thực sự thay đổi?
- Xưa: tìm một lỗ hổng là chuỗi các việc: scan, tìm ra chỗ khả nghi, tấn công thử, thành công. Việc này rất tốn thời gian, công sức, và phải chuyên gia mới làm được. Một lỗ hổng thường tốn vài tuần đến vài tháng.
- Nay: model AI làm trọn cả chuỗi, chạy đêm ngày không nghỉ, tự dựng docker, tự viết script test, tự thử đi thử lại nhiều lần ở nhiều kịch bản. Một lỗ hổng tốn một đêm chạy. Nút thắt giờ là chi phí token và quyền được dùng model. Đó là lý do các hãng AI phải kiểm duyệt ai được dùng model AI mở khóa (như Claude Cyber Verification Program ). Và giới bảo mật thi nhau tìm cách... bẻ khóa để AI thực hiện tác vụ vượt rào.
Và... bên phòng thủ cũng đang vỡ trận vì núi các report bug bảo mật.
- Linux gán số cho 432 lỗ hổng chỉ trong 2 ngày. Số lỗ hổng của mỗi bản phát hành từ 500 đang tiến tới 2.000. Linus Torvalds nói danh sách báo lỗi bảo mật đã "gần như không quản lý nổi".
- Apple phát hành 3 đợt vá trong vòng 3 tuần, đợt gần nhất 29 lỗi, vì AI tìm lỗi nhanh hơn chu kỳ phát hành của họ (anh em thấy gần đây Macbook, Iphone hay update là vậy).
- HackerOne, sàn săn lỗi (bug bounty hunting) lớn nhất thế giới thông báo lượng report tăng 76%. GitHub cắt tiền thưởng chương trình bug bounty chỉ còn 1/4. HackerOne bắt nộp hộ chiếu, chụp selfie mới cho gửi báo cáo.
Trở lại Ultron. Bước thứ ba của phim - chiếm xưởng để tự nhân bản - chưa xảy ra. Nhưng với tình hình này... chắc cái nào quan trọng, gặp sự cố xảy ra cứ rút dây điện như anh tôi từng nói là lẹ nhất quá!