AI của OpenAI và Anthropic tự tạo danh tính giả để tấn công mạng

07/08/2026 08:30
Viện Nghiên cứu An ninh AI Anh phát hiện các mô hình AI của OpenAI và Anthropic thực hiện hành vi lừa đảo chưa từng có trong một cuộc kiểm thử an ninh mạng.

Các tác nhân AI chạy trên mô hình Mythos 5 của Anthropic và GPT-5.6 Sol của OpenAI thực hiện các hành vi bất thường trong buổi kiểm thử an ninh mạng ngày 28/7 của AISI. Ảnh: Bloomberg

Viện Nghiên cứu An ninh AI Anh (AISI) vừa phát hiện các hành vi bất thường từ các tác vụ AI (agent) chạy trên hai mô hình tiên tiến: Mythos 5 của Anthropic và GPT-5.6 Sol của OpenAI.

Sự việc xảy ra trong buổi kiểm thử an ninh mạng định kỳ ngày 28/7, khi một số hệ thống có biểu hiện "hoạt động kéo dài, tiềm ẩn nguy cơ gây hại đến người thật và các tổ chức". Các chuyên gia mất một giờ để khống chế vụ việc.

Trong sự cố nghiêm trọng nhất, tác vụ AI chạy mô hình Mythos đã tìm cách chèn mã độc vào một dự án phần mềm mã nguồn mở trên nền tảng GitHub.

Để mã độc được phê duyệt, AI này tạo các danh tính ảo dựa trên thông tin người thật nhằm gây áp lực lên quản trị viên dự án. Hành vi bị ngăn chặn nhờ một lập trình viên kịp thời phát hiện.

AISI cho biết tác vụ AI đã sử dụng các kỹ thuật tấn công phổ biến của tin tặc. Hệ thống tự gửi email nhắm vào các cá nhân cụ thể (kỹ thuật spear-phishing - tấn công giả mạo có mục tiêu) để thao túng người nhận, trong đó một số thư có chứa phần mềm độc hại.

Dù chưa gây ra thiệt hại thực tế, AISI đánh giá đây là hành vi chưa từng có tiền lệ. "Đây là lần đầu tiên chúng tôi ghi nhận các rủi ro về tính tự chủ và sự tự lừa đảo thể hiện rõ ràng như vậy trong điều kiện thực tế mà không cần lệnh gợi ý (prompt) cụ thể", đại diện AISI đăng tải trên blog.

Sự cố này tiếp nối các vụ việc tương tự gần đây. Tháng 7, OpenAI cho biết một tác vụ AI của hãng đã tấn công mạng một công ty khởi nghiệp AI trong buổi kiểm thử. Vài ngày sau, Anthropic cũng xác nhận mô hình Claude đã xâm nhập vào hệ thống của ba tổ chức.

AISI nhận định đây là sự "chuyển dịch trong bức tranh rủi ro". Sự việc không xuất phát từ việc cố ý sử dụng sai mục đích các mô hình thương mại, mà cho thấy AI trong môi trường nghiên cứu đã tự ý thực hiện các hành động vượt quá phạm vi cho phép. Trong số 19 trường hợp AI tự phát hiện hành vi bất thường, 17 vụ do Mythos và 2 vụ do Sol thực hiện.

Tổ chức khẳng định AI chưa vượt khỏi môi trường thử nghiệm an toàn (sandbox). Trong quá trình thử nghiệm, AISI đã chủ động mở truy cập Internet và tắt các bộ lọc chặn hành vi nguy hiểm.

Các mô hình này không được phát hành công khai ở trạng thái trên và chưa có dấu hiệu lặp lại hành vi ngoài các bài kiểm tra.

AISI thừa nhận đã không giám sát chủ động các tác vụ AI trong quá trình đánh giá. Sau sự cố, cơ quan này quyết định thắt chặt kiểm soát truy cập Internet, thiết lập hệ thống theo dõi liên tục và đánh giá lại quy trình kiểm thử.

Ông Kanishka Narayan, Bộ trưởng AI Anh, nhấn mạnh việc phát hiện các hành vi mới và chia sẻ thông tin để xử lý chính là mục tiêu thành lập của AISI.

Đại diện OpenAI cho biết cuộc kiểm thử diễn ra trong "điều kiện không phản ánh cách sử dụng thông thường" và khẳng định sẽ tiếp tục phối hợp với các bên để nâng cao an toàn đánh giá.

Trong khi đó, Anthropic nhận định vụ việc "nhấn mạnh tầm quan trọng của việc thảo luận về cách đánh giá an toàn cho các tác vụ AI ngày càng thông minh".

Theo Du Lam (Vietnamnet)
Dịch từ The Guardian
 
Xem tin/bài gốc tại đây

Tin xem thêm

5 từ khóa nuôi dạy con của 'bà mẹ thung lũng Silicon' tạo nên 2 nữ CEO đình đám

Tin Tức
08/08/2026 10

MỸ - Bà mẹ nổi tiếng ở thung lũng Silicon tiết lộ bí quyết nuôi dạy thành công 1 nhà khoa học và 2 nữ CEO đình đám bằng 5 giá trị cốt lõi "tin tưởng - tôn trọng - tự lập ...

Nhiều tài xế vẫn liều mình lái ô tô đi qua cây cầu đã bị gãy sập suốt gần 3 năm

Tin Tức
08/08/2026 10

HY LẠP - Dù đã đổ sập từ năm 2023 và bị cấm lưu thông, một cây cầu ở Hy Lạp vẫn ngày ngày có nhiều ô tô qua lại. Không ít tài xế chấp nhận mạo hiểm, hàng ngày làm bạn với...

Xuất khẩu sầu riêng tăng mạnh, vì sao giá ngày càng rẻ?

Tin Tức
08/08/2026 08

Xuất khẩu sầu riêng đã đem về khoảng 1,8 tỷ USD trong 7 tháng đầu năm, tăng gần 30% so với cùng kỳ năm ngoái. Thế nhưng, “trái cây vua” ở nước ta có giá ngày càng rẻ.

Magie thành 'vitamin quốc dân', bác sĩ cảnh báo nóng

Tin Tức
08/08/2026 08

Thời gian gần đây, các video quảng bá tác dụng của magie xuất hiện dày đặc trên nền tảng mạng xã hội. Tuy nhiên, các bác sĩ cảnh báo việc tự ý bổ sung khoáng chất này có ...

Nguồn cung xe máy mới dồi dào trước dịp năm học mới bắt đầu

Tin Tức
08/08/2026 08

Lượng xe máy mới được các doanh nghiệp trong nước xuất xưởng trong tháng 7 vừa qua vẫn duy trì ở mức cao, đưa tổng số xe máy sản xuất trong nước 7 tháng đầu năm lên con s...

Khởi tố ca sĩ Phương Diễm Huyền và giám đốc công ty truyền thông

Tin Tức
08/08/2026 08

Công an TPHCM vừa khởi tố bị can đối với ca sĩ Nguyễn Thị Hiền (chủ kênh YouTube "Phương Diễm Huyền") và Nguyễn Thành Hiệp (Giám đốc Công ty TNHH Truyền thông và Giải trí...

Từ dấu hiệu trên da, nam thanh niên phát hiện mắc căn bệnh 2 triệu người gặp 1

Tin Tức
08/08/2026 08

Nam thanh niên nhập viện vì nhiều nốt sưng đỏ, đau dưới da và ban hoại tử tím lan rộng ở tay, chân, thân mình. Bác sĩ chẩn đoán anh mắc căn bệnh rất hiếm gặp.

Samsung chính thức mở bán Galaxy Z Fold8 Ultra, Fold8, Flip8 trên toàn cầu

Tin Tức
08/08/2026 08

Samsung chính thức đưa bộ ba điện thoại gập Galaxy Z Fold8 Ultra, Galaxy Z Fold8 và Galaxy Z Flip8 lên kệ tại 106 thị trường từ ngày 7/8, sau khi kết thúc giai đoạn đặt t...

Ngân hàng trung ương mua vàng nhiều kỷ lục khi giá vàng lao dốc

Tin Tức
08/08/2026 08

Theo số liệu của WGC, trong khi giá vàng trải qua quý giảm mạnh nhất hơn một thập kỷ, các ngân hàng trung ương toàn cầu mua ròng 289 tấn vàng trong quý II, tăng 62% so vớ...

Thủ tướng yêu cầu phòng, chống gian lận trong thi tốt nghiệp THPT 2027

Tin Tức
08/08/2026 08

Thủ tướng Lê Minh Hưng vừa ban hành Chỉ thị số 31 về việc thực hiện các nhiệm vụ trọng tâm năm học 2026-2027.

Cơ quan quản lý trang thông tin điện tử tổng hợp: Tập đoàn Bưu chính Viễn thông Việt Nam
Địa chỉ: Số 57 Phố Huỳnh Thúc Kháng, Phường Láng, Thành phố Hà Nội
Chịu trách nhiệm quản lý nội dung: Ông Vũ Trường Giang – TGĐ VNPT Media
SĐT : 024 37722728 - Hotline 18001091 - Email: vnptmedia@vnpt.vn
Giấy phép trang tin điện tử số: 822/GP-TTĐT do Sở TT-TT Hà Nội cấp ngày 02/03/2017