Câu chuyện AI đáng báo động của năm 2026 không phải là một chatbot nói điều gì đó xúc phạm. Đó là các tác nhân AI tự động—phần mềm có thể lập kế hoạch, sử dụng các công cụ và tự hành động—vượt ra ngoài ranh giới mà người tạo ra chúng đặt ra. Tuần này đã đưa ra ví dụ nổi bật nhất và nó phù hợp với mô hình đã được xây dựng trong nhiều tháng. Vô số: Nvidia sẽ xuống thấp đến mức nào? Bấm vào để đưa ra dự đoán của bạn. Hôm thứ Tư, Thủ tướng Úc Anthony Albanese tiết lộ rằng một Op Đặc vụ enAI đã xâm nhập một trang web của chính phủ Úc vào tháng 6, giành quyền truy cập trái phép vào các tệp công khai và không công khai trên cổng thông tin thống kê của Medicare — đây có vẻ là trường hợp đầu tiên được biết đến về việc một đặc vụ AI tấn công một trang web của chính phủ. Albanese cho biết cho đến nay không có dữ liệu cá nhân nào được cho là bị truy cập, nhưng ông gọi việc OpenAI chậm trễ khoảng ba tháng trong việc tiết lộ vi phạm là “không thể chấp nhận được”. OpenAI cho biết các mô hình của họ đã “thực hiện những hành động ngoài ý muốn” tiến hành đánh giá nội bộ. Đó không phải là một sự cố cá biệt. Trong hai tháng qua, một loạt tiết lộ đã cho thấy các tác nhân AI tiên phong đã tiếp cận được các hệ thống mà chúng không được phép chạm tới. Các đặc vụ của OpenAI đã vi phạm kho lưu trữ nguồn mở Ôm Mặt vào tháng 7—một vụ xâm nhập được phát hiện khoảng một tuần sau đó và được tiết lộ vài tháng sau đó. Các đối thủ đã phải đối mặt với những giai đoạn riêng của họ: Google giữ im lặng về các đại lý của Gemini đã xâm phạm các công ty, Meta cho biết trong số các mẫu của nó đã thoát trong quá trình thử nghiệm của bên thứ ba và Kimi K3 của Trung Quốc được cho là đã thoát ra khỏi hộp cát của mình để tra cứu các câu trả lời kiểm tra. Tại sao điều này lại khó kiềm chế đến vậy? Câu trả lời ngắn gọn là tính hữu dụng của một đặc vụ và mối nguy hiểm của nó đều đến từ cùng một nơi. Cung cấp cho mô hình khả năng lập kế hoạch hướng tới mục tiêu và hành động thông qua các công cụ—duyệt, chạy mã, gọi API—và nó có thể theo đuổi mục tiêu đó theo những cách mà các nhà thiết kế của nó không lường trước được. Mặt ôm và Aus các trường hợp bệnh tralia đều liên quan đến việc các mô hình chủ động trong quá trình đánh giá, chứ không phải các mô hình trở nên "xấu xa". Như một cơ cấu từ cộng đồng nghiên cứu đã chỉ ra, rủi ro không phải là một mô hình phát triển mục đích xấu mà là nó theo đuổi một mục tiêu hẹp với những hậu quả không lường trước được, được bao bọc trong một hệ thống cho phép nó hoạt động tự chủ. Rủi ro sẽ tăng cao hơn khi AI gặp tiền điện tử, bởi vì ở đó những kẻ tấn công có động cơ tài chính trực tiếp. Các mô hình AI hiện nay rẻ và đủ khả năng để tìm kiếm các lỗ hổng phần mềm trên quy mô lớn—một nhóm bảo mật Bitcoin đã cảnh báo rằng AI đã xóa bỏ "sự bất cân xứng thông tin" từng khiến các hoạt động khai thác nằm ngoài tầm với của những kẻ tấn công không có kỹ năng. Cùng tuần đó, các mô hình AI đứng đầu bảng xếp hạng trong cuộc thi nhằm tối ưu hóa khả năng phòng thủ lượng tử của Bitcoin, một lời nhắc nhở rằng công nghệ này cắt giảm cả hai chiều. 'Bitcoin đang bùng cháy': Đội Đỏ sử dụng AI của Trung Quốc để tìm ra lỗ hổng ave đã gây ra một cuộc tranh luận nghiêm túc trong ngành về việc chậm lại. Giám đốc điều hành Anthropic Dario Amodei đã kêu gọi các nhà phát triển tăng tốc độ tăng năng lực, giành được sự hỗ trợ từ Sam Altman của OpenAI và những người khác, trong khi OpenAI đã hỏi các nhà lập pháp liệu các đối thủ có thể phối hợp hợp pháp để giảm tốc độ mà không vi phạm luật chống độc quyền hay không. Các nhà phê bình, bao gồm cả Viện Cato theo chủ nghĩa tự do, phản bác rằng việc tạm dừng bắt buộc sẽ củng cố các nhà lãnh đạo ngày nay mà không giúp ai an toàn hơn. N o người ta có một bản sửa lỗi rõ ràng. Điều mà tuần trước đã làm rõ là AI "đại lý" đã chuyển từ sự tò mò trong phòng thí nghiệm sang thứ gì đó có thể tiếp cận các hệ thống thực trong tự nhiên — và rằng các công ty xây dựng nó, theo sự thừa nhận của chính họ, vẫn đang bắt kịp những gì sáng tạo của họ làm