- Một lời nhắc được đưa vào tác nhân OpenClaw AI sẽ đánh lừa nó cài đặt phần mềm.
- Rủi ro ngày càng tăng khi AI giành được quyền truy cập lệnh, đồng thời kêu gọi các biện pháp bảo vệ mạnh mẽ hơn.
Những lo ngại về bảo mật xung quanh các công cụ AI tự động đã chuyển từ các tài liệu nghiên cứu sang thử nghiệm trong thế giới thực trong tuần này, sau khi một tác nhân nguồn mở lan truyền có tên OpenClaw được sử dụng trong một trò lừa tiêm nhanh cho thấy cách các trợ lý AI có thể bị lừa cài đặt phần mềm trên máy của người dùng.
Vụ việc liên quan đến trợ lý mã hóa Cline, người sử dụng mô hình Claude của Anthropic để giúp các nhà phát triển viết và quản lý mã. Một nhà nghiên cứu đã chứng minh rằng các hướng dẫn ẩn được nhúng trong nội dung có thể khiến công cụ AI tự động tải xuống và cài đặt tác nhân OpenClaw mà không cần người dùng chấp thuận hành động.
Mặc dù các tác nhân đã cài đặt chưa được kích hoạt và không có tác hại nào được xác nhận, nhưng thử nghiệm đã nêu bật cách các cuộc tấn công tiêm nhiễm kịp thời có thể dẫn đến những thay đổi thực sự trong hệ thống nếu các công cụ AI được cấp quyền chạy lệnh hoặc quản lý tệp.
Cách tính năng chèn nhắc nhở biến văn bản thành hành động của hệ thống
Tính năng nhắc nhở hoạt động bằng cách đặt các hướng dẫn trong văn bản mà AI đọc như một phần nhiệm vụ của nó. Vì nhiều tác nhân AI phải xử lý nội dung bên ngoài, như tài liệu, trang web hoặc tệp dự án, nên kẻ tấn công có thể ẩn các lệnh bên trong nội dung đó. Nếu hệ thống không phân tách được các hướng dẫn đáng tin cậy khỏi đầu vào không đáng tin cậy thì AI có thể làm theo các lệnh đó.
Các nhà nghiên cứu đã cảnh báo về vấn đề này, nhưng ví dụ về OpenClaw đã thu hút sự chú ý vì nó liên quan đến phần mềm được thiết kế để hoạt động trên máy tính của người dùng chứ không phải tạo ra phản hồi. Cuộc trình diễn cho thấy cách một trợ lý AI có thể bị buộc phải cài đặt các công cụ một cách âm thầm, làm dấy lên mối lo ngại về điều gì có thể xảy ra nếu phương pháp tương tự được sử dụng để cung cấp phần mềm độc hại.
Các tác nhân nguồn mở mang đến những thách thức bảo mật mới
Bản thân OpenClaw là một khung AI nguồn mở được thiết kế để thực hiện các tác vụ như chạy tập lệnh, xử lý tệp hoặc tự động hóa quy trình công việc. Dự án đã nhanh chóng trở nên phổ biến trực tuyến trong những tuần gần đây, một phần do thương hiệu có chủ đề tôm hùm vui nhộn và khả năng hoạt động trực tiếp trên hệ thống của người dùng.
Mức độ truy cập hệ thống đó cũng là nguyên nhân khiến những công cụ như vậy trở nên rủi ro. Không giống như chatbot chủ yếu tạo ra văn bản, các tác nhân tự trị có thể tương tác với hệ điều hành và môi trường phát triển. Nếu bị xâm phạm, họ có thể tải tệp xuống, thay đổi cài đặt hoặc truy cập thông tin đăng nhập được lưu trữ.
Các nhà nghiên cứu bảo mật đã cảnh báo rằng hệ sinh thái xung quanh các tác nhân này cũng có thể gây ra rủi ro. Báo cáo trước đó từ The Verge nêu bật mối lo ngại về các tiện ích mở rộng và tiện ích bổ sung gắn liền với OpenClaw, khi các nhà phân tích tìm thấy phần mềm độc hại ẩn trong một số thành phần do cộng đồng xây dựng. Các phát hiện cho thấy rằng các thị trường mở cho các công cụ tác nhân AI có thể khiến người dùng gặp phải mã không an toàn nếu không thực hiện kiểm tra thích hợp.
Từ trợ lý Chat đến hệ thống AI tự động
Thử nghiệm tiêm nhanh mới nhất củng cố những lo lắng đó. Khi các công cụ AI giành được nhiều quyền kiểm soát hơn đối với các hệ thống cục bộ, ranh giới giữa phản hồi văn bản vô hại và hành động ở cấp hệ thống trở nên mỏng hơn. Các nhà phát triển thường cấp quyền cho các công cụ này để tăng tốc độ mã hóa hoặc tự động hóa công việc thường ngày, nhưng quyền truy cập đó có thể bị lạm dụng nếu các biện pháp bảo vệ không thành công.
Các chuyên gia bảo mật cho biết thách thức chính là các mô hình AI được thiết kế để tuân theo hướng dẫn. Khi họ đọc văn bản, không phải lúc nào họ cũng phân biệt được giữa một yêu cầu hợp pháp và một lệnh độc hại ẩn giấu. Nếu không có tính năng lọc, kiểm soát quyền và giám sát chặt chẽ, tính năng chèn nhắc nhở có thể biến các tương tác thông thường thành hành động ngoài ý muốn.
Ví dụ về OpenClaw cho thấy rằng khi các công cụ này trở nên có nhiều khả năng hơn thì thiết kế bảo mật của chúng cần phải phù hợp với khả năng đó. Các biện pháp kiểm soát như lời nhắc xác nhận, quyền thực thi bị hạn chế và sự phân tách rõ ràng hơn giữa nội dung đáng tin cậy và không đáng tin cậy có thể giúp giảm thiểu rủi ro.
Đối với các nhà phát triển và tổ chức đang thử nghiệm các tác nhân AI, sự cố này như một lời nhắc nhở rằng các tính năng tiện lợi có thể gây ra các lỗ hổng mới. Việc cung cấp cho các công cụ AI khả năng hoạt động trực tiếp trên hệ thống có thể cải thiện năng suất nhưng cũng đòi hỏi các biện pháp bảo vệ mạnh mẽ hơn so với các biện pháp bảo vệ được sử dụng cho trợ lý dựa trên Chat.
Người đại diện theo chủ đề tôm hùm có thể nhanh chóng biến mất khỏi các tiêu đề báo chí, nhưng bài học đằng sau nó có thể vẫn còn đó. Khi hệ thống AI thay đổi từ đưa ra lời khuyên sang thực hiện hành động, ngay cả những điểm yếu nhỏ trong cách chúng xử lý hướng dẫn cũng có thể gây ra hậu quả rộng lớn hơn. Thử nghiệm gần đây cho thấy rằng các câu hỏi bảo mật xung quanh AI tự trị không hề trừu tượng – chúng đã xuất hiện trong các công cụ thực tế được các nhà phát triển sử dụng ngày nay.

Bạn muốn tìm hiểu thêm về AI và dữ liệu lớn từ các nhà lãnh đạo ngành? Hãy xem AI & Big Data Expo diễn ra ở Amsterdam, California và London. Sự kiện toàn diện này là một phần của TechEx và được tổ chức cùng với các sự kiện công nghệ hàng đầu khác, hãy nhấp vào đây để biết thêm thông tin.
Tin tức AI được cung cấp bởi TechForge Media. Khám phá các sự kiện và hội thảo trực tuyến về công nghệ doanh nghiệp sắp tới khác tại đây.



