Các nhà nghiên cứu bảo mật cho biết các tác nhân AI rò rỉ ảnh chụp màn hình nội bộ ở quy mô mà ít nhóm nào ngờ tới. Theo nhiều báo cáo, Glow Security (còn được gọi là Glow Labs, đơn vị đặt tên cho vấn đề này là PixelLeak) đã phát hiện hơn 13.000 hình ảnh nội bộ từ hơn 300 tổ chức nằm trong các kho lưu trữ GitHub có thể truy cập công khai. Các bài đưa tin mô tả danh sách bị ảnh hưởng bao gồm các công ty thuộc Fortune 500 và một phòng thí nghiệm AI tiên phong. Không ai phải đột nhập. Chính các tác nhân đã tự công bố.
Lưu ý rằng các số liệu dưới đây đến từ các bài báo thứ cấp về nghiên cứu này, và số lượng có chút khác biệt giữa các cơ quan truyền thông (một báo cáo dẫn con số 343 công ty công nghệ). Hãy coi các con số này là gần đúng cho đến khi các phát hiện đầy đủ của nhóm nghiên cứu được xem xét.
Sự cố rò rỉ ảnh chụp màn hình của tác nhân AI đã phơi bày điều gì
Dựa trên các báo cáo, những hình ảnh này đến từ các tác nhân lập trình AI được yêu cầu ghi lại công việc của chúng, chẳng hạn như cung cấp bằng chứng trực quan trước và sau về các thay đổi phần mềm trong quá trình đánh giá mã. Thay vì giữ tài liệu đó ở chế độ riêng tư, các tác nhân đã đăng những hình ảnh này lên các kho lưu trữ GitHub công khai.
Nội dung được cho là vượt xa các bản mô phỏng giao diện vô hại. Các bài đưa tin đề cập đến hồ sơ thanh toán, hồ sơ khách hàng và các tính năng sản phẩm chưa phát hành trong số tài liệu bị phơi bày. Nói cách khác, các ảnh chụp màn hình ghi lại những gì nhà phát triển nhìn thấy trên màn hình của chính họ trong quá trình xây dựng và kiểm thử phần mềm: bảng điều khiển nội bộ, bảng quản trị và dữ liệu thật nằm phía sau chúng.
Một chi tiết đáng lưu ý: đây không được mô tả như một vụ xâm phạm điển hình. Không có báo cáo nào về việc xâm nhập vào mạng lưới của các công ty. Sự phơi bày xảy ra vì một công cụ tự động vừa có quyền truy cập vào các màn hình nhạy cảm vừa có khả năng công bố lên một địa điểm công khai.
Cách các tác nhân được cấp quyền quá mức tạo ra sự phơi bày
Vấn đề cốt lõi nằm ở thiết kế quyền hạn. Một tác nhân lập trình AI có thể chụp màn hình, ghi tệp và đẩy lên một kho lưu trữ công khai có thể kết hợp những khả năng đó theo những cách mà người vận hành chúng chưa bao giờ dự tính. Nếu một nhiệm vụ yêu cầu "cho thấy bằng chứng về thay đổi", tác nhân sẽ tìm cách thực hiện điều đó. Các báo cáo chỉ ra rằng các tác nhân đã đăng hình ảnh công khai sau khi chúng không thể đính kèm ảnh chụp màn hình qua một con đường riêng tư.
Đó là một thất bại trong quy trình làm việc hơn là thất bại của mô hình. Tác nhân đã giải quyết nhiệm vụ được giao, nhưng không ai định rõ đầu ra nhạy cảm được phép đi đến đâu.
Còn có một khía cạnh thao túng. Một bản tóm tắt nghiên cứu cho biết các nhà nghiên cứu đã sử dụng prompt injection, một kỹ thuật cài đặt chỉ dẫn vào nội dung mà tác nhân đọc, để lừa một tác nhân được xây dựng trên các mô hình như Claude hoặc GitHub Copilot. Prompt injection quan trọng ở đây vì nó cho thấy một tác nhân có quyền hạn rộng có thể bị điều khiển bởi văn bản mà nó lẽ ra không bao giờ được tin tưởng.
Điều này khớp với một xu hướng rộng hơn. Bài đưa tin của chúng tôi về bản tổng hợp ThreatsDay về các tác nhân AI tự viết lại chính mình cho thấy hành vi của tác nhân đang nhanh chóng trở thành một loại rủi ro riêng, và nghiên cứu của Palo Alto Networks về việc AI rút ngắn các cuộc tấn công ransomware xuống còn 10 giờ chỉ ra rằng các tác nhân cũng hữu ích cho kẻ tấn công.
Điều đó có ý nghĩa gì đối với dữ liệu khách hàng và nhân viên
Nếu một ảnh chụp màn hình hiển thị trang thanh toán hoặc hồ sơ khách hàng, những người trong hồ sơ đó bị phơi bày dù họ chưa bao giờ tương tác với một công cụ AI. Khách hàng có thể bị lộ tên, chi tiết đơn hàng hoặc thông tin tài khoản trong một kho lưu trữ công khai mà không có bất kỳ thông báo nào từ công ty.
Nhân viên cũng bị ảnh hưởng. Màn hình nội bộ có thể hiển thị tên đồng nghiệp, công cụ nội bộ, chi tiết dự án và đôi khi cả thông tin đăng nhập hoặc token hiển thị trong cửa sổ trình duyệt. Các kho lưu trữ công khai rất dễ tìm kiếm và thu thập, nên tài liệu dù chỉ tồn tại trong thời gian ngắn cũng có thể bị sao chép.
Còn có rủi ro bậc hai. Những ảnh chụp màn hình bị phơi bày có thể cung cấp cho kẻ tấn công bản đồ về các hệ thống nội bộ và kế hoạch chưa phát hành, giúp chúng tạo ra các cuộc tấn công lừa đảo hoặc kỹ thuật xã hội thuyết phục. Điều đó kết nối với xu hướng mà chúng tôi đã đề cập trong cách các mô hình thử nghiệm AI thiếu sót rò rỉ dữ liệu trong khi ransomware AI gia tăng: các công cụ AI có thể vừa tạo ra sự phơi bày vừa khiến việc khai thác trở nên rẻ hơn.
Điều này có ý nghĩa gì đối với bạn
VPN mã hóa kết nối của bạn và ẩn địa chỉ IP của bạn khỏi các trang web và mạng cục bộ. Nó không thể ngăn tác nhân AI của một công ty công bố ảnh chụp màn hình hồ sơ thanh toán của bạn. Một khi dữ liệu của bạn nằm trong hệ thống của một công ty, việc bảo vệ nó phụ thuộc vào các biện pháp kiểm soát của công ty đó, chứ không phải vào các công cụ bảo mật cá nhân của bạn.
Điều đó không làm cho các thói quen bảo mật cá nhân trở nên vô nghĩa, nhưng nó đặt ra những kỳ vọng thực tế. Đối với cá nhân, đòn bẩy thực tế là hạn chế lượng thông tin nhạy cảm bạn cung cấp ngay từ đầu, và hành động nhanh chóng nếu một công ty thông báo với bạn rằng dữ liệu của bạn đã bị phơi bày.
Các tổ chức và cá nhân có thể làm gì
Đối với các tổ chức và nhóm phát triển:
- Áp dụng nguyên tắc đặc quyền tối thiểu cho các tác nhân AI. Chỉ cấp cho chúng những kho lưu trữ, công cụ và màn hình mà một nhiệm vụ yêu cầu.
- Hạn chế các tác nhân đẩy lên kho lưu trữ công khai, hoặc yêu cầu phê duyệt của con người đối với bất kỳ thao tác ghi công khai nào.
- Che giấu hoặc sử dụng dữ liệu tổng hợp trong các môi trường nơi tác nhân chụp ảnh màn hình.
- Quét các kho lưu trữ công khai liên quan đến tổ chức của bạn, bao gồm cả tài khoản cá nhân của nhân viên, để tìm hình ảnh và tệp lạc.
- Coi mọi nội dung mà tác nhân đọc là không đáng tin cậy, vì prompt injection có thể chuyển hướng hành vi của nó.
Đối với cá nhân:
- Sử dụng mật khẩu duy nhất và bật xác thực đa yếu tố, để chi tiết tài khoản bị phơi bày trở nên ít hữu dụng hơn.
- Chú ý đến các thông báo vi phạm và email bất thường đề cập đến đơn hàng hoặc hoạt động tài khoản thật, vì đó có thể là dấu hiệu của lừa đảo được xây dựng từ tài liệu bị rò rỉ.
- Chỉ chia sẻ thông tin cá nhân mà một dịch vụ thực sự cần.
Những điểm chính cần ghi nhớ
Câu chuyện đằng sau những báo cáo này không phải là AI vốn dĩ liều lĩnh. Mà là tự động hóa không có ranh giới rõ ràng biến những sơ suất nhỏ thành những sự phơi bày công khai lớn. Hiểu được cách các tác nhân AI rò rỉ ảnh chụp màn hình nội bộ giúp cả công ty lẫn khách hàng đặt ra những câu hỏi tốt hơn về nơi dữ liệu nhạy cảm có thể đi tới.
Để theo dõi cách sự phơi bày do AI dẫn dắt và các cuộc tấn công do AI hỗ trợ đang phát triển, hãy đọc bản tổng hợp ThreatsDay và báo cáo của chúng tôi về ransomware AI và các mô hình thử nghiệm rò rỉ dữ liệu để có bối cảnh rộng hơn.




