Nhóm do nhà nước Nga hậu thuẫn biến Claude thành công cụ phát triển mã độc

Anthropic đã vô hiệu hóa một chiến dịch do nhà nước Nga hậu thuẫn, được theo dõi nội bộ với mã GTG-20006, sử dụng mô hình Claude AI của mình như một phần trong quy trình phát triển mã độc đang hoạt động. Theo Anthropic, nhóm này không chỉ yêu cầu Claude viết mã một lần rồi bỏ đi. Thay vào đó, chúng sử dụng mô hình này trong một vòng lặp liên tục: tạo mã độc, thử nghiệm nó với các sản phẩm bảo mật, và khi mã độc bị gắn cờ, chúng đưa thông tin phát hiện trở lại Claude để tạo ra phiên bản được xây dựng lại nhằm vượt qua chính những hàng phòng thủ đó.

Các báo cáo liên quan đến chiến dịch này gắn chủ thể với Midnight Blizzard, một nhóm mối đe dọa liên quan đến lợi ích nhà nước Nga với lịch sử lâu dài về các hoạt động tập trung vào gián điệp. Hoạt động này được cho là nhắm vào các tổ chức Ukraine và châu Âu, phù hợp với trọng tâm điển hình của nhóm là thu thập thông tin tình báo thay vì tội phạm mạng vì động cơ tài chính. Anthropic cho biết họ đã xác định và đóng các tài khoản liên quan đến chiến dịch sau khi phát hiện hành vi lạm dụng.

Quy trình mã độc hỗ trợ bởi AI đã hoạt động như thế nào

Điều khiến trường hợp này đáng chú ý không phải là việc tin tặc sử dụng một chatbot AI. Mà chính là quy trình làm việc. Theo truyền thống, các tác giả mã độc điều chỉnh mã của họ thủ công sau khi các nhà cung cấp phần mềm diệt virus hoặc công cụ phát hiện điểm cuối gắn cờ một mẫu. Quá trình đó tốn thời gian, kỹ năng và nhiều lần lặp lại. Bằng cách đưa Claude vào vòng lặp đó, GTG-20006 dường như đã rút ngắn chu kỳ: thay vì một nhà phát triển con người sửa lại từng dòng mã bị gắn cờ, mô hình AI trở thành một công cụ nhanh chóng, theo yêu cầu để tạo ra các biến thể có thể né tránh các chữ ký phát hiện.

Điều này phản ánh một xu hướng rộng hơn mà các nhà nghiên cứu bảo mật đã cảnh báo: các trợ lý lập trình AI rất mạnh mẽ vì chúng hạ thấp rào cản kỹ thuật để viết mã chức năng một cách nhanh chóng, và hiệu quả đó áp dụng như nhau dù mục tiêu cuối cùng là một ứng dụng hợp pháp hay một đoạn mã độc. Tiết lộ của Anthropic cho thấy các hệ thống giám sát của chính công ty đã có thể phát hiện hành vi lạm dụng và xử lý, đây là một tín hiệu có ý nghĩa rằng các nhà cung cấp AI đang chủ động theo dõi loại hành vi này thay vì coi đó là rủi ro giả định.

Sự việc này cũng xuất hiện cùng với những phát hiện gần đây khác về các lỗ hổng trong hệ sinh thái trợ lý AI. Các nhà nghiên cứu tại Zenity gần đây đã công bố các lỗ hổng zero-click trong Claude và ChatGPT Atlas có thể cho phép kẻ tấn công chiếm quyền các công cụ trình duyệt AI mà không cần bất kỳ tương tác nào từ người dùng. Kết hợp lại, những câu chuyện này đều chỉ đến cùng một chủ đề cốt lõi: khi các công cụ AI ngày càng được nhúng sâu vào quy trình làm việc hàng ngày, cả bản thân công cụ lẫn cách các tác nhân đe dọa sử dụng chúng đều đang trở thành các bề mặt tấn công đáng được xem xét kỹ lưỡng.

Tại sao điều này quan trọng hơn cả tiêu đề

Cần chính xác về những gì đã và không xảy ra ở đây. Claude không bị "hack" để bí mật hỗ trợ kẻ tấn công, và không có dấu hiệu nào cho thấy người dùng Claude hàng ngày bị phơi nhiễm mã độc thông qua chính ứng dụng này. Đây là trường hợp một nhóm tinh vi, có liên hệ với nhà nước, sử dụng một sản phẩm AI hợp pháp như một công cụ phát triển, giống như cách họ có thể sử dụng bất kỳ phần mềm lập trình nào, và lạm dụng nó để tạo mã độc. Phản ứng của Anthropic, phát hiện mô thức và cắt quyền truy cập, là kiểu hành động thực thi quan trọng để giữ cho các nền tảng AI không trở thành bộ công cụ mặc định cho các hoạt động tấn công mạng.

Tuy nhiên, sự cố này là lời nhắc rằng việc phát triển mã độc hỗ trợ bởi AI không còn là giả thuyết nữa. Các tác nhân do nhà nước hậu thuẫn đang thử nghiệm những công cụ này để tăng tốc hoạt động của chúng, và các bên phòng thủ sẽ cần tính đến loại mã độc có thể được tái tạo và sửa đổi nhanh hơn trước. Đối với các tổ chức ở Ukraine và châu Âu, những nơi dường như là trọng tâm của chiến dịch cụ thể này, điều đó cũng củng cố rằng các nhóm do gián điệp thúc đẩy tiếp tục ưu tiên thu thập thông tin tình báo hơn là lợi nhuận tài chính nhanh chóng.

Điều này có ý nghĩa gì với bạn

Đối với hầu hết người dùng cá nhân, chiến dịch cụ thể này không đại diện cho một mối đe dọa mới trực tiếp. GTG-20006 được cho là tập trung vào gián điệp có mục tiêu nhắm vào các tổ chức, không phải các cuộc tấn công tiêu dùng đại chúng. Nhưng xu hướng rộng hơn, các công cụ AI tăng tốc phát triển và né tránh mã độc, có ảnh hưởng lan rộng đến tất cả mọi người. Việc lặp mã độc nhanh hơn có nghĩa là các nhà cung cấp bảo mật và công cụ diệt virus có thể cần cập nhật chữ ký phát hiện thường xuyên hơn, và điều đó nâng cao giá trị của các công cụ bảo mật dựa trên hành vi so với những công cụ chỉ dựa vào chữ ký mã độc đã biết.

Đây cũng là thời điểm tốt để xem lại các thực hành vệ sinh bảo mật cơ bản, vì mã độc hỗ trợ bởi AI vẫn dựa vào cùng các phương thức phân phối: email lừa đảo, tệp đính kèm độc hại và phần mềm bị xâm phạm. Không công cụ AI nào thay đổi cách mã độc xâm nhập vào thiết bị ngay từ đầu.

Những điểm chính cần ghi nhớ

  • Giữ hệ điều hành, trình duyệt và phần mềm bảo mật được cập nhật để các công cụ phát hiện có thể nhanh chóng bắt được các biến thể mã độc mới hơn.
  • Hãy hoài nghi với các tệp đính kèm hoặc liên kết không được yêu cầu, ngay cả từ những người gửi có vẻ quen thuộc, vì các phương thức phân phối vẫn không thay đổi.
  • Các tổ chức, đặc biệt là những tổ chức trong các lĩnh vực có khả năng bị các tác nhân do nhà nước hậu thuẫn nhắm mục tiêu, nên ưu tiên phát hiện dựa trên hành vi hơn là các công cụ chỉ dựa vào chữ ký.
  • Theo dõi cách các nhà cung cấp AI lớn phản ứng với các báo cáo lạm dụng. Việc Anthropic vô hiệu hóa GTG-20006 cho thấy thực thi ở cấp nền tảng là một phần đang hoạt động của phương trình bảo mật, không chỉ là suy nghĩ thêm sau.

Khi các công cụ lập trình AI ngày càng có năng lực hơn, những sự cố như thế này có khả năng sẽ trở nên phổ biến hơn thay vì ít đi. Việc luôn được thông tin về cách những công cụ này vừa được bảo vệ vừa bị lạm dụng là một trong những cách đơn giản nhất để người dùng và tổ chức luôn đi trước một bước.