Từ Gemini, Claude đến ChatGPT: Khi AI Agent có thể trở thành hacker tự động

Từ Gemini, Claude đến ChatGPT: Khi AI Agent có thể trở thành hacker tự động

Trợ lý AI (AI assistant) từng chỉ dừng ở việc gợi ý vài dòng mã cho lập trình viên. Nhưng theo nghiên cứu công bố tháng 4/2026 của Forescout Vedere Labs, các mô hình AI như Gemini, Claude và GPT, khi được triển khai dưới dạng AI Agent và cấp quyền sử dụng terminal cùng công cụ phân tích, đã có thể tự thực hiện nhiều bước trong quá trình tìm kiếm và khai thác lỗ hổng. Là nhà phân phối chính thức của Forescout tại Việt Nam, Mi2 JSC tổng hợp những phát hiện quan trọng và gợi ý cách doanh nghiệp cần chuẩn bị trước sự xuất hiện của “hacker tự động”.

Từ trợ lý AI đến hacker tự động: AI Agent đã tiến xa đến đâu?

Chỉ trong một năm, AI Agent đã chuyển từ vai trò trợ lý AI thụ động sang hacker tự động. Năm 2025, 55% mô hình AI thất bại ở bước nghiên cứu lỗ hổng cơ bản và 93% thất bại khi phải viết mã khai thác. Đến 2026, toàn bộ mô hình được kiểm thử đều vượt qua bài nghiên cứu lỗ hổng.

Điểm thay đổi cốt lõi là cách vận hành. Thay vì hội thoại đơn thuần, Forescout cho phép các mô hình hoạt động dưới dạng tác nhân (agentic) – được cấp quyền truy cập terminal, dòng lệnh và công cụ phân tích trong môi trường Visual Studio Code. Nhờ đó, một nửa số mô hình năm 2026 có thể tự tạo ra mã khai thác hoạt động được mà không cần người dùng chỉnh sửa từng bước. Ranh giới giữa “công cụ hỗ trợ” và “kẻ tấn công tự động” gần như đã bị xóa.

Gemini, Claude, ChatGPT: mô hình AI nào nguy hiểm nhất khi thành hacker tự động

Claude Opus 4.6 và Kimi K2.5 là hai mô hình mạnh nhất, có thể tự phát hiện và khai thác lỗ hổng mà không cần câu lệnh phức tạp – khiến năng lực tấn công đến được cả tay những kẻ ít kinh nghiệm. Ngược lại, GPT-5.3-Codex lại từ chối thực hiện vì chính sách an toàn siết chặt hơn.

Thông qua nhiều quy trình AI Agent, bao gồm thử nghiệm trực tiếp với Claude, khung RAPTOR và một workflow tùy chỉnh tương tự RAPTOR, nhóm nghiên cứu đã xác định bốn lỗ hổng chưa từng được công bố trong OpenNDS – một dự án mã nguồn mở được dùng phổ biến để tạo captive portal trên router, gateway và điểm truy cập Wi-Fi. Đáng chú ý, một trong số đó từng bị bỏ sót khi chính các chuyên gia phân tích thủ công.

Ở quy mô lớn hơn, dự án Project Glasswing của Anthropic đã phát hiện hàng nghìn lỗ hổng zero-day trên các hệ điều hành và trình duyệt lớn – trong đó có một lỗ hổng nằm im suốt 27 năm trong OpenBSD. Bảng dưới đây tóm tắt năng lực của các mô hình AI theo kết quả kiểm thử:

Mô hình AI Tự tìm lỗ hổng Tự viết mã khai thác
Claude Opus 4.6
Kimi K2.5
Gemini 3 Pro Preview Chưa ổn định
DeepSeek V3.2 Chưa
OpenAI GPT-5.3-Codex Từ chối (chính sách an toàn)

 

Kết quả trên phản ánh các bài kiểm thử cụ thể của Forescout, không đánh giá tuyệt đối về mọi phiên bản hoặc mọi môi trường triển khai.

Vì sao hacker tự động là mối đe dọa cận kề với doanh nghiệp

Hacker tự động hạ thấp rào cản tấn công. Kẻ tấn công ít kinh nghiệm nay có thể dùng AI thương mại để tìm lỗ hổng mới chỉ trong vài phút, khiến giả định “một lỗ hổng có thể chờ vá vài tháng” không còn an toàn.

Nghiên cứu cũng ghi nhận sự dịch chuyển rõ rệt trong giới tội phạm mạng: các mô hình AI ngầm (như WormGPT) gần như bị bỏ rơi, thay vào đó là mô hình thương mại kết hợp jailbreak và mô hình mã nguồn mở chạy nội bộ. Những thành viên có kinh nghiệm còn hướng dẫn người mới sử dụng AI để tạo nội dung lừa đảo, hỗ trợ phát tán mã độc hoặc thực hiện các tác vụ kỹ thuật vốn thường xuất hiện trong kiểm thử xâm nhập. Từ giữa năm 2025, Claude trở thành lựa chọn được ưa chuộng trong cộng đồng này, trong khi các phiên bản ChatGPT mới mất dần sức hút vì chính sách kiểm soát chặt hơn.

Hệ quả trực tiếp: số lượng lỗ hổng được phát hiện sẽ tăng vọt, nhanh đến mức quy trình công bố phối hợp kéo dài nhiều tháng – và ngay cả hệ thống định danh CVE truyền thống – khó lòng theo kịp.

Đối phó với hacker tự động: hiển thị toàn diện và AI Agent phòng thủ từ Forescout

Muốn chống hacker tự động, doanh nghiệp cần khả năng hiển thị toàn diện (full visibility) theo thời gian thực trên toàn bộ môi trường IT, OT, IoT và thiết bị y tế. Bạn không thể vá, phân đoạn hay phản ứng với một tài sản mà mình thậm chí không biết nó tồn tại.

Forescout đưa ra bốn khuyến nghị: nén ngắn thời gian vá lỗi; ưu tiên tuyệt đối cho khả năng hiển thị tài sản; tập trung xử lý các thiết bị OT, IoT và y tế vốn thường không được quản lý; và chủ động dùng chính AI để tự rà soát lỗ hổng trước khi kẻ tấn công ra tay.

Đây cũng chính là thế mạnh của nền tảng Forescout do Mi2 phân phối: hiển thị và phân loại mọi thiết bị theo thời gian thực mà không cần cài agent, kết hợp với kiểm soát truy cập mạng (Network Access Control – NAC) để tự động cách ly thiết bị rủi ro. Với các nhà máy và hệ thống hạ tầng, giải pháp bảo mật IoT/OT giúp giám sát những tài sản khó thấy nhất. Song song, bộ tác nhân AI phòng thủ Forescout VistaroAI được xây dựng riêng cho an ninh mạng, dùng chính sức mạnh của AI Agent để bảo vệ thay vì tấn công.

Vì sao chọn Mi2 cho hành trình phòng thủ trước hacker tự động

Mi2 JSC là nhà phân phối chính thức của Forescout cùng nhiều hãng bảo mật hàng đầu tại Việt Nam, cung cấp trọn gói tư vấn – triển khai – hỗ trợ để doanh nghiệp xây dựng năng lực phòng thủ chủ động.

Bên cạnh Forescout, danh mục của Mi2 phủ toàn diện các lớp phòng thủ mà một chiến lược chống hacker tự động cần đến: từ kiểm thử xâm nhập (penetration testing) để chủ động tìm điểm yếu, đến trung tâm điều hành an ninh (SOC) giám sát và phản ứng 24/7. Đội ngũ kỹ sư giàu kinh nghiệm của Mi2 đồng hành cùng doanh nghiệp từ khâu đánh giá hiện trạng đến vận hành lâu dài. Tìm hiểu thêm về năng lực và đối tác của Mi2.

Câu hỏi thường gặp (FAQ)

AI Agent là gì?

Có thể hình dung AI Agent như một “nhân viên số” được hỗ trợ bởi trí tuệ nhân tạo. Thay vì chỉ trả lời câu hỏi, AI Agent có thể tự lên kế hoạch, thực hiện nhiều bước công việc, tương tác với các hệ thống khác và liên tục điều chỉnh hành động để đạt được mục tiêu được giao.

Những mô hình AI nào có thể trở thành hacker tự động?

Theo Forescout, Claude Opus 4.6 và Kimi K2.5 là hai mô hình tự tìm và khai thác lỗ hổng tốt nhất; Gemini 3 Pro Preview và DeepSeek V3.2 cũng phát hiện được lỗ hổng thực tế, trong khi GPT-5.3-Codex từ chối do chính sách an toàn.

AI Agent có thể tự tấn công hoàn toàn mà không cần con người không?

Một số mô hình đã hoàn thành được chuỗi nghiên cứu và khai thác lỗ hổng trong môi trường thử nghiệm với rất ít can thiệp. Tuy nhiên, năng lực này chưa ổn định, vẫn có hiện tượng báo sai và phụ thuộc nhiều vào mô hình, quyền truy cập, công cụ, câu lệnh và bối cảnh triển khai.

Doanh nghiệp Việt Nam nên làm gì để phòng thủ?

Ưu tiên xây dựng khả năng hiển thị toàn diện toàn bộ tài sản IT/OT/IoT, rút ngắn thời gian vá lỗi, tập trung bảo vệ thiết bị OT và y tế, đồng thời dùng AI để chủ động rà soát lỗ hổng của chính mình.

Mua giải pháp Forescout ở đâu tại Việt Nam?

Mi2 JSC là nhà phân phối chính thức của Forescout tại Việt Nam. Doanh nghiệp có thể liên hệ đội ngũ Mi2 để được tư vấn, khảo sát và triển khai giải pháp phù hợp.

Liên hệ chúng tôi

Để biết thêm chi tiết về sản phẩm, dịch vụ trong bài viết, vui lòng liên hệ chúng tôi hoặc để lại thông tin, chúng tôi sẽ liên hệ lại trong thời gian sớm nhất:

Mục lục bài viết

Đặt lịch tư vấn

Đăng ký nhận bản tin từ chúng tôi