03-08-2026
Bài báo: Toward Adaptive Web Application Honeypots: Fine-Tuned Large Language Models for Realistic Response EmulationNhóm tác giả:- Phan Bá Cường – ATCL2021- Phạm Đô Thành – ATCL2021Giảng viên hướng dẫn:- ThS. Đỗ Hoàng HiểnTóm tắt:Trước sự gia tăng của các cuộc tấn công ngày càng phức tạp, các honeypot web truyền thống gặp nhiều hạn chế trong việc duy trì tính chân thực do sử dụng các phản hồi tĩnh và dễ bị nhận diện. Bài báo này đề xuất một khung honeypot dựa trên Mô hình Ngôn ngữ Lớn (LLM) đã được tinh chỉnh (fine-tuned), có khả năng tạo ra các phản hồi động, nhận biết ngữ cảnh và mô phỏng sát hành vi của các ứng dụng web thực tế.Để thực hiện điều này, chúng tôi thu thập các cặp yêu cầu (request) và phản hồi (response) thực tế từ các ứng dụng mục tiêu, sau đó tiến hành tiền xử lý bằng cách trích xuất các thông tin quan trọng từ yêu cầu và chuẩn hóa dữ liệu phản hồi. Các cặp dữ liệu yêu cầu–phản hồi này được sử dụng để tinh chỉnh mô hình LLM.Kết quả thực nghiệm cho thấy phương pháp đề xuất vượt trội hơn một cách nhất quán so với cả mô hình huấn luyện trực tiếp trên dữ liệu thô và các honeypot dựa trên LLM hiện có, bao gồm Galah và VelLMes. Cụ thể, phương pháp đạt điểm tương đồng cao hơn trên tất cả các thước đo đánh giá, với độ tương đồng Cosine đạt 0,9396 so với 0,4506 của Galah và 0,7357 của VelLMes. Đồng thời, khoảng cách Levenshtein đạt mức thấp đáng kể là 329,35, so với 564,98 của mô hình cơ sở, 2940,25 của Galah và 2340,99 của VelLMes.Những kết quả này khẳng định khả năng của mô hình trong việc tạo ra các phản hồi có tính chân thực cao, cấu trúc hợp lệ và hoạt động ổn định, từ đó nâng cao hiệu quả đánh lừa và duy trì tương tác với kẻ tấn công.Bài báo được công bố tại hội nghị quốc tế:SOICT 2025 (The 14th International Symposium on Information and Communication Technology) là hội nghị khoa học quốc tế uy tín, tập trung vào các hướng nghiên cứu quan trọng và đang phát triển mạnh mẽ trong lĩnh vực Công nghệ Thông tin và Truyền thông như: Nền tảng Trí tuệ nhân tạo và Dữ liệu lớn, Mạng và Công nghệ truyền thông, Xử lý đa phương tiện, Ứng dụng AI, Generative AI, Nghiên cứu vận hành và tối ưu hóa ứng dụng, cùng các tiến bộ mới trong An toàn – An ninh mạng.Thông tin chi tiết tại: https://www.facebook.com/share/p/1FH9B5WA2U/ Đông Xanh - Cộng tác viên truyền thông Trường Đại học Công nghệ Thông tin