Thế giới
Báo cáo nêu lo ngại an toàn với hai mô hình AI Kimi, Moonshot rà soát
Mindgard nêu rủi ro trong thử nghiệm với Kimi; Moonshot đang rà soát, chưa có bằng chứng những câu trả lời ấy khả thi.

Nhóm kiểm thử Mindgard báo cáo hai mô hình AI Kimi K2.6 và K3 Swarm có thể bị dẫn dắt trả lời những yêu cầu lẽ ra phải bị chặn. Theo BBC News, nhóm nêu lo ngại về khả năng nội dung này bị dùng cho mục đích gây hại.
Nhà phát triển Moonshot nói đang trao đổi với Mindgard và rà soát an toàn. Công ty cho biết các đánh giá nội bộ ghi nhận tỷ lệ từ chối cao với yêu cầu tương tự.
Mindgard chưa chứng minh những câu trả lời gây lo ngại có thể áp dụng trong thực tế. Báo cáo vì thế phản ánh rủi ro trong điều kiện thử nghiệm, chưa phải bằng chứng về một vụ tấn công đã xảy ra.
Nguồn: BBC News.
DKN.TV