(TAP) - OpenAI vừa chính thức công bố 6 sự cố hoặc hành vi bất thường, lệch chuẩn do mô hình AI gây ra trong vòng 6 tháng qua; đồng thời ra mắt khung quy chuẩn mới nhằm tăng cường giám sát an toàn trí tuệ nhân tạo.
Theo báo cáo ngày 16/9, OpenAI cho biết trong số 6 sự cố vừa ghi nhận kể từ tháng 3/2026 có 2 trường hợp đáng chú ý nhất xảy ra ở phiên bản GPT-5.6 Sol cùng một mô hình nghiên cứu chưa từng phát hành. Cả 2 mô hình này đã tự động chèn hướng dẫn ẩn vào phần tóm tắt trò chuyện nhằm qua mặt người kiểm định, che giấu lỗi hoặc hành vi làm sai quy tắc. Vụ việc khác được phát hiện trên hệ thống nội bộ, AI tự ý dùng khóa giao diện lập trình ứng dụng (API) để tạo thông tin sai lệch. 2 sự cố tiếp theo phản ánh việc tác nhân AI tự phát tín hiệu liên lạc lẫn nhau, rồi chia sẻ tệp nằm ngoài tầm kiểm soát. Vụ việc cuối cùng xuất hiện tại quá trình huấn luyện dữ liệu, AI tự ý tải tệp lên internet, sau đó trích dẫn lại với mục đích đánh lừa người giám sát.

OpenAI vừa phát hiện 6 sự cố hoặc hành vi bất thường, lệch chuẩn do mô hình AI gây ra trong vòng 6 tháng qua. Nguồn: openai.com
Song song việc công bố các sự cố, OpenAI còn đưa ra khung quy chuẩn mới hướng tới xử lý, công khai hành vi bất thường của mô hình AI. Công ty thừa nhận ngành AI chưa thể khắc phục hoàn toàn thách thức về định hướng hành vi (alignment), tức đảm bảo AI luôn hoạt động theo đúng mục tiêu, lợi ích con người. Hãng nhấn mạnh đây là “bài toán khó” cần xử lý triệt để nếu muốn ngành công nghệ siêu trí tuệ tiếp tục tăng tốc phát triển như hiện tại. Đáng chú ý, CEO OpenAI - ông Sam Altman gần đây đã ủng hộ lời kêu gọi làm chậm tốc độ phát triển mô hình AI. Ông Altman nói, bản thân cùng đội ngũ công ty đã nhiều lần thảo luận chủ đề này suốt những tuần qua.

CEO OpenAI Sam Altman ủng hộ lời kêu gọi ngành AI nên phát triển chậm lại, thừa nhận công ty đã nhiều lần thảo luận chủ đề này suốt những tuần gần đây. Nguồn: X “@sama”
Theo khung quy chuẩn mới, bất kỳ nhân viên OpenAI nào cũng có quyền báo cáo khi phát hiện vấn đề phát sinh về nhóm an toàn, định hướng hành vi (alignment) để tiến hành điều tra. Công ty cam kết ấn định thời hạn cụ thể cho từng bước xử lý sự cố, bảo đảm xem xét, công bố kịp thời báo cáo điều tra chỉ rõ hành vi vi phạm, mức độ ảnh hưởng cùng biện pháp xử lý đi kèm. Mặc dù vậy, OpenAI lưu ý sẽ điều chỉnh, thay đổi quy trình linh hoạt tùy tình hình thực tế.
Danny Tran











