Đúng một phần
Một mô hình AI được cho là đã chứng minh năng lực của con người và đạt điểm tuyệt đối trong kỳ thi tuyển sinh đại học quốc gia (CSAT) của Hàn Quốc. Tuy nhiên, căn cứ hồ sơ tài liệu tham khảo, thông tin này chỉ đúng một phần.
Tuyên bố "AI chứng minh năng lực của con người và đạt điểm tuyệt đối kỳ thi CSAT" được đánh giá thuộc nhóm "một phần sự thật". Việc đánh giá có dựa trên tài liệu minh họa môn vật lý được công bố trong bộ benchmark CSAT (ub.io/CSAT-benchmark).
Theo các tài liệu tham khảo đã được xem xét — tổng cộng 12 nguồn sơ cấp — phần lớn nội dung tuyên bố có cơ sở: có AI đã đạt kết quả rất cao trong kỳ thi CSAT, vượt qua mức năng lực của thí sinh người ở trình độ cao. Đây là minh chứng cho khả năng giải đề thi đại học của các mô hình ngôn ngữ lớn (LLM) hiện nay.
Tuy vậy, yếu tố "điểm tuyệt đối" chưa được xác nhận đầy đủ. Kết quả tổng thể phụ thuộc vào phạm vi môn thi, phương pháp chấm và cách thiết lập benchmark — các yếu tố chưa được làm rõ hoàn toàn trong dữ liệu hiện có. Người đọc nên lưu ý rằng kết quả được truyền thông tuyệt đối hóa so với những gì tài liệu thể hiện.
AI đạt thành tích rất cao, ở mức có thể sánh với thí sinh ưu tú, trong kỳ thi CSAT là thông tin có cơ sở; tuy nhiên chi tiết "đạt điểm tuyệt đối" chỉ đúng trong một phạm vi nhất định. Do đó, tuyên bố này là Đúng một phần.