Tất cả tin tức

TOPIK sẽ được chấm điểm bằng AI, huấn luyện từ bài làm của thí sinh: Các kỳ thi thử nghiệm vào năm 2028

TOPIK chuyển sang chấm điểm bằng AI vào năm 2029, được huấn luyện từ bài làm của các thí sinh trước đây. Các kỳ thi thử nghiệm vào năm 2028, thi tại nhà với nhận diện khuôn mặt vào năm 2029. Ngân sách ₩23,5 tỷ, chưa nêu tên nhà thầu hay mô hình AI nào.

Thí sinh TOPIK làm bài trong phòng thi

Kỳ thi tiếng Hàn TOPIK chuẩn bị giao việc chấm điểm cho trí tuệ nhân tạo. Theo một kế hoạch được Bộ Giáo dục công bố vào ngày 29 tháng 9, AI sẽ biên soạn các câu hỏi TOPIK và chấm điểm bài thi viết cũng như nói của thí sinh từ năm 2029, cùng các kỳ thi thử nghiệm cho bài thi được thiết kế lại vào năm 2028.

Các bản tin năm ngoái cho biết chính phủ đã đàm phán với tập đoàn công nghệ Hàn Quốc Naver để vận hành kỳ thi. Lần này là một kế hoạch chính thức, với một ủy ban, ngân sách ₩23,5 tỷ và lộ trình theo từng năm. Hơn 560.000 người đã đăng ký thi TOPIK vào năm 2025, nhiều người trong số đó để xin visa, nhập học đại học và tìm việc làm tại Hàn Quốc.

Hãy cùng xem kế hoạch này bao gồm những gì, từ việc chấm điểm bằng AI và dữ liệu mà nó sẽ học, cho đến việc ai sẽ xây dựng hệ thống đó.

TL;DR

  • Từ năm 2029, AI sẽ biên soạn câu hỏi TOPIK và chấm điểm lần đầu cho bài làm viết và nói, với người chấm thi con người kiểm tra lại kết quả của nó
  • AI sẽ được huấn luyện dựa trên bài làm viết tay và bài nói của những thí sinh trước đây
  • Các kỳ thi thử nghiệm cho bài thi được thiết kế lại sẽ diễn ra vào năm 2028, tiếp theo là các đợt thử nghiệm thi tại nhà với nhận diện khuôn mặt và theo dõi ánh mắt vào năm 2029
  • Kế hoạch không trích dẫn nghiên cứu nào cho thấy AI có thể chấm điểm TOPIK một cách đáng tin cậy, và trong nghiên cứu của viện ra đề thi Suneung, các giáo viên đánh giá độ chính xác hiện tại ở mức 60-70%
  • Một nhà thầu tư nhân sẽ xây dựng hệ thống, và kế hoạch không nêu tên công ty hay mô hình AI nào
  • Kế hoạch trích dẫn các quan chức và nhà quản lý Hàn Quốc, nhưng không có chuyên gia tiếng Hàn người nước ngoài nào

Cuộc cải tổ năm 2029

Kế hoạch tái cấu trúc TOPIK xoay quanh một hệ thống AI với hai nhiệm vụ. Một mô hình ngôn ngữ lớn được huấn luyện trên ngân hàng câu hỏi của kỳ thi sẽ biên soạn các câu hỏi cho từng cấp độ. Hệ thống cũng đối chiếu các câu hỏi mới với những câu hỏi trước đây và dự đoán độ khó của chúng.

Hiện tại, câu hỏi cho mỗi kỳ thi do những người được cách ly biệt lập biên soạn. Từ năm 2029, các câu hỏi sẽ được lấy từ một ngân hàng lưu trữ, và theo kế hoạch, ngân hàng này sẽ được bổ sung thêm 4.000 câu hỏi mỗi năm. Phần thi viết của TOPIK II có bốn dạng câu hỏi, từ điền vào câu cho đến một bài luận 600-700 ký tự. Bài thi nói là một kỳ thi riêng biệt được thực hiện trên máy tính. Đối với cả hai, các câu trả lời viết tay và bản ghi âm sẽ được chuyển đổi thành văn bản và được chấm điểm dựa trên ngữ pháp, từ vựng và tính mạch lạc logic. AI sẽ cho điểm số đầu tiên và người chấm thi con người sau đó sẽ xem xét lại, một bước mà kế hoạch gọi là "Human-in-the-Loop" (con người tham gia vào quy trình).

Việc thử nghiệm thi tại nhà trên máy tính cá nhân sẽ diễn ra tiếp theo vào năm 2029. Các đợt thi này chỉ giới hạn ở các cấp độ thấp hơn mà kết quả không dùng cho mục đích du học hoặc xin visa, trong khi các bài thi trên giấy tạm thời vẫn được duy trì. Sáu trong số 15 kỳ thi năm 2027 được tổ chức trên giấy, chín kỳ còn lại thực hiện trên máy tính: sáu kỳ thi IBT và ba kỳ thi nói.

Một ủy ban cải cách gồm các thành viên từ lĩnh vực giáo dục tiếng Hàn, khảo thí và AI sẽ được thành lập vào tháng 10 này, sau đó sẽ công bố thiết kế bài thi mới vào tháng 6 năm 2027. Các kỳ thi thử nghiệm được lên lịch vào năm 2028, và cùng với các câu hỏi luyện tập trực tuyến, chúng nhằm để thí sinh trải nghiệm định dạng mới trước khi nó có hiệu lực. Chính phủ đã dự trù ngân sách ₩23,5 tỷ cho các công việc liên quan đến AI và kỹ thuật số, đồng thời đặt mục tiêu đạt một triệu thí sinh đăng ký vào năm 2030.

Ủy ban sẽ được cân bằng theo khu vực, giới tính và cơ quan trực thuộc. Đối với lực lượng người ra đề, khu vực có nghĩa là các thành viên đang làm việc tại khu vực Seoul hay các nơi khác ở Hàn Quốc, chứ không phải mang tính toàn cầu hơn. Các chuyên gia tiếng Hàn người nước ngoài, những người đã học tiếng Hàn như một ngoại ngữ và có thể lên tiếng từ góc nhìn của thí sinh, không hề xuất hiện ở đâu trong kế hoạch. Tất cả bốn ý kiến từ thực tiễn được trích dẫn đều đến từ các quan chức và nhà quản lý Hàn Quốc: hai giám đốc Trung tâm Giáo dục Hàn Quốc ở nước ngoài trực thuộc bộ, một cơ quan đại diện ngoại giao và trưởng phòng hợp tác quốc tế của một trường đại học.

Chấm điểm bằng AI chưa được kiểm chứng

Chương trình nghị sự của ủy ban cải cách bao gồm cấu trúc cấp độ, việc đối chiếu điểm số giữa bài thi giấy và máy tính, các bài tập phần viết và nói, cùng một phiên bản TOPIK dành cho thanh thiếu niên. Việc AI có nên chấm điểm bài thi hay không không nằm trong chương trình nghị sự này, bởi điều đó đã được quyết định từ trước khi kế hoạch được công bố. Cũng chưa rõ liệu các kỳ thi thử nghiệm năm 2028 có sử dụng việc chấm điểm bằng AI hay không, khi mà tiến độ trong kế hoạch cho thấy hệ thống có thể vẫn đang được phát triển trong năm đó. Nếu vậy, kịch bản ngầm hiểu sẽ là việc chấm điểm bằng AI hoàn toàn không được thử nghiệm qua các đợt thi thử nghiệm nào.

Một điều khác còn thiếu trong kế hoạch là không có bất kỳ nghiên cứu nào được trích dẫn về mức độ hiệu quả của AI khi chấm điểm phần thi viết hoặc nói của TOPIK. Trong các nghiên cứu của viện ra đề thi đại học Suneung, các giáo viên nhận định độ chính xác của việc chấm điểm bằng AI hiện nay ở mức 60-70%, và phần lớn cho rằng cần đạt ít nhất 80% trước khi có thể đưa vào thực tế. Các nhà nghiên cứu phát hiện ra rằng hiệu quả chấm điểm chênh lệch rất lớn tùy theo môn học và câu hỏi. Họ cũng kêu gọi sử dụng AI để kiểm tra lại công việc của người chấm thi con người, điều này trái ngược với thiết kế của TOPIK, nơi người chấm thi con người xem xét lại kết quả đầu ra của AI. Bên cạnh đó, một nghiên cứu kéo dài một năm tại một trường trung học phổ thông khoa học ở Hàn Quốc phát hiện ra rằng cùng một câu trả lời, khi được chấm lại, có thể nhận được điểm số khác nhau.

Chấm điểm tự động không hoàn toàn mới đối với các kỳ thi ngôn ngữ. ETS, đơn vị điều hành TOEFL, từ lâu đã sử dụng công cụ chấm điểm tự động bên cạnh người chấm thi con người. Nghiên cứu của chính tổ chức này cho thấy đối với phần lớn các nhóm thí sinh, công cụ chấm điểm và người chấm con người đưa ra điểm trung bình gần như giống hệt nhau. Tuy nhiên, có một sự sai lệch đáng chú ý: các bài luận từ Trung Quốc đại lục là ngoại lệ, khi nhận được điểm số từ máy móc cao hơn nhiều so với từ con người. TOPIK được tổ chức tại 94 quốc gia, vì vậy có nguy cơ thực tế về sự biến thiên tương tự ở đây.

Biện pháp bảo đảm của kế hoạch cũng tiềm ẩn một mâu thuẫn nội tại. Nếu người chấm thi con người kiểm tra kỹ lưỡng từng bài làm, AI sẽ tiết kiệm được rất ít công sức. Nếu họ không làm vậy, AI trên thực tế chính là người chấm điểm.

Năm ngoái, Lee Chang-yong, trưởng Chi hội Giáo viên tiếng Hàn thuộc Công đoàn trực tuyến Gapjil 119, đã nêu rõ điều gì cần được ưu tiên hàng đầu: "Trước khi AI có thể được sử dụng trong một kỳ thi có tính chất quyết định cao và ảnh hưởng nghiêm trọng đến cuộc sống của con người, nghiên cứu và xác minh để đảm bảo tính hợp lệ, độ tin cậy và sự công bằng của việc đánh giá phải được đặt lên hàng đầu. Việc xác minh đó hiện vẫn chưa được thực hiện đầy đủ."

Sự thận trọng ở những nơi khác

Hàn Quốc cũng đang cân nhắc ý tưởng tương tự cho chính học sinh của mình, nhưng thận trọng hơn rất nhiều. Việc chấm điểm bằng AI đối với các câu hỏi tự luận trong kỳ thi Suneung vẫn đang trong quá trình lấy ý kiến công chúng, và chủ tịch Ủy ban Giáo dục Quốc gia đã phát biểu rằng ngay cả khi được đưa vào áp dụng, việc chấm điểm bởi con người vẫn phải giữ vai trò trung tâm, AI chỉ đóng vai trò hỗ trợ.

Các quốc gia khác đã rút lui. Nhật Bản đã hoãn kế hoạch đưa các câu hỏi tự luận vào kỳ thi tuyển sinh đại học chung vào năm 2019 do việc đảm bảo chấm điểm đáng tin cậy gần như là điều bất khả thi. Úc đã từng cân nhắc việc chấm điểm bằng AI trước khi hủy bỏ kế hoạch này.

Điều đó khiến TOPIK trở thành kỳ thi quốc gia duy nhất của Hàn Quốc có kế hoạch đã được cấp ngân sách và lên lịch trình để AI chấm điểm lần đầu cho các câu trả lời viết và nói.

Chữ viết tay, giọng nói và khuôn mặt

Vào năm 2027, chính phủ sẽ bắt đầu thu thập dữ liệu huấn luyện cho AI, một năm trước khi bản thân hệ thống được xây dựng. Dữ liệu huấn luyện này bao gồm kho lưu trữ của chính phủ về bài làm viết tay và bài nói thực tế của các thí sinh từ các phần thi viết và nói của TOPIK.

Đối với các bài thi tại nhà, kế hoạch bổ sung tính năng giám thị bằng AI sử dụng nhận diện khuôn mặt và theo dõi ánh mắt để giám sát thí sinh ngay tại nhà của họ. Khi đăng ký, thí sinh cũng sẽ phải đồng ý chia sẻ dữ liệu cá nhân với các bên thứ ba, điều mà kế hoạch gắn với sự hợp tác cùng "các cơ quan liên quan". Các trường đại học được chỉ định là viện nghiên cứu TOPIK sẽ được cung cấp dữ liệu thi phục vụ cho việc nghiên cứu của họ, theo cơ sở pháp lý mà chính phủ đặt mục tiêu thiết lập trong năm nay.

Kế hoạch không đề cập liệu công ty xây dựng hệ thống có được thấy bài làm, bản ghi âm hay dữ liệu khuôn mặt của thí sinh hay không, hoặc sự đồng ý bắt buộc này áp dụng cho những bên thứ ba nào.

Hàn Quốc đã có tiền lệ trong vấn đề này. Trong một dự án kết thúc vào năm 2021, Bộ Tư pháp và Bộ Khoa học đã cho phép các công ty tư nhân huấn luyện AI trên ảnh khuôn mặt xuất nhập cảnh. Cơ quan giám sát quyền riêng tư sau đó phát hiện các công ty này đã sử dụng gần 180 triệu bản ghi, trong đó 120 triệu bản ghi là của người nước ngoài, phán quyết rằng thỏa thuận này là hoạt động ủy thác xử lý dữ liệu hợp pháp, và phạt Bộ Tư pháp ₩1 triệu, chỉ vì không công khai tên các công ty. Vào tháng 2 năm 2026, Tòa án Hiến pháp đã bác bỏ một đơn khiếu nại vì dự án đã kết thúc, đồng thời cho biết thêm rằng Hiến pháp không quy định nghĩa vụ phải cấm việc sử dụng những dữ liệu như vậy để huấn luyện AI.

Ai xây dựng hệ thống chấm điểm

Phần lớn ngân sách được dành cho việc xây dựng hệ thống và phát triển AI từ năm 2028. Khoản này chiếm ₩23 tỷ trong tổng số ₩23,5 tỷ, với một kế hoạch chiến lược được đưa ra trước vào năm 2027. Tại Hàn Quốc, những hệ thống như thế này do các nhà thầu tư nhân xây dựng thông qua đấu thầu công khai.

Cho đến tháng 12 năm 2025, kế hoạch ban đầu là để một doanh nghiệp tài trợ kinh phí và vận hành kỳ thi. Vào năm 2024, chính phủ đã chọn một liên danh do Naver dẫn đầu cho dự án đầu tư tư nhân, trong đó doanh nghiệp này sẽ chi trả khoảng ₩344 tỷ chi phí và thu hồi lại từ doanh thu của kỳ thi. Các giáo viên dạy tiếng Hàn và các công đoàn đã vận động phản đối điều này, và đến tháng 12 năm 2025, chính phủ đã hủy bỏ thỏa thuận trên và chuyển dự án sang sử dụng ngân sách nhà nước. Mặc dù kế hoạch tư nhân hóa toàn diện không còn nữa, việc chấm điểm bằng AI, vốn sẽ do một công ty tư nhân phát triển, vẫn tồn tại qua bước chuyển hướng này.

Điểm còn thiếu trong kế hoạch là không hề đề cập ai sẽ xây dựng hệ thống hay mô hình AI nào sẽ được sử dụng. Các mô hình hàng đầu hiện nay là của Mỹ, nhưng kế hoạch lại đặt nền tảng trên đám mây riêng của chính phủ, khiến việc gửi các câu hỏi chưa công bố và bài làm của thí sinh đến một dịch vụ AI nước ngoài là khó xảy ra. Hầu hết các mô hình mạnh nhất có thể chạy nội bộ lại là của Trung Quốc, và là điều cấm kỵ về mặt chính trị: các bộ ngành chính phủ đã chặn DeepSeek vào năm 2025, và Naver đã bị loại khỏi dự án mô hình AI quốc gia của chính phủ vào tháng 1 năm 2026 giữa những tranh cãi về việc sử dụng các thành phần mô hình của Trung Quốc. Điều đó khiến các mô hình của Hàn Quốc trở thành lựa chọn duy nhất còn lại. Viện ra đề thi Suneung đã thuê công ty AI Hàn Quốc Upstage xây dựng hệ thống ra đề cho môn tiếng Anh trong kỳ thi Suneung, nhưng việc chấm bài luận và bài nói là một nhiệm vụ đòi hỏi khắt khe hơn nhiều so với việc soạn câu hỏi mới.

Việc lựa chọn mô hình quan trọng hơn so với vẻ bề ngoài. Qua quá trình xây dựng TOPIK Easy6, chúng tôi nhận thấy không có một mô hình AI đơn lẻ nào là tốt nhất ở mọi nhiệm vụ đánh giá tiếng Hàn, và chỉ những mô hình độc quyền đắt đỏ nhất mới đủ chính xác để chấm điểm một cách công bằng. Thêm vào đó, mức độ lưu loát tiếng Hàn của một mô hình lại cho biết rất ít một cách đáng ngạc nhiên về việc nó chấm bài luận của người học tốt đến mức nào.

Dự án AI lớn gần đây nhất của Bộ Giáo dục là một lời cảnh báo. Chỉ sau một học kỳ vào năm 2025, sách giáo khoa kỹ thuật số AI cho các trường học đã bị hạ cấp xuống thành "tài liệu giáo dục". Ủy ban Kiểm toán và Thanh tra sau đó phát hiện dự án đã bị thúc đẩy vội vã mà không qua tham vấn hay các đợt chạy thử nghiệm, với tỷ lệ sử dụng trung bình là 8,1%.

Lộ trình và thực hiện

Ủy ban cải cách dự kiến sẽ thành lập trong tháng này, và một đợt kêu gọi đóng góp câu hỏi thi mới được lên kế hoạch vào cuối năm nay. Vào năm 2027, ủy ban sẽ công bố thiết kế bài thi mới vào tháng 6. Chính phủ cũng sẽ vạch ra chiến lược AI trong năm đó, bắt đầu xây dựng ngân hàng câu hỏi và thu thập dữ liệu huấn luyện AI.

Vào năm 2028, nền tảng AI sẽ được xây dựng trên đám mây của chính phủ, và các kỳ thi thử nghiệm cho bài thi được thiết kế lại sẽ diễn ra tại Hàn Quốc và nước ngoài. Bài thi TOPIK mới dự kiến có hiệu lực vào năm 2029, với AI biên soạn câu hỏi và chấm điểm bài làm, cùng các đợt thử nghiệm thi tại nhà bắt đầu ở các cấp độ thấp hơn.

Nguồn

Chia sẻ

XFacebookLINE

Hành trình chinh phục 6급 bắt đầu từ một câu trả lời.

Tải Easy6, chọn một câu hỏi và nhận điểm đầu tiên chỉ trong giây lát.

Tải về trên App StoreTải trên Google Play