Quay lại Tin tức
Chính sáchAI Understanding tóm tắt

Các trường đại học Singapore chuyển việc đánh giá từ bài luận sang tư duy của sinh viên khi việc sử dụng AI ngày càng tăng

Tờ Straits Times đưa tin rằng các trường đại học Singapore đang thay thế một số bài luận mang về nhà bằng các bài thuyết trình trực tiếp, bảo vệ miệng, bài nộp theo dàn dựng và bài viết có giám sát để đánh giá những gì sinh viên hiểu, đồng thời loại bỏ các công cụ phát hiện AI không đáng tin cậy.

6 min readRead the original reporting
Source-provided image accompanying Singapore universities shift assessment from essays to students’ thinking as AI use grows
Báo cáo phân bổNguồn đã ghi
Nhà xuất bản
straitstimes.com
Liên kết nguồn
straitstimes.comhttps://www.straitstimes.com/singapore/parenting-education/not-about-preventing-ai-misuse-spore-universities-move-from-grading-essays-to-assessing-thinking
Loại nguồn
Báo cáo của một cơ quan báo chí — không phải tài liệu của bên thứ nhất.

Những gì chúng tôi không thể xác nhận độc lập: Khiếu nại này được quy cho ổ cắm được đặt tên. Chúng tôi đã không xác minh nó dựa trên tài liệu của bên thứ nhất. (straitstimes.com)

Bối cảnhHiểu điều này trong 60 giây

Bắt đầu ở đây

Thuật ngữ chính

suy luận
Giai đoạn chạy trong đó mô hình được đào tạo tạo ra dự đoán hoặc kết quả đầu ra.
thiên vị
Một dạng lỗi hoặc sự không công bằng nhất quán trong dữ liệu hoặc hành vi của mô hình.
Tự kiểm traCâu đố về đạo đức AI

Chuyện gì đã xảy ra

Tờ Straits Times đưa tin các trường đại học Singapore đang thiết kế lại các bài đánh giá khi việc sử dụng AI trở nên phổ biến hơn. Các tổ chức bao gồm NTU, SUSS, NUS, SIT, SUTD và SMU đang sử dụng hoặc xem xét các bài thuyết trình trực tiếp, bảo vệ miệng, viết trong lớp, bài nộp và bài tập theo giai đoạn yêu cầu sinh viên đánh giá tài liệu do AI tạo ra.

Tờ Straits Times đưa tin rằng Đại học Quản lý Singapore đang sử dụng bài đánh giá trực tiếp để kiểm tra mức độ hiểu biết của sinh viên theo những cách khó hoàn thành chỉ thông qua bài nộp được chuẩn bị sẵn hoặc do AI tạo ra. Trong một mô-đun giao tiếp quản lý, phần trình bày dài 5 phút của sinh viên và các câu hỏi tiếp theo chiếm 30% điểm cuối cùng. Báo cáo cho biết giáo sư đánh giá liệu sinh viên có hiểu các khái niệm của họ và có thể trả lời một cách tự nhiên hay không, cùng với các bài phản ánh và bài luận hàng tuần được hoàn thành trong lớp hoặc thông qua trình duyệt bị khóa.

Tờ báo cũng đưa tin rằng sinh viên SMU trong lớp tiếp thị bền vững được giao một câu hỏi tiểu luận trước hai tuần và được phép sử dụng AI để nghiên cứu và phát triển câu trả lời, nhưng sau đó có 15 phút để viết bài luận trong lớp mà không cần tài liệu tham khảo. Theo báo cáo, thiết kế này nhằm mục đích cho thấy liệu sinh viên có thể biến nghiên cứu và hiểu biết của mình thành một câu trả lời mạch lạc hay không thay vì sử dụng AI như một lối tắt. Các phương pháp được báo cáo khác bao gồm các bài thuyết trình trong phòng trưng bày, các tạp chí phản ánh được hoàn thành trong lớp, bảo vệ miệng và các bài nộp theo giai đoạn cho thấy dự án phát triển như thế nào.

The Straits Times cho biết sự thay đổi này đang diễn ra cùng với việc rút lui khỏi các công cụ phát hiện AI. NTU và SUSS cho biết vào tháng 8 rằng họ sẽ ngừng triển khai các công cụ như vậy để gắn cờ nghi ngờ lạm dụng AI, trong khi NUS, SIT và SUTD nói với tờ báo rằng họ không sử dụng chúng. SMU cho biết các công cụ phát hiện chỉ là một cách để xác định việc sử dụng sai mục đích. Phó chủ tịch kiêm giám đốc NTU, Christian Wolfrum, nói với tờ báo rằng các máy dò từng phục vụ mục đích hợp lý sau khi ChatGPT được phát hành nhưng đã trở nên lỗi thời do nghiên cứu cho thấy kết quả không đáng tin cậy. Báo cáo cho biết SUSS đã sử dụng công cụ phát hiện AI của Turnitin và mô tả công cụ này dựa vào suy luận thống kê hơn là bằng chứng thuyết phục.

Báo cáo cho biết các trường đại học không áp dụng một quy tắc chung cho AI. Học sinh được thông báo khi nào AI được phép, bị cấm hoặc bắt buộc, tùy thuộc vào khóa học. Trong một số lớp học, các em có thể sử dụng nó để động não hoặc nghiên cứu; ở những người khác, họ có thể bị cấm sử dụng nó trong một bài kiểm tra. Bài tập viết và lý luận được báo cáo của SMU yêu cầu sinh viên tạo các bản tóm tắt bằng AI và sau đó đánh giá các bản tóm tắt đó về độ chính xác, sai lệch và ảo giác bằng cách so sánh chúng với các nguồn đã xuất bản. Tờ Straits Times đưa tin rằng việc thiết kế và thử nghiệm những bài tập như vậy đòi hỏi sự nỗ lực đáng kể của những người hướng dẫn. Chính sách của các trường đại học, quy mô thực hiện và kết quả của các phương pháp này không được xác nhận độc lập trong nguồn được cung cấp.

Chi tiết nguồn: straitstimes.com ↗

Tại sao nó quan trọng

Sự thay đổi này làm thay đổi câu hỏi giáo dục từ việc học sinh có sử dụng AI đến việc liệu học sinh đó có thể chứng minh kiến ​​thức, khả năng phán đoán và lý luận hay không. Nó cũng phản ánh mối lo ngại ngày càng tăng rằng máy dò AI có thể tạo ra kết quả dương tính giả và ảnh hưởng không công bằng đến một số hình thức viết, mặc dù các tuyên bố và thực tiễn thể chế được mô tả ở đây chưa được xác nhận độc lập.

Sự thay đổi được báo cáo coi việc đánh giá là một cách để quan sát việc học thay vì chỉ kiểm tra một sản phẩm cuối cùng. Một bài luận trau chuốt có thể thể hiện khả năng viết, nhưng bản thân nó có thể tiết lộ rất ít về cách học sinh lựa chọn bằng chứng, đưa ra quyết định hoặc hiểu các ý tưởng cơ bản. Câu hỏi trực tiếp, bản nháp và bài viết trong lớp cung cấp cho người hướng dẫn bằng chứng bổ sung về quá trình lập luận. Điều đó không chứng minh rằng học sinh đã làm việc mà không có AI ở mọi giai đoạn trước đó, nhưng nó có thể khiến việc che giấu những hiểu biết không được hỗ trợ trở nên khó khăn hơn trong quá trình đánh giá.

Động thái này cũng giải quyết một điểm yếu thực tế trong việc phát hiện AI tự động. Tờ Straits Times báo cáo rằng những hệ thống như vậy có thể tạo ra các dấu hiệu sai cho cách viết có cấu trúc của con người và có thể nhắm mục tiêu một cách không công bằng vào những người nói tiếng Anh không phải là người bản xứ viết ở dạng đơn giản hơn. Nếu một tổ chức coi máy dò xác suất là bằng chứng cho hành vi sai trái, sinh viên có thể phải đối mặt với các hình phạt mà không có cơ sở đáng tin cậy cho quyết định. Việc ngừng sử dụng hoặc hạn chế những công cụ đó có thể làm giảm rủi ro đó, nhưng nguồn này không độc lập xác lập tính chính xác của nghiên cứu được trích dẫn hoặc giải thích cách mỗi trường đại học sẽ điều tra nghi ngờ sử dụng sai mục đích.

Đối với sinh viên, sự thay đổi có nghĩa là khả năng đọc viết AI trở thành một phần của năng lực học thuật chứ không phải là một câu hỏi giới hạn trong kỷ luật. Họ có thể cần biết cách sử dụng hệ thống AI để nghiên cứu, nhận biết ảo giác và thành kiến, ghi lại quy trình của mình và bảo vệ kết luận mà không có hệ thống hiện diện. Tờ Straits Times dẫn lời những sinh viên nói rằng đánh giá miệng đòi hỏi sự chuẩn bị sâu hơn và lập luận theo thời gian thực, trong khi một sinh viên khác cho biết việc sử dụng AI vẫn ở mức cao nhưng chuyển sang nghiên cứu cơ bản và sàng lọc kịch bản. Hàm ý không phải là các đánh giá trực tiếp sẽ loại bỏ sự phụ thuộc vào AI; họ thay đổi vị trí và cách thức mà sự phụ thuộc đó được nhìn thấy.

Đối với người sử dụng lao động và công chúng, mối quan tâm còn vượt xa việc chấm điểm ở trường đại học. Tờ báo cho biết SIT coi đánh giá sau đại học là bài kiểm tra kiến ​​thức, năng lực và khả năng đánh giá chuyên môn tại nơi làm việc có hỗ trợ AI. Những sinh viên tốt nghiệp có thể đưa ra câu trả lời có sự hỗ trợ của AI nhưng không thể giải thích hoặc thách thức nó có thể ít được chuẩn bị hơn cho những vai trò mà sai sót gây ra hậu quả về tài chính, pháp lý, sức khỏe hoặc an toàn. Đồng thời, nguồn này không cung cấp bằng chứng nào cho thấy các hình thức mới cải thiện kết quả việc làm, khả năng duy trì kết quả học tập hoặc sự công bằng giữa các nhóm sinh viên khác nhau. Đó là những câu hỏi mở hơn là những kết quả đã được xác lập.

Interactive Mechanism

Cơ chế tương tác: Nó thực sự hoạt động như thế nào

Khám phá công nghệ cơ bản đằng sau sự phát triển này một cách tương tác.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Kiểm tra khái niệm tương tác+10 Points
AI Ethics Quiz

Why can ethical evaluation not be reduced to one model score?

Xem gì tiếp theo

Tờ Straits Times đưa tin rằng các trường đại học đang làm rõ khi nào việc sử dụng AI được cho phép, bị cấm hoặc bắt buộc. Bài kiểm tra quan trọng tiếp theo sẽ là liệu các định dạng đánh giá này có cải thiện việc học mà không tạo ra khối lượng công việc quá lớn, gây bất lợi cho những học sinh gặp khó khăn trong giao tiếp hay chỉ đơn giản là chuyển việc sử dụng AI sang các phần ít nhìn thấy hơn của khóa học.

Vấn đề đầu tiên cần xem là tính nhất quán. Tờ Straits Times đưa tin rằng sáu trường đại học tự chủ sử dụng nhiều hình thức đánh giá khác nhau và các khóa học riêng lẻ sẽ quyết định liệu AI được phép, bị cấm hay bắt buộc. Sự linh hoạt đó có thể phù hợp với các môn học khác nhau, nhưng nó cũng có thể tạo ra sự không chắc chắn khi học sinh di chuyển giữa các lớp với các quy tắc khác nhau. Hướng dẫn rõ ràng về các công cụ được phép, tiết lộ, xử lý dữ liệu, trích dẫn và biện pháp trừng phạt sẽ quan trọng như bản thân định dạng của đánh giá.

Vấn đề thứ hai là khối lượng công việc và quyền truy cập. Thuyết trình trực tiếp, kiểm tra lặp đi lặp lại và bảo vệ miệng đòi hỏi thời gian của giảng viên và sinh viên, đặc biệt khi lớp học có sĩ số đông. Họ cũng có thể gây thêm áp lực cho học sinh khuyết tật, lo lắng, khác biệt ngôn ngữ hoặc hạn chế tiếp cận hỗ trợ chuẩn bị. Nguồn báo cáo rằng một số sinh viên nhận thấy đánh giá miệng đòi hỏi khắt khe, nhưng nó không cung cấp dữ liệu so sánh về kết quả hoặc điều chỉnh. Các trường đại học sẽ cần phải chứng minh liệu các thiết kế mới có khả thi và công bằng trên quy mô lớn hay không.

Câu hỏi thứ ba là liệu việc đánh giá có thể theo kịp quá trình chuẩn bị được hỗ trợ bởi AI hay không. Học sinh có thể sử dụng AI để nghiên cứu, động não, phác thảo hoặc diễn tập trước khi đánh giá trực tiếp, ngay cả khi phần biểu diễn cuối cùng không được hỗ trợ. Đó không nhất thiết là hành vi sai trái nếu khóa học cho phép, nhưng nó làm cho tính minh bạch trở nên quan trọng. Các bài tập được báo cáo yêu cầu học sinh phê bình kết quả đầu ra của AI đưa ra một cách tiếp cận khả thi: họ kiểm tra xem học sinh có thể sử dụng công nghệ hay không đồng thời kiểm tra độ chính xác và giới hạn của nó. Nguồn không cho biết tần suất sử dụng các nhiệm vụ này hoặc liệu chúng có được xác nhận dựa trên các biện pháp học tập độc lập hay không.

Cuối cùng, các trường đại học sẽ cần bằng chứng về các biện pháp bảo vệ thay thế sau khi các công cụ dò tìm bị loại bỏ. Tờ Straits Times đưa tin rằng NTU đang dạy kiến ​​thức AI và cách sử dụng có trách nhiệm từ tháng 4 năm 2026, đồng thời cung cấp cho sinh viên các công cụ AI Google cao cấp, trong khi các tổ chức khác cung cấp quyền truy cập vào ChatGPT Edu hoặc Microsoft Copilot và sử dụng bot tùy chỉnh cho các hoạt động như học tập, viết mã và thi vấn đáp. Vẫn chưa biết các tổ chức sẽ kiểm tra các hệ thống này như thế nào, bảo vệ dữ liệu của sinh viên, xử lý các trường hợp tranh chấp hoặc đo lường xem sinh viên có thực sự học tập hay không. Thử nghiệm mạnh mẽ nhất về sự thay đổi được báo cáo sẽ là kết quả minh bạch về học tập, sự công bằng, khối lượng công việc và các quyết định về tính liêm chính trong học thuật theo thời gian.

Hướng dẫn và câu hỏi liên quan

Đạo đức AIĐào tạo AIPrompt EngineeringChatGPT & LLMKiểm tra những gì bạn biết — thử một bài kiểm tra AI miễn phíTra cứu một thuật ngữ AI trong bảng thuật ngữ của chúng tôiThực hiện theo trình theo dõi quy định AI
Tìm thấy điều này hữu ích?