Chuyện gì đã xảy ra
gHacks báo cáo rằng OpenAI đã ra mắt ChatGPT dành cho thanh thiếu niên, một phiên bản chatbot dành cho người dùng từ 13 đến 17 tuổi. Trải nghiệm được báo cáo bao gồm Chế độ học tập, nhắc nhở bài tập về nhà, câu đố, trực quan hóa, Giờ học theo lịch, bộ lọc nội dung phù hợp với lứa tuổi và các biện pháp kiểm soát bổ sung của phụ huynh. gHacks cho biết những người dùng xác định là thanh thiếu niên hoặc hệ thống ước tính dưới 18 tuổi sẽ tự động được đưa vào trải nghiệm dành cho thanh thiếu niên. OpenAI cũng được cho là đang hợp tác với CodeAI về các tài nguyên xóa mù chữ AI cho học sinh và giáo viên. Việc triển khai, các biện pháp bảo vệ và kết quả thử nghiệm do công ty báo cáo chưa được nguồn xác nhận độc lập.
Theo gHacks, OpenAI đã giới thiệu ChatGPT dành cho thanh thiếu niên cho người dùng từ 13 đến 17. Báo cáo cho biết hệ thống đưa mọi người vào phiên bản này khi họ cho biết rằng họ ở trong độ tuổi đó hoặc khi công nghệ dự đoán tuổi của OpenAI ước tính rằng họ dưới 18 tuổi. Điều đó khiến việc phân loại độ tuổi trở thành một phần trọng tâm của trải nghiệm sản phẩm, thay vì cài đặt tùy chọn mà các gia đình phải kích hoạt thủ công. gHacks mô tả việc phát hành như một phần mở rộng của những nỗ lực OpenAI trước đó liên quan đến kiểm soát của phụ huynh, thông số kỹ thuật của mô hình dưới 18 tuổi và các tính năng dự đoán độ tuổi. Bài viết không xác minh độc lập việc ra mắt, giải thích phương pháp ước tính độ tuổi cơ bản hoặc cho biết cách người dùng có thể phản đối việc phân loại không chính xác.
gHacks báo cáo rằng trải nghiệm dành cho thanh thiếu niên được thiết kế để khuyến khích việc học tập tích cực thay vì đưa ra câu trả lời ngay lập tức cho mọi câu hỏi. Chế độ học tập của nó được cho là sử dụng các câu hỏi và hỗ trợ từng bước. Lời nhắc bài tập về nhà có thể xác định các nỗ lực rút ngắn bài tập và chuyển hướng người dùng sang Chế độ học tập, trong khi các câu hỏi và hình ảnh trực quan nhằm hỗ trợ thực hành và ôn tập. Theo báo cáo, cài đặt Giờ học có thể được thanh thiếu niên hoặc phụ huynh định cấu hình để Chế độ học tập vẫn hoạt động trong khoảng thời gian đã chọn. Nguồn tin cho biết OpenAI đã làm việc với các giáo viên, nhà khoa học và chuyên gia giáo dục và dựa trên nghiên cứu về học tập tích cực và khả năng tự giải thích. Nó cũng cho biết các bài kiểm tra ban đầu của công ty cho thấy kết quả học tập của sinh viên được cải thiện nhưng không cung cấp phương pháp luận hoặc kết quả được sao chép độc lập.
Báo cáo cũng mô tả mối quan hệ hợp tác về xóa mù chữ AI giữa OpenAI và CodeAI dành cho học sinh và giáo viên. gHacks cho biết các tài nguyên nhằm giải thích cách AI hoạt động, cách sử dụng nó và cách đặt câu hỏi cho câu trả lời của nó, đồng thời giáo viên hướng dẫn cách sử dụng trong lớp học. Bài báo trích lời Giám đốc điều hành CodeAI Karim Meghji nói rằng sinh viên phải có khả năng xác định sai lầm và biết khi nào nên ngừng tin tưởng vào công nghệ. gHacks báo cáo thêm rằng các biện pháp bảo vệ thanh thiếu niên mặc định của OpenAI bao gồm các lĩnh vực bao gồm tự làm hại bản thân, bạo lực, rối loạn ăn uống, hoạt động nguy hiểm và nội dung tục tĩu. Theo báo cáo, phụ huynh có tài khoản được liên kết có thể đặt Giờ yên tĩnh, thay đổi một số cài đặt và nhận thông báo an toàn trong một số tình huống có nguy cơ cao. Báo cáo cho biết các thông báo liên quan đến chứng rối loạn ăn uống đang được bổ sung với khả năng chia sẻ hạn chế, tập trung vào các trường hợp mà việc hỗ trợ ngoại tuyến có thể quan trọng.
Tại sao nó quan trọng
Việc ra mắt đặt trực tiếp hành vi học tập và an toàn dành riêng cho lứa tuổi vào bên trong một sản phẩm AI tiêu dùng chính. Nếu các tính năng được báo cáo hoạt động như dự kiến, chúng có thể thay đổi cách thanh thiếu niên sử dụng ChatGPT để làm bài tập về nhà, ôn tập và học tập chung, đồng thời giúp phụ huynh có nhiều quyền kiểm soát hơn đối với cài đặt tài khoản và một số thông báo có rủi ro cao nhất định. Cách tiếp cận này cũng đặt ra những câu hỏi thực tế về ước tính độ tuổi, quyền riêng tư, phân loại sai, tính khả dụng trong khu vực và liệu các bộ lọc an toàn có thể xử lý các cuộc trò chuyện nhạy cảm một cách đáng tin cậy hay không. gHacks báo cáo rằng OpenAI cho biết các bài kiểm tra sớm của Chế độ học tập đã cải thiện hiệu suất của học sinh, nhưng bài viết không cung cấp thiết kế nghiên cứu, dữ liệu, kích thước hiệu ứng hoặc xác nhận độc lập.
Sản phẩm này mang tính hệ quả vì nó coi trẻ vị thành niên là một nhóm người dùng riêng biệt với các giá trị mặc định, kiểu tương tác và công cụ giám sát khác nhau. Một chatbot thông thường có thể trả lời các câu hỏi về nhiều chủ đề, nhưng cấu hình hướng đến thanh thiếu niên sẽ cố gắng định hình cả những gì hệ thống sẽ thảo luận cũng như cách hệ thống phản hồi với bài tập ở trường. Điều đó có thể hữu ích cho các gia đình và nhà giáo dục muốn được hỗ trợ mà không đặt việc thay thế câu trả lời thành mặc định. Nó cũng trao cho OpenAI trách nhiệm rõ ràng hơn đối với các quyết định về phân loại độ tuổi, xử lý nội dung nhạy cảm cũng như ranh giới giữa hướng dẫn giáo dục và hoàn thành trực tiếp bài tập.
Thiết kế an toàn được báo cáo giải quyết các rủi ro đặc biệt nghiêm trọng khi người trẻ tuổi sử dụng chatbot. gHacks cho biết hướng dẫn cập nhật dành cho trẻ dưới 18 tuổi không chỉ ngăn chặn việc nhập vai tình dục hoặc lãng mạn: hệ thống cũng không được phép sử dụng ngôn ngữ lãng mạn, khuyến khích sự phụ thuộc về mặt cảm xúc hoặc gợi ý rằng nó có cảm xúc hoặc ý thức. Những giới hạn đó có liên quan vì hệ thống đàm thoại có thể mang tính cá nhân ngay cả khi nó chỉ là phần mềm. Báo cáo cho biết OpenAI đang bổ sung thêm lời nhắc về việc tải lên hình ảnh nhạy cảm, giới thiệu cho thanh thiếu niên và các tùy chỉnh như màu nhấn và lựa chọn giọng nói. Những chi tiết này cho thấy nỗ lực cá nhân hóa sản phẩm trong khi vẫn duy trì sự khác biệt giữa công cụ và con người, mặc dù nguồn cung cấp không có thử nghiệm độc lập nào về sự khác biệt đó trong thực tế.
Các tuyên bố mang tính giáo dục đòi hỏi sự xem xét kỹ lưỡng. gHacks báo cáo rằng các bài kiểm tra ban đầu của OpenAI cho thấy sự cải thiện về thành tích của học sinh, nhưng bài báo không xác định người tham gia, nhóm so sánh, nhiệm vụ, thời lượng hoặc kết quả. Nếu không có những chi tiết đó, người đọc không thể xác định liệu kết quả được báo cáo phản ánh sự hiểu biết tốt hơn, sự kiên trì hơn, sự quen thuộc với bài kiểm tra hay các yếu tố khác. Hạn chế tương tự cũng áp dụng cho các tuyên bố về an toàn: nguồn tin cho biết OpenAI đang chia sẻ các đánh giá dành cho người dưới 18 tuổi trong thẻ hệ thống nhưng không cung cấp kết quả đánh giá. Giá trị công cộng của việc ra mắt sẽ không chỉ phụ thuộc vào sự tồn tại của các bộ lọc và biện pháp kiểm soát mà còn phụ thuộc vào bằng chứng minh bạch về tần suất chúng thất bại, cách xử lý lỗi và liệu các gia đình có thể hiểu được các quyết định của hệ thống hay không.
Cơ chế tương tác: Nó thực sự hoạt động như thế nào
Khám phá công nghệ cơ bản đằng sau sự phát triển này một cách tương tác.
What is a common training objective for an autoregressive language model?
Xem gì tiếp theo
Các vấn đề chính là phạm vi triển khai, độ chính xác đảm bảo độ tuổi, bảo vệ quyền riêng tư và bằng chứng cho thấy các tính năng của nghiên cứu cải thiện việc học thay vì chỉ làm chậm các câu trả lời. Theo dõi các đánh giá thẻ hệ thống dành riêng cho thanh thiếu niên của OpenAI, giải thích rõ ràng hơn về thông báo của phụ huynh và thông tin về cách sửa lỗi ước tính độ tuổi sai lầm. Điều quan trọng nữa là phải xem liệu giáo viên và phụ huynh có thể định cấu hình trải nghiệm một cách có ý nghĩa hay không, cách thức thực hiện các biện pháp bảo vệ trong các cuộc trò chuyện thực tế liên quan đến hành vi tự làm hại bản thân hoặc rối loạn ăn uống cũng như liệu tài nguyên giáo dục của CodeAI có được cung cấp rộng rãi hay không. Báo cáo không thiết lập thời gian khởi chạy cho các khu vực cụ thể hoặc toàn bộ bộ điều khiển có sẵn cho các gia đình.
Câu hỏi thực tế đầu tiên là sự sẵn có. gHacks báo cáo rằng OpenAI chưa cho biết khi nào việc triển khai sẽ đến các khu vực cụ thể. Điều đó không rõ thanh thiếu niên nào hiện có thể sử dụng sản phẩm, liệu quyền truy cập có khác nhau tùy theo quốc gia hay không và liệu một số tính năng có phụ thuộc vào quy tắc địa phương hoặc cấu hình tài khoản hay không. Báo cáo cũng không giải thích cách dịch vụ xử lý những người dùng không xác định được độ tuổi, bị tranh chấp hoặc ước tính không chính xác. Bởi vì việc sắp xếp tự động là một phần của thiết kế được báo cáo nên các thủ tục chỉnh sửa và khiếu nại sẽ rất quan trọng đối với cả trẻ vị thành niên và người lớn bị đặt nhầm vào trải nghiệm của thanh thiếu niên.
Vấn đề tiếp theo là liệu sự giám sát của phụ huynh có ý nghĩa hay không nếu không trở thành sự giám sát quá mức. gHacks cho biết các bậc cha mẹ được liên kết có thể điều chỉnh một số cài đặt và nhận thông báo trong một số trường hợp có nguy cơ cao nhất định, trong khi OpenAI giới hạn những gì được chia sẻ liên quan đến rối loạn ăn uống. Nguồn không chỉ rõ sự kiện nào kích hoạt thông báo, thông tin nào phụ huynh nhận được, thời gian lưu giữ thông tin đó hoặc liệu thanh thiếu niên có được thông báo khi thông báo được gửi hay không. Những chi tiết đó sẽ xác định liệu các công cụ có hỗ trợ trợ giúp ngoại tuyến kịp thời trong khi vẫn tôn trọng quyền riêng tư của người trẻ hay không. Đánh giá độc lập nên kiểm tra các kết quả dương tính giả, rủi ro bị bỏ sót và ảnh hưởng của thông báo đến niềm tin giữa thanh thiếu niên và người chăm sóc.
Cuối cùng, hãy theo dõi bằng chứng từ các đánh giá thẻ hệ thống dành cho người dưới 18 tuổi và các đánh giá độc lập của các nhà giáo dục, chuyên gia phát triển trẻ em và nhà nghiên cứu an toàn. gHacks cho biết OpenAI có kế hoạch chia sẻ nhiều hơn về các đánh giá liên quan đến việc tự làm hại bản thân, rối loạn ăn uống, bạo lực, hàng hóa bị giới hạn độ tuổi và nội dung khiêu dâm, nhưng báo cáo không bao gồm kết quả. Báo cáo trong tương lai nên kiểm tra xem Chế độ học tập có nhất quán thúc đẩy lý luận hay không, liệu lời nhắc bài tập về nhà có phân biệt chính xác trợ giúp hợp pháp với việc cố gắng viết tắt hay không và liệu các câu đố hoặc hình ảnh trực quan có cải thiện khả năng ghi nhớ hay không. Quan hệ đối tác CodeAI cũng cần được đánh giá bằng khả năng tiếp cận và tính hữu ích của các tài nguyên, thay vì chỉ bằng thông báo hợp tác. Cho đến khi có bằng chứng đó, việc ra mắt sản phẩm nên được hiểu là một sự thay đổi đáng kể về sản phẩm với những câu hỏi quan trọng chưa được giải quyết.