ELECTE 4.0 đã ra mắt — AI Agent đã có mặt.Xem tính năng mới
Newsletter6 phút đọc

Trí tuệ nhân tạo trong giáo dục: Đừng hoảng loạn nữa, chúng ta cần sự thật.

Những tiêu đề giật gân và phương pháp luận đáng ngờ đang làm sai lệch cuộc tranh luận về trí tuệ nhân tạo trong giáo dục. Câu hỏi không phải là liệu AI có làm thay đổi giáo dục hay không, mà là làm thế nào chúng ta có thể dẫn dắt sự thay đổi này một cách có trách nhiệm. Câu trả lời nằm ở khoa học nghiêm túc, chứ không phải những tiêu đề giật gân.

AI nell'Educazione: Basta Panico, Servono Fatti

Tóm tắt bài viết này bằng AI

"ChatGPT khiến bạn ngu đi", "AI gây hại cho não bộ", "Nghiên cứu MIT: trí tuệ nhân tạo gây suy giảm nhận thức". Trong những tháng gần đây, những tiêu đề giật gân như thế này đã thống trị các phương tiện truyền thông đại chúng, nuôi dưỡng những nỗi sợ hãi vô căn cứ về việc sử dụng trí tuệ nhân tạo trong giáo dục và công việc. Nhưng khoa học thực sự nói gì? Một phân tích phê phán về tài liệu nghiên cứu cho thấy một thực tế phức tạp hơn nhiều và, quan trọng hơn, lạc quan hơn.

Vụ việc tại MIT: Khi phương pháp luận gặp gỡ truyền thông

Nghiên cứu của MIT Media Lab "Your Brain on ChatGPT" đã gây ra làn sóng đưa tin giật gân trên truyền thông, thường dựa trên những cách diễn giải sai lệch về kết quả. Được công bố dưới dạng preprint (do đó chưa qua bình duyệt), nghiên cứu này chỉ có sự tham gia của 54 người ở khu vực Boston, và chỉ có 18 người hoàn thành phiên thử nghiệm quan trọng.

Những hạn chế quan trọng về phương pháp luận

Mẫu nghiên cứu không đủ: Với tổng cộng 54 người tham gia, nghiên cứu này thiếu sức mạnh thống kê cần thiết để đưa ra kết luận có thể khái quát hóa. Như chính các nhà nghiên cứu thừa nhận, "mẫu nhỏ" và "đồng nhất: những người sống gần MIT chắc chắn không phản ánh sự phân bố của con người trên thế giới".

Thiết kế thực nghiệm có vấn đề: Người tham gia phải viết bài luận SAT chỉ trong 20 phút - một giới hạn giả tạo tự nhiên đẩy họ đến việc sao chép-dán thay vì tích hợp có suy nghĩ. Thiết kế này "mô phỏng tốt các ràng buộc tự nhiên trong đời sống thực" như "hạn chót là ngày mai" hay "tôi thà chơi game hơn", nhưng không đại diện cho việc sử dụng AI một cách có hiểu biết về mặt sư phạm.

Nhiễu do hiệu ứng làm quen: Nhóm "chỉ dùng não" đã cho thấy sự cải thiện dần dần trong ba phiên đầu tiên đơn giản là vì họ trở nên quen thuộc hơn với nhiệm vụ. Khi nhóm dùng AI phải viết mà không có sự hỗ trợ trong phiên thứ tư, họ đang đối mặt với nhiệm vụ lần đầu tiên mà không có lợi thế của việc luyện tập trước đó.

Khoa học mâu thuẫn: Bằng chứng mạnh mẽ về lợi ích nhận thức

Trong khi giới truyền thông tập trung vào những phát hiện gây lo ngại của MIT, nhiều nghiên cứu nghiêm túc hơn đã cho ra những kết quả hoàn toàn khác biệt.

Nghiên cứu tại Ghana: Phương pháp luận vượt trội, kết quả trái ngược.

Một nghiên cứu được thực hiện tại Đại học Khoa học và Công nghệ Kwame Nkrumah đã theo dõi 125 sinh viên đại học trong một thiết kế đối chứng ngẫu nhiên kéo dài trọn một học kỳ. Kết quả trực tiếp mâu thuẫn với kết luận của MIT:

Tư duy phản biện: Sinh viên sử dụng ChatGPT đã cải thiện từ 28,4 lên 39,2 điểm (+38%), vượt trội đáng kể so với nhóm đối chứng (từ 24,9 lên 30,6, +23%).

Tư duy sáng tạo: Mức tăng còn ấn tượng hơn, từ 57,2 lên 92,0 điểm (+61%) đối với nhóm dùng ChatGPT, với sự cải thiện ở cả sáu khía cạnh được đo lường: lòng can đảm, tìm kiếm sáng tạo, sự tò mò, tính kỷ luật tự giác, sự hoài nghi và tính linh hoạt.

Tư duy phản tư: Cải thiện đáng kể từ 35,1 lên 56,6 điểm (+61%), cho thấy khả năng tự phản tư và nhận thức siêu nhận thức được nâng cao.

Những khác biệt phương pháp luận then chốt: Nghiên cứu tại Ghana đã sử dụng các thang đo đã được xác thực (Cronbach α > 0,89), phân tích nhân tố khẳng định, kiểm soát ANCOVA cho điểm số trước thử nghiệm, và - điều quan trọng - đã tích hợp ChatGPT trong bối cảnh giáo dục thực tế với sự hỗ trợ sư phạm phù hợp.

Nghiên cứu của Harvard/BCG: Tiêu chuẩn vàng trong nghiên cứu.

Nghiên cứu chặt chẽ nhất hiện có liên quan đến 758 tư vấn viên của Boston Consulting Group trong một thử nghiệm đã đăng ký trước và có đối chứng. Kết quả rõ ràng không thể chối cãi:

  • Năng suất: +12,2% số công việc hoàn thành, +25,1% tốc độ hoàn thành
  • Chất lượng: +40% cải thiện về chất lượng kết quả
  • Dân chủ hóa hiệu suất: Những người có hiệu suất ban đầu yếu hơn đã chứng kiến mức tăng 43%, những người vốn đã mạnh tăng 17%

Như Ethan Mollick, đồng tác giả của nghiên cứu, đã chỉ ra: "Các chuyên gia tư vấn sử dụng ChatGPT đạt hiệu quả vượt trội hơn hẳn so với những người không sử dụng. Trên mọi phương diện. Theo mọi cách chúng tôi đo lường hiệu quả."

Phân tích tổng hợp: Một góc nhìn rộng hơn

Một đánh giá có hệ thống về nghiên cứu trí tuệ nhân tạo trong giáo dục đại học đã xác định được những lợi ích đáng kể:

  • Trải nghiệm học tập cá nhân hóa
  • Hỗ trợ sức khỏe tâm thần được cải thiện
  • Hòa nhập các nhu cầu học tập đa dạng
  • Cải thiện hiệu quả giao tiếp

Một nghiên cứu đa quốc gia trên 401 sinh viên đại học Trung Quốc sử dụng mô hình phương trình cấu trúc đã xác nhận rằng "cả AI và mạng xã hội đều có tác động tích cực đến kết quả học tập và sức khỏe tâm thần".

Vấn đề truyền thông: Chủ nghĩa giật gân so với khoa học

Việc truyền thông đưa tin về nghiên cứu của MIT là một ví dụ điển hình về cách mà sự giật gân có thể làm sai lệch sự hiểu biết của công chúng về khoa học.

Tiêu đề gây hiểu nhầm so với thực tế

Tiêu đề điển hình: "Nghiên cứu MIT chứng minh ChatGPT làm người ta ngu đi"
Thực tế: Nghiên cứu sơ bộ chưa qua bình duyệt với 54 người tham gia phát hiện sự khác biệt về kết nối thần kinh trong các nhiệm vụ nhân tạo.

Tiêu đề điển hình: "AI gây hại cho não bộ"
Thực tế: EEG cho thấy các mẫu hình kích hoạt khác nhau, có thể được diễn giải là hiệu quả thần kinh hơn là tổn hại.

Tiêu đề điển hình: "ChatGPT gây suy giảm nhận thức"
Thực tế: Một nghiên cứu có những hạn chế nghiêm trọng về phương pháp luận, bị mâu thuẫn bởi các nghiên cứu chặt chẽ hơn.

Sự trớ trêu của những "cạm bẫy" chống trí tuệ nhân tạo

Trưởng nhóm nghiên cứu của MIT, Nataliya Kosmyna, thừa nhận đã cài cắm "bẫy" vào bài báo để ngăn chặn các phần mềm tóm tắt ngôn ngữ (LLM) tóm tắt chính xác nội dung. Trớ trêu thay, nhiều người dùng mạng xã hội sau đó đã sử dụng LLM để tóm tắt và chia sẻ nghiên cứu, vô tình chứng minh tính hữu ích thực tiễn của các công cụ này.

"Ranh giới gập ghềnh": Hiểu rõ giới hạn thực sự của trí tuệ nhân tạo

Các nghiên cứu nghiêm túc về trí tuệ nhân tạo trong giáo dục không phủ nhận sự tồn tại của những thách thức, nhưng chúng được trình bày một cách tinh tế hơn. Khái niệm "ranh giới công nghệ có khía cạnh" trong nghiên cứu của Harvard minh họa rằng trí tuệ nhân tạo vượt trội trong một số nhiệm vụ trong khi lại gặp khó khăn trong những nhiệm vụ khác, dù thoạt nhìn có vẻ tương tự nhau.

Các yếu tố chính cho sự thành công

Thời điểm áp dụng: Bằng chứng cho thấy việc phát triển các kỹ năng nền tảng trước khi đưa AI vào có thể tối đa hóa lợi ích. Như chính nghiên cứu của MIT ghi nhận, những người tham gia "Brain-to-LLM đã cho thấy khả năng ghi nhớ vượt trội và kích hoạt các vùng chẩm-đỉnh và trước trán".

Thiết kế sư phạm: Nghiên cứu tại Ghana cho thấy tầm quan trọng của việc tích hợp AI với sự hỗ trợ giáo dục phù hợp, các câu lệnh (prompt) được thiết kế tốt và các mục tiêu học tập rõ ràng.

Bối cảnh có ý nghĩa: Việc sử dụng AI trong các bối cảnh giáo dục thực tế, thay vì trong các nhiệm vụ nhân tạo, tạo ra những kết quả khác biệt rõ rệt.


Trí tuệ nhân tạo có thể giúp bạn học tốt hơn và đạt được mục tiêu nhanh hơn, nếu được sử dụng đúng cách.

Hậu quả của chủ nghĩa báo động

Việc đưa tin thiên vị của giới truyền thông không chỉ là vấn đề học thuật mà còn có những hậu quả thực tế đối với việc ứng dụng các công nghệ tiềm năng mang lại lợi ích.

Tác động đến các chính sách giáo dục

Như chính Kosmyna thừa nhận: "Điều thúc đẩy tôi xuất bản nó ngay bây giờ trước khi chờ đợi đánh giá đầy đủ từ các chuyên gia là vì tôi sợ rằng trong 6-8 tháng nữa, một nhà hoạch định chính sách nào đó sẽ quyết định 'hãy thành lập một trường mẫu giáo GPT'. Tôi nghĩ điều đó sẽ hoàn toàn tiêu cực và có hại."

Tuyên bố này cho thấy động cơ vận động chính trị, điều đáng báo động về tính trung lập khoa học của nghiên cứu.

Thiên kiến ​​chấp nhận

Một cuộc khảo sát 28.698 kỹ sư phần mềm cho thấy chỉ có 41% đã thử các công cụ AI, tỷ lệ áp dụng thậm chí còn thấp hơn ở phụ nữ (31%) và các kỹ sư trên 40 tuổi (39%). Những tiêu đề giật gân góp phần tạo nên những định kiến ​​này, có khả năng tước đoạt của nhiều người lao động những lợi ích đã được chứng minh của AI.

Ý nghĩa đối với các công ty AI

Giao tiếp có trách nhiệm

Các công ty AI cần cân bằng giữa sự nhiệt tình đối với công nghệ và việc truyền đạt trung thực về những hạn chế của nó. Kết quả của các nghiên cứu nghiêm túc cho thấy những lợi ích thực sự khi AI được triển khai một cách thận trọng, nhưng cũng chỉ ra sự cần thiết phải:

  • Đào tạo người dùng về các phương pháp thực hành tốt nhất
  • Thiết kế hệ thống thúc đẩy sự tham gia nhận thức
  • Giám sát kết quả trong dài hạn

Vượt lên trên sự giật gân

Thay vì phản ứng một cách phòng thủ trước những tiêu đề tiêu cực, ngành công nghiệp AI nên:

  1. Đầu tư vào nghiên cứu chặt chẽ với mẫu lớn và phương pháp luận vững chắc
  2. Hợp tác với các nhà giáo dục để phát triển khung triển khai hiệu quả
  3. Thúc đẩy hiểu biết về truyền thông để giúp công chúng phân biệt giữa nghiên cứu nghiêm túc và sự giật gân

Kết luận: Lời kêu gọi trách nhiệm khoa học

Lịch sử của nghiên cứu tại MIT và sự đưa tin của giới truyền thông về nó mang đến những bài học quan trọng cho tất cả các bên liên quan trong hệ sinh thái trí tuệ nhân tạo.

Dành cho các nhà nghiên cứu

Áp lực phải công bố các kết quả "đáng chú ý" không được làm ảnh hưởng đến tính nghiêm ngặt về phương pháp luận. Các bản thảo sơ bộ có thể hữu ích cho các cuộc tranh luận khoa học, nhưng cần phải truyền đạt cẩn thận những hạn chế của chúng.

Dành cho giới truyền thông

Công chúng xứng đáng được đưa tin chính xác, phân biệt rõ giữa:

  • Nghiên cứu sơ bộ so với bằng chứng đã được xác lập
  • Tương quan so với quan hệ nhân quả
  • Hạn chế phương pháp luận so với kết luận tổng quát

Dành cho ngành công nghiệp trí tuệ nhân tạo

Tương lai của trí tuệ nhân tạo trong giáo dục phụ thuộc vào việc triển khai một cách thận trọng dựa trên bằng chứng vững chắc, chứ không phải phản ứng trước những tin tức giật gân mới nhất.

Lời hứa thực sự của Trí tuệ nhân tạo trong Giáo dục

Trong khi cuộc tranh luận vẫn đang diễn ra sôi nổi trên các mặt báo, những nghiên cứu nghiêm túc đang hé lộ tiềm năng thực sự của trí tuệ nhân tạo (AI) trong việc dân chủ hóa quyền tiếp cận các trải nghiệm học tập chất lượng cao. Nghiên cứu tại Ghana cho thấy rằng khi được triển khai đúng cách, AI có thể:

  • San bằng sân chơi cho học sinh có trình độ khác nhau
  • Cá nhân hóa việc học theo những cách trước đây không thể thực hiện
  • Giải phóng giáo viên để tập trung vào các hoạt động ý nghĩa hơn
  • Phát triển các kỹ năng thế kỷ 21 quan trọng cho tương lai

Câu hỏi không phải là liệu trí tuệ nhân tạo có làm thay đổi giáo dục hay không, mà là làm thế nào chúng ta có thể dẫn dắt sự thay đổi này một cách có trách nhiệm. Câu trả lời nằm ở khoa học chính xác, chứ không phải những tiêu đề giật gân.

Nguồn và Tài liệu tham khảo:

Để cập nhật các nghiên cứu khoa học nghiêm túc về AI (không giật gân), hãy theo dõi blog doanh nghiệp của chúng tôi và đăng ký nhận Newsletter của chúng tôi.

Bình luận

Chưa có bình luận nào — hãy bắt đầu cuộc trò chuyện.