HIỆU SUẤT GIẢI TOÁN CỦA CHATGPT TRONG CHUYÊN ĐỀ LÍ THUYẾT ĐỒ THỊ LỚP 11

HIỆU SUẤT GIẢI TOÁN CỦA CHATGPT TRONG CHUYÊN ĐỀ LÍ THUYẾT ĐỒ THỊ LỚP 11

Phạm Thành Đạt datpt@hcmue.edu.vn Trường Đại học Sư phạm Thành phố Hồ Chí Minh 280 An Dương Vương, phường Chợ Quán, Thành phố Hồ Chí Minh, Việt Nam
Goi Ngọc Tú* goingoctu9at4@gmail.com Trường Đại học Sư phạm Thành phố Hồ Chí Minh 280 An Dương Vương, phường Chợ Quán, Thành phố Hồ Chí Minh, Việt Nam
Trần Khánh Anh Kaanh3851D@gmail.com Trường Đại học Sư phạm Thành phố Hồ Chí Minh 280 An Dương Vương, phường Chợ Quán, Thành phố Hồ Chí Minh, Việt Nam
Hồ Ngọc Bảo Trâm hongocbaotram2020@gmail.com Trường Đại học Sư phạm Thành phố Hồ Chí Minh 280 An Dương Vương, phường Chợ Quán, Thành phố Hồ Chí Minh, Việt Nam
Tóm tắt: 
Mặc dù hiệu suất giải Toán của ChatGPT đã được khảo sát trên nhiều lĩnh vực, song việc đánh giá năng lực của mô hình này đối với nội dung Lí thuyết đồ thị trong Chương trình Giáo dục phổ thông 2018 vẫn còn là một khoảng trống cần được làm rõ. Nghiên cứu này tập trung phân tích khả năng giải quyết vấn đề của ChatGPT thông qua 257 nhiệm vụ thuộc chuyên đề Toán học lớp 11 từ ba bộ sách giáo khoa hiện hành, đồng thời nhận diện các sai sót mang tính hệ thống của mô hình. Kết quả thực nghiệm cho thấy, hiệu suất của ChatGPT có sự chênh lệch đáng kể giữa các bộ sách và chỉ ra 05 nhóm lỗi điển hình mà mô hình thường xuyên mắc phải khi xử lí dữ liệu đồ thị. Những phát hiện này không chỉ cung cấp minh chứng thực tiễn về năng lực của trí tuệ nhân tạo trong giáo dục Toán học mà còn giúp các nhà giáo dục nhận diện rõ giới hạn của công cụ, từ đó đưa ra những định hướng sử dụng hiệu quả và phù hợp trong bối cảnh đổi mới giáo dục phổ thông hiện nay.
Từ khóa: 
ChatGPT
Lí thuyết đồ thị
Hiệu suất giải toán
lỗi sai.
Tham khảo: 

[1] Díaz, B. & Nussbaum, M. (2024). Artificial intelligence for teaching and learning in schools: The need for pedagogical intelligence. Computers & Education, 217, 105071. https://doi.org/10.1016/j. compedu.2024.105071.

[2] Fergus, S., Botha, M. & Ostovar, M. (2023). Evaluating academic answers generated using ChatGPT. Journal of Chemical Education, 100(4), pp.1672-1675. https://doi.org/10.1021/acs.jchemed.3c00087.

[3] Gandolfi, A. (2025). GPT-4 in education: Evaluating aptness, reliability, and loss of coherence in solving calculus problems and grading submissions. International Journal of Artificial Intelligence in Education, 35(1), pp.367-397. https:// doi.org/10.1007/s40593-024-00403-3.

[4] Giannos, P. & Delardas, O. (2023). Performance of ChatGPT on UK standardized admission tests: insights from the BMAT, TMUA, LNAT, and TSA examinations. JMIR Medical Education, 9(1), Article e47737. https://doi.org/10.2196/47737.

[5] Huang, L., Yu, W., Ma, W., Zhong, W., Feng, Z., Wang, H., ... & Liu, T. (2025). A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions. ACM Transactions on Information Systems, 43(2), pp.1-55. https://doi. org/10.1145/3703155.

[6] Kaya, D. & Yavuz, S. (2025). Can generative aI and ChatGPT break human supremacy in mathematics and reshape competence in cognitive-demanding problem-solving tasks?. Journal of Intelligence, 13(4), p.43.

[7] Kortemeyer, G. (2023). Could an artificial-intelligence agent pass an introductory physics course?. Physical Review Physics Education Research, 19(1), p.010132. https://doi.org/10.1103/PhysRevPhysE ducRes.19.010132.

[8] Lê Anh Vinh, Bùi Thị Diển, Lê Quang Quân & Vũ Văn Luân. (2023). Khả năng thực hiện bài kiểm tra định kì môn Toán và môn Ngữ văn cấp Trung học của công cụ ChatGPT: Kết quả nghiên cứu và một số khuyến nghị ban đầu. Tạp chí Khoa học Giáo dục Việt Nam, 19(2), tr.1-10.

[9] Le Thai Bao Thien Trung, Nguyen Minh Dat, Tang Minh Dung, Trinh Van Thanh & Nguyen Minh Nhut. (2025). Promoting teachers’ use of ChatGPT: A case study on generating real-world problems in 10th grade algebra instruction. HCMUE Journal of Science, 22(3), pp.500-511.

[10] Oh, S. (2024). Evaluating Mathematical Problem Solving Abilities of Generative AI Models: Performance Analysis of o1-preview and gpt-4o Using the Korean College Scholastic Ability Test. IEEE Access, 13, pp.1227-1235.

[11] Pardos, Z. A. & Bhandari, S. (2024). ChatGPT-generated help produces learning gains equivalent to human tutor-authored help on mathematics skills. PLOS ONE, 19(5), e0304013. https://doi.org/10.1371/ journal.pone.0304013.

[12] Phạm Tất Thành. (2024). Đánh giá kết quả phản hồi của Chatbot Bard trong thực hiện bài thi môn Địa lí kì thi tốt nghiệp Trung học Phổ thông Quốc gia Việt Nam từ năm 2019 đến năm 2023. Tạp chí Giáo dục, 24(4), tr.35-40.

[13] Polverini, G. & Gregorcic, B. (2024). Performance of ChatGPT on the test of understanding graphs in kinematics. Physical Review Physics Education Research, 20(1), 010109. https://doi.org/10.1103/ PhysRevPhysEducRes.20.010109

Bài viết cùng số