AIEDHKAI in Education Hub of Knowledge
InicioMisiónNoticiasAcademiaAcerca de
InicioMisiónNoticiasAcademiaAcerca de
← Volver a noticias de investigación

#LLM evaluation

LLM evaluation

1 artículos

A diverse group of computing students and an instructor compare AI tutoring responses with a prerequisite map and scaffolded Python exercises
Artículo de congreso2026
Artículo de congreso 86

Pedagogical-fit feedback improved 51 of 62 weak AI-tutor responses, but scaffolding gains created trade-offs

Benjamin Barlog, Hudson Craig, Zedong Peng

IEEE 27th International Conference on Information Reuse and Integration for Data Science (IRI 2026)

Barlog, Craig and Peng evaluated ChatGPT, Gemini, Gemma 4 and Qwen 3 across 240 introductory-programming tutoring scenarios with a six-part Pedagogical Suitability Index. Baseline scores differed modestly, while targeted feedback improved 51 of 62 weak cases. The largest gain was scaffolding, but prerequisite ordering and Bloom-level alignment sometimes declined, showing why tutoring quality needs multiple measures rather than one composite score.

AI tutorspedagogical fitscaffolding
Leer resumen de 500 palabras →
AIEDHKAI in Education Hub of Knowledge

AIEDHK es un centro multilingüe de conocimiento para investigación, desarrollo e innovación responsable del aprendizaje con IA en educación.

Navegación

InicioMisiónNoticiasAcademiaAcerca de

Enlaces del ecosistema

Dr. Peter Hu DongpinPedaNova TechnologyMAISCAIS
© 2026 AIEDHK. Todos los derechos reservados.