Препринт — материал ещё не прошёл рецензирование
ИИ собрал 1934 учебных шага, но длинные связи остались непроверенными
Кратко
Модель сама разобрала два учебника по математике на 1934 небольших учебных шага и 4616 связей, а затем составила 6648 заданий для 373 школьников в двух английских школах за семь недель. Предположение о пользе дальних связей осталось непроверенным: детям почти не давали задания, требующие больше двух шагов, а оценка сложности заданий почти не совпала с тем, насколько успешно их решали.
Зачем это знать
Подход обещает упростить создание заданий под разные знания учеников, однако его главное преимущество пока не подтверждено. Исследование не показывает, как модель работает с более длинными цепочками связей и насколько точно оценивает сложность заданий.
Разбор
Авторы проверяли не просто генератор задач, а целую схему представления школьной математики. Модель превратила содержание учебников в граф: отдельные умения стали узлами, а связи показывали, какие знания нужны раньше других. Затем для каждого ребёнка система хранила отдельную оценку освоения каждого умения и подбирала вопрос обычным расчётом по этому графу — без ручной разметки задач и без отдельной настройки параметра «сложность». Это должно было сделать создание заданий дешевле и позволить точнее учитывать пробелы конкретного ученика.
Но проверка показала неожиданный перекос в затратах: прочитать страницы для модели оказалось сравнительно дёшево, а построить связи между умениями — заметно дороже. Кроме того, дети начинали работать медленнее, когда на один балл уходило около семи секунд вместо трёх. Это важно для практического применения: система должна учитывать не только правильность ответа, но и время, после которого задание перестаёт удерживать внимание.
Самая существенная проверка так и не состоялась. В реальном использовании детям не показывали задания, которые уходили дальше двух шагов по цепочке предпосылок. Поэтому нельзя понять, помогает ли граф действительно прокладывать длинный путь от уже известных навыков к новому. Иными словами, авторы построили механизм, на котором можно было бы проверить главную идею, но почти не использовали его в самой сложной области.
Ключевые цифры
Можно ли доверять
Это препринт на arXiv, то есть его ещё не проверили независимые рецензенты. В пользу работы говорит проверка на 373 школьниках в двух школах, но главный вывод пока нельзя считать подтверждённым: на практике почти не было заданий с длинными цепочками предпосылок, ради которых и создавалась такая схема.
Пересказано ИИ по научной статье. Как это устроено