Skip to main content

Аудиоматериалы курса для нейроотличных студентов: руководство для университетов

Как университетам переводить учебные материалы в аудио для нейроотличных студентов: обязанности по закону, данные исследований и рамки пилота.

Университеты по всей Великобритании уже переводят учебные документы в аудио. Чего почти никто из них не производит — так это аудио, которое кто-нибудь стал бы слушать по собственному выбору. Автоматическое преобразование, встроенное в системы управления обучением (LMS), порождает один синтетический голос, читающий вслух один файл, и сами учебные заведения прямо пишут об этом в своих руководствах. В этой статье разбирается, чего на самом деле требуют установленные законом обязанности, что опубликованные исследования показывают и чего не показывают об аудио для нейроотличных студентов, где нынешнее обеспечение оставляет пробел и как университетская команда может очертить пилотный проект с разговорными аудиоматериалами курса, ничем себя предварительно не связывая.


Что такое альтернативные форматы и какое место в них уже занимает аудио?

Альтернативные форматы — это версии учебных материалов, выпущенные в форме, отличной от оригинала: тегированный PDF, HTML, EPUB, DAISY, электронный шрифт Брайля, укрупнённый шрифт и аудио. В высшем образовании Великобритании они обычно поставляются сразу по двум маршрутам.

Первый маршрут — автоматическое преобразование внутри системы управления обучением (LMS). UWE Bristol объясняет, что «Blackboard автоматически создаёт ряд альтернативных форматов на основе исходного контента», включая аудио, «воспроизводимое на любых устройствах, способных проигрывать MP3-файлы», и что «всем студентам рекомендуется изучить и использовать альтернативные форматы». Университет Йорка и Университет Рединга описывают тот же результат в формате MP3 в своих системах.

Второй маршрут — служба преобразования, работающая в режиме самообслуживания или с участием сотрудников. Бодлианские библиотеки Оксфорда преобразуют документы «в широкий спектр альтернативных форматов, включая аудиокниги (MP3 и DAISY)». Университет Глазго сообщает студентам, что та же служба «позволяет вам преобразовывать конспекты лекций, статьи и слайды в альтернативные форматы, включая MP3 и электронные книги».

То есть обеспечение аудио — не новая идея для отрасли. Это устоявшаяся, широко развёрнутая возможность. Вопрос, который стоит задать, — какое именно аудио она производит.


Чего на самом деле требует Закон о равенстве 2010 года?

Он требует доступных форматов. Аудио в нём не названо, и любой поставщик, который утверждает обратное, преувеличивает содержание закона.

Раздел 91(9) Закона о равенстве 2010 года распространяет обязанность вносить разумные приспособления на ответственный орган высшего учебного заведения, а Приложение 13 применяет к таким заведениям первое, второе и третье требования. Третье требование, в разделе 20(5), касается вспомогательных средств. Далее раздел 20(6) добавляет, что если первое или третье требование относится к предоставлению информации, «шаги, которые A разумно должен предпринять, включают шаги, обеспечивающие, чтобы в соответствующих обстоятельствах информация предоставлялась в доступном формате».

Следствие для планирования вытекает из того, когда эта обязанность возникает. Техническое руководство EHRC по дальнейшему и высшему образованию указывает, что обязанность «является упреждающей в том смысле, что требует учёта барьеров, мешающих всем людям с инвалидностью, и действий в отношении этих барьеров ещё до того, как конкретный студент с инвалидностью попытается получить доступ к образованию», что учебным заведениям «поэтому не следует ждать, пока человек с инвалидностью к ним обратится», и что она применяется «независимо от того, известно ли образовательному учреждению, что конкретный человек имеет инвалидность». То же руководство отмечает, что обязанность относится ко «всем студентам с инвалидностью и любым абитуриентам с инвалидностью, а не только к тем, кто имеет право на пособия Disabled Students’ Allowances».

Университет Лидс Беккет формулирует ту же мысль своими словами в руководстве для сотрудников: у университета есть «юридическая и моральная ответственность в соответствии с Законом о равенстве 2010 года предоставлять всю информацию в альтернативном формате по запросу человека с инвалидностью» и «обязанность предвосхищать потребности людей с инвалидностью, обеспечивая, чтобы вся информация создавалась максимально доступным образом».

Что касается именно веб-контента, университеты Великобритании подпадают под действие Public Sector Bodies (Websites and Mobile Applications) Accessibility Regulations 2018 — исключение, сделанное для школ и детских садов, на высшее образование не распространяется. Какую именно версию WCAG применять, стоит формулировать точно, потому что два источника сейчас говорят разное: руководство GOV.UK указывает на WCAG 2.2 AA, тогда как EN 301 549 — гармонизированный стандарт, на который опирается этот режим, — дословно воспроизводит WCAG 2.1 AA. Планируйте по 2.2 и понимайте, почему в самом стандарте стоит 2.1. То же руководство GOV.UK исходит из того, что «кто-то может попросить информацию в альтернативном, доступном формате — например, крупным шрифтом или в виде аудиозаписи». EN 301 549 — это ещё и базовый стандарт ЕС: он задаёт требования «в форме, пригодной для использования в государственных закупках в Европе» и лежит в основе Директивы (ЕС) 2016/2102.

В США картина расходится по типу учебного заведения, и здесь регулярно ошибаются. Правило Министерства юстиции о веб-доступности 2024 года устанавливает WCAG 2.1 уровня AA в рамках раздела II ADA, а он охватывает только государственные университеты. Сроки соблюдения затем были продлены промежуточным окончательным правилом, опубликованным 20 апреля 2026 года (91 FR 20902), до 26 апреля 2027 года — для организаций, обслуживающих 50 000 человек и более, и до 26 апреля 2028 года — для менее крупных организаций и специальных округов, поэтому любой источник, всё ещё называющий исходную дату 2026 года, устарел. Частные университеты подпадают под раздел III, для которого технический стандарт для веба вообще не принят.

Одно уточнение, которое стоит сделать, потому что здесь часто ошибаются: руководящий принцип WCAG о «текстовых альтернативах» требует текста для нетекстового контента, а не аудио для текста. Он работает в обратную сторону. Соответствующий материал W3C — техника G79 «Предоставление озвученной версии текста», достаточная техника для критерия «Уровень чтения», которая помогает «пользователям, которым трудно озвучивать (декодировать) слова в письменном тексте». Этот критерий относится к уровню AAA, поэтому ни одно нормативное требование его не предписывает. Это признанная техника, а не обязанность.

Второе замечание избавит от спора в будущем. Критерий WCAG для предзаписанного аудио без видео обычно требует текстовой альтернативы для аудиоконтента, но в нём есть прямое исключение — «когда аудио или видео является медиаальтернативой тексту и явно обозначено как таковая»; при этом медиаальтернатива тексту — это медиа, которое «не представляет больше информации, чем уже представлено в тексте». Поэтому явно обозначенной аудиоверсии учебного комплекта, которая ничего не добавляет к исходному документу, отдельная расшифровка не нужна: документ и есть расшифровка.

Обратная сторона этого не факультативна, и именно эту мысль стоит держать в голове до конца статьи: аудио — это дополнительная модальность, но никогда не замена доступного текста. Одно только аудио исключает глухих и слабослышащих студентов. Доступный исходный документ обязан существовать и оставаться доступным независимо от того, что вы предлагаете рядом с ним.


Есть ли доказательства, что аудио помогает нейроотличным студентам?

Да — но честный вывод звучит так: паритет и доступ, а не превосходство. Данные подтверждают, что аудио — равноценный путь к тому же содержанию, и этого достаточно, чтобы его предлагать; внутри организации такая позиция защищается куда легче, чем утверждение, будто слушание лучше чтения.

Самое масштабное сравнение — метаанализ Clinton-Lisell (2022) в Review of Educational Research, который объединил исследования понимания при чтении и на слух и обнаружил, что они в целом сопоставимы, с небольшим преимуществом чтения при некоторых условиях. Аудио — не короткий путь к лучшему пониманию. Это вторая дверь в ту же комнату.

Ближайшее к этой конкретной аудитории исследование — предварительно зарегистрированное рандомизированное контролируемое исследование Jafarian и Kramer (2025), опубликованное в Computers and Education: Artificial Intelligence. В нём сообщается, что «модули аудиообучения повысили мотивацию студентов и вовлечённость в чтение», что этот рост «поднял академическую успеваемость» и — что напрямую относится к нашей теме — что «студенты с более выраженными симптомами СДВГ получили от модулей аудиообучения особенно заметную пользу, поскольку те сыграли решающую роль в успешном прохождении курса». Это одно исследование, и говорит оно о выраженности симптомов СДВГ, а не о каждом нейроотличном профиле.

Более широкая литература о синтезе речи осторожнее. Метаанализ Wood, Moxley, Tighe и Wagner (2018) обнаружил малый-умеренный средний эффект для понимания прочитанного у студентов с трудностями чтения и заключил, что эти технологии «могут помогать студентам в понимании прочитанного», тогда как «необходимы дополнительные исследования, чтобы полнее изучить модерирующие переменные». Авторы также сообщают, что «модерирующие эффекты дизайна исследования, как было установлено, объясняют часть дисперсии»; вошедшие исследования предшествуют современному синтезу речи, а изучавшаяся популяция — это студенты с нарушениями чтения, а не с СДВГ, аутизмом или диспраксией.

Для институциональной рамки, а не для оценки величины эффекта, полезен систематический обзор Gunderson и Cumming (2023) в Innovations in Education and Teaching International: в нём подкастинг в высшем образовании рассматривается именно как составная часть универсального дизайна обучения — то есть ровно тот аргумент, который приводит эта статья, только у его авторов нет ничего на продажу.

Отсюда следуют три честных ограничения:

  • Ни один опубликованный корпус доказательств не показывает улучшения результатов от аудиоматериалов курса по всем нейроотличным профилям. Тот, кто утверждает обратное, экстраполирует.
  • Управление национальной статистики Великобритании подтверждает, что не располагает клиническими или диагностическими данными по нейроотличным состояниям и не фиксирует дислексию, диспраксию и другие специфические особенности обучения в своих наборах данных, поэтому к широко тиражируемым национальным оценкам распространённости стоит относиться осторожно.
  • Аудио лучше всего понимать как компенсаторное средство — оно помогает студенту получить доступ к материалу здесь и сейчас, — а не как воздействие, развивающее навык чтения со временем.

Аргумент в пользу аудио держится не на том, что оно лучше. Он держится на том, что оно сопоставимо по пониманию, доступно в те моменты, когда чтение недоступно, и обходится дешевле по усилиям тем студентам, кому декодирование текста даётся дорого.


Почему read-along важнее, чем аудио само по себе

Расхожий рефлекс — считать аудио заменой чтению. Литература о когнитивной нагрузке такую рамку не подтверждает. Принцип избыточности, описанный Mayer и Moreno (2003), прямо предостерегает от дублирования экранного текста речью, а эффект модальности касается закадрового повествования в паре с графикой, а не сравнения «только аудио» и «только текст». Ссылаться на «двойное кодирование», доказывая, что слушание должно заменить чтение, — значит искажать исследования.

Руководства по доступности на самом деле описывают аудио вместе с текстом. Документ W3C Making Content Usable for People with Cognitive and Learning Disabilities фиксирует потребность пользователя напрямую: «Мне нужна поддержка синтеза речи с синхронной подсветкой, чтобы я мог следить за словами по мере того, как их читают вслух». Материал W3C о синтезе речи называет «людей с дислексией и другими когнитивными нарушениями и трудностями обучения, которым нужно слышать и видеть текст, чтобы лучше его понимать», а его руководство по когнитивным нарушениям и трудностям обучения прямо охватывает дислексию, СДВГ и расстройство аутистического спектра.

Руководство CAST по универсальному дизайну обучения приводит аргумент дизайна, а не эмпирики, и здесь важна точность ссылки. Версия 3.0, выпущенная в 2024 году, отменила прежнюю нумерацию контрольных пунктов; относящееся к делу положение — это соображение 2.2 «Поддерживайте декодирование текста, математической нотации и символов», которое предлагает «разрешить использование синтеза речи» и «использовать цифровой текст в сопровождении записи человеческого голоса». Это соображение о декодировании, а не о восприятии: руководство о восприятии работает в обратную сторону — в сторону текстовых альтернатив к аудио, поэтому ссылаться на него в смысле «UDL требует предоставлять аудиоверсии текста» — ошибка чтения, которую специалист службы поддержки студентов с инвалидностью заметит. UDL — это дизайн-фреймворк, а не доказательство результатов, и цитировать его стоит именно в этом качестве. (Ссылаться как CAST (2024), CAST Universal Design for Learning Guidelines version 3.0.)

В случае диспраксии и расстройства развития координации барьером чаще оказывается производство, а не восприятие. Исследование 2024 года в European Journal of Investigation in Health, Psychology and Education установило, что письмо от руки представляет значительную трудность более чем для половины его участников с DCD: студенты описывали, как теряют нить лекции, сосредоточившись на записывании конспекта. Материал, доступный в форме, которую не нужно расшифровывать в реальном времени, снимает эту проблему напрямую. (Отметим, что Dyspraxia Foundation закрылся в 2024 году; British Dyslexia Association подтвердила закрытие, а Movement Matters — актуальная точка отсчёта в Великобритании.)


В чём нынешнее обеспечение не дотягивает?

Три пробела видны на собственных опубликованных страницах университетов.

Маршрут с проверкой медленный, а быстрый маршрут никем не проверяется. UWE Bristol использует оба. Его служба альтернативных форматов открыта для «любого студента UWE Bristol, у которого есть нарушение зрения, который является нейроотличным или имеет любое другое состояние, затрудняющее доступ к тексту», и указывает, что стремится «выпускать доступные PDF в течение трёх недель с момента получения запроса», тогда как «другие форматы, такие как Word и Audio», занимают больше времени. Его автоматический маршрут возвращает аудио всем и сразу. Студент выбирает между продуманным форматом, который приходит после того, как тему уже прочитали, и мгновенным, который, как City St George’s, University of London говорит об автоматических форматах в целом, «не проверяется никакими сотрудниками, например преподавателями» и должен рассматриваться как «вспомогательный ресурс».

Бремя по-прежнему лежит на студенте. Обзор Office for Students Beyond the bare minimum установил, что «бремя запрашивать инклюзивные педагогические практики остаётся на студентах с инвалидностью, вместо того чтобы такие практики были нормой», и сообщил, что, хотя подавляющее большинство опрошенных учебных заведений записывали часть своих лекций, лишь малое меньшинство записывало их все. Обзор опубликован в 2019 году по данным 2017 года, поэтому конкретику стоит считать исторической, — но структурный вывод в нём тот же, что и у упреждающей обязанности.

Студенты уже сказали, чего хотят. Open SU, студенческая ассоциация Открытого университета, опубликовала позицию, в которой просит учебные заведения «предоставлять материалы в нескольких форматах везде, где это возможно (текст, аудио, видео, пригодный для печати)» и обеспечивать, чтобы материалы «по умолчанию проектировались с учётом нейроотличных студентов, а не полагались на раскрытие диагноза или отложенные приспособления». Это письменное, публичное, никем не запрошенное изложение требования со стороны студентов.

Одно терминологическое замечание, поскольку по нему видно, читал ли поставщик отраслевые материалы: об отдельных людях говорят нейроотличный. Как поясняет ресурсный центр по нейроразнообразию Университета Глазго, «нейроразнообразный» описывает группу, охватывающую весь спектр нейроразнообразия, тогда как «нейроотличный» описывает отдельных людей. «Нейроразнообразные студенты» — неверная конструкция.


Что меняет разговорное аудио?

Различие — между прочитанным вслух документом и объяснённым предметом.

Автоматическое преобразование берёт один файл и озвучивает его одним синтетическим голосом в том порядке, в каком файл написан. Podhoc перестраивает материал в дискуссию между голосами, что меняет и ощущение от прослушивания, и то, для чего оно полезно. Конкретно — и это проверяемо на этом сайте:

  • Исходный материал в форматах .pdf, .docx, .doc и .txt, а также вставленный текст и ссылки становятся многоголосым эпизодом, а не одноголосой начиткой.
  • Восемь аудиостилей — среди них Техника Фейнмана, Критика, Дебаты и Упрощённое объяснение — определяют, как обрабатывается материал, поэтому плотная методологическая статья и вводный список литературы получают разное обращение.
  • Read-along — синхронная подсветка текста — подсвечивает слова и текущее предложение синхронно с аудио; это именно тот паттерн, который описывают руководства W3C по когнитивной доступности, а не замена текста аудио.
  • Управление скоростью воспроизведения позволяет слушателю замедлить трудные фрагменты или быстро пройти знакомые.
  • Результат доступен на 73 языках, что важно для учебных заведений с международными потоками.
  • REST API с аутентификацией по токену позволяет запускать преобразование из существующих систем, а не вручную.

Какие из этих возможностей важны для конкретного внедрения и как настраивается каждая из них — именно это и устанавливает пилот; список выше описывает платформу, а не готовую институциональную конфигурацию.

Чего оно не делает — так это не отменяет необходимости в продуманном доступном PDF, транскрипции шрифтом Брайля или проверенном человеком формате там, где материал этого требует. Это ещё один формат в наборе альтернативных форматов, и оценивать его следует именно так.

Услышать сам подход можно на страницах для студентов и исследователей, а обоснование формата изложено в статье почему аудиообучение работает.


О чём университету стоит спросить любого поставщика до запуска пилота?

Эти вопросы относятся к каждому поставщику в этой области, включая нас. Их всё равно задаст оценка воздействия на защиту данных, поэтому быстрее задать их в самом начале.

ВопросПочему это важноОтвет Podhoc сегодня
Куда по умолчанию попадает сгенерированный результат?Определяет, станет ли материал, производный от студенческого, публично видимымСгенерированные подкасты по умолчанию публикуются в общедоступной ленте Discover; отказ от публикации — это шаг настройки
Что происходит с исходным документом?Учебные материалы часто лицензированы третьими сторонамиИсходные документы не публикуются; публикуется только сгенерированный подкаст
Какие данные об использовании записываются?Аналитика прослушивания может быть персональными даннымиЗаписываются события завершения прослушивания — см. Политику конфиденциальности
Кто выступает стороной договора?Нужно для соглашения об обработке данныхNexo Apex SL — см. Условия
Можно ли получить результат на языке обучения?Актуально для международных и двуязычных потоков73 языка вывода
Можно ли управлять этим из наших существующих систем?Определяет, впишется ли решение в текущий рабочий процесс или создаст параллельныйREST API с аутентификацией по токену

Первая строка — та, которую нужно закрыть до обработки любых студенческих работ. На платформе Podhoc публикация включена по умолчанию, и такое умолчание уместно для отдельного человека, который делится тем, что сделал сам. Для институционального использования оно уместно не автоматически, и это вопрос настройки, а не допущения.


Как университету провести пилот аудиоматериалов курса?

Держите первый заход достаточно небольшим, чтобы под него не требовалось экономическое обоснование.

  1. Выберите один модуль с большой нагрузкой по чтению и поток, от которого уже поступают запросы на альтернативные форматы.
  2. Возьмите небольшой набор репрезентативных документов — базовый текст для чтения, раздаточный материал к лекции, главу о методах — вместо целого модуля.
  3. Согласуйте письменно настройки публикации и обращения с данными до того, как что-либо пойдёт в обработку.
  4. Заранее решите, что вы будете измерять. Вовлечённость в материал и отзывы студентов реалистичны в пределах семестра; эффекты на успеваемость — нет, и пилот, который их обещает, разочарует.
  5. Честно сравните результат с тем, что ваша система управления обучением (LMS) уже создаёт автоматически. Если он не заметно лучше — это тоже полезный результат.

Это повторяет то, как британские учебные заведения уже испытывают ассистивные технологии — во временное пользование или в режиме пробы до любых обязательств, — поэтому должно вписаться в существующий процесс, а не требовать нового.

Запросить пилотный проект для вашего учебного заведения, компании или работодателя →


Материалы по теме

Часто задаваемые вопросы

Заменяют ли аудиоматериалы курса университетскую службу альтернативных форматов?
Нет. Службы альтернативных форматов выпускают доступные PDF, EPUB, DAISY, электронный шрифт Брайля и укрупнённый шрифт, и эти форматы закрывают потребности, которые аудио закрыть не может. Аудио — это один дополнительный формат рядом с ними. Университетам, где уже работает SensusAccess или Blackboard Ally, стоит рассматривать разговорное аудио как дополнение к этой услуге, а не как её замену.
Обязывает ли Закон о равенстве 2010 года предоставлять учебные материалы в аудио?
Аудио в нём не названо. Раздел 20(6) Закона о равенстве 2010 года говорит, что если обязанность касается предоставления информации, разумные шаги «включают шаги, обеспечивающие, чтобы в соответствующих обстоятельствах информация предоставлялась в доступном формате», — сам формат остаётся открытым. Для планирования важно другое: техническое руководство EHRC описывает эту обязанность в дальнейшем и высшем образовании как упреждающую, то есть от учебных заведений ожидается, что они будут учитывать барьеры до того, как об этом попросит конкретный студент.
Улучшает ли аудио результаты обучения нейроотличных студентов?
Данные говорят о паритете и доступе, а не о превосходстве. Метаанализ Clinton-Lisell (2022) обнаружил, что понимание на слух и понимание прочитанного в целом сопоставимы, с небольшим преимуществом чтения при некоторых условиях, — то есть аргумент в пользу аудио в том, что это равноценный путь к тому же содержанию, а не лучший. Ближайшее к этой аудитории исследование — предварительно зарегистрированное рандомизированное контролируемое исследование Jafarian и Kramer (2025) — показало, что модули аудиообучения повысили мотивацию и вовлечённость в чтение и что «студенты с более выраженными симптомами СДВГ получили особенно заметную пользу», но это одно исследование, и говорит оно о выраженности симптомов СДВГ, а не о каждом профиле. Метаанализ синтеза речи Wood с коллегами (2018) сообщил о малом-умеренном среднем эффекте для студентов с трудностями чтения, заключив лишь, что эти технологии «могут помогать студентам в понимании прочитанного» и что «необходимы дополнительные исследования, чтобы полнее изучить модерирующие переменные». Корпуса доказательств, охватывающего аудиоматериалы курса по всем нейроотличным профилям, не существует.
Чем разговорное аудио отличается от MP3-файлов, которые уже создаёт наша LMS?
Автоматическое преобразование в системе управления обучением (LMS) выдаёт синтетическое чтение вслух одного документа одним голосом. Разговорное аудио перестраивает материал в поясняющую дискуссию между голосами и может опираться более чем на один источник. Университеты откровенно говорят об ограничениях автоматического пути: City St George’s, University of London указывает, что автоматические альтернативные форматы «не проверяются никакими сотрудниками, например преподавателями» и «не следует полагаться только на альтернативный формат».
Что проверить в обращении с данными, прежде чем обрабатывать студенческие работы?
С любым поставщиком нужно выяснить четыре вещи: где по умолчанию публикуется сгенерированный результат, какие данные о прослушивании или использовании записываются, сохраняются ли исходные документы и открыты ли они посторонним, и где происходит обработка. В Podhoc сгенерированные подкасты по умолчанию публикуются в общедоступной ленте Discover, а события завершения прослушивания записываются — см. Политику конфиденциальности и Условия. Для любого институционального внедрения эти настройки по умолчанию должны быть письменно согласованы до того, как студенческие материалы попадут в обработку.
Какое подразделение внутри университета обычно этим занимается?
На практике этим занимается та команда, которая уже отвечает за альтернативные форматы: служба поддержки студентов с инвалидностью или служба поддержки обучения, специалист по ассистивным технологиям, отдел альтернативных форматов при библиотеке либо служба образовательных технологий и цифрового образования. Эти команды и так проводят испытания ассистивных инструментов, поэтому ограниченный по объёму пилот вписывается в уже существующий порядок работы, а не требует нового.