Современные браузеры настолько хорошо исправляют ошибки разработчиков, что пользователи редко замечают сломанную разметку. Проверка 5000 популярных доменов показала обратную сторону браузерной терпимости: 87,2% сайтов хотя бы в одном месте нарушают стандарты HTML, а полностью чистый код встречается лишь у 2,6%.
Исследование провёл независимый французский разработчик Тео Дюкре, создавший проект ValidateHTML. Для проверки Дюкре взял 5000 наиболее востребованных доменов из рейтинга Tranco, включая Google, YouTube, Akamai и технические адреса вроде gstatic и Ezviz7.
Доступные для обычного посетителя главные страницы нашлись у 2656 доменов. Многие остальные адреса перенаправляли трафик или обслуживали внутренние запросы программ и устройств. Проверка охватывала весь список независимо от назначения домена.
Сканер обнаружил 100 305 нарушений стандартов HTML и ещё 18 863 ошибки CSS. Полностью корректную HTML-разметку использовали только 12,8% проверенных сайтов. Доля страниц без ошибок и предупреждений о несоблюдении рекомендуемых практик составила всего 2,6%.
Стандарты W3C и WHATWG помогают браузерам, программам чтения с экрана и другим инструментам одинаково понимать структуру страницы. Обычный посетитель может не заметить ошибку, поскольку Chrome и другие браузеры восстанавливают повреждённую разметку автоматически. Вспомогательные программы справляются с подобными нарушениями значительно хуже.
Больше трети сайтов не прошли проверку доступности. У 20,4% ресурсов изображения не имели текстовых описаний alt, хотя картинки могли содержать важную информацию. На 41,6% страниц отсутствовали метки ARIA, обозначающие основные области интерфейса. Программы чтения с экрана без подобных подсказок не всегда способны правильно передать структуру и назначение элементов.
Проблемы доступности грозят владельцам сайтов не только потерей части аудитории, но и юридическими претензиями. В Европе с 2025 года действует Европейский акт о доступности, а в США интернет-магазины уже сталкиваются с судебными разбирательствами из-за интерфейсов, непригодных для людей с нарушениями зрения.
Самой распространённой ошибкой оказалась неправильная вложенность тегов. Нарушение встретилось более чем на 59% сайтов. По оценке Дюкре, значительную часть некорректной разметки создают фронтенд-фреймворки во время сборки проекта, а не разработчики вручную.
Для исследования Дюкре написал собственный поисковый робот и подключил открытые инструменты HTML-validate, CSS Validator, Lightning CSS и fast-xml-parser. Разработчик самостоятельно поддерживает проект без команды, компании и внешнего финансирования.
Некорректный HTML редко приводит к заметной поломке страницы, поскольку браузеры умеют угадывать замысел разработчика и восстанавливать структуру документа. Подобная снисходительность позволяет ошибкам годами накапливаться в коде.
Последствия становятся заметнее за пределами браузера. Страницы читают программы экранного доступа, голосовые помощники, переводчики и ИИ-агенты, которым сложнее интерпретировать повреждённую структуру. Соблюдение стандартов помогает всем инструментам одинаково понимать содержимое страницы, а не полагаться на способность Chrome исправлять чужие ошибки.