Bábeli zűrzavar lesz úrrá a HTML-kódokban?
Bitport
2026-08-21 09:56
A világ legnépszerűbb webhelyeinek közel 90 százaléka sérti meg a HTML-szabványokat, derítette ki egy francia fejlesztő. Théo Ducreux indította el a ValidateHTML projektet , amelyben az 5000 leggyakrabban használt oldalt vizsgálta (ezeket a Tranco-lista alapján választotta ki.) Az oldalak között olyan oldalak is szerepeltek, mint a Google, a YouTube vagy az Akamai, de Ducreux projektje kiterjedt közvetlenül a felhasználóknak szánt tartalommal nem rendelkező domainekre is, melyek elsősorban átirányítási vagy háttérszolgáltatásokat nyújtanak.
A vizsgált oldalak közül 2656 rendelkezett ember által olvasható kezdőlappal. Ezeknek jelentős része kisebb-nagyobb mértékben megsértette a World Wide Web Consortium (W3C) és a WHATWG által meghatározott HTML-szabványt. Ducreux több mint 100 ezer HTML-hibát, valamint közel 19 ezer CSS-hibát azonosított. Az oldalak 87,2 százalékánál talált legalább egy olyan elemet, amely megsértette a szabványt. Az oldalak 12,8 százalékának volt szabványos a HTML-kódja, de hibátlannak mindössze 2,6 százalékuk bizonyult.
Az oldalak harmada nem akadálymentesíthető
A projektben feltárt hibák elsősorban az akadálymentesítést nehezítik. A vizsgált oldalak több mint harmada nem ment át az akadálymentességi teszteken. Minden ötödik oldalról (20,4 százalék) hiányzott a képek alternatív szöveges leírása, ami különösen akkor okoz gondot, ha a kép fontos információt tartalmaz. Ennél is gyakoribb probléma, hogy az oldalak 41,6 százaléka nem használ megfelelő ARIA-címkéket az egyes területek és funkciók azonosítására. Emiatt a képernyőolvasók nehezebben tudják értelmezni és felolvasni az oldal szerkezetét.
Ez azért probléma, mondta Ducreux , mert a képernyőolvasók kevésbé hibatűrők, mint például a Chrome. Azaz amit egy hagyományos böngésző gond nélkül megjelenít, egy segítő technológiát használó felhasználó számára már értelmezhetetlen lehet.
A probléma részben a modern böngészők fejlett hibajavító képességére vezethető vissza. Ha egy weboldal kódja hibás, a böngésző megpróbálja kitalálni, mire gondolt a "szerző", majd a megfejtés szellemében felépíti a dokumentum objektummodelljét. Emiatt a hibás kódnak nem lesz látható következménye, és a fejlesztő sem fog utánajárni, hogy minden rendben van-e.
A leggyakoribb hibák egyébként nem a kézzel írt kódban találhatók, hanem a modern front-end keretrendszerek fordítási folyamatából származnak. Az oldalak több mint 59 százalékában volt elembeágyazási hiba.
A mesterséges intelligencia is szenved
A nem szabványos kódon nemcsak a képernyőolvasók akadnak fenn. A hangasszisztensek, a fordítórendszerek és az MI-ügynökök dolgát is megnehezíti, mivel nem feltétlenül rendelkeznek a Chrome-éhoz hasonló hatékonysággal működő hibajavító logikájával.
Persze fel lehet hozni érvként, hogy a szabálytalan HTML önmagában nem veszélyezteti a web működését. Az azonban már most is látszik, hogy a böngésző által javítható hibák egyre több felhasználót és informatikai rendszert zárhatnak ki a webes tartalmak megfelelő értelmezéséből. Egy szabványos HTML-oldal tehát nem egyszerűen szebb vagy technikailag elegánsabb, hanem nagyobb eséllyel ugyanazt jelenti minden feldolgozó rendszer számára.