← Vissza

● news.bsdnet.hu

Bábeli zűrzavar lesz úrrá a HTML-kódokban?

Bitport 2026-08-21 09:56
A világ legnépszerűbb webhelyeinek közel 90 százaléka sérti meg a HTML-szabványokat, derítette ki egy francia fejlesztő. Théo Ducreux indította el a ValidateHTML projektet , amelyben az 5000 leggyakrabban használt oldalt vizsgálta (ezeket a Tranco-lista alapján választotta ki.) Az oldalak között olyan oldalak is szerepeltek, mint a Google, a YouTube vagy az Akamai, de Ducreux projektje kiterjedt közvetlenül a felhasználóknak szánt tartalommal nem rendelkező domainekre is, melyek elsősorban átirányítási vagy háttérszolgáltatásokat nyújtanak. A vizsgált oldalak közül 2656 rendelkezett ember által olvasható kezdőlappal. Ezeknek jelentős része kisebb-nagyobb mértékben megsértette a World Wide Web Consortium (W3C) és a WHATWG által meghatározott HTML-szabványt. Ducreux több mint 100 ezer HTML-hibát, valamint közel 19 ezer CSS-hibát azonosított. Az oldalak 87,2 százalékánál talált legalább egy olyan elemet, amely megsértette a szabványt. Az oldalak 12,8 százalékának volt szabványos a HTML-kódja, de hibátlannak mindössze 2,6 százalékuk bizonyult. Az oldalak harmada nem akadálymentesíthető A projektben feltárt hibák elsősorban az akadálymentesítést nehezítik. A vizsgált oldalak több mint harmada nem ment át az akadálymentességi teszteken. Minden ötödik oldalról (20,4 százalék) hiányzott a képek alternatív szöveges leírása, ami különösen akkor okoz gondot, ha a kép fontos információt tartalmaz. Ennél is gyakoribb probléma, hogy az oldalak 41,6 százaléka nem használ megfelelő ARIA-címkéket az egyes területek és funkciók azonosítására. Emiatt a képernyőolvasók nehezebben tudják értelmezni és felolvasni az oldal szerkezetét. Ez azért probléma, mondta Ducreux , mert a képernyőolvasók kevésbé hibatűrők, mint például a Chrome. Azaz amit egy hagyományos böngésző gond nélkül megjelenít, egy segítő technológiát használó felhasználó számára már értelmezhetetlen lehet. A probléma részben a modern böngészők fejlett hibajavító képességére vezethető vissza. Ha egy weboldal kódja hibás, a böngésző megpróbálja kitalálni, mire gondolt a "szerző", majd a megfejtés szellemében felépíti a dokumentum objektummodelljét. Emiatt a hibás kódnak nem lesz látható következménye, és a fejlesztő sem fog utánajárni, hogy minden rendben van-e. A leggyakoribb hibák egyébként nem a kézzel írt kódban találhatók, hanem a modern front-end keretrendszerek fordítási folyamatából származnak. Az oldalak több mint 59 százalékában volt elembeágyazási hiba. A mesterséges intelligencia is szenved A nem szabványos kódon nemcsak a képernyőolvasók akadnak fenn. A hangasszisztensek, a fordítórendszerek és az MI-ügynökök dolgát is megnehezíti, mivel nem feltétlenül rendelkeznek a Chrome-éhoz hasonló hatékonysággal működő hibajavító logikájával. Persze fel lehet hozni érvként, hogy a szabálytalan HTML önmagában nem veszélyezteti a web működését. Az azonban már most is látszik, hogy a böngésző által javítható hibák egyre több felhasználót és informatikai rendszert zárhatnak ki a webes tartalmak megfelelő értelmezéséből. Egy szabványos HTML-oldal tehát nem egyszerűen szebb vagy technikailag elegánsabb, hanem nagyobb eséllyel ugyanazt jelenti minden feldolgozó rendszer számára.
Eredeti cikk megtekintése →