Gold-plating.eu

Metodika

Celý postup je popsán tak, aby šel zopakovat a zkontrolovat. Zdrojová data i kód jsou ke stažení.

Zdroje textů

Česká jazyková znění předpisů Evropské unie pocházejí z repozitáře CELLAR Úřadu pro publikace EU (publications.europa.eu/resource/celex/<CELEX>, obsahová negociace s hlavičkou Accept-Language: ces). Tam, kde existuje konsolidované znění, se použilo to nejnovější; přesný konsolidovaný identifikátor je uveden u každého páru. Česká znění jsou konsolidované texty ze Zákonů pro lidi, stav k 18. srpnu 2026.

Počty vnitrostátních prováděcích opatření pocházejí z registru NIM Úřadu pro publikace EU, dotazem SPARQL přes predikát cdm:measure_national_implementing_implements_resource_legal. Pozor na dvě pasti: identifikátor CELEX je v grafu alias, takže je nutné projít přes owl:sameAs; a totožnost opatření nese koncové číslo aliasu, ne alias sám — jeden uzel nese desítky aliasů, po jednom za každou směrnici, kterou provádí. Prostý součet aliasů proto opatření násobí.

Úprava textů před měřením

Měření srozumitelnosti

Všechny ukazatele se počítají identicky na obou korpusech, oba v češtině. Index obtížnosti je vážený součet sedmi složek: délka věty 25 %, podíl dlouhých slov 15 %, hustota křížových odkazů 20 %, podmínkové vazby 10 %, nominalizace 15 %, vedlejší věty 10 % a podíl vět nad 40 slov 5 %. Každá složka je ořezána na svém stropu, takže index leží mezi 0 a 100 a vyšší hodnota znamená hůře srozumitelný text.

Průměry napříč všemi 72 páry:

UkazatelPředpisy EU České předpisyRozdíl
Průměrná délka věty (slov)21.6621.41-0.3
Medián délky věty17.0416.80-0.2
Podíl vět nad 40 slov (%)11.4610.83-0.6
Slov se 4+ slabikami (%)21.1821.69+0.5
Křížové odkazy / 1000 slov30.3434.88+4.5
Podmínkové vazby / 1000 slov6.997.74+0.7
Příkazy a zákazy / 1000 slov8.778.56-0.2
Nominalizace / 1000 slov59.5870.83+11.2
Trpný rod / 1000 slov6.985.51-1.5
Vedlejších vět na větu0.870.87-0.0
INDEX OBTÍŽNOSTI47.5252.26+4.7

Měření přísnosti

První kolo — nález

Pro každý pár prošel analytik oba texty ustanovení po ustanovení a zaznamenal rozdíly v devíti kategoriích (mechanismy). Nálezy opačným směrem, tedy kde je česká úprava mírnější, se zaznamenávají také.

Doložitelnost

Každý nález musí obsahovat doslovnou citaci z obou textů; tam, kde směrnice protějšek nemá, je uvedeno „SMĚRNICE MLČÍ". Všech 1034 nálezů prošlo strojovou kontrolou, že citace je doslovným podřetězcem zdrojového souboru. Kontrola se pouští po každé dávce znovu nad všemi páry, ne jen nad nově přidanými — právě tím se ukázalo, že u jednoho páru byl podkladový text směrnice uříznutý v půli, takže citace, které dřív seděly, náhle přestaly sedět. Text se opravil a pár se analyzoval znovu. Kontrola tedy nehlídá jen poctivost citací, ale i to, že se pod nimi nezměnil podklad.

Druhé kolo — pokus o vyvrácení

U každého nálezu s nejvyšší závažností se nezávislý ověřovatel pokusil nález vyvrátit, a to na šesti důvodech: unijní text má protějšek jinde (typicky v jiném článku nebo v příloze); český text je čten nesprávně nebo jej neutralizuje výjimka jinde; rozdíl je ve skutečnosti unijním právem vyžadován; jde o výslovně nabídnutou volbu členského státu; citace je vytržena z kontextu; nebo je závažnost nadhodnocená. Výsledek je u každého nálezu uveden.

Výsledek napříč souborem: 78 potvrzeno, 231 sníženo, 20 vyvráceno. Vysoký podíl snížení je záměr — první kolo má hledat, druhé krotit.

Indexy

Index zátěže je součet druhých mocnin výsledných závažností přísnějších nálezů, normalizovaný na 0–100 vůči nejvyšší hodnotě v souboru; kvadratická váha zajišťuje, aby jeden zásadní požadavek vážil víc než několik drobných. Index přísnosti je 0,67 × skóre po ověření + 0,33 × index zátěže.

Jak byl vybrán vzorek

První kolo (23 párů) bylo vybráno podle dopadu na podnikatele a podle toho, kde je gold-plating nejvíc předmětem sporu. Druhé kolo (24 párů) vzniklo strojově: prošel jsem všech 1985 platných zákonů z let 2004 a novějších, z textu každého vytáhl citované předpisy EU, vyloučil novelizační zákony a z výsledku vybral základní předpisy, kde je jedna směrnice jasnou kotvou transpozice.

Metoda stojí na tom, že české zákony musí podle Legislativních pravidel vlády transpozici deklarovat. Ověřil jsem ji proti ručně spárovaným párům: trefila 22 z 23. Jediná neshoda je legitimní — AML zákon dnes cituje přepracované nařízení 2023/1113 místo původního 2015/847.

Klíčové pravidlo pro čtení citací: v české citaci předpisu EU je rok vždy první — „(EU) 2019/1937", „2011/83/EU", „91/439/EHS". Druhé pole není nikdy rok.

Proč nešlo použít ISAP ani e-Sbírku

ISAP (isap.vlada.cz) má funkční veřejné JSON API a databáze Directory obsahuje 4 521 směrnic s identifikátorem CELEX, názvem, lhůtou pro implementaci a gestorem. Mapování na český předpis v ní ale není — srovnávací tabulky jsou v neveřejné části pro resorty.

Otevřená data e-Sbírky obsahují 46 537 aktů s identifikátory ELI. Pole cis-esb-kompatibilita-eu existuje, ale je prázdné u všech 46 537 záznamů, a datová sada odkazů (326 MB) neobsahuje jediný odkaz na EUR-Lex nebo CELEX. Vytěžení textu je proto jediná funkční cesta.

Omezení