Metodika
Celý postup je popsán tak, aby šel zopakovat a zkontrolovat. Zdrojová data i kód jsou ke stažení.
Zdroje textů
Česká jazyková znění předpisů Evropské unie pocházejí z repozitáře CELLAR Úřadu pro publikace EU
(publications.europa.eu/resource/celex/<CELEX>, obsahová negociace s hlavičkou
Accept-Language: ces). Tam, kde existuje konsolidované znění, se použilo to nejnovější;
přesný konsolidovaný identifikátor je uveden u každého páru. Česká znění jsou konsolidované texty ze
Zákonů pro lidi, stav k 18. srpnu 2026.
Počty vnitrostátních prováděcích opatření pocházejí z registru NIM Úřadu pro publikace EU, dotazem
SPARQL přes predikát cdm:measure_national_implementing_implements_resource_legal.
Pozor na dvě pasti: identifikátor CELEX je v grafu alias, takže je nutné projít přes
owl:sameAs; a totožnost opatření nese koncové číslo aliasu, ne alias sám — jeden uzel
nese desítky aliasů, po jednom za každou směrnici, kterou provádí. Prostý součet aliasů proto opatření
násobí.
Úprava textů před měřením
- Z unijních textů byly odstraněny body odůvodnění a hlavička Úředního věstníku. Srovnává se pouze normativní část, protože české zákony body odůvodnění nemají a jejich ponechání by unijní texty systematicky znevýhodnilo. U některých směrnic tvoří preambule přes polovinu textu.
- Z českých textů byl odstraněn obsah, navigace a patička webu.
- Hranice normativní části se hledá podle přijímací formule („PŘIJALY TUTO SMĚRNICI"). To ale u konsolidovaných znění selhává: ta formuli nemají vůbec, zato se v nich stejná věta objeví uvnitř vloženého pozdějšího předpisu — a řez podle ní uřízne většinu textu. Jeden pár tak byl měřen jen z poloviny směrnice, než to odhalila kontrola citací. Formule se proto přijímá jen tehdy, není-li před ní žádný nadpis článku na samostatném řádku; jinak se začíná prvním „Článek 1" v textu.
- Tam, kde je nositelem transpozice obecný kodex, bylo srovnání omezeno na příslušné paragrafy — u směrnice o právech spotřebitelů na § 1810 až 1867 občanského zákoníku, u rámcové směrnice o BOZP na § 101 až 108 zákoníku práce, u trestněprávní směrnice o praní peněz na § 216 a 217 trestního zákoníku, u směrnice o soukromí v elektronických komunikacích na § 87 až 104 zákona o elektronických komunikacích a u směrnice o skládkách na § 36 až 43 zákona o odpadech.
- Segmentace probíhá nejprve po řádcích a teprve pak na věty. Oba zdroje zapisují každou položku výčtu na samostatný řádek; kdyby se text nejprve slil, třicetipoložkový výčet by se stal jednou šestisetslovnou „větou". Směrnice jsou výčtovější než české zákony, takže by tenhle artefakt zkreslil každé srovnání — v první verzi analýzy obrátil výsledek u délky vět o opačné znaménko.
Měření srozumitelnosti
Všechny ukazatele se počítají identicky na obou korpusech, oba v češtině. Index obtížnosti je vážený součet sedmi složek: délka věty 25 %, podíl dlouhých slov 15 %, hustota křížových odkazů 20 %, podmínkové vazby 10 %, nominalizace 15 %, vedlejší věty 10 % a podíl vět nad 40 slov 5 %. Každá složka je ořezána na svém stropu, takže index leží mezi 0 a 100 a vyšší hodnota znamená hůře srozumitelný text.
Průměry napříč všemi 72 páry:
| Ukazatel | Předpisy EU | České předpisy | Rozdíl |
|---|---|---|---|
| Průměrná délka věty (slov) | 21.66 | 21.41 | -0.3 |
| Medián délky věty | 17.04 | 16.80 | -0.2 |
| Podíl vět nad 40 slov (%) | 11.46 | 10.83 | -0.6 |
| Slov se 4+ slabikami (%) | 21.18 | 21.69 | +0.5 |
| Křížové odkazy / 1000 slov | 30.34 | 34.88 | +4.5 |
| Podmínkové vazby / 1000 slov | 6.99 | 7.74 | +0.7 |
| Příkazy a zákazy / 1000 slov | 8.77 | 8.56 | -0.2 |
| Nominalizace / 1000 slov | 59.58 | 70.83 | +11.2 |
| Trpný rod / 1000 slov | 6.98 | 5.51 | -1.5 |
| Vedlejších vět na větu | 0.87 | 0.87 | -0.0 |
| INDEX OBTÍŽNOSTI | 47.52 | 52.26 | +4.7 |
Měření přísnosti
První kolo — nález
Pro každý pár prošel analytik oba texty ustanovení po ustanovení a zaznamenal rozdíly v devíti kategoriích (mechanismy). Nálezy opačným směrem, tedy kde je česká úprava mírnější, se zaznamenávají také.
Doložitelnost
Každý nález musí obsahovat doslovnou citaci z obou textů; tam, kde směrnice protějšek nemá, je uvedeno „SMĚRNICE MLČÍ". Všech 1034 nálezů prošlo strojovou kontrolou, že citace je doslovným podřetězcem zdrojového souboru. Kontrola se pouští po každé dávce znovu nad všemi páry, ne jen nad nově přidanými — právě tím se ukázalo, že u jednoho páru byl podkladový text směrnice uříznutý v půli, takže citace, které dřív seděly, náhle přestaly sedět. Text se opravil a pár se analyzoval znovu. Kontrola tedy nehlídá jen poctivost citací, ale i to, že se pod nimi nezměnil podklad.
Druhé kolo — pokus o vyvrácení
U každého nálezu s nejvyšší závažností se nezávislý ověřovatel pokusil nález vyvrátit, a to na šesti důvodech: unijní text má protějšek jinde (typicky v jiném článku nebo v příloze); český text je čten nesprávně nebo jej neutralizuje výjimka jinde; rozdíl je ve skutečnosti unijním právem vyžadován; jde o výslovně nabídnutou volbu členského státu; citace je vytržena z kontextu; nebo je závažnost nadhodnocená. Výsledek je u každého nálezu uveden.
Výsledek napříč souborem: 78 potvrzeno, 231 sníženo, 20 vyvráceno. Vysoký podíl snížení je záměr — první kolo má hledat, druhé krotit.
Indexy
Index zátěže je součet druhých mocnin výsledných závažností přísnějších nálezů, normalizovaný na 0–100 vůči nejvyšší hodnotě v souboru; kvadratická váha zajišťuje, aby jeden zásadní požadavek vážil víc než několik drobných. Index přísnosti je 0,67 × skóre po ověření + 0,33 × index zátěže.
Jak byl vybrán vzorek
První kolo (23 párů) bylo vybráno podle dopadu na podnikatele a podle toho, kde je gold-plating nejvíc předmětem sporu. Druhé kolo (24 párů) vzniklo strojově: prošel jsem všech 1985 platných zákonů z let 2004 a novějších, z textu každého vytáhl citované předpisy EU, vyloučil novelizační zákony a z výsledku vybral základní předpisy, kde je jedna směrnice jasnou kotvou transpozice.
Metoda stojí na tom, že české zákony musí podle Legislativních pravidel vlády transpozici deklarovat. Ověřil jsem ji proti ručně spárovaným párům: trefila 22 z 23. Jediná neshoda je legitimní — AML zákon dnes cituje přepracované nařízení 2023/1113 místo původního 2015/847.
Klíčové pravidlo pro čtení citací: v české citaci předpisu EU je rok vždy první — „(EU) 2019/1937", „2011/83/EU", „91/439/EHS". Druhé pole není nikdy rok.
Proč nešlo použít ISAP ani e-Sbírku
ISAP (isap.vlada.cz) má funkční veřejné JSON API a databáze Directory obsahuje 4 521 směrnic s identifikátorem CELEX, názvem, lhůtou pro implementaci a gestorem. Mapování na český předpis v ní ale není — srovnávací tabulky jsou v neveřejné části pro resorty.
Otevřená data e-Sbírky obsahují 46 537 aktů s identifikátory ELI. Pole
cis-esb-kompatibilita-eu existuje, ale je prázdné u všech 46 537 záznamů, a datová sada
odkazů (326 MB) neobsahuje jediný odkaz na EUR-Lex nebo CELEX. Vytěžení textu je proto jediná funkční
cesta.
Omezení
- Index přísnosti je expertní úsudek vyjádřený číslem. Je spolehlivý pro pořadí a pro určení, kde se zátěž koncentruje; není kalibrovaným měřením a rozdíl dvou nebo tří bodů mezi sousedními předpisy neznamená nic.
- Index obtížnosti se počítá stejně na obou korpusech, takže rozdíl mezi dvěma texty jednoho páru je vypovídající. Absolutní hodnota není ukotvena k žádné studii lidského porozumění a neměla by se citovat samostatně.
- U dvou párů je unijním nástrojem nařízení (GDPR, 2015/847). Pojem transpozice se na ně nevztahuje; měří se pouze národní nadstavba a hodnoty nejsou přímo srovnatelné se směrnicemi.
- U části párů se srovnává jen výřez nebo je český zákon mnohem širší než směrnice. Celkovou délku u nich srovnávat nelze; kvalita párování je uvedena u každého páru.
- Nálezy s nižší závažností neprošly druhým kolem ověření. Jsou doloženy citací, ale nikdo se je nepokusil vyvrátit.
- Zpřísnění nad rámec směrnice není samo o sobě protiprávní. U směrnic minimální harmonizace je výslovně dovolené. Výjimkou je směrnice o právech spotřebitelů, která je směrnicí maximální harmonizace — tam je přísnější národní pravidlo potenciálně neslučitelné s právem Unie.
- Analýza pracuje s textem, nikoli s praxí. Neříká nic o tom, jak jsou povinnosti vymáhány ani jaké náklady skutečně vznikají.
- Vzorek není náhodný a je vychýlený k předpisům s vysokým dopadem, takže spíš nadhodnocuje než podhodnocuje. Směr zjištění je konzistentní napříč všemi zkoumanými oblastmi; velikost efektu na české právo jako celek z něj extrapolovat nelze.
- Materiál není právním stanoviskem. Před jakýmkoli použitím je nutné ověřit aktuální znění obou předpisů.