Jak pracovat s URL v Python

Jak pracovat s URL v Python

URL vrstva Aspose.HTML FOSS pro Python implementuje parsování ve stylu WHATWG, takže URL nalezené v dokumentech jsou řešeny a normalizovány stejným způsobem, jakým je prohlížeče zpracovávají. Tento průvodce se zabývá parsováním, validací, řetězci dotazů a modelem selhání, přičemž pro instalaci používá pip.

Průvodce krok za krokem

Krok 1: Nainstalujte balíček

git clone https://github.com/aspose-html-foss/Aspose.HTML-FOSS-for-Python.git
cd Aspose.HTML-FOSS-for-Python
pip install -e .

Krok 2: Importujte požadované třídy

from aspose_html.url import URL, URLSearchParams

Krok 3: Parsujte a ověřte

URL.parse() parsuje absolutní nebo relativní URL (s bází); URL.can_parse() odpovídá na platnost levně, aniž by vytvářel objekt; selhání parsování vyvolá typovaný URLParseError.


Krok 4: Upravit řetězce dotazů

URLSearchParams round-trips parametry dotazu — append(), get(), get_all(), has() a delete() — zachovává multi-hodnotovou semantiku pro opakované klíče.

Běžné problémy a opravy

Relativní URL se nepodařilo parsovat. Relativní parsování potřebuje základní URL — poskytněte ji URL.parse().

Vrátí se pouze první hodnota opakovaného klíče. get() vrací první shodu podle návrhu; použijte get_all() pro každou hodnotu.

Komponenty vypadají nečekaně normalizovaně nebo procentově kódované. WHATWG normalizace v akci — výstup odpovídá chování prohlížeče.

Často kladené otázky

Jak mohu ověřit URL, aniž bych ji parsoval?

URL.can_parse() vrací boolean bez konstrukce objektu.

Jsou klíče dotazů citlivé na velikost písmen?

Ano — klíče jsou porovnávány tak, jak jsou, v souladu se standardem URL.

Jaký typ chyby vyvolává selhání parsování?

Typovaný URLParseError — zachyťte jej místo předběžného ověřování regulárními výrazy.

Viz také:

 Čeština