Jak pracovat s URL v Python
URL vrstva Aspose.HTML FOSS pro Python implementuje parsování ve stylu WHATWG, takže URL nalezené v dokumentech jsou řešeny a normalizovány stejným způsobem, jakým je prohlížeče zpracovávají. Tento průvodce se zabývá parsováním, validací, řetězci dotazů a modelem selhání, přičemž pro instalaci používá pip.
Průvodce krok za krokem
Krok 1: Nainstalujte balíček
git clone https://github.com/aspose-html-foss/Aspose.HTML-FOSS-for-Python.git
cd Aspose.HTML-FOSS-for-Python
pip install -e .Krok 2: Importujte požadované třídy
from aspose_html.url import URL, URLSearchParamsKrok 3: Parsujte a ověřte
URL.parse() parsuje absolutní nebo relativní URL (s bází); URL.can_parse() odpovídá na platnost levně, aniž by vytvářel objekt; selhání parsování vyvolá typovaný URLParseError.
Krok 4: Upravit řetězce dotazů
URLSearchParams round-trips parametry dotazu — append(), get(), get_all(), has() a delete() — zachovává multi-hodnotovou semantiku pro opakované klíče.
Běžné problémy a opravy
Relativní URL se nepodařilo parsovat. Relativní parsování potřebuje základní URL — poskytněte ji URL.parse().
Vrátí se pouze první hodnota opakovaného klíče. get() vrací první shodu podle návrhu; použijte get_all() pro každou hodnotu.
Komponenty vypadají nečekaně normalizovaně nebo procentově kódované. WHATWG normalizace v akci — výstup odpovídá chování prohlížeče.
Často kladené otázky
Jak mohu ověřit URL, aniž bych ji parsoval?
URL.can_parse() vrací boolean bez konstrukce objektu.
Jsou klíče dotazů citlivé na velikost písmen?
Ano — klíče jsou porovnávány tak, jak jsou, v souladu se standardem URL.
Jaký typ chyby vyvolává selhání parsování?
Typovaný URLParseError — zachyťte jej místo předběžného ověřování regulárními výrazy.