@vouchington/crawler-html
v0.0.1
Published
HTML content decoding and extraction for crawlers.
Readme
@vouchington/crawler-html
Pure HTML response decoding and content extraction using Vurst. Transport, SSRF policy, cache, and response-size limits remain application concerns.
import { extractHtmlContent } from '@vouchington/crawler-html'Provenance
Generalized from Filaments revision 2bd1d813f858da613fa89eec76037379503d9fd1, primarily
backend/modules/crawler-html/index.mts and backend/modules/crawler-html/types.mts.
