/** * Reader Mode - Mozilla Readability Integration * * Extracts clean article content from web pages using Mozilla's Readability.js. * This module strips navigation, ads, and boilerplate to return main article content. * * CRITICAL: Content extraction happens BEFORE sanitization. The pipeline is: * Playwright renders → Readability extracts → Sanitizer runs → Token ceiling applied */ import type { Result } from '../types.js'; /** * Result from reader mode extraction */ export interface ReaderResult { title: string; byline: string | null; publishedTime: string | null; content: string; excerpt: string | null; wordCount: number; readerModeAvailable: boolean; } /** * Extract clean article content using Mozilla Readability * * @param html - Rendered HTML from Playwright * @param url - Original URL (required for relative link resolution) * @returns Result containing extracted article or fallback to full HTML */ export declare function extractArticle(html: string, url: string): Result; //# sourceMappingURL=reader.d.ts.map