/** * Vector Quantization Module * * Scalar Quantization으로 임베딩 저장 공간 절감. * - Float32: 50% 절감 (float64 → float32) * - Int8: 87.5% 절감 (float64 → int8) */ export type QuantizationLevel = 'none' | 'float32' | 'int8'; export interface QuantizationStats { min: number; max: number; dimensions: number; } /** * Float32 양자화 (float64 → float32, 50% 저장 공간 절감) */ export declare function quantizeToFloat32(embedding: number[]): Buffer; /** * Float32 역양자화 (buffer → number[]) */ export declare function dequantizeFromFloat32(buffer: Buffer): number[]; /** * Int8 양자화 (float64 → int8, 87.5% 저장 공간 절감) * Min-Max Scaling: value → round((value - min) / (max - min) * 255) - 128 */ export declare function quantizeToInt8(embedding: number[], stats?: QuantizationStats): { buffer: Buffer; stats: QuantizationStats; }; /** * Int8 역양자화 (buffer + stats → number[]) */ export declare function dequantizeFromInt8(buffer: Buffer, stats: QuantizationStats): number[]; //# sourceMappingURL=quantization.d.ts.map