Weight Quantization
Verificato
Significato di «Weight Quantization»
Riduzione della precisione numerica con cui sono rappresentati i pesi (per esempio da 32 bit a 8 bit o meno); diminuisce l'occupazione di memoria e accelera l'inferenza, di solito con una minima perdita di accuratezza.
Fonti: Quantizzazione dei pesi per l'efficienza. Fonti: Jacob et al., 'Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only Inference' (arXiv:1712.05877, CVPR 2018); documentazione PyTorch, torch.quantization. Verifica web 2026-08-03. · Verificato il 2026-08-03