journal
2026-08-21·12 min de lecture
Quantifier ou élaguer un LLM pour le faire tourner sur un téléphone semble indolore : la précision moyenne bouge à peine. Un papier arXiv montre pourtant que la compression redistribue les connaissances de façon asymétrique, laisse le modèle confiant dans ses erreurs et déplace ses biais sans que les scores globaux ne bronchent.