EN
en direct
tag

#tokenizers

Hugging Face réécrit tokenizers en Rust avec du SIMD et encodage jusqu’à 30 fois plus vite

Le 21 septembre 2026, Hugging Face détaille la version 1 de sa bibliothèque tokenizers : même sortie que la v0.23, mais un encodage 3 à 30 fois plus rapide en monothread sur un Apple M4 Max grâce à un découpage par bitstream SIMD et un cache de mots. Les équipes qui servent du LLM ont une raison mesurée de regarder le tokenizer, devenu le nouveau goulot à mesure que les modèles accélèrent.

Tapez au moins deux caractères.

↑ ↓ naviguer ↵ ouvrir esc fermer