Protocole TokenBench
Benchmarker sa carte
Une seule commande. Elle télécharge llama.cpp (release officielle) et le modèle de référence (~4,9 Go, une seule fois, cache dans ~/.tokenbench), lance le protocole standard, relève la télémétrie, puis publie le résultat.
Téléchargez notre logiciel
Bibliothèque de modèles, télémétrie en direct, tests soutenus avec courbes : téléchargez, double-cliquez, benchez.
Windows SmartScreen peut avertir au premier lancement (application non signée) : « Informations complémentaires » puis « Exécuter quand même ».
Vous ne voulez pas passer par le logiciel ? Suivez ces instructions
Prérequis
Node.js LTS et un GPU NVIDIA avec des pilotes à jour. C'est tout.
Windows : une fois, avant le premier lancement
PowerShell bloque les scripts par défaut (npx compris). Autorise-les pour ton compte — pas besoin d'être administrateur :
Set-ExecutionPolicy -ExecutionPolicy RemoteSigned -Scope CurrentUser
La commande
Windows (PowerShell), macOS ou Linux :
npx https://tokenbench.sephigame.fr/tokenbench-0.3.0.tgz --api-url https://tokenbench.sephigame.fr --token 'VOTRE-JETON'
Le jeton est OPTIONNEL : sans lui, la commande fonctionne à l'identique (retire simplement --token) et ta mesure arrive « en attente de modération » — elle apparaît sur le site après validation. Avec un jeton de confiance (contributeurs réguliers), publication immédiate. Guillemets simples autour du jeton : les caractères spéciaux ne survivent pas au shell sans eux.
Options utiles
--gpu-index 1 # machine multi-GPU : benchmarker la 2e carte --ref-only # uniquement le modèle de référence (rapide) --replay result.json # republier un résultat dont l'envoi a échoué --no-upload # mesurer sans publier --help # tout le reste
Ce qui est mesuré
Vitesse de génération et de lecture du prompt (llama-bench, pp512/tg128, 5 répétitions), pic de VRAM, températures et consommation électrique (nvidia-smi, échantillonné pendant le run). Rien n'est saisi à la main : ce qui entre en base a été mesuré.