Mercury 2.5 d'Inception Labs affiche 770 tokens/s à 0,25 $/1M input, sept fois plus rapide que la médiane
Résumé
Artificial Analysis mesure Mercury 2.5, le nouveau modèle propriétaire d'Inception Labs, à 770,4 tokens/seconde en sortie contre 108,6 pour la médiane des modèles comparables. Facturé 0,25 $/1M input et 0,75 $/1M output avec 90 % de rabais cache, 260K de contexte et raisonnement étendu, il ne score que 12 sur l'Intelligence Index, misant tout sur la latence et le prix.
Article original publié par artificialanalysis.ai
Lire l'article original →Titre original : Mercury 2.5 d'Inception Labs affiche 770 tokens/s à 0,25 $/1M input, sept fois plus rapide que la médiane