artificialanalysis.ai via Hacker News

Mercury 2.5 d'Inception Labs affiche 770 tokens/s à 0,25 $/1M input, sept fois plus rapide que la médiane

Résumé

Artificial Analysis mesure Mercury 2.5, le nouveau modèle propriétaire d'Inception Labs, à 770,4 tokens/seconde en sortie contre 108,6 pour la médiane des modèles comparables. Facturé 0,25 $/1M input et 0,75 $/1M output avec 90 % de rabais cache, 260K de contexte et raisonnement étendu, il ne score que 12 sur l'Intelligence Index, misant tout sur la latence et le prix.