anthropic.com via Hacker News

Anthropic lance Claude Opus 5 au prix inchangé d'Opus 4.8

4 médias qui couvrent ce sujet

TL;DR

  • Opus 5 outscored Fable 5 on 8 benchmark tests despite costing 50% less, per SiliconANGLE, giving buyers a concrete performance-per-dollar inversion at the top of the market.
  • Guardrail activations drop 85% versus the predecessor, addressing the most common enterprise objection to deploying Fable 5 in production.
  • Opus 5 scored zero on Anthropic's internal vulnerability-exploitation benchmark, adding a safety argument alongside the cost argument.

Le geste intéressant chez Anthropic ce vendredi n'est pas un score de leaderboard, c'est le prix. Selon l'annonce publiée le 24 juillet 2026, Claude Opus 5 conserve exactement la grille d'Opus 4.8, 5 $ le million de tokens en entrée et 25 $ en sortie, alors que l'entreprise revendique une intelligence proche de son propre modèle de frontière, Claude Fable 5, pour la moitié du prix.

Les chiffres avancés sont massifs si on les prend tels que la société les rapporte. Sur CursorBench 3.2 en effort maximal, Opus 5 se situerait à 0,5 % de Fable 5. Sur OSWorld 2.0, il dépasserait Fable 5 pour un tiers du coût. Il triplerait le score du meilleur concurrent sur ARC-AGI 3 et doublerait Opus 4.8 sur Frontier-Bench v0.1. Les partenaires commerciaux cités appuient le message : Devin décrit un modèle qui « approche la performance de Fable pour la moitié du coût », Cursor évoque une « intelligence proche de Fable 5 à la vitesse et au prix d'Opus », Zapier revendique 100 % de succès sur des séquences de prévention de churn où les modèles précédents échouaient. Box mesure un gain de 8 % sur Opus 4.8, Lovable un +22 % sur Opus 4.7 en coding agentique.

Anthropic revendique aussi le meilleur score d'alignement de sa gamme, 2,3 sur son audit comportemental interne, mieux qu'Opus 4.8, Sonnet 5 ou Fable 5. Le caveat honnête est que ces benchmarks sont soit maison, soit produits par des clients qui vendent des produits construits sur Claude, à prendre comme rapportés et non comme établis. Anthropic reconnaît par ailleurs rester derrière un concurrent nommé Mythos 5 sur le développement d'exploits de vulnérabilités comme sur la recherche biologique autonome, et bascule automatiquement les requêtes cyber sensibles vers Opus 4.8 par défaut sur Claude.ai, Claude Code et Claude Cowork. Ce que l'annonce ne dit pas non plus : qui édite Fable 5 et Mythos 5, quelle est la fenêtre de contexte, ou l'échelle réelle du score d'alignement à 2,3.

Ce qui vaut la peine d'être surveillé dans les prochaines semaines, c'est moins le communiqué que les grilles tarifaires de Cursor, Devin, Zapier, Box et Lovable. Si la promesse coût/capacité tient hors benchmarks maison, la marge se déplace vers l'aval, et les abonnés Claude Max qui héritent d'Opus 5 comme nouveau modèle par défaut deviennent les premiers témoins grandeur nature.

Ce qu'en disent les autres médias

Couverture consolidée 24h après publication

  1. Fortune Lire →

    Frames the launch as a response to enterprise bill shock and Fable 5 controversies; includes Hugging Face CEO commentary on the defender-vs-misuse tradeoff.

    Opus 5 'comes close' to the capabilities of Fable 5, but at half the price, according to Anthropic.
  2. TechCrunch Lire →

    Spotlights Automatic Fallbacks as an operational detail: requests that hit safety classifiers route to lighter models rather than erroring, a developer-facing reliability change.

    much stronger at verifying its work and iterating carefully until it succeeds
  3. SiliconANGLE Lire →

    Leads with the self-verification demo: Opus 5 built a computer vision pipeline to validate a 3D schematic it generated without visual access, illustrating agentic reliability claims with a concrete example.

    Opus 5 scored higher on eight of the tests despite costing about 50% less

Shared on Bluesky by 9 AI experts (top 5 by trust)