Sommaire du guide
Autres ressources

Retour d'expérience outillé

Sortir d'Anthropic en direct
ce que Back Market mesure, et ce que les autres sources en disent

Deux comptes rendus de Nicolas M sur la sortie de l'API Anthropic en direct, confrontés aux autres vidéos publiques qui parlent d'OpenRouter et à sa documentation.

Dossier documenté · Sources et mesures datées dans chaque chapitre

À retenir

Consulter le glossaire

Les termes en pointillés donnent leur définition au survol, au clavier ou au toucher.

I

Le cas Back Market

01

La facture Anthropic passe de 57 k$ à 87 k$ en un mois

La dépense double presque en un mois, avant tout problème technique.

Nicolas M ouvre sur ce qu'il appelle « là où ça fait mal ». En mai 2026, environ 230 à 240 développeurs consomment 57 k$ d'API Anthropic, uniquement via Claude Code. En juin, le même périmètre passe à 87 k$.

Il parle en responsable du déploiement : « Imaginez ceci, 250 développeurs pendant 1 an qui peuvent utiliser Claude Code sans aucune limite de budget avec une facturation à l'usage. » Le rôle assigné est de déployer l'outil et de former, pendant que la dépense grimpe.

Plus de tokens ne veut pas dire plus de valeur « On se rend compte rapidement que le fait de dépenser beaucoup de tokens et donc beaucoup d'argent n'a pas forcément un rapport direct avec la valeur que l'on génère. » Tout le dispositif décrit ensuite cherche à relier la dépense à un résultat.

La décision est prise de quitter l'accès Anthropic en direct. L'usage d'OpenRouter démarre le 18 juin 2026, la généralisation intervient fin juillet.

02

La dépense mensuelle tombe de 87 k$ à 23 k$

Les 2 colonnes de facturation se lisent mois par mois, sans interruption de service pour les utilisateurs.

Nicolas M montre les 2 consoles en parallèle. La colonne Anthropic s'éteint pendant que la colonne OpenRouter monte, sur la même population d'utilisateurs.

Chiffres lus à l'écran dans la vidéo de Nicolas M du 14 septembre 2026.
Dépense mensuelle par canal, telle que lue à l'écran dans la vidéo
Mois 2026Anthropic en directOpenRouterCommentaire
Mai57 k$pas encore utilisé230 à 240 utilisateurs Claude Code
Juin87 k$démarrage le 18 juinLe pic qui déclenche la décision
Juillet25 k$21 k$Le montant OpenRouter couvre le 18 juin au 31 juillet
Août574 $23 k$Mois de référence pour toutes les analyses de la vidéo
Septembre17 $non communiquéRelevé au 9 septembre environ
Une comparaison à lire avec précaution Le chiffre de 21 k$ couvre 6 semaines, du 18 juin au 31 juillet, et non un mois calendaire. La seule comparaison mois contre mois propre oppose juin chez Anthropic à août chez OpenRouter, et c'est celle que Nicolas M retient.

À la question d'un arrêt de l'IA, il répond : « Est-ce que vous avez arrêté d'utiliser l'IA ? Non, tous ces gens-là ont été transférés sur OpenRouter. » La colonne Anthropic baisse parce que l'usage est passé sur OpenRouter.

DIAGRAMME · Avant et après la passerelle
Le même poste de travail, 2 chemins d'approvisionnement. La passerelle n'ajoute pas un modèle, elle ouvre un catalogue.
03

Un contrat unique avec l'agrégateur ne transfère pas la responsabilité

La vidéo du 22 juillet 2026, antérieure au bilan, pose la contrainte juridique que les chiffres ne montrent pas.

Le bilan de septembre n'est pas le premier épisode. Le 22 juillet 2026, Nicolas M avait déjà expliqué le mécanisme, et surtout ce qu'il coûte en travail juridique. C'est la partie que les tableaux de dépense ne montrent jamais.

Son argument commercial est clair : « vous en tant qu'entreprise vous allez avoir qu'un seul contrat avec Open Router et vous n'aurez pas forcément besoin d'avoir ensuite un contrat avec tous les fournisseurs qu'il y a derrière ».

OpenRouter ne répond pas de ce que font les providers « Il faut faire très attention juridiquement. En fait, il y a une chaîne de responsabilité et Open Router ne va pas porter pour vous ce qui se passe chez Fireworks, chez Google Vertex ou chez Amazon Bedrock. Il y a une histoire que chacun reste chez soi. » Chaque provider reste responsable de ses propres traitements.
Schéma établi d'après la vidéo de Nicolas M du 22 juillet 2026.

Il en tire une règle : « si vous routez vers 10 providers, vous avez 10 politiques de données à vérifier ». Il précise à l'oral qu'il s'agit bien des providers et non des modèles, corrigeant une coquille de sa propre diapositive.

Ce que la vidéo du 22 juillet 2026 établit sur le catalogue
ÉlémentValeurFiabilité
Providers disponibles chez OpenRouter« à peu près 70 aujourd'hui »Audible dans la vidéo
Providers retenus et autorisés par Back Marketnon lisibleLe sous-titre rend le nombre par « H »
Providers nommés en juilletGoogle Vertex, Fireworks, Amazon BedrockCités explicitement
Providers nommés en septembre+ Microsoft Azure, MistralCités explicitement
Providers utilisés en septembre« une dizaine »Audible dans la vidéo
Pourquoi le décompte exact reste ouvert Juillet parle des providers « short listés et autorisés », septembre de ceux « avec lesquels on travaille ». Ce ne sont pas la même question. La liste autorisée est un sur-ensemble de la liste utilisée. Le chiffre de septembre resserre l'ordre de grandeur à environ 10 sur 70, il ne donne pas la taille de l'autorisation.

Le même épisode définit au passage le vocabulaire que la suite emploie : un modèle frontière l'est « parce qu'en fait c'est un modèle très puissant et qui ne peut pas tourner aujourd'hui dans votre infrastructure ou sur un provider, et c'est surtout un modèle qui est privé ».

Anthropic est alors le seul à héberger les modèles Claude. La bascule vers OpenRouter ne change pas cela. Elle n'ouvre pas Claude à d'autres hébergeurs, elle ouvre l'usage à d'autres modèles.

II

Pourquoi la facture baisse

04

GLM 5.2 absorbe 53 % des tokens pour 35 % de la facture

Back Market paie moins parce qu'il consomme d'autres modèles que ceux d'Anthropic.

L'économie vient des modèles consommés « On paye pas moins cher parce qu'on a un prix plus intéressant chez Anthropic. On paye moins cher parce qu'en fait on utilise plus uniquement les modèles Anthropic, on utilise d'autres modèles. » Selon lui, le prix des modèles Claude ne baisse pas en passant par OpenRouter.

En août, Nicolas M croise 2 vues de la même console, la répartition en montant dépensé et la répartition en volume de tokens. Un modèle qui pèse plus en tokens qu'en dépense coûte moins cher au token que la moyenne du mix.

Août 2026, répartition par modèle telle qu'annoncée dans la vidéo
ModèlePart des tokensPart de la factureMontant cité
GLM 5.2 (open weight)53 %35 %plus de 8 k$
Sonnet 58 %non chiffréà peine 2 k$
Opusnon chiffrénon chiffré« a pas mal disparu du radar »
Gemini, GPT« loin derrière »non chiffrénon chiffré
Répartition annoncée par Nicolas M pour août 2026, vidéo du 14 septembre 2026.

GLM 5.2 est à la fois le modèle le plus utilisé et, selon ses mots, « le modèle aussi qui va coûter le plus cher » parmi ceux qui portent le volume. Mais quand on trie par argent plutôt que par tokens, Sonnet et Opus remontent dans le classement malgré leur faible volume.

D'où sa conclusion : « les modèles d'Anthropic sont vraiment vraiment chers, même quand vous passez par OpenRouter ».

Il prend soin de ne pas surinterpréter la disparition d'Opus : « le coût a été réduit pas parce qu'on s'en sert moins mais parce que simplement on a accès à plus de providers ». Il répond aussi à l'objection productivité : « les utilisateurs n'ont pas perdu soudainement leur productivité ou leur usage ».

Vitesse : plus rapides sur les tâches simples, moins bons sur les longues

La vitesse est pour lui un critère sous-estimé : « les modèles d'OpenAI sont plus rapides. Le nombre de tokens par seconde qui sont générés par ces modèles sont plus rapides et une session de travail va prendre moins de temps parce que vous allez moins attendre. » Même impression sur GLM 5.2.

Sur des tâches complexes et longues, il constate que ces modèles « tirent un peu la patte » ou « font un peu n'importe quoi », et « restent quand même moins bons en terme d'intelligence que les modèles Anthropic ». Sur des tâches simples en revanche, « ça marche super bien ».

Back Market segmente donc l'usage par difficulté de tâche.

Une équipe dont la charge est majoritairement complexe ne devrait pas attendre le même facteur. Le guide AI Unit Economics détaille ce routage par complexité et ses risques, dont la perte du cache quand le modèle change en cours de tâche.

05

Les tarifs publics confirment un rapport de 5,7 entre GLM 5.2 et Opus 4.8

Le catalogue OpenRouter au 16 septembre 2026 permet de contrôler les ordres de grandeur avancés.

Aucun accès à la console de Back Market n'est nécessaire. Le catalogue OpenRouter est public et non authentifié, et son affirmation sur le prix des modèles Anthropic s'y vérifie.

Tarifs relevés sur https://openrouter.ai/api/v1/models le 16 septembre 2026, en dollars par million de tokens
IdentifiantEntréeSortieRapport sortie vs GLM 5.2
z-ai/glm-5.3-flash0,09 $0,30 $0,07
z-ai/glm-5.21,40 $4,40 $référence
anthropic/claude-haiku-4.51,00 $5,00 $1,1
anthropic/claude-sonnet-52,00 $10,00 $2,3
anthropic/claude-opus-4.85,00 $25,00 $5,7
Ce que le rapport de 5,7 change Un token de sortie Opus 4.8 coûte 5,7 fois un token de sortie GLM 5.2. Déplacer du volume de l'un vers l'autre fait baisser la facture, sans remise ni renégociation.
GLM 5.2 coûte 15 fois le prix de GLM 5.3 Flash Le million en sortie y est facturé 4,40 $, contre 0,30 $ chez z-ai/glm-5.3-flash. Entre 2 modèles open weight de la même famille, l'écart de prix dépasse celui qui sépare GLM 5.2 de Sonnet 5.
Le prix catalogue ne comprend pas les frais de plateforme OpenRouter prélève 5,5 % en paiement à l'usage et 8 % en offre Business ; l'offre Enterprise ouvre des remises. Avec ses propres clés de fournisseur (BYOK), les 25 k$ premiers de consommation mensuelle au prix catalogue sont sans frais (200 k$ en Enterprise), puis 5 % au-delà. La vidéo ne précise pas l'offre souscrite par Back Market, donc pas le taux appliqué à ses 23 k$ mensuels. Source : tarifs OpenRouter, relevés le 17/09/2026.
06

Une dizaine de providers et une ventilation automatique au prix du token

Ce que la passerelle fait à la place de l'équipe, et ce qu'elle ne fait pas.

Back Market travaille avec une dizaine de providers, dont Microsoft Azure, Amazon Bedrock, Google, Fireworks et Mistral. Nicolas M note que Mistral héberge aussi du GLM 5.2 : « vous pouvez aller taper sur l'infrastructure Mistral » pour consommer un modèle chinois depuis une infrastructure européenne.

Sa définition, pour qui confond les 2 niveaux : « un provider c'est comme un hébergeur internet qui aurait plein de sites internet, et chaque site internet en fait ce sont les fameux modèles ».

DIAGRAMME · Ce que la passerelle arbitre
Le développeur demande un modèle. OpenRouter choisit chez qui l'exécuter. Le seul critère de répartition cité dans la vidéo est le prix du token.

Il décrit l'arbitrage : « cette ventilation, elle est faite automatiquement par OpenRouter selon aussi le prix du token. Parfois c'est plus intéressant d'aller chercher chez Microsoft un accès à OpenAI que de l'avoir en direct, et parfois c'est l'inverse. » Le bénéfice qu'il retient est opérationnel plus que financier : « moi, en tant qu'utilisateur, j'ai pas besoin de m'ennuyer ».

Le critère qui écarte des modèles bien classés Des modèles Tencent montent dans le classement d'OpenRouter mais restent inutilisables chez eux : ils « ne sont pas encore disponibles sur des providers en Europe en zero data retention ». La contrainte ZDR filtre le catalogue avant le prix. Une équipe sans exigence ZDR a accès à davantage de modèles.

Côté OpenRouter, ces contraintes passent par des paramètres de routage documentés. zdr: true limite une requête aux endpoints sans rétention de données, data_collection: "deny" écarte les providers qui conservent des données. La liste only restreint le routage à des providers nommés, à l'intérieur de ceux autorisés au niveau du compte. C'est l'équivalent technique de la liste courte de Back Market décrite en partie I. Par défaut, OpenRouter répartit la charge en favorisant les providers les moins chers, pondérés par l'inverse du carré de leur prix. Source : documentation du routage par provider.

Rendre un poste de travail indépendant d'un fournisseur de modèles demande davantage qu'une URL de passerelle. L'article « Portability becomes a Scale concern » décrit ce qui survit à une migration contrôlée d'un fournisseur à l'autre.

07

Le blended cost par million de tokens recule de 13 % en un mois

L'indicateur unique que Nicolas M retient pour piloter, et ce qu'il prouve exactement.

Sa métrique préférée s'affiche en haut à droite de la console OpenRouter, le blended dollar per million. Entre juillet et août, il recule de 13 %.

Indicateur affiché par la console OpenRouter, cité par Nicolas M dans la vidéo du 14 septembre 2026.

Son interprétation : « mes utilisateurs pour un million de tokens ont payé moins cher que le mois d'avant, et je suppose que du coup ils ont utilisé des modèles moins chers. Pour mesurer l'efficience d'une entreprise et de 245-250 utilisateurs, c'est plutôt un bon indicateur. »

Le blended cost ne mesure ni le volume, ni la facture, ni la qualité Il mesure un déplacement du mix de modèles, à volume de tokens donné. Le blended peut donc baisser de 13 % pendant que la dépense augmente, si le volume croît plus vite. La qualité obtenue n'entre nulle part dans ce calcul.

Au niveau de la tâche, le même angle mort existe. Inferya compare 2 modèles qui coûtent chacun 0,07 $ par tentative sur SWE-bench Verified, avec le harnais mini-SWE-agent : l'un résout 75,8 % des tâches, l'autre 9 %. Rapporté aux tâches résolues, le premier revient à 0,092 $ par tâche et le second à 0,778 $, soit 8,4 fois plus.

Un blended cost proche peut donc cacher des coûts par tâche résolue très différents.

La FinOps Foundation formalise ces indicateurs, du coût par token au coût par inférence et par appel d'API, dans son guide « FinOps for AI » mis à jour le 17/02/2026. L'article « Mapping the token-reduction toolbox » applique la même prudence aux outils de réduction de tokens. Une sortie plus courte ne suffit pas à prouver qu'une tâche terminée coûte moins cher.

Nicolas M présente d'ailleurs cette baisse comme une inférence, pas comme une mesure. Le verbe qu'il emploie est « je suppose ».

III

Le pilotage budgétaire

08

200 $ par développeur et par mois, avec 3 issues en cas d'épuisement

Le levier que la passerelle n'apporte pas, et que Nicolas M présente comme co-responsable du résultat.

Nicolas M attribue la baisse à 2 leviers « Vous avez compris, on est passé de 87 000 dollars à 22-25 000 dollars par mois. Et la question, c'est comment on a fait ? Oui, on a basculé OpenRouter. Oui, je vous ai montré que les gens utilisent des modèles open weight comme GLM 5.2. Mais il y a aussi une chose qui est importante, c'est qu'aujourd'hui on a mis un budget de 200 dollars par développeur et par mois. »

Le budget se remet à zéro à la fin du mois. Interrogé sur la suffisance des 200 $, il répond : « Oui, les gens le prouvent aujourd'hui. »

DIAGRAMME · Le parcours d'un développeur qui épuise sa dotation
Trois issues, dont une seule est automatique. Le formulaire n'est pas un filtre d'approbation : il n'y a pas d'approbateur humain sur les 20 $.
  1. Extension auto-servie de 20 $

    Demandable depuis Slack à n'importe quelle heure, « parce que c'est pas un humain qui va approuver votre demande ». Elle exige de remplir un formulaire avec des chiffres relevés dans la console OpenRouter : nombre de sessions, session la plus coûteuse, répartition par modèle. Elle n'est accordée qu'une seule fois : « si j'éclate ces 20 dollars, j'aurai pas le droit à 240 dollars, ça s'arrêtera là ».

  2. Exception projet arbitrée en comité

    Le manager remplit un formulaire Confluence avec une estimation du montant nécessaire. Un comité, mêlant tenue du budget et profils produit, vérifie que la demande « va générer du business ». Délai annoncé : environ une demi-journée. Résultat : un workspace OpenRouter dédié, hors dotation individuelle.

  3. Clés dédiées pour les traitements automatisés

    Les agents non humains, revue de pull request, tâches de CI, bots Slack, fonctionnalités produit, ont leurs propres clés avec un modèle imposé, et ne consomment pas la dotation d'un développeur.

L'intention du formulaire est pédagogique, pas punitive : « c'est pour que les gens puissent comprendre un peu où est parti l'argent et qu'ils puissent se poser les bonnes questions, et que nous en fait on n'ait pas besoin de leur expliquer à chaque fois qu'est-ce que c'est qu'un modèle, qu'est-ce que c'est qu'une session. » Il ajoute que c'est « super bien accepté par nos collaborateurs ».

Sa propre session à 190 $ sert d'exemple

Plutôt que d'exposer un collègue, Nicolas M se nomme. Il montre une session des 13-14 août à 190 $ sur un seul run. « Vous êtes motivé et vous faites ça. »

Répartition de la session à 190 $, affichée à l'écran
ModèleCoût
Opus 4.8139 $
Opus 58 $
Sonnet 55 $
Restenégligeable

Un seul modèle porte 73 % de la session. Le formulaire demande la répartition par modèle, ce qui rend cet écart visible : « je prends conscience qu'il y a des modèles qui font mal ».

Une dizaine d'exceptions accordées depuis début août Sur le dispositif d'exception : « personne n'est arrivé en disant : moi, je veux 30 000 dollars pour tous mes développeurs. C'est pas comme ça que ça fonctionne. » Une dizaine d'exceptions accordées depuis début août, allant d'un hackathon de 3 à 4 jours à la semaine d'astreinte de release du monolithe.

Le guide AI Unit Economics distingue les politiques de budget selon qui dépense. Un agent, une tâche de CI ou un service sans surveillance appellent un plafond strict, faute de personne pour lire une alerte. Un développeur en session peut recevoir une alerte, puis passer par une approbation.

09

Les exceptions rattachent chaque dépense à un projet nommé

Ce que Nicolas M valorise le plus dans le dispositif, et qui n'apparaît dans aucun des chiffres précédents.

Il cite des montants rattachés à des projets : « on sait qu'on a mis 1100 € sur ce petit projet là qui est important, et que ce hackathon là finalement a coûté que 38 dollars et pas 500 dollars ».

Relier chaque dépense à un projet « On arrive enfin à rattacher le volume financier qu'on engage à des vraies histoires, avec des vrais projets, avec des choses où les gens nous racontent pourquoi ils veulent utiliser l'IA pour coder. »

Le même raisonnement s'applique aux agents automatisés, avec une contrainte supplémentaire : « si jamais un système commence à faire n'importe quoi et à dépenser plein d'argent, grâce à OpenRouter on peut très facilement contrôler ça, mettre de l'alerting dessus ».

Sa conclusion élargit volontairement le sujet : « je sais que je parle beaucoup d'OpenRouter, mais au-delà d'OpenRouter, ce que je voudrais vous montrer c'est comment on fait pour que la valeur que génère l'intelligence artificielle, on s'assure que cette valeur est là ». Il ajoute un argument non financier : « quand on voit des tokens et la finance, faut réfléchir que ça a un certain coût en énergie ».

IV

Ce qu'en disent les autres sources

10

75 vidéos publiques parlent d'OpenRouter, 12 apportent un fait nouveau

Retours d'usage, lecture du marché et mise en pratique, tout ce qui complète, nuance ou contredit le cas Back Market.

Entre 2025 et septembre 2026, 75 vidéos publiques mentionnent OpenRouter, sur des chaînes techniques francophones et anglophones. La plupart le citent au passage ; 12 apportent un fait, un chiffre ou un retour d'expérience.

3 faits publiés entre mai et août 2026 Un rachat officiel : Stripe a annoncé le 19/08/2026 un accord pour acquérir OpenRouter, sans en communiquer le prix ; Bloomberg évoquait plus de 7 milliards de dollars. Un départ documenté : une équipe de 200 ingénieurs a quitté OpenRouter pour Vertex AI, pour des raisons de sécurité et de contrôle. Un basculement de marché : sur OpenRouter, les modèles chinois dépassent 60 % de l'usage en juillet 2026, avec la réserve que cette plateforme ne voit pas l'usage direct des API américaines.

Pour une vue d'ensemble du marché, OpenRouter et a16z ont publié le 04/12/2025 un rapport « State of AI » fondé sur plus de 100 000 milliards de tokens routés en un an. Il constate que l'adoption des modèles open weight s'est accélérée et qu'ils servent désormais de briques pour des applications en production.

Les 12 vidéos retenues
Vidéos retenues, classées par angle
AngleDateChaîneVidéoCe qu'elle apporte
Retours d'usage14/09/2026Nicolas MartignoleBilan de 2 mois avec OpenRouter, pour 245 utilisateurs : les vrais chiffresBilan de la bascule : 87 k$ par mois chez Anthropic en juin, 23 k$ chez OpenRouter en août, pour environ 245 développeurs, avec le dispositif budgétaire associé.
Retours d'usage22/07/2026Nicolas MartignoleClaude Max (abo prix fixe) ou API (pay-as-you-go): ce n'est pas une question de prixEnviron 70 providers disponibles, une liste courte autorisée par Back Market, et une responsabilité qui reste au client.
Retours d'usage11/07/2026Nicolas MartignoleLe vrai coût de l'IA : pourquoi le prix au token est fauxD'après une présentation du COO d'OpenRouter, les modèles chinois y dépassent les modèles américains en volume ; Nicolas M en conclut que le prix au token induit en erreur.
Retours d'usage30/06/2026Nicolas MartignolePremiers benchmarks avec Sonnet 5, et comparo avec GLM 5.2Évaluation d'OpenRouter pour obtenir un contrat unique, et providers testés : Google Vertex, Amazon Bedrock, Fireworks.
Retours d'usage29/05/2026AI Native DevHow We Built an AI Code Reviewer for 200 EngineersUne équipe de 200 ingénieurs démarre sur OpenRouter (une seule API, mêmes prix que les éditeurs) puis passe sur Vertex AI : certains modèles ne respectaient pas ses règles de sécurité, et Vertex lui donne plus de contrôle sur les journaux et les budgets.
Marché17/08/2026BloombergAnthropic's Revenue Jump, The Wealthy Bet on SpaceX · Bloomberg TechStripe rachèterait OpenRouter pour plus de 7 milliards de dollars, selon les sources de Bloomberg.
Marché22/08/2026BloombergChinese AI Models Gain Ground on US AI in Price and UseLes données d'usage d'OpenRouter montrent plus de 60 % de modèles chinois en juillet 2026. Réserve explicite : OpenRouter n'est qu'une plateforme, et l'usage direct des API Anthropic et OpenAI n'y est pas visible.
Marché06/08/2026AI EngineerThe State of Model Routing — NVIDIA, Cognition, OpenRouterTable ronde avec un représentant d'OpenRouter, NVIDIA et Cognition sur le routage : envoyer chaque tâche au plus petit modèle suffisant, et orchestrer plusieurs modèles ensemble.
Marché23/04/2026The Product CrewTech @ France : Comment l’État français déploie sa propre stack IAL'État français présente OpenGateLLM, sa passerelle d'inférence open source, comme alternative à LiteLLM et OpenRouter.
Mise en pratique04/06/2026Cole MedinClaude Plans, Gemini Designs: The Workflow to Build BEAUTIFUL FrontendsClaude planifie, Gemini 3.5 Flash conçoit l'interface : l'accès à Gemini passe par OpenRouter depuis l'agent Pi.
Mise en pratique06/04/2026The Next New ThingBest & cheapest AI for OpenClawConfigurer un agent avec des modèles moins chers via OpenRouter : quelques dollars de crédit, puis comparaison de modèles jusqu'au choix de GLM 5.1.
Mise en pratique15/06/2025Alex so yesTutoriel Complet : Coder une app entière avec Cline (OpenSource)OpenRouter comme interface unique qui masque les différences de format d'API entre éditeurs, avec son classement des modèles les plus utilisés.
Comment la sélection a été faite Chaque vidéo retenue a été relue sur ses passages consacrés à OpenRouter. Le nombre de mentions a servi à repérer les candidates, pas à les classer. Une seule vidéo peut peser davantage par un fait que 10 mentions au passage. Les résumés s'appuient sur les sous-titres, automatiques pour la plupart.
Les 75 vidéos qui mentionnent OpenRouter
De la plus récente à la plus ancienne. Mentions : nombre d'occurrences d'OpenRouter dans les sous-titres
DateChaîneVidéoMentions
14/09/2026Nicolas MartignoleBilan de 2 mois avec OpenRouter, pour 245 utilisateurs : les vrais chiffres29
02/09/2026Latent SpaceThe Inference Frontier: from 100 to 10,000 tokens per second — Sean Lie, Cerebras CTO1
28/08/2026Stanford OnlineWhen AI Stops Being a Project: Turning Technology into Real Value for Patients and Providers2
27/08/2026Cole MedinWatch This If Your Coding Agent is Ignoring Your Rules (You Need Hooks)1
24/08/2026IndyDevDanIntelligence EXPLOSION: Harness Engineering with Pi Agent, Deepseek, and Gemini2
22/08/2026BloombergChinese AI Models Gain Ground on US AI in Price and Use3
22/08/2026BloombergBloomberg This Weekend · Trade War Escalates, Pushback on Beef Plan, Bond Market Intervention2
21/08/2026The Next New ThingTop 10 GitHub: AI videos, gorgeous diagrams, token savings and more1
20/08/2026Cole MedinDeepSeek Just Built the Next Generation of Coding Agents1
17/08/2026BloombergAnthropic's Revenue Jump, The Wealthy Bet on SpaceX · Bloomberg Tech6
17/08/2026AI EngineerSecurity Firewall for Agents — Ryan Dahl, Deno1
10/08/2026IndyDevDanEngineers… Your Software Factory NEEDS Agent Sandboxes to SCALE (exe.dev)3
06/08/2026AI EngineerThe State of Model Routing — NVIDIA, Cognition, OpenRouter6
03/08/2026Latent SpaceNext 100x in AI: Inference, Networking, & Self-Optimizing Models — Philip Kiely & Ali Taha, Baseten1
01/08/2026The Next New ThingFree: Agent creation, chat, task-assignment and other tools.1
30/07/2026LangChainThe misaligned incentives behind AI coding agents2
27/07/2026IndyDevDanIs Anthropic STEALING Your Data? (While You PAY FOR IT)2
24/07/2026Cole MedinIs Kimi K3 Really That Good?! (Don't Just Believe The Hype)1
22/07/2026Nicolas MartignoleClaude Max (abo prix fixe) ou API (pay-as-you-go): ce n'est pas une question de prix14
20/07/2026The Next New ThingTutorial: how non-developers build apps in Claude Code1
20/07/2026IndyDevDanEngineers... STOP Picking GPT-5.6 Sol OR Claude Fable 5… FUSE THEM1
17/07/2026AI EngineerSpecial Topics in Kernels, RL, Reward Hacking in Agents — Daniel Han, Unsloth4
16/07/2026LangChainThe best AI agents cost less than you think2
11/07/2026Nicolas MartignoleLe vrai coût de l'IA : pourquoi le prix au token est faux31
10/07/2026The Next New ThingFree transcription app, YouTube scraper, and GitHub’s top repos!1
09/07/2026Nicolas MartignoleRAISE Summit 2026 - Paris - Visite rapide et impressions4
04/07/2026Alex so yesJ'ai testé Mistral Vibe : la meilleure alternative open source à Claude Code ?1
02/07/2026AI Native DevLars Trieloff - Building AI agents in the browser, for the browser, of the browser - AI Native DevCo1
02/07/2026Nicolas MartignoleSonnet 5.0, Fable et le benchmark le plus scientifique du monde...10
01/07/2026LangChainIntroducing OpenWiki, an open source agent for repo documentation1
30/06/2026Nicolas MartignolePremiers benchmarks avec Sonnet 5, et comparo avec GLM 5.218
25/06/2026The Next New ThingNew AI Drops: AI does your work, Claude in Slack, cheap AI & more10
23/06/2026Stanford OnlineStanford MS&E435 Economics of the AI Supercycle · Spring 2026 · Applications, Coding AI1
21/06/2026BloombergWeekend Listen: Anthropic's Co-Founder and Top Economist on Doing Research at the AI Frontier ·...1
19/06/2026BloombergAnthropic's Co-Founder and Top Economist on Doing Research at the AI Frontier · Odd Lots1
17/06/2026AI Native DevLiran Tal - Your AI Agent Installed Malware Because a SKILL.md Told It To - AI DevCon June 20261
10/06/2026AI EngineerSovereign Escape Velocity: Ownership w Open Models — Gus Martins, & Ian Ballantyne, Google DeepMind2
04/06/2026Cole MedinClaude Plans, Gemini Designs: The Workflow to Build BEAUTIFUL Frontends4
29/05/2026AI Native DevHow We Built an AI Code Reviewer for 200 Engineers2
29/05/2026LangChainIntroducing Managed Deep Agents · Interrupt 261
22/05/2026AI EngineerLobster Trap: OpenClaw in Containers from Local to K8s and Back — Sally Ann O'Malley, Red Hat1
21/05/2026The Next New ThingFounders react: real Hermes use1
19/05/2026Stanford OnlineStanford CS336 Language Modeling from Scratch · Spring 2026 · Lecture 12: Evaluation3
19/05/2026The Next New ThingAnthropic beats OpenAI? + 5 AI Stories You Missed3
19/05/2026AI EngineerDon't Build Slop (4 Levels of AI Agent Maturity) - Ara Khan, Cline1
15/05/2026The Next New ThingFree Claude Code + 9 other apps1
13/05/2026AI EngineerBuilding a Chess Coach — Anant Dole and Asbjorn Steinskog, Take Take Take2
09/05/2026AI EngineerVoice AI: when is the "Her" moment? — Neil Zeghidour, CEO, Gradium AI1
02/05/2026AI EngineerHuman-in-the-Loop Automation with n8n — Liam McGarrigle5
28/04/2026NVIDIA DeveloperIntroducing NVIDIA Nemotron 3 Nano Omni1
23/04/2026The Product CrewTech @ France : Comment l’État français déploie sa propre stack IA2
16/04/2026Cole MedinI'm Building an AI Dark Factory That Ships Its Own Code (Public Experiment)2
15/04/2026AI EngineerPaperclip: Open Source Human Control Plane for AI Labor — Dotta Bippa3
08/04/2026AI EngineerLet LLMs Wander: Engineering RL Environments — Stefano Fiorucci1
06/04/2026The Next New ThingBest & cheapest AI for OpenClaw9
06/04/2026Cole MedinI Built Self-Evolving Claude Code Memory w/ Karpathy's LLM Knowledge Bases1
31/03/2026The Next New ThingFounder of Paperclip shows how1
19/03/2026Cole MedinThe Subagent Era Is Officially Here - Learn this Now1
17/03/2026NVIDIA DeveloperGet Started with Unsloth Studio: Generate Data & Fine-Tune LLMs Locally on any NVIDIA GPU1
13/03/2026Dev With AIAlphonse Terrier - dataaaaa! : Comment l'IA a rendu possible un projet que je n'osais pas commencer2
08/02/2026AI Native DevGitHub's Former CEO On What AI Competition Means for IDEs1
29/01/2026Cole MedinClaude Skills Aren't Just for Claude - Here's How to Build Them for ANY Agent1
27/01/2026AI Native DevWhat GitHub's Ex-CEO Says About the Future of Developer Skills1
22/01/2026Cole MedinI Was Wrong About Ralph Wiggum4
08/01/2026AI EngineerDSPy: The End of Prompt Engineering - Kevin Madura, AlixPartners2
22/12/2025IndyDevDanTOP 2% Engineering: /PLAN 20263
01/12/2025IndyDevDanClaude Opus 4.5: The Engineers' Model1
27/11/2025AI Native DevAdam Larson - Evaluating An LLM's Ability To Code · DevCon Fall 20253
07/10/2025DevoxxRoboCoders: Judgment Day – AI IDEs Face Off By Viktor Gamov, Baruch Sadogursky1
15/06/2025Alex so yesTutoriel Complet : Coder une app entière avec Cline (OpenSource)14
04/06/2025Stanford OnlineStanford CS336 Language Modeling from Scratch · Spring 2025 · Lecture 12: Evaluation1
30/05/2025Alex so yesOpenAI Codex CLI : Coder avec une IA dans un terminal ?1
14/05/2025AI Native DevAgentic workflow powered by Dagger with Kambui Nurse7
07/04/2025IndyDevDanCRACKED Aider AND Claude Code Combo. Zuck ships Llama4. Gemini 2.5 Pro is SOTA?9
19/02/2025AI Native DevBuilding the Ultimate AI-Powered Development Environment with Farhath Razzaque4
V

Ce que le guide Claude Code en retient

11

4 pages du Claude Code Ultimate Guide intègrent ces enseignements

Chaque enseignement rejoint la page du guide qui traite déjà sa question.

Le Claude Code Ultimate Guide couvrait déjà la question des passerelles, mais de façon dispersée, et avec une contradiction entre 2 pages. L'une déconseillait de pointer Claude Code vers un autre backend en production, l'autre recommandait exactement ce mécanisme.

Les enseignements de ce document y sont intégrés page par page, sans répéter un même chiffre à 2 endroits.

Chaque question a sa page
QuestionPage du guideCe qu'elle retient du cas Back Market
Comment plafonner et attribuer la dépense des développeurs ?API Gateway, Model AllowlistsLe plafond à 200 $ par mois avec extension auto-servie ; environ 70 providers disponibles et une dizaine utilisés ; la règle des 10 providers, 10 politiques de données ; la responsabilité qui reste au client
Licences nominatives, identités de service, ou les 2 ?Subscription Strategy, section 6Le passage de 87 k$ à 23 k$ par mois, avec la réserve que 2 leviers ont agi ensemble
Pointer Claude Code ailleurs est-il légitime ?Pointing Claude Code at Another BackendLa distinction entre une passerelle commerciale sous contrat et un proxy rétro-ingénieré, l'avertissement restant entier sur le second
Quel matériel, et combien coûte un token servi ?Local vs Cloud InferenceUn tableau de renvoi vers la page qui traite chaque question

2 autres pages du guide prolongent le sujet sans reprendre le cas Back Market : AI Unit Economics, sur le coût par tâche acceptée, et Team Metrics, sur les métriques des équipes qui travaillent avec des agents.

Pourquoi pas une page dédiée Chacune de ces 4 pages répond à une question différente. Une page consacrée à « consommer autre chose que Claude » aurait repris le matériel, la dépense et la gouvernance déjà traités ailleurs. Le guide préfère rattacher chaque enseignement à la page propriétaire de sa question et relier les pages entre elles.
VI

Reproduire la mesure

12

Comparer 2 modèles sur des tâches réelles, via l'API OpenRouter

Un protocole minimal teste la substitution de modèles avant de toucher à la configuration d'une équipe.

La substitution de modèles se teste en premier. Elle ne demande ni passerelle d'équipe ni plafond. Le test porte sur un petit lot de tâches réelles et figées, 5 à 10 demandes représentatives du travail courant, envoyées à l'identique à 2 modèles.

Prérequis, et ce qui fausse la mesure Il faut une clé OpenRouter créditée. Chaque appel consomme de vrais tokens, sur les 2 modèles. Commencer petit. Changer une demande entre les 2 passes invalide la comparaison ; les garder dans des fichiers texte évite de les réécrire.

Le test le plus direct branche Claude Code lui-même sur OpenRouter. Le guide d'intégration officiel tient en 3 variables d'environnement, sans proxy local, à placer dans le profil du shell ou dans le fichier .claude/settings.local.json du projet.

Terminal Brancher Claude Code sur OpenRouter 4 lignes
export OPENROUTER_API_KEY="sk-or-..."
export ANTHROPIC_BASE_URL="https://openrouter.ai/api"
export ANTHROPIC_AUTH_TOKEN="$OPENROUTER_API_KEY"
export ANTHROPIC_API_KEY=""   # doit être vide, et non absente

Si Claude Code était déjà connecté à un compte Anthropic, lancer /logout une fois et relancer. La commande /status doit ensuite afficher https://openrouter.ai/api sur la ligne de l'URL de base. Cette URL ne prend pas de suffixe /v1, réservé à l'API compatible OpenAI, qui provoque des erreurs de modèle introuvable.

OpenRouter ne garantit Claude Code qu'avec Anthropic en fournisseur Le guide d'intégration l'écrit en toutes lettres : « Claude Code with OpenRouter is only guaranteed to work with the Anthropic first-party provider. » OpenRouter recommande de placer Anthropic en fournisseur prioritaire. Faire tourner Claude Code sur GLM 5.2 ou un autre modèle open weight sort donc du cadre garanti. Ce cas reste à tester sur ses propres tâches.

Pour une comparaison contrôlée hors de Claude Code, la première étape consiste à lister les identifiants disponibles plutôt que recopier un nom vu dans une vidéo. Le catalogue est public et ne demande aucune authentification.

Terminal Lister les modèles et leur tarif, trié par prix de sortie 10 lignes
curl -s https://openrouter.ai/api/v1/models -o or-models.json

python3 - or-models.json <<'PY'
import json, sys
rows = json.load(open(sys.argv[1]))["data"]
for m in sorted(rows, key=lambda x: float(x["pricing"]["completion"])):
    p = m["pricing"]
    print("%-44s in=%7.2f $/M  out=%8.2f $/M" % (
        m["id"], float(p["prompt"]) * 1e6, float(p["completion"]) * 1e6))
PY

La réponse contient data, total_count et links ; chaque entrée porte id, pricing.prompt, pricing.completion et context_length. Au 16 septembre 2026, le catalogue compte 443 entrées. Les identifiants préfixés d'un ~ sont des alias qui suivent la dernière version d'une famille : pratiques pour explorer, à éviter pour comparer, puisque leur cible peut changer entre 2 passes.

Deuxième étape, envoyer la même demande aux 2 modèles. La commande suivante lit la demande dans prompt.txt et enregistre chaque réponse dans un fichier distinct, depuis n'importe quel dossier de travail.

Terminal Même demande, 2 modèles (nécessite curl et jq) 10 lignes
export OPENROUTER_API_KEY='sk-or-...'

for model in anthropic/claude-sonnet-5 z-ai/glm-5.2; do
  jq -n --arg m "$model" --rawfile p prompt.txt \
    '{model: $m, messages: [{role: "user", content: $p}]}' \
  | curl -s https://openrouter.ai/api/v1/chat/completions \
      -H "Authorization: Bearer $OPENROUTER_API_KEY" \
      -H "Content-Type: application/json" \
      -d @- > "reponse-${model//\//_}.json"
done
Portée de la vérification L'URL de base, l'en-tête d'authentification et le chemin /api/v1/chat/completions proviennent de la documentation d'OpenRouter, consultée le 16 septembre 2026. L'appel de complétion lui-même n'a pas été exécuté pour ce document, faute de clé créditée. Vérifier la structure d'une première réponse avant d'automatiser la lecture des suivantes.

Troisième étape, comparer sur des critères vérifiables plutôt qu'à l'impression : la réponse est-elle exploitable sans reprise, le code compile-t-il, les tests passent-ils. Rapporter ensuite la consommation de tokens de chaque passe au tarif relevé à la première étape.

Sans ce décompte, on ne sait pas si le modèle moins cher le reste une fois les reprises comptées. Le guide AI Unit Economics explique comment construire cette comparaison par paires, et ce qu'un petit échantillon permet de conclure.

13

Reproduire le plafond par personne avec une clé à limite de crédit

Le mécanisme des 200 $ est une fonctionnalité documentée d'OpenRouter, testable seul.

La dotation individuelle de Back Market repose sur une capacité documentée de l'API de gestion. Une clé peut porter son propre plafond de crédit.

Éléments d'API vérifiés dans la documentation OpenRouter le 16 septembre 2026
BesoinÉlémentVérifié
Point d'entréehttps://openrouter.ai/api/v1oui, Quickstart
AuthentificationEn-tête Authorization: Bearer <clé>oui, Quickstart
Appel de complétionPOST /api/v1/chat/completionsoui, Quickstart
Catalogue et tarifsGET /api/v1/modelsoui, appelé en direct
Plafond par cléPOST /api/v1/keys, champ limitoui, doc Provisioning
Remise à zéro du plafondQuotidienne, hebdomadaire ou mensuelle, par cléoui, page Enterprise

Sur sa page Enterprise, OpenRouter documente des plafonds de crédit par clé avec remise à zéro automatique, quotidienne, hebdomadaire ou mensuelle. Une clé par développeur avec une remise mensuelle reproduit donc la dotation de 200 $ par mois de Back Market, sans comptabilité maison.

Ce qui n'a pas été vérifié par exécution POST /api/v1/keys n'a pas été appelé pour ce document. Cette opération crée une ressource facturable et exige une clé de provisioning. L'existence du champ limit (« Optional credit limit ») vient de la documentation, pas d'une exécution. Le comportement exact à l'atteinte du plafond, code d'erreur et message renvoyés au client, reste à observer avant de bâtir un process dessus.

Pour un test individuel, reproduire le formulaire à 3 questions ne dépend d'aucune API. Après une semaine d'usage, répondre soi-même : combien de sessions, quelle a été la session la plus coûteuse, et quelle est la répartition par modèle. Nicolas M lui attribue un effet pédagogique, et il se teste sans budget.

Formulaire décrit par Nicolas M dans la vidéo du 14 septembre 2026.
Protocole minimal sur 2 semaines
  1. Semaine 1, mesurer sans rien changer

    Basculer l'usage courant sur une clé OpenRouter dédiée, sans plafond et sans changer de modèle. L'objectif est d'obtenir une ligne de base et un blended cost de départ.

  2. Fin de semaine 1, répondre au formulaire

    Les 3 questions, sur sa propre console. Noter la réponse avant de regarder la semaine suivante. C'est la mesure de l'effet pédagogique, et elle disparaît si on la reconstitue après coup.

  3. Semaine 2, segmenter par difficulté

    Router explicitement les tâches simples vers un modèle bon marché et garder le modèle haut de gamme pour les tâches complexes, selon la coupure que Nicolas M décrit. Cette semaine teste la segmentation.

  4. Comparer les 2 blended costs

    L'écart entre les 2 semaines est l'équivalent individuel des 13 % observés chez Back Market. À volume très différent d'une semaine à l'autre, l'indicateur reste comparable puisqu'il est ramené au million de tokens, mais la facture totale, elle, ne l'est pas.

14

Ce que ce retour d'expérience ne démontre pas

Transposer le facteur observé demande 4 précautions.

Ce que la vidéo ne compte pas Elle ne contient aucune mesure de la qualité du code produit, du taux de reprise, du temps passé, ni du nombre de tâches abouties. L'affirmation « les utilisateurs n'ont pas perdu leur productivité » est une observation qualitative, présentée comme telle. Sans mesure de qualité, le facteur 3,8 sur la dépense ne suffit pas à établir une économie. Les métriques agentiques du guide Team Metrics proposent un cadre pour mesurer ce que la vidéo ne mesure pas.
Un banc public donne un premier ordre de grandeur Superconductor a comparé plusieurs agents le 03/08/2026 sur des tickets tirés de ses propres pull requests Rails fusionnées, notés par des modèles évaluateurs distincts sur la correction, la complétude et la qualité du code. Kimi K3 y atteint environ 80 % de qualité, au niveau d'Opus 4.8, pour à peu près un quart de son coût moyen par ticket ; GLM 5.2 arrive environ 5 points derrière. Kimi K3 est aussi le plus lent, avec environ 44 minutes par ticket, à peu près le double d'Opus 4.8. Ces résultats portent sur des séries de 10 tickets et une seule base de code. Ils donnent un ordre de grandeur à confirmer ailleurs.
La passerelle et le plafond sont arrivés dans la même fenêtre La vidéo ne permet pas d'attribuer une part de la baisse à chacun. Nicolas M les présente comme conjoints. Attribuer le facteur à la seule passerelle irait au-delà de ce qu'il affirme.
Les sous-titres automatiques déforment les noms Le transcript rend « Anthropic » en « entropic », « Claude Code » en « clô code », « Tencent » en « 10 cent ». Les noms de modèles les plus récents cités à l'écran n'ont pas pu être rétablis avec certitude depuis le seul audio. Les identifiants exacts de ce document proviennent du catalogue OpenRouter, pas du transcript.
245 développeurs, un résultat obtenu à l'échelle d'une entreprise 245 développeurs permettent une ventilation multi-providers, un comité d'arbitrage et une négociation de volume. Un usage solo ou une équipe de 5 personnes n'accède ni au même effet de mix, ni au même besoin de gouvernance. À petite échelle, la segmentation par difficulté de tâche et la lecture régulière du blended cost restent applicables.

Les chiffres de population varient dans la vidéo elle-même : le titre annonce 245 utilisateurs, l'introduction parle de 250, le premier écran Anthropic de 230 à 240. Nicolas M les emploie de façon interchangeable pour désigner la même population. Ce document conserve ses formulations plutôt que d'harmoniser un chiffre qu'il n'a pas arrêté.

Une question sur Back Market et OpenRouter ?

Une question, un retour de test ou une correction à partager ? Écrivez-moi sur LinkedIn.

Me contacter sur LinkedIn
15

Glossaire

Les termes utilisés dans ce dossier.

Blended cost
Prix moyen payé pour un million de tokens sur une période, tous modèles confondus. OpenRouter l'affiche sur sa console. À volume constant, il baisse quand les utilisateurs se déplacent vers des modèles moins chers.
Open weight
Modèle dont les poids sont publiés, donc hébergeable par n'importe quel provider. À distinguer d'un modèle propriétaire, accessible uniquement chez son éditeur.
Provider
Hébergeur qui sert un modèle. Un même modèle open weight peut être servi par plusieurs providers, à des prix différents.
Zero data retention
Engagement d'un provider à ne conserver aucune donnée de requête. Critère de sélection cité pour écarter des modèles pourtant bien classés. Abrégé ZDR.
Les autres termes du glossaire
BYOK
Bring Your Own Key : utiliser ses propres clés ou crédits chez un fournisseur de modèles à travers une passerelle. OpenRouter applique alors un barème de frais distinct.
Claude Code
Agent de développement en ligne de commande édité par Anthropic. Il consomme soit l'API Anthropic en direct, soit une passerelle compatible.
GLM
Famille de modèles open weight publiée par Z.ai. GLM 5.2 est le modèle le plus consommé dans le retour d'expérience décrit ici.
Modèle frontière
Modèle privé, trop lourd pour tourner chez un tiers ou sur une infrastructure interne, servi uniquement par son éditeur. Les modèles Claude en font partie.
OpenRouter
Passerelle commerciale qui expose plusieurs centaines de modèles derrière une seule API et une seule facture, et répartit les requêtes entre providers.
Passerelle
Service intermédiaire entre un client et plusieurs fournisseurs de modèles. Elle centralise l'authentification, la facturation et le routage. On dit aussi gateway.
Token
Unité de découpage du texte facturée par les fournisseurs. Les prix sont exprimés par million de tokens, séparément en entrée et en sortie.
Workspace
Espace de facturation isolé dans OpenRouter. Utilisé ici pour sortir un budget projet de la dotation individuelle d'un développeur.
16

Conclusion, sources et mises à jour

Périmètre et méthode du dossier

Ce document part de 2 vidéos de Nicolas M, publiées le 22 juillet et le 14 septembre 2026, qui décrivent la migration d'environ 245 développeurs de l'accès Anthropic direct vers la passerelle OpenRouter, puis le dispositif budgétaire qui l'accompagne. Il les confronte à d'autres vidéos publiques qui parlent d'OpenRouter, à la documentation et aux tarifs d'OpenRouter, et renvoie vers les pages du Claude Code Ultimate Guide qui traitent chaque question. Les citations proviennent des sous-titres, automatiques pour la plupart, qui écorchent les noms propres. Les noms de modèles ont été rétablis quand ils étaient certains, et signalés quand ils ne l'étaient pas. Les tarifs OpenRouter ont été relevés sur l'API publique le 16 septembre 2026. Ce document ne mesure ni la qualité du code produit, ni le temps passé par les développeurs. Il porte sur une dépense, et sur la traçabilité de cette dépense.

Conclusion

La bascule vers une passerelle et le plafond par personne sont 2 décisions distinctes, que Nicolas M présente comme conjointes. La passerelle ouvre l'accès à d'autres modèles et détaille la dépense par modèle ; le plafond limite ce que chaque développeur engage. La vidéo ne permet pas de dire quelle part de la baisse revient à chacune.

Le dispositif transposable le moins coûteux est le formulaire à 3 questions exigé avant l'extension de 20 $. Il oblige le développeur à relire sa propre console avant de dépenser davantage. Il ne demande ni passerelle ni budget, et se teste seul, sur son propre usage.

Sources datées

La mention « consulté le » indique la date de lecture. Une source peut avoir été publiée plus tôt, puis modifiée.

Historique des mises à jour

DateVersionAjouts
18 septembre 20262.8.0Passe de rythme et de redites sur les 2 langues : 24 deux-points d'annonce repassés en phrases, 7 paragraphes ouverts par « Sur » rendus à leur sujet, 5 chapeaux de chapitre repassés au verbe conjugué, 6 paragraphes scindés pour créer des ruptures courtes. Redites supprimées : les montants de la comparaison mensuelle rejoués dans un encadré, 2 citations reprises mot pour mot d'une section à l'autre, l'annonce en partie II d'une session détaillée en partie III, et les définitions du glossaire répétées dans le corps.
17 septembre 20262.6.0Compléments vérifiés sur sources primaires : annonce officielle du rachat par Stripe, paramètres de routage et plafonds par clé d'OpenRouter, frais de plateforme, branchement de Claude Code sur OpenRouter et sa réserve officielle, mesures de qualité et de coût par tâche de Superconductor et d'Inferya, guide FinOps for AI. Liens vers les pages AI Unit Economics et Team Metrics du guide et vers 2 articles publiés du blog. Dates au format JJ/MM/AAAA.
17 septembre 20262.5.0Montants en notation k$, liens vers les entreprises et produits cités à leur première mention, lien vers le profil de l'intervenant, citations mises en évidence, bouton de copie sur les commandes et menu « Autres ressources ».
16 septembre 20262.4.0Coloration syntaxique des commandes et liens vers le portfolio, le Claude Code Ultimate Guide et GitHub dans le menu.
16 septembre 20262.3.0Relecture éditoriale complète : suppression des tournures d'opposition répétées, des intertitres de signalisation et des chutes sentencieuses ; titres réécrits pour énoncer le fait ; légendes des infographies remplacées par leur source et leur date. 4 affirmations qui dépassaient la source ont été corrigées, dont l'idée qu'aucun des 2 leviers ne suffirait seul, que la vidéo n'établit pas.
16 septembre 20262.2.0Ajout de 5 infographies : responsabilité contractuelle, écart tokens contre facture, baisse de la facture mensuelle, portée du blended cost, formulaire à 3 questions. Chaque image repose sur un fait déjà établi dans le document ; ses textes et ses proportions ont été contrôlés un par un. Corrections de formulation : un reste d'impératif et des propos oraux présentés comme écrits.
16 septembre 20262.1.0Document rendu consultable par tout lecteur : liste complète des vidéos qui mentionnent OpenRouter et sélection commentée de 12 d'entre elles, renvois vers les pages publiques du guide, protocole de test réécrit sur l'API OpenRouter seule. Retrait des éléments propres à l'environnement de l'auteur.
16 septembre 20262.0.0Périmètre élargi : vidéo du 22 juillet 2026 et contrainte de responsabilité qu'elle pose, comparaison avec d'autres vidéos publiques, renvois vers le Claude Code Ultimate Guide. Le décompte des providers autorisés reste une réserve ouverte et non une donnée établie.

Copier le dossier en JSON

La copie automatique est indisponible. Le texte est sélectionné : utilisez ⌘C ou Ctrl+C, puis collez-le dans votre assistant.

Partager ce dossier

Télécharger le dossier HTML