Le prix de votre IA dépend maintenant de l'heure qu'il est à Pékin

praxena.fr

Depuis le 16 août, DeepSeek facture ses modèles deux fois plus cher en heures de pointe. Ces fenêtres épousent les horaires de bureau chinois et coupent la journée de travail française en deux.

Le 13 août, DeepSeek a publié une nouvelle grille pour ses modèles V4, appliquée trois jours plus tard à 16 heures UTC. La sortie de V4-Pro, son gros modèle, est passée de 0,87 dollar le million de tokens à 1,98 dollar hors pointe et 3,96 dollars en pointe.

Même au tarif le plus bas, la facture a plus que doublé. Pour un fournisseur qui s'est fait un nom en coûtant dix fois moins cher que les Américains, c'est un demi-tour.

La hausse fera parler quelques semaines. La seconde nouveauté mérite plus d'attention : le prix a désormais une horloge.

Les heures de pointe vont de 1 heure à 4 heures et de 6 heures à 10 heures UTC, du lundi au vendredi. Sept heures par jour ouvré. Converti à Pékin, cela donne 9 heures-midi et 14 heures-18 heures, la journée de bureau chinoise aux pauses près.

DeepSeek ne facture donc pas la rareté du calcul en général. Il facture l'affluence de son marché intérieur (rationnel de son côté, indifférent au vôtre).

Pour une direction informatique française, la conversion est immédiate. En heure d'été, la fenêtre chère couvre 8 heures à midi à Paris. Votre matinée se paie au tarif fort, votre après-midi au tarif réduit. En hiver, le créneau glisse et prend 7 heures-11 heures. Il se déplace, il ne disparaît pas.

Ce que cela abîme, c'est le dossier d'investissement. Un business case IA tient sur une multiplication, coût par requête par volume, où le premier terme figure comme une constante. Il ne l'est plus, et la variable qui le pilote est la congestion des serveurs d'un autre pays, sur laquelle personne ici n'a de visibilité.

L'objection vient tout de suite : il suffit de décaler les traitements. Elle vaut pour ce qui est décalable. Un batch de nuit, oui. Un copilote qui répond à un commercial pendant son rendez-vous, non, et c'est justement la part de l'usage qui grossit cette année.

Le procédé lui-même n'a rien d'inédit. OpenAI et Anthropic remisent de moitié les traitements asynchrones depuis deux ans, contre une fenêtre de vingt-quatre heures. La différence tient en un mot : c'est le client qui choisit d'y aller. Chez DeepSeek, l'horloge décide à sa place.

Ceux qui suivent le fournisseur de longue date auront d'ailleurs une impression de déjà-vu. DeepSeek pratiquait déjà des créneaux en 2025, dans l'autre sens, avec 50 à 75 % de remise entre 16 h 30 et 0 h 30 UTC. Le programme s'est arrêté en septembre 2025. Même mécanique, sens inversé. Ce qui s'appelait une remise s'appelle aujourd'hui une surcharge, sans qu'aucun contrat ait été rouvert.

Ne réduisons pas l'épisode à une affaire chinoise. Sur sa propre page tarifaire, OpenAI signale que le prix de GPT-5.6 Sol, 4 dollars en entrée et 20 en sortie, est promotionnel au moins jusqu'au 21 novembre 2026. Un prix assorti d'une date de fin est un prix provisoire, et il figure pourtant tel quel dans des dossiers bâtis sur trois ans (j'en ai lu).

Le chiffre qui devrait décider les arbitrages est ailleurs. Hors pointe, V4-Pro sort à 1,98 dollar le million. Au relevé du 1er septembre de mon baromètre mensuel des prix, la moyenne de sortie des modèles économiques du panel s'établit à 1,96 dollar. Mistral Large 3, lui, sort à 1,50 dollar, à n'importe quelle heure.

Je ne prétends pas que ces modèles se valent sur les tâches. Je constate que l'écart de prix qui justifiait d'aller chercher un fournisseur à l'autre bout du monde vient de s'évaporer.

DeepSeek ne figure pas dans ce panel, et l'épisode explique assez bien pourquoi : on ne met pas en série un tarif qui change selon l'heure de la journée.

Restent deux questions à poser en comité. Combien de jours faut-il pour changer de modèle en production, du commit au déploiement, sans réécrire les prompts ? Et que prévoit votre contrat en matière de préavis sur les prix ? Si la première réponse se compte en trimestres, le tarif affiché sur la page du fournisseur est décoratif : vous paierez ce qu'on vous demandera, le temps de bouger.

L'industrie a traité le prix au token comme une ligne de catalogue, stable et négociable au volume. Depuis le 16 août, c'est un tarif d'électricité. Les directions achats qui gèrent des contrats d'énergie l'ont appris il y a vingt ans, on n'achète pas un kilowattheure, on achète un profil de consommation. La couche modèle vient de rejoindre les fluides.