NewsAnime Creation Platform Launch 

Les tarifs de l'API DeepSeek changent le 16 août—voici ce que cela coûtera réellement

Calculez les coûts de DeepSeek V4 Pro et Flash selon le barème tarifaire des heures pleines et creuses du 16 août, avec des exemples pratiques de budgétisation.

| Source: Elser AI
AI anime and movie generator - Elser AI

DeepSeek s'apprête à rendre la budgétisation des API plus complexe—et potentiellement plus contrôlable. À 16h00 UTC le 16 août 2026, l'entreprise prévoit de remplacer ses tarifs fixes actuels de la V4 par des prix de pointe et hors pointe. L'utilisation hors pointe coûtera la moitié du tarif de pointe, créant ainsi une incitation directe à déplacer les charges de travail flexibles en dehors des heures d'affluence.

Ce changement affecte à la fois DeepSeek-V4-Flash et le nouveau DeepSeek-V4-Pro, désormais en disponibilité générale. Il modifie également suffisamment l’économie pour que les anciennes comparaisons de coûts deviennent trompeuses. Cet article traduit le tableau officiel des prix par million de jetons en charges de travail réalistes et explique comment éviter les erreurs de budgétisation les plus courantes.

Tout d'abord, le timing

À la date de vérification de cet article—le 14 août—le nouveau calendrier est annoncé mais pas encore actif. DeepSeek indique qu'il commence à 16:00 UTC le 16 août. Les fenêtres de pointe désignées sont 01:00–04:00 UTC et 06:00–10:00 UTC. Toutes les autres heures sont hors pointe.

Étant donné que la tarification est une information opérationnelle en direct, confirmez la page de tarification officielle avant d'alimenter un compte ou de publier un calculateur. Les tarifs ci-dessous reflètent cette page en date du 14 août 2026.

Le Tableau des Prix Programmés

Les prix sont par million de tokens.

| Modèle et période | Entrée en cache | Entrée non en cache | Sortie | |---|---:|---:|---:| | V4 Flash hors pointe | 0,007 $ | 0,22 $ | 0,66 $ | | Pic de flash V4 | 0,014 $ | 0,44 $ | 1,32 $ | | V4 Pro hors pointe | 0,022 $ | 0,66 $ | 1,98 $ | | V4 Pro peak | 0,044 $ | 1,32 $ | 3,96 $ |

Trois motifs sont immédiatement visibles. La sortie est la catégorie coûteuse. Un échec de cache coûte bien plus qu'un succès de cache. Le niveau Pro coûte environ trois fois le taux Flash correspondant. Ces ratios sont plus utiles qu'un prix unique en titre car les applications réelles ont des mélanges d'entrée/sortie différents.

Combien Coûte une Demande Typique

Considérez un assistant de support qui lit 8 000 tokens d'entrée non mis en cache et produit 1 000 tokens de sortie. Au tarif Flash hors pointe, le coût du modèle est d'environ :


SORTIE UNIQUEMENT TRADUCTION :
(8 000 / 1 000 000 × 0,22 $) + (1 000 / 1 000 000 × 0,66 $) = 0,00242 $

Au prix de pointe de Flash, il double pour atteindre environ 0,00484 $. Avec Pro, le même mélange de jetons coûte environ 0,00726 $ en heures creuses et 0,01452 $ en heures de pointe.

Ces chiffres semblent minuscules, mais le volume change la donne. À un million de telles requêtes par mois, la différence liée uniquement au modèle entre Flash hors pointe et Pro en pointe est d'environ 12 100 $. Les appels d'outils, les API de recherche, le stockage, l'observabilité, les tentatives et la révision humaine ajouteraient davantage.

Considérons maintenant un agent de codage qui consomme 120 000 tokens d'entrée non mis en cache et émet 20 000 tokens de sortie par tâche. Flash coûte environ 0,0396 $ hors pointe ou 0,0792 $ en pointe. Pro coûte environ 0,1188 $ hors pointe ou 0,2376 $ en pointe. Si le modèle Pro réduit considérablement les tentatives échouées, il peut encore être économique. Vous avez besoin du taux de réussite pour décider.

Les hits de cache peuvent changer le résultat

L'écart entre les entrées mises en cache et non mises en cache est énorme. Pour V4 Pro en heures creuses, un million de tokens d'entrée non mis en cache coûte 0,66 $ tandis que l'entrée mise en cache coûte 0,022 $. Cela fait de l'architecture des prompts une préoccupation économique.

Placez le matériel stable et réutilisable là où le mécanisme de cache du fournisseur peut le reconnaître. Évitez de modifier les espaces, l'ordre, les horodatages ou les métadonnées non pertinentes dans un grand préfixe statique. Séparez les instructions durables et les documents de référence du contenu utilisateur par requête. Mesurez ensuite l'utilisation réelle des hits de cache plutôt que de supposer que la conception fonctionne.

La mise en cache ne doit pas être utilisée pour justifier l’envoi de tout. Une invite plus petite et pertinente est souvent plus fiable qu’une montagne de bruit mise en cache. Optimisez d’abord la pertinence, puis la capacité de mise en cache.

Comment utiliser les tarifs hors pointe

De nombreuses tâches d’IA ne sont pas réellement en temps réel. La génération de rapports de nuit, l’indexation de référentiels, les actualisations d’embeddings, la classification de documents, la création de données synthétiques, les exécutions d’évaluation et les brouillons de contenu à faible priorité peuvent attendre.

Créez une file d'attente avec trois classes de service :

  1. Interactif : exécutez immédiatement et acceptez le tarif actuel.
  2. Flexible : planifiez pour la prochaine fenêtre creuse.
  3. Batch : traiter par lots contrôlés pendant les heures creuses.

Traduisez soigneusement les fenêtres UTC. Les changements d'heure d'été peuvent décaler les correspondances d'horloge locale. Stockez les plannings en UTC et affichez la conversion aux opérateurs. Ajoutez de la gigue pour que chaque tâche en file d'attente ne démarre pas exactement à la limite, et limitez la concurrence pour éviter une tempête de tentatives.

Les erreurs qui brisent les prévisions de coûts

La première erreur est de ne compter que le texte visible. Les tokeniseurs divisent les mots, le code, la ponctuation, le JSON et le contenu multilingue différemment. Utilisez l'utilisation rapportée par l'API.

Le second est d'ignorer les boucles d'agent. Une seule "demande utilisateur" peut déclencher des dizaines d'appels de modèle, d'opérations de recherche, d'exécutions de tests et de réparations. Budget par tâche terminée, pas par message de chat.

La troisième est de supposer que la réflexion maximale est une qualité gratuite. Un effort de raisonnement plus important peut augmenter la latence et la consommation. Acheminez les tâches simples vers un faible effort, les tâches quotidiennes des agents vers un effort élevé, et n'utilisez le maximum que lorsque les évaluations montrent un bénéfice.

Le quatrième est d'oublier les échecs. Les timeouts, les arguments d'outil invalides, les dépassements de contexte et les sorties rejetées coûtent tous de l'argent. Suivez les raisons des tentatives et corrigez les erreurs systémiques au lieu de payer pour la répétition.

La cinquième consiste à publier les prix futurs comme prix actuels. Jusqu'à l'heure d'activation indiquée, les anciens tarifs restent applicables. Après l'activation, la page officielle fait foi.

Un meilleur budget modèle

Créez une feuille de calcul avec ces colonnes :

  • nom de la charge de travail ;
  • requêtes par mois ;
  • entrée moyenne mise en cache ;
  • entrée non mise en cache moyenne ;
  • sortie moyenne ;
  • répartition attendue entre heures pleines et heures creuses ;
  • multiplicateur de tentatives ;
  • Flash ou Pro ;
  • coût des outils et de la recherche ;
  • minutes de révision humaine ;
  • taux de réussite.

Calculez un scénario bas, attendu et élevé. Le scénario élevé doit inclure un pic de cache-miss et des boucles d’agent supplémentaires. Définissez des alertes sur les dollars par tâche réussie, et non simplement sur les jetons par requête.

Si votre organisation cherche encore à déterminer où l'IA s'intègre dans son pipeline de contenu ou de création, expérimenter via Elser AI peut aider à définir le flux de travail utile avant de vous engager dans une architecture à l'échelle API. Un processus clair empêche les équipes d'optimiser les prix des tokens pour une tâche dont les utilisateurs n'avaient pas besoin.

FAQ

Quand commence la nouvelle tarification de DeepSeek ?

DeepSeek indique 16h00 UTC le 16 août 2026. Vérifiez la page en direct au cas où le programme changerait.

Quand sont les heures de pointe ?

Les fenêtres de pointe annoncées sont 01:00–04:00 UTC et 06:00–10:00 UTC. Les autres heures sont désignées comme hors pointe.

Le V4 Pro est-il trois fois plus cher que le Flash ?

Les tarifs programmés sont environ trois fois plus élevés que Flash dans chaque catégorie de jetons. Le coût total par tâche réussie peut différer car la qualité, les tentatives et la correction humaine comptent également.

Quel est le moyen le plus simple d'économiser de l'argent ?

Utilisez Flash pour les travaux simples validés, planifiez les tâches flexibles en heures creuses, réduisez les sorties inutiles, améliorez les hits de cache et arrêtez les boucles d’agent ayant échoué de manière répétée.

Sources et Vérification

Cet article utilise le journal des modifications de l'API officielle de DeepSeek, la documentation sur les modèles et les tarifs, ainsi que les documents de la version V4 comme sources principales. Les étiquettes des produits sont conservées intentionnellement : V4 Pro 0813 est en disponibilité générale, tandis que V4 Flash 0731 est décrit comme étant en version bêta publique à la date de vérification. Les chiffres des benchmarks sont identifiés comme étant fournis par le vendeur, et non présentés comme des résultats indépendants d'Elser AI. Les tarifs programmés sont qualifiés de futurs jusqu'à leur heure d'activation annoncée. Les lecteurs prenant des décisions de production ou d'achat doivent revérifier la documentation en direct, car les alias de modèles, les prix, les limites de débit, le statut bêta et le comportement des fonctionnalités peuvent changer après la publication. Une évaluation indépendante sur des tâches représentatives reste nécessaire.

Conclusion

Le système de tarification heures pleines/heures creuses de DeepSeek fait du timing une variable de coût de première classe. Les plus grandes économies viendront de la combinaison de la planification, de la mise en cache, du routage des modèles, du contrôle des sorties et de la réduction des défaillances. Copier le tableau des prix ne suffit pas. Modélisez votre mix réel de tokens et mesurez le coût d’un résultat commercial réussi.

Latest News

AI anime and movie generator - Elser AI
August 14, 2026

Effort de réflexion DeepSeek expliqué : quand utiliser Faible, Élevé ou Max

AI anime and movie generator - Elser AI
August 14, 2026

Mise à niveau de l'agent DeepSeek V4 Pro : véritable percée ou marketing de benchmark ?

AI anime and movie generator - Elser AI
August 14, 2026

DeepSeek V4 Pro est officiellement disponible : tout ce que les développeurs doivent savoir

AI anime and movie generator - Elser AI
August 14, 2026

DeepSeek V4 Pro vs V4 Flash : Quel modèle devriez-vous utiliser ?

AI anime and movie generator - Elser AI
August 14, 2026

DeepSeek V4 Pro vs Flash Tarification : Est-ce que le Pro vaut le coût supplémentaire ?

AI anime and movie generator - Elser AI
August 14, 2026

DeepSeek V4 prend désormais en charge l’API Responses : pourquoi cela compte pour les développeurs d’IA

AI anime and movie generator - Elser AI
August 5, 2026

Des panneaux de BD IA à la vidéo : Workflow Elser AI et Seedance 2.5

AI anime and movie generator - Elser AI
August 5, 2026

Comment animer un personnage original avec Elser AI et Seedance 2.5

AI anime and movie generator - Elser AI
August 5, 2026

Comment garder les personnages Elser AI cohérents dans Seedance 2.5

AI anime and movie generator - Elser AI
August 5, 2026

Comment créer un court métrage d'animation de 30 secondes avec Elser AI et Seedance 2.5

AI anime and movie generator - Elser AI
August 5, 2026

Seedance 2.5 Prompts d'Anime : 20 Modèles pour les Personnages Elser AI

AI anime and movie generator - Elser AI
August 5, 2026

Du storyboard à l'anime : Utiliser Elser AI avec Seedance 2.5

AI anime and movie generator - Elser AI
August 5, 2026

Pourquoi votre personnage Seedance 2.5 change constamment—et comment Elser AI vous aide

AI anime and movie generator - Elser AI
August 3, 2026

Comment créer une annonce produit de 30 secondes avec Seedance 2.5

AI anime and movie generator - Elser AI
August 3, 2026

Comment conserver des personnages cohérents dans Seedance 2.5

AI anime and movie generator - Elser AI
August 3, 2026

Seedance 2.5 pour les vidéos d'anime : De la fiche de personnage à la scène animée

AI anime and movie generator - Elser AI
August 3, 2026

Seedance 2.5 est-il sûr pour un usage commercial ? Droits d'auteur, droit à l'image et droits de référence expliqués

AI anime and movie generator - Elser AI
August 3, 2026

Seedance 2.5 est disponible : Tout ce qui a été confirmé — et ce qui reste incertain

AI anime and movie generator - Elser AI
August 3, 2026

Guide de prompts Seedance 2.5 : Contrôler la caméra, le mouvement, l'éclairage et le timing

AI anime and movie generator - Elser AI
August 3, 2026

Seedance 2.5 vs Seedance 2.0 : Qu'a réellement changé ?

AI anime and movie generator - Elser AI
August 3, 2026

Seedance 2.5 contre Veo 3.1 contre Sora 2 Pro : Quoi tester avant de choisir

AI anime and movie generator - Elser AI
August 3, 2026

Pourquoi 50 références peuvent rendre votre vidéo Seedance 2.5 pire

AI anime and movie generator - Elser AI
July 29, 2026

ChatGPT 5.5 contre 5.6 : Devriez-vous mettre à niveau ?

AI anime and movie generator - Elser AI
July 29, 2026

GPT-5.6 pour le Codage : Sol vs Terra vs Luna pour les Développeurs

AI anime and movie generator - Elser AI
July 29, 2026

Avis sur le GPT-5.6 Luna : Le modèle le plus rapide d'OpenAI est-il suffisamment bon ?

AI anime and movie generator - Elser AI
July 29, 2026

Tarifs GPT-5.6 expliqués : Quel modèle offre la meilleure valeur ?

AI anime and movie generator - Elser AI
July 29, 2026

Revue GPT-5.6 Sol : Qui a vraiment besoin du modèle phare d'OpenAI ?

AI anime and movie generator - Elser AI
July 29, 2026

GPT-5.6 Sol vs Claude Fable 5 : Lequel est le meilleur pour le travail complexe ?

AI anime and movie generator - Elser AI
July 29, 2026

Revue GPT-5.6 Terra : Le meilleur équilibre entre capacités et coût ?

AI anime and movie generator - Elser AI
July 29, 2026

GPT-5.6 contre GPT-5.5 : Codage, Raisonnement, Vitesse et Prix comparés

AI anime and movie generator - Elser AI
July 29, 2026

GPT-5.6 vs GPT-5.5 : Qu'est-ce qui a réellement changé ?

AI anime and movie generator - Elser AI
July 29, 2026

GPT Sol, Terra et Luna expliqués : Les nouveaux niveaux de modèles d'OpenAI

AI anime and movie generator - Elser AI
July 29, 2026

Devriez-vous remplacer GPT-5.5 par GPT-5.6 dans votre flux de travail IA ?

AI anime and movie generator - Elser AI
July 24, 2026

Kimi K3 contre DeepSeek V4 contre Qwen 3.8 : Un guide pratique des modèles de 2026

AI anime and movie generator - Elser AI
July 24, 2026

La guerre des modèles devient une guerre des agents — et cela change la manière dont vous achetez l'IA

AI anime and movie generator - Elser AI
July 24, 2026

Agents de codage IA en 2026: Comment choisir au-delà des benchmarks

AI anime and movie generator - Elser AI
July 24, 2026

Arrêtez de choisir les modèles d'IA en fonction des benchmarks : Un cadre d'achat pour 2026

AI anime and movie generator - Elser AI
July 24, 2026

DeepSeek V4 expliqué : Ce que les développeurs doivent savoir

AI anime and movie generator - Elser AI
July 24, 2026

Gemini 3.5 Pro est retardé : Ce qu'il faut utiliser pendant que Google continue de tester

AI anime and movie generator - Elser AI
July 24, 2026

Rapport sur les modèles d'IA de juillet 2026 : Kimi, DeepSeek, Qwen, Gemini, GPT et Claude

AI anime and movie generator - Elser AI
July 24, 2026

Kimi K3 a changé la course de l'IA — Voici ce que les développeurs devraient faire ensuite

AI anime and movie generator - Elser AI
July 24, 2026

L'IA à poids ouverts attire l'attention — mais le téléchargement est la partie la plus facile

AI anime and movie generator - Elser AI
July 24, 2026

Analyse détaillée de la version de prévisualisation de Qwen 3.6 Max : L'histoire vraie de l'IA d'Alibaba derrière les rumeurs sur Qwen 3.8

AI anime and movie generator - Elser AI
July 24, 2026

Qwen3.8 : Ce qui est confirmé, ce qui manque et ce qu'il faut tester

AI anime and movie generator - Elser AI
July 20, 2026

Kimi K3 vs DeepSeek V4 vs Qwen 3.6 : Quel modèle d'IA devriez-vous utiliser en 2026 ?

AI anime and movie generator - Elser AI
July 20, 2026

Les meilleurs modèles de codage IA en 2026 : GPT-5.6, Claude Sonnet 5, Kimi K3, DeepSeek V4 et Qwen comparés

AI anime and movie generator - Elser AI
July 20, 2026

Le Moment de l'IA en Chine : Kimi K3, DeepSeek V4 et Qwen réécrivent la course mondiale des modèles d'IA

AI anime and movie generator - Elser AI
July 20, 2026

Les poids ouverts gagnent à nouveau : Comment les laboratoires d'IA chinois ont transformé le marché des modèles de 2026

AI anime and movie generator - Elser AI
July 20, 2026

L'essor des agents IA : Pourquoi chaque modèle de pointe court pour dépasser les chatbots

AI anime and movie generator - Elser AI
July 20, 2026

L'État de l'IA à la mi-2026 : Ce que chaque développeur, créateur et entreprise devrait savoir

AI anime and movie generator - Elser AI
July 20, 2026

Pourquoi Kimi K3 a explosé du jour au lendemain — et ce que les développeurs devraient tester avant de croire au buzz

AI anime and movie generator - Elser AI
December 2, 2025

Elser dévoile la liste d'attente pour son studio AI révolutionnaire tout-en-un dédié aux animes et aux films, démocratisant la création de vidéos d'anime professionnelle.

Associated Press icon
AI anime and movie generator - Elser AI
December 2, 2025

Elser AI dévoile la première plateforme de création d'anime tout-en-un au monde et ouvre la liste d'attente pour un accès précoce

Associated Press icon
AI anime and movie generator - Elser AI
December 2, 2025

Elser AI Dévoile la Première Plateforme de Création d'Anime Tout-en-Un au Monde et Ouvre la Liste d'attente pour un Accès Précoce

Morningstar icon
AI anime and movie generator - Elser AI
December 2, 2025

Elser dévoile une liste d'attente pour son studio AI d'animation et de cinéma tout-en-un révolutionnaire, démocratisant la création de vidéos d'animation professionnelle

The AI Journal icon
AI anime and movie generator - Elser AI
December 2, 2025

Elser AI dévoile la première plateforme de création anime tout-en-un au monde et ouvre la liste d'attente pour un accès anticipé

Yahoo! Finance icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser dévoile une liste d'attente pour son studio AI révolutionnaire tout-en-un pour animes et films, démocratisant la création professionnelle de vidéos d'anime

Benzinga icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser AI ouvre la liste d'attente pour le premier studio de création d'anime tout-en-un dédié aux propriétés intellectuelles originales

Digitaljournal icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser AI Lance la première plateforme de production d'animation AI intégrée au monde et ouvre la liste d'attente pour un accès anticipé

EinNews icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser AI ouvre la liste d'attente précoce pour le premier studio AI tout-en-un au monde pour l'anime, les films et les courts métrages dramatiques

LosAngelesNN icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser AI lance la toute première plateforme de création d'animation IA tout-en-un au monde et ouvre la liste d'attente pour l'accès anticipé

Rockford Register Star icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser dévoile la liste d'attente pour son studio AI révolutionnaire tout-en-un dédié aux animes et aux films, démocratisant la création de vidéos d'anime de qualité professionnelle

The Daily Press icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser AI dévoile la première plateforme de création d'anime tout-en-un au monde et ouvre la liste d'attente pour l'accès anticipé

WV News icon
AI anime and movie generator - Elser AI
December 1, 2025

Elser AI lance la première plateforme de création d'animation AI tout-en-un au monde et ouvre sa liste d'attente pour l'accès anticipé

Yahoo! Finance icon
Les tarifs de l'API DeepSeek changent le 16 août—voici ce que cela coûtera réellement | Actualités Elser AI