DeepSeek : ce que valent V4 Flash et V4 Pro pour une entreprise.

DeepSeek est l'un des modèles d'IA les plus recherchés en France, et l'un des moins chers à utiliser par API. Voici ce que sont ses modèles actuels, ce que coûte vraiment l'API, où partent vos données, et comment une entreprise peut profiter de ses prix sans prendre de risque.

01 · La définition

Ce qu'est DeepSeek.

DeepSeek est une entreprise chinoise d'intelligence artificielle, basée à Hangzhou, qui développe des modèles de langage : le même type de technologie que celle derrière ChatGPT, Claude ou Mistral. Elle se distingue par deux choix forts :

  • des prix très bas sur son API ;
  • des modèles ouverts : les poids sont publiés sous licence MIT, ce qui permet de les télécharger et de les faire tourner soi-même.

On peut l'utiliser de trois façons : l'assistant (site web et application mobile, gratuits), l'API payante à l'usage pour l'intégrer dans vos outils, ou les modèles ouverts installés sur vos propres serveurs.

02 · Les modèles

Les modèles de septembre 2026.

Au 27 septembre 2026, l'API de DeepSeek propose deux modèles :

DeepSeek-V4.1-Flash DeepSeek-V4-Pro
Nom dans l'API deepseek-flash deepseek-v4-pro
Positionnement Rapide et économique Le plus puissant
Contexte 1 million de tokens 1 million de tokens
Réponse maximale 384 000 tokens 384 000 tokens
Images Oui Non
Appel d'outils, sortie JSON Oui Oui
Mode raisonnement Oui, activé par défaut Oui, activé par défaut

DeepSeek présente V4.1-Flash comme une amélioration générale sur le texte et les tâches d'agent, avec une compréhension native des images. Les anciens noms (deepseek-v4-flash) restent acceptés, mais les requêtes sont désormais servies par V4.1-Flash.

Détail pratique pour les équipes techniques : l'API accepte le format d'OpenAI et celui d'Anthropic. Un outil déjà branché sur l'un des deux se connecte à DeepSeek en changeant l'adresse et la clé. La documentation cite Claude Code, GitHub Copilot ou OpenCode parmi les outils compatibles.

03 · Les prix

Le prix réel de l'API.

DeepSeek facture au million de tokens, entrée et sortie séparées. Particularité : deux grilles selon l'heure. Voici les prix affichés le 27 septembre 2026, en dollars :

Par million de tokens V4.1-Flash, heures pleines V4.1-Flash, heures creuses V4-Pro, heures pleines V4-Pro, heures creuses
Entrée (en cache) 0,006 $ 0,003 $ 0,044 $ 0,022 $
Entrée (hors cache) 0,30 $ 0,15 $ 1,32 $ 0,66 $
Sortie 1,20 $ 0,60 $ 3,96 $ 1,98 $

Les heures pleines vont de 1 h à 4 h et de 6 h à 10 h UTC, du lundi au vendredi, hors jours fériés chinois. Soit, à l'heure d'été de Paris, de 3 h à 6 h et de 8 h à 12 h en semaine (de 2 h à 5 h et de 7 h à 11 h à l'heure d'hiver). Tout le reste, week-ends compris, est en heures creuses, à moitié prix.

Ordre de grandeur : traiter un million de tokens en entrée et produire un million de tokens en sortie avec V4.1-Flash, en heures creuses, revient à 0,75 $. Pour comparaison, Mistral affiche Mistral Large à 0,5 $ en entrée et 1,5 $ en sortie par million de tokens. Deux conseils pour payer encore moins : lancer les traitements de masse l'après-midi ou le week-end, et réutiliser les mêmes débuts de prompt pour profiter du cache.

04 · Données et RGPD

Où vont vos données.

C'est le point qui compte le plus pour une entreprise. La politique de confidentialité de DeepSeek indique que l'entreprise collecte, traite et stocke les données personnelles en République populaire de Chine. Elle a désigné un représentant dans l'Union européenne pour les demandes liées aux droits des personnes, et précise que ses services ne sont pas conçus pour traiter des données personnelles sensibles.

Notre recommandation, simple :

  • Pour tester, rédiger, explorer sans donnée confidentielle : l'assistant gratuit et l'API conviennent.
  • Pour des données clients, RH, financières ou stratégiques : ne pas passer par l'application ni par l'API publiques.

La bonne nouvelle, c'est qu'on peut garder le prix bas sans exposer ses données : les modèles sont ouverts.

05 · Les modèles ouverts

Profiter de DeepSeek sans exposer ses données.

DeepSeek publie les poids de DeepSeek-V4.1-Flash et de DeepSeek-V4-Pro sur Hugging Face, sous licence MIT, qui autorise l'usage commercial. Concrètement, on peut les faire tourner :

  • sur un serveur GPU loué chez un hébergeur européen, où les données ne quittent pas l'Europe ;
  • chez un fournisseur d'inférence hébergé en Europe, s'il propose ces modèles ;
  • sur vos propres machines, si vous avez déjà l'infrastructure.

La contrepartie : ces modèles sont volumineux et demandent des GPU adaptés. Le calcul se fait au cas par cas, selon le volume à traiter. Pour un usage ponctuel, un fournisseur européen comme Mistral peut être plus simple : voir Le Chat de Mistral devient Vibe.

06 · Les usages

DeepSeek en entreprise : les bons usages.

DeepSeek est particulièrement intéressant quand le volume est élevé et la donnée peu sensible :

  • Traitement de masse : classer, résumer ou extraire des informations de milliers de documents publics ou internes non confidentiels, en heures creuses.
  • Agents et automatisations : le modèle rapide et bon marché d'un agent qui enchaîne beaucoup d'appels, avec l'appel d'outils et la sortie JSON.
  • Développement : un modèle de code à bas coût dans les outils compatibles, pour les projets sans code confidentiel.

Dans un système bien conçu, DeepSeek n'est qu'un des modèles possibles : on envoie chaque tâche vers le modèle qui offre le meilleur compromis entre coût, qualité et confidentialité. C'est l'approche détaillée dans Quelle IA choisir en 2026, et celle que nous appliquons dans nos agents IA sur mesure.

07 · Questions fréquentes

DeepSeek : ce qu'on nous demande.

DeepSeek, c'est quoi ?

Une entreprise chinoise d'intelligence artificielle, basée à Hangzhou, qui développe des modèles de langage. Elle propose un assistant gratuit (site web et application mobile), une API payante à l'usage, et publie les poids de ses modèles sous licence MIT.

DeepSeek est-il gratuit ?

L'assistant, oui : l'application est gratuite sur l'App Store, sans achat intégré affiché, et le chat est accessible sur le web. L'API, elle, se paie au million de tokens, par prélèvement sur un solde rechargé à l'avance.

Combien coûte l'API DeepSeek ?

Au 27 septembre 2026, DeepSeek-V4.1-Flash coûte 0,30 $ par million de tokens en entrée et 1,20 $ en sortie aux heures de pointe ; DeepSeek-V4-Pro coûte 1,32 $ et 3,96 $. En dehors des heures de pointe, les prix sont divisés par deux, et les entrées déjà en cache coûtent beaucoup moins.

Quelle différence entre DeepSeek V4 Flash et V4 Pro ?

V4.1-Flash est le modèle rapide et économique, avec compréhension des images. V4-Pro est le modèle le plus puissant, sans vision, trois à quatre fois plus cher. Les deux acceptent 1 million de tokens de contexte, l'appel d'outils et un mode de raisonnement activé par défaut.

DeepSeek est-il compatible avec le RGPD ?

D'après sa politique de confidentialité, DeepSeek collecte, traite et stocke les données personnelles en République populaire de Chine, et a désigné un représentant dans l'Union européenne. Pour des données clients ou sensibles, nous recommandons de ne pas passer par l'application ni par l'API publiques, mais d'héberger les modèles ouverts en Europe ou de choisir un fournisseur européen.

Peut-on installer DeepSeek sur son propre serveur ?

Oui. DeepSeek publie les poids de DeepSeek-V4.1-Flash et DeepSeek-V4-Pro sur Hugging Face, sous licence MIT, qui autorise l'usage commercial. Il faut en revanche des serveurs équipés de GPU à la hauteur de la taille des modèles.

La suite

Et si on regardait
votre cas?

Un appel de 20 minutes, gratuit. On regarde ce qui vous prend du temps et on vous dit franchement ce qui vaut la peine d'être automatisé. Sinon aussi.

Réserver un appel de 20 min → Voir nos services
Gratuit · 20 minutes · Réponse sous 24 h