Tarifs API relevés jusqu'à 4,5x en heure de pointe depuis le 16 août 2026
Harness, une infrastructure open source pour agents de code, rivalise avec Claude Code
V4-Flash-Vision-Exp ajoute la compréhension d'images, mais les benchmarks restent nuancés
01Définition
Qu'est-ce que DeepSeek, au juste ?
DeepSeek est à la fois une entreprise basée à Hangzhou (Chine), une famille de modèles de langage et une application de chat accessible gratuitement. Devenue mondialement connue début 2025 avec son modèle de raisonnement R1, elle confirme en 2026 sa stratégie : des modèles open source de niveau quasi frontière, à une fraction du prix des solutions américaines.
Sa particularité tient à deux choix structurants : l’open source (les poids des modèles sont téléchargeables et auto-hébergeables) et un rapport performance/prix agressif, rendu possible par une architecture Mixture-of-Experts (MoE) très optimisée.
L’application est utilisable gratuitement et sans limite de requêtes via le site officiel ou les applications mobiles. Les développeurs peuvent aussi accéder aux modèles via l’API, sur des plateformes comme OpenRouter, ou en auto-hébergement depuis Hugging Face.
L’équation « quasi frontière, prix cassé » a toutefois évolué au fil de l’été 2026 : après une nouvelle baisse de 50 % en août, DeepSeek a au contraire fortement relevé ses tarifs API à partir du 16 août (jusqu’à 4,5 fois plus cher pour V4-Pro aux heures de pointe), tout en lançant Harness, une infrastructure open source pour agents de code — une manière de faire reposer sa valeur autant sur l’environnement de travail que sur le prix du modèle. DeepSeek reste malgré tout nettement moins cher que les offres américaines haut de gamme.
02Évolution & versions
Des origines à aujourd'hui
Janvier 2025
R1
Le modèle de raisonnement R1 provoque une chute boursière historique pour Nvidia (environ 600 milliards de dollars effacés), en démontrant des coûts d’entraînement bien inférieurs à ceux des labos américains.
Été 2025
V3 et V3.1
DeepSeek V3.1 (685 milliards de paramètres) unifie les lignes de produits et impressionne par ses scores sur les benchmarks de code, à un coût des dizaines de fois inférieur aux concurrents fermés.
24 avril 2026
V4 (preview)
Lancement en preview sous licence MIT sur Hugging Face, en deux variantes V4-Pro et V4-Flash, avec un million de tokens de contexte et un mode de raisonnement optionnel qui remplace progressivement R1.
Mai 2026
Baisse de prix V4-Pro
DeepSeek rend permanente une baisse de 75 % du prix de V4-Pro, le rendant plusieurs dizaines de fois moins cher que les modèles haut de gamme américains à l’usage.
4 août 2026
V4-Flash
Nouvelle génération open-weight accompagnée d’une baisse de 50 % du prix des tokens et de l’abandon d’une tarification dynamique déjà annoncée — DeepSeek mise sur la conquête plutôt que la rentabilité immédiate.
16 août 2026
Hausse des prix & Harness
Revirement stratégique : les tarifs API de V4-Pro et V4-Flash augmentent fortement (jusqu’à 4,5× pour V4-Pro en heure de pointe), avec une grille différenciée heures pleines / heures creuses. En parallèle, DeepSeek lance Harness v0.1, une infrastructure open source (licence MIT) pour agents de code, pensée comme rivale de Claude Code mais compatible avec d’autres modèles.
0,66 $ à 1,32 $/ M tokens en sortie (creux / pointe)
Version légère, optimisée vitesse et coûts
Tarification différenciée depuis le 16 août 2026
Vision expérimentale (V4-Flash-Vision-Exp)
API V4-Pro
Développeurs
1,98 $ à 3,96 $/ M tokens en sortie (creux / pointe)
Modèle phare (1,6 T paramètres)
Performance maximale code et raisonnement
Prix relevé jusqu'à 4,5× le 16 août 2026
Auto-hébergement
Open source
Gratuit
Poids sous licence MIT
Téléchargement sur Hugging Face
Nécessite une infrastructure serveur
Depuis le 16 août 2026, l’API applique une tarification différenciée heures pleines / heures creuses, nettement plus chère qu’auparavant (jusqu’à 4,5x pour V4-Pro en pointe) ; DeepSeek reste toutefois moins cher que les modèles haut de gamme d’OpenAI ou d’Anthropic à l’usage.
04Comment y accéder
Où et comment l'utiliser
Interface web et mobile
chat.deepseek.com + apps iOS/Android
Gratuit, sans limite de requêtes
API
API DeepSeek (aussi via OpenRouter)
Tarifs très bas, idéale pour développeurs et applications à fort volume
Auto-hébergement
Téléchargement des poids sur Hugging Face
Licence MIT ; modèle complet nécessite une infrastructure serveur
Harness
Infrastructure agent de code (v0.1)
Open source (MIT), compatible avec d'autres modèles, rival de Claude Code
05Fonctionnalités
Ce que ça permet de faire
V4-Pro
Modèle phare à 1,6 billion de paramètres, taillé pour la performance maximale en code et en raisonnement.
V4-Flash
Version légère optimisée pour la vitesse et les coûts, avec une variante vision expérimentale (V4-Flash-Vision-Exp).
Poids open source
Modèles publiés sous licence MIT, téléchargeables librement sur Hugging Face.
Harness
Infrastructure d’agent de code open source (v0.1), pensée comme un rival direct de Claude Code.
API à très bas coût
Tarification différenciée creux/pointe depuis août 2026, particulièrement compétitive pour les applications à fort volume.
Interface web et mobile gratuite
chat.deepseek.com et les applications iOS/Android sont utilisables sans limite de requêtes, sans compte payant.
06Limites & risques
Ce qu'il faut garder en tête
Confidentialité et hébergement
L’application grand public traite les données sur des serveurs en Chine, ce qui peut poser problème pour des usages réglementés (RGPD, données sensibles). L’auto-hébergement est alors recommandé.
Censure et biais
Comme d’autres modèles chinois, DeepSeek peut éviter ou orienter certaines réponses sur des sujets politiquement sensibles.
Statut preview
V4 est encore étiqueté preview ; son comportement peut évoluer. Pour la production, il est conseillé de figer la version et de prévoir une re-validation.
Hallucinations
Comme tous les LLM, DeepSeek peut produire des informations inexactes ; la vérification reste nécessaire.
Prix moins prévisible
Depuis le 16 août 2026, l’API applique une tarification différenciée heures pleines / heures creuses nettement plus élevée qu’auparavant ; DeepSeek n’est plus un simple argument « prix cassé » à toute heure.
Autopromotion à nuancer
DeepSeek revendique une performance proche de Claude Opus 4.8 pour V4-Flash-Vision-Exp, mais son propre tableau de benchmarks ne le montre gagnant que sur 3 tests sur 11 — à prendre avec précaution.
07Conseils par profil
Faut-il utiliser DeepSeek ?
Utilisateur gratuit
L’interface web et les apps mobiles s’utilisent sans limite de requêtes ni abonnement.
Développeur économe
L’API DeepSeek (dès 0,66 $/M tokens en V4-Flash) reste parmi les moins chères du marché pour les applications à fort volume.
Entreprise soucieuse de confidentialité
L’auto-hébergement des poids sous licence MIT évite de transmettre ses données, mais impose de gérer sa propre infrastructure serveur.
Développeur d'agents de code
Harness offre une alternative open source à Claude Code, compatible avec d’autres modèles que ceux de DeepSeek.
Une startup chinoise d’IA basée à Hangzhou et la famille de modèles de langage open source qu’elle développe. Connue pour son modèle R1 en 2025, elle propose en 2026 la génération V4 (V4-Pro et V4-Flash), avec un rapport performance/prix très agressif.
DeepSeek est-il gratuit ?
Oui. L’application web et mobile est utilisable gratuitement et sans limite de requêtes, et les poids des modèles sont téléchargeables gratuitement sur Hugging Face. Seule l’API, destinée aux développeurs, est payante — mais à des tarifs très bas.
Quel est le dernier modèle de DeepSeek ?
Le plus récent est DeepSeek V4, lancé en preview le 24 avril 2026, décliné en V4-Pro (performance maximale) et V4-Flash (vitesse et coûts). V4 remplace progressivement la ligne de raisonnement R1.
DeepSeek est-il vraiment open source ?
Oui, les poids de DeepSeek V4 sont publiés sous licence MIT sur Hugging Face, ce qui permet de les télécharger, les modifier et les auto-héberger. C’est un positionnement frontal face aux stratégies fermées d’OpenAI et de Google.
DeepSeek est-il fiable pour les données sensibles ?
L’application grand public traite les données sur des serveurs en Chine, ce qui peut poser problème pour des usages réglementés (RGPD, données confidentielles). Pour ces cas, l’auto-hébergement des modèles open source est l’option recommandée.
Pourquoi DeepSeek est-il si peu cher ?
Grâce à une architecture Mixture-of-Experts très optimisée et à l’usage de puces chinoises (Huawei Ascend). Le rapport prix/performance reste agressif, mais moins mécanique qu’avant : après une baisse de 75 % en mai puis de 50 % début août 2026, DeepSeek a au contraire fortement relevé ses tarifs API le 16 août (jusqu’à 4,5× en heure de pointe pour V4-Pro), tout en restant nettement moins cher que les modèles haut de gamme américains.
Qu'est-ce que DeepSeek Harness ?
Lancé le 16 août 2026 sous licence MIT, Harness est une infrastructure open source destinée aux agents IA capables d’accomplir des tâches longues sur du code : explorer des fichiers, manipuler du code, interagir avec des outils. Pensé comme un rival de Claude Code, il se distingue par une architecture ouverte compatible avec des modèles d’autres fournisseurs.
DeepSeek a-t-il vraiment rattrapé Claude Opus 4.8 ?
Pas encore, malgré la communication de DeepSeek. Avec V4-Flash-Vision-Exp (août 2026), l’entreprise revendique des performances proches de Claude Opus 4.8 sur les benchmarks d’agents multimodaux, mais son propre tableau ne le montre gagnant que sur 3 tests sur 11 — à nuancer donc.
Ne manquez plus rien
Retrouvez BlogNT en priorité sur Google
Ajoutez-nous à vos sources préférées : nos analyses et tests remontent en tête de votre fil Google Actualités et de la recherche.
To provide the best experiences, we and our partners use technologies like cookies to store and/or access device information. Consenting to these technologies will allow us and our partners to process personal data such as browsing behavior or unique IDs on this site and show (non-) personalized ads. Not consenting or withdrawing consent, may adversely affect certain features and functions.
Click below to consent to the above or make granular choices. Your choices will be applied to this site only. You can change your settings at any time, including withdrawing your consent, by using the toggles on the Cookie Policy, or by clicking on the manage consent button at the bottom of the screen.
Fonctionnel
Toujours activé
L’accès ou le stockage technique est strictement nécessaire dans la finalité d’intérêt légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’effectuer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
L’accès ou le stockage technique est nécessaire dans la finalité d’intérêt légitime de stocker des préférences qui ne sont pas demandées par l’abonné ou l’internaute.
Statistiques
Le stockage ou l’accès technique qui est utilisé exclusivement à des fins statistiques.Le stockage ou l’accès technique qui est utilisé exclusivement dans des finalités statistiques anonymes. En l’absence d’une assignation à comparaître, d’une conformité volontaire de la part de votre fournisseur d’accès à internet ou d’enregistrements supplémentaires provenant d’une tierce partie, les informations stockées ou extraites à cette seule fin ne peuvent généralement pas être utilisées pour vous identifier.
Marketing
L’accès ou le stockage technique est nécessaire pour créer des profils d’internautes afin d’envoyer des publicités, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web ayant des finalités marketing similaires.