Aller au contenu principal
BlogNT

Comprendre

Qu'est-ce que DeepSeek ?

Définition, fonctionnement, versions, prix, accès et limites de DeepSeek — la fiche de référence pour tout comprendre.

L'ESSENTIEL
  • Tarifs API relevés jusqu'à 4,5x en heure de pointe depuis le 16 août 2026
  • Harness, une infrastructure open source pour agents de code, rivalise avec Claude Code
  • V4-Flash-Vision-Exp ajoute la compréhension d'images, mais les benchmarks restent nuancés
01 Définition

Qu'est-ce que DeepSeek, au juste ?

DeepSeek est à la fois une entreprise basée à Hangzhou (Chine), une famille de modèles de langage et une application de chat accessible gratuitement. Devenue mondialement connue début 2025 avec son modèle de raisonnement R1, elle confirme en 2026 sa stratégie : des modèles open source de niveau quasi frontière, à une fraction du prix des solutions américaines.

Sa particularité tient à deux choix structurants : l’open source (les poids des modèles sont téléchargeables et auto-hébergeables) et un rapport performance/prix agressif, rendu possible par une architecture Mixture-of-Experts (MoE) très optimisée.

L’application est utilisable gratuitement et sans limite de requêtes via le site officiel ou les applications mobiles. Les développeurs peuvent aussi accéder aux modèles via l’API, sur des plateformes comme OpenRouter, ou en auto-hébergement depuis Hugging Face.

L’équation « quasi frontière, prix cassé » a toutefois évolué au fil de l’été 2026 : après une nouvelle baisse de 50 % en août, DeepSeek a au contraire fortement relevé ses tarifs API à partir du 16 août (jusqu’à 4,5 fois plus cher pour V4-Pro aux heures de pointe), tout en lançant Harness, une infrastructure open source pour agents de code — une manière de faire reposer sa valeur autant sur l’environnement de travail que sur le prix du modèle. DeepSeek reste malgré tout nettement moins cher que les offres américaines haut de gamme.

02 Évolution & versions

Des origines à aujourd'hui

  1. Janvier 2025

    R1

    Le modèle de raisonnement R1 provoque une chute boursière historique pour Nvidia (environ 600 milliards de dollars effacés), en démontrant des coûts d’entraînement bien inférieurs à ceux des labos américains.

  2. Été 2025

    V3 et V3.1

    DeepSeek V3.1 (685 milliards de paramètres) unifie les lignes de produits et impressionne par ses scores sur les benchmarks de code, à un coût des dizaines de fois inférieur aux concurrents fermés.

  3. 24 avril 2026

    V4 (preview)

    Lancement en preview sous licence MIT sur Hugging Face, en deux variantes V4-Pro et V4-Flash, avec un million de tokens de contexte et un mode de raisonnement optionnel qui remplace progressivement R1.

  4. Mai 2026

    Baisse de prix V4-Pro

    DeepSeek rend permanente une baisse de 75 % du prix de V4-Pro, le rendant plusieurs dizaines de fois moins cher que les modèles haut de gamme américains à l’usage.

  5. 4 août 2026

    V4-Flash

    Nouvelle génération open-weight accompagnée d’une baisse de 50 % du prix des tokens et de l’abandon d’une tarification dynamique déjà annoncée — DeepSeek mise sur la conquête plutôt que la rentabilité immédiate.

  6. 16 août 2026

    Hausse des prix & Harness

    Revirement stratégique : les tarifs API de V4-Pro et V4-Flash augmentent fortement (jusqu’à 4,5× pour V4-Pro en heure de pointe), avec une grille différenciée heures pleines / heures creuses. En parallèle, DeepSeek lance Harness v0.1, une infrastructure open source (licence MIT) pour agents de code, pensée comme rivale de Claude Code mais compatible avec d’autres modèles.

  7. 21-24 août 2026

    V4-Flash-Vision-Exp

    Version expérimentale de V4-Flash capable de comprendre images et captures d’écran pour des usages agentiques. DeepSeek revendique une performance proche de Claude Opus 4.8, mais son propre tableau de benchmarks ne le montre gagnant que sur 3 tests sur 11.

03 Prix & formules

Combien ça coûte ?

Web et mobile

Grand public
Gratuit
  • Sans limite de requêtes
  • Site officiel chat.deepseek.com
  • Applications iOS et Android

API V4-Flash

Développeurs
0,66 $ à 1,32 $ / M tokens en sortie (creux / pointe)
  • Version légère, optimisée vitesse et coûts
  • Tarification différenciée depuis le 16 août 2026
  • Vision expérimentale (V4-Flash-Vision-Exp)

API V4-Pro

Développeurs
1,98 $ à 3,96 $ / M tokens en sortie (creux / pointe)
  • Modèle phare (1,6 T paramètres)
  • Performance maximale code et raisonnement
  • Prix relevé jusqu'à 4,5× le 16 août 2026

Auto-hébergement

Open source
Gratuit
  • Poids sous licence MIT
  • Téléchargement sur Hugging Face
  • Nécessite une infrastructure serveur

Depuis le 16 août 2026, l’API applique une tarification différenciée heures pleines / heures creuses, nettement plus chère qu’auparavant (jusqu’à 4,5x pour V4-Pro en pointe) ; DeepSeek reste toutefois moins cher que les modèles haut de gamme d’OpenAI ou d’Anthropic à l’usage.

04 Comment y accéder

Où et comment l'utiliser

Interface web et mobile
chat.deepseek.com + apps iOS/Android
Gratuit, sans limite de requêtes
API
API DeepSeek (aussi via OpenRouter)
Tarifs très bas, idéale pour développeurs et applications à fort volume
Auto-hébergement
Téléchargement des poids sur Hugging Face
Licence MIT ; modèle complet nécessite une infrastructure serveur
Harness
Infrastructure agent de code (v0.1)
Open source (MIT), compatible avec d'autres modèles, rival de Claude Code
05 Fonctionnalités

Ce que ça permet de faire

V4-Pro

Modèle phare à 1,6 billion de paramètres, taillé pour la performance maximale en code et en raisonnement.

V4-Flash

Version légère optimisée pour la vitesse et les coûts, avec une variante vision expérimentale (V4-Flash-Vision-Exp).

Poids open source

Modèles publiés sous licence MIT, téléchargeables librement sur Hugging Face.

Harness

Infrastructure d’agent de code open source (v0.1), pensée comme un rival direct de Claude Code.

API à très bas coût

Tarification différenciée creux/pointe depuis août 2026, particulièrement compétitive pour les applications à fort volume.

Interface web et mobile gratuite

chat.deepseek.com et les applications iOS/Android sont utilisables sans limite de requêtes, sans compte payant.

06 Limites & risques

Ce qu'il faut garder en tête

Confidentialité et hébergement

L’application grand public traite les données sur des serveurs en Chine, ce qui peut poser problème pour des usages réglementés (RGPD, données sensibles). L’auto-hébergement est alors recommandé.

Censure et biais

Comme d’autres modèles chinois, DeepSeek peut éviter ou orienter certaines réponses sur des sujets politiquement sensibles.

Statut preview

V4 est encore étiqueté preview ; son comportement peut évoluer. Pour la production, il est conseillé de figer la version et de prévoir une re-validation.

Hallucinations

Comme tous les LLM, DeepSeek peut produire des informations inexactes ; la vérification reste nécessaire.

Prix moins prévisible

Depuis le 16 août 2026, l’API applique une tarification différenciée heures pleines / heures creuses nettement plus élevée qu’auparavant ; DeepSeek n’est plus un simple argument « prix cassé » à toute heure.

Autopromotion à nuancer

DeepSeek revendique une performance proche de Claude Opus 4.8 pour V4-Flash-Vision-Exp, mais son propre tableau de benchmarks ne le montre gagnant que sur 3 tests sur 11 — à prendre avec précaution.

07 Conseils par profil

Faut-il utiliser DeepSeek ?

Utilisateur gratuit

L’interface web et les apps mobiles s’utilisent sans limite de requêtes ni abonnement.

Développeur économe

L’API DeepSeek (dès 0,66 $/M tokens en V4-Flash) reste parmi les moins chères du marché pour les applications à fort volume.

Entreprise soucieuse de confidentialité

L’auto-hébergement des poids sous licence MIT évite de transmettre ses données, mais impose de gérer sa propre infrastructure serveur.

Développeur d'agents de code

Harness offre une alternative open source à Claude Code, compatible avec d’autres modèles que ceux de DeepSeek.

08 Concurrents

Les principales alternatives

Alternative Éditeur Ce qui la distingue
ChatGPT OpenAI

La référence grand public, mais à un coût d’API bien supérieur.

Gemini Google

Intégration profonde à l’écosystème Google.

Claude Anthropic

Référence sur le code complexe et la sécurité.

09 FAQ

Questions fréquentes

Qu'est-ce que DeepSeek ?

Une startup chinoise d’IA basée à Hangzhou et la famille de modèles de langage open source qu’elle développe. Connue pour son modèle R1 en 2025, elle propose en 2026 la génération V4 (V4-Pro et V4-Flash), avec un rapport performance/prix très agressif.

DeepSeek est-il gratuit ?

Oui. L’application web et mobile est utilisable gratuitement et sans limite de requêtes, et les poids des modèles sont téléchargeables gratuitement sur Hugging Face. Seule l’API, destinée aux développeurs, est payante — mais à des tarifs très bas.

Quel est le dernier modèle de DeepSeek ?

Le plus récent est DeepSeek V4, lancé en preview le 24 avril 2026, décliné en V4-Pro (performance maximale) et V4-Flash (vitesse et coûts). V4 remplace progressivement la ligne de raisonnement R1.

DeepSeek est-il vraiment open source ?

Oui, les poids de DeepSeek V4 sont publiés sous licence MIT sur Hugging Face, ce qui permet de les télécharger, les modifier et les auto-héberger. C’est un positionnement frontal face aux stratégies fermées d’OpenAI et de Google.

DeepSeek est-il fiable pour les données sensibles ?

L’application grand public traite les données sur des serveurs en Chine, ce qui peut poser problème pour des usages réglementés (RGPD, données confidentielles). Pour ces cas, l’auto-hébergement des modèles open source est l’option recommandée.

Pourquoi DeepSeek est-il si peu cher ?

Grâce à une architecture Mixture-of-Experts très optimisée et à l’usage de puces chinoises (Huawei Ascend). Le rapport prix/performance reste agressif, mais moins mécanique qu’avant : après une baisse de 75 % en mai puis de 50 % début août 2026, DeepSeek a au contraire fortement relevé ses tarifs API le 16 août (jusqu’à 4,5× en heure de pointe pour V4-Pro), tout en restant nettement moins cher que les modèles haut de gamme américains.

Qu'est-ce que DeepSeek Harness ?

Lancé le 16 août 2026 sous licence MIT, Harness est une infrastructure open source destinée aux agents IA capables d’accomplir des tâches longues sur du code : explorer des fichiers, manipuler du code, interagir avec des outils. Pensé comme un rival de Claude Code, il se distingue par une architecture ouverte compatible avec des modèles d’autres fournisseurs.

DeepSeek a-t-il vraiment rattrapé Claude Opus 4.8 ?

Pas encore, malgré la communication de DeepSeek. Avec V4-Flash-Vision-Exp (août 2026), l’entreprise revendique des performances proches de Claude Opus 4.8 sur les benchmarks d’agents multimodaux, mais son propre tableau ne le montre gagnant que sur 3 tests sur 11 — à nuancer donc.

Retrouvez BlogNT en priorité sur Google

Ajoutez-nous à vos sources préférées : nos analyses et tests remontent en tête de votre fil Google Actualités et de la recherche.

Ajouter BlogNT comme source préférée
Publicité
Sujets abordés