DeepSeek
par High-Flyer / DeepSeek AI — Fondé en 2023 à Hangzhou, Chine
Le LLM chinois qui a bouleversé le marché mondial de l'IA en janvier 2025 : avec DeepSeek-R1, un modèle de raisonnement au niveau d'OpenAI o1 publié en open source, DeepSeek a fait chuter Nvidia de 17 % en une séance. Depuis, le laboratoire de Hangzhou a lancé la série V4 (avril 2026) puis V4.1-Flash (10 septembre 2026), multimodal, avec un contexte d'un million de tokens. Le chat reste gratuit et les poids sont ouverts sous licence MIT.
L'histoire de DeepSeek
Du hedge fund chinois au modèle qui a mis à genoux Wall Street, puis à la série V4 : l'ascension la plus rapide de l'histoire de l'IA.
Fondation & DeepSeek-V3
DeepSeek est fondé en 2023 à Hangzhou par Liang Wenfeng, cofondateur du hedge fund High-Flyer, avec une mission claire : des LLMs ouverts et compétitifs pour une fraction du coût des laboratoires américains. Après DeepSeek-Coder et DeepSeek LLM (67 Md de paramètres), V3 sort en décembre 2024 : un modèle MoE de 671 milliards de paramètres (37 Md actifs par token) dont la phase finale d'entraînement a coûté environ 5,6 millions de dollars, hors R&D.
DeepSeek-R1 : le « Spoutnik de l'IA »
Le 20 janvier 2025, DeepSeek publie R1 en open source (licence MIT). Ce modèle de raisonnement, entraîné par apprentissage par renforcement, égale OpenAI o1 en mathématiques (AIME 2024 : 79,8 %), en code et en sciences. Une semaine plus tard, l'app est n°1 de l'App Store américain et Nvidia perd 17 % en une séance, soit près de 600 Md$ de capitalisation. L'investisseur Marc Andreessen parle d'un « moment Spoutnik » de l'IA.
Mises à jour en série, pas de R2
DeepSeek enchaîne V3-0324 (passé sous licence MIT), R1-0528, puis V3.1 en août, premier modèle hybride avec et sans réflexion : le raisonnement est désormais intégré au modèle principal et aucun R2 distinct ne voit le jour. Suivent V3.1-Terminus, V3.2-Exp (septembre, attention parcimonieuse DSA) et V3.2 en décembre, facturé 0,28 $/M tokens en entrée. En septembre, l'article publié dans Nature chiffre l'entraînement du raisonnement de R1 à 294 000 $. Côté Europe, l'Italie bloque l'app dès janvier, puis la République tchèque et la Belgique l'interdisent dans leurs administrations.
DeepSeek V4 : Pro et Flash
DeepSeek publie en préversion V4-Pro (1,6 T de paramètres, 49 Md actifs) et V4-Flash (284 Md, 13 Md actifs), poids sous licence MIT. Le contexte d'un million de tokens devient la norme sur tous les services officiels, le chat propose un mode Instant et un mode Expert, et l'API accepte les formats OpenAI et Anthropic. Les anciens modèles deepseek-chat et deepseek-reasoner sont retirés le 24 juillet 2026.
Levée de fonds & versions finales
DeepSeek boucle son premier tour de table externe, environ 7 milliards de dollars pour une valorisation supérieure à 50 milliards (Reuters). Selon QuestMobile, l'app compte 130 millions d'utilisateurs actifs mensuels en Chine en mai 2026, au 3e rang derrière Doubao et Qwen. Une nouvelle version de V4-Flash (31 juillet) puis la version finale de V4-Pro (13 août) renforcent les capacités d'agent, avec trois niveaux d'effort de réflexion (low, high, max) et une tarification heures pleines / heures creuses.
DeepSeek V4.1-Flash : plus petit, plus fort
V4.1-Flash inaugure une architecture encodeur-décodeur causale : 552 Md de paramètres, mais seulement 8 Md actifs en lecture et 16 Md en génération, avec vision native et poids sous licence MIT. DeepSeek le place devant V4-Pro sur plusieurs benchmarks d'agents. Annoncé sur le départ, V4-Pro reste finalement disponible dans l'API à la demande des utilisateurs, et DeepSeek évoque un futur V4.1-Pro. Fin septembre, l'entreprise publie avec Huawei des outils open source pour les puces Ascend et prépare, selon Reuters, une introduction en Bourse à Shanghai.
Capacités & benchmarks
Avec la série V4 puis V4.1-Flash, DeepSeek se hisse au niveau des meilleurs modèles propriétaires sur le code et les tâches d'agent, tout en publiant ses poids sous licence MIT. Les scores ci-dessous sont annoncés par DeepSeek.
Raisonnement & mathématiques
En mode Max, DeepSeek-V4-Pro annonce 95,2 % sur HMMT (février 2026), 89,8 % sur IMOAnswerBench et 90,1 % sur GPQA Diamond (avril 2026). V4.1-Flash monte à 90,9 % sur GPQA Diamond et 65,6 % sur MathArena Apex (septembre 2026). Chiffres annoncés par DeepSeek.
Code & agents
V4-Pro annonce 93,5 % sur LiveCodeBench et 80,6 % sur SWE-bench Verified, au niveau de Claude Opus 4.6 (80,8 %). V4.1-Flash revendique 74,2 % sur DeepSWE v1.1 et 90,6 % sur Terminal-Bench 2.1, devant V4-Pro. Chiffres annoncés par DeepSeek.
Coût d'entraînement révolutionnaire
La phase finale d'entraînement de DeepSeek-V3 a coûté environ 5,6 millions de dollars (hors R&D), et l'étape de raisonnement de R1 seulement 294 000 $ selon l'article publié dans Nature en septembre 2025. Ces chiffres ont forcé tout le marché à revoir ses hypothèses sur les besoins en calcul.
Architecture MoE ultra-efficace
Les modèles récents reposent sur une architecture Mixture of Experts : V4-Pro compte 1,6 T de paramètres (49 Md actifs), V4-Flash 284 Md (13 Md actifs). V4.1-Flash (552 Md) passe à un encodeur-décodeur causal avec seulement 8 Md de paramètres actifs en lecture et 16 Md en génération, et un cache KV divisé par quatre. Contexte : 1 million de tokens.
Open source & auto-hébergement
Les poids de V4-Pro, V4-Flash et V4.1-Flash sont publiés sous licence MIT sur Hugging Face, usage commercial compris. Les gros modèles exigent un serveur multi-GPU (vLLM, SGLang), tandis que les versions distillées de R1 (1,5 à 70 Md de paramètres) restent la porte d'entrée pour un déploiement local sur du matériel grand public.
Adoption & communauté développeurs
Selon QuestMobile, l'app DeepSeek comptait 130 millions d'utilisateurs actifs mensuels en Chine en mai 2026, au 3e rang derrière Doubao (382 M) et Qwen (167 M). Le dépôt GitHub de DeepSeek-V3 dépasse 104 000 étoiles, et l'API est compatible avec les formats OpenAI et Anthropic, ce qui facilite son intégration dans les outils de code.
Benchmarks clés DeepSeek V4.1-Flash vs V4-Pro et Claude Opus 5.0 (sept. 2026)
| Benchmark | Catégorie | DeepSeek V4.1-Flash | DeepSeek V4-Pro | Claude Opus 5.0 | Source |
|---|---|---|---|---|---|
| GPQA Diamond | Raisonnement scientifique | 90,9 % | 92,4 % | 93,4 % | DeepSeek (sept. 2026) |
| Codeforces (Elo) | Programmation compétitive | 3471 | 3348 | n.c. | DeepSeek (sept. 2026) |
| Terminal-Bench 2.1 | Agents en terminal | 90,6 % | 87,9 % | 89,1 % | DeepSeek (sept. 2026) |
| DeepSWE v1.1 | Ingénierie logicielle | 74,2 % | 62,7 % | 74,0 % | DeepSeek (sept. 2026) |
| HLE avec outils | Raisonnement expert outillé | 63,9 % | 60,0 % | 63,6 % | DeepSeek (sept. 2026) |
| Terminal-Bench 4.0 | Agents, tâches longues | 31,2 % | 12,4 % | 51,8 % | DeepSeek (sept. 2026) |
Scores annoncés par DeepSeek dans la fiche Hugging Face de V4.1-Flash (septembre 2026), en effort de raisonnement maximal, non vérifiés de manière indépendante. n.c. : non communiqué. Sources : Hugging Face deepseek-ai/DeepSeek-V4.1-Flash (sept. 2026) · Hugging Face deepseek-ai/DeepSeek-V4-Pro (avril 2026) · Nature (sept. 2025) · QuestMobile via TechNode (juillet 2026).
Notre avis sur DeepSeek
🎯 Pour quel profil ?
L'API V4.1-Flash coûte 0,30 $/M tokens en entrée et 1,20 $/M en sortie, deux fois moins en heures creuses. Malgré une hausse par rapport à V3.2, elle reste parmi les moins chères du marché pour ce niveau de performance en code et en agents. Pour la recherche, le prototypage ou les applications sans contrainte de confidentialité, le rapport qualité/prix est difficile à battre.
Le chat web et les apps mobiles sont entièrement gratuits, et l'API se paie à l'usage, sans abonnement. En planifiant les traitements lourds hors des heures pleines (tarif divisé par deux), une startup accède à des performances proches des modèles frontier avec un budget très contenu.
95,2 % sur HMMT (février 2026) pour V4-Pro, 90,9 % sur GPQA Diamond pour V4.1-Flash, selon DeepSeek : les modèles DeepSeek restent très solides pour le raisonnement mathématique, la résolution de problèmes en plusieurs étapes et la planification logique, avec trois niveaux d'effort de réflexion.
Les poids sont librement téléchargeables sous licence MIT. V4.1-Flash (552 Md de paramètres, 8 à 16 Md actifs) tourne sur un serveur GPU, et les versions distillées de R1 sur du matériel plus modeste. Hébergés en Europe, ces modèles éliminent le risque lié aux serveurs chinois : c'est la solution pour conjuguer performance DeepSeek et souveraineté des données.
La politique de confidentialité de DeepSeek précise que les données des utilisateurs sont stockées sur des serveurs en Chine. L'app est bloquée en Italie depuis janvier 2025, la République tchèque et la Belgique l'ont proscrite dans leurs administrations, tout comme l'Australie et plusieurs administrations fédérales américaines. En France, la CNIL a lancé des investigations. À éviter absolument pour les données sensibles via l'app ou l'API officielles.
Depuis V4.1-Flash (septembre 2026), DeepSeek comprend nativement les images, mais il ne génère ni images ni vidéos. Pour la création visuelle, ChatGPT ou Gemini restent supérieurs.
“DeepSeek reste le choc le plus important de l'industrie IA depuis le lancement de ChatGPT. Avec la série V4 puis V4.1-Flash, le laboratoire de Hangzhou montre qu'un modèle à poids ouverts sous licence MIT peut tenir tête aux meilleurs modèles propriétaires sur le code et les agents, pour une fraction du prix. Pour les développeurs et chercheurs travaillant sur des données non sensibles, c'est l'un des meilleurs rapports qualité/prix du marché. Mais la souveraineté des données reste un point de blocage réel pour les entreprises européennes. Notre recommandation : auto-héberger les poids en Europe, ou réserver l'app et l'API officielles aux données publiques.”
Combien coûte DeepSeek ?
DeepSeek propose un accès 100 % gratuit via le web et les apps mobiles, une API facturée à l'usage parmi les moins chères du marché, et des poids ouverts pour l'auto-hébergement. Source officielle : api-docs.deepseek.com.
- Mode Instant (réponses rapides)
- Mode Expert pour les tâches complexes
- Contexte d'un million de tokens
- Applications iOS & Android gratuites
- Recherche web & analyse de fichiers
- Données sur serveurs en Chine
- App bloquée en Italie depuis janvier 2025
- Modèle : deepseek-flash (V4.1-Flash)
- Sortie : 1,20 $/M tokens
- Cache hit : 0,006 $/M tokens
- Heures creuses : −50 % (0,15 $ / 0,60 $)
- Contexte 1M tokens, sortie max 384K
- Vision native, modes avec ou sans réflexion
- Plus cher que l'ex-V3.2 (0,28 $ / 0,42 $)
- Modèle : deepseek-v4-pro
- Sortie : 3,96 $/M tokens
- Cache hit : 0,044 $/M tokens
- Heures creuses : −50 % (0,66 $ / 1,98 $)
- 1,6 T paramètres (49 Md actifs), contexte 1M
- Effort de réflexion low / high / max
- Devancé par V4.1-Flash selon DeepSeek
- Téléchargement sur Hugging Face
- V4.1-Flash : 552 Md params. (8 à 16 Md actifs)
- V4-Flash (284 Md) et V4-Pro (1,6 T)
- Usage commercial autorisé
- Inférence via vLLM, SGLang ou Docker
- Hébergement possible en Europe
- Serveur multi-GPU requis pour les gros modèles
ⓘ Tarifs API vérifiés le 1er octobre 2026, par million de tokens. Sources : api-docs.deepseek.com · annonce DeepSeek V4.1-Flash (10 septembre 2026). Heures pleines : 01h00–04h00 et 06h00–10h00 UTC du lundi au vendredi (hors jours fériés chinois) ; le reste du temps, tarif heures creuses à −50 %.
Essayer DeepSeek gratuitement
L'un des LLMs à poids ouverts les plus compétitifs du marché, désormais propulsé par la série V4. Accès 100 % gratuit via l'interface web et les apps mobiles, sans abonnement ni carte bancaire.
Vous voulez intégrer DeepSeek dans votre stack IA en toute sécurité ? Parlons-en avec Digital-m →
Tout savoir sur DeepSeek
Pourquoi DeepSeek a-t-il provoqué un tel choc sur les marchés en janvier 2025 ?
Le lancement de DeepSeek-R1 le 20 janvier 2025 a été un choc économique autant que technique. Le modèle rivalisait avec OpenAI o1 en mathématiques et en raisonnement, tout en étant publié en open source. Surtout, DeepSeek affirmait avoir entraîné son modèle de base V3 pour environ 5,6 millions de dollars (phase finale, hors R&D), puis a chiffré en 2025 l'étape de raisonnement de R1 à 294 000 $ dans la revue Nature, contre des centaines de millions pour les modèles américains. Ce résultat remettait en question l'idée que l'IA frontier exige des dizaines de milliards de dollars d'infrastructure. Le 27 janvier 2025, Nvidia a perdu 17 % en bourse, soit près de 600 milliards de dollars de capitalisation, en une seule séance. L'investisseur Marc Andreessen a qualifié l'événement de « moment Spoutnik » de l'IA. Sources : rapport technique DeepSeek-V3 & Nature (septembre 2025).
Quelle est la différence entre DeepSeek V4-Pro, V4-Flash et V4.1-Flash ?
DeepSeek-V4-Pro (avril 2026, version finale en août) est le grand modèle de la série : 1,6 T de paramètres dont 49 Md actifs, contexte d'un million de tokens, 1,32 $/M tokens en entrée en heures pleines. DeepSeek-V4-Flash (284 Md de paramètres, 13 Md actifs) était sa version rapide et économique ; il est désormais retiré de l'API. DeepSeek-V4.1-Flash (10 septembre 2026) le remplace : 552 Md de paramètres, 8 Md actifs en lecture et 16 Md en génération, vision native, et des scores que DeepSeek annonce supérieurs à ceux de V4-Pro sur plusieurs benchmarks d'agents, pour 0,30 $/M tokens en entrée. Tous ces modèles sont hybrides, avec ou sans réflexion : les anciens modèles deepseek-chat et deepseek-reasoner (V3.2, héritiers de V3 et R1) ont quitté l'API le 24 juillet 2026, et aucun R2 n'a été publié. Sources : api-docs.deepseek.com & Hugging Face (2026).
DeepSeek est-il sûr à utiliser en France et en Europe ?
La réponse dépend de l'utilisation. La politique de confidentialité de DeepSeek précise que les données des utilisateurs sont stockées sur des serveurs en Chine, soumis aux lois chinoises. Plusieurs autorités ont réagi : le Garante italien bloque l'app depuis janvier 2025, la commissaire berlinoise à la protection des données a demandé à Apple et Google de la retirer en Allemagne (juin 2025), et la République tchèque puis la Belgique l'ont interdite dans leurs administrations. En France, DeepSeek n'est pas interdit, mais la CNIL a lancé des investigations. Pour les données non sensibles (recherche publique, prototypage, usage personnel), le risque est limité. Pour les données professionnelles, clients ou R&D stratégique, nous recommandons l'auto-hébergement des poids (licence MIT) sur une infrastructure européenne, ou une alternative européenne comme celles présentées dans notre guide Mistral. Sources : Garante privacy (janvier 2025), TechCrunch (juin 2025), Euronews (juillet 2025), RTBF (septembre 2025).
DeepSeek est-il réellement gratuit ? Comment accéder à son API ?
L'interface chat.deepseek.com et les apps iOS et Android sont entièrement gratuites, sans abonnement ni carte bancaire, avec un mode Instant et un mode Expert. L'API, accessible après inscription sur platform.deepseek.com, est facturée à l'usage : V4.1-Flash (deepseek-flash) coûte 0,30 $/M tokens en entrée et 1,20 $/M en sortie, V4-Pro 1,32 $ et 3,96 $. Ces tarifs sont divisés par deux en heures creuses, c'est-à-dire en dehors des créneaux 01h00–04h00 et 06h00–10h00 UTC en semaine. L'API accepte les formats OpenAI et Anthropic, ce qui simplifie l'intégration dans les outils existants. Les poids des modèles sont également téléchargeables gratuitement sur Hugging Face pour l'auto-hébergement. Source : api-docs.deepseek.com (octobre 2026).
DeepSeek est-il visible dans les résultats GEO (IA générative) ?
DeepSeek est aujourd'hui un canal GEO secondaire pour une PME française, mais à surveiller. Son audience est d'abord chinoise : 130 millions d'utilisateurs actifs mensuels en Chine en mai 2026 selon QuestMobile, au 3e rang derrière Doubao et Qwen (voir notre guide Qwen). Son chat intègre une recherche web, mais son poids dans le trafic IA en Europe reste faible face à ChatGPT, aux AI Overviews de Google ou à Perplexity, qui restent les priorités GEO. DeepSeek constitue un canal complémentaire, surtout auprès des développeurs, des profils techniques et des marchés asiatiques. Pour structurer votre visibilité GEO multi-plateformes, contactez Digital-m.
Peut-on héberger DeepSeek soi-même en France ?
Oui, et c'est même la solution recommandée pour les entreprises européennes souhaitant bénéficier des performances DeepSeek sans les risques liés à la localisation des données en Chine. Les poids des modèles récents (V4-Pro, V4-Flash, V4.1-Flash) sont publiés sous licence MIT sur Hugging Face, usage commercial compris. Ces modèles complets, de 284 Md à 1,6 T de paramètres, nécessitent un serveur multi-GPU et s'exploitent avec vLLM ou SGLang. Pour du matériel plus modeste, les versions distillées de R1 (de 1,5 à 70 Md de paramètres) tournent avec Ollama ou LM Studio : les plus petites sur un GPU grand public, les 32 et 70 Md sur un serveur GPU. En auto-hébergement sur un cloud européen (OVHcloud, Scaleway, Hetzner), les données ne quittent jamais l'Europe.
📋 Sources & références
- DeepSeek, DeepSeek-V4.1-Flash : annonce officielle, septembre 2026 — api-docs.deepseek.com
- DeepSeek, Models & Pricing — API Docs officiels, octobre 2026 — api-docs.deepseek.com
- DeepSeek, Change Log de l'API (V4, V4-Pro, V4.1-Flash), septembre 2026 — api-docs.deepseek.com
- DeepSeek, DeepSeek V4 Preview Release, avril 2026 — api-docs.deepseek.com
- Hugging Face, deepseek-ai/DeepSeek-V4.1-Flash (fiche modèle, benchmarks, licence MIT), septembre 2026 — huggingface.co
- Hugging Face, deepseek-ai/DeepSeek-V4-Pro (fiche modèle et benchmarks), avril 2026 — huggingface.co
- TechNode, QuestMobile : China's AI-native apps reach 499 million monthly active users, juillet 2026 — technode.com
- Reuters via Yahoo Finance, DeepSeek taps CITIC Securities for Shanghai STAR Market IPO, septembre 2026 — finance.yahoo.com
- TechNode Global, DeepSeek and Huawei open Ascend AI programming tools, octobre 2026 — technode.global
- The Decoder, Deepseek says training its R1 model cost just $294,000, septembre 2025 — the-decoder.com
- RTBF, Une circulaire interdit l'usage de l'IA DeepSeek dans les administrations fédérales, septembre 2025 — rtbf.be
- Euronews, Czech Republic bans Chinese AI startup DeepSeek in government work, juillet 2025 — euronews.com
- TechCrunch, German data protection official wants Apple, Google to remove DeepSeek from the country's app stores, juin 2025 — techcrunch.com
- Garante privacy, Intelligenza artificiale : il Garante privacy blocca DeepSeek, janvier 2025 — garanteprivacy.it
- Le Monde Informatique, Pourquoi DeepSeek n'est toujours pas interdit en France, février 2025 — lemondeinformatique.fr
- GitHub, deepseek-ai/DeepSeek-R1 (résultats d'évaluation, licence MIT), 2025 — github.com
Page rédigée et mise à jour par Louis-Marie Mouton — Digital-m, agence SEO & GEO à Nancy. Dernière mise à jour : octobre 2026.