En silence, DeepSeek continue de bousculer le marché des modèles d'IA : le V-4 Flash est le moins cher possible en ce moment

En silence, DeepSeek continue de bousculer le marché des modèles d’IA : le V-4 Flash est le moins cher possible en ce moment

DeepSeek a une fois de plus ébranlé l’industrie technologique avec son nouveau modèle d’IA, mais cette fois pas par surprise, mais par prix. Et comme ils l’expliquent dans Artificial Analysis, la dernière version de son modèle phare, le V4-Flash, est l’option la plus économique parmi tous les modèles d’IA pertinents du marché lorsqu’il s’agit d’accomplir des tâches. Et nous ne parlons pas seulement de coûts, mais cela a aussi beaucoup à dire en matière de références.

Le moins cher. Le coût d’utilisation des modèles d’IA devient de plus en plus une préoccupation majeure pour les entreprises et les développeurs. Quant à DeepSeek, selon les données d’Artificial Analysis, réaliser tous ses tests (appelés Intelligence Index) ne coûte que trois centimes par dollar avec le V4-Flash. Pour nous donner une idée, le même test coûte environ 86 cents avec le Kimi K3 de Moonshot, 1,86 $ avec le GPT-5.6 Sol d’OpenAI et 3,15 $ avec Claude Fable 5 d’Anthropic. Autrement dit, le modèle de DeepSeek serait environ 100 fois moins cher à utiliser que le modèle le plus puissant d’Anthropic.

En détails. DeepSeek facture 0,14 $ par million de jetons d’entrée et 0,28 $ par million de jetons de sortie, bien en dessous de ses concurrents. V4-Flash est la version « légère » de la nouvelle famille de modèles de l’entreprise, conçue pour les tâches quotidiennes à volume élevé, tandis que son frère aîné, V4-Pro, est destiné à des raisonnements plus complexes bien qu’il n’ait pas encore de date de sortie officielle.

En termes de capacité technique, le modèle dispose d’une fenêtre contextuelle d’un million de jetons et d’un total de 284 milliards de paramètres, dont seulement 13 milliards sont activés lors de l’inférence, un système qui nous donne des indices sur la raison pour laquelle il est si bon marché d’utiliser ce modèle.

Coût

Coût par tâche exécutée dans l’Intelligence Index. Image : Analyse artificielle

Pas cher, mais pas mieux. Maintenant, si l’on parle de capacités techniques, elle est à la hauteur des attentes, mais logiquement elle ne surpasse pas les modèles les plus avant-gardistes du moment. Dans le test d’intelligence d’analyse artificielle, V4-Flash obtient 50 points sur 100, le même résultat que le Gemini 3.6 Flash de Google, et légèrement en dessous de Muse Spark 1.1 de Meta et du GLM-5.2 de Z.ai, tous deux avec 51 points.

Les modèles les plus puissants du marché, comme Claude Opus 5, Claude Fable 5 ou GPT-5.6, dépassent ces chiffres d’environ neuf points. De plus, selon le test AA-Omniscience du cabinet d’analyse, V4-Flash ne réussit que 37 % du temps sur les questions de connaissances, avec un taux d’hallucinations de 84 %, ce qui peut se traduire par des erreurs importantes si l’on utilise le modèle pour des tâches critiques sans supervision humaine.

Devenir public. Ce signal d’alarme pourrait aussi avoir une raison. Selon Reuters, DeepSeek se prépare à une éventuelle introduction en bourse, et ce mouvement cherche à reprendre de l’importance en pariant sur ce que la startup d’IA fait de mieux, c’est-à-dire proposer des alternatives ultra-économiques à l’IA.

L’entreprise avait déjà provoqué un séisme sur le marché technologique début 2025 avec son modèle R1, et voilà qu’elle fait à nouveau pression sur les prix du secteur en pleine guerre entre laboratoires chinois et américains. En fait, même si OpenAI réduit le prix du GPT-5.6 jusqu’à 80 %, le nouveau modèle DeepSeek reste environ 60 % moins cher pour des tâches équivalentes.

L’IA a résolu l’un des gros problèmes de la cybersécurité : la détection des bugs. Maintenant nous en avons un autre beaucoup plus grand

Le prix ne fait pas tout. Le fait que le modèle soit bon marché à utiliser est un grand soulagement face à une telle augmentation du coût des jetons. Cependant, comme le souligne Forbes, pour une entreprise qui s’appuie sur un modèle d’IA, les retards, les erreurs, la supervision du modèle ou la perte de confiance ont aussi un prix. Par conséquent, avant d’opter pour le modèle le moins cher, une organisation ou un développeur devrait se demander si cela en vaut vraiment la peine en fonction des capacités techniques du modèle. En fin de compte, l’important est l’équilibre entre coût et capacités, et la bonne nouvelle est qu’il existe de nombreux tests comme l’analyse artificielle qui nous permettent de connaître toutes ces informations et plus sur les modèles.

Et comme si cela ne suffisait pas, ce lancement a été suivi, un jour plus tard, par la présentation du Qwen3.8-Max d’Alibaba, un autre géant en compétition pour le même terrain.

Image de couverture | Solen Feyissa

À Simseo | Google a reçu 800 000 réservations pour une application dans 168 pays. Leur réponse a été de l’annuler.