Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

bloombergfinance.biggo+1finance.biggoLe chinois DeepSeek a lancé vendredi une interface de programmation d'application (API) en bêta publique pour son modèle V4 Flash, vantant des capacités d'agents renforcées qui dépassent de loin, selon lui, celles de son système V4-Pro-Preview pourtant plus puissant. Cette initiative marque la transition du modèle vers un accès public plus large, ce qui intensifie la guerre des prix entre laboratoires d'IA chinois et américains.bloomberg
DeepSeek V4 Flash, un modèle de mélange d'experts de 284 milliards de paramètres comptant 13 milliards de paramètres actifs, facture 0,14 $ par million de tokens d'entrée et 0,28 $ par million de tokens de sortie. Ce tarif le rend considérablement moins cher que les offres d'OpenAI alimentées par les GPU de NVIDIA Corporation , même après qu'OpenAI a réduit les coûts de son modèle GPT-5.6 Luna de 80 % le 30 juillet, ramenant le prix d'entrée de Luna à 0,20 $ par million de tokens.finance.biggo+3
L'annonce de la bêta publique s'est accompagnée d'une affirmation précise sur la performance des agents. "Capacités d'agents nettement améliorées, avec des résultats de référence dépassant largement V4-Pro-Preview", a déclaré DeepSeek dans une publication sur son site web, selon Bloomberg. Le modèle était d'abord entré en aperçu le 24 avril avec des poids ouverts sous licence MIT et une fenêtre de contexte d'un million de tokens.api-docs.deepseek+2
Le calendrier est notable. Un jour seulement avant l'annonce de DeepSeek, OpenAI a restructuré ses propres tarifs pour rivaliser sur l'entrée de gamme, réduisant Luna à 0,20 $ en entrée et 1,20 $ en sortie tout en laissant son modèle phare Sol inchangé à 5,00 $ et 30,00 $. Pourtant, même après ces réductions, DeepSeek V4 Flash reste moins cher que Luna tant en entrée qu'en sortie.xenospectrum
Les données citées par CNBC montrent que les modèles chinois peuvent être jusqu'à neuf fois moins chers par token que leurs équivalents américains, la part de tokens consommés par les entreprises américaines sur des modèles chinois restant supérieure à 30 % chaque semaine depuis février. Ion Stoica, professeur d'informatique à l'UC Berkeley et cofondateur de Databricks, a noté que l'écart entre les modèles open source chinois et les systèmes de pointe s'est réduit, passant de six à neuf mois à seulement deux ou trois.finance.biggo
La bêta publique positionne DeepSeek pour capter les charges de travail des entreprises qui privilégient le coût par rapport à la fidélité à la marque, en particulier pour les tâches à fort volume de classification, d'extraction et de codage où l'avantage de vitesse de V4 Flash compte le plus. OpenAI et Anthropic ayant toutes deux déposé confidentiellement leur dossier d'entrée en bourse en juin, la pression pour défendre les marges tout en s'alignant sur les prix chinois ne fera qu'augmenter à mesure que ces entreprises se rapprochent de leur introduction en bourse.finance.biggo