DeepSeek lance officiellement V4-Pro et intensifie la bataille des modèles chinois

DeepSeek vient de rendre officiellement disponible la version générale de son modèle d’intelligence artificielle V4-Pro, son système le plus puissant à ce jour. Accessible dans l’application, sur le Web et par API, cette nouvelle version vise notamment les agents d’IA, la programmation et les tâches complexes nécessitant plusieurs étapes.

V4-Pro avait déjà été présenté en avril sous forme préliminaire. Le modèle repose sur une architecture à experts multiples comptant 1,6 billion de paramètres, dont environ 49 milliards sont activés pour chaque jeton traité. Il peut gérer une fenêtre de contexte allant jusqu’à un million de jetons, soit suffisamment pour analyser de très grandes quantités de texte ou de code dans une seule session.

DeepSeek affirme avoir particulièrement amélioré les capacités de V4-Pro comme agent autonome. The Information rapporte que sur Terminal Bench 2.1, un test consacré aux tâches réalisées dans un environnement informatique, le modèle obtient un score de 87,9, contre 82,7 pour V4-Flash. DeepSeek publie également des gains sur plusieurs évaluations de programmation, d’automatisation et d’utilisation d’outils. Comme toujours avec des résultats publiés par le fabricant, ces chiffres doivent être distingués des évaluations indépendantes.

Artificial Analysis classe actuellement V4-Pro parmi les modèles ouverts les plus performants qu’il a évalués. Le modèle obtient 53 à son Intelligence Index et fonctionne à environ 78 jetons par seconde. Le service estime son coût actuel à environ 0,435 $ US par million de jetons en entrée et 0,87 $ en sortie. DeepSeek prévoit toutefois modifier sa tarification à compter du 16 août avec des prix différents selon les heures de pointe et les périodes moins achalandées.

Cette tarification demeure l’un des principaux arguments de DeepSeek. L’entreprise chinoise s’est fait connaître en proposant des modèles capables de rivaliser avec des systèmes beaucoup plus coûteux à exploiter. Reuters rapportait déjà au début du mois que son modèle V4-Flash était de loin l’un des moins chers parmi les grands modèles évalués par Artificial Analysis.

V4-Pro arrive surtout dans un marché chinois devenu particulièrement compétitif. Moonshot AI a récemment lancé Kimi K3, un modèle ouvert de 2,8 billions de paramètres, dont 104 milliards actifs, doté lui aussi d’une fenêtre de contexte d’un million de jetons. Kimi K3 accepte également les images et a été conçu pour la programmation, le raisonnement, le travail documentaire et les agents capables d’exécuter des tâches sur une longue période.

La confrontation entre DeepSeek et Moonshot illustre une évolution importante du marché de l’IA en Chine. Les entreprises ne cherchent plus seulement à rattraper les grands modèles américains. Elles se livrent désormais une concurrence directe sur les performances, l’ouverture des modèles et surtout le coût d’utilisation. Pour les développeurs et les entreprises, cette guerre des prix pourrait devenir aussi importante que la course aux performances elles-mêmes.

Source : the information, artificial analysis

+++++++

Du lundi au vendredi, Bruno Guglielminetti vous propose un regard sur
l’essentiel de l’actualité numérique avec 120 secondes de Tech.

Ou encore…

Écoutez la plus récente édition de Mon Carnet,
le magazine hebdomadaire de l’actualité numérique.


En savoir plus sur Mon Carnet

Subscribe to get the latest posts sent to your email.

Laisser un commentaire