DeepSeek V4 Flash défie OpenAI en quelques heures, rendu Opus à 0,28 €/M tokens, Moonshot monte avec 20 000 GPU NVIDIA

OpenAI a lancé une guerre des prix sur le marché des IA, mais la riposte chinoise a été quasi immédiate. DeepSeek et Moonshot ont dégainé des modèles et des clusters de GPU qui pourraient bien redessiner les rapports de force. Voici comment Pékin entend prendre l’avantage sur le terrain de la puissance de calcul et des tarifs.

OpenAI fait face à une contre-attaque chinoise simultanée dans la guerre des prix

Comme nous le relations récemment, OpenAI a déclenché une véritable guerre des prix en réduisant de 80 % le tarif de son GPU GPT-5.6 Luna. Les tokens d’entrée sont désormais facturés 0,20 € par million, contre 1,00 € auparavant, et les tokens de sortie passent de 6,00 € à 1,20 € par million.

OpenAI a justifié cette baisse massive par des gains d’efficacité architecturale sur ses modèles. Pourtant, la plupart des observateurs y ont vu une manœuvre destinée à contrer les laboratoires chinois d’intelligence artificielle.

Quelques heures plus tard, DeepSeek a dévoilé une version rafraîchie de son modèle Flash, le V4 Flash 0731. Avec seulement 284 milliards de paramètres, il offre des performances comparables à celles de l’Opus 4.8 d’Anthropic, un modèle qui reposerait pourtant sur plusieurs billions de paramètres.

DeepSeek frappe au cœur de la stratégie d’OpenAI. Le V4 Flash 0731 est proposé à seulement 0,14 € par million de tokens d’entrée et 0,28 € par million de tokens de sortie. Un tarif qui anéantit tout avantage concurrentiel qu’OpenAI espérait tirer de ses propres réductions.

Bloomberg a par ailleurs rapporté que Moonshot a obtenu d’Alibaba un cluster de calcul composé de 20 000 GPU NVIDIA H200, ce qui augmente considérablement sa capacité d’entraînement.

À lire :  ASUS lance des moniteurs ProArt OLED 27 et 32 pouces 4K avec 1000 nits de luminosité maximale

Moonshot s’est retrouvé au cœur de la rivalité technologique entre la Chine et les États-Unis lorsqu’Anthropic et certains membres de l’administration Trump l’ont accusé d’avoir distillé son modèle Kimi K3 à partir du Fable d’Anthropic.

Les États-Unis soupçonnent depuis longtemps les ingénieurs chinois d’emporter leurs disques durs chargés de modèles vers des pays alliés pour améliorer leurs capacités, en utilisant des techniques d’apprentissage par renforcement sur des GPU NVIDIA de pointe.

Selon des accusations récentes d’un responsable de l’administration Trump, Moonshot posséderait discrètement des serveurs NVIDIA GB300 et aurait pu en obtenir d’autres via la Thaïlande.

Thinking Machines est le seul laboratoire américain capable de rivaliser avec les laboratoires chinois

Thinking Machine vient de dévoiler Inkling-Small, un modèle open-weight de 276 milliards de paramètres. Sur l’indice Artificial Analysis Intelligence, le DeepSeek V4 Flash 0731 mène avec un score de 50 %, tandis que l’Inkling-Small suit de près à 40 %, égalant la performance de l’ancienne version de base du DeepSeek V4 Flash.

Guide Optimisation Pc Windows 11 Jeux Performance Bot Guide Optimisations Pc Windows 10 Jeux Performances Sur Omgpu.com Bot

Guide Comment Reduire Input Lag Latence Omgpu Bot Comment supprimer Coil Whine carte graphique

Vous pourriez aussi aimer