Moonshot AI veut entraîner Kimi K4 avec les GPU Blackwell 

Suivez Intelligence-Artificielle

Malgré les restrictions américaines sur les exportations de puces vers la Chine, Moonshot AI ne compte pas ralentir ses ambitions. La startup chinoise chercherait à obtenir des GPU Nvidia Blackwell, les processeurs les plus avancés de Nvidia, afin d’entraîner Kimi K4, le successeur de son modèle Kimi K3.

Cette nouvelle offensive intervient dans un contexte de fortes tensions entre Washington et Pékin autour de l’intelligence artificielle. Alors que Moonshot AI fait déjà l’objet d’accusations de contournement des sanctions américaines, l’entreprise poursuit ses investissements pour développer une nouvelle génération de modèles toujours plus puissants.

Moonshot AI prépare déjà la relève de Kimi K3

D’après les informations du média The Information, la startup Moonshot AI cherche à réunir un maximum de GPU Blackwell pour renforcer sa puissance de calcul. L’objectif est clair : disposer des ressources nécessaires pour développer un modèle encore plus performant que Kimi K3, présenté à la mi-juillet 2026.

Youtube video

Dans le domaine de l’IA générative, la capacité de calcul est devenue un facteur déterminant. Les modèles les plus avancés nécessitent des milliers de puces fonctionnant en parallèle pendant plusieurs semaines, voire plusieurs mois. Pour Moonshot AI, accéder aux dernières générations de GPU de Nvidia représente donc un enjeu stratégique.

Kimi K3 a marqué les esprits

Dévoilé en open-weight à la mi-juillet, Kimi K3 est un modèle multimodal qui revendique près de 2 800 milliards de paramètres. Son architecture repose sur un système de 896 experts, une approche qui permet d’améliorer l’efficacité des calculs tout en limitant la consommation de mémoire. Le modèle prend également en charge une fenêtre de contexte pouvant atteindre un million de tokens.

Ses performances auraient rapidement attiré l’attention de plusieurs grands acteurs du secteur. Selon des estimations relayées par Microsoft, utiliser Kimi K3 pour faire fonctionner Copilot pourrait réduire les coûts d’inférence de près de 600 millions de dollars.

L’annonce du modèle a également eu des répercussions sur les marchés financiers. Les investisseurs ont temporairement sanctionné l’action Nvidia, faisant reculer la capitalisation boursière du groupe. Dans le même temps, Moonshot AI a bouclé une levée de fonds de 3,5 milliards de dollars, portant sa valorisation à environ 35 milliards de dollars.

Youtube video

Des accusations de contournement des sanctions

Cette course aux GPU intervient alors que Moonshot AI est déjà sous le feu des critiques de l’administration américaine. Michael Kratsios, directeur de l’Office of Science and Technology Policy sous l’administration Trump, accuse la startup chinoise d’avoir contourné les règles d’exportation imposées par les États-Unis. Selon les autorités américaines et Anthropic, Moonshot AI aurait eu accès à des GPU Nvidia GB300 installés dans des centres de données situés en Chine et en Thaïlande.

Washington affirme également que Kimi K3 aurait été entraîné, au moins en partie, grâce à une technique de distillation reposant sur les réponses du modèle Fable d’Anthropic. Moonshot AI rejette toutefois ces accusations. L’entreprise rappelle que Fable n’a été de nouveau accessible qu’à la fin du mois de juin 2026. Selon elle, ce délai est trop court pour avoir permis l’entraînement d’un modèle aussi massif avant son lancement à la mi-juillet.

Une nouvelle bataille autour de l’IA open-weight

Pour entraîner Kimi K3, Moonshot AI avait déjà mobilisé plusieurs centres de données chinois reliés entre eux, chaque serveur étant équipé de huit GPU. Avec Kimi K4, la startup viserait une infrastructure encore plus puissante afin de dépasser les capacités de son modèle actuel.

Cette montée en puissance pourrait toutefois raviver les tensions entre Washington et Pékin. L’administration américaine étudierait la possibilité de restreindre davantage les modèles open-weight développés par des entreprises chinoises.

À l’inverse, plusieurs géants du secteur, dont Nvidia, Microsoft, Meta, Dell et Mistral AI, ont récemment signé une lettre commune pour défendre le maintien d’un écosystème open-weight. Selon eux, l’ouverture des modèles reste un moteur essentiel de l’innovation, même dans un contexte de rivalité technologique de plus en plus marqué.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

Nubia présente le NaviX Ultra et son agent IA

Le NaviX Ultra de Nubia veut changer la manière dont nous utilisons un smartphone. Au lieu de se limiter à répondre aux demandes de l’utilisateur,

21 juillet 2026

NVIDIA Rubin adopte un système de refroidissement liquide à 45 °C

NVIDIA prépare un changement important dans la conception de ses supercalculateurs dédiés à l’intelligence artificielle. Avec sa nouvelle architecture Rubin, le constructeur abandonne le refroidissement

21 juillet 2026

230 $ ? Mais qui va acheter ce petit clavier d’OpenAI ?

230 $ ? Mais qui va acheter ce petit clavier d’OpenAI ?

J’ai personnellement attendu avec impatience le premier projet matériel de Sam Altman et de Jony Ive. Et hier, j’ai eu vent du développement d’une enceinte

16 juillet 2026

OpenAI prépare une enceinte dotée d’une personnalité

OpenAI prépare une enceinte dotée d’une personnalité

Alors que les rumeurs prêtaient depuis plusieurs années à OpenAI l’ambition de concevoir un smartphone capable de concurrencer l’iPhone, le laboratoire de San Francisco a

15 juillet 2026

Samsung prépare une puce pour démocratiser l’IA sur les PC d’entrée de gamme

Samsung prépare une puce pour démocratiser l’IA sur les PC d’entrée de gamme

La puce IA Samsung GAIA permet d’exécuter des calculs complexes sur des ordinateurs portables d’entrée de gamme, grâce à une gravure en 4 nanomètres.  D’après

15 juillet 2026

Meta décode les pensées en texte sans implant cérébral

L’entreprise Meta développe actuellement le système non invasif Brain2Qwerty v2. Cette technologie décode l’activité cérébrale pour transcrire les pensées des utilisateurs directement en texte complet.

2 juillet 2026