Dernières brèves

Nouveau modèle

Upstage publie Solar Open 2, un modèle coréen de 250 milliards de paramètres à attention hybride

Le 22 juillet 2026, la société sud-coréenne Upstage a publié Solar Open 2, un modèle à mélange d'experts de 250 milliards de paramètres dont 15 milliards activés par jeton, que l'éditeur présente comme un modèle de fondation souverain coréen. L'architecture combine 321 experts, dont un partagé, et une attention hybride alternant une couche à softmax et trois couches d'attention linéaire, sans encodage positionnel. La fenêtre de contexte atteint un million de jetons. Upstage revendique 86,2 sur MMLU-Pro et 92,4 sur LiveCodeBench v6, devant DeepSeek-V4-Flash, ainsi qu'une moyenne de 85,4 sur les évaluations en langue coréenne contre 84,9 pour ce dernier. Le rapport technique a été déposé sur arXiv le même jour. La licence Solar impose le préfixe Solar aux modèles dérivés et la mention « Built with Solar ».

Résultats financiers

Le Kospi clôture en baisse de 4,46 %, plombé par les valeurs d'IA après la percée de Kimi K3 et la flambée du pétrole

Le 20 juillet 2026, l'indice sud-coréen Kospi a clôturé en baisse de 4,46 % à 6 516,27 points, lors de sa première séance depuis un jour férié, entraîné par les poids lourds des semi-conducteurs : Samsung Electronics a perdu 4,7 % et SK Hynix 4,5 %. Selon l'Associated Press, le repli combine trois facteurs : les doutes sur les valorisations des valeurs d'IA après le recul de Wall Street vendredi (Nasdaq -1,4 %), la percée du modèle ouvert chinois Kimi K3, comparée par des analystes au choc DeepSeek, et la flambée du pétrole (Brent +3,2 % à 90,95 dollars) sur fond de tensions autour du détroit d'Ormuz. Le choc est resté essentiellement coréen : Hong Kong a gagné 1,7 %, Shanghai et Sydney ont peu varié, la Bourse de Tokyo étant fermée pour jour férié.

Source : Associated Press
Ranger dans…
Enregistré. Ajouter une note ?
Nouveau modèle

Saturé par la demande pour Kimi K3, Moonshot AI suspend les nouvelles souscriptions à ses offres grand public

Le 19 juillet 2026, Moonshot AI a annoncé la suspension immédiate des nouvelles souscriptions à ses abonnements grand public Kimi, la demande des 48 heures suivant le lancement de Kimi K3 ayant, selon la société, approché les limites de sa capacité de calcul. Les abonnés existants conservent leur accès, la capacité disponible leur étant réservée, et la réouverture se fera par lots au fur et à mesure de l'ajout de capacité ("Our GPUs are feeling it", écrit l'équipe). Selon TechNode, l'offre est réorganisée en deux volets, Kimi Web, App et Work d'un côté, Kimi Code de l'autre, et la publication des poids ouverts complets du modèle reste attendue le 27 juillet. Kimi K3, modèle ouvert de 2 800 milliards de paramètres sorti le 16 juillet, est comparé par plusieurs analystes au choc DeepSeek de janvier 2025.

Nouveau modèle

La percée du modèle chinois Kimi K3 fait reculer le Nasdaq d'environ 1 % et relance le débat sur la course à l'IA à Washington

Le 17 juillet 2026, au lendemain de la sortie du modèle ouvert Kimi K3 de la startup chinoise Moonshot AI, le Nasdaq a clôturé en baisse d'environ 1 %, les investisseurs délestant notamment les valeurs de semi-conducteurs comme Nvidia. Les analyses indépendantes d'Arena et de Vals AI jugent Kimi K3 compétitif avec les modèles de pointe américains. David Sacks, ancien responsable de l'IA à la Maison-Blanche devenu coprésident du conseil présidentiel des conseillers en science et technologie, a averti que les États-Unis risquaient de perdre la course à l'IA, accusant le pays de s'entraver par ses propres restrictions réglementaires. La sortie de Kimi K3, qui a coïncidé avec le discours d'ouverture de Xi Jinping au WAIC de Shanghai, est comparée par plusieurs analystes au choc DeepSeek de janvier 2025.

Ranger dans…
Enregistré. Ajouter une note ?
Appel à projets / AMI / AAP

Cybersécurité : les modèles ouverts ne sont plus qu'à quatre à sept mois de la frontière, selon l'AI Security Institute britannique

Dans une analyse publiée le 17 juillet 2026, l'AI Security Institute britannique livre sa première mesure publique de l'écart entre modèles ouverts et modèles fermés sur les capacités cyber offensives : quatre à sept mois, contre six à dix mois mesurés en 2025. GLM-5.2, publié en juin par le laboratoire pékinois Z.ai, égale sur les tâches cyber de l'institut les meilleurs modèles fermés sortis quatre mois avant lui et rejoint Opus 4.5 (novembre 2025) sur les exercices longs en cyber range ; DeepSeek V4-Pro se situe lui aussi au niveau d'Opus 4.5. L'écart de coût est massif : un parcours de cyber range d'environ 100 millions de tokens revient à quelque 85 dollars avec Opus 4.5 ou 4.6, 46 dollars avec GLM-5.2 et 1,19 dollar avec DeepSeek V4-Pro. L'institut y voit un rétrécissement mesurable de la fenêtre avant qu'une capacité cyber proche de la frontière ne devienne accessible à tous.

DeepSeek, start-up chinoise créée en mai 2023 à Hangzhou, s'est rapidement imposée comme un acteur majeur dans le domaine de l'intelligence artificielle (IA) et plus spécifiquement des modèles de langage massifs (LLM). Filiale du fonds spéculatif High-Flyer, DeepSeek est dirigée par Liang Wenfeng et a pour ambition de rivaliser avec les géants américains de l'IA en proposant des solutions open source innovantes et compétitives.

Lire la suite du profil Mis à jour le 21 juillet 2026
Domaines d'expertise et réalisations principales

DeepSeek se spécialise dans le développement de modèles de langage massifs capables de réaliser des tâches complexes grâce à des capacités de raisonnement avancées. Depuis son lancement, l'entreprise a introduit plusieurs modèles notables, notamment DeepSeek-V3, un modèle de 671 milliards de paramètres qui a été pré-entraîné sur un vaste ensemble de données et se distingue par sa performance et son coût d’entraînement drastiquement réduit. Ce modèle rivalise avec les meilleurs modèles américains, tels que GPT-4o ou Claude 3.5 Sonnet, malgré des ressources matérielles limitées.

En janvier 2025, DeepSeek a fait sensation avec le lancement de DeepSeek-R1, un modèle de raisonnement de première génération qui a perturbé l'écosystème technologique en raison de ses performances impressionnantes et de son coût d’entraînement réduit. Ce modèle a notamment été adopté rapidement par l'industrie automobile chinoise pour des applications d'assistance à la conduite et d'interaction améliorée entre conducteurs et véhicules.

Contributions récentes et projets notables

DeepSeek continue de se mesurer aux géants technologiques avec des mises à jour régulières de ses modèles. En mai 2025, l'entreprise a lancé une mise à jour de son modèle DeepSeek-R1, baptisée DeepSeek-R1-0528, améliorant ainsi ses capacités de raisonnement, de logique, de mathématiques et de programmation. Cette mise à jour permet à DeepSeek de se rapprocher des performances des modèles phares d'OpenAI et de Google tout en renforçant la fiabilité de ses réponses grâce à une réduction significative du taux d'hallucination.

Parallèlement, DeepSeek a entamé une démarche de distillation de ses modèles vers des versions plus légères pour rendre ses solutions accessibles à un plus large public, notamment aux développeurs disposant de ressources matérielles limitées. Cette stratégie vise à démocratiser l'accès à des capacités de raisonnement avancées sans nécessiter une infrastructure coûteuse.

Position dans l'écosystème technologique

DeepSeek s'est imposée comme une alternative sérieuse aux solutions propriétaires américaines, notamment grâce à son approche open source qui favorise l'innovation collaborative. En publiant ses modèles sous licence MIT, l'entreprise permet à la communauté de chercheurs et développeurs d'accéder librement à ses technologies, stimulants ainsi l'innovation et l'évolution de l'écosystème de l'IA open source.

La start-up bénéficie également du soutien du gouvernement chinois, qui voit en elle un vecteur clé pour atteindre l'autosuffisance technologique face aux restrictions américaines sur les exportations de composants stratégiques. DeepSeek s'inscrit dans la stratégie nationale chinoise visant à devenir le leader mondial de l'IA d'ici 2030.

Développements et actualités récentes

DeepSeek a récemment été au centre de l'attention avec la suspension temporaire de son chatbot en Corée du Sud en raison de préoccupations liées à la confidentialité des données. Bien que cela ait mis en lumière certains défis réglementaires, cela n'a pas freiné l'enthousiasme autour de ses technologies, notamment en Chine où le modèle DeepSeek-R1 a été massivement adopté dans des secteurs clés tels que la justice, la cybersécurité et l'administration publique.

Alors que les rumeurs s'intensifient autour du lancement imminent de DeepSeek-R2, l'entreprise semble bien positionnée pour continuer à défier les géants américains et à jouer un rôle central dans l'évolution de l'IA à l'échelle mondiale. Ce prochain modèle devrait offrir un support multilingue étendu et des capacités multimodales, ouvrant la voie à de nouvelles applications dans la création de contenu et l'analyse de données.

En conclusion, DeepSeek se distingue par sa capacité à innover rapidement et à proposer des solutions compétitives sur un marché dominé par des géants technologiques, renforçant ainsi la position de la Chine dans la course mondiale à l'intelligence artificielle.

Articles liés

25 au total
Décision d'autorité (CNIL, CE…) · Commission Européenne

Qwen et DeepSeek : Pékin scelle leurs données d'entraînement, l'AI Act les réclame

02/06
Avancée méthodologique · Cellenza

Aramis-2B : explorer l’équilibre entre performance et frugalité en IA

08/09
Avancée méthodologique · OpenAI

Alternative prometteuse au Chain-Of-Thought : Sapient mise sur une architecture hiérarchique

30/07
Nouveau modèle · Alibaba Cloud

Alibaba lance Qwen3-235B-A22B-Instruct-2507 et rompt avec le raisonnement hybride

23/07
Nouveau modèle · Google Cloud

Mistral AI défie DeepSeek avec Magistral, son premier modèle de raisonnement avancé

11/06
Mise à jour de modèle · DeepSeek

DeepSeek-R1-0528 : la start-up chinoise continue à se mesurer aux géants américains avec une mise à jour de son modèle phare

02/06
Tribune / opinion · Meta AI

Meta AI : l’assistant conversationnel aspire-t-il vraiment les données ?

26/05
Nouveau produit / service · OVHcloud

L'IA clé en main : OVHcloud lance AI Endpoints, sa plateforme serverless d’IA open source

30/04
Tribune / opinion · Chine

De la dépendance à l'autosuffisance : l’ambition IA de la Chine

29/04
Décision d'autorité (CNIL, CE…) · DeepSeek

DeepSeek, suspendu temporairement en Corée du Sud, aurait bien transféré des données personnelles sans consentement

28/04
Nouveau modèle · Meta AI

Meta s'impose dans l'IA multimodale avec les premières versions de Llama 4, Scout et Maverick

07/04
Tribune / opinion · DeepMind

DeepMind invite la communauté de l'IA à collaborer pour que l'IA soit développée de manière sûre et responsable

07/04