Dernières brèves

Nouveau modèle

Mistral AI ouvre en préversion Mistral Large 4, modèle multimodal de 1 000 milliards de paramètres dont les poids sortiront fin octobre

Le 6 octobre 2026, Mistral AI a ouvert une préversion publique de Mistral Large 4, accessible par API sur Mistral Studio. Ce modèle à mélange d'experts, multimodal natif, compte 1 000 milliards de… Lire la brève

Source : Mistral AI
Ranger dans…
Enregistré. Ajouter une note ?
Levée de fonds

Selon Bloomberg et Reuters, DeepSeek s'apprête à lever plus de 80 milliards de yuans, Tencent et CATL en tête, avant une IPO en 2027

Le 6 octobre 2026, Bloomberg a rapporté, citant des sources non nommées, que DeepSeek est sur le point de boucler un tour de table d'au moins 80 milliards de yuans, contre un objectif initial… Lire la brève

Nouveau produit / service

Together AI lance Together Link pour faire tourner Claude Code et Codex sur des modèles ouverts, avec une facture annoncée divisée par deux

Le 5 octobre 2026, Together AI a lancé Together Link, qui branche les agents de code déjà utilisés par les équipes sur les modèles ouverts servis par sa plateforme. Le service prend en charge Claude… Lire la brève

Source : Together AI
Ranger dans…
Enregistré. Ajouter une note ?
Mise à jour de modèle

vLLM 0.31.0 réunit 717 commits de 307 contributeurs et garde les poids en mémoire GPU entre deux redémarrages

Le 5 octobre 2026, le projet vLLM a publié la version 0.31.0 de son moteur d'inférence, qui rassemble 717 commits de 307 contributeurs, dont 96 nouveaux. Une nouvelle commande, vllm preload, lance un… Lire la brève

Nouveau modèle

MLCommons publie son Jailbreak Benchmark v1.0 : sous attaque, huit modèles ouverts passent de 11,08 % à 18,65 % de réponses dangereuses

Déposés le 2 octobre et rendus publics par arXiv le 5 octobre 2026, les premiers résultats complets du Jailbreak Benchmark v1.0 de MLCommons succèdent à la version 0.5 d'octobre 2025 et à la… Lire la brève

Source : MLCommons (arXiv)
Ranger dans…
Enregistré. Ajouter une note ?
Nouveau modèle

Selon Bloomberg Intelligence, l'écart de performance entre modèles d'IA américains et chinois tombe à 3 %, contre 15 % en début d'année

Le 4 octobre 2026, Bloomberg a publié les conclusions d'un rapport de Robert Lea, analyste senior de Bloomberg Intelligence : les meilleurs modèles chinois ne sont plus qu'à 3 % de leurs rivaux… Lire la brève

Nouveau modèle

SGLang 0.5.21 agrège 779 contributions, bascule à chaud entre préremplissage et décodage et accélère de 22 % le premier jeton de DeepSeek-V4.1

Le 2 octobre 2026, le projet SGLang a publié la version 0.5.21 de son moteur de service de modèles, qui rassemble 779 pull requests de 227 contributeurs. Les instances de service désagrégé peuvent… Lire la brève

Nouveau modèle

DeepSeek porte sur les puces Huawei Ascend 950 ses bibliothèques DeepGEMM et DeepEP, compatibles avec leurs versions pour GPU NVIDIA

Le 30 septembre 2026, DeepSeek a ouvert sur GitHub DeepGEMM-Ascend et DeepEP-Ascend, portages pour les NPU Huawei Ascend de deux bibliothèques jusqu'ici écrites pour les GPU, l'une de calcul, l'autre… Lire la brève

Source : DeepSeek (GitHub)
Ranger dans…
Enregistré. Ajouter une note ?
Conférence / salon

La commission coréenne de protection des données réunit le 29 septembre à Séoul régulateurs et plateformes sur les garde-fous de l'IA

Le 28 septembre 2026, la commission sud-coréenne de protection des informations personnelles (PIPC) a annoncé la tenue le 29 septembre, à l'El Tower de Yangjae à Séoul, d'un « Global AI Privacy Forum… Lire la brève

Nouveau modèle

NaiveAI ouvre sous licence MIT Naive-N0.5-Flash, 309 milliards de paramètres greffés sur la base MiMo-V2.5 de Xiaomi

Le 27 septembre 2026, NaiveAI a publié sous licence MIT Naive-N0.5-Flash, modèle à mélange d'experts de 309 milliards de paramètres dont 15,5 milliards actifs, destiné au code et à la recherche en… Lire la brève

DeepSeek, start-up chinoise créée en mai 2023 à Hangzhou, s'est rapidement imposée comme un acteur majeur dans le domaine de l'intelligence artificielle (IA) et plus spécifiquement des modèles de langage massifs (LLM). Filiale du fonds spéculatif High-Flyer, DeepSeek est dirigée par Liang Wenfeng et a pour ambition de rivaliser avec les géants américains de l'IA en proposant des solutions open source innovantes et compétitives.

Lire la suite du profil Historique mis à jour le 11 juillet 2025
Domaines d'expertise et réalisations principales

DeepSeek se spécialise dans le développement de modèles de langage massifs capables de réaliser des tâches complexes grâce à des capacités de raisonnement avancées. Depuis son lancement, l'entreprise a introduit plusieurs modèles notables, notamment DeepSeek-V3, un modèle de 671 milliards de paramètres qui a été pré-entraîné sur un vaste ensemble de données et se distingue par sa performance et son coût d’entraînement drastiquement réduit. Ce modèle rivalise avec les meilleurs modèles américains, tels que GPT-4o ou Claude 3.5 Sonnet, malgré des ressources matérielles limitées.

En janvier 2025, DeepSeek a fait sensation avec le lancement de DeepSeek-R1, un modèle de raisonnement de première génération qui a perturbé l'écosystème technologique en raison de ses performances impressionnantes et de son coût d’entraînement réduit. Ce modèle a notamment été adopté rapidement par l'industrie automobile chinoise pour des applications d'assistance à la conduite et d'interaction améliorée entre conducteurs et véhicules.

Contributions récentes et projets notables

DeepSeek continue de se mesurer aux géants technologiques avec des mises à jour régulières de ses modèles. En mai 2025, l'entreprise a lancé une mise à jour de son modèle DeepSeek-R1, baptisée DeepSeek-R1-0528, améliorant ainsi ses capacités de raisonnement, de logique, de mathématiques et de programmation. Cette mise à jour permet à DeepSeek de se rapprocher des performances des modèles phares d'OpenAI et de Google tout en renforçant la fiabilité de ses réponses grâce à une réduction significative du taux d'hallucination.

Parallèlement, DeepSeek a entamé une démarche de distillation de ses modèles vers des versions plus légères pour rendre ses solutions accessibles à un plus large public, notamment aux développeurs disposant de ressources matérielles limitées. Cette stratégie vise à démocratiser l'accès à des capacités de raisonnement avancées sans nécessiter une infrastructure coûteuse.

Position dans l'écosystème technologique

DeepSeek s'est imposée comme une alternative sérieuse aux solutions propriétaires américaines, notamment grâce à son approche open source qui favorise l'innovation collaborative. En publiant ses modèles sous licence MIT, l'entreprise permet à la communauté de chercheurs et développeurs d'accéder librement à ses technologies, stimulants ainsi l'innovation et l'évolution de l'écosystème de l'IA open source.

La start-up bénéficie également du soutien du gouvernement chinois, qui voit en elle un vecteur clé pour atteindre l'autosuffisance technologique face aux restrictions américaines sur les exportations de composants stratégiques. DeepSeek s'inscrit dans la stratégie nationale chinoise visant à devenir le leader mondial de l'IA d'ici 2030.

Développements et actualités récentes

DeepSeek a récemment été au centre de l'attention avec la suspension temporaire de son chatbot en Corée du Sud en raison de préoccupations liées à la confidentialité des données. Bien que cela ait mis en lumière certains défis réglementaires, cela n'a pas freiné l'enthousiasme autour de ses technologies, notamment en Chine où le modèle DeepSeek-R1 a été massivement adopté dans des secteurs clés tels que la justice, la cybersécurité et l'administration publique.

Alors que les rumeurs s'intensifient autour du lancement imminent de DeepSeek-R2, l'entreprise semble bien positionnée pour continuer à défier les géants américains et à jouer un rôle central dans l'évolution de l'IA à l'échelle mondiale. Ce prochain modèle devrait offrir un support multilingue étendu et des capacités multimodales, ouvrant la voie à de nouvelles applications dans la création de contenu et l'analyse de données.

En conclusion, DeepSeek se distingue par sa capacité à innover rapidement et à proposer des solutions compétitives sur un marché dominé par des géants technologiques, renforçant ainsi la position de la Chine dans la course mondiale à l'intelligence artificielle.

Articles liés

37 au total