Dernières brèves

Nouveau modèle

NaiveAI ouvre sous licence MIT Naive-N0.5-Flash, 309 milliards de paramètres greffés sur la base MiMo-V2.5 de Xiaomi

Le 27 septembre 2026, NaiveAI a publié sous licence MIT Naive-N0.5-Flash, modèle à mélange d'experts de 309 milliards de paramètres dont 15,5 milliards actifs, destiné au code et à la recherche en IA. Il part du modèle ouvert MiMo-V2.5-Base de Xiaomi, dont les couches d'attention globale sont remplacées par l'attention creuse de DeepSeek, ce qui donne un contexte natif d'un million de jetons sans aucune couche d'attention pleine ; l'adaptation a demandé 3 250 milliards de jetons de préentraînement supplémentaire. L'éditeur dit confier à ses propres modèles la conception de l'architecture et l'optimisation des systèmes, les chercheurs humains fixant la direction, et faire tourner près de dix millions de bacs à sable par semaine, 100 000 simultanés en pointe. Selon les tableaux qu'il publie, le modèle atteint 73,6 sur SWE-bench Pro, 86,7 sur Terminal-Bench 2.1 et 63,2 sur PaperBench. Les poids pèsent environ 315 gigaoctets et exigent des cartes NVIDIA compatibles FP8.

Nouveau modèle

Xiaomi corrige pour 90 000 dollars la répétition d'appels d'outils de MiMo-V2.6 et republie ses poids sous licence MIT

Le 27 septembre 2026, l'équipe MiMo de Xiaomi a mis en ligne sur Hugging Face deux points de contrôle MOPD de son modèle omnimodal MiMo-V2.6, Pro et Flash, sous licence MIT, et publié le diagnostic d'un défaut signalé après la sortie initiale : le modèle réémettait des appels d'outils identiques sans progresser. En rejouant des cas internes sur la version Flash, l'équipe mesure que la part d'exemples dépassant dix appels par tour montait de 11,1 % au début de l'apprentissage par renforcement à 24,6 % à l'étape 20, et de 30,6 % à 41,7 % dans son harnais MiMo Code. Abaisser de 32 à 8 le seuil de pénalité aurait imposé de reprendre 20 étapes, chiffrées à 2,31 millions de dollars. Xiaomi a retenu la distillation multi-enseignants sur politique : un enseignant spécialisé entraîné en 12 étapes sur environ 7 000 exemples, fusionné ensuite dans le modèle, pour environ 90 000 dollars, soit 4 % de l'alternative. Les modèles d'API mimo-v2.6-pro et mimo-v2.6-flash sont à jour depuis le 25 septembre.

Nouveau modèle

llama.cpp publie la version 0.5.0 : convolutions CUDA accélérées par GEMM implicite et serveur multi-adresses

Le 23 septembre 2026, le projet ggml-org a publié la version 0.5.0 de llama.cpp, moteur d'inférence locale de modèles de langage. Les notes de version retiennent trois points saillants : l'accélération des convolutions conv2d sur CUDA par GEMM implicite, des fusions Metal pour les couches d'experts et pour l'opérateur SSM_CONV, et un serveur capable d'écouter sur plusieurs adresses à la fois, l'option --host acceptant désormais des adresses TCP séparées par des virgules et des sockets UNIX. La version ajoute la prise en charge de HRM-Text (DFM Mimir 1B), la conversion du MiMo-V2.6 de Xiaomi et le support DFlash pour HunyuanOCR, ainsi que la sortie d'images depuis les appels de fonction du serveur. Les analyseurs de conversation corrigés couvrent DeepSeek V3.2 et V4 et qwen3-coder.

Alliance stratégique

La Chine enregistre trois IA génératives embarquées dans les téléphones de Honor, Xiaomi et JieYue

Le 23 septembre 2026, l'administration chinoise du cyberespace a publié les informations de dépôt de trois services d'IA générative fonctionnant sur le terminal, tous destinés à des téléphones mobiles, au titre des Mesures provisoires d'administration des services d'IA générative. Le tableau joint à l'avis liste YOYO Claw, déposé dans le Guangdong par Shenzhen Honor Software Technology pour les téléphones Honor, sous le numéro GuangDong-YOYOClaw-202607280195 ; Xiaomi miclaw, déposé à Pékin par Xiaomi Technology pour les téléphones Xiaomi ; et JieYue ZhongDuan AI, déposé à Shanghai par Zhiyuan Xingchen (Shanghai) Intelligent Technology pour les téléphones JieYue. Ce régime de dépôt, conduit par les services du cyberespace avec les autres administrations concernées, conditionne l'offre de services d'IA générative au public en Chine. Les trois enregistrements portent la même date, le 22 septembre 2026.

Nouveau produit / service

Qualcomm lance deux plates-formes Snapdragon 8 Elite Gen 6 gravées en 2 nanomètres, centrées sur les agents d'IA embarqués

Le 22 septembre 2026, au Snapdragon Summit, Qualcomm Technologies a présenté deux plates-formes mobiles haut de gamme, Snapdragon 8 Elite Extreme Gen 6 et Snapdragon 8 Elite Gen 6, bâties sur le même nœud de gravure 2 nanomètres. Les deux associent un processeur Oryon conçu en interne, un GPU Adreno réarchitecturé et un NPU Hexagon, et visent des agents qui s'exécutent sur l'appareil. Le catalogue introduit Adreno Neural Fusion, qui applique l'IA au rendu graphique des jeux, ainsi que le support Advanced Professional Video et une fonction Intelligent Pixel Control pour la photo et la vidéo. Chris Patrick, vice-président senior chargé des combinés, décrit cette double annonce comme une stratégie de plusieurs vaisseaux amiraux. Les premiers terminaux viendront de HONOR, iQOO, Motorola, OnePlus, OPPO, REDMI, RedMagic, vivo et Xiaomi.

Source : Qualcomm
Ranger dans…
Enregistré. Ajouter une note ?
Lire le profil complet Mis à jour le 23 février 2025

Xiaomi est une entreprise chinoise d'électronique et d'informatique, basée à Pékin et spécialisée dans la téléphonie mobile et l'électronique grand public. En 2014, Xiaomi était valorisée à 46 milliards de dollars. Xiaomi est devenu 4ᵉ constructeur mondial vendant le plus de smartphones en 2018.

Articles liés

4 au total