// FRANDROID — HARDWARE & GADGET
Microsoft et Nvidia réinventent le PC : tout ce qu’il faut retenir de la conférence Windows
Une heure et demie de conférence, trois patrons sur scène, un portable à 128 Go de mémoire et le mot « agent » prononcé à une cadence qu’on a renoncé à compter. Si vous avez passé la soirée du 7 octobre à faire autre chose, c’est pardonnable.
Microsoft y tenait pourtant sa première grande conférence Windows depuis mai 2024, avec Satya Nadella, Pavan Davuluri, le patron de Windows et de Surface, et Jensen Huang, le patron de Nvidia.
Le résumé tient en une idée : le PC doit faire tourner lui-même une partie de l’IA, et Windows doit apprendre à surveiller les agents qui travaillent dessus. On fait le tri des annonces.
Le sujet le moins spectaculaire de la soirée est sans doute le plus important. Un agent IA qui code ou range des fichiers tourne aujourd’hui avec les mêmes droits que l’utilisateur, ce qui revient à lui confier les clés de la maison. Microsoft répond avec MXC, pour Microsoft Execution Containers, un bac à sable qui limite ce qu’un agent peut toucher, fichier par fichier et réseau par réseau. En préversion depuis juin, il passe en version finale sur Windows 11.
Chaque agent reçoit aussi une identité distincte de celle de l’utilisateur, ce qui permet de savoir qui a fait quoi. Dans la démonstration, Defender bloque une instruction malveillante cachée dans une page web, puis coupe l’accès de l’agent à un document sans toucher à celui de l’humain. Anthropic, OpenAI, Nvidia et OpenClaw figurent parmi les partenaires cités. Pour une entreprise, c’est la condition pour laisser des agents travailler sur les postes.
Microsoft appelle « intelligence hybride » le fait de répartir le travail entre des modèles installés sur le PC et ceux du cloud. L’argument est d’abord économique, puisque les tâches simples tournent en local sans consommer de crédits. Trois modèles ont servi de vitrine. Le modèle de code maison MAI Code 1.1 Flash, 130 milliards de paramètres, est compressé à 3 bits par paramètre, ce qui réduit sa taille de près de 80 %. Un modèle Nemotron de Nvidia, plus de 70 milliards de paramètres, tient dans un peu plus de 20 Go. DeepSeek V4 Flash, 284 milliards de paramètres compressés à 1,6 bit, occupe 60 Go et dépasserait GPT-5 sur des tests de code et de raisonnement, selon Microsoft.
Ces chiffres demandent deux précautions. Une compression aussi forte dégrade forcément un modèle, et Microsoft n’a montré aucune mesure indépendante. Pavan Davuluri a d’ailleurs résumé lui-même la hiérarchie : RTX Spark apporte sur un portable « la frontière de l’an dernier », le cloud garde celle du moment. Côté pratique, GitHub Copilot choisira seul entre modèle local et cloud à partir du 15 octobre, dans son application et dans VS Code. Windows ML, le moteur qui exécute les modèles, accueille aussi llama.cpp, l’outil favori des amateurs de modèles open source.
Protégez votre vie numérique avec Bitdefender, la protection européenne de confiance.
Bitdefender vous protège contre les arnaques et les fraudes du web. Profitez de vos activités en ligne en toute tranquillité.
Pour aller plus loin
Microsoft veut faire tourner des IA géantes sur PC : prévoyez jusqu’à 60 Go de RAM
Pour aller plus loin
Microsoft défie Claude et GPT en local, mais réclame 75 Go de RAM avec son nouveau modèle MAI Code 1.1 Flash