Journée chargée pour l’IA : l’agent Manus redevient une entreprise indépendante, NVIDIA met en ligne un modèle ouvert qui tourne sur une seule carte graphique, et plusieurs petits modèles conçus pour fonctionner chez toi font parler d’eux. Côté sécurité, une recherche montre qu’on peut voler les « pensées » cachées des grands modèles, et un prestataire de Steam a laissé fuiter des données clients en Europe. On fait le tour, calmement, avec dix sujets et les sources pour aller plus loin.
Manus redevient une entreprise indépendante
Tu te souviens de Manus ? Cet agent IA qui promettait d’accomplir des tâches entières à ta place — réserver un voyage, préparer un dossier, remplir des formulaires. Meta l’avait racheté fin décembre 2025. C’est terminé : l’entreprise annonce aujourd’hui qu’elle redevient indépendante, pour se conformer aux exigences réglementaires liées à cette acquisition.
Concrètement, les comptes concernés devront sauvegarder leurs données avant le 23 août : tout ce qui a été généré depuis le rachat par Meta sera supprimé entre le 23 et le 24 août, puis restaurable à partir du 25. Manus insiste sur deux points : ce n’est pas une faille de sécurité, et la majorité des utilisateurs ne sera pas impactée. Si tu l’es, tu recevras un e-mail ou une notification dans l’application. À défaut de pouvoir tout vérifier, la consigne est simple : sauvegarde ce qui compte avant la date butoir.

Source : blog officiel Manus (manus.im)
NVIDIA sort un modèle ouvert qui tient sur une carte graphique
NVIDIA a publié Nemotron 3.5 Lightning, un modèle de langue ouvert de 30 milliards de paramètres dont seuls 3 milliards sont actifs à chaque réponse. Un paramètre est un réglage interne appris pendant l’entraînement ; moins il y en a d’actifs, moins la machine a de travail à fournir. Résultat : l’éditeur annonce qu’il tourne sur une seule carte graphique, y compris une GeForce RTX 5090 grand public.
Le modèle gère jusqu’à un million de tokens de contexte — un token est une brique de texte, et un million, c’est de quoi avaler des livres entiers en une seule session — et il est taillé pour les agents autonomes, ces programmes qui enchaînent des actions tout seuls. Sorti officiellement ce jour, il est disponible en « poids ouverts » sur Hugging Face avec une licence libre assortie de conditions. Pour qui veut faire tourner un assistant sérieux sans louer un cluster, c’est une option crédible.

Source : NVIDIA / Hugging Face (huggingface.co)
Les « pensées » cachées des IA peuvent se voler
Les grands modèles d’OpenAI, d’Anthropic et de Google réfléchissent en cachette : avant de répondre, ils produisent une chaîne de raisonnement interne que l’utilisateur ne voit jamais. Une équipe de chercheurs publie une méthode pour reconstituer ces traces à partir des réponses renvoyées par les API, et elle fonctionne sur les modèles des trois laboratoires.
Le plus inquiétant n’est pas la prouesse technique : en appliquant leur méthode à des sessions publiques récupérées sur GitHub et Hugging Face, ils ont retrouvé de vrais secrets — clés API, mots de passe, adresses e-mail — dont certains n’apparaissaient que dans ces raisonnements cachés. Pour toi, le conseil ne change pas : ne colle jamais de données sensibles dans un assistant IA. Mais l’étude montre que le problème est plus profond qu’un simple « l’IA garde tes prompts », et les éditeurs de modèles vont devoir répondre.

Source : recherche « Stolen Thoughts », arXiv 2608.09867 — schéma explicatif NumeriBrain
Une fuite de données chez un expéditeur Steam
Valve, l’éditeur de Steam, prévient ses clients européens : son partenaire logistique CEVA Logistics a subi une cyberattaque qui a pu exposer des données de commande — noms, adresses, numéros de téléphone et adresses e-mail. Valve a été informé le 7 août, et l’enquête est toujours en cours, donc l’ampleur exacte reste inconnue.
Ce type de fuite est un terreau parfait pour le phishing : avec ton nom et ton adresse, un attaquant peut fabriquer un faux avis de livraison ou un faux e-mail de remboursement très crédible. Si tu as commandé du matériel Steam récemment, reste vigilant sur les messages qui parlent de colis ou de paiement, et vérifie toujours l’expéditeur réel avant de cliquer.

Source : The Verge (theverge.com) — schéma explicatif NumeriBrain
Le créateur de Redis fait de la vidéo IA sur ton Mac
antirez — Salvatore Sanfilippo, le créateur de la base Redis — vient de publier h3-metal, un moteur d’inférence pour le modèle MiniMax-H3. Le modèle sait générer des images, des sons et des vidéos à partir d’une phrase ; le moteur, lui, fait tourner tout ça en local sur les puces Apple Silicon. Tu tapes « un renard roux marche dans la neige », et il génère une courte vidéo sur ta machine, sans envoyer tes prompts dans le cloud.
C’est encore un projet jeune et expérimental, avec des compromis de qualité selon la vitesse choisie — quelques passes de nettoyage suffisent pour un aperçu rapide, une cinquantaine pour un rendu soigné. Mais le code est en licence MIT, donc libre à étudier et à améliorer. Pour les curieux de l’IA locale, c’est exactement le genre de projet à surveiller de près.

Source : dépôt github.com/antirez/h3.c — schéma dérivé de la documentation
Un agent IA de 14 Mo pour ta montre et ta maison
Needle 2 est un petit modèle de 45 millions de paramètres, compressé dans un fichier de 14 Mo, conçu pour faire une chose précise : transformer une phrase en action. « Éteins la lumière du salon », « monte le chauffage » : il choisit la bonne fonction, remplit les bons arguments, et le tout tourne sur des appareils sans carte graphique — montres connectées, box domotique, petits robots, téléphones d’entrée de gamme.
La startup Cactus cite Pebble, qui l’utilise dans sa bague connectée pour déclencher des actions sans dépendre du réseau. Le modèle est open source (licence Apache 2.0) et personnalisable : tu peux l’ajuster sur ta propre liste de commandes en quelques minutes sur un ordinateur ordinaire. C’est la promesse d’une IA qui ne télécharge plus tes conversations sur un serveur distant — et qui tient dans la poche.

Source : cactuscompute.com/needle
LFM2.5 : un petit modèle qui n’a pas peur des gros
Liquid AI publie LFM2.5-2.6B, un modèle de 2,6 milliards de paramètres. La promesse : rivaliser avec des modèles quatre fois plus gros sur les tâches qui comptent pour un usage réel — appeler des outils, suivre des instructions, enchaîner plusieurs étapes. Les benchmarks annoncés le placent effectivement au niveau de modèles de 8 à 10 milliards de paramètres sur plusieurs exercices.
Le plus frappant, c’est l’efficacité : 220 tokens par seconde sur un Mac récent, 113 sur un processeur AMD, le tout dans moins de 2,5 Go de mémoire. Traduction : un assistant capable de raisonner et d’utiliser des outils, qui tourne sur un ordinateur portable classique — voire un téléphone à 30 tokens par seconde. Les poids sont ouverts et plusieurs formats sont déjà disponibles, dont un optimisé pour Apple Silicon. Encore un signe que l’IA locale n’attend plus les gros GPU.

Source : Liquid AI / Hugging Face (huggingface.co)
Des VM macOS enfin rapides pour l’IA locale
Faire tourner une machine virtuelle macOS dans macOS est pratique, mais le GPU y était bridé : les programmes d’IA comme llama.cpp choisissaient des chemins lents faute de capacités graphiques récentes. L’équipe de trycua, derrière l’outil de virtualisation Lume, publie une petite couche de compatibilité qui débloque des fonctionnalités Metal plus modernes à l’intérieur de la VM.
Les chiffres publiés parlent d’eux-mêmes : sur un M1 Ultra, le traitement des prompts passe de 432 à 4 787 tokens par seconde, et la génération de texte devient jusqu’à 16 fois plus rapide, proche des performances de la machine réelle. Attention, c’est une recherche expérimentale et fragile selon les versions de macOS. Mais pour celles et ceux qui isolent leur IA locale dans une VM, le gain est spectaculaire.

Source : blog trycua / Cua, 11 août 2026 (github.com/trycua/cua)
Ton serveur Jellyfin devient un vidéoclub des années 90
Halcyon Video transforme ta bibliothèque Jellyfin — le serveur multimédia open source que tu peux héberger chez toi — en vidéoclub 3D des années 90, parcourable en première personne. Chaque film est une cassette sur une étagère, avec sa jaquette, le résumé au dos, le comptoir de location, le sac qui crisse… Jusqu’à la « caissière » qui te recommande des films en s’appuyant sur ce que tu possèdes réellement.
C’est gratuit, open source (licence GPL) et auto-hébergé, avec un rendu à la demande : quand personne ne s’en sert, il ne consomme presque rien, et un mode allégé tourne même sur un Raspberry Pi. Ce n’est pas qu’un gadget : l’interface est pensée pour choisir un film en famille, et la lecture repasse par ton serveur en qualité originale. La démo est jouable en ligne sans rien installer.

Source : dépôt halcyon-video/halcyon-video (GPL-3.0)
La mémoire d’Internet s’efface, et personne ne s’en occupe
The Walrus publie un long essai sur un problème qui nous concerne tous : la mémoire collective du web se dégrade. Liens morts, pages supprimées — Disney a effacé tout l’archive de FiveThirtyEight —, archives attaquées et attaquées en justice, résumés IA qui remplacent les visites sur Wikipédia sans reverser le trafic qui la faisait vivre : le filet de sécurité se troue de tous les côtés.
Le texte plaide pour traiter la recherche d’information comme une infrastructure publique, et non comme un service gratuit offert par une régie publicitaire. Un sujet de société, certes, mais avec des conséquences très concrètes : ce qui disparaît aujourd’hui du web, c’est notre capacité à vérifier demain. De quoi réfléchir avant de considérer le prochain résumé IA comme une source.

Source : The Walrus (thewalrus.ca) — schéma explicatif NumeriBrain
À surveiller demain
On garde un œil sur la suite de la séparation entre Manus et Meta, avec la fenêtre de sauvegarde qui se referme le 23 août. Côté petits modèles — Needle, LFM2.5, Nemotron —, les premiers retours d’expérience vont arriver et diront si les promesses tiennent la route sur du matériel ordinaire. Et on attend les précisions de Valve et de CEVA sur l’ampleur réelle de la fuite de données. Enfin, si tu veux observer l’éclipse solaire du 12 août sans te brûler les yeux, NumeriBrain a déjà publié sa carte open source pour la suivre.
Sources
Manus — https://manus.im/blog/a-note-to-our-users — annonce officielle du retour à une exploitation indépendante
NVIDIA Nemotron 3.5 Lightning — https://huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 — fiche officielle du modèle, release du 11 août 2026
Stolen Thoughts — https://stolen-thoughts.com/ — recherche sur le décodage des traces de raisonnement
Steam / CEVA Logistics — https://www.theverge.com/games/977314/valve-steam-hardware-shipping-data-breach — article The Verge sur la fuite de données clients
h3-metal — https://github.com/antirez/h3.c — moteur d’inférence MiniMax-H3 pour Apple Silicon
Needle 2 — https://cactuscompute.com/needle — page officielle du modèle agentique de 14 Mo
LFM2.5-2.6B — https://huggingface.co/LiquidAI/LFM2.5-2.6B — fiche officielle du modèle Liquid AI
VM macOS et llama.cpp — https://github.com/trycua/cua/blob/main/blog/gpu-passthrough-macos-vms.md — article technique trycua publié le 11 août 2026
Halcyon Video — https://github.com/halcyon-video/halcyon-video — dépôt officiel, licence GPL-3.0, démo en ligne
The Walrus — https://thewalrus.ca/google-search-is-dying/ — essai « Google Search Is Dying » sur la mémoire du web
—
Recherche, relecture et illustration assistées par IA. Le contenu reflète le travail éditorial de la rédaction.




No comments yet