Revue technologique du 11 août 2026, illustration sombre avec écran et touches orange

Le récap tech du 11 août 2026

Le récap tech du 11 août 2026 : Manus redevient indépendant, NVIDIA dégaine un modèle ouvert, des IA de poche fleurissent et une fuite Steam inquiète.

Journée chargée pour l’IA : l’agent Manus redevient une entreprise indépendante, NVIDIA met en ligne un modèle ouvert qui tourne sur une seule carte graphique, et plusieurs petits modèles conçus pour fonctionner chez toi font parler d’eux. Côté sécurité, une recherche montre qu’on peut voler les « pensées » cachées des grands modèles, et un prestataire de Steam a laissé fuiter des données clients en Europe. On fait le tour, calmement, avec dix sujets et les sources pour aller plus loin.

Manus redevient une entreprise indépendante

Tu te souviens de Manus ? Cet agent IA qui promettait d’accomplir des tâches entières à ta place — réserver un voyage, préparer un dossier, remplir des formulaires. Meta l’avait racheté fin décembre 2025. C’est terminé : l’entreprise annonce aujourd’hui qu’elle redevient indépendante, pour se conformer aux exigences réglementaires liées à cette acquisition.

Concrètement, les comptes concernés devront sauvegarder leurs données avant le 23 août : tout ce qui a été généré depuis le rachat par Meta sera supprimé entre le 23 et le 24 août, puis restaurable à partir du 25. Manus insiste sur deux points : ce n’est pas une faille de sécurité, et la majorité des utilisateurs ne sera pas impactée. Si tu l’es, tu recevras un e-mail ou une notification dans l’application. À défaut de pouvoir tout vérifier, la consigne est simple : sauvegarde ce qui compte avant la date butoir.

Le blog officiel de Manus annonce le retour de l’entreprise à une exploitation indépendante
La page d’annonce du blog officiel de Manus, publiée le 11 août 2026

Source : blog officiel Manus (manus.im)

NVIDIA sort un modèle ouvert qui tient sur une carte graphique

NVIDIA a publié Nemotron 3.5 Lightning, un modèle de langue ouvert de 30 milliards de paramètres dont seuls 3 milliards sont actifs à chaque réponse. Un paramètre est un réglage interne appris pendant l’entraînement ; moins il y en a d’actifs, moins la machine a de travail à fournir. Résultat : l’éditeur annonce qu’il tourne sur une seule carte graphique, y compris une GeForce RTX 5090 grand public.

Le modèle gère jusqu’à un million de tokens de contexte — un token est une brique de texte, et un million, c’est de quoi avaler des livres entiers en une seule session — et il est taillé pour les agents autonomes, ces programmes qui enchaînent des actions tout seuls. Sorti officiellement ce jour, il est disponible en « poids ouverts » sur Hugging Face avec une licence libre assortie de conditions. Pour qui veut faire tourner un assistant sérieux sans louer un cluster, c’est une option crédible.

Carte officielle du modèle Nemotron 3.5 Lightning sur Hugging Face
La fiche officielle du modèle NVIDIA Nemotron 3.5 Lightning, publiée le 11 août 2026

Source : NVIDIA / Hugging Face (huggingface.co)

Les « pensées » cachées des IA peuvent se voler

Les grands modèles d’OpenAI, d’Anthropic et de Google réfléchissent en cachette : avant de répondre, ils produisent une chaîne de raisonnement interne que l’utilisateur ne voit jamais. Une équipe de chercheurs publie une méthode pour reconstituer ces traces à partir des réponses renvoyées par les API, et elle fonctionne sur les modèles des trois laboratoires.

Le plus inquiétant n’est pas la prouesse technique : en appliquant leur méthode à des sessions publiques récupérées sur GitHub et Hugging Face, ils ont retrouvé de vrais secrets — clés API, mots de passe, adresses e-mail — dont certains n’apparaissaient que dans ces raisonnements cachés. Pour toi, le conseil ne change pas : ne colle jamais de données sensibles dans un assistant IA. Mais l’étude montre que le problème est plus profond qu’un simple « l’IA garde tes prompts », et les éditeurs de modèles vont devoir répondre.

Schéma explicatif NumeriBrain sur le vol des traces de raisonnement des IA
Schéma explicatif NumeriBrain : les raisonnements cachés des modèles peuvent être décodés

Source : recherche « Stolen Thoughts », arXiv 2608.09867 — schéma explicatif NumeriBrain

Une fuite de données chez un expéditeur Steam

Valve, l’éditeur de Steam, prévient ses clients européens : son partenaire logistique CEVA Logistics a subi une cyberattaque qui a pu exposer des données de commande — noms, adresses, numéros de téléphone et adresses e-mail. Valve a été informé le 7 août, et l’enquête est toujours en cours, donc l’ampleur exacte reste inconnue.

Ce type de fuite est un terreau parfait pour le phishing : avec ton nom et ton adresse, un attaquant peut fabriquer un faux avis de livraison ou un faux e-mail de remboursement très crédible. Si tu as commandé du matériel Steam récemment, reste vigilant sur les messages qui parlent de colis ou de paiement, et vérifie toujours l’expéditeur réel avant de cliquer.

Schéma explicatif NumeriBrain sur la fuite de données chez le prestataire de Steam
Schéma explicatif NumeriBrain : alerte sur la fuite de données clients chez CEVA Logistics

Source : The Verge (theverge.com) — schéma explicatif NumeriBrain

Le créateur de Redis fait de la vidéo IA sur ton Mac

antirez — Salvatore Sanfilippo, le créateur de la base Redis — vient de publier h3-metal, un moteur d’inférence pour le modèle MiniMax-H3. Le modèle sait générer des images, des sons et des vidéos à partir d’une phrase ; le moteur, lui, fait tourner tout ça en local sur les puces Apple Silicon. Tu tapes « un renard roux marche dans la neige », et il génère une courte vidéo sur ta machine, sans envoyer tes prompts dans le cloud.

C’est encore un projet jeune et expérimental, avec des compromis de qualité selon la vitesse choisie — quelques passes de nettoyage suffisent pour un aperçu rapide, une cinquantaine pour un rendu soigné. Mais le code est en licence MIT, donc libre à étudier et à améliorer. Pour les curieux de l’IA locale, c’est exactement le genre de projet à surveiller de près.

Schéma explicatif NumeriBrain sur la génération vidéo locale avec MiniMax-H3 sur Mac
Schéma explicatif NumeriBrain : MiniMax-H3 génère une vidéo en local sur Apple Silicon

Source : dépôt github.com/antirez/h3.c — schéma dérivé de la documentation

Un agent IA de 14 Mo pour ta montre et ta maison

Needle 2 est un petit modèle de 45 millions de paramètres, compressé dans un fichier de 14 Mo, conçu pour faire une chose précise : transformer une phrase en action. « Éteins la lumière du salon », « monte le chauffage » : il choisit la bonne fonction, remplit les bons arguments, et le tout tourne sur des appareils sans carte graphique — montres connectées, box domotique, petits robots, téléphones d’entrée de gamme.

La startup Cactus cite Pebble, qui l’utilise dans sa bague connectée pour déclencher des actions sans dépendre du réseau. Le modèle est open source (licence Apache 2.0) et personnalisable : tu peux l’ajuster sur ta propre liste de commandes en quelques minutes sur un ordinateur ordinaire. C’est la promesse d’une IA qui ne télécharge plus tes conversations sur un serveur distant — et qui tient dans la poche.

Carte officielle du projet Needle 2 sur le site de Cactus
La page officielle du projet Needle 2, un modèle agentique de 14 Mo pour les petits appareils

Source : cactuscompute.com/needle

LFM2.5 : un petit modèle qui n’a pas peur des gros

Liquid AI publie LFM2.5-2.6B, un modèle de 2,6 milliards de paramètres. La promesse : rivaliser avec des modèles quatre fois plus gros sur les tâches qui comptent pour un usage réel — appeler des outils, suivre des instructions, enchaîner plusieurs étapes. Les benchmarks annoncés le placent effectivement au niveau de modèles de 8 à 10 milliards de paramètres sur plusieurs exercices.

Le plus frappant, c’est l’efficacité : 220 tokens par seconde sur un Mac récent, 113 sur un processeur AMD, le tout dans moins de 2,5 Go de mémoire. Traduction : un assistant capable de raisonner et d’utiliser des outils, qui tourne sur un ordinateur portable classique — voire un téléphone à 30 tokens par seconde. Les poids sont ouverts et plusieurs formats sont déjà disponibles, dont un optimisé pour Apple Silicon. Encore un signe que l’IA locale n’attend plus les gros GPU.

Carte officielle du modèle LFM2.5-2.6B de Liquid AI sur Hugging Face
La fiche officielle du modèle LFM2.5-2.6B de Liquid AI sur Hugging Face

Source : Liquid AI / Hugging Face (huggingface.co)

Des VM macOS enfin rapides pour l’IA locale

Faire tourner une machine virtuelle macOS dans macOS est pratique, mais le GPU y était bridé : les programmes d’IA comme llama.cpp choisissaient des chemins lents faute de capacités graphiques récentes. L’équipe de trycua, derrière l’outil de virtualisation Lume, publie une petite couche de compatibilité qui débloque des fonctionnalités Metal plus modernes à l’intérieur de la VM.

Les chiffres publiés parlent d’eux-mêmes : sur un M1 Ultra, le traitement des prompts passe de 432 à 4 787 tokens par seconde, et la génération de texte devient jusqu’à 16 fois plus rapide, proche des performances de la machine réelle. Attention, c’est une recherche expérimentale et fragile selon les versions de macOS. Mais pour celles et ceux qui isolent leur IA locale dans une VM, le gain est spectaculaire.

Graphique de benchmark du blog trycua montrant l’accélération de l’inférence LLM dans une VM macOS
Graphique du blog officiel trycua : l’inférence llama.cpp accélérée dans une VM macOS

Source : blog trycua / Cua, 11 août 2026 (github.com/trycua/cua)

Ton serveur Jellyfin devient un vidéoclub des années 90

Halcyon Video transforme ta bibliothèque Jellyfin — le serveur multimédia open source que tu peux héberger chez toi — en vidéoclub 3D des années 90, parcourable en première personne. Chaque film est une cassette sur une étagère, avec sa jaquette, le résumé au dos, le comptoir de location, le sac qui crisse… Jusqu’à la « caissière » qui te recommande des films en s’appuyant sur ce que tu possèdes réellement.

C’est gratuit, open source (licence GPL) et auto-hébergé, avec un rendu à la demande : quand personne ne s’en sert, il ne consomme presque rien, et un mode allégé tourne même sur un Raspberry Pi. Ce n’est pas qu’un gadget : l’interface est pensée pour choisir un film en famille, et la lecture repasse par ton serveur en qualité originale. La démo est jouable en ligne sans rien installer.

Capture officielle du projet Halcyon Video montrant la façade du vidéoclub au coucher du soleil
Capture officielle du projet : la façade du vidéoclub Halcyon, générée depuis la bibliothèque Jellyfin

Source : dépôt halcyon-video/halcyon-video (GPL-3.0)

La mémoire d’Internet s’efface, et personne ne s’en occupe

The Walrus publie un long essai sur un problème qui nous concerne tous : la mémoire collective du web se dégrade. Liens morts, pages supprimées — Disney a effacé tout l’archive de FiveThirtyEight —, archives attaquées et attaquées en justice, résumés IA qui remplacent les visites sur Wikipédia sans reverser le trafic qui la faisait vivre : le filet de sécurité se troue de tous les côtés.

Le texte plaide pour traiter la recherche d’information comme une infrastructure publique, et non comme un service gratuit offert par une régie publicitaire. Un sujet de société, certes, mais avec des conséquences très concrètes : ce qui disparaît aujourd’hui du web, c’est notre capacité à vérifier demain. De quoi réfléchir avant de considérer le prochain résumé IA comme une source.

Schéma explicatif NumeriBrain sur l’effacement de la mémoire d’Internet
Schéma explicatif NumeriBrain : liens morts, archives fragiles et résumés IA qui remplacent les clics

Source : The Walrus (thewalrus.ca) — schéma explicatif NumeriBrain

À surveiller demain

On garde un œil sur la suite de la séparation entre Manus et Meta, avec la fenêtre de sauvegarde qui se referme le 23 août. Côté petits modèles — Needle, LFM2.5, Nemotron —, les premiers retours d’expérience vont arriver et diront si les promesses tiennent la route sur du matériel ordinaire. Et on attend les précisions de Valve et de CEVA sur l’ampleur réelle de la fuite de données. Enfin, si tu veux observer l’éclipse solaire du 12 août sans te brûler les yeux, NumeriBrain a déjà publié sa carte open source pour la suivre.

Sources

Manus — https://manus.im/blog/a-note-to-our-users — annonce officielle du retour à une exploitation indépendante

NVIDIA Nemotron 3.5 Lightning — https://huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 — fiche officielle du modèle, release du 11 août 2026

Stolen Thoughts — https://stolen-thoughts.com/ — recherche sur le décodage des traces de raisonnement

Steam / CEVA Logistics — https://www.theverge.com/games/977314/valve-steam-hardware-shipping-data-breach — article The Verge sur la fuite de données clients

h3-metal — https://github.com/antirez/h3.c — moteur d’inférence MiniMax-H3 pour Apple Silicon

Needle 2 — https://cactuscompute.com/needle — page officielle du modèle agentique de 14 Mo

LFM2.5-2.6B — https://huggingface.co/LiquidAI/LFM2.5-2.6B — fiche officielle du modèle Liquid AI

VM macOS et llama.cpp — https://github.com/trycua/cua/blob/main/blog/gpu-passthrough-macos-vms.md — article technique trycua publié le 11 août 2026

Halcyon Video — https://github.com/halcyon-video/halcyon-video — dépôt officiel, licence GPL-3.0, démo en ligne

The Walrus — https://thewalrus.ca/google-search-is-dying/ — essai « Google Search Is Dying » sur la mémoire du web



Recherche, relecture et illustration assistées par IA. Le contenu reflète le travail éditorial de la rédaction.

No comments yet