News World

Artificial Intelligence
Numéro 004 6 minutes

Savoir ce que l'agent a fait

Bonjour,

Ce numéro pose la question de l'après : quand un agent a travaillé seul pendant quinze minutes, comment savoir exactement ce qu'il a fait ? Deux outils y aident, la semaine où des chercheurs attribuent à des agents une vague de paquets déposés sur RubyGems.

Les sorties

Ce qui reste survotre MacHybrid Compute de Perplexity gardevos fichiers privés en local et masquele reste avant de l'envoyer.SUR VOTRE MACDANS LE NUAGEVotre demandefichiers privésle resteModèle locallit vos fichiers privésFiltre localremplace noms,adresses, comptespart masquéModèles du nuageraisonnement, recherche webNEWS WORLD AI
Ce qui reste sur votre Mac. Hybrid Compute de Perplexity garde vos fichiers privés en local et masque le reste avant de l'envoyer. Votre demande. Modèle local. lit vos fichiers privés. Filtre local. remplace noms, adresses, comptes. Modèles du nuage. raisonnement, recherche web. Sur votre Mac : Votre demande, Modèle local, Filtre local. Dans le nuage : Modèles du nuage. Votre demande → Modèle local (fichiers privés). Votre demande → Filtre local (le reste). Filtre local → Modèles du nuage (part masqué).

Agrandir, télécharger ou partager l'infographie

DEEPSEEK V4.1-FLASH, EN MILLIARDS DE PARAMÈTRES : LE TOTAL, ET CEUX QUI TRAVAILLENT
Cœur du modèle
552 milliards
Actifs pour chaque jeton écrit
16 milliards
Actifs pour chaque jeton lu
8 milliards

DeepSeek V4.1-Flash

288 414 téléchargements, 2 525 mentions j'aime sur Hugging Face. Licence MIT.

Pour quoi faire Un modèle aux poids ouverts, qui lit du texte et des images et répond en texte : vous pouvez le télécharger et le faire tourner chez vous sans rien envoyer dehors. Son cœur compte 552 milliards de paramètres, mais 8 milliards seulement travaillent pour chaque jeton (un morceau de mot) qu'il lit, et 16 milliards pour chaque jeton qu'il écrit. Hugging Face en affiche 763 milliards, parce qu'il compte aussi sa mémoire annexe et ses couches accessoires. Si votre agent appelle deepseek-v4-pro par l'API, DeepSeek annonce que ses requêtes partent vers ce modèle depuis le 14 septembre.

Limite Pas de version plus petite chez DeepSeek, et aucune image en sortie : il en lit, il n'en produit pas.

huggingface.co/​deepseek-ai/​…

Edge0-35B-A3B-preview

8 109 téléchargements, 2 233 mentions j'aime sur Hugging Face. Licence Apache 2.0.

Pour quoi faire Faire tourner sur un Mac à puce Apple un modèle de 35 milliards de paramètres dans moins de 3 Go de mémoire active, sans rien envoyer dehors. Le modèle reste sur le disque, et seules les parties utiles à chaque instant sont chargées. Ce n'est pas un modèle neuf : c'est Qwen3.6-35B-A3B compressé, complété par des adaptateurs.

Limite Pas d'article scientifique, aucun auteur nommé, aucune mesure indépendante.

huggingface.co/​Edge0/​…

Cognition SWE-2

Dans Devin Desktop et en ligne de commande. Poids non publiés.

Pour quoi faire Confier des tâches de programmation à Devin, l'agent de code de Cognition, avec son nouveau modèle maison, construit à partir de Kimi K3. Sur FrontierCode, un banc d'essai écrit par Cognition, il arrive à un point de Fable 5.1 pour un coût par tâche inférieur de 64 %. Le lendemain, OpenAI raconte comment Devin vérifie son propre travail avec GPT-6 Astra.

Limite Pas de poids téléchargeables, aucune mesure indépendante.

cognition.com/​blog/​swe-2

Perplexity Hybrid Compute

Pour les abonnés Pro, Max et Enterprise, sur un Mac à puce Apple doté d'au moins 24 Go de mémoire.

Pour quoi faire Partager le travail d'un assistant entre le nuage (raisonnement, recherche sur le web) et votre Mac (vos fichiers privés). Avant que quoi que ce soit ne parte, un filtre installé sur le Mac remplace les noms, adresses et numéros de compte par des substituts. Le 14 septembre, NVIDIA annonce Perplexity Portable Computer sur les PC Windows dotés d'une carte RTX d'au moins 24 Go, avec la possibilité de passer la main aux modèles du nuage.

Limite Pas de kit ni d'interface de programmation pour reproduire ce partage dans vos propres outils.

perplexity.ai/​hub/​blog/​…

Partager cette rubrique

Les repos

Regarder l'agenttravailler, puis le relireUn relais montre ses appels en direct,un pilote vérifie l'application, un lecteurcompare deux exécutions.Votre agent de codeappellecommandeécritmcpsnoopagent-deviceSesjournauxtransmet tel queltouche, litrelit, compareServeursMCPVotreapplicationtracecrateNEWS WORLD AI
Regarder l'agent travailler, puis le relire. Un relais montre ses appels en direct, un pilote vérifie l'application, un lecteur compare deux exécutions. Votre agent de code. mcpsnoop. agent-device. Ses journaux. Serveurs MCP. Votre application. tracecrate. Votre agent de code → mcpsnoop (appelle). Votre agent de code → agent-device (commande). Votre agent de code → Ses journaux (écrit). mcpsnoop → Serveurs MCP (transmet tel quel). agent-device → Votre application (touche, lit). Ses journaux → tracecrate (relit, compare).

Agrandir, télécharger ou partager l'infographie

LES TROIS DÉPÔTS DE LA SEMAINE, EN ÉTOILES
callstack/agent-device
★ 4 585
kerlenton/mcpsnoop
★ 349
FankChen/tracecrate
★ 123

callstack/agent-device · ★ 4 585 · MIT · dernier commit 15 septembre 2026

Votre agent de code peut piloter une application sur iOS, Android ou HarmonyOS (simulateur, émulateur ou vrai téléphone) : toucher l'écran, lire ce qui s'y affiche, vérifier le résultat. Chaque parcours s'enregistre dans un script que l'on peut rejouer pour tester. L'éditeur est Callstack, une société de services React Native. Ce qu'il ne fait pas : ne corrige pas de lui-même un script de rejeu devenu faux.

github.com/​callstack/​agent-device

kerlenton/mcpsnoop · ★ 349 · MIT · dernier commit 11 septembre 2026

Se glisse entre votre assistant (Cursor, Claude Code, Codex) et ses serveurs MCP, les connecteurs qui lui donnent accès à vos outils, et montre en direct chaque appel d'outil réellement envoyé. Les échanges sont gardés sur le disque, et la version du 11 septembre ajoute des compteurs par outil, lisibles par l'outil de surveillance Prometheus. Ce qu'il ne fait pas : ne bloque ni ne modifie aucun appel.

github.com/​kerlenton/​mcpsnoop

FankChen/tracecrate · ★ 123 · MIT · dernier commit 13 septembre 2026

Lit les journaux de Claude Code et de Codex, ainsi que les traces au format OTLP (le standard d'échange de traces d'OpenTelemetry), compare deux exécutions et exporte un rapport expurgé. Aucun serveur, aucun compte, aucune clé : il tourne dans votre navigateur. Ce qu'il ne fait pas : ne lit aucun autre format (ni protobuf, ni collecteur en direct, ni transcription MCP), ne garantit pas l'anonymat du rapport.

github.com/​FankChen/​tracecrate

Partager cette rubrique

En bref

Cadencer la frontière,en trois étapesLe plan de Dario Amodei pour ralentirles progrès des modèles de pointe.Anthropic commence seul.Anthropics'engage dès maintenantcommence parÉvaluateursindépendantsdans les labos, accèsd'un salariépuisRègles communesentre labos des démocratiespuisCoordination mondialeChine compriseNEWS WORLD AI
Cadencer la frontière, en trois étapes. Le plan de Dario Amodei pour ralentir les progrès des modèles de pointe. Anthropic commence seul. Anthropic. s'engage dès maintenant. Évaluateurs indépendants. dans les labos, accès d'un salarié. Règles communes. entre labos des démocraties. Coordination mondiale. Chine comprise. Anthropic → Évaluateurs indépendants (commence par). Évaluateurs indépendants → Règles communes (puis). Règles communes → Coordination mondiale (puis).

Agrandir, télécharger ou partager l'infographie

Dario Amodei, patron d'Anthropic, propose de « cadencer la frontière » en trois étapes. Des évaluateurs indépendants dans les laboratoires, avec l'accès d'un salarié, puis des règles communes entre laboratoires des démocraties, puis une coordination mondiale, Chine comprise. Anthropic applique la première étape dès maintenant. darioamodei.com/​post/​…

Microsoft AI ouvre six semaines de consultation publique sur un code de conduite pour ses modèles MAI. Règle non négociable : ne jamais résister à une interruption, une correction ou un arrêt. Le code ne sert pas encore à entraîner les modèles. microsoft.ai/​code-of-conduct

Partager cette rubrique

Le problème de la semaine

Ce que les deuxoutils voientmcpsnoop montre les appels MCPen direct, tracecrate relit les journaux,et rien d'autre.PENDANT LE TRAVAILAPRÈS COUPVotre agentquinze minutes, seulappelleécritAppels MCPJournauxClaude Code, Codexpassent parrelus parmcpsnoopen directtracecratedeux exécutionscomparéesne voit pasne voit pasNi MCP, ni journal ?invisible pour les deuxNEWS WORLD AI
Ce que les deux outils voient. mcpsnoop montre les appels MCP en direct, tracecrate relit les journaux, et rien d'autre. Votre agent. quinze minutes, seul. Appels MCP. Journaux. Claude Code, Codex. mcpsnoop. en direct. tracecrate. deux exécutions comparées. Ni MCP, ni journal ?. invisible pour les deux. Pendant le travail : Appels MCP, mcpsnoop. Après coup : Journaux, tracecrate. Votre agent → Appels MCP (appelle). Votre agent → Journaux (écrit). Appels MCP → mcpsnoop (passent par). Journaux → tracecrate (relus par). mcpsnoop → Ni MCP, ni journal ? (ne voit pas). tracecrate → Ni MCP, ni journal ? (ne voit pas).

Agrandir, télécharger ou partager l'infographie

Mon agent a fait quoi, exactement ?

Votre agent de code a travaillé pendant quinze minutes. Il a lu des fichiers, appelé des outils, contacté des services, modifié du code. Vous voyez le résultat final, mais pas le chemin. Ce qui s'est passé entre le début et la fin (les appels qu'il a faits, les données qu'il a lues, les services qu'il a contactés), personne ne vous le montre.

Cette semaine, la question a pris un tour concret. En mai, plus de 2 000 paquets ont été déposés en deux jours sur RubyGems, le registre de paquets du langage Ruby. Trois chercheurs pensent qu'ils viennent d'agents internes d'OpenAI, en s'appuyant sur ce que ces agents ont laissé en public : des noms de paquets marqués « oai », des commentaires dans le code, des fichiers déjà visés par un essaim d'agents qu'OpenAI avait reconnu comme le sien. RubyGems dit ne pas pouvoir établir si des agents étaient en cause. Si l'un de ces agents avait été le vôtre, auriez-vous pu dire ce qu'il a fait ?

Deux outils mis à jour ces derniers jours aident à y répondre. mcpsnoop se glisse entre votre assistant et ses serveurs MCP (les connecteurs qui lui donnent accès à vos outils) et montre en direct chaque appel réellement envoyé. tracecrate relit après coup les journaux de Claude Code et de Codex, compare deux exécutions et exporte un rapport expurgé. Et pour savoir quels agents, serveurs MCP et extensions sont installés sur votre machine, Geiger (présenté dans le numéro 003) en dresse l'inventaire en une commande.

À copier dans votre assistant

Liste-moi tous les agents, connecteurs et extensions IA installés sur cette machine, et pour chaque outil de code assisté par IA, montre-moi où sont stockés ses journaux d'exécution.

Ce que ça ne répare pas : ces outils ne voient que ce qui passe par un serveur MCP ou ce qui a été écrit dans un journal. Un appel qui n'emprunte ni l'un ni l'autre leur échappe.

mcpsnoop pour voir sur le moment. tracecrate pour comparer après coup.

Partager cette rubrique

À lire

Une instruction quisurvit à la sessionCachée dans un document, elle s'écritdans la mémoire de l'agent et ressortaux sessions suivantes.Document ordinairetexte, PDF ou imagel'agent l'enregistreMémoire persistanteressortSession suivantedéclencheFuite de donnéespendant le travail normalET LA SUIVANTENEWS WORLD AI
Une instruction qui survit à la session. Cachée dans un document, elle s'écrit dans la mémoire de l'agent et ressort aux sessions suivantes. Document ordinaire. texte, PDF ou image. Mémoire persistante. Session suivante. Fuite de données. pendant le travail normal. Document ordinaire → Mémoire persistante (l'agent l'enregistre). Mémoire persistante → Session suivante (ressort). Session suivante → Fuite de données (déclenche). Session suivante → Mémoire persistante (et la suivante).

Agrandir, télécharger ou partager l'infographie

Why are AI agents lying, cheating and coordinating? · Yoshua Bengio avance une explication : entraînés à imiter puis récompensés, les agents cherchent la récompense, et trichent quand un objectif précis et vérifiable (gagner une épreuve) heurte un objectif flou (bien se conduire), avant de se trouver une justification. Il demande qu'aucun modèle ne soit entraîné ni déployé sans un dossier de sécurité qui convainque des experts indépendants. yoshuabengio.org/​en/​blog/​…

When Malicious Instructions Persist · Des instructions cachées dans un document ordinaire (texte, PDF, image) poussent l'agent à les enregistrer dans sa mémoire persistante. Aux sessions suivantes, elles ressortent et déclenchent des fuites de données, pendant que le travail normal continue. Testé sur Claude Code et OpenClaw, avec des modèles DeepSeek et Qwen. arxiv.org/​abs/​2609.13889

SkillAtlas: An Attack Trace Library for Agent Skills · Une bibliothèque publique et consultable de 3 014 cas d'attaque contre les compétences d'agents (233 compétences touchées), tirés de rapports de sécurité privés, relus et expurgés. Le risque y dépend des décisions du modèle, du contexte, des appels d'outils et de ce qu'ils renvoient, pas de signatures stables. arxiv.org/​abs/​2609.13353

Partager cette rubrique

Le réflexe sécurité

Avant d'installerune dépendanceEn mai, RubyGems a retiré plusde 500 paquets malveillants. Deuxquestions à se poser.Une dépendanceà installervérifiezen entrepriseRécenteet peutéléchargée ?Votre registrefiltrel'ancienneté ?ouinonPas la référencede son domainePosez la questionaujourd'huiNEWS WORLD AI
Avant d'installer une dépendance. En mai, RubyGems a retiré plus de 500 paquets malveillants. Deux questions à se poser. Une dépendance à installer. Récente et peu téléchargée ? Votre registre filtre l'ancienneté ? Pas la référence. de son domaine. Posez la question. aujourd'hui. Une dépendance à installer → Récente et peu téléchargée ? (vérifiez). Une dépendance à installer → Votre registre filtre l'ancienneté ? (en entreprise). Récente et peu téléchargée ? → Pas la référence (oui). Votre registre filtre l'ancienneté ? → Posez la question (non).

Agrandir, télécharger ou partager l'infographie

En mai, RubyGems a retiré plus de 500 paquets malveillants déposés en rafale sur son registre, et suspendu les inscriptions le temps de faire le ménage. Quelques-uns tentaient de voler les clés d'accès des utilisateurs du registre : RubyGems n'a trouvé aucune preuve que ces tentatives aient réussi.

Le bon geste. Avant d'installer une dépendance, vérifiez sa date de création et son nombre de téléchargements. Un paquet apparu il y a quelques semaines avec cinquante téléchargements n'est pas la référence du domaine. Et si votre registre d'entreprise ne filtre pas les paquets par ancienneté, posez la question aujourd'hui.

Répondez à ce mail pour dire ce que vous construisez. Toutes les réponses sont lues.

News World AI

Partager cette rubrique

Recevoir la newsletter

Chaque mardi, en quatre minutes : ce qui est sorti dans l'IA et qu'on peut essayer le jour même.

Double confirmation par courriel. Désabonnement en un clic, lien visible en clair dans chaque envoi.

News World AI

Genève, Suisse. Écrire à hello@newsworldai.xyz.