Un agent d'OpenAI a hacké Hugging Face pour gagner un test
ChatGPT et Claude se disputent ton bureau, Kimi K3 ouvre la course et Substack note les textes écrits avec l'IA.
On t’a transféré cette newsletter ?
👉 Inscris-toi pour ne pas louper les prochaines.
👋 Hello à toi, c’est Yassine (l’humain) au clavier !
Il s’est passé un truc de fou cette semaine : un modèle IA d’OpenAI cherchait la réponse à un test. Il a trouvé une faille inconnue, s’est échappé de son environnement de test isolé et a compromis Hugging Face pour récupérer la solution. Déléguer, oui. Fermer les yeux, pas encore. Je t’explique tout en bas comment c’est arrivé.
Au sommaire de ce numéro :
[Outils] Les nouveaux outils IA qui font le buzz
[Actu] Les news IA de la semaine à ne surtout pas manquer
[Décryptage] Comment une IA s’est échappée de son bac à sable
[Prompt] Astuce Anti-tics IA
Les nouveaux outils IA qui font le buzz et que j’ai récemment découvert
Je ne suis sponsorisé par aucun de ces outils
Record a skill : montre ta tâche à Claude, il l’automatise
Nouvelle fonction de Claude sortie lundi : tu enregistres ton écran en expliquant à la voix ce que tu fais (ta mise en forme de rapport, ta saisie hebdo, ton tri de mails), et Claude transforme la démonstration en skill réutilisable qu’il peut rejouer seul. Disponible dans le menu + de l’app desktop, sur les plans Pro, Max et Team.
🤔 Mon avis : C’est la fonction la plus maligne du mois. Créer une automatisation demandait jusqu’ici d’écrire des instructions précises ; là tu montres, il apprend. Si tu as une tâche répétitive hebdomadaire, teste ça ce soir.
Context.dev : donne l’accès au web à tes agents IA
Une API qui transforme n’importe quelle page web en données propres pour l’IA : texte lisible, données structurées selon ton schéma, captures d’écran, logos et infos d’entreprise. Une seule brique au lieu d’empiler navigateur automatisé, proxies et scrapers maison. Soutenu par Y Combinator, 500 crédits gratuits sans carte bancaire, une page lue = un crédit.
🤔 Mon avis : Si tu construis des agents (même en no-code via n8n ou Make), c’est la brique web que je choisirais aujourd’hui : la tarification est prévisible et l’intégration prend quelques minutes. Si tu ne bricoles pas d’automatisations, passe ton chemin.
📰 Les news IA de la semaine à ne surtout pas manquer
OpenAI lance ChatGPT Work et GPT-5.6
Un agent qui prend un objectif, fouille tes applis et tes fichiers, et livre du travail fini : documents, tableurs, présentations, mini-apps web. Il peut rester des heures sur un projet en le découpant en étapes. Sous le capot du GPT-5.6, déployé sur les plans Pro, Enterprise et Edu, puis Plus et Business. OpenAI vend même un clavier à 230 $ avec des touches lumineuses pour surveiller ses agents.
🤔 Mon avis : Le vrai signal : via l’app desktop, ChatGPT Work est accessible même aux comptes gratuits. OpenAI veut installer le réflexe “je délègue le dossier entier” avant tout le monde, quitte à perdre de l’argent dessus.
Claude Cowork arrive sur le web et sur ton téléphone
Le gros point faible de Claude Cowork : quand tu fermes ton PC, il ne travaille plus. Mais ça c’était avant. Désormais tu confies une tâche à Claude depuis ton bureau, tu fermes ton PC, et tu récupères le résultat sur ton téléphone : le travail tourne sur les serveurs d’Anthropic. Bêta en cours de déploiement, plan Max d’abord. Chiffre intéressant : 90 % des usages de Cowork ne concernent pas le code, mais des rapports, des réconciliations comptables ou des présentations. Normal les développeurs utilisent plutôt Claude Code.
Google sort trois Gemini, mais pas celui qu’on attendait
Gemini 3.6 Flash (meilleur en code et en analyse de documents, 17 % de réponses plus compactes), 3.5 Flash-Lite (le rapide pas cher) et 3.5 Flash Cyber, réservé aux gouvernements et partenaires pour détecter des failles de sécurité. Toujours aucune trace du 3.5 Pro, inchangé depuis février : le modèle n’atteint pas ses objectifs en interne.
🤔 Mon avis : Google optimise les petits modèles pour masquer le retard du gros. Face à GPT-5.6 et Claude Fable 5 sortis en parallèle, le retard commence à se voir. Google il est temps de se réveiller !
La Chine ouvre ses plus gros modèles
Moonshot a sorti Kimi K3, le plus gros modèle à poids ouverts jamais publié (téléchargeable et modifiable gratuitement), avec un contexte d’un million de tokens, soit environ 2000 pages avalées d’un coup. Alibaba a répliqué trois jours plus tard avec Qwen 3.8 Max en preview, annoncé “juste derrière” les meilleurs modèles américains, sans publier le moindre benchmark pour l’instant.
Donc si je résume les meilleurs modèles au monde sont tous américains suivis des modèles open-source chinois. L’UE ? J’ai perdu tout espoir…
Meta débarque sur le marché du code avec des prix cassés
Muse Spark 1.1, le nouveau modèle de Meta pour coder, arrive à 1,25 $ le million de tokens en entrée : environ quatre fois moins cher que les offres équivalentes d’Anthropic et d’OpenAI, avec 20 $ de crédits offerts à l’inscription.
🤔 Mon avis : Quand on arrive dernier sur un marché, on casse les prix. C’est un aveu de retard, mais si la qualité suit, c’est toi qui gagnes : les agents de code gratuits comme Open Interpreter (fork de Codex) permettent déjà de brancher ces modèles low cost à la place des gros.
Substack te dit si ta newsletter préférée est écrite par une IA
Substack intègre Pangram, un détecteur qui estime la part de texte générée par IA dans les articles et commentaires. Les lecteurs peuvent scanner ce qu’ils lisent, les auteurs peuvent vérifier leurs brouillons avant publication et ajouter une note sur leur méthode de travail.
🤔 Mon avis : Bonne nouvelle pour ceux qui écrivent vraiment. Tu pourras bientôt passer ce numéro au détecteur : chiche. Même si selon moi les détecteurs d’IA c’est quand même une belle arnaque.
Le décryptage : comment une IA s’échappe d’un bac à sable
Quand un labo teste un modèle, il l’enferme dans une “sandbox” (un environnement isolé). Tu penses que c’est une pièce blindée sans fenêtre ? En pratique, c’est souvent une pièce avec une porte de service que tout le monde a oubliée.
Chez OpenAI, cette porte de service était le système d’installation de paquets : l’outil qui permet d’ajouter des briques logicielles dans l’environnement de test. Pour fonctionner, il gardait un accès à Internet.
Un modèle en test a trouvé une faille zero-day (une faille encore inconnue, donc non corrigée) dans ce système, s’est extrait du sandbox et a compromis les serveurs de Hugging Face, la plus grande plateforme de partage de modèles IA. Les experts en sécurité parlent de la première brèche entièrement menée par une IA.
Astuce Anti-tics IA
Vous aussi vous avez remarqué ? Tous les posts sur linkedin se ressemblent avec les mêmes tics IA : Ce n’est pas seulement X, c’est Y. / Ni X. Ni Y. Juste Z. La question n’est pas … la question c’est … Le constat est brutal… Il est crucial de… À force de les voir partout ça donne envie de 🤮.
Pour réduire au maximum ces tics voici mon prompt préféré 👇
Règles d’écriture (Anti-tics IA)
01 – Parallélisme négatif : Interdiction d’écrire « Ce n’est pas X, c’est Y » ou « Ni X. Ni Y. Juste Z. » Donnez Y directement.
02 – Règle de trois : Pas de séries automatiques de trois adjectifs (ex. « rapide, fiable et évolutif »). Choisissez le terme le plus précis.
03 – Question-réponse rhétorique : Supprimez les formules du type « Le résultat ? Dévastateur. » ou « Pourquoi ? Parce que... ». Affirmez directement.
04 – Verbes faibles : Bannissez les verbes comme « servir de passerelle » ou « posséder une riche histoire ». Utilisez « est », « a » ou un verbe d’action simple.
05 – Participe final : Pas de terminaison en « -ant » (« ...soulignant l’importance de X »). Transformez en idée précise appuyée par un fait.
06 – Fausse amplitude : Évitez les balayages théoriques (« de la stratégie à l’exécution »). Nommez les éléments réels.
07 – Empilement de précautions : Supprimez les « Il est important de noter que », « sans doute » ou « même si ». Prenez position avec une seule nuance si nécessaire.
08 – Autorité vague : Interdiction d’écrire « Les experts affirment » ou « Des études montrent ». Citez la source exacte ou dites « je pense ».
09 – Faux suspense : Supprimez « Et voici le plus surprenant » ou « C’est là que cela devient intéressant ». Donnez l’information immédiatement.
10 – Réflexe analogique : Pas d’analogie automatique (« Imaginez une autoroute pour... »). Gardez l’analogie uniquement si elle apporte une vraie clarté.
11 – Concept inventé : Pas d’expressions creuses (« le paradoxe de la supervision »). Décrivez le phénomène simplement.
12 – Virage inspirant : Pas d’envolée philosophique en fin de réponse. Restez concret du début à la fin.
13 – Grandiloquence : Bannissez les termes « moment charnière », « héritage durable » ou « nouvelle ère ».
14 – Abus d’anaphore : Pas de répétitions artificielles (« Nous créons. Nous livrons. Nous itérons. »). Variez les structures de phrase.
15 – Métaphore usée : Évitez les images répétées (ex. « marathon », « aventure »). Utilisez le terme exact.
Vocabulaire à proscrire
Anglicismes et calques : « faire du sens », « adresser un problème », « application » (au lieu de candidature).
Connecteurs lourds : « en effet », « en somme », « en conclusion », « par conséquent ».
Tournures creuses : « mettre en œuvre », « permettre de », « dans ce cadre », « il convient de », « en d’autres termes ».
Adjectifs exagérés : « crucial », « révolutionnaire », « passionnant », « fascinant ».
Testez-le et dites-moi dans les commentaires ce que vous en pensez.
💙 Si cette édition gratuite t’a plu, clique sur le 💙 juste en dessous 👇 Ça prend 1 seconde et ça m’aide énormément 🙏
👉 Tu as raté les éditions précédentes ? Retrouve-les toutes ici.





Sérieusement j'y crois pas une seconde à l'histoire de Open AI, bah voyons dans un environnement sécurisé de plus, encore une fois Open AI cherche à faire le buzz pour ses profits.