Menu

Aucun menu défini dans le customizer.

Age of LLM – Un Age of Empires où aucun humain ne joue

Vous voulez savoir comment GPT-5.5, Claude ou Grok raisonnent quand on les met sous pression ? Hé bien filez-leur un jeu de stratégie et regardez-les se faire la guerre.

C’est tout le principe d’
Age of LLM
, monté par Rymentz, un lecteur du blog où deux IA s’affrontent au tour par tour, sans aucun humain aux commandes.

C’est un benchmark 1v1 dans lequel on balance deux modèles sur la même carte, on leur donne les règles et puis c’est tout, sans aucun autre conseil de stratégie. À eux alors de déduire seuls comment contrer les attaques, quand bâtir leur économie, quand lever une armée pour aller défoncer la base d’en face, quand négocier la paix et quand carrément appuyer sur le gros bouton rouge. Parce que dans ce benchmark, on peut gagner de trois façons : la conquête militaire, la victoire diplomatique, ou la bombe nucléaire.

Trump veut couper Claude Fable 5 pour les étrangers – Anthropic coupe tout

Vendredi soir, vers 23h heure de Paris, Anthropic a reçu un courrier du gouvernement américain. Trois heures plus tard, ses deux modèles d’IA les plus avancés étaient hors ligne. Partout. Pour tout le monde.

Anthropic, c’est le concurrent direct d’OpenAI, la boîte derrière l’assistant Claude. Le 9 juin, elle lançait Claude Fable 5 et Claude Mythos 5, ses IA les plus puissantes à ce jour. Elles auront tenu trois jours.

Anthropic met entre toutes les mains un modèle qu’elle jugeait trop dangereux à publier il y a deux mois

Voilà autre chose dites donc. En avril, Anthropic, le concurrent direct d’OpenAI et créateur de l’assistant Claude, dévoilait Mythos, un modèle d’intelligence artificielle tellement doué pour dénicher et exploiter des failles informatiques que l’entreprise avait préféré ne pas le diffuser. Il restait réservé à une poignée d’organisations de cyberdéfense triées sur le volet.

Deux mois plus tard, ce même moteur arrive chez le grand public sous le nom de Claude Fable 5.

Claude FM – La radio lofi planquée dans Claude Code

Vous aimez bosser avec un petit fond sonore ?

Et bien sachez qu’Anthropic diffuse désormais sa propre radio lofi sur YouTube, 24h sur 24. Ça s’appelle Claude FM et c’est même planqué dans
Claude Code
derrière la commande /radio.

Le visuel du stream, sobre comme la com’ qui va avec (
Source
)

Zcash – Une IA déniche en 24h une faille vieille de 4 ans

Un chercheur en sécurité, Taylor Hornby, a lâché Claude Opus 4.8 sur le code de Zcash et 24 heures plus tard, le modèle lui a déniché une faille bien planquée là depuis 4 ans qui avait échappé aux auditeurs !

Et ce qu’elle permet de faire pique un peu (ouille ouille ^^) ! Car je vous rappelle que Zcash, c’est la cryptomonnaie taillée pour l’anonymat, où les transactions sont chiffrées et validées par des preuves mathématiques (le fameux “zero-knowledge” dont je vous ai déjà parlé). Sauf que dans son pool de confidentialité le plus récent, baptisé Orchard, une vérification censée s’assurer que les transactions étaient légitimes… ne vérifiait en fait rien du tout ! En clair, vous pouviez fabriquer du ZEC à partir de rien.

Rsync, le logiciel de sauvegarde culte sous Linux, mis à jour avec de l’IA et ça déclenche une vraie colère

rsync vient de sortir sa version 3.4.3, un correctif censé boucher plusieurs trous de sécurité. Sauf que pour une partie des utilisateurs, leurs sauvegardes incrémentales se sont mises à mal fonctionner juste après la mise à jour.

En fouillant le code, certains ont remarqué un détail qui ne leur a pas plu. Depuis la version 3.4.1, des dizaines de modifications (des “commits”, les unités de changement de code) sont signées “tridge and claude”. Comprendre Andrew Tridgell, le créateur historique de rsync, et Claude, l’assistant IA d’Anthropic, le concurrent direct d’OpenAI.

Anthropic – L’entreprise éthique qui hacke pour la NSA

Anthropic, c’est la boite qui nous rabâche le plus les oreilles avec l’importance de l’éthique dans les IA. Sauf que d’après le Financial Times, la société a “discrètement” embarqué une demi-douzaine d’ingénieurs environ au cœur de la NSA. Et leur job, c’est d’aider l’agence à manier Mythos, son modèle capable de dénicher et d’exploiter des failles informatiques quasiment tout seul. Voilà… Du 100% en mode offensif quoi…

Petit rappel sur
Mythos
, parce que cette bêbête vaut le détour… Ce modèle est conçu pour dénicher des vulnérabilités zero-day en quelques heures, pour quelques dizaines de dollars la tentative, sur à peu près tous les OS, logiciels et navigateurs du marché. Il a même débusqué un bug vieux de 27 ans dans OpenBSD, un système pourtant réputé pour sa sécurité béton. Anthropic l’a d’ailleurs jugé tellement balèze qu’au départ, la boîte le présentait comme trop dangereux pour être rendu public, l’intégrant côté défense via son projet
Glasswing
imaginé pour trouver les failles avant les méchants, quoi.

Ils ont créé des villes gérées par IA

Une société de recherche baptisée Emergence AI a eu une idée à la fois ludique et un peu vertigineuse : bâtir des petites sociétés virtuelles entièrement gérées par des intelligences artificielles, puis les laisser vivre quinze jours pour voir ce qu’elles deviennent.

Le projet, appelé Emergence World, a placé une dizaine d’habitants synthétiques dans chaque ville, tous pilotés par un même modèle, et a confronté les résultats obtenus par cinq IA concurrentes, dont Claude, ChatGPT, Grok et Gemini.

Ils ont créé des villes gérées par IA

Une société de recherche baptisée Emergence AI a eu une idée à la fois ludique et un peu vertigineuse : bâtir des petites sociétés virtuelles entièrement gérées par des intelligences artificielles, puis les laisser vivre quinze jours pour voir ce qu’elles deviennent.

Le projet, appelé Emergence World, a placé une dizaine d’habitants synthétiques dans chaque ville, tous pilotés par un même modèle, et a confronté les résultats obtenus par cinq IA concurrentes, dont Claude, ChatGPT, Grok et Gemini.