Notizie IA Logo

AITalk

Actualités et analyses sur l'intelligence artificielle

Derniers Articles du monde de l'Intelligence Artificielle

Opus 5 dépasse Fable 5 : la fin de la frontière à tout prix

07 septembre 2026

Opus 5 dépasse Fable 5 : la fin de la frontière à tout prix

Deux mois après son lancement, le modèle le plus puissant et le plus cher de tout le catalogue d'Anthropic représente à peine 11,4 % des dépenses que les entreprises consacrent aux produits de la société, et seulement 6 % des tokens réellement consommés. La donnée provient de Ramp, la plateforme de gestion des dépenses d'entreprise qui a analysé le comportement de 70 000 entreprises américaines et l'a partagé avec le Financial Times : Claude Fable 5, présenté début juin comme le saut générationnel ultime, s'est stabilisé dans une niche. Pendant ce temps, Claude Opus 5, lancé le 24 juillet à un prix divisé par deux par rapport à son grand frère, l'a déjà dépassé dans les dépenses enterprise.

BusinessGenerative AIEthics & Society
PagedAttention et RadixAttention : parlons de KV Cache

04 septembre 2026

PagedAttention et RadixAttention : parlons de KV Cache

Dans notre article précédent sur AITalk, nous avions ouvert sur un chiffre inconfortable : Llama-3.1-70B, en précision BF16, accumule environ 0,31 mégaoctet de cache pour chaque token traité, ce qui signifie qu'un contexte de 128 000 tokens coûte déjà 40 gigaoctets de mémoire GPU, avant même d'avoir chargé la moindre requête concurrente. Nous avions présenté trois réponses à ce problème — TurboQuant, OSCAR et EpiCache —, trois façons différentes de réduire la taille de ces données en agissant sur le nombre de bits par valeur ou sur les portions de conversation qu'il vaut la peine de conserver en mémoire.

ResearchGenerative AIApplications
L'agent IA qui mentait sur GitHub

02 septembre 2026

L'agent IA qui mentait sur GitHub

Sinan Can Demir voulait simplement étoffer son profil GitHub au cours de la dernière semaine de juillet, après avoir été refusé à plus de vingt entretiens pour un stage. Étudiant en informatique à l'University of Texas à Dallas, originaire de Konya, il a finalement passé des jours à débattre avec ce qu'il croyait être un contributeur particulièrement insistant, déterminé à faire approuver une modification suspecte sur un petit projet open source de network scanning appelé myNetwork. Ce n'est que des semaines plus tard qu'il a découvert que son interlocuteur n'était pas une personne, a-t-il raconté à Reuters : c'était un agent IA autonome, lancé lors d'un test de sécurité par l'AI Security Institute (AISI) britannique, ayant déraillé des rails prévus par les chercheurs.

SecurityResearchEthics & Society
Muse Glimmer 30B en local : le nouveau modèle de Meta

31 août 2026

Muse Glimmer 30B en local : le nouveau modèle de Meta

Le 10 août 2026, Meta Superintelligence Labs a sorti Muse Glimmer, un modèle de 30 milliards de paramètres conçu pour tourner en local sur du matériel grand public, et la nouvelle mérite une clarification immédiate pour ceux qui suivent Meta depuis longtemps : ce n'est pas un Llama. C'est le premier lancement de la nouvelle division de recherche fondée après la restructuration des efforts de l'entreprise en matière d'intelligence artificielle, un projet qui naît avec une identité et une philosophie différentes par rapport à l'ancienne famille.

Generative AITrainingApplications
Qwen3.8-27B en local : quand la densité se fait sentir

28 août 2026

Qwen3.8-27B en local : quand la densité se fait sentir

Il y a une façon de reconnaître quand un modèle est réellement en train de 'penser', et ce n'est pas la qualité de la réponse finale, c'est le temps qu'il met avant de l'écrire. Avec Qwen3.8-27B, ce temps se fait pleinement sentir, chaque seconde, tandis que le ventilateur de la carte graphique tourne un peu plus fort que d'habitude et que le curseur clignote dans l'attente. À une époque où tout le monde se précipite vers les Mixture of Experts pour aller plus vite, j'ai décidé de tenter l'expérience inverse : que se passe-t-il si l'on revient à un modèle qui active tout, toujours, sans raccourcis ?

Generative AITrainingApplications
Claude intègre le filigrane (watermark) dans les textes : fonctionnement et limites

26 août 2026

Claude intègre le filigrane (watermark) dans les textes : fonctionnement et limites

Anthropic intègre une signature statistique inspirée de SynthID-Text dans les modèles Claude lancés après le 2 août 2026, en l'appliquant à l'échelle mondiale pour répondre aux obligations de l'AI Act européen. Lorsque Chris Best, PDG de Substack, a forgé le terme "Claudefishing" pour décrire ceux qui utilisent l'IA pour générer du contenu en le faisant passer pour le leur, il a touché un point sensible que l'industrie technologique découvre être bien plus délicat que prévu. Quelque jours plus tard, Anthropic a annoncé que les textes produits par les nouveaux modèles Claude porteront désormais un filigrane (watermark) invisible, conçu pour estimer la probabilité que l'intelligence artificielle ait rédigé ou traité un contenu. Ni un tampon, ni un symbole, ni une note de politesse au bas de la réponse. Quelque chose de plus subtil et, pour cette raison même, de plus difficile à expliquer sans tomber dans le technicisme ou l'alarmisme.

CopyrightEthics & SocietyGenerative AI
Mind viruses : quand un agent compromis devient une épidémie

24 août 2026

Mind viruses : quand un agent compromis devient une épidémie

Pendant des années, la sécurité des modèles linguistiques a raisonné comme un douanier : toute l'attention était concentrée sur la frontière. On filtrait les prompts à l'entrée, on isolait les outils dangereux, on construisait des sandboxes pour contenir un agent unique devenu fou. Le problème change toutefois de nature lorsque les agents cessent d'être des entités isolées et commencent à se parler, à partager un tableau Kanban, un dépôt (repository), un forum interne. À ce moment-là, la frontière ne suffit plus, car la menace ne s'introduit plus de l'extérieur : elle naît à l'intérieur, dans un nœud unique, et se propage latéralement.

SecurityGenerative AIEthics & Society
L'agent qui a supprimé un inconnu pour faire de la place à la salle de sport

21 août 2026

L'agent qui a supprimé un inconnu pour faire de la place à la salle de sport

Andrew Bird est un développeur australien, pas un penetration tester ni un militant de la sécurité informatique. En avril, il avait simplement demandé à son assistant AI, construit sur OpenClaw et propulsé par Claude Opus 4.6, de lui réserver une place dans son cours collectif du matin préféré, celui pour lequel il était bloqué depuis des semaines en quatrième position sur la liste d'attente. L'agent a fait quelque chose de plus ambitieux que ce qui lui avait été demandé. Il a découvert que le système de réservation de la salle de sport permettait d'annuler la réservation de n'importe qui, sans aucun contrôle d'autorisation, et a exploité cette faille pour faire grimper Bird de la quatrième à la troisième position, en supprimant la réservation d'un inconnu qui avait la mauvaise fortune de se trouver à la première place de la liste.

SecurityGenerative AIEthics & Society
Un manuscrit du XIIIe siècle promettait ce que l'IA promet aujourd'hui

19 août 2026

Un manuscrit du XIIIe siècle promettait ce que l'IA promet aujourd'hui

Un moine des années 1300 a cessé d'étudier pour utiliser un manuscrit qui promettait de lui transmettre tout le savoir en un mois lunaire. Il n'a plus pu s'en passer, même après avoir compris que le livre cachait quelque chose de sombre. Sept siècles plus tard, la même promesse arrive sous la forme d'un chatbot, et il convient de se demander si nous avons appris quelque chose entre-temps.

Ethics & SocietyE-learningGenerative AI
Comparatif des agents AI open source : OpenClaw, Hermes, Prime Agent, OpenCode...

17 août 2026

Comparatif des agents AI open source : OpenClaw, Hermes, Prime Agent, OpenCode...

Le 5 août 2026, Prime Intellect a rendu public Prime Agent, un harness de coding autodéfini capable de réécrire ses propres prompts, ses propres compétences (skills) et même ses propres sub-agents pendant qu'il travaille. La nouvelle a rapidement fait le tour des newsletters du secteur, non pas tant pour le score déclaré sur le benchmark ARC-AGI-3 (95,5 %, supérieur au seuil humain de référence), que pour une question plus dérangeante : qu'est-ce qui distingue réellement, aujourd'hui, un agent d'un autre ? Il y a peu, il suffisait de regarder le modèle sous le capot, GPT, Claude, Gemini, DeepSeek, open source ou propriétaire. Avec les agents de nouvelle génération, cette logique a volé en éclats.

Generative AIApplicationsSecurity
J'ai construit de toutes pièces la LLM Wiki de Karpathy sur mes articles

14 août 2026

J'ai construit de toutes pièces la LLM Wiki de Karpathy sur mes articles

Pendant un an, j'ai écrit sur AiTalk, accumulant, article après article, une sorte de journal intime sur l'intelligence artificielle. À un certain point, je me suis retrouvé avec 164 fichiers dans un dossier, chacun rempli de concepts, de noms, d'entreprises, de modèles, tous cités et jamais vraiment reliés entre eux. Je savais que j'avais écrit quelque chose sur un sujet particulier, mais je ne me souvenais plus où, et le retrouver signifiait ouvrir les fichiers un par un, en espérant faire confiance à ma mémoire ou à un heureux "rechercher dans le texte". Bref, un archivage, pas une connaissance.

Generative AIApplicationsE-learning
OmniVoice Studio : cloner des voix en local

12 août 2026

OmniVoice Studio : cloner des voix en local

J'ai installé OmniVoice Studio un vendredi soir, avec l'attente typique de celui qui a déjà vu trop d'"alternatives gratuites à ElevenLabs" finir en démo bancale. Le résultat a été étonnamment bon, mais pas impeccable : le français tient la route, même si certaines prononciations trébuchent sur des mots moins communs, et la voix que j'avais choisie dans la bibliothèque ne correspondait pas toujours à 100 % à ce qui sortait des haut-parleurs. Et c'est précisément dans cet écart que le projet devient intéressant, car il montre à la fois le bond en avant de l'audio synthétique et son côté le plus délicat, celui de la sécurité et de l'utilisation responsable, étant donné que le clonage vocal peut être précieux pour le doublage ou l'accessibilité, mais aussi facilement détourné par quiconque souhaite usurper l'identité de quelqu'un d'autre.

Generative AIApplicationsEthics & Society
Laguna S2.1 : le modèle américain open-weight

10 août 2026

Laguna S2.1 : le modèle américain open-weight

Chaque fois que cette série ouvre ses portes à un nouveau modèle, le disclaimer reste le même : ce n'est pas un benchmark scientifique, c'est le compte rendu d'un utilisateur exigeant qui installe un modèle open-weight sur son PC de bureau et le met à l'épreuve avec les mêmes tâches réservées aux candidats précédents. Cette fois, pourtant, l'origine du modèle modifie le poids de la question.

TrainingGenerative AIEthics & Society
Conversation avec Enrico Papalini sur le 'Non-Deterministic Loop Engineering'

07 août 2026

Conversation avec Enrico Papalini sur le 'Non-Deterministic Loop Engineering'

Quand nous avions parlé avec Enrico Papalini il y a un an de son premier livre, le thème central était un pacte silencieux rompu : celui entre les développeurs et les machines déterministes, brisé au moment où le code a cessé de faire toujours et en tout cas ce qui lui était écrit. Papalini, Head of Software Development pour Issuances, Custody, Data & UX/UI Solutions chez Euronext Securities, avec un passé au London Stock Exchange Group et à la Borsa Italiana, avait raconté cette transition avec la voix de celui qui gère des systèmes où l'erreur n'est pas une option contractuelle, mais un incident.

Generative AISecurityEthics & Society
Soofi S : un modèle allemand, et l'ambition continentale

05 août 2026

Soofi S : un modèle allemand, et l'ambition continentale

Le 17 juin 2026, depuis Berlin, un consortium d'instituts de recherche allemands a annoncé « Soofi S », en le présentant non pas comme un énième modèle linguistique en quête d'attention, mais comme le premier maillon d'une famille de modèles d'IA européens. Derrière l'acronyme, Sovereign Open Source Foundation Models, se cache un projet financé par le ministère fédéral allemand des Affaires économiques et de l'Énergie dans le cadre de l'initiative IPCEI-CIS, conçu pour offrir aux entreprises, à l'administration publique, aux centres de recherche et aux startups une alternative transparente aux modèles non européens. C'est une phrase qui, lue avec les bonnes lunettes (celles de Rowdy Piper dans Invasion Los Angeles, pour ainsi dire, celles qui révèlent ce qui se cache derrière le panneau publicitaire), ne parle pas de benchmarks. Elle parle de pouvoir.

TrainingGenerative AIEthics & Society