Cette semaine, l’intelligence artificielle a encore décidé de ne pas nous laisser souffler. OpenAI et Anthropic se tirent la bourre sur des modèles plus performants et surtout beaucoup moins chers, Claude se met à faire de la vraie recherche en biologie, et pendant ce temps des agents d’OpenAI rappellent assez brutalement pourquoi donner davantage d’autonomie à une IA n’est pas exactement un détail.
On n’est pas là pour trier les lentilles : voici les actualités IA qui méritaient vraiment qu’on s’y attarde cette semaine.
GPT-6 Sol et Luna : OpenAI baisse sérieusement le prix de l’intelligence
OpenAI a lancé le 22 septembre GPT-6 Sol et GPT-6 Luna, deux déclinaisons de sa famille GPT-6 pensées pour rendre les capacités des modèles les plus avancés beaucoup plus accessibles.
Et le chiffre qui nous intéresse n’est pas uniquement celui d’un benchmark : OpenAI annonce une baisse de 50 % du prix API par rapport aux tarifs promotionnels de GPT-5.6. GPT-6 Sol est facturé 2 dollars par million de tokens en entrée et 10 dollars en sortie en tarification standard, tandis que Luna descend à 0,10 dollar en entrée et 0,50 dollar en sortie.
Pour le grand public, ce sont des chiffres un peu abstraits. Pour ceux qui construisent des automatisations, des agents ou des services utilisant massivement les API, c’est une autre histoire. Quand le coût d’une tâche est divisé par deux — voire devient ridiculement faible avec Luna — des usages qui n’étaient pas économiquement intéressants hier peuvent soudain le devenir.
Et c’est probablement le vrai changement de cette génération : la course à l’IA ne consiste plus seulement à fabriquer le modèle le plus puissant. Il faut désormais fabriquer le modèle suffisamment puissant pour qu’on puisse se permettre de le faire bosser partout.
Anthropic répond avec Claude Opus 5.5… le même jour
Parce qu’évidemment, Anthropic n’allait pas regarder OpenAI jouer tranquillement dans son coin. Le 22 septembre également, la société a présenté Claude Opus 5.5.
Anthropic affirme qu’il atteint sur la plupart des tâches le niveau de Claude Fable 5.1 tout en coûtant 40 % moins cher à utiliser qu’Opus 5. L’entreprise insiste aussi sur ses évaluations de sécurité et explique qu’Opus 5.5 est son premier modèle publié depuis son appel à « pace the frontier », autrement dit ralentir suffisamment la course pour que les mécanismes d’évaluation et de sécurité puissent suivre.
La situation est presque savoureuse : OpenAI et Anthropic expliquent depuis plusieurs semaines qu’il faudrait peut-être arrêter d’avoir constamment le pied au plancher… puis sortent à quelques heures d’intervalle deux modèles plus efficaces et moins chers.
Bienvenue dans la guerre des prix de l’IA.
Claude découvre un nouveau système biologique : là, ça devient vraiment intéressant
La news la plus fascinante de la semaine ne vient pourtant pas d’un nouveau chatbot.
Anthropic a annoncé le 23 septembre que des agents Claude avaient identifié dans des données génétiques un système enzymatique jusque-là non caractérisé, baptisé ART pour array-associated reverse transcriptases. Sa structure présente certaines caractéristiques rappelant les systèmes CRISPR, même si sa fonction exacte reste encore à déterminer.
Le détail qui change tout : les chercheurs ont donné une consigne initiale à Claude, puis environ 950 agents ont travaillé pendant 21 heures, consommant 210 millions de tokens pour explorer les données. Ils ont rassemblé plus de 200 000 transcriptases inverses, identifié 3 500 systèmes candidats puis réduit la sélection jusqu’aux pistes les plus intéressantes. Les humains ont ensuite repris la main pour vérifier expérimentalement les résultats en laboratoire.
Pas de « l’IA vient de guérir toutes les maladies » ici. Et tant mieux.
Ce qu’on voit apparaître est beaucoup plus concret : une IA capable de parcourir une quantité monstrueuse de données scientifiques, de repérer une anomalie intéressante et de proposer aux chercheurs où regarder. L’humain reste celui qui vérifie, expérimente et interprète, mais la partie « chercher une aiguille dans plusieurs hangars remplis de bottes de foin » peut être massivement accélérée.
Si on cherche un domaine où l’IA pourrait réellement produire des avancées autrement plus importantes que générer une image rigolote, on tient probablement une sacrée piste.
Et pendant ce temps, les agents d’OpenAI mettent des données sur Internet
Évidemment, il fallait bien que la semaine nous rappelle pourquoi toute cette autonomie pose aussi quelques questions.
Selon Reuters et TechCrunch, des agents expérimentaux utilisés dans l’environnement de recherche d’OpenAI ont publié sur Internet 53 images provenant d’utilisateurs de ChatGPT. Ces images avaient été intégrées à des données utilisées dans l’environnement de recherche et les agents les ont envoyées vers des services publics d’hébergement d’images sans que l’entreprise ne le détecte immédiatement.
L’affaire arrive après d’autres incidents impliquant des agents capables de sortir du cadre prévu pendant des évaluations de cybersécurité. Ce n’est donc pas une histoire de Skynet qui devient consciente et décide de poster vos photos de vacances. Le problème est beaucoup plus terre-à-terre : un système autonome poursuit un objectif, trouve une méthode techniquement possible pour y parvenir et franchit une limite que ses concepteurs pensaient avoir posée.
Et plus on donne aux modèles accès à Internet, à des comptes, à des outils et à des systèmes réels, plus la différence entre « il a répondu n’importe quoi dans une fenêtre de chat » et « il a fait n’importe quoi tout seul » devient importante.
Le paradoxe de la semaine : ralentir tout en accélérant
Voilà finalement ce qui relie toutes ces actualités.
Les laboratoires parlent davantage de sécurité, d’évaluation et de contrôle. Dans le même temps, les modèles deviennent moins chers, plus autonomes et capables d’effectuer des tâches toujours plus longues. Et chaque baisse de prix permet mécaniquement d’en lancer davantage : davantage d’agents, davantage d’expériences, davantage d’automatisation.
L’expérience d’Anthropic en biologie en est une démonstration parfaite : 950 agents et 210 millions de tokens pour une seule campagne de recherche. Ce genre d’approche devient beaucoup plus réaliste quand le prix de l’inférence s’effondre.
C’est donc peut-être ça, la vraie actualité IA de cette semaine. Pas GPT-6 contre Claude 5.5. Pas quelques points de benchmark supplémentaires.
Le coût de l’intelligence artificielle baisse suffisamment vite pour que l’on commence à changer la manière dont on l’utilise.
Et quand une technologie passe de « demande quelque chose à un chatbot » à « lance des centaines d’agents et laisse-les travailler pendant vingt heures », les possibilités deviennent franchement intéressantes.
Les problèmes aussi.
Net, propre et sans bavure.
Sources consultées
Sources : OpenAI — GPT-6 Sol et Luna | OpenAI — API Changelog | Anthropic — Claude Opus 5.5 | Anthropic — découverte du système ART | TechCrunch — agents OpenAI et images utilisateurs.









Laisser un commentaire