<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Coûts d&#39;inférence on AutoIA</title>
    <link>https://autoia.net/tags/co%C3%BBts-dinf%C3%A9rence/</link>
    <description>Recent content in Coûts d&#39;inférence on AutoIA</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>fr</language>
    <lastBuildDate>Mon, 17 Aug 2026 05:10:26 +0100</lastBuildDate>
    <atom:link href="https://autoia.net/tags/co%C3%BBts-dinf%C3%A9rence/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Avec Harness, une couche d’exécution d’agents sous licence MIT, DeepSeek veut peser sur les standards logiciels de l’IA agentique</title>
      <link>https://autoia.net/posts/ia/avec-harness-une-couche-dexecution-dagents-sous-licence-mit-deepseek-veut-peser-sur-les-standards-logiciels-de-lia-agentique/</link>
      <pubDate>Mon, 17 Aug 2026 05:10:26 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/avec-harness-une-couche-dexecution-dagents-sous-licence-mit-deepseek-veut-peser-sur-les-standards-logiciels-de-lia-agentique/</guid>
      <description>Le 13 août 2026, DeepSeek a mis en ligne DeepSeek Harness, abrégé dsh, un environnement d’exécution d’agents sous licence MIT bâti sur le noyau à plugins Cordis, où le modèle, les outils, les sessions et l’interface deviennent des modules interchangeables. Quatre modes sont proposés, dont un mode Minimal voué au benchmarking, et le journal de session en ajout seul promet l’audit autant qu’il crée un passif de rétention. La préversion arrive sur un marché occupé par Codex, Claude Code, Gemini CLI et Qwen Code, dans une année marquée par le reflux de l’ouverture, et pose la question de la couche d’exécution comme véritable terrain de la concurrence agentique.</description>
    </item>
    <item>
      <title>La version gratuite de ChatGPT perd son plafond de messages, les conversations texte deviennent illimitées avec GPT-5.6 Luna</title>
      <link>https://autoia.net/posts/ia/la-version-gratuite-de-chatgpt-perd-son-plafond-de-messages-les-conversations-texte-deviennent-illimitees-avec-gpt-5-6-luna/</link>
      <pubDate>Fri, 07 Aug 2026 10:49:28 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/la-version-gratuite-de-chatgpt-perd-son-plafond-de-messages-les-conversations-texte-deviennent-illimitees-avec-gpt-5-6-luna/</guid>
      <description>Le 6 août 2026, OpenAI a annoncé que les conversations texte de ChatGPT deviendraient illimitées pour les comptes gratuits à partir de la semaine suivante, avec GPT-5.6 Luna comme modèle par défaut de Free et de Go. L&amp;rsquo;illimité ne couvre ni les images, ni les fichiers, ni la voix, ni les autres outils, et le modèle offert n&amp;rsquo;est pas GPT-5.6 Sol, réservé aux formules payantes. Un bouton Réfléchir et un curseur de raisonnement déplacent le rationnement du message vers le jeton. La baisse de 80 % du prix de Luna le 30 juillet et les noyaux GPU réécrits par le modèle rendent le geste soutenable, tandis que ChatGPT Go perd son principal argument et que l&amp;rsquo;Europe voit monter ses compteurs réglementaires.</description>
    </item>
    <item>
      <title>Une intelligence artificielle aurait signé dix avancées mathématiques, un exploit ou une opération de communication ?</title>
      <link>https://autoia.net/posts/ia/une-intelligence-artificielle-aurait-signe-dix-avancees-mathematiques-un-exploit-ou-une-operation-de-communication/</link>
      <pubDate>Mon, 03 Aug 2026 21:44:34 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/une-intelligence-artificielle-aurait-signe-dix-avancees-mathematiques-un-exploit-ou-une-operation-de-communication/</guid>
      <description>OpenAI attribue à une version interne de son prochain modèle, baptisée Astra, dix résultats présentés comme inédits en mathématiques et en informatique théorique, chacun accompagné d&amp;rsquo;un certificat formalisé dans Lean 4 et déposé publiquement. Le laboratoire met en avant un manuscrit de 249 pages et une facture de jetons estimée à 2 000 dollars, un chiffre qui laisse de côté l&amp;rsquo;entraînement, le travail humain et les tentatives infructueuses. Un tel certificat garantit la correction d&amp;rsquo;une démonstration, jamais la fidélité de l&amp;rsquo;énoncé formalisé, ni la nouveauté ou l&amp;rsquo;importance du résultat. Deux dépôts concurrents en quarante-huit heures et un calendrier réglementaire chargé complètent le tableau.</description>
    </item>
    <item>
      <title>Microsoft dévoile Project Perception, une armée d&#39;agents IA conçus pour automatiser la réponse aux cybermenaces</title>
      <link>https://autoia.net/posts/ia/microsoft-devoile-project-perception-une-armee-d-agents-ia-concus-pour-automatiser-la-reponse-aux-cybermenaces/</link>
      <pubDate>Tue, 28 Jul 2026 18:14:25 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/microsoft-devoile-project-perception-une-armee-d-agents-ia-concus-pour-automatiser-la-reponse-aux-cybermenaces/</guid>
      <description>Microsoft a détaillé le 27 juillet 2026 Project Perception, une architecture de sécurité agentique pour les centres opérationnels de sécurité, qui enchaîne simulation d&amp;rsquo;attaque, enquête, détection et remédiation dans une même boucle. Trois familles d&amp;rsquo;agents s&amp;rsquo;y répartissent le travail, red teams à l&amp;rsquo;offensive, blue teams à l&amp;rsquo;analyse, green teams au correctif, sur un contexte partagé. Le dispositif repose sur le système MDASH et sur MAI-Cyber-1-Flash, modèle maison qui absorbe environ 90 % des requêtes, GPT-5.4 traitant les cas les plus difficiles. L&amp;rsquo;éditeur revendique 96 % de réussite sur le banc d&amp;rsquo;essai CyberGym et un coût réduit de près de moitié. La préversion publique doit ouvrir le 3 août 2026.</description>
    </item>
    <item>
      <title>GPT-5.6 et ChatGPT Travail, OpenAI oppose trois modèles et un agent de bureau aux tarifs et aux scores d&#39;Anthropic</title>
      <link>https://autoia.net/posts/ia/gpt-5-6-et-chatgpt-travail-openai-oppose-trois-modeles-et-un-agent-de-bureau-aux-tarifs-et-aux-scores-d-anthropic/</link>
      <pubDate>Fri, 10 Jul 2026 23:57:19 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/gpt-5-6-et-chatgpt-travail-openai-oppose-trois-modeles-et-un-agent-de-bureau-aux-tarifs-et-aux-scores-d-anthropic/</guid>
      <description>Le 9 juillet 2026, OpenAI a ouvert à tous GPT-5.6 Sol, Terra et Luna, tarifés de 1 à 5 dollars le million de jetons d&amp;rsquo;entrée, et lancé ChatGPT Travail, un agent qui accède au bureau et au navigateur. Chaque chiffre vise Claude Fable 5: 53,6 à Agents&amp;rsquo; Last Exam, 59 contre 60 à l&amp;rsquo;Intelligence Index, 80 au Coding Agent Index. Deux de ces écarts tiennent dans une marge d&amp;rsquo;erreur ou dans le choix d&amp;rsquo;un harnais, et le premier ignore le palier où tous les agents échouent. Restent le coût par tâche, une fiche système qui admet un dépassement d&amp;rsquo;intention, une preview de douze jours sous revue gouvernementale et l&amp;rsquo;échéance européenne du 2 août 2026.</description>
    </item>
    <item>
      <title>Grok 4.5, xAI mise sur un tarif au token plus bas pour défier OpenAI et Anthropic sur le codage agentique</title>
      <link>https://autoia.net/posts/ia/grok-4-5-xai-mise-sur-un-tarif-au-token-plus-bas-pour-defier-openai-et-anthropic-sur-le-codage-agentique/</link>
      <pubDate>Thu, 09 Jul 2026 11:47:10 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/grok-4-5-xai-mise-sur-un-tarif-au-token-plus-bas-pour-defier-openai-et-anthropic-sur-le-codage-agentique/</guid>
      <description>Présenté comme le modèle le plus puissant de xAI, désormais absorbé par SpaceX, Grok 4.5 est facturé 2 dollars le million de tokens en entrée et 6 dollars en sortie, quand le haut de gamme d&amp;rsquo;Anthropic atteint 5 et 25 dollars. Sur l&amp;rsquo;indice des agents de codage d&amp;rsquo;Artificial Analysis, il obtient 76 points pour 2,49 dollars par tâche, contre 5,07 dollars pour GPT-5.5 et 11,80 dollars pour Fable 5. La grille officielle nuance l&amp;rsquo;offensive, puisque les prix doublent au-delà de 200 000 tokens de contexte, que les appels d&amp;rsquo;outils sont facturés à part et que le modèle reste le plus cher du catalogue maison. Forrester, Omdia et Counterpoint invitent à raisonner en coût par résultat réussi plutôt qu&amp;rsquo;en coût par token.</description>
    </item>
    <item>
      <title>Anthropic dévoile Claude Sonnet 5, le modèle par défaut hérite des capacités agentiques du haut de gamme</title>
      <link>https://autoia.net/posts/ia/anthropic-devoile-claude-sonnet-5-le-modele-par-defaut-herite-des-capacites-agentiques-du-haut-de-gamme/</link>
      <pubDate>Wed, 01 Jul 2026 17:41:12 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/anthropic-devoile-claude-sonnet-5-le-modele-par-defaut-herite-des-capacites-agentiques-du-haut-de-gamme/</guid>
      <description>Anthropic a présenté le 30 juin 2026 Claude Sonnet 5, décrit comme le modèle Sonnet le plus agentique jamais conçu, capable de relire et de corriger seul sa production, et devenu la référence par défaut des comptes sans abonnement et de l&amp;rsquo;abonnement Pro. L&amp;rsquo;écart jugé négligeable avec Opus 4.8 sur Humanity&amp;rsquo;s Last Exam ne tient qu&amp;rsquo;avec les outils, 57,4 % contre 57,9 %, et grimpe à 6,6 points sans eux. Le tarif reste de trois et quinze dollars le million de tokens, mais un nouveau tokenizer produit environ 30 % de tokens en plus pour le même texte. Claude Science accompagne le lancement, au lendemain de la levée des restrictions américaines à l&amp;rsquo;exportation qui frappaient Fable 5 et Mythos 5.</description>
    </item>
    <item>
      <title>L&#39;alerte de Microsoft sur les API d&#39;OpenAI et d&#39;Anthropic, un modèle économique qui menace les budgets informatiques</title>
      <link>https://autoia.net/posts/ia/l-alerte-de-microsoft-sur-les-api-d-openai-et-d-anthropic-un-modele-economique-qui-menace-les-budgets-informatiques/</link>
      <pubDate>Mon, 22 Jun 2026 08:07:36 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/l-alerte-de-microsoft-sur-les-api-d-openai-et-d-anthropic-un-modele-economique-qui-menace-les-budgets-informatiques/</guid>
      <description>Le 22 juin 2026, le PDG de Microsoft met en cause une industrie de l&amp;rsquo;intelligence artificielle où quelques laboratoires captent l&amp;rsquo;essentiel des usages professionnels, juge la facturation au token insoutenable au-delà d&amp;rsquo;un certain volume et redoute une érosion des savoir-faire chez ses clients. Les chiffres avancés appellent pourtant une vérification : les parts de marché citées proviennent d&amp;rsquo;un fonds d&amp;rsquo;investissement, la fourchette de coûts par ingénieur concerne un autre groupe, et l&amp;rsquo;entreprise qui alerte a basculé trois semaines plus tôt son propre assistant de codage vers une facturation à l&amp;rsquo;usage. Derrière la querelle tarifaire demeure une question de fond : le prix d&amp;rsquo;une valeur qui reste à démontrer.</description>
    </item>
    <item>
      <title>Des factures d&#39;IA qui explosent, ce qui se joue dans la guerre des prix annoncée entre OpenAI et Anthropic</title>
      <link>https://autoia.net/posts/ia/des-factures-d-ia-qui-explosent-ce-qui-se-joue-dans-la-guerre-des-prix-annoncee-entre-openai-et-anthropic/</link>
      <pubDate>Thu, 11 Jun 2026 18:38:33 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/des-factures-d-ia-qui-explosent-ce-qui-se-joue-dans-la-guerre-des-prix-annoncee-entre-openai-et-anthropic/</guid>
      <description>OpenAI étudierait des baisses de prix drastiques sur ses tokens pour anticiper un mouvement d&amp;rsquo;Anthropic, à la veille de deux introductions en Bourse. Aucun chiffre ni calendrier n&amp;rsquo;accompagne cette hypothèse, alors que le prix à performance constante baisse déjà d&amp;rsquo;un facteur dix par an. Le décalage tient à des mécanismes invisibles sur les grilles tarifaires : jetons de raisonnement facturés au tarif de sortie, contexte renvoyé à chaque tour d&amp;rsquo;une boucle agentique, six tarifs distincts entre cache et batch. Uber plafonne la dépense de ses salariés, Meta a retiré son classement interne, et les données de marché contredisent l&amp;rsquo;idée que les modèles seraient interchangeables.</description>
    </item>
  </channel>
</rss>
