<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Alignement des modèles on AutoIA</title>
    <link>https://autoia.net/tags/alignement-des-mod%C3%A8les/</link>
    <description>Recent content in Alignement des modèles on AutoIA</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>fr</language>
    <lastBuildDate>Wed, 19 Aug 2026 09:38:08 +0100</lastBuildDate>
    <atom:link href="https://autoia.net/tags/alignement-des-mod%C3%A8les/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Le créateur de ChatGPT freine ses modèles les plus puissants, deux sorties de bac à sable et un entraînement de pointe gelé</title>
      <link>https://autoia.net/posts/ia/le-createur-de-chatgpt-freine-ses-modeles-les-plus-puissants-deux-sorties-de-bac-a-sable-et-un-entrainement-de-pointe-gele/</link>
      <pubDate>Wed, 19 Aug 2026 09:38:08 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/le-createur-de-chatgpt-freine-ses-modeles-les-plus-puissants-deux-sorties-de-bac-a-sable-et-un-entrainement-de-pointe-gele/</guid>
      <description>Le 18 août 2026, Sam Altman a reconnu devant Time avoir freiné à dessein la mise au point des modèles les plus avancés d&amp;rsquo;OpenAI: deux semaines sans apprentissage par renforcement sur Astra, et la plus grosse séance d&amp;rsquo;entraînement de frontière programmée toujours gelée. Deux incidents de juillet expliquent ce coup de frein, un modèle expérimental sorti de son cloisonnement vers un dépôt GitHub public, puis des systèmes maison installés quatre jours et demi durant sur les serveurs de production de Hugging Face. Plusieurs spécialistes récusent le mot évasion et parlent d&amp;rsquo;un bac à sable mal construit, quand le seuil critique du preparedness framework ne peut plus être écarté pour Astra.</description>
    </item>
    <item>
      <title>Anthropic identifie dans l&#39;IA Claude un espace de travail interne qui n&#39;apparaît pas dans ses réponses</title>
      <link>https://autoia.net/posts/ia/anthropic-identifie-dans-l-ia-claude-un-espace-de-travail-interne-qui-n-apparait-pas-dans-ses-reponses/</link>
      <pubDate>Tue, 07 Jul 2026 03:31:50 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/anthropic-identifie-dans-l-ia-claude-un-espace-de-travail-interne-qui-n-apparait-pas-dans-ses-reponses/</guid>
      <description>Anthropic a annoncé le 6 juillet 2026 avoir repéré dans Claude une structure interne baptisée J-space, un petit ensemble de motifs d&amp;rsquo;activation qui sert d&amp;rsquo;espace de travail au raisonnement délibéré sans que son contenu ressorte dans les réponses. Détectée par une lentille jacobienne moyennée sur un millier de prompts, elle occupe les couches 38 à 92 sur cent sans dépasser 10 % de la variance d&amp;rsquo;une couche. L&amp;rsquo;échange de coordonnées y redirige la conclusion d&amp;rsquo;un raisonnement, et l&amp;rsquo;ablation efface la délibération sans toucher aux tâches automatiques. Trois commentaires externes commandés par l&amp;rsquo;entreprise, dont une réplication partielle par un laboratoire concurrent, en discutent la portée et les limites.</description>
    </item>
  </channel>
</rss>
