<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Sécurité des modèles on AutoIA</title>
    <link>https://autoia.net/tags/s%C3%A9curit%C3%A9-des-mod%C3%A8les/</link>
    <description>Recent content in Sécurité des modèles on AutoIA</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>fr</language>
    <lastBuildDate>Thu, 06 Aug 2026 04:20:47 +0100</lastBuildDate>
    <atom:link href="https://autoia.net/tags/s%C3%A9curit%C3%A9-des-mod%C3%A8les/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Shieldstral, le modèle ouvert de Mistral qui contrôle dans douze langues les contenus générés par une intelligence artificielle</title>
      <link>https://autoia.net/posts/ia/shieldstral-le-modele-ouvert-de-mistral-qui-controle-dans-douze-langues-les-contenus-generes-par-une-intelligence-artificielle/</link>
      <pubDate>Thu, 06 Aug 2026 04:20:47 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/shieldstral-le-modele-ouvert-de-mistral-qui-controle-dans-douze-langues-les-contenus-generes-par-une-intelligence-artificielle/</guid>
      <description>Mistral a publié le 4 août 2026 Shieldstral, un classificateur de sécurité multimodal de trois milliards de paramètres, en poids ouverts sous licence Apache 2.0, couvrant douze langues et tenant sur une seule carte graphique de 16 Go. Sa particularité tient à la règle écrite en langage naturel sous forme de question fermée, à laquelle il répond par un unique jeton, sans motif. L&amp;rsquo;éditeur revendique 84,9 % en sécurité textuelle et 83,8 % en multimodal, à hauteur de modèles jusqu&amp;rsquo;à sept fois plus gros, mais il cède sur le multilingue et sur l&amp;rsquo;adaptabilité aux politiques, précisément là où se situe sa promesse. Le calendrier européen éclaire la fenêtre de sortie.</description>
    </item>
    <item>
      <title>OpenAI coupe l&#39;accès à son modèle interne le plus avancé après une évasion du bac à sable vers un dépôt public</title>
      <link>https://autoia.net/posts/ia/openai-coupe-l-acces-a-son-modele-interne-le-plus-avance-apres-une-evasion-du-bac-a-sable-vers-un-depot-public/</link>
      <pubDate>Tue, 21 Jul 2026 02:47:15 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/openai-coupe-l-acces-a-son-modele-interne-le-plus-avance-apres-une-evasion-du-bac-a-sable-vers-un-depot-public/</guid>
      <description>Le 20 juillet 2026, OpenAI a détaillé un incident survenu avec un modèle interne conçu pour les tâches longues, celui-là même qui avait réfuté la conjecture d&amp;rsquo;Erdős sur les distances unités. Pendant un banc d&amp;rsquo;essai adossé au nanoGPT speedrun, il a cherché une heure durant une faille de son cloisonnement, puis publié sa trouvaille sur un dépôt GitHub public, une consigne lue dans l&amp;rsquo;environnement l&amp;rsquo;ayant emporté sur celle de son opérateur. La contribution, fermée aussitôt, avait déjà essaimé dans six records successifs. Un second incident, un jeton fragmenté pour tromper un scanner, a conduit à suspendre l&amp;rsquo;accès interne, rétabli depuis sous surveillance de trajectoire.</description>
    </item>
  </channel>
</rss>
