<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Classificateurs on AutoIA</title>
    <link>https://autoia.net/tags/classificateurs/</link>
    <description>Recent content in Classificateurs on AutoIA</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>fr</language>
    <lastBuildDate>Sun, 16 Aug 2026 14:30:00 +0100</lastBuildDate>
    <atom:link href="https://autoia.net/tags/classificateurs/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Anthropic découvre un trou de onze mois dans la sécurité de ses modèles, les filtres sur les armes biologiques désactivés</title>
      <link>https://autoia.net/posts/ia/anthropic-decouvre-un-trou-de-onze-mois-dans-la-securite-de-ses-modeles-les-filtres-sur-les-armes-biologiques-desactives/</link>
      <pubDate>Sun, 16 Aug 2026 14:30:00 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/anthropic-decouvre-un-trou-de-onze-mois-dans-la-securite-de-ses-modeles-les-filtres-sur-les-armes-biologiques-desactives/</guid>
      <description>Le 14 août 2026, Anthropic a publié son deuxième rapport de risques, 186 pages caviardées. On y apprend que les classificateurs chargés de bloquer les échanges liés aux armes biologiques sont restés inactifs onze mois, de mai 2025 à avril 2026, sur les plateformes de retour humain de quelque 50 000 prestataires, soit près de 133 millions d&amp;rsquo;échanges. Un indicateur interne coupait à la fois le blocage et la journalisation, rendant toute alerte impossible. L&amp;rsquo;audit rétrospectif, mené en rejouant les messages dans un classificateur, a signalé 1 197 conversations sans révéler d&amp;rsquo;usage malveillant préoccupant. Le risque chimique et biologique passe de très faible à faible mais non négligeable.</description>
    </item>
    <item>
      <title>Shieldstral, le modèle ouvert de Mistral qui contrôle dans douze langues les contenus générés par une intelligence artificielle</title>
      <link>https://autoia.net/posts/ia/shieldstral-le-modele-ouvert-de-mistral-qui-controle-dans-douze-langues-les-contenus-generes-par-une-intelligence-artificielle/</link>
      <pubDate>Thu, 06 Aug 2026 04:20:47 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/shieldstral-le-modele-ouvert-de-mistral-qui-controle-dans-douze-langues-les-contenus-generes-par-une-intelligence-artificielle/</guid>
      <description>Mistral a publié le 4 août 2026 Shieldstral, un classificateur de sécurité multimodal de trois milliards de paramètres, en poids ouverts sous licence Apache 2.0, couvrant douze langues et tenant sur une seule carte graphique de 16 Go. Sa particularité tient à la règle écrite en langage naturel sous forme de question fermée, à laquelle il répond par un unique jeton, sans motif. L&amp;rsquo;éditeur revendique 84,9 % en sécurité textuelle et 83,8 % en multimodal, à hauteur de modèles jusqu&amp;rsquo;à sept fois plus gros, mais il cède sur le multilingue et sur l&amp;rsquo;adaptabilité aux politiques, précisément là où se situe sa promesse. Le calendrier européen éclaire la fenêtre de sortie.</description>
    </item>
  </channel>
</rss>
