<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Évaluation des modèles on AutoIA</title>
    <link>https://autoia.net/tags/%C3%A9valuation-des-mod%C3%A8les/</link>
    <description>Recent content in Évaluation des modèles on AutoIA</description>
    <generator>Hugo -- gohugo.io</generator>
    <language>fr</language>
    <lastBuildDate>Fri, 03 Jul 2026 12:32:47 +0100</lastBuildDate>
    <atom:link href="https://autoia.net/tags/%C3%A9valuation-des-mod%C3%A8les/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>La souveraineté linguistique à 7 millions d&#39;euros, le Portugal livre Amália, son modèle de langue public et ouvert</title>
      <link>https://autoia.net/posts/ia/la-souverainete-linguistique-a-7-millions-d-euros-le-portugal-livre-amalia-son-modele-de-langue-public-et-ouvert/</link>
      <pubDate>Fri, 03 Jul 2026 12:32:47 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/la-souverainete-linguistique-a-7-millions-d-euros-le-portugal-livre-amalia-son-modele-de-langue-public-et-ouvert/</guid>
      <description>Le 1er juillet 2026, le gouvernement portugais a présenté à Lisbonne Amália, premier grand modèle de langue ouvert en portugais européen, publié sous licence Apache 2.0 par un consortium de plus de soixante chercheurs coordonné par la NOVA University. Doté de 7 millions d&amp;rsquo;euros au titre du plan de relance et de résilience, il prolonge le socle européen EuroLLM-9B au lieu de repartir de zéro, pour environ 26 000 heures-GPU obtenues sur les machines publiques d&amp;rsquo;EuroHPC. L&amp;rsquo;enveloppe paie surtout des chercheurs, la curation d&amp;rsquo;une archive nationale et quatre jeux d&amp;rsquo;évaluation propres à la variété européenne. Le cas éclaire par contraste une stratégie française tournée vers le déploiement.</description>
    </item>
    <item>
      <title>Les grands modèles de langage échouent au test de Stroop, une épreuve psychologique de 1935 que les humains réussissent</title>
      <link>https://autoia.net/posts/ia/les-grands-modeles-de-langage-echouent-au-test-de-stroop-une-epreuve-psychologique-de-1935-que-les-humains-reussissent/</link>
      <pubDate>Thu, 18 Jun 2026 23:28:57 +0100</pubDate>
      <guid>https://autoia.net/posts/ia/les-grands-modeles-de-langage-echouent-au-test-de-stroop-une-epreuve-psychologique-de-1935-que-les-humains-reussissent/</guid>
      <description>Le test de Stroop, conçu en 1935, oppose la lecture automatique d&amp;rsquo;un mot à la couleur de l&amp;rsquo;encre qui l&amp;rsquo;imprime. Soumis à ce protocole sous forme d&amp;rsquo;images, GPT-4o passe de 91 % de bonnes réponses sur cinq mots à 15 % sur quarante, Claude 3.5 Sonnet de 76 % à 24 %, tandis que les humains gardent un taux élevé bien au-delà de quarante items. Les conditions de contrôle nuancent pourtant la lecture qui circule: la précision s&amp;rsquo;effondre aussi quand aucun conflit sémantique n&amp;rsquo;est présent, ce qui déplace la question de l&amp;rsquo;inhibition vers l&amp;rsquo;énumération, la perception visuelle et la dispersion de l&amp;rsquo;attention avec la longueur de la séquence.</description>
    </item>
  </channel>
</rss>
