Un modèle d’intelligence artificielle sur trois cède face à une instruction malveillante correctement formulée. Le chiffre a de quoi surprendre, d’autant qu’il ne sort pas d’un obscur forum de pirates informatiques, mais bien de tests standardisés conduits en laboratoire. Ces protocoles n’ont qu’un seul objectif : mesurer l’écart, parfois vertigineux, entre ce qu’une IA promet […]
Cet article est paru en premier sur sciencepost.fr
Cet article est paru en premier sur le site https://sciencepost.fr/lia-etait-censee-suivre-vos-consignes-a-la-lettre-des-tests-standardises-viennent-de-reveler-ce-quelle-fait-quand-personne-ne-regarde/
