Passer au contenu

Vous lisez l’IA sans le savoir : voici ce que révèle l’étude sur les textes générés par l’intelligence artificielle sur le web

2 min
0 commentaire
Partagez

Pew Research Center a réalisé une étude sur les textes générés par l’IA et publiés sur le web. 35 % des pages étudiées qui ont été publiées après le lancement de ChatGPT montraient des signes de génération ou d’édition de texte avec l’intelligence artificielle. Les résultats sont cependant à considérer avec prudence, étant donné qu’elle a été menée sur un échantillon de pages en anglais.

Il est possible qu’une bonne partie des contenus que vous lisez sur internet soit déjà écrite par l’intelligence artificielle. S’il est impossible d’avoir le nombre exact de textes générés par IA publiés sur la toile, le think tank américain Pew Research Center a pu obtenir un pourcentage en étudiant le Common Crawl, un référentiel d’exploration du contenu du web.

L’étude de Pew Research Center été réalisée sur une archive de presque un demi-million de pages web en anglais, datant des cinq dernières années. Durant celle-ci, une technologie de détection appelée Open Pangram a été utilisée pour identifier celles dont les textes sont susceptibles d’avoir été rédigés par une IA.

Et, selon les résultats de cette étude, 35 % des pages apparues après le lancement de ChatGPT montrent des signes importants qui indiquent que le texte a peut-être été édité ou rédigé avec l’intelligence artificielle.

L’Europe a déjà une loi pour ça

Bien entendu, les résultats de cette étude sont à considérer avec prudence, car celle-ci a été menée sur un échantillon de pages en anglais. De plus, la technologie utilisée pour déterminer si un texte a été rédigé avec l’IA ne permet pas d’avoir des certitudes, mais détecte seulement certains signaux.

Mais, en tout cas, ce problème a déjà été pris en compte par l’Union européenne, qui a mis en place de nouvelles règles de transparence par rapport à l’IA. D’ailleurs, c’est pour se conformer à ces règles qu’Anthropic, le développeur de Claude, a décidé d’appliquer un filigrane invisible sur les textes rédigés par ses futurs modèles d’IA.

Ce filigrane n’utilise pas de caractères cachés et ne change pas la qualité des contenus produits par Claude. Néanmoins, en jouant sur le choix de certains mots, la technologie peut générer un schéma que l’humain ne voit pas, mais qui pourra être détecté par des logiciels pour déterminer si un texte a été généré ou édité avec Claude.

Articles sauvegardés