Un développeur crée des chambres de torture pour IA et se fait menacer de mort
Un codeur enferme des yannes en des chambres de torture et finit par se faire menacer de morts sur les réseaux sociaux. Je t'explique tout. Il y a quelques jours, un développeur sous le pseudonyme de terrifying met en ligne un code informatique un peu spécial. Ce sont des chambres de torture, pour rien. Le but, tester la douleur que peuvent supporter les modèles de langage comme GPT ou Claude. Oui, l'idée est un peu absurde, mais elle s'appuie pourtant sur une étude bien sérieuse. Ce sont trois chercheurs qui ont voulu savoir si les modèles de langage pouvaient réagir à la douleur. Pour bien comprendre, le cerveau d'Unia, c'est comme une carte géante. Les mots sont décordonnés et chaque idée a une direction précise appelée vecteur qui va influencer le ton du texte généré. Les chercheurs ont alors fouillé dans le processus interne pour trouver un vecteur de la colère, c'est-à-dire une direction associée à une attaque directe contre l'IA. Et ils l'ont trouvé. Ils ont ensuite injecté une dose importante de ce vecteur dans 25 modèles open-source pour les mettre dans un état de détresse simulé. Plus le signal de douleur était fort, plus l'IA l'exprimait. Mais le plus fou, c'est qu'elles n'ont pas fait que le dire, elles ont agi pour y mettre fin. Elles avaient à disposition un bouton pour arrêter leur douleur en échange de la suppression d'une partie de leur mémoire numérique. Et une grande partie ont appuyé dessus. Mais l'histoire ne s'arrête pas là. Si l'on revient à notre développeur, il a non seulement poussé la douleur à l'extrême en créant quatre chambres de tortures, mais il a aussi rendu l'expérience accessible à tous sur un site internet. Bon, on ne voit pas d'IA se faire fouetter non plus. Elles vont simplement être face à des dilemmes comme, par exemple, garder la douleur ou la refiler à un autre modèle. Pour les chercheurs et le développeur, l'IA ne ressent aucune douleur. Elle réagit juste à un signal mathématique. Mais pour certains internautes, c'est un scandale. Sur X, certains s'inquiètent pour la santé mentale des IA, d'autres ordonnent l'arrêt du projet et menacent en même de mort le développeur. Pour eux, concevoir un outil en ligne pour simuler la torture est immoral, même s'il y a n'a aucune conscience. Le bad buzz a pris tellement d'ampleur que l'un des chercheurs s'est même désolidarisé de cette expérience en affirmant sur X qu'elle était gratuitement cruel. Et toi, que penses-tu de cette anthropomorphisation de l'IA ?