Intelligence Artificielle

L’IA de Meta accusée d’addiction au contenu adulte : Mark Zuckerberg défend son usage personnel et crée le débat

Mamadou Sow Par Mamadou Sow
4 min de lecture
L’IA de Meta accusée d’addiction au contenu adulte : Mark Zuckerberg défend son usage personnel et crée le débat
Illustration de l'accusation de Meta d'utiliser des contenus pornographiques pour entraîner son intelligence artificielle.
EN BREF
  • Meta accusée d’entraîner son IA avec des contenus pornographiques pour améliorer la précision.
  • Meta réfute les accusations, affirmant qu’il s’agit de comportements individuels et non d’un plan coordonné.
  • La question des adresses IP cachées soulève des doutes sur les pratiques internes de Meta.
  • Le débat sur la transparence des données utilisées pour l’entraînement des IA est relancé.

Meta, le géant technologique de Menlo Park, fait face à des accusations surprenantes de la part d’un studio de films pour adultes. Selon Strike 3 Holdings, Meta aurait téléchargé des milliers de vidéos pornographiques pour entraîner une intelligence artificielle (IA) interne, baptisée « Movie Gen ». Cette IA serait capable de générer des séquences vidéo réalistes à partir de texte. Meta nie ces allégations, les attribuant à des comportements individuels de certains employés. Cette affaire soulève des questions sur l’utilisation des contenus protégés pour l’entraînement des IA et sur la transparence des données utilisées dans ces processus.

L’importance des contenus explicites pour l’entraînement des IA

Les modèles d’IA vidéo, comme ceux développés par Meta et OpenAI, nécessitent une immense quantité de données pour apprendre à reproduire des mouvements humains réalistes. Les contenus explicites sont souvent riches en détails tels que les postures corporelles et les interactions physiques, ce qui les rend particulièrement intéressants pour l’entraînement des IA. Ainsi, certaines entreprises pourraient être tentées d’utiliser ces contenus pour améliorer la fluidité et la précision de leurs modèles. Cependant, cette approche soulève des questions éthiques et légales quant à l’utilisation de contenus protégés par le droit d’auteur sans consentement explicite.

« Plus de porno = meilleure compréhension visuelle », une équation simple mais controversée selon Strike 3.

« Les IA parlent entre elles dans un langage sonore incompréhensible » : le mystère grandit autour du code “Gibberlink”

La défense de Meta face aux accusations

Meta a rapidement réagi aux accusations en déposant une requête de rejet de la plainte, qualifiant celle-ci d’absurde et sans fondement. Selon la firme, les téléchargements incriminés remontent à une période antérieure aux recherches sur les modèles vidéo, et il s’agirait de comportements individuels de certains employés, non coordonnés et sans lien avec un projet d’IA. De plus, Meta affirme que ses conditions d’utilisation interdisent explicitement la production de contenu sexuel, rendant peu probable l’intégration délibérée de pornographie dans ses IA.

« Quelques dizaines de films par an, épars, sans coordination: tout indique des usages personnels, pas un entraînement d’IA ».

« L’Australie secouée par un scandale d’État » : un rapport de 250 000 dollars rédigé par l’IA fait exploser la polémique

La question des IP cachées et des pratiques internes

Un des points centraux de l’accusation concerne l’utilisation supposée d’un réseau de 2 500 adresses IP cachées par Meta pour télécharger des contenus protégés. Meta argumente que la présence de 47 adresses IP publiques impliquées dans ces téléchargements rend peu crédible l’hypothèse d’une tentative de dissimulation. L’entreprise souligne que des milliers de connexions transitent chaque jour par ses infrastructures, impliquant des employés, des sous-traitants, et même des visiteurs. Ainsi, une adresse IP liée à Meta ne prouve pas nécessairement l’implication directe d’un salarié.

Un débat plus large sur la transparence des datasets d’IA

Au-delà de l’anecdote, cette affaire met en lumière un problème plus vaste : le manque de transparence concernant les données utilisées pour entraîner les modèles d’IA. Depuis plusieurs années, les entreprises utilisant des modèles génératifs sont critiquées pour leur recours à des contenus protégés sans consentement. Bien que les grandes entreprises comme Meta, OpenAI, ou Google prétendent filtrer les contenus inappropriés, il est notoire que les datasets publics en contiennent souvent. Cette situation soulève des questions cruciales sur la responsabilité des entreprises et des ingénieurs face aux contenus utilisés pour l’entraînement des IA.

« Le cerveau numérique géant de Microsoft » : une infrastructure secrète dévoilée pour propulser l’IA à un niveau inédit

« Le porno, jusqu’ici, restait un tabou : personne n’en parle, tout le monde sait qu’il circule. »

Alors que l’affaire entre Meta et Strike 3 Holdings n’a pas encore trouvé son dénouement, elle soulève des questions importantes pour l’avenir de l’intelligence artificielle. La transparence des données et le respect des droits d’auteur deviennent des enjeux majeurs dans le développement de technologies de plus en plus sophistiquées. Comment les entreprises peuvent-elles garantir un entraînement éthique de leurs IA tout en respectant les lois sur les droits d’auteur ? Et quel rôle les régulateurs doivent-ils jouer pour encadrer ces pratiques ?

Cet article s’appuie sur des sources vérifiées et l’assistance de technologies éditoriales.
Mamadou Sow

Informatique, logiciels et infrastructures

Mamadou Sow

Mamadou Sow a commencé comme technicien réseau dans une entreprise de services numériques, avant de se spécialiser dans les tests d'intrusion. Il écrit pour EDS.fr sur la cybersécurité, les fuites de données et la transformation numérique des organisations. Il entraîne une équipe de football de jeunes à Montreuil.