lama1
Meta admet avoir intégré le jeu de données Book3 au jeu d’entraînement de son grand modèle de langage Llama.
Si un journaliste de The Atlantic l’avait déjà démontré, TorrentFreak a repéré la confirmation apportée par l’entreprise elle-même dans les documents soumis à la justice américaine dans le cadre de la plainte qui oppose plusieurs artistes (un groupe différent de ceux qui ont attaqué OpenAI, Stable Diffusion, Midjourney et DeviantArt) aux géants numériques.
En effet, Book3 a été construite en 2020 par le chercheur en IA Shawn Presser, à partir d’un scrap de la bibliothèque « pirate » Bibliotik. La base de données a longtemps été laissé en libre accès dans l’idée qu’elle permettrait aux plus enthousiastes de créer de meilleurs modèles d’IA.
Quelques années plus tard, alors que de nombreuses entreprises privées s’activent dans le domaine de l’IA générative, l’intégration de ce jeu de données à l’entraînement de leurs machines fait émerger des problématiques de droits d’auteur proches de celles constatées du côté des modèles de génération d’images Midjourney, Dall-E et autre.
L'IA : opportunité ou menace ? Les DSI de la finance s'interrogent Alors que l'intelligence…
Sécurité des identités : un pilier essentiel pour la conformité au règlement DORA dans le…
La transformation numérique du secteur financier n'a pas que du bon : elle augmente aussi…
Telegram envisage de quitter la France : le chiffrement de bout en bout au cœur…
L'intelligence artificielle (IA) révolutionne le paysage de la cybersécurité, mais pas toujours dans le bon…
TISAX® et ISO 27001 sont toutes deux des normes dédiées à la sécurité de l’information. Bien qu’elles aient…
This website uses cookies.