-
Tennis de table: Félix Lebrun devient le premier Français vainqueur d'un Grand Smash
-
La Belgique mobilisée face à un feu historique qui se rapproche de l'Allemagne
-
Dix-neuf morts dans des frappes en Russie et en Ukraine
-
Euro de natation: Léon Marchand sacré champion d'Europe du 400 m nage libre
-
Lula et Flavio Bolsonaro partent à la conquête du vote des femmes au Brésil
-
Community Shield: Arsenal se balade face à Manchester City version Maresca
-
Piratage du fisc : Lecornu s'empare du dossier face à l'ampleur de l'incident
-
Seize morts dans des frappes en Russie et en Ukraine
-
Quinze morts dans des frappes en Russie et en Ukraine
-
Réseaux sociaux : Attal alimente le débat sur le référendum
-
Séisme : la Colombie poursuit les recherches sans trop d'espoir
-
La Belgique mobilisée face à un incendie historique
-
L'ouragan Lala s'éloigne d'Hawaï
-
Hongrie: 12 morts et 10 blessés dans l'accident d'un car immatriculé en Pologne
-
Douze morts dans des frappes en Russie et en Ukraine
-
Moscou visée par 600 drones, Kiev par des missiles balistiques
-
Hongrie: 12 morts et 10 blessés dans l'accident d'un bus immatriculé en Pologne
-
Lula et Flavio Bolsonaro lancent leurs campagnes dans un Brésil polarisé
-
Andy Burnham, un "Premier ministre TikTok" qui snobe les médias traditionnels
-
Japon: les lunes de Mars en ligne de mire
-
Face à un des pires incendies de son histoire, la Belgique compte sur du soutien aérien
-
Indonésie: des milliers d'évacués en attente d'aide après le puissant séisme
-
Automobile : de la Kadett à Leapmotor, le long déclin d'Opel à Rüsselsheim
-
Dans la vallée du Rhin, le Riesling à l'épreuve du climat
-
L'ouragan Lala frôle la Grande Île d'Hawaï, fortes pluies
-
Incendies: "la situation évolue plutôt favorablement" dans les Landes
-
Trophée des champions: déjà un deuxième titre en jeu pour le PSG
-
Cyclisme: le biathlète Emilien Jacquelin entre "trac" et "excitation" pour ses débuts pros
-
Euro de natation: Marchand à l'assaut d'un nouveau terrain avec le 400 m nage libre
-
Colombie : une femme meurt pour sauver son chien du tremblement de terre
-
Séisme en Indonésie: la fuite en panique d'un hôpital pour "une nouvelle chance de vivre"
-
L'ouragan Lala provoque de fortes pluies et des coupures de courant à Hawaï
-
Athlétisme: Gressier ouvre enfin son compteur européen avec le bronze du 10.000 m
-
Euro de natation: une soirée dorée pour Léon Marchand et Mary-Ambre Moluh
-
Tennis: Djokovic battu dès son premier match au Masters 1000 de Cincinnati
-
Foot: Le Paris SG recrute l'ailier belge Mika Godts
-
La Belgique se bat contre un des pires incendies de son histoire
Pour grandir, l'IA générative se tourne vers les livres
Préserver les droits d'auteurs en négociant avec les plateformes: confronté aux besoins toujours plus grands de l'intelligence artificielle générative, le monde de l'édition commence lui aussi à passer des contrats avec ses acteurs pour monnayer ses contenus.
Le grand éditeur américain HarperCollins vient de proposer à certains de ses auteurs un contrat avec une société d'intelligence artificielle (IA) - dont l'identité est confidentielle - permettant à cette dernière d'utiliser leurs œuvres publiées pour entraîner son modèle d'intelligence artificielle générative.
Dans un courrier consulté par l'AFP, l'entreprise d'IA propose 2.500 dollars par livre sélectionné afin d'entraîner son modèle de langage (LLM) pour une période de trois ans.
Car pour pouvoir produire toutes sortes de contenus sur simple requête en langage courant, les modèles d'IA générative ont besoin d'être nourris d'une quantité de données sans cesse croissante.
Contacté, l'éditeur a confirmé l'opération. "HarperCollins a conclu un accord avec une société de technologie d'intelligence artificielle pour autoriser l'utilisation limitée de certains titres (...) pour entraîner des modèles d'IA, afin d'améliorer la qualité et les performances des modèles", écrit-il.
La maison d'édition explique également que l'accord "encadre clairement la production de modèles respectueux des droits d'auteur".
L'offre a toutefois été diversement appréciée dans le secteur de l'édition, et des écrivains comme l'Américain Daniel Kibblesmith l'ont sèchement déclinée: "je le ferais probablement pour un milliard de dollars. Je le ferais pour une somme d'argent qui ne me demanderait plus de travailler, puisque c'est le but final de cette technologie", s'est indigné l'auteur sur le réseau social Bluesky.
- Nouveaux matériaux -
Si HarperCollins est l'un des plus gros éditeurs à ce jour à passer ce type d'accord, il n'est pas le premier. L'éditeur américain de livres scientifiques Wiley a donné accès "au contenu de livres académiques et professionnels publiés pour une utilisation spécifique dans la formation des modèles, pour 23 millions de dollars, à une grande entreprise technologique", indiquait-il en mars cette année, lors de la présentation de ses résultats financiers.
Ce type de collaboration met en lumière les problèmes liés au développement des intelligences artificielles génératives, qui sont entraînées sur d'immenses quantités de données collectées sur le web avec, à la clef, de potentielles violations des droit d'auteurs.
Pour Giada Pistilli, responsable de l'éthique chez Hugging Face, une plateforme d'IA en accès libre franco-américaine, cette annonce est un pas en avant, puisque le contenu des livres est monétisé. Mais elle regrette une marge de négociation limitée pour les auteurs.
"Ce que l'on va voir, c'est un mécanisme d'accords bilatéraux entre entreprises de nouvelles technologies et éditeurs ou détenteurs de droits d'auteur, alors qu'il faudrait, à mon sens, une conversation plus large pour inclure un peu plus les parties prenantes", dit-elle.
"On part de tellement loin", commente de son côté Julien Chouraqui, le directeur juridique du syndicat français de l'édition (SNE). "C'est un progrès: le fait qu'il y ait un accord signifie qu'il y a eu un dialogue et une volonté d'aboutir à un équilibre entre l'utilisation de données sources, qui sont sous droit et qui vont générer de la valeur", dit-il.
Face à ces questions, les éditeurs de presse sont eux aussi en train de s'organiser. Fin 2023, le quotidien américain The New York Times a lancé des poursuites à l'encontre d'OpenAI, créateur du logiciel ChatGPT, ainsi que de Microsoft, son principal investisseur, pour violation des droits d'auteur. D'autres médias ont, eux, noué des accords avec OpenAI.
Les entreprises de la tech n'ont peut-être plus le choix pour améliorer leurs produits que de mettre la main au portefeuille, d'autant qu'elles commencent à manquer de nouveaux matériaux pour alimenter les modèles.
La presse américaine a récemment rapporté que les nouveaux modèles en développement semblent avoir atteint leurs limites, notamment chez Google, Anthropic et OpenAI.
"Sur le net, vous récoltez du licite et de l'illicite, et beaucoup de contenus piratés. Cela pose un problème juridique. Sans oublier le problème de qualité des données", observe Julien Chouraqui, du SNE: "si on a à cœur le développement d'un marché sur des bases vertueuses, il faut donc associer l'ensemble des acteurs."
E.Schubert--BTB