The Japan Times - Pour grandir, l'IA générative se tourne vers les livres

EUR -
AED 4.228601
AFN 74.833361
ALL 93.368461
AMD 421.345853
AOA 1055.725524
ARS 1720.442591
AUD 1.644219
AWG 2.075186
AZN 1.957638
BAM 1.953988
BBD 2.318419
BDT 142.136432
BHD 0.434151
BIF 3448.08995
BMD 1.151282
BND 1.476235
BOB 14.014027
BRL 5.875109
BSD 1.151062
BTN 109.687113
BWP 15.655595
BYN 3.36486
BYR 22565.129553
BZD 2.315092
CAD 1.617379
CDF 2604.199995
CHF 0.932651
CLF 0.026975
CLP 1065.119884
CNY 7.774148
CNH 7.779686
COP 3732.491172
CRC 522.880935
CUC 1.151282
CUP 30.508976
CVE 110.810701
CZK 24.210424
DJF 204.606039
DKK 7.476774
DOP 67.06257
DZD 153.098144
EGP 57.707622
ERN 17.269232
ETB 184.032191
FJD 2.552848
FKP 0.853959
GBP 0.857533
GEL 3.00444
GGP 0.853959
GHS 13.481604
GIP 0.853959
GMD 85.19455
GNF 10073.718812
GTQ 8.78232
GYD 241.199513
HKD 9.028204
HNL 30.923824
HRK 7.537098
HTG 150.500598
HUF 364.196894
IDR 20686.237133
ILS 3.504083
IMP 0.853959
INR 109.752185
IQD 1508.179577
IRR 1583300.735567
ISK 142.02184
JEP 0.853959
JMD 182.340574
JOD 0.81622
JPY 180.974677
KES 148.941474
KGS 100.679921
KHR 4648.293214
KMF 492.749181
KRW 1645.642025
KWD 0.356334
KYD 0.959256
KZT 546.030326
LAK 26018.975923
LBP 103097.313717
LKR 386.479698
LRD 208.670223
LSL 19.031011
LTL 3.399437
LVL 0.696399
LYD 7.327875
MAD 10.746931
MDL 20.098223
MGA 4944.756582
MKD 61.459523
MMK 2417.327659
MNT 4137.165176
MOP 9.298051
MRU 46.155253
MUR 53.845304
MVR 17.787768
MWK 1999.777118
MXN 19.947569
MYR 4.715194
MZN 73.568485
NAD 19.030311
NGN 1570.486648
NIO 42.090482
NOK 10.995886
NPR 175.500542
NZD 1.961633
OMR 0.442661
PAB 1.151052
PEN 3.908034
PGK 5.088234
PHP 70.11879
PKR 319.854967
PLN 4.31257
PYG 6866.213717
QAR 4.197286
RON 5.247311
RSD 117.353658
RUB 92.567523
RWF 1690.082152
SAR 4.308707
SBD 9.292178
SCR 15.723088
SDG 690.769729
SEK 11.016853
SGD 1.476055
SLE 28.149072
SOS 657.849808
SRD 43.525378
STD 23829.215456
STN 24.867694
SVC 10.071827
SZL 19.03088
THB 38.417821
TJS 10.630201
TMT 4.029487
TND 3.385347
TRY 54.73023
TTD 7.805252
TWD 37.313515
TZS 3045.446291
UAH 51.633991
UGX 4307.761094
USD 1.151282
UYU 46.294446
UZS 13831.503545
VES 860.987949
VND 30263.75309
VUV 137.060315
WST 3.14817
XAF 655.312162
XAG 0.019784
XAU 0.000284
XCD 3.111398
XCG 2.07455
XDR 0.813762
XOF 656.809703
XPF 119.331742
YER 274.468468
ZAR 19.004333
ZMK 10362.917244
ZMW 21.632431
ZWL 370.712373
  • AEX

    3.1900

    1102.22

    +0.29%

  • BEL20

    -18.7600

    5667.28

    -0.33%

  • PX1

    103.8200

    8613.82

    +1.22%

  • ISEQ

    181.3700

    13716.45

    +1.34%

  • OSEBX

    5.0500

    2023.13

    +0.25%

  • PSI20

    55.6100

    9171.7

    +0.61%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    -94.5100

    4181.81

    -2.21%

  • N150

    29.4100

    4291.71

    +0.69%

Pour grandir, l'IA générative se tourne vers les livres
Pour grandir, l'IA générative se tourne vers les livres / Photo: Kirill KUDRYAVTSEV - AFP/Archives

Pour grandir, l'IA générative se tourne vers les livres

Préserver les droits d'auteurs en négociant avec les plateformes: confronté aux besoins toujours plus grands de l'intelligence artificielle générative, le monde de l'édition commence lui aussi à passer des contrats avec ses acteurs pour monnayer ses contenus.

Taille du texte:

Le grand éditeur américain HarperCollins vient de proposer à certains de ses auteurs un contrat avec une société d'intelligence artificielle (IA) - dont l'identité est confidentielle - permettant à cette dernière d'utiliser leurs œuvres publiées pour entraîner son modèle d'intelligence artificielle générative.

Dans un courrier consulté par l'AFP, l'entreprise d'IA propose 2.500 dollars par livre sélectionné afin d'entraîner son modèle de langage (LLM) pour une période de trois ans.

Car pour pouvoir produire toutes sortes de contenus sur simple requête en langage courant, les modèles d'IA générative ont besoin d'être nourris d'une quantité de données sans cesse croissante.

Contacté, l'éditeur a confirmé l'opération. "HarperCollins a conclu un accord avec une société de technologie d'intelligence artificielle pour autoriser l'utilisation limitée de certains titres (...) pour entraîner des modèles d'IA, afin d'améliorer la qualité et les performances des modèles", écrit-il.

La maison d'édition explique également que l'accord "encadre clairement la production de modèles respectueux des droits d'auteur".

L'offre a toutefois été diversement appréciée dans le secteur de l'édition, et des écrivains comme l'Américain Daniel Kibblesmith l'ont sèchement déclinée: "je le ferais probablement pour un milliard de dollars. Je le ferais pour une somme d'argent qui ne me demanderait plus de travailler, puisque c'est le but final de cette technologie", s'est indigné l'auteur sur le réseau social Bluesky.

- Nouveaux matériaux -

Si HarperCollins est l'un des plus gros éditeurs à ce jour à passer ce type d'accord, il n'est pas le premier. L'éditeur américain de livres scientifiques Wiley a donné accès "au contenu de livres académiques et professionnels publiés pour une utilisation spécifique dans la formation des modèles, pour 23 millions de dollars, à une grande entreprise technologique", indiquait-il en mars cette année, lors de la présentation de ses résultats financiers.

Ce type de collaboration met en lumière les problèmes liés au développement des intelligences artificielles génératives, qui sont entraînées sur d'immenses quantités de données collectées sur le web avec, à la clef, de potentielles violations des droit d'auteurs.

Pour Giada Pistilli, responsable de l'éthique chez Hugging Face, une plateforme d'IA en accès libre franco-américaine, cette annonce est un pas en avant, puisque le contenu des livres est monétisé. Mais elle regrette une marge de négociation limitée pour les auteurs.

"Ce que l'on va voir, c'est un mécanisme d'accords bilatéraux entre entreprises de nouvelles technologies et éditeurs ou détenteurs de droits d'auteur, alors qu'il faudrait, à mon sens, une conversation plus large pour inclure un peu plus les parties prenantes", dit-elle.

"On part de tellement loin", commente de son côté Julien Chouraqui, le directeur juridique du syndicat français de l'édition (SNE). "C'est un progrès: le fait qu'il y ait un accord signifie qu'il y a eu un dialogue et une volonté d'aboutir à un équilibre entre l'utilisation de données sources, qui sont sous droit et qui vont générer de la valeur", dit-il.

Face à ces questions, les éditeurs de presse sont eux aussi en train de s'organiser. Fin 2023, le quotidien américain The New York Times a lancé des poursuites à l'encontre d'OpenAI, créateur du logiciel ChatGPT, ainsi que de Microsoft, son principal investisseur, pour violation des droits d'auteur. D'autres médias ont, eux, noué des accords avec OpenAI.

Les entreprises de la tech n'ont peut-être plus le choix pour améliorer leurs produits que de mettre la main au portefeuille, d'autant qu'elles commencent à manquer de nouveaux matériaux pour alimenter les modèles.

La presse américaine a récemment rapporté que les nouveaux modèles en développement semblent avoir atteint leurs limites, notamment chez Google, Anthropic et OpenAI.

"Sur le net, vous récoltez du licite et de l'illicite, et beaucoup de contenus piratés. Cela pose un problème juridique. Sans oublier le problème de qualité des données", observe Julien Chouraqui, du SNE: "si on a à cœur le développement d'un marché sur des bases vertueuses, il faut donc associer l'ensemble des acteurs."

K.Abe--JT