Dubai Telegraph - Pour grandir, l'IA générative se tourne vers les livres

EUR -
AED 4.215393
AFN 74.598916
ALL 91.730818
AMD 417.168467
ANG 2.054749
AOA 1052.414027
ARS 1732.985425
AUD 1.61371
AWG 2.068676
AZN 1.957511
BAM 1.956491
BBD 2.312677
BDT 141.009831
BGN 1.932036
BHD 0.432853
BIF 3454.46055
BMD 1.147671
BND 1.465092
BOB 11.682925
BRL 5.910163
BSD 1.148186
BTN 110.097907
BWP 15.571231
BYN 3.490573
BYR 22494.343129
BZD 2.309396
CAD 1.605276
CDF 2651.118975
CHF 0.946645
CLF 0.02784
CLP 1099.227676
CNY 7.696736
CNH 7.694052
COP 3641.868583
CRC 513.672572
CUC 1.147671
CUP 30.41327
CVE 110.302057
CZK 24.32262
DJF 203.964245
DKK 7.475605
DOP 68.01196
DZD 153.505082
EGP 59.761474
ERN 17.215059
ETB 187.555811
FJD 2.571643
FKP 0.853497
GBP 0.859443
GEL 2.989713
GGP 0.853497
GHS 13.21644
GIP 0.853497
GMD 84.927252
GNF 10094.567253
GTQ 8.761096
GYD 240.190694
HKD 9.004741
HNL 30.818891
HRK 7.534683
HTG 150.068455
HUF 362.847333
IDR 20374.59559
ILS 3.481901
IMP 0.853497
INR 109.967158
IQD 1504.179127
IRR 1577559.270208
ISK 139.395902
JEP 0.853497
JMD 181.200876
JOD 0.81372
JPY 179.04981
KES 148.692067
KGS 100.36376
KHR 4676.571126
KMF 491.202422
KPW 1032.903876
KRW 1585.547024
KWD 0.354054
KYD 0.956921
KZT 511.490752
LAK 25717.86418
LBP 102824.544611
LKR 380.844584
LRD 199.214324
LSL 18.70551
LTL 3.388773
LVL 0.694214
LYD 7.293577
MAD 10.937174
MDL 20.157772
MGA 4986.718773
MKD 61.541748
MMK 2409.72351
MNT 4128.00026
MOP 9.278696
MRU 45.999255
MUR 54.698168
MVR 17.68535
MWK 1991.068913
MXN 19.728996
MYR 4.703496
MZN 73.340629
NAD 18.70551
NGN 1527.032739
NIO 42.254932
NOK 10.815033
NPR 176.15318
NZD 2.001868
OMR 0.441282
PAB 1.148196
PEN 3.87647
PGK 5.108716
PHP 72.035261
PKR 318.267771
PLN 4.357028
PYG 6792.400322
QAR 4.185579
RON 5.262033
RSD 117.348156
RUB 96.977778
RWF 1694.269201
SAR 4.261919
SBD 9.181952
SCR 16.307434
SDG 690.290457
SEK 11.273998
SGD 1.464348
SHP 0.85727
SLE 28.278783
SLL 24066.068653
SOS 656.220462
SRD 43.320546
STD 23754.463616
STN 24.508234
SVC 10.047375
SYP 14922.013014
SZL 18.698282
THB 38.214014
TJS 10.592459
TMT 4.016847
TND 3.377794
TOP 2.763315
TRY 55.861146
TTD 7.795619
TWD 36.604983
TZS 3045.261184
UAH 51.310638
UGX 4512.594676
USD 1.147671
UYU 46.16551
UZS 13520.778019
VES 970.303763
VND 29853.20681
VUV 135.777557
WST 3.147961
XAF 655.957
XAG 0.0175
XAU 0.000263
XCD 3.101637
XCG 2.069431
XDR 0.811463
XOF 655.957
XPF 119.331742
YER 271.596073
ZAR 18.673094
ZMK 10330.415703
ZMW 22.534571
ZWL 369.549455
SSP 6493.721767
MXV 2.236858
  • AEX

    4.7100

    1100.8

    +0.43%

  • BEL20

    43.5800

    5777.27

    +0.76%

  • PX1

    46.4000

    8186.93

    +0.57%

  • ISEQ

    -14.3400

    14326.14

    -0.1%

  • OSEBX

    13.1600

    2136.55

    +0.62%

  • PSI20

    130.7000

    9671.11

    +1.37%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    111.0800

    4663.37

    +2.44%

  • N150

    24.3700

    4298.99

    +0.57%

Pour grandir, l'IA générative se tourne vers les livres
Pour grandir, l'IA générative se tourne vers les livres / Photo: Kirill KUDRYAVTSEV - AFP/Archives

Pour grandir, l'IA générative se tourne vers les livres

Préserver les droits d'auteurs en négociant avec les plateformes: confronté aux besoins toujours plus grands de l'intelligence artificielle générative, le monde de l'édition commence lui aussi à passer des contrats avec ses acteurs pour monnayer ses contenus.

Taille du texte:

Le grand éditeur américain HarperCollins vient de proposer à certains de ses auteurs un contrat avec une société d'intelligence artificielle (IA) - dont l'identité est confidentielle - permettant à cette dernière d'utiliser leurs œuvres publiées pour entraîner son modèle d'intelligence artificielle générative.

Dans un courrier consulté par l'AFP, l'entreprise d'IA propose 2.500 dollars par livre sélectionné afin d'entraîner son modèle de langage (LLM) pour une période de trois ans.

Car pour pouvoir produire toutes sortes de contenus sur simple requête en langage courant, les modèles d'IA générative ont besoin d'être nourris d'une quantité de données sans cesse croissante.

Contacté, l'éditeur a confirmé l'opération. "HarperCollins a conclu un accord avec une société de technologie d'intelligence artificielle pour autoriser l'utilisation limitée de certains titres (...) pour entraîner des modèles d'IA, afin d'améliorer la qualité et les performances des modèles", écrit-il.

La maison d'édition explique également que l'accord "encadre clairement la production de modèles respectueux des droits d'auteur".

L'offre a toutefois été diversement appréciée dans le secteur de l'édition, et des écrivains comme l'Américain Daniel Kibblesmith l'ont sèchement déclinée: "je le ferais probablement pour un milliard de dollars. Je le ferais pour une somme d'argent qui ne me demanderait plus de travailler, puisque c'est le but final de cette technologie", s'est indigné l'auteur sur le réseau social Bluesky.

- Nouveaux matériaux -

Si HarperCollins est l'un des plus gros éditeurs à ce jour à passer ce type d'accord, il n'est pas le premier. L'éditeur américain de livres scientifiques Wiley a donné accès "au contenu de livres académiques et professionnels publiés pour une utilisation spécifique dans la formation des modèles, pour 23 millions de dollars, à une grande entreprise technologique", indiquait-il en mars cette année, lors de la présentation de ses résultats financiers.

Ce type de collaboration met en lumière les problèmes liés au développement des intelligences artificielles génératives, qui sont entraînées sur d'immenses quantités de données collectées sur le web avec, à la clef, de potentielles violations des droit d'auteurs.

Pour Giada Pistilli, responsable de l'éthique chez Hugging Face, une plateforme d'IA en accès libre franco-américaine, cette annonce est un pas en avant, puisque le contenu des livres est monétisé. Mais elle regrette une marge de négociation limitée pour les auteurs.

"Ce que l'on va voir, c'est un mécanisme d'accords bilatéraux entre entreprises de nouvelles technologies et éditeurs ou détenteurs de droits d'auteur, alors qu'il faudrait, à mon sens, une conversation plus large pour inclure un peu plus les parties prenantes", dit-elle.

"On part de tellement loin", commente de son côté Julien Chouraqui, le directeur juridique du syndicat français de l'édition (SNE). "C'est un progrès: le fait qu'il y ait un accord signifie qu'il y a eu un dialogue et une volonté d'aboutir à un équilibre entre l'utilisation de données sources, qui sont sous droit et qui vont générer de la valeur", dit-il.

Face à ces questions, les éditeurs de presse sont eux aussi en train de s'organiser. Fin 2023, le quotidien américain The New York Times a lancé des poursuites à l'encontre d'OpenAI, créateur du logiciel ChatGPT, ainsi que de Microsoft, son principal investisseur, pour violation des droits d'auteur. D'autres médias ont, eux, noué des accords avec OpenAI.

Les entreprises de la tech n'ont peut-être plus le choix pour améliorer leurs produits que de mettre la main au portefeuille, d'autant qu'elles commencent à manquer de nouveaux matériaux pour alimenter les modèles.

La presse américaine a récemment rapporté que les nouveaux modèles en développement semblent avoir atteint leurs limites, notamment chez Google, Anthropic et OpenAI.

"Sur le net, vous récoltez du licite et de l'illicite, et beaucoup de contenus piratés. Cela pose un problème juridique. Sans oublier le problème de qualité des données", observe Julien Chouraqui, du SNE: "si on a à cœur le développement d'un marché sur des bases vertueuses, il faut donc associer l'ensemble des acteurs."

A.El-Nayady--DT