The Prague Post - IA generativa recorre a livros para crescer

EUR -
AED 4.261414
AFN 74.847626
ALL 91.860932
AMD 420.621113
ANG 2.077506
AOA 1065.207702
ARS 1750.68835
AUD 1.617447
AWG 2.090092
AZN 1.977213
BAM 1.954969
BBD 2.333807
BDT 142.989188
BGN 1.956548
BHD 0.436914
BIF 3456.529963
BMD 1.160357
BND 1.469175
BOB 14.425865
BRL 5.942784
BSD 1.158707
BTN 110.658938
BWP 15.610361
BYN 3.519103
BYR 22742.987576
BZD 2.330409
CAD 1.608081
CDF 2676.942886
CHF 0.946838
CLF 0.027681
CLP 1093.009876
CNY 7.783962
CNH 7.782558
COP 3582.776272
CRC 521.978007
CUC 1.160357
CUP 30.749447
CVE 110.218125
CZK 24.254589
DJF 206.342244
DKK 7.477806
DOP 68.200995
DZD 154.700207
EGP 59.51249
ERN 17.405348
ETB 187.040853
FJD 2.582664
FKP 0.857755
GBP 0.857332
GEL 3.021407
GGP 0.857755
GHS 13.279352
GIP 0.857755
GMD 85.290672
GNF 10187.667261
GTQ 8.847237
GYD 242.426898
HKD 9.102537
HNL 31.099773
HRK 7.538725
HTG 151.445591
HUF 363.749008
IDR 20430.397054
ILS 3.517447
IMP 0.857755
INR 110.878451
IQD 1517.954425
IRR 1595026.057673
ISK 139.649353
JEP 0.857755
JMD 183.032158
JOD 0.822739
JPY 178.201797
KES 149.936233
KGS 101.473623
KHR 4699.00155
KMF 493.151923
KPW 1044.321264
KRW 1556.583891
KWD 0.357808
KYD 0.965589
KZT 522.867628
LAK 25924.974301
LBP 103764.469742
LKR 380.93799
LRD 202.194008
LSL 18.710243
LTL 3.426232
LVL 0.701889
LYD 7.328883
MAD 10.828095
MDL 20.08046
MGA 4987.878692
MKD 61.498845
MMK 2436.696433
MNT 4173.310084
MOP 9.359819
MRU 46.593184
MUR 54.502384
MVR 17.927947
MWK 2009.245483
MXN 19.691487
MYR 4.723004
MZN 74.158822
NAD 18.710243
NGN 1539.282968
NIO 42.641865
NOK 10.77786
NPR 177.0547
NZD 1.983685
OMR 0.44629
PAB 1.158707
PEN 3.896743
PGK 5.230775
PHP 72.715486
PKR 321.229583
PLN 4.324823
PYG 6862.081608
QAR 4.223804
RON 5.256187
RSD 117.280122
RUB 97.758424
RWF 1709.173101
SAR 4.358794
SBD 9.297943
SCR 15.981203
SDG 697.958705
SEK 11.251285
SGD 1.470524
SHP 0.858982
SLE 28.487183
SLL 24332.100067
SOS 662.218363
SRD 43.998983
STD 24017.036986
STN 24.489585
SVC 10.138688
SYP 15086.955721
SZL 18.713041
THB 38.344025
TJS 10.718242
TMT 4.072851
TND 3.381862
TOP 2.79386
TRY 55.932437
TTD 7.864655
TWD 36.71821
TZS 3070.594099
UAH 51.613749
UGX 4484.092949
USD 1.160357
UYU 46.640164
UZS 13626.204876
VES 964.775755
VND 30079.341604
VUV 137.28957
WST 3.174719
XAF 655.957
XAG 0.017994
XAU 0.000267
XCD 3.135922
XCG 2.088312
XDR 0.820432
XOF 655.957
XPF 119.331742
YER 275.062932
ZAR 18.706305
ZMK 10444.605168
ZMW 22.363489
ZWL 373.634322
SSP 6555.144452
MXV 2.233452
IA generativa recorre a livros para crescer
IA generativa recorre a livros para crescer / foto: Kirill Kudryavtsev - AFP

IA generativa recorre a livros para crescer

Para expandir o negócio dos direitos autorais, o mundo editorial começa a assinar contratos com empresas de tecnologia para permitir que os seus livros alimentem as necessidades crescentes da inteligência artificial generativa.

Tamanho do texto:

A grande editora americana HarperCollins acaba de propor a alguns dos seus autores um contrato com uma sociedade de inteligência artificial para que esta possa usar os seus livros para treinar o seu modelo de IA generativa.

Em um e-mail consultado pela AFP, a empresa tecnológica, cuja identidade é confidencial, propõe 2.500 dólares (14.530 reais) por cada livro selecionado para treinar o seu modelo de linguagem durante um período de três anos.

Para produzir todos os tipos de conteúdo, esta tecnologia precisa ser alimentada continuamente com uma grande quantidade de dados.

Contactada pela AFP, a editora confirmou a operação.

"A HarperCollins fechou um acordo com uma empresa de tecnologia de inteligência artificial para autorizar o uso limitado de determinados títulos (…) para treinar modelos de IA, a fim de melhorar sua qualidade e desempenho", escreveu.

A editora especificou que o acordo "limita claramente a produção de modelos que respeitem os direitos autorais".

A oferta gerou opiniões divergentes no setor e escritores como o americano Daniel Kibblesmith rejeitaram-na categoricamente.

"Provavelmente faria isso por um bilhão de dólares. Faria isso por uma quantia de dinheiro que não me obrigaria a trabalhar mais, porque esse é o objetivo final desta tecnologia", publicou na rede social Bluesky.

- Novos materiais -

A HarperCollins é um dos maiores atores do setor a dar esse passo, mas não o primeiro.

A editora americana de livros científicos Wiley deu acesso "ao conteúdo de livros acadêmicos e profissionais publicados para uso específico na formação desses modelos por 23 milhões de dólares (133 milhões de reais) a uma grande empresa de tecnologia", disse a companhia em março durante a apresentação de seus resultados financeiros.

Este tipo de colaboração evidencia os problemas ligados ao desenvolvimento da inteligência artificial generativa, treinada com enormes quantidades de dados recolhidos na Internet, o que pode resultar em possíveis violações de direitos autorais.

Para Giada Pistilli, chefe de ética da Hugging Face, plataforma franco-americana de IA de acesso livre, o anúncio é um avanço, porque o conteúdo dos livros passa a ser monetizado. Mas lamenta a margem de negociação limitada para os autores.

"O que veremos é um mecanismo de acordos bilaterais entre empresas de novas tecnologias e editoras ou proprietários de direitos autorais, quando na minha opinião seria necessário um diálogo mais amplo para incluir todas as partes envolvidas", afirma.

"Viemos de muito longe", comenta Julien Chouraqui, diretor jurídico do sindicato editorial francês SNE. "É um progresso: o fato de haver um acordo significa que houve um diálogo e uma vontade de alcançar um equilíbrio no uso de dados de origem que estão protegidos por direitos autorais e que vão gerar valor", afirma.

Os editores de imprensa também estão se organizando para enfrentar esse problema. No final de 2023, o jornal americano The New York Times processou a OpenAI, criadora do programa ChatGPT, e a Microsoft, sua principal investidora, por violação de direitos autorais.

Outros veículos de comunicação optaram por fechar acordos com esta empresa pioneira em IA.

As empresas de tecnologia podem não ter outra opção senão investir a fundo para melhorar os seus produtos, já que suas bases de dados e materiais para treinar os seus modelos estão esgotando.

A imprensa americana publicou recentemente que os novos modelos em desenvolvimento dão sinais de ter atingido o seu limite, especialmente no Google, Anthropic e OpenAI.

"Na Internet, você coleta material lícito e ilícito e muito conteúdo pirateado. Isso implica um problema jurídico. Sem esquecer o problema da qualidade dos dados", afirma Julien Chouraqui, do SNE.

"Para que o desenvolvimento de um mercado seja alcançado sobre uma base virtuosa, todos os atores devem estar envolvidos", destaca.

B.Hornik--TPP