The Prague Post - Un pas de plus dans l'interprétation du génome grâce à l'IA

EUR -
AED 4.284055
AFN 76.990671
ALL 93.078883
AMD 425.733944
ANG 2.087821
AOA 1069.700581
ARS 1746.739083
AUD 1.637787
AWG 2.099739
AZN 1.987822
BAM 1.965914
BBD 2.349739
BDT 142.563477
BGN 1.978848
BHD 0.439954
BIF 3487.095973
BMD 1.166522
BND 1.489162
BOB 13.480065
BRL 6.032785
BSD 1.166677
BTN 111.655063
BWP 15.757069
BYN 3.548557
BYR 22863.824435
BZD 2.346321
CAD 1.611375
CDF 2648.004322
CHF 0.934197
CLF 0.027316
CLP 1075.148386
CNY 7.866204
CNH 7.851583
COP 3597.401136
CRC 522.074842
CUC 1.166522
CUP 30.912824
CVE 110.833805
CZK 24.159858
DJF 207.744375
DKK 7.4757
DOP 68.542646
DZD 154.725143
EGP 59.075808
ERN 17.497825
ETB 190.561941
FJD 2.5667
FKP 0.861354
GBP 0.857061
GEL 3.038825
GGP 0.861354
GHS 12.978495
GIP 0.861354
GMD 86.322654
GNF 10250.606691
GTQ 8.902612
GYD 244.080543
HKD 9.146183
HNL 31.281269
HRK 7.535266
HTG 152.595089
HUF 363.611795
IDR 20767.585021
ILS 3.472794
IMP 0.861354
INR 111.470769
IQD 1528.363299
IRR 1603471.503919
ISK 142.186362
JEP 0.861354
JMD 184.348457
JOD 0.827037
JPY 184.775886
KES 151.062701
KGS 102.012671
KHR 4717.269953
KMF 496.938372
KPW 1049.869832
KRW 1619.242909
KWD 0.359685
KYD 0.972202
KZT 538.890999
LAK 26273.612428
LBP 104472.56349
LKR 386.106485
LRD 211.749433
LSL 18.954815
LTL 3.444436
LVL 0.705617
LYD 7.425106
MAD 10.817416
MDL 20.119513
MGA 5027.759645
MKD 61.848204
MMK 2448.815867
MNT 4196.154406
MOP 9.422256
MRU 46.676145
MUR 54.802967
MVR 18.034072
MWK 2022.964627
MXN 19.782096
MYR 4.734796
MZN 74.546501
NAD 18.954815
NGN 1575.527046
NIO 42.929951
NOK 10.887351
NPR 178.65215
NZD 1.967234
OMR 0.448537
PAB 1.166677
PEN 3.928628
PGK 5.16752
PHP 72.003535
PKR 323.778714
PLN 4.316049
PYG 7018.107567
QAR 4.253383
RON 5.246084
RSD 117.32988
RUB 98.481949
RWF 1719.044337
SAR 4.381688
SBD 9.362283
SCR 16.151138
SDG 701.664827
SEK 11.020148
SGD 1.483611
SHP 0.864236
SLE 28.754932
SLL 24461.374939
SOS 666.721653
SRD 44.026889
STD 24144.643057
STN 24.626172
SVC 10.20839
SYP 15167.114447
SZL 18.960305
THB 38.355546
TJS 10.76224
TMT 4.082826
TND 3.409743
TOP 2.808704
TRY 55.920133
TTD 7.913545
TWD 37.179146
TZS 3088.629706
UAH 52.1624
UGX 4351.293783
USD 1.166522
UYU 46.760579
UZS 13766.829167
VES 900.061104
VND 30540.120184
VUV 137.900924
WST 3.168153
XAF 659.349296
XAG 0.01776
XAU 0.00026
XCD 3.152583
XCG 2.102591
XDR 0.824791
XOF 659.340774
XPF 119.331742
YER 276.588204
ZAR 18.777386
ZMK 10500.131025
ZMW 21.844922
ZWL 375.619497
  • AEX

    -4.8700

    1102.43

    -0.44%

  • BEL20

    -10.9400

    5747.89

    -0.19%

  • PX1

    -7.6600

    8501.91

    -0.09%

  • ISEQ

    -109.8700

    13976.27

    -0.78%

  • OSEBX

    -0.8300

    2080.67

    -0.04%

  • PSI20

    -66.0700

    9238.9

    -0.71%

  • ENTEC

    -5.8300

    1416.23

    -0.41%

  • BIOTK

    63.9400

    4835.92

    +1.34%

  • N150

    0.0000

    4299.81

    0%

Un pas de plus dans l'interprétation du génome grâce à l'IA
Un pas de plus dans l'interprétation du génome grâce à l'IA / Photo: HO - AFP/Archives

Un pas de plus dans l'interprétation du génome grâce à l'IA

AlphaGenome, outil d'intelligence artificielle (IA) de Google rendu public mercredi, fait un pas de plus dans la compréhension du génome, en analysant comment des portions de l'ADN régulent l'activité des gènes dans la cellule.

Taille du texte:

Le déchiffrage de l'ensemble du génome humain en 2003, "nous a donné le livre de la vie, mais le lire reste un défi", a rappelé Pushmeet Kohli, vice-président de la recherche chez Google DeepMind, à l'occasion de la présentation d'AlphaGenome dans la revue Nature.

"Nous avons le texte" - la succession de 3 milliards de paires de nucléotides A, T, C et G qui composent l'ADN -, mais "comprendre la grammaire (...) et la manière dont cela gouverne la vie constitue la prochaine frontière majeure de la recherche", a-t-il souligné devant la presse.

Seules 2% des séquences d'ADN "codent" directement des protéines, indispensables au fonctionnement des organismes vivants.

Les 98% restants ont un rôle de "chef d'orchestre": elles coordonnent, protègent et régulent l'expression de l'information génétique dans chacune de nos cellules. Ces séquences, appelées "non codantes", contiennent de nombreux variants associés à des maladies.

Ce sont elles qu'étudie AlphaGenome, venant compléter les autres modèles développés par le laboratoire d'IA de Google: AlphaMissense (analyse des séquences codantes de l'ADN), AlphaProteo (conception de protéines) et AlphaFold (prédiction de la structure de protéines, prix Nobel de chimie en 2024).

Le modèle d'apprentissage profond (dans lequel un réseau de neurones apprend à reconnaître automatiquement des motifs complexes) a été entraîné avec des données provenant de grands consortiums publics, qui ont mesuré expérimentalement ces propriétés dans des centaines de types de cellules et de tissus chez l'homme et la souris.

Il est capable d'analyser une longue séquence d'ADN et de "prédire" l'influence de chaque paire de nucléotides sur différents processus biologiques dans la cellule: activer ou réprimer l'expression d'un gène, piloter l'assemblage de l'ARN (une "copie" de l'ADN qui transmet l'information génétique dans la cellule)...

- "Fondamental" mais "pas parfait" -

D'autres modèles existaient déjà. Mais ils devaient faire un compromis entre la longueur des séquences analysées et la finesse de la résolution.

Or, une longue séquence - jusqu'à un million de paires de nucléotides - est "nécessaire pour comprendre l'environnement régulateur complet d'un gène unique", explique Ziga Avsec, un des co-auteurs du projet.

Et la finesse de la résolution permet d'étudier l'effet de variants génétiques en comparant les prédictions de séquences mutées à celles de séquences non mutées.

Autre avancée, AlphaGenome modélise simultanément l'influence de la séquence sur onze processus biologiques, alors que les scientifiques devaient jusqu'à présent utiliser plusieurs modèles.

Cet outil "peut accélérer notre compréhension du génome en aidant à cartographier l'emplacement des éléments fonctionnels et à déterminer leurs rôles au niveau moléculaire", estime Natasha Latysheva, également co-autrice.

"Nous espérons que les chercheurs enrichiront avec davantage de données et de modalités" le modèle, déjà testé par 3.000 scientifiques de 160 pays et désormais disponible en open source pour la recherche non-commerciale, souligne M. Kohli.

"Identifier précisément les différences dans nos génomes qui nous rendent plus ou moins susceptibles de développer des milliers de maladies est une étape clé vers de meilleurs traitements", note Ben Lehner, responsable de la génomique générative et synthétique au Wellcome Sanger Institute de Cambridge.

Le chercheur, qui n'a pas participé au projet mais a testé le modèle, le juge "très performant", mais encore "loin d'être parfait".

"Les modèles d'IA ne sont bons que dans la mesure où les données utilisées pour les entraîner le sont", or la plupart des jeux de données existants "sont trop petits et insuffisamment standardisés", explique-t-il dans une réaction à l'organisme britannique Science Media Center (SMC).

AlphaGenome n'est pas une "solution miracle à toutes les questions biologiques", l'expression des gènes "étant influencée par des facteurs environnementaux complexes", mais il constitue un "outil fondamental", abonde Robert Goldstone, responsable de la génomique au Francis Crick Institute, cité dans le même texte.

Selon lui, ce nouvel outil permettra aux scientifiques "d'étudier et de simuler de manière programmatique les bases génétiques des maladies complexes".

C.Zeman--TPP