De l'ARN à la protéine : la traduction
Le code génétique
L'ARN messager est écrit dans un alphabet de quatre lettres ; les protéines dans un alphabet de vingt. Le code génétique est la table de conversion entre les deux.
Pourquoi des groupes de trois
Le raisonnement est purement combinatoire, et il fut mené avant toute expérience :
si 1 base codait 1 acide aminé -> 4 possibilités insuffisant
si 2 bases codaient -> 4² = 16 encore insuffisant
si 3 bases codent -> 4³ = 64 suffisant (20 nécessaires)
Le code est donc à triplets : chaque groupe de trois bases, appelé codon, désigne un acide aminé.
Un code redondant
64 codons pour 20 acides aminés : plusieurs codons désignent le même acide aminé.
UUU -> phénylalanine GGU -> glycine
UUC -> phénylalanine GGC -> glycine
GGA -> glycine
AUG -> méthionine (START) GGG -> glycine
UAA, UAG, UGA -> STOP (aucun acide aminé)
Cette redondance n'est pas du gaspillage : elle amortit les mutations. Si la troisième base d'un codon change, l'acide aminé reste souvent le même — les quatre codons de la glycine ne diffèrent que par leur dernière lettre. Le code est construit de façon à ce que les erreurs les plus fréquentes soient les moins graves.
Attention à ne pas inverser : le code est redondant mais non ambigu. Un codon donné code toujours le même acide aminé ; c'est l'inverse qui n'est pas vrai.
La ponctuation
AUG codon INITIATEUR : marque le début, et code la méthionine
UAA, UAG, UGA codons STOP : marquent la fin, ne codent aucun acide aminé
Le codon AUG définit aussi le cadre de lecture : c'est à partir de lui que l'ARN est découpé en triplets. Une même séquence lue avec un décalage d'une base donne une protéine entièrement différente.
AUG CCU GAA UAC ... cadre correct
A UGC CUG AAU AC... décalé d'une base : message illisible
Un code quasi universel
C'est l'un des arguments les plus forts en faveur d'une origine commune de la vie : le même code génétique fonctionne chez la bactérie, la levure, le chêne et l'être humain. Le codon GGU désigne la glycine partout.
Cette universalité a une conséquence pratique majeure : on peut insérer un gène humain dans une bactérie, et elle fabriquera la protéine humaine correspondante. C'est ainsi que l'insuline est produite depuis 1982 — avant cela, on l'extrayait de pancréas de porc.
Quelques rares exceptions existent, notamment dans les mitochondries, où un ou deux codons ont un sens différent. Elles confirment la règle plus qu'elles ne l'affaiblissent.
En résumé
- Le code génétique convertit des codons (triplets de bases) en acides aminés.
- Trois bases sont nécessaires :
4² = 16 < 20 < 4³ = 64. - Le code est redondant (plusieurs codons par acide aminé) mais non ambigu.
AUGest le codon initiateur et fixe le cadre de lecture ;UAA,UAG,UGAsont STOP.- Le code est quasi universel — argument fort pour une origine commune du vivant.
- Cette universalité permet de faire produire des protéines humaines par des bactéries.

