Понятие о гене, генетическом коде. Генетический код как способ записи наследственной информации

Понятие о гене, генетическом коде. Генетический код как способ записи наследственной информации

Генетический код - это способ кодирования последовательности аминокислот в молекуле белка с помощью последовательности нуклеотидов в молекуле нуклеиновой кислоты. Свойства генетического кода вытекают из особенностей этого кодирования.

Каждой аминокислоте белка сопоставляется в соответствие три подряд идущих нуклеотида нуклеиновой кислоты - триплет , или кодон . Каждый из нуклеотидов может содержать одно из четырех азотистых оснований. В РНК это аденин (A), урацил (U), гуанин (G), цитозин (C). По-разному комбинируя азотистые основания (в данном случае содержащие их нуклеотиды) можно получить множество различных триплетов: AAA, GAU, UCC, GCA, AUC и т. д. Общее количество возможных комбинаций - 64, т. е. 4 3 .

В состав белков живых организмов входит около 20 аминокислот. Если бы природа «задумала» кодировать каждую аминокислоту не тремя, а двумя нуклеотидами, то разнообразия таких пар не хватило бы, так как их оказалось бы всего 16, т.е. 4 2 .

Таким образом, основное свойство генетического кода - его триплетность . Каждая аминокислота кодируется тройкой нуклеотидов.

Поскольку возможных разных триплетов существенно больше, чем используемых в биологических молекулах аминокислот, то в живой природе было реализовано такое свойство как избыточность генетического кода. Многие аминокислоты стали кодироваться не одним кодоном, а несколькими. Например, аминокислота глицин кодируется четырьмя различными кодонами: GGU, GGC, GGA, GGG. Избыточность также называют вырожденностью .

Соответствие между аминокислотами и кодонами отражают в виде таблиц. Например, таких:

По отношению к нуклеотидам генетический код обладает таким свойством как однозначность (или специфичность ): каждый кодон соответствует только одной аминокислоте. Например, кодоном GGU можно закодировать только глицин и больше никакую другую аминокислоту.

Еще раз. Избыточность - это про то, что несколько триплетов могут кодировать одну и ту же аминокислоту. Специфичность - каждый конкретный кодон может кодировать только одну аминокислоту.

В генетическом коде нет специальных знаков препинания (если не считать стоп-кодонов, обозначающих окончание синтеза полипептида). Функцию знаков препинания выполняют сами триплеты - окончание одного обозначает, что следом начнется другой. Отсюда следуют следующие два свойства генетического кода: непрерывность и неперекрываемость . Под непрерывность понимают считывание триплетов сразу друг за другом. Под неперекрываемостью - то, что каждый нуклеотид может входить в состав только одного триплета. Так первый нуклеотид следующего триплета всегда стоит после третьего нуклеотида предшествующего триплета. Кодон не может начаться со второго или третьего нуклеотида предшествующего кодона. Другими словами, код не перекрывается.

Генетический код обладает свойством универсальности . Он един для всех организмов на Земле, что говорит о единстве происхождения жизни. При этом встречаются очень редкие исключения. Например, некоторые триплеты митохондрий и хлоропластов кодируют другие, а не обычные для них, аминокислоты. Это может говорить о том, что на заре развития жизни существовали немного различные вариации генетического кода.

Наконец, генетический код обладает помехоустойчивостью , которая является следствием такого его свойства как избыточность. Точечные мутации , иногда происходящие в ДНК , обычно приводят к замене одного азотистого основания на другое. При этом изменяется триплет. Например, было AAA, после мутации стало AAG. Однако подобные изменения не всегда приводят к изменению аминокислоты в синтезируемом полипептиде, так как оба триплета из-за свойства избыточности генетического кода могут соответствовать одной аминокислоте. Учитывая, что мутации чаще вредны, свойство помехоустойчивости полезно.

Генетический код разных организмов обладает некоторыми общими свойствами:
1) Триплетность. Для записи любой, в том числе и наследственной информации используется определенный шифр, элементом которого является буква, или символ. Совокупность таких символов составляет алфавит. Отдельные сообщения записываются комбинацией символов, которые называются кодовыми группами, или кодонами. Известен алфавит, состоящий всего из двух символов, - это азбука Морзе. В ДНК 4 буквы – первые буквы названий азотистых оснований (А, Г, Т, Ц), значит, генетический алфавит состоит всего из 4 символов. Что же является кодовой группой, или, словом генетического кода? Известно 20 основных аминокислот, содержание которых должно быть записано генетическим кодом, т. е. 4 буквы должны дать 20 кодовых слов. Допустим, слово состоит из одного символа, тогда мы получим только 4 кодовые группы. Если же слово состоит из двух символов, то таких групп будет только 16, а этого явно мало, чтобы закодировать 20 аминокислот. Следовательно, в кодовом слове должно быть минимум 3 нуклеотида, что даст 64 (43) сочетания. Такого количества триплетных сочетаний вполне достаточно для кодирования всех аминокислот. Таким образом, кодон генетического кода – это триплет нуклеотидов.
2) Вырожденность (избыточность) – свойство генетического кода состоящее с одной стороны, в том, что он содержит избыточные триплеты, т. е. синонимы, а с другой – «бессмысленные» триплеты. Поскольку код включает 64 сочетания, а кодируются только 20 аминокислот, то некоторые аминокислоты кодируются несколькими триплетами (аргинин, серин, лейцин – шестью; валин, пролин, аланин, глицин, треонин – четырьмя; изолейцин – тремя; фенилаланин, тирозин, гистидин, лизин, аспарагин, глутамин, цистеин, аспарагиновая и глутаминовая кислоты – двумя; метионин и триптофан – одним триплетом). Некоторые кодовые группы (УАА, УАГ, УГА) вообще не несут смысловой нагрузки, т. е. являются «бессмысленными» триплетами. «Бессмысленные», или nonsense, кодоны выполняют функцию терминаторов цепей – знаков препинания в генетическом тексте – служат сигналом окончания синтеза белковой цепи. Такая избыточность кода имеет большое значение для повышения надежности передачи генетической информации.
3) Неперекрываемость. Кодовые триплеты никогда не перекрываются, т. е. всегда транслируются вместе. При считывании информации с молекулы ДНК невозможно использование азотистого основания одного триплета в комбинации с основаниями другого триплета.
4) Однозначность. Нет случаев, когда один и тот же триплет соответствовал бы более чем одной кислоте.
5) Отсутствие разделительных знаков внутри гена. Генетический код считывается с определенного места без запятых.
6) Универсальность. У различных видов живых организмов (вирусов, бактерий, растений, грибов и животных) одинаковые триплеты кодируют одни и те же аминокислоты.
7) Видовая специфичность. Количество и последовательность азотистых оснований в цепи ДНК у разных организмов различные.

ГЕНЕТИЧЕСКИЙ КОД (греч, genetikos относящийся к происхождению; син.: код, биологический код, аминокислотный код, белковый код, код нуклеиновых к-т ) - система записи наследственной информации в молекулах нуклеиновых кислот животных, растений, бактерий и вирусов чередованием последовательности нуклеотидов.

Генетическая информация (рис.) из клетки в клетку, из поколения в поколение, за исключением РНК-содержащих вирусов, передается путем редупликации молекул ДНК (см. Репликация). Реализация наследственной информации ДНК в процессе жизнедеятельности клетки осуществляется через 3 типа РНК: информационную (иРНК или мРНК), рибосомную (рРНК) и транспортную (тРНК), которые с помощью фермента РНК-полимеразы синтезируются на ДНК как на матрице. При этом последовательность нуклеотидов в молекуле ДНК однозначно определяет последовательность нуклеотидов во всех трех типах РНК (см. Транскрипция). Информацию гена (см.), кодирующего белковую молекулу, несет только иРНК. Конечным продуктом реализации наследственной информации является синтез белковых молекул, специфичность которых определяется последовательностью входящих в них аминокислот (см. Трансляция).

Поскольку в составе ДНК или РНК представлено только по 4 разных азотистых основания [в ДНК - аденин (А), тимин (Т), гуанин (Г), цитозин (Ц); в РНК - аденин (А), урацил (У), цитозин (Ц), гуанин (Г)], последовательность которых определяет последовательность 20 аминокислот в составе белка, возникает проблема Г. к., т. е. проблема перевода 4-буквенного алфавита нуклеиновых к-т в 20-буквенный алфавит полипептидов.

Впервые идея матричного синтеза белковых молекул с правильным предсказанием свойств гипотетической матрицы была сформулирована Н. К. Кольцовым в 1928 г. В 1944 г. Эйвери (О. Avery) с соавт, установил, что за передачу наследственных признаков при трансформации у пневмококков ответственны молекулы ДНК. В 1948 г. Чаргафф (E. Chargaff) показал, что во всех молекулах ДНК имеет место количественное равенство соответствующих нуклеотидов (А-T, Г-Ц). В 1953 г. Ф. Крик, Дж. Уотсон и Уилкинс (М. H. F. Wilkins), исходя из этого правила и данных рентгеноструктурного анализа (см.), пришли к выводу, что молекул а ДНК представляет собой двойную спираль, состоящую из двух полинуклеотидных нитей, соединенных между собой водородными связями. Причем против А одной цепи во второй может находиться только Т, против Г - только Ц. Эта комплементарность приводит к тому, что последовательность нуклеотидов одной цепи однозначно определяет последовательность другой. Второй существенный вывод, вытекающий из этой модели,- молекула ДНК способна к самовоспроизведению.

В 1954 г. Гамов (G. Gamow) сформулировал проблему Г. к. в ее современном виде. В 1957 г. Ф. Крик высказал Гипотезу адаптера, предположив, что аминокислоты взаимодействуют с нуклеиновой к-той не непосредственно, а через посредников (теперь известных под названием тРНК). В ближайшие после этого годы все принципиальные звенья общей схемы передачи генетической информации, вначале гипотетичные, были подтверждены экспериментально. В 1957 г. были открыты иРНК [А. С. Спирин, А. Н. Белозерский с соавт.; Фолькин и Астрахан (E. Volkin, L. Astrachan)] и тРНК [Хоугленд (М. В. Hoagland)]; в 1960 г. синтезирована ДНК вне клетки с использованием в качестве матрицы существующих макромолекул ДНК (А. Корнберг) и открыт ДНК-зависимый синтез РНК [Вейсс (S. В. Weiss) с соавт.]. В 1961 г. была создана бесклеточная система, в к-рой в присутствии естественной РНК или синтетических полирибонуклеотидов осуществлялся синтез белковоподобных веществ [М. Ниренберг и Маттеи (J. H. Matthaei)]. Проблема познания Г. к. состояла из исследования общих свойств кода и собственно его расшифровки, т. е. выяснения, какие комбинации нуклеотидов (кодоны) кодируют определенные аминокислоты.

Общие свойства кода были выяснены независимо от его расшифровки и в основном до нее путем анализа молекулярных закономерностей образования мутаций (Ф. Крик и соавт., 1961; Н. В. Лучник, 1963). Они сводятся к следующему:

1. Код универсален, т. е. идентичен, по крайней мере в основном, для всех живых существ.

2. Код триплетен, т. е. каждая аминокислота кодируется тройкой нуклеотидов.

3. Код неперекрывающийся, т. е. данный нуклеотид не может входить в состав более чем одного кодона.

4. Код вырожден, т. е. одна аминокислота может кодироваться несколькими триплетами.

5. Информация о первичной структуре белка считывается с иРНК последовательно, начиная с фиксированной точки.

6. Большинство возможных триплетов имеет «смысл», т. е. кодирует аминокислоты.

7. Из трех «букв» кодона преимущественное значение имеют лишь две (облигатные), третья же (факультативная) несет значительно меньшую информацию.

Прямая расшифровка кода состояла бы в сравнении последовательности нуклеотидов в структурном гене (или синтезированной на нем иРНК) с последовательностью аминокислот в соответствующем белке. Однако такой путь пока технически невозможен. Были применены два других пути: синтез белка в бесклеточной системе с использованием в качестве матрицы искусственных полирибонуклеотидов известного состава и анализ молекулярных закономерностей образования мутаций (см.). Первый принес положительные результаты раньше и исторически сыграл в расшифровке Г. к. большую роль.

В 1961 г. М. Ниренберг и Маттеи применили в качестве матрицы гомо-полимер - синтетическую полиуридиловую к-ту (т. е. искусственную РНК состава УУУУ...) и получили полифенилаланин. Из этого следовало, что кодон фенилаланина состоит из нескольких У, т. е. в случае триплетного кода расшифровывается как УУУ. Позже наряду с гомополимерами были использованы полирибонуклеотиды, состоявшие из разных нуклеотидов. При этом был известен только состав полимеров, расположение же нуклеотидов в них было статистическим, поэтому и анализ результатов был статистическим и давал косвенные выводы. Довольно быстро удалось найти хотя бы по одному триплету для всех 20 аминокислот. Выяснилось, что присутствие органических растворителей, изменение pH или температуры, некоторые катионы и особенно антибиотики делают код неоднозначным: те же кодоны начинают стимулировать включение других аминокислот, в некоторых случаях один кодон начинал кодировать до четырех разных аминокислот. Стрептомицин влиял на считывание информации как в бесклеточных системах, так и in vivo, причем был эффективен только на стрептомицинчувствительных штаммах бактерий. У стрептомицинзависимых штаммов он «исправлял» считывание с кодонов, изменившихся в результате мутации. Подобные результаты давали основание сомневаться в правильности расшифровки Г. к. с помощью бесклеточной системы; требовалось подтверждение, и в первую очередь данными in vivo.

Основные данные о Г. к. in vivo получены при анализе аминокислотного состава белков у организмов, обработанных мутагенами (см.) с известным механизмом действия, напр, азотистой к-той, к-рая вызывает в молекуле ДНК замену Ц на У и А на Г. Полезную информацию дают также анализ мутаций, вызванных неспецифическими мутагенами, сравнение различий в первичной структуре родственных белков у разных видов, корреляция между составом ДНК и белков и т. п.

Расшифровка Г. к. на основании данных in vivo и in vitro дала совпадающие результаты. Позже были разработаны три других метода расшифровки кода в бесклеточных системах: связывание аминоацил-тРНК (т. е. тРНК с присоединенной активированной аминокислотой) тринуклеотидами известного состава (М. Ниренберг и соавт., 1965), связывание аминоацил-тРНК полинуклеотидами, начинающимися с определенного триплета (Маттеи с соавт., 1966), и использование в качестве иРНК полимеров, в которых известен не только состав, но и порядок нуклеотидов (X. Корана и соавт., 1965). Все три метода дополняют друг друга, а результаты находятся в соответствии с данными, полученными в опытах in vivo.

В 70-х гг. 20 в. появились методы особенно надежной проверки результатов расшифровки Г. к. Известно, что мутации, возникающие под действием профлавина, состоят в выпадении или вставке отдельных нуклеотидов, что приводит к сдвигу рамки считывания. У фага Т4 был вызван профлавином ряд мутаций, при которых изменился состав лизоцима. Этот состав был проанализирован и сопоставлен с теми кодонами, которые должны были получиться при сдвиге рамки считывания. Получилось полное соответствие. Дополнительно этот метод позволил установить, какие именно триплеты вырожденного кода кодируют каждую из аминокислот. В 1970 г. Адамсу (J. М. Adams) с сотрудниками удалось провести частичную расшифровку Г. к. прямым методом: у фага R17 определили последовательность оснований во фрагменте длиной в 57 нуклеотидов и сравнили с аминокислотной последовательностью белка его оболочки. Результаты полностью совпали с полученными менее прямыми методами. Т. о., код расшифрован полностью и верно.

Результаты расшифровки сведены в таблицу. В ней указан состав кодонов и РНК. Состав антикодонов тРНК комплементарен кодонам иРНК, т. е. вместо У в них находится А, вместо А - У, вместо Ц - Г и вместо Г - Ц, и соответствует кодонам структурного гена (той нити ДНК, с к-рой считывается информация) с той лишь разницей, что место тимина занимает урацил. Из 64 триплетов, которые могут быть образованы сочетанием 4 нуклеотидов, 61 имеет «смысл», т. е. кодирует аминокислоты, а 3 являются «нонсенсами» (лишенными смысла). Между составом триплетов и их смыслом имеется довольно четкая зависимость, к-рая была обнаружена еще при анализе общих свойств кода. В ряде случаев триплеты, кодирующие определенную аминокислоту (напр., пролин, аланин), характеризуются тем, что два первых нуклеотида (облигатные) у них одинаковы, а третий (факультативный) может быть любым. В других случаях (при кодировании, напр., аспарагина, глутамина) один и тот же смысл имеют два сходных триплета, у которых совпадают два первых нуклеотида, а на месте третьего стоит любой пурин или любой пиримидин.

Нонсенс-кодоны, 2 из которых имеют специальные названия, соответствующие обозначению фаговых мутантов (УАА-охра, УАГ-амбер, УГА-опал), хотя и не кодируют каких-либо аминокислот, но имеют большое значение при считывании информации, кодируя конец полипептидной цепи.

Считывание информации происходит в направлении от 5 1 -> 3 1 - к концу нуклеотидной цепи (см. Дезоксирибонуклеиновые кислоты). При этом синтез белка идет от аминокислоты со свободной аминогруппой к аминокислоте со свободной карбоксильной группой. Начало синтеза кодируется триплетами АУГ и ГУГ, которые в этом случае включают специфичную стартовую аминоацил-тРНК, а именно N-формилметио-нил-тРНК. Эти же триплеты при локализации внутри цепи кодируют соответственно метионин и валин. Неоднозначность снимается тем, что началу считывания предшествует нонсенс. Есть данные, говорящие в пользу того, что граница между участками иРНК, кодирующими разные белки, состоит более чем из двух триплетов и что в этих местах меняется вторичная структура РНК; этот вопрос находится в стадии исследования. Если нонсенс-кодон возникает внутри структурного гена, то соответствующий белок строится только до места расположения этого кодона.

Открытие и расшифровка генетического кода - выдающееся достижение молекулярной биологии - оказало влияние на все биол, науки, положив в ряде случаев начало развитию специальных крупных разделов (см. Молекулярная генетика). Эффект открытия Г. к. и связанных с ним исследований сравнивают с тем эффектом, который оказала на биол, науки теория Дарвина.

Универсальность Г. к. является прямым доказательством универсальности основных молекулярных механизмов жизни у всех представителей органического мира. Между тем большие различия в функциях генетического аппарата и его строении при переходе от прокариотов к эукариотам и от одноклеточных к многоклеточным, вероятно, связаны и с молекулярными различиями, исследование которых - одна из задач будущего. Поскольку исследования Г. к.- дело лишь последних лет, значение полученных результатов для практической медицины носит лишь Косвенный характер, позволяя пока понять природу заболеваний, механизм действия возбудителей болезней и лекарственных веществ. Однако открытие таких явлений, как трансформация (см.), трансдукция (см.), супрессия (см.), указывает на принципиальную возможность исправления патологически измененной наследственной информации или ее коррекции - так наз. генная инженерия (см.).

Таблица. ГЕНЕТИЧЕСКИЙ КОД

Первый нуклеотид кодона

Второй нуклеотид кодона

Третий, нуклеотид кодона

Фенилаланин

J Нонсенс

Триптофан

Гистидин

Глутаминовая кислота

Изолейцин

Аспарагиновая

Метионин

Аспарагин

Глутамин

* Кодирует конец цепи.

** Кодирует также начало цепи.

Библиография: Ичас М. Биологический код, пер. с англ., М., 1971; Лучник Н.Б. Биофизика цитогенетических поражений и генетический код, Л., 1968; Молекулярная генетика, пер. с англ., под ред. А. Н. Белозерского, ч. 1, М., 1964; Нуклеиновые кислоты, пер. с англ., под ред. А. Н. Белозерского, М., 1965; Уотсон Дж. Д. Молекулярная биология гена, пер. с англ., М., 1967; Физиологическая генетика, под ред. М. Е. Лобашева С. Г., Инге-Вечтомо-ва, Л., 1976, библиогр.; Desoxyribonuc-leins&ure, Schlttssel des Lebens, hrsg. v„ E. Geissler, B., 1972; The genetic code, Gold Spr. Harb. Symp. quant. Biol., v. 31, 1966; W o e s e C. R. The genetic code, N. Y. a. o., 1967.

Ген - структурная и функциональная единица наследственности, контролирующая развитие определенного признака или свойства. Совокупность генов родители передают потомкам во время размножения.Большой вклад в изучение гена внесли российские учёные: Симашкевич Е.А.,Гаврилова Ю.А.,Богомазова О.В.(2011 год)

В настоящее время, в молекулярной биологии установлено, что гены - это участки ДНК, несущие какую-либо целостную информацию - о строении одной молекулы белка или одной молекулы РНК. Эти и другие функциональные молекулы определяют развитие, рост и функционирование организма.

В то же время, каждый ген характеризуется рядом специфических регуляторных последовательностей ДНК, таких как промоторы, которые принимают непосредственное участие в регулировании проявления гена. Регуляторные последовательности могут находиться как в непосредственной близости от открытой рамки считывания, кодирующей белок, или начала последовательности РНК, как в случае с промоторами (так называемые cis cis-regulatory elements ), так и на расстоянии многих миллионов пар оснований (нуклеотидов), как в случае с энхансерами, инсуляторами и супрессорами (иногда классифицируемые как trans -регуляторные элементы, англ. trans-regulatory elements ). Таким образом, понятие гена не ограничено только кодирующим участком ДНК, а представляет собой более широкую концепцию, включающую в себя и регуляторные последовательности.

Изначально термин ген появился как теоретическая единица передачи дискретной наследственной информации. История биологии помнит споры о том, какие молекулы могут являться носителями наследственной информации. Большинство исследователей считали, что такими носителями могут быть только белки, так как их строение (20 аминокислот) позволяет создать больше вариантов, чем строение ДНК, которое составлено всего из четырёх видов нуклеотидов. Позже было экспериментально доказано, что именно ДНК включает в себя наследственную информацию, что было выражено в виде центральной догмы молекулярной биологии.

Гены могут подвергаться мутациям - случайным или целенаправленным изменениям последовательности нуклеотидов в цепи ДНК. Мутации могут приводить к изменению последовательности, а следовательно изменению биологических характеристик белка или РНК, которые, в свою очередь, могут иметь результатом общее или локальное изменённое или анормальное функционирование организма. Такие мутации в ряде случаев являются патогенными, так как их результатом является заболевание, или летальными на эмбриональном уровне. Однако, далеко не все изменения последовательности нуклеотидов приводят к изменению структуры белка (благодаря эффекту вырожденности генетического кода) или к существенному изменению последовательности и не являются патогенными. В частности, геном человека характеризуется однонуклеотидными полиморфизмами и вариациями числа копий (англ. copy number variations ), такими как делеции и дупликации, которые составляют около 1 % всей нуклеотидной последовательности человека. Однонуклеотидные полиморфизмы, в частности, определяют различные аллели одного гена.

Мономеры, составляющие каждую из цепей ДНК, представляют собой сложные органические соединения, включающие в себя азотистые основания: аденин(А) или тимин(Т) или цитозин(Ц) или гуанин(Г), пятиатомный сахар-пентозу-дезоксирибозу,по имени которой и получила название сама ДНК, а так же остаток фосфорной кислоты.Эти соединения носят название нуклеотидов.

Свойства гена

  1. дискретность - несмешиваемость генов;
  2. стабильность - способность сохранять структуру;
  3. лабильность - способность многократно мутировать;
  4. множественный аллелизм - многие гены существуют в популяции во множестве молекулярных форм;
  5. аллельность - в генотипе диплоидных организмов только две формы гена;
  6. специфичность - каждый ген кодирует свой признак;
  7. плейотропия - множественный эффект гена;
  8. экспрессивность - степень выраженности гена в признаке;
  9. пенетрантность - частота проявления гена в фенотипе;
  10. амплификация - увеличение количества копий гена.

Классификация

  1. Структурные гены - уникальные компоненты генома, представляющие единственную последовательность, кодирующую определенный белок или некоторые виды РНК. (См. также статью гены домашнего хозяйства).
  2. Функциональные гены - регулируют работу структурных генов.

Генети́ческий код - свойственный всем живым организмам способ кодирования аминокислотной последовательности белков при помощи последовательности нуклеотидов.

В ДНК используется четыре нуклеотида - аденин (А), гуанин (G), цитозин (С), тимин (T), которые в русскоязычной литературе обозначаются буквами А, Г, Ц и Т. Эти буквы составляют алфавит генетического кода. В РНК используются те же нуклеотиды, за исключением тимина, который заменён похожим нуклеотидом - урацилом, который обозначается буквой U (У в русскоязычной литературе). В молекулах ДНК и РНК нуклеотиды выстраиваются в цепочки и, таким образом, получаются последовательности генетических букв.

Генетический код

Для построения белков в природе используется 20 различных аминокислот. Каждый белок представляет собой цепочку или несколько цепочек аминокислот в строго определённой последовательности. Эта последовательность определяет строение белка, а следовательно все его биологические свойства. Набор аминокислот также универсален почти для всех живых организмов.

Реализация генетической информации в живых клетках (то есть синтез белка, кодируемого геном) осуществляется при помощи двух матричных процессов: транскрипции (то есть синтеза мРНК на матрице ДНК) и трансляции генетического кода в аминокислотную последовательность (синтез полипептидной цепи на мРНК). Для кодирования 20 аминокислот, а также сигнала «стоп», означающего конец белковой последовательности, достаточно трёх последовательных нуклеотидов. Набор из трёх нуклеотидов называется триплетом. Принятые сокращения, соответствующие аминокислотам и кодонам, изображены на рисунке.

Свойства

  1. Триплетность - значащей единицей кода является сочетание трёх нуклеотидов (триплет, или кодон).
  2. Непрерывность - между триплетами нет знаков препинания, то есть информация считывается непрерывно.
  3. Неперекрываемость - один и тот же нуклеотид не может входить одновременно в состав двух или более триплетов (не соблюдается для некоторых перекрывающихся генов вирусов, митохондрий и бактерий, которые кодируют несколько белков, считывающихся со сдвигом рамки).
  4. Однозначность (специфичность) - определённый кодон соответствует только одной аминокислоте (однако, кодон UGA у Euplotes crassus кодирует две аминокислоты - цистеин и селеноцистеин)
  5. Вырожденность (избыточность) - одной и той же аминокислоте может соответствовать несколько кодонов.
  6. Универсальность - генетический код работает одинаково в организмах разного уровня сложности - от вирусов до человека (на этом основаны методы генной инженерии; есть ряд исключений, показанный в таблице раздела «Вариации стандартного генетического кода» ниже).
  7. Помехоустойчивость - мутации замен нуклеотидов, не приводящие к смене класса кодируемой аминокислоты, называют консервативными ; мутации замен нуклеотидов, приводящие к смене класса кодируемой аминокислоты, называют радикальными .

Биосинтез белка и его этапы

Биосинтез белка - сложный многостадийный процесс синтеза полипептидной цепи из аминокислотных остатков, происходящий на рибосомах клеток живых организмов с участием молекул мРНК и тРНК.

Биосинтез белка можно разделить на стадии транскрипции, процессинга и трансляции. Во время транскрипции происходит считывание генетической информации, зашифрованной в молекулах ДНК, и запись этой информации в молекулы мРНК. В ходе ряда последовательных стадий процессинга из мРНК удаляются некоторые фрагменты, ненужные в последующих стадиях, и происходит редактирование нуклеотидных последовательностей. После транспортировки кода из ядра к рибосомам происходит собственно синтез белковых молекул, путём присоединения отдельных аминокислотных остатков к растущей полипептидной цепи.

Между транскрипцией и трансляцией молекула мРНК претерпевает ряд последовательных изменений, которые обеспечивают созревание функционирующей матрицы для синтеза полипептидной цепочки. К 5΄-концу присоединяется кэп, а к 3΄-концу поли-А хвост, который увеличивает длительность жизни мРНК. С появлением процессинга в эукариотической клетке стало возможно комбинирование экзонов гена для получения большего разнообразия белков, кодируемым единой последовательностью нуклеотидов ДНК, - альтернативный сплайсинг.

Трансляция заключается в синтезе полипептидной цепи в соответствии с информацией, закодированной в матричной РНК. Аминокислотная последовательность выстраивается при помощи транспортных РНК (тРНК), которые образуют с аминокислотами комплексы - аминоацил-тРНК. Каждой аминокислоте соответствует своя тРНК, имеющая соответствующий антикодон, «подходящий» к кодону мРНК. Во время трансляции рибосома движется вдоль мРНК, по мере этого наращивается полипептидная цепь. Энергией биосинтез белка обеспечивается за счёт АТФ.

Готовая белковая молекула затем отщепляется от рибосомы и транспортируется в нужное место клетки. Для достижения своего активного состояния некоторые белки требуют дополнительной посттрансляционной модификации.

Благодаря процессу транскрипции в клетке осуществляется передача информации от ДНК к белку: ДНК - и-РНК - белок. Генетическая информация, содержащаяся в ДНК и в и-РНК, заключена в последовательности расположения нуклеотидов в молекулах. Каким же образом происходит перевод информации с "языка" нуклеотидов на "язык" аминокислот? Такой перевод осуществляется с помощью генетического кода. Код, или шифр,- это система символов для перевода одной формы информации в другую. Генетический код - это система записи информации о последовательности расположения аминокислот в белках с помощью последовательности расположения нуклеотидов в информационной РНК. Насколько важна именно последовательность расположения одних и тех же элементов (четырех нуклеотидов в РНК) для понимания и сохранения смысла информации, можно убедиться на простом примере: переставив буквы в слове код, мы получим слово с иным значением - док. Какими же свойствами обладает генетический код?

1. Код триплетен. В состав РНК входят 4 нуклеотида: А, Г, Ц, У. Если бы мы пытались обозначить одну аминокислоту одним нуклеотидом, то 16 из 20 аминокислот остались бы не зашифрованы. Двухбуквенный код позволил бы зашифровать 16 аминокислот (из четырех нуклеотидов можно составить 16 различных комбинаций, в каждой из которых имеется два нуклеотида). Природа создала трехбуквенный, или триплетный, код. Это означает, что каждая из 20 аминокислот зашифрована последовательностью трех нуклеотидов, называемых триплетом или кодоном. Из 4 нуклеотидов можно создать 64 различные комбинации по 3 нуклеотида в каждой (4*4*4=64). Этого с избытком хватает для кодирования 20 аминокислот и, казалось бы, 44 кодона являются лишними. Однако это не так.

2. Код вырожден. Это означает, что каждая аминокислота шифруется более чем одним кодоном (от двух до шести). Исключение составляют аминокислоты метионин и триптофан, каждая из которых кодируется только одним триплетом. (Это видно из таблицы генетического кода .) Тот факт, что метионин кодируется одним триплетом АУТ, имеет особый смысл, который вам станет понятен позже ( 16).

3. Код однозначен. Каждый кодон шифрует только одну аминокислоту. У всех здоровых людей в гене, несущем информацию о бета-цепи гемоглобина , триплет ГАА или ГАГ, I стоящий на шестом месте, кодирует глутаминовую кислоту. У больных серповидноклеточной анемией второй нуклеотид в этом триплете заменен на У. Как видно из таблицы, триплеты ГУА или ГУГ, которые в этом случае образуются, кодируют аминокислоту валин. К чему приводит такая замена, вы уже знаете из раздела о ДНК .

4. Между генами имеются "знаки препинания". В печатном тексте в конце каждой фразы стоит точка. Несколько связанных по смыслу фраз составляют абзац. На языке генетической информации таким абзацем являются оперон и комплементарная ему и-РНК. Каждый ген в опероне кодирует одну полипептидную цепочку - фразу. Так как в ряде случаев по матрице и-РНК последовательно создается несколько разных полипептидных цепей, они должны быть отделены друг от друга. Для этого в генетическом коде существуют три специальные триплета - УАА, УАГ, УГА, каждый из которых обозначает прекрдщение синтеза одной полипептидной цепи. Таким образом, эти триплеты выполняют функцию знаков препинания. Они находятся в конце каждого гена. Внутри гена нет "знаков препинания". Поскольку генетический код подобен языку, разберем это свойство на примере такой составленной из триплетов фразы: жил был кот тих был сер мил мне тот кот. Смысл написанного понятен, несмотря на отсутствие "знаков препинания. Если же мы уберем в первом слове одну букву (один нуклеотид в гене), но читать будем также тройками букв, то получится бессмыслица: илб ылк отт ихб ылс ерм илм нет отк от Нарушение смысла возникает и при выпадении одного или двух нуклеотидов из гена. Белок, который будет считываться с такого испорченного гена, не будет иметь ничего общего с тем белком, который кодировался нормальным геном.

6. Код универсален. Генетический код един для всех живущих на Земле существ. У бактерий и грибов, пшеницы и хлопка, рыб и червей, лягушки и человека одни и те же триплеты кодируют одни и те же аминокислоты.