Молекулалық биологияның орталық догмасы және нуклеин қышқылдарының транскрипциясы
Молекулалық биологияның орталық догмасы генетикалық ақпараттың жасуша ішіндегі бағытты ағынын сипаттайды. Бұл ақпарат дезоксирибонуклеин қышқылынан (DNA) рибонуклеин қышқылына (RNA), одан кейін нәруыздарға беріледі. DNA-дан RNA-ға өту процесі транскрипция деп аталады. Бұл процесс барысында генетикалық код сақталады, бірақ нуклеотидтер құрамында маңызды айырмашылық пайда болады: DNA құрамындағы тимин (T) негізі RNA құрамында урацил (U) негізіне ауыстырылады.
Кері бағытта, яғни RNA-дан DNA-ға ақпараттың берілуі кері транскрипция деп аталады. Бұл процесс табиғатта ретровирустардың тіршілік әрекетінде кездеседі және зертханалық жағдайда комплементарлы DNA (cDNA) алу үшін қолданылады. Зерттеулер барысында алынған RNA тізбегін келесі молекулалық-биологиялық талдау құралдарына енгізу үшін оны DNA форматына түрлендіру қажеттілігі жиі туындайды.
Кодтаушы және матрицалық тізбектердің айырмашылығы
Транскрипция процесін дұрыс модельдеу үшін DNA молекуласының қос тізбекті құрылымын ескеру қажет. Түрлендіру бағытына байланысты екі түрлі тізбек қолданылады:
- Кодтаушы (мағыналы) тізбек (Coding / sense): Бұл тізбек синтезделетін RNA тізбегімен бірдей нуклеотидтер реттілігіне ие, тек DNA-дағы барлық тимин (T) негіздері RNA-да урацил (U) негіздеріне ауысады.
- Матрицалық (антимағыналы) тізбек (Template / antisense): Бұл транскрипция кезінде RNA полимераза ферменті тікелей оқитын және комплементарлы негіздерді жинақтауға негіз болатын тізбек. Матрицалық тізбекті түрлендіру кезінде әрбір негіз өзінің комплементарлы сыңарына ауыстырылады.
Түрлендіргіш құралда осы екі бағытты да есепке алу мүмкіндігі қарастырылған. Пайдаланушы DNA → RNA немесе RNA → DNA бағытын таңдап, сәйкесінше Кодтаушы (мағыналы) немесе Матрицалық (антимағыналы) тізбек режимін белгілей алады.
Түрлендіру ережелері және IUPAC белгісіздік кодтары
Түрлендіру процесі таңдалған тізбек түріне байланысты қатаң математикалық ережелерге сәйкес орындалады:
-
Кодтаушы (мағыналы) тізбек бойынша түрлендіру:
DNA → RNAбағытында әрбірTәрпіUәрпіне өзгереді.RNA → DNAбағытында әрбірUәрпіTәрпіне өзгереді.- Басқа барлық негіздер өзгеріссіз қалады.
-
Матрицалық (антимағыналы) тізбек бойынша түрлендіру:
DNA → RNAбағытында негіздер комплементарлы түрде ауысады:A→U,T→A,C→G,G→C.- Дегенерацияланған IUPAC белгісіздік кодтары өздерінің тиісті комплементарлы жұптарына сәйкестендіріледі:
R↔Y,K↔M,B↔V,D↔H. Өз-өзіне комплементарлы болып табылатынS,WжәнеNкодтары өзгеріссіз қалады.
Түрлендіру кезінде кіші әріптер өз регистрін сақтайды. Сонымен қатар, тізбектерді туралау үшін қолданылатын бос орын белгілері (-) өзгеріссіз сақталады.
Тізбекті енгізу кезінде бос орындар, жол ауысулары, цифрлар мен тыныс белгілері автоматты түрде еленбейді және жойылады. Құрал өңделгеннен кейін пайдаланушыға ‹n› бос орын, цифр және тыныс белгісі еленбеді. деген хабарлама арқылы жойылған таңбалардың нақты санын көрсетеді.
Егер енгізілген мәтінде рұқсат етілмеген әріптер анықталса, жүйе Қолдау көрсетілмейтін әріптер: ‹chars›. Тек DNA/RNA негіздерінің әріптеріне рұқсат етіледі. деген қате туралы хабарламаны шығарады (мұндағы ‹chars› орнына алғашқы 6 қате әріп көрсетіледі). Енгізілетін шикі мәтіннің шегі 2 000 000 таңбадан аспауы тиіс, әйтпесе Бұл тізбек бұл құрал үшін тым ұзын. Оны ‹max› таңбадан асырмай сақтаңыз. деген қате шығады.
FASTA форматын өңдеу ерекшеліктері
Биоинформатикада нуклеотидтік тізбектерді сақтау үшін FASTA форматы кеңінен қолданылады. Бұл форматта тізбектің сипаттамасы немесе атауы жазылған жол > белгісінен басталады (кейде ескі конвенция бойынша ; белгісі де қолданылады).
Құрал FASTA форматындағы деректерді толық қолдайды:
- Егер енгізілген мәтінде бір ғана атау жолы болса, ол өзгеріссіз сақталып, нәтиженің үстінде көрсетіледі және
Атау жолы сақталды.деген белгі шығады. - Егер бірнеше атау жолы анықталса, құрал барлық тізбек жолдарын бір тізбекке біріктіреді және
‹n› атау жолы табылды — тізбек жолдары бір жолға біріктірілді.деген ескертуді көрсетеді.
ГЦ (GC) мөлшерін есептеу әдістемесі
ГЦ (GC) мөлшері — бұл нуклеин қышқылы тізбегіндегі гуанин (G) және цитозин (C) негіздерінің пайыздық үлесі. Бұл көрсеткіш праймерлерді жобалауда, ПТР (PCR) реакцияларының температуралық режимін анықтауда және геномдық талдауларда маңызды рөл атқарады.
Құралда ГЦ мөлшері келесі формула бойынша есептеледі:
ГЦ мөлшері = (G + C + S) / (A + C + G + T + U + W + S) × 100%
Бұл формулада IUPAC белгісіздік кодтарының ішінен тек S (күшті байланыс: G немесе C) және W (әлсіз байланыс: A, T немесе U) кодтары есепке алынады. Басқа дегенерацияланған кодтар (R, Y, K, M, B, V, D, H, N) ГЦ үлесіне қосқан үлесі белгісіз болғандықтан, бөлшектің алымынан да, бөлімінен де шығарылып тасталады. Егер тізбекте есептеуге жарамды бірде-бір негіз болмаса, пайыздық көрсеткіш көрсетілмейді. Түрлендіру бағыты өзгергенде ГЦ мөлшері өзгермейді.
Құпиялылық және деректерді өңдеу
Пайдаланушының құпиялылығын қамтамасыз ету мақсатында барлық есептеулер мен түрлендірулер толығымен жергілікті түрде орындалады. Тізбегіңіз браузерде түрлендіріледі. BroBroGo серверіне ештеңе жіберілмейді.
Жиі қойылатын сұрақтар (FAQ)
FASTA тақырыптары, сандар мен бос орындар не болады?
> белгісінен басталатын атау жолы сақталады және нәтиженің үстінде көрсетіледі. Бос орындар, жол ауысулары, цифрлар мен тыныс белгілері еленбейді, ал енгізу өрісінің астындағы ескерту қанша таңбаның жойылғанын көрсетеді — ештеңе де білдіртпей тасталмайды.
N, R немесе Y сияқты белгісіздік кодтарын кірістіруге бола ма?
Иә. Дегенерацияланған IUPAC әріптері сақталады: қарапайым түрлендіру тек T және U әріптеріне әсер етеді, ал матрицалық тізбекті түрлендіру әр кодты өзінің тиісті комплементарлы жұбына сәйкестендіреді (R↔Y, K↔M; S, W және N қалады). Туралаудың бос орын белгілері (-) сақталады, ал кіші әріптер өз регистрін сақтайды.
Кодтаушы және матрицалық тізбектердің айырмашылығы неде?
Кодтаушы (мағыналы) тізбек ақпараттық RNA-ға сәйкес келеді, тек T әрпі U болып өзгереді. Матрицалық (антимағыналы) тізбек — бұл жасуша іс жүзінде оқитын тізбек, сондықтан әрбір негіз комплементарлы негізге ауысады: A→U, T→A, C→G, G→C. Тізбегіңіздің қалай жазылғанына сәйкес келетін тізбекті таңдаңыз.
RNA → DNA маған не береді?
RNA-ның DNA көшірмесі: әрбір U әрпі T болады, ал қалғанының бәрі өзгеріссіз қалады. Бұл кері транскриптаза түзетін cDNA тізбегі, ол келесі құрал тек DNA-ны қабылдайтын жағдайда пайдалы.