Գենետիկական տեղեկատվության փոխարկում. DNA և RNA շղթաների տրանսկրիպցիա
Մոլեկուլային կենսաբանության հիմնական դոգման նկարագրում է գենետիկական տեղեկատվության երկկողմանի հոսքը նուկլեինաթթուների միջև: DNA-ից RNA անցումը (տրանսկրիպցիա) և RNA-ից DNA հետադարձ անցումը (հետադարձ տրանսկրիպցիա) հանդիսանում են կենսաբանական հետազոտությունների հիմնարար գործընթացները: Գործնականում, լաբորատոր հետազոտությունների կամ կենսաինֆորմատիկ վերլուծությունների ժամանակ հաճախ անհրաժեշտ է լինում արագորեն փոխարկել նուկլեոտիդային հաջորդականությունները մի ձևից մյուսի՝ պահպանելով կառուցվածքային առանձնահատկությունները:
Այս առցանց գործիքը նախատեսված է DNA և RNA հաջորդականությունների երկկողմանի փոխարկման համար: Կախված հետազոտական խնդրից՝ փոխարկումը կարող է կատարվել ինչպես կոդավորող (իմաստային), այնպես էլ կաղապարային (հակաիմաստային) շղթայի հիման վրա: Գործիքը լիովին համատեղելի է FASTA ձևաչափի հետ, պահպանում է տառերի ռեգիստրը, հավասարեցման բացատների նշիչները և IUPAC երկիմաստության կոդերը:
Փոխարկման ուղղությունները և շղթաների տեսակները
Նուկլեոտիդային հաջորդականությունների փոխարկման ժամանակ արդյունքը կախված է ընտրված ուղղությունից և շղթայի տեսակից: Գործիքում հասանելի են հետևյալ կարգավորումները.
- Փոխարկում. Օգտագործողը կարող է ընտրել
DNA → RNAկամRNA → DNAուղղությունը: - Շղթա. Հասանելի են
Կոդավորող (իմաստային)ևԿաղապարային (հակաիմաստային)տարբերակները:
Կոդավորող (իմաստային) շղթայի փոխարկում
Կոդավորող շղթայի (sense strand) ընտրության դեպքում նուկլեոտիդների հաջորդականությունը չի փոխվում, կատարվում է միայն համապատասխան հիմքի փոխարինում:
DNA → RNAուղղության դեպքում յուրաքանչյուր թիմին (T) փոխարինվում է ուրացիլով (U):RNA → DNAուղղության դեպքում յուրաքանչյուր ուրացիլ (U) փոխարինվում է թիմինով (T):- Մնացած բոլոր հիմքերը պահպանվում են անփոփոխ:
Կաղապարային (հակաիմաստային) շղթայի փոխարկում
Կաղապարային շղթայի (antisense strand) դեպքում յուրաքանչյուր հիմք փոխարինվում է իր կոմպլեմենտար զույգով:
DNA → RNAուղղության դեպքում կիրառվում են հետևյալ կանոնները՝A→U,T→A,C→G,G→C:RNA → DNAուղղության դեպքում կիրառվում են համապատասխան կոմպլեմենտար կանոնները:
IUPAC երկիմաստության կոդերի և հատուկ նշանների մշակումը
Գենետիկական հաջորդականությունները հաճախ պարունակում են ոչ միայն ստանդարտ հիմքեր (A, T, C, G, U), այլև այլասերված կոդեր, որոնք սահմանվել են IUPAC-IUB կոմիտեի կողմից՝ անորոշ կամ բազմակի հնարավոր նուկլեոտիդները նշելու համար: Գործիքը լիովին աջակցում է այս կոդերին՝ կիրառելով Cornish-Bowden-ի (1985) առաջարկած կանոնները:
Կաղապարային շղթայի փոխարկման ժամանակ IUPAC երկիմաստ կոդերը քարտեզագրվում են իրենց համապատասխան կոմպլեմենտար զույգերին.
R(պուրին՝ A կամ G) փոխարինվում էY-ով (պիրիմիդին՝ C կամ T/U) և հակառակը (R↔Y):K(կետո՝ G կամ T/U) փոխարինվում էM-ով (ամինո՝ A կամ C) և հակառակը (K↔M):B(ոչ A) փոխարինվում էV-ով (ոչ T/U) և հակառակը (B↔V):D(ոչ C) փոխարինվում էH-ով (ոչ G) և հակառակը (D↔H):S(ուժեղ կապ՝ G կամ C),W(թույլ կապ՝ A կամ T/U) ևN(ցանկացած նուկլեոտիդ) կոդերը ինքնակոմպլեմենտար են, ուստի մնում են անփոփոխ:
Փոքրատառերով գրված նուկլեոտիդները պահպանում են իրենց ռեգիստրը փոխարկումից հետո: Հավասարեցման բացատների նշիչները (-) նույնպես անփոփոխ փոխանցվում են արդյունքի մեջ:
Մուտքային տվյալների ձևաչափեր և սահմանափակումներ
Գործիքն ընդունում է հաջորդականություններ հետևյալ պայմաններով.
- Առավելագույն չափ. Մուտքագրվող հում տեքստի ծավալը չպետք է գերազանցի 2,000,000 նշանը: Սահմանաչափը խախտելու դեպքում հայտնվում է սխալի հաղորդագրություն՝
Այդ հաջորդականությունը չափազանց երկար է այս գործիքի համար: Սահմանափակեք այն մինչև ‹max› նշանով:: - Թույլատրելի նշաններ. Մուտքագրումը պետք է պարունակի միայն թույլատրելի նուկլեոտիդային տառեր, IUPAC կոդեր, հավասարեցման նշաններ, բացատներ, թվանշաններ, կետադրական նշաններ կամ FASTA վերնագրեր: Չթույլատրված տառերի առկայության դեպքում ցուցադրվում է սխալ՝
Չաջակցվող տառեր՝ ‹chars›: Թույլատրվում են միայն DNA/RNA հիմքերի տառերը:(ցուցադրվում են առաջին 6 սխալ տառերը): - Անտեսվող նշաններ. Բացատները, տողադարձերը, թվանշանները և կետադրական նշանները ավտոմատ կերպով հեռացվում են հաջորդականությունից: Գործիքը հաշվում և ցուցադրում է դրանց քանակը
Անտեսվել է ‹n› բացատ, թվանշան և կետադրական նշան:հաղորդագրությամբ: - FASTA վերնագրեր.
>կամ;նշանով սկսվող մեկ տողը ճանաչվում է որպես վերնագիր և պահպանվում է արդյունքի վերևում (Անվան տողը պահպանվել է:): Եթե հայտնաբերվում են մի քանի անվան տողեր, հաջորդականությունները միավորվում են մեկ ընդհանուր շղթայի մեջ, և հայտնվում է նշում՝Գտնվել է անվան ‹n› տող — հաջորդականության տողերը միավորվել են մեկի մեջ::
GC պարունակության հաշվարկման մեթոդաբանությունը
GC պարունակությունը կարևոր ցուցանիշ է PCR պրայմերների նախագծման և գենոմային վերլուծության համար: Գործիքն օգտագործում է հետևյալ բանաձևը GC տոկոսը որոշելու համար.
GC պարունակություն = (G + C + S) / (A + C + G + T + U + W + S) × 100%
Այս բանաձևում.
S(ուժեղ կապ՝ G կամ C) կոդը ներառվում է թե՛ հաշվիչում, թե՛ հայտարարում:W(թույլ կապ՝ A կամ T/U) կոդը ներառվում է միայն հայտարարում:- Մյուս բոլոր երկիմաստ կոդերը (
R,Y,K,M,B,V,D,H,N) ամբողջությամբ բացառվում են հաշվարկից, քանի որ դրանց ազդեցությունը GC հարաբերակցության վրա անորոշ է: - Եթե հաջորդականությունը չի պարունակում հաշվարկի համար պիտանի որևէ հիմք, տոկոսային արժեքը չի ցուցադրվում: GC պարունակությունը չի փոխվում փոխարկման ժամանակ, քանի որ պարզ T↔U փոխարինումները կամ կոմպլեմենտար շղթայի անցումը պահպանում են նույն դասերի հարաբերակցությունը:
Տվյալների գաղտնիություն
Մուտքագրված բոլոր հաջորդականությունների մշակումը և փոխարկումը կատարվում է տեղային եղանակով՝ անմիջապես օգտատիրոջ բրաուզերում: Ոչ մի տվյալ չի ուղարկվում BroBroGo սերվերներին, ինչը ապահովում է տվյալների տեղային մշակումը:
Հաճախ տրվող հարցեր (FAQ)
Ո՞րն է տարբերությունը կոդավորող և կաղապարային շղթաների միջև:
Կոդավորող (իմաստային) շղթան համընկնում է տեղեկատվական RNA-ի (mRNA) հետ, բացառությամբ այն բանի, որ T-ն դառնում է U: Կաղապարային (հակաիմաստային) շղթան այն է, որն իրականում ընթերցում է բջիջը, ուստի յուրաքանչյուր հիմք փոխարինվում է իր կոմպլեմենտարով՝ A→U, T→A, C→G, G→C: Ընտրեք այն շղթան, որը համապատասխանում է Ձեր հաջորդականության գրառմանը:
Ի՞նչ է տալիս ինձ RNA → DNA փոխարկումը:
Ձեր RNA-ի DNA պատճենը. յուրաքանչյուր U դառնում է T, իսկ մնացած ամեն ինչ մնում է նույնը: Սա cDNA հաջորդականությունն է, որը կստեղծեր հետադարձ տրանսկրիպտազը, ինչը օգտակար է, երբ հաջորդող գործիքն ընդունում է միայն DNA:
Կարո՞ղ եմ տեղադրել այնպիսի երկիմաստ կոդեր, ինչպիսիք են N-ը, R-ը կամ Y-ը:
Այո: IUPAC-ի այլասերված տառերը պահպանվում են. պարզ փոխարկումը վերաբերում է միայն T և U տառերին, իսկ կաղապարային շղթայի փոխարկումը համապատասխանեցնում է յուրաքանչյուր կոդ իր կոմպլեմենտար զույգին (R↔Y, K↔M, իսկ S-ը, W-ն և N-ը մնում են նույնը): Հավասարեցման բացատների նշիչները (-) պահպանվում են, իսկ փոքրատառերը պահում են իրենց ռեգիստրը:
Ի՞նչ է պատահում FASTA վերնագրերին, թվերին և բացատներին:
> նշանով սկսվող անվան տողը պահպանվում է և ցուցադրվում արդյունքի վերևում: Բացատները, տողադարձերը, թվանշանները և կետադրական նշաններն անտեսվում են, իսկ ներմուծման դաշտի տակ գտնվող նշումը հայտնում է, թե որքան նշան է հեռացվել. ոչինչ աննկատ չի կորչում: