Գենետիկական հաջորդականությունների փոխարկման մաթեմատիկան և ուղղվածությունը
Մոլեկուլային կենսաբանության մեջ նուկլեոտիդային հաջորդականությունները ստանդարտ կերպով գրվում են 5'→3' ուղղությամբ: Քանի որ DNA-ի երկու շղթաները հակազուգահեռ են, մի շղթայի 5' ծայրը համապատասխանում է մյուս շղթայի 3' ծայրին: Երբ անհրաժեշտ է լինում վերլուծել կոմպլեմենտար շղթան, պարզ կոմպլեմենտար փոխարկումը տալիս է 3'→5' ուղղությամբ կարդացվող հաջորդականություն: Ստանդարտ 5'→3' կողմնորոշումը վերականգնելու համար անհրաժեշտ է կատարել հակադարձ կոմպլեմենտար փոխարկում:
Մաթեմատիկական տեսանկյունից հաջորդականության շրջումը (reverse) և կոմպլեմենտարի ստացումը (complement) կոմուտատիվ գործողություններ են: Սա նշանակում է, որ սկզբում հաջորդականությունը շրջելը և ապա յուրաքանչյուր հիմքն իր զուգընկերով փոխարինելը տալիս է ճիշտ նույն արդյունքը, ինչ սկզբում կոմպլեմենտարը ստանալը և ապա այն շրջելը: Այս գործիքը թույլ է տալիս կատարել այս գործողություններից յուրաքանչյուրը՝ ընտրելով համապատասխան տարբերակը «Գործողություն» ցանկից:
Գործիքի մուտքային տվյալները և ֆորմատավորման կանոնները
Գործիքն ընդունում է DNA կամ RNA հաջորդականություններ, որոնք կարող են տեղադրվել «Հաջորդականություն» դաշտում: Մուտքագրման ժամանակ գործում են հետևյալ կանոնները.
- Ֆորմատներ. Թույլատրվում է տեղադրել սովորական տեքստային հաջորդականություններ կամ FASTA ֆորմատով տվյալներ, որոնք սկսվում են
>նշանով և անվանման տողով: - Մաքրման կանոններ. Բացատները, թվանշանները և կետադրական նշաններն ավտոմատ կերպով հեռացվում են հաջորդականությունից մինչև մշակումը: Օգտատիրոջը ցուցադրվում է «Անտեսվել է
‹n›բացատ, թվանշան և կետադրական նշան» հաղորդագրությունը: - Երկարության սահմանափակում. Եթե տեղադրված հաջորդականությունը գերազանցում է թույլատրելի առավելագույն սահմանը, ցուցադրվում է «Այդ հաջորդականությունը չափազանց երկար է այս գործիքի համար: Սահմանափակեք այն մինչև
‹max›նիշով:» սխալի հաղորդագրությունը: - Անվավեր նիշեր. Եթե հաջորդականության մեջ հայտնաբերվում են չաջակցվող տառեր, գործիքը ցուցադրում է «Չաջակցվող տառեր՝
‹chars›: Թույլատրվում են միայն DNA/RNA հիմքերի տառերը:» հաղորդագրությունը:
DNA և RNA հիմքերի զուգավորման առանձնահատկությունները
DNA-ի և RNA-ի քիմիական կառուցվածքների տարբերությունը պայմանավորում է նուկլեոտիդների զուգավորման տարբեր կանոններ: Գործիքն ավտոմատ կերպով հայտնաբերում է նուկլեոտիդի տեսակը. եթե հաջորդականությունը պարունակում է «U» (ուրացիլ) և չի պարունակում «T» (թիմին), այն դիտարկվում է որպես RNA: Այս դեպքում ցուցադրվում է «Հայտնաբերվել է RNA — A-ն զուգավորվում է U-ի հետ:» նշումը: Մնացած բոլոր դեպքերում հաջորդականությունը մշակվում է որպես DNA, որտեղ «A»-ն զուգավորվում է «T»-ի հետ: Ցիտոզինը (C) և գուանինը (G) բոլոր դեպքերում զուգավորվում են միմյանց հետ:
IUPAC երկիմաստության կոդերի և տառերի մեծատառ/փոքրատառի պահպանումը
Գենետիկական հետազոտություններում հաճախ օգտագործվում են IUPAC երկիմաստության կոդեր՝ նշելու համար այն դիրքերը, որտեղ կարող են լինել մի քանի հնարավոր նուկլեոտիդներ: Գործիքն ամբողջությամբ աջակցում է այս կոդերին և փոխարկում է դրանք հետևյալ կանոններով.
- «R» (պուրիններ՝ A/G) փոխարինվում է «Y»-ով (պիրիմիդիններ՝ C/T/U) և հակառակը:
- «K» (կետո հիմքեր՝ G/T/U) փոխարինվում է «M»-ով (ամինո հիմքեր՝ A/C) և հակառակը:
- «B» (ոչ A) փոխարինվում է «V»-ով (ոչ T/U) և հակառակը:
- «D» (ոչ C) փոխարինվում է «H»-ով (ոչ G) և հակառակը:
- «S» (ուժեղ կապեր՝ G/C), «W» (թույլ կապեր՝ A/T/U) և «N» (ցանկացած նուկլեոտիդ) կոդերը մնում են անփոփոխ:
Փոխարկման ընթացքում ամբողջությամբ պահպանվում է տառերի սկզբնական մեծատառ կամ փոքրատառ լինելը: Սա թույլ է տալիս պահպանել հաջորդականության մեջ նախապես նշված փոքրատառ հատվածները, օրինակ՝ ինտրոնները կամ հատուկ թիրախային տիրույթները:
FASTA վերնագրերի մշակումը
FASTA ֆորմատով աշխատելիս գործիքն ապահովում է հետևյալ վարքագիծը.
- Եթե մուտքագրված է մեկ FASTA վերնագիր (տող, որը սկսվում է
>նշանով), այն պահպանվում է արդյունքի վերևում, և ցուցադրվում է «Անվանման տողը պահպանվել է:» նշումը: - Եթե հայտնաբերվում են բազմակի անվանման տողեր, բոլոր հաջորդականությունները միավորվում են մեկ ընդհանուր շղթայի մեջ, և օգտատիրոջը ցուցադրվում է «Գտնվել է անվանման
‹n›տող — հաջորդականության տողերը միավորվել են մեկ տողում:» հաղորդագրությունը:
Գործնական կիրառությունը PCR պրայմերների նախագծման մեջ
PCR (պոլիմերազային շղթայական ռեակցիա) իրականացնելիս անհրաժեշտ է լինում նախագծել երկու պրայմեր՝ ուղիղ (forward) և հակադարձ (reverse): Ուղիղ պրայմերն ունի նույն հաջորդականությունը, ինչ DNA-ի կոդավորող շղթան 5'→3' ուղղությամբ: Հակադարձ պրայմերը պետք է միանա կոդավորող շղթայի վերջնամասին: Քանի որ սինթեզը միշտ ընթանում է 5'→3' ուղղությամբ, հակադարձ պրայմերի հաջորդականությունը պետք է լինի թիրախային շղթայի վերջնամասի ճշգրիտ հակադարձ կոմպլեմենտը: Այս գործիքի միջոցով հետազոտողները կարող են արագ ստանալ անհրաժեշտ հաջորդականությունը՝ պատվիրման ենթակա ճիշտ կողմնորոշմամբ:
Տվյալների մշակման գաղտնիությունը
Ձեր հաջորդականությունը մնում է Ձեր սարքում: Այն փոխարկվում է Ձեր բրաուզերում և երբեք չի բեռնվում սերվեր:
Հաճախ տրվող հարցեր (FAQ)
Ո՞րն է տարբերությունը կոմպլեմենտար և հակադարձ կոմպլեմենտար հաջորդականությունների միջև:
Կոմպլեմենտար հաջորդականությունը փոխարինում է յուրաքանչյուր հիմքն իր զուգընկերով (A-ն՝ T-ով, C-ն՝ G-ով), բայց պահպանում է սկզբնական ուղղությունը, ուստի այն կարդացվում է 3'→5' ուղղությամբ: Հակադարձ կոմպլեմենտարը նաև շրջում է հաջորդականության ուղղությունը՝ տրամադրելով հակառակ շղթան սովորական 5'→3' ուղղությամբ, որն իրականում կոմպլեմենտար կապ է հաստատում Ձեր հաջորդականության հետ:
Ինչո՞ւ է հակադարձ PCR պրայմերի համար օգտագործվում հակադարձ կոմպլեմենտարը:
Պրայմերները գրվում են 5'→3' ուղղությամբ: Հակադարձ պրայմերը միանում է հակառակ շղթային թիրախային հատվածի վերջնամասում, ուստի վերցվում է այդ վերջնամասի հաջորդականությունը և կատարվում է դրա հակադարձ կոմպլեմենտար փոխարկումը: Արդյունքն ուղղված է լինում դեպի թիրախային հատվածը և հենց այն հաջորդականությունն է, որը Դուք պատվիրում եք:
Կարո՞ղ եմ տեղադրել երկիմաստ կոդեր, ինչպիսիք են N-ը, R-ը կամ Y-ը:
Այո: IUPAC երկիմաստ կոդերը հետևում են իրենց զուգավորման կանոններին. R-ը փոխարինվում է Y-ով, K-ն՝ M-ով, B-ն՝ V-ով, իսկ D-ն՝ H-ով, մինչդեռ S-ը, W-ն և N-ը մնում են անփոփոխ: Տառերի մեծատառ կամ փոքրատառ լինելը պահպանվում է, ուստի փոքրատառերով նշված հատվածները չեն կորչում:
Արդյո՞ք այն աշխատում է RNA-ի հետ, և ի՞նչ է պատահում FASTA վերնագրերին:
Այո: U պարունակող և T չպարունակող հաջորդականությունը դիտարկվում է որպես RNA, ուստի A-ն զուգավորվում է U-ի հետ. հակառակ դեպքում A-ն զուգավորվում է T-ի հետ: Սկզբնական > անվանման տողը պահպանվում է արդյունքի վերևում, իսկ բացատները, թվանշաններն ու կետադրական նշանները մաքրվում և հաշվարկվում են մուտքային դաշտի ներքևում: