Pretvarač DNA i RNA sekvenci

Pretvorite DNA u RNA ili natrag u DNA — kodirajući ili predložak lanac, uz očuvanje dvosmislenih kodova.

Pretvorba
Lanac
Sekvenca
Pretvorena sekvenca
Spremno. Zalijepite DNA ili RNA sekvencu.

Vaša se sekvenca pretvara u vašem pregledniku. Ništa se ne prenosi na BroBroGo.

Česta pitanja

Koja je razlika između kodirajućeg i predloška lanca?

Kodirajući (smisleni) lanac odgovara glasničkoj RNA, osim što T postaje U. Predložak (protusmisleni) lanac je onaj koji stanica zapravo čita, pa se svaka baza komplementira: A→U, T→A, C→G, G→C. Odaberite lanac koji odgovara načinu na koji je vaša sekvenca zapisana.

Što dobivam pretvorbom RNA → DNA?

DNA kopija vaše RNA: svako U postaje T, a sve ostalo ostaje isto. To je cDNA sekvenca koju bi proizvela reverzna transkriptaza, što je korisno kada nizvodni alat prihvaća samo DNA.

Mogu li zalijepiti dvosmislene kodove poput N, R ili Y?

Da. Degenerirani IUPAC znakovi su očuvani: obična pretvorba utječe samo na T i U, dok pretvorba predloška lanca preslikava svaki kod u njegov odgovarajući komplement (R↔Y, K↔M; S, W i N ostaju). Markeri praznina u poravnanju (-) se zadržavaju, a mala slova zadržavaju svoju veličinu.

Što se događa s FASTA zaglavljima, brojevima i razmacima?

Redak s nazivom koji počinje znakom > zadržava se i prikazuje iznad rezultata. Razmaci, prijelomi redaka, znamenke i interpunkcijski znakovi se zanemaruju, a napomena ispod unosa govori vam koliko je toga uklonjeno — ništa se ne odbacuje prešutno.

Protok genetskih informacija i uloga pretvorbe sekvenci

Središnja dogma molekularne biologije opisuje dvosmjerni i jednosmjerni protok genetskih informacija unutar bioloških sustava. Informacije zapisane u deoksiribonukleinskoj kiselini (DNA) prenose se u ribonukleinsku kiselinu (RNA) procesom transkripcije, nakon čega slijedi translacija RNA u funkcionalne proteine. U laboratorijskim istraživanjima i bioinformatičkoj analizi, potreba za pretvorbom između DNA i RNA sekvenci javlja se svakodnevno.

Pretvorba sekvenci omogućuje istraživačima rekonstrukciju komplementarne DNA (cDNA) iz RNA predložaka, analizu transkripata i pripremu podataka za nizvodne računalne alate koji prihvaćaju isključivo jedan tip nukleinske kiseline. Ovaj digitalni pretvarač omogućuje brzu i preciznu pretvorbu sekvenci u oba smjera, uz potpuno očuvanje strukture datoteka, FASTA zaglavlja i specifičnih oznaka unutar sekvence.

Kodirajući nasuprot predlošku lanca

Prilikom pretvorbe DNA u RNA ili obrnuto, ključno je definirati koji lanac dvostruke uzvojnice DNA sekvenca predstavlja. Unutar alata možete odabrati dvije opcije za parametar Lanac:

  • Kodirajući (smisleni): Ovaj lanac (engl. coding ili sense strand) sadrži istu sekvencu baza kao i nastala glasnička RNA (mRNA), uz jedinu razliku što DNA sadrži timin (T), dok RNA sadrži uracil (U). Prilikom pretvorbe DNA → RNA uz odabranu opciju Kodirajući (smisleni), svako slovo T jednostavno prelazi u U. Kod obrnute pretvorbe RNA → DNA, svako U prelazi u T. Sve ostale baze ostaju nepromijenjene.
  • Predložak (protusmisleni): Ovaj lanac (engl. template ili antisense strand) služi kao fizički kalup koji RNA polimeraza čita tijekom transkripcije. Redoslijed baza na mRNA komplementaran je ovom lancu. Ako odaberete Predložak (protusmisleni), alat primjenjuje pravilo komplementarnosti baza. Za smjer DNA → RNA, baze se sparuju na sljedeći način: A prelazi u U, T u A, C u G, a G u C.

Pravila pretvorbe i očuvanje IUPAC kodova

Alat je u potpunosti usklađen sa standardima molekularne biologije i podržava degenerirane IUPAC (IUB) kodove za dvosmislene nukleinske kiseline. Ovi kodovi predstavljaju položaje na kojima je moguće prisustvo više različitih baza, što je čest slučaj kod konsenzusnih sekvenci ili dizajna degeneriranih primera.

Prilikom pretvorbe preko opcije Predložak (protusmisleni), degenerirani kodovi se precizno komplementiraju prema preporukama IUPAC-IUB iz 1984. godine (Cornish-Bowden, 1985):

Izvorni kod Značenje (Baze) Komplementarni kod
R A ili G Y
Y C ili T/U R
K G o T/U M
M A ili C K
B C, G ili T/U V
V A, C ili G B
D A, G ili T/U H
H A, C ili T/U D
S G ili C (jake veze) S (samokomplementaran)
W A ili T/U (slabe veze) W (samokomplementaran)
N Bilo koja baza N (samokomplementaran)

Mala slova u sekvenci u potpunosti zadržavaju svoju veličinu nakon pretvorbe. Također, markeri praznina u poravnanju, poput crtice (-), ostaju netaknuti na svojim pozicijama, što omogućuje izravnu pretvorbu poravnatih sekvenci (engl. sequence alignments).

Obrada FASTA formata i ignoriranih znakova

Alat je prilagođen radu s FASTA formatom zapisa. Ako ulazni tekst sadrži redak s nazivom koji započinje znakom > (ili starijim komentarom koji započinje sa ;), taj se redak prepoznaje kao zaglavlje.

Tijekom obrade primjenjuju se sljedeća pravila:

  • Ako je prisutno jedno zaglavlje, ono se zadržava na vrhu rezultata, a ispod njega se prikazuje pretvorena sekvenca. Korisniku se prikazuje obavijest: Redak s nazivom je zadržan..
  • Ako se u unosu detektira više zaglavlja, sekvence se spajaju u jednu cjelinu, a sustav ispisuje napomenu: Pronađeno je ‹n› redaka s nazivom — redci sekvence spojeni su u jedan..
  • Svi razmaci, prijelomi redaka, brojevi i znakovi interpunkcije automatski se uklanjaju iz sekvence kako bi se spriječile pogreške u nizvodnim analizama. Broj uklonjenih znakova prikazuje se u napomeni: Zanemareno je ‹n› razmaka, znamenki i interpunkcijskih znakova..

Maksimalna duljina sirovog unosa ograničena je na 2.000.000 znakova. Ako unos premaši ovu granicu, alat prekida rad i prikazuje poruku o pogrešci: Ta je sekvenca predugačka za ovaj alat. Neka bude kraća od ‹max› znakova.. U slučaju unosa nedopuštenih znakova koji nisu dio standardnih ili degeneriranih baza, pojavljuje se poruka: Nepodržana slova: ‹chars›. Dopuštena su samo slova DNA/RNA baza. (prikazuje se do 6 problematičnih slova).

Izračun udjela GC i statistika

Nakon svake uspješne pretvorbe, alat izračunava i prikazuje osnovne statističke podatke o sekvenci: Ulazne baze, Rezultirajuće baze i Udio GC.

Udio GC (postotak gvanina i citozina) izračunava se prema sljedećoj formuli:

Udio GC = (G + C + S) / (A + C + G + T + U + W + S) × 100%

U ovoj formuli, dvosmisleni kod S (jake veze: G ili C) računa se kao GC doprinos, dok se kod W (slabe veze: A ili T/U) računa u ukupni zbroj baza, ali ne i u brojnik. Ostali degenerirani kodovi (R, Y, K, M, B, V, D, H, N) isključeni su iz izračuna jer je njihov točan doprinos GC udjelu neodređen. Ako sekvenca ne sadrži baze koje se mogu uračunati, postotak se ne prikazuje. Vrijednost udjela GC ostaje identična prije i nakon pretvorbe jer jednostavna zamjena T↔U ili komplementiranje lanca ne mijenjaju ukupni omjer baza.

Privatnost podataka

Vaša se sekvenca pretvara u vašem pregledniku. Ništa se ne prenosi na BroBroGo.

Često postavljana pitanja (FAQ)

Koja je razlika između kodirajućeg i predloška lanca?

Kodirajući (smisleni) lanac odgovara glasničkoj RNA, osim što T postaje U. Predložak (protusmisleni) lanac je onaj koji stanica zapravo čita, pa se svaka baza komplementira: A→U, T→A, C→G, G→C. Odaberite lanac koji odgovara načinu na koji je vaša sekvenca zapisana.

Što dobivam pretvorbom RNA → DNA?

DNA kopija vaše RNA: svako U postaje T, a sve ostalo ostaje isto. To je cDNA sekvenca koju bi proizvela reverzna transkriptaza, što je korisno kada nizvodni alat prihvaća samo DNA.

Mogu li zalijepiti dvosmislene kodove poput N, R ili Y?

Da. Degenerirani IUPAC znakovi su očuvani: obična pretvorba utječe samo na T i U, dok pretvorba predloška lanca preslikava svaki kod u njegov odgovarajući komplement (R↔Y, K↔M; S, W i N ostaju). Markeri praznina u poravnanju (-) se zadržavaju, a mala slova zadržavaju svoju veličinu.

Što se događa s FASTA zaglavljima, brojevima i razmacima?

Redak s nazivom koji počinje znakom > zadržava se i prikazuje iznad rezultata. Razmaci, prijelomi redaka, znamenke i interpunkcijski znakovi se zanemaruju, a napomena ispod unosa govori vam koliko je toga uklonjeno — ništa se ne odbacuje prešutno.