Convertidor de seqüències de DNA i RNA

Converteixi DNA a RNA o de tornada a DNA: cadena codificant o motlle, mantenint els codis d'ambigüitat.

Conversió
Cadena
Seqüència
Seqüència convertida
Llest. Enganxi una seqüència de DNA o RNA.

La seva seqüència es converteix al seu navegador. No es puja res a BroBroGo.

PMF

Quina és la diferència entre la cadena codificant i la motlle?

La cadena codificant (sentit) coincideix amb l'RNA missatger, excepte que la T es converteix en U. La cadena motlle (antisentit) és la que la cèl·lula llegeix realment, de manera que cada base es complementa: A→U, T→A, C→G, G→C. Triï la cadena que coincideixi amb la manera com s'ha escrit la seva seqüència.

Què m'aporta la conversió de RNA → DNA?

Una còpia en DNA del seu RNA: cada U es converteix en T i tota la resta es manté. Aquesta és la seqüència de cDNA que produiria una transcriptasa inversa, útil quan una eina posterior només accepta DNA.

Puc enganxar codis d'ambigüitat com N, R o Y?

Sí. Es preserven les lletres degenerades IUPAC: una conversió senzilla només afecta la T i la U, i la conversió de la cadena motlle mapeja cada codi amb el seu complementari correcte (R↔Y, K↔M; S, W i N es mantenen). Els marcadors de buit d'alineament (-) es conserven, i les lletres minúscules mantenen la seva caixa.

Què passa amb les capçaleres FASTA, els números i els espais?

Es manté la línia de nom que comença per > i es mostra a sobre del resultat. S'ignoren els espais, els salts de línia, els dígits i els signes de puntuació, i la nota sota l'entrada li indica quant s'ha eliminat; no es descarta res de manera silenciosa.

El dogma central i la conversió de seqüències

En la biologia molecular, el flux de la informació genètica es regeix pel dogma central, que descriu com les instruccions codificades en el DNA es transcriuen en RNA i, posteriorment, es tradueixen en proteïnes. El procés de transcripció és la transferència d'informació de nucleòtids de DNA a molècules de RNA. Per als investigadors i bioinformàtics, treballar amb aquestes seqüències requereix sovint alternar entre ambdós tipus d'àcids nucleics.

El "Convertidor de seqüències de DNA i RNA" facilita aquesta tasca realitzant conversions precises en ambdues direccions:

  • DNA → RNA: Transcriu una seqüència de DNA a la seva forma equivalent de RNA.
  • RNA → DNA: Realitza la transcripció inversa, convertint una seqüència de RNA en DNA (cDNA).

El processament de les dades es realitza de manera totalment local. La seva seqüència es converteix al seu navegador. No es puja res a BroBroGo. Això garanteix que les dades no es transmeten a servidors externs durant l'ús de l'eina.


Cadena codificant versus cadena motlle

La transcripció a la cèl·lula és un procés asimètric on només una de les dues cadenes de la doble hèlix de DNA serveix de guia. Per tant, per realitzar una conversió digital correcta, cal especificar quina cadena representa la seqüència introduïda:

Cadena codificant (sentit)

També coneguda com a cadena sense, té la mateixa seqüència de bases que el transcrit de RNA resultant (amb la diferència que el RNA conté uracil en lloc de timina).

  • En la conversió DNA → RNA, cada timina (T) es transforma en uracil (U).
  • En la conversió RNA → DNA, cada uracil (U) es transforma en timina (T).
  • La resta de bases es mantenen idèntiques.

Cadena motlle (antisentit)

Anomenada cadena antisense, és la cadena física que llegeix l'RNA polimerasa per sintetitzar l'RNA complementari. Durant la conversió utilitzant aquesta opció, cada base es complementa de la següent manera:

  • En la conversió DNA → RNA: A passa a U, T a A, C a G i G a C.
  • En la conversió RNA → DNA: A passa a T, U a A, C a G i G a C.

Tractament de codis d'ambigüitat IUPAC i caràcters especials

Les seqüències biològiques reals sovint contenen dades que van més enllà de les quatre bases estàndard (A, C, G, T/U). Aquesta eina està dissenyada per respectar la complexitat de les dades experimentals mitjançant regles estrictes de preservació:

  • Codis degenerats IUPAC: S'admeten els símbols estàndard definits per la nomenclatura de Cornish-Bowden per a bases de nucleòtids especificades de manera incompleta. En la conversió de la cadena motlle (antisentit), els codis es mapegen directament amb els seus complementaris:
    • R (purina: A o G) esdevé Y (pirimidina: C o T/U), i viceversa (RY).
    • K (ceto: G o T/U) esdevé M (amino: A o C), i viceversa (KM).
    • B (no A) esdevé V (no T/U), i viceversa (BV).
    • D (no C) esdevé H (no G), i viceversa (DH).
    • Els codis autoconsistents o autocomplementaris S (fort: G o C), W (feble: A o T/U) i N (qualsevol base) es mantenen inalterats.
  • Preservació de majúscules i minúscules: Les lletres minúscules mantenen la seva caixa original després de qualsevol conversió.
  • Marcadors d'alineament: Els caràcters de buit d'alineament (-) es conserven exactament en la mateixa posició dins de la seqüència resultant.

El format FASTA i la neteja de dades

L'eina és totalment compatible amb el format FASTA, un estàndard de text utilitzat per descriure seqüències on la primera línia comença amb un caràcter de capçalera.

>Exemple de capçalera FASTA
ATGGTGAGCAAGGGCGAGGAGCTGTTCACCGGGGTGGTG

El convertidor processa l'entrada seguint aquestes regles de format:

  1. Capçalera única: Si es detecta una línia de nom que comença per > (o una línia de comentari que comença per ;), es manté intacta i es mostra a la part superior del resultat. El sistema mostra la nota: Línia de nom mantinguda..
  2. Múltiples capçaleres: Si es detecten diverses línies de nom, l'eina uneix totes les línies de seqüència en una de sola i mostra el missatge: S'han trobat ‹n› línies de nom; les línies de seqüència s'han unit en una de sola..
  3. Caràcters no desitjats: Els espais, els salts de línia, els dígits i els signes de puntuació s'eliminen automàticament de la seqüència per evitar errors de lectura. L'eina informa de l'acció amb el missatge: S'han ignorat ‹n› espais, dígits i signes de puntuació..

Si la seqüència supera els 2.000.000 de caràcters de text sense processar, es deté l'operació i es mostra l'error: Aquesta seqüència és massa llarga per a aquesta eina. Mantingui-la per sota de ‹max› caràcters.. Si s'introdueixen lletres no permeses que no formen part de l'alfabet de nucleòtids o dels codis IUPAC, es mostra el missatge d'error: Lletres no admeses: ‹chars›. Només es permeten lletres de bases de DNA/RNA. (mostrant fins a les primeres 6 lletres incorrectes detectades).


Càlcul del contingut GC

El contingut de GC és un paràmetre crític en biologia molecular que influeix en la temperatura de fusió del DNA, el disseny de cebadors per a PCR i l'estabilitat de l'estructura secundària de l'RNA. L'eina calcula automàticament aquest percentatge basant-se en la següent fórmula estàndard:

Contingut GC = (G + C + S) / (A + C + G + T + U + W + S) × 100%

D'acord amb aquesta convenció, el codi d'ambigüitat S (bases fortes: G o C) es comptabilitza tant al numerador com al denominador, mentre que W (bases febles: A o T/U) s'inclou només al denominador. Els altres codis degenerats (R, Y, K, M, B, V, D, H, N) s'exclouen completament del càlcul perquè la seva contribució real a la proporció de GC és incerta. Si la seqüència no conté cap base computable, no es mostra cap percentatge.


Preguntes freqüents

Quina és la diferència entre la cadena codificant i la motlle?

La cadena codificant (sentit) coincideix amb l'RNA missatger, excepte que la T es converteix en U. La cadena motlle (antisentit) és la que la cèl·lula llegeix realment, de manera que cada base es complementa: A→U, T→A, C→G, G→C. Triï la cadena que coincideixi amb la manera com s'ha escrit la seva seqüència.

Què m'aporta la conversió de RNA → DNA?

Una còpia en DNA del seu RNA: cada U es converteix en T i tota la resta es manté. Aquesta és la seqüència de cDNA que produiria una transcriptasa inversa, útil quan una eina posterior només accepta DNA.

Puc enganxar codis d'ambigüitat com N, R o Y?

Sí. Es preserven les lletres degenerades IUPAC: una conversió senzilla només afecta la T i la U, i la conversió de la cadena motlle mapeja cada codi amb el seu complementari correcte (R↔Y, K↔M; S, W i N es mantenen). Els marcadors de buit d'alineament (-) es conserven, i les lletres minúscules mantenen la seva caixa.

Què passa amb les capçaleres FASTA, els números i els espais?

Es manté la línia de nom que comença per > i es mostra a sobre del resultat. S'ignoren els espais, els salts de línia, els dígits i els signes de puntuació, i la nota sota l'entrada li indica quant s'ha eliminat; no es descarta res de manera silenciosa.