Análisis de secuencias

Calculadora de contenido de GC

Contenido de GC y AT, y cómo se distribuye el GC a lo largo de la secuencia.

Hay un ejemplo cargado. Pulsa aquí y se borra.

Ejemplos:

sequence

Longitud
300
Contenido de GC
46.0 %
Contenido de AT
54.0 %
Sesgo de GC
0.159
Sesgo de AT
0.000

Composición de bases

  • G 80 (26.7 %)
  • C 58 (19.3 %)
  • A 81 (27.0 %)
  • T 81 (27.0 %)

GC a lo largo de la secuencia (ventana de 50 nt)

050100media

Cómo se usa

  1. Pega una secuencia, un registro FASTA o varios registros a la vez.
  2. Fija el tamaño de la ventana. Decide cuánto detalle muestra la línea de GC: una ventana estrecha sigue los rasgos locales, una ancha enseña la forma del conjunto.
  3. Lee las cifras, luego la barra de composición y después el GC a lo largo de la secuencia. Con varios registros, la tabla de abajo los compara y al pulsar un nombre cambia el detalle de arriba.

Conviene saber

  • El GC y el AT se calculan sobre las bases que son A, C, G o T. Las bases ambiguas cuentan para la longitud y no para el porcentaje, y la pantalla dice cuántas había siempre que eso cambie algo.
  • El sesgo de GC es (G − C) / (G + C) medido dentro de una hebra, de Lobry (1996). No es una comparación entre las dos hebras: la complementaria tiene el valor espejo por construcción, así que esa lectura sería cero en todas partes.
  • Los nombres que se generan para los registros sin cabecera son ASCII a propósito. Un identificador FASTA acaba en programas de otra gente, y uno no ASCII vuelve estropeado de unos cuantos de ellos.

Preguntas frecuentes

Las demás herramientas de secuencias

Referencias

De dónde sale la definición del sesgo GC (GC skew). El contenido GC y la composición de bases son recuentos y no se citan.

  1. Lobry JR. (1996) Asymmetric substitution patterns in the two DNA strands of bacteria. Mol Biol Evol 13(5):660–665.doi:10.1093/oxfordjournals.molbev.a025626GC skew = (G − C) / (G + C), medido dentro de una sola hebra: no es una comparación entre las dos hebras