Análisis de secuencias
Calculadora de contenido de GC
Contenido de GC y AT, composición de bases, sesgo y GC a lo largo de la secuencia.
Hay un ejemplo cargado. Pulsa aquí y se borra.
Ejemplos:
sequence
- Longitud
- 300
- Contenido de GC
- 46.0 %
- Contenido de AT
- 54.0 %
- Sesgo de GC
- 0.159
- Sesgo de AT
- 0.000
Composición de bases
- G 80 (26.7 %)
- C 58 (19.3 %)
- A 81 (27.0 %)
- T 81 (27.0 %)
GC a lo largo de la secuencia (ventana de 50 nt)
Cómo se usa
- Pega una secuencia, un registro FASTA o varios registros a la vez.
- Fija el tamaño de la ventana. Decide cuánto detalle muestra la línea de GC: una ventana estrecha sigue los rasgos locales, una ancha enseña la forma del conjunto.
- Lee las cifras, luego la barra de composición y después el GC a lo largo de la secuencia. Con varios registros, la tabla de abajo los compara y al pulsar un nombre cambia el detalle de arriba.
Conviene saber
- El GC y el AT se calculan sobre las bases que son A, C, G o T. Las bases ambiguas cuentan para la longitud y no para el porcentaje, y la pantalla dice cuántas había siempre que eso cambie algo.
- El sesgo de GC es (G − C) / (G + C) medido dentro de una hebra, de Lobry (1996). No es una comparación entre las dos hebras: la complementaria tiene el valor espejo por construcción, así que esa lectura sería cero en todas partes.
- Los nombres que se generan para los registros sin cabecera son ASCII a propósito. Un identificador FASTA acaba en programas de otra gente, y uno no ASCII vuelve estropeado de unos cuantos de ellos.
Preguntas frecuentes
Casi siempre por las bases ambiguas. Si la secuencia tiene N, dividir por la longitud completa da un número menor que dividir por las bases realmente leídas, y esta herramienta hace lo segundo.
Depende de lo que busques más que de una regla. Lo bastante ancha para que la línea no sea ruido, lo bastante estrecha para que el rasgo que te interesa no se promedie.
Que G y C aparecen con la misma frecuencia en la hebra que pegaste. Es habitual en secuencias que no están bajo las presiones que producen sesgo, y no es un error.
Las demás herramientas de secuencias
- Traducción de ADN a proteína — Traducción en seis marcos y marcos de lectura abiertos, con los códigos del NCBI.
- Calculadora de Tm de cebadores — Temperatura de fusión por el modelo del vecino más próximo
- Limpieza de FASTA — Ordena un FASTA pegado sin romper el alineamiento.