Sequence Analysis
GC 함량 계산기
GC·AT 함량, 염기 조성, skew, 위치별 GC 함량을 계산합니다.
예제가 들어 있습니다. 여기를 누르면 지워집니다.
예제:
sequence
- 길이
- 300
- GC 함량
- 46.0 %
- AT 함량
- 54.0 %
- GC skew
- 0.159
- AT skew
- 0.000
염기 조성
- G 80 (26.7 %)
- C 58 (19.3 %)
- A 81 (27.0 %)
- T 81 (27.0 %)
위치별 GC 함량 (창 50 nt)
사용 방법
- 서열 하나나 FASTA 레코드, 또는 여러 레코드를 한 번에 붙여넣습니다.
- 창 크기를 정합니다. GC 선이 얼마나 세밀할지가 여기서 정해집니다 — 좁으면 국소 특징을 따라가고, 넓으면 서열 전체의 모양이 보입니다.
- 수치를 읽고, 조성 막대를 보고, 위치별 GC 를 봅니다. 레코드가 여럿이면 아래 표가 비교해 주고, 이름을 누르면 위쪽 상세가 그 서열로 바뀝니다.
알아 둘 것
- GC·AT 는 A·C·G·T 인 염기를 분모로 계산합니다. 모호 염기는 길이에는 들어가지만 백분율에는 들어가지 않으며, 그것이 답을 바꾸는 경우에는 화면이 몇 개인지 말해 줍니다.
- GC skew 는 한 가닥 «안에서» 잰 (G − C) / (G + C) 이고 출처는 Lobry(1996)입니다. 두 가닥 사이의 비교가 아닙니다 — 상보 가닥은 정의상 정확히 반대 부호라 그렇게 재면 어디서나 0 이 됩니다.
- 헤더 없는 레코드에 붙는 이름은 일부러 ASCII 입니다. FASTA 식별자는 다른 사람의 프로그램으로 넘어가는데, 비ASCII 는 그중 적지 않은 곳에서 깨져 돌아옵니다.
자주 묻는 질문
거의 항상 모호 염기 때문입니다. N 이 있으면 전체 길이로 나눈 값이 실제로 읽힌 염기로 나눈 값보다 낮게 나오는데, 이 도구는 뒤쪽으로 계산합니다.
규칙이 아니라 무엇을 보려는지에 달렸습니다. 선이 잡음이 되지 않을 만큼 넓고, 보려는 특징이 뭉개지지 않을 만큼 좁으면 됩니다.
붙여넣은 가닥에서 G 와 C 가 같은 빈도로 나온다는 뜻입니다. skew 를 만드는 압력이 없는 서열에서는 흔한 일이고 오류가 아닙니다.
다른 서열 도구
- DNA 단백질 번역 Tool — 6개 해독틀 번역과 ORF 찾기. NCBI 유전암호표를 고를 수 있습니다.
- 프라이머 Tm 계산 Tool — nearest-neighbor 모델로 융해온도를 구합니다
- FASTA 정리 도구 — 붙여넣은 FASTA 를 정리하고 정렬은 그대로 둡니다.