Sequence Analysis
FASTA 정리 도구
붙여넣은 FASTA 를 정리합니다. 잡문자 제거·줄바꿈·이름 부여, 갭은 유지합니다.
예제가 들어 있습니다. 여기를 누르면 지워집니다.
예제:
설정
정리 결과
- 레코드
- 5
- 총 길이
- 119
- 제거된 문자
- 1
- 이름 자동 생성
- 1
- 중복 번호 부여
- 1
- 빈 레코드 제외
- 1
| 이름 | 길이 | 상태 |
|---|---|---|
| sequence | 20 | 이름 자동생성 |
| clone_1 first pick | 39 | 정상 |
| clone_1 second pick from the same plate | 20 | 정상 |
| clone_2 backup | 20 | 정상 |
| clone_2 backup_2 | 20 | 중복 (번호 붙음) |
정리된 글은 그대로 정렬 도구에 붙여넣을 수 있습니다.
사용 방법
- 가진 것을 그대로 붙여넣습니다 — FASTA 파일이든, 왼쪽에 위치 번호가 붙은 덩어리든, 헤더 없는 생 서열이든 됩니다.
- 줄바꿈 폭과 대소문자를 정합니다. 정렬 결과에서 가져온 것이면 갭 체크는 그대로 두세요.
- 집계를 읽고 레코드별 표를 확인한 뒤, 정리된 파일을 복사하거나 내려받습니다.
알아 둘 것
- 갭은 기본으로 유지합니다. 정렬에서 갭을 빼면 각 줄이 여전히 서열처럼 보이면서 서로 안 맞게 되는데, 그 뒤 어느 도구도 알아채지 못합니다.
- 중복된 이름은 그대로 두지 않고 번호를 붙입니다. 이름을 키로 쓰는 프로그램은 그러지 않으면 하나만 남기고 나머지를 조용히 버립니다.
- 아미노산은 살아남습니다. 염기 코드만 아는 정리 도구는 단백질 서열에서 E·F·I·L·P·Q 를 지우고 그것을 정리했다고 보고합니다.
자주 묻는 질문
서열 글자도 갭도 아닌 것입니다. 공백·줄바꿈과 일부 뷰어가 왼쪽에 찍는 위치 번호는 세지 않습니다 — 그것은 누가 입력한 것이 아니라 배치이기 때문입니다.
헤더만 있고 서열이 없는 레코드는 제외하고 따로 셉니다. 사라진 레코드는 「빈 레코드 제외」 칸에 있습니다.
헤더 줄의 첫 낱말입니다. 나머지는 설명으로 남아 레코드와 함께 갑니다.
다른 서열 도구
- 다중 서열 정렬 Tool — 여러 서열을 한 번에 정렬하고 보존된 컬럼을 확인합니다.
- GC 함량 계산기 — GC·AT 함량과 skew, 위치별 GC 함량을 봅니다.
- DNA 단백질 번역 Tool — 6개 해독틀 번역과 ORF 찾기. NCBI 유전암호표를 고를 수 있습니다.