Sequence Analysis
FASTA 정리 도구
붙여넣은 FASTA 를 표준 형식으로 정리합니다.
예제가 들어 있습니다. 여기를 누르면 지워집니다.
예제:
설정
정리 결과
- 레코드
- 5
- 총 길이
- 119
- 제거된 문자
- 1
- 이름 자동 생성
- 1
- 중복 번호 부여
- 1
- 빈 레코드 제외
- 1
| 이름 | 길이 | 상태 |
|---|---|---|
| sequence | 20 | 이름 자동생성 |
| clone_1 first pick | 39 | 정상 |
| clone_1 second pick from the same plate | 20 | 정상 |
| clone_2 backup | 20 | 정상 |
| clone_2 backup_2 | 20 | 중복 (번호 붙음) |
정리된 결과는 그대로 정렬 도구에 붙여넣을 수 있습니다.
사용 방법
- 보유한 형태 그대로 붙여넣습니다. FASTA 파일, 왼쪽에 위치 번호가 붙은 형태, 헤더 없는 생 서열 모두 가능합니다.
- 줄바꿈 폭과 대소문자를 설정합니다. 정렬 결과에서 가져온 것이면 갭 유지 설정은 그대로 두세요.
- 집계를 확인하고 레코드별 표를 점검한 뒤, 정리된 파일을 복사하거나 내려받습니다.
알아 둘 것
- 갭은 기본적으로 유지합니다. 정렬에서 갭을 제거하면 각 행이 여전히 서열처럼 보이면서 서로 정합되지 않게 되는데, 이후 어떤 도구도 이를 감지하지 못합니다.
- 중복된 이름은 그대로 두지 않고 번호를 부여합니다. 이름을 키로 사용하는 프로그램은 그러지 않으면 하나만 남기고 나머지를 임의로 폐기합니다.
- 아미노산은 보존됩니다. 염기 코드만 인식하는 정리 도구는 단백질 서열에서 E·F·I·L·P·Q를 제거하고 정리를 완료했다고 보고합니다.
자주 묻는 질문
서열 문자도 갭도 아닌 것입니다. 공백·줄바꿈과 일부 뷰어가 왼쪽에 표시하는 위치 번호는 계수하지 않습니다. 사용자가 입력한 것이 아니라 표시 형식이기 때문입니다.
헤더만 있고 서열이 없는 레코드는 제외하고 따로 셉니다. 사라진 레코드는 「빈 레코드 제외」 칸에 있습니다.
헤더 행의 첫 단어입니다. 나머지는 설명으로 남아 레코드와 함께 유지됩니다.
다른 서열 도구
- 다중 서열 정렬 Tool — 여러 서열을 한 번에 정렬하고 보존된 열을 확인합니다.
- GC 함량 계산기 — GC·AT 함량과 skew, 위치별 GC 함량을 표시합니다.
- DNA 단백질 번역기 — 해독틀 6개 번역과 ORF 찾기. NCBI 유전암호표를 선택할 수 있습니다.