配列解析
FASTA 整形ツール
貼り付けた FASTA を整えます。余分な文字の除去・折り返し・命名、ギャップは残します。
例が入っています。ここを押すと消えます。
例:
設定
整形結果
- レコード
- 5
- 合計長
- 119
- 除去した文字
- 1
- 自動で付けた名前
- 1
- 番号を振った重複
- 1
- 除いた空レコード
- 1
| 名前 | 長さ | 状態 |
|---|---|---|
| sequence | 20 | 名前を自動生成 |
| clone_1 first pick | 39 | 正常 |
| clone_1 second pick from the same plate | 20 | 正常 |
| clone_2 backup | 20 | 正常 |
| clone_2 backup_2 | 20 | 重複 (番号を付与) |
整形した文字は、そのままアライメントツールに貼り付けられます。
使い方ガイド
- 手元にあるものをそのまま貼り付けます。FASTA ファイルでも、左に位置番号が付いた塊でも、ヘッダーのない生の配列でも構いません。
- 折り返し幅と大文字・小文字を決めます。アライメントから持ってきたものなら、ギャップのチェックはそのままにしてください。
- 集計を読み、レコードごとの表を確認してから、整形したファイルをコピーするかダウンロードします。
知っておくとよいこと
- ギャップは既定で残します。アライメントからギャップを取ると、各行は配列のように見えたまま互いにそろわなくなり、その先のどのツールも気づきません。
- 重複した名前はそのままにせず番号を振ります。名前をキーにするプログラムは、そうしないと 1 件だけ残してほかを静かに捨てるからです。
- アミノ酸は残ります。塩基のコードしか知らない整形ツールは、タンパク質配列から E・F・I・L・P・Q を消し、それを整形したと報告します。
よくある質問
配列の文字でもギャップでもないものです。空白・改行や、一部のビューアーが左に付ける位置番号は数えません。それらは誰かが入力したものではなく体裁だからです。
ヘッダーだけで配列のないレコードは除いて別に数えます。消えたレコードは「除いた空レコード」の欄にあります。
ヘッダー行の最初の単語です。残りは説明として保たれ、レコードと一緒に運ばれます。
ほかの配列ツール
- マルチプルアライメント — 近縁の配列を並べて、保存領域を読み取ります。
- GC 含量計算ツール — GC・AT 含量とスキュー、位置ごとの GC 含量を見ます。
- DNA タンパク質翻訳ツール — 6 つの読み枠の翻訳と ORF 検索。NCBI の遺伝暗号表を選べます。