macでインフォマティクス

macでインフォマティクス

HTS (NGS) 関連のインフォマティクス情報についてまとめています。

GenBank

タンパク質のドメインレベルのアノテーションを行う Domainator

2024/06/03 タイトル修正、誤字修正 生物学的配列の大規模なデータベースが利用可能になったことで、遺伝子の多様性と機能を深く探求する機会がもたらされた。細菌防御系は、多様であるがアノテーションが困難な遺伝子の豊富な供給源であり、バイオテクノロ…

ライフサイエンスのための包括的なフォーマットコンバーター BioConvert

2023/07/04 追記 バイオインフォマティクスは、長年にわたって開発されてきた数多くの標準やフォーマットで知られる分野である。このフォーマットの多さは時に補完的であり、しばしば冗長であるため、バイオインフォマティクスのデータ解析者に多くの課題を…

細菌・古細菌の環状ゲノムプロットを出力する GenoVi

2023/04/10 タイトル変更 2023/04/11追記 2024/04/20 dockerイメージ追記 純粋培養やメタゲノムから得られる微生物のゲノム配列の増加は、全ゲノムおよびショットガンシーケンス法の現在の達成可能性を反映している。しかし、ゲノムの可視化のためのソフトウ…

Genbankファイルから遺伝子のnon-coding RNAの配列を取り出す gbseqextractor

gbseqextractorはタイトルの通りgbseqextractorはGenbankファイルから遺伝子やrNRA、tRNAの配列を返すツール。Biopython (http://www.biopython.org/) が使われている。 インストール Github #ここではcondaの仮想環境に導入。mamba create -n gbseqextracto…

GenBank Flat File FormatとJSON間の変換を行う GBSON

HPの解説より GenBank Flat File Format (.gb または .gbk) は、核酸やタンパク質の配列とそのアノテーションを保存できるファイルフォーマットとして広く利用されている。NIHの遺伝子配列データベース「GenBank」(https://www.ncbi.nlm.nih.gov/genbank/)…

GenBankファイルから配列とメタデータを取り出す gbmunge

この小さなCプログラムgbmungeは、GenBankファイルをFASTA配列とタブで区切られたメタデータに変換する。 GenBankファイルから以下の情報を抽出する。 名前 アクセッション 長さ 投稿日 ホスト 国 収集日 これらの情報を抽出するだけでなく、日付はBEASTのよ…

原核生物の遺伝子配列をGenBankファイルから簡単に検索するためのウェブツール BAGET 2.0

細菌ゲノムや古細菌ゲノムの完全シークエンスから単一の遺伝子配列とコンテキストを検索することは、ウェットベンチ生物学者にとっては気が遠くなるような作業である。既存のウェブベースのゲノムブラウザは、日常的に使用するには複雑すぎるか、原核生物ゲ…

GenbankアクセッションIDからtaxonomyを返す acc2tax

タイトルの通りのツール。 インストール macos標準のclangでビルドした。 Github git clone https://github.com/richardmleggett/acc2tax.gitcd acc2tax/cc -o acc2tax acc2tax.c#パスの通ったディレクトリにコピーcp acc2tax /usr/locasl/bin/ > acc2tax -h…

GenBankから配列やアノテーションを取り出すWebサービス FeatureExtract

イントロン/エクソン構造、プロモーター領域の内容、上流域および下流域における他の遺伝子の位置など、DNA配列の特徴のアノテーションに簡単にアクセスできることは、多くの生物学的問題に取り組むことが非常に有益である。たとえば、遺伝子内のイントロン…

EMBOSSのseqretを使ってfastaファイルを修復する

2019 6/19 インストール追記 2019 7/15 タイトル修正 2019 8/7リンク追加 2019 10/3コメント追加 fastaファイルfをいじっていると、何らかの拍子に構造がおかしくなってsamtoolsのindexでsegmentation errorを起こすことがある。途中に空行ができていたり、…