PLM
xBindは、大規模言語モデル(LLM)を活用した、分子間(タンパク質間、タンパク質-DNA間、タンパク質-RNA間)のタンパク質結合部位予測を行うための、対話型かつ自由に利用可能な、高度にカスタマイズ可能なウェブサーバーである。xBindは、ESM-2モデル由来…
2026/07/14 追記 タンパク質配列のアラインメントはバイオインフォマティクスにおける重要な課題だが、特にギャップの扱いの難しさから、配列同一性が低い遠縁の相同タンパク質(リモートホモログ)をアラインメントすることは依然として困難な課題となって…
2025/11/05 誤字修正 メタゲノムシーケンシングの急速な発展により、メタゲノムアセンブルゲノム(MAG)の前例のない膨大なデータが生成され、微生物の発見および機能的特徴づけの機会が一変した。しかしながら、これらの資源を完全に活用することは、データ…
ProTrekは、配列、構造、自然言語機能(SSF)をシームレスに融合し、先進的なトライモーダル言語モデルにすることで、タンパク質探索を再定義する。対照学習により、ProTrekはタンパク質データと人間の理解とのギャップを埋め、9つのSSFペアワイズモダリティの…
配列比較による相同性の検出は、タンパク質の機能と進化の研究における典型的な最初のステップである。この研究では、タンパク質言語モデルのこのタスクへの適用可能性を探る。pLM-BLASTはBLASTにインスパイアされたツールであり、タンパク質言語モデルProtT…
2026/07/11 追記 Homologous protein searchは、タンパク質のアノテーションや解析に最もよく使われる手法の一つである。構造検索と比較して、配列のみから遠い進化関係を検出することは依然として困難である。ここでは、配列のみを入力とするHomologous pro…