本文へスキップ

TANKBind

TANKBindは、タンパク質–リガンド結合構造と親和性を予測する研究モデルです。リポジトリには、予測、データセット準備、セルフドッキング評価、バーチャルスクリーニング用のノートブックが含まれています。

掲載情報の更新 ·

概要

TANKBindは、NeurIPS 2022の論文 “TANKBind: Trigonometry-Aware Neural NetworKs for Drug-Protein Binding Structure Prediction” に付随するものです。このリポジトリは、論文の結果の再現と、モデルを基盤とするさらなる研究を支援することを目的としています。文書に記載された予測対象はタンパク質–リガンド結合構造と結合親和性であり、実験的な結合アッセイではなく、計算創薬ワークフローの予測コンポーネントとして位置付けられています。

プロジェクトのREADMEでは、実際の作業がノートブック単位で整理されています。構造予測の例では、PDB: 6HD6で識別されるABL1とImatinibおよびcompound6を使用します。ほかのノートブックでは、PDBbindの学習用・テスト用データセットの構築、セルフドッキング評価、LRRK2のWDRドメインを対象としたハイスループット・バーチャルスクリーニングを扱います。ワークフローの概要として、モデルはタンパク質とリガンドの情報を入力として結合予測を出力しますが、抜粋には完全な入力スキーマ、前処理要件、出力ファイル形式は記載されていません。例を改変する前に、ノートブックで詳細を確認する必要があります。

インストール案内では、Pythonベースの環境、PyTorch、複数の科学計算用依存関係に加え、外部からのp2rankのダウンロードが挙げられています。また、GPUに応じてCUDAツールキットの選択を調整する必要がある場合があると記載されています。READMEは、新しいモデルを利用するための別個のアカウント制サービスを案内しているため、そのサービスをリポジトリの実装と同一のものとして扱うべきではありません。報告されているスクリーニングのスループットは情報源による主張であり、別のデータセットやハードウェア構成で独立に確立されたベンチマークではありません。

主な機能

  • タンパク質–リガンド結合構造と結合親和性を予測します。
  • PDB: 6HD6で識別されるABL1、Imatinib、compound6を用いた構造予測ノートブックを提供します。
  • 論文のセルフドッキング・テストセット評価を再現するためのノートブックを含みます。
  • PDBbindの学習用・テスト用データセットを構築するノートブックと、文書化されたモデル学習の呼び出し方法を提供します。
  • LRRK2のWDRドメインを対象とするハイスループット・バーチャルスクリーニングのノートブックを含みます。

用途

  • 評価案:ABL1の例を使い、文書化された構造予測ワークフローを研究対象のタンパク質–リガンドペアに適用できるか評価します。
  • 評価案:文書に記載されたデータセットを再構築してセルフドッキングのノートブックを実行し、論文の評価の再現性を調べます。
  • 評価案:LRRK2 WDRスクリーニングのノートブックを、計算による候補優先順位付けの出発点として検討し、想定するワークロードでスループットと予測の有用性を測定します。

使い方

  1. 公式READMEを読み、構造予測、セルフドッキング評価、データセット構築、バーチャルスクリーニングから選択します。リポジトリのワークフローと、リンク先のアカウント制サービスは区別して扱ってください。
  2. READMEの環境構築手順に従います。Python 3.8と科学計算用依存関係が指定されており、GPUに応じてCUDAツールキットの選択を調整するよう案内されています。これらの説明は、ほかの構成との互換性を示すものではありません。
  3. 文書に記載されたp2rankのダウンロードを確認し、研究データを準備する前に、選択したノートブックで実際の入力要件と前処理要件を調べます。
  4. ABL1の例には examples/prediction_example_using_PDB_6hd6.ipynb から、スクリーニングのワークフローには examples/high_throughput_virtual_screening_LRRK2_WDR.ipynb から取りかかります。いずれの例も改変する前に、生成された出力を確認してください。
  5. 再現を試みる場合は、まず examples/construction_PDBbind_training_and_test_dataset.ipynb.ipynb を確認し、続いて examples/testset_evaluation_cleaned.ipynb を確認します。ローカルの設定と実測結果を記録し、READMEに報告されたスループットが自分の環境でも得られると仮定しないでください。

関連リソース

AIDDISON Explorer

プラットフォーム

AIDDISON Explorerは、目標プロファイル、設計上の制約、予測物性、合成可能性に基づいて分子候補を生成し、順位付けするホスト型創薬プラットフォームです。

分子生成 · 創薬

AutoDock Vina

オープンソース

AutoDock Vinaは、VinaおよびAutoDock4.2スコアリング、複数リガンドのドッキング、マクロサイクル対応、Python 3バインディングを備えたオープンソースの分子ドッキング・バーチャルスクリーニングプログラムです。

オープンソースPython

創薬

Boltz

モデル

Boltz は生体分子相互作用の予測モデル群です。Boltz-2 は複合体構造と結合親和性の予測手順を提供します。

オープンソースPython

創薬

ChEMBL MCP (cyanheads) は、MCP クライアントを ChEMBL の化合物、標的、生物活性、医薬品の記録に接続し、構造検索と、オプションで DuckDB を用いた大規模な活性データセットの分析を提供します。

オープンソースTypeScript

創薬 · 科学データ

ChEMBL データとケモインフォマティクスサービスのクエリに使用する、ChEMBL グループが保守する公式 Python クライアント。QuerySet 形式のフィルター、遅延取得、ローカルでの結果キャッシュを備えています。

オープンソースPython

創薬 · 科学データ

Chemistry42

プラットフォーム

Chemistry42 は、生成的設計、逆合成、ADMET と選択性の予測、物理ベースの優先順位付けを組み合わせた小分子創薬プラットフォームで、ヒット同定とリード最適化を支援します。

分子生成 · 創薬

関連ガイド

エージェント

化学AIエージェント入門:チャットから研究ワークフローへ

化学および生物医学研究向けの8つのエージェントを取り上げる実践ガイドです。ツール、メモリ、計画、多エージェントの役割の仕組み、タスク別に適したプロジェクト、科学的監督のもとで限定的な自律性を評価する方法を解説します。

ワークフロー

AI創薬ツール:Agents・MCP・研究プラットフォームの選び方

ワークフローの段階に応じてツールを選択します。標的の根拠、タンパク質構造、既知の結合部位、分子生成、特性解析、スクリーニングを対象に、研究用エージェント、MCP連携、ホスト型API、プラットフォームを比較し、提案するエンドツーエンドの例と実践的な評価ゲートを示します。

ワークフロー

タンパク質・構造生物学のAIワークフロー:UniProt・RCSB PDB・Agent

タンパク質の同定情報と配列から、RCSB の構造メタデータ、観察されたリガンド接触、提案する下流候補評価まで、証拠に基づくタンパク質ワークフローを構築します。生物種、アイソフォーム、鎖、欠損データ、実験的検証について明示的に確認します。