概要
UniProt MCP (cyanheads) は @cyanheads/uniprot-mcp-server として配布され、UniProt REST データへの MCP インターフェースを提供します。これはサードパーティ製の統合であり、UniProt データベースそのものではありません。提供された資料からは、上流組織による推奨は確認できません。その役割は、MCP クライアントが研究ワークフロー中にタンパク質の根拠情報や識別子を取得できるようにすることであり、タンパク質の性質を予測したり、自律的に研究を行ったりすることではありません。README には、ローカル STDIO、セルフホスト型 Streamable HTTP、公開ホスト型エンドポイントが記載されています。
入力には、タンパク質機能に関するテキスト、Lucene フィールドクエリ、アクセッション、データベース識別子、学名、分類群またはプロテオーム ID が含まれます。出力には、ページ分割された検索結果、セクション別の注釈レコード、識別子マッピング結果、プロテオームのメタデータ、分類系統、標準配列またはオプションのアイソフォーム配列が含まれます。検索では、デフォルトでレビュー済みの Swiss-Prot エントリーが対象になります。注釈出力にはキュレーションの指標と利用可能な PubMed/ECO の根拠情報が保持されるため、クライアントは注釈の由来を区別できます。付属の dossier プロンプトは、識別子の解決、注釈の取得、構造・生物活性・引用文献の相互参照の探索をガイドします。
このサーバーを統合する際には、いくつかの制約に留意してください。識別子マッピングは非同期であり、返されたチケットをポーリングした後、別途、結果ページの続きを取得する必要がある場合があります。大きな注釈レコードでは概要のみが返され、特定のセクションを取得するには追加呼び出しが必要になることがあります。プロテオームのタンパク質一覧は明示的に要求する必要があり、件数にも上限があります。上流データにないフィールドは欠落したままとなり、一括エントリー取得では成功と失敗が個別に報告されます。2 つの URI リソースはエントリーおよび分類学ツールに対応しますが、データベース全体のリソース列挙には対応していません。リポジトリのコードは Apache-2.0 で提供されており、UniProt データの利用条件やホスト型サービスの運用とは別個のものです。
主な機能
- `uniprot_search_proteins` によるタンパク質検索。自然文または Lucene クエリ、生物種フィルタリング、レビュー済みエントリーを既定とする設定、オプションのファセット、カーソルによる前方ページネーションに対応します。
- `uniprot_get_entry` によるセクション別注釈の取得。最大 20 件のアクセッションの一括処理、アクセッションごとの失敗報告、フィールド投影、巨大レコードに対する概要ベースの追加取得に対応します。
- `uniprot_map_ids` による非同期のデータベース横断識別子マッピング。再開可能なジョブチケット、完了済みページの継続取得、分類群に基づく遺伝子シンボルの曖昧性解消に対応します。
- 識別子または学名によるプロテオームおよび分類情報の検索。プロテオームの完全性メタデータ、分類系統、オプションの直接の下位分類群、件数上限付きのタンパク質一覧を含みます。
- 標準 FASTA 配列とその長さ、解析済みヘッダーを取得し、必要に応じて選択的スプライシングによるアイソフォーム配列も取得できます。
- エントリーおよび分類学の URI リソースに加え、注釈や相互参照の取得をガイドする `uniprot_protein_dossier` プロンプトを提供します。
用途
- 評価案:機能、局在、疾患との関連、バリアント、PDB・ChEMBL・PubMed の相互参照など、文書化された情報を統合してタンパク質標的 dossier を作成する。
- 評価案:Ensembl、RefSeq、遺伝子シンボル、その他の対応する識別子を UniProtKB アクセッションに照合し、生物種の曖昧性と未マッピング結果を明示的に確認する。
- 評価案:分類の解決、プロテオームメタデータ、フィルタリングしたタンパク質一覧を使って、生物種固有のタンパク質サブセットを作成する。
- 評価案:注釈の由来情報とともに標準配列やアイソフォーム配列を取得して後続解析に用いる。ただし、取得を科学的検証とみなさない。
使い方
- リポジトリ READMEを読み、ホスト型 Streamable HTTP またはローカルデプロイを選びます。README には STDIO と HTTP のクライアント設定が示されています。UniProt REST へのアクセスに API キーは不要です。
- ホスト型の方法を使う場合は、MCP クライアントに https://uniprot.caseyjhand.com/mcp を設定します。ローカルでセットアップする場合は、README にあるパッケージまたはコンテナの設定に従います。Bun の要件が README の前提条件と異なるため、ランタイムを選ぶ前に package.json を確認してください。
uniprot_get_taxonomyで生物種を解決し、その後uniprot_search_proteinsで機能または遺伝子を検索します。名前の一致だけに頼らず、レビュー状況と注釈の根拠情報を確認してください。uniprot_get_entryで選択したアクセッションを取得します。失敗したアクセッションは個別に処理し、概要が返された場合は特定のセクションを要求します。識別子マッピングでは、ワークフローが完了するまでチケットと継続取得情報を保持してください。- 必要に応じて配列やプロテオームのサブセットを取得するか、
uniprot_protein_dossierを使って検索をガイドします。初期評価として、取得した注釈を UniProt と比較し、未解決の識別子と欠落フィールドを記録します。