T3MP3STは、既存のAIコーディングエージェントをレッドチーム向けの自動化フレームワークに変換するオープンソースプロジェクトです。Pliny the LiberatorがAGPL-3.0ライセンスで公開したこのツールは、reconからexploit、reportまでのキルチェーンを1つのWar Room UIで完結させます。CTFやCVE検証での実績が公開されており、セキュリティ研究者向けの新選択肢として注目されています。
📑目次
T3MP3STの概要と背景
T3MP3STは、Claude CodeやCodexなどの既存エージェントを「ハックボットスウォーム」として再利用するためのフレームワークです。開発者は「誰でもゼロデイハンターになれる」と位置づけ、公式GitHubリポジトリでソースコードとベンチマーク結果を公開しています。
主な特徴は以下の通りです。
- ユーザーの既存エージェントをそのまま活用(追加APIキー不要)
- フルキルチェーン自動化(recon → exploit → report)
- War Room UIによるリアルタイム操作
- Evidence Vaultによる証拠管理とOPSEC機能
公式リポジトリのREADMEによると、T3MP3STはローカルモデル(Ollamaなど)にも対応し、クラウドコストを抑えつつ大規模検証を可能にします。Xの発表ポストでも、XBOWやCybenchでの高スコアが共有されています。
キルチェーンと8オペレーターアーキテクチャ
T3MP3STの核心は8つのオペレーターが連携するセル構造にあります。各オペレーターは独立した役割を持ち、Evidence VaultとOPSECレイヤーを通じて協調動作します。
| オペレーター | 役割 | ステータス |
|---|---|---|
| Recon | ターゲット調査・情報収集 | Stable |
| Scanner | 脆弱性スキャン | Stable |
| Exploiter | 攻撃実行 | Experimental |
| Infiltrator | 侵入・権限昇格 | Experimental |
| Exfiltrator | データ持ち出し | Experimental |
| Ghost | 痕跡隠蔽 | Planned |
| Coordinator | タスク調整 | Stable |
| Analyst | レポート生成 | Stable |
このテーブルは公式READMEのステータス表に基づきます。ReconとCoordinatorは安定版として利用可能ですが、Exploiter以降のモジュールは実験段階である点に注意が必要です。出典: https://github.com/elder-plinius/T3MP3ST(2026年7月時点)
ベンチマーク結果と再現性検証
公式リポジトリでは、以下のベンチマーク結果が公開されています。
- XBEN(104課題スイート): 90.1% pass@1(Wilson-95区間 86.2–92.9)
- Cybench(40タスク、ヒントなし): 23/40(58%) with Opus 4.8
- CVE-Zero(2026年以降の10 CVE、7言語): single-agentで8/10 exact match
これらの数値は npm run verify-claims コマンドで再現可能です。リポジトリにコミットされたJSONアーティファクトから全24件の主張が検証済みであることが確認されています。再現性を重視する研究者にとって、コミット済み証拠は大きな利点です。
インストール・War Roomの使い方
インストール手順はシンプルです。
- リポジトリをクローン
npm install && npm run serverを実行- ブラウザで http://127.0.0.1:3333/ui/ にアクセス
War Room UIにローカルエージェントを接続すると、ミッション作成から実行、レポート生成までをGUIで操作できます。キーレスモードでは外部APIを介さず、ローカルモデルだけで動作します。
対応ドメインとステータス
T3MP3STはWeb、CTF、CVE、Cloud、DeFi、Binary、Mobileなど複数のドメインに対応予定です。現在の安定機能はRecon、Mission engine、Arsenal(35+ツール)、Egress-scope containment、Coordinated-disclosure pipelineです。Cloud/Mobile/Binaryモジュールは実験的または計画段階にあります。
利用上の注意点と認可要件
T3MP3STは攻撃ツールであるため、明示的な許可を得たシステムでのみ使用してください。AGPL-3.0ライセンスの下で公開されていますが、無許可のターゲットへの使用は法的リスクを伴います。セキュリティポリシーやガバナンス担当者は、社内での利用可否を事前に確認する必要があります。
関連記事:
- Arbor:Claude Code・Codexを2.5倍上回るHypothesis-Tree AI最適化フレームワーク【2026年】
- Google Agent Development Kit (ADK) オープンソース公開 — 生産グレード multi-agent 構築フレームワーク
- Meta、Applied AIエンジニアのClaude Code/Codex利用を事前承認制に制限 — 蒸留リスクとLlama学習データ保護
よくある質問(FAQ)
まとめと読者が次に取るべきアクション
T3MP3STは、既存のAIエージェントをレッドチーム用途に転用する実用的なフレームワークです。ベンチマークの再現性とWar Room UIの利便性が強みですが、攻撃ツールとしての性質上、利用には厳格な認可管理が求められます。
読者が次に取るべきアクションは以下の通りです。
- 公式GitHub https://github.com/elder-plinius/T3MP3ST をクローンしてローカルで試す
npm run verify-claimsでベンチマークを自分で再現する- 自社セキュリティポリシーとの適合性を確認する
- 類似フレームワーク(Arborなど)と比較検討する
関連する新しい記事:
- CodexプラグインでClaude Codeからレビュー委譲 – This published update adds current operational context for T3MP3STとは?Claude Code / Codexをハッカースウォームに変えるオープンソースレッドチームフレームワーク.
- Keystrokeとは?Claude Code/Cursor向けn8n代替の使い方と採用判断 – This published update adds current operational context for T3MP3STとは?Claude Code / Codexをハッカースウォームに変えるオープンソースレッドチームフレームワーク.
- Docker Sandboxes(sbx)入門|Claude Code を microVM で安全に無人実行 – This published update adds current operational context for T3MP3STとは?Claude Code / Codexをハッカースウォームに変えるオープンソースレッドチームフレームワーク.
著者
krona23
IT業界20年以上の実務経験を持ち、日本国内有数のPVを誇る大規模Webサービスで事業部長・CTOを複数社で歴任。Windows/iOS/Android/Webと技術の変遷を経験し、現在はAIネイティブへの変革に注力。DevGENTでは、AIコードエディタ・自動化ツール・LLMの実践的な使い方を日英西3言語で発信中。












コメントを残す