TREX: コードを実行してバグを発見するAIコードレビューシステム
TREX: An AI code reviewer that runs your code
Greptileは、コードを実行してバグを発見するAIコードレビューシステム「TREX(Test, Run, Execute)」を開発しました。従来の静的コードレビューはコード自体を読むことに限界があり、実行時に発生するバグを見逃す可能性がありました。TREXは、プルリクエストのレビューに加えてコードを実行し、問題が発生した場合にその詳細を表示します。TREXは、メインのGreptileレビュー担当エージェントが問題を特定し、個別のTREXサブエージェントを並列で起動するオーケストレーションアーキテクチャを採用しています。各サブエージェントは、スクリーンショット、ログ、APIトレース、実行スクリプトなどのマルチモーダルな成果物を生成し、レビュー担当者が実行内容を検証できるようにします。また、TREXは特定のモデルに依存しない評価ハーネスを備えており、複数のモデルを切り替えて使用することが可能です。レビューは、隔離されたサンドボックス化された環境で実行され、再現可能な実験として証拠とともに提示されます。Greptileは、TREXを単なるコードレビューツールではなく、バグのない世界を目指すための検証スイートと位置づけています。
- Greptileがコードを実行してバグを発見するAIコードレビューシステム「TREX」を開発・発表した
- TREXはマルチエージェント・オーケストレーションアーキテクチャを採用し、プルリクエストレビューに加えてコードを実行し問題の詳細を表示する
- TREXは特定のモデルに依存しない評価ハーネスを備え、複数のモデルを切り替えて使用可能
従来の静的コードレビューの限界を超え、実際にコードを実行してバグを発見するTREXは、AIエージェントによるソフトウェア品質保証の新たな領域を切り開く。特に、マルチエージェント・オーケストレーションとサンドボックス実行環境を組み合わせたアーキテクチャは、AIコードレビュー市場における差別化要因となり得る。Greptileがこの分野で技術的優位性を確立できれば、DevOpsツールチェーン全体の再編や、AI支援開発プラットフォームの競争構図に影響を与える可能性があるため、スタートアップの技術動向として注目したい。