Cursorは9月23日、新たな開発ボットを2つ発表した。Rolloutsは、変更がマージされてから本番環境に届くまでの全過程を監視し、リグレッションを検知すると復旧を試みる。Security Reviewerは各プルリクエスト(PR)ごとにセキュリティレビューを実行し、脆弱性の説明と修正案を提示する。いずれもTeamsおよびEnterpriseプラン向けで、Cursorのautomationsタブから有効化する。
Rollouts:マージ前に監視計画を組み立てる
Cursorの説明によると、Rolloutsは "watches a change from PR to production, flags regressions, and acts to restore a healthy state"、つまり変更をPRから本番環境まで追跡し、リグレッションを検知した場合は健全な状態への復旧を図る。
連携対象は、コードホスティング、デプロイシステム、そしてDatadog、Grafana、Honeycombといったテレメトリツールの3種類。処理は2段階に分かれる。マージ前にはコード差分を読み取ってリスクを判断し、それをもとに監視計画を生成する。今回の変更に関わる指標が計測すらされていない場合は、マージ前にその旨を警告する。デプロイ後には本番データをベースラインと比較し、特定のエンドポイントや特定の地域だけに現れるリグレッションを検出できるほか、「想定内の変化」と「実際の問題」を切り分けようとする。たとえばレート制限のしきい値を変更しただけの場合、それを障害として扱わないようにする。
フィーチャーフラグとの連携やリリーススケジュールの把握については、Cursorはまだ計画段階だとしている。「健全な状態への復旧」が具体的に自動ロールバックをどこまで行うのか、人による確認が必要なのかについて、発表文はあいまいで、今後のドキュメントを待つ必要がある。
Security Reviewer:コードの流れをたどって調べる
Security Reviewerは "runs on every PR, reads the change in the context of the whole codebase" と位置づけられている。データがどこから入りどこへ出るのかをコードフローに沿って追跡する点が、ルールマッチングだけに頼るスキャナーとの違いだとCursorは強調する。検出範囲は次の通り。
- SQL、コマンド、テンプレート、LDAPなどのインジェクション;
- 認証・認可の不備;
- 認証情報の漏洩;
- 安全でないデシリアライズやリダイレクト;
- 依存関係の脆弱性やインフラ設定の問題。
Cursorが示したデータによると、平均レビュー時間は4.8分から3.8分に短縮し、コメント採用率は45~50%から60~70%に上昇した。発表ではこの数値が自社の旧バージョンと比較したものなのか、他社製品と比較したものなのかは明かされておらず、サンプル数や計測期間も公開されていない。「採用率」は開発者がボットのコメントを取り入れた割合を指すのであって、脆弱性の検出率とは異なるため、両者を混同すべきではない。
同種のツールの中に位置づける
AIによるコードレビューの分野は今年、かなり混み合ってきた。Anthropicは2025年にClaude Codeへ/security-reviewコマンドを追加し、各PRで自動的にセキュリティチェックを行う対応するGitHub Actionも用意した。GitHub Security Labは今週、侵入口の特定から脆弱性レポートの作成までを一気通貫で行う、大規模言語モデル駆動のファジングパイプラインを公開したばかりだ。Cursor自身のBugbotも6月にアップデートされ、速度が3倍以上、コストが22%削減、検出できるバグが10%増えたとしている。
各社のアプローチには違いがある。Claude Codeのセキュリティレビューおよび Bugbotはいずれも「マージ前」にとどまる。GitHubのパイプラインはセキュリティ研究寄りで、成熟したオープンソースプロジェクトを深く掘り下げることを狙う。Cursorは今回さらに一歩踏み込み、Rolloutsをデプロイ後の領域まで広げ、SREや運用チームの持ち場に踏み込んだ。この領域では以前からDatadogのWatchdogや各種APMツールの異常検知が使われてきたが、Cursorの違いは、その変更のコードを読んだ上で、どの指標を注視すべきかを把握している点にある。
チームにとっては、機能をオンにするのはあくまで最初の一歩にすぎない。Rolloutsはデプロイシステムと監視プラットフォームへのアクセス権を必要とし、「健全な状態への復旧」は実運用上、直接ロールバックを実行することを意味しかねない。こうした権限を持つボットを、大企業の変更管理プロセスが受け入れられるかどうかは、機能そのものよりも難しい課題だ。Cursorは現時点で具体的な権限モデルや監査ログの設計を公開していない。
参考資料:CocoLoop、Cursor公式ブログ、GitHubブログ、Anthropic Claude Codeドキュメント;Security Reviewerのレビュー時間とコメント採用率、対象プラン、検出範囲について検証済み。