Cursor bringt zwei Bots: Deployment-Überwachung und Sicherheitsprüfung

Cursor hat am 23. September zwei neue Entwickler-Bots vorgestellt: Rollouts überwacht eine Änderung vom Merge bis in die Produktion, meldet Regressionen und versucht, den Zustand wiederherzustellen; Security Reviewer führt bei jedem PR eine Sicherheitsprüfung durch und liefert Beschreibungen von Schwachstellen samt Fixvorschlägen. Beide richten sich an Teams- und Enterprise-Pläne und werden im Automations-Tab von Cursor aktiviert.

Rollouts: Überwachungsplan schon vor dem Merge

Laut Cursor "watches a change from PR to production, flags regressions, and acts to restore a healthy state" — Rollouts verfolgt also eine Änderung von der PR bis zum Live-Betrieb, markiert Regressionen und bringt das System in einen gesunden Zustand zurück.

Dafür muss es an drei Systemtypen angebunden werden: Code-Hosting, Deployment-Systeme sowie Telemetrie-Tools wie Datadog, Grafana und Honeycomb. Der Ablauf hat zwei Phasen. Vor dem Merge liest es den Code-Diff, bewertet das Risiko und erstellt daraus einen Monitoring-Plan; sind die betroffenen Metriken gar nicht instrumentiert, warnt es bereits vor dem Merge. Nach dem Deployment vergleicht es Live-Daten mit einer Baseline, erkennt Regressionen, die nur bei einem einzelnen Endpunkt oder in einer einzelnen Region auftreten, und versucht, "beabsichtigte Änderung" von "echtem Problem" zu unterscheiden, damit eine geänderte Rate-Limit-Schwelle nicht als Störung gewertet wird.

Cursor zufolge sind Feature-Flag-Integration und ein Bewusstsein für Release-Zeitpläne noch in Planung. Was "Zustand wiederherstellen" konkret bedeutet — wie weit automatische Rollbacks gehen und ob eine manuelle Bestätigung nötig ist — bleibt in der Ankündigung vage und soll erst in späterer Dokumentation geklärt werden.

Security Reviewer: Verfolgt den Datenfluss im Code

Security Reviewer positioniert sich als Tool, das "runs on every PR, reads the change in the context of the whole codebase". Es verfolgt im Code, woher Daten kommen und wohin sie fließen; Cursor betont, dass sich das von reinen musterbasierten Scannern unterscheidet. Zum Erkennungsumfang gehören:

  • Injection-Schwachstellen wie SQL, Command, Template, LDAP
  • Fehler bei Authentifizierung und Autorisierung
  • Offenlegung von Zugangsdaten
  • Unsichere Deserialisierung und Redirects
  • Schwachstellen in Abhängigkeiten und Infrastrukturkonfiguration

Laut Cursor sank die durchschnittliche Prüfzeit von 4,8 auf 3,8 Minuten, die Annahmequote von Kommentaren stieg von 45–50 % auf 60–70 %. Die Ankündigung erklärt nicht, ob diese Zahlen mit der eigenen früheren Version oder mit anderen Lösungen verglichen wurden; Stichprobengröße und Erhebungszeitraum werden ebenfalls nicht genannt. "Annahmequote" bedeutet nur, dass Entwickler die Kommentare des Bots übernommen haben — das ist nicht dasselbe wie eine Trefferquote bei echten Schwachstellen, beide Kennzahlen sollten nicht vermischt werden.

Im Vergleich zu ähnlichen Tools

Der Bereich KI-gestützter Code-Reviews ist in diesem Jahr ziemlich voll geworden. Anthropic hat Claude Code 2025 um den Befehl /security-review samt zugehöriger GitHub Action erweitert, die bei jedem PR automatisch eine Sicherheitsprüfung durchführt; GitHub Security Lab hat diese Woche einen von einem großen Sprachmodell gesteuerten Fuzzing-Workflow vorgestellt, der vom Auffinden von Einstiegspunkten bis zum Schreiben des Schwachstellenberichts reicht. Cursors eigener Bugbot bekam im Juni ebenfalls ein Update, das eine mehr als dreifach höhere Geschwindigkeit, 22 % geringere Kosten und 10 % mehr gefundene Bugs versprach.

Die Ansatzpunkte unterscheiden sich. Sowohl die Sicherheitsprüfung von Claude Code als auch Bugbot enden "vor dem Merge"; der GitHub-Workflow ist eher auf Sicherheitsforschung ausgelegt und gräbt tief in ausgereiften Open-Source-Projekten. Cursor geht mit Rollouts einen Schritt weiter und dehnt die Überwachung bis nach dem Deployment aus — damit betritt es das Terrain von SRE- und Ops-Teams. Dort sind seit Langem Datadogs Watchdog und Anomalieerkennung diverser APM-Anbieter aktiv; Cursors Unterschied liegt darin, dass es den Code der jeweiligen Änderung gelesen hat und daher weiß, welche Metriken relevant sind.

Für Teams ist das Einschalten der Funktion erst der Anfang. Rollouts braucht Zugriff auf Deployment-Systeme und Monitoring-Plattformen; "Zustand wiederherstellen" kann in der Praxis bedeuten, direkt einen Rollback auszulösen. Ob die Change-Management-Prozesse großer Unternehmen einem Bot mit solchen Rechten zustimmen, dürfte schwieriger umzusetzen sein als die Funktion selbst. Cursor hat bislang weder ein konkretes Berechtigungsmodell noch ein Audit-Log-Konzept veröffentlicht.

Quellen: CocoLoop, offizieller Cursor-Blog, GitHub-Blog, Anthropic-Claude-Code-Dokumentation; die Prüfzeit und Annahmequote von Security Reviewer, die verfügbaren Pläne sowie der Erkennungsumfang werden noch verifiziert.