Künstliche Intelligenz · Programmierung
KI-Agenten zum Programmieren: Claude Code vs. Codex vs. Cursor
Was jedes Tool kann, was es im September 2026 kostet, worin sie sich wirklich unterscheiden und was Studien darüber sagen, ob man damit tatsächlich schneller programmiert.
Von Dravvt · September 2026 · 9 Min. Lesezeit

Vor zwei Jahren bedeutete KI beim Programmieren vor allem Autovervollständigung: Du hast eine Zeile geschrieben, und sie hat dir die nächste vorgeschlagen. 2026 ist es üblich, ihr eine ganze Aufgabe zu übertragen, etwa einen Fehler zu beheben oder eine Funktion samt Tests hinzuzufügen, und einen Agenten das Projekt lesen, die Dateien ändern und die nötigen Befehle ausführen zu lassen.
Drei Tools bestimmen diese Diskussion: Claude Code von Anthropic, Codex von OpenAI und Cursor. Ich nutze sie in meiner täglichen Arbeit und erkläre in diesem Artikel, was jedes davon kann, was es kostet, worin sie sich wirklich unterscheiden und was Studien darüber sagen, ob sie tatsächlich schneller machen.
Was ein Programmier-Agent ist (und was ihn von Autovervollständigung unterscheidet)
Autovervollständigung schlägt vor, ein Agent handelt. Anthropic erklärt es ganz einfach: Bei einem Agenten entscheidet das Modell selbst, welche Schritte es unternimmt und welche Werkzeuge es einsetzt (Schluntz & Zhang, 2024). Beim Programmieren heißt das: Dateien lesen und bearbeiten, Befehle im Terminal ausführen und die Tests laufen lassen.
Der bekannteste Test dafür, was ein Programmier-Agent kann, heißt SWE-bench: 2294 echte Probleme aus GitHub, entnommen aus 12 Python-Projekten, bei denen oft mehrere Dateien gleichzeitig geändert werden müssen. Als der Benchmark erschien, löste das beste Modell gerade einmal 1,96 % davon (Jimenez et al., 2024). Heute melden die Unternehmen weit höhere Werte, doch jedes misst mit seinem eigenen Aufbau, sodass sich diese Ergebnisse nicht direkt miteinander vergleichen lassen.
Eine allgemeine Erklärung, was ein Agent ist, mit Beispielen über das Programmieren hinaus, findest du unter Was sind KI-Agenten?.
Claude Code (Anthropic)
Laut seiner Dokumentation ist Claude Code ein Tool, das dein Projekt liest, Dateien bearbeitet, Befehle ausführt und sich in die Entwicklungswerkzeuge einfügt, die du bereits verwendest (Anthropic, n.d.-a).
- Wo du es nutzt: Entstanden ist es im Terminal, inzwischen gibt es aber auch eine Erweiterung für VS Code (die in Cursor genauso funktioniert), ein Plugin für JetBrains, eine Desktop-App und eine Web-Version, dazu Integrationen mit GitHub Actions, GitLab und Slack (Anthropic, n.d.-a).
- Anpassung: eine Datei
CLAUDE.mdmit den Regeln des Projekts, eigene Fähigkeiten (Skills), automatische Aktionen vor oder nach jedem Schritt (Hooks), Subagenten und die Anbindung externer Werkzeuge über MCP (Anthropic, n.d.-a). - Modelle: ausschließlich die von Anthropic. Im September 2026 sind das Fable 5.1, Opus 5.5, Sonnet 5 und Haiku 4.5, und Anthropic empfiehlt, für die meisten Aufgaben mit Opus 5.5 zu beginnen (Anthropic, n.d.-b).
- Preis: Im kostenlosen Plan ist es nicht enthalten, wohl aber in allen kostenpflichtigen: Pro für 20 $/Monat, Max je nach Nutzung für 100 oder 200 $/Monat und Team ab 25 $ pro Person und Monat (Anthropic, n.d.-c, n.d.-d). Außerdem lässt es sich mit einem API-Schlüssel nutzungsbasiert abrechnen.
Seine Stärke ist, dass es sich gut automatisieren lässt: Du kannst es aus einem Skript heraus starten, mit anderen Werkzeugen kombinieren und bis ins Detail an jedes Projekt anpassen. Seine größte Einschränkung ist, dass es nur mit Modellen von Anthropic arbeitet.
Codex (OpenAI)
Codex ist der Programmier-Agent von OpenAI. Er läuft im Terminal, als Editor-Erweiterung, als Desktop-App und in der Cloud (OpenAI, n.d.-a). Die Terminal-Version ist Open Source, steht unter der Apache-2.0-Lizenz und läuft lokal auf deinem Rechner (OpenAI, n.d.-d).
- Modelle: ausschließlich die von OpenAI (OpenAI, n.d.-c).
- Preis: Codex ist in allen ChatGPT-Plänen enthalten, sogar im kostenlosen, dort allerdings mit begrenzter Nutzung. Go kostet 8 $/Monat, Plus 20 $/Monat und Pro 100 oder 200 $/Monat, mit fünf- bzw. zwanzigmal so viel Codex-Nutzung wie Plus. Business kostet 25 $ pro Nutzer und Monat, und es gibt auch die Möglichkeit, nutzungsbasiert mit einem API-Schlüssel zu zahlen (OpenAI, n.d.-b).
Sein großer Vorteil ist ganz praktisch: Wenn du schon für ChatGPT zahlst, hast du Codex bereits und brauchst kein weiteres Abo, um es auszuprobieren.
Cursor
Cursor ist etwas anderes: ein vollständiger Code-Editor auf Basis von VS Code mit integrierter KI. Sein Agent-Modus erledigt komplexe Aufgaben selbstständig, führt Befehle im Terminal aus und bearbeitet den Code (Cursor, n.d.-c). Außerdem gibt es eine Terminal-Version und Cloud-Agenten, die die Änderungen fertig zur Durchsicht liefern (Cursor, n.d.-d, n.d.-e).
- Modelle: Hier liegt der große Unterschied. Neben eigenen Modellen kannst du zwischen denen von Anthropic, OpenAI, Google und anderen Unternehmen wählen (Cursor, n.d.-a).
- Eigentümer: Seit August 2026 gehört Cursor zu SpaceX (Cursor Team, 2026). Vorerst bietet es weiterhin Modelle anderer Unternehmen an.
- Preis: Hobby ist kostenlos, Pro kostet 20 $/Monat, Pro+ 60 $/Monat und Ultra 200 $/Monat. Für Teams sind es 40 oder 120 $ pro Nutzer und Monat. Jeder Plan enthält ein bestimmtes Nutzungskontingent, das mit Cursors eigenen Modellen deutlich weiter reicht als mit denen anderer Unternehmen (Cursor, n.d.-b, n.d.-f).
Es ist die bequemste Wahl, wenn du Änderungen gern direkt im Editor siehst, sie Zeile für Zeile annimmst oder ablehnst und je nach Aufgabe das Modell wechselst.
Schneller Vergleich (September 2026)
| Claude Code | Codex | Cursor | |
|---|---|---|---|
| Wo nutzbar | Terminal, VS Code, JetBrains, Desktop, Web | Terminal, Editor-Erweiterung, Desktop, Cloud | Eigener Editor, Terminal, Cloud |
| Modelle | Nur Anthropic | Nur OpenAI | Eigene und von mehreren Unternehmen |
| Ab | Pro, 20 $/Monat | Kostenlos (begrenzt), Go 8 $/Monat | Hobby kostenlos, Pro 20 $/Monat |
| Intensive Nutzung | Max, 100 oder 200 $/Monat | Pro, 100 oder 200 $/Monat | Pro+ 60 $, Ultra 200 $/Monat |
| Stärke | Automatisierbar und stark anpassbar | Inklusive, wenn du schon für ChatGPT zahlst | Editor-Erlebnis und freie Modellwahl |
Die Preise ändern sich häufig; diese wurden am 27. September 2026 auf den offiziellen Seiten überprüft (Anthropic, n.d.-c; OpenAI, n.d.-b; Cursor, n.d.-b).
Welches du wählen solltest
- Wenn du überwiegend im Terminal arbeitest und Aufgaben automatisieren willst: Claude Code oder Codex.
- Wenn du jede Änderung lieber im Editor sehen und freigeben möchtest: Cursor.
- Wenn du schon für ChatGPT zahlst, fang mit Codex an, denn es ist bereits enthalten; wenn du schon für Claude zahlst, gilt dasselbe für Claude Code.
- Wenn du Modelle mehrerer Unternehmen ausprobieren willst, ohne dich an eines zu binden: Cursor.
- Sie schließen sich nicht aus: Claude Code lässt sich als Erweiterung in Cursor installieren (Anthropic, n.d.-a), und viele nutzen beides.
In einer Umfrage von Stack Overflow vom April 2026 waren die in den sechs Monaten davor meistgenutzten Programmier-Agenten GitHub Copilot (41 %), Claude Code (26 %), Codex (22 %) und Cursor (22 %) (Yepis, 2026). Copilot, das in diesem Vergleich nicht vorkommt, ist nach wie vor am weitesten verbreitet.
Hinter jedem Tool steht ein Unternehmen mit einer eigenen Agenten-Strategie, die ich in Die KI-Agenten von OpenAI, Google, Microsoft und Anthropic im Vergleich erkläre. Und wenn du einen Agenten suchst, der funktioniert, ohne deinen Code in die Cloud zu schicken, findest du das in Lokale KI-Agenten.
Programmiert man damit wirklich schneller?
Die ehrliche Antwort lautet: Das ist nicht klar. Die meistzitierte Studie führte METR 2025 mit 16 erfahrenen Entwicklern durch, die an ihren eigenen Open-Source-Projekten arbeiteten, überwiegend mit Cursor. Mit KI brauchten sie 19 % länger. Das Kuriose daran: Sie hatten erwartet, 24 % schneller zu sein, und waren nach Abschluss immer noch überzeugt, 20 % an Tempo gewonnen zu haben (Becker et al., 2025). Die Autoren stellen klar, dass sich das Ergebnis nicht zwangsläufig auf alle Programmierer übertragen lässt.
−19 %
Erfahrene Entwickler waren 2025 mit KI 19 % langsamer, obwohl sie glaubten, schneller gewesen zu sein (Becker et al., 2025).
2026 wiederholte METR die Studie mit neueren Tools, darunter Claude Code und Codex. Diesmal deuten die Daten darauf hin, dass KI die Arbeit tatsächlich beschleunigt, allerdings mit einer so großen Fehlerspanne, dass sich das nicht sicher behaupten lässt. METR weist zudem darauf hin, dass die tatsächliche Verbesserung vermutlich größer ist als die gemessene, weil viele Teilnehmende sich weigerten, die für sie lästigsten Aufgaben ohne KI zu erledigen (Becker et al., 2026).
Auch das Vertrauen ist nicht groß. In der Stack-Overflow-Umfrage 2025 nutzten 84 % der Programmierer KI-Tools oder hatten es vor, aber nur 33 % vertrauten der Genauigkeit ihrer Antworten. Die häufigste Klage, mit 66 %, war Code, der fast stimmt, aber eben nicht ganz (Stack Overflow, 2025).
Mein praktisches Fazit: Agenten sparen viel Zeit bei wiederkehrenden Aufgaben und in Projekten, die du nicht kennst, aber du musst alles überprüfen, was sie tun. Die Zeit, die du beim Schreiben von Code sparst, kannst du beim Überprüfen wieder verlieren.
Häufige Fragen
- Welcher KI-Agent zum Programmieren ist besser: Claude Code, Codex oder Cursor?
- Keiner gewinnt in allem. Claude Code punktet, wenn du im Terminal arbeitest und automatisieren willst; Codex, wenn du schon für ChatGPT zahlst; und Cursor, wenn du Änderungen lieber im Editor prüfst und das Modell selbst wählst. Alle drei haben Pläne ab 20 $/Monat oder weniger (Anthropic, n.d.-c; OpenAI, n.d.-b; Cursor, n.d.-b).
- Was ist besser zum Programmieren, Claude Code oder Cursor?
- Das hängt davon ab, wie du arbeitest. Claude Code ist ein stark anpassbarer Terminal-Agent, Cursor dagegen ein vollständiger Editor mit mehreren Modellen zur Auswahl. Außerdem schließen sie sich nicht aus: Claude Code lässt sich als Erweiterung in Cursor installieren (Anthropic, n.d.-a).
- Kann man mit Claude Code eigene KI-Agenten erstellen?
- Ja. Anthropic bietet das Agent SDK an, das dir dieselben Werkzeuge, denselben Agenten-Zyklus und dasselbe Kontextmanagement zur Verfügung stellt, die Claude Code verwendet, damit du eigene Agenten in Python oder TypeScript bauen kannst (Anthropic, n.d.-e).
- Was ist besser, Codex oder Claude Code?
- Beide machen sehr Ähnliches: Sie lesen das Projekt, bearbeiten Dateien und führen Befehle aus. Der praktische Unterschied liegt in den Modellen, die sie nutzen, nur von OpenAI bzw. nur von Anthropic, und darin, welches Abo du bereits hast (OpenAI, n.d.-b; Anthropic, n.d.-c).
- Ist Codex kostenlos?
- Der kostenlose ChatGPT-Plan enthält Codex mit begrenzter Nutzung. Die kostenpflichtigen Pläne beginnen mit Go für 8 $/Monat (OpenAI, n.d.-b).
- Was kostet Cursor?
- Hobby ist kostenlos. Pro kostet 20 $/Monat, Pro+ 60 $/Monat und Ultra 200 $/Monat; für Teams sind es 40 oder 120 $ pro Nutzer und Monat (Cursor, n.d.-b).
Weiterlesen
- Was sind KI-Agenten? Erklärt mit Beispielen
- Die KI-Agenten von OpenAI, Google, Microsoft und Anthropic im Vergleich
- Lokale KI-Agenten: So nutzt du sie auf deinem eigenen Rechner
- KI-Agenten bauten ein geheimes Forum — und drangen bei Hugging Face ein
- Meine Projekte: Web-Apps, Automatisierung und KI
Literaturverzeichnis
- Anthropic. (n.d.-a). Overview. Claude Code Docs. Abgerufen am 27. September 2026, von https://code.claude.com/docs/en/overview
- Anthropic. (n.d.-b). Models overview. Claude Platform Docs. Abgerufen am 27. September 2026, von https://platform.claude.com/docs/en/about-claude/models/overview
- Anthropic. (n.d.-c). Plans & pricing. Claude. Abgerufen am 27. September 2026, von https://claude.com/pricing
- Anthropic. (n.d.-d). What is the Max plan? Claude Help Center. Abgerufen am 27. September 2026, von https://support.claude.com/en/articles/11049741-what-is-the-max-plan
- Anthropic. (n.d.-e). Agent SDK overview. Claude Code Docs. Abgerufen am 27. September 2026, von https://code.claude.com/docs/en/agent-sdk/overview
- Becker, J., Rush, N., Barnes, E., & Rein, D. (2025). Measuring the impact of early-2025 AI on experienced open-source developer productivity (arXiv:2507.09089). arXiv. https://arxiv.org/abs/2507.09089
- Becker, J., Rush, N., Cunningham, T., Rein, D., & Mahamud, K. (2026, 24. Februar). We are changing our developer productivity experiment design. METR. https://metr.org/blog/2026-02-24-uplift-update/
- Cursor. (n.d.-a). Models. Cursor Docs. Abgerufen am 27. September 2026, von https://cursor.com/docs/models
- Cursor. (n.d.-b). Pricing. Cursor Docs. Abgerufen am 27. September 2026, von https://cursor.com/docs/account/pricing
- Cursor. (n.d.-c). Cursor Agent. Cursor Docs. Abgerufen am 27. September 2026, von https://cursor.com/docs/agent/overview
- Cursor. (n.d.-d). Cursor CLI. Cursor Docs. Abgerufen am 27. September 2026, von https://cursor.com/docs/cli/overview
- Cursor. (n.d.-e). Cloud agents. Cursor Docs. Abgerufen am 27. September 2026, von https://cursor.com/docs/cloud-agent
- Cursor. (n.d.-f). Pricing. Cursor. Abgerufen am 27. September 2026, von https://cursor.com/pricing
- Cursor Team. (2026, 14. August). Cursor is now a part of SpaceX. Cursor Blog. https://cursor.com/blog/joining-spacex
- Jimenez, C. E., Yang, J., Wettig, A., Yao, S., Pei, K., Press, O., & Narasimhan, K. (2024). SWE-bench: Can language models resolve real-world GitHub issues? International Conference on Learning Representations (ICLR 2024). https://arxiv.org/abs/2310.06770
- OpenAI. (n.d.-a). Codex. ChatGPT Learn. Abgerufen am 27. September 2026, von https://learn.chatgpt.com/docs
- OpenAI. (n.d.-b). Pricing. ChatGPT Learn. Abgerufen am 27. September 2026, von https://learn.chatgpt.com/docs/pricing
- OpenAI. (n.d.-c). Models. ChatGPT Learn. Abgerufen am 27. September 2026, von https://learn.chatgpt.com/docs/models
- OpenAI. (n.d.-d). openai/codex [Software]. GitHub. Abgerufen am 27. September 2026, von https://github.com/openai/codex
- Schluntz, E., & Zhang, B. (2024, 19. Dezember). Building effective agents. Anthropic. https://www.anthropic.com/engineering/building-effective-agents
- Stack Overflow. (2025). AI | 2025 Stack Overflow Developer Survey. https://survey.stackoverflow.co/2025/ai
- Yepis, E. (2026, 27. Mai). Agents on a leash: Agentic AI remains mostly single-agent and monitored at work. Stack Overflow Blog. https://stackoverflow.blog/2026/05/27/agents-on-a-leash-agentic-ai-remains-mostly-monitored-at-work/