Die KI-Tools, die ich nutze 2026-03-25 Ausgabe
Hinweis: Das hier ist alles nur meine Meinung, basierend auf meinen Erfahrungen und dem, was ich genutzt habe. Es ist unmöglich, alles so gründlich auszuprobieren, wie ich es gerne würde, deshalb konzentriere ich mich auf dieser Seite einfach auf die Tools, die ich im Alltag am meisten nutze.
Historisch: 5. Mai 202625. März 2026
Modelle
Kurz gesagt → GPT 5.4 · Opus 4.6 · GPT 5.4 Mini
-
GPT 5.4 → Empfohlen
Mein Standardmodell fürs Programmieren.
- Befolgt Anweisungen unglaublich gut
- Aktuelle Trainingsdaten
- Tool-Calling und langes Ausführen in Schleifen
- Programmierung
- Computer- & Browsernutzung
- Schlecht bei UIs
-
Opus 4.6 → Empfohlen
Das Modell, das ich zum Erstellen von UIs und für Frontend-Arbeit nutze
- Sehr gut beim Tool-Calling
- Fühlt sich richtig schnell an (neigt dazu, direkt zu handeln)
- Angenehm im Gespräch
- Hervorragend bei UI und Frontend
- Es fehlt die „Weisheit“ von 5.4, was mit der Zeit zu deutlich schlechterem Code führt
- Teuer
-
GPT 5.4 Mini → Empfohlen
Ein Geheimtipp. Die Geschwindigkeit ist absurd – unglaublich für Aufgaben vom Typ „Subagent“ (Suche mit Tools).
- Hervorragendes Tool Calling
- Sehr, sehr schnell
- Sehr günstig
- Kommt insgesamt nicht an die Intelligenz von 5.4 heran
-
Gemini 3.1 Pro (and Flash kinda)
Du willst ein Video oder Bild verarbeiten oder einen riesigen Textblock in JSON umwandeln? Dafür ist dieses Modell (oder Flash) da. Auch bei UI-Aufgaben ist es ziemlich gut.
- Wahrscheinlich aktuell das beste multimodale Modell (Video, Bild usw.)
- Unordentliche Eingaben in strukturiertes JSON umwandeln
- Ziemlich gut bei UI-Aufgaben
- Schrecklich bei Tool Calling und beim Einsatz in einem Agent-Harness
-
Noch ein Geheimtipp, von dem ich nicht dachte, dass ich ihn so oft nutzen würde. Wenn ich schnell etwas ändern oder suchen muss, ist es perfekt. Außerdem überraschend gut bei UI-Kram.
- Unfassbar schnell
- Günstig
- Sehr gut beim Tool-Calling
- Ziemlich smart und leistungsfähig
- Nur in Cursor-Harnesses nutzbar
- Nicht so leistungsfähig wie die Spitzenmodelle von OpenAI und Anthropic
Harnesses
Kurz gesagt → T3 Code · Cursor · Pi
-
T3 Code → Empfohlen
Klar, ich bin voreingenommen, aber T3 Code ist echt gut. 90 % meiner Arbeit mache ich hier, die einzige echte Ausnahme sind Frontend-Sachen (meistens in Cursor, OpenCode oder Pi)
- Sehr, sehr schnell
- Lässt meinen Computer nicht ruckeln oder überhitzen
- Baut auf Codex und anderen bestehenden Harnesses auf, ist also A) kostenlos und B) bietet dir die beste Erfahrung mit den Modellen
- Unterstützt aktuell nur Codex und Claude Code, daher begrenzte Modellauswahl
-
Cursor → Empfohlen
Immer noch mein Standard-Editor.
- Der Editor basiert auf VSCode – genau das, was du erwartest, und er funktioniert.
- Sie haben die einzigen guten Cloud-Agenten, die ich bisher ausprobiert habe
- Jedes Modell ist nutzbar
- Die allgemeine Stabilität des Produkts/der Plattform ist ziemlich mau ...
- Muss für die Inferenz ein Cursor-Abo nutzen
- Die neue Desktop-UI von Glass steckt noch ganz am Anfang und hat jede Menge Probleme
-
Pi → Empfohlen
Die TUI ist eine TUI. Keine Ahnung, was ich sonst sagen soll, aber: Sie ist gut. Der wirklich beeindruckende Teil ist das SDK. Mit Abstand das beste „Agent“-SDK, das ich ausprobiert habe.
- Schnelle und schlanke TUI
- Fantastisches SDK
- Kann jedes Modell nutzen*
- Die Authentifizierung ist mit der TUI etwas seltsam
-
Insgesamt immer noch die beeindruckendste TUI, und ihre Desktop-App hat große Fortschritte gemacht und ist inzwischen ziemlich solide. Ich mag es einfach, sie für kleine Aufgaben zwischendurch griffbereit zu haben.
- Sieht toll aus und lässt sich super nutzen
- Solide Desktop-App
- Hervorragende Client-Server-Architektur, dadurch extrem erweiterbar
- Das SDK ist im Vergleich zu Pi ziemlich schlecht. Es macht einfach zu viel
- Die TUI ist keine normale TUI; sie übernimmt die Terminalansicht komplett, was meistens super ist, aber seltsame Probleme verursachen kann
-
Das beste Harness für OpenAI-Modelle. Die CLI ist super. Die Desktop-App ist wunderschön, hat aber jede Menge Performanceprobleme. Ich nutze es meistens nur im Hintergrund über T3 Code.
- Die Desktop-App sieht wunderschön aus
- Die CLI ist schlank und performant
- Hervorragendes Harness für die aktuell besten Modelle
- Die Desktop-Performance ist mies
Abonnements
Kurz gesagt → Cursor Ultra · OpenAI Codex · OpenCode Black
-
Cursor Ultra → Empfohlen
Für deine $200 bekommst du monatlich Inference im Wert von ~$400-$500. Bei Weitem nicht so eine krasse Subvention wie bei den großen Labs, aber meiner Meinung nach trotzdem lohnenswert. Wenn du nur ein Abo wählen kannst, nimm dieses.
- Du bekommst einen soliden Editor, die einzigen guten Cloud-Agenten und eine brauchbare CLI.
- Modellvielfalt
- Die Inference-Subvention ist nicht so krass wie bei den großen Labs
-
OpenAI Codex → Empfohlen
Irres Preis-Leistungs-Verhältnis: Für deine $200 bekommst du monatlich GPT im Wert von Tausenden Dollar, wenn du es ausreizt. Wenn du dir zwei Abos leisten kannst, ist dies das andere, das du nehmen solltest. GPT-Modelle sind aktuell insgesamt die besten, und OpenAI ist total entspannt damit, dass du dein Abo auch in anderen Harnesses nutzt: - Codex - T3 Code - OpenCode - Pi
- Irres Preis-Leistungs-Verhältnis
- Harness-Flexibilität
- Nur GPT-Modelle
-
OpenCode Black → Empfohlen
Das ist das dritte Abo, das ich nehmen würde, wenn du das Geld ausgeben kannst. Nicht ganz so ein irres Preis-Leistungs-Verhältnis wie die anderen Abos, aber du kannst wohl ziemlich leicht auf fast $1000 kommen, wenn du es ausreizt (obwohl sich das ändern könnte). Das Beste daran ist, wie flexibel OpenCode Zen ist. Es ist wirklich einfach nur eine API, dein Abo gibt dir einen API-Key. Das heißt, du kannst es problemlos als Inference für Agenten verwenden, die du entwickelst, in anderen Harnesses usw.
- OpenCode Zen ist im Grunde eine API, sodass du es überall nutzen kannst
- Nicht ganz so absurd viel fürs Geld
- Aktuell lange Warteliste – vielleicht bekommst du es nicht mal
-
Ein ziemlich irre gutes Preis-Leistungs-Verhältnis, wenn du es richtig ausreizt. Deine 200 $ bringen dir bei intensiver Nutzung inference im Wert von Tausenden Dollar pro Monat. Das Problem: Das ist das am stärksten eingeschränkte Abo von allen. Du kannst es praktisch nur in Claude Code nutzen, dem aktuell schwächsten Mainline-harness
- Enorm viel inference, wenn du es richtig ausreizt
- Auf Claude Code beschränkt