Ben Davis davis7.sh

Narzędzia AI, których używam 2026-03-25 Edycja

Uwaga: to wszystko jest tylko moją opinią, opartą na moich doświadczeniach i narzędziach, z których korzystałem. Nie da się wypróbować wszystkiego tak dogłębnie, jak bym chciał, więc postanowiłem skupić tę stronę na narzędziach, których najczęściej używam na co dzień.

Historia: 5 maja 202625 marca 2026

TL;DR → GPT 5.4 · Opus 4.6 · GPT 5.4 Mini

  1. GPT 5.4 DomyślnyProgramowanieObsługa komputera → Polecane

    Mój domyślny model do programowania.

    • Doskonale trzyma się instrukcji
    • Aktualne dane treningowe
    • Wywoływanie narzędzi i długie działanie w pętli
    • Programowanie
    • Obsługa komputera i przeglądarki
    • Beznadziejny w UI
  2. Opus 4.6 UIProjektowanieProgramowanie → Polecane

    Model, którego używam do projektowania UI i pracy nad frontendem

    • Świetnie wywołuje narzędzia
    • Sprawia wrażenie naprawdę szybkiego (skłonny do działania)
    • Przyjemnie się z nim rozmawia
    • Znakomity w UI i frontendzie
    • Brakuje mu „mądrości” wersji 5.4, przez co z czasem tworzy znacznie gorszy kod
    • Drogi
  3. GPT 5.4 Mini WyszukiwaniePodagenciObsługa komputera → Polecane

    Czarny koń. Jest absurdalnie szybki, świetnie sprawdza się w zadaniach typu „podagent” (wyszukiwanie z narzędziami)

    • Świetne wywoływanie narzędzi
    • Bardzo, bardzo szybki
    • Bardzo tani
    • Nie dorównuje 5.4 pod względem ogólnej inteligencji
  4. Gemini 3.1 Pro (and Flash kinda) InteligentnyModel od Google

    Chcesz przetworzyć wideo, obraz albo zamienić ogromny blok tekstu w JSON? Ten model (albo Flash) jest do tego. Całkiem dobrze radzi sobie też z UI.

    • Prawdopodobnie najlepszy obecnie model multimodalny (wideo, obraz itd.)
    • Przekształcanie chaotycznych danych wejściowych w uporządkowany JSON
    • Całkiem dobrze radzi sobie z UI
    • Fatalny w wywoływaniu narzędzi i pracy w harnessie agenta
  5. Composer 2.0 Programowanie

    Kolejny czarny koń — nie sądziłem, że będę go używać aż tak często. Gdy potrzebuję szybkiej zmiany albo wyszukiwania, jest idealny. Zaskakująco dobrze radzi sobie też z UI.

    • Cholernie szybki
    • Tani
    • Świetnie wywołuje narzędzia
    • Całkiem inteligentny i sprawny
    • Może być używany tylko w harnessach Cursor
    • Nie tak potężny jak najlepsze modele od OpenAI i Anthropic

TL;DR → T3 Code · Cursor · Pi

  1. T3 Code Aplikacja desktopowa → Polecane

    Tak, jestem stronniczy, ale T3 Code jest naprawdę dobry. 90% mojej pracy robię właśnie tutaj, a jedynym prawdziwym wyjątkiem są rzeczy frontendowe (zwykle robię je w Cursor, OpenCode lub Pi)

    • Bardzo, bardzo szybki
    • Nie spowalnia ani nie przegrzewa mojego komputera
    • Stanowi nakładkę na Codex i inne istniejące harnessy, więc A) jest darmowy i B) zapewnia najlepsze doświadczenie z modelami
    • Obecnie obsługuje tylko Codex i Claude Code, więc wybór modeli jest ograniczony
  2. Cursor EdytorAgent chmurowyAplikacja desktopowaCLI → Polecane

    Nadal mój domyślny edytor.

    • Edytor jest oparty na VSCode — to dokładnie to, czego można się spodziewać, i działa
    • To jedyni dobrzy agenci chmurowi, jakich testowałem
    • Każdy model nadaje się do użycia
    • Ogólna stabilność produktu/platformy pozostawia wiele do życzenia...
    • Wymaga subskrypcji Cursor do inference
    • Nowy desktopowy interfejs Glass jest jeszcze na bardzo wczesnym etapie i ma masę problemów
  3. Pi CLISDK → Polecane

    TUI to TUI. Nie wiem, co więcej powiedzieć, poza tym że jest dobre. Naprawdę imponuje SDK. Zdecydowanie najlepsze SDK dla „agentów”, jakie testowałem.

    • Szybkie i minimalistyczne TUI
    • Niesamowite SDK
    • Obsługuje dowolny model*
    • Autoryzacja w TUI jest trochę dziwna
  4. OpenCode CLIAplikacja desktopowaSDK

    Nadal najbardziej imponujące TUI ogółem, a ich aplikacja desktopowa przeszła długą drogę i jest już całkiem solidna. Po prostu lubię mieć ją pod ręką do różnych zadań.

    • Świetnie wygląda i świetnie się z niego korzysta
    • Solidna aplikacja desktopowa
    • Świetna architektura klient-serwer, która czyni ją bardzo rozszerzalną
    • SDK jest dość słabe w porównaniu z Pi. Po prostu robi za dużo
    • TUI nie jest zwykłym TUI — całkowicie przejmuje widok terminala, co przez większość czasu jest świetne, ale może powodować dziwne problemy
  5. Codex CLIAplikacja desktopowaAgent chmurowySDK

    Najlepszy harness dla modeli OpenAI. CLI jest świetne. Aplikacja desktopowa jest piękna, ale ma masę problemów z wydajnością. Głównie używam go pod maską przez T3 Code.

    • Aplikacja desktopowa wygląda pięknie
    • CLI jest minimalistyczne i wydajne
    • Świetny harness dla obecnie najlepszych modeli
    • Wydajność wersji desktopowej kuleje
  6. Claude Code CLISDK

    Jest w kiepskim stanie

    • Nie jest to coś, po co chętnie sięgam

TL;DR → Cursor Ultra · OpenAI Codex · OpenCode Black

  1. Cursor Ultra $200Każdy model → Polecane

    Za $200 dostaniesz miesięcznie inferencję o wartości około $400–$500. To nie aż tak szalone dofinansowanie jak w przypadku dużych laboratoriów, ale moim zdaniem i tak warto. Jeśli masz wybrać tylko jedną subskrypcję, wybierz tę.

    • Dostajesz solidny edytor, jedynych dobrych agentów chmurowych i niezłe CLI.
    • Różnorodność modeli
    • Dofinansowanie inferencji nie jest tak szalone jak w dużych laboratoriach
  2. OpenAI Codex $200Tylko GPT → Polecane

    Niesamowita opłacalność — jeśli mocno to wykorzystasz, za $200 dostaniesz miesięcznie GPT warte tysiące dolarów. Jeśli możesz sobie pozwolić na dwie subskrypcje, to druga, którą warto wziąć. Modele GPT są obecnie ogólnie najlepsze, a OpenAI jest super wyluzowane, jeśli chodzi o używanie subskrypcji w innych harnessach: - Codex - T3 Code - OpenCode - Pi

    • Niesamowita opłacalność
    • Elastyczność harnessa
    • Tylko modele GPT
  3. OpenCode Black $200Każdy model → Polecane

    To trzecia subskrypcja, którą bym wziął, jeśli możesz sobie na nią pozwolić. Nie jest aż tak opłacalna jak pozostałe, ale wygląda na to, że przy intensywnym korzystaniu można dość łatwo wyciągnąć prawie $1000 (choć to może się zmienić). Najlepsze w niej jest to, jak elastyczny jest OpenCode Zen. To po prostu API — subskrypcja daje ci klucz API. Dzięki temu banalnie łatwo użyć go jako źródła inferencji dla tworzonych agentów, w innych harnessach itd.

    • OpenCode Zen to w zasadzie API, więc możesz używać go wszędzie
    • Nie aż tak absurdalnie opłacalne
    • Obecnie jest ogromna lista oczekujących — możesz nawet nie mieć szansy go dostać
  4. Claude Max $200Tylko Claude

    Naprawdę szalona wartość za te pieniądze, jeśli mocno go wykorzystujesz. Za 200 USD dostaniesz miesięcznie inference warte tysiące dolarów, jeśli naprawdę go ciśniesz. Problem w tym, że to najbardziej ograniczona subskrypcja ze wszystkich. W praktyce możesz go używać tylko w Claude Code, który obecnie jest najsłabszym z głównych harnessów

    • Ogromna wartość inference, jeśli mocno go ciśniesz
    • Ograniczone do Claude Code

Podsumowanie tego okresu · To nie jest ranking na żywo