Ben Davis davis7.sh

Gli strumenti di IA che uso 2026-03-25 Edizione

Disclaimer: sono tutte solo mie opinioni, basate sulle mie esperienze e su ciò che ho usato. È impossibile provare tutto con il livello di approfondimento che vorrei, quindi ho deciso di concentrarmi qui semplicemente sugli strumenti che uso di più ogni giorno.

Storico: 5 maggio 202625 marzo 2026

TL;DR → GPT 5.4 · Opus 4.6 · GPT 5.4 Mini

  1. GPT 5.4 PredefinitoCodingUso del computer → Consigliato

    Il mio modello predefinito per il coding.

    • Incredibile nel seguire le istruzioni
    • Dati di addestramento recenti
    • Tool calling e capacità di restare in esecuzione a lungo in un loop
    • Coding
    • Uso del computer e del browser
    • Pessimo con le UI
  2. Opus 4.6 UIDesignCoding → Consigliato

    Il modello che uso per creare UI e lavorare sul frontend

    • Ottimo nel tool calling
    • Sembra davvero rapido (tende ad agire)
    • Con cui è piacevole parlare
    • Eccellente con UI e frontend
    • Gli manca la "saggezza" di 5.4, il che porta a codice molto peggiore nel tempo
    • Costoso
  3. GPT 5.4 Mini CercaSubagentiUso del computer → Consigliato

    Una sorpresa. La velocità è assurda, incredibile per attività da "subagent" (ricerca con tool)

    • Tool calling eccellente
    • Velocissimo
    • Molto economico
    • Non ha l'intelligenza complessiva di 5.4
  4. Gemini 3.1 Pro (and Flash kinda) IntelligenteModello Google

    Vuoi elaborare un video, un'immagine o trasformare un enorme blocco di testo in JSON? Questo è il modello giusto (o Flash). Se la cava anche piuttosto bene con la UI.

    • Probabilmente il miglior modello multimodale al momento (video, immagini, ecc.)
    • Trasformare input disordinati in JSON strutturato
    • Piuttosto bravo con la UI
    • Pessimo nel tool calling e nell'uso di un harness per agent
  5. Composer 2.0 Coding

    Un'altra sorpresa che non pensavo avrei usato così tanto. Ogni volta che mi serve una modifica o una ricerca veloce, è perfetto. Sorprendentemente bravo anche con la UI.

    • Velocissimo
    • Economico
    • Ottimo nel tool calling
    • Piuttosto intelligente e capace
    • Utilizzabile solo nei harness di Cursor
    • Non potente quanto i modelli di frontiera di OpenAI e Anthropic

TL;DR → T3 Code · Cursor · Pi

  1. T3 Code App desktop → Consigliato

    Sì, sono di parte, ma T3 Code è davvero ottimo. Faccio il 90% del mio lavoro da qui; l'unica vera eccezione è il frontend (di solito in Cursor, OpenCode o Pi)

    • Velocissimo
    • Non rallenta né surriscalda il mio computer
    • Fa da wrapper per Codex e altri harness esistenti, quindi A) è gratuito e B) offre la migliore esperienza con i modelli
    • Al momento supportano solo Codex e Claude Code, quindi la selezione di modelli è limitata
  2. Cursor EditorAgente cloudApp desktopCLI → Consigliato

    Resta il mio editor predefinito.

    • L'editor è basato su VSCode: è quello che ti aspetti e funziona
    • Hanno gli unici agent cloud validi che abbia provato
    • Tutti i modelli sono utilizzabili
    • La stabilità generale del prodotto/piattaforma lascia a desiderare...
    • Devi usare un abbonamento a Cursor per l'inference
    • Glass, la nuova UI desktop, è ancora agli inizi e ha un sacco di problemi
  3. Pi CLISDK → Consigliato

    La TUI è una TUI. Non so che altro dire: è buona. La parte davvero impressionante è l'SDK. Di gran lunga il miglior SDK per "agent" che abbia provato.

    • TUI veloce e minimale
    • SDK incredibile
    • Può usare qualsiasi modello*
    • L'autenticazione con la TUI è un po' strana
  4. OpenCode CLIApp desktopSDK

    Resta la TUI complessivamente più impressionante, e la loro app desktop ha fatto molta strada fino a diventare davvero piuttosto solida. Mi piace averla a disposizione per attività casuali.

    • Bello da vedere e piacevole da usare
    • Solida app desktop
    • Eccellente architettura client/server che la rende super estensibile
    • L'SDK è piuttosto scarso rispetto a Pi. Fa semplicemente troppo
    • La TUI non è una TUI normale: prende completamente il controllo del terminale, il che è ottimo quasi sempre, ma può causare problemi strani
  5. Codex CLIApp desktopAgente cloudSDK

    Il miglior harness per i modelli OpenAI. La CLI è ottima. L'app desktop è bellissima, ma ha un sacco di problemi di prestazioni. La uso soprattutto dietro le quinte tramite T3 Code.

    • L'app desktop è bellissima
    • La CLI è minimale e performante
    • Eccellente harness per i migliori modelli attuali
    • Le prestazioni desktop sono scarse
  6. Claude Code CLISDK

    È in pessime condizioni

    • Non è qualcosa a cui ricorro

TL;DR → Cursor Ultra · OpenAI Codex · OpenCode Black

  1. Cursor Ultra $200Tutti i modelli → Consigliato

    Con i tuoi $200 ottieni circa $400-$500 al mese di inference. Non è un sussidio folle come quello dei grandi laboratori, ma secondo me vale comunque la pena. Se devi scegliere un solo abbonamento, è questo.

    • Hai un editor solido, gli unici agent cloud validi e una CLI decente.
    • Varietà di modelli
    • Il sussidio per l'inference non è folle come quello dei grandi laboratori
  2. OpenAI Codex $200Solo GPT → Consigliato

    Rapporto qualità-prezzo folle: con i tuoi $200 ottieni ogni mese migliaia di dollari di GPT se lo sfrutti al massimo. Se puoi permetterti due abbonamenti, questo è l'altro da fare. I modelli GPT sono complessivamente i migliori al momento e OpenAI è super tranquilla nel permetterti di usare l'abbonamento in altri harness: - Codex - T3 Code - OpenCode - Pi

    • Rapporto qualità-prezzo folle
    • Flessibilità dell'harness
    • Solo modelli GPT
  3. OpenCode Black $200Tutti i modelli → Consigliato

    Questo è il terzo abbonamento che farei se puoi permettertelo. Non offre un rapporto qualità-prezzo folle come gli altri abbonamenti, ma sembra che si possa arrivare abbastanza facilmente vicino ai $1000 se lo sfrutti al massimo (anche se potrebbe cambiare). La parte migliore è la flessibilità di OpenCode Zen. È davvero solo un'API: l'abbonamento ti dà una chiave API. Ciò significa che è banale usarla come inference per gli agent che stai creando, in altri harness ecc.

    • OpenCode Zen è praticamente un'API, quindi puoi usarla ovunque
    • Un rapporto qualità-prezzo meno assurdo
    • Al momento c'è una lunga lista d'attesa, potresti non riuscire nemmeno ad averlo
  4. Claude Max $200Solo Claude

    Un rapporto qualità-prezzo pazzesco se lo sfrutti a fondo. Con $200 ottieni migliaia di dollari al mese in inference se lo sfrutti a fondo. Il problema è che è l'abbonamento più blindato di tutti. Puoi usarlo davvero solo in Claude Code, che al momento è l'harness principale più debole

    • Valore in inference enorme se lo spremi
    • Vincolato a Claude Code

Panoramica del periodo · Non è una classifica in tempo reale