Las herramientas de IA que uso 2026-03-25 Edición
Aviso: todo esto es solo mi opinión, basada en mi experiencia y en lo que he usado. Es imposible probarlo todo con el nivel de profundidad que me gustaría, así que he decidido centrar este sitio en las herramientas que más uso a diario.
Histórico: 5 de mayo de 202625 de marzo de 2026
Modelos
TL;DR → GPT 5.4 · Opus 4.6 · GPT 5.4 Mini
-
GPT 5.4 → Recomendado
Mi modelo predeterminado para programar.
- Increíble seguimiento de instrucciones
- Datos de entrenamiento recientes
- Llamadas a herramientas y ejecución prolongada en bucle
- Programación
- Uso del ordenador y del navegador
- Pésimo con la UI
-
Opus 4.6 → Recomendado
El modelo que uso para crear interfaces y trabajar en el frontend
- Excelente con las llamadas a herramientas
- Parece muy rápido (tiende a actuar)
- Agradable para conversar
- Excelente en UI y frontend
- Carece de la «sabiduría» de 5.4, lo que acaba generando código mucho peor con el tiempo
- Caro
-
GPT 5.4 Mini → Recomendado
Una joyita inesperada. La velocidad es absurda; increíble para tareas de tipo «subagente» (búsquedas con herramientas)
- Excelente capacidad de uso de herramientas
- Muy, muy rápido
- Muy barato
- Carece de la inteligencia general de 5.4
-
Gemini 3.1 Pro (and Flash kinda)
¿Quieres procesar un video, una imagen o convertir un enorme bloque de texto en JSON? Este es el modelo (o Flash) para eso. También se le da bastante bien la UI.
- Probablemente el mejor modelo multimodal ahora mismo (video, imagen, etc.)
- Convertir entradas desordenadas en JSON estructurado
- Bastante bueno con la UI
- Pésimo usando herramientas y trabajando en un harness de agentes
-
Otra joyita inesperada que no pensé que usaría tanto. Siempre que necesito hacer un cambio o una búsqueda rápida, es perfecto. Además, se le da sorprendentemente bien la UI.
- Ridículamente rápido
- Barato
- Excelente con las llamadas a herramientas
- Bastante inteligente y capaz
- Solo se puede usar en harnesses de Cursor
- No es tan potente como los modelos de vanguardia de OpenAI y Anthropic
Arneses
TL;DR → T3 Code · Cursor · Pi
-
T3 Code → Recomendado
Sí, soy parcial, pero T3 Code es realmente bueno. El 90 % de mi trabajo lo hago desde aquí; la única excepción real es el frontend (normalmente en Cursor, OpenCode o Pi)
- Muy, muy rápido
- No ralentiza ni sobrecalienta mi computadora
- Funciona sobre Codex y otros harnesses existentes, así que A) es gratis y B) te ofrece la mejor experiencia con los modelos
- Por ahora solo admite Codex y Claude Code, así que la selección de modelos es limitada
-
Cursor → Recomendado
Sigue siendo mi editor predeterminado.
- El editor está basado en VSCode: es lo que esperas y funciona
- Son los únicos buenos agentes en la nube que he probado
- Todos los modelos se pueden usar
- La estabilidad general del producto/plataforma deja bastante que desear...
- Hay que usar una suscripción a Cursor para la inference
- La nueva UI de escritorio de Glass está muy verde y tiene un montón de problemas
-
Pi → Recomendado
La TUI es una TUI. No sé qué más decir, salvo que es buena. Lo realmente impresionante es el SDK. De lejos, el mejor SDK de "agent" que he probado.
- TUI rápida y minimalista
- SDK increíble
- Admite cualquier modelo*
- La autenticación es un poco rara con la TUI
-
Sigue siendo la TUI más impresionante en general, y su app de escritorio ha mejorado mucho hasta ser bastante sólida. Simplemente me gusta tenerla a mano para tareas aleatorias.
- Se ve y se siente genial al usarlo
- App de escritorio sólida
- Excelente arquitectura cliente-servidor que la hace muy extensible
- El SDK es bastante malo comparado con Pi. Simplemente hace demasiado
- La TUI no es una TUI normal: ocupa por completo la terminal, lo cual es genial la mayor parte del tiempo, pero puede causar problemas raros
-
El mejor harness para modelos de OpenAI. La CLI es genial. La app de escritorio es preciosa, pero tiene un montón de problemas de rendimiento. Yo sobre todo la uso internamente a través de T3 Code.
- La app de escritorio se ve preciosa
- La CLI es minimalista y rinde bien
- Excelente harness para los mejores modelos actuales
- El rendimiento de escritorio es flojo
Suscripciones
TL;DR → Cursor Ultra · OpenAI Codex · OpenCode Black
-
Cursor Ultra → Recomendado
Por $200 tendrás entre ~$400 y $500 al mes en inference. No es un subsidio ni de lejos tan bestial como el de los grandes laboratorios, pero en mi opinión sigue valiendo la pena. Si solo puedes elegir una suscripción, elige esta.
- Tienes un editor sólido, los únicos agentes en la nube que valen la pena y una CLI decente.
- Variedad de modelos
- El subsidio de inference no es tan bestial como el de los grandes laboratorios
-
OpenAI Codex → Recomendado
Una relación calidad-precio brutal: por $200 puedes obtener miles de dólares en GPT al mes si le sacas partido. Si puedes permitirte dos suscripciones, esta es la otra que elegiría. En general, los modelos GPT son los mejores ahora mismo, y OpenAI no pone problemas para que uses la suscripción en otros harnesses: - Codex - T3 Code - OpenCode - Pi
- Una relación calidad-precio brutal
- Flexibilidad del harness
- Solo modelos GPT
-
OpenCode Black → Recomendado
Esta sería la tercera suscripción que elegiría si puedes permitírtela. No tiene una relación calidad-precio tan brutal como las otras, pero parece que puedes llegar fácilmente a casi $1000 si le sacas partido (aunque eso podría cambiar). Lo mejor es lo flexible que es OpenCode Zen. En realidad, es solo una API: tu suscripción te da una clave de API. Eso hace que sea muy fácil usarla como inference para los agentes que estés creando, en otros harnesses, etc.
- OpenCode Zen es básicamente una API, así que puedes usarlo en cualquier parte
- Un valor no tan absurdo
- Ahora mismo tiene una lista de espera larguísima; puede que ni siquiera consigas obtenerlo
-
Una relación calidad-precio bastante brutal si lo exprimes. Tus 200 $ te darán miles de dólares al mes en inferencia si lo usas a fondo. El problema es que es la suscripción más restringida de todas. En realidad solo puedes usarla en Claude Code, que actualmente es el harness principal más flojo
- Mucho valor de inferencia si lo exprimes
- Limitado a Claude Code