La señal sin el ruido. Tecnología curada por ingenieros.

Únete a la comunidad de profesionales tech que reciben en su correo el resumen diario de IA, ciberseguridad, cloud y sostenibilidad. Cada noticia revisada y resumida por ingenieros — no por periodistas. 5 minutos al día. Gratis siempre.

CITADO EN 

Wired

Bloomberg

Xataka

Forbes MX

Interesting Engineering

COBERTURA

Seis verticales. Cero ruido. Solo lo que importa hoy.

No cubrimos todo. Cubrimos lo que un ingeniero senior consideraría relevante para entender hacia dónde va la tecnología.

COBERTURA

Lo lee como un ingeniero.Lo escribe como un ingeniero.

Otros newsletters tech los hacen periodistas que cubren tecnología. Piild lo hacen ingenieros activos en la industria. Esa diferencia se nota en cada edición.

Open rate promedio en últimos 90 días
0 %
Profesionales tech suscritos en ES + LATAM
0

DIARIO

6:30 AM en tu correo. Sin excepciones.

Quién está detrás

Javier Ramírez

Editor en jefe · ML Engineer

Ex-Google Cloud, ML Engineer en startup IA en Madrid. Cubre IA y MLOps.

María Aguilar

Editora · Security Engineer

CISSP. Security Engineer en banca digital LATAM. Cubre cyber + cloud security.

Carlos Vega

Editor · DevOps & Sustainability

SRE, AWS Solutions Architect. Activo en green-ops y FinOps. Cubre cloud y sostenibilidad.

EDICIÓN DE HOY

Así se ve un día normal en tu bandeja.

Esta es la edición de hoy. Cada sección bajo 60 segundos.

Piild
📧 Tu Piildora diaria
⏱ Resumen de tecnología y ciencia
🟦 Píldora especial

Gemini vs Claude vs ChatGPT: qué modelo es mejor para qué

Los tres asistentes de IA más usados del mundo nunca habían estado tan parejos: apenas 55 puntos Elo los separan. Así que la pregunta ya no es cuál es el mejor, sino cuál te conviene a ti. Comparamos siete categorías una por una —razonamiento, programación, imagen, video, escritura, contexto y precio— con veredicto claro en cada una y una recomendación final según lo que hagas.

  • Razonamiento y matemáticas: quién resuelve mejor los problemas difíciles
  • Programación: el único terreno donde hay un ganador claro
  • Imagen y video: la categoría donde Claude ni siquiera compite
  • Escritura y contexto: naturalidad de la prosa y tamaño de la memoria
  • Precio y veredicto: cuál elegir según lo que hagas

Agosto 2026 · 9 min de lectura

🧠 RAZONAMIENTO Y MATEMÁTICAS

Los tres están más cerca que nunca — pero cada uno gana en un examen distinto

Comparación modelos IA Claude ChatGPT Gemini razonamiento benchmarks 2026

Empecemos por lo básico: a agosto de 2026 los modelos insignia son Claude Opus 5 (Anthropic, lanzado el 24 de julio), GPT-5.6 en sus tres niveles Sol, Terra y Luna (OpenAI) y Gemini 3.1 Pro (Google), acompañado del más veloz Gemini 3.6 Flash. Los tres laboratorios lanzan una actualización insignia cada seis a diez semanas, así que cualquier ranking envejece rápido.

En razonamiento general, el Artificial Analysis Intelligence Index —el índice independiente más citado— coloca a Claude Opus 5 en primer lugar con 61 puntos, el primer modelo en cruzar la barrera de los 60. Pero ese índice está centrado en texto y subestima capacidades multimodales, así que conviene mirar más de un examen. En ARC-AGI-2, el benchmark de razonamiento abstracto más exigente que existe, Gemini 3.1 Pro alcanzó un 77.1%, un salto de más de 46 puntos frente a la generación anterior. Y en LMArena —donde son personas reales quienes votan qué respuesta prefieren— la distancia entre los tres se redujo a apenas 55 puntos Elo, la brecha más pequeña registrada en la historia de estos modelos.

🏆 Veredicto

Empate técnico con matices. Claude Opus 5 lidera el índice general de inteligencia; Gemini 3.1 Pro domina el razonamiento abstracto puro. Diferencias de 3 a 5 puntos porcentuales rara vez se notan en uso real.

Fuente: Tech Insider / Artificial Analysis → Fuente: DonWeb / LMArena →
⏱ ~90 segundos lectura
💻 PROGRAMACIÓN

Aquí sí hay ganador: cuanto más difícil el problema, más se despega Claude

La programación es la única categoría donde los números dejan de estar empatados. En SWE-bench Verified —el examen estándar que mide si un modelo puede resolver bugs reales de repositorios de GitHub— GPT-5.5 y Claude Opus 4.8 quedaron a menos de un punto de distancia (88.7% contra 88.6%), con Gemini 3.1 Pro unos ocho puntos atrás en 80.6%. Un empate, en la práctica.

La diferencia aparece cuando el examen se endurece. En SWE-bench Pro —tareas de ingeniería que tocan múltiples archivos y exigen entender un proyecto entero, no arreglar una función suelta— la brecha se abre de forma clara: Claude marcó 69.2% frente al 58.6% de GPT-5.5 y el 54.2% de Gemini 3.1 Pro. Más de diez puntos de ventaja. Es la señal más nítida de todo el conjunto de datos: para refactorizaciones grandes y trabajo de arquitectura, Claude está medible­mente adelante. A eso se suma el ecosistema: Claude alimenta editores como Cursor y Windsurf, y su herramienta de terminal Claude Code se convirtió en un estándar entre desarrolladores. GPT-5.6, por su parte, empuja más fuerte en capacidades agénticas y uso de herramientas.

🏆 Veredicto

Gana Claude. Empata con GPT en bugs sencillos, pero se despega diez puntos en tareas complejas multi-archivo. Gemini queda tercero en esta categoría.

Fuente: Tech Insider / SWE-bench → Fuente: Pasquale Pillitteri →
⏱ ~88 segundos lectura
🎨 IMAGEN Y VIDEO

Carrera de dos: Claude no genera imágenes ni video, y eso lo saca de la conversación

Generación de imágenes y video con IA 2026 GPT Image Nano Banana Sora Veo

Aclaración importante antes de comparar: Claude no genera imágenes ni video de forma nativa. Puede analizar y describir imágenes que le compartas, pero no crearlas. Anthropic ha enfocado su producto en texto, código y tareas agénticas. Así que esta categoría se juega entre dos.

En imágenes, OpenAI lanzó GPT Image 2 el 21 de abril de 2026 y le arrebató el liderato a Google: puntúa 1512 Elo en Image Arena frente a los 1360 de Nano Banana 2 (el nombre comercial de Gemini 3.1 Flash Image). GPT Image 2 gana en realismo, arte clásico, edición iterativa y sobre todo en tipografía, con un 99% de precisión al escribir texto dentro de la imagen. Nano Banana 2 gana en ilustración anime, composición espacial y, muy notoriamente, en velocidad: genera en 3 a 6 segundos frente a los 30-60 segundos de GPT Image 2 en modo razonamiento. También es más generoso en su plan gratuito.

En video, la división es de filosofías más que de calidad. Veo 3.1 de Google apunta al realismo profesional: salida 4K, simulación física precisa, secuencias largas y un costo desde 0.15 dólares por segundo. Sora 2 de OpenAI apuesta por la narrativa social y las herramientas virales integradas, a 0.75 dólares por segundo — cinco veces más caro por calidad comparable. Un detalle práctico que conviene tener en el radar: la documentación de OpenAI indica que los modelos Sora 2 vía API están marcados como obsoletos con apagado programado para el 24 de septiembre de 2026, así que cualquier plan de producción debería verificar disponibilidad antes de comprometerse.

🏆 Veredicto

Imágenes: gana ChatGPT por calidad y tipografía; Gemini gana si priorizas velocidad y plan gratuito. Video: gana Gemini con Veo 3.1 por 4K, realismo y precio. Claude: no compite — no genera ni imagen ni video.

Fuente: Decrypt / Image Arena → Fuente: Get AI Perks →
⏱ ~95 segundos lectura
✍️ ESCRITURA · CONTEXTO Y MEMORIA

Prosa contra memoria: dos categorías con dos ganadores distintos

La escritura es difícil de medir con benchmarks, así que las mejores evidencias vienen de pruebas ciegas con personas. En un test con 134 participantes que evaluaron respuestas sin saber qué modelo las había generado, Claude ganó 4 de 8 rondas, destacando sobre todo en tareas de redacción; ChatGPT sobresalió en creatividad e imágenes, y Gemini en investigación con datos en tiempo real. El torneo "AI Madness" de Tom's Guide describió una "brecha de sofisticación": mientras ChatGPT tendía a recurrir a marcos genéricos y plantillas académicas, Claude mostraba una prosa menos robótica. La contracara: ChatGPT sigue siendo más flexible para adaptar tonos muy distintos y produce mejor material publicitario corto.

En contexto y memoria —cuánta información puede procesar el modelo de una sola vez— la ventaja es de Google. Gemini 3.1 Pro ofrece 1 millón de tokens de entrada de serie, y en el plan Google AI Pro se documentan configuraciones de hasta 2 millones, lo que equivale aproximadamente a 1.5 millones de palabras. Claude maneja 200,000 tokens en su configuración estándar (unas 150,000 palabras, una novela completa) con variantes extendidas de 1 millón para documentos y bases de código muy grandes. ChatGPT Plus se queda en 128,000 tokens, duplicándose en el plan Pro. Conviene un matiz honesto: para el 95% de los usos cotidianos —un correo, un artículo, una conversación larga— ninguno de estos límites se alcanza jamás. Solo importa si procesas libros enteros, repositorios completos o cientos de documentos a la vez.

🏆 Veredicto

Escritura: gana Claude por naturalidad y prosa menos plantillada. Contexto: gana Gemini con 1-2 millones de tokens, el doble que sus competidores.

Fuente: Gmelius / Tom's Guide → Fuente: Javadex →
⏱ ~92 segundos lectura
💰 PRECIO · VEREDICTO FINAL

Todos cuestan 20 dólares — así que la pregunta correcta no es cuál es mejor, sino cuál es mejor para ti

Precios planes suscripción IA 2026 ChatGPT Plus Claude Pro Google AI Pro

Los tres planes de entrada de pago rondan el mismo precio: ChatGPT Plus a 20 dólares al mes, Claude Pro a 20 dólares y Google AI Pro a 19.99 dólares. Las diferencias están arriba y abajo de ese escalón. Por abajo, OpenAI sumó un plan Go de 8 dólares y Google un AI Plus de entre 8 y 10 dólares, ambos con límites más generosos que el gratuito pero sin funciones avanzadas. Por arriba, ChatGPT Pro llega a 200 dólares, Claude Max 5x a 100 dólares —donde ahora vive Claude Code, que dejó de estar incluido en Pro— y Google AI Ultra bajó a 99.99 dólares.

En planes gratuitos, Gemini es el más generoso: acceso amplio sin pagar, generación de imágenes con Nano Banana 2 incluida y sin anuncios. ChatGPT gratuito incorporó anuncios en Estados Unidos y límites más estrictos. Claude gratuito es el más limitado en volumen de mensajes. En API, los precios por millón de tokens se separan bastante: Claude Opus 5 en 5/25 dólares, GPT-5.6 entre 1/6 y 5/30 según nivel, y Gemini 3.6 Flash en 1.50/7.50 — con Claude Sonnet 5 en oferta de lanzamiento a 2/10 dólares hasta el 31 de agosto de 2026.

Qué elegir según quién eres: si eres creador de contenido, ChatGPT Plus — es el único que junta texto, imágenes de primer nivel y video en una sola suscripción. Si programas, Claude Pro sin discusión, y Max 5x si vas a usar Claude Code a diario. Si eres estudiante, Gemini: el plan gratuito más generoso del mercado, integración con Google Docs y búsqueda en tiempo real para investigar. Si representas a una empresa, la respuesta depende del ecosistema que ya usas: Google Workspace inclina hacia Gemini, Microsoft 365 hacia ChatGPT, y si tu producto es texto y código, Claude. Y una última recomendación que repiten casi todos los análisis: los equipos con mejores resultados en 2026 no eligen uno solo — usan los tres, cada uno para lo que hace mejor.

Fuente: tl;dv → Fuente: La Opinión →
⏱ ~98 segundos lectura
💡 EL DATO
55 Elo
La distancia que separa a los tres modelos en LMArena, el ranking donde personas reales votan qué respuesta prefieren. Es la brecha más pequeña jamás registrada entre modelos punteros — y la razón por la que en 2026 elegir bien importa más que elegir "el mejor".
Fuente: DonWeb / LMArena →
📌 EN OTRAS NOTICIAS
La gama media superó a la alta en relación calidad-precio

El cambio estructural de 2026: los tres laboratorios dejaron de vender "un modelo" para vender gamas completas. En julio, los niveles intermedios —Claude Sonnet 5, GPT-5.6 Terra, Gemini 3.6 Flash— superaron a los modelos insignia en relación calidad-precio en tres de cada cuatro casos evaluados. Pagar por el modelo más caro dejó de ser automáticamente la mejor decisión.

Leer más →
Cuidado con los rankings: cada laboratorio publica el benchmark que gana

Un patrón que conviene conocer al leer cualquier comparativa: los laboratorios seleccionan qué exámenes destacar en sus anuncios. Anthropic incluyó una columna completa de GPT-5.6 en su tabla de lanzamiento de Opus 5 pero no mencionó a Google en ninguna parte. La recomendación de los analistas independientes es siempre la misma: mira varios índices, no uno.

Leer más →
Grok y DeepSeek: los dos que rompen el precio por debajo

Más allá del trío principal, Grok 4.5 de xAI compite en la gama baja a 2/6 dólares por millón de tokens, y DeepSeek se consolidó como la alternativa de código abierto desde China para equipos con alto volumen y presupuesto ajustado. Ninguno lidera los rankings de calidad, pero ambos cambiaron las expectativas de precio de todo el mercado.

Leer más →
¿Comentarios? equipo@piild.com
© 2026 Piild · Cancelar suscripción

LO QUE DICEN QUIENES LEEN PIILD

Para profesionales que realmente quieren entender, no solo enterarse.

"Es lo único tech que abro en automático. Me ahorra 30 min al día de doom-scrolling en X buscando si algo importante pasó."
Diego López
CTO · Fintech serie B (México)
"Se nota cuando lo escribe alguien que sabe del tema. No copy-paste de TechCrunch traducido"
Sofía Ruiz
Senior ML Engineer · Madrid
"El de IA es el primer correo que abro cada mañana. La sección de evaluaciones es oro puro."
Andrés Torres
Head of Data · SaaS B2B (Bogotá)
"Cancelé 4 newsletters tech para quedarme solo con Piild. La señal/ruido es la mejor del mercado en español."
Lucía Pérez
Product Manager · Barcelona

PREGUNTAS FRECUENTES

Lo que querías saber antes de suscribirte.

¿Cuánto cuesta? ¿Habrá costo en el futuro?

Piild es gratis y siempre lo será. Monetizamos vía sponsors claramente etiquetados que NUNCA modifican el contenido editorial. Lanzaremos un producto premium opcional (reportes mensuales profundos por vertical) en 2026, pero la newsletter base seguirá gratis.

Diario a las 6:30 AM. No enviamos sábados ni domingos para no saturar tu inbox personal.

Mixx.io es excelente, pero combina newsletter y podcast, por lo que normalmente requiere cerca de una hora de tu tiempo. Piild es 100% texto, directo al punto y diseñado para leerse en solo 5 minutos. Xataka es un medio editorial; Piild es un servicio de inteligencia tech.

Cada mañana el equipo editorial revisa ~60 fuentes primarias (papers, posts oficiales, SEC filings, GitHub releases, Hacker News, etc.). De ahí seleccionamos las 5-7 noticias que un profesional senior debería conocer. Si una historia no aporta valor técnico real, no entra.

En 1 clic al final de cualquier correo. Sin formularios ni preguntas. Tus datos se eliminan al instante.

Sí. Tenemos espacios limitados de sponsorship por edición. Visita /anunciantes para ver formatos, audiencia y pricing.

PREGUNTAS FRECUENTES

Lo que querías saber antes de suscribirte.

¿Cuánto cuesta? ¿Habrá costo en el futuro?

Piild es gratis y siempre lo será. Monetizamos vía sponsors claramente etiquetados que NUNCA modifican el contenido editorial. Lanzaremos un producto premium opcional (reportes mensuales profundos por vertical) en 2026, pero la newsletter base seguirá gratis.

Diario a las 6:30 AM. No enviamos sábados ni domingos para no saturar tu inbox personal.

Mixx.io es excelente, pero combina newsletter y podcast, por lo que normalmente requiere cerca de una hora de tu tiempo. Piild es 100% texto, directo al punto y diseñado para leerse en solo 5 minutos. Xataka es un medio editorial; Piild es un servicio de inteligencia tech.

Cada mañana el equipo editorial revisa ~60 fuentes primarias (papers, posts oficiales, SEC filings, GitHub releases, Hacker News, etc.). De ahí seleccionamos las 5-7 noticias que un profesional senior debería conocer. Si una historia no aporta valor técnico real, no entra.

En 1 clic al final de cualquier correo. Sin formularios ni preguntas. Tus datos se eliminan al instante.

Sí. Tenemos espacios limitados de sponsorship por edición. Visita /anunciantes para ver formatos, audiencia y pricing.

¿Listo para 5 minutos diarios que importan?

Únete a los profesionales tech. Cancela cuando quieras. Sin spam.

¿Listo para 5 minutos diarios que importan?

Únete a los profesionales tech. Cancela cuando quieras. Sin spam.