✓ Verificado el 3 de septiembre de 2026⏱ 2 min de lectura✓ terminado
Comparativa de competidores
| Criterio | Claude | ChatGPT | Gemini | Mistral | Perplexity |
|---|---|---|---|---|---|
| Modelo estrella | Fable 5 ✦ | GPT-5.5 | Gemini | Mistral Large | Sonar |
| Contexto | 1M ✦ | 128K | 1M | 128K | Variable |
| Output | 128K ✦ | 16K | 64K | 32K | ~8K |
| Redacción | ★★★★★ | ★★★★☆ | ★★★★☆ | ★★★★☆ | ★★★☆☆ |
| Coding | 80,8 % SWE-bench* | 80,0 % | ★★★★☆ | ★★★★☆ | ★★★☆☆ |
| Búsqueda | ★★★★☆ | ★★★★☆ | ★★★★☆ | ★★★☆☆ | ★★★★★ ✦ |
| Imágenes | Análisis ✓ · generación no | DALL-E 3 | Nano Banana | No | No |
| Ctrl orden. | Cowork ✦ | Operator | Agent | No | No |
| Office | Add-ins ✦ | Copilot | Workspace | No | No |
| Skills | 2 300+ ✦ | GPTs | Gems | Le Chat | Spaces |
| Seguridad | Constitution ✦ | RLHF | Filters | Guardrails | Standard |
| Precio Pro | 20$ | 20$ | 20$ | Gratis | 20$ |
| Open src | No | No | Parcial | Sí ✦ | No |
🦋 La brecha se amplía en las tareas largas
Con el lanzamiento de Fable 5 (clase Mythos), Claude está en el estado del arte en casi la totalidad de los benchmarks públicos — la ventaja es tanto más clara cuanto más larga y compleja es la tarea (migraciones de código a gran escala, investigación autónoma durante varios días). Dos referencias reivindicadas oficialmente: la mejor puntuación jamás registrada en FrontierCode (Cognition) y en el Finance Benchmark de Hebbia. Y Opus 5 pone esta inteligencia de vanguardia a mitad de precio — incluso supera a Fable 5 en algunos benchmarks, como OSWorld 2.0 (control del ordenador). Fable 5.1 recupera el liderazgo (Terminal-Bench 4.0, Humanity's Last Exam) por delante de Opus 5 y GPT-5.6 Sol, al mismo precio que Fable 5 pero con una lectura de caché 4× más barata. En la generación de imágenes, Claude sigue voluntariamente ausente: combínalo con una herramienta específica si lo necesitas.
* SWE-bench: test de referencia del sector sobre código (puntuación Sonnet 4.6, feb. 2026 — Sonnet 5 y Fable 5 lo superan). Las estrellas reflejan una valoración de uso, no una medición oficial: haz tu propia prueba con tus casos reales.
Test a ciegas — 134 participantes (feb. 2026, estudio comunitario independiente, a leer con cautela)
🥇 PRIMERO
Claude — 4/8
Márgenes 35-54 pts
🥈 SEGUNDO
Gemini — 3/8
Márgenes 3-11 pts
🥉 TERCERO
ChatGPT — 1/8
Margen 25 pts


