Guía clasificada

Ecosistema Diario — Los Asistentes Líderes

Son las navajas suizas de la inteligencia artificial: los asistentes que la gente abre antes que el correo. Escriben, razonan, planifican y, de vez en cuando, se inventan cosas con una seguridad asombrosa. Claude Opus 5.5 lidera ahora el trabajo intelectual cuidadoso y verificable, Claude Sonnet 5.5 ofrece casi los mismos resultados en trabajo de oficina en el plan gratuito de Claude, GPT-6 Astra es el más fuerte manejando programas por ti, y GPT-6.1 Sol lleva a ChatGPT Work resultados casi al nivel de Astra por una fracción del costo. Aquí tienes qué hace bien cada uno, dónde tropieza y por qué la elección correcta depende de cómo sea tu día.

Primero, la decisión

Nuestro ranking

Empieza por el ganador y compara después las concesiones que podrían cambiar tu elección.

#1 Ecosistema Diario

Claude Opus 5.5

Anthropic

Claude Opus 5.5 es el modelo al que confiaríamos un trabajo enredado y de alto riesgo con la tranquilidad de que volverá con la respuesta correcta. Anthropic asegura que rinde al nivel de su modelo premium, Fable 5.1, en la mayoría de las tareas, pero cuesta menos de la mitad por token. Y ahora escribe como un colega sereno, no como un recién graduado nervioso.

Por qué gana

La puntuación más alta del índice independiente Artificial Analysis Intelligence Index en su lanzamiento (58, esfuerzo máximo). Lidera GDPval-AA v2.1, una prueba de trabajo profesional real, con 1846 Elo, por delante de Fable 5.1 (1735). El precio por token bajó un 20 %, a $4/$20, y la lectura desde caché un 60 %, a $0,20, lo que según Anthropic abarata un 40 % las cargas de trabajo típicas frente a Opus 5. Genera texto más de un 30 % más rápido, y los límites de uso de cinco horas subieron en los planes de pago.

La Trampa

En esfuerzo máximo piensa en voz alta muchísimo: Artificial Analysis midió unos 119.000 tokens de salida por tarea, frente a unos 27.000 de GPT-6 Astra. Así que el precio bajo solo compensa si el trabajo rutinario se queda en el esfuerzo predeterminado. No genera imágenes, el razonamiento ya no se puede desactivar y la mayoría de las peticiones de ciberseguridad se derivan discretamente al antiguo Opus 4.8.

9.8 Nota editorial
Leer reseña
Ideal para

Claude Opus 5.5 es el modelo al que confiaríamos un trabajo enredado y de alto riesgo con la tranquilidad de que volverá con la respuesta correcta. Anthropic asegura que rinde al nivel de su modelo premium, Fable 5.1, en la mayoría de las tareas, pero cuesta menos de la mitad por token. Y ahora escribe como un colega sereno, no como un recién graduado nervioso.

Por qué gana

La puntuación más alta del índice independiente Artificial Analysis Intelligence Index en su lanzamiento (58, esfuerzo máximo). Lidera GDPval-AA v2.1, una prueba de trabajo profesional real, con 1846 Elo, por delante de Fable 5.1 (1735). El precio por token bajó un 20 %, a $4/$20, y la lectura desde caché un 60 %, a $0,20, lo que según Anthropic abarata un 40 % las cargas de trabajo típicas frente a Opus 5. Genera texto más de un 30 % más rápido, y los límites de uso de cinco horas subieron en los planes de pago.

Ten en cuenta

En esfuerzo máximo piensa en voz alta muchísimo: Artificial Analysis midió unos 119.000 tokens de salida por tarea, frente a unos 27.000 de GPT-6 Astra. Así que el precio bajo solo compensa si el trabajo rutinario se queda en el esfuerzo predeterminado. No genera imágenes, el razonamiento ya no se puede desactivar y la mayoría de las peticiones de ciberseguridad se derivan discretamente al antiguo Opus 4.8.

#2

GPT-6 Astra

OpenAI

GPT-6 Astra es el nuevo buque insignia de OpenAI para la parte del trabajo que ocurre fuera del cuadro de chat. Maneja el navegador, hace clic en las aplicaciones de escritorio, lleva flujos de trabajo profesionales de varios pasos hasta el final y comprueba sus propios datos casi el doble de bien que GPT-5.6 Sol, dentro del mismo ecosistema de ChatGPT, Codex y API que ya conoces.

9.8 Nota editorial
Leer reseña
#3

Claude Fable 5.1

Anthropic

Los mismos pesos que el exclusivo Mythos 5.1, pero con la capa de seguridad que la mayoría realmente obtiene. Es el modelo que Anthropic te dice que uses cuando Opus 5 a alto esfuerzo pierde en tu evaluación privada: codificación a largo plazo, investigación de varias horas, y documentos que deben mantener la coherencia.

9.8 Nota editorial
Leer reseña
#4

Claude Sonnet 5.5

Anthropic

Claude Sonnet 5.5 es el asistente para la semana laboral de siempre: resumir documentos, montar hojas de cálculo y presentaciones, redactar informes. En las pruebas independientes de trabajo de oficina queda a uno o dos puntos de Opus 5.5, está disponible en el plan gratuito de Claude y sus tokens de API cuestan la mitad. Eso sí, Opus sabe más datos y resuelve mejor los problemas realmente enrevesados.

9.7 Nota editorial
Leer reseña
#5

GPT-6.1 Sol

OpenAI

GPT-6.1 Sol es el modelo de trabajo diario de OpenAI: el que usas en ChatGPT Work para revisar informes, archivos PDF y tareas de múltiples pasos. En pruebas independientes, se sitúa a solo un punto de GPT-6 Astra, el modelo insignia de OpenAI, pero el costo por tarea típica es menos de una cuarta parte. Lee bien documentos largos y comete menos errores factuales que el modelo al que reemplaza. Según OpenAI, también puede operar aplicaciones de escritorio casi tan bien como Astra.

9.6 Nota editorial
Leer reseña
#6

Gemini 3.1 Pro

Google DeepMind

Gemini 3.1 Pro es el especialista reflexivo de Google: un buque insignia veterano que aún sobresale en ciencia, lógica nueva, documentos extensos e investigación multimodal. La familia Flash es más rápida y barata, pero 3.1 Pro conserva valor cuando importa más la calidad del análisis que llegar primero.

9.6 Nota editorial
Leer reseña
#7

Grok 4.7

xAI

Grok 4.7 mantiene el precio bajo de Grok 4.6 —$2 de entrada y $6 de salida por millón de tokens—, pero es un modelo claramente más fuerte y más cuidadoso. xAI lo entrenó con tareas más largas y difíciles y le enseñó a revisar su propio trabajo. Es la forma más económica de conseguir ayuda casi de primer nivel para trabajo de oficina, borradores jurídicos y matemáticas de ingeniería.

9.6 Nota editorial
Leer reseña
#8

Qwen3.8-Max

Alibaba / Qwen Team

Qwen3.8 ahora tiene dos formas importantes: el producto Qwen3.8-Max alojado con visión, herramientas integradas y un contexto predeterminado de 1M, y el primer punto de control descargable de nivel Max de Qwen. El modelo abierto es un modelo de texto de 2.4T en total, 95B activos, con un contexto nativo de 262K ampliable a aproximadamente un millón de tokens.

9.0 Nota editorial
Leer reseña
Preguntas respondidas

Preguntas frecuentes