24 de julio de 2026

Claude Opus 5: novedades, precios y qué cambia para desarrolladores (2026)

Foto de Marco Orta Marco Orta | 11 min de lectura
Compartir
Ilustración 3D del lanzamiento de Claude Opus 5 de Anthropic en 2026: novedades, precios y escalera de esfuerzo
Tabla de Contenidos

    El 24 de julio de 2026 Anthropic lanzó Claude Opus 5 (claude-opus-5), su modelo más capaz para coding agéntico y trabajo empresarial: 1 millón de tokens de contexto, pensamiento activado por defecto, una nueva escalera de esfuerzo que llega hasta max y —lo más importante— el mismo precio que Opus 4.8: 5 USD por millón de tokens de entrada y 25 USD de salida. Anthropic lo describe como un salto “de otra categoría” frente a Opus 4.8, no una mejora incremental, y lo posiciona como inteligencia de frontera a la mitad del costo de Claude Fable 5.

    Es el cuarto modelo que Anthropic publica en menos de dos meses —tras Mythos 5, Fable 5 y Sonnet 5 en junio— y llega dos semanas después de que OpenAI renovara ChatGPT con la familia GPT-5.6. En esta guía te ordeno lo que de verdad cambia, desde la mirada de quien integra estos modelos en producto real: qué hay de nuevo, cuánto cuesta y cómo migrar tu código sin sorpresas.

    Ficha rápida de Claude Opus 5

    • ID de modelo (API): claude-opus-5
    • Ventana de contexto: 1M de tokens (es el valor por defecto y el máximo; no hay variante más pequeña)
    • Salida máxima: 128k tokens (hasta 300k con la beta de lotes)
    • Precio: 5 USD / millón de entrada · 25 USD / millón de salida (sin cambios respecto a Opus 4.8)
    • Corte de conocimiento fiable: mayo de 2026
    • Pensamiento (thinking): activado por defecto
    • Esfuerzo (effort): low, medium, high, xhigh y max
    • Disponible en: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry y las apps Pro, Max, Team y Enterprise

    ¿Qué es Claude Opus 5?

    Claude Opus 5 es el modelo insignia de la familia Opus de Anthropic, orientado a coding agéntico complejo, razonamiento profundo y tareas de larga duración. “Opus” es la línea de mayor capacidad para trabajo pesado; por encima solo queda Claude Fable 5, más caro y pensado para agentes de muy largo aliento.

    La diferencia respecto a versiones anteriores no está en un número de benchmark aislado, sino en la consistencia: Opus 5 mantiene el hilo a lo largo de cadenas de razonamiento de muchos pasos, completa funciones multi-archivo sin dejar TODOs ni stubs, y verifica su propio trabajo sin que se lo pidas. Según Anthropic, en su prueba interna sobre la plataforma de Box, Opus 5 supera a Opus 4.8 en un 8 % de media, con un 17 % de mejora en due diligence y un 11 % en análisis de datos.

    Las novedades que de verdad importan

    1. El pensamiento viene activado por defecto

    En Opus 4.8 las peticiones corrían sin “thinking” salvo que activaras thinking: {"type": "adaptive"}. En Opus 5 el pensamiento está encendido por defecto: el modelo decide cuándo y cuánto razonar en cada turno, y el nuevo control es el parámetro effort.

    Ojo con un detalle práctico: como max_tokens es un límite duro que suma el razonamiento más la respuesta, si migras una carga que antes corría sin pensar, revisa ese valor o te quedarás corto de salida.

    2. Escalera de esfuerzo completa: de low a max

    Opus 5 estrena la escalera de esfuerzo completa: low, medium, high, xhigh y max, siendo max el nuevo tope para el razonamiento más profundo posible. Es, en la práctica, el “interruptor entre costo y capacidad” del que hablaron los medios el día del lanzamiento: subes el esfuerzo cuando la tarea lo justifica y lo bajas para trabajo rutinario.

    Y aquí está la joya para quien mira la factura: con low y medium, Opus 5 entrega calidad muy alta con una fracción de los tokens y la latencia de los niveles superiores. En el benchmark de trading de Anthropic, el modelo resolvió las tareas usando aproximadamente una séptima parte de los tokens de razonamiento que gastaba Opus 4.8.

    Cambio que rompe compatibilidad: deshabilitar el pensamiento (thinking: {"type": "disabled"}) solo se acepta con esfuerzo high o inferior. Si lo combinas con xhigh o max, la API devuelve un error 400.

    3. Rendimiento: coding agéntico y razonamiento profundo

    Las mayores ganancias frente a Opus 4.8 están, por orden, en:

    • Razonamiento profundo: sostiene análisis multipaso a lo largo de cadenas de problemas largas.
    • Coding agéntico y tareas de larga duración: no se pierde en bucles extensos de uso de herramientas y termina refactors grandes y features de punta a punta.
    • Escalado en tiempo de inferencia: convierte más esfuerzo (hasta max) en mejores resultados, de forma predecible.
    • Revisión de código y caza de bugs: encuentra errores reales a buena tasa por pasada y con pocos falsos positivos.
    • Visión: interpreta gráficas, documentos y diagramas, y replica interfaces y visuales de frontend.

    En modelado financiero, Anthropic reporta 9 puntos porcentuales más de precisión que Opus 4.8 y un tercio menos de turnos para llegar al resultado.

    4. Inteligencia de frontera a mitad de precio

    Este es el titular económico: Opus 5 ofrece, según Anthropic, inteligencia de frontera a la mitad del costo de Claude Fable 5 (que cuesta 10 / 50 USD por millón). Se acerca a la capacidad de Fable 5 pagando 5 / 25 USD. Para la mayoría de productos reales, eso convierte a Opus 5 en el punto dulce entre potencia y presupuesto —Fable 5 queda reservado para los agentes autónomos más exigentes.

    5. Cambios de API que agradecerás

    Tres mejoras silenciosas pero útiles:

    • Cambios de herramientas a mitad de conversación (beta): puedes añadir o quitar herramientas entre turnos preservando el caché de prompt, en vez de reenviar la lista completa toda la sesión.
    • Modo de fallback por defecto: cuando el modelo rechaza una petición por seguridad, la API puede recurrir automáticamente a otro modelo en lugar de devolver un error —una respuesta directa a la frustración con los rechazos.
    • Mínimo de caché más bajo: el prompt mínimo cacheable baja a 512 tokens (era 1.024 en Opus 4.8), así que prompts que antes eran demasiado cortos para cachearse ahora sí ahorran, sin tocar código.

    Opus 5 frente a Opus 4.8, Sonnet 5 y Fable 5

    ¿Qué modelo de Anthropic elegir en 2026? Esta es la foto de la familia actual:

    Opus 5Fable 5Sonnet 5Opus 4.8
    Para quéCoding agéntico y trabajo empresarialAgentes de muy larga duraciónEquilibrio velocidad/inteligenciaGeneración anterior
    ID de APIclaude-opus-5claude-fable-5claude-sonnet-5claude-opus-4-8
    Contexto1M tokens1M tokens1M tokens1M tokens
    Salida máx.128k128k128k128k
    Precio (entrada/salida por MTok)5 / 25 USD10 / 50 USD3 / 15 USD5 / 25 USD
    PensamientoActivado por defectoSiempre activoAdaptativoAdaptativo
    LatenciaModeradaMás lentaRápidaModerada
    Corte de conocimientoMayo 2026Enero 2026Enero 2026Enero 2026

    En resumen: Sonnet 5 si priorizas velocidad y costo, Opus 5 como caballo de batalla para lo complejo, y Fable 5 solo cuando necesitas el techo de capacidad y puedes pagarlo.

    Precios de Claude Opus 5

    Opus 5 mantiene la tarifa de Opus 4.8, sin subida:

    ConceptoPrecio
    Entrada5 USD / millón de tokens
    Salida25 USD / millón de tokens
    Caché de promptHasta 90 % de ahorro
    Procesamiento por lotes50 % de descuento
    Fast mode (solo API, research preview)10 / 50 USD por millón

    Como el pensamiento cuenta como tokens de salida, la factura real depende mucho del nivel de effort que elijas. Antes de mover una carga a Opus 5, te conviene estimar el costo con una calculadora de tokens de IA y contrastarlo con lo que ya pagas —te dejé una comparativa completa en cuánto cuesta la API de OpenAI, Claude y Gemini en 2026.

    Qué cambia para quienes programan con la API

    Migrar desde Opus 4.8 es, en lo básico, cambiar el ID del modelo:

    import anthropic
    
    client = anthropic.Anthropic()
    
    with client.messages.stream(
        model="claude-opus-5",          # antes: "claude-opus-4-8"
        max_tokens=64000,               # deja margen: el pensamiento también consume max_tokens
        output_config={"effort": "high"},  # low | medium | high | xhigh | max
        messages=[
            {"role": "user", "content": "Refactoriza este módulo y explica los cambios."}
        ],
    ) as stream:
        response = stream.get_final_message()
    
    print(response)
    

    Más allá del ID, hay tres cosas que debes revisar:

    1. Pensamiento activado por defecto. No necesitas el campo thinking. Si tu integración debe correr sin pensar, recuerda que solo es válido con effort: high o inferior.
    2. Quita las instrucciones de verificación heredadas. Opus 5 se autoverifica; frases como “añade un paso de verificación final” o “usa un subagente para verificar” provocan sobre-verificación. Bórralas de tus prompts antiguos.
    3. Respuestas más largas y más narradas. Por defecto Opus 5 escribe entregables más extensos, narra su progreso más a menudo y delega en subagentes con más soltura. Si necesitas respuestas concisas, pídelo explícitamente en el prompt.

    Un detalle menor pero importante: con el pensamiento deshabilitado, Opus 5 puede a veces escribir una llamada de herramienta en el texto en lugar de emitir un bloque tool_use. La recomendación de Anthropic es mantener el pensamiento encendido y controlar el gasto bajando el effort.

    Dónde usar Claude Opus 5 hoy

    Está disponible desde el día del lanzamiento en:

    • Claude API como claude-opus-5 (para todos los clientes).
    • Amazon Bedrock (anthropic.claude-opus-5), Google Cloud y Microsoft Foundry.
    • Las apps de Claude para planes Pro, Max, Team y Enterprise.

    Opus 4.8 sigue disponible en todas esas plataformas, así que puedes migrar a tu ritmo. Si construyes agentes que orquestan varios modelos, Opus 5 encaja como el “cerebro” de razonamiento; te lo cuento en detalle en la guía de IA agéntica y agentes de IA en 2026.

    Primeras reacciones

    No todo fueron aplausos. En las primeras horas, parte de la comunidad se quejó de los límites de uso en las apps —muchos usuarios esperaban un reinicio de cuota que no llegó con el lanzamiento— y de que Fable 5, el hermano mayor, había ganado fama de “quemar” tokens y disparar presupuestos. Anthropic parece haber tomado nota: Opus 5 es notablemente más eficiente en niveles de esfuerzo bajos y estrena fallback automático para suavizar los rechazos. Como siempre, la prueba está en tu propio caso de uso: mide antes de casarte con un modelo.

    Qué significa para tu empresa

    Si integras IA en tu producto o en tus procesos, la lectura práctica de Opus 5 es sencilla: más capacidad por el mismo precio, y una palanca (effort) para ajustar costo y calidad tarea por tarea. Eso hace viables casos que antes no cerraban por presupuesto —revisión de código, análisis de documentos, agentes de soporte, automatización de back-office— sin saltar al escalón más caro de la familia.

    En OrtaMarco ayudo a PyMEs y equipos a integrar estos modelos en flujos reales: elegir el modelo correcto, controlar el gasto de tokens y llevar el agente a producción. Si estás evaluando Opus 5 para tu negocio, escríbeme y lo aterrizamos a tu caso.

    Preguntas frecuentes

    ¿Cuándo salió Claude Opus 5? El 24 de julio de 2026, disponible desde el primer día en la Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry y las apps de Claude (Pro, Max, Team y Enterprise).

    ¿Cuánto cuesta Claude Opus 5? 5 USD por millón de tokens de entrada y 25 USD de salida —el mismo precio que Opus 4.8—, con hasta 90 % de ahorro por caché de prompt y 50 % por lotes.

    ¿En qué se diferencia de Opus 4.8? Pensamiento activado por defecto, escalera de esfuerzo hasta max, autoverificación, mayor consistencia en tareas largas y mucho menos gasto de tokens de razonamiento, todo al mismo precio.

    ¿Qué es la escalera de esfuerzo? Un parámetro de cinco niveles (low a max) que ajusta cuánto razona el modelo: el interruptor entre costo y capacidad.

    ¿Cómo migro desde Opus 4.8? Cambia el ID a claude-opus-5, revisa max_tokens, quita las instrucciones de verificación manual y ten en cuenta que deshabilitar el pensamiento requiere effort: high o inferior.

    ¿Opus 5 o Fable 5? Opus 5 para el trabajo complejo del día a día; Fable 5 solo cuando necesitas el máximo de capacidad y puedes pagar el doble.


    Fuentes: Claude Opus (Anthropic), Models overview (Anthropic Docs) y documentación de effort. Datos verificados el 24 de julio de 2026.

    Compartir

    Buscar

    Etiquetas

    Tutorial Laravel PHP IA Buenas Prácticas Desarrollo Web JavaScript Laravel 13 Seguridad SEO Claude Expresiones Regulares Manipulación de Texto Frontend OpenAI