Skip to main content

Claude Opus 5 ahora en Felo: Características, precios y prueba gratuita de 7 días

· 14 min de lectura
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo ahora es compatible con Claude Opus 5. Explora características, benchmarks, seguridad y precios, y prueba gratis durante 7 días el modelo de codificación agentica de Anthropic.

Felo ahora es compatible con Claude Opus 5, el nuevo modelo de Anthropic de nivel Opus para codificación agentica, análisis profesional y trabajos de larga duración. Elígelo en Felo cuando una tarea requiera más que una buena primera respuesta: necesita investigación, verificación, iteración y un resultado que puedas revisar con confianza.

Para celebrar el lanzamiento, los suscriptores de Felo Pro pueden usar Claude Opus 5 sin costo adicional durante siete días a partir de la fecha de lanzamiento. Tráele un error persistente, un informe de investigación con evidencia contradictoria, un análisis de varios pasos o un documento que necesita más de una revisión para quedar bien—y evalúalo en trabajos que realmente te importan.

Claude Opus 5 launch announcement from Anthropic, shown unchanged with a gray border

Imagen de portada: obra original del anuncio de Claude Opus 5 de Anthropic. El contenido visual está sin cambios; Felo solo añadió el borde gris.

Esto es más que una nota de lanzamiento. A continuación tienes una guía visual sobre para qué está diseñado Opus 5, qué informa Anthropic en sus evaluaciones, dónde siguen existiendo límites y cómo probarlo con trabajo real en Felo.

¿Listo para probarlo? Inicia tu prueba gratuita de 7 días de Claude Opus 5 en Felo ->

Características de Claude Opus 5: para qué está construido el modelo

Anthropic lanzó Claude Opus 5 el 24 de julio de 2026, posicionándolo como un modelo de alta capacidad para el día a día en agentes de larga duración, ingeniería de software y trabajo profesional de conocimiento. Según la propia descripción de Anthropic, el cambio clave no es simplemente una mejor primera respuesta. Opus 5 está pensado para trabajar de manera más deliberada: verificar resultados intermedios, mantener el hilo de una tarea compleja e iterar cuando el primer intento no resuelve el problema real.

Esa distinción importa en el trabajo práctico. Una pregunta rutinaria puede requerir solo una respuesta rápida y concisa. Una tarea mayor puede requerir que el modelo lea material fuente, decida qué necesita saber aún, realice un cálculo o use una herramienta, compare alternativas, revise su salida y explique el resultado. Esos son los casos donde un modelo de nivel Opus vale más la pena.

Anthropic destaca tres fortalezas que se superponen:

  • Codificación agentica: funciones más grandes, depuración difícil, análisis de causa raíz, refactorizaciones y tareas que abarcan más de un archivo o herramienta.
  • Trabajo de conocimiento y análisis: razonamiento estructurado sobre material denso, trabajo numérico y de tablas, diligencia debida, investigación y apoyo a la toma de decisiones.
  • Flujos de trabajo de uso de computadora y automatización: completar una secuencia de pasos en vez de producir una sola respuesta aislada.

Ninguna de estas afirmaciones significa que un modelo deba quedar sin supervisión. Sí significa que puede abordar un borrador más completo de trabajos difíciles antes de que una persona revise la decisión, la evidencia y la acción final.

Benchmarks y capacidades de Claude Opus 5

Los benchmarks de modelos son señales útiles, no una garantía de que el modelo funcionará igual en cada proyecto. Dependen de la tarea, el entorno, la configuración y el método de puntuación. Aun así, el lanzamiento de Anthropic ofrece una imagen útil de los problemas que Opus 5 busca resolver.

Para ingeniería de software, Anthropic informa que Opus 5 lidera su ejecución interna de Frontier-Bench v0.1 y más que duplica el rendimiento reportado de Opus 4.8 a un menor costo por tarea. El gráfico a continuación es útil porque concreta la comparación: la serie naranja de Opus 5 supera los resultados previos de Opus en todos sus niveles de esfuerzo, no solo en el punto más costoso.

Anthropic's Frontier-Bench v0.1 chart comparing agentic coding score with cost per attempt, shown unchanged with a gray border

Fuente: Anthropic, Introducing Claude Opus 5. Gráfico original sin cambios; borde gris añadido por Felo. El gráfico indica que la ejecución de Frontier-Bench usó un entorno mini-SWE-agent, backend GKE y recompensa media sobre cinco intentos por tarea.

En CursorBench 3.2, Anthropic dice que el modelo se queda a solo 0.5% del puntaje máximo de Claude Fable 5 en el mayor esfuerzo, mientras cuesta la mitad por tarea. Por eso Opus 5 es más interesante para tareas donde un primer intento de baja calidad genera más trabajo: depuración en toda una base de código, construcción de una función de extremo a extremo o rastreo de la causa raíz en vez de parchear el síntoma.

Para resolución de problemas más amplia y trabajo de oficina, la empresa informa que Opus 5:

  • obtuvo un puntaje tres veces mayor que el siguiente mejor modelo en ARC-AGI 3, una evaluación de resolución de problemas novedosos;
  • logró aproximadamente 1.5 veces la tasa de éxito del siguiente mejor modelo al mismo costo por tarea en Zapier AutomationBench, que prueba automatización empresarial de extremo a extremo;
  • superó a otros modelos a costo comparable en OSWorld 2.0, un benchmark de uso de computadora; y
  • es su modelo más eficiente y rentable en las evaluaciones relacionadas ARC-AGI 3, GDPval-AA v2, HLE, AutomationBench y DeepSearchQA.

La imagen no se limita al código. El gráfico GDPval-AA v2 de Anthropic rastrea tareas de conocimiento del mundo real en diferentes niveles de esfuerzo. Ayuda a explicar por qué Opus 5 puede ser relevante para investigación, finanzas, legal, operaciones y otros trabajos donde una respuesta debe resistir la revisión, no solo sonar bien en la primera pasada.

Anthropic's GDPval-AA v2 chart comparing real-world knowledge task scores by effort level, shown unchanged with a gray border

Fuente: Anthropic, Introducing Claude Opus 5. Gráfico original sin cambios; borde gris añadido por Felo.

Estos son resultados publicados por Anthropic, incluyendo ejecuciones internas de evaluación y comentarios seleccionados de acceso anticipado, no rankings universales independientes. La forma más productiva de leerlos es como guía para dónde probar el modelo tú mismo: tareas con cadenas largas de dependencias, requisitos ambiguos, uso de herramientas, verificación y consecuencias importantes si una respuesta superficial se cuela.

Características de Claude Opus 5: por qué el “esfuerzo” cambia la experiencia

Opus 5 admite diferentes configuraciones de esfuerzo. En términos simples, el esfuerzo te permite intercambiar velocidad de respuesta y uso de tokens por más tiempo de razonamiento. Los gráficos de Anthropic comparan el modelo en varios niveles de esfuerzo, desde configuraciones bajas pensadas para ahorrar tokens hasta esfuerzo alto, xhigh y máximo.

Esto es útil porque no todas las solicitudes merecen el mismo presupuesto. Usa un nivel bajo para una clasificación rápida, un esquema o una revisión puntual. Aumenta el esfuerzo cuando la tarea tiene múltiples restricciones, cuando el modelo debe reconciliar fuentes o cuando debe diagnosticar por qué falló un intento anterior. Para salidas de alto impacto, dedica el tiempo ahorrado a una revisión: pide al modelo que identifique supuestos, cite sus fuentes, pruebe casos límite o explique qué cambiaría su recomendación.

El lanzamiento también introduce un modo rápido opcional en la propia plataforma de Anthropic. Anthropic dice que funciona aproximadamente 2.5 veces más rápido que el estándar y cuesta el doble de la tarifa base allí. La disponibilidad y los controles pueden variar según el producto, así que en Felo debes usar las configuraciones que aparecen en tu espacio de trabajo en vez de asumir que todas las opciones de Anthropic aparecen igual.

La diferencia se nota en cómo se verifica a sí mismo

El tema más interesante del lanzamiento es la verificación. Anthropic describe una evaluación en la que Opus 5 recibió un dibujo de una pieza mecánica pero no tenía forma directa de verla. En vez de detenerse, el modelo supuestamente escribió un pipeline de visión computacional para recuperar la geometría de los píxeles crudos y luego reconstruyó la pieza como un modelo 3D en FreeCAD. En otro ejemplo, Anthropic dice que el modelo halló la causa raíz de un error real en un gestor de paquetes y abordó un caso límite que una corrección comunitaria pasó por alto.

Ejemplos como estos deben tratarse como demostraciones del creador del modelo, no como promesas. Pero sugieren un patrón concreto de prompts para Felo: no pidas solo la respuesta. Pide el ciclo de trabajo.

Investiga el problema y luego propone una solución.
Antes de finalizar, verifica la solución según los requisitos indicados,
enumera cualquier supuesto e identifica pruebas o evidencia que podrían refutarla.
Devuelve la recomendación final por separado de las notas de trabajo.

Para investigación, el mismo enfoque puede convertir un prompt amplio en un proceso revisable: recopila fuentes actuales, distingue hechos de inferencias, busca contra-evidencia y produce un informe de decisión conciso. El flujo de trabajo multilingüe de Felo es especialmente útil cuando el material relevante aparece en varios idiomas; pide que se preserve el idioma fuente junto a una síntesis clara en inglés cuando sea necesario.

Anthropic también informa buenos resultados en OSWorld 2.0, un benchmark para operar una computadora mediante interfaces de varios pasos. Es un recordatorio útil de que el trabajo agentico a menudo no es “un prompt, una respuesta”. Es una secuencia de revisión de estado, elección de la siguiente acción y validación de si el resultado realmente cumple el objetivo.

Anthropic's OSWorld 2.0 chart comparing agentic computer-use performance with cost per task, shown unchanged with a gray border

Fuente: Anthropic, Introducing Claude Opus 5. Gráfico original sin cambios; borde gris añadido por Felo.

El rendimiento no es la única consideración: seguridad y límites

Anthropic informa que su auditoría de comportamiento previa al despliegue encontró que Opus 5 es su modelo más alineado recientemente. Afirma que el modelo mostró menor comportamiento desalineado, menor comportamiento engañoso y mayor resistencia a prompts de uso indebido que otros modelos recientes de Claude. La empresa también dice que Opus 5 no amplía el límite de capacidades de doble uso riesgosas en sus pruebas de biología y ciberseguridad ofensiva.

El siguiente gráfico de auditoría es el resumen visual más claro de esa afirmación. En la escala de comportamiento desalineado de Anthropic de 1 a 10, menor es mejor; Opus 5 aparece en 2.30, por debajo de los otros modelos recientes en la comparación. Es una evaluación interna de seguridad, así que debe informar—no reemplazar—controles humanos cuidadosos en trabajos importantes.

Anthropic's automated behavioral audit chart showing Opus 5 with the lowest misaligned-behavior score among the compared models, shown unchanged with a gray border

Fuente: Anthropic, Introducing Claude Opus 5. Gráfico original sin cambios; borde gris añadido por Felo.

El punto práctico importante es que las salvaguardas siguen siendo parte del producto. Anthropic dice que Opus 5 puede ayudar a encontrar vulnerabilidades en código fuente pero coloca barreras más fuertes en ciertas actividades cibernéticas, incluyendo escaneo de vulnerabilidades basado en binarios, pruebas de penetración y generación de exploits. Las solicitudes que activen esas salvaguardas pueden ser bloqueadas o, en algunos productos de Anthropic, pasar a otro modelo.

Para todo el resto del trabajo, mantén los mismos buenos hábitos que usarías con cualquier modelo capaz:

  • Revisa afirmaciones, cálculos, citas, código y acciones finales antes de confiar en ellos.
  • No trates la fluidez como evidencia. Pide fuentes primarias y revísalas.
  • Mantén a una persona responsable de decisiones legales, financieras, médicas, de seguridad y otras de importancia.
  • Da al modelo una condición clara de éxito y los límites que no debe cruzar.

Anthropic también señala que Opus 5 aún tiene limitaciones importantes en tareas autónomas de investigación de larga duración. Capacidad no es autonomía, y un ciclo de revisión humana bien diseñado sigue siendo parte de un flujo de trabajo sólido.

Precios de Claude Opus 5 y prueba gratuita en Felo

Anthropic lista Claude Opus 5 a $5 por millón de tokens de entrada y $25 por millón de tokens de salida a través de la API de Claude, las mismas tarifas base que para Opus 4.8. Los precios en plataformas de terceros, suscripciones y funciones pueden variar, así que usa la información de precios y uso que aparece en el producto donde trabajas.

Para los suscriptores de Felo Pro, el punto inmediato es más simple: Claude Opus 5 es gratis para probar durante siete días desde su lanzamiento. Eso te permite evaluarlo con tareas reales antes de decidir dónde encaja en tu mezcla habitual de modelos. Una comparación sensata no es solo “¿Qué modelo escribió el mejor primer borrador?” Prueba la misma tarea difícil con el modelo que usas hoy y compara completitud, tasa de error, necesidad de seguimiento, calidad en el manejo de fuentes y cuánto tiempo de revisión necesita cada resultado.

Cómo probar Claude Opus 5 gratis durante 7 días en Felo Pro

  1. Inicia sesión en tu cuenta de Felo Pro.
  2. Comienza una nueva tarea en el espacio de trabajo de Felo que normalmente usas para investigación, escritura, análisis o trabajo agentico.
  3. Selecciona Claude Opus 5 en el selector de modelos.
  4. Asígnale una tarea con un entregable claro, archivos o contexto relevante y un paso explícito de verificación.
  5. Revisa el resultado, refina la instrucción donde sea necesario y compáralo con tu flujo de trabajo actual durante la oferta de lanzamiento de siete días.

Empieza con trabajos que revelen las fortalezas del modelo: un plan de proyecto que requiere compensaciones, una hoja de cálculo o informe complejo, una revisión de código difícil, una pregunta de investigación de múltiples fuentes o un análisis que debe resistir preguntas de seguimiento. El objetivo no es impresionar al modelo con un prompt ingenioso. Es descubrir si realmente hace tu trabajo más claro, confiable y fácil de terminar.

Usa la oferta en una tarea que importe: Inicia tu prueba de Claude Opus 5 en Felo ->

¿Vale la pena probar Claude Opus 5?

Claude Opus 5 aporta una nueva opción a Felo para tareas que recompensan la persistencia, el razonamiento cuidadoso y la verificación. Sus resultados publicados apuntan a avances significativos en codificación agentica, automatización, uso de computadora y análisis profesional, mientras que sus restricciones de seguridad y limitaciones siguen siendo contexto importante.

Durante los próximos siete días, los suscriptores de Felo Pro pueden evaluarlo sin costo adicional por modelo. Trae una tarea que realmente importe, pídele que muestre y revise su trabajo, y decide a partir del resultado si Claude Opus 5 merece un lugar permanente en tu flujo de trabajo.

Inicia tu prueba gratuita de 7 días de Claude Opus 5 en Felo ->


Fuentes y lecturas adicionales


Esta publicación también está disponible en English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, বাংলা and Português.