Claude Opus 5.5 ya está en Felo Search: Respuestas que resisten la verificación
Claude Opus 5.5 está disponible en Felo Search: 1M de contexto, $4/$20 por millón de tokens y respuestas verificadas con la evidencia antes de que actúes sobre ellas.
Anthropic lanzó Claude Opus 5.5 el 22 de septiembre, y el número que importa para la búsqueda no aparece en la tabla de benchmarks. Es el precio: $4 por millón de tokens de entrada y $20 por millón de tokens de salida, frente a los $5 y $25 de Opus 5. Anthropic calcula una reducción de costos operativos de cerca del 40% en cargas de trabajo típicas, con una salida más de 30% más rápida.
Opus 5.5 está activo en Felo Search ahora. Más barato y más rápido ya sería suficiente. Lo que lo hace valioso para investigación es que también se volvió más cuidadoso.

Qué es realmente Claude Opus 5.5
Opus 5.5 es el primer lanzamiento de Anthropic desde que la empresa pidió públicamente frenar el desarrollo de frontera en septiembre. Se sitúa en la cima de la línea Opus, por encima de Claude Sonnet 5, con la línea Fable reservada para otro tipo de despliegue.
La especificación se diseñó para trabajo que necesita defensa, no solo producción: una ventana de contexto de un millón de tokens, una salida máxima de 128,000 tokens y lecturas de caché a $0.20 por millón de tokens que permiten repetir sesiones largas e iterativas sin alto costo.
| Especificación | Claude Opus 5.5 |
|---|---|
| ID del modelo | claude-opus-5-5 |
| Fabricante | Anthropic |
| Lanzamiento | 22 de septiembre de 2026 |
| Ventana de contexto | 1,000,000 tokens |
| Salida máxima | 128,000 tokens |
| Entrada | Texto, imagen |
| Salida | Texto |
| Precio | $4 por millón de entrada, $20 por millón de salida |
| Entrada en caché | $0.20 por millón de tokens |
| Generación previa | Opus 5, lanzado el 24 de julio de 2026 a $5 / $25 |
Dos filas en esa tabla explican por qué un flujo de trabajo de investigación nota este modelo.
Un millón de tokens de contexto. Eso equivale a unas 750,000 palabras, una pila de documentos fuente que de otro modo tendrías que resumir antes de hacer una pregunta sobre ellos. El resumen previo introduce errores: el resumen lo escribe un modelo que no sabe qué detalle vas a necesitar.
Lecturas de caché a una quinta parte del precio de entrada. Una investigación en Felo Search no es una sola llamada. Es un primer pase, un desafío, una revisión y una síntesis, cada uno releyendo las mismas fuentes. El caché convierte la relectura repetida en un costo insignificante.
Por qué la verificación es el problema central en la búsqueda con IA
Haz una pregunta a un motor de búsqueda con IA y recibes una respuesta bien redactada. Eso ya no es lo difícil. El reto es saber si la frase sobre la que vas a actuar resistiría una revisión.
La verificación es una habilidad distinta al resumen. Implica notar que dos fuentes describen la misma estadística con denominadores diferentes. Implica señalar que el único respaldo de una afirmación es un comunicado de prensa. Implica devolver "la evidencia aquí es escasa" en vez de un párrafo seguro.
Anthropic publicó cuatro benchmarks en el anuncio de Opus 5.5, y el patrón entre ellos merece atención:
| Benchmark | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 57.9% |
| FrontierCode v1.1 (Main) | 54.4% | 53.3% |
| AutomationBench | 40.0% | 41.4% |
| Terminal-Bench-Science 0.1 | 58.7% | 64.6% |
Anthropic lidera en dos y queda detrás en dos, lo que resulta más útil que un dominio total. Astra mantiene la ventaja en tareas terminales científicas y automatización de procesos de negocio; Opus 5.5 domina en codificación agente general y código de frontera.
La nota metodológica importa más que los puntajes. Anthropic evaluó Opus 5.5 con sus salvaguardas de producción activadas: la misma configuración que reciben los usuarios, incluyendo el enrutamiento que envía solicitudes riesgosas a un modelo anterior. Un sistema de seguridad que solo existe en la evaluación no es un sistema de seguridad. La empresa también reporta cerca de 85% menos intentos de eludir límites de contención que Opus 5, y su mejor resultado de alineación hasta la fecha.
Para búsqueda, esa configuración es el producto. Un modelo que rechaza responder resulta molesto. Un modelo que responde a una pregunta que debió rechazar, con fluidez y citas, resulta peor.
Cómo usar Claude Opus 5.5 en Felo Search
1. Selecciónalo en el selector de modelos. Abre Felo Search, elige Claude Opus 5.5 y pregunta en el mismo cuadro de siempre.
2. Entrégale todo el conjunto de documentos, no un resumen. La ventana de un millón de tokens vale más cuando dejas de comprimir previamente. Sube los informes, los artículos, el hilo, todo, y formula tu pregunta sobre el texto completo.
3. Pide las advertencias de forma explícita. "¿Qué tendría que ser cierto para que esta conclusión sea incorrecta?" y "¿cuál de estas fuentes es la más débil?" son preguntas que un modelo entrenado en verificación responde distinto a un resumidor.
4. Haz que muestre el desacuerdo. Cuando las fuentes discrepan, pídele que exponga dónde coinciden, dónde divergen y qué afirmación tiene el respaldo más débil. Ese es el resultado que buscas en una investigación.
5. Itera en el mismo hilo. Las lecturas de caché cuestan poco; reiniciar no. Mantén el desafío, la corrección y la síntesis final en una sesión para que el modelo conserve la evidencia original a la vista.
Los otros tres modelos activos en Felo Search
Opus 5.5 llegó casi al mismo tiempo que otros tres lanzamientos de frontera, y Felo Search ejecuta los cuatro.
| Modelo | Lanzado por | Precio por millón de tokens | Contexto | Diseñado para |
|---|---|---|---|---|
| Grok 4.7 | SpaceXAI | $2 entrada / $6 salida | 500K | Razonamiento a largo plazo y trabajo de conocimiento |
| Claude Opus 5.5 | Anthropic | $4 entrada / $20 salida | 1M | Respuestas que resisten verificación |
| GPT-6 Luna | OpenAI | $0.10 entrada / $0.50 salida | 1.05M | Búsqueda de alto volumen al menor costo por consulta |
| GPT-6 Sol | OpenAI | $2 entrada / $10 salida | 1.05M | Bucles de agente y llamadas repetidas a precio medio |
Opus 5.5 es el más caro de los cuatro en salida, y es el único donde el proveedor publicó su configuración de seguridad junto con los puntajes. Úsalo para preguntas donde equivocarse cuesta más que tardar.
Qué probar primero
Una afirmación que piensas repetir. Elige una estadística que vas a incluir en un documento y pide a Opus 5.5 que la rastree hasta su origen. Lo interesante no es el número, sino el rastro.
Una decisión con dos respuestas defendibles. Dale ambas opciones y las restricciones, luego pregunta cuál respalda realmente la evidencia y qué cambiaría la respuesta.
Un documento que estás por firmar. Contratos, políticas y términos de servicio benefician a un modelo que reporta lo que falta en vez de lo que está presente.
Un hilo de investigación que ya ejecutaste. Repite una pregunta que hiciste hace un mes y compara las advertencias. Esa diferencia muestra lo que la generación anterior no hacía.
Prueba Claude Opus 5.5 en Felo Search
Claude Opus 5.5 está activo en Felo Search con una ventana de contexto de un millón de tokens, precios de $4/$20 y salvaguardas de producción activadas. Operar cuesta 40% menos que el modelo anterior y es la configuración que Anthropic respalda con su propio nombre.
Abre Claude Opus 5.5 en Felo Search →
Esta publicación también está disponible en English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, বাংলা and Português.