



const { OpenAI } = require('openai');
const api = new OpenAI({
baseURL: 'https://api.ai.cc/v1',
apiKey: '',
});
const main = async () => {
const result = await api.chat.completions.create({
model: 'anthropic/claude-opus-4-8',
messages: [
{
role: 'system',
content: 'You are an AI assistant who knows everything.',
},
{
role: 'user',
content: 'Tell me, why is the sky blue?'
}
],
});
const message = result.choices[0].message.content;
console.log(`Assistant: ${message}`);
};
main();
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.ai.cc/v1",
api_key="",
)
response = client.chat.completions.create(
model="anthropic/claude-opus-4-8",
messages=[
{
"role": "system",
"content": "You are an AI assistant who knows everything.",
},
{
"role": "user",
"content": "Tell me, why is the sky blue?"
},
],
)
message = response.choices[0].message.content
print(f"Assistant: {message}")

Claude Opus 4.8
En todas las dimensiones evaluadas (codificación, finalización de tareas por agentes, trabajo del conocimiento, razonamiento y uso de computadoras), Opus 4.8 iguala o mejora a su predecesor y, con frecuencia, supera a los modelos de vanguardia de la competencia.
¿Qué es Claude Opus 4.8?
Claude Opus 4.8 es la última versión del modelo de IA de gama alta de Anthropic, sucesor de Claude Opus 4.7. En lugar de un rediseño completo, representa una actualización específica y significativa, que se basa en fundamentos sólidos con mejoras cuantificables en codificación, razonamiento, fiabilidad de los agentes y lo que Anthropic denomina honestidad: la disposición del modelo a revelar la incertidumbre en lugar de disimular las deficiencias con aproximaciones que parecen seguras.
- 4 veces menos propensos a pasar por alto los defectosen su propio código generado frente a Opus 4.7
- Puntuación Online-Mind2Web del 84 %Mejor resultado probado en el uso del ordenador y del agente del navegador
- >10% de referencia para agentes legalesPrimer modelo en superar este umbral en el estándar de aprobación total.
Donde Opus 4.8 sobresale
Programación e ingeniería de software
Varios equipos de ingeniería informan que Opus 4.8 es más fiable como asistente de codificación autónomo. Formula preguntas más precisas para aclarar dudas antes de realizar cambios importantes, advierte cuando los planes parecen erróneos y detecta más errores propios antes de que se propaguen. En CursorBench, una evaluación rigurosa del equipo de Cursor que abarca todas las tareas de desarrollo de principio a fin, Opus 4.8 superó a todos los modelos Opus anteriores en todos los niveles de esfuerzo. La llamada a herramientas también es más eficiente, completando el mismo trabajo con menos pasos intermedios.
Finalización de tareas por parte del agente
En flujos de trabajo autónomos complejos y de múltiples pasos, Opus 4.8 muestra las características de confiabilidad de las que dependen las implementaciones de agentes de IA en producción. En una prueba de rendimiento de superagente desarrollada por un socio externo, fue el único modelo que completó todos los casos de principio a fin, superando a las versiones anteriores de Opus yGPT-5.5a un coste equivalente. Es consistentemente mejor a la hora de mantener el contexto a lo largo de sesiones extensas y seguir las directrices estilísticas o técnicas sin desviarse.
Trabajo de conocimiento jurídico y profesional
Opus 4.8 es el primer modelo que supera el 10 % en el estándar de aprobación total del Legal Agent Benchmark, un hito significativo en un sector donde los errores de precisión conllevan consecuencias profesionales reales. Diversas plataformas de IA legal informan que la mejora en la consistencia y la calidad del razonamiento se traduce directamente en mayor confianza a la hora de delegar tareas legales a flujos de trabajo asistidos por IA.
Automatización del uso del ordenador y del navegador
Con una puntuación del 84 % en Online-Mind2Web, Opus 4.8 se posiciona como el modelo de agente de navegador y uso de computadora más sólido probado por cualquier equipo externo en su lanzamiento. Mantiene la concentración durante tareas web largas y complejas, lo que beneficia directamente a los procesos de automatización del mundo real.
Análisis financiero
Para flujos de trabajo de documentos financieros, procesamiento de archivos densos, informes de ganancias y datos estructurados, Opus 4.8 mantiene la calidad deOpus 4.7al tiempo que se mejora la precisión de las citas, se reduce el consumo de tokens en las tareas de recuperación y se señalan de forma proactiva las anomalías en las entradas y salidas que otros modelos dejaban en manos de los revisores humanos.
Actualizaciones del sistema durante la tarea
La API de Mensajes ahora acepta entradas del sistema dentro del array de mensajes, no solo en el nivel superior. Los desarrolladores pueden actualizar las instrucciones de Claude durante la ejecución de una tarea (cambiando permisos, presupuestos de tokens o contexto ambiental) sin romper la caché de avisos ni redirigir la actualización a través del turno del usuario. Esto facilita enormemente la creación de sistemas de agentes sofisticados y adaptables.
Precios de API
- Entrada: $6.50 / MTok
- Salida: $32.50 / MTok
Almacenamiento en caché de avisos
- Escribir: $8.13 / MTok
- Lectura: $0.65 / MTok
¿Para quién está diseñado Opus 4.8?
Opus 4.8 es el modelo insignia de Anthropic, diseñado para trabajos donde la calidad es la principal prioridad y el costo es secundario. Es la opción ideal para desarrollar agentes de IA de nivel profesional, gestionar tareas de conocimiento profesional de alto riesgo o cuando se necesita un modelo capaz de mantener un contexto y un juicio coherentes durante sesiones muy largas.
- Equipos de ingeniería de softwareConstruir agentes de codificación autónomos o ejecutar migraciones de bases de código a gran escala con Claude Code
- Empresas de tecnología jurídicadonde la precisión de las citas, la calidad del razonamiento y los umbrales de exactitud importan a nivel de caso.
- Plataformas de servicios financierosprocesamiento de documentos densos no estructurados donde el modelo necesita señalar sus propias incertidumbres
- equipos de productos de IAconstruir sistemas automatizados de múltiples pasos que se ejecutan de forma autónoma durante períodos prolongados
- Investigación y análisis empresarialflujos de trabajo que requieren resultados fiables y de alta densidad en ventanas de contexto extensas
- Flujos de trabajo de documentos multimodales— Opus 4.8 razona sobre archivos PDF, diagramas y contenido visual no estructurado con un coste de tokens un 61 % menor que Opus 4.7.
Preguntas frecuentes
¿Es Claude Opus 4.8 mejor que GPT-5.5?
En las pruebas de rendimiento basadas en agentes, Opus 4.8 supera a GPT-5.5 en evaluaciones específicas: la prueba Super-Agent de un socio externo demostró que Opus 4.8 completó todos los casos que GPT-5.5 no pudo, con un coste similar. En el uso del ordenador (Online-Mind2Web), la puntuación del 84 % de Opus 4.8 supera el resultado de GPT-5.5 en la misma evaluación. El rendimiento comparativo varía según el tipo de tarea; los usuarios con cargas de trabajo específicas deben realizar sus propias evaluaciones.
¿Qué cambios se produjeron entre Opus 4.7 y Opus 4.8?
Las mejoras más destacadas son una mayor honestidad (Opus 4.8 detecta incertidumbres y fallos de código con una frecuencia significativamente mayor), un mejor criterio en tareas autónomas, una llamada a herramientas más eficiente y mejores puntuaciones de alineación. En esta versión se corrigen las inconsistencias en la generación de comentarios detallados y en la llamada a herramientas que se habían detectado con Opus 4.7.
¿Qué son los flujos de trabajo dinámicos en Claude Code?
Los flujos de trabajo dinámicos permiten a Claude planificar una tarea de software compleja y ejecutarla mediante la creación de cientos de subagentes paralelos dentro de una única sesión de Claude Code. Verifica sus resultados antes de mostrarlos. Actualmente se encuentra en fase de investigación y está disponible en los planes Enterprise, Team y Max.
¿Cómo se compara Opus 4.8 en tareas multimodales?
Opus 4.8 puede analizar archivos PDF, diagramas, gráficos y otros contenidos visuales no estructurados. Para flujos de trabajo con gran cantidad de documentos, ofrece esta funcionalidad con un coste de tokens un 61 % menor que Opus 4.7, según las pruebas internas de una plataforma de datos empresarial.
Campo de juegos de IA



Acceso