



const { OpenAI } = require('openai');
const api = new OpenAI({
baseURL: 'https://api.ai.cc/v1',
apiKey: '',
});
const main = async () => {
const result = await api.chat.completions.create({
model: 'anthropic/claude-opus-4-8',
messages: [
{
role: 'system',
content: 'You are an AI assistant who knows everything.',
},
{
role: 'user',
content: 'Tell me, why is the sky blue?'
}
],
});
const message = result.choices[0].message.content;
console.log(`Assistant: ${message}`);
};
main();
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.ai.cc/v1",
api_key="",
)
response = client.chat.completions.create(
model="anthropic/claude-opus-4-8",
messages=[
{
"role": "system",
"content": "You are an AI assistant who knows everything.",
},
{
"role": "user",
"content": "Tell me, why is the sky blue?"
},
],
)
message = response.choices[0].message.content
print(f"Assistant: {message}")

Claude Opus 4.8
Em todas as dimensões testadas — codificação, conclusão de tarefas de forma autônoma, trabalho intelectual, raciocínio e uso de computador — o Opus 4.8 iguala ou supera seu antecessor e, frequentemente, supera os modelos de ponta concorrentes.
O que é Claude Opus 4.8?
Claude Opus 4.8 é a versão mais recente do modelo de IA de ponta da Anthropic, sucessor do Claude Opus 4.7. Em vez de uma reformulação completa, representa uma atualização focada e significativa — que se baseia em fundamentos sólidos com melhorias mensuráveis em codificação, raciocínio, confiabilidade do agente e o que a Anthropic chama de honestidade: a disposição do modelo em revelar incertezas em vez de mascarar lacunas com aproximações que soam confiantes.
- 4 vezes menos propensos a ignorar defeitosem seu próprio código gerado versus Opus 4.7
- Pontuação de 84% no Online-Mind2Webmelhor uso do computador e resultado do agente do navegador testados
- >10% de referência para agentes jurídicosPrimeiro modelo a ultrapassar esse limite no padrão de aprovação total.
Onde o Opus 4.8 se destaca
Programação e engenharia de software
Diversas equipes de engenharia relatam que o Opus 4.8 é mais confiável como assistente de codificação autônomo. Ele faz perguntas mais precisas antes de implementar grandes mudanças, intervém quando os planos parecem falhos e detecta mais erros antes que se propaguem. No CursorBench — uma avaliação rigorosa da equipe Cursor que abrange tarefas de desenvolvimento de ponta a ponta —, o Opus 4.8 superou todos os modelos anteriores do Opus em todos os níveis de esforço. A chamada de ferramentas também é mais eficiente, concluindo o mesmo trabalho com menos etapas intermediárias.
Conclusão de tarefas agentivas
Em fluxos de trabalho autônomos complexos e com várias etapas, o Opus 4.8 demonstra as características de confiabilidade das quais as implantações de agentes de IA em produção dependem. Em um benchmark de Superagente desenvolvido por um parceiro externo, foi o único modelo a concluir todos os casos de ponta a ponta, superando as versões anteriores do Opus.GPT-5.5a um custo equivalente. É consistentemente melhor em manter o contexto ao longo de sessões longas e em seguir a direção estilística ou técnica sem desvios.
Trabalho de conhecimento jurídico e profissional
O Opus 4.8 é o primeiro modelo a ultrapassar os 10% no padrão de aprovação total do Legal Agent Benchmark — um patamar significativo em um setor onde erros de precisão acarretam consequências profissionais reais. Diversas plataformas de IA jurídica relatam que a melhoria na consistência e na qualidade do raciocínio se traduz diretamente em maior confiança sobre quais tarefas dos advogados podem ser delegadas a fluxos de trabalho assistidos por IA.
Uso de computadores e automação de navegadores
Com uma pontuação de 84% no Online-Mind2Web, o Opus 4.8 se destaca como o modelo de uso de computador e agente de navegador mais robusto testado por qualquer equipe externa no lançamento. Ele mantém o foco em tarefas web longas e complexas, beneficiando diretamente os fluxos de automação do mundo real.
Análise financeira
Para fluxos de trabalho de documentos financeiros, processamento de arquivos complexos, relatórios de resultados e dados estruturados, o Opus 4.8 mantém a qualidade deOpus 4.7ao mesmo tempo que melhora a precisão das citações, reduz o consumo de tokens em tarefas de recuperação e sinaliza proativamente anomalias nas entradas e saídas que outros modelos deixavam para os revisores humanos detectarem.
Atualizações de avisos do sistema durante a tarefa
A API de Mensagens agora aceita entradas do sistema dentro da matriz de mensagens, e não apenas no nível superior. Os desenvolvedores podem atualizar as instruções de Claude durante a execução de uma tarefa — alterando permissões, orçamentos de tokens ou contexto ambiental — sem quebrar o cache de prompts ou rotear a atualização por meio de uma interação do usuário. Isso facilita consideravelmente a criação de estruturas de agentes sofisticadas e adaptáveis.
Preços da API
- Entrada: $6,50 / MTok
- Saída: $32,50 / MTok
Cache imediato
- Escreva: $8,13 / MTok
- Leitura: US$ 0,65 / MTok
Para quem foi desenvolvido o Opus 4.8?
O Opus 4.8 é o modelo principal da Anthropic, ideal para trabalhos onde a qualidade é a principal restrição e o custo é secundário. É a escolha certa para quem está criando agentes de IA de nível de produção, lidando com tarefas complexas que exigem alto nível de conhecimento profissional ou precisando de um modelo capaz de manter contexto e julgamento coerentes ao longo de sessões muito longas.
- Equipes de engenharia de softwareCrie agentes de codificação autônomos ou execute migrações de código em larga escala com o Claude Code.
- Empresas de tecnologia jurídicaonde a precisão da citação, a qualidade do raciocínio e os limiares de exatidão são importantes no nível do caso.
- Plataformas de serviços financeirosProcessamento de documentos densos e não estruturados, onde o modelo precisa sinalizar suas próprias incertezas.
- equipes de produto de IAConstrução de pipelines agéticos de múltiplas etapas que funcionam de forma autônoma por períodos prolongados.
- Pesquisa e análise empresarialfluxos de trabalho que exigem saídas confiáveis e de alta densidade em longas janelas de contexto
- Fluxos de trabalho de documentos multimodais— O Opus 4.8 processa PDFs, diagramas e conteúdo visual não estruturado com um custo em tokens 61% menor do que o Opus 4.7.
Perguntas frequentes
O Claude Opus 4.8 é melhor que o GPT-5.5?
Em benchmarks de agentes, o Opus 4.8 supera o GPT-5.5 em avaliações específicas: um benchmark Super-Agent de um parceiro externo mostrou que o Opus 4.8 concluiu todos os casos que o GPT-5.5 não conseguiu, com custo equivalente. Em uso computacional (Online-Mind2Web), a pontuação de 84% do Opus 4.8 supera o resultado relatado pelo GPT-5.5 na mesma avaliação. O desempenho comparativo varia de acordo com o tipo de tarefa; usuários com cargas de trabalho específicas devem executar suas próprias avaliações.
O que mudou do Opus 4.7 para o Opus 4.8?
As principais melhorias são: maior honestidade (o Opus 4.8 sinaliza incertezas e falhas de código com uma frequência significativamente maior), julgamento aprimorado em tarefas autônomas, chamada de ferramentas mais eficiente e melhores pontuações de alinhamento. A geração de comentários verbosos e as inconsistências na chamada de ferramentas relatadas no Opus 4.7 foram corrigidas nesta versão.
O que são fluxos de trabalho dinâmicos no Claude Code?
Os fluxos de trabalho dinâmicos permitem que o Claude planeje uma grande tarefa de software e a execute, criando centenas de subagentes paralelos em uma única sessão do Claude Code. Ele verifica suas saídas antes de exibir os resultados. Atualmente, está em fase de pré-visualização para pesquisa e disponível nos planos Enterprise, Team e Max.
Como o Opus 4.8 se compara em tarefas multimodais?
O Opus 4.8 consegue analisar PDFs, diagramas, gráficos e outros conteúdos visuais não estruturados. Para fluxos de trabalho com grande volume de documentos, ele oferece essa capacidade com um custo em tokens 61% menor em comparação com o Opus 4.7, de acordo com benchmarks internos de uma plataforma de dados corporativa.
Playground de IA
