



const { OpenAI } = require('openai');
const api = new OpenAI({
baseURL: 'https://api.ai.cc/v1',
apiKey: '',
});
const main = async () => {
const result = await api.chat.completions.create({
model: 'anthropic/claude-opus-4-8',
messages: [
{
role: 'system',
content: 'You are an AI assistant who knows everything.',
},
{
role: 'user',
content: 'Tell me, why is the sky blue?'
}
],
});
const message = result.choices[0].message.content;
console.log(`Assistant: ${message}`);
};
main();
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.ai.cc/v1",
api_key="",
)
response = client.chat.completions.create(
model="anthropic/claude-opus-4-8",
messages=[
{
"role": "system",
"content": "You are an AI assistant who knows everything.",
},
{
"role": "user",
"content": "Tell me, why is the sky blue?"
},
],
)
message = response.choices[0].message.content
print(f"Assistant: {message}")

Claude Opus 4.8
Sur l’ensemble des dimensions testées — codage, réalisation de tâches autonomes, travail intellectuel, raisonnement et utilisation de l’ordinateur — Opus 4.8 égale ou améliore son prédécesseur et surpasse fréquemment les modèles concurrents de pointe.
Qu'est-ce que Claude Opus 4.8 ?
Claude Opus 4.8 est la dernière version du modèle d'IA haut de gamme d'Anthropic, succédant à Claude Opus 4.7. Plutôt qu'une refonte complète, il s'agit d'une mise à niveau ciblée et significative, qui s'appuie sur des bases solides avec des améliorations mesurables au niveau du codage, du raisonnement, de la fiabilité de l'agent et de ce qu'Anthropic appelle l'honnêteté : la volonté du modèle de faire émerger l'incertitude plutôt que de masquer les lacunes avec des approximations qui semblent confiantes.
- 4× Moins susceptibles de négliger les défautsdans son propre code généré par rapport à Opus 4.7
- Score Online-Mind2Web de 84 %meilleurs résultats d'utilisation de l'ordinateur et d'agent de navigateur testés
- >10% Référence des agents juridiquespremier modèle à franchir ce seuil selon la norme de réussite globale
Là où Opus 4.8 excelle
Programmation et génie logiciel
Plusieurs équipes d'ingénieurs indiquent qu'Opus 4.8 est plus fiable en tant qu'assistant de programmation autonome. Il pose des questions plus pertinentes avant d'effectuer des modifications importantes, signale les erreurs de conception et détecte davantage d'erreurs avant qu'elles ne se propagent. Sur CursorBench, une évaluation rigoureuse menée par l'équipe Cursor et couvrant l'ensemble des tâches de développement, Opus 4.8 a surpassé tous les modèles Opus précédents à tous les niveaux d'effort. L'appel d'outils est également plus efficace, permettant d'effectuer le même travail avec moins d'étapes intermédiaires.
Achèvement de tâche agentique
Dans les flux de travail autonomes complexes et à plusieurs étapes, Opus 4.8 démontre la fiabilité essentielle au déploiement d'agents d'IA en production. Sur un banc d'essai Super-Agent développé par un partenaire externe, il a été le seul modèle à mener à bien chaque cas de bout en bout, surpassant ainsi les versions précédentes d'Opus.GPT-5.5À coût équivalent, il est nettement supérieur pour maintenir le contexte tout au long des longues sessions et pour suivre une direction stylistique ou technique sans dérive.
travail sur les connaissances juridiques et professionnelles
Opus 4.8 est le premier modèle à dépasser les 10 % de réussite au test Legal Agent Benchmark, un seuil significatif dans un secteur où les erreurs d'exactitude ont de réelles conséquences professionnelles. Plusieurs plateformes d'IA juridique indiquent que l'amélioration de la cohérence et de la qualité du raisonnement se traduit directement par une plus grande confiance dans les tâches des avocats pouvant être déléguées à des flux de travail assistés par l'IA.
Utilisation de l'ordinateur et automatisation du navigateur
Avec un score de 84 % sur Online-Mind2Web, Opus 4.8 se positionne comme le modèle d'utilisation d'ordinateur et d'agent navigateur le plus performant testé par une équipe externe lors de son lancement. Il assure une concentration optimale lors de tâches web longues et complexes, ce qui améliore directement les processus d'automatisation en conditions réelles.
Analyse financière
Pour les flux de travail de documents financiers, le traitement de dossiers volumineux, de rapports de résultats et de données structurées, Opus 4.8 maintient la qualité deOpus 4.7tout en améliorant la précision des citations, en réduisant la consommation de jetons lors des tâches de recherche et en signalant de manière proactive les anomalies dans les entrées et les sorties que d'autres modèles laissaient aux examinateurs humains le soin de repérer.
Mises à jour des invites système en cours de tâche
L'API Messages accepte désormais les entrées système directement dans le tableau des messages, et non plus seulement au niveau supérieur. Les développeurs peuvent ainsi modifier les instructions de Claude en cours de tâche (modification des permissions, des budgets de jetons ou du contexte environnemental) sans interrompre le cache des invites ni nécessiter une nouvelle intervention de l'utilisateur. Il est donc beaucoup plus facile de créer des environnements d'agents sophistiqués et adaptatifs.
Tarification de l'API
- Entrée : 6,50 $ / MTok
- Résultat : 32,50 $ / MTok
Mise en cache rapide
- Écriture : 8,13 $/MTok
- Lecture : 0,65 $/MTok
À qui s'adresse Opus 4.8 ?
Opus 4.8 est le modèle phare d'Anthropic, conçu pour les applications où la qualité prime sur le coût. C'est le choix idéal pour développer des agents d'IA de niveau production, gérer des tâches professionnelles complexes nécessitant une expertise pointue, ou encore pour disposer d'un modèle capable de maintenir un contexte et un jugement cohérents lors de sessions très longues.
- équipes d'ingénierie logicielleCréation d'agents de codage autonomes ou exécution de migrations de bases de code à grande échelle avec Claude Code
- entreprises de technologie juridiqueoù la précision des citations, la qualité du raisonnement et les seuils d'exactitude sont importants au niveau du cas.
- plateformes de services financierstraitement de documents denses et non structurés où le modèle doit signaler ses propres incertitudes
- équipes de produits IAconstruction de pipelines multi-étapes automatisés fonctionnant de manière autonome pendant des périodes prolongées
- Recherche et analyse d'entrepriseflux de travail nécessitant des sorties fiables et à haute densité sur de longues fenêtres de contexte
- Flux de travail documentaires multimodaux— Opus 4.8 prend en charge les raisonnements sur les PDF, les diagrammes et le contenu visuel non structuré à un coût en jetons inférieur de 61 % à celui d'Opus 4.7
Questions fréquentes
Claude Opus 4.8 est-il meilleur que GPT-5.5 ?
Sur les benchmarks d'agents, Opus 4.8 surpasse GPT-5.5 dans certaines évaluations : le benchmark Super-Agent d'un partenaire externe a démontré qu'Opus 4.8 réussissait tous les cas où GPT-5.5 échouait, à coût égal. Sur les tests d'utilisation sur ordinateur (Online-Mind2Web), le score de 84 % d'Opus 4.8 surpasse le résultat obtenu par GPT-5.5 lors de cette même évaluation. Les performances comparatives varient selon le type de tâche ; les utilisateurs ayant des charges de travail spécifiques sont invités à effectuer leurs propres évaluations.
Qu'est-ce qui a changé entre l'Opus 4.7 et l'Opus 4.8 ?
Les principales améliorations concernent la transparence accrue (Opus 4.8 signale les incertitudes et les défauts de code avec une fréquence nettement supérieure), un meilleur jugement dans les tâches autonomes, une utilisation plus efficace des outils et de meilleurs scores d'alignement. Les problèmes de génération de commentaires verbeux et d'incohérences dans l'utilisation des outils signalés avec Opus 4.7 sont corrigés dans cette version.
Qu'est-ce que les flux de travail dynamiques dans Claude Code ?
Les flux de travail dynamiques permettent à Claude de planifier une tâche logicielle complexe, puis de l'exécuter en lançant des centaines de sous-agents en parallèle au sein d'une même session Claude Code. Il vérifie ses résultats avant de les afficher. Cette fonctionnalité est actuellement en version préliminaire pour la recherche et disponible avec les abonnements Enterprise, Team et Max.
Comment Opus 4.8 se compare-t-il sur les tâches multimodales ?
Opus 4.8 peut analyser des fichiers PDF, des diagrammes, des graphiques et d'autres contenus visuels non structurés. Pour les flux de travail impliquant un grand nombre de documents, il offre cette fonctionnalité à un coût en jetons inférieur de 61 % à celui d'Opus 4.7, selon les tests internes d'une plateforme de données d'entreprise.
Terrain de jeu de l'IA



Se connecter