



const { OpenAI } = require('openai');
const api = new OpenAI({
baseURL: 'https://api.ai.cc/v1',
apiKey: '',
});
const main = async () => {
const result = await api.chat.completions.create({
model: 'google/gemini-3-5-flash',
messages: [
{
role: 'system',
content: 'You are an AI assistant who knows everything.',
},
{
role: 'user',
content: 'Tell me, why is the sky blue?'
}
],
});
const message = result.choices[0].message.content;
console.log(`Assistant: ${message}`);
};
main();
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.a.cc/v1",
api_key="",
)
response = client.chat.completions.create(
model="google/gemini-3-5-flash",
messages=[
{
"role": "system",
"content": "You are an AI assistant who knows everything.",
},
{
"role": "user",
"content": "Tell me, why is the sky blue?"
},
],
)
message = response.choices[0].message.content
print(f"Assistant: {message}")

Gemini 3.5 Flash
Le modèle Gemini 3.5 Flash réduit l'écart entre la vitesse de niveau Flash et le raisonnement de niveau professionnel.
Qu'est-ce que l'API Gemini 3.5 Flash ?
Avec l'API Gemini 3.5 Flash, Google introduit une nouvelle génération d'IA multimodale conçue pour les charges de travail de production réelles, l'automatisation à haute vitesse, l'assistance avancée au codage et les flux de travail d'agents évolutifs. Que vous développiez des outils SaaS basés sur l'IA, des copilotes d'entreprise, des systèmes de support client, des pipelines d'automatisation ou des agents de codage nouvelle génération, Gemini 3.5 Flash offre les performances exigées par les applications modernes.
Contrairement aux modèles lourds traditionnels qui sacrifient souvent la latence au profit de la qualité du raisonnement, Gemini 3.5 Flash se concentre sur la fourniture d'un raisonnement avancé, de capacités de codage et d'une compréhension multimodale à la vitesse du Flash.

Ce que Gemini 3.5 Flash apporte à la table
Tout ce que les développeurs attendent d'après les fuites actuelles, la documentation officielle de la série Gemini 3 et les premiers rapports des testeurs.
Raisonnement quasi-professionnel
On s'attend à ce qu'il se rapproche considérablement de la qualité de raisonnement du Gemini 3.1 Pro, tout en restant plus rapide et moins cher. Les premiers testeurs indiquent que le problème persistant du « modèle paresseux » a été en grande partie résolu.
Contexte de 1 million de jetons
Reprend l'intégralité de la fenêtre de contexte d'entrée de jetons de 1M de la génération Gemini 3 — suffisamment grande pour contenir des bases de code entières, des documents longs et des conversations complexes à plusieurs tours impliquant des agents dans un seul appel.
Niveaux de pensée configurables
Comme Gemini 3 Flash avant lui, 3.5 Flash devrait prendre en charge quatre niveaux de réflexion — minimal, faible, moyen et élevé — permettant aux développeurs de faire un compromis entre la profondeur du raisonnement, la latence et le coût par requête.
Prise en charge multimodale complète
Accepte les formats texte, images, audio, vidéo et PDF en entrée. Bénéficie des améliorations audio de la série Gemini 3, notamment une meilleure gestion des accents et des bruits de fond.
Un ancrage plus solide
Des informations divulguées laissent entrevoir une fiabilité accrue de la recherche, un point faible récurrent des précédents modèles Gemini Flash. Si ces informations se confirment, la version 3.5 Flash pourrait devenir nettement plus performante pour les recherches concrètes et les tâches factuelles.
Tarification de l'API Flash Gemini 3.5
- Entrée mise en cache : 0,065 $
- Entrée audio : 1,30 $
- 1 million de jetons d'entrée : 0,65 $
- 1 million de jetons de sortie : 3,90 $
> 200 000 jetons
- 1 million de jetons d'entrée : 3,25 $
- 1 million de jetons de sortie : 23,40 $
Aperçu des caractéristiques du modèle
Quatre niveaux de pensée, un modèle
Le paramètre thinking_level vous permet de doser la profondeur du raisonnement pour chaque requête — un point crucial pour les charges de travail importantes où vous ne souhaitez pas payer le prix Pro pour des tâches simples.
Gemini 3.5 Flash contre la gamme Gemini 3 actuelle
À quoi sert la clé USB Gemini 3.5 ?
D'après tout ce que nous savons jusqu'à présent, voici en quoi la version 3.5 Flash se distinguera par rapport à la gamme actuelle.
Des flux de travail complexes impliquant des agents qui nécessitent de la rapidité
Les boucles d'agents à plusieurs étapes ont toujours constitué un point faible des modèles Flash : perte de contexte, erreurs dans les paramètres des outils ou réponses superficielles en cours de chaîne. La version 3.5 de Flash devrait gérer ces problèmes avec la fiabilité auparavant réservée à la version Pro, pour un coût et une latence considérablement réduits.
Assistants de codage et intégrations IDE
L'objectif « quasi-professionnel » de Flash 3.5 est de permettre des tâches concrètes de débogage, de revue de code et de refactorisation qui nécessitent actuellement la version Pro. L'échéance de janvier 2026 implique également une meilleure connaissance des frameworks récents, des versions de packages et des modifications d'API majeures.
Applications de recherche en temps réel
Si les améliorations apportées à la mise à la terre se confirment lors de la GA, la version 3.5 de Flash devrait être nettement plus fiable pour les applications où les erreurs sont coûteuses : outils de recherche destinés aux clients, pipelines de vérification des faits et systèmes RAG qui nécessitent un classement précis des extraits ainsi qu’une faible latence.
Conversation interactive avec des documents complexes
Le contexte de jetons 1M et les améliorations attendues en matière de raisonnement en font une solution parfaitement adaptée aux produits de questions-réponses sur les documents, à l'analyse des contrats juridiques et à l'analyse des rapports financiers — des tâches où la vitesse de Flash est importante, mais où les modèles Flash précédents donnaient parfois des réponses superficielles sur des documents denses.
pipelines multimodaux (vidéo, audio, images)
Gemini 3.5 Flash hérite de la pile multimodale complète, avec notamment une qualité d'entrée audio améliorée par rapport à la génération 2.5. Pour les applications traitant des enregistrements de réunions, des photos de produits ou des documents multimédias, il offre un modèle unique plutôt que des points de terminaison spécialisés distincts.
Terrain de jeu de l'IA



Se connecter