qwen-bg
max-ico04
Dans
3,25
Dehors
23.4
max-ico02
Chat
max-ico03
Actif
Gemini 3.5 Flash
Gemini 3.5 Flash offre une puissance de calcul quasi professionnelle à la vitesse de l'éclair. Découvrez ses caractéristiques, son prix et ses niveaux de performance.
Text to Speech
                                        const { OpenAI } = require('openai');

const api = new OpenAI({
  baseURL: 'https://api.ai.cc/v1',
  apiKey: '',
});

const main = async () => {
  const result = await api.chat.completions.create({
    model: 'google/gemini-3-5-flash',
    messages: [
      {
        role: 'system',
        content: 'You are an AI assistant who knows everything.',
      },
      {
        role: 'user',
        content: 'Tell me, why is the sky blue?'
      }
    ],
  });

  const message = result.choices[0].message.content;
  console.log(`Assistant: ${message}`);
};

main();
                                
                                        import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.a.cc/v1",
    api_key="",    
)

response = client.chat.completions.create(
    model="google/gemini-3-5-flash",
    messages=[
        {
            "role": "system",
            "content": "You are an AI assistant who knows everything.",
        },
        {
            "role": "user",
            "content": "Tell me, why is the sky blue?"
        },
    ],
)

message = response.choices[0].message.content

print(f"Assistant: {message}")
Docs

Plus de 300 modèles d'IA pour OpenClaw et agents IA

qwenmax-bg
Google (4).svg
Gemini 3.5 Flash

Gemini 3.5 Flash

Le modèle Gemini 3.5 Flash réduit l'écart entre la vitesse de niveau Flash et le raisonnement de niveau professionnel.

Qu'est-ce que l'API Gemini 3.5 Flash ?

Avec l'API Gemini 3.5 Flash, Google introduit une nouvelle génération d'IA multimodale conçue pour les charges de travail de production réelles, l'automatisation à haute vitesse, l'assistance avancée au codage et les flux de travail d'agents évolutifs. Que vous développiez des outils SaaS basés sur l'IA, des copilotes d'entreprise, des systèmes de support client, des pipelines d'automatisation ou des agents de codage nouvelle génération, Gemini 3.5 Flash offre les performances exigées par les applications modernes.

Contrairement aux modèles lourds traditionnels qui sacrifient souvent la latence au profit de la qualité du raisonnement, Gemini 3.5 Flash se concentre sur la fourniture d'un raisonnement avancé, de capacités de codage et d'une compréhension multimodale à la vitesse du Flash.

Ce que Gemini 3.5 Flash apporte à la table

Tout ce que les développeurs attendent d'après les fuites actuelles, la documentation officielle de la série Gemini 3 et les premiers rapports des testeurs.

Raisonnement quasi-professionnel

On s'attend à ce qu'il se rapproche considérablement de la qualité de raisonnement du Gemini 3.1 Pro, tout en restant plus rapide et moins cher. Les premiers testeurs indiquent que le problème persistant du « modèle paresseux » a été en grande partie résolu.

Contexte de 1 million de jetons

Reprend l'intégralité de la fenêtre de contexte d'entrée de jetons de 1M de la génération Gemini 3 — suffisamment grande pour contenir des bases de code entières, des documents longs et des conversations complexes à plusieurs tours impliquant des agents dans un seul appel.

Niveaux de pensée configurables

Comme Gemini 3 Flash avant lui, 3.5 Flash devrait prendre en charge quatre niveaux de réflexion — minimal, faible, moyen et élevé — permettant aux développeurs de faire un compromis entre la profondeur du raisonnement, la latence et le coût par requête.

Prise en charge multimodale complète

Accepte les formats texte, images, audio, vidéo et PDF en entrée. Bénéficie des améliorations audio de la série Gemini 3, notamment une meilleure gestion des accents et des bruits de fond.

Un ancrage plus solide

Des informations divulguées laissent entrevoir une fiabilité accrue de la recherche, un point faible récurrent des précédents modèles Gemini Flash. Si ces informations se confirment, la version 3.5 Flash pourrait devenir nettement plus performante pour les recherches concrètes et les tâches factuelles.

Tarification de l'API Flash Gemini 3.5

  • Entrée mise en cache : 0,065 $
  • Entrée audio : 1,30 $

  • 1 million de jetons d'entrée : 0,65 $
  • 1 million de jetons de sortie : 3,90 $

> 200 000 jetons

  • 1 million de jetons d'entrée : 3,25 $
  • 1 million de jetons de sortie : 23,40 $

Aperçu des caractéristiques du modèle

Spécification Détails
ID du modèle aperçu flash de Gemini 3.5
Promoteur Google DeepMind
Série de modèles Gémeaux 3.5 (Niveau Flash)
Fenêtre contextuelle 1 000 000 jetons d'entrée
Puissance maximale ~64 000 à 65 000 jetons (correspondant à Gemini 3 Flash)
Seuil de connaissances Janvier 2026 (selon la page de prix qui a fuité)
modalités d'entrée Texte · Images · Audio · Vidéo · PDF
Modalités de sortie Texte
Niveaux de réflexion Minimal · Faible · Moyen · Élevé
Outils pris en charge Recherche Google · Contexte URL · Exécution de code · Appel de fonction · Mise à jour des cartes
mise en cache du contexte Oui (cela réduit le coût des invites répétées)

Quatre niveaux de pensée, un modèle

Le paramètre thinking_level vous permet de doser la profondeur du raisonnement pour chaque requête — un point crucial pour les charges de travail importantes où vous ne souhaitez pas payer le prix Pro pour des tâches simples.

Niveau de réflexion Description Meilleurs cas d'utilisation
Minimal Le plus rapide, le moins cher. Latence similaire à celle d'un modèle sans raisonnement. Classification, routage et transformations simples où une réflexion approfondie n'apporte aucune valeur ajoutée.
Faible Raisonnement léger alliant vitesse et qualité. Résumé, traduction et questions-réponses de base pour des flux de contenu rentables.
Moyen Performances et profondeur de raisonnement équilibrées. Le choix par défaut pour la plupart des applications. Génération de code, analyse de documents et instructions en plusieurs étapes.
Haut Chaîne de raisonnement complète avec une qualité de sortie quasi professionnelle pour les tâches avancées. Logique complexe, mathématiques, synthèse de la recherche et raisonnement à plusieurs étapes.

Gemini 3.5 Flash contre la gamme Gemini 3 actuelle

Fonctionnalité Gemini 3.1 Flash-Lite Gemini 3 Flash Gemini 3.5 Flash Gemini 3.1 Pro
Étage Flash-Lite Éclair Flash (premium) Pro
Fenêtre contextuelle 1 million de jetons 1 million de jetons 1 million de jetons 2 millions de jetons
Niveaux de réflexion ✓ 4 niveaux ✓ 4 niveaux ✓ 4 niveaux ✓ 4 niveaux
Qualité du raisonnement Bien Très bien Quasi-Pro Meilleur de sa catégorie
Latence le plus rapide Rapide Rapide Ralentissez
Améliorations de la mise à la terre Modéré Bien Amélioré Meilleur

À quoi sert la clé USB Gemini 3.5 ?

D'après tout ce que nous savons jusqu'à présent, voici en quoi la version 3.5 Flash se distinguera par rapport à la gamme actuelle.

Des flux de travail complexes impliquant des agents qui nécessitent de la rapidité

Les boucles d'agents à plusieurs étapes ont toujours constitué un point faible des modèles Flash : perte de contexte, erreurs dans les paramètres des outils ou réponses superficielles en cours de chaîne. La version 3.5 de Flash devrait gérer ces problèmes avec la fiabilité auparavant réservée à la version Pro, pour un coût et une latence considérablement réduits.

Assistants de codage et intégrations IDE

L'objectif « quasi-professionnel » de Flash 3.5 est de permettre des tâches concrètes de débogage, de revue de code et de refactorisation qui nécessitent actuellement la version Pro. L'échéance de janvier 2026 implique également une meilleure connaissance des frameworks récents, des versions de packages et des modifications d'API majeures.

Applications de recherche en temps réel

Si les améliorations apportées à la mise à la terre se confirment lors de la GA, la version 3.5 de Flash devrait être nettement plus fiable pour les applications où les erreurs sont coûteuses : outils de recherche destinés aux clients, pipelines de vérification des faits et systèmes RAG qui nécessitent un classement précis des extraits ainsi qu’une faible latence.

Conversation interactive avec des documents complexes

Le contexte de jetons 1M et les améliorations attendues en matière de raisonnement en font une solution parfaitement adaptée aux produits de questions-réponses sur les documents, à l'analyse des contrats juridiques et à l'analyse des rapports financiers — des tâches où la vitesse de Flash est importante, mais où les modèles Flash précédents donnaient parfois des réponses superficielles sur des documents denses.

pipelines multimodaux (vidéo, audio, images)

Gemini 3.5 Flash hérite de la pile multimodale complète, avec notamment une qualité d'entrée audio améliorée par rapport à la génération 2.5. Pour les applications traitant des enregistrements de réunions, des photos de produits ou des documents multimédias, il offre un modèle unique plutôt que des points de terminaison spécialisés distincts.

Terrain de jeu de l'IA

Testez tous les modèles d'API dans l'environnement de test avant de les intégrer. Nous proposons plus de 300 modèles à intégrer à votre application.
Contactez-nous
api-droite-1
modèle-bg02-1

Plus de 300 modèles d'IA pour
OpenClaw et agents IA

Économisez 20 % sur vos coûts