qwen-bg
ico máximo04
En
3.25
Afuera
23.4
ico-máximo02
Charlar
ico-máximo03
Activo
Géminis 3.5 Flash
Gemini 3.5 Flash ofrece un razonamiento casi profesional a la velocidad de Flash. Descubre sus especificaciones, precios y niveles de procesamiento.
Text to Speech
                                        const { OpenAI } = require('openai');

const api = new OpenAI({
  baseURL: 'https://api.ai.cc/v1',
  apiKey: '',
});

const main = async () => {
  const result = await api.chat.completions.create({
    model: 'google/gemini-3-5-flash',
    messages: [
      {
        role: 'system',
        content: 'You are an AI assistant who knows everything.',
      },
      {
        role: 'user',
        content: 'Tell me, why is the sky blue?'
      }
    ],
  });

  const message = result.choices[0].message.content;
  console.log(`Assistant: ${message}`);
};

main();
                                
                                        import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.a.cc/v1",
    api_key="",    
)

response = client.chat.completions.create(
    model="google/gemini-3-5-flash",
    messages=[
        {
            "role": "system",
            "content": "You are an AI assistant who knows everything.",
        },
        {
            "role": "user",
            "content": "Tell me, why is the sky blue?"
        },
    ],
)

message = response.choices[0].message.content

print(f"Assistant: {message}")
Docs

Más de 300 modelos de IA para OpenClaw y agentes de IA

qwenmax-bg
Google (4).svg
Géminis 3.5 Flash

Géminis 3.5 Flash

El modelo Gemini 3.5 Flash reduce la brecha entre la velocidad propia de Flash y el razonamiento de nivel profesional.

¿Qué es la API Flash Gemini 3.5?

Con la API Gemini 3.5 Flash, Google presenta una nueva generación de IA multimodal diseñada para cargas de trabajo de producción reales, automatización de alta velocidad, asistencia avanzada para la codificación y flujos de trabajo escalables basados ​​en agentes. Ya sea que esté creando herramientas SaaS con IA, sistemas de asistencia empresarial, sistemas de atención al cliente, pipelines de automatización o agentes de codificación de última generación, Gemini 3.5 Flash ofrece el rendimiento que exigen las aplicaciones modernas.

A diferencia de los modelos pesados ​​tradicionales que a menudo sacrifican la latencia en aras de la calidad del razonamiento, Gemini 3.5 Flash se centra en ofrecer razonamiento avanzado, capacidad de codificación y comprensión multimodal a la velocidad de Flash.

Lo que Gemini 3.5 Flash aporta a la mesa

Todo lo que los desarrolladores esperan según las filtraciones actuales, la documentación oficial de la serie Gemini 3 y los primeros informes de los probadores.

Razonamiento casi profesional

Se espera que alcance una calidad de razonamiento significativamente mayor que la de Gemini 3.1 Pro, manteniendo a la vez un menor coste y una mayor velocidad. Los primeros usuarios que lo probaron informan que el problema persistente del "modelo inactivo" se ha solucionado en gran medida.

Contexto de 1 millón de tokens

Conserva la ventana de contexto de entrada de 1 millón de tokens completa de la generación Gemini 3, lo suficientemente grande como para albergar bases de código completas, documentos extensos y conversaciones complejas de varios turnos entre agentes en una sola llamada.

Niveles de pensamiento configurables

Al igual que Gemini 3 Flash, se espera que Flash 3.5 admita cuatro niveles de procesamiento (mínimo, bajo, medio y alto), lo que permitirá a los desarrolladores equilibrar la profundidad del razonamiento con la latencia y el coste por solicitud.

Soporte multimodal completo

Admite texto, imágenes, audio, vídeo y archivos PDF como entrada. Conserva las mejoras en la calidad de audio de la serie Gemini 3, incluyendo un mejor manejo del habla con acento y el ruido de fondo.

Conexión a tierra más sólida

Los detalles filtrados apuntan a una mayor fiabilidad en la búsqueda, un problema recurrente en los modelos Gemini Flash anteriores. De ser cierto, esto podría hacer que el Flash 3.5 sea mucho más útil para la investigación y las tareas de análisis de datos en el mundo real.

Precios de la API Flash de Gemini 3.5

  • Entrada almacenada en caché: $0.065
  • Entrada de audio: $1.30

  • 1 millón de tokens de entrada: $0.65
  • 1 millón de tokens de salida: $3.90

> 200.000 tokens

  • 1 millón de tokens de entrada: $3.25
  • 1 millón de tokens de salida: $23.40

Especificaciones del modelo de un vistazo

Especificación Detalles
ID del modelo vista previa de Flash de Gemini 3.5
Revelador Google DeepMind
Serie de modelos Géminis 3.5 (Nivel Flash)
Ventana de contexto 1.000.000 de tokens de entrada
Salida máxima ~64.000–65.000 tokens (en consonancia con Gemini 3 Flash)
límite de conocimiento Enero de 2026 (según la página de precios filtrada)
Modalidades de entrada Texto · Imágenes · Audio · Vídeo · PDF
Modalidades de salida Texto
Niveles de pensamiento Mínimo · Bajo · Medio · Alto
Herramientas compatibles Búsqueda de Google · Contexto de URL · Ejecución de código · Llamada a funciones · Conexión a Internet con mapas
Almacenamiento en caché de contexto Sí (reduce el coste de las solicitudes repetidas)

Cuatro niveles de pensamiento, un modelo

El parámetro thinking_level permite ajustar la profundidad de razonamiento por solicitud, algo fundamental para cargas de trabajo de gran volumen en las que no se desea pagar precios Pro por tareas sencillas.

Nivel de pensamiento Descripción Mejores casos de uso
Mínimo El más rápido y económico. Latencia similar a la de un modelo sin razonamiento. Clasificación, enrutamiento y transformaciones simples donde la reflexión profunda no aporta valor.
Bajo Razonamiento ligero con velocidad y calidad equilibradas. Resumen, traducción y preguntas y respuestas básicas para flujos de trabajo de contenido rentables.
Medio Rendimiento equilibrado y capacidad de razonamiento profunda. La opción predeterminada práctica para la mayoría de las aplicaciones. Generación de código, análisis de documentos e instrucciones de varios pasos.
Alto Cadena de razonamiento completa con una calidad de salida casi profesional para tareas avanzadas. Lógica compleja, matemáticas, síntesis de investigación y razonamiento de múltiples pasos.

Gemini 3.5 Flash frente a la gama actual de Gemini 3

Característica Gemini 3.1 Flash-Lite Géminis 3 Flash Géminis 3.5 Flash Gemini 3.1 Pro
Nivel Linterna Destello Flash (premium) Pro
Ventana de contexto 1 millón de tokens 1 millón de tokens 1 millón de tokens 2 millones de tokens
Niveles de pensamiento ✓ 4 niveles ✓ 4 niveles ✓ 4 niveles ✓ 4 niveles
Calidad del razonamiento Bien Muy bien Casi profesional Lo mejor de su clase
Estado latente Lo más rápido Rápido Rápido Más lento
Mejoras en la puesta a tierra Moderado Bien Mejorado Mejor

Para qué está diseñado Gemini 3.5 Flash

Según todo lo que sabemos hasta ahora, aquí es donde el 3.5 Flash destacará sobre la gama actual.

Flujos de trabajo complejos basados ​​en agentes que requieren velocidad.

Históricamente, los bucles de agentes de varios pasos han sido un punto débil de los modelos Flash: perdían el contexto, generaban parámetros de herramientas erróneos o proporcionaban respuestas superficiales a mitad de la cadena. Se espera que Flash 3.5 gestione estos problemas con la fiabilidad que antes solo estaba reservada para Pro, pero con un coste y una latencia mucho menores.

Asistentes de codificación e integraciones con IDE

El razonamiento "Near-Pro" implica que Flash 3.5 debería ser capaz de gestionar tareas reales de depuración, revisión de código y refactorización que actualmente requieren la versión Pro. El límite de conocimientos de enero de 2026 también implica una mayor familiaridad con los frameworks recientes, las versiones de paquetes y los cambios incompatibles en la API.

Aplicaciones basadas en búsquedas en tiempo real

Si las mejoras en la conexión a tierra se mantienen en la versión general, Flash 3.5 debería ser significativamente más fiable para aplicaciones donde las alucinaciones son costosas: herramientas de investigación orientadas al cliente, sistemas de verificación de datos y sistemas RAG que necesitan una clasificación precisa de fragmentos junto con una baja latencia.

Chat interactivo con documentos complejos

El contexto de 1 millón de tokens y las mejoras previstas en el razonamiento lo convierten en una opción ideal para productos de preguntas y respuestas sobre documentos, análisis de contratos legales y análisis de informes financieros; tareas en las que la velocidad de Flash es importante, pero en las que los modelos Flash anteriores a veces ofrecían respuestas superficiales sobre material denso.

Canalizaciones multimodales (vídeo, audio, imágenes)

Gemini 3.5 Flash hereda la pila multimodal completa, incluyendo una calidad de entrada de audio mejorada con respecto a la generación 2.5. Para aplicaciones que procesan grabaciones de reuniones, fotos de productos o documentos multimedia, ofrece un único modelo en lugar de puntos finales especializados separados.

Campo de juegos de IA

Pruebe todos los modelos de API en el entorno de pruebas antes de integrarlos. Ofrecemos más de 300 modelos para integrar en su aplicación.
Contáctanos
api-right-1
modelo-bg02-1

Más de 300 modelos de IA para
OpenClaw y agentes de IA

Ahorre un 20% en costos