



const { OpenAI } = require('openai');
const api = new OpenAI({
baseURL: 'https://api.ai.cc/v1',
apiKey: '',
});
const main = async () => {
const result = await api.chat.completions.create({
model: 'google/gemini-3-5-flash',
messages: [
{
role: 'system',
content: 'You are an AI assistant who knows everything.',
},
{
role: 'user',
content: 'Tell me, why is the sky blue?'
}
],
});
const message = result.choices[0].message.content;
console.log(`Assistant: ${message}`);
};
main();
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.a.cc/v1",
api_key="",
)
response = client.chat.completions.create(
model="google/gemini-3-5-flash",
messages=[
{
"role": "system",
"content": "You are an AI assistant who knows everything.",
},
{
"role": "user",
"content": "Tell me, why is the sky blue?"
},
],
)
message = response.choices[0].message.content
print(f"Assistant: {message}")

Géminis 3.5 Flash
El modelo Gemini 3.5 Flash reduce la brecha entre la velocidad propia de Flash y el razonamiento de nivel profesional.
¿Qué es la API Flash Gemini 3.5?
Con la API Gemini 3.5 Flash, Google presenta una nueva generación de IA multimodal diseñada para cargas de trabajo de producción reales, automatización de alta velocidad, asistencia avanzada para la codificación y flujos de trabajo escalables basados en agentes. Ya sea que esté creando herramientas SaaS con IA, sistemas de asistencia empresarial, sistemas de atención al cliente, pipelines de automatización o agentes de codificación de última generación, Gemini 3.5 Flash ofrece el rendimiento que exigen las aplicaciones modernas.
A diferencia de los modelos pesados tradicionales que a menudo sacrifican la latencia en aras de la calidad del razonamiento, Gemini 3.5 Flash se centra en ofrecer razonamiento avanzado, capacidad de codificación y comprensión multimodal a la velocidad de Flash.

Lo que Gemini 3.5 Flash aporta a la mesa
Todo lo que los desarrolladores esperan según las filtraciones actuales, la documentación oficial de la serie Gemini 3 y los primeros informes de los probadores.
Razonamiento casi profesional
Se espera que alcance una calidad de razonamiento significativamente mayor que la de Gemini 3.1 Pro, manteniendo a la vez un menor coste y una mayor velocidad. Los primeros usuarios que lo probaron informan que el problema persistente del "modelo inactivo" se ha solucionado en gran medida.
Contexto de 1 millón de tokens
Conserva la ventana de contexto de entrada de 1 millón de tokens completa de la generación Gemini 3, lo suficientemente grande como para albergar bases de código completas, documentos extensos y conversaciones complejas de varios turnos entre agentes en una sola llamada.
Niveles de pensamiento configurables
Al igual que Gemini 3 Flash, se espera que Flash 3.5 admita cuatro niveles de procesamiento (mínimo, bajo, medio y alto), lo que permitirá a los desarrolladores equilibrar la profundidad del razonamiento con la latencia y el coste por solicitud.
Soporte multimodal completo
Admite texto, imágenes, audio, vídeo y archivos PDF como entrada. Conserva las mejoras en la calidad de audio de la serie Gemini 3, incluyendo un mejor manejo del habla con acento y el ruido de fondo.
Conexión a tierra más sólida
Los detalles filtrados apuntan a una mayor fiabilidad en la búsqueda, un problema recurrente en los modelos Gemini Flash anteriores. De ser cierto, esto podría hacer que el Flash 3.5 sea mucho más útil para la investigación y las tareas de análisis de datos en el mundo real.
Precios de la API Flash de Gemini 3.5
- Entrada almacenada en caché: $0.065
- Entrada de audio: $1.30
- 1 millón de tokens de entrada: $0.65
- 1 millón de tokens de salida: $3.90
> 200.000 tokens
- 1 millón de tokens de entrada: $3.25
- 1 millón de tokens de salida: $23.40
Especificaciones del modelo de un vistazo
Cuatro niveles de pensamiento, un modelo
El parámetro thinking_level permite ajustar la profundidad de razonamiento por solicitud, algo fundamental para cargas de trabajo de gran volumen en las que no se desea pagar precios Pro por tareas sencillas.
Gemini 3.5 Flash frente a la gama actual de Gemini 3
Para qué está diseñado Gemini 3.5 Flash
Según todo lo que sabemos hasta ahora, aquí es donde el 3.5 Flash destacará sobre la gama actual.
Flujos de trabajo complejos basados en agentes que requieren velocidad.
Históricamente, los bucles de agentes de varios pasos han sido un punto débil de los modelos Flash: perdían el contexto, generaban parámetros de herramientas erróneos o proporcionaban respuestas superficiales a mitad de la cadena. Se espera que Flash 3.5 gestione estos problemas con la fiabilidad que antes solo estaba reservada para Pro, pero con un coste y una latencia mucho menores.
Asistentes de codificación e integraciones con IDE
El razonamiento "Near-Pro" implica que Flash 3.5 debería ser capaz de gestionar tareas reales de depuración, revisión de código y refactorización que actualmente requieren la versión Pro. El límite de conocimientos de enero de 2026 también implica una mayor familiaridad con los frameworks recientes, las versiones de paquetes y los cambios incompatibles en la API.
Aplicaciones basadas en búsquedas en tiempo real
Si las mejoras en la conexión a tierra se mantienen en la versión general, Flash 3.5 debería ser significativamente más fiable para aplicaciones donde las alucinaciones son costosas: herramientas de investigación orientadas al cliente, sistemas de verificación de datos y sistemas RAG que necesitan una clasificación precisa de fragmentos junto con una baja latencia.
Chat interactivo con documentos complejos
El contexto de 1 millón de tokens y las mejoras previstas en el razonamiento lo convierten en una opción ideal para productos de preguntas y respuestas sobre documentos, análisis de contratos legales y análisis de informes financieros; tareas en las que la velocidad de Flash es importante, pero en las que los modelos Flash anteriores a veces ofrecían respuestas superficiales sobre material denso.
Canalizaciones multimodales (vídeo, audio, imágenes)
Gemini 3.5 Flash hereda la pila multimodal completa, incluyendo una calidad de entrada de audio mejorada con respecto a la generación 2.5. Para aplicaciones que procesan grabaciones de reuniones, fotos de productos o documentos multimedia, ofrece un único modelo en lugar de puntos finales especializados separados.
Campo de juegos de IA



Acceso