



const { OpenAI } = require('openai');
const api = new OpenAI({
baseURL: 'https://api.ai.cc/v1',
apiKey: '',
});
const main = async () => {
const result = await api.chat.completions.create({
model: 'google/gemini-3-5-flash',
messages: [
{
role: 'system',
content: 'You are an AI assistant who knows everything.',
},
{
role: 'user',
content: 'Tell me, why is the sky blue?'
}
],
});
const message = result.choices[0].message.content;
console.log(`Assistant: ${message}`);
};
main();
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.a.cc/v1",
api_key="",
)
response = client.chat.completions.create(
model="google/gemini-3-5-flash",
messages=[
{
"role": "system",
"content": "You are an AI assistant who knows everything.",
},
{
"role": "user",
"content": "Tell me, why is the sky blue?"
},
],
)
message = response.choices[0].message.content
print(f"Assistant: {message}")

双子座3.5闪光灯
Gemini 3.5 Flash 型号缩小了 Flash 级速度和专业级推理能力之间的差距。
什么是 Gemini 3.5 Flash API?
Google推出的 Gemini 3.5 Flash API 是一款新一代多模态 AI,专为实际生产工作负载、高速自动化、高级编码辅助和可扩展的代理工作流而设计。无论您是构建 AI 驱动的 SaaS 工具、企业级副驾驶、客户支持系统、自动化管道还是下一代编码代理,Gemini 3.5 Flash 都能提供现代应用程序所需的高性能。
与通常为了推理质量而牺牲延迟的传统重量级模型不同,Gemini 3.5 Flash 专注于以 Flash 级的速度提供高级推理、编码能力和多模态理解。

Gemini 3.5 Flash 有哪些优势
根据目前的泄露信息、Gemini 3 系列官方文档和早期测试人员的报告,开发者们所期待的一切都在这里。
接近专业人士的推理
预计其推理质量将显著接近 Gemini 3.1 Pro,同时保持速度更快、价格更低。早期测试者报告称,长期存在的“惰性模型”问题已基本得到解决。
100万Tokens上下文
延续了 Gemini 3 一代的 100 万个令牌输入上下文窗口——足够大,可以在一次调用中容纳整个代码库、冗长的文档和复杂的多轮代理对话。
可配置的思维水平
与之前的 Gemini 3 Flash 一样,3.5 Flash 预计将支持四个思维级别——最小、低、中、高——让开发人员在推理深度与延迟和每次请求的成本之间进行权衡。
全面支持多模态
支持文本、图像、音频、视频和PDF格式的输入。延续了Gemini 3系列改进的音频处理能力,包括更好地处理带口音的语音和背景噪音。
更牢固的接地
泄露的信息显示,搜索接地可靠性有所提升——这一直是早期 Gemini Flash 型号的痛点。如果属实,这将使 3.5 版 Flash 在实际研究和事实性任务中更加实用。
Gemini 3.5 Flash API 定价
- 缓存输入:0.065 美元
- 音频输入:1.30 美元
- 100万个输入Tokens:0.65美元
- 100万个输出Tokens:3.90美元
> 20万个Tokens
- 100万个输入Tokens:3.25美元
- 100万个输出Tokens:23.40美元
型号规格概览
四个思维层次,一个模型
thinking_level 参数允许您根据请求调整推理深度——这对于高容量工作负载至关重要,因为您不想为简单的任务支付专业版的价格。
Gemini 3.5 Flash 与目前的 Gemini 3 系列产品对比
Gemini 3.5 闪光灯的设计用途
根据我们目前所了解的一切,3.5 Flash 相较于现有产品线的优势体现在以下几个方面。
需要速度的复杂代理工作流程
多步骤代理循环一直是 Flash 模型的一个弱点——它们会丢失上下文信息、错误地理解工具参数,或者在循环过程中给出肤浅的答案。Flash 3.5 有望以远低于 Pro 的成本和延迟,提供以往只有 Pro 版本才具备的可靠性来处理这些问题。
编码助手和IDE集成
“接近专业级”意味着 Flash 3.5 应该能够处理目前需要专业级才能完成的实际调试、代码审查和重构任务。2026 年 1 月的知识截止日也意味着需要更好地了解最新的框架、软件包版本和 API 的重大变更。
实时搜索应用程序
如果 GA 版本能够保持这些基础改进,那么 3.5 Flash 对于那些容错成本高昂的应用来说,可靠性应该会显著提高——例如面向客户的研究工具、事实核查流程以及需要准确片段排名和低延迟的 RAG 系统。
与复杂文档进行交互式聊天
100 万个标记上下文和预期推理改进使其非常适合文档问答产品、法律合同分析和财务报告解析——在这些任务中,Flash 的速度很重要,但以前的 Flash 模型有时会对密集的材料给出肤浅的答案。
多模态管道(视频、音频、图像)
Gemini 3.5 Flash 继承了完整的多模态协议栈,音频输入质量较 2.5 代有所提升。对于需要导入会议录音、产品照片或混合媒体文档的应用,它提供了一个统一的接口,无需单独的专用接口。



登录