qwen-bg
max-ico04
3.25
出去
23.4
max-ico02
聊天
max-ico03
积极的
双子座3.5闪光灯
Gemini 3.5 Flash 以闪电般的速度带来接近专业级的推理能力。探索规格、价格和思维层次。
Text to Speech
                                        const { OpenAI } = require('openai');

const api = new OpenAI({
  baseURL: 'https://api.ai.cc/v1',
  apiKey: '',
});

const main = async () => {
  const result = await api.chat.completions.create({
    model: 'google/gemini-3-5-flash',
    messages: [
      {
        role: 'system',
        content: 'You are an AI assistant who knows everything.',
      },
      {
        role: 'user',
        content: 'Tell me, why is the sky blue?'
      }
    ],
  });

  const message = result.choices[0].message.content;
  console.log(`Assistant: ${message}`);
};

main();
                                
                                        import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.a.cc/v1",
    api_key="",    
)

response = client.chat.completions.create(
    model="google/gemini-3-5-flash",
    messages=[
        {
            "role": "system",
            "content": "You are an AI assistant who knows everything.",
        },
        {
            "role": "user",
            "content": "Tell me, why is the sky blue?"
        },
    ],
)

message = response.choices[0].message.content

print(f"Assistant: {message}")
Docs

300 多个适用于 OpenClaw 和 AI 代理的 AI 模型

qwenmax-bg
Google (4).svg
双子座3.5闪光灯

双子座3.5闪光灯

Gemini 3.5 Flash 型号缩小​​了 Flash 级速度和专业级推理能力之间的差距。

什么是 Gemini 3.5 Flash API?

Google推出的 Gemini 3.5 Flash API 是一款新一代多模态 AI,专为实际生产工作负载、高速自动化、高级编码辅助和可扩展的代理工作流而设计。无论您是构建 AI 驱动的 SaaS 工具、企业级副驾驶、客户支持系统、自动化管道还是下一代编码代理,Gemini 3.5 Flash 都能提供现代应用程序所需的高性能。

与通常为了推理质量而牺牲延迟的传统重量级模型不同,Gemini 3.5 Flash 专注于以 Flash 级的速度提供高级推理、编码能力和多模态理解。

Gemini 3.5 Flash 有哪些优势

根据目前的泄露信息、Gemini 3 系列官方文档和早期测试人员的报告,开发者们所期待的一切都在这里。

接近专业人士的推理

预计其推理质量将显著接近 Gemini 3.1 Pro,同时保持速度更快、价格更低。早期测试者报告称,长期存在的“惰性模型”问题已基本得到解决。

100万Tokens上下文

延续了 Gemini 3 一代的 100 万个令牌输入上下文窗口——足够大,可以在一次调用中容纳整个代码库、冗长的文档和复杂的多轮代理对话。

可配置的思维水平

与之前的 Gemini 3 Flash 一样,3.5 Flash 预计将支持四个思维级别——最小、低、中、高——让开发人员在推理深度与延迟和每次请求的成本之间进行权衡。

全面支持多模态

支持文本、图像、音频、视频和PDF格式的输入。延续了Gemini 3系列改进的音频处理能力,包括更好地处理带口音的语音和背景噪音。

更牢固的接地

泄露的信息显示,搜索接地可靠性有所提升——这一直是早期 Gemini Flash 型号的痛点。如果属实,这将使 3.5 版 Flash 在实际研究和事实性任务中更加实用。

Gemini 3.5 Flash API 定价

  • 缓存输入:0.065 美元
  • 音频输入:1.30 美元

  • 100万个输入Tokens:0.65美元
  • 100万个输出Tokens:3.90美元

> 20万个Tokens

  • 100万个输入Tokens:3.25美元
  • 100万个输出Tokens:23.40美元

型号规格概览

规格 细节
型号 ID gemini-3.5-flash-预览
开发者 GoogleDeepMind
型号系列 双子座 3.5(闪光级)
上下文窗口 1,000,000 个输入令牌
最大输出 约 64,000–65,000 个Tokens(与 Gemini 3 Flash 一致)
知识门槛 2026年1月(根据泄露的定价页面)
输入方式 文本 · 图片 · 音频 · 视频 · PDF
输出方式 文本
思维层次 最低 · 低 · 中 · 高
支持的工具 Google 搜索 · URL 上下文 · 代码执行 · 函数调用 · 地图基础
上下文缓存 是的(减少重复提示的成本)

四个思维层次,一个模型

thinking_level 参数允许您根据请求调整推理深度——这对于高容量工作负载至关重要,因为您不想为简单的任务支付专业版的价格。

思维水平 描述 最佳应用案例
极简主义 速度最快,成本最低。延迟与非推理模型相近。 分类、路由和简单转换,无需过多思考。
低的 轻快的推理,兼顾速度和质量。 为降低成本的内容制作流程提供摘要、翻译和基本问答功能。
中等的 性能与推理深度兼顾。这是大多数应用程序的实用默认设置。 代码生成、文档分析和多步骤指令。
高的 完整的推理链,输出质量接近专业级,适用于高级任务。 复杂的逻辑、数学、研究综合和多跳推理。

Gemini 3.5 Flash 与目前的 Gemini 3 系列产品对比

特征 Gemini 3.1 手电筒 双子座3号闪光灯 双子座3.5闪光灯 Gemini 3.1 Pro
层级 手电筒 闪光 Flash(高级版) 专业版
上下文窗口 100万个Tokens 100万个Tokens 100万个Tokens 200万Tokens
思维层次 ✓ 4 个级别 ✓ 4 个级别 ✓ 4 个级别 ✓ 4 个级别
推理质量 好的 非常好 准职业选手 一流
延迟 最快 快速地 快速地 慢点
接地改进 缓和 好的 改进 最好的

Gemini 3.5 闪光灯的设计用途

根据我们目前所了解的一切,3.5 Flash 相较于现有产品线的优势体现在以下几个方面。

需要速度的复杂代理工作流程

多步骤代理循环一直是 Flash 模型的一个弱点——它们会丢失上下文信息、错误地理解工具参数,或者在循环过程中给出肤浅的答案。Flash 3.5 有望以远低于 Pro 的成本和延迟,提供以往只有 Pro 版本才具备的可靠性来处理这些问题。

编码助手和IDE集成

“接近专业级”意味着 Flash 3.5 应该能够处理目前需要专业级才能完成的实际调试、代码审查和重构任务。2026 年 1 月的知识截止日也意味着需要更好地了解最新的框架、软件包版本和 API 的重大变更。

实时搜索应用程序

如果 GA 版本能够保持这些基础改进,那么 3.5 Flash 对于那些容错成本高昂的应用来说,可靠性应该会显著提高——例如面向客户的研究工具、事实核查流程以及需要准确片段排名和低延迟的 RAG 系统。

与复杂文档进行交互式聊天

100 万个标记上下文和预期推理改进使其非常适合文档问答产品、法律合同分析和财务报告解析——在这些任务中,Flash 的速度很重要,但以前的 Flash 模型有时会对密集的材料给出肤浅的答案。

多模态管道(视频、音频、图像)

Gemini 3.5 Flash 继承了完整的多模态协议栈,音频输入质量较 2.5 代有所提升。对于需要导入会议录音、产品照片或混合媒体文档的应用,它提供了一个统一的接口,无需单独的专用接口。

API 操练场(Playground)

集成前,请在沙盒环境中测试所有 API 模型。我们提供 300 多个模型供您集成到应用中。
联系我们
api-right-1
模型-bg02-1

300 多个 AI 模型
OpenClaw 和人工智能代理

节省20%的费用