Google 模型

Gemini 3.6 Flash

Gemini 3.6 Flash 是 Gemini 3 系列高性能原生多模态推理模型的新增成员。作为主力模型,它在代码生成、知识处理与多模态能力上表现更优异,同时相比 Gemini 3.5 Flash 具备更高的 Token 效率。

Google平台整理目录
流式输出工具调用JSON 模式视觉长上下文
输入价格$1.50 / 1M tokens
输出价格$7.50 / 1M tokens
上下文长度1M 令牌
最大输出8.2k 令牌

Gemini 3.6 Flash 在 NextModel 中是什么?

Gemini 3.6 Flash 是 NextModel 目录中的 Google 模型,常用于 图像理解、multimodal chat 工作负载。当前展示价格为 $1.50 / 1M tokens、输出 $7.50 / 1M tokens,上下文窗口为 1M token。

适用场景

  • 图像理解
  • multimodal chat

OpenAI 兼容调用示例

保持 OpenAI SDK 调用方式不变,把 base_url 改为 NextModel,并使用模型目录 ID google--gemini-3.6-flash

Python
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.nextmodel.app/v1"
)

resp = client.chat.completions.create(
    model="google/gemini-3.6-flash",
    messages=[{"role": "user", "content": "Hello from NextModel"}]
)

print(resp.choices[0].message.content)

相似替代项

Moonshotai目录正常1072ms

kimi-k2.7-code 是 Kimi 迄今为止最智能的编码模型。它能更可靠地在长时间上下文中执行指令,并以更高的成功率完成编程任务。它支持文本、图片和视频输入,以及思考模式、对话和客服任务。

$0.9 / 1M tokens输入$3.72 / 1M tokens输出256k上下文
适用场景图像理解, multimodal chat
流式输出工具调用JSON 模式视觉
平台整理NextModel gateway catalog (Go origin)
查看详情
Qwen目录正常1204ms

Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。

Starting at $0.3 / 1M tokens输入$1.18 / 1M tokens输出1M上下文
适用场景图像理解, multimodal chat
流式输出工具调用JSON 模式视觉
平台整理NextModel gateway catalog (Go origin)
查看详情
Google目录正常996ms

Google Gemini 3.1 Flash-Lite,超轻量快速模型。支持文本、图像、视频多模态输入,极低成本。适合对延迟和成本极度敏感的大规模部署场景,支持缓存进一步降本。

$0.25 / 1M tokens输入$1.50 / 1M tokens输出1M上下文
适用场景图像理解, multimodal chat
流式输出工具调用JSON 模式视觉
平台整理NextModel gateway catalog (Go origin)
查看详情

参考

相关文章

常见问题

Gemini 3.6 Flash API 常见问题