Google 模型

Gemini 3.8 Flash

Gemini 3.8 Flash 是现阶段综合性能最为出色的主力模型。相较 Gemini 3.7 Flash,该模型在软件工程、智能代理任务以及专业领域复杂多步骤核心推理能力方面,均实现全方位大幅升级。

Google平台整理目录
流式输出工具调用JSON 模式视觉长上下文
输入价格$0.75 / 1M tokens
输出价格$3.75 / 1M tokens
上下文长度1M 令牌
最大输出8.2k 令牌

Gemini 3.8 Flash 在 NextModel 中是什么?

Gemini 3.8 Flash 是 NextModel 目录中的 Google 模型,常用于 图像理解、multimodal chat 工作负载。当前展示价格为 $0.75 / 1M tokens、输出 $3.75 / 1M tokens,上下文窗口为 1M token。

适用场景

  • 图像理解
  • multimodal chat

OpenAI 兼容调用示例

保持 OpenAI SDK 调用方式不变,把 base_url 改为 NextModel,并使用模型目录 ID google--gemini-3.8-flash

Python
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.nextmodel.app/v1"
)

resp = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello from NextModel"}]
)

print(resp.choices[0].message.content)

相似替代项

Google目录

Gemini 3.5 Flash-Lite 是 Gemini 3 系列高性能原生多模态推理模型的新增成员。该模型成本效益突出、响应速度快,专为翻译、分类这类高吞吐量、时延敏感型任务优化,同时支持智能体工作流。

$0.3 / 1M tokens输入$2.50 / 1M tokens输出1M上下文
适用场景图像理解, multimodal chat
路由已配置
流式输出工具调用JSON 模式视觉
平台整理NextModel gateway catalog (Go origin)
查看详情
Qwen目录

Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。

Starting at $0.03 / 1M tokens输入$0.12 / 1M tokens输出1M上下文
适用场景图像理解, multimodal chat
路由已配置
流式输出工具调用JSON 模式视觉
平台整理NextModel gateway catalog (Go origin)
查看详情
Google目录

Google Gemini 3.1 Flash-Lite,超轻量快速模型。支持文本、图像、视频多模态输入,极低成本。适合对延迟和成本极度敏感的大规模部署场景,支持缓存进一步降本。

$0.25 / 1M tokens输入$1.50 / 1M tokens输出1M上下文
适用场景图像理解, multimodal chat
路由已配置
流式输出工具调用JSON 模式视觉
平台整理NextModel gateway catalog (Go origin)
查看详情

参考

相关文章

常见问题

Gemini 3.8 Flash API 常见问题