Google 模型 · 香港版

Gemini 3.8 Flash

香港團隊可用的 NextModel 目錄中的 Google 模型,常用於 圖像理解、multimodal chat 工作負載。當前展示價格為 $0.75 / 1M tokens、輸出 $3.75 / 1M tokens,上下文視窗為 1M token。

GooglePlatform curated目錄
StreamingTool callingJSON modeVisionLong context
輸入價格$0.75 / 1M tokens
輸出價格$3.75 / 1M tokens
上下文長度1M token
最大輸出8.2k token

Gemini 3.8 Flash 在 NextModel 中是什麼?

香港團隊可用的 NextModel 目錄中的 Google 模型,常用於 圖像理解、multimodal chat 工作負載。當前展示價格為 $0.75 / 1M tokens、輸出 $3.75 / 1M tokens,上下文視窗為 1M token。

適用場景

  • 圖像理解
  • multimodal chat

OpenAI 相容呼叫範例

request.sh
curl https://api.nextmodel.app/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $NEXTMODEL_API_KEY" \
  -d '{"model":"google/gemini-3.8-flash","messages":[{"role":"user","content":"Reply with OK."}]}'

换模型只改 model 字段。

在 Playground 裡試運行

相似替代項

Google目錄

Gemini 3.5 Flash-Lite 是 Gemini 3 系列高性能原生多模态推理模型的新增成员。该模型成本效益突出、响应速度快,专为翻译、分类这类高吞吐量、时延敏感型任务优化,同时支持智能体工作流。

$0.3 / 1M tokens輸入$2.50 / 1M tokens輸出1M上下文
適用場景圖像理解, multimodal chat
路由已設定
串流輸出工具呼叫JSON 模式視覺
平台整理NextModel gateway catalog (Go origin)
查看詳情
Qwen目錄

Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。

Starting at $0.03 / 1M tokens輸入$0.12 / 1M tokens輸出1M上下文
適用場景圖像理解, multimodal chat
路由已設定
串流輸出工具呼叫JSON 模式視覺
平台整理NextModel gateway catalog (Go origin)
查看詳情
Google目錄

Google Gemini 3.1 Flash-Lite,超轻量快速模型。支持文本、图像、视频多模态输入,极低成本。适合对延迟和成本极度敏感的大规模部署场景,支持缓存进一步降本。

$0.25 / 1M tokens輸入$1.50 / 1M tokens輸出1M上下文
適用場景圖像理解, multimodal chat
路由已設定
串流輸出工具呼叫JSON 模式視覺
平台整理NextModel gateway catalog (Go origin)
查看詳情

參考

Gemini 3.8 Flash 相關文章

常見問題

Gemini 3.8 Flash API 常見問題