Gemini 3.8 Flash 在 NextModel 中是什麼?
台灣團隊可用的 NextModel 目錄中的 Google 模型,常用於 圖像理解、multimodal chat 工作負載。當前展示價格為 $0.75 / 1M tokens、輸出 $3.75 / 1M tokens,上下文視窗為 1M token。
適用場景
- 圖像理解
- multimodal chat
OpenAI 相容呼叫範例
request.sh
curl https://api.nextmodel.app/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $NEXTMODEL_API_KEY" \
-d '{"model":"google/gemini-3.8-flash","messages":[{"role":"user","content":"Reply with OK."}]}'换模型只改 model 字段。
相似替代項
Google目錄
Gemini 3.5 Flash-Lite 是 Gemini 3 系列高性能原生多模态推理模型的新增成员。该模型成本效益突出、响应速度快,专为翻译、分类这类高吞吐量、时延敏感型任务优化,同时支持智能体工作流。
適用場景圖像理解, multimodal chat
路由已設定
串流輸出工具呼叫JSON 模式視覺
平台整理NextModel gateway catalog (Go origin)
Qwen目錄
Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。
適用場景圖像理解, multimodal chat
路由已設定
串流輸出工具呼叫JSON 模式視覺
平台整理NextModel gateway catalog (Go origin)
Google目錄
Google Gemini 3.1 Flash-Lite,超轻量快速模型。支持文本、图像、视频多模态输入,极低成本。适合对延迟和成本极度敏感的大规模部署场景,支持缓存进一步降本。
適用場景圖像理解, multimodal chat
路由已設定
串流輸出工具呼叫JSON 模式視覺
平台整理NextModel gateway catalog (Go origin)
參考
Gemini 3.8 Flash 相關文章
上線前如何估算 AI API 成本
Listed price only tells you the unit cost. This walkthrough turns that into a traffic estimate.
Lin Qiming
LLM Gateway: Compare Options and Alternatives
Same OpenAI-compatible base URL, with routing and billing sitting in front of the model.
Zhao Yu'an
常見問題