Gemini 3.6 Flash 在 NextModel 中是什么?
Gemini 3.6 Flash 是 NextModel 目录中的 Google 模型,常用于 图像理解、multimodal chat 工作负载。当前展示价格为 $1.50 / 1M tokens、输出 $7.50 / 1M tokens,上下文窗口为 1M token。
适用场景
- 图像理解
- multimodal chat
OpenAI 兼容调用示例
保持 OpenAI SDK 调用方式不变,把 base_url 改为 NextModel,并使用模型目录 ID google--gemini-3.6-flash。
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.nextmodel.app/v1"
)
resp = client.chat.completions.create(
model="google/gemini-3.6-flash",
messages=[{"role": "user", "content": "Hello from NextModel"}]
)
print(resp.choices[0].message.content)相似替代项
kimi-k2.7-code 是 Kimi 迄今为止最智能的编码模型。它能更可靠地在长时间上下文中执行指令,并以更高的成功率完成编程任务。它支持文本、图片和视频输入,以及思考模式、对话和客服任务。
Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
Google Gemini 3.1 Flash-Lite,超轻量快速模型。支持文本、图像、视频多模态输入,极低成本。适合对延迟和成本极度敏感的大规模部署场景,支持缓存进一步降本。
参考
相关文章
上线前如何估算 AI API 成本
Listed price only tells you the unit cost. This walkthrough turns that into a traffic estimate.
Lin Qiming
LLM Gateway: Compare Options and Alternatives
Same OpenAI-compatible base URL, with routing and billing sitting in front of the model.
Zhao Yu'an
常见问题