GPT‑6 Astra 是 OpenAI 于 2026 年 9 月 3 日发布的新一代旗舰大模型,代号 Astra 源自拉丁语,意为 “星辰”,官方定位为全球最智能、对齐度最高的 AI 模型,核心转向智能体代理,重点强化计算机自主操作能力,不再局限于单纯对话问答
129 / 129 个模型
每张卡片都标好来源,也能直接复制成 OpenAI 兼容调用。
选型先看三件事
谁在供货、输入输出各多少钱、上下文装不装得下你的任务——这三件事决定成本的大头,页面上每张卡片都直接标出来。其余标签(延迟、能力、路由状态)做成了筛选项,按你的工作负载勾选即可。
2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。
面向长周期 Agent、大型代码工程、多步科研推理、重度知识工作的前沿大模型,在 Fable5 基础上重点强化长时间自主任务稳定性、工具调用、科学数学推理、代码全库开发能力,支持多小时持续 Agent 会话,具备自我校验纠错能力。
2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。
Available through the NextModel gateway via Black Forest Labs.
Available through the NextModel gateway via Black Forest Labs.
OpenAI GPT Image 系列标准模型,支持文本和图像输入。擅长添加、删除、组合和混合元素编辑,保持构图和光照一致性,适合创意设计和图像处理。
OpenAI GPT Image 系列轻量模型,性价比极高。保持良好的图像生成质量,适合大批量图像生成和对成本敏感的场景。
OpenAI 最新图像生成模型,支持文本和图像输入。生成速度比 GPT Image 1 快 4 倍,成本降低 20%。精确编辑控制,出色的文字渲染能力,支持密集小字和复杂排版,适合专业设计和营销素材制作。
OpenAI 新一代推理式多模态图像生成模型,支持文生图/图生图/对话式编辑,具备思考模式、精准多语言文字渲染、2K分辨率、批量连贯出图能力,专为商用级视觉内容生产优化。
Available through the NextModel gateway via OpenAI.
Available through the NextModel gateway via OpenAI.
GLM-5.3 是智谱最新旗舰模型,1M长上下文,支持思考长度控制,在复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色。
DeepSeek-V4-Pro-0813核心强化Agent智能体能力,在代码智能体、工具调用、长链路任务执行等公开基准测试中性能提升,依托DeepSeek Harness极简测试框架完成专项优化,更适配自动化开发、复杂任务编排场景。
均衡型通用模型,兼顾性能与成本,综合能力超越上一代主力模型,适配 95% 企业高频场景,是多数业务的性价比之选。
字节跳动旗舰级通用 Agent 模型,侧重长链路推理与复杂任务稳定性,多模态理解全面升级,适配科研分析、专业方案评审等高端复杂场景。
Qwen3系列小尺寸视觉理解模型,实现思考模式和非思考模式的有效融合,效果优于开源版Qwen3-VL-30B-A3B,响应速度快。全面升级图像/视频理解,支持长视频长文档等超长上下文、空间感知与万物识别;具备视觉2D/3D定位能力,胜任复杂现实任务。
Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。
Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。
Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。
千问3系列Max模型,相较preview版本在智能体编程与工具调用方向进行了专项升级。本次发布的正式版模型达到领域SOTA水平,适配场景更加复杂的智能体需求。
Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视觉coding、空间感知、多模态思考等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解。
Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。
千问3系列Max模型,相较preview版本在智能体编程与工具调用方向进行了专项升级。本次发布的正式版模型达到领域SOTA水平,适配场景更加复杂的智能体需求。
Available through the NextModel gateway via Qwen.
Gemini 3.7 Flash 是 Gemini 3 系列中兼顾高效性能与高性价比的主力模型。它具备媲美专业级的智能自主代理能力,代码生成与终端执行能力实现跨越式提升。
GPT-5 Codex 优化版,专为代码生成和软件工程任务优化。支持 Responses API,擅长修复 Bug、代码编辑和复杂代码库问答。
编程专用模型,深度优化代码生成、审查与调试能力,与 TRAE 工具链无缝协同,大幅提升开发者编码效率与质量。
Doubao Seed 2.0 Mini 是目前通过 NextModel 公共网关暴露的最低成本生产模型。它适合作为中文问答、分类、摘要和轻量多模态任务的默认选择。
Qwen3系列小尺寸视觉理解模型,实现思考模式和非思考模式的有效融合,效果优于开源版Qwen3-VL-30B-A3B,响应速度快。全面升级图像/视频理解,支持长视频长文档等超长上下文、空间感知与万物识别;具备视觉2D/3D定位能力,胜任复杂现实任务。
Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步。
Grok 4.1 快速非推理是 xAI 前沿工具调用模型的即时响应变体。它跳过思考令牌阶段,以实现最高速度和低延迟,同时提供针对代理式工作流优化的高质量输出。它基于 Grok 4.1 的传承,保持了强大的工具调用准确性,相比前几代减少了幻觉,并支持较大的上下文窗口。该变体在高通量、实时场景中表现出色,优先考虑即时响应而非逐步推理。
Grok 4.1 快速推理是一个专注于高性能代理工具调用的前沿多模态模型。它能够准确快速地推理并完成代理任务,在客户支持和财务等复杂现实场景中表现出色。配合代理工具,它使开发者能够构建专注于工具调用和代理搜索的生产级代理。它拥有更自然流畅的对话,同时保持了强大的核心推理能力,更敏锐地捕捉细腻的意图,引人入胜,个性连贯。
Grok 4.2 是 xAI 最新的大型语言模型,专为强推理、多模态理解和企业应用而构建。它提升了指令跟踪、诚信性和校准能力,相较早期版本,同时支持单代理和多代理工作流程。Grok 4.2 被设计为通用的真理追寻助手,在配合适当防护下,非常适合研究、分析、编码及复杂专业任务。
Grok 4.2 是 xAI 最新的大型语言模型,专为强推理、多模态理解和企业应用而构建。它提升了指令跟踪、诚信性和校准能力,相较早期版本,同时支持单代理和多代理工作流程。Grok 4.2 被设计为通用的真理追寻助手,在配合适当防护下,非常适合研究、分析、编码及复杂专业任务。
迈向生产级智能的新一代大模型,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。
效果与成本均衡,全面升级 Coding、Agent 与多模态能力,以更强的自主规划、长链路执行和动态修复能力,胜任企业真实复杂任务。
Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。
Available through the NextModel gateway via Qwen.
Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。
高效轻量化MoE模型,总参284B,激活13B,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG、批量文案处理等普惠刚需场景。
Gemini 3.5 Flash-Lite 是 Gemini 3 系列高性能原生多模态推理模型的新增成员。该模型成本效益突出、响应速度快,专为翻译、分类这类高吞吐量、时延敏感型任务优化,同时支持智能体工作流。
Gemini 3.8 Flash 是现阶段综合性能最为出色的主力模型。相较 Gemini 3.7 Flash,该模型在软件工程、智能代理任务以及专业领域复杂多步骤核心推理能力方面,均实现全方位大幅升级。
Kimi K3 is a 2.8T parameter open-weight multimodal reasoning model from Moonshot AI. It is suited for complex coding, knowledge work, and long-horizon agentic workflows, and is particularly strong at...
GPT-5.6 系列极速高性价比轻量模型,全系列最低调用成本、低延迟高吞吐,面向实时客服、批量摘要、内容清洗、高频并发标准化企业任务场景
GPT-5.6 均衡中端通用模型,兼顾强推理能力与减半使用成本,适配企业日常文档处理、业务分析、常规开发与批量知识运维,性能对标上代旗舰 GPT-5.5
GPT-5.6 Sol is the flagship model in OpenAI's GPT-5.6 series. It is suited for complex reasoning, coding, and agentic workflows, and is particularly strong at command-line and multi-step coding tasks...
GLM-5.2是智谱的旗舰模型,适用于长时程、项目规模的任务。它拥有真正可用的1M-token上下文窗口,能够处理大型工程上下文,在扩展工作流程中保持一致性,并以更高的可靠性执行长时间运行的任务。它专为端到端软件开发而设计,从需求分析、架构规划到实现、测试、调试和多平台部署,非常适合自主代理和复杂的工程工作流程。
kimi-k2.7-code 是 Kimi 迄今为止最智能的编码模型。它能更可靠地在长时间上下文中执行指令,并以更高的成功率完成编程任务。它支持文本、图片和视频输入,以及思考模式、对话和客服任务。
Gemini 3.6 Flash 是 Gemini 3 系列高性能原生多模态推理模型的新增成员。作为主力模型,它在代码生成、知识处理与多模态能力上表现更优异,同时相比 Gemini 3.5 Flash 具备更高的 Token 效率。
Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
Qwen3.7-Max is the flagship model in Alibaba's Qwen3.7 series. It supports text input and output and is designed for agent-centric workloads, with particular strengths in coding, office and productivity tasks,...
Google Gemini 3.1 Flash-Lite,超轻量快速模型。支持文本、图像、视频多模态输入,极低成本。适合对延迟和成本极度敏感的大规模部署场景,支持缓存进一步降本。
GPT-Chat Latest 是 OpenAI 自动追踪更新的通用聊天模型别名,对应当前最新 GPT Instant 版本,拥有 400K 超大上下文、多模态图文输入能力,幻觉更低、工具调用更稳定,适配通用对话、检索增强与轻量智能体开发场景
xAI 新一代智能体旗舰大模型,标配百万级上下文与原生多模态,内置持续推理与工具调用能力,推理、代码、长文档处理综合性能大幅升级,API 调用成本大幅下调,兼顾复杂任务处理与高性价比,适配自动化工作流、图文解析、实时资讯分析等场景。
高效轻量化MoE模型,总参284B,激活13B,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG、批量文案处理等普惠刚需场景。
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。
Qwen3.6-Max-Preview is a proprietary frontier model from Alibaba Cloud built on a sparse mixture-of-experts architecture with approximately 1 trillion total parameters. It is optimized for agentic coding, tool use, and...
OpenAI 2026 主力旗舰,1M 上下文、原生自主智能体,可独立完成编码、研究、数据分析、跨工具办公全流程,速度与前代持平、智能大幅跃升
旗舰级 MoE 大模型,总参1.6T、激活 49B,原生支持百万级超长上下文。依托海量高质量训练数据,具备顶尖数学逻辑、复杂推理、专业代码与长文本深度解析能力,适配高阶科研、复杂办公、深度智能代理等高难度场景。
kimi-k2.6是Kimi最新最智能的模型,具备更强更稳的长程代码编写能力,指令遵循和自我纠错能力显著提升,同时支持文本、图片与视频输入,思考与非思考模式,对话与Agent任务。
GLM-5.1是智谱AI推出的面向长程任务(Long Horizon Task)设计的模型,总参数744B,支持200K超长上下文,最大输出 128K tokens。拥有强大逻辑推理、长文本理解与代码生成能力、兼顾性能与推理效率;在多任务基准中表现优异,适用于智能交互、企业应用、开发辅助等场景。
100 万 token 上下文、64K 输出、文 / 图 / 音 / 视频多模态输入、原生支持智能体与代码执行,是当前 Google 性价比最高的长上下文多模态模型。
Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。
GPT‑5.4 Nano 是 GPT‑5.4 最轻量、最快速的版本,专为对速度和成本要求极高的任务而设计。
GPT-5.4 Mini将GPT-5.4的优势融入到一个更快、更高效的模型中,专为高负载工作量设计。
GPT-5.4 是 OpenAI 2026年3月发布的旗舰推理模型,核心新特性包括:105万 Token 超长上下文窗口(输出支持12.8万 Token)、原生计算机使用能力(自主操作浏览器与软件)、多档推理强度调节(none 到 xhigh)、多模态理解(文本+图像)
GPT-5.4 Pro使用更多计算资源来更深入地思考并提供始终更好的答案。仅可通过响应API访问,以在响应API请求前支持多轮模型交互功能,以及未来其他高级API特性。
GPT-5.3-Codex is OpenAI’s most advanced agentic coding model, combining the frontier software engineering performance of GPT-5.2-Codex with the broader reasoning and professional knowledge capabilities of GPT-5.2. It achieves state-of-the-art results...
Google Gemini 3.1 Pro,最新旗舰推理模型。在 Gemini 3 Pro 基础上全面提升,1M token 上下文窗口,支持文本、图像、视频、音频多模态输入。ARC-AGI-2 得分 77.1%,编码和推理能力大幅增强。
Anthropic Claude 4.6 Sonnet,接近 Opus 级别的能力但成本降低约 40%。支持自适应思考(Adaptive Thinking),1M token 上下文窗口(Beta),在编码、计算机操作、长上下文推理和智能体规划方面全面提升。
MiniMax-M2.5是MiniMax推出的旗舰级开源大模型,经过数十万个真实复杂环境中的大规模强化学习训练,M2.5 在编程、工具调用和搜索、办公等生产力场景都达到或者刷新了行业的 SOTA。
GLM-5是面向Coding与Agent场景的新一代大模型,在复杂系统工程与长程任务中达到开源 SOTA,真实编程体验逼近 Claude Opus 级别;基于 744B 新基座、异步强化学习与稀疏注意力,实现从“写代码”到“写工程”的全面升级。
Opus 4.6 is Anthropic’s strongest model for coding and long-running professional tasks. It is built for agents that operate across entire workflows rather than single prompts, making it especially effective...
Kimi K2.5是2026年1月27日由月之暗面Kimi发布的新一代开源模型。该模型基于原生多模态架构设计,支持视觉与文本输入,集成了视觉理解与推理、编程、智能体等多种能力。
GPT-5.2 Codex 优化版,专为智能体编码工作流设计。支持上下文压缩,在 SWE-Bench Pro (56.4%) 和 Terminal-Bench 2.0 (64.0%) 上达到 SOTA。
GPT-5.2 推理模型,引入响应压缩和 xhigh 推理深度。三层智能系统(Instant/Thinking/Pro)自动优化响应质量和速度,在专业知识工作基准测试中超越行业专家。
GPT-5.1 Codex 增强版,OpenAI 前沿智能体编码模型。原生支持跨多个上下文窗口的压缩操作,可在单个任务中处理数百万 token,适合多小时持续编码会话和大型项目重构。
Anthropic Claude 4.5 Opus,强大推理能力。支持最高 1M token 上下文窗口(特殊模式),擅长处理整个代码库、长文档和多日对话历史。扩展思考模式下可进行深度推理。
GPT-5.1 Codex 轻量版,平衡编码能力与成本效率。适合日常开发辅助、代码补全和快速迭代场景。
GPT-5.1 推理模型,在 GPT-5 基础上提升智能水平和指令遵循能力。更温暖自然的对话风格,简单任务更快响应,复杂任务更持久推理。
GPT-5.1 Codex 优化版,在 GPT-5 Codex 基础上提升代码生成质量和多文件重构能力。支持上下文压缩,适合长时间编码会话。
Anthropic Claude 4.5 Haiku,极速低成本模型。性能接近 Claude Sonnet 4,适合大规模部署、多智能体协作和对延迟敏感的场景。支持视觉理解和函数调用。
GPT-5 专业推理模型,提供最高级别的推理深度和准确性。适合需要极致推理能力的科研、金融分析和复杂决策场景,支持更长的思考时间。
Anthropic Claude 4.5 Sonnet,平衡性能与成本的中端模型。200K 上下文窗口,在编码、分析和智能体推理方面表现出色,支持扩展思考模式。
GPT-5 推理模型,OpenAI 第五代旗舰。统一快速响应与深度思考模式,400K 总上下文(272K 输入 + 128K 输出)。在编码、数学、写作、健康和视觉感知等领域达到 SOTA 水平。
GPT-5 超轻量推理模型,极低成本和延迟。适合简单查询、分类任务和大规模并发调用场景。
GPT-5 轻量推理模型,平衡性能与成本。继承 GPT-5 核心推理能力,适合高吞吐量批处理和对延迟敏感的场景。
GPT-4.1 多模态模型,支持最高 1M token 上下文窗口。在编码、指令遵循和长上下文理解方面大幅提升,支持文本和图像输入,适用于大规模文档处理和复杂代码任务。
GPT-4.1 轻量版,1M token 上下文窗口,在保持强大编码和推理能力的同时大幅降低成本。适合高吞吐量场景和对延迟敏感的应用。
GPT-4.1 超轻量版,1M token 上下文窗口,极低成本和延迟。支持多模态输入,适合分类、自动补全、标签提取等轻量级任务。
O3 增强推理模型,首次支持智能体式工具组合调用。可自主搜索网页、分析文件、深度推理视觉输入并生成图像,在数学竞赛 AIME 中达到 95.2% 准确率。
O4 轻量推理模型,继承 O3 的工具调用和多模态推理能力,成本更低、速度更快。适合日常推理任务和对延迟敏感的应用。
GPT-4o 的低成本精简版,兼顾基础多模态能力与经济性,适合大规模轻量级应用OpenAI。
OpenAI 旗舰多模态模型,支持文本、图像和音频输入输出。128K 上下文窗口,具备出色的指令遵循和多语言能力,适用于复杂对话、内容生成和分析任务。
字节跳动旗舰音视频联合生成模型,支持文本 / 图像 / 音频 / 视频多模态输入,具备原生多镜头叙事与角色一致性,适配专业级视频创作与编辑。
极速版视频生成模型,推理速度提升 10 倍 +,30% 更快生成且不牺牲质量,支持多镜头自动编排与原生音频同步,适配快速内容生产场景。
Seedance 2.0 mini 是面向更广泛视频生成需求推出的新一代高性价比视频生成模型。在保持竞争力效果的同时,将视频生成能力带入更低门槛、更高频、更规模化的应用场景
旗舰音视频联合生成模型,支持文本 / 图像 / 音频 / 视频多模态输入,具备原生多镜头叙事与角色一致性,适配专业级视频创作与编辑。
极速版视频生成模型,推理速度提升 10 倍 +,30% 更快生成且不牺牲质量,支持多镜头自动编排与原生音频同步,适配快速内容生产场景。
Doubao-Seedance-2.0-mini 是豆包大模型团队推出的高性价比视频生成模型,面向更广泛的视频创作与生产需求。相较 Seedance 2.0,2.0 mini 在价格上进一步下探,生成成本降低约 50%,帮助企业客户以更低成本完成调用。2.0 mini 兼顾成本与可用性,适用于电商内容生产、营销素材批量生成、UGC 内容创作、特效玩法生成等高频、规模化的视频生成场景。
谷歌旗舰专业图像生成模型,拥有工作室级精细画面控制、顶尖文字排版与强现实世界认知,4K 高清输出,面向专业设计、高精度可视化与复杂商业创作需求。
谷歌高速高性价比图像生成模型,兼顾 Pro 级画面质量与极速推理,文字渲染精准、支持 4K 输出与检索增强生成,适配大批量、实时图像创作场景。
Gemini 3.1 Flash Lite Image(Nano Banana 2 Lite)模型是图片生成系列中的效率专家,专为超低延迟和经济高效的图片生成和修改而设计。
支持文本、图像及多图参考输入,在文本响应度与画面美感上实现全面升级,提供标准与高品质双模式,适用于多角色交互与复杂场景的视频创作。【积分单价说明:每1积分单价为0.15USD】
支持文本与图像输入,在生成稳定性与创意想象力上全面升级,兼顾高性能与高性价比,适用于大批量视频生成与企业级内容生产。【积分单价说明:每1积分单价为0.15USD】
支持画面与语音、音效、环境音同步生成,运动控制能力增强,适用于有声广告、短视频与多媒体内容创作。【积分单价说明:每1积分单价为0.15USD】
支持智能分镜与15秒长视频生成,最高4K Ultra画质输出,可实现场景切换与连续叙事,适用于企业广告营销与专业影视创作。【积分单价说明:每1积分单价为0.15USD】
Available through the NextModel gateway via OpenAI.
Available through the NextModel gateway via OpenAI.
Qwen-Image-2.0系列加速版模型,实现了图片生成和图片编辑的融合;具备更专业的文字渲染1k token指令支持能力、更细腻的真实质感,细腻刻画写实场景、更强的语义遵循能力。加速版有效实现了模型效果和性能的最佳平衡。
Qwen-Image-2.0系列加速版模型,实现了图片生成和图片编辑的融合;具备更专业的文字渲染1k token指令支持能力、更细腻的真实质感,细腻刻画写实场景、更强的语义遵循能力。加速版有效实现了模型效果和性能的最佳平衡。
Available through the NextModel gateway via Qwen.
Available through the NextModel gateway via Qwen.
万相2.6-文生图,画面质感、美学表现、指令遵循升级,在艺术风格精准控制、真实感人像、长文本生图及广泛历史文化IP覆盖上均表现出卓越能力,可生成高质量且富有表现力的视觉内容。 官方API网址:
万相2.6-文生图,画面质感、美学表现、指令遵循升级,在艺术风格精准控制、真实感人像、长文本生图及广泛历史文化IP覆盖上均表现出卓越能力,可生成高质量且富有表现力的视觉内容。 官方API文档参考:
万相2.7-图生视频,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力。
万相2.7-图生视频,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力。
万相2.7-图像生成与编辑,支持文生图、文生组图、图生组图、图像编辑、多图参考生成、交互式编辑,在文字渲染、主体一致性、复杂指令遵循上都有更强表现。
万相2.7-图像生成与编辑,支持文生图、文生组图、图生组图、图像编辑、多图参考生成、交互式编辑,在文字渲染、主体一致性、复杂指令遵循上都有更强表现。
万相2.7-图像生成与编辑旗舰版模型,支持文生图、文生组图、图生组图、图像编辑、多图参考生成、交互式编辑,在文字渲染、主体一致性、复杂指令遵循上都有更强表现。
万相2.7-图像生成与编辑旗舰版模型,支持文生图、文生组图、图生组图、图像编辑、多图参考生成、交互式编辑,在文字渲染、主体一致性、复杂指令遵循上都有更强表现。
万相2.7-参考生视频,更加稳定的角色、道具与场景参考,支持最大5个图/视频混合参考,支持音频音色参考,搭配基础能力升级实现更强表演能力。
万相2.7-参考生视频,更加稳定的角色、道具与场景参考,支持最大5个图/视频混合参考,支持音频音色参考,搭配基础能力升级实现更强表演能力。
万相2.7-文生视频,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力。
万相2.7-文生视频,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力。
Vidu Q3 Pro 是生数科技推出的高品质视频生成模型,支持文生视频、图生视频和首尾帧视频三种工作流,可生成带同步音频的 1080p 高清视频,最长达 16 秒,具备极致的角色保真度、运动一致性和风格控制能力。【积分单价说明:每1积分单价为0.046USD】
Vidu Q3 Turbo 是 Vidu Q3 系列的快速版 AI 视频生成模型,能将文本提示、静态图像或首尾帧对快速转换为流畅的高清视频并带有同步音频,在保持高质量输出的同时大幅提升生成速度,兼顾效率与成本。【积分单价说明:每1积分单价为0.046USD】
决策表
一屏看完价格、上下文、能力、状态与来源。
适合在进入生产测试、成本估算或提供方策略决策前快速缩小候选范围。
| 模型 | 提供方 | 输入 | 输出 | 上下文 | 能力 | 适用场景 | 延迟 | 状态 | 来源 |
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Astraopenai/gpt-6-astra | OpenAI | Starting at $10 / 1M tokens | $50 / 1M tokens | 1.1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2766-6283ms | 目录 | 平台整理 |
| Qwen3.8-Maxqwen/qwen3.8-max | Qwen | $1.77 / 1M tokens | $5.30 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 1672-5802ms | 目录 | 平台整理 |
| Claude Fable 5.1anthropic/claude-fable-5.1 | Anthropic | $10 / 1M tokens | $50 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 4209-4963ms | 目录 | 平台整理 |
| Qwen3.8-Max-GLBqwen/qwen3.8-max-glb | Qwen | $2 / 1M tokens | $6 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 1957-5865ms | 目录 | 平台整理 |
| FLUX.2 Flexblack-forest-labs/FLUX.2-flex | Black Forest Labs | $0.2 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| FLUX.2 PROblack-forest-labs/FLUX.2-pro | Black Forest Labs | $0.075 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| GPT Image 1openai/gpt-image-1 | OpenAI | $0.26 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| GPT Image 1 Miniopenai/gpt-image-1-mini | OpenAI | $0.0539 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| GPT Image 1.5openai/gpt-image-1.5 | OpenAI | $0.218 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| GPT Image 2.0openai/gpt-image-2 | OpenAI | $0.221 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Text Embedding 3 Smallopenai/text-embedding-3-small | OpenAI | $0.02 / 1M tokens | $0 / 1M tokens | — | 流式输出 | General chat via OpenAI, API workloads | 0-0ms | 目录 | 平台整理 |
| Text Embedding 3 Largeopenai/text-embedding-3-large | OpenAI | $0.13 / 1M tokens | $0 / 1M tokens | — | 流式输出 | General chat via OpenAI, API workloads | 0-0ms | 目录 | 平台整理 |
| GLM 5.3z-ai/glm-5.3 | Z Ai | $1.40 / 1M tokens | $4.40 / 1M tokens | 1M | 流式输出工具调用JSON 模式长上下文 | General chat via Z Ai, API workloads | 5137-7205ms | 目录 | 平台整理 |
| Deepseek-V4-Pro-0813deepseek/deepseek-v4-pro-0813 | DeepSeek | $1.33 / 1M tokens | $3.98 / 1M tokens | 1M | 流式输出工具调用JSON 模式长上下文 | 中文问答, general chat | 2075-14930ms | 目录 | 平台整理 |
| Doubao Seed 2.0 Litedoubao-seed-2-0-lite | Volcengine | Starting at $0.09 / 1M tokens | $0.53 / 1M tokens | 256k | 流式输出 | 中文问答, general chat | 19256-25059ms | 目录 | 平台整理 |
| Doubao Seed 2.0 Prodoubao-seed-2-0-pro | Volcengine | Starting at $0.48 / 1M tokens | $2.36 / 1M tokens | 256k | 流式输出 | 中文问答, general chat | 5387-7239ms | 目录 | 平台整理 |
| Qwen3-VL-Flash CNqwen/qwen3-vl-flash-cn | Qwen | Starting at $0.03 / 1M tokens | $0.22 / 1M tokens | 256k | 流式输出 | General chat via Qwen, API workloads | 835-1062ms | 目录 | 平台整理 |
| Qwen3.5 Flashqwen/qwen3.5-flash | Qwen | Starting at $0.03 / 1M tokens | $0.29 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 1085-1339ms | 目录 | 平台整理 |
| Qwen3.5 Plusqwen/qwen3.5-plus | Qwen | Starting at $0.12 / 1M tokens | $0.69 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 2698-2964ms | 目录 | 平台整理 |
| Qwen3-VL-Plus CNqwen/qwen3-vl-plus-cn | Qwen | Starting at $0.15 / 1M tokens | $1.44 / 1M tokens | 256k | 流式输出 | General chat via Qwen, API workloads | 1076-1257ms | 目录 | 平台整理 |
| Qwen3.6 Flash GLBqwen/qwen3.6-flash-glb | Qwen | Starting at $0.25 / 1M tokens | $1.50 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 3643-4402ms | 目录 | 平台整理 |
| Qwen3-Max CNqwen/qwen3-max-cn | Qwen | Starting at $0.36 / 1M tokens | $1.44 / 1M tokens | 256k | 流式输出 | General chat via Qwen, API workloads | 1152-1427ms | 目录 | 平台整理 |
| Qwen3-VL-Plus GLBqwen/qwen3-vl-plus-2025-12-19-glb | Qwen | Starting at $0.2 / 1M tokens | $1.60 / 1M tokens | 256k | 流式输出 | General chat via Qwen, API workloads | 606-670ms | 目录 | 平台整理 |
| Qwen3.6 Plus GLBqwen/qwen3.6-plus-glb | Qwen | Starting at $0.5 / 1M tokens | $3 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 5518-6156ms | 目录 | 平台整理 |
| Qwen3-Max GLBqwen/qwen3-max-2026-01-23-glb | Qwen | Starting at $1.20 / 1M tokens | $6 / 1M tokens | 256k | 流式输出 | General chat via Qwen, API workloads | 994-1416ms | 目录 | 平台整理 |
| Qwen3.6 Max GLBqwen/qwen3.6-max-preview-glb | Qwen | Starting at $1.30 / 1M tokens | $7.80 / 1M tokens | 256k | 流式输出 | General chat via Qwen, API workloads | 7045-10404ms | 目录 | 平台整理 |
| Gemini 3.7 Flashgoogle/gemini-3.7-flash | $1.50 / 1M tokens | $7.50 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2151-3307ms | 目录 | 平台整理 | |
| GPT-5 Codexopenai/gpt-5-codex | OpenAI | $1.25 / 1M tokens | $10 / 1M tokens | 400k | 流式输出 | General chat via OpenAI, API workloads | 1148-3461ms | 目录 | 平台整理 |
| Doubao Seed 2.0 Codedoubao-seed-2-0-code | Volcengine | Starting at $0.48 / 1M tokens | $2.36 / 1M tokens | 256k | 流式输出 | 中文问答, general chat | 3961-7509ms | 目录 | 平台整理 |
| Doubao Seed 2.0 Minidoubao-seed-2-0-mini | Volcengine | Starting at $0.03 / 1M tokens | $0.3 / 1M tokens | 256k | 流式输出 | 中文问答, general chat | 2624-3200ms | 目录 | 平台整理 |
| Qwen3-VL-Flash GLBqwen/qwen3-vl-flash-glb | Qwen | Starting at $0.05 / 1M tokens | $0.4 / 1M tokens | 256k | 流式输出 | General chat via Qwen, API workloads | 655-2265ms | 目录 | 平台整理 |
| Qwen3.5 Plus GLBqwen/qwen3.5-plus-glb | Qwen | Starting at $0.4 / 1M tokens | $2.40 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 13707-29936ms | 目录 | 平台整理 |
| grok-4-1-fast-non-reasoningx-ai/grok-4.1-fast-non-reasoning | X Ai | $0.2 / 1M tokens | $0.5 / 1M tokens | 2M | 流式输出 | General chat via X Ai, API workloads | 924-2549ms | 目录 | 平台整理 |
| grok-4-1-fast-reasoningx-ai/grok-4.1-fast-reasoning | X Ai | $0.2 / 1M tokens | $0.5 / 1M tokens | 2M | 流式输出 | General chat via X Ai, API workloads | 3378-28567ms | 目录 | 平台整理 |
| grok-4-20-non-reasoningx-ai/grok-4.20-non-reasoning | X Ai | $1.25 / 1M tokens | $2.50 / 1M tokens | 256k | 流式输出 | General chat via X Ai, API workloads | 895-2560ms | 目录 | 平台整理 |
| grok-4-20-reasoningx-ai/grok-4.20-reasoning | X Ai | $1.25 / 1M tokens | $2.50 / 1M tokens | 256k | 流式输出 | General chat via X Ai, API workloads | 1911-2767ms | 目录 | 平台整理 |
| Doubao-Seed-2.1-prodoubao-seed-2-1-pro | Volcengine | $0.89 / 1M tokens | $4.42 / 1M tokens | 256k | 流式输出 | 中文问答, general chat | 10972-20216ms | 目录 | 平台整理 |
| Doubao-Seed-2.1-turbodoubao-seed-2-1-turbo | Volcengine | $0.45 / 1M tokens | $2.21 / 1M tokens | 256k | 流式输出 | 中文问答, general chat | 5930-24588ms | 目录 | 平台整理 |
| Qwen3.5 Flash GLBqwen/qwen3.5-flash-glb | Qwen | $0.1 / 1M tokens | $0.4 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 2790-6899ms | 目录 | 平台整理 |
| Qwen3.7 Max GLBqwen/qwen3.7-max-glb | Qwen | $2.50 / 1M tokens | $7.50 / 1M tokens | 1M | 流式输出 | General chat via Qwen, API workloads | 6550-20357ms | 目录 | 平台整理 |
| Qwen3.7 Flashqwen/qwen3.7-flash | Qwen | Starting at $0.03 / 1M tokens | $0.12 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 340-1274ms | 目录 | 平台整理 |
| DeepSeek-V4-Flash-0731deepseek/deepseek-v4-flash-0731 | DeepSeek | $0.45 / 1M tokens | $1.33 / 1M tokens | 1M | 流式输出工具调用JSON 模式长上下文 | 中文问答, general chat | 2425-5673ms | 目录 | 平台整理 |
| Gemini 3.5 Flash-Litegoogle/gemini-3.5-flash-lite | $0.3 / 1M tokens | $2.50 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 923-1223ms | 目录 | 平台整理 | |
| Gemini 3.8 Flashgoogle/gemini-3.8-flash | $0.75 / 1M tokens | $3.75 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1787-2933ms | 目录 | 平台整理 | |
| Kimi K3moonshotai/kimi-k3 | Moonshotai | $2.95 / 1M tokens | $14.71 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1713-5039ms | 目录 | 平台整理 |
| GPT-5.6 Lunaopenai/gpt-5.6-luna | OpenAI | Starting at $0.2 / 1M tokens | $1.20 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1576-3642ms | 目录 | 平台整理 |
| GPT-5.6 Terraopenai/gpt-5.6-terra | OpenAI | Starting at $2 / 1M tokens | $12 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1733-3303ms | 目录 | 平台整理 |
| GPT-5.6 Solopenai/gpt-5.6-sol | OpenAI | Starting at $5 / 1M tokens | $30 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1569-3206ms | 目录 | 平台整理 |
| GLM-5.2z-ai/glm-5.2 | Z Ai | $1.18 / 1M tokens | $4.12 / 1M tokens | 1M | 流式输出工具调用JSON 模式长上下文 | General chat via Z Ai, API workloads | 1113-3279ms | 目录 | 平台整理 |
| Kimi-K2.7-Codemoonshotai/kimi-k2.7-code | Moonshotai | $0.9 / 1M tokens | $3.72 / 1M tokens | 256k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1020-2160ms | 目录 | 平台整理 |
| Gemini 3.6 Flashgoogle/gemini-3.6-flash | $1.50 / 1M tokens | $7.50 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1324-1756ms | 目录 | 平台整理 | |
| Qwen3.7 Plusqwen/qwen3.7-plus | Qwen | Starting at $0.3 / 1M tokens | $1.18 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1301-1644ms | 目录 | 平台整理 |
| Qwen3.7 Maxqwen/qwen3.7-max | Qwen | $1.65 / 1M tokens | $4.96 / 1M tokens | 1M | 流式输出工具调用JSON 模式长上下文 | General chat via Qwen, API workloads | 656-1125ms | 目录 | 平台整理 |
| Gemini 3.1 Flash-Litegoogle/gemini-3.1-flash-lite | $0.25 / 1M tokens | $1.50 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 996-1871ms | 目录 | 平台整理 | |
| GPT-Chat Latestopenai/gpt-chat-latest | OpenAI | $5 / 1M tokens | $30 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2084-2804ms | 目录 | 平台整理 |
| Grok 4.3x-ai/grok-4.3 | X Ai | $1.25 / 1M tokens | $2.50 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2516-4471ms | 目录 | 平台整理 |
| DeepSeek-V4-Flashdeepseek/deepseek-v4-flash | DeepSeek | $0.14 / 1M tokens | $0.28 / 1M tokens | 1M | 流式输出工具调用JSON 模式长上下文 | 中文问答, general chat | 10764-44383ms | 目录 | 平台整理 |
| Qwen3.6 Flashqwen/qwen3.6-flash | Qwen | Starting at $0.17 / 1M tokens | $0.99 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 553-917ms | 目录 | 平台整理 |
| Qwen3.6 Maxqwen/qwen3.6-max-preview | Qwen | Starting at $1.24 / 1M tokens | $7.43 / 1M tokens | 256k | 流式输出工具调用JSON 模式长上下文 | General chat via Qwen, API workloads | 7694-12970ms | 目录 | 平台整理 |
| GPT-5.5openai/gpt-5.5 | OpenAI | Starting at $5 / 1M tokens | $30 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1617-2991ms | 目录 | 平台整理 |
| DeepSeek-V4-Prodeepseek/deepseek-v4-pro | DeepSeek | $1.65 / 1M tokens | $3.31 / 1M tokens | 1M | 流式输出工具调用JSON 模式长上下文 | 中文问答, general chat | 1663-2547ms | 目录 | 平台整理 |
| Kimi-K2.6moonshotai/kimi-k2.6 | Moonshotai | $0.9 / 1M tokens | $3.72 / 1M tokens | 256k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1142-3060ms | 目录 | 平台整理 |
| GLM-5.1z-ai/glm-5.1 | Z Ai | Starting at $0.83 / 1M tokens | $3.31 / 1M tokens | 202k | 流式输出工具调用JSON 模式长上下文 | General chat via Z Ai, API workloads | 1555-11058ms | 目录 | 平台整理 |
| Gemini 3.5 Flashgoogle/gemini-3.5-flash | $1.50 / 1M tokens | $9 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1316-1653ms | 目录 | 平台整理 | |
| Qwen3.6 Plusqwen/qwen3.6-plus | Qwen | Starting at $0.28 / 1M tokens | $1.66 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1188-17203ms | 目录 | 平台整理 |
| GPT-5.4 Nanoopenai/gpt-5.4-nano | OpenAI | $0.2 / 1M tokens | $1.25 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1778-2643ms | 目录 | 平台整理 |
| GPT-5.4 Miniopenai/gpt-5.4-mini | OpenAI | $0.75 / 1M tokens | $4.50 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1344-2863ms | 目录 | 平台整理 |
| GPT-5.4openai/gpt-5.4 | OpenAI | Starting at $2.50 / 1M tokens | $15 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1538-2565ms | 目录 | 平台整理 |
| GPT-5.4 Proopenai/gpt-5.4-pro | OpenAI | Starting at $30 / 1M tokens | $180 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 7112-13899ms | 目录 | 平台整理 |
| GPT-5.3 Codexopenai/gpt-5.3-codex | OpenAI | $1.75 / 1M tokens | $14 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1976-3122ms | 目录 | 平台整理 |
| Gemini 3.1 Pro Previewgoogle/gemini-3.1-pro-preview | Starting at $2 / 1M tokens | $12 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2257-2837ms | 目录 | 平台整理 | |
| Claude Sonnet 4.6anthropic/claude-sonnet-4.6 | Anthropic | $3 / 1M tokens | $15 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1724-3148ms | 目录 | 平台整理 |
| MiniMax M2.5minimax/minimax-m2.5 | MiniMax | $0.31 / 1M tokens | $1.22 / 1M tokens | 200k | 流式输出工具调用JSON 模式长上下文 | 中文问答, general chat | 1087-1303ms | 目录 | 平台整理 |
| GLM-5z-ai/glm-5 | Z Ai | Starting at $0.58 / 1M tokens | $2.58 / 1M tokens | 198k | 流式输出工具调用JSON 模式长上下文 | General chat via Z Ai, API workloads | 2313-11193ms | 目录 | 平台整理 |
| Claude Opus 4.6anthropic/claude-opus-4.6 | Anthropic | $5 / 1M tokens | $25 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2396-4594ms | 目录 | 平台整理 |
| Kimi-K2.5moonshotai/kimi-k2.5 | Moonshotai | $0.58 / 1M tokens | $3.02 / 1M tokens | 256k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2651-8699ms | 目录 | 平台整理 |
| GPT-5.2 Codexopenai/gpt-5.2-codex | OpenAI | $1.75 / 1M tokens | $14 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2006-2655ms | 目录 | 平台整理 |
| GPT-5.2openai/gpt-5.2 | OpenAI | $1.75 / 1M tokens | $14 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1994-2665ms | 目录 | 平台整理 |
| GPT-5.1 Codex Maxopenai/gpt-5.1-codex-max | OpenAI | $1.25 / 1M tokens | $10 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2019-4593ms | 目录 | 平台整理 |
| Claude Opus 4.5anthropic/claude-opus-4.5 | Anthropic | $5 / 1M tokens | $25 / 1M tokens | 200k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2145-4380ms | 目录 | 平台整理 |
| GPT-5.1 Codex Miniopenai/gpt-5.1-codex-mini | OpenAI | $0.25 / 1M tokens | $2 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1327-2489ms | 目录 | 平台整理 |
| GPT-5.1openai/gpt-5.1 | OpenAI | $1.25 / 1M tokens | $10 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1812-2570ms | 目录 | 平台整理 |
| GPT-5.1 Codexopenai/gpt-5.1-codex | OpenAI | $1.25 / 1M tokens | $10 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1872-5243ms | 目录 | 平台整理 |
| Claude Haiku 4.5anthropic/claude-haiku-4.5 | Anthropic | $1 / 1M tokens | $5 / 1M tokens | 200k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1606-3345ms | 目录 | 平台整理 |
| GPT-5 Proopenai/gpt-5-pro | OpenAI | $15 / 1M tokens | $120 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 15404-19787ms | 目录 | 平台整理 |
| Claude Sonnet 4.5anthropic/claude-sonnet-4.5 | Anthropic | $3 / 1M tokens | $15 / 1M tokens | 200k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2192-2546ms | 目录 | 平台整理 |
| GPT-5openai/gpt-5 | OpenAI | $1.25 / 1M tokens | $10 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2676-3919ms | 目录 | 平台整理 |
| GPT-5 Nanoopenai/gpt-5-nano | OpenAI | $0.05 / 1M tokens | $0.4 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1998-2871ms | 目录 | 平台整理 |
| GPT-5 Miniopenai/gpt-5-mini | OpenAI | $0.25 / 1M tokens | $2 / 1M tokens | 400k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2329-4415ms | 目录 | 平台整理 |
| GPT-4.1openai/gpt-4.1 | OpenAI | $2 / 1M tokens | $8 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 2520-9317ms | 目录 | 平台整理 |
| GPT-4.1 Miniopenai/gpt-4.1-mini | OpenAI | $0.4 / 1M tokens | $1.60 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1448-2937ms | 目录 | 平台整理 |
| GPT-4.1 Nanoopenai/gpt-4.1-nano | OpenAI | $0.1 / 1M tokens | $0.4 / 1M tokens | 1M | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 964-18349ms | 目录 | 平台整理 |
| O3openai/o3 | OpenAI | $2 / 1M tokens | $8 / 1M tokens | 200k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1540-3575ms | 目录 | 平台整理 |
| O4 Miniopenai/o4-mini | OpenAI | $1.10 / 1M tokens | $4.40 / 1M tokens | 200k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 955-2953ms | 目录 | 平台整理 |
| GPT-4o-miniopenai/gpt-4o-mini | OpenAI | $0.15 / 1M tokens | $0.6 / 1M tokens | 128k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 934-2264ms | 目录 | 平台整理 |
| GPT-4oopenai/gpt-4o | OpenAI | $2.50 / 1M tokens | $10 / 1M tokens | 128k | 流式输出工具调用JSON 模式视觉 | 图像理解, multimodal chat | 1772-2933ms | 目录 | 平台整理 |
| Doubao Seedance 2.0doubao/doubao-seedance-2-0-260128 | Doubao | $0.148 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Doubao Seedance 2.0 Fastdoubao/doubao-seedance-2-0-fast-260128 | Doubao | $0.119 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Doubao Seedance 2.0 minidoubao/doubao-seedance-2-0-mini-260615 | Doubao | $0.0738 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Dreamina-Seedance 2.0dreamina/dreamina-seedance-2-0-260128 | Dreamina | $0.153 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Dreamina-Seedance 2.0 Fastdreamina/dreamina-seedance-2-0-fast-260128 | Dreamina | $0.122 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Dreamina-Seedance 2.0 minidreamina/dreamina-seedance-2-0-mini-260615 | Dreamina | $0.0764 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Gemini 3 Pro Image (Nano Banana Pro) gemini/gemini-3-pro-image | Gemini | $0.314 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Gemini 3.1 Flash Image (Nano Banana 2)gemini/gemini-3.1-flash-image | Gemini | $0.151 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Gemini 3.1 Flash Lite Image(Nano Banana 2 Lite)gemini/gemini-3.1-flash-lite-image | Gemini | $0.0336 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Kling V1.6 CNkling/kling-v1-6-cn | Kling | $0.525 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Kling V2.5 Turbo CNkling/kling-v2-5-turbo-cn | Kling | $0.075 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Kling V2.6 CNkling/kling-v2-6-cn | Kling | $0.18 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Kling V3 CNkling/kling-v3-cn | Kling | $0.45 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| TTS 1openai/tts-1 | OpenAI | $0.15 / 10k chars | — | — | General chat via OpenAI, API workloads | 0-0ms | 目录 | 平台整理 | |
| TTS 1 HDopenai/tts-1-hd | OpenAI | $0.3 / 10k chars | — | — | General chat via OpenAI, API workloads | 0-0ms | 目录 | 平台整理 | |
| Qwen-Image-2.0 CNqwen/qwen-image-2.0-cn | Qwen | $0.0287 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Qwen-Image-2.0 GLBqwen/qwen-image-2.0-glb | Qwen | $0.035 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Qwen-Image-2.0-Pro CNqwen/qwen-image-2.0-pro-cn | Qwen | $0.0717 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Qwen-Image-2.0-Pro GLBqwen/qwen-image-2.0-pro-glb | Qwen | $0.075 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.6-T2I-CNqwen/wan2.6-t2i-cn | Qwen | $0.0287 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.6-T2I-GLBqwen/wan2.6-t2i-glb | Qwen | $0.03 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7-I2V-CNqwen/wan2.7-i2v-cn | Qwen | $0.138 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7-I2V-GLBqwen/wan2.7-i2v-glb | Qwen | $0.15 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7 Image CNqwen/wan2.7-image-cn | Qwen | $0.0275 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7 Image GLBqwen/wan2.7-image-glb | Qwen | $0.03 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7 Image Pro CNqwen/wan2.7-image-pro-cn | Qwen | $0.0688 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7 Image Pro GLBqwen/wan2.7-image-pro-glb | Qwen | $0.075 / image | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7-R2V-CNqwen/wan2.7-r2v-cn | Qwen | $0.138 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7-R2V-GLBqwen/wan2.7-r2v-glb | Qwen | $0.15 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7-T2V-CNqwen/wan2.7-t2v-cn | Qwen | $0.138 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Wan2.7-T2V-GLBqwen/wan2.7-t2v-glb | Qwen | $0.15 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Vidu-Q3-pro-CNvidu/viduq3-pro-cn | Vidu | $0.11 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |
| Vidu-Q3-turbo-CNvidu/viduq3-turbo-cn | Vidu | $0.0598 / s | — | — | 流式输出视觉 | 图像理解, multimodal chat | 0-0ms | 目录 | 平台整理 |