Qwen modelo

Qwen3 VL Flash GLB

Qwen3 VL Flash GLB Compare precos de API, fornecedor, comprimento de contexto, capacidades, casos de uso, latencia e alternativas. General chat via Qwen, API workloads. $0.0072 / 1M tokens / $0.058 / 1M tokens. — tokens.

QwenPlatform curatedCatalog
Streaming
Preco de entrada$0.0072 / 1M tokens
Preco de saida$0.058 / 1M tokens
Comprimento de contexto— tokens
Saida maxima8.2k tokens
Input lengthInput / 1MOutput / 1MCache hit / 1M
— - 32k$0.0072$0.058$0.0014
32k - 128k$0.012$0.087$0.0029
128k - 256k$0.017$0.139$0.0043

O que e Qwen3 VL Flash GLB no NextModel?

Qwen3 VL Flash GLB Compare precos de API, fornecedor, comprimento de contexto, capacidades, casos de uso, latencia e alternativas. General chat via Qwen, API workloads. $0.0072 / 1M tokens / $0.058 / 1M tokens. — tokens.

Melhores casos de uso

  • General chat via Qwen
  • API workloads

Exemplo compativel com OpenAI

Mantenha o estilo do SDK OpenAI, aponte base_url para NextModel e use o ID do catalogo qwen--qwen3-vl-flash-glb.

Python
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.nextmodel.app/v1"
)

resp = client.chat.completions.create(
    model="qwen/qwen3-vl-flash-glb",
    messages=[{"role": "user", "content": "Hello from NextModel"}]
)

print(resp.choices[0].message.content)

Alternativas semelhantes

QwenCatalog

Available through the NextModel gateway via Qwen.

Starting at $0.174 / 1M tokensInputStarting at $0.868 / 1M tokensOutputContext
Best forGeneral chat via Qwen, API workloads
RoutingConfigured
Streaming
Platform curatedNextModel gateway catalog (Go origin)
View details
QwenCatalog

Available through the NextModel gateway via Qwen.

Starting at $0.052 / 1M tokensInputStarting at $0.208 / 1M tokensOutputContext
Best forGeneral chat via Qwen, API workloads
RoutingConfigured
Streaming
Platform curatedNextModel gateway catalog (Go origin)
View details
QwenCatalog

Available through the NextModel gateway via Qwen.

Starting at $0.0043 / 1M tokensInputStarting at $0.032 / 1M tokensOutputContext
Best forGeneral chat via Qwen, API workloads
RoutingConfigured
Streaming
Platform curatedNextModel gateway catalog (Go origin)
View details

FAQ

Qwen3 VL Flash GLB FAQ