qwen3-vl-32b-thinking
qwen3-vl-32b-thinking (qwen3-vl-32b-thinking) — 128K context, Reasoning tier. 入力単価: $0.3/M · 出力単価: $3/M · 平均レイテンシ 48ms. Routed via Routara OpenAI-compatible endpoint with multi-region failover and metered billing.
入力単価: $0.3/M · 出力単価: $3/M · 初回トークン遅延: 48ms
Specifications
- 開発元: qwen3-vl-32b-thinking
- カテゴリ: Reasoning
- コンテキスト: 128K
- 入力単価: $0.3 / 1M
- 出力単価: $3 / 1M
- 平均レイテンシ: 48 ms
- SLA: S+
Typical use cases
- 画像・動画生成
- 多言語チャットボット
- RAG とツール呼び出し
FAQ
- qwen3-vl-32b-thinking の Routara 料金は? — 入力 $0.3/M、出力 $3/M。リクエストごとに課金、プラットフォーム手数料なし。
- qwen3-vl-32b-thinking は OpenAI 互換? — はい。base_url を https://api.routara.ai/v1 に設定してください。
- qwen3-vl-32b-thinking はストリーミング対応? — ルートが live のとき stream: true で利用可能です。
Related models
- audio1.0 (/detail/audio1-0)
- sao10k/l3-8b-lunaris (/detail/sao10k-l3-8b-lunaris)
- Sao10K/L3-8B-Stheno-v3.2 (/detail/sao10k-l3-8b-stheno-v3-2)
Quick integration
- curl https://api.routara.ai/v1/chat/completions \ -H "Authorization: Bearer YOUR_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"qwen3-vl-32b-thinking","messages":[{"role":"user","content":"Hello"}],"stream":true}'