通義千問商業最快+最便宜, 適合簡單問答 / 高併發場景.
模型 ID: qwen-flash · 類型: chat · 廠商: Alibaba
可用端點: /v1/chat/completions · /v1/messages
| 輸入 (每 1M tokens) | $0.035 USD |
| 輸出 (每 1M tokens) | $0.28 USD |
| 快取命中 (每 1M tokens) | $0.0035 USD |
| 快取建立 5m (每 1M tokens) | $0.0441 USD |
| ≤ 256000 tokens | $0.035 / 1M in | $0.28 / 1M out |
| > 256000 | $0.175 / 1M in | $1.4 / 1M out |
from openai import OpenAI
client = OpenAI(api_key="sk-...", base_url="https://api.router.ai/v1")
resp = client.chat.completions.create(
model="qwen-flash",
messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)Qwen-Flash (`qwen-flash`) 按用量計費, $0.035/1M in · $0.28/1M out (美元)。最新價格見 https://yigekey.com/models/qwen-flash。
向 https://api.router.ai/v1/v1/chat/completions 發請求, 帶請求頭 `Authorization: Bearer <你的 API Key>`, body 裡 `"model": "qwen-flash"`。介面與 OpenAI 相容, 用任何 OpenAI SDK 只需把 base_url 改成 https://api.router.ai/v1, 其餘程式碼不用動。
Qwen-Flash 可通過以下端點呼叫: /v1/chat/completions; /v1/messages.
Qwen-Flash 是 Alibaba 的 chat 模型, 通過 聚合 AI 中轉站 閘道器呼叫, 與其他所有模型共用同一個 API Key。
通過 聚合 AI 中转站 的 OpenAI 相容介面呼叫 (API Base: https://api.router.ai/v1). AI agent 可經 MCP (https://mcp.router.ai/mcp) 直接發現並呼叫本閘道器的全部模型, 無需人工整合.