按用途选型
代码和日常对话先看 GPT、Claude;超长上下文看 Gemini;低成本推理可比较 DeepSeek、Kimi 和 MiniMax。
代码和日常对话先看 GPT、Claude;超长上下文看 Gemini;低成本推理可比较 DeepSeek、Kimi 和 MiniMax。
表格使用 USD / 1M token,按配置中的 input_cost_per_token 和 output_cost_per_token 换算,仅用于横向比较。
视觉、工具调用、推理和 Responses 支持可能受分组限制。用短请求测试,再在用量记录核对结果。
价格为输入 / 输出参考值;“是”表示模型配置包含该能力字段,不代表你的 API Key 当前分组一定开放。
| 模型 ID | 模型家族 | 上下文 | 输入 USD / 1M | 输出 USD / 1M | 视觉 | 工具 | 推理 |
|---|---|---|---|---|---|---|---|
gpt-5 | OpenAI | 272k | 1.25 | 10.00 | 是 | 是 | 是 |
gpt-4.1 | OpenAI | 1.05M | 2.00 | 8.00 | 是 | 是 | 否 |
gpt-4o | OpenAI | 128k | 2.50 | 10.00 | 是 | 是 | 否 |
gpt-4o-mini | OpenAI | 128k | 0.15 | 0.60 | 是 | 是 | 否 |
claude-sonnet-4-5 | Anthropic | 200k | 3.00 | 15.00 | 是 | 是 | 是 |
claude-opus-4-1 | Anthropic | 200k | 15.00 | 75.00 | 是 | 是 | 是 |
gemini-2.5-pro | Google Gemini | 1.05M | 1.25 | 10.00 | 是 | 是 | 是 |
gemini-2.5-flash | Google Gemini | 1.05M | 0.30 | 2.50 | 是 | 是 | 是 |
deepseek-chat | DeepSeek | 131k | 0.28 | 0.42 | 否 | 是 | 否 |
deepseek-reasoner | DeepSeek | 131k | 0.28 | 0.42 | 否 | 否 | 是 |
deepseek-v4-pro | DeepSeek | 1M | 1.32 | 3.96 | 否 | 是 | 是 |
grok-4.5 | xAI Grok | 500k | 2.00 | 6.00 | 是 | 是 | 是 |
kimi-k2.5 | Kimi | 131k | 0.60 | 2.25 | 否 | 是 | 是 |
minimax-m2.7 | MiniMax | 131k | 0.30 | 1.20 | 否 | 是 | 是 |
gemini-3.1-pro | Google Gemini | 1.05M | 2.00 | 12.00 | 是 | 是 | 是 |
快照来自 2026-09-26 的服务器模型配置。页面不承诺每个模型均已加入你的分组,也不把参考价当作订单报价。
多数 Chat Completions 客户端只需替换 Base URL、API Key 和模型 ID:
from openai import OpenAI
client = OpenAI(api_key="你的 API Key", base_url="https://shushutoken.com/v1")
response = client.chat.completions.create(
model="控制台中的模型 ID",
messages=[{"role": "user", "content": "连接测试"}],
)页面价格是服务器配置换算的 USD / 1M token 参考值。最终分组倍率、缓存、套餐和扣费以控制台和使用记录为准。
模型目录是全站参考数据,API Key 只能调用所属分组允许的模型。检查模型 ID、分组权限、余额和限流状态。
常见 Chat Completions 请求可以复用 OpenAI SDK,使用 https://shushutoken.com/v1,再按文档验证特殊字段。
Responses 请求属于独立协议路径和能力边界,先查看接入教程,并用当前分组允许的模型做小额测试。