对话与推理模型 — 一把 Key,35 个模型

Claude、GPT、Gemini、DeepSeek、Kimi、GLM、Qwen、Grok 走同一个 OpenAI 兼容接口。先并排比价,再改一个字符串就能换模型。

Crazyrouter 是一个 AI API 网关,用一把 OpenAI 兼容的 Key 提供 35 个对话与推理模型,按 token 计费最低 $0.055,并在厂商支持时提供 Anthropic、Gemini、Responses 原生端点。

35
个模型
$0.055
起 / 1M 输入 token
45%
最高低于官方价
输入价格 / 1M token(官方 vs Crazyrouter),便宜的在前
官方价CrazyrouterGemini 2.5 Flash-Lite$0.100 → $0.055GPT-4o mini$0.150 → $0.098Gemini 3 Flash$0.500 → $0.165Gemini 2.5 Flash$0.300 → $0.165DeepSeek V4 Flash$0.300 → $0.230GPT-4.1 mini$0.400 → $0.260MiniMax M3$0.300 → $0.300MiMo V2.6 Pro$0.435 → $0.435GPT-5.4 mini$0.750 → $0.488Kimi K2.5$0.600 → $0.600Claude Haiku 4.5$1.00 → $0.650DeepSeek V4 Pro$1.32 → $0.670

还有 23 个模型见下表

模型实际用起来是什么样

全部对话与推理模型(按价格)

模型厂商Crazyrouter 价格 (每 1M token(输入 / 输出))官方价上下文折扣
Gemini 2.5 Flash-Lite
gemini-2.5-flash-lite
Google$0.055 / $0.22 / 1M token$0.10 / $0.401M tokens−45%试一下 · 比价
GPT-4o mini
gpt-4o-mini
OpenAI$0.0975 / $0.39 / 1M token$0.15 / $0.60128K tokens−35%试一下 · 比价
Gemini 3 Flash
gemini-3-flash
Google$0.165 / $1.32 / 1M token$0.50 / $3.001M tokens−45%试一下 · 比价
Gemini 2.5 Flash
gemini-2.5-flash
Google$0.165 / $1.38 / 1M token$0.30 / $2.501M tokens−45%试一下 · 比价
DeepSeek V4 Flash
deepseek-v4-flash
DeepSeek$0.23 / $0.67 / 1M token$0.30 / $1.201M tokens—试一下 · 比价
GPT-4.1 mini
gpt-4.1-mini
OpenAI$0.26 / $1.04 / 1M token$0.40 / $1.601M tokens−35%试一下 · 比价
MiniMax M3
MiniMax-M3
MiniMax$0.30 / $1.20 / 1M token$0.30 / $1.201M tokens—试一下 · 比价
MiMo V2.6 Pro
mimo-v2.6-pro
Xiaomi$0.435 / $0.87 / 1M token$0.435 / $0.871M tokens—试一下 · 比价
GPT-5.4 mini
gpt-5.4-mini
OpenAI$0.488 / $2.93 / 1M token$0.75 / $4.50272K tokens−35%试一下 · 比价
Kimi K2.5
kimi-k2.5
Moonshot AI$0.60 / $3.15 / 1M token$0.60 / $3.00262K tokens—试一下 · 比价
Claude Haiku 4.5
claude-haiku-4-5
Anthropic$0.65 / $3.25 / 1M token$1.00 / $5.00200K tokens−35%试一下 · 比价
DeepSeek V4 Pro
deepseek-v4-pro
DeepSeek$0.67 / $2.00 / 1M token$1.32 / $3.961M tokens—试一下 · 比价
Gemini 2.5 Pro
gemini-2.5-pro
Google$0.688 / $5.50 / 1M token$1.25 / $10.001M tokens−45%试一下 · 比价
Gemini 3.8 Flash
gemini-3.8-flash
Google$0.75 / $3.75 / 1M token$0.75 / $3.751M tokens—试一下 · 比价
GPT-5
gpt-5
OpenAI$0.813 / $6.50 / 1M token$1.25 / $10.00272K tokens−35%试一下 · 比价
GPT-5 Codex
gpt-5-codex
OpenAI$0.813 / $6.50 / 1M token$1.25 / $10.00272K tokens−35%试一下 · 比价
GLM-5
glm-5
Zhipu AI$1.00 / $3.20 / 1M token$1.00 / $3.20200K tokens—试一下 · 比价
Gemini 3.1 Pro
gemini-3.1-pro
Google$1.10 / $6.60 / 1M token$2.00 / $12.001M tokens−45%试一下 · 比价
GPT-5.3 Codex
gpt-5.3-codex
OpenAI$1.14 / $9.10 / 1M token$1.75 / $14.00272K tokens−35%试一下 · 比价
Claude Sonnet 5
claude-sonnet-5
Anthropic$1.30 / $6.50 / 1M token$2.00 / $10.001M tokens−35%试一下 · 比价
GPT-4.1
gpt-4.1
OpenAI$1.30 / $5.20 / 1M token$2.00 / $8.001M tokens−35%试一下 · 比价
GPT-5.4
gpt-5.4
OpenAI$1.63 / $9.75 / 1M token$2.50 / $15.001M tokens−35%试一下 · 比价
GPT-4o
gpt-4o
OpenAI$1.63 / $6.50 / 1M token$2.50 / $10.00128K tokens−35%试一下 · 比价
Grok 4.6
grok-4.6
xAI$1.70 / $5.10 / 1M token$2.00 / $6.00500K tokens−15%试一下 · 比价
Claude Sonnet 4.6
claude-sonnet-4-6
Anthropic$1.95 / $9.75 / 1M token$3.00 / $15.00200K tokens−35%试一下 · 比价
OpenAI o3
o3
OpenAI$2.00 / $8.00 / 1M token$2.00 / $8.00200K tokens—试一下 · 比价
Qwen3.8 Max
qwen3.8-max
Alibaba Cloud$2.00 / $6.00 / 1M token$2.00 / $6.00992K tokens—试一下 · 比价
Kimi K3
kimi-k3
Moonshot AI$3.00 / $15.00 / 1M token$3.00 / $15.001M tokens—试一下 · 比价
Claude Opus 5
claude-opus-5
Anthropic$3.25 / $16.25 / 1M token$5.00 / $25.001M tokens−35%试一下 · 比价
Claude Opus 4.8
claude-opus-4-8
Anthropic$3.25 / $16.25 / 1M token$5.00 / $25.00200K tokens−35%试一下 · 比价
Claude Opus 4.7
claude-opus-4-7
Anthropic$3.25 / $16.25 / 1M token$5.00 / $25.00200K tokens−35%试一下 · 比价
GPT-5.5
gpt-5.5
OpenAI$3.25 / $19.50 / 1M token$5.00 / $30.001M tokens−35%试一下 · 比价
GPT-5.6 Sol
gpt-5.6-sol
OpenAI$3.25 / $19.50 / 1M token$4.00 / $20.00922K tokens−35%试一下 · 比价
GPT-6 Astra
gpt-6-astra
OpenAI$3.25 / $16.25 / 1M token$10.00 / $50.00922K tokens−35%试一下 · 比价
Claude Fable 5
claude-fable-5
Anthropic$6.50 / $32.50 / 1M token$10.00 / $50.001M tokens−35%试一下 · 比价

价格来自实时计费表,已含 Crazyrouter 折扣;官方价为各厂商公开定价,仅作对照。

什么是对话与推理 API

大模型 API 根据提示词返回文本(以及工具调用和结构化输出)。各模型在推理深度、上下文、速度和价格上差异很大;用网关可以按请求挑模型,而不用分别对接四家厂商。

怎么选

复杂推理与编程

Claude Opus 5 / Opus 4.8、GPT-6 Astra、GPT-5.5、Gemini 3.1 Pro。输出单价最高,只用在质量决定结果的任务上。

日常助手

Claude Sonnet 5 / 4.6、GPT-5.6 Sol、Gemini 3 Flash、DeepSeek V4 Flash、Kimi K3。摘要、起草、抽取的性价比最优。

高并发低成本

Claude Haiku 4.5、GPT-5.4 mini、Gemini 2.5 Flash-Lite、GLM-5。每次请求不到一分钱,配合缓存更省。

长上下文

Gemini 3.1 Pro 与 GPT-4.1(1M token)、Claude(200K)。整仓库喂进去之前先看上下文列。

所有模型同一个请求结构

把 model 换成表格里任意一个即可;示例用 gemini-2.5-flash-lite。

cURL
curl https://api.crazyrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $CRAZYROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gemini-2.5-flash-lite","messages":[{"role":"user","content":"Summarize this PR in three bullets."}]}'

FAQ

对话模型的 base URL 填什么?

OpenAI 兼容的 chat completions 用 https://api.crazyrouter.com/v1;Claude 模型也支持 /v1/messages,Gemini 模型支持 /v1beta。

价格和官方一样吗?

不一样——表里是 Crazyrouter 价格,已含相对各厂商定价的折扣;官方价放在旁边做对照。

流式、工具调用、JSON 模式能用吗?

能,行为与上游模型文档一致。传 stream: true 即为 SSE 流式。

付费前能试吗?

每个模型页都有 Try-it 输入框,新账号送 $2 Playground 额度;API 本身按量付费。

Crazyrouter 上最便宜的对话模型是哪个?

按最近一次价格同步,Gemini 2.5 Flash-Lite 每 1M 输入 token $0.055;输出价见表格。