Блог Crazyrouter

Практические заметки об ИИ-моделях, стоимости API и рабочих процессах в продакшене.

Обновления моделей, руководства по интеграции, разбор цен и рабочие процессы с инструментами для разработчиков и команд.

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"
18 июля 2026 г.366 просмотровРусскийComparison

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"

"В рамках одного OpenAI-compatible API и одного и того же промпта проведено сравнение kimi-k3 и gpt-5.6-sol на задачах по времени остановки режима, задаче по физике с моментом инерции на шкиве и задаче по программированию с зависимыми замыканиями; зафиксированы ко

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API
17 июля 2026 г.357 просмотровРусскийComparison

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API

Практический API-тест Kimi K3 и Claude Fable 5 на математике, физике, исполняемом Python и логических ограничениях с анализом finish_reason и reasoning tokens.

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?
13 июля 2026 г.326 просмотровРусскийComparison

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?

Реальный тест Crazyrouter OpenAI-compatible API: сравнение gpt-5.6-sol и gpt-5.6-terra в четырех задачах по точности, задержке, токенам, локальным тестам Python и расчетной стоимости запросов.

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена
7 июля 2026 г.372 просмотровРусскийTutorial

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена

Практическое руководство по использованию gemini-2.5-flash и gemini-2.5-flash-lite для высоконагруженных, высокочастотных и чувствительных к цене AI-приложений через Crazyrouter.

GLM-5.2 против Claude Fable 5: лимит вывода, reasoning_tokens и коэффициент discount 0.8
6 июля 2026 г.319 просмотровРусскийComparison

GLM-5.2 против Claude Fable 5: лимит вывода, reasoning_tokens и коэффициент discount 0.8

Практический тест через OpenAI-compatible API Crazyrouter: glm-5.2 и claude-fable-5 на математике, физике и длинной Canvas-анимации, с учетом текущего discount 0.8 для glm-5.2.

Тест 6 Vision API моделей: Gemini 2.5, GPT-4.1 и Qwen3 VL для понимания изображений
22 июня 2026 г.467 просмотровРусскийComparison

Тест 6 Vision API моделей: Gemini 2.5, GPT-4.1 и Qwen3 VL для понимания изображений

Практический benchmark шести моделей для image understanding API: Gemini 2.5 Flash, Gemini 2.5 Flash Lite, GPT-4.1 Mini, GPT-4.1 Nano, Qwen3 VL Flash и Qwen3 VL Plus. Сравниваем accuracy, latency, стоимость успешного изображения, usage signals, failure modes и production routing.

Qwen3 VL Flash vs Qwen3 VL Plus: бенчмарк Vision API 2026 для практического выбора модели
22 июня 2026 г.389 просмотровРусскийComparison

Qwen3 VL Flash vs Qwen3 VL Plus: бенчмарк Vision API 2026 для практического выбора модели

Практический benchmark для сравнения qwen3-vl-flash и qwen3-vl-plus в задачах Vision API: реальная точность распознавания, latency, tail latency, стоимость успешного изображения, usage signals, failure modes и routing recommendations.

Qwen3 VL Flash vs GPT-4.1 Nano: бенчмарк Vision API 2026 для практического выбора модели
22 июня 2026 г.384 просмотровРусскийComparison

Qwen3 VL Flash vs GPT-4.1 Nano: бенчмарк Vision API 2026 для практического выбора модели

Практический benchmark для сравнения qwen3-vl-flash и gpt-4.1-nano в задачах Vision API: реальная точность распознавания, latency, tail latency, стоимость успешного изображения, usage signals, failure modes и routing recommendations.