Login
Crazyrouter Blog

Practical notes on AI models, API costs, and production workflows.

Model updates, integration guides, pricing breakdowns, and tool workflows for developers and teams.

Claude Opus 5 против GPT-5.6 Luna: 18 проверяемых задач без рейтинга скорости
Featured article

Claude Opus 5 против GPT-5.6 Luna: 18 проверяемых задач без рейтинга скорости

Сравнение Claude Opus 5 и GPT-5.6 Luna с приоритетом проверяемой точности: математика, физика, алгоритмы, ложные предпосылки, ограничения и инструкции.

July 30, 20269 viewsРусскийComparison
Claude Opus 5 и GPT-5.6-SOL: проверка точности — обе модели дали 10 из 10 правильных основных ответов
July 29, 202611 viewsРусскийComparison

Claude Opus 5 и GPT-5.6-SOL: проверка точности — обе модели дали 10 из 10 правильных основных ответов

Claude Opus 5 и GPT-5.6-SOL прошли 10 проверяемых задач через единый API Crazyrouter. Обе модели дали 10/10 правильных основных ответов; отдельно проверены скрытые тесты кода, полнота инструкций и строгий JSON.

Claude Opus 5 vs Claude Fable 5: семь задач в реальном API-бенчмарке и рекомендации по production-routing
July 25, 202644 viewsРусскийComparison

Claude Opus 5 vs Claude Fable 5: семь задач в реальном API-бенчмарке и рекомендации по production-routing

В одном OpenAI-compatible API, с одинаковыми промптами и параметрами, Claude Opus 5 и Claude Fable 5 сравниваются на задачах по математике, физике, рассуждению с ограничениями, code review, строгому JSON и дизайну экспериментов. Фиксируются delivery rate, content filtering, latency, tokens и результаты повторных запусков.

Достигла ли Kimi K3 уровня Opus 4.8? API-тестирование по семи измерениям
July 19, 202674 viewsРусскийComparison

Достигла ли Kimi K3 уровня Opus 4.8? API-тестирование по семи измерениям

Kimi K3 и Claude Opus 4.8: сравнение точности, задержки и эффективности reasoning Token в семи тестах.

Kimi K3 против Claude Opus 4.8: практические тесты по математике, физике и программированию уровня магистратуры
July 19, 202687 viewsРусскийComparison

Kimi K3 против Claude Opus 4.8: практические тесты по математике, физике и программированию уровня магистратуры

Реальное сравнение Kimi K3 и Claude Opus 4.8 на задачах уровня выпускной работы: марковская цепь, затухающие связанные осцилляторы и планирование зависимостей; проверены полнота вывода, точность, задержка и код.

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"
July 18, 2026106 viewsРусскийComparison

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"

"В рамках одного OpenAI-compatible API и одного и того же промпта проведено сравнение kimi-k3 и gpt-5.6-sol на задачах по времени остановки режима, задаче по физике с моментом инерции на шкиве и задаче по программированию с зависимыми замыканиями; зафиксированы ко

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API
July 17, 202687 viewsРусскийComparison

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API

Практический API-тест Kimi K3 и Claude Fable 5 на математике, физике, исполняемом Python и логических ограничениях с анализом finish_reason и reasoning tokens.

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?
July 13, 202697 viewsРусскийComparison

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?

Реальный тест Crazyrouter OpenAI-compatible API: сравнение gpt-5.6-sol и gpt-5.6-terra в четырех задачах по точности, задержке, токенам, локальным тестам Python и расчетной стоимости запросов.

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена
July 7, 2026133 viewsРусскийTutorial

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена

Практическое руководство по использованию gemini-2.5-flash и gemini-2.5-flash-lite для высоконагруженных, высокочастотных и чувствительных к цене AI-приложений через Crazyrouter.