Login
Crazyrouter Blog

Practical notes on AI models, API costs, and production workflows.

Model updates, integration guides, pricing breakdowns, and tool workflows for developers and teams.

Достигла ли Kimi K3 уровня Opus 4.8? API-тестирование по семи измерениям
July 19, 202638 viewsРусскийComparison

Достигла ли Kimi K3 уровня Opus 4.8? API-тестирование по семи измерениям

Kimi K3 и Claude Opus 4.8: сравнение точности, задержки и эффективности reasoning Token в семи тестах.

Kimi K3 против Claude Opus 4.8: практические тесты по математике, физике и программированию уровня магистратуры
July 19, 202646 viewsРусскийComparison

Kimi K3 против Claude Opus 4.8: практические тесты по математике, физике и программированию уровня магистратуры

Реальное сравнение Kimi K3 и Claude Opus 4.8 на задачах уровня выпускной работы: марковская цепь, затухающие связанные осцилляторы и планирование зависимостей; проверены полнота вывода, точность, задержка и код.

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"
July 18, 202664 viewsРусскийComparison

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"

"В рамках одного OpenAI-compatible API и одного и того же промпта проведено сравнение kimi-k3 и gpt-5.6-sol на задачах по времени остановки режима, задаче по физике с моментом инерции на шкиве и задаче по программированию с зависимыми замыканиями; зафиксированы ко

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API
July 17, 202655 viewsРусскийComparison

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API

Практический API-тест Kimi K3 и Claude Fable 5 на математике, физике, исполняемом Python и логических ограничениях с анализом finish_reason и reasoning tokens.

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?
July 13, 202671 viewsРусскийComparison

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?

Реальный тест Crazyrouter OpenAI-compatible API: сравнение gpt-5.6-sol и gpt-5.6-terra в четырех задачах по точности, задержке, токенам, локальным тестам Python и расчетной стоимости запросов.

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена
July 7, 2026106 viewsРусскийTutorial

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена

Практическое руководство по использованию gemini-2.5-flash и gemini-2.5-flash-lite для высоконагруженных, высокочастотных и чувствительных к цене AI-приложений через Crazyrouter.

GLM-5.2 против Claude Fable 5: лимит вывода, reasoning_tokens и коэффициент discount 0.8
July 6, 202688 viewsРусскийComparison

GLM-5.2 против Claude Fable 5: лимит вывода, reasoning_tokens и коэффициент discount 0.8

Практический тест через OpenAI-compatible API Crazyrouter: glm-5.2 и claude-fable-5 на математике, физике и длинной Canvas-анимации, с учетом текущего discount 0.8 для glm-5.2.

Тест 6 Vision API моделей: Gemini 2.5, GPT-4.1 и Qwen3 VL для понимания изображений
June 22, 2026178 viewsРусскийComparison

Тест 6 Vision API моделей: Gemini 2.5, GPT-4.1 и Qwen3 VL для понимания изображений

Практический benchmark шести моделей для image understanding API: Gemini 2.5 Flash, Gemini 2.5 Flash Lite, GPT-4.1 Mini, GPT-4.1 Nano, Qwen3 VL Flash и Qwen3 VL Plus. Сравниваем accuracy, latency, стоимость успешного изображения, usage signals, failure modes и production routing.