Login
Crazyrouter Blog

Practical notes on AI models, API costs, and production workflows.

Model updates, integration guides, pricing breakdowns, and tool workflows for developers and teams.

Достигла ли Kimi K3 уровня Opus 4.8? API-тестирование по семи измерениям
Featured article

Достигла ли Kimi K3 уровня Opus 4.8? API-тестирование по семи измерениям

Kimi K3 и Claude Opus 4.8: сравнение точности, задержки и эффективности reasoning Token в семи тестах.

July 19, 202638 viewsРусскийComparison
Kimi K3 против Claude Opus 4.8: практические тесты по математике, физике и программированию уровня магистратуры
July 19, 202647 viewsРусскийComparison

Kimi K3 против Claude Opus 4.8: практические тесты по математике, физике и программированию уровня магистратуры

Реальное сравнение Kimi K3 и Claude Opus 4.8 на задачах уровня выпускной работы: марковская цепь, затухающие связанные осцилляторы и планирование зависимостей; проверены полнота вывода, точность, задержка и код.

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"
July 18, 202665 viewsРусскийComparison

"Kimi K3 против GPT-5.6-SOL: жёсткое тестирование по математике, физике и программированию"

"В рамках одного OpenAI-compatible API и одного и того же промпта проведено сравнение kimi-k3 и gpt-5.6-sol на задачах по времени остановки режима, задаче по физике с моментом инерции на шкиве и задаче по программированию с зависимыми замыканиями; зафиксированы ко

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API
July 17, 202656 viewsРусскийComparison

Kimi K3 против Claude Fable 5: точность проверки, обрезка кода и задержка API

Практический API-тест Kimi K3 и Claude Fable 5 на математике, физике, исполняемом Python и логических ограничениях с анализом finish_reason и reasoning tokens.

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?
July 13, 202672 viewsРусскийComparison

GPT-5.6-sol против GPT-5.6-terra: насколько отличается производительность при двукратной разнице в цене?

Реальный тест Crazyrouter OpenAI-compatible API: сравнение gpt-5.6-sol и gpt-5.6-terra в четырех задачах по точности, задержке, токенам, локальным тестам Python и расчетной стоимости запросов.

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена
July 7, 2026107 viewsРусскийTutorial

Gemini 2.5 Flash и Flash-Lite для API с высоким RPM: почему важны пропускная способность и низкая цена

Практическое руководство по использованию gemini-2.5-flash и gemini-2.5-flash-lite для высоконагруженных, высокочастотных и чувствительных к цене AI-приложений через Crazyrouter.

GLM-5.2 против Claude Fable 5: лимит вывода, reasoning_tokens и коэффициент discount 0.8
July 6, 202689 viewsРусскийComparison

GLM-5.2 против Claude Fable 5: лимит вывода, reasoning_tokens и коэффициент discount 0.8

Практический тест через OpenAI-compatible API Crazyrouter: glm-5.2 и claude-fable-5 на математике, физике и длинной Canvas-анимации, с учетом текущего discount 0.8 для glm-5.2.

Тест 6 Vision API моделей: Gemini 2.5, GPT-4.1 и Qwen3 VL для понимания изображений
June 22, 2026179 viewsРусскийComparison

Тест 6 Vision API моделей: Gemini 2.5, GPT-4.1 и Qwen3 VL для понимания изображений

Практический benchmark шести моделей для image understanding API: Gemini 2.5 Flash, Gemini 2.5 Flash Lite, GPT-4.1 Mini, GPT-4.1 Nano, Qwen3 VL Flash и Qwen3 VL Plus. Сравниваем accuracy, latency, стоимость успешного изображения, usage signals, failure modes и production routing.

Qwen3 VL Flash vs Qwen3 VL Plus: бенчмарк Vision API 2026 для практического выбора модели
June 22, 2026141 viewsРусскийComparison

Qwen3 VL Flash vs Qwen3 VL Plus: бенчмарк Vision API 2026 для практического выбора модели

Практический benchmark для сравнения qwen3-vl-flash и qwen3-vl-plus в задачах Vision API: реальная точность распознавания, latency, tail latency, стоимость успешного изображения, usage signals, failure modes и routing recommendations.