Один API-ключ ко всем ИИ-моделям

Полностью совместим с OpenAI: меняете base_url — и ваш код работает с любой подключённой моделью. Оплата по факту, за реально потраченные токены, без подписок и минимальных платежей.

from openai import OpenAI

client = OpenAI(
    api_key="sk-agg-…",
    base_url="https://flake.host/v1",
)

resp = client.chat.completions.create(
    model="claude-opus-4-8",
    messages=[{"role": "user", "content": "Привет!"}],
)
Pay as you go

Списываем ровно за токены запроса и ответа по прозрачному прайсу. Остаток и история каждого запроса видны в личном кабинете.

Совместимость с OpenAI SDK

/v1/chat/completions и /v1/models, включая стриминг. Работает с официальными SDK, LangChain, Cursor и любым OpenAI-клиентом.

Отказоустойчивость

За одним именем модели — пул ключей и несколько провайдеров. Если один отвечает ошибкой, запрос уходит следующему автоматически.

Доступные модели

Модель Вход, $ / 1M Выход, $ / 1M Контекст
claude-opus-4-8
Claude Opus 4.8
0.78 3.88
claude-opus-5
Claude Opus 5
1.00 3.00 128 000
deepseek-v4-flash
deepseek-v4-flash
1.00 3.00 128 000
glm-5.3
glm-5.3
1.00 3.00 128 000
gpt-5.6-sol
GPT-5.6 Sol
5.39 33.89
qwen3-235b-a22b
Qwen3-235B-A22B-2507
0.15 0.45 32 000
qwen3-5-397b-a17b
Qwen3.5-397B-A17B
0.20 0.60 32 000
qwen3-5-flash
Qwen3.5-Flash
0.02 0.06 32 000
qwen3-5-omni-flash
Qwen3.5-Omni-Flash
0.05 0.15 32 000
qwen3-5-omni-plus
Qwen3.5-Omni-Plus
0.25 0.75 32 000
qwen3-5-plus
Qwen3.5-Plus
0.10 0.30 32 000
qwen3-6-27b
Qwen3.6-27B
0.05 0.15 32 000
qwen3-6-35b-a3b
Qwen3.6-35B-A3B
0.08 0.24 32 000
qwen3-6-max-preview
Qwen3.6-Max-Preview
0.40 1.20 32 000
qwen3-6-plus
Qwen3.6-Plus
0.15 0.45 32 000
qwen3-7-max
Qwen3.7-Max
0.50 1.50 32 000
qwen3-7-plus
Qwen3.7-Plus
0.20 0.60 32 000
qwen3-8-max
Qwen3.8-Max
0.50 1.50 32 000
qwen3-8-max-preview
Qwen3.8-Max-Preview
0.50 1.50 32 000
qwen3-coder
Qwen3-Coder
0.10 0.30 32 000
qwen3-max
Qwen3-Max
0.25 0.75 32 000
qwen3-omni-flash
Qwen3-Omni-Flash
0.04 0.12 32 000
qwen3-vl
Qwen3-VL-235B-A22B
0.15 0.45 32 000