CLOSED BETA Ранний доступ: приветственный грант 500 000 токенов

> Рунет LLM _

Единый API для нейросетей

Каскадный шлюз с failover: до 90% экономии на токенах, оплата в рублях, drop-in OpenAI API.

config.py · Drop-in миграция в 1 строку
import openai
client = openai.OpenAI(
- base_url = "https://api.openai.com/v1",
+ base_url = "https://api.runetllm.com/v1",
api_key = "rllm_..."
)
quickstart.sh · base_url = https://api.runetllm.com/v1

                
HYBRID CODING CASCADE PIPELINE

Зачем платить Senior-модели за работу Junior-a?

90% времени в IDE — это дебаг, генерация тестов и рефакторинг. Каскадный шлюз позволяет распределить задачи по уровням сложности и цене.

Tier 1 · Воркеры

Llama 4 / Laguna

Черновой дебаг, тесты, синтаксис.

~4.50 ₽ / 1M ток.

Tier 2 · Воркеры

DeepSeek / Qwen

Шаблонный код, рефакторинг, RAG.

~25 ₽ / 1M ток.

Tier 3 · Архитектор

Claude / GPT frontier

Архитектура, сложная логика, ревью.

~480 ₽ / 1M ток.

Каскад: простые задачи → дешёвые воркеры; сложные → Архитектор. Failover только внутри уровня.

AI MODEL ADVISOR

Подберите идеальный каскад под задачу

Опишите задачу — ИИ предложит оптимальный пресет моделей с учетом вашего приоритета.

0 / 1000 символов
Приоритет:
SYSTEM STATUS & LATENCY

Мониторинг доступности и аптайм шлюза

Прямой мониторинг каналов связи и автоматического каскадного переключения в режиме реального времени.

Шлюз api.runetllm.com
32 мс EU Uplink
38 мс из МСК/СПб без VPN
Накладная задержка
< 1.8 мс In-Memory
Авторизация и роутинг
OpenAI Direct RTT
124 мс Uplink
Европейский дата-центр
Anthropic Direct RTT
142 мс Uplink
Прямое оптоволокно

Uptime: frontier models via cascade

Сравнение стабильности при прямом обращении и через каскадный шлюз

Availability over the last 3 days
Availability 99.90%
Hourly availability (72h) 100% Operational
--.--.----, --:--:-- --.--.----, --:--:--
Availability over the last 24 hours
RunetLLM Routed (99.90%) Without Routing (Direct Uplink ~94.2%)
100.00% 95.00% 90.00% 85.00%
--.--.----, --:--:-- --.--.----, --:--:--

При возникновении ошибок или рейт-лимитов у апстрим-провайдера, шлюз Рунет LLM автоматически перенаправляет запрос на доступный резервный узел кластера за миллисекунды, сохраняя непрерывность работы приложения.

MODEL REGISTRY

Доступные модели и правила каскада

Все модели доступны по единому API-ключу. При недоступности флагмана запрос автоматически уходит на резерв.

Модель Алиас (model ID) Роль в контуре Каскадный Fallback Статус
Claude Sonnet 5 (Anthropic) claude-sonnet-5 Архитектор / Agentic Coding (Tier 3) → gpt-5.6-terra Active · 99.9%
Claude Opus 5 (Anthropic) claude-opus-5 Архитектор / Deep Reasoning (Tier 3) → gpt-5.6-sol Active · 99.9%
GPT-5.6 Sol / Terra (OpenAI) gpt-5.6-sol Архитектор / Flagship Reasoning (Tier 3) → claude-opus-5 Active · 99.9%
Gemini 3.1 Pro (Google) gemini-3.1-pro Архитектор / Ultra-long Context (Tier 3) → claude-sonnet-5 Active · 99.9%
DeepSeek V4 Pro (DeepSeek) deepseek-v4-pro Воркер / Fast Reasoning (Tier 2) → qwen3.8-27b Active · 99.9%
Qwen 3.8-27B (Alibaba) qwen3.8-27b Воркер / Code & Multimodal (Tier 2) → deepseek-v4-pro Active · 99.9%
GLM-5.3 (Zhipu AI) glm-5.3 Воркер / Reasoning & Code (Tier 2) → deepseek-v4-pro Active · 99.9%
Kimi-k3 (Moonshot AI) kimi-k3 Воркер / Long-Context & Agents (Tier 2) → qwen3.8-27b Active · 99.9%
Llama 4 Maverick (Meta) llama-4-maverick Песочница / Open Weights (Tier 1) → nemotron-3.5-lightning Active · 99.9%
Laguna S 2.1 (Poolside) laguna-s-2.1 Песочница / Agentic Code Fallback (Tier 1) → llama-4-maverick Active Backup
💡 Принцип изолированного Failover: Шлюз выполняет автоматическое переключение исключительно на равнозначную модель того же уровня (Tier 3 ↔ Tier 3, Tier 2 ↔ Tier 2). Архитектурные запросы никогда не деградируют до легких моделей.
BEST MODELS BY TASK

Лучшие модели под ваш сценарий

Данные обновляются еженедельно по результатам публичных бенчмарков: LMSYS Arena, SWE-bench, Artificial Analysis, LiveBench.

🎯 Точность / Качество LMSYS Arena Elo
🏆 Claude Opus 5 Проприетарная
Elo 1412
#2 GPT-5.6 Sol
Elo 1398
#3 Gemini 3.1 Pro
Elo 1385
💰 Лучшая цена Artificial Analysis
🏆 DeepSeek V4 Flash Open Weights
$0.07/1M
#2 Qwen 3.8-27B
$0.10/1M
#3 Laguna S 2.1
Free tier
⚡ Скорость Artificial Analysis TTFT
🏆 Step 3.7 Flash 196B MoE
192 tok/s
#2 Claude Haiku 4.5
165 tok/s
#3 DeepSeek V4 Flash
148 tok/s

Безопасность и расчёты

Оплата в рублях и ЭДО · API-ключи только как SHA-256 хэш · fail-closed rate limit (RPM/TPM). Подробности — в FAQ и оферте через бота.

FREQUENTLY ASKED QUESTIONS

Частые вопросы

Как подключить Рунет LLM к Cursor, Claude Code или своему бэкенду? ↓

Достаточно указать base_url="https://api.runetllm.com/v1" и передать ваш ключ в заголовке Authorization: Bearer rllm_.... Шлюз на 100% совместим со спецификацией OpenAI API для Python, TypeScript, Go, Java и расширениями для IDE.

Что происходит, если OpenAI или Claude падают или включают rate limit? ↓

Шлюз автоматически перехватывает ошибку 429/500/таймаут и прозрачно перенаправляет запрос на следующую модель в каскаде (например, DeepSeek или Laguna M.1). Ваше приложение получает успешный ответ без прерывания пользовательской сессии.

Как получить закрытый бета-доступ и грант токенов? ↓

Запустите Telegram-бота по ссылке t.me/runetllm_bot?start=beta. Бот моментально создаст ваш персональный API-ключ и начислит стартовый грант в 500 000 токенов для полноценного тестирования.

Как оформить договор и оплачивать по безналичному расчету? ↓

В боте доступна команда /feedback — вы можете оставить реквизиты вашей компании, и мы сформируем оферту и счет с передачей актов через ЭДО (Диадок).

Готовы протестировать шлюз в боевом коде?

Получите API-ключ за 30 секунд через Telegram и подключите первый запрос без привязки карты.