CLOSED BETA Ранний доступ: получите приветственный грант 500 000 токенов для закрытого тестирования
OpenAI API Drop-in Gateway · Каскадный роутинг · Оплата в рублях

Единый API для нейросетей

Снижайте затраты на разработку до 90%

Единый шлюз с интеллектуальной маршрутизацией запросов между фронтирными моделями и быстрыми воркерами. Автоматический failover за миллисекунды.

config.py · Drop-in миграция в 1 строку
import openai
client = openai.OpenAI(
- base_url = "https://api.openai.com/v1",
+ base_url = "https://api.runetllm.com/v1",
api_key = "rllm_..."
)

Легальные рубли и закрывашки

Пополняйте баланс картами РФ, СБП или USDT. Официальный договор-оферта для ИП/ООО и автоматические закрывающие акты.

Прямой доступ с низким пингом

Серверы развернуты в EU с оптимизированной маршрутизацией до РФ. Стабильный пинг 30–50 мс без использования локальных VPN.

Миграция за 60 секунд

100% совместимость со спецификацией OpenAI API. Просто перепишите одну строку base_url в вашем Cursor или коде.

Умный Failover

Если провайдер перегружен или выдает ошибку (429/500), наш шлюз за миллисекунды перенаправит запрос на резервный пул. Никаких обрывов релизов.

quickstart.sh · base_url = https://api.runetllm.com/v1

                
HYBRID CODING CASCADE PIPELINE

Зачем платить Senior-модели за работу Junior-a?

90% времени в IDE — это дебаг, генерация тестов и рефакторинг. Каскадный шлюз позволяет распределить задачи по уровням сложности и цене.

Tier 1 (Песочница и черновой дебаг)

Llama 4 Maverick / Laguna S 2.1

Черновой дебаг, синтаксический анализ, автогенерация unit-тестов и проверка базовых скриптов.

Цена: ~4.50 руб. за 1M токенов
Tier 2 (Рутинные воркеры)

DeepSeek V4 Pro / Qwen 3.8

Генерация шаблонного кода, рефакторинг, автодокументирование и активные RAG-агенты (контекст до 1M токенов).

Цена: ~25.00 руб. за 1M токенов
Tier 3 (Архитектурный уровень)

Claude Sonnet 5 / GPT-5.6 (o3)

Сложная бизнес-логика, проектирование баз данных, системная архитектура и финальное ревью кода.

Цена: ~480.00 руб. за 1M токенов
SYSTEM STATUS & LATENCY

Мониторинг доступности и аптайм шлюза

Прямой мониторинг каналов связи и автоматического каскадного переключения в режиме реального времени.

Шлюз api.runetllm.com
32 мс EU Uplink
38 мс из МСК/СПб без VPN
Накладная задержка
< 1.8 мс In-Memory
Авторизация и роутинг
OpenAI Direct RTT
124 мс Uplink
Европейский дата-центр
Anthropic Direct RTT
142 мс Uplink
Прямое оптоволокно

Uptime Example: Claude Sonnet 5 / GPT-5.6 Sol

Сравнение стабильности при прямом обращении и через каскадный шлюз

Availability over the last 3 days
Availability 99.90%
Hourly availability (72h) 100% Operational
--.--.----, --:--:-- --.--.----, --:--:--
Availability over the last 24 hours
RunetLLM Routed (99.90%) Without Routing (Direct Uplink ~94.2%)
100.00% 95.00% 90.00% 85.00%
--.--.----, --:--:-- --.--.----, --:--:--

При возникновении ошибок или рейт-лимитов у апстрим-провайдера, шлюз Рунет LLM автоматически перенаправляет запрос на доступный резервный узел кластера за миллисекунды, сохраняя непрерывность работы приложения.

MODEL REGISTRY

Доступные модели и правила каскада

Все модели доступны по единому API-ключу. При недоступности флагмана запрос автоматически уходит на резерв.

Модель Алиас (model ID) Роль в контуре Каскадный Fallback Статус
Claude Sonnet 5 (Anthropic) claude-sonnet-5 Архитектор / Agentic Coding (Tier 3) → gpt-5.6-terra Active · 99.9%
Claude Opus 5 (Anthropic) claude-opus-5 Архитектор / Deep Reasoning (Tier 3) → gpt-5.6-sol Active · 99.9%
GPT-5.6 Sol / Terra (OpenAI) gpt-5.6-sol Архитектор / Flagship Reasoning (Tier 3) → claude-opus-5 Active · 99.9%
Gemini 3.1 Pro (Google) gemini-3.1-pro Архитектор / Ultra-long Context (Tier 3) → claude-sonnet-5 Active · 99.9%
DeepSeek V4 Pro (DeepSeek) deepseek-v4-pro Воркер / Fast Reasoning (Tier 2) → qwen3.8-27b Active · 99.9%
Qwen 3.8-27B (Alibaba) qwen3.8-27b Воркер / Code & Multimodal (Tier 2) → deepseek-v4-pro Active · 99.9%
Llama 4 Maverick (Meta) llama-4-maverick Песочница / Open Weights (Tier 1) → nemotron-3.5-lightning Active · 99.9%
Laguna S 2.1 (Poolside) laguna-s-2.1 Песочница / Agentic Code Fallback (Tier 1) → llama-4-maverick Active Backup
💡 Принцип изолированного Failover: Шлюз выполняет автоматическое переключение исключительно на равнозначную модель того же уровня (Tier 3 ↔ Tier 3, Tier 2 ↔ Tier 2). Архитектурные запросы никогда не деградируют до легких моделей.
BEST MODELS BY TASK

Лучшие модели под ваш сценарий

Данные обновляются еженедельно по результатам публичных бенчмарков: LMSYS Arena, SWE-bench, Artificial Analysis, LiveBench.

🎯 Точность / Качество LMSYS Arena Elo
🏆 Claude Opus 5 Проприетарная
Elo 1412
#2 GPT-5.6 Sol
Elo 1398
#3 Gemini 3.1 Pro
Elo 1385
💰 Лучшая цена Artificial Analysis
🏆 DeepSeek V4 Flash Open Weights
$0.07/1M
#2 Qwen 3.8-27B
$0.10/1M
#3 Laguna S 2.1
Free tier
⚡ Скорость Artificial Analysis TTFT
🏆 Step 3.7 Flash 196B MoE
192 tok/s
#2 Claude Haiku 4.5
165 tok/s
#3 DeepSeek V4 Flash
148 tok/s
AI MODEL ADVISOR

Подберите идеальный каскад под задачу

Опишите задачу — ИИ предложит оптимальный пресет моделей с учетом вашего приоритета.

0 / 1000 символов
Приоритет:
SECURITY & COMPLIANCE

Создано для надежной работы в РФ и мире

Инженерные гарантии безопасности, безналичные расчеты и нулевой риск потери контекста.

Оплата в рублях и ЭДО

Принимаем карты МИР, СБП и безналичные переводы для юридических лиц. Автоматическое выставление счетов и закрывающих документов в Диадок / СБИС.

Zero-Knowledge Хранение ключей

API-ключи пользователей хэшируются по стандарту SHA-256 до сохранения в базе. Даже при компрометации хранилища ваши реальные ключи невозможно восстановить.

Fail-Closed Rate Limiter

Точный учет RPM и TPM на уровне высокоскоростного Token Bucket. Гарантия отсутствия перерасхода и блокировка неконтролируемого слива бюджета ботами.

FREQUENTLY ASKED QUESTIONS

Частые вопросы

Как подключить Рунет LLM к Cursor, Claude Code или своему бэкенду?

Достаточно указать base_url="https://api.runetllm.com/v1" и передать ваш ключ в заголовке Authorization: Bearer rllm_.... Шлюз на 100% совместим со спецификацией OpenAI API для Python, TypeScript, Go, Java и расширениями для IDE.

Что происходит, если OpenAI или Claude падают или включают rate limit?

Шлюз автоматически перехватывает ошибку 429/500/таймаут и прозрачно перенаправляет запрос на следующую модель в каскаде (например, DeepSeek или Laguna M.1). Ваше приложение получает успешный ответ без прерывания пользовательской сессии.

Как получить закрытый бета-доступ и грант токенов?

Запустите Telegram-бота по ссылке t.me/runetllm_bot?start=beta. Бот моментально создаст ваш персональный API-ключ и начислит стартовый грант в 500 000 токенов для полноценного тестирования.

Как оформить договор и оплачивать по безналичному расчету?

В боте доступна команда /feedback — вы можете оставить реквизиты вашей компании, и мы сформируем оферту и счет с передачей актов через ЭДО (Диадок).

Готовы протестировать шлюз в боевом коде?

Получите API-ключ за 30 секунд через Telegram и подключите первый запрос без привязки карты.