OpenAI-совместимый API к ведущим LLM

LLM-токены с выдержкой

Legendario — платформа доступа к GPT, Claude, Gemini, Qwen, DeepSeek и другим моделям через единый API. Интеллектуальная маршрутизация подбирает для каждого запроса оптимальный путь по цене и качеству, а каждый токен учитывается честно и прозрачно.

Совместимость
OpenAI SDK
Маршрутизация
под ваш режим
Расчёты
договор, рубли
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://legendario.tech/v1",
    api_key=os.environ["LEGENDARIO_API_KEY"],
)

# режим маршрутизации задан в аккаунте
resp = client.chat.completions.create(
    model="claude-sonnet-5",
    messages=[{"role": "user",
               "content": "Привет!"}],
)
print(resp.choices[0].message.content)
OpenAI-совместимый формат Список моделей: GET /v1/models

IКак это работает

Один вход — все ведущие модели

Вы отправляете запросы на один адрес. Legendario API маршрутизирует каждый запрос с учётом выбранного режима, учитывает токены и обеспечивает отказоустойчивость — без отдельной интеграции под каждую модель.

Клиент

Ваше приложение

POST /v1/chat/completions

Платформа

Legendario API

  • Интеллектуальная маршрутизация
  • Контроль качества
  • Отказоустойчивость
  • Учёт каждого токена

Ведущие модели

  • GPTgpt-*
  • Claudeclaude-*
  • Geminigemini-*
  • Qwenqwen-*
  • DeepSeekdeepseek-*

И другие модели — полный список через GET /v1/models

Секрет эликсира — не в одной модели, а в точном выборе маршрута для каждого запроса.

  1. 01

    Запрос

    Ваш код обращается к /v1/chat/completions так же, как к OpenAI: тот же формат, SDK и стриминг.

  2. 02

    Маршрутизация

    Платформа выбирает оптимальный путь исполнения по цене и качеству — с учётом вашего режима и текущей нагрузки.

  3. 03

    Резервирование

    Если основной маршрут недоступен, запрос автоматически исполняется по резервному — без изменений на вашей стороне.

  4. 04

    Учёт

    Модель, токены и стоимость фиксируются по каждому запросу — для отчётности и сверки.

IIРежимы маршрутизации

Вы задаёте приоритет, маршрут подбираем мы

Режим задаёт баланс между ценой и качеством ответа. Переключение не требует изменений в коде.

economy

Экономия

Минимальная стоимость токена при стабильном качестве. Для массовых задач, где решает цена.

Приоритет цены
высокий
Приоритет качества
базовый

Подходит для

  • Классификации и разметки
  • Извлечения данных из текстов
  • Суммаризации и черновиков
balanced С него удобно начать

Баланс

Разумный компромисс: выгодная цена без заметных потерь в качестве и стабильности ответа.

Приоритет цены
средний
Приоритет качества
средний

Подходит для

  • Чат-ботов и ассистентов
  • RAG и поиска по базе знаний
  • Продуктовых функций на LLM
quality

Качество

Приоритет — максимальное качество ответа по нашим замерам и стабильность. Цена вторична.

Приоритет цены
базовый
Приоритет качества
высокий

Подходит для

  • Сложных рассуждений и анализа
  • Генерации и ревью кода
  • Ответов, где цена ошибки высока

Режим закрепляется за аккаунтом и меняется без правок в коде. В любом режиме действуют контроль качества и честный учёт каждого токена.

IIIПочему мы

Доверяй, но измеряй

Мы не полагаемся на обещания — мы измеряем. Качество ответов, скорость и каждый списанный токен находятся под постоянным инструментальным контролем.

Протокол контроля качества

Вы получаете ровно то, за что платите

Мы инструментально проверяем заявленную модель, счёт токенов, скорость и стабильность ответа. Замеры идут постоянно, а не один раз при запуске, и опираются на наши собственные исследования.

  1. Подлинность модели

    Ответ формирует именно та модель, которую вы указали в запросе, — без подмены на более дешёвую.

  2. Честный счёт токенов

    Входящие и исходящие токены считаются по фактическому объёму, без скрытых надбавок.

  3. Точность списаний

    Каждое списание сходится с фактическим потреблением и действующими ценами.

  4. Скорость

    Время до первого токена и скорость генерации — под реальной нагрузкой, а не в демо.

  5. Доступность

    Доля успешных ответов, поведение на пиках и восстановление после сбоев.

Прозрачный учёт

Каждый запрос фиксируется: модель, токены на входе и выходе, стоимость. Отчётность по потреблению — в разрезе дней, моделей и ключей.

Выдержанная архитектура

Резервирование на уровне инфраструктуры: при сбое запрос автоматически исполняется по резервному маршруту. Нестабильные маршруты временно выводятся из ротации.

Совместимость с OpenAI SDK

Меняете base_url и ключ — остальной код остаётся прежним. Поддерживаются стриминг и список моделей через /v1/models.

Корпоративный формат

Работаем с компаниями по договору, оплата в рублях. Условия и объёмы обсуждаем индивидуально.

IVПодключение

Три шага до первого запроса

Подключение не требует переписывать код — достаточно заменить адрес API и ключ.

  1. Оставьте заявку

    Расскажите о задачах, нужных моделях и ожидаемых объёмах — подберём режим и условия.

  2. Получите ключ

    Оформляем договор, выдаём API-ключ и настраиваем режим маршрутизации для вашего аккаунта.

  3. Смените base_url

    Укажите в OpenAI SDK адрес https://legendario.tech/v1 и новый ключ. Остальной код не меняется.

Всё, что меняется в вашем коде
base_url="https://api.openai.com/v1"base_url="https://legendario.tech/v1"

VЗаявка

Запросить доступ

Расскажите о задаче — мы свяжемся, чтобы обсудить модели, объёмы и условия подключения.

  1. Обсудим сценарии и подберём режим маршрутизации
  2. Согласуем условия и оформим договор
  3. Выдадим API-ключ и поможем с подключением

Предпочитаете почту? Пишите на hello@legendario.tech

Поля, отмеченные звёздочкой, обязательны.