ЦАРЬ РОУТЕР

История изменений

Все обновления ЦАРЬ РОУТЕР - добавление/удаление моделей, изменения API, исправления и новый функционал

02.10.2026

  • Добавлено:
    • Новый провайдер reg.cloud.
    • Новая модель от провайдера reg.cloud - Qwen/Qwen3.8-Flash-Next. Цена - 30 / 90 ₽ за 1 млн токенов вход / выход.
    • Qwen/Qwen3.8-27B новый провайдер - reg.cloud: 20 / 210 ₽ за 1 млн токенов вход / выход.

01.10.2026

  • Добавлено:

    • Два типа API-ключа: «Вызов моделей» и «Просмотр баланса». Тип выбирается при создании ключа в личном кабинете и потом не меняется. Все ключи, созданные раньше, - «Вызов моделей».
    • GET /v1/balance - баланс аккаунта в рублях. Работает только с ключом «Просмотр баланса».
    • На странице ключей в личном кабинете - колонка «Последний запрос»: когда ключ последний раз вызывали.
    • Новая модель от провайдера Yandex - deepseek/DeepSeek-V4.1-Flash.
    • Полные карточки моделей в GET /v1/models и GET /v1/models/{id}: контекст, что умеет модель, цены в рублях (от и до по провайдерам). В GET /v1/models/{id} - ещё список провайдеров с их ценами и контекстом. Ответ отдаёт ETag: с заголовком If-None-Match неизменившийся список приходит ответом 304 без тела.
    • Дата добавления модели в каталог: сортировка «Дата добавления» на странице «Модели», в llms.txt и llms-full.txt, поле added_date в /models.json, колонка added_date (последней) в /models.csv.
    • В каталоге моделей у текстовых моделей в карточке две цены - за входящие и за исходящие токены. Задержка по провайдерам теперь на странице модели.
    • Новый раздел документации «Справочник API»: у каждого из 16 методов API своя страница - параметры, ответ, лимиты, ошибки с текстами, примеры на curl, Python и TypeScript. На главной странице раздела - типы ключей и таблица всех методов.
    • Страница «Подключение OpenCode»: готовый конфиг со всеми текстовыми моделями скачивается одной командой - https://tsarrouter.ru/api/opencode-config.
  • Изменено:

    • Справочные запросы - GET /v1/models, GET /v1/models/{id}, GET /v1/balance, GET /v1/key - теперь считаются вместе: 120 запросов в минуту на аккаунт. Раньше у GET /v1/models было до 1200 в минуту. В GET /v1/key и GET /v1/limits прежние поля этих лимитов заменены одним полем reference_rpm.
    • GET /v1/key: у ключа без лимита расходов поле available_rub теперь null - раньше там был баланс аккаунта. Баланс теперь отдаёт GET /v1/balance. В ответ добавлено поле scopes - тип ключа.
    • Текст ошибки 402 у ключей из личного кабинета больше не называет баланс аккаунта.
    • GET /v1/models и GET /v1/models/{id} с отключённым ключом отвечают 403, с просроченным - 401, как остальные методы. Раньше эти методы такому ключу отвечали.
    • Заголовок X-TsarRouter-Attempts (цепочка попыток по провайдерам) больше не отдаётся. Кто исполнил запрос, по-прежнему видно в X-TsarRouter-Provider и X-TsarRouter-Model.
    • GET /v1/models: у моделей появилось поле name. Клиенты, которые его показывают (например, Open WebUI), будут показывать название модели вместо её идентификатора. Выключенные модели больше не попадают в список, GET /v1/models/{id} по ним отвечает 404. Поле created - дата появления модели в ЦАРЬ РОУТЕР. GET /v1/models/{id} по старому имени переименованной модели отдаёт карточку новой модели с её именем в id.
    • ai-sage/GigaChat3.5-432B-A28B заменена на ai-sage/GigaChat3.5-432B-A28B-Reasoning, старое имя тоже ведёт в неё.
    • Если прервать стрим до конца ответа, оплачиваются токены, отданные до обрыва, - теперь с учётом описаний инструментов (tools) и аргументов их вызовов.
    • Конфиг OpenCode: провайдер называется tsarrouter (было tsar_router), имена моделей начинаются с tsarrouter/. Если скачивали конфиг раньше, скачайте заново.
  • Удалено:

    • Qwen/Qwen3.5-35B-A3B.
    • nvidia/Nemotron-3-Nano-30B-A3B.
  • Временно недоступно:

    • Переход моделей провайдера immers.cloud на платный доступ, анонсированный 21.09, откладывается. Модели провайдера пока недоступны: google/gemma-4-26b-a4b-it, deepseek/deepseek-v4-flash-0731 и Qwen/Qwen3.6-27B. О сроках сообщим здесь отдельно.

30.09.2026

  • Удалено:
    • Qwen/Qwen3-235B-A22B-Instruct-2507 - провайдер Yandex Cloud отключил модель 30.09.2026 в 13:08 МСК. Других провайдеров у неё не было, модель снята. Замена - deepseek/deepseek-v4-flash, yandex/aliceai-llm или yandex/aliceai-llm-flash

23.09.2026

  • Анонсировано:
    • 1 октября ai-sage/GigaChat3.5-432B-A28B заменяется на ai-sage/GigaChat3.5-432B-A28B-Reasoning: 5 октября провайдер Cloud.ru отключает обычную версию. Цена та же - 96,22 / 288,60 ₽ за 1 млн токенов вход / выход.
    • Старое имя продолжит работать: запросы к нему будут уходить в Reasoning-версию, код менять не нужно.
    • Reasoning-версия рассуждает всегда. Отключить рассуждение или задать его уровень нельзя, reasoning_effort не влияет. Ход рассуждений приходит в поле reasoning_content.

22.09.2026

  • Добавлено:

    • Новый провайдер Selectel.
    • Новая модель от провайдера Selectel - Qwen/Qwen3.8-27B.
  • Изменено:

    • У Qwen/Qwen3.8-27B в карточке указан контекст 245 000 токенов - по меньшему из двух каналов, чтобы обещание выполнялось на обоих.
    • Картинки Qwen/Qwen3.8-27B принимает только через immers.cloud - в карточке модели значок мультимодальности теперь стоит у самого провайдера. Запрос с картинкой мы отправляем на тот канал, который её примет, ничего указывать не нужно.

21.09.2026

  • Анонсировано:
    • С 1 октября провайдер immers.cloud делает свои публичные модели платными. Ориентировочные цены, ₽ за 1 млн токенов (вход / выход / кэшированный вход):
МодельВходВыходКэш
openai/gpt-oss-20b3,0014,004,00
Qwen/Qwen3.6-35B-A3B7,0040,001,00
google/gemma-4-26b-a4b-it7,5042,000,75
deepseek/deepseek-v4-flash-073119,0079,003,00
Qwen/Qwen3.8-27B24,00120,005,00
Qwen/Qwen3.6-27B56,00350,0010,00
  • По nvidia/Nemotron-3-Nano-30B-A3B и Qwen/Qwen3.5-35B-A3B провайдер цены пока не объявил - уточняем. Итоговые цены появятся в карточках моделей к 1 октября.

19.09.2026

  • Временно недоступно:
    • Модели провайдера immers.cloud снова недоступны. Мы уже работаем над восстановлением доступа. Рассчитываем вернуть его до конца следующей недели (27.09.2026), о возврате сообщим здесь отдельно. Извиняемся за доставленные неудобства.

18.09.2026

  • Восстановлено (21:45):

    • Доступ к моделям провайдера immers.cloud восстановлен. Решение временное - мы продолжаем разбираться в причинах, чтобы подобное отключение не повторилось. Извиняемся за доставленные неудобства.
  • Временно недоступно:

    • Модели провайдера immers.cloud временно недоступны. Если статус доступа изменится, сообщим здесь отдельно.

17.09.2026

  • Добавлено:
    • sber/gigachat-3-pro
    • ai-sage/GigaChat3.5-432B-A28B

09.09.2026

  • Удалено:
    • Qwen/Qwen3-235B-A22B-Instruct-2507 у провайдера MWS - модель остаётся у провайдера Yandex Cloud до 30 сентября

08.09.2026

  • Анонсировано:
    • 8 октября провайдер MWS отключает модель zai-org/GLM-5.2 - модель остаётся у провайдера Timeweb Cloud, но подорожает: 267,00 / 1120,00 ₽ за 1 млн токенов вход / выход вместо 178,12 / 746,64 ₽ у MWS
    • Замена от того же разработчика - zai-org/GLM-5.3 у MWS, по цене нынешней GLM-5.2

03.09.2026

  • Анонсировано:
    • 30 сентября провайдер Yandex Cloud отключает модель Qwen/Qwen3-235B-A22B-Instruct-2507. Вместе с уходом этой модели у MWS 9 сентября она станет недоступна полностью
    • 30 октября провайдер Yandex Cloud отключает модели openai/gpt-oss-20b и openai/gpt-oss-120b - обе остаются у других провайдеров
    • 31 октября провайдер Sber GigaChat прекращает работу GigaChat API. Часть моделей линейки останется доступна через провайдера Cloud.ru; какие именно - уточняем и сообщим отдельно

02.09.2026

  • Анонсировано:
    • 9 сентября провайдер MWS отключает модель Qwen/Qwen3-235B-A22B-Instruct-2507 - модель остаётся у провайдера Yandex Cloud

31.08.2026

  • Добавлено:
    • ai-sage/GigaAM-v3 - модель распознавания речи.

30.08.2026

  • Изменено:
    • Суточный лимит бесплатных моделей теперь растёт с уровнем аккаунта:
Уровень лимитаБылоСтало
0250250
11000500
210001000
310002000

27.08.2026

  • Добавлено:

    • Бесплатные текстовые модели: deepseek/deepseek-v4-flash-0731, Qwen/Qwen3.5-35B-A3B, Qwen/Qwen3.6-27B, Qwen/Qwen3.8-27B
  • Изменено:

    • У моделей nvidia/Nemotron-3-Nano-30B-A3B и Qwen/Qwen3.5-35B-A3B на канале immers.cloud проставлен бейдж квантования INT4
    • Обновлены цены канала Timeweb Cloud. Ставки за 1 млн токенов, вход / выход:
МодельПредыдущая ценаНовая цена
zai-org/GLM-5.22318,00 / 2318,00 ₽267,00 / 1120,00 ₽
openai/gpt-oss-120b68,00 / 67,50 ₽20,00 / 82,00 ₽

26.08.2026

  • Удалено:
    • Бесплатные текстовые модели: deepseek/deepseek-v4-flash-0731 и Qwen/Qwen3.5-35B-A3B - канал immers.cloud снял их публичные эндпоинты

24.08.2026

  • Удалено:
    • Бесплатные текстовые модели: Qwen/Qwen3.6-27B и Qwen/Qwen3.8-27B
    • Бесплатный канал immers.cloud у модели openai/gpt-oss-20b - модель остаётся на канале Yandex Cloud

21.08.2026

  • Изменено:
    • Обновлены цены канала MWS. Ставки за 1 млн токенов, вход / выход:
МодельПредыдущая ценаНовая цена
openai/gpt-oss-120b3,40 / 13,50 ₽13,42 / 54,90 ₽
zai-org/GLM-5.2115,00 / 463,00 ₽178,12 / 746,64 ₽
Qwen/Qwen3-235B-A22B-Instruct-250761,00 / 244,00 ₽79,30 / 320,86 ₽
Qwen/Qwen3.6-35B-A3B54,00 / 219,00 ₽70,76 / 283,04 ₽
google/gemma-4-31b-it54,00 / 219,00 ₽56,12 / 224,48 ₽
moonshotai/Kimi-K2.6183,00 / 732,00 ₽157,38 / 652,70 ₽

У моделей с несколькими каналами цены остальных каналов не изменились - актуальные ставки каждого канала видны в каталоге.

19.08.2026

  • Изменено:
    • Бесплатные модели на уровне 0 (аккаунт без пополнений) - суточный лимит поднят с 50 до 250 запросов. Минутный лимит (20 запросов/мин) и лимиты остальных уровней не изменились.

18.08.2026

  • Добавлено:
    • Бесплатная модель Qwen/Qwen3.8-27B - контекст 262K, распознавание изображений, вызов функций и структурированный ответ.
  • Изменено:
    • У моделей Qwen/Qwen3.8-27B, Qwen/Qwen3.6-27B и Qwen/Qwen3.6-35B-A3B на канале immers.cloud заработало размышление. Раньше оно было отключено, теперь включено по умолчанию: ход рассуждений приходит в reasoning_content, уровень задаётся reasoning_effort (low, medium, high), выключить можно через reasoning_options (mode: DISABLED) - подробности в разделе «Рассуждение моделей».

17.08.2026

  • Добавлено:
    • Три бесплатные модели: deepseek/deepseek-v4-flash-0731, Qwen/Qwen3.6-35B-A3B и Qwen/Qwen3.6-27B. У DeepSeek рассуждение по умолчанию выключено. Для сложных задач оно включается параметром reasoning_effort (low/medium/high), ход рассуждений приходит в reasoning_content;
    • Значки квантования (NVFP4, INT4) у каналов в каталоге: сжатая версия модели быстрее и дешевле в размещении, но может отвечать чуть слабее полной;
    • Обновлена смена пароля на странице «Аккаунт»;
    • Переключатель Стоимость / Объём на графике «Использование»: если вы пользуетесь бесплатными моделями, график стоимости пуст - теперь расход виден в токенах, а у нетокенных моделей в минутах, символах или штуках.
  • Исправлено:
  • Удалено:
    • yandex/yandex-art (YandexART 2.0) - Яндекс выводит модель 18.08.2026, запросы к ней перестанут работать. Перейдите на yandex/aliceai-image-art (Alice AI ART 3.0) - она уже в каталоге, достаточно поменять имя модели в запросе.

11.08.2026

10.08.2026

  • Изменено:
    • Страница «Использование» в личном кабинете переработана: разрезы по моделям / ключам / провайдерам, фильтры одним рядом чипов, серии в журнале, сортировка по всей выборке, выгрузка CSV, разбивка кэша на графике.
  • Исправлено:
    • Графики расходов режут сутки по местному времени пользователя - раньше столбики могли сдвигаться относительно журнала.

30.07.2026

  • Добавлено:
    • Раздел руководства «Рассуждение моделей»;
    • reasoning_effort у моделей GigaChat и счётчик токенов рассуждения в usage - подробности в новом разделе.
  • Изменено:
    • Ход рассуждений в обычном запросе теперь приходит в choices[0].message.reasoning_content (как в потоковом); прежнее имя reasoning не отдаётся.

28.07.2026

  • Добавлено:
    • usage.prompt_tokens_details.cached_tokens - сколько входных токенов пришло из кэша повторяющегося начала промпта;
    • Значок «Кэш» у моделей и каналов в каталоге, в подсказке - ставка за кэшированный вход;
    • Разбивка расхода «новый вход / из кэша / выход» на странице «Использование» в личном кабинете.
  • Изменено:
    • Там, где у канала есть отдельная ставка за кэшированный вход, он считается по ней - дешевле обычного входа. Где такой ставки нет, вход считается как раньше, по полной цене.

18.07.2026

  • Добавлено:
    • Платные дополнения к распознаванию речи Nexara на /v1/audio/transcriptions - включаются параметрами запроса, тарифицируются надбавкой к минуте:
      • диаризация (разделение по дикторам) - diarize=true (плюс num_speakers, diarization_setting);
      • определение ролей говорящих - roles (auto или список названий; только вместе с диаризацией);
      • фильтрация нецензурной лексики - profanity_filter=true.
    • nexara/speech-to-text-ru - модель распознавания Nexara, заточенная под русскую речь.
  • Изменено:
    • Распознавание Nexara теперь основной канал общей модели openai/whisper-large-v3 (резерв - Cloud.ru и MTS). Прежнее имя nexara/speech-to-text продолжает работать.

15.07.2026

  • Добавлена:
    • GLM-5.2 (MWS) - рассуждающая модель Z.ai, контекст 200K токенов.

04.07.2026

  • Изменено:

03.07.2026

  • Добавлено:
    • Заголовки x-ratelimit-limit-requests / x-ratelimit-remaining-requests / x-ratelimit-reset-requests на авторизованных ответах /v1 и честный Retry-After в каждом 429 (см. Лимиты);
    • GET /v1/key - уровень аккаунта, действующая сетка лимитов и бюджет ключа;
    • Страница «Лимиты» в личном кабинете;
    • Опубликована сетка лимитов по уровням.
  • Изменено:
    • Все отказы по лимитам теперь возвращают единый код 429 (раньше часть отвечала 503);
    • Оферта: новый п. 2.8 о технических лимитах (редакция от 03.07.2026).

02.07.2026

  • Добавлены:
    • Распознавание речи Yandex SpeechKit - синхронное (yandex/speech-to-text, записи до 30 с) и асинхронное (yandex/speech-to-text-async, до 40 мин, диаризация до 2 дикторов, пословные таймкоды, авто-определение языка).
  • Изменено:
    • Лимит загрузки аудио на /v1/audio/transcriptions поднят до 60 МБ; размер и длительность файла теперь проверяются по лимитам выбранной модели с понятной ошибкой 400 (см. список ошибок).

27.06.2026

  • Добавлены:
    • MiniMax M3 (Cloud.ru);
    • Анализ тональности речи (Palatine).
    • Gemma 3 27B (MWS)

26.06.2026

  • Удалена:
    • DeepSeek V3.2 (Yandex) - запросы автоматически перенаправляются на DeepSeek V4 Flash.

23.06.2026

  • Обновление линейки MWS. Добавлены:
    • Gemma 4 31B,
    • Kimi K2.6,
    • Qwen3.6 35B.
  • Удалены:
    • Qwen3 Coder 480B,
    • Qwen3 ASR,
    • Qwen3 TTS.

21.06.2026

  • Добавлены:
    • Улучшение и повышение разрешения фото (VK Cloud).

16.06.2026

  • Добавлена:
    • Синтез речи Qwen3 TTS (MWS, превью).
  • Удалена:
    • GLM-4.6

15.06.2026

  • Добавлены:
    • Генерация изображений Kandinsky (Sber);
    • Распознавание и синтез речи (VK Cloud).

14.06.2026

  • Добавлены типы моделей:
    • Синтез речи (Yandex SpeechKit v3);
    • Генерация изображений (YandexART, Alice);
    • Классификация текста (Yandex);
    • Детекторы ИИ-контента (GigaCheck, Sber).

13.06.2026

  • Добавлены провайдеры распознавания речи (STT) с вариантами диаризации:
    • Nexara,
    • Palatine,
    • T-Bank,
    • VK Cloud.

12.06.2026

  • Добавлены:
    • Qwen3.5 35B;
    • Gemma 4 26B;
    • Nemotron 3 Nano (Immers Cloud).

05.06.2026

  • Добавлена:
    • Qwen3 ASR (распознавание речи, MTS).

29.05.2026

  • Добавлены:
    • DeepSeek V4 Pro (Cloud.ru);
    • Kimi K2.6 (Cloud.ru);
    • GLM-5.1.

28.05.2026

  • Добавлены:
    • DeepSeek V4 Flash (Yandex);
    • Alice Flash;
    • Эмбеддинги Yandex v2;
    • Распознавание речи Whisper (Cloud.ru).

27.05.2026

  • Добавлены:
    • компьютерное зрение VK Cloud - 8 детекторов и OCR-моделей.

24.05.2026

  • Добавлены:
    • OCR Yandex (13 моделей: документы, таблицы, рукописный текст, паспорта и др.);
    • DeepSeek OCR.

17.05.2026

  • Добавлены:
    • YandexGPT Pro 5 и 5.1,
    • YandexGPT Lite 5.
  • Подключён новый провайдер Timeweb Cloud с моделями Yandex.

12.05.2026

  • Добавлены (Cloud.ru):
    • MiniMax M2.5,
    • Qwen3.5 397B,
    • Qwen3.6 35B,
    • VL-эмбеддеры,
    • Реранкеры Qwen3.

11.05.2026

  • Обновление моделей Cloud.ru. Удалены:
    • MiniMax M2,
    • Qwen3 Next 80B,
    • GLM-4.7 Flash,
    • вся линейка T-pro и T-lite.

27.04.2026

  • Добавлены:
    • Kimi K2 (MTS);
    • Gemma 3 27B (Cloud.ru).

11.04.2026

  • Добавлено распознавание речи:
    • Whisper (Cloud.ru),
    • SpeechKit (Yandex).

10.04.2026

  • Добавлены: GigaChat 2 Lite, Pro, Max (Sber).

06.04.2026

  • Добавлены:
    • DeepSeek V3.2,
    • Qwen3.5 35B (Yandex).

10.02.2026

  • Добавлены:
    • Модели Yandex (YandexGPT, Alice, Gemma 3),
    • Эмбеддинги Sber и Yandex.

08.02.2026

  • Запуск ЦАРЬ РОУТЕР. Стартовый каталог Cloud.ru: GigaChat, линейка GLM, Qwen3 (Coder/Next/Instruct), T-pro и T-lite, gpt-oss, а также эмбеддеры и реранкеры.

На этой странице

Редактировать на GitVerse