История изменений
Все обновления ЦАРЬ РОУТЕР - добавление/удаление моделей, изменения API, исправления и новый функционал
02.10.2026
- Добавлено:
- Новый провайдер reg.cloud.
- Новая модель от провайдера reg.cloud -
Qwen/Qwen3.8-Flash-Next. Цена - 30 / 90 ₽ за 1 млн токенов вход / выход. Qwen/Qwen3.8-27Bновый провайдер - reg.cloud: 20 / 210 ₽ за 1 млн токенов вход / выход.
01.10.2026
-
Добавлено:
- Два типа API-ключа: «Вызов моделей» и «Просмотр баланса». Тип выбирается при создании ключа в личном кабинете и потом не меняется. Все ключи, созданные раньше, - «Вызов моделей».
GET /v1/balance- баланс аккаунта в рублях. Работает только с ключом «Просмотр баланса».- На странице ключей в личном кабинете - колонка «Последний запрос»: когда ключ последний раз вызывали.
- Новая модель от провайдера Yandex -
deepseek/DeepSeek-V4.1-Flash. - Полные карточки моделей в
GET /v1/modelsиGET /v1/models/{id}: контекст, что умеет модель, цены в рублях (от и до по провайдерам). ВGET /v1/models/{id}- ещё список провайдеров с их ценами и контекстом. Ответ отдаётETag: с заголовкомIf-None-Matchнеизменившийся список приходит ответом 304 без тела. - Дата добавления модели в каталог: сортировка «Дата добавления» на странице «Модели», в
llms.txtиllms-full.txt, полеadded_dateв/models.json, колонкаadded_date(последней) в/models.csv. - В каталоге моделей у текстовых моделей в карточке две цены - за входящие и за исходящие токены. Задержка по провайдерам теперь на странице модели.
- Новый раздел документации «Справочник API»: у каждого из 16 методов API своя страница - параметры, ответ, лимиты, ошибки с текстами, примеры на curl, Python и TypeScript. На главной странице раздела - типы ключей и таблица всех методов.
- Страница «Подключение OpenCode»: готовый конфиг со всеми текстовыми моделями скачивается одной командой -
https://tsarrouter.ru/api/opencode-config.
-
Изменено:
- Справочные запросы -
GET /v1/models,GET /v1/models/{id},GET /v1/balance,GET /v1/key- теперь считаются вместе: 120 запросов в минуту на аккаунт. Раньше уGET /v1/modelsбыло до 1200 в минуту. ВGET /v1/keyиGET /v1/limitsпрежние поля этих лимитов заменены одним полемreference_rpm. GET /v1/key: у ключа без лимита расходов полеavailable_rubтеперьnull- раньше там был баланс аккаунта. Баланс теперь отдаётGET /v1/balance. В ответ добавлено полеscopes- тип ключа.- Текст ошибки 402 у ключей из личного кабинета больше не называет баланс аккаунта.
GET /v1/modelsиGET /v1/models/{id}с отключённым ключом отвечают 403, с просроченным - 401, как остальные методы. Раньше эти методы такому ключу отвечали.- Заголовок
X-TsarRouter-Attempts(цепочка попыток по провайдерам) больше не отдаётся. Кто исполнил запрос, по-прежнему видно вX-TsarRouter-ProviderиX-TsarRouter-Model. GET /v1/models: у моделей появилось полеname. Клиенты, которые его показывают (например, Open WebUI), будут показывать название модели вместо её идентификатора. Выключенные модели больше не попадают в список,GET /v1/models/{id}по ним отвечает 404. Полеcreated- дата появления модели в ЦАРЬ РОУТЕР.GET /v1/models/{id}по старому имени переименованной модели отдаёт карточку новой модели с её именем вid.ai-sage/GigaChat3.5-432B-A28Bзаменена наai-sage/GigaChat3.5-432B-A28B-Reasoning, старое имя тоже ведёт в неё.- Если прервать стрим до конца ответа, оплачиваются токены, отданные до обрыва, - теперь с учётом описаний инструментов (
tools) и аргументов их вызовов. - Конфиг OpenCode: провайдер называется
tsarrouter(былоtsar_router), имена моделей начинаются сtsarrouter/. Если скачивали конфиг раньше, скачайте заново.
- Справочные запросы -
-
Удалено:
Qwen/Qwen3.5-35B-A3B.nvidia/Nemotron-3-Nano-30B-A3B.
-
Временно недоступно:
- Переход моделей провайдера immers.cloud на платный доступ, анонсированный 21.09, откладывается. Модели провайдера пока недоступны:
google/gemma-4-26b-a4b-it,deepseek/deepseek-v4-flash-0731иQwen/Qwen3.6-27B. О сроках сообщим здесь отдельно.
- Переход моделей провайдера immers.cloud на платный доступ, анонсированный 21.09, откладывается. Модели провайдера пока недоступны:
30.09.2026
- Удалено:
Qwen/Qwen3-235B-A22B-Instruct-2507- провайдер Yandex Cloud отключил модель 30.09.2026 в 13:08 МСК. Других провайдеров у неё не было, модель снята. Замена -deepseek/deepseek-v4-flash,yandex/aliceai-llmилиyandex/aliceai-llm-flash
23.09.2026
- Анонсировано:
- 1 октября
ai-sage/GigaChat3.5-432B-A28Bзаменяется наai-sage/GigaChat3.5-432B-A28B-Reasoning: 5 октября провайдер Cloud.ru отключает обычную версию. Цена та же - 96,22 / 288,60 ₽ за 1 млн токенов вход / выход. - Старое имя продолжит работать: запросы к нему будут уходить в Reasoning-версию, код менять не нужно.
- Reasoning-версия рассуждает всегда. Отключить рассуждение или задать его уровень нельзя,
reasoning_effortне влияет. Ход рассуждений приходит в полеreasoning_content.
- 1 октября
22.09.2026
-
Добавлено:
- Новый провайдер Selectel.
- Новая модель от провайдера Selectel -
Qwen/Qwen3.8-27B.
-
Изменено:
- У
Qwen/Qwen3.8-27Bв карточке указан контекст 245 000 токенов - по меньшему из двух каналов, чтобы обещание выполнялось на обоих. - Картинки
Qwen/Qwen3.8-27Bпринимает только через immers.cloud - в карточке модели значок мультимодальности теперь стоит у самого провайдера. Запрос с картинкой мы отправляем на тот канал, который её примет, ничего указывать не нужно.
- У
21.09.2026
- Анонсировано:
- С 1 октября провайдер immers.cloud делает свои публичные модели платными. Ориентировочные цены, ₽ за 1 млн токенов (вход / выход / кэшированный вход):
| Модель | Вход | Выход | Кэш |
|---|---|---|---|
openai/gpt-oss-20b | 3,00 | 14,00 | 4,00 |
Qwen/Qwen3.6-35B-A3B | 7,00 | 40,00 | 1,00 |
google/gemma-4-26b-a4b-it | 7,50 | 42,00 | 0,75 |
deepseek/deepseek-v4-flash-0731 | 19,00 | 79,00 | 3,00 |
Qwen/Qwen3.8-27B | 24,00 | 120,00 | 5,00 |
Qwen/Qwen3.6-27B | 56,00 | 350,00 | 10,00 |
- По
nvidia/Nemotron-3-Nano-30B-A3BиQwen/Qwen3.5-35B-A3Bпровайдер цены пока не объявил - уточняем. Итоговые цены появятся в карточках моделей к 1 октября.
19.09.2026
- Временно недоступно:
- Модели провайдера immers.cloud снова недоступны. Мы уже работаем над восстановлением доступа. Рассчитываем вернуть его до конца следующей недели (27.09.2026), о возврате сообщим здесь отдельно. Извиняемся за доставленные неудобства.
18.09.2026
-
Восстановлено (21:45):
- Доступ к моделям провайдера immers.cloud восстановлен. Решение временное - мы продолжаем разбираться в причинах, чтобы подобное отключение не повторилось. Извиняемся за доставленные неудобства.
-
Временно недоступно:
- Модели провайдера immers.cloud временно недоступны. Если статус доступа изменится, сообщим здесь отдельно.
17.09.2026
- Добавлено:
sber/gigachat-3-proai-sage/GigaChat3.5-432B-A28B
09.09.2026
- Удалено:
Qwen/Qwen3-235B-A22B-Instruct-2507у провайдера MWS - модель остаётся у провайдера Yandex Cloud до 30 сентября
08.09.2026
- Анонсировано:
- 8 октября провайдер MWS отключает модель
zai-org/GLM-5.2- модель остаётся у провайдера Timeweb Cloud, но подорожает: 267,00 / 1120,00 ₽ за 1 млн токенов вход / выход вместо 178,12 / 746,64 ₽ у MWS - Замена от того же разработчика -
zai-org/GLM-5.3у MWS, по цене нынешней GLM-5.2
- 8 октября провайдер MWS отключает модель
03.09.2026
- Анонсировано:
- 30 сентября провайдер Yandex Cloud отключает модель
Qwen/Qwen3-235B-A22B-Instruct-2507. Вместе с уходом этой модели у MWS 9 сентября она станет недоступна полностью - 30 октября провайдер Yandex Cloud отключает модели
openai/gpt-oss-20bиopenai/gpt-oss-120b- обе остаются у других провайдеров - 31 октября провайдер Sber GigaChat прекращает работу GigaChat API. Часть моделей линейки останется доступна через провайдера Cloud.ru; какие именно - уточняем и сообщим отдельно
- 30 сентября провайдер Yandex Cloud отключает модель
02.09.2026
- Анонсировано:
- 9 сентября провайдер MWS отключает модель
Qwen/Qwen3-235B-A22B-Instruct-2507- модель остаётся у провайдера Yandex Cloud
- 9 сентября провайдер MWS отключает модель
31.08.2026
- Добавлено:
ai-sage/GigaAM-v3- модель распознавания речи.
30.08.2026
- Изменено:
- Суточный лимит бесплатных моделей теперь растёт с уровнем аккаунта:
| Уровень лимита | Было | Стало |
|---|---|---|
| 0 | 250 | 250 |
| 1 | 1000 | 500 |
| 2 | 1000 | 1000 |
| 3 | 1000 | 2000 |
27.08.2026
-
Добавлено:
- Бесплатные текстовые модели:
deepseek/deepseek-v4-flash-0731,Qwen/Qwen3.5-35B-A3B,Qwen/Qwen3.6-27B,Qwen/Qwen3.8-27B
- Бесплатные текстовые модели:
-
Изменено:
- У моделей
nvidia/Nemotron-3-Nano-30B-A3BиQwen/Qwen3.5-35B-A3Bна канале immers.cloud проставлен бейдж квантования INT4 - Обновлены цены канала Timeweb Cloud. Ставки за 1 млн токенов, вход / выход:
- У моделей
| Модель | Предыдущая цена | Новая цена |
|---|---|---|
zai-org/GLM-5.2 | 2318,00 / 2318,00 ₽ | 267,00 / 1120,00 ₽ |
openai/gpt-oss-120b | 68,00 / 67,50 ₽ | 20,00 / 82,00 ₽ |
26.08.2026
- Удалено:
- Бесплатные текстовые модели:
deepseek/deepseek-v4-flash-0731иQwen/Qwen3.5-35B-A3B- канал immers.cloud снял их публичные эндпоинты
- Бесплатные текстовые модели:
24.08.2026
- Удалено:
- Бесплатные текстовые модели:
Qwen/Qwen3.6-27BиQwen/Qwen3.8-27B - Бесплатный канал immers.cloud у модели
openai/gpt-oss-20b- модель остаётся на канале Yandex Cloud
- Бесплатные текстовые модели:
21.08.2026
- Изменено:
- Обновлены цены канала MWS. Ставки за 1 млн токенов, вход / выход:
| Модель | Предыдущая цена | Новая цена |
|---|---|---|
openai/gpt-oss-120b | 3,40 / 13,50 ₽ | 13,42 / 54,90 ₽ |
zai-org/GLM-5.2 | 115,00 / 463,00 ₽ | 178,12 / 746,64 ₽ |
Qwen/Qwen3-235B-A22B-Instruct-2507 | 61,00 / 244,00 ₽ | 79,30 / 320,86 ₽ |
Qwen/Qwen3.6-35B-A3B | 54,00 / 219,00 ₽ | 70,76 / 283,04 ₽ |
google/gemma-4-31b-it | 54,00 / 219,00 ₽ | 56,12 / 224,48 ₽ |
moonshotai/Kimi-K2.6 | 183,00 / 732,00 ₽ | 157,38 / 652,70 ₽ |
У моделей с несколькими каналами цены остальных каналов не изменились - актуальные ставки каждого канала видны в каталоге.
19.08.2026
- Изменено:
- Бесплатные модели на уровне 0 (аккаунт без пополнений) - суточный лимит поднят с 50 до 250 запросов. Минутный лимит (20 запросов/мин) и лимиты остальных уровней не изменились.
18.08.2026
- Добавлено:
- Бесплатная модель
Qwen/Qwen3.8-27B- контекст 262K, распознавание изображений, вызов функций и структурированный ответ.
- Бесплатная модель
- Изменено:
- У моделей
Qwen/Qwen3.8-27B,Qwen/Qwen3.6-27BиQwen/Qwen3.6-35B-A3Bна канале immers.cloud заработало размышление. Раньше оно было отключено, теперь включено по умолчанию: ход рассуждений приходит вreasoning_content, уровень задаётсяreasoning_effort(low, medium, high), выключить можно черезreasoning_options(mode: DISABLED) - подробности в разделе «Рассуждение моделей».
- У моделей
17.08.2026
- Добавлено:
- Три бесплатные модели:
deepseek/deepseek-v4-flash-0731,Qwen/Qwen3.6-35B-A3BиQwen/Qwen3.6-27B. У DeepSeek рассуждение по умолчанию выключено. Для сложных задач оно включается параметромreasoning_effort(low/medium/high), ход рассуждений приходит вreasoning_content; - Значки квантования (NVFP4, INT4) у каналов в каталоге: сжатая версия модели быстрее и дешевле в размещении, но может отвечать чуть слабее полной;
- Обновлена смена пароля на странице «Аккаунт»;
- Переключатель Стоимость / Объём на графике «Использование»: если вы пользуетесь бесплатными моделями, график стоимости пуст - теперь расход виден в токенах, а у нетокенных моделей в минутах, символах или штуках.
- Три бесплатные модели:
- Исправлено:
- Фильтр «Кэш» в каталоге
- Удалено:
yandex/yandex-art(YandexART 2.0) - Яндекс выводит модель 18.08.2026, запросы к ней перестанут работать. Перейдите наyandex/aliceai-image-art(Alice AI ART 3.0) - она уже в каталоге, достаточно поменять имя модели в запросе.
11.08.2026
- Добавлено:
- Разделы руководства «Сколько стоит запрос» и «Выбор канала и надёжность».
- Изменено:
GET /v1/keyиGET /v1/limitsбольше не отдают служебные поляis_serviceиenforcement;- Заголовки
X-TsarRouter-*теперь читаются браузерными клиентами (добавлены в CORS).
10.08.2026
- Изменено:
- Страница «Использование» в личном кабинете переработана: разрезы по моделям / ключам / провайдерам, фильтры одним рядом чипов, серии в журнале, сортировка по всей выборке, выгрузка CSV, разбивка кэша на графике.
- Исправлено:
- Графики расходов режут сутки по местному времени пользователя - раньше столбики могли сдвигаться относительно журнала.
30.07.2026
- Добавлено:
- Раздел руководства «Рассуждение моделей»;
reasoning_effortу моделей GigaChat и счётчик токенов рассуждения вusage- подробности в новом разделе.
- Изменено:
- Ход рассуждений в обычном запросе теперь приходит в
choices[0].message.reasoning_content(как в потоковом); прежнее имяreasoningне отдаётся.
- Ход рассуждений в обычном запросе теперь приходит в
28.07.2026
- Добавлено:
usage.prompt_tokens_details.cached_tokens- сколько входных токенов пришло из кэша повторяющегося начала промпта;- Значок «Кэш» у моделей и каналов в каталоге, в подсказке - ставка за кэшированный вход;
- Разбивка расхода «новый вход / из кэша / выход» на странице «Использование» в личном кабинете.
- Изменено:
- Там, где у канала есть отдельная ставка за кэшированный вход, он считается по ней - дешевле обычного входа. Где такой ставки нет, вход считается как раньше, по полной цене.
18.07.2026
- Добавлено:
- Платные дополнения к распознаванию речи Nexara на
/v1/audio/transcriptions- включаются параметрами запроса, тарифицируются надбавкой к минуте:- диаризация (разделение по дикторам) -
diarize=true(плюсnum_speakers,diarization_setting); - определение ролей говорящих -
roles(autoили список названий; только вместе с диаризацией); - фильтрация нецензурной лексики -
profanity_filter=true.
- диаризация (разделение по дикторам) -
nexara/speech-to-text-ru- модель распознавания Nexara, заточенная под русскую речь.
- Платные дополнения к распознаванию речи Nexara на
- Изменено:
- Распознавание Nexara теперь основной канал общей модели
openai/whisper-large-v3(резерв - Cloud.ru и MTS). Прежнее имяnexara/speech-to-textпродолжает работать.
- Распознавание Nexara теперь основной канал общей модели
15.07.2026
- Добавлена:
- GLM-5.2 (MWS) - рассуждающая модель Z.ai, контекст 200K токенов.
04.07.2026
- Изменено:
- Сетка лимитов по уровням теперь действует - запросы сверх лимита получают
429. Ваши актуальные лимиты - на странице «Лимиты» в личном кабинете и черезGET /v1/key.
- Сетка лимитов по уровням теперь действует - запросы сверх лимита получают
03.07.2026
- Добавлено:
- Заголовки
x-ratelimit-limit-requests/x-ratelimit-remaining-requests/x-ratelimit-reset-requestsна авторизованных ответах/v1и честныйRetry-Afterв каждом429(см. Лимиты); GET /v1/key- уровень аккаунта, действующая сетка лимитов и бюджет ключа;- Страница «Лимиты» в личном кабинете;
- Опубликована сетка лимитов по уровням.
- Заголовки
- Изменено:
- Все отказы по лимитам теперь возвращают единый код
429(раньше часть отвечала503); - Оферта: новый п. 2.8 о технических лимитах (редакция от 03.07.2026).
- Все отказы по лимитам теперь возвращают единый код
02.07.2026
- Добавлены:
- Распознавание речи Yandex SpeechKit - синхронное (
yandex/speech-to-text, записи до 30 с) и асинхронное (yandex/speech-to-text-async, до 40 мин, диаризация до 2 дикторов, пословные таймкоды, авто-определение языка).
- Распознавание речи Yandex SpeechKit - синхронное (
- Изменено:
- Лимит загрузки аудио на
/v1/audio/transcriptionsподнят до 60 МБ; размер и длительность файла теперь проверяются по лимитам выбранной модели с понятной ошибкой 400 (см. список ошибок).
- Лимит загрузки аудио на
27.06.2026
- Добавлены:
- MiniMax M3 (Cloud.ru);
- Анализ тональности речи (Palatine).
- Gemma 3 27B (MWS)
26.06.2026
- Удалена:
- DeepSeek V3.2 (Yandex) - запросы автоматически перенаправляются на DeepSeek V4 Flash.
23.06.2026
- Обновление линейки MWS. Добавлены:
- Gemma 4 31B,
- Kimi K2.6,
- Qwen3.6 35B.
- Удалены:
- Qwen3 Coder 480B,
- Qwen3 ASR,
- Qwen3 TTS.
21.06.2026
- Добавлены:
- Улучшение и повышение разрешения фото (VK Cloud).
16.06.2026
- Добавлена:
- Синтез речи Qwen3 TTS (MWS, превью).
- Удалена:
- GLM-4.6
15.06.2026
- Добавлены:
- Генерация изображений Kandinsky (Sber);
- Распознавание и синтез речи (VK Cloud).
14.06.2026
- Добавлены типы моделей:
- Синтез речи (Yandex SpeechKit v3);
- Генерация изображений (YandexART, Alice);
- Классификация текста (Yandex);
- Детекторы ИИ-контента (GigaCheck, Sber).
13.06.2026
- Добавлены провайдеры распознавания речи (STT) с вариантами диаризации:
- Nexara,
- Palatine,
- T-Bank,
- VK Cloud.
12.06.2026
- Добавлены:
- Qwen3.5 35B;
- Gemma 4 26B;
- Nemotron 3 Nano (Immers Cloud).
05.06.2026
- Добавлена:
- Qwen3 ASR (распознавание речи, MTS).
29.05.2026
- Добавлены:
- DeepSeek V4 Pro (Cloud.ru);
- Kimi K2.6 (Cloud.ru);
- GLM-5.1.
28.05.2026
- Добавлены:
- DeepSeek V4 Flash (Yandex);
- Alice Flash;
- Эмбеддинги Yandex v2;
- Распознавание речи Whisper (Cloud.ru).
27.05.2026
- Добавлены:
- компьютерное зрение VK Cloud - 8 детекторов и OCR-моделей.
24.05.2026
- Добавлены:
- OCR Yandex (13 моделей: документы, таблицы, рукописный текст, паспорта и др.);
- DeepSeek OCR.
17.05.2026
- Добавлены:
- YandexGPT Pro 5 и 5.1,
- YandexGPT Lite 5.
- Подключён новый провайдер Timeweb Cloud с моделями Yandex.
12.05.2026
- Добавлены (Cloud.ru):
- MiniMax M2.5,
- Qwen3.5 397B,
- Qwen3.6 35B,
- VL-эмбеддеры,
- Реранкеры Qwen3.
11.05.2026
- Обновление моделей Cloud.ru. Удалены:
- MiniMax M2,
- Qwen3 Next 80B,
- GLM-4.7 Flash,
- вся линейка T-pro и T-lite.
27.04.2026
- Добавлены:
- Kimi K2 (MTS);
- Gemma 3 27B (Cloud.ru).
11.04.2026
- Добавлено распознавание речи:
- Whisper (Cloud.ru),
- SpeechKit (Yandex).
10.04.2026
- Добавлены: GigaChat 2 Lite, Pro, Max (Sber).
06.04.2026
- Добавлены:
- DeepSeek V3.2,
- Qwen3.5 35B (Yandex).
10.02.2026
- Добавлены:
- Модели Yandex (YandexGPT, Alice, Gemma 3),
- Эмбеддинги Sber и Yandex.
08.02.2026
- Запуск ЦАРЬ РОУТЕР. Стартовый каталог Cloud.ru: GigaChat, линейка GLM, Qwen3 (Coder/Next/Instruct), T-pro и T-lite, gpt-oss, а также эмбеддеры и реранкеры.