Ответ — метка и вероятность, а не текст

Не каждый вопрос к модели — это разговор

Вы подаёте текст и список вопросов о нём. Модель отвечает на каждый одной из ваших же меток и говорит, насколько в ней уверена. Разбирать ответ не нужно — он сразу ложится в условие.

Что поданоО чём спросилиЧто ответила модель
«Заказ ждал три недели, деньги списали сразу» Это жалоба? да — уверенность 0,97
«Не приходит код подтверждения при входе» В какой отдел: оплата, доставка, доступ? доступ — уверенность 0,88
Карточка «Чехол силиконовый прозрачный» по запросу «защитное стекло» Насколько результат подходит запросу, от 1 до 5? 2 — уверенность 0,74

Вероятность при метке — не украшение. Она позволяет провести границу: выше порога решает модель, ниже — человек. У ответа словами такой границы нет вовсе, и провести её постфактум не по чему.

Запрос

Один текст — сколько угодно вопросов

Текст читается один раз, ответов приходит столько, сколько вопросов вы задали. Ключи вопросов выбираете вы — под теми же именами вернутся ответы.

terminal — bash
curl https://openrusrouter.ru/v1/systemone \
  -H "Authorization: Bearer orr_live_ВАШ_КЛЮЧ" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "typesafe/jev-latest",
    "state": "Order #1481 arrived broken. I want my money back, not a replacement.",
    "questions": {
      "refund": {"type": "noul", "instructions": "The customer asks for a refund."},
      "tone": {"type": "choice", "instructions": "Tone of the message.",
               "criteria": {"calm": "neutral wording", "angry": "hostile wording"}},
      "urgency": {"type": "score", "instructions": "How urgent is the request?",
                  "criteria": ["low", "medium", "high"]}
    }
  }'
Это не чат: у маршрута собственный формат запроса, потоковой отдачи нет, и обычный чат-клиент сюда не подойдёт. Адрес и ключ — те же, что у остальных маршрутов сервиса.
Цена

Вы платите один раз, а не два

Обычная модель берёт деньги дважды: за чтение вашего текста и за сочинение ответа словами. Здесь платится только чтение — ответ выбирается из ваших меток, сочинять нечего.

МодельВход, ₽/1MВыход, ₽/1M
typesafe/jev-latest Jev (последняя версия) 4,82 не тарифицируется
typesafe/jev-1.13.0 Jev 1.13 4,82 не тарифицируется
openai/gpt-5-nano OpenAI: GPT-5 Nano — обычная чат-модель 5,74 45,92

Цены по базовому тарифу и расчётному курсу 84,0954 ₽ за доллар США на 21.09.2026. Посчитайте на своей задаче: разметка миллиона токенов обращений у чат-модели складывается из двух колонок сразу, здесь же счёт заканчивается на первой. Чем короче вопрос и длиннее текст, тем заметнее разница — у второй колонки нет предмета.

Где модель работает хуже — проверьте до внедрения

Основной язык модели — английский. На русских текстах качество заметно ниже, насколько именно — зависит от вашей задачи, и общего ответа здесь нет. Способ узнать один: возьмите два-три десятка своих обращений, разметьте их руками и прогоните через модель. Это полчаса работы и несколько рублей по тарифу выше — дешевле любого решения, принятого по описанию на сайте. Если качество на вашей выборке не устроило, тот же текст можно подать на английском: перевод обращения обычной моделью стоит дешевле разбора его же человеком.

Чего модель не делает вовсе, по устройству, а не по недоработке: не считает и не сравнивает числа, не сопоставляет даты, читает инструкции буквально и не додумывает за вас, не генерирует текст. На большом состоянии с нерелевантными подробностями качество ответов падает — подавайте то, что относится к вопросу, а не всю переписку целиком.

Ответы на арифметику, даты и «напиши текст» остаются за обычными моделями — они у сервиса те же и доступны тем же ключом.

Применения

Где это заменяет чат-модель

Везде, где от модели нужен не текст, а решение — и желательно с уверенностью при нём.

Классификация обращений
Жалоба, вопрос по оплате, предложение о сотрудничестве. Одна метка на обращение и вероятность при ней — спорные уходят человеку, остальные разбираются сами.
Роутинг интентов
Куда направить письмо или звонок. Список отделов вы задаёте сами в том же запросе, менять его можно без переобучения и без правки промптов.
Модерация
Оскорбления, спам, запрещённая тематика. Порог уверенности задаёте вы: выше — скрываем сразу, ниже — в очередь на просмотр.
Ре-ранкинг поиска
Оценка по шкале «насколько результат подходит запросу» для каждой позиции выдачи. Дёшево настолько, что можно прогонять всю выдачу, а не первую пятёрку.
Проверка цитат
Подтверждается ли утверждение приложенным фрагментом. Ответ «да/нет» с вероятностью — то, что нужно, чтобы отсечь выдумки другой модели.
Извлечение полей
Тип документа, срочность, тональность, наличие персональных данных. Несколько вопросов о тексте в одном запросе — текст при этом читается один раз.
Вопросы

Часто спрашивают

Обычная модель отвечает текстом: его нужно разбирать в коде, и уверенности модели в своём ответе он не несёт. Jev отвечает меткой из списка, который вы задали сами, и вероятностью при ней — такой ответ сразу ложится в условие. Маршрут POST /v1/systemone — это не чат: у него собственный формат запроса и нет потоковой отдачи, обычный чат-клиент сюда не подойдёт.

Тарифицируются только входные токены — то, что модель прочитала. Ответ она не сочиняет: это одна из заранее перечисленных вами меток, генерировать нечего, и на выходе тарифицировать нечего тоже. Это устройство модели, а не временная акция. Действующая цена входа — в таблице выше и в полном прайсе.

Проверьте на своей выборке

Регистрация займёт минуту, ключ выпускается сразу. Десяти своих обращений хватит, чтобы понять, ваша это задача или нет.

Начать