Я спросил: да или нет?

Лаборатория decision models · прогоны 22 и 24 сентября 2026
Итоговый отчёт →
Запись реального запуска

Вероятности имеют разное происхождение. DeepSeek генерирует числа в JSON. У Laya здесь показана p выбранного класса, а не энтропийное поле confidence. Задержка: прогретый вызов на CPU или полный HTTP-запрос; ожидание между запросами Jev не включено.

Сначала Jev, затем DeepSeek

Порог ниже которого передаём решение DeepSeek: 0,90

Ретроспективный replay 100 исходных примеров. Ответы взяты из двух записанных прогонов. Стоимость и время каскада рассчитаны, каскад не измерялся отдельным сквозным запуском. Порог — иллюстрация, а не рекомендация для production.

Попробовать свой текст

Введи текст, выбери модель и отправь настоящий запрос. Для локальных моделей первый запуск включает загрузку весов и может занять около минуты.

Что проверяли и где границы

100 строк — это 41 двуязычный сюжет и 18 команд. Набор авторский и небольшой. Модели не дообучались. Перестановки и инъекции наследуют исходные примеры. Перефразировки добавлены после первого прогона. Из результатов нельзя выводить общий рейтинг моделей или гарантию безопасности.