TypeSafe представила модель Jev для быстрой оценки вариантов вместо генерации текста

Jev выдаёт оценки и вероятности только для заранее заданных вариантов, а не пишет свободный ответ. TypeSafe обещает отклик за 70–500 мс, но её тесты охватывают четыре собственных сценария и не имеют независимо проверенных правильных ответов.

Модель выбирает из заданных вариантов

Стартап TypeSafe AI представил Jev — модель, которая должна оценивать варианты внутри программ, а не генерировать текст или код. Разработчик задаёт вопрос и перечень допустимых ответов, а Jev возвращает оценки и вероятности. Сооснователь TypeSafe Диогу Алмейда ранее работал в OpenAI и был одним из авторов исследования InstructGPT.

Пример: сортировка запроса на возврат

Интернет-магазин может передать Jev сообщение клиента о двойном списании. Модель определит тему как проблему оплаты и оценит, просит ли клиент возврат. Затем обычные правила магазина направят обращение в бухгалтерию или на проверку сотруднику. Jev не подтверждает, что списание действительно было двойным, и не возвращает деньги: для этого нужно сверить транзакции.

Быстро, но не обязательно правильно

TypeSafe заявляет задержку ответа от 70 до 500 миллисекунд и цену $0,042 за миллион входных токенов без платы за выход. Компания описывает проверки четырёх рабочих процессов, созданных самостоятельно; правильные ответы в них сопоставлялись с выводами других моделей, а не независимыми эталонами. GPT-6 Astra в сравнении отсутствовала.

Реклама Jev как модели, которая не может галлюцинировать, относится к формату: ответ ограничен заранее заданными вариантами. Неверно выбранная категория или вероятность остаётся возможной.

The Decoder — Former OpenAI researcher builds an AI model that judges options instead of writing text