Jaggedness модели Jev 1.13
Отсейте типы сбоев Jev 1.13 до выпуска вопроса.
Поиск
Семейство
9 режимов отказа
Буквальное прочтение
Точно сформулируйте условие в инструкциях и критериях.
Математика и числа
Выполняйте арифметику и подсчёты в коде.
Сравнение дат и времени
Извлекайте компоненты через Choice, а сравнивайте в коде.
Косвенность
Сократите число переходов и назовите нужное состояние.
Большой объём состояния с лишними подробностями
Сначала фильтруйте данные; передавайте только нужное для вопроса.
Враждебный контент
Задавайте точные критерии и проверяйте граничные случаи.
Противоречивые инструкции и критерии
Согласуйте критерии с инструкцией.
Очевидные структурные инварианты
Не считайте тождества Noul и Choice гарантированными.
Генерация
Используйте генеративную модель; не выстраивайте цепочку из Choice для написания текста.
Нет режимов отказа по этому запросу.
Jev 1.13 работает быстро, выдаёт калиброванные результаты и хорошо справляется с житейскими суждениями, но не идеальна. TypeSafe описывает девять типов сбоев jev-1.13; последняя проверка проведена 17 сентября 2026. Модель может воспринимать формулировки буквально, ошибаться в точных числах и ненадёжно работать с дополнительными уровнями косвенности. Фильтруйте список по названию или рекомендуемой замене, а арифметику, даты и генерацию не включайте в отправляемый вопрос.
Как пользоваться этим списком
Поиск проверяет название типа и текст рекомендуемой замены. Для каждой строки family имеет значение jev-1.13-failure-mode, а appliesTo — jev-1.13. Очистите строку поиска, чтобы снова увидеть все девять. По данным TypeSafe, многие из этих пограничных случаев будут исправлены в последующих версиях. До тех пор считайте столбец с заменой обязательным правилом для рабочих вопросов.
Буквальное прочтение: Jev отвечает на написанный вопрос, а не на подразумеваемый. Ограничивающие слова, отрицания и неявные условия трактуются буквально. Если вам приходится объяснять, что вы на самом деле имели в виду, добавьте это объяснение в инструкции и критерии. Неизбежное толкование разбивайте на два буквальных вопроса и объединяйте результаты кодом.
Математика и числа: Jev — не калькулятор. Модель ненадёжно считает символы, вхождения терминов и элементы длинных списков, причём с ростом набора точность падает. Названия на английском распознаются лучше шестнадцатеричных цветов и низкоуровневых кодировок. Не пытайтесь восстановить точное значение интерполяцией уровней Score. Выполняйте арифметику кодом; перебирайте кандидатов и задавайте по одному смысловому вопросу, а затем суммируйте результаты самостоятельно.
Даты, цепочки переходов, состояние и генерация
Сравнение дат и времени: Jev воспринимает даты как текст, а не как упорядоченные величины. Нельзя надёжно определить, какая дата раньше, каков интервал между ними и попадает ли одна из них в заданный период, особенно при смешении форматов и кварталов. Извлеките месяц, день и год через Choice, предусмотрев вариант «не указано», а затем соберите и сравните даты в коде.
Косвенность: двойные отрицания и вопросы о свойствах свойств снижают точность. Сократите число переходов и явно назовите нужное состояние. Большой объём состояния с лишними подробностями отвлекает модель — сначала отфильтруйте данные. Враждебный контент в состоянии может повлиять на ответы, поскольку состояние — это данные, а не доверенный пользователь. Задавайте точные критерии и проверяйте граничные случаи. Противоречия между инструкциями и критериями сбивают модель: согласуйте их и не сопоставляйте true с «нет».
Соблюдение очевидных структурных инвариантов не гарантируется. Ответы Noul и Choice на один вопрос о возврате средств могут различаться, а сумма Noul и его отрицания не обязательно равна единице. Формулируйте каждое решение одним способом. Генерация не поддерживается: цепочка из Choice для написания текста работает медленно и плохо. Предложите варианты с помощью генеративной модели или регулярного выражения, а выбор поручите Jev.
Перед публикацией вопроса
Прочитайте инструкцию вслух. Если для объяснения коллеге требуется ещё одно предложение, добавьте его в инструкцию. Укажите в критериях граничные случаи, включая явный вариант «нет» или «не указано» для Choices, извлекающих даты или значения перечислений.
Найдите в этом списке использованный глагол: посчитать, сравнить, сгенерировать, перейти, выгрузить. Обычно проблема связана с математикой и числами, сравнением дат и времени, генерацией, косвенностью или большим объёмом состояния. Враждебный контент важен, если состояние содержит недоверенный пользовательский текст, который обосновывает собственную метку.
Сохраните все девять записей в тестовых фикстурах. Модульный тест, проверяющий только успешный Choice, не выявит расхождение между Noul и Choice. TypeSafe в последний раз проверял этот каталог 17 сентября 2026; в более поздних версиях Jev список может сократиться, но jev-1.13.0 пока содержит все девять пунктов.
Держите этот список из девяти строк рядом при проверке промпта. Фильтр на странице использует тот же список: ищите по названию или строке с альтернативой, оставляя семейство jev-1.13-failure-mode. Если производственная ошибка не входит в девятку, она всё равно остаётся ошибкой, но не считается документированной слабой стороной jev-1.13.
Первой вы заметите ошибку буквального прочтения: модель сделала именно то, что вы написали. Ошибка математики проявится, когда кто-то попросит её посчитать. Ошибка генерации — когда кто-то выстроит цепочку из Choice для написания текста. Остальные шесть режимов обычно обнаруживаются после первой недели эксплуатации.
При ошибке сначала определите её режим и только потом переписывайте промпт. Если назвать режим не удаётся, возможно, это новая слабая сторона либо состояние по-прежнему содержит политику и заявку, слитые в одну строку.
У каждой строки тег семейства jev-1.13-failure-mode. Значение appliesTo — jev-1.13. Оба поля служат фильтрами, а не дополнительными режимами.
Источники