Современные конвейеры ИИ часто сжигают вычислительные ресурсы, используя генеративные модели с более чем 8B параметрами, просто чтобы ответить на такие вопросы, как: «Этот запрос в службу поддержки срочный?» «Нарушает ли этот комментарий политику модерации?» «Если этот запрос будет направлен в отдел выставления счетов или в техническую...
Современные конвейеры ИИ часто сжигают вычислительные ресурсы, используя генеративные модели с более чем 8B параметрами, просто чтобы ответить на такие вопросы, как:
«Этот запрос в службу поддержки срочный?»
«Нарушает ли этот комментарий политику модерации?»
«Должен ли этот запрос направляться в отдел выставления счетов или в отдел технической поддержки?»
Генерация авторегрессии для классификации приводит к высокой задержке (ожидание поточного декодирования), непредсказуемым ошибкам форматирования JSON и ненужным затратам.
Laya-cli — это высокопроизводительный интерфейс командной строки и демон-оболочка вокруг Laya, предоставляющий типизированные решения (выбор, оценка, ноль) за один проход вперед без авторегрессионной генерации токенов.
Ключевые возможности
Детерминированные типизированные выходные данные за один проход:
выбор: дискретные метки с калиброванными вероятностями.
Оценка: порядковые ожидаемые значения (например, приоритет от 1 до 5).
noul: Вероятность того, что утверждение верно.
Скорость: ~33 мс для одиночных прогнозов, ~7 мс для каждого элемента в пакетном режиме.
Резидентный демон: запустите Laya-Cli, чтобы сохранить веса в памяти, исключая холодный запуск для последующих вызовов CLI или подпроцесса.
Совместимость с конвейерами Unix: встроенная поддержка потоковой передачи для каналов JSON и JSONL.
Быстрая установка
установка УФ-инструмента Laya-Cli
# или: pip installlaya-cli
США
