Новые разделы!
ИИ, квантовые вычисления и много других интересных тем
03.10.2026
Cloudflare представила Clef и Clef-flash — модели, которые вместо свободного текста возвращают вероятности для заранее заданных вариантов действий. Веса опубликованы под лицензией Apache 2.0, а медианная задержка Clef-flash, по тестам компании, составляет 38,8 мс.
Инфраструктурная компания Cloudflare представила модели Clef и Clef-flash для принятия структурированных решений в системах с ИИ-агентами. Они получают контекст и набор допустимых вариантов, после чего возвращают типизированные ответы с вероятностями, не генерируя свободный текст.
Такой результат можно напрямую использовать в коде: например, для маршрутизации обращения в службу поддержки, запуска эскалации или передачи задачи человеку. Cloudflare считает, что в ограниченных заранее заданной схемой сценариях это позволяет агентам выполнять часть действий без обязательного ручного подтверждения.
Clef построена на Qwen3.8-27B, а Clef-flash — на Qwen3.5-9B. Базовые модели остаются замороженными, а варианты ответа оцениваются параллельно специализированным модулем без последовательной генерации токенов. Модели совместимы с API конкурирующей Jev и поддерживают обработку изображений.
По результатам собственных испытаний Cloudflare на 43 наборах задач, медианная задержка Clef-flash составила 38,8 мс, Clef — 209,3 мс, а Jev — 524,1 мс. Это данные разработчика, а не независимая оценка.
Модели доступны через платформу Workers AI, а их веса опубликованы на Hugging Face под лицензией Apache 2.0. Cloudflare также запускает услугу дообучения Clef с подкреплением; сначала настройкой будут заниматься инженеры компании, позднее планируется самостоятельная платформа для клиентов.
Источник: blog.cloudflare.com