Cloudflare lanzó el 1 de octubre de 2026 Clef y Clef-flash, dos modelos de IA de pesos abiertos que clasifican información y devuelven decisiones estructuradas para agentes. Admiten contenido visual y la compañía afirma que superan a Jev en velocidad y en varias pruebas de precisión. Ya están disponibles en Workers AI y Hugging Face, con un precio por token mayor que el de su rival.
Estos modelos reciben una situación y preguntas con respuestas delimitadas: sí o no, una opción entre categorías o una valoración en una escala. Devuelven probabilidades que el software puede usar para asignar una solicitud de soporte, escalar un caso o pedir revisión humana. Su función es resolver esos pasos de decisión dentro de una aplicación.
Como contamos en septiembre, Jev ya había llegado a Vercel y figuraba en la documentación de Cloudflare. Ahora la empresa ofrece sus propios modelos para esa capa de decisiones, con una API compatible con la de TypeSafe.
El soporte visual cambia según la vía de uso
Clef se basa en Qwen3.8-27B, con 27,000 millones de parámetros; Clef-flash parte de Qwen3.5-9B, con 9,000 millones. Ambos incorporan un codificador visual y puntúan las opciones permitidas sin generar una explicación intermedia token por token.
La distribución descargable documenta imágenes y video como secuencias de fotogramas. Para el servicio alojado, la API de Workers AI detalla hasta cuatro imágenes adjuntas por solicitud y no describe un campo de video en ese esquema. La capacidad del modelo y las entradas que expone el servicio son dos aspectos distintos.
Workers AI ofrece una ventana de contexto de 65,536 tokens y admite hasta 64 preguntas por solicitud. La compatibilidad con Jev facilita reutilizar el formato de preguntas y respuestas; el tratamiento del contenido visual depende de la vía elegida.
Más velocidad en sus pruebas, con un precio por token mayor
La comparación reúne las tarifas públicas de Cloudflare y TypeSafe, junto con las latencias medianas que Cloudflare reportó en 43 evaluaciones. Los tiempos son mediciones de la compañía, no una garantía para cualquier aplicación.
| Medida | Clef | Clef-flash | Jev |
|---|---|---|---|
| Precio por millón de tokens de entrada (USD) | 0.24 | 0.09 | 0.042 |
| Latencia mediana en pruebas de Cloudflare (ms) | 209.3 | 38.8 | 524.1 |
Las medianas publicadas equivalen a respuestas aproximadamente 2.5 veces más rápidas con Clef y 13 veces con Clef-flash frente a Jev. Para una misma cantidad de tokens de entrada, sus tarifas son unas 5.7 y 2.1 veces la de Jev, respectivamente. El costo final por tarea depende de los tokens que procese cada solicitud.
La ventaja de precisión tampoco fue uniforme. En las pruebas de Cloudflare sobre cuatro flujos de trabajo de TypeSafe, Clef superó a Jev en procesamiento de facturas, atención al cliente e incidentes de seguridad. Jev quedó por delante de ambas variantes en observabilidad de trazas de agentes, que evalúa registros de su actividad.
Ejecutarlos localmente exige memoria gráfica
Michelle Chen, responsable de producto de la plataforma de IA de Cloudflare, dijo a The Register que Clef requiere una GPU con 85 GB de memoria gráfica, mientras Clef-flash necesita 41 GB. Esos requisitos corresponden a una solicitud a la vez y una ventana de contexto de 64K tokens.
Los pesos se distribuyen bajo licencia Apache 2.0. Chen aclaró al medio que los conjuntos de datos de entrenamiento no son públicos: la apertura del modelo permite descargarlo y operarlo, mientras el material usado para entrenarlo permanece privado.
Cloudflare también anunció un servicio de ajuste mediante aprendizaje por refuerzo, inicialmente con apoyo de su equipo de ingeniería. La plataforma para que los clientes ajusten y vuelvan a desplegar los modelos por su cuenta queda para una etapa posterior.