Cloudflare Clef: Modelos de Decisão em 39ms para Agentes de IA

Alex da Cruz
Alex da Cruz é desenvolvedor full-stack em São Paulo. Trabalha com React, TypeScript e automação, e usa inteligência artificial no dia a dia para resolver problemas reais de código e de operação — não como demonstração. Já tocou uma operação de e-commerce de ponta a ponta e hoje constrói e mantém o pipeline de automação por trás deste blog. Escreve aqui sobre o que testa de fato.
Segundo a Cloudflare, os novos modelos de decisão Clef e Clef-flash eliminam a necessidade de intervenção humana em tarefas rotineiras de agentes de IA ao retornarem probabilidades estruturadas em vez de texto livre. Construídos sobre arquiteturas Qwen, os modelos atribuem chances a opções predefinidas, permitindo que sistemas executem ações de forma instantânea.
Qual é a velocidade real dos modelos Clef da Cloudflare?
A Cloudflare aponta um tempo de resposta mediano de 39 milissegundos para o Clef-flash e 209 milissegundos para o modelo Clef principal. Em testes comparativos, essa performance supera o modelo Jev da TypeSafe AI, que registra latência mediana superior a 524 milissegundos.
O o que muda para equipes de engenharia na prática?
Equipes de desenvolvimento podem rotear tickets de suporte, filtrar relatórios de abuso ou classificar fluxos de dados sem depender de grandes modelos de linguagem lentos. Processar a classificação completa de um site leva 2,2 segundos com o Clef, contra 4,7 segundos em LLMs tradicionais, cortando o tempo de espera pela metade em pipelines automatizados.
Ambos os modelos rodam diretamente na infraestrutura Workers AI da Cloudflare e estão disponíveis sob a licença Apache 2.0, permitindo que desenvolvedores integrem decisões estruturadas em aplicações de borda imediatamente.
Fontes
Perguntas frequentes
- O que é um modelo de decisão como o Cloudflare Clef?
- Um modelo de decisão atribui probabilidades a um conjunto de respostas predefinidas em vez de gerar texto livre. Essa estrutura permite que sistemas automatizados ajam de imediato com base nos resultados.
- Qual é a velocidade do Clef-flash em comparação com concorrentes?
- O Clef-flash entrega um tempo de resposta mediano de 39 milissegundos, superando a velocidade de modelos concorrentes de decisão no mercado.
Comentários
0 comentário
Seja o primeiro a comentar.
Continue Lendo

Modelos MAI da Microsoft trazem voz natural com latência de 100ms
A Microsoft lançou novos modelos de transcrição e voz com latência de 100ms e clonagem rápida para agentes de atendimento.

Manus 2.0: controle móvel, edição de vídeo e agentes
Manus 2.0 adiciona controle remoto via celular, edição de vídeo, hospedagem de jogos e reduz custos operacionais em 32 por cento.

Shopify libera checkout para agentes de IA no navegador
A Shopify agora permite que agentes de IA no navegador concluam compras no checkout usando ferramentas estruturadas do WebMCP.