Gestileerde vioolsleutel in een oranje bol op een witte achtergrond, de officiële Clef-afbeelding van Cloudflare.
Nieuws1 oktober · 18:383 min leestijd

Cloudflare publiceert Clef-modellen voor agentbesluiten

Clef en Clef-flash geven agenten gestructureerde classificaties met kansen. Cloudflare publiceert de modelgewichten en modelcode onder Apache 2.0, terwijl de RL-finetuning voorlopig een begeleide dienst is.

Cloudflare brengt Clef en Clef-flash uit als open beslismodellen voor classificatie en agentworkflows, gehost op Workers AI; de Clef-repository publiceert modelgewichten en modelcode onder Apache 2.0, en de Clef-flash-repository vermeldt dezelfde licentie en bestanden.

Voor een Nederlandse organisatie verandert daarmee de rol van een model in een workflow: Clef geeft vaste velden en kansen terug, zodat software bijvoorbeeld een supportbericht kan routeren, escaleren of aan een medewerker voorleggen. De eerste finetuning wordt begeleid door het technische team van Cloudflare; zelfbediening noemt het bedrijf als volgende stap.

Een beslislaag voor agenten

Een beslismodel geeft geen vrij tekstantwoord, maar beoordeelt vooraf gekozen uitkomsten. Bij een supportbericht kan Clef bijvoorbeeld urgentie, het juiste team en de ernst van de storing invullen. De workflow gebruikt die velden vervolgens om de volgende stap te kiezen.

Clef kan ook afbeeldingen classificeren en heeft een contextvenster van 64.000 tokens. Clef-flash is bedoeld voor beslissingen waarbij snelheid zwaarder weegt. In een test van Cloudflares Threat Intelligence-team duurde het ophalen, weergeven en classificeren van een website 2,2 seconden met Clef. Het algemene model gpt-oss-120b deed dezelfde taak in 4,7 seconden en gaf volgens Cloudflare maar twee classificaties terug.

Cloudflares eigen benchmarkgrafiek toont Clef en Clef-flash op beslisscore en mediane wachttijd. Bron: Cloudflare
Cloudflares eigen benchmarkgrafiek toont Clef en Clef-flash op beslisscore en mediane wachttijd. Bron: Cloudflare

In Cloudflares grafiek voor de Jev Decision Index scoort Clef 61,2 punten bij een mediane wachttijd van 209,3 milliseconden; Clef-flash haalt 57,1 punten bij 38,8 milliseconden. Cloudflare markeert de eigen resultaten als zelfgerapporteerd; de aankondiging noemt geen onafhankelijke prestatie-evaluatie.

Gewichten open, finetuning in opbouw

De twee openbare modelrepositories bevatten gewichtsbestanden en het Python-bestand joint_schema_model.py; beide repositories vermelden Apache 2.0. De release maakt daarmee de modellen lokaal testbaar. De aankondiging noemt geen aparte openbare repository of licentie voor de trainingscode of de RL-finetuningdienst.

Cloudflare biedt finetuning nu aan met een technisch team dat met klanten meewerkt. RL staat voor versterkingsleren: het systeem beoordeelt agentacties en past de modelgewichten aan. Het zelfbedieningsplatform moet later data verzamelen, het model trainen en het aangepaste model opnieuw uitrollen, allemaal op Cloudflare. In de beschreven opzet verzamelt AI Gateway verzoeken voor een trainingsdataset, maken Workers AI en Cloudflare Containers oefenrondes en scores voor agentacties, en past een nieuwe Trainer de gewichten aan. Cloudflare noemt deze platformonderdelen nog werk in uitvoering.

De release volgt op Cloudflare OS, de open-source AI-werkplek waar medewerkers apps en agenten bouwen, maar het is een afzonderlijke ontwikkeling. Cloudflare OS is een werkplek; Clef is een model voor vaste classificaties binnen software en agentsystemen. Daarmee kan een team de beslismodellen zelf verkennen, terwijl specifieke RL-finetuning voorlopig via Cloudflares dienstverlening loopt.

Veelgestelde vragen

Alisina Nawabi
Geschreven doorAlisina Nawabi

AI Product Engineer & Solutions Architect

Van model naar werkende agent

Ik denk mee over waar een beslismodel past, ontwerp de agentworkflow en realiseer die van begin tot eind. Waar het kan, automatiseer ik met software die op je eigen infrastructuur draait.

Meer informatie

Dit artikel is geproduceerd samen met het Agent Team. Meer over de redactie.

Gerelateerde artikelen

Cloudflare geeft AI-werkplek Cloudflare OS open source vrij
Nieuws
5 min

5 aug 22:25

Cloudflare geeft AI-werkplek Cloudflare OS open source vrij

Cloudflare geeft Cloudflare OS vrij onder Apache 2.0: de AI-werkplek waarop het bedrijf zelf draait, waarin elke medewerker in de browser apps bouwt en agents alleen bij bronnen komen die je expliciet vrijgeeft.

Snowflake stuurt AI-taken automatisch naar het goedkoopste model dat volstaat
Nieuws
5 min

18 aug 16:20

Snowflake stuurt AI-taken automatisch naar het goedkoopste model dat volstaat

Snowflake kondigt dynamic model routing aan in Cortex AI Gateway: per taak automatisch het goedkoopste model dat de kwaliteit haalt. De functie zit nog niet in private preview en een prijs ontbreekt.

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld
Inzicht
7 min

15 aug 17:00

Het gratis AI-model met een drempel is een prijskaartje dat later wordt ingevuld

Qwen, Kimi, Llama en Gemma zetten voorwaarden op je omzet, je gebruikersaantal en je merknaam. Een gratis model met een drempel is geen open source, maar een inkoopbeslissing die je vooruitschuift naar het moment dat je niet meer weg kunt.

Cloudflare zet een geverifieerde identiteit op elk AI-verzoek
Nieuws
6 min

5 aug 16:11

Cloudflare zet een geverifieerde identiteit op elk AI-verzoek

Cloudflare koppelt een geverifieerde identiteit aan elk AI-verzoek dat via zijn AI Gateway loopt. De koppeling met Access gaat in open beta, het analysetabblad User Insights is meteen algemeen beschikbaar en zonder meerprijs.

Cloudflare en Deutsche Telekom koppelen hun netwerken
Nieuws
3 min

30 sep 02:57

Cloudflare en Deutsche Telekom koppelen hun netwerken

Cloudflare en Deutsche Telekom koppelen hun netwerken en willen Cloudflare-beveiliging via Telekoms zakelijke kanaal aanbieden. Voor Nederlandse bedrijven zijn productnamen, tarieven, contractvorm en startdatum nog niet bekend.

Light Origins publiceert Light-O1 als open model voor robotica
Nieuws
3 min

22 sep 06:44

Light Origins publiceert Light-O1 als open model voor robotica

Light Origins publiceert Light-O1-Preview als open whole-body-model van 6 miljard parameters. Het zet taal om in robotacties en verlaagt de softwaredrempel voor experimenten, terwijl hardware, adapters en veiligheid buiten de preview blijven.