Une note terrain sur le branchement de GLM-5.2 dans Hermes via Cloudflare Workers AI, puis le choix d’une architecture lead/delegate plus sûre pour les modèles de raisonnement coûteux.
Écrit par Ryan Spice · publié 20 juin 2026
GLM-5.2 dans Hermes : le quota gratuit a marché, mais la délégation était le vrai gain
Note terrain
Une note terrain sur le branchement de GLM-5.2 dans Hermes via Cloudflare Workers AI, puis le choix d’une architecture lead/delegate plus sûre pour les modèles de raisonnement coûteux.