
IA
Cerebras sert Qwen 3.8 27B à 1500 tokens/s, et l'agent n'attend plus
La documentation d'inférence de Cerebras annonce Qwen 3.8 27B servi à environ 1500 tokens par seconde sur ses points d'accès publics. Pour un chatbot c'est du confort ; pour une boucle d'agent, c'est un changement de nature.
