Qwen 3.8 27B available on Cerebras at 1500 tokens/s
inference-docs.cerebras.ai原文 ↗
Cerebras 文档把 Qwen 3.8 27B 列为托管模型,digest 给出的服务指标是约 1,500 tokens/s。该数字属于平台推理规格,实际吞吐仍受输入长度、批量、限额和计费层影响;条目体现的是硬件服务化,不是 Qwen 权重或训练过程的开放。
–浏览
inference-docs.cerebras.ai原文 ↗
评论 · Comments