Cerebras Brings Trillion Parameter Inference to Enterprises with Kimi K2.6
Run Kimi K2.6 at 981 output tokens per second in Cerebras enterprise trials, enabling real-time agentic coding and trillion-parameter AI workloads.
阅读 Cerebras 官方博客(网页) 原文 ↗Run Kimi K2.6 at 981 output tokens per second in Cerebras enterprise trials, enabling real-time agentic coding and trillion-parameter AI workloads.
阅读 Cerebras 官方博客(网页) 原文 ↗