Gemma 4 on Cerebras—The Fastest Inference is Now Multimodal
Run Gemma 4 31B at over 1,800 tokens per second on Cerebras. Build responsive vision, document, screenshot, and agentic AI workflows.
阅读 Cerebras 官方博客(网页) 原文 ↗Run Gemma 4 31B at over 1,800 tokens per second on Cerebras. Build responsive vision, document, screenshot, and agentic AI workflows.
阅读 Cerebras 官方博客(网页) 原文 ↗