因需求火爆,Cerebras 暂时下调部分高级模型的免费层速率限制

AI芯片独角兽Cerebras近日发布公告,由于两款特定的高级模型(包括zai-glm-4.7和qwen-3-235b相关变体)访问量激增,导致资源紧张,平台不得不暂时降低免费使用层的速率限制。这一调整侧面反映了市场对高性能AI推理服务的强劲需求。Cerebras表示,技术团队正在全力优化基础设施,力求尽快恢复原有的服务配置,以保障用户体验。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册