近期有开发者在技术社区反馈,AI 编程工具 Cursor 更新了其订阅套餐中的“自有模型”额度,整体额度上调了 50%。根据用户推算,在 20 美元的套餐档位下,Cursor 提供的自有模型额度从原先约 5 亿 tokens 增加至 7.5 亿 tokens,这些额度主要用于 Grok 4.6 模型的调用。尽管配额显著增加,但用户对该模型的实际表现持保留态度。实测对比显示,Grok 4.6 在处理逻辑复杂的编程“糖果题”时表现不佳,准确率远低于 GLM-5.3、Kimi K3 以及 DeepSeek V4 PRO 等竞品模型。甚至有用户指出,Grok 的综合能力可能不及 Flash 模型。虽然马斯克在社交媒体上频繁宣传 Grok 的 benchmark 跑分优势,但在实际的 Cursor 编程环境中,其并未展现出相匹配的速度与推理能力。这一现象表明,单纯的 Token 数量堆砌难以弥补模型在代码生成质量上的短板,开发者对于模型的选择正从营销噱头回归到实际效能的考量。
事件分析
核心观点:Token 配额的通胀无法掩盖模型在垂直场景的代差,AI 编程工具的竞争核心已从成本优势回归至代码生成的精准度与推理深度。
原文链接:Linux.do

评论前必须登录!
立即登录 注册