IT资源栈互联网海量AI资源栈
  • 首页
  • AI
  • 前沿
  • 专题
  • 碎片
  • 架构
  • 实战
  • 安全
  • 生活
  • 工具
  • 管理
  • 标签云
  • 文章存档
Hi, 请登录     我要注册     找回密码

Codex缓存实测:命中率超95%,真实倍率仅3.7倍

分类:前沿 阅读() 评论(0)

本文基于Codex本地会话日志,对包月缓存机制进行了严谨的成本倍率测试。通过分析5个rollout数据,发现缓存命中率高达95.12%,真实倍率降至3.7倍,有效单价约$3.24/1M tokens。报告详细拆解了冷启动与工具密集型场景的成本差异,并提供了可复现的计算脚本,为AI模型的高效低成本使用提供了数据支撑。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›
AI推理codexToken计费成本分析缓存机制
上一篇
硬核DIY:利用Cloudflare Workers自制“生存打卡”系统
下一篇
别陷入“反AI”的炒作陷阱

相关推荐

  • OpenAI上线网页版Codex:浏览器直接开发、可上传文件夹,不占原额度
  • Codex实用技巧:两步配置让普通模式也能主动向用户提问
  • 3 步装好 UsageHub Open:Claude + Codex 用量看板-IT资源栈3 步装好 UsageHub Open:Claude + Codex 用量看板
  • Codex 背后的 Harness:OpenAI 把 Coding Agent 的控制层讲透了-IT资源栈Codex 背后的 Harness:OpenAI 把 Coding Agent 的控制层讲透了
  • John Ousterhout:TCP 和 RDMA 正拖慢 AI 推理,他想用 Homa 换掉它们-IT资源栈John Ousterhout:TCP 和 RDMA 正拖慢 AI 推理,他想用 Homa 换掉它们
  • Artificial Analysis 分享智能成本曲线-IT资源栈Artificial Analysis 分享智能成本曲线
  • Claude Code 用量怎么算: Pro、Max 5x、Max 20x 与 ReClaude-IT资源栈Claude Code 用量怎么算: Pro、Max 5x、Max 20x 与 ReClaude
  • 刚刚,Codex 被拿去订酒店了!

抢沙发

评论前必须登录!

立即登录   注册

易安
易安作者
长期关注 AI Agent、软件工程、自动化工作流与个人生产力系统。喜欢把复杂技术拆成普通人也能上手的实践教程,也记录自己在工具链、编程、内容创作和知识管理上的真实折腾。
  • 分享 AI 工具、Agent 工作流与提示词工程的实战经验
  • 记录从想法到产品、从代码到上线的完整实践过程
  • 关注普通人如何用 AI 放大能力,而不是被工具牵着走
阅读作者的全部文章 ›
文章目录

    置顶推荐

    • 2026最新Claude Code国内上手教程 从安装到第一次跑通完整流程一次讲清2026-05-31
    • OpenAI Codex CLI 新手指南:安装、审批模式和项目规则2026-05-25
    • Claude Code 国内使用完整教程 从 API Key 到三端安装这次一次配明白2026-05-14
    • codex国内编码远超claudecode,2026最新Codex国内保姆级入门教程2026-05-05
    • 2026最新Claude Code新手避坑指南 第一次使用最容易卡住的10个问题2026-04-17
    • 2026最新Claude Code订阅怎么选 免费版ProMaxTeamAPI一篇讲清2026-04-17
    • Codex 国内怎么用才省事:从官方账号到 Code80 CLI,一篇讲清楚稳定玩法2026-04-02
    • Claude 国内怎么用最省事:官网订阅、直连平台和第三方入口2026-04-02
    Code80 · AI 编程巴士

    前沿哨所

    • 15年PDF引擎开发者发布AetherPDF 1.2.0:多Agent分工批量处理文档

      独立开发者发布PDF编辑器AetherPDF 1.2.0版本,核心更新聚焦批量处理,推出多文档AI助手。新版本包含四项主要功能:一是多文档会话,用户可将整个文件夹拖入AI对话,对多个文件执行任务;二是多Agent分工机制,主Agent负责理解目标、拆分任务并派发工作,每个子Agent绑定一份文档且工具面相互隔离,单个子Agent无法访问其他文档;三是技能库,AI执行过的流程可沉淀为可复用技能,包含操作手册与参数协议;四是记忆功能,保存用户偏好与上下文,并提供记忆管理窗口随时查看清理。典型工作流为:拖入文件夹、一句话触发、主Agent派子Agent分批提取、汇总校验、结果输出到指定文件夹。此外,该版本修复多项稳定性问题,包括Type3位图字体编辑后文字不可见、多栏文档与目录页文本选择顺序错乱、字体编码乱码、颜色空间解析无限递归、Stream对象filter chain解压失败等。性能方面引入长会话历史按需加载与Markdown后台渲染。产品采用买断制定价698元,免费版全功能可用但保存带水印,本次通过社区活动赠送20个终生会员换取真实使用反馈,应用已在Mac App Store上架。

      事件分析

      此版本的技术看点在于多Agent编排模式的工程化落地:主Agent负责任务分解与调度,子Agent绑定单一文档并隔离工具面,这种设计可避免跨文档误操作,也降低上下文串扰风险。技能库将执行流程固化为’操作手册+参数协议’,与当前Agent工作流复用的行业方向一致。产业层面,这反映了AI文档处理从单文档问答向批量自动化流水线演进的趋势,独立开发者依托自研15年的PDF渲染引擎叠加LLM能力,在垂直工具市场形成差异化壁垒。其建议用户自备模型token的成本结构,也体现了Agent类应用’软件买断+推理自付’的新商业模式。后续可能向更多文档格式支持、企业级批处理场景延伸。

      核心观点:多Agent分工与工具隔离让AI文档处理从单点问答走向批量流水线,垂直工具正成为Agent技术落地的现实切口。

      原文链接:V2EX 分享发现

      6小时前
    • Apple 烂尾系统 Copland 复活:最后的 D11E4 版本可在浏览器中启动

      Apple 在 1990 年代开发的 Copland 操作系统最后一个构建版本 D11E4,现已通过改进版 PowerPC 模拟器 DingusPPC 在浏览器中成功启动。Copland 长期以难以在真实硬件上运行著称,此前从未有过可用的模拟版本。项目由 pagetable.com 发布,作者指出,在真实硬件上启动 Copland 约需 30 秒,而现代计算机通过 WebAssembly(wasm)即可实现实时模拟。用户点击屏幕即可接管键盘和鼠标控制,按 Escape 键归还控制权。若系统代码触发断言错误,会自动进入调试器,点击 Continue 可继续运行。作者还建议尝试运行系统自带的 GXSlidemaster 演示程序和 Eric’s Solitaire 纸牌游戏。技术层面,作者为解锁 Copland 制作了 11 个补丁,已发布在其 fork 的分支上。值得注意的是,DingusPPC 项目不接受借助 AI 编写的补丁,因此作者希望有人能根据 commit message 中的说明重新实现这些修复,wasm 版本所需的补丁则单独发布在另一分支。Copland 原本是 Apple 用来取代老旧 System 7 的现代化微内核系统,但因开发受阻于 1996 年被取消。Apple 随后收购 NeXT 公司,以其 NeXTSTEP/OpenStep 系统为基础打造出 Mac OS X,深刻影响了此后二十余年的 Mac 产品线。此次浏览器化复现,让这款未及面世便被放弃的系统首次向公众开放体验。

      事件分析

      此次复现的核心技术看点在于 PowerPC 架构模拟的成熟度。DingusPPC 作为开源 PowerPC 模拟器,此前主要针对常规 Mac 系统优化,而 Copland 依赖大量未公开文档化的硬件行为和未完成代码路径,11 个补丁的破解过程实质上是对系统底层机制的逆向工程。WebAssembly 使这类重模拟负载在浏览器中接近实时运行,标志着浏览器正成为软件保存的重要载体。另一值得关注的细节是 DingusPPC 明确拒绝 AI 辅助编写的补丁,在 AI 代码生成工具普及的当下,这反映了部分开源社区对代码可审计性与贡献者理解深度的坚持。从产业视角看,此类项目推动了数字遗产保存实践,历史上大量失败或未发布的系统因缺乏可运行环境而逐渐失传,模拟器与浏览器的结合为其提供了低门槛的存续方式。后续可期待更多经典系统的浏览器化复现,以及开源社区对 AI 代码贡献边界的持续讨论。

      核心观点:被 Apple 废弃的系统靠开源模拟器在浏览器中复活,数字考古正成为对抗技术失忆的力量,而拒绝 AI 代码更凸显人工逆向的不可替代性。

      原文链接:Hacker News

      14小时前
    • Gravity Linux 早期 Alpha 发布:M4 Mac mini 跑通原生 Linux,GPU 与 DCP 驱动可用

      Gravity Linux 团队(开发者 Cody Ho 与 Niklas Sheth)发布面向 M4 Mac mini 的早期 Alpha 版本,首次在该设备上实现可用的 DCP 显示协处理器与 GPU 驱动,GPU 已通过 OpenGL ES 3.0 与 OpenGL 3.3 合规认证。该项目是基于 Fedora 的发行版重制,默认搭载 KDE 桌面与 Wayland 显示协议,用户可在 macOS 下通过一条 shell 命令完成安装。官方明确表示此版本仅供开发者测试,尚不适合日常使用:Alpha 版无法升级至后续 Beta 或正式版,届时需整盘重装;暂不支持睡眠唤醒、USB-C 接口视频输出(HDMI 正常)以及 Thunderbolt/USB4;功耗偏高、关机重启不稳定,扬声器音量出于安全考虑被限制。除上述已知问题外,其余功能均经过测试可正常工作。团队称发布 Alpha 的目的是让开发者尽早测试真实负载、发现缺陷并参与修复,为 Beta 版打磨平台。后续计划将支持扩展至 MacBook Neo 及其余 M4、M4 Pro、M4 Max 机型,M5 与 M6 设备亦在规划范围内。长期目标是将全部成果提交上游,项目采用教科书式净室逆向工程流程,未参考任何 Apple 二进制文件,并公开文档化全部方法与发现,以规避法律风险并保障项目可持续性。

      事件分析

      Apple Silicon 上实现完整 Linux 支持的最大技术瓶颈集中在 DCP(显示协处理器)与 GPU 驱动,此前该领域几乎由 Asahi Linux 一家长期攻坚,Gravity Linux 的出现意味着这一方向出现了第二支具备实质产出的团队,社区对 M 系列芯片硬件细节的逆向理解正在加速沉淀。OpenGL 3.3 合规距离 Vulkan 等现代图形 API 仍有差距,但已足以支撑轻量桌面与部分图形工作负载。项目强调净室逆向、不接触 Apple 二进制,兼顾了法律安全与可持续性,并把上游化作为长期目标,若驱动最终进入主线内核,苹果硬件有望成为小型服务器、编译农场与自托管场景的低功耗选项。后续值得关注的节点包括 Beta 版能否补齐睡眠与雷电接口、以及 MacBook Neo 等移动设备的适配进度。

      核心观点:净室逆向攻克 DCP 与 GPU 驱动后,苹果封闭硬件生态正被开源社区一步步撬开,通用 Linux 生态向 M 系列芯片扩张已成趋势。

      原文链接:Hacker News

      14小时前
    • Grok 4.7 正式上线:编程跑分超同档 Opus 5,成本仅其一半

      xAI 新旗舰模型 Grok 4.7 已正式上线 Modelflare 平台,支持 50 万 tokens 上下文窗口,接受文本和图片输入、输出文本,可通过 Chat Completions 与 Responses API 调用,此前的 grok-4.5 和 grok-4.6 仍可继续使用。在编程基准测试 CursorBench 的 Extra High 档位中,Grok 4.7 得分 46.3%,略高于同档 Claude Opus 5 的 46.1%,但低于 Opus 5 Max 的 46.6%。成本差距更为显著:按 Cursor 公开标价折算,Grok 4.7 单任务成本约 6.01 美元,而 Opus 5 Extra High 约 11.43 美元,前者约为后者一半。需注意将 reasoning_effort 参数设为 xhigh(默认为 high)才能达到该档位表现,且 Cursor 提示分数存在波动,接近的分差不一定具有统计意义。价格方面,Modelflare 开设两个分组:grok-award(0.03 倍率)输入 0.06 美元、输出 0.18 美元、缓存读取 0.015 美元每百万 tokens;grok-stable(0.11 倍率)输入 0.22 美元、输出 0.66 美元、缓存读取 0.055 美元每百万 tokens。用户在 API Key 页面选择分组、模型名填写 grok-4.7 即可调用。

      事件分析

      Grok 4.7 在 CursorBench 上与 Opus 5 打平的表现,标志着 xAI 在编程能力这一长期由 Anthropic 主导的领域已基本补齐短板。0.2 个百分点的分差参考价值有限,Cursor 官方也承认存在波动,但单价约为 Opus 5 一半的成本结构更具实质冲击力——当头部模型性能趋同后,价格将成为开发者和平台选型的关键变量。对 Cursor 等编程工具而言,模型供给多元化有助于压低推理成本、改善产品毛利。后续值得关注两点:Grok 4.7 在真实工程场景中长上下文的稳定性表现,以及 Anthropic 是否以降价或调整 Opus 5 Max 策略作出回应。此外,第三方推理平台快速跟进旗舰模型上线,也反映出模型分发与推理服务环节的竞争已进入白热化阶段。

      核心观点:头部模型性能差距已收窄至统计误差级别,编程模型竞争正从跑分之争转向定价权之争。

      原文链接:V2EX 分享发现

      16小时前
    • xAI发布Grok 4.7:性能逼近Claude Opus 5,价格近乎减半

      xAI正式发布新一代大模型Grok 4.7,其最高配置版本Grok 4.7 XHigh在多项基准测试中表现接近Anthropic的Claude Opus 5,而价格仅为其一半左右,被社区评价为当前性价比最高的前沿模型之一。此次更新中,Grok 4.7的上下文窗口扩展至500K token,较前代产品有明显提升,能够处理更长篇幅的代码库和文档,对长上下文编程场景更为友好。定价方面,Grok 4.7与上一代4.6保持一致,即在性能提升的同时未上调费用,延续了xAI的低价策略。此外,xAI在发布新闻中提到,将开始向已授权的网络安全合作伙伴提供Red Team Model(红队模型),用于安全测试与攻防研究,显示出其在AI安全领域的布局。官方同步公开了发布新闻、模型卡与计费文档,开发者可在xAI文档站查询具体的模型参数与调用成本。在编码能力评测方面,该消息引用了Cursor Bench 4.0基准作为参考依据,表明Grok 4.7在实际开发工具场景下的表现是主要卖点。该消息最早出现在Linux.do社区讨论帖中,引发开发者关于以Grok 4.7替代Claude Opus 5进行日常编码工作流的热议。

      事件分析

      技术层面,500K上下文窗口是本次升级的关键指标,长上下文能力直接决定模型在大型代码库理解与多文件编辑任务中的表现上限,对Cursor等编程工具场景尤其重要。产业层面,xAI采取性能对标、价格减半的定价策略,将竞争焦点从单纯的能力追逐转向性价比,对Anthropic等竞品形成直接价格压力,可能引发新一轮前沿模型降价。Red Team Model面向授权网络安全伙伴开放,反映头部厂商开始将红队测试产品化,AI安全正从内部流程演变为对外服务能力。后续关键在于第三方基准与真实开发场景的独立验证,若口碑坐实,编码开发者向Grok迁移的比例或明显上升,同时Cursor Bench等工具链评测的话语权也将进一步放大。

      核心观点:前沿模型竞争进入性价比决战阶段,xAI以半价贴身战术冲击对手溢价,编码场景正成为大模型商业化的主战场。

      原文链接:Linux.do

      18小时前
    • 2MB开源新闻应用“有所闻”适配LinuxDO,RSS、知乎无缝聚合

      开发者t59688在Linux.do社区发帖宣布,其开源新闻聚合应用“有所闻”(GitHub项目名newsnook)已完成对LinuxDO论坛(L站)的适配,常用功能均可正常使用,用户需切换至最新Beta版本方可体验。至此,该应用已实现RSS、新闻、知乎、L站等多个信息源之间的无缝切换。开发者同时在社区征集用户反馈建议。“有所闻”是一款面向Android平台的纯新闻聚合阅读应用,安装包仅约2-3MB,内置90多个频道。其核心功能是将各平台新闻聚合到一起,按时间顺序展示,无推荐算法、无广告、无信息流干扰。架构设计上,该应用没有账号体系、没有后端服务,客户端直接拉取各媒体源站的RSS或JSON数据,从机制上避免了用户数据被集中收集。此前版本已支持云同步设置功能。项目代码托管在GitHub上,以开源模式持续迭代,此前曾因“简单而全面的RSS和新闻APP”的定位在开发者社区获得关注,本次更新进一步扩展了其对中文社区内容的覆盖范围。

      事件分析

      该应用的技术亮点在于“无后端”架构:不设账号体系与服务器中转,客户端直连各源站的RSS/JSON接口,天然规避了用户数据集中存储的隐私风险,也大幅降低了开发与运维成本。安装包仅2-3MB却覆盖90+频道,体现了移动端轻量化开发思路,与主流新闻客户端动辄上百MB、依赖算法推荐的产品形态形成鲜明对照。对RSS生态而言,这类工具延续了信息订阅的去中心化传统;而对LinuxDO、知乎等社区内容的适配,则显示开发者正尝试将垂直社区纳入统一阅读入口。后续走向上,iOS客户端缺位、源站接口频繁变更带来的维护成本、以及各平台的反爬限制,将是此类项目能否长期存活的关键变量。

      核心观点:当算法推荐垄断信息入口,无后端、按时间排序的极简聚合器正在帮用户夺回阅读主动权。

      原文链接:Linux.do

      21小时前

    最新文章

    • 15年PDF引擎开发者发布AetherPDF 1.2.0:多Agent分工批量处理文档2026-09-22
    • Apple 烂尾系统 Copland 复活:最后的 D11E4 版本可在浏览器中启动2026-09-22
    • Gravity Linux 早期 Alpha 发布:M4 Mac mini 跑通原生 Linux,GPU 与 DCP 驱动可用2026-09-22
    • Grok 4.7 正式上线:编程跑分超同档 Opus 5,成本仅其一半2026-09-22
    • xAI发布Grok 4.7:性能逼近Claude Opus 5,价格近乎减半2026-09-22
    • 2MB开源新闻应用“有所闻”适配LinuxDO,RSS、知乎无缝聚合2026-09-21

    热门专题

    • AI 大模型
    • Claude 实战
    • 前沿观察
    • 安全攻防

    热门标签

    AI编程claude大模型AIAI Agent人工智能开源项目Gemini开发者工具开源GitHubClaude Code开源工具AI工具开发工具谷歌openaideepseek提示词工程cursor网络安全anthropicAI应用ChatgptAI开发agentAI安全自动化智能体AI智能体

    网站统计

    • 日志总数:28559
    • 评论总数:7
    • 标签总数:17903
    • 用户总数:3675
    • 最后更新:2026-09-22

    © 2023-2026   IT资源栈   粤ICP备2021152721号-5