OpenAI GPT-5.6系列模型规格曝光:API透传配置与参数详解

近期,技术社区在OpenAI的API接口中发现了名为`gpt-5.6-sol`、`gpt-5.6-terra`和`gpt-5.6-luna`的新型模型系列。尽管上游中转服务(如sub2api)已支持这些模型,但下游客户端(如OMP)在默认配置下无法正常调用。针对这一兼容性问题,技术人员提供了解决方案:需在API管理后台暂时关闭“自动透传”功能,手动将`gpt-5.6`系列模型添加至“模型限制”白名单,随后更新配置并重新开启透传,即可实现下游的稳定访问。配置文件显示,该系列模型具备显著的推理与多模态特性。技术参数方面,三款模型均支持文本与图像输入,拥有高达372,000的上下文窗口(ContextWindow)和128,000的最大输出Token(maxTokens)。在架构上,它们被标记为`reasoning: true`,并倾向于使用Websockets连接。定价策略呈现明显的分层,其中`sol`级别最高,输入与输出成本分别为5美元和30美元(每百万Token),而`luna`级别成本最低。此外,模型引入了新的`thinking`模式,支持从`minimal`到`xhigh`的不同推理努力程度,这表明OpenAI正在推进更为细粒度的推理成本控制机制。

事件分析

GPT-5.6系列模型的曝光揭示了OpenAI在模型架构迭代上的最新方向。从技术规格来看,`gpt-5.6`极有可能是GPT-5或下一代推理模型的内部代号,其命名方式从4.x跳跃至5.6引发了业界的广泛猜测。该系列模型将“推理能力”作为核心配置项,并引入了`remoteCompaction`(远程压缩)和`applyPatchToolType`等参数,暗示了其在处理长上下文和复杂工具调用时的底层优化。值得注意的是,高达1:6的输入输出价格比(以Sol模型为例)印证了“推理即服务”的高成本特性,说明未来的AI应用将不仅要为输入付费,更要为模型深度的“思考过程”买单。对于开发者工具生态而言,此次API的变更暴露了传统中转工具在应对上游模型快速迭代时的滞后性,手动配置模型映射虽然解决了燃眉之急,但也倒逼API管理工具必须升级其自动化适配能力,以支持更复杂的透传逻辑和动态参数加载。

💡 核心观点:GPT-5.6系列的曝光证实OpenAI正推行高成本的强推理模型架构,迫使下游API工具生态加速适配新标准。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册