全部模型

GPT-5.4 Mini:OpenAI的轻量推理模型

GPT-5系列里OpenAI做成本优化的那一个。×0.3积分,多模态视觉,快到足以承担高频的路由、分类和前置筛选。

400K tokens · Text / Vision / Code · Prompt cache

Okou已不再运行GPT-5.4 Mini。本页作为它的规格、价格和基准测试参考保留。要做同类工作,请用GPT 5.6 Luna。

查看GPT 5.6 Luna

GPT-5.4 Mini是OpenAI GPT-5系列里省钱的那一个——当单位成本比峰值推理质量更要紧时,你会伸手去拿它。它保留了这个系列的40万token上下文窗口和多模态输入,但削减了每个token投入的算力,换来更低的价格(每100万token $0.75/$4.5)和明显更高的速度。

GPT-5.4 Mini是什么?

2026年4月 · GPT-5系列里省钱的变体。Kimi K2.7 Code在OpenAI这边的对应者。

GPT-5.4 Mini是OpenAI GPT-5这一代做成本优化的成员,2026年4月与GPT-5.5和GPT-5.4一同发布。OpenAI把它定位为高吞吐档位——分类、路由、前置筛选这些环节让更大的5.4或5.5去做太浪费,就一直用它。

架构上它与GPT-5系列共享40万token的上下文窗口、reasoning_effort参数、提示词缓存,以及codex CLI默认使用的Responses API接口。相对5.4的取舍在推理深度:Mini处理标准工具调用、短摘要和结构化输出的工作负载没问题,但在5.4还稳得住的多步骤难规划上会开始跑偏。相对同价位竞品的差别在生态——如果你已经在Codex上,留在OpenAI的接口里能让工具定义和结构化输出的结构保持一致。

GPT-5.4 Mini有什么特别之处

架构与能力上的主要亮点。

GPT-5.4 Mini与GPT-5系列其余成员架构相同:40万token上下文窗口,reasoning_effort参数分四档,提示词缓存让缓存输入只按输入价的十分之一计费,以及Responses API接口。支持工具调用、结构化输出和多模态视觉输入。它是更小更快的那个兄弟——每个token的参数更少,每一美元的吞吐更高。

规格速览

家族GPT-5系列
模态文本、视觉、代码
语言以英文为主,支持多语言
提示词缓存支持(OpenAI)
上下文窗口40万token
最大输出最高128K token
推理强度Minimal / Low / Medium / High
服务商标价输入$0.75/输出$4.5,每100万token

GPT-5.4 Mini基准测试

分数来自OpenAI GPT-5 Mini发布材料。独立评测在多数智能体基准上,把5.4 Mini放在与Kimi K2.7 Code相同的省钱区间。绝对百分比只当作方向性参考。

SWE-bench Verified厂商公布
约60%
Terminal-Bench 2.0厂商公布的工具使用成绩
约42%
AIME 2025(不用工具)厂商公布的竞赛数学成绩
约84%
GPQA Diamond厂商公布的研究生级科学成绩
约74%
速度Artificial Analysis,medium强度
约165 token/秒

GPT-5.4 Mini价格

服务商标价,按每100万token计。

输入$0.75
输出$4.50
缓存读取$0.07
缓存写入不计费

GPT-5.4 Mini实际用起来怎么样

来自生产环境智能体运行的实际观察。

速度

GPT-5系列里最快的模型——据Artificial Analysis,medium强度下约165 token/秒。正是这一点,让它在交互式对话回复和短扇出工具调用这类用户能直接感知延迟的场景里站得住。

常规工具调用

在标准的Codex框架工具目录上表现准确。5.4领先的地方在难的边缘情况(条件式工具选择、深层嵌套参数)——常规情况下Mini用三分之一的成本就能把工具路由做干净。

批量分类与前置筛选

在扇出式工作上,它是GPT-5系列里成本与质量最好的位置。批量PR分流、支持工单归类、文档分级——这些过去只能手写正则去做的活儿,现在用一次真正的模型调用也负担得起。

成本效率

×0.3积分,还自带多模态视觉。Mini和Kimi K2.7 Code处在同一区间,DeepSeek V4 Pro更低,在×0.1——选哪个通常取决于框架契合度和它在你具体工作负载上的表现。

什么时候该升级

Mini在长的多步骤规划、难推理和要求一次成型的跨文件代码修改上会跑偏。把智能体设计成由编排者来决定何时升级到5.4或5.5,而不是让Mini一个人扛完整个流程。

GPT-5.4 Mini最适合的智能体任务

每个事件都跑一遍的扇出分类器

进来的支持工单、PR评论、销售通话转录、上传的文档——Mini逐一读过,再把它路由到对应的下游智能体或人工审阅者。×0.3积分加上165 token/秒,意味着单个事件的成本低到可以真的每个事件都跑一次,而不只是抽样跑批。

贵模型之前的那道前置筛选

把Mini钉在智能体工具调用的最前面,由它判断这个请求到底需不需要升级。大多数请求拿到一个又快又便宜的答案;只有剩下的少数才付出GPT-5.4或5.5的完整成本。把省钱档和核心档叠起来用,正是在这里真正改变了什么叫负担得起。

交互式对话回复

用户能直接感知延迟的短多模态轮次。Mini回得够快,流式输出感觉是瞬时的;多模态支持则让对话里丢进一张截图就能直接用。

什么时候不该用GPT-5.4 Mini

最难的推理、多步骤的智能体编排、computer-use序列,以及要求一次成型的跨文件代码修改,都别用GPT-5.4 Mini——这些任务的常规版本升级到5.4,最难的交给5.5。

GPT-5.4 Mini与其他模型对比

GPT-5.4 Mini对比GPT-5.4

同一个系列,定位不同。5.4 Mini(×0.3)赢在成本和速度;5.4(×1)赢在推理质量和难情况下的工具路由准确度。标准做法是用Mini做前置筛选,把剩下的情况升级给5.4。

GPT-5.4 Mini对比Claude Sonnet 4.6

Claude Sonnet 4.6是目录里当前与这个模型对标的比较对象。

结论:你该用GPT-5.4 Mini吗?

GPT-5.4 Mini是OpenAI这边省钱的默认选择。用Mini做前置筛选,常规环节升级到GPT-5.4,只有最难的推理才升级到GPT-5.5。

常见问题

GPT-5.4 Mini的上下文窗口有多大?

40万token,单次回复最高输出128K token——和GPT-5系列其余成员一样。

GPT-5.4 Mini能处理图片吗?

能。和GPT-5系列其余成员一样,它接受图片与文本、代码一起输入。

什么时候该选GPT-5.4 Mini而不是Kimi K2.7 Code?

当你的智能体已经建在Codex框架上,或者你需要OpenAI的结构化输出和工具调用生态的时候。两者都在×0.3积分档,成本一样,选择取决于框架契合度和实际表现。

GPT-5.4 Mini支持提示词缓存吗?

支持。缓存输入按每100万token $0.075计费——缓存的那部分成本降到十分之一。

替代选择

GPT-5.4 Mini在Okou上的可用情况

GPT-5.4 Mini已从Okou阵容中移除,因此在聊天和工作流里都无法再选用,也不能用你自己的API密钥接入。GPT 5.6 Luna覆盖同一个省钱档位。