GPT-4o-mini 成本优化:4 个实测省 50% 的方法
从 $0.30/M 降到 $0.10/M 不靠运气 — GPT-4o-mini 缓存折扣 + 短 prompt + provider 选择实测
一、GPT-4o-mini 当前市场价(2026-06-19)
OpenAI 官方 定价:$0.15/M 输入,$0.60/M 输出。但 Aihubmix、API2D 等中转站价能到 $0.105/M 输入,价差 30%。完整横向对比见 价格页。
二、4 个实测省 50% 的方法
- 方法 1:选高覆盖中转 — 价格页 验证度 ≥60% 里的最低价 = 0.105/M,比官方省 30%
- 方法 2:用 prompt cache — GPT-4o-mini 支持 OpenAI 缓存折扣,长 prompt(≥1k tokens)能省 50%
- 方法 3:短 prompt 优先 — 输入价是输出价的 1/4,所以 prompt 越短越划算(聚合/分类任务)
- 方法 4:流式输出 — 流式响应 = 客户端可中断 = 节省无效输出(长回答可省 20-40%)
三、缓存档位怎么用(看 L3 详情)
GPT-4o-mini prompt cache 折扣是 OpenAI 官方定价:$0.075/M cache read。意思是相同 prompt 第二次调用时,输入价直接半价。详细档位见 GPT-4o-mini 官方 L3 详情(含缓存 read 5m / 1h 档位)。
四、决策清单
1. 看 OpenAI 官方 当前公开价 = 成本下限
2. 看 Aihubmix GPT-4o-mini 详情 = 中转最低价
3. 用 OpenAI 检测 跑一次 = 协议透传验证