1. 先给结论:小额、固定、可复核
GPT 中转站的第一次验收建议控制在几分钱以内。使用同一模型、同一段输入和同一客户端重复三次,分别保存请求时间、HTTP 状态、响应正文、首字时间、完成时间、返回用量和余额变化。这样得到的是一份可复核记录,而不是凭感觉的“快”或“便宜”。
词元AI提供统一的 OpenAI 兼容 Base URL。公开页面的模型与价格只作为选型参考,具体可用型号、线路和扣费以登录后的控制台为准。
2. 四步验收表
| 步骤 | 固定内容 | 应保存的证据 | 异常信号 |
|---|---|---|---|
| 确认入口 | Base URL、API Key、model | 脱敏后的配置与请求时间 | 401、404 或路径重复出现 /v1 |
| 验证格式 | 只输出短 JSON | 原始响应与 HTTP 状态 | 额外 Markdown、字段缺失或响应截断 |
| 重复测量 | 相同输入发送三次 | 首字、完成时间和错误码 | 持续超时、429 或结果不稳定 |
| 核对账单 | 小额请求后查看用量 | 模型、Token、余额变化 | 请求成功但账单无记录或金额无法解释 |
3. 用 OpenAI 兼容请求做最小验证
下面的请求只验证接口是否能按指定模型返回短文本。请把示例 Key 换成自己的密钥,不要把真实密钥提交到公开仓库或截图中。
curl https://www.gpt345.com/v1/chat/completions \
-H "Authorization: Bearer $GPT345_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-5.6-sol","messages":[{"role":"user","content":"只输出 JSON:{\"status\":\"ok\"}"}],"temperature":0}'记录响应中的 model、usage 和服务端返回时间。响应字段只能说明这次请求的行为,不能单独证明上游身份或长期性能。
4. 实际成本要看三处
- 公开价格页:用于比较计费单位和已确认的活动口径,例如图片按张、视频按秒或按任务;
- 模型详情页:用于核对完整模型代号、上下文标注和兼容端点;
- 控制台账单:用于确认本账户实际可用型号、输入/输出用量、失败请求和余额变化。
不要把上游目录价、站内参考价和账户实际扣费混成一个数字。对于批量任务,先用三次小样本测算单次平均成本,再决定并发和预算。
5. 哪些结论不能只靠一次测试
单次响应不能证明“官方直连”,固定延迟不能证明“永远稳定”,一段自然语言也不能证明模型一定没有降级。网络区域、排队、缓存、提示词和上游负载都会改变结果。较稳妥的做法是保留多次记录,并把异常与服务商公告、控制台明细和服务条款一起核对。
如果遇到 401,先检查 Key、Bearer 前缀和 Base URL;遇到 429,降低并发并使用指数退避;遇到账单不一致,暂停扩大调用量并联系客服 QQ 49098022。
6. 常见问题
GPT中转站越便宜越好吗?
不一定。应同时比较可用模型、计费单位、错误处理、账单透明度和实际响应质量,不能只看倍率。
需要测试多少次?
最小验收建议固定输入重复三次;生产上线前再按高峰和低峰分别抽样,保存可复核记录。
测试会不会产生费用?
会。使用短输入和小输出控制成本,发送前确认模型与计费单位,完成后立即核对控制台账单。
词元AI的价格以什么为准?
公开页面提供参考口径,账户实际可用模型和扣费以控制台实时记录为准。