先看结论
截至 2026 年 9 月 20 日,官方列出的 Jev 输入价格为每百万 Token 0.042 美元,也就是每十亿 Token 42 美元;输出 Token 免费。这是用量单价,不代表无限免费调用或每次判断费用相同。
用实际输入 Token 估算费用
优先记录请求返回的 input_tokens。规划时可以按“请求次数 × 平均输入 Token ÷ 1,000,000 × 0.042 美元”计算。下表假设每次请求恰好使用 1,000 个输入 Token,仅为算术示例,不是实测账单。
| 调用次数 | 假设输入 Token 总量 | 预计输入费用(美元) |
|---|---|---|
| 1,000 | 100 万 | $0.042 |
| 10,000 | 1,000 万 | $0.42 |
| 100,000 | 1 亿 | $4.20 |
| 1,000,000 | 10 亿 | $42.00 |
预算要覆盖完整工作流
一次用户操作可能引发多次模型调用:分流、复核和失败重试都会影响总量。应统计每个完成的业务任务用了多少次调用,而不是默认一个访客对应一次请求。
模型费用只是生产预算的一部分。后端、数据预处理、日志和人工审核可能比推理更贵,应分开记录,避免低模型单价掩盖运营成本。
- 用代表性任务测量平均输入长度与较长输入的分布。
- 估算请求总量时计入失败和重试,并在账号中确认实际计费规则。
- 比较每个正确完成任务的成本和人工审核量,不只比较 Token 单价。
输出免费不等于无限免费使用
输出 Token 不收费,不会取消输入费用。本页没有核实到可永久承诺的免费额度、注册赠金或最低消费政策,预算不能建立在未经确认的优惠上。
公开价格也不代表账号已经获得调用权限。访问状态、额度和计费设置需要分别查看;企业合同条件应向 TypeSafe 确认,不能从公开示例自行推导。
注意速率限制和模型版本变化
速率限制决定单位时间能发多少请求,上下文限制决定一次能放多少内容。官方模型页说明上线阶段的速率限制可能调整,配置生产容量时应以当时官方数值为准。
要复现成本比较,请记录解析后的模型版本、输入用量和测试日期。jev-latest 这样的别名可能指向新版本。提示词、输入长度或模型变化后,应重新抽样测量。
怎样与其他模型公平比较
采用同一批输入,并要求可比较的输出。如果一个方案返回概率分布,另一个只返回标签,它们服务的业务需求就不完全相同,应先统一需求。
把错误后人工修正的成本也算进去。低推理费不一定能抵消错误分流造成的人力消耗。用固定样本比较总成本、延迟、正确率和转人工比例,才更接近实际收益。
常见问题
每次 1,000 输入 Token,调用十万次多少钱?
按本次核对的价格,输入 Token 估算为 4.20 美元,不包含其他服务,并假设实际用量和价格符合上述条件。
42 美元是每百万 Token 的价格吗?
不是。42 美元对应十亿输入 Token;每百万输入 Token 是 0.042 美元。
这是保证不变的报价吗?
不是,这是对核对当日公开价格的解释。请以最新官方价格和账号条款为准。
资料来源与核对
示例和解释为社区编辑内容,最新官方文档与账号条款优先。