AI 上下文窗口计算器

检查系统提示词、历史消息、工具、用户输入和预留输出是否能放入模型上下文窗口。

上下文窗口计算器AI Token 上限计算提示词上下文计算

AI 上下文窗口计算器

发送请求前,为提示词、历史、工具、输出和分词误差预留空间。

容纳状态
可容纳
57.3% 已使用
剩余空间
49.2K
预留后的 Token
可用上下文
115.2K
10% 缓冲
可增加轮数
14
按平均每轮大小
计划 Token 总量66,000
原始上下文上限128,000
溢出数量0
请求可以容纳,在缓冲后的限制内约剩余 49,200 Token。

常见问题

将这个计算器用于实际 API 计费和用量规划时的常见问题。

上下文窗口是否包含输出 Token?

多数模型 API 的输入和生成输出共享总上下文限制,因此决定发送多少历史内容前应先预留输出容量。

为什么需要上下文安全缓冲?

Token 估算可能与实际分词器结果不同,工具或框架消息也会增加隐藏开销。缓冲可以减少意外失败。

请求太大时应该怎么办?

可裁剪历史、总结旧消息、删除未使用的工具定义、减少检索文档、拆分任务或选择更大上下文的模型。