确定输入量
GPT 与 DeepSeek 使用浏览器本地分词器;Gemini 在点击后使用 Google 官方计数接口。
上下文窗口
选择具体子模型后,用官方公布的上下文窗口和最大输出值检查占用。模型共享分词器时,计数相同,但容量仍可能不同。
文本在浏览器本地计数
工作原理
可以把它想成一张固定长度的纸:系统指令、历史消息、当前输入和模型输出都要写在同一张纸上,输入占得越多,留给输出的位置就越少。
最基本的关系是:剩余空间 = 上下文窗口 − 输入 Token。本页还会检查剩余空间能否容纳该模型登记的最大输出。
GPT 与 DeepSeek 使用浏览器本地分词器;Gemini 在点击后使用 Google 官方计数接口。
占用比例等于输入 Token 除以上下文窗口。超过 100% 就表示请求无法完整放入。
如果模型登记了最大输出,还要从窗口中预留这部分容量;未登记时工具会明确标为未知。
理解边界:容量来自项目登记的公开模型资料,预览模型和平台限制可能变化;正式调用前仍应以供应商当前文档和 API 返回为准。
延伸阅读:Gemini Token 与上下文窗口