LLM上下文窗口可视化计算器
输入文本或对话内容,估算 Token 数量,并对比 GPT-4、GPT-4o、Claude 3.5 Sonnet、Gemini 1.5 Pro 等主流大模型的上下文窗口占用比例。
使用说明
在输入框粘贴一段文本或完整的对话记录,点击“计算占用”,工具会先统计总字符数、中日韩字符数、其他字符数,并按粗略规则估算 Token 数量(中日韩文字约 1.7 字符/token,英文数字标点等其他字符约 4 字符/token)。
估算出的 Token 数会分别与几个有代表性的模型上下文窗口大小做对比(GPT-4 32K、GPT-4o/GPT-4o mini 128K、Claude 3.5 Sonnet/Opus 4 200K、Gemini 1.5 Pro/Flash 1M、Llama 3.1 128K),每个模型显示一条占用比例进度条:绿色表示占用较低,黄色表示占用超过70%接近上限,红色表示已超出该模型的窗口容量,并会标注剩余可用 token 数或超出提示。点击“加载示例数据”可以看一段中英文混合示例文本的计算效果。
功能介绍
大语言模型的“上下文窗口”决定了一次对话或一次调用最多能处理多少 token 的输入+输出内容,不同模型的窗口大小差异很大(从32K到1M token不等)。开发者在设计 Prompt、拼接长文档或多轮对话历史时,常常需要粗略判断当前内容是否会超出目标模型的窗口限制。
本工具用简化规则估算 token 数量(区分中日韩文字和其他字符分别按不同的字符/token 比例换算,不依赖真实的模型专属 tokenizer,因此结果是近似值而非精确计数),并把估算结果同时对比多个主流模型的公开窗口大小,用进度条直观展示占用比例,帮助快速判断内容对于目标模型是否安全、大概还能再加多少内容。
所有计算均在浏览器本地完成,不上传文本内容,不调用任何模型API。