GGUF模型元数据查看器
在线解析 GGUF(llama.cpp生态模型文件格式)文件头和元数据区,展示 version、tensor_count、模型架构名称、量化版本等信息,文件仅在浏览器本地解析,不上传。
使用说明
点击虚线框选择本地 .gguf 模型文件,或直接拖拽文件到框内;也可以点击“加载示例数据”体验一个工具内合成构造的最小合法GGUF文件(不依赖真实模型文件)。
解析完成后会展示:文件头信息(文件大小、version、tensor_count 张量数量、metadata_kv_count 元数据条目数)、常见字段(自动从元数据里提取 general.architecture、general.name、general.quantization_version 等常见字符串/数值字段并高亮展示)、以及全部元数据表格(列出解析到的每一个key、值类型、值内容;ARRAY类型的字段只展示元素类型和长度摘要,不逐项展开)。
如果文件不是合法GGUF(magic number不匹配)或数据被截断,会显示明确的错误提示。为避免大文件(数十GB模型权重)撑爆内存,超过64MB的文件只读取前4MB(通常足以覆盖文件头和metadata区),不加载完整张量数据。
功能介绍
GGUF 是 llama.cpp 生态广泛使用的模型文件格式,用于存储量化后的大语言模型权重和相关元信息。文件开头是一个结构化的头部区(magic number + version + tensor_count + metadata_kv_count),紧接着是若干个 key-value 元数据对(如模型架构名称、量化版本、上下文长度等),再之后才是体积巨大的张量权重数据。
很多时候用户只想快速确认一个GGUF文件的基本信息(是哪个架构、什么量化版本、大概有多少张量),而不需要真正加载整个模型。本工具按 GGUF 官方规范(ggml-org/ggml 仓库文档)在浏览器本地按字节解析文件头和metadata区:先校验4字节magic number是否为“GGUF”,再按小端序依次读取version(uint32)、tensor_count(uint64)、metadata_kv_count(uint64),然后逐条解析metadata的key-value对,支持全部13种官方定义的value_type(UINT8/INT8/UINT16/INT16/UINT32/INT32/FLOAT32/BOOL/STRING/ARRAY/UINT64/INT64/FLOAT64),ARRAY类型会正确跳过其全部字节但只展示摘要,避免超大数组撑爆页面渲染。
本工具不解析文件后续的tensor info区和实际权重数据,只读取头部和元数据,所以处理超大模型文件也很快;所有解析都在浏览器本地用 FileReader + DataView 完成,文件内容不会上传到任何服务器。