打开 Hugging Face 看到各种各样的模型名,会比懵逼
比如: Qwen3-32B-Q4_K_M.gguf、DeepSeek-R1-Distill-Llama-70B、gemma-3-27b-it-q8_0
这些名字里,把 型号、智商、大小、适配设备 都写好了。
如 Qwen3-32B-Q4_K_M.gguf
说人话:千问第三代、320亿参数、4bit中等精度压缩、GGUF本地专用格式
7B、14B、70B 是什么?
B就是Billion,十亿,代表AI的神经连接数量,参数越大理论智商越高。
参数大不一定更强。新一代14B优质模型,完全可以吊打老款70B。 就像新款中端手机,体验远超几年前的旗舰机,关键看训练技术、数据和架构。
同一个模型,有几十个版本,如
这种压缩专业名叫量化,原本70B原始模型要140GB以上,普通电脑根本装不下; 经过Q4量化 MacBook、台式机都能本地跑大模型。
Q4、Q6、Q8,数字越小,压缩越狠,体积越小,画质轻微下降;数字越大,越接近原版精度。
后缀GGUF又是什么?
GGUF = 本地大模型专用格式,专门适配热门工具 llama.cpp, Ollama, LM Studio, Open WebUI
Instruct, Chat, Coder 又是什么?是模型厂商根据特定领域调教出来的。
HuggingFace:AI圈的Steam+应用商店
现在的HuggingFace,早就不只是一个模型网站。AI界的GitHub + 应用商店 + 游戏平台上面有模型、数据集、演示demo、开发工具、微调项目、开源应用。
现在很多AI新品,都不先发官网,直接首发上传HuggingFace,已经成了行业默认标准。