ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

3 步完成 text-generation-webui 大模型下载:download-model.py 完整使用指南

3 步完成 text-generation-webui 大模型下载:download-model.py 完整使用指南 3 步完成 text-generation-webui 大模型下载download-model.py 完整使用指南【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen下载一个 15GB 的模型断在 80% 后重新来其实不用。text-generation-webui 自带的download-model.py脚本负责从 Hugging Face 拉取模型默认 4 线程并发、断点续传、下载完还能用 SHA256 逐文件校验。你只需要给一个仓库名比如facebook/opt-1.3b剩下的过滤、分类、落盘它都做了。 先跑通一次模型下载读完这节你能把第一个模型完整拉到本地。# 克隆项目 git clone https://gitcode.com/GitHub_Trending/te/text-generation-webui cd text-generation-webui# 下载小模型做第一次测试约 500MB python download-model.py facebook/galactica-125m看到终端输出Download of N files to ... completed.就说明成功了。想跑 LLM 日常任务GGUF 量化版更省资源。用--specific-file指定单个 GGUF 文件脚本不会把仓库里十几个量化版本全拉下来# 只下载一个 GGUF 文件 python download-model.py bartowski/Llama-3-8B-Instruct-GGUF \ --specific-file Llama-3-8B-Instruct-Q4_K_M.gguf两个容易踩的细节LoRA 自动分流仓库里带adapter_config.json或adapter_model.bin的脚本判定为 LoRA文件直接放进user_data/loras/不会混进模型目录。格式择优仓库同时有.bin、.safetensors、.gguf时只保留 safetensors避免重复占盘。 模型文件会落盘到哪里读完这节你知道文件在哪不用满目录找。模型类型存放位置普通模型safetensors 等user_data/models/仓库名/分支不是 main 时目录名追加分支名LoRAuser_data/loras/单个 GGUF 文件直接平铺在user_data/models/下不建子目录另外普通模型目录下会多一个huggingface-metadata.txt记录来源 URL、下载时间和每个大文件的 sha256 值——后面校验就用它。 校验下载结果并续传读完这节文件坏了能查出来断了不用从头下。# 只校验不下载核对每个文件的 sha256 python download-model.py facebook/galactica-125m --check全部通过会打印[] Validated checksums of all model files!有缺漏会提示你加--clean重跑。中断恢复是默认行为脚本先 HEAD 请求比对已落盘的字节数不够就带Range: bytesN-头从断点接着写不会覆盖重下。只有确认本地文件已经损坏、要彻底重来时才加--clean。⚙️ 给下载加几个常用参数读完这节你掌握了 5 个高频参数够应对绝大多数场景。# 8 线程并发数字 同时下载的文件数默认 4 python download-model.py bigscience/bloom-7b1 --threads 8--specific-file 文件名只取指定文件配合 GGUF 单文件下载用。--text-only只下 txt / json 等小文件适合先看配置、词表。--exclude-pattern .*\.bin正则排除文件注意是正则不是通配符。--max-retries 15单文件最大重试次数默认 7失败间隔按 2 的幂指数退避2s、4s、8s……。--model-dir /path/to/disk换到空间更大的磁盘目录名规则不变。 常见报错排查读完这节遇到 401、断流、校验失败你知道下一步敲什么。401 / 403私有或 gated 模型需要凭证。export HF_TOKEN你的token网络不稳默认每个文件最多重试 7 次再不稳定就--max-retries 15且中断后重跑会自动续传不必--clean。--check报Checksum failed文件下载不全或已损坏对同一个仓库加--clean重新下载。磁盘写满改用--model-dir指到别的磁盘或先--text-only把小文件下回来占坑。想走镜像源脚本会读取HF_ENDPOINT环境变量设置后所有请求自动改走该地址。细节可以对照仓库里的 download-model.py 源码或查阅 docs/08 - Additional Tips.md。✅ 行动清单从最小模型开始读完这节按顺序做今晚就能把流程走一遍。克隆仓库先下facebook/galactica-125m——它够小失败成本最低。跑--check确认输出[] Validated checksums of all model files!。成功后再上真正的目标模型GGUF 格式记得配--specific-file线程可以拉到--threads 8。做完第 2 步你会看到终端里一行绿色的校验通过提示到第 3 步模型就躺在user_data/models/里等着server.py加载了。【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表