news 2026/8/24 10:04:12

TGW 完整上手指南:从克隆到调参一次讲清

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
TGW 完整上手指南:从克隆到调参一次讲清

TGW 完整上手指南:从克隆到调参一次讲清

【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen

想在浏览器里跑本地 LLM,又不想折腾 Docker 和依赖地狱——这就是 Text Generation Web UI(TGW)的出场场景。一句话:开源的本地 LLM 网页界面,文本、视觉、工具调用全支持,数据不出本机,还带 OpenAI/Anthropic 兼容 API。

5 分钟把 TGW 跑起来

装什么

不用自己准备环境,官方启动脚本会全包:先拉 Miniforge 建一个隔离的 Python 3.13 环境,再按你的显卡装对应版本的 torch。如果你本机已有干净的 Python 环境,这一步可以直接跳过。

怎么启动

git clone https://gitcode.com/GitHub_Trending/te/text-generation-webui cd text-generation-webui

然后按系统三选一:

Linux./start_linux.shWindows双击start_windows.batmacOS./start_macos.sh

首次运行比较慢,放着等 10 分钟以上很正常。好了之后浏览器开http://127.0.0.1:7860,界面就在。

角色扮演 / 多后端 / 参数预设,一次看够 🎭

先给 AI 立个人设再开口聊

你想做什么:让 AI 扮演特定的人跟你对话。

它怎么做到:改一个 YAML 里的namegreetingcontext三个字段,角色就成了。角色配置目录 里Assistant.yamlExample.yaml是现成例子,抄一份改两行就能用。

效果如何:多角色可以在同一个会话里来回切,人设不会串。连角色形象都能画,比如参考下面这张示例:

大模型塞不进显存?换个后端就行

你想做什么:小显存也要跑大一点的模型。

它怎么做到:Model 标签页里换引擎——Transformers 兼容性最好,llama.cpp 的 GGUF 量化适合低显存部署,ExLlamaV2 走高性能推理,CTransformers 偏 C++ 效率路线。Text Generation Web UI 的对话界面完全不变,只是底下换了台发动机。

生成太放飞?换个预设就行

你想做什么:让输出"稳一点、别乱编"。

它怎么做到:Presets 标签页一键套用参数组合,预设目录 里的Creative.yamlDeterministic.yamlTop-P.yaml直接选。自己调好的组合存下来,下次一条命令复现。

TGW 参数怎么调不翻车 🛠️

关键参数速查

参数作用推荐起步值
temperature生成随机性,越高越放飞0.7 - 1.0
top_p词汇多样性,管风格松紧0.9 - 0.95
top_k候选词数量截断50
min_p过滤低概率词,压复读0.02 - 0.1
repetition penalty防止车轱辘话1.05 - 1.1

高频报错对照

  • 首跑半天没反应→ 还在下环境和依赖,第一次 10 分钟起步,别以为卡死去强杀
  • CUDA out of memory→ 我一开始也以为是模型坏了,其实是显存爆了;换小一点的量化或 llama.cpp 后端
  • 同一句话翻来覆去说→ 加一点 min_p,或重复惩罚 +0.05
  • 7860 端口被占→ 启动命令后面加--port 7861换个门牌号

硬件四句话:

  • NVIDIA:CUDA 是默认路线,最省心
  • AMD:走 ROCm,docs 里有专门的 AMD Setup 文档
  • CPU:能跑,但只建议试小模型
  • Apple 芯片:有专门优化,M 系跑得顺

装完 TGW 还能干嘛

这四点是我用得最多的后续玩法:

  • LoRA 微调:Training 标签页内置训练,数据丢进user_data/training/datasets/目录就能开训
  • OpenAI 兼容 API:启动时加--api,把你原来调 OpenAI 的现成应用指到http://127.0.0.1:7860就能通
  • 社区扩展extensions/目录里 TTS、画图、翻译现成一大堆,装上即启用
  • 多语言对话google_translate扩展挂上就能跨语言聊

打开extensions/目录,挑一个silero_tts这样的 TTS 插件装上启用,生成你的第一句语音。

【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/8/24 10:04:03

如何手写一个高速日期解析器?LogViewer的FastDateTimeParser源码全解

如何手写一个高速日期解析器?LogViewer的FastDateTimeParser源码全解 【免费下载链接】log-viewer Web UI for viewing logs 项目地址: https://gitcode.com/gh_mirrors/log/log-viewer LogViewer 是一款开源的 Web 日志查看器,它能用浏览器实时查…

作者头像 李华
网站建设 2026/8/24 10:02:06

微信聊天记录导出完整教程:用 EchoTrace 一键配置、快速导出与排错

微信聊天记录导出完整教程:用 EchoTrace 一键配置、快速导出与排错 【免费下载链接】echotrace EchoTrace 是一个本地、安全的微信聊天记录导出、分析与年度报告生成工具 | EchoTrace is a local, secure tool for exporting, analyzing, and generating annual rep…

作者头像 李华
网站建设 2026/8/24 9:59:33

【前端知识点总结】Nginx 指南:从开发到生产的完美衔接

目录 一、 核心认知:Nginx 在前端架构中扮演什么角色? 对于开发环境: 对于生产环境(为什么要 Nginx?): Nginx 到底是干什么的? 角色 1:静态资源服务器(前端代码的“门卫”) 角色 2:反向代理服务器(接替 Vite 代理的工作) 打个比方 二、 场景判断:到底需…

作者头像 李华
网站建设 2026/8/24 9:59:20

具身智能体记忆系统BrainMem:类脑记忆与任务规划实践

1. 项目概述:当具身智能体拥有“大脑记忆”最近在折腾具身智能体(Embodied Agent)的任务规划时,我遇到了一个经典难题:如何让智能体在复杂、动态的环境中,记住过去的关键经验,并利用这些经验来指…

作者头像 李华