news 2026/9/30 4:07:44

TuriX config.json配置详解:如何为brain、actor、memory、planner四个模型正确搭配LLM

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
TuriX config.json配置详解:如何为brain、actor、memory、planner四个模型正确搭配LLM

TuriX config.json配置详解:如何为brain、actor、memory、planner四个模型正确搭配LLM

【免费下载链接】TuriX-CUAThis is the official website for TuriX Computer-use-Agent项目地址: https://gitcode.com/gh_mirrors/tu/TuriX-CUA

TuriX 是一款开源的 AI 桌面操作智能体(Computer-use-Agent),它让大模型直接在你的电脑上点击、输入、开应用。TuriX 采用"多模型分工"架构,所有模型都通过一个 examples/config.json 文件配置:只要改brain_llm、actor_llm、memory_llm、planner_llm四段 JSON,就能为每个角色自由搭配 LLM,无需改一行代码。

先看懂:四个模型各自负责什么

TuriX 把"用电脑"这件事拆成了四个角色,每个角色独立配置一个 LLM:

角色配置项职责对模型的要求
🧠brain(大脑)brain_llm看截图、评估上一步成败、为每一步生成目标视觉理解强、输出格式稳定,建议支持思考模式
⚡actor(执行者)actor_llm把目标翻译成点击、输入、快捷键等具体动作视觉定位准、响应快
📝memory(记忆)memory_llm压缩、总结历史步骤,控制记忆 token 占用纯文本摘要能力好即可,要求最低
🗺️planner(规划者)planner_llm把任务拆成步骤级计划、挑选相关 Skills(可选)长文本规划能力强

四个角色的提示词定义在 src/agent/prompts.py 中,主流程则位于 src/agent/service.py。注意planner 是可选的:只有当agent.use_plan设为true时才需要它(见 src/agent/planner_service.py)。

config.json 配置总览

四个模型使用完全相同结构的配置块,核心字段只有 4 个:

"brain_llm": { "provider": "turix", "model_name": "turix-brain", "api_key": "YOUR_API_KEY", "base_url": "https://your-endpoint/v1" }, "actor_llm": { "provider": "...", "model_name": "...", "api_key": "...", "base_url": "..." }, "memory_llm": { "provider": "...", "model_name": "...", "api_key": "...", "base_url": "..." }, "planner_llm":{ "provider": "...", "model_name": "...", "api_key": "...", "base_url": "..." }
  • provider:决定用哪种客户端接入,目前内置turix(OpenAI 兼容)、gpt、google_flash、google_pro、anthropic、deepseek、minimax、kimi、ollama等,定义在 examples/main.py 的build_llm函数中
  • model_name/api_key/base_url:模型名称、密钥与你的模型服务地址
  • 除provider、model_name外还支持temperature、max_tokens、timeout、model_kwargs等可选字段

如果想接入其他模型,只需在main.py中按同样方式扩展一个新的 provider 分支即可。

如何为每个角色正确搭配 LLM

brain:选最强的视觉模型

brain 每一步都要分析 1~2 张截图,判断"上一步成功了吗?下一步该干什么",是整个 Agent 成败的关键。给它配置视觉能力最强的模型,并通过顶层字段brain_enable_thinking(见 examples/main.py)开启思考模式,复杂任务会更稳。

actor:选定位准、响应快的视觉模型

actor 负责把 brain 的目标落到 0~1000 归一化坐标的点击和输入上,对坐标定位精度要求高。actor 默认关闭思考模式(固定enable_thinking=False),所以不必选"想得多"的模型,快而准更重要。

memory:性价比之选

memory 只做一件事:把历史步骤压缩成结构化摘要(提示词见 src/agent/prompts.py)。纯文本模型即可胜任,可以复用 brain 的模型或换一个便宜的小模型来省成本。与之相关的memory_budget_tokens、summary_memory_budget_tokens控制记忆占用上限。

planner:开启计划才需要配置

planner 只在agent.use_plan: true时加载(examples/main.py),负责生成步骤级计划并挑选 Skills,且默认开启思考模式。如果你的任务较简单、关闭了 planning,这一段可以不填也不报错。

💡省事搭配:四个角色填同一个视觉大模型也能跑;追求效果再按"brain 最强、actor 求快、memory 求省"的原则分别升级。

进阶:四个角色全部指向本地 Ollama

本地部署时,把四个provider都改为ollama,base_url指向本机 Ollama 服务地址,model_name写你拉取的视觉模型(如 llama3.2-vision)即可,api_key可省略。这样 brain、actor、memory、planner 全程离线运行,适合数据敏感的场景。

⚠️ 常见配置坑

  1. planner 没配又开了 planning——use_plan: true时planner_llm必须填写,否则启动报错
  2. base_url 漏填——turix/deepseek之外的部分 provider 会兜底默认地址,但turix与ollama缺失时行为不同,建议显式填写
  3. api_key 找不到—— 会自动回退读取环境变量API_KEY或OPENAI_API_KEY
  4. 任务描述含糊——agent.task的清晰度直接影响成功率,写清应用名和具体目标

配置完成,一键运行

保存 examples/config.json 后执行:

python examples/main.py

Agent 会在.turix_tmp目录(由output_dir控制)中输出日志和 brain / actor / planner 的对话记录(save_brain_conversation_path等字段可自定义文件名),方便你回看每个角色的"思考过程",快速定位是哪个模型拖了后腿。

四段配置看懂了,你的 TuriX 就能换上最合适的"大脑",让桌面自动化又快又稳 🎉

【免费下载链接】TuriX-CUAThis is the official website for TuriX Computer-use-Agent项目地址: https://gitcode.com/gh_mirrors/tu/TuriX-CUA

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/30 4:07:40

Linux快速创建大文件:fallocate、truncate与dd的原理和选型指南

1. 为什么“快速创建大文件”不是个随便写个 dd 就完事的小问题在 Linux 系统运维、测试环境搭建、磁盘压力模拟、甚至某些存储系统初始化场景里,你经常需要“立刻生成一个 10GB 的空文件”——注意,是“立刻”,不是等三分钟。这时候很多人第…

作者头像 李华
网站建设 2026/9/30 4:07:26

强化学习稀疏奖励难题:HER算法如何用“事后经验”救活失败样本

“hindsight”这个英文词,直译过来是“后见之明”,听起来总带点“事后诸葛”的意思。但在强化学习圈子里,只要聊到稀疏奖励、机器人抓取、多步决策这些话题,hindsight就会以另一个身份高频出现——Hindsight Experience Replay&am…

作者头像 李华
网站建设 2026/9/30 4:06:58

从零搭建AI工程体系:环境配置、推理服务与性能调优实战

1. 从零搭建AI工程体系,为什么我劝你别急着调包很多人一上来就想跑通一个大模型应用,结果卡在环境配置、依赖冲突、显存溢出这些破事上,折腾三天连个能对话的界面都没搭出来。我见过太多这样的案例了,包括我自己早期也是这么过来的…

作者头像 李华
网站建设 2026/9/30 4:06:57

DD命令制作ISO镜像U盘启动盘:从零开始一次搞懂写盘原理与避坑指南

简介:一份讲解在Linux系统中利用系统自带DD命令制作ISO镜像U盘启动盘的Word文档,面向需要给无系统或重装系统电脑安装Linux镜像的入门与中级用户。内容从标题与需求场景展开,说明无需依赖UltraISO等第三方工具,仅需Linux系统、U盘…

作者头像 李华
网站建设 2026/9/30 4:06:47

大模型单卡部署实战:Model-Optimizer量化推理与vLLM调优全流程

第一次做模型服务化部署的时候,我搜到最多的一个名字就是 Model-Optimizer。一开始我以为它是一个具体的模型,后来才知道它更像是一整套围绕模型压缩、推理加速和部署调优的方法论与工具链。真正让我下决心把整套东西吃透的,是一次很狼狈的上…

作者头像 李华
网站建设 2026/9/30 4:06:45

NLP情感分析实战:基于PyTorch LSTM的IMDB评论分类全流程解析

简介:PDF文档以IMDB影评情感分类为实战项目,完整讲解基于PyTorch LSTM的NLP建模全流程。内容先介绍NLP情感分析概念与常用方法,再梳理PyTorch核心组件和LSTM结构,随后逐步展开IMDB数据集获取、填充与划分、模型搭建、前向传播、训…

作者头像 李华