这四家直接支持的免费大模型都不直接具有文生图的功能
多模态不一定文生图。
但我在TraeWork 和Qoder 中都用上了文生图功能。
TraeWork是当时字帖生成器基本完工(在当时看来可以完赛),还有赠送的积分剩余,我于是测试连环画生成功能。后来发现,其实是内置了其它可以文生图的未知大模型,可能是seedance之类,这是消耗积分的
Qoder则是纯粹免费的,我想盲测Qwen3.8flash是否可以文生图。结果发现,居然也能够生成连环画!——其实也是因为Qoder内置了自己的其它可以文生图的大模型,具体哪个我不知道。——但正常用qwen3.8flash其实是免费的,不扣credits,但文生图的时候,我突然发现credits哗哗掉,这才明白,文生图触发了不免费的其它大模型,所以,开始扣费了。
Zcode的1亿token是可以确认不具有文生图的功能、在当前纯免费的情况下,也不具有调用文生图大模型的可能性。所以zcode其实非常小巧。
Workbuddy,除非自己有文生图大模型,但QClaw 则是直接调用 qclaw generate image skill
QClaw中生成上面的图片,然后追究这个过程和来龙去脉:
从当前 Skill 脚本和配置看,可以回答你这两个问题:
- qclaw-generate-image 用了哪个文生图大模型?
脚本本身并不直接指定模型。它通过 AUTH_GATEWAY 把任务提交给本地网关代理:
text复制POST 127.0.0.1:19000/proxy/qclaw-generate-image/submit
也就是走 OpenClaw 的 qclaw-generate-image 专用代理通道。真正的文生图后端由 QClaw 应用层在网关处路由,脚本看不到模型名。
从当前 openclaw.json 里已配置的模型列表看,你并没有一个显式配置为「文生图」的 provider;qclaw/pool-kimi 是文本模型池。因此生图模型大概率是 QClaw 内置或应用层的图片生成服务(可能是 Gemini Image、Kling、Recraft 这类,由 QClaw 网关统一封装),而不是你当前会话用的 qclaw/pool-kimi-k2.7-code-highspeed。
如果你想确认具体模型,需要在网关侧查 QClaw 日志或看 /proxy/qclaw-generate-image 路由指向哪个上游。 - Token 消耗怎么算?
分两层:
文本会话层:你当前选的 qclaw/pool-kimi-k2.7-code-highspeed 只参与生成文字回复、构造 prompt、调用 skill。这一轮里,读取文件、拼接 prompt、最终回答都会走这个模型,按它的输入/输出 token 计费。
图片生成层:generate.cjs 是独立脚本,它不调用 LLM,只和网关做 HTTP 交互(提交、轮询、下载)。所以:
文生图本身不消耗 Kimi 的 token;
但我在执行前做 prompt 扩写、调用前后读取 skill 文件、回答你问题,这些文字工作会消耗 Kimi 的 token。
简单说:画图是画图,聊天是聊天,两者分开计费。generate.cjs 只是网关的客户端,不产生 LLM token 费用。
如果你想进一步确认,可以查 openclaw logs --follow 里 qclaw-generate-image 的 upstream 日志,或者直接看 QClaw 计费明细里这次生图对应的模型名。需要我帮你抓一下网关日志吗?