文章目录

结论

~/.openclaw/openclaw.json里的models.providers.llama.models.x改成

"reasoning": true,
"compat":{
 "thinkingFormat":"qwen-chat-template"
 ,"supportsReasoningEffort":false
 }

背景

llama.cpp启动qwen3.6。openclaw添加它,一般是选择custom provider->8080/v1。随后openclaw会自动在openclaw.json里添加里这个大模型。
openclaw gateway里聊天,随后去

tail -f ~/.openclaw/agents/main/sessions/agents/main/sessions/最新的jsonl

找最新的"role":"assistant"。它就是openclaw接受到llama的报文。

故障

在openclaw gateway的聊天框处,无论思考模式选off还是high,对应的日志里都有

"content":[{"type":"thinking","thinking":"思考内容"}

原因

思考是大模型天生的能力,传入它的报文,需加上字段

"chat_template_kwargs": {"enable_thinking":false}

才能控制它思考与否。参见modelscope.cn/models/Qwen/Qwen3.6-35B-A3B。各家大模型控制思考与否的字段并不一样,openclaw为此设置了thinkingFormat字段,把它设置为qwen系列即可自动组装出这个字段。
qwen3.6原本就没有控制推理努力程度的参数,因此"supportsReasoningEffort":false

Logo

腾讯云面向开发者汇聚海量精品云计算使用和开发经验,营造开放的云计算技术生态圈。

更多推荐