openclaw控制llama.cpp的qwen3.6思考与否
·
结论
~/.openclaw/openclaw.json里的models.providers.llama.models.x改成
"reasoning": true,
"compat":{
"thinkingFormat":"qwen-chat-template"
,"supportsReasoningEffort":false
}
背景
llama.cpp启动qwen3.6。openclaw添加它,一般是选择custom provider->8080/v1。随后openclaw会自动在openclaw.json里添加里这个大模型。
openclaw gateway里聊天,随后去
tail -f ~/.openclaw/agents/main/sessions/agents/main/sessions/最新的jsonl
找最新的"role":"assistant"。它就是openclaw接受到llama的报文。
故障
在openclaw gateway的聊天框处,无论思考模式选off还是high,对应的日志里都有
"content":[{"type":"thinking","thinking":"思考内容"}
原因
思考是大模型天生的能力,传入它的报文,需加上字段
"chat_template_kwargs": {"enable_thinking":false}
才能控制它思考与否。参见modelscope.cn/models/Qwen/Qwen3.6-35B-A3B。各家大模型控制思考与否的字段并不一样,openclaw为此设置了thinkingFormat字段,把它设置为qwen系列即可自动组装出这个字段。
qwen3.6原本就没有控制推理努力程度的参数,因此"supportsReasoningEffort":false。
更多推荐
所有评论(0)