openclaw关于大模型的优化设置总结
一、openclaw配置文件优化
"models": {
"mode": "merge",
"providers": {
"ollama": {
"baseUrl": "http://192.168.222.162:11434",
"apiKey": "OLLAMA_API_KEY",
"api": "ollama",
"timeoutSeconds": 600,#此处为添加内容,ollama单次推理超时时间
"models": [
{
"id": "gemma4",
"name": "gemma4",
"reasoning": false,
"input": [
"text"
],
"cost": {
"input": 0,
"output": 0,
"cacheRead": 0,
"cacheWrite": 0
},
"contextWindow": 128000,
"maxTokens": 8192,
"params": { #params这里是后加的,所有发给ollama的设置都可以在这里添加
"num_ctx": 65536, #上下文长度,不用管模型的上下文,这里设置为64k优先级最高
"num_predict": 8192, #单次输出文本长度 ,不能设置为1024或2048太小模型不输出
*"num_parallel": 1, #并行推理数,不能用删掉
"keep_alive": "20s" #保证模型常驻内存,不能用删掉*
"think": false #关闭大模型的思考过程,节省上下文
},
"compat": {
"supportsTools": true,
"supportsUsageInStreaming": true
}
},
二、ollama运行服务器优化