一、openclaw配置文件优化

"models": {

"mode": "merge",
"providers": {
  "ollama": {
    "baseUrl": "http://192.168.222.162:11434",
    "apiKey": "OLLAMA_API_KEY",
    "api": "ollama",
    "timeoutSeconds": 600,#此处为添加内容,ollama单次推理超时时间
    "models": [
      {
        "id": "gemma4",
        "name": "gemma4",
        "reasoning": false,
        "input": [
          "text"
        ],
        "cost": {
          "input": 0,
          "output": 0,
          "cacheRead": 0,
          "cacheWrite": 0
        },
        "contextWindow": 128000,
        "maxTokens": 8192,
        "params": {  #params这里是后加的,所有发给ollama的设置都可以在这里添加
          "num_ctx": 65536, #上下文长度,不用管模型的上下文,这里设置为64k优先级最高
          "num_predict": 8192, #单次输出文本长度 ,不能设置为1024或2048太小模型不输出
          *"num_parallel": 1,  #并行推理数,不能用删掉
          "keep_alive": "20s"  #保证模型常驻内存,不能用删掉*
          "think": false #关闭大模型的思考过程,节省上下文
        },
        "compat": {
          "supportsTools": true,
          "supportsUsageInStreaming": true
        }
      },

二、ollama运行服务器优化

标签: none

添加新评论