Home › Development › ollama-handoff

ollama-handoff

Offload cheap work from your AI agent to a local Ollama model, at zero cloud cost.

Python Local macOSWindowsLinux
★ 3 stars Last pushed 2026-09-23 License: MIT

Topics: Developer Tools

Connect

Review any command before running it. Package names and URLs come from the server's own registry entry.

Package (pypi 0.1.2)

uvx ollama-handoff

Or add to your MCP client config:

{
  "mcpServers": {
    "ollama-handoff": {
      "command": "uvx",
      "args": [
        "ollama-handoff"
      ],
      "env": {
        "OLLAMA_URL": "<YOUR_VALUE>",
        "OLLAMA_DEFAULT_MODEL": "<YOUR_VALUE>",
        "OLLAMA_NUM_CTX": "<YOUR_VALUE>",
        "OLLAMA_KEEP_ALIVE": "<YOUR_VALUE>",
        "OLLAMA_TIMEOUT_S": "<YOUR_VALUE>"
      }
    }
  }
}
  • OLLAMA_URL — Base URL of the Ollama server.
  • OLLAMA_DEFAULT_MODEL — Default model used for handoffs.
  • OLLAMA_NUM_CTX — Context window in tokens.
  • OLLAMA_KEEP_ALIVE — How long to keep the model resident in VRAM.
  • OLLAMA_TIMEOUT_S — Per-request timeout in seconds.

Related servers

Listed in punkpeye/awesome-mcp-servers (MIT)

Data from the Official MCP Registry