local-models
Installation
SKILL.md
Local Model Deployment
Ollama Setup
# Install model
ollama pull qwen2.5:7b
# Run
ollama run qwen2.5:7b
# API endpoint
curl http://localhost:11434/api/generate
llama.cpp (for Claude Code integration)
# Start server
llama-server --model model.gguf --port 8001