curl -fsSL https://ollama.com/install.sh | sh
ollama pull <model>
For example:
ollama pull qwen3:8b
ollama pull mistral
List available models:
ollama list
ollama run mistral "Say hello"
By default, the server is available at:
http://localhost:11434
From Python:
import requests
response = requests.post(
"http://localhost:11434/api/generate",
json={
"model": "qwen3:8b",
"prompt": "Explain quantum computing in one paragraph."
}
)Using OpenAI-compatible endpoint:
from openai import OpenAI
client = OpenAI(
base_url="http://localhost:11434/v1",
api_key="dummy"
)
response = client.chat.completions.create(
model="qwen3:8b",
messages=[
{"role": "user", "content": "Hello"}
]
)
print(response.choices[0].message.content)