Friday, September 11, 2026

Ollama Raspberry

curl -fsSL https://ollama.com/install.sh | sh

 

sudo systemctl edit ollama.service

#para red

[Service]

Environment="OLLAMA_HOST=0.0.0.0:11434"

#Environment="OLLAMA_KEEP_ALIVE=24h"

Environment="OLLAMA_NUM_PARALLEL=1”

Environment="OLLAMA_MAX_LOADED_MODELS=1”

Environment="OLLAMA_KEEP_ALIVE=5m”

sudo systemctl daemon-reload

sudo systemctl restart ollama

 

ollama run gemma4:e2b

 

Configurar la memoria Swap en la Raspberry Pi

Para evitar que el sistema cierre Ollama por falta de memoria (errores Out-Of-Memory), aumenta el archivo de intercambio (Swap):

Abre el archivo de configuración: sudo nano /etc/dphys-swapfile

Cambia CONF_SWAPSIZE=100 por CONF_SWAPSIZE=2048 (o 4096 si tienes espacio en la MicroSD/SSD).

Reinicia el servicio de swap:

bash

sudo /etc/init.d/dphys-swapfile stop

sudo /etc/init.d/dphys-swapfile start



 

 

 

 

 

 

API

curl http:// localhost:11434/api/generate -d '{

  "model": " qwen2.5-coder:3b ",

  "prompt": "¿Cómo se creo roma en 5 lineas?",

  "stream": false

}'

qwen2.5-coder:3b

para bajar

ollama run gemma4:e2b --keepalive 0s

 

 

sudo nano prueba.py

 

import requests

import json

 

url = "http://localhost:11434/api/generate"

payload = {

    "model": " qwen2.5-coder:3b",

    "prompt": "Escribe un saludo corto.",

    "stream": False

}

 

response = requests.post(url, json=payload)

 

if response.status_code == 200:

    resultado = response.json()

    print("Respuesta:", resultado.get("response"))

else:

    print("Error:", response.status_code)

 

 

 

No comments:

Post a Comment