curl
-fsSL https://ollama.com/install.sh | sh
sudo systemctl edit ollama.service
#para red
[Service]
Environment="OLLAMA_HOST=0.0.0.0:11434"
#Environment="OLLAMA_KEEP_ALIVE=24h"
Environment="OLLAMA_NUM_PARALLEL=1”
Environment="OLLAMA_MAX_LOADED_MODELS=1”
Environment="OLLAMA_KEEP_ALIVE=5m”
sudo
systemctl daemon-reload
sudo
systemctl restart ollama
ollama run gemma4:e2b
Configurar la memoria Swap en la Raspberry Pi
Para evitar que el sistema cierre Ollama por falta de
memoria (errores Out-Of-Memory), aumenta el archivo de intercambio (Swap):
Abre el archivo de configuración: sudo nano
/etc/dphys-swapfile
Cambia CONF_SWAPSIZE=100 por CONF_SWAPSIZE=2048 (o 4096
si tienes espacio en la MicroSD/SSD).
Reinicia el servicio de swap:
bash
sudo
/etc/init.d/dphys-swapfile stop
sudo
/etc/init.d/dphys-swapfile start
API
curl
http:// localhost:11434/api/generate -d '{
"model":
" qwen2.5-coder:3b ",
"prompt": "¿Cómo se creo roma
en 5 lineas?",
"stream": false
}'
qwen2.5-coder:3b
para bajar
ollama run gemma4:e2b --keepalive 0s
sudo nano prueba.py
import requests
import
json
url =
"http://localhost:11434/api/generate"
payload = {
"model":
" qwen2.5-coder:3b",
"prompt": "Escribe
un saludo corto.",
"stream": False
}
response
= requests.post(url, json=payload)
if response.status_code == 200:
resultado = response.json()
print("Respuesta:",
resultado.get("response"))
else:
print("Error:",
response.status_code)
No comments:
Post a Comment