Ir al contenido

Ejecución de modelos de IA localmente con Ollama

Ejecución de modelos de IA localmente con Ollama

Sección titulada «Ejecución de modelos de IA localmente con Ollama»

Ollama es una herramienta que permite ejecutar modelos de lenguaje grandes (LLMs) localmente en tu máquina. Esto es especialmente útil para aquellos que desean mantener la privacidad de sus datos o reducir la dependencia de servicios en la nube. A continuación, se detalla cómo integrar Ollama con ArchiHUB para aprovechar modelos de IA localmente.

El docker-compose.yml de ArchiHUB trae el servicio de Ollama comentado. Para habilitarlo, descomenta el bloque archihub_ollama:

archihub_ollama:
image: ollama/ollama:latest
restart: unless-stopped
volumes:
- ../../ollama:/root/.ollama
environment:
CUDA_VISIBLE_DEVICES: 0 # Remove if not using a GPU
networks:
- archihub_mongo_network
- archihub_elastic_network
command: serve
# Remove the deploy section if not using a GPU
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: 1
capabilities: [gpu]

Los modelos se guardan en la carpeta ollama de la raíz del repositorio. Si la máquina no tiene una GPU NVIDIA, elimina la variable CUDA_VISIBLE_DEVICES y la sección deploy. Luego inicia el servicio con docker compose up -d.

El servicio no publica ningún puerto: el backend lo alcanza por la red interna de Docker con el nombre archihub_ollama, así que no hace falta configurar variables de entorno.

Una vez que Ollama esté en funcionamiento, puedes instalar modelos de IA utilizando el comando ollama pull. Por ejemplo, para instalar el modelo llama2, ejecuta el siguiente comando en la terminal:

Ventana de terminal
docker compose exec archihub_ollama ollama pull llama2 # Reemplaza "llama2" con el nombre del modelo que deseas instalar.

Después de instalar los modelos en Ollama, ArchiHUB podrá utilizarlos para diversas tareas de inteligencia artificial. Para esto, en el menú Asistentes de IA de ArchiHUB crea un asistente nuevo con estos datos:

  • Protocolo: ollama.
  • URL base: http://archihub_ollama:11434.
  • Modelo por defecto: uno de los modelos que instalaste, por ejemplo llama2.

Ollama no necesita llave de acceso. Los datos del modelo, como su ventana de contexto, se consultan al propio Ollama.

Creación del asistente en ArchiHUB

Configuración del asistente en ArchiHUB

Con estos pasos, habrás configurado exitosamente Ollama para ejecutar modelos de IA localmente en ArchiHUB. Ahora puedes aprovechar las capacidades de inteligencia artificial sin depender de servicios externos.

Una vez que el asistente de Ollama esté configurado en ArchiHUB, podrás utilizar los modelos instalados para diversas tareas, como generación de texto, análisis de documentos, entre otros. A continuación, se presenta un listado de recursos que el asistente puede utilizar:

  • Documentos cargados en ArchiHUB.
  • Imágenes cargadas en ArchiHUB (si el modelo lo soporta).
  • Transcripciones de audio a texto.
  • Información adicional proporcionada por el usuario.

Por ejemplo, si tienes un video que se transcribió usando el plugin de transcripción, el asistente podrá analizar el texto resultante para responder preguntas o generar resúmenes basados en el contenido del video:

Análisis de transcripciones con Ollama

O si quieres identificar un ave a partir de una imagen cargada en ArchiHUB, el asistente podrá ayudarte a identificarla utilizando el modelo de Ollama que soporte análisis de imágenes:

Identificación de imágenes con Ollama