Einen Tag nach dem Initial-Release folgt für beide Hailo-Rollen Version 0.2.0 - mit zwei deutlichen Sprüngen: wählbare Paket-Quellen (Raspberry-Pi-Repository oder Hailo-Vendor) und eine vollständige Web-UI-Auslieferung mit Open WebUI und optionalem Caddy-TLS.
head1328.hailo- Treiber und Runtime für die Hailo-NPUhead1328.hailo_ollama- Hailo-Ollama-LLM-Server inkl. Open WebUI und Caddy-Reverse-Proxy
head1328.hailo#
Die Basis-Rolle installiert den Hailo-Treiber und die Runtime. Unterstützte Hardware:
| Gerät | Variante | TOPS |
|---|---|---|
| AI HAT+ (Hailo-8L) | h8l | 13 |
| AI HAT+ (Hailo-8) | h8 | 26 |
| AI HAT+ 2 (Hailo-10H) | h10 | 40 |
Neu in 0.2.0:
- Quellen wählbar:
hailo_source: raspberry(apt-Repository des Raspberry-Pi-OS) oderhailo_source: vendor(Pakete vondev-public.hailo.ai) - Variablen
hailo_vendor_versionundhailo_vendor_base_urlfür gezieltes Pinnen der Vendor-Pakete - Automatisches Aufräumen kollidierender Pakete beim Wechsel
raspberry⇄vendor - Robusteres Handling des apt-States bei Quellen-Wechseln
- Eigenes Molecule-Szenario für die Vendor-Variante inkl. Idempotenz-Test
head1328.hailo_ollama#
Setzt auf der Treiber-Rolle auf und bringt einen LLM-Server für die Hailo-10H-NPU mit. Container laufen rootless via Podman Quadlets.
Neu in 0.2.0:
- Quellen wählbar: Hailo-GenAI-Model-Zoo aus dem Raspberry-Pi-OS oder direkt vom Hailo-Vendor
- Open WebUI als Chat-Frontend (standardmäßig aktiv, gepinnt auf
0.8) - Optionaler Caddy-Reverse-Proxy mit TLS
- iptables-PREROUTING-Redirect für privilegierte Ports + Persistenz über Reboots via
iptables-persistent - Caddy-Workarounds für Open WebUI 0.8 (
/config-Stub,/api/*/0-Path-Rewrite) - Open WebUI-Title-Generation und Follow-up-Suggestions standardmäßig aus (NPU-Limit: ein Request gleichzeitig)
OLLAMA_HOST-Env in der systemd-Unit für Kompatibilität mit hailo-ollama 5.3.0- Anleitung zum Importieren der Caddy-Root-CA in den Browser
Wofür gedacht#
Wer einen Raspberry Pi 5 mit AI HAT+ 2 als kleinen, lokalen LLM-Server betreiben möchte - ohne dass dafür eine GPU oder ein Cloud-Account nötig wäre. Im Zusammenspiel mit head1328.ivly
wird daraus eine vollständige, selbstgehostete Backoffice-Umgebung mit LLM-Unterstützung.
Installation#
ansible-galaxy role install head1328.hailo
ansible-galaxy role install head1328.hailo_ollamaLizenz#
Beide Rollen: AGPL-3.0-or-later.
Verwendete Projekte#
- Hailo - NPU-Hardware und SDK
- Ollama - LLM-Server
- Open WebUI - Chat-Frontend für Ollama
- Caddy - Reverse Proxy mit automatischer TLS-Verwaltung
- Podman - daemonless Container-Runtime
- Ansible Galaxy - Rollen-Registry
Hat dir das hier geholfen?
Unterstütze gerne via:
