{"id":216135,"date":"2026-08-26T11:00:59","date_gmt":"2026-08-26T09:00:59","guid":{"rendered":"https:\/\/www.deskmodder.de\/blog\/?p=216135"},"modified":"2026-08-25T15:15:24","modified_gmt":"2026-08-25T13:15:24","slug":"lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten","status":"publish","type":"post","link":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/","title":{"rendered":"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten"},"content":{"rendered":"<p>Mit dem BOSGAME M5 hatten wir Anfang August eine kompakte Linux-Workstation mit AMD Ryzen AI MAX+ 395, Radeon 8060S und 128 GB LPDDR5X im Test. Statt des vorinstallierten Windows 11 Pro kam bei uns Debian 13 zum Einsatz. Darauf haben wir verschiedene Sprachmodelle mit Ollama und GPU-Beschleunigung \u00fcber AMD ROCm getestet. In den Kommentaren kam anschlie\u00dfend die Frage auf, wie eine solche lokale KI-Umgebung eingerichtet wird. Genau das reichen wir mit diesem HowTo nach. Wir bleiben dabei bewusst bei Linux und orientieren uns an der Konfiguration, die wir f\u00fcr den Test des BOSGAME M5 verwendet haben. Dabei zeigte sich auch, dass lokale KI unter Linux keineswegs mit jedem Workload gleich gut funktioniert. Sprachmodelle liefen mit Ollama auf Strix Halo \u00fcberzeugend. Bei anderen Anwendungen und insbesondere der Videogenerierung stie\u00dfen wir dagegen auf deutlich gr\u00f6\u00dfere H\u00fcrden.<\/p>\n<figure id=\"attachment_216136\" aria-describedby=\"caption-attachment-216136\" style=\"width: 500px\" class=\"wp-caption aligncenter\"><a href=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png\" rel=\"lightbox[216135]\"><img loading=\"lazy\" decoding=\"async\" class=\"wp-image-216136 size-medium\" src=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-500x281.png\" alt=\"\" width=\"500\" height=\"281\" srcset=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-500x281.png 500w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-810x456.png 810w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-306x172.png 306w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-1536x864.png 1536w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png 1672w\" sizes=\"auto, (max-width: 500px) 100vw, 500px\" \/><\/a><figcaption id=\"caption-attachment-216136\" class=\"wp-caption-text\">Symbolfoto: KI-generierter Inhalt mit ChatGPT Images (OpenAI)<\/figcaption><\/figure>\n<h2>Warum lokale KI \u00fcberhaupt interessant ist<\/h2>\n<p>Cloud-Dienste wie ChatGPT, Claude oder Gemini bieten einen unkomplizierten Zugang zu leistungsf\u00e4higen Sprachmodellen. Die Verarbeitung findet dabei allerdings auf der Infrastruktur des jeweiligen Anbieters statt. Bei einer lokalen Installation liegen sowohl das Modell als auch die Rechenarbeit auf dem eigenen System. Prompts, Quellcode, Dokumente oder andere Informationen m\u00fcssen f\u00fcr die eigentliche Inferenz deshalb nicht an einen externen LLM-Anbieter \u00fcbertragen werden. Gerade bei vertraulichen Daten kann das interessant sein. Gleichzeitig entscheidet der Betreiber selbst \u00fcber Modell, Software und Netzwerkzugriff. Daf\u00fcr muss er sich allerdings auch selbst um Betriebssystem, Treiber, Modelle und Updates k\u00fcmmern. Lokal bedeutet zudem nicht automatisch offline. Werden sp\u00e4ter externe APIs, Suchmaschinen oder andere Cloud-Dienste eingebunden, k\u00f6nnen weiterhin Daten das eigene Netzwerk verlassen. Entscheidend ist deshalb immer der gesamte Datenfluss.<\/p>\n<h2>Debian 13 als Grundlage<\/h2>\n<p>Auf dem <a href=\"https:\/\/www.deskmodder.de\/blog\/2026\/08\/03\/bosgame-m5-im-test-kompakte-linux-workstation-fuer-lokale-ki\/\">BOSGAME M5<\/a> haben wir Windows 11 Pro durch Debian 13 ersetzt. Prozessor, NVMe-SSD, Netzwerk und Radeon-Grafik wurden direkt erkannt. F\u00fcr den gew\u00f6hnlichen Linux-Betrieb war deshalb keine umfangreiche Nacharbeit notwendig.<\/p>\n<p>Vor der Einrichtung von ROCm sollte Debian zun\u00e4chst aktualisiert werden:<\/p>\n<p><code>sudo apt update<\/code><br \/>\n<code>sudo apt full-upgrade<\/code><br \/>\n<code>sudo reboot<\/code><\/p>\n<p>Nach dem Neustart l\u00e4sst sich \u00fcberpr\u00fcfen, ob die Grafikhardware erkannt wird:<\/p>\n<p><code>lspci | grep -Ei \"VGA|Display\"<\/code><\/p>\n<p>F\u00fcr die Berechnung der Sprachmodelle <a href=\"https:\/\/rocm.docs.amd.com\/en\/latest\/install\/rocm.html\">ben\u00f6tigen wir anschlie\u00dfend AMD ROCm<\/a>.<\/p>\n<h2>ROCm erm\u00f6glicht den Zugriff auf die Radeon 8060S<\/h2>\n<p>ROCm ist AMDs Compute-Plattform und stellt die notwendigen Komponenten bereit, damit Anwendungen die Radeon-GPU f\u00fcr entsprechende Berechnungen verwenden k\u00f6nnen. Die konkreten Installationsschritte h\u00e4ngen von der verwendeten ROCm- und Linux-Version ab. Gerade bei einer jungen Architektur wie Strix Halo empfiehlt es sich deshalb, die jeweils aktuelle AMD-Dokumentation zu verwenden.<\/p>\n<p>Nach der Installation l\u00e4sst sich die Erkennung mit:<\/p>\n<p><code>rocminfo<\/code><\/p>\n<p>kontrollieren.<\/p>\n<p>Auf unserem BOSGAME M5 wurde die Radeon 8060S als gfx1151 erkannt. ROCm meldete au\u00dferdem die erwarteten 40 Compute Units und einen maximalen GPU-Takt von 2.900 MHz.<\/p>\n<h2>Zugriffsrechte verhinderten zun\u00e4chst den GPU-Zugriff<\/h2>\n<p>ROCm erkannte die Hardware korrekt, der verwendete Benutzer hatte zun\u00e4chst aber nicht die erforderlichen Zugriffsrechte auf die Render-Ger\u00e4te. Wir haben ihn deshalb der Gruppe render hinzugef\u00fcgt:<\/p>\n<p><code>sudo usermod -aG render $USER<\/code><\/p>\n<p>Abh\u00e4ngig von der Konfiguration kann zus\u00e4tzlich die Gruppe video erforderlich sein:<\/p>\n<p><code>sudo usermod -aG video $USER<\/code><\/p>\n<p>Nach einer erneuten Anmeldung beziehungsweise einem Neustart l\u00e4sst sich mit:<\/p>\n<p><code>groups<\/code><\/p>\n<p>kontrollieren, ob die Gruppenzugeh\u00f6rigkeit \u00fcbernommen wurde. Die vorhandenen Render-Ger\u00e4te zeigt:<\/p>\n<p><code>ls -l \/dev\/dri\/<\/code><\/p>\n<p>Nach der Anpassung konnte <a href=\"https:\/\/www.deskmodder.de\/blog\/?s=Ollama\">Ollama<\/a> bei uns zuverl\u00e4ssig auf die Radeon 8060S zugreifen.<\/p>\n<p>Nicht jedes ROCm-Werkzeug arbeitete fehlerfrei<\/p>\n<p>Die eigentliche Compute-Unterst\u00fctzung funktionierte, bei den begleitenden Werkzeugen zeigte sich die junge Plattform allerdings noch. rocm-smi konnte zwar unter anderem Temperatur, Leistungsaufnahme und Auslastung anzeigen, einzelne Abfragen endeten bei uns jedoch mit Exception caught: map::at. Das hatte keinen Einfluss auf die GPU-Beschleunigung. Ein fehlerhaftes Monitoring-Werkzeug bedeutet deshalb nicht automatisch, dass ROCm insgesamt nicht funktioniert.<\/p>\n<h2>Ollama unter Linux installieren<\/h2>\n<p>Nachdem ROCm funktionierte, haben wir Ollama eingerichtet:<\/p>\n<p><code>curl -fsSL https:\/\/ollama.com\/install.sh | sh<\/code><\/p>\n<p>Die installierte Version l\u00e4sst sich anschlie\u00dfend mit:<\/p>\n<p><code>ollama --version<\/code><\/p>\n<p>\u00fcberpr\u00fcfen. Unter Linux l\u00e4uft Ollama normalerweise als Dienst:<\/p>\n<p><code>systemctl status ollama<\/code><\/p>\n<p>Ollama \u00fcbernimmt das Herunterladen, Laden und Ausf\u00fchren der Sprachmodelle und stellt zus\u00e4tzlich eine API f\u00fcr andere Anwendungen bereit.<\/p>\n<h2>Modelle bewusst \u00fcber die CLI getestet<\/h2>\n<p>F\u00fcr einen ersten Test empfiehlt sich ein vergleichsweise kleines Modell. Qwen3 l\u00e4sst sich beispielsweise mit:<\/p>\n<p><code>ollama run qwen3:8b<\/code><\/p>\n<p>starten.<\/p>\n<p>Beim ersten Aufruf l\u00e4dt Ollama die ben\u00f6tigten Modelldateien herunter. Danach kann direkt im Terminal mit dem Modell gearbeitet werden.<\/p>\n<p>Installierte Modelle zeigt:<\/p>\n<p><code>ollama list<\/code><\/p>\n<p>Nicht mehr ben\u00f6tigte Modelle lassen sich beispielsweise mit:<\/p>\n<p><code>ollama rm qwen3:8b<\/code><\/p>\n<p>entfernen.<\/p>\n<p>F\u00fcr unseren BOSGAME-Test haben wir bewusst ausschlie\u00dflich die Kommandozeile verwendet. Die Benchmarks wurden direkt \u00fcber Ollama durchgef\u00fchrt. Eine zus\u00e4tzliche Weboberfl\u00e4che war nicht Bestandteil des Testaufbaus.<\/p>\n<h2>Pr\u00fcfen, ob Ollama wirklich die GPU nutzt<\/h2>\n<p>Eine erfolgreiche Textausgabe bedeutet noch nicht zwangsl\u00e4ufig, dass Ollama das Modell \u00fcber die Radeon ausf\u00fchrt. Die Software kann Modelle auch \u00fcber die CPU berechnen.<\/p>\n<p>W\u00e4hrend ein Modell geladen ist, hilft:<\/p>\n<p><code>ollama ps<\/code><\/p>\n<p>Der Befehl zeigt unter anderem, ob ein Modell auf der GPU oder teilweise \u00fcber die CPU ausgef\u00fchrt wird. Gerade bei unerwartet niedriger Leistung sollte deshalb zun\u00e4chst kontrolliert werden, wo das Modell tats\u00e4chlich berechnet wird.<\/p>\n<h2>Open WebUI als optionale Oberfl\u00e4che<\/h2>\n<p>Wer Ollama dauerhaft einsetzt, muss nicht ausschlie\u00dflich im Terminal arbeiten. Mit Open WebUI steht beispielsweise eine browserbasierte Oberfl\u00e4che zur Verf\u00fcgung, die sich direkt mit einer vorhandenen Ollama-Instanz verbinden l\u00e4sst. Ollama bleibt dabei das eigentliche Backend. Open WebUI setzt lediglich eine komfortablere Oberfl\u00e4che davor und greift \u00fcber die Ollama-API auf die Modelle zu. L\u00e4uft Open WebUI etwa in einem Docker-Container und Ollama direkt auf dem Linux-Host, kann die Verbindung \u00fcber Port 11434 beziehungsweise host.docker.internal hergestellt werden. Gerade wenn der Rechner sp\u00e4ter als zentraler KI-Server im Netzwerk arbeitet, kann eine Weboberfl\u00e4che komfortabler sein als die CLI.<\/p>\n<h2>Strix Halo profitiert vom gro\u00dfen gemeinsamen Speicher<\/h2>\n<p>Eine der interessantesten Eigenschaften des Ryzen AI MAX+ 395 ist seine Speicherarchitektur. CPU und Radeon 8060S greifen auf denselben LPDDR5X-Speicher zu. In unserem BOSGAME M5 sind davon 128 GB verbaut. Im UEFI konnten wir bis zu 96 GB f\u00fcr die Grafikeinheit reservieren.<\/p>\n<p><a href=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42.jpg\" rel=\"lightbox[216135]\"><img loading=\"lazy\" decoding=\"async\" class=\"aligncenter size-medium wp-image-215517\" src=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42-500x276.jpg\" alt=\"\" width=\"500\" height=\"276\" srcset=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42-500x276.jpg 500w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42-810x447.jpg 810w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42-306x169.jpg 306w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42-1536x847.jpg 1536w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42-600x330.jpg 600w, https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/photo-2026-08-03-18-34-42.jpg 1674w\" sizes=\"auto, (max-width: 500px) 100vw, 500px\" \/><\/a><\/p>\n<p>Gerade bei lokalen Sprachmodellen ist das ein Vorteil gegen\u00fcber vielen klassischen Grafikkarten. Eine leistungsf\u00e4hige Desktop-GPU kann erheblich mehr Rechenleistung bieten, verf\u00fcgt aber h\u00e4ufig nur \u00fcber 12, 16 oder 24 GB eigenen VRAM. Passt ein Modell dort nicht hinein, hilft die h\u00f6here Rohleistung nur bedingt. Strix Halo kann der Radeon dagegen einen deutlich gr\u00f6\u00dferen Speicherbereich zur Verf\u00fcgung stellen. Gleichzeitig muss gen\u00fcgend Speicher f\u00fcr Betriebssystem und andere Anwendungen verbleiben.<\/p>\n<h2>30B-Modelle liefen mit mehr als 60 Tokens pro Sekunde<\/h2>\n<p>F\u00fcr den urspr\u00fcnglichen BOSGAME-Test haben wir mehrere Modelle unter m\u00f6glichst vergleichbaren Bedingungen ausgef\u00fchrt. Dabei verwendeten wir Temperatur 0, Seed 42 und maximal 512 Ausgabetokens. <code>qwen3:30b-a3b<\/code> erreichte 66,10 Tokens pro Sekunde. <code>qwen3-coder:30b<\/code> kam auf 63,84 Tokens pro Sekunde. Beide Modelle konnten damit ausgesprochen fl\u00fcssig genutzt werden. Das kleinere <code>qwen3:8b<\/code> erreichte 39,05 Tokens pro Sekunde, <code>qwen3:14b<\/code> kam auf 23,32 Tokens pro Sekunde. Bei den gr\u00f6\u00dferen dichten Modellen lagen <code>gemma3:27b<\/code> bei 11,56 und <code>qwen3:32b<\/code> bei 10,64 Tokens pro Sekunde. Die Ergebnisse zeigen zugleich, warum die reine Parameterzahl wenig \u00fcber die Geschwindigkeit aussagt.<code> qwen3:30b-a3b<\/code> arbeitet als Mixture-of-Experts-Modell und aktiviert pro Token nur einen Teil seiner Parameter.<\/p>\n<h2>DeepSeek-R1 70B scheiterte am Speicher<\/h2>\n<p>Nicht jedes Modell lie\u00df sich auf unserem Aufbau starten. Bei DeepSeek-R1 mit 70 Milliarden Parametern war in der damaligen Konfiguration Schluss. <a href=\"https:\/\/www.deskmodder.de\/blog\/?s=ROCm\">ROCm<\/a> konnte den ben\u00f6tigten GPU-Speicher nicht reservieren. Die insgesamt vorhandenen 128 GB LPDDR5X bedeuten also nicht, dass automatisch jedes Modell entsprechender Gr\u00f6\u00dfe ausgef\u00fchrt werden kann. Neben den Modellgewichten ben\u00f6tigen unter anderem Kontext, Cache, Zwischenergebnisse, ROCm und das Betriebssystem zus\u00e4tzlichen Speicher. Auch Quantisierung und die im UEFI konfigurierte Speicheraufteilung spielen eine Rolle.<\/p>\n<h2>Videogenerierung zeigte die derzeitigen Grenzen von ROCm<\/h2>\n<p>Noch deutlicher wurden die Einschr\u00e4nkungen bei anderen KI-Workloads. Die guten Erfahrungen mit Ollama lassen sich nicht ohne Weiteres auf Bild- oder Videogenerierung \u00fcbertragen. Wir haben auf dem BOSGAME M5 auch mit PyTorch und ComfyUI experimentiert. Dabei bereiteten Abh\u00e4ngigkeiten, unterst\u00fctzte PyTorch-Versionen und die noch junge gfx1151-Architektur deutlich mehr Probleme. Eine funktionierende lokale Videogenerierung konnten wir unter Linux auf dem M5 letztlich nicht einrichten.<\/p>\n<p>Das zeigt, dass nicht allein die Hardware entscheidend ist. Die Radeon 8060S besitzt ausreichend Rechenleistung und kann auf einen gro\u00dfen Speicherbereich zugreifen. Unterst\u00fctzt der jeweilige Software-Stack die Architektur aber nicht sauber, lassen sich diese Ressourcen nicht ohne Weiteres nutzen.<\/p>\n<h2>CUDA bleibt bei einigen Workloads im Vorteil<\/h2>\n<p><a href=\"https:\/\/www.deskmodder.de\/blog\/?s=Nvidia\">Nvidia<\/a> besitzt an dieser Stelle mit <a href=\"https:\/\/www.deskmodder.de\/blog\/?s=CUDA\">CUDA<\/a> weiterhin einen praktischen Vorteil. Viele Projekte aus dem Bereich Bild- und Videogenerierung werden prim\u00e4r f\u00fcr CUDA entwickelt oder dort zumindest umfangreicher getestet. ROCm-Unterst\u00fctzung ist bei zahlreichen Projekten vorhanden, kann bei neuer AMD-Hardware aber bestimmte Kombinationen aus ROCm, PyTorch und weiteren Abh\u00e4ngigkeiten voraussetzen. F\u00fcr unseren Test war die Trennlinie deshalb relativ deutlich: Lokale Sprachmodelle mit Ollama funktionierten unter Linux gut, bei der Videogenerierung kamen wir dagegen nicht ans Ziel.<\/p>\n<h2>Datenschutz endet nicht beim lokalen Modell<\/h2>\n<p>Ist ein Modell einmal heruntergeladen, kann eine gew\u00f6hnliche Unterhaltung vollst\u00e4ndig auf dem eigenen Linux-System verarbeitet werden. Der Prompt muss dabei nicht an <a href=\"https:\/\/www.deskmodder.de\/blog\/?s=OpenAI\">OpenAI<\/a>, <a href=\"https:\/\/www.deskmodder.de\/blog\/?s=Google\">Google<\/a>, <a href=\"https:\/\/www.deskmodder.de\/blog\/?s=Anthropic\">Anthropic<\/a> oder einen anderen LLM-Anbieter \u00fcbertragen werden. Bei internen Dokumenten, Quellcode oder Protokolldateien kann das ein wesentlicher Vorteil sein. Eine lokale Installation ist allerdings kein automatischer Garant f\u00fcr Datenschutz. Entscheidend bleibt, welche Anwendungen zus\u00e4tzlich auf Ollama zugreifen, ob Gespr\u00e4chsverl\u00e4ufe gespeichert werden, welche Benutzer Zugriff haben und wo m\u00f6gliche Backups liegen. Wer sensible Daten verarbeitet, sollte deshalb immer den gesamten Workflow betrachten.<\/p>\n<h2>Externe Dienste k\u00f6nnen Daten trotzdem nach au\u00dfen senden<\/h2>\n<p>Besonders relevant wird das, sobald Ollama um weitere Komponenten erg\u00e4nzt wird. RAG-Systeme, Agenten oder Weboberfl\u00e4chen k\u00f6nnen ihrerseits externe Dienste verwenden. Ein lokal ausgef\u00fchrtes Sprachmodell kann beispielsweise eine externe Such-API ansprechen. Die eigentliche Inferenz findet dann weiterhin auf dem BOSGAME M5 statt, Teile der Anfrage k\u00f6nnen das eigene Netzwerk trotzdem verlassen. Das gleiche gilt f\u00fcr Cloud-basierte Embedding-Dienste oder andere APIs. Wer lokale KI gerade aus Datenschutzgr\u00fcnden einsetzt, sollte bei jeder Erweiterung pr\u00fcfen, welche Daten wohin \u00fcbertragen werden.<\/p>\n<h2>Die Ollama-API geh\u00f6rt nicht offen ins Internet<\/h2>\n<p>\u00dcber seine API kann Ollama auch anderen Ger\u00e4ten im Netzwerk zur Verf\u00fcgung gestellt werden. Der BOSGAME M5 l\u00e4sst sich dadurch als zentraler KI-Rechner verwenden, w\u00e4hrend die Bedienung \u00fcber Notebook oder Desktop erfolgt. Die Ollama-Schnittstelle sollte aber nicht einfach per Portfreigabe ins \u00f6ffentliche Internet gestellt werden. F\u00fcr externen Zugriff bietet sich stattdessen ein VPN wie WireGuard an. Tailscale kann ebenfalls eine unkompliziertere Alternative sein. Firewall-Regeln k\u00f6nnen zus\u00e4tzlich einschr\u00e4nken, welche Ger\u00e4te Ollama \u00fcberhaupt erreichen d\u00fcrfen.<\/p>\n<h2>Agenten erweitern auch das Sicherheitsrisiko<\/h2>\n<p>Auf Ollama l\u00e4sst sich sp\u00e4ter deutlich mehr als ein einfacher Chat aufbauen. Unterst\u00fctzte Modelle k\u00f6nnen Werkzeuge verwenden und damit beispielsweise Informationen aus einer lokalen Wissensdatenbank abrufen, Skripte starten oder mit anderen Diensten kommunizieren. Damit ver\u00e4ndert sich allerdings auch das Sicherheitsmodell. Ein Agent mit Dateizugriff, Shell, Datenbankzugang oder anderen Werkzeugen kann tats\u00e4chlich Aktionen auf dem System ausf\u00fchren. Solche Werkzeuge sollten deshalb nur die Rechte erhalten, die sie f\u00fcr ihre jeweilige Aufgabe ben\u00f6tigen. Ein Agent zur Analyse von Logdateien braucht beispielsweise keinen Schreibzugriff auf das gesamte Dateisystem. Auch Prompt Injection bleibt relevant. Verarbeitet ein Agent fremde Dokumente oder Inhalte aus dem Internet, k\u00f6nnen darin Anweisungen enthalten sein, die unerw\u00fcnschte Werkzeugaufrufe provozieren. Lokale Ausf\u00fchrung sch\u00fctzt davor nicht.<\/p>\n<h2>Lokale KI verlangt Eigenverantwortung<\/h2>\n<p>Unser Aufbau mit <a href=\"https:\/\/www.deskmodder.de\/blog\/?s=Debian+13\">Debian 13<\/a>, ROCm und Ollama hat gezeigt, dass f\u00fcr eine leistungsf\u00e4hige lokale KI kein klassischer GPU-Server notwendig ist. Die Kombination aus Radeon 8060S und gro\u00dfem gemeinsamem Speicher kann selbst Sprachmodelle mit mehreren Dutzend Milliarden Parametern sinnvoll ausf\u00fchren. Gleichzeitig sollte man die Grenzen kennen. W\u00e4hrend Ollama auf unserem <a href=\"https:\/\/www.bosgamepc.com\/products\/bosgame-m5-ai-mini-desktop-ryzen-ai-max-395\">BOSGAME M5<\/a> nach der Einrichtung zuverl\u00e4ssig funktionierte, ist das ROCm-\u00d6kosystem bei anderen KI-Workloads noch nicht \u00fcberall so unkompliziert. Unsere erfolglosen Versuche mit lokaler Videogenerierung unter Linux sind daf\u00fcr ein gutes Beispiel.<\/p>\n<p>Hinzu kommt die Administration. Betriebssystem, ROCm, Modelle, Zugriffsrechte, Netzwerk und Updates m\u00fcssen selbst gepflegt werden. Daf\u00fcr bleibt die technische Kontrolle beim Betreiber und es l\u00e4sst sich wesentlich genauer bestimmen, welche Daten das eigene System verlassen d\u00fcrfen. F\u00fcr den Einstieg ist Ollama damit eine vergleichsweise \u00fcberschaubare Basis. Wer sp\u00e4ter mehr Komfort ben\u00f6tigt, kann <a href=\"https:\/\/github.com\/open-webui\/open-webui\">Open WebUI<\/a> erg\u00e4nzen. Wissensdatenbanken, RAG und Agenten lassen sich anschlie\u00dfend ebenfalls darauf aufbauen.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Mit dem BOSGAME M5 hatten wir Anfang August eine kompakte Linux-Workstation mit AMD Ryzen AI MAX+ 395, Radeon 8060S und 128 GB LPDDR5X im Test. Statt des vorinstallierten Windows 11 Pro kam bei uns Debian 13 zum Einsatz. Darauf haben&hellip; <\/p>\n","protected":false},"author":4894,"featured_media":216136,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","jetpack_publicize_message":"","jetpack_publicize_feature_enabled":true,"jetpack_social_post_already_shared":true,"jetpack_social_options":{"image_generator_settings":{"template":"highway","default_image_id":0,"font":"","enabled":false},"version":2},"jetpack_post_was_ever_published":false},"categories":[10],"tags":[97939,97591,93259,13904,9740,92310,95957,92309,97941,97593,97592,97940],"class_list":["post-216135","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-linux","tag-amd-rocm","tag-bosgame-m5","tag-debian-13","tag-kuenstliche-intelligenz","tag-linux","tag-llm","tag-lokale-ki","tag-ollama","tag-open-webui","tag-radeon-8060s","tag-ryzen-ai-max-395","tag-strix-halo"],"wp_featured_image":{"id":216136,"alt_text":"","description":"","media_type":"image","media_details":{"width":1672,"height":941,"file":"2026\/08\/lokale-ki-m5.png","filesize":1882604,"sizes":{"medium":{"file":"lokale-ki-m5-500x281.png","width":500,"height":281,"mime-type":"image\/png","filesize":169128,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-500x281.png"},"large":{"file":"lokale-ki-m5-810x456.png","width":810,"height":456,"mime-type":"image\/png","filesize":411566,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-810x456.png"},"thumbnail":{"file":"lokale-ki-m5-306x172.png","width":306,"height":172,"mime-type":"image\/png","filesize":69612,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-306x172.png"},"1536x1536":{"file":"lokale-ki-m5-1536x864.png","width":1536,"height":864,"mime-type":"image\/png","filesize":1318052,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-1536x864.png"},"blog-large":{"file":"lokale-ki-m5-642x300.png","width":642,"height":300,"mime-type":"image\/png","filesize":220767,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-642x300.png"},"blog-medium":{"file":"lokale-ki-m5-306x205.png","width":306,"height":205,"mime-type":"image\/png","filesize":77918,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-306x205.png"},"recent-thumb":{"file":"lokale-ki-m5-350x316.png","width":350,"height":316,"mime-type":"image\/png","filesize":122883,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-350x316.png"},"service-featured":{"file":"lokale-ki-m5-600x330.png","width":600,"height":330,"mime-type":"image\/png","filesize":231383,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5-600x330.png"}},"image_meta":{"aperture":"0","credit":"","camera":"","caption":"","created_timestamp":"0","copyright":"","focal_length":"0","iso":"0","shutter_speed":"0","title":"","orientation":"0","keywords":[],"alt":""}},"post":216135,"source_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png"},"commentcount":5,"wp_comments":[{"id":343912,"parent":0,"author":4767,"author_name":"Holgi","author_email":"holger_freese@hotmail.com","author_url":"","author_avatar_urls":{"24":"https:\/\/secure.gravatar.com\/avatar\/0b9a7e8e22fe490941487d0cbe59d0e7232454955198e0bd0f0fc8b2f4a0043e?s=24&d=mm&r=g","48":"https:\/\/secure.gravatar.com\/avatar\/0b9a7e8e22fe490941487d0cbe59d0e7232454955198e0bd0f0fc8b2f4a0043e?s=48&d=mm&r=g","96":"https:\/\/secure.gravatar.com\/avatar\/0b9a7e8e22fe490941487d0cbe59d0e7232454955198e0bd0f0fc8b2f4a0043e?s=96&d=mm&r=g"},"date":"2026-08-26T12:22:29","cld_nonce":"7133b94bdd","content":{"rendered":"<p>Hi Bj\u00f6rn,<br \/>\nvielen Dank f\u00fcr diesen Beitrag. Eine Menge Stoff, der erst mal verdaut werden muss.<br \/>\nLeider habe ich eher wenig bis gar keine Ahnung von Linux (klar: installiert hatte ich schon \u00f6fter mal eines; aber wehe es funktioniert dann mal etwas nicht. Dann stehe ich auf dem Schlauch).<br \/>\nDeshalb diese Frage:<br \/>\ngedenkst du\/gedenkt ihr in Zukunft so etwas auch mal f\u00fcr Windows und vlt. auf NVIDIA Basis herauszubringen?<\/p>\n"},"status":"1"},{"id":343914,"parent":343912,"author":4894,"author_name":"Wagener_bjoern","author_email":"wagener.bjoern.max@mailbox.org","author_url":"","author_avatar_urls":{"24":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=24&d=mm&r=g","48":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=48&d=mm&r=g","96":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g"},"date":"2026-08-26T12:46:23","cld_nonce":"7133b94bdd","content":{"rendered":"<p>Moin,<\/p>\n<p>unter Windows muss ich mir das Ganze selbst erst einmal in Ruhe anschauen und ausprobieren. Daher kann und will ich an der Stelle noch nichts versprechen. Wenn sich daraus ein sinnvoller Aufbau f\u00fcr einen weiteren Beitrag ergibt, ist das aber nat\u00fcrlich nicht ausgeschlossen. <img src=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/plugins\/classic-smilies\/img\/icon_smile.gif\" alt=\":-)\" class=\"wp-smiley\" \/><\/p>\n"},"status":"1"},{"id":343923,"parent":0,"author":7078,"author_name":"el viejo","author_email":"peter.altherr@gmail.com","author_url":"","author_avatar_urls":{"24":"https:\/\/secure.gravatar.com\/avatar\/2598e1331d3194984b03e8ae636c97ae86253c638f63138ca5c5d695c8219419?s=24&d=mm&r=g","48":"https:\/\/secure.gravatar.com\/avatar\/2598e1331d3194984b03e8ae636c97ae86253c638f63138ca5c5d695c8219419?s=48&d=mm&r=g","96":"https:\/\/secure.gravatar.com\/avatar\/2598e1331d3194984b03e8ae636c97ae86253c638f63138ca5c5d695c8219419?s=96&d=mm&r=g"},"date":"2026-08-26T14:10:26","cld_nonce":"7133b94bdd","content":{"rendered":"<p>Ich hab den GMKtec EVO-X2 mit 128 Gb unified RAM, gekauft zu Zeiten als die Preise noch normal (f\u00fcr Privatanwender) waren. Ich bin zwar fit auf Linux, hab mich aber entschieden erstmal mit Windows 11 und dem, was AMD und die Community f\u00fcr Windows anbieten zu starten und fahre aus meiner subjektiven Sicht gar nicht schlecht damit. Ich bin mir bewusst, dass ich das letzte Qu\u00e4ntchen RAM oder Performance mit diesem Setup nicht ausgereizt bekomme, muss ich aber auch gar nicht. Wenn du das willst, dann musst du wirklich alle beteiligten Komponenten und Abh\u00e4ngigkeiten st\u00e4ndig im Blick haben, wenn du nicht auf einem einmal eingerichteten System blieben willst. Und daf\u00fcr ist das Thema aktuell noch zu dynamisch und ich hab nicht die Zeit mir die ganzen aufeinander abgestimmten Komponenten zusammenzusuchen, die das unter Linux erm\u00f6glichen.<\/p>\n<p>Wer (aus meiner Sicht) ein Strix Halo System mit Windows statt Linux und ausschliesslich lokaler KI betreiben will, dem empfehle ich sich mit folgenden Komponenten zu besch\u00e4ftigen und ggf. einzulesen:<\/p>\n<p>&#8211; AMD Adrenaline Edition aktuell halten (beinhaltet auch einen KI-Chat-Bot und diverse Tools zur Bild- und Video-Erstellung out of the Box)<br \/>\n&#8211; Lemonade Server (ein AMD-Projekt f\u00fcr verschiedene Plattformen) als Backend f\u00fcr die Sprachmodelle<br \/>\n&#8211; Hermes Agent von NOUS Research oder OpenClaw (Ich hab mit OpenClaw angefangen, bin aber irgendwann zu Hermes gegangen, weil OpenClaw sich regelm\u00e4ssig die Config zerschossen hat.<br \/>\n&#8211; Qwen3.x-Sprachmodelle z.B. von huggingface.com (bevorzugt die von politischen, religi\u00f6sen und kulturellen Denkschranken befreiten Modelle; und nein ich bin deshalb kein Bombenbauer, Kindersch\u00e4nder, Cybererpresser, AI-Porn-Ersteller, )<br \/>\n&#8211; Telegram-Anbindung um mich unkompliziert mit Hermes Agent auszutauschen.<\/p>\n<p>Damit hab ich f\u00fcr mich und die Familie, mit nicht allzu grossem Zeitaufwand, ein passendes ausschliesslich lokales Setup aufgesetzt, dass auch f\u00fcr vertrauliche Anfragen taugt. Es antwortet zwar nicht in Sekunden, wie die grossen Modelle, die in einem RZ laufen, eher in Minuten und bei komplexen Problemstellungen auch mal Stunden, aber daf\u00fcr unter meiner Kontrolle. Wenn das Grundger\u00fcst mal steht, dann l\u00e4sst sich das System mit ganz normaler Kommunikation um Features erweitern. Die eigentlich Config-Arbeit macht der Hermes Agent selbst.<\/p>\n"},"status":"1"},{"id":343937,"parent":343923,"author":4767,"author_name":"Holgi","author_email":"holger_freese@hotmail.com","author_url":"","author_avatar_urls":{"24":"https:\/\/secure.gravatar.com\/avatar\/0b9a7e8e22fe490941487d0cbe59d0e7232454955198e0bd0f0fc8b2f4a0043e?s=24&d=mm&r=g","48":"https:\/\/secure.gravatar.com\/avatar\/0b9a7e8e22fe490941487d0cbe59d0e7232454955198e0bd0f0fc8b2f4a0043e?s=48&d=mm&r=g","96":"https:\/\/secure.gravatar.com\/avatar\/0b9a7e8e22fe490941487d0cbe59d0e7232454955198e0bd0f0fc8b2f4a0043e?s=96&d=mm&r=g"},"date":"2026-08-26T16:39:38","cld_nonce":"7133b94bdd","content":{"rendered":"<p>das klingt alles interessant, aber auch nicht gerade nach &#8222;mal eben aufgesetzt&#8220;.<br \/>\nBin gespannt, ob es da irgendwann mal eine &#8222;one-click&#8220; L\u00f6sung geben wird. Alles aus einer Hand und einem Guss.<br \/>\nIch dachte bislang immer, NVIDIA sei das Ma\u00df aller Dinge f\u00fcr KI, aber damit liege ich wohl schon daneben.<\/p>\n"},"status":"1"},{"id":343966,"parent":343914,"author":0,"author_name":"WongKit","author_email":"wongkit@web.de","author_url":"","author_avatar_urls":{"24":"https:\/\/secure.gravatar.com\/avatar\/9b8be4df3c3cb5b77abd510a678625c84e70dce4960ce86927dac9244cf07af3?s=24&d=mm&r=g","48":"https:\/\/secure.gravatar.com\/avatar\/9b8be4df3c3cb5b77abd510a678625c84e70dce4960ce86927dac9244cf07af3?s=48&d=mm&r=g","96":"https:\/\/secure.gravatar.com\/avatar\/9b8be4df3c3cb5b77abd510a678625c84e70dce4960ce86927dac9244cf07af3?s=96&d=mm&r=g"},"date":"2026-08-27T05:57:50","cld_nonce":"7133b94bdd","content":{"rendered":"<p>Hallo Bj\u00f6rn,<\/p>\n<p>ich glaube, wir haben so etwa zeitgleich mit den Bosgame M5 angefangen. Mein Ger\u00e4t kam etwa 4 Tage vor deinem letzten Artikel zu dem Ger\u00e4t. Erste Gehversuche damals auch mit Debian 13 (allerdings als Desktop) und so ziemlich identische Erfahrung. Die Windows Seite ist nicht gro\u00dfartig anders einzurichten. In der Minimalaufwandauspr\u00e4gung reichen hier aktuelle AMD Treiber und LM Studio. Danach kann man nat\u00fcrlich beliebig komplex werden, 1000 Parameter tunen, andere Agenten nutzen und ihnen unterschiedliche F\u00e4higkeiten beibringen. Eine Einschr\u00e4nkung hat Windows f\u00fcr LLM Nutzung jedoch: Es lassen sich auf dem Ger\u00e4t maximal 102GB (96GB vor einem bestimmten Windows Update) als VRAM verwenden. Als Desktop Ersatz bzw im Mischbetrieb reicht das allerdings aus.<\/p>\n"},"status":"1"}],"wp_author":{"id":4894,"name":"Wagener_bjoern","description":"Blaulicht- &amp; Technikjournalist \u270f\ufe0f | Fotografie, Drohnen &amp; Luftfahrt \ud83d\udcf8\u2708\ufe0f | 3D-Druck &amp; Maker \ud83d\udda8\ufe0f | Cat Dad \ud83d\udc3e","author_avatar_urls":{"24":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=24&d=mm&r=g","48":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=48&d=mm&r=g","96":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g"}},"cld_nonce":"7133b94bdd","yoast_head":"<!-- This site is optimized with the Yoast SEO Premium plugin v28.3 (Yoast SEO v28.3) - https:\/\/yoast.com\/product\/yoast-seo-premium-wordpress\/ -->\n<title>Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten - Deskmodder.de<\/title>\n<meta name=\"description\" content=\"Lokale KI unter Linux einrichten: Wir zeigen, wie Debian 13, AMD ROCm und Ollama auf dem Ryzen AI MAX+ 395 mit Radeon 8060S funktionieren.\" \/>\n<meta name=\"robots\" content=\"index, follow, max-snippet:-1, max-image-preview:large, max-video-preview:-1\" \/>\n<link rel=\"canonical\" href=\"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/\" \/>\n<meta property=\"og:locale\" content=\"de_DE\" \/>\n<meta property=\"og:type\" content=\"article\" \/>\n<meta property=\"og:title\" content=\"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten\" \/>\n<meta property=\"og:description\" content=\"Lokale KI unter Linux einrichten: Wir zeigen, wie Debian 13, AMD ROCm und Ollama auf dem Ryzen AI MAX+ 395 mit Radeon 8060S funktionieren.\" \/>\n<meta property=\"og:url\" content=\"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/\" \/>\n<meta property=\"og:site_name\" content=\"Deskmodder.de\" \/>\n<meta property=\"article:publisher\" content=\"https:\/\/www.facebook.com\/Deskmodder\" \/>\n<meta property=\"article:author\" content=\"https:\/\/www.facebook.com\/bjoern.max.wagener\" \/>\n<meta property=\"article:published_time\" content=\"2026-08-26T09:00:59+00:00\" \/>\n<meta property=\"og:image\" content=\"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png\" \/>\n\t<meta property=\"og:image:width\" content=\"1672\" \/>\n\t<meta property=\"og:image:height\" content=\"941\" \/>\n\t<meta property=\"og:image:type\" content=\"image\/png\" \/>\n<meta name=\"author\" content=\"Wagener_bjoern\" \/>\n<meta name=\"twitter:card\" content=\"summary_large_image\" \/>\n<meta name=\"twitter:creator\" content=\"@wagener_bjoern\" \/>\n<meta name=\"twitter:site\" content=\"@Deskmodder\" \/>\n<script type=\"application\/ld+json\" class=\"yoast-schema-graph\">{\"@context\":\"https:\\\/\\\/schema.org\",\"@graph\":[{\"@type\":\"Article\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#article\",\"isPartOf\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/\"},\"author\":{\"name\":\"Wagener_bjoern\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#\\\/schema\\\/person\\\/efd7dda2abfc34d2f026b3dd1ff08c0c\"},\"headline\":\"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten\",\"datePublished\":\"2026-08-26T09:00:59+00:00\",\"mainEntityOfPage\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/\"},\"wordCount\":2019,\"commentCount\":5,\"publisher\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#organization\"},\"image\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#primaryimage\"},\"thumbnailUrl\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/wp-content\\\/uploads\\\/2026\\\/08\\\/lokale-ki-m5.png\",\"keywords\":[\"AMD ROCm\",\"BOSGAME M5\",\"Debian 13\",\"K\u00fcnstliche Intelligenz\",\"Linux\",\"LLM\",\"Lokale KI\",\"Ollama\",\"Open WebUI\",\"Radeon 8060S\",\"Ryzen AI MAX+ 395\",\"Strix Halo\"],\"articleSection\":[\"Linux\"],\"inLanguage\":\"de\",\"potentialAction\":[{\"@type\":\"CommentAction\",\"name\":\"Comment\",\"target\":[\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#respond\"]}],\"copyrightYear\":\"2026\",\"copyrightHolder\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#organization\"}},{\"@type\":\"WebPage\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/\",\"url\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/\",\"name\":\"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten - Deskmodder.de\",\"isPartOf\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#website\"},\"primaryImageOfPage\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#primaryimage\"},\"image\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#primaryimage\"},\"thumbnailUrl\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/wp-content\\\/uploads\\\/2026\\\/08\\\/lokale-ki-m5.png\",\"datePublished\":\"2026-08-26T09:00:59+00:00\",\"description\":\"Lokale KI unter Linux einrichten: Wir zeigen, wie Debian 13, AMD ROCm und Ollama auf dem Ryzen AI MAX+ 395 mit Radeon 8060S funktionieren.\",\"breadcrumb\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#breadcrumb\"},\"inLanguage\":\"de\",\"potentialAction\":[{\"@type\":\"ReadAction\",\"target\":[\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/\"]}]},{\"@type\":\"ImageObject\",\"inLanguage\":\"de\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#primaryimage\",\"url\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/wp-content\\\/uploads\\\/2026\\\/08\\\/lokale-ki-m5.png\",\"contentUrl\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/wp-content\\\/uploads\\\/2026\\\/08\\\/lokale-ki-m5.png\",\"width\":1672,\"height\":941,\"caption\":\"Symbolfoto: KI-generierter Inhalt mit ChatGPT Images (OpenAI)\"},{\"@type\":\"BreadcrumbList\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/2026\\\/08\\\/26\\\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\\\/#breadcrumb\",\"itemListElement\":[{\"@type\":\"ListItem\",\"position\":1,\"name\":\"Startseite\",\"item\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/\"},{\"@type\":\"ListItem\",\"position\":2,\"name\":\"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten\"}]},{\"@type\":\"WebSite\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#website\",\"url\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/\",\"name\":\"Deskmodder.de\",\"description\":\"News zum Thema Microsoft, Windows 11 \\\/ 10, sowie anderen Neuigkeiten aus dem Netz, viele Tipps und individuelle Hilfe bei Problemen in unserem Forum \u25cf Deskmodder - seit 2003\",\"publisher\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#organization\"},\"potentialAction\":[{\"@type\":\"SearchAction\",\"target\":{\"@type\":\"EntryPoint\",\"urlTemplate\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/?s={search_term_string}\"},\"query-input\":{\"@type\":\"PropertyValueSpecification\",\"valueRequired\":true,\"valueName\":\"search_term_string\"}}],\"inLanguage\":\"de\"},{\"@type\":\"Organization\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#organization\",\"name\":\"Deskmodder\",\"url\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/\",\"logo\":{\"@type\":\"ImageObject\",\"inLanguage\":\"de\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#\\\/schema\\\/logo\\\/image\\\/\",\"url\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/wp-content\\\/uploads\\\/2019\\\/01\\\/deskmodder-logo-app.png\",\"contentUrl\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/wp-content\\\/uploads\\\/2019\\\/01\\\/deskmodder-logo-app.png\",\"width\":281,\"height\":286,\"caption\":\"Deskmodder\"},\"image\":{\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#\\\/schema\\\/logo\\\/image\\\/\"},\"sameAs\":[\"https:\\\/\\\/www.facebook.com\\\/Deskmodder\",\"https:\\\/\\\/x.com\\\/Deskmodder\",\"https:\\\/\\\/mastodontech.de\\\/@Deskmodder\",\"https:\\\/\\\/www.youtube.com\\\/user\\\/deskmodder\",\"https:\\\/\\\/mewe.com\\\/group\\\/5c83b5231add826fc80cdae1\"]},{\"@type\":\"Person\",\"@id\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/#\\\/schema\\\/person\\\/efd7dda2abfc34d2f026b3dd1ff08c0c\",\"name\":\"Wagener_bjoern\",\"image\":{\"@type\":\"ImageObject\",\"inLanguage\":\"de\",\"@id\":\"https:\\\/\\\/secure.gravatar.com\\\/avatar\\\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g\",\"url\":\"https:\\\/\\\/secure.gravatar.com\\\/avatar\\\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g\",\"contentUrl\":\"https:\\\/\\\/secure.gravatar.com\\\/avatar\\\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g\",\"caption\":\"Wagener_bjoern\"},\"description\":\"Blaulicht- &amp; Technikjournalist \u270f\ufe0f | Fotografie, Drohnen &amp; Luftfahrt \ud83d\udcf8\u2708\ufe0f | 3D-Druck &amp; Maker \ud83d\udda8\ufe0f | Cat Dad \ud83d\udc3e\",\"sameAs\":[\"https:\\\/\\\/www.facebook.com\\\/bjoern.max.wagener\",\"https:\\\/\\\/www.instagram.com\\\/wagener_bjoern\\\/\",\"https:\\\/\\\/x.com\\\/wagener_bjoern\"],\"url\":\"https:\\\/\\\/www.deskmodder.de\\\/blog\\\/author\\\/wagener_bjoern\\\/\"}]}<\/script>\n<!-- \/ Yoast SEO Premium plugin. -->","yoast_head_json":{"title":"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten - Deskmodder.de","description":"Lokale KI unter Linux einrichten: Wir zeigen, wie Debian 13, AMD ROCm und Ollama auf dem Ryzen AI MAX+ 395 mit Radeon 8060S funktionieren.","robots":{"index":"index","follow":"follow","max-snippet":"max-snippet:-1","max-image-preview":"max-image-preview:large","max-video-preview":"max-video-preview:-1"},"canonical":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/","og_locale":"de_DE","og_type":"article","og_title":"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten","og_description":"Lokale KI unter Linux einrichten: Wir zeigen, wie Debian 13, AMD ROCm und Ollama auf dem Ryzen AI MAX+ 395 mit Radeon 8060S funktionieren.","og_url":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/","og_site_name":"Deskmodder.de","article_publisher":"https:\/\/www.facebook.com\/Deskmodder","article_author":"https:\/\/www.facebook.com\/bjoern.max.wagener","article_published_time":"2026-08-26T09:00:59+00:00","og_image":[{"width":1672,"height":941,"url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png","type":"image\/png"}],"author":"Wagener_bjoern","twitter_card":"summary_large_image","twitter_creator":"@wagener_bjoern","twitter_site":"@Deskmodder","schema":{"@context":"https:\/\/schema.org","@graph":[{"@type":"Article","@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#article","isPartOf":{"@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/"},"author":{"name":"Wagener_bjoern","@id":"https:\/\/www.deskmodder.de\/blog\/#\/schema\/person\/efd7dda2abfc34d2f026b3dd1ff08c0c"},"headline":"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten","datePublished":"2026-08-26T09:00:59+00:00","mainEntityOfPage":{"@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/"},"wordCount":2019,"commentCount":5,"publisher":{"@id":"https:\/\/www.deskmodder.de\/blog\/#organization"},"image":{"@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#primaryimage"},"thumbnailUrl":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png","keywords":["AMD ROCm","BOSGAME M5","Debian 13","K\u00fcnstliche Intelligenz","Linux","LLM","Lokale KI","Ollama","Open WebUI","Radeon 8060S","Ryzen AI MAX+ 395","Strix Halo"],"articleSection":["Linux"],"inLanguage":"de","potentialAction":[{"@type":"CommentAction","name":"Comment","target":["https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#respond"]}],"copyrightYear":"2026","copyrightHolder":{"@id":"https:\/\/www.deskmodder.de\/blog\/#organization"}},{"@type":"WebPage","@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/","url":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/","name":"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten - Deskmodder.de","isPartOf":{"@id":"https:\/\/www.deskmodder.de\/blog\/#website"},"primaryImageOfPage":{"@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#primaryimage"},"image":{"@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#primaryimage"},"thumbnailUrl":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png","datePublished":"2026-08-26T09:00:59+00:00","description":"Lokale KI unter Linux einrichten: Wir zeigen, wie Debian 13, AMD ROCm und Ollama auf dem Ryzen AI MAX+ 395 mit Radeon 8060S funktionieren.","breadcrumb":{"@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#breadcrumb"},"inLanguage":"de","potentialAction":[{"@type":"ReadAction","target":["https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/"]}]},{"@type":"ImageObject","inLanguage":"de","@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#primaryimage","url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png","contentUrl":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png","width":1672,"height":941,"caption":"Symbolfoto: KI-generierter Inhalt mit ChatGPT Images (OpenAI)"},{"@type":"BreadcrumbList","@id":"https:\/\/www.deskmodder.de\/blog\/2026\/08\/26\/lokale-ki-unter-linux-ollama-und-rocm-auf-amd-strix-halo-einrichten\/#breadcrumb","itemListElement":[{"@type":"ListItem","position":1,"name":"Startseite","item":"https:\/\/www.deskmodder.de\/blog\/"},{"@type":"ListItem","position":2,"name":"Lokale KI unter Linux: Ollama und ROCm auf AMD Strix Halo einrichten"}]},{"@type":"WebSite","@id":"https:\/\/www.deskmodder.de\/blog\/#website","url":"https:\/\/www.deskmodder.de\/blog\/","name":"Deskmodder.de","description":"News zum Thema Microsoft, Windows 11 \/ 10, sowie anderen Neuigkeiten aus dem Netz, viele Tipps und individuelle Hilfe bei Problemen in unserem Forum \u25cf Deskmodder - seit 2003","publisher":{"@id":"https:\/\/www.deskmodder.de\/blog\/#organization"},"potentialAction":[{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https:\/\/www.deskmodder.de\/blog\/?s={search_term_string}"},"query-input":{"@type":"PropertyValueSpecification","valueRequired":true,"valueName":"search_term_string"}}],"inLanguage":"de"},{"@type":"Organization","@id":"https:\/\/www.deskmodder.de\/blog\/#organization","name":"Deskmodder","url":"https:\/\/www.deskmodder.de\/blog\/","logo":{"@type":"ImageObject","inLanguage":"de","@id":"https:\/\/www.deskmodder.de\/blog\/#\/schema\/logo\/image\/","url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2019\/01\/deskmodder-logo-app.png","contentUrl":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2019\/01\/deskmodder-logo-app.png","width":281,"height":286,"caption":"Deskmodder"},"image":{"@id":"https:\/\/www.deskmodder.de\/blog\/#\/schema\/logo\/image\/"},"sameAs":["https:\/\/www.facebook.com\/Deskmodder","https:\/\/x.com\/Deskmodder","https:\/\/mastodontech.de\/@Deskmodder","https:\/\/www.youtube.com\/user\/deskmodder","https:\/\/mewe.com\/group\/5c83b5231add826fc80cdae1"]},{"@type":"Person","@id":"https:\/\/www.deskmodder.de\/blog\/#\/schema\/person\/efd7dda2abfc34d2f026b3dd1ff08c0c","name":"Wagener_bjoern","image":{"@type":"ImageObject","inLanguage":"de","@id":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g","url":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g","contentUrl":"https:\/\/secure.gravatar.com\/avatar\/faab38a98808dff100d6876904ec74377b3897ebbe844221f011f24bf665bd16?s=96&d=mm&r=g","caption":"Wagener_bjoern"},"description":"Blaulicht- &amp; Technikjournalist \u270f\ufe0f | Fotografie, Drohnen &amp; Luftfahrt \ud83d\udcf8\u2708\ufe0f | 3D-Druck &amp; Maker \ud83d\udda8\ufe0f | Cat Dad \ud83d\udc3e","sameAs":["https:\/\/www.facebook.com\/bjoern.max.wagener","https:\/\/www.instagram.com\/wagener_bjoern\/","https:\/\/x.com\/wagener_bjoern"],"url":"https:\/\/www.deskmodder.de\/blog\/author\/wagener_bjoern\/"}]}},"jetpack_publicize_connections":[],"jetpack_featured_media_url":"https:\/\/www.deskmodder.de\/blog\/wp-content\/uploads\/2026\/08\/lokale-ki-m5.png","_links":{"self":[{"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/posts\/216135","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/users\/4894"}],"replies":[{"embeddable":true,"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/comments?post=216135"}],"version-history":[{"count":1,"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/posts\/216135\/revisions"}],"predecessor-version":[{"id":216190,"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/posts\/216135\/revisions\/216190"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/media\/216136"}],"wp:attachment":[{"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/media?parent=216135"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/categories?post=216135"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.deskmodder.de\/blog\/wp-json\/wp\/v2\/tags?post=216135"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}