Lernpfad
DeepSeek Harness ist einer der meistdiskutierten Open-Source-KI-Agenten – und verfolgt einen ganz anderen Ansatz als die meisten Coding-Assistenten: Alles ist ein Plugin.
In diesem Leitfaden richten wir DeepSeek Harness von Grund auf ein und bauen eine praxistaugliche Agentenumgebung mit DeepSeek als Hauptmodell, der integrierten Websuche von DeepSeek für aktuelle Informationen und ModLens mit Gemini für Bildverständnis. Anschließend starten wir die Harness-Weboberfläche und testen Coding, Websuche, Vision und die Anbindung von Drittanbieter-Modellen.
Wenn du neu dabei bist, wie Agenten planen, Tools aufrufen und eigenständig handeln, deckt der AI Agent Fundamentals Lernpfad die Kernkonzepte ab, bevor du loslegst.
Was ist DeepSeek Harness?
DeepSeek Harness ist ein Open-Source-KI-Agentenframework von DeepSeek AI für Entwicklerinnen und Entwickler, die mehr Kontrolle darüber wollen, wie KI-Agenten arbeiten.
Statt dich auf einen festen Coding-Assistenten oder Workflow festzulegen, folgt Harness dem Ansatz „Alles ist ein Plugin“: Modelle, Tools, Interfaces und das Agentenverhalten lassen sich je nach Einsatz austauschen, hinzufügen oder entfernen.
Wenn du dir noch nicht ganz sicher bist, was der Begriff genau bedeutet, lies unseren Leitfaden zur Frage „What is an agent harness?"
Einführung in KI-Agenten
Warum ist DeepSeek Harness so beliebt?
DeepSeek Harness hat sehr schnell Aufmerksamkeit gewonnen und liegt zum Zeitpunkt der Veröffentlichung dieses Artikels bei über 160.000 GitHub‑Sternen und 18.000 Forks.
Ein wichtiger Grund: Entwickler berichten, dass es mit verschiedenen Modellen starke Ergebnisse liefert – nicht nur mit DeepSeek. Auf Reddit wird häufig von erfolgreichen Einsätzen mit Modellen wie Qwen3.8-27b berichtet, besonders für Coding und längere agentische Aufgaben.
Ein weiterer Pluspunkt ist die Autonomie und Flexibilität. Nutzer berichten, dass Harness mehrstufige Aufgaben durchzieht, sich von Fehlern erholt, lange Kontexte managt und weitermacht, ohne ständige Eingriffe. Das pluginbasierte Design erleichtert zudem den Modellwechsel, das Hinzufügen von Tools und die Anpassung des Agenten‑Workflows, statt auf ein fixes Setup festgelegt zu sein.
Wenn du Harness gegen die Tools abwägst, mit denen es konkurrieren soll, vergleicht unser Leitfaden zu Claude Code-Alternativen sieben der wichtigsten Optionen im direkten Vergleich.
Wichtige Funktionen von DeepSeek Harness
Das sind einige der zentralen Features:
-
Pluginbasierte Architektur: Die meisten Teile des Agenten lassen sich über Plugins erweitern oder austauschen – so passt du dein Setup leichter an.
-
Lokale Weboberfläche: Mit
dshweb erhältst du ein browserbasiertes Interface, in dem du Modelle, Sessions, Workspaces, Einstellungen und Agenten verwaltest. -
Python‑SDK: Das
deepseek-harness-sdkermöglicht dir, Harness‑Agenten direkt aus Python‑Apps, Skripten, Tests und Automationsworkflows zu nutzen. -
Mehrere Modellanbieter: Du bist nicht auf DeepSeek‑Modelle beschränkt. Du kannst etwa OpenAI und Anthropic verwenden oder einen eigenen kompatiblen Endpoint anbinden.
-
Toolaufrufe: Agenten können Tools aufrufen, um Aktionen auszuführen – nicht nur Text generieren.
-
Datei‑ und Terminal‑Tools: Harness bringt Tools zum Lesen, Suchen und Bearbeiten von Dateien mit, dazu Bash unter Linux und macOS sowie PowerShell unter Windows.
-
Integrierte Websuche: Der Websuche‑Provider von DeepSeek ist in der Standardkonfiguration enthalten und nutzt denselben DeepSeek‑API‑Schlüssel wie das Modell.
-
Code Mode: Harness kann Tools über einen codebasierten Ausführungsmodus bereitstellen und dem Agenten so mehr Kontrolle geben, wie Toolaufrufe kombiniert und ausgeführt werden.
-
Trajectory: In der Trajectory‑Ansicht prüfst du Schritt für Schritt, was der Agent tut – inklusive Modellantworten, Toolaufrufen, verschachtelten Tool‑Aktivitäten, Timing und Tokenverbrauch.
-
Agenten‑Presets: Erstelle verschiedene Agentensetups mit eigenen Tools und Prompts und nutze sie in unterschiedlichen Sessions.
-
Session‑Statistiken: Harness erfasst Infos wie Turns, Steps, Model Time, Tool Time, Time to First Token und Decoding Time.
-
Subagenten: Ein Hauptagent kann Teile einer Aufgabe an Child‑Agenten delegieren – hilfreich für komplexere Workflows.
-
Community‑Plugins: Drittanbieter‑Plugins erweitern Fähigkeiten, die das Basismodell nicht hat. In diesem Guide nutzen wir ModLens, um Vision zu ergänzen.
-
MIT‑Lizenz: DeepSeek Harness ist Open Source und unter der permissiven MIT‑Lizenz veröffentlicht.
Der große Vorteil: Du bist weder an ein Modell noch an ein Toolset oder einen Agententyp gebunden. Du kannst mit dem Standardsetup starten und nach und nach Komponenten hinzufügen oder ersetzen, während du mit verschiedenen Workflows experimentierst.
Wie richte ich DeepSeek Harness ein?
Starten wir mit der Installation von DeepSeek Harness und richten alles ein, was wir für den Rest des Guides brauchen. Wir installieren Node.js, DeepSeek Harness und pnpm, und fügen dann unsere API‑Schlüssel hinzu.
Node.js installieren
DeepSeek Harness läuft auf Node.js. Da wir später auch ModLens für Vision nutzen, empfehle ich Node.js 22.19 oder neuer.
Unter Ubuntu oder Debian kannst du Node.js so installieren:
curl -fsSL https://deb.nodesource.com/setup_22.x | sudo -E bash - && sudo apt-get install -y nodejs
Prüfe danach, ob Node.js und npm funktionieren:
node --version
npm --version
Auf meinem System ergab das:
v24.19.0
11.17.0
Du brauchst nicht exakt dieselben Versionen. Solange du eine ausreichend aktuelle Node.js‑Version nutzt, bist du startklar.
DeepSeek Harness installieren
Als Nächstes installieren wir DeepSeek Harness selbst.
Der offizielle Quickstart nutzt npx, ich installiere es aber lieber global, damit wir im Guide einfach den Befehl dsh verwenden können.
Führe aus:
npm install -g @deepseek-ai/dsh
Prüfe anschließend die Installation:
dsh --version
Zum Testzeitpunkt dieses Guides nutzte ich:
0.1.0-rc.7
pnpm installieren
Wir benötigen außerdem pnpm. DeepSeek Harness nutzt es, wenn wir Plugins hinzufügen oder entfernen. Installiere es global:
npm install -g pnpm
API‑Schlüssel einrichten
Für dieses Tutorial brauchen wir nur zwei API‑Schlüssel:
- DeepSeek‑API-Schlüssel: Wird für das DeepSeek‑Modell und die integrierte Websuche verwendet.
- Gemini‑API‑Schlüssel: Wird von ModLens für Bildverständnis genutzt.
Wir richten jetzt den DeepSeek‑Schlüssel ein, da wir ihn für Coding und Websuche brauchen, und fügen den Gemini‑Schlüssel später hinzu, wenn wir Vision mit ModLens ergänzen.
Für DeepSeek brauchst du ein DeepSeek‑Konto, generierst einen API‑Schlüssel und lädst Guthaben auf. Für diesen Guide empfehle ich mindestens 2 $ Guthaben. Das reicht locker, um die Beispiele zu testen, ohne viel vorzustrecken.

Sobald du den API‑Schlüssel hast, füge ihn deiner Umgebung hinzu.
Unter Linux oder macOS:
export DEEPSEEK_API_KEY="your_deepseek_api_key"
Unter Windows PowerShell:
$env:DEEPSEEK_API_KEY="your_deepseek_api_key"
Praktisch an diesem Setup ist: Wir brauchen keine separate Websuche‑API. DeepSeek Harness enthält bereits den Websuche‑Provider von DeepSeek und nutzt denselben DEEPSEEK_API_KEY.
Du kannst deinen DeepSeek‑API‑Schlüssel auch später in der Weboberfläche unter Settings → Models hinzufügen.
Wie starte ich DeepSeek Harness?
Jetzt, wo alles konfiguriert ist, starten wir DeepSeek Harness und öffnen die Weboberfläche. Führe einfach dsh web aus. Standardmäßig startet das Browser‑Interface auf Port 3080.
Du siehst die UI, wenn du im Browser http://127.0.0.1:3080 öffnest.

Erstelle dort einen neuen Workspace oder wähle einen bestehenden, starte eine neue Session und wähle das gewünschte DeepSeek‑Modell.
Sobald die Session bereit ist, testen wir Coding, Websuche, Vision und die Unterstützung für Drittanbieter‑Modelle.

DeepSeek Harness fürs Coding nutzen
Jetzt, da DeepSeek Harness läuft, testen wir die Hauptfähigkeiten unseres Setups. Starten wir mit einer einfachen Coding‑Aufgabe:
Create a simple Python calculator with a command-line interface.

DeepSeek Harness kann direkt mit Dateien und dem Terminal arbeiten. Es kann also die Python‑Datei erstellen, den Code bearbeiten und Befehle im Workspace ausführen.
Nach Abschluss der Aufgabe solltest du die generierte Datei und Anweisungen zum Ausführen sehen.
Um mehr aus den DeepSeek‑Modellen in Harness herauszuholen, zeigt unser DeepSeek V4 API‑Tutorial die Reasoning‑Modi und API‑Parameter in Python.
DeepSeek Harness für die Websuche nutzen
Als Nächstes testen wir die Websuche. Es ist keine zusätzliche Einrichtung nötig, da DeepSeek Harness den Websuche‑Provider von DeepSeek bereits enthält.
Probiere zum Beispiel diesen Prompt:
Search the web for the latest open-source AI model releases and summarize the top three as of August 18, 2026.
Der Agent sollte das Web durchsuchen und eine Zusammenfassung mit Quellen liefern.

Öffne während der Ausführung den Tab Trajectory. Du solltest Toolaufrufe wie SUBTOOL: web_search sehen.

Das zeigt, dass der Agent tatsächlich das Websuche‑Tool nutzt und sich nicht nur auf vorhandenes Modellwissen stützt. Standardmäßig wird diese Suche vom Provider deepseek-official abgewickelt und nutzt denselben DEEPSEEK_API_KEY, den wir zuvor konfiguriert haben.
DeepSeek für Vision‑Aufgaben nutzen
Das Chat‑Modell von DeepSeek in Harness ist textbasiert und versteht keine hochgeladenen Bilder. Um Vision zu ergänzen, nutzen wir ModLens als Brücke zwischen DeepSeek und einem visionsfähigen Modell.
ModLens‑Plugin installieren
Wenn du ein Bild hochlädst, verarbeitet ModLens es mit einem Vision‑Modell, extrahiert die relevanten visuellen Informationen und gibt sie an DeepSeek zurück, damit es darüber schlussfolgern kann.
Installiere das ModLens‑Plugin zunächst im web‑Profil:
dsh plugin --profile web add @liustack/modlens@3.20.0
Nach der Installation fügt ModLens das Tool modlens_read_image hinzu und erstellt Modellvarianten wie ``DeepSeek-V4-Flash (modlens vision)`.
Diese Modellvarianten erlauben dir, Bilder hochzuladen und dennoch DeepSeek als Haupt‑Reasoning‑Modell zu verwenden.
Vision‑Backend registrieren
Für diesen Guide nutzen wir die Gemini‑API als Vision‑Backend. Dafür brauchst du einen Gemini‑API‑Schlüssel. Du kannst mit dem Free‑Tier der Gemini‑API starten. Google stellt innerhalb der Free‑Tier‑Limits kostenlosen Zugriff auf unterstützte Gemini‑Modelle bereit. Du musst also keine Zahlungsdaten hinterlegen, nur um das Vision‑Setup in diesem Guide zu testen.
Sobald du deinen Schlüssel hast, füge ihn deiner Umgebung hinzu.
Unter Linux oder macOS:
export GEMINI_API_KEY="your_gemini_api_key"
Unter Windows PowerShell:
$env:GEMINI_API_KEY="your_gemini_api_key"
ModLens‑CLI installieren und konfigurieren
Installiere als Nächstes die ModLens‑CLI:
npm install -g @liustack/modlens
Konfiguriere sie anschließend mit dem Gemini‑API‑Schlüssel.
Unter Linux oder macOS:
modlens config set gemini-api.apiKey "$GEMINI_API_KEY"
modlens config set provider gemini-api
Unter Windows PowerShell:
modlens config set gemini-api.apiKey "$env:GEMINI_API_KEY"
modlens config set provider gemini-api
Zum Schluss prüfen wir, ob alles funktioniert:
modlens doctor
Du solltest gemini-api als ausgewählten, einsatzbereiten Provider sehen.
DeepSeek Harness mit ModLens testen
Testen wir jetzt das Bildverständnis.
Wähle im Modellpicker eines der Modelle mit (modlens vision) im Namen, zum Beispiel DeepSeek-V4-Flash (modlens vision).

Füge ein Bild ein oder lade es hoch und frage dann: Explain what is shown in this image.

Wie im obigen Beispiel zu sehen, kann DeepSeek das hochgeladene Bild nun beschreiben und darüber schlussfolgern.
Hinter den Kulissen sendet ModLens das Bild an Gemini zum visuellen Verständnis und gibt die extrahierten Informationen an DeepSeek zurück. So bleibt DeepSeek das Haupt‑Reasoning‑Modell, während Gemini nur den Vision‑Teil übernimmt.
DeepSeek Harness mit einem Drittanbieter‑Modell nutzen
Zum Schluss probieren wir ein Modell eines anderen Anbieters. Öffne Settings → Models.

Hier kannst du Anbieter wie OpenAI und Anthropic hinzufügen oder einen anderen unterstützten Modellanbieter mit deinen API‑Zugangsdaten konfigurieren.
Du kannst auch einen Custom‑Provider anlegen, wenn du ein selbstgehostetes Modell oder einen anderen kompatiblen Endpoint verbinden willst. So konfigurierst du Details wie Provider‑ID, Basis‑URL, API‑Typ, Zugangsdaten und Modellnamen.
Sobald der Provider hinzugefügt ist, kehre zu deiner Session zurück und wähle das neue Modell im Modellpicker aus.
Zum Beispiel mit diesem Prompt:
Create a Python command-line to-do app that lets users add, list, complete, and delete tasks, with tasks saved locally in a JSON file.

Im obigen Beispiel erledigt ein Drittanbieter‑Modell Kimi-K3 die Coding‑Aufgabe – ein Beleg dafür, dass DeepSeek Harness nicht auf DeepSeek‑Modelle beschränkt ist.
Du kannst im Modellpicker zwischen konfigurierten Modellen wechseln. Die Änderung greift mit deiner nächsten Anfrage, ohne den Harness‑Server neu zu starten.
Fazit
Nach meinen Tests bevorzuge ich für meinen Workflow weiterhin Pi Coding Agent und OpenCode.
DeepSeek Harness erinnert mich stark an den Pi Coding Agent, weil beide auf einem Plugin‑Ökosystem aufbauen. Du kannst verschiedene Erweiterungen installieren und deinem Coding‑Agenten je nach Bedarf zusätzliche Fähigkeiten geben. Diese Flexibilität ist nützlich, aber in meinen Tests verstehe ich den Hype um DeepSeek Harness noch nicht so recht. Das Gesamterlebnis wirkte im Vergleich zu anderen Coding‑Agenten, die ich bereits nutze, ziemlich normal.
Außerdem bin ich auf ein paar nervige Punkte gestoßen. Manchmal stoppte der Agent mitten in einer Aufgabe ohne Erklärung, und ich musste continue tippen, damit er weitermacht. Auch die Installation und Konfiguration von Plugins war ein Knackpunkt. Das kann ziemlich schwierig sein, wenn man nicht genau weiß, was man tut – und die Dokumentation hilft aktuell wenig.
Gleichzeitig ist DeepSeek Harness noch sehr neu, daher sind diese Punkte nachvollziehbar. Ich erwarte, dass sich Nutzererlebnis, Doku und Plugin‑Ökosystem mit der Zeit deutlich verbessern. Möglich ist auch, dass DeepSeek ein Harness baut, das besonders gut mit den eigenen Modellen harmoniert – was einen Teil der Begeisterung erklären könnte.
DeepSeek Harness FAQs
What is DeepSeek Harness?
DeepSeek Harness (dsh) ist ein Open-Source-Agentenframework von DeepSeek AI unter MIT-Lizenz, das auf der Idee basiert, dass „alles ein Plugin“ ist. Modelle, Tools, Interfaces und sogar die Agentenschleife lassen sich austauschen. Es läuft als lokaler Coding‑Agent mit browserbasierter Weboberfläche und Headless‑Modus und ist modellagnostisch – du bist also nicht auf DeepSeeks eigene Modelle festgelegt. Der Developer Preview startete im August 2026 und entwickelt sich rasant weiter.
Is DeepSeek Harness free to use?
Das Harness selbst ist kostenlos und Open Source unter der MIT‑Lizenz. Du kannst es ohne Kosten installieren, anpassen und selbst hosten. Bezahlen musst du für das zugrunde liegende Modell: Du brauchst einen DeepSeek‑API‑Schlüssel mit etwas Guthaben für DeepSeeks Modelle und die integrierte Websuche oder Zugangsdaten für jeden anderen angebundenen Provider.
Can DeepSeek Harness run models other than DeepSeek?
Ja. Da Modell‑Adapter als Plugins vorliegen, kannst du Anbieter wie OpenAI und Anthropic unter Settings → Models hinzufügen oder einen Custom‑Provider auf jeden OpenAI‑kompatiblen Endpoint zeigen lassen – inklusive selbstgehosteter oder lokaler Modelle. Du kannst im Modellpicker zwischen konfigurierten Modellen wechseln, ohne den Server neu zu starten.
How is DeepSeek Harness different from Claude Code?
Beides sind Agenten‑Harnesses, aber Claude Code ist ein Closed‑Source‑Produkt, das an die Modelle von Anthropic gebunden ist, während DeepSeek Harness MIT‑lizenziert und modellagnostisch ist. Jede Fähigkeit bis hin zur Agentenschleife ist als austauschbares Plugin umgesetzt. Harness ist außerdem viel jünger: ein Developer Preview mit zu erwartenden Breaking Changes, während Claude Code ein ausgereiftes Produkt ist.
How do you add image understanding (vision) to DeepSeek Harness?
Die Chat‑Modelle von DeepSeek in Harness sind textbasiert. Vision ergänzst du über ein Community‑Plugin wie ModLens, das DeepSeek mit einem visionsfähigen Modell verbindet. Nach der Installation fügt ModLens das Tool modlens_read_image und Modellvarianten wie „DeepSeek-V4-Flash (modlens vision)“ hinzu. Anschließend konfigurierst du ein Vision‑Backend. Empfohlen ist ein kostenloser Gemini‑API‑Schlüssel.
Als zertifizierter Data Scientist ist es meine Leidenschaft, modernste Technologien zu nutzen, um innovative Machine Learning-Anwendungen zu entwickeln. Mit meinem fundierten Hintergrund in den Bereichen Spracherkennung, Datenanalyse und Reporting, MLOps, KI und NLP habe ich meine Fähigkeiten bei der Entwicklung intelligenter Systeme verfeinert, die wirklich etwas bewirken können. Neben meinem technischen Fachwissen bin ich auch ein geschickter Kommunikator mit dem Talent, komplexe Konzepte in eine klare und prägnante Sprache zu fassen. Das hat dazu geführt, dass ich ein gefragter Blogger zum Thema Datenwissenschaft geworden bin und meine Erkenntnisse und Erfahrungen mit einer wachsenden Gemeinschaft von Datenexperten teile. Zurzeit konzentriere ich mich auf die Erstellung und Bearbeitung von Inhalten und arbeite mit großen Sprachmodellen, um aussagekräftige und ansprechende Inhalte zu entwickeln, die sowohl Unternehmen als auch Privatpersonen helfen, das Beste aus ihren Daten zu machen.
