Khoj verfolgt ein klares Ziel: Die Dokumente, Notizen und Webseiten, die über Ihren Rechner verstreut sind, werden zu einer persönlichen Wissensbasis, die Sie einfach befragen – mit Antworten aus Ihrem eigenen Material statt aus freier Erfindung. Mit rund 35.000 Sternen auf GitHub gehört es zu den meistbeachteten Open-Source-Projekten für persönliches Wissensmanagement. Wichtiger als der Hype ist der Teil, der über Staubansatz entscheidet: Sie betreiben es selbst und pflegen es selbst – rechnen Sie die Kosten, bevor Sie installieren.
Offizielle Repository-Angaben
- Plattform: GitHub
- Organisation: khoj-ai
- Projekt: khoj
- Lizenz: AGPL-3.0
Warum es durchstartete
Erstens frisst es fast alles: PDFs, Word-Dateien, Markdown, Bilder und Notion-Exporte lassen sich indexieren, und bei Fragen durchsucht es zuerst Ihr Material, bevor es antwortet. Zweitens ist es an keinen Modellanbieter gefesselt – Cloud-Modelle wie GPT, Claude und Gemini funktionieren ebenso wie lokal betriebene offene Modelle, was Wege zum Sparen und zum Datenschutz öffnet. Drittens sind die Zugänge überall: Browser, Desktop- und Handy-Apps plus Plugins für Obsidian und Emacs, sodass Notizgewohnheiten bleiben dürfen. Viertens kann es mehr als Frage und Antwort, mit eigenen Agenten und geplanten Automatisierungen, die Informationen periodisch ordnen und zustellen.
Betrieb: drei Kosten vorher zählen
Die Maschinenrechnung: Empfohlen wird Docker, und es braucht einen Rechner oder Server, der dauerhaft läuft. Auf dem eigenen Gerät herumspielen ist leicht; von überall zugreifen heißt Miete für einen Cloud-Server oder Strom und Zuverlässigkeit eines Heimgeräts. Die Modellrechnung: Cloud-Modelle rechnen nach Verbrauch ab, und Fragen wie Indexierung zehren am Kontingent; lokale Modelle sparen das Geld, verlangen aber eine ordentliche Grafikkarte und kosten Tempo und Antwortqualität. Die Zeitrechnung: Der Erstimport einer großen Bibliothek braucht Geduld, danach gehören Updates, Backups und Fehlersuche Ihnen – es gibt keinen Support-Schalter, nur Community und Dokumentation.
Die echten Stolpersteine
Die Dokumentanalyse hat eine Decke: Gescannte PDFs, komplexe Tabellen und layoutlastige Handbücher werden spürbar schlechter indexiert, und Antworten können unvollständig zurückkommen – kein Khoj-Spezifikum, aber die Erwartung gehört justiert. Finden ist nicht Wahrheit: Sind die gefundenen Passagen veraltet oder widersprüchlich, synthetisiert es trotzdem eine selbstsichere Antwort; wichtige Schlüsse gehören am Original geprüft. Die Lizenz zählt über den Eigengebrauch hinaus: Die AGPL-3.0 berührt Selbsthoster kaum, doch wer eine veränderte Version als öffentlichen Dienst anbietet, unterliegt deutlich strengeren Pflichten – vor kommerziellem Einsatz lesen. Und das mobile Erlebnis ist brauchbar statt begeisternd, was stört, wenn Ihre Wissensarbeit auf dem Handy lebt.
Für wen es passt – und für wen nicht
Es passt zu großen persönlichen Archiven, in die Sie wirklich zurückkehren; zu datenschutzbewussten Nutzern, deren Dokumente die eigene Maschine nicht verlassen sollen; und zu Obsidian-Nutzern, die eine Frage-Antwort-Schicht über ihren Tresor legen wollen. Es passt nicht zu Menschen, die Docker und Server nicht anfassen möchten – ein gehostetes Notizprodukt mit Fragefunktion macht Sie glücklicher –, und nicht zu Teams, die Rechteverwaltung und Zusammenarbeit auf Unternehmensniveau von einem im Kern persönlichen Werkzeug erwarten. Wer bereit ist, der Hausmeister des eigenen zweiten Gehirns zu sein, findet in Khoj eine der vollständigsten offenen Optionen seiner Klasse.