Khoj
Gratuit
Khoj est une application d'IA personnelle open source positionnée comme le « deuxième cerveau de l'IA ». Il peut connecter vos notes, documents et informations réseau, fournir une recherche sémantique, des questions et réponses conversationnelles, des recherches en réseau et des agents personnalisés, et prendre en charge l'automatisation des tâches dans des assistants de recherche exécutés régulièrement. Khoj fournit à la fois une version hébergée dans le cloud et peut également être entièrement auto-hébergé localement. Il prend en charge l'accès au cloud et aux grands modèles locaux et est intégré à des portails tels que Obsidian, Emacs, Desktop et WhatsApp.
Khoj
Paramètres et statistiques de base
Khoj est une application d'IA personnelle open source, officiellement positionnée comme « votre deuxième cerveau d'IA ». Il intègre des informations dispersées dans des notes, des documents et sur Internet, propose une recherche sémantique, des questions et réponses conversationnelles, une recherche approfondie en réseau et des agents personnalisables, et peut automatiser les tâches de recherche dans des assistants qui s'exécutent selon les plans.
| Projets | Informations publiques |
|---|---|
| Positionnement officiel | Deuxième cerveau d'IA personnel auto-hébergé |
| Formulaire de déploiement | Version hébergée dans le cloud + entièrement auto-hébergée (Docker/local) |
| Capacités de base | Recherche sémantique, dialogue questions-réponses, recherche de réseau, agents personnalisés |
| Automatisation | Les tâches de recherche peuvent être configurées pour s'exécuter automatiquement sur une base planifiée |
| Source de données | Notes personnelles PDF, Markdown, images, pages Web, etc. |
| Intégration du portail | Web, bureau Obsidian, Emacs, WhatsApp |
| Accès au modèle | Modèle cloud et modèle open source local |
| Licence Open Source | AGPL-3.0 |
| Taille de la communauté | GitHub environ 35 000 étoiles, 2 200 forks |
| Dernière version | v2.0.0-beta.28 (2026-03-26, versions GitHub) |
Valeur du formulaire : Khoj fournit à la fois une « version cloud prête à l'emploi » et une « version entièrement auto-hébergée ». Le premier est destiné aux personnes qui souhaitent l’utiliser immédiatement, et le second est destiné aux utilisateurs qui apprécient la confidentialité et souhaitent que leurs données restent locales. Les deux partagent le même ensemble de capacités cérébrales secondaires et peuvent être sélectionnés en fonction des besoins de confidentialité.
Valeur de recherche : le modèle de recherche de Khoj peut effectuer une récupération et une synthèse d'informations en plusieurs étapes à travers des notes et sur Internet, étendant la « recherche de réponses dans vos propres documents » à « combiner les connaissances privées et les réseaux publics pour une recherche approfondie », et peut automatiser ces tâches dans des assistants programmés.
Valeur d'intégration : Khoj n'oblige pas les utilisateurs à modifier leurs habitudes existantes, mais s'intègre dans des portails courants tels que Obsidian, Emacs, Desktop et WhatsApp, faisant de « interroger sa propre base de connaissances » une action naturelle dans le flux de travail existant.
Reconnaissance des utilisateurs et du marché
La reconnaissance de Khoj vient de la popularité de la communauté open source et de l’approbation de Y Combinator. La société n'a pas divulgué ses revenus ni le nombre d'utilisateurs payants.
Taille de la communauté : le référentiel GitHub khoj-ai/khoj affiche publiquement environ 35 000 étoiles et 2 200 forks. Il s'agit d'un projet open source très regardé dans le sens d'un « assistant personnel IA/second cerveau ». La fonctionnalité d'auto-hébergement le rend particulièrement populaire parmi les groupes d'utilisateurs qui apprécient l'autonomie des données.
Contexte et positionnement : Khoj a été développé par une équipe soutenue par Y Combinator. En combinant gestion des connaissances personnelles et assistants IA, Khoj fait la différence avec « open source + auto-hébergement + intégration multi-entrées ». Il est souvent comparé à diverses IA de prise de notes et à des outils cérébraux secondaires. Ses avantages résident dans son ouverture et sa confidentialité contrôlable.
Prérequis pour la mise en œuvre : La version auto-hébergée nécessite certaines capacités de déploiement et d'exploitation et de maintenance (Docker ou environnement local) ; la qualité finale des questions-réponses et des recherches dépend du grand modèle connecté et de l’organisation des données personnelles. Si les utilisateurs ordinaires ne souhaitent pas fonctionner et entretenir eux-mêmes, ils peuvent directement utiliser la version d'hébergement cloud.
Avantage de coût
- C-side/Individuel : Généralement, une version gratuite est fournie pour découvrir les fonctions de base, et l'utilisation à haute fréquence nécessite un abonnement payant.
- API/Développeur : Facturé au volume d'appels, adapté aux équipes de développement qui peuvent être intégrées de manière flexible dans leurs propres systèmes.
- Entreprise/Privatisation : contactez le propriétaire de l'entreprise pour obtenir un devis personnalisé et un plan de déploiement. Le prix spécifique est soumis à la page officielle de tarification en temps réel.
Fonctions principales
Les capacités de Khoj sont organisées autour de « la transformation des connaissances personnelles en IA conversationnelle, consultable et automatisable » :
- Recherche sémantique : effectuez une recherche sémantique sur des notes PDF, des Markdown, des images, etc. pour trouver des informations basées sur la signification plutôt que sur des mots-clés.
- Conversation de questions et réponses : posez des questions sur la base de connaissances personnelles et les informations du réseau en langage naturel, et obtenez des réponses fondées sur des preuves.
- Recherche Internet approfondie : le mode recherche peut effectuer une synthèse d'informations en plusieurs étapes sur des données privées et des réseaux publics.
- Agent personnalisé : créez un agent doté de connaissances et d'une personnalité spécifiques à des fins spécifiques.
- Automation et portails multiples : définissez des tâches de recherche pour qu'elles s'exécutent régulièrement et utilisez-les à tout moment via des portails tels que Obsidian, Emacs, Desktop et WhatsApp.
Evolution du modèle et de la version
Khoj est en phase d'itération bêta 2.0 et se concentre principalement sur les capacités de recherche et d'automatisation.
Version principale
La dernière version v2.0.0-beta.28 (2026-03-26) suit la bêta.27 (2026-03-25) et la bêta.26 (2026-03-25). La série 2.0 se concentre sur les modes de recherche, les agents personnalisés et les assistants automatisés, et continue d'améliorer l'intégration multi-entrées et l'indexation des documents.
Contexte de la version
Depuis ses débuts axés sur la recherche sémantique et la prise de notes, jusqu'à l'accent mis par la version 2.0 sur « recherche + automatisation + intelligence », l'évolution de Khoj reflète la transformation d'un « second cerveau basé sur la recherche » vers un « assistant personnel actif d'IA ». Pour les utilisateurs, la version bêta 2.0 est encore rapidement itérée, et il est conseillé aux utilisateurs auto-hébergés de prêter attention à la compatibilité de la configuration et de l'indexation des données lors de la mise à niveau.
Avantages techniques
Les avantages techniques de Khoj s'expliquent par l'enchaînement « mécanisme-effet-scène ».
Mécanisme : Index sémantique + accès multi-sources. Unifiez l’indexation sémantique des données personnelles dans plusieurs formats. L'effet est qu'il peut effectuer une recherche dans les documents selon leur signification. Le scénario applicable est la gestion des connaissances personnelles où les données sont dispersées et la récupération des mots clés échoue.
Mécanisme : auto-hébergé + modèle neutre. Prend en charge le déploiement entièrement sur site et l'accès aux modèles cloud ou sur site. L'effet est que les données sont contrôlables et le coût est réglable, ce qui convient aux utilisateurs qui apprécient la confidentialité ou qui ont un accès limité au réseau.
Mécanisme : Mode recherche + Automatisation. Encapsulez la recherche en plusieurs étapes et exécutez-la régulièrement. L'effet est de transformer les questions et réponses ponctuelles en un assistant de recherche avec une sortie continue, ce qui convient aux utilisateurs qui ont besoin de suivre régulièrement un certain sujet.
Comment utiliser
Khoj propose deux entrées : cloud et auto-hébergée :
- Version Cloud : Inscrivez-vous sur le site officiel et vous pourrez directement utiliser le Web, le bureau et diverses intégrations de portail sans déploiement.
- Version auto-hébergée : utilisez Docker ou le déploiement de contexte local selon la documentation officielle, connectez le répertoire de notes et les documents, et configurez le modèle avant utilisation.
- Processus de base : Accéder à la source de données (notes/PDF/page web) → Attendre l'indexation sémantique → Poser des questions et effectuer des recherches sur le Web ou le portail intégré → Créer un agent ou mettre en place une tâche automatisée.
Lors de la mise en œuvre, vous devez prêter attention à l'organisation et à la qualité de l'indexation des données, ainsi qu'à l'impact de la sélection du modèle sur les réponses et la profondeur de la recherche ; Les utilisateurs auto-hébergés doivent également planifier le déploiement et la compatibilité des données lors des mises à niveau.
Prix des produits
Le modèle de tarification est soumis à la page officielle en temps réel. Habituellement, un système freemium ou d'abonnement est utilisé et les fonctions de base peuvent être utilisées gratuitement. Les fonctions avancées ou l'utilisation à haute fréquence nécessitent des abonnements payants, et il est conseillé aux utilisateurs d'évaluer la solution optimale en fonction de l'utilisation réelle.
Scénarios d'application
- Gestion des connaissances personnelles : transformez des années de notes et de documents en une base de connaissances conversationnelle. L'objectif de la vérification est la qualité de la récupération sémantique.
- Recherche et suivi de sujets : utilisez le mode de recherche pour effectuer des recherches approfondies sur les données et les réseaux, et suivez automatiquement un certain sujet à intervalles réguliers. L'objectif de la vérification est la traçabilité des conclusions de la recherche.
- Assistant local sensible à la confidentialité : entièrement auto-hébergé + modèle local, laissant les données privées pour le traitement local. La vérification se concentre sur l'expérience du modèle local sur le matériel cible.
Personnes concernées
- Travailleurs du savoir et chercheurs : Il existe un grand nombre de notes et de documents qui doivent être récupérés par leur sens et étudiés en profondeur.
- Utilisateurs individuels qui apprécient la confidentialité : assistants personnels d'IA qui souhaitent être entièrement auto-hébergés et les données ne seront pas envoyées.
- Utilisateurs approfondis des outils de prise de notes : habitués à Obsidian, Emacs et d'autres outils, et espèrent acquérir des capacités d'IA dans les portails existants.
Ne convient pas aux limites : la version auto-hébergée nécessite certaines capacités d'exploitation et de maintenance et ne convient pas aux utilisateurs qui ne souhaitent absolument pas configurer l'environnement et se soucient du cloud ; en tant qu'application d'IA personnelle, elle ne remplace pas la base de connaissances collaborative orientée équipe, et les scénarios de collaboration multi-personnes doivent être évalués séparément.
Résumé et Outlook
Elle propose des solutions compétitives dans son domaine et sa valeur fondamentale réside dans l’abaissement du seuil d’utilisation de l’IA dans ce domaine.
Limites actuelles : Certaines fonctionnalités avancées nécessitent un abonnement payant et la version gratuite comporte des restrictions de fonction ou d'utilisation ; les détails techniques spécifiques et les critères de performance n’ont pas encore été entièrement divulgués.
Outils associés : ÉquipageAI, langchain
Comparaison des produits concurrents
| Dimensions de comparaison | Khodj | Concurrent A | Concurrent B |
|---|---|---|---|
| Différences fondamentales | — | — | — |
| Prix | — | — | — |
| Utilisateurs cibles | — | — | — |
Remarque : la comparaison ci-dessus est basée sur les informations publiques sur le produit et les différences réelles sont basées sur l'expérience utilisateur.
Informations de version
- Khoj v2.0.0-bêta.28 :La dernière version de test 2.0 publiée par GitHub Releases fait la promotion du modèle de recherche, des agents personnalisés et des capacités d'automatisation du deuxième cerveau de l'IA personnelle, et prend en charge l'accès au cloud et aux modèles locaux et l'intégration multi-entrées.
- Khoj v2.0.0-bêta.27 :Itération de la version bêta 2.0 pour améliorer la stabilité du modèle de recherche et de l'expérience des agents.
- Khoj v2.0.0-bêta.26 :Version bêta 2.0, favorisant l'intégration multi-entrées et les capacités d'indexation de documents.
Avis des utilisateurs