1 points par GN⁺ 2024-02-21 | 1 commentaires | Partager sur WhatsApp
  • Kagi Sidekick est un service en version alpha visant à ajouter une recherche rapide et de l’IA à un site web personnel ou à un site de documentation avec quelques lignes de code
  • Kagi prend en charge l’indexation, les embeddings, la recherche vectorielle et le chat IA basé sur les pages web, sans que l’exploitant du site ait à les construire lui-même
  • L’intégration est possible soit avec 2 lignes de code via des Web Components légers de 20kB min+gzip, soit via des plugins Docusaurus, Hugo ou VitePress
  • Le service est prévu comme gratuit pour les petits sites et les sites personnels, et comme une option de recherche à prix raisonnable pour les sites commerciaux
  • Pour l’instant, il s’agit d’une phase de recueil de demande et de retours avant lancement, et les sites web ayant opté pour le service peuvent être automatiquement indexés dans la recherche Kagi

Une couche recherche·IA à ajouter à un site web

  • Kagi Sidekick est un service en version alpha qui ajoute des fonctions de recherche et d’IA à un site web personnel ou de documentation
  • Kagi prend en charge les tâches de backend de recherche difficiles à implémenter directement pour l’exploitant du site
    • indexation
    • embeddings
    • recherche vectorielle
    • chat IA basé sur les pages web
  • Deux méthodes d’intégration sont proposées
    • intégration en 2 lignes de code à l’aide de Web Components légers de 20kB min+gzip
    • utilisation de plugins Docusaurus, Hugo ou VitePress

Plan de mise à disposition et modalités de participation

  • Le service est destiné à être proposé gratuitement pour les petits sites et les sites personnels
  • Il est aussi prévu comme une option de recherche à prix raisonnable pour les sites commerciaux
  • Les sites web qui utilisent Sidekick peuvent, après opt-in, être automatiquement indexés dans la recherche Kagi
  • Kagi recueille actuellement la demande et les retours avant le lancement

1 commentaires

 
GN⁺ 2024-02-21
Avis sur Hacker News
  • Je suis le fondateur de Kagi. Il s’agit d’une preuve de concept alpha très précoce, réalisée en quelques semaines par un développeur de Kagi Labs ; l’infrastructure et le produit aboutis n’existent pas encore.
    Nous publions ce prototype pour recueillir des retours et évaluer la demande.
    La raison pour laquelle nous l’avons créé est que cela pourrait être un moyen efficace pour Kagi de constituer et d’étendre son propre index. Si l’utilisateur est un utilisateur de Kagi, nous pouvons élargir l’index à des dizaines de milliers de sites de qualité — sites personnels, projets de loisir, startups, sites de documentation — et les faire apparaître dans les résultats de recherche quand c’est pertinent. C’est proche de ce que nous faisons déjà avec l’initiative Kagi Small Web (https://kagi.com/smallweb).
    Si le widget de recherche comporte notre marque, c’est aussi une façon d’exposer Kagi en dehors de kagi.com. C’est pourquoi il me semble logique de le proposer gratuitement aux petits sites ou projets.
    Par ailleurs, le crowdsourcing de l’index me plaît parce qu’il va exactement à l’opposé de la tendance de la recherche financée par la publicité, où un petit nombre d’acteurs accaparent l’essentiel de l’espace et dégradent la qualité des résultats (https://detailed.com/google-control/).
    Voilà le plan, et comme c’est un projet Labs, nous sommes prêts à accepter qu’il échoue. On ne peut pas savoir sans essayer, donc il faut continuer à tenter des choses.

    • Je me demande comment vous comptez empêcher qu’un site qui ressemble au départ à un petit site web, puis se remplit ensuite de mots-clés SEO générés par LLM et de publicités, soit relié à Sidekick.
      Un examen manuel est possible au moment de l’inscription, mais une fois qu’un canal permettant d’injecter du contenu dans l’index de Kagi est ouvert, il faut un moyen d’empêcher l’abus de cette position privilégiée.
    • Je suis d’accord avec un autre commentaire disant que l’IA peut brouiller la vision centrale du produit, mais je suis plutôt satisfait de l’orientation et de la roadmap de Kagi.
      J’ai le sentiment que les produits IA sortis jusqu’ici ont bien complété la recherche, et j’espère que cela continuera. J’espère que cette fonctionnalité aidera aussi à améliorer l’index et offrira un service intéressant aux petits créateurs.
      Le changement qui déclenche une réponse rapide en ajoutant ? à la fin d’une requête était vraiment excellent. J’aimerais qu’il y ait davantage de fonctionnalités invocables en ajoutant quelque chose avant ou après la requête.
    • J’apprécie la transparence qui consiste à expliquer honnêtement quel avantage cela apporte aussi à Kagi.
      Au lieu de simplement dire que c’est une fonctionnalité formidable pour l’utilisateur, vous expliquez aussi en quoi cela aide Kagi ; cela inspire davantage confiance et donne une idée de la direction que peut prendre le produit.
    • Je me demande comment vous appliqueriez la tarification à des sites de type wiki à but non lucratif, mais comptant des centaines à des milliers de pages et divers médias.
      Pour les wikis de fandom indépendants, obtenir une recherche correcte qui dépasse la simple correspondance de noms est un problème récurrent, mais ils manquent généralement de moyens financiers ou de capacité de coordination pour faire mieux qu’un site MediaWiki classique.
      Par exemple, le wiki Baldur's Gate 3 (https://bg3.wiki) compte plus de 8 000 pages, avec un texte assez dense (voir des pages comme https://bg3.wiki/wiki/D%26D_5e_rule_changes), et fonctionne entièrement grâce aux dons.
    • En tant qu’utilisateur de Kagi et scientifique, je pense que Kagi Sidekick serait assez bien accueilli dans le domaine de la bio-informatique.
      Il existe beaucoup de documentation complexe où l’utilisateur final doit comprendre de grands ensembles de données compliqués. Je me demande aussi s’il est possible de le configurer pour qu’il renvoie uniquement vers la documentation, sans répondre directement aux questions.
  • En tant que rédacteur technique gérant un site de documentation, j’ai quelques questions.
    Je me demande quelles pages sont incluses dans l’index : toutes les pages du même domaine, ou seulement celles où le widget de recherche est intégré ? La démo semble récupérer des réponses depuis kagi.com, mais si je gérais la documentation, je pourrais vouloir qu’il ne consulte que help.kagi.com.
    Il est aussi important de savoir si l’on peut recevoir les logs de ce que les utilisateurs saisissent dans la barre de recherche, et comment. Il faudrait aussi les logs des résumés générés, car il faut savoir ce que le LLM dit aux lecteurs.
    Je me demande également s’il est possible d’accéder aux embeddings générés pour mon site. Probablement pas, mais si des embeddings de mon site « existent déjà quelque part » sans travail supplémentaire de mon côté, il y aurait des usages intéressants. En y repensant, rien ne garantit toutefois que des embeddings soient effectivement utilisés.
    La fréquence de mise à jour de l’index est également importante. Même un index de documentation basé sur une version vieille d’une semaine peut poser problème.
    J’aimerais aussi savoir si Kagi fera quelque chose des requêtes des utilisateurs.

  • Je suis utilisateur payant de Kagi depuis plusieurs mois. La seule chose qui me manquait vraiment dans les résultats de recherche Google, c’était les réponses instantanées
    C’est la fonctionnalité qui extrait la réponse d’une page web visible et l’affiche directement, sans qu’il soit nécessaire de cliquer sur un lien. Kagi le fait aussi pour certaines requêtes, mais pas aussi largement que Google
    Donc, contrairement à la plupart des réactions ici, je soutiens les tentatives de Kagi avec l’IA pour réduire les clics et fournir directement des réponses. Les résultats de recherche sont déjà très bons, et j’espère que Kagi continuera à grandir

    • Personnellement, j’ai commencé à éviter les réponses instantanées de Google et d’autres services. Parce qu’elles sont sorties de leur contexte et deviennent souvent des réponses fausses
      Elles essaient de montrer ce que l’utilisateur veut voir, mais le sens réel est souvent différent
    • En fait, Kagi vient d’améliorer fortement cette fonctionnalité, donc ça vaut le coup de continuer à l’essayer
      Au risque de sonner comme une pub, Kagi a été de loin la dépense dont j’ai été le plus satisfait l’an dernier. Les boutons “programmation”, “académique”, “petit web” et surtout “PDF” valent vraiment leur prix
      Les deux grandes améliorations de la semaine dernière sont l’ajout de Wolfram|Alpha, qui renforce les résultats pour les calculs, les conversions d’unités et les requêtes sur l’heure. Cela résout beaucoup de problèmes signalés sur ce type de requêtes, puisque les résultats viennent désormais d’une référence en matière de connaissances computationnelles
      Pour obtenir des réponses plus rapidement, Quick Answer se déclenche maintenant automatiquement si la recherche commence par un mot interrogatif (what, where, who, which, when, how) ou si l’on ajoute simplement un point d’interrogation ? à la fin
    • J’aime assez la réponse rapide ajoutée par Kagi (https://help.kagi.com/kagi/ai/quick-answer.html)
      La documentation explique dans quelles conditions elle se déclenche, ce qui la rend moins arbitraire
    • Une des choses qui me manquent dans Google, c’est sa calculatrice intégrée fiable
      On peut utiliser une autre appli de calculatrice, mais il est difficile de perdre l’habitude de taper directement dans la barre d’adresse
      Kagi a aussi une calculatrice, mais elle donne des résultats subtils sur beaucoup de requêtes. Par exemple, pour 210/8, elle renvoie 105/4. Techniquement c’est correct, mais ce n’est presque jamais la réponse attendue
    • En tant que client Ultimate/standard, je suis d’accord. Personnellement, je pense que l’IA est en train de devenir la recherche
      Il n’est pas nécessaire de fusionner les deux de force dès maintenant en une sorte de monstre gigantesque, mais il est important de poser dès aujourd’hui les bases de quelque chose de familier, pratique et bien intégré pour l’avenir
  • J’aime Kagi et j’en suis un client satisfait. Mais j’espère que ses essais de fonctionnalités IA ne s’éloigneront pas trop de sa proposition de valeur centrale : être un moteur de recherche web
    C’est tout ce que j’attends de Kagi

    • S’ils ne se concentrent pas sur l’IA, quelqu’un d’autre les remplacera
  • Je suis un des premiers utilisateurs de Kagi. J’aime la recherche Kagi et les fonctions de résumé, mais j’aimerais qu’ils se concentrent sur des résultats de recherche et de résumé de haute qualité et configurables, plutôt que sur de nouveaux produits

    • Je pense que leur activité principale actuelle n’est peut-être pas durable telle quelle
      Si j’ai bien compris, Kagi utilise des API de recherche, qui coûtent cher. Pour devenir une activité durable, il leur faut donc au moins en partie leur propre index
    • Cela ressemble à une fonctionnalité bénéfique pour tout le monde. L’activité des utilisateurs sur les sites intégrés pourrait servir de signal d’intérêt pour la mise à jour de l’index de Kagi
      Comme un index plus à jour permet d’obtenir de meilleurs résultats de recherche, j’ai l’impression que cela correspond tout à fait à la direction souhaitée
  • Je veux juste de bons résultats de recherche. Cela ressemble à une distraction

    • Si la motivation de cette fonctionnalité est de trouver davantage de sites et de pages à indexer, alors un index plus grand devrait améliorer la qualité des résultats, ou au moins leur quantité
    • D’accord. Je pensais payer pour qu’ils construisent un moteur de recherche
      Ce qui m’inquiète, c’est que cela ressemble à une recherche de financement, ou dans le pire des cas à une préparation à une acquisition
    • D’accord. Que ce soit Kagi ou un concurrent, la mise en œuvre de la recherche web semble pouvoir être améliorée presque indéfiniment, et les fonctionnalités qui ne relèvent pas de la recherche me semblent entrer en conflit avec cet objectif
      Cela dit, on peut défendre l’idée que les personnes susceptibles d’utiliser cette fonctionnalité sont aussi celles qui exploitent des sites dignes d’être indexés, ce qui serait bon pour elles et améliorerait aussi la recherche pour l’ensemble des utilisateurs
  • En tant que client payant, je suis d’accord pour dire que la seule chose qui m’intéresse chez Kagi est la recherche, mais il est difficile d’ignorer la possibilité qu’à court terme la recherche soit presque entièrement absorbée par l’IA
    Il est naturel qu’une entreprise de recherche explore l’interaction entre IA et recherche. J’espère que cela ne deviendra pas l’axe principal, mais si cela devient nécessaire, ce sera une autre histoire
    L’histoire de Kodak, qui a ignoré les appareils photo numériques parce que c’était une entreprise de “film”, devrait servir de leçon. Si l’on ignore la possibilité que quelque chose remplace totalement la recherche, il se peut qu’au moment même où l’on devient bon en recherche, la recherche elle-même cesse d’avoir de l’importance

    • Je ne crois pas que cette fonctionnalité soit directement liée à l’IA. Il est possible que quelque chose m’ait échappé
      Si j’ai bien compris, elle permet d’ajouter une fonction “rechercher avec Kagi” à un site, avec pour effet secondaire que l’indexeur de Kagi indexe ce site
    • Je paie pour la recherche, et je serais aussi prêt à payer pour l’e-mail. Pour l’instant, je paie Google pour ça
      Puisqu’on parle de Google, je n’aime pas le logo “g” de Kagi
  • Je me demande s’il serait possible d’envisager aussi une version sous forme d’extension de navigateur pour les abonnés payants
    Ce que je voudrais vraiment, c’est utiliser cette fonctionnalité sur des sites web ou des documents non pris en charge. Pouvoir “demander” des faits à Kagi à propos de l’article ou du document que je suis en train de lire serait puissant, même si cela ne fait qu’explorer ou parser une seule page

  • Tout le monde doit avoir un moment où il a jugé que Google était devenu “mauvais”. Du moins ceux qui ont un jour pensé que Google était bon ; dans mon cas, c’était Google Plus
    Parce que Google avait décidé de créer un service de destination comme Facebook. Avant son lancement, je pensais que ce serait une fonctionnalité à intégrer aux sites web, comme AdWords
    S’ils avaient ajouté une couche sociale au web, cela aurait accru l’utilité du web, Google aurait pu continuer à exploiter sa manière existante d’identifier les endroits intéressants, et cela aurait aussi affaibli le principal avantage que Facebook avait sur le reste du web
    Je suis content de voir que Kagi semble comprendre ce que Google a oublié

  • Je paie pour Kagi, et comme j’ai aussi un petit site perso, j’ai vraiment envie d’essayer ça