3 points par GN⁺ 2024-05-31 | 1 commentaires | Partager sur WhatsApp
  • delve a été présenté comme une interface ChatGPT destinée à approfondir un sujet ; la page actuelle se limite à une brève introduction
  • L’écran public affiche la formule « delve into — », avec Faster language models, High-speed rail et Lentils comme exemples de sujets
  • Aucune information permettant d’évaluer le produit n’est fournie, comme la description des fonctionnalités, le mode d’emploi, la création de compte, les tarifs ou les modèles pris en charge
  • Le mode d’intégration avec ChatGPT ou le fonctionnement réel de l’interface sont difficiles à vérifier à partir du seul texte fourni
  • Les informations actuellement vérifiables se limitent au nom du produit et aux exemples de sujets ; des informations supplémentaires sont nécessaires pour juger de son utilisation réelle

Ce que montre la page publique

  • Le nom du produit est delve
  • L’écran affiche la formule « delve into — »
  • Trois exemples de sujets d’exploration sont indiqués
    • Faster language models
    • High-speed rail
    • Lentils

Informations non encore vérifiables

  • Le corps du texte ne contient pas de liste de fonctionnalités ni de procédure d’utilisation
  • La création de compte, les tarifs, les modèles pris en charge, le mode de traitement des données et le mode d’intégration avec ChatGPT ne peuvent pas être vérifiés dans le texte fourni

1 commentaires

 
GN⁺ 2024-05-31
Commentaires sur Hacker News
  • Très bien. Difficile de dire exactement pourquoi, mais ça semble être quelque chose de plus important qu’un simple gimmick
    J’ai aussi aimé le fait qu’un sujet déjà exploré ne se rouvre pas quand on clique dessus, et ce serait encore mieux si cela ramenait au panneau où ce sujet est déjà ouvert. C’est une tentative intéressante du point de vue selon lequel il faut accorder davantage d’attention à l’UX des LLM

    • L’UI est bonne et donne envie d’approfondir. Mais à mon avis, le problème est que cet outil entraîne l’utilisateur vers des domaines où les LLM ne sont pas bons
      Les LLM sont utiles quand il s’agit de faire des choses qu’une personne pourrait faire mais n’a pas envie de faire. Par exemple, un ami utilise ChatGPT pour rédiger des politiques anti-discrimination banales, un autre pour générer des descriptions de méchants, et il est aussi connu pour produire du code banal. Mais les utiliser pour découvrir de nouveaux faits concrets frôle la catastrophe. En cherchant des boulons contrefaits, il a halluciné un cas de « sword net » qui aurait ciblé les fixations contrefaites en 2018, avec le slogan « Secure the Foundation, Eliminate the Fake », sans qu’il y ait la moindre trace de cela sur Google, Brave ou DuckDuckBing. Au final, le système a confondu la question générale des contrefaçons avec un sujet plus spécifique, celui des fixations contrefaites, et si ce type de distinction fine est inévitable, alors les LLM ne sont pas très utiles pour ce genre d’exploration
    • Si je devais expliquer cette impression de « quelque chose de plus important qu’un simple gimmick », je dirais que les conversations humaines peuvent suivre plusieurs fils de discussion, et qu’au bout de 10 minutes le sujet a parfois tellement changé qu’il devient difficile de retrouver le point de départ
      Ce n’est pas exactement la même chose qu’un chat où l’historique des prompts reste visible, mais la conversation reste malgré tout assez linéaire. Cette UI permet de faire bifurquer la pensée, ce qui évite ce problème en amont
    • Honnêtement, je ne sais pas trop. Je me demande en quoi c’est différent de ChatGPT
  • En prenant un peu de recul, l’UX/UI des LLM en général est encore très immature. On en est encore aux tout débuts de la meilleure manière d’interagir avec ce type d’outils, donc il faut plus d’expérimentations comme celle-ci pour comprendre ce qui fonctionne et ce qui ne fonctionne pas

    • Entièrement d’accord. J’ai l’impression qu’on n’a même pas encore vraiment effleuré la surface
      Sur le projet sur lequel je travaille en ce moment, on fait des expérimentations évidentes mais nécessaires, comme supprimer la syntaxe Markdown agaçante que tous les LLM affichent brièvement, ou lisser le rendu du texte pour qu’il suive le taux de rafraîchissement de l’écran. https://llm-ui.com/
    • Une interface de chat de base reste bien meilleure que les affreux panneaux latéraux de Copilot, ou que les tentatives de style Google trop polies avec un design quasi material
      Il y a peut-être de la marge d’amélioration pour des cas particuliers comme le multimodal ou la recherche approfondie, mais pour le simple chat textuel, je pense qu’il est difficile d’améliorer l’interface la plus simple
    • J’aimerais que l’interaction humain-machine progresse suffisamment pour qu’un jour l’interface devienne le dernier recours
    • L’extension Chrome HLAI expérimente aussi cette idée
  • Si « delve » était une blague interne, je l’ai comprise. J’ai moi aussi un Custom GPT appelé AutoExpert (Chat), et plusieurs personnes qui l’ont testé l’ont surnommé « le Rabbit Hole GPT parfait » à cause de sa manière de faire apprendre un sujet à travers plusieurs relecteurs
    Même les utilisateurs du palier gratuit peuvent maintenant y accéder, donc ça pourrait vous plaire. [0]: https://chatgpt.com/g/g-LQHhJCXhW-autoexpert-chat

    • J’aime bien. J’apprécie le fait qu’il soit facile d’aller plus en profondeur. En revanche, les utilisateurs gratuits ont une limite d’usage assez stricte sur les Custom GPT, donc il peut être difficile d’aller aussi loin qu’on le voudrait
      J’ai posé des questions sur la théorie des cordes, la mécanique quantique, les pâtes romaines classiques, les vins italiens, et j’ai même envoyé une photo d’égopode podagraire ; je crois bien que j’ai trouvé mon nouveau GPT préféré. Je lui ai aussi demandé de critiquer des photos prises récemment, et c’était excellent, assez impressionnant même
    • J’aime bien l’approche globale, mais je me demande vraiment si c’est une bonne idée « d’apprendre » avec un outil qui hallucine aussi facilement
      La plupart du temps ce sera juste, mais avec un peu de malchance, j’ai peur de mémoriser sans m’en rendre compte quelque chose d’halluciné, puis de le ressortir devant un vrai expert et de passer pour quelqu’un de bizarre
    • C’est vraiment utile. La manière de faire émerger un rôle d’expert, des experts alternatifs, voire un point de vue opposé, est intéressante
      J’ai l’impression qu’on n’en est qu’au tout début de ce qu’on pourra faire avec les LLM
    • Je me demande quelle est la blague
  • J’aime bien. Le fait que le site mène immédiatement à l’action est appréciable, mais ce serait bien mieux avec un walkthrough
    Présenter directement le site dans le prompt de départ aiderait à comprendre son objectif dès le début. Par exemple, on pourrait afficher sur le premier écran un prompt recommandé comme [Explique ce que signifie "delve into"], avec une réponse du type : « C’est un outil pour explorer un sujet en profondeur, comme un rabbit hole où une chose intéressante en mène à une autre. Par exemple... » Ensuite, ce serait bien de guider pas à pas les fonctionnalités, du style : « Cliquez sur l’option X pour lancer un nouveau fil, choisissez un prompt recommandé ou créez le vôtre, puis suivez les fils connexes pour aller plus loin »

    • L’effet net positif de ce type de guide de démarrage est moins évident qu’on ne le pense. Les gens sont très partagés sur ce genre de propositions d’accompagnement
      Beaucoup trouvent qu’un walkthrough très bienveillant est forcément utile, et beaucoup d’autres le trouvent agaçant. J’ai recueilli beaucoup d’avis de designers UX seniors, de PM et d’utilisateurs sur de nombreux sites et applis, et ils se contredisent souvent sur les améliorations et les bonnes pratiques. Bien sûr, ce sont surtout les personnes qui veulent donner leur avis qui s’expriment, alors que celles que cela agace se font moins entendre. Ce projet me paraît facile à comprendre et intuitif, donc je ne vois pas la nécessité d’un walkthrough supplémentaire
  • J’aime beaucoup. Et si l’utilisateur pouvait sélectionner n’importe quelle portion du texte pour l’utiliser comme les liens fonctionnent actuellement ?
    Par exemple, il semble que les noms de personnes ne soient pas transformés en liens, alors que j’aime justement sur Wikipedia la facilité avec laquelle on peut retrouver les personnes mentionnées dans le corps du texte. Plutôt que d’ajouter des milliers de liens sur la page, ce serait pratique de pouvoir sélectionner un nom dans le texte, puis cliquer sur un bouton ou utiliser le menu contextuel pour créer un prompt basé sur la sélection. Pour ce type d’usage personnalisé, ça ne me dérange pas que l’utilisateur doive faire quelques clics de plus

    • J’ai posé une question sur les ordinateurs Atari 8 bits, et il a bien indiqué qu’ils utilisaient un CPU MOS 6502, mais cette partie n’a pas été transformée en lien. C’est exactement là que j’aurais voulu plonger dans le rabbit hole suivant
  • Bonne idée. On dirait que c’est aussi inspiré des notes d’Andy Matuschak, et j’aime bien cette approche
    [0] https://notes.andymatuschak.org/zB74H9CuWrosEuqve7jZyCo?stac...

    • Est-ce qu’il existe un SaaS du type Notion ou un plugin Obsidian qui permette d’écrire des notes comme ça ?
  • C’est excellent, et c’est quelque chose que j’aurais aimé avoir depuis longtemps. Pour l’instant, les tuiles ont une structure linéaire
    Par exemple, si la tuile A renvoie vers les tuiles B et C, quand on clique sur B ou C, une nouvelle tuile s’ouvre juste à côté de A et on ne voit qu’une seule de B ou C à la fois. Je me demande ce que donnerait une disposition en arbre où B et C se ramifient tous les deux depuis A et peuvent être vus simultanément

    • À ce stade, je pense qu’il faut élargir un peu le périmètre et regarder le domaine plus mature des hiérarchies de texte générales, plutôt que de chercher uniquement des implémentations d’UI en arbre pour LLM
      Il doit déjà exister beaucoup d’UI pour visualiser des dépôts de documents de type wikilink, sous forme de plugins Obsidian, d’extensions de navigateur, de plugins Vim/Emacs, etc. Personnellement, j’ai quelques principes que j’aimerais un jour imposer au monde à travers un livre : utiliser des index plutôt que des clés, faire en sorte qu’un ensemble ne contienne généralement que N éléments, avec au plus 10 environ, et référencer chaque élément soit par un index local 3, soit par un chemin complet obtenu en concaténant les index des ancêtres depuis la racine, comme 053. C’est un exemple d’approche « analytique », par opposition à l’approche de « synthèse » plus temporaire qui consiste simplement à visualiser une structure de wikilinks existant de façon contingente. Je préfère utiliser une structure conçue à l’avance, car cela permet une visualisation automatique. Par exemple, réutiliser les mêmes 3 ou 4 modèles de répertoires à 12 facteurs pour tous les projets SWE, ce qui peut aussi s’appliquer immédiatement à des projets de recherche menés avec de nombreuses requêtes LLM automatisées
    • D’accord. L’UI est déjà excellente, mais une structure arborescente serait géniale
    • Un peu comme un diagramme en toile d’araignée ?
  • J’aime beaucoup. Ça donne l’impression de flâner de lien Wikipedia en lien Wikipedia, mais avec cette différence essentielle qu’on conserve le contexte précédent à chaque nouvelle étape
    Pour moi, c’est nouveau et utile

    • Ça me rappelle les sessions rabbit hole dans lesquelles je me perdais autrefois sur https://wiki.c2.com/. Une interface qui combinerait le chat et une fenêtre de rabbit hole contextuel serait parfaite pour moi
  • Waouh, c’est vraiment superbe. En général, Show HN m’impressionne rarement, et je commente peu parce que je ne veux pas que mon détachement fasse obstacle à la personne qui publie son travail, mais de temps en temps il y a des choses vraiment remarquables comme celle-ci
    J’apprécie aussi énormément le fait qu’il n’y ait pas de suivi autre que Cloudflare Insights. Il y a un vieux lieu commun dans le secteur selon lequel plus les gens font des « suggestions » à propos d’une idée, plus ils aiment cette idée, et c’est vraiment vrai. C’est un projet très bien réalisé. Je me demande s’il y a des projets de monétisation ou d’open source

  • Les conversations à embranchements sont excellentes pour plusieurs raisons. J’avais déjà publié une démo de prototype : https://x.com/ajdegol/status/1788689011302682657
    Jake Collins a aussi annoncé qu’il allait open sourcer un plugin Obsidian avec beaucoup de fonctionnalités : https://x.com/JacobColling/status/1795462258258002255

    • J’ai l’impression que c’est la bonne direction. Si j’imagine utiliser ça pour créer des programmes, on pourrait faire glisser les fonctions générées, puis les relier visuellement
      Chaque fonction deviendrait son propre nœud, et en ajustant les entrées et les sorties par glisser-déposer, l’IA comprendrait magiquement les besoins
    • Moi aussi, je développe une application très similaire sur l’aspect embranchements. Il n’y a pas encore la visualisation à droite, mais je prévois de prendre en charge quelque chose de similaire ainsi qu’un graphe de type Git
      1: https://msty.app