1 points par GN⁺ 2 시간 전 | 1 commentaires | Partager sur WhatsApp
  • Après environ deux ans d’utilisation de Claude et ChatGPT, connecter opencode à un endpoint d’inférence personnel a procuré un sentiment de liberté plus fort que prévu
  • Le fait que les données ne circulent qu’entre l’ordinateur portable et un endpoint possédé par soi-même renforce le sentiment de contrôle et de propriété
  • Plutôt que de passer à une offre supérieure pour les forfaits personnels Claude ou ChatGPT, choix d’utiliser Kimi K3, lancé par Modal comme endpoint managé, pour des projets annexes
  • Environ 5 minutes ont suffi pour configurer et lancer opencode avec son propre endpoint Modal
  • L’expérience était épurée, comme lorsqu’on ouvre vim au lieu d’un grand éditeur sophistiqué, et donnait une impression de liberté, comme si l’on s’était détaché d’une connexion liée à un autre fournisseur

Ce qui a motivé le choix d’un endpoint personnel

  • Aucun forfait Claude ou ChatGPT n’étant adapté à un compte personnel, recherche d’une autre option plutôt que de passer à une offre supérieure pour des projets annexes
  • Modal, l’entreprise où travaille l’auteur, a lancé Kimi K3 sur ses endpoints managés, et ses performances étant réputées correctes, décision de l’essayer directement
    • L’auteur n’ayant pas participé au développement de cette fonctionnalité, il ne l’avait pas utilisée auparavant

Ce que la connexion à opencode a changé dans l’expérience d’utilisation

  • En environ 5 minutes, opencode a été connecté à son endpoint Modal et lancé
  • Une architecture où les données circulent entre l’ordinateur portable et un endpoint possédé par soi-même renforce le sentiment de contrôle et de propriété
  • L’écran de démarrage vide et simple d’opencode rappelait l’expérience d’ouvrir vim après avoir longtemps utilisé un grand éditeur
  • Le sentiment de liberté, comme si la connexion qui le liait à un autre fournisseur avait été rompue, a été un changement inattendu

1 commentaires

 
GN⁺ 2 시간 전
Réactions sur Hacker News
  • Si Claude Code est populaire, c’est parce qu’il peut produire d’un coup des milliers de lignes de code, divers traitements d’exceptions de surface et des fonctionnalités entières à partir de demandes vagues comme « crée-moi un SaaS à un million de dollars »
    Les petits modèles et les modèles open source sont plus faibles sur ce genre de tâche, mais en pratique le développement ne consiste pas à demander toute l’application d’un seul coup puis à s’arrêter là. Si on améliore de petites fonctions concrètes de manière itérative, comme dans le développement traditionnel, GLM fait aussi bien que Claude, voire mieux, et si on fournit clairement le contexte comme dans du rubber duck debugging, il produit généralement des résultats très propres

    • Personnellement, DeepSeek v4 Flash m’a paru aussi utile qu’Opus. Pas besoin d’une simple démo technique ponctuelle : si on a la compréhension technique nécessaire pour demander précisément les changements voulus avec la bonne terminologie, cela suffit largement, et même après avoir crédité OpenRouter, il a fallu du temps avant d’atteindre 1 dollar de dépenses
    • Les modèles de pointe comme Opus 5 excellent aussi pour combiner des éléments issus de plusieurs disciplines et produire, à partir de demandes ambiguës et spéculatives, parfois jusqu’à des résultats de recherche nouveaux d’un niveau publiable
      Même pour des méthodes déjà connues, ils permettent de les implémenter en environ un centième du temps d’un travail manuel, ce qui accélère l’exploration d’idées, et ils peuvent aussi écrire dès le départ des implémentations presque sans dépendances tierces au-delà de NumPy ou SciPy, ce qui améliore la clarté et les performances
    • Ces outils abaissent fortement la barrière d’entrée pour les non-ingénieurs logiciel. En tant que data scientist dans l’environnement, j’ai peu d’expérience en front-end, mais j’ai tout de même terminé en quelques semaines avec Claude une application Android pour aider ma partenaire à gérer ses prises de parole à cheval, actuellement en test
      J’avais détaillé pendant plusieurs jours les services et fonctionnalités à utiliser au stade de la planification, mais des fonctions non explicitement mentionnées dans les demandes pouvaient manquer, par exemple implémenter X sans inclure la modification ou la suppression. J’avais déjà une preuve de concept des fonctions clés, mais sans interface simple à utiliser ; grâce à Claude, j’ai pu créer rapidement une application sur mesure malgré un manque de temps. Seul, il m’aurait fallu plus d’un an, même pour un résultat moins abouti
    • À la demande absurde « crée-moi un remplaçant de Microsoft Word », ChatGPT a décrit des décennies de gestion de cas particuliers, de corrections de bugs, de fonctionnalités rares et de procédures métier, puis a redemandé si c’était vraiment ce que je voulais. Claude, lui, s’est mis au travail immédiatement pour réellement essayer de le faire, ce qui m’a surpris
    • Si les modèles open source deviennent eux aussi capables de créer une application entière d’un seul coup, j’ai l’impression que tout le monde oubliera vite la « façon actuelle de développer des logiciels »
  • Les performances de DeepSeek V4 Flash sont nettement meilleures que prévu. J’utilise surtout Claude Code basé sur Claude 5 Opus et Codex basé sur GPT-5.6 Sol, mais DS V4 Flash ne donne pas vraiment l’impression d’être très en retrait, et avec oh-my-pi ou pi de base, c’est franchement excellent
    Les modèles de pointe sont bien meilleurs pour l’appel d’outils, ce qui les avantage dans les flux d’assistant, mais en optimisant l’environnement d’exécution, par exemple en réécrivant les outils pour qu’ils correspondent à la manière dont le modèle fait ses suppositions, DS V4 Flash fonctionne lui aussi très bien. Les petits modèles ont une latence avant le premier token et un débit en tokens par seconde bien meilleurs, donc ils restent compétitifs sur beaucoup de tâches, et cela rappelle Sonnet de la fin de l’an dernier, ce qui est impressionnant

    • J’ai moi-même construit ce week-end un système comme OpenClaw pour utiliser DeepSeek v4 Flash et Qwen comme assistants basés sur Matrix, pour un coût d’environ 2 dollars par mois. Le fait de pouvoir contrôler entièrement les outils accessibles le rend plus utile que ChatGPT
      Il peut prendre en photo des documents médicaux et les ajouter au calendrier, taguer et OCRiser des PDF pour les archiver, ainsi qu’effectuer des recherches web et consulter des données Google Maps. Il est aussi relié à Home Assistant et à un système open source de type Alexa, ce qui permet de parler à l’agent à la voix
  • C’est en pratique une publicité assez habile, mais justement sur une configuration qui m’intéressait, donc le contenu en lui-même est correct. Il manque malgré tout des indicateurs de coût pour savoir quel surcoût il faut accepter afin d’éviter d’envoyer directement ses conversations à la NSA
    Claude et OpenAI sont réputés fortement subventionnés, donc je me demande si utiliser Kimi K3 via un endpoint privé coûterait plus cher ou moins cher

    • Si vous voulez savoir combien d’agents de codeurs « gratuits » on peut utiliser pour un certain coût, il y a l’enquête de Fable : https://claude.ai/public/artifacts/2c9a5001-0b7e-4944-beb1-9...
    • Sur OpenRouter, chaque page de modèle affiche des icônes indiquant le prix par fournisseur et si les données sont conservées ou non. On peut aussi définir des règles de protection à l’échelle du compte pour bloquer le routage vers des fournisseurs non ZDR
  • Cet article est une pub pour son propre produit. Même si l’auteur est actif depuis longtemps et a écrit honnêtement, un billet du style « j’ai utilisé mon produit et il était vraiment très bien » ne diffère pas vraiment de l’autopromotion

    • Le billet a déjà été signalé donc cela ne changera probablement pas grand-chose, mais il n’y avait absolument aucune intention publicitaire. Ce n’était ni demandé par quelqu’un ni planifié à l’avance : j’ai simplement enfin eu le temps de construire quelque chose chez moi, j’avais besoin d’un LLM pour m’aider à développer et d’un autre à utiliser dans mon produit, alors j’ai testé l’endpoint Modal auquel je pensais depuis un moment
      Je ne voulais pas augmenter mon abonnement Claude, et si cela ne m’avait pas intéressé, je n’aurais pas écrit ce billet. Ce qui m’a poussé à l’écrire, ce n’était pas « Modal est génial », mais la sensation décrite dans le texte. J’ai même envisagé de retirer le lien par crainte que cela ressemble à une pub, et le fait que l’entreprise où je travaille ait fait quelque chose de cool n’était qu’un avantage annexe
    • Sur HN, des billets de blog qui font la promo d’Anthropic arrivent en permanence ; il est difficile de comprendre selon quel critère ceux-là ne seraient pas des pubs alors que celui-ci en serait une
    • Si le produit est vraiment bon, il n’y a aucune raison qu’un développeur ne puisse pas en faire directement la promotion
    • Pour conserver le billet, il vaudrait mieux ajouter Show HN au début du titre
    • Beaucoup de billets sur HN sont de l’autopromotion, et ce qui est intéressant ou non se décide déjà dans le processus qui les fait monter en une. Une autopromotion intéressante reste intéressante
  • GLM 5.2 me semble meilleur qu’Opus et K3 aussi bon que Fable. J’espère voir K3 distillé à l’échelle de Qwen 3.6 27b ou Poolside S 2.1 pour obtenir un remplaçant local rapide de Composer 2.5

  • Quand on passe d’un gros modèle de pointe à un modèle agile comme Composer, cela donne parfois une sensation comparable à l’ouverture de vim à la place d’un éditeur tape-à-l’œil et lourd
    Avec un modèle rapide, la boucle entre réflexion et questions-réponses est plus fluide, un peu comme quand on navigue rapidement entre les fichiers dans vim

  • J’aime l’interface presque vide de OpenCode. C’est propre, léger et passif, avec une sensation de vitesse différente des outils internet modernes, jolis mais lents

    • Pi Agent paraît encore plus léger, donc cela vaut le coup d’essayer
  • Cet article ressemble à une publicité pour Modal. Et si le matériel est seulement loué, on peut aussi se demander si on peut vraiment parler de sa propre infrastructure

  • Indépendamment du fait qu’il soit chinois ou non, il faut s’inquiéter du fait qu’en utilisant un modèle hébergé, on ne sait pas où partent les secrets commerciaux
    J’ai aussi essayé des modèles locaux, mais sur un MPB M5 16 Go d’entrée de gamme, c’est lent, et je n’ai pas prévu de changer de portable dans l’immédiat