- Après environ deux ans d’utilisation de Claude et ChatGPT, connecter opencode à un endpoint d’inférence personnel a procuré un sentiment de liberté plus fort que prévu
- Le fait que les données ne circulent qu’entre l’ordinateur portable et un endpoint possédé par soi-même renforce le sentiment de contrôle et de propriété
- Plutôt que de passer à une offre supérieure pour les forfaits personnels Claude ou ChatGPT, choix d’utiliser Kimi K3, lancé par Modal comme endpoint managé, pour des projets annexes
- Environ 5 minutes ont suffi pour configurer et lancer opencode avec son propre endpoint Modal
- L’expérience était épurée, comme lorsqu’on ouvre vim au lieu d’un grand éditeur sophistiqué, et donnait une impression de liberté, comme si l’on s’était détaché d’une connexion liée à un autre fournisseur
Ce qui a motivé le choix d’un endpoint personnel
- Aucun forfait Claude ou ChatGPT n’étant adapté à un compte personnel, recherche d’une autre option plutôt que de passer à une offre supérieure pour des projets annexes
- Modal, l’entreprise où travaille l’auteur, a lancé Kimi K3 sur ses endpoints managés, et ses performances étant réputées correctes, décision de l’essayer directement
- L’auteur n’ayant pas participé au développement de cette fonctionnalité, il ne l’avait pas utilisée auparavant
Ce que la connexion à opencode a changé dans l’expérience d’utilisation
- En environ 5 minutes, opencode a été connecté à son endpoint Modal et lancé
- Une architecture où les données circulent entre l’ordinateur portable et un endpoint possédé par soi-même renforce le sentiment de contrôle et de propriété
- L’écran de démarrage vide et simple d’opencode rappelait l’expérience d’ouvrir vim après avoir longtemps utilisé un grand éditeur
- Le sentiment de liberté, comme si la connexion qui le liait à un autre fournisseur avait été rompue, a été un changement inattendu
1 commentaires
Réactions sur Hacker News
Si Claude Code est populaire, c’est parce qu’il peut produire d’un coup des milliers de lignes de code, divers traitements d’exceptions de surface et des fonctionnalités entières à partir de demandes vagues comme « crée-moi un SaaS à un million de dollars »
Les petits modèles et les modèles open source sont plus faibles sur ce genre de tâche, mais en pratique le développement ne consiste pas à demander toute l’application d’un seul coup puis à s’arrêter là. Si on améliore de petites fonctions concrètes de manière itérative, comme dans le développement traditionnel, GLM fait aussi bien que Claude, voire mieux, et si on fournit clairement le contexte comme dans du rubber duck debugging, il produit généralement des résultats très propres
Même pour des méthodes déjà connues, ils permettent de les implémenter en environ un centième du temps d’un travail manuel, ce qui accélère l’exploration d’idées, et ils peuvent aussi écrire dès le départ des implémentations presque sans dépendances tierces au-delà de NumPy ou SciPy, ce qui améliore la clarté et les performances
J’avais détaillé pendant plusieurs jours les services et fonctionnalités à utiliser au stade de la planification, mais des fonctions non explicitement mentionnées dans les demandes pouvaient manquer, par exemple implémenter X sans inclure la modification ou la suppression. J’avais déjà une preuve de concept des fonctions clés, mais sans interface simple à utiliser ; grâce à Claude, j’ai pu créer rapidement une application sur mesure malgré un manque de temps. Seul, il m’aurait fallu plus d’un an, même pour un résultat moins abouti
Les performances de DeepSeek V4 Flash sont nettement meilleures que prévu. J’utilise surtout Claude Code basé sur Claude 5 Opus et Codex basé sur GPT-5.6 Sol, mais DS V4 Flash ne donne pas vraiment l’impression d’être très en retrait, et avec oh-my-pi ou pi de base, c’est franchement excellent
Les modèles de pointe sont bien meilleurs pour l’appel d’outils, ce qui les avantage dans les flux d’assistant, mais en optimisant l’environnement d’exécution, par exemple en réécrivant les outils pour qu’ils correspondent à la manière dont le modèle fait ses suppositions, DS V4 Flash fonctionne lui aussi très bien. Les petits modèles ont une latence avant le premier token et un débit en tokens par seconde bien meilleurs, donc ils restent compétitifs sur beaucoup de tâches, et cela rappelle Sonnet de la fin de l’an dernier, ce qui est impressionnant
Il peut prendre en photo des documents médicaux et les ajouter au calendrier, taguer et OCRiser des PDF pour les archiver, ainsi qu’effectuer des recherches web et consulter des données Google Maps. Il est aussi relié à Home Assistant et à un système open source de type Alexa, ce qui permet de parler à l’agent à la voix
C’est en pratique une publicité assez habile, mais justement sur une configuration qui m’intéressait, donc le contenu en lui-même est correct. Il manque malgré tout des indicateurs de coût pour savoir quel surcoût il faut accepter afin d’éviter d’envoyer directement ses conversations à la NSA
Claude et OpenAI sont réputés fortement subventionnés, donc je me demande si utiliser Kimi K3 via un endpoint privé coûterait plus cher ou moins cher
Cet article est une pub pour son propre produit. Même si l’auteur est actif depuis longtemps et a écrit honnêtement, un billet du style « j’ai utilisé mon produit et il était vraiment très bien » ne diffère pas vraiment de l’autopromotion
Je ne voulais pas augmenter mon abonnement Claude, et si cela ne m’avait pas intéressé, je n’aurais pas écrit ce billet. Ce qui m’a poussé à l’écrire, ce n’était pas « Modal est génial », mais la sensation décrite dans le texte. J’ai même envisagé de retirer le lien par crainte que cela ressemble à une pub, et le fait que l’entreprise où je travaille ait fait quelque chose de cool n’était qu’un avantage annexe
GLM 5.2 me semble meilleur qu’Opus et K3 aussi bon que Fable. J’espère voir K3 distillé à l’échelle de Qwen 3.6 27b ou Poolside S 2.1 pour obtenir un remplaçant local rapide de Composer 2.5
Quand on passe d’un gros modèle de pointe à un modèle agile comme Composer, cela donne parfois une sensation comparable à l’ouverture de vim à la place d’un éditeur tape-à-l’œil et lourd
Avec un modèle rapide, la boucle entre réflexion et questions-réponses est plus fluide, un peu comme quand on navigue rapidement entre les fichiers dans vim
J’aime l’interface presque vide de OpenCode. C’est propre, léger et passif, avec une sensation de vitesse différente des outils internet modernes, jolis mais lents
Cet article ressemble à une publicité pour Modal. Et si le matériel est seulement loué, on peut aussi se demander si on peut vraiment parler de sa propre infrastructure
Indépendamment du fait qu’il soit chinois ou non, il faut s’inquiéter du fait qu’en utilisant un modèle hébergé, on ne sait pas où partent les secrets commerciaux
J’ai aussi essayé des modèles locaux, mais sur un MPB M5 16 Go d’entrée de gamme, c’est lent, et je n’ai pas prévu de changer de portable dans l’immédiat