2 points par GN⁺ 15 시간 전 | 1 commentaires | Partager sur WhatsApp
  • Kimi Work est un agent IA de bureau qui combine connexion aux fichiers locaux, automatisation du navigateur, exécution de code en arrière-plan et tâches planifiées pour réaliser un travail approfondi
  • Grâce à un moteur Cron intégré, il automatise les appels d’agents LLM ainsi que l’exécution de Python et de Shell chaque jour, chaque heure ou selon des conditions, et prend aussi en charge le travail nocturne avec Keep Computer Awake
  • WebBridge navigue entre plusieurs onglets, effectue des clics, du défilement et de l’extraction de données pour gérer de façon autonome la recherche web et les tâches à étapes multiples
  • Agent Swarm, qui orchestre plusieurs agents spécialisés, traite en parallèle des tâches complexes et convertit les résultats de recherche en PowerPoint ou Excel
  • Les données boursières des marchés chinois A-shares, de Hong Kong et des États-Unis sont fournies nativement, et avant toute modification ou écrasement de fichiers locaux ainsi qu’avant toute exécution de code, Ask before acting demande une approbation explicite

Automatisation du travail sur le bureau

  • Contrairement à l’application web Kimi, adaptée au chat rapide et aux requêtes simples, Kimi Work est un agent local capable d’effectuer un travail approfondi en montant des dossiers locaux
  • Le planificateur Cron intégré exécute les tâches répétitives en arrière-plan
    • Il peut appeler un agent LLM tôt le matin pour rédiger un briefing quotidien
    • Il peut traiter de grands ensembles de données avec un script Python à minuit
    • Il peut lancer des appels d’agents LLM ainsi que des exécutions Python et Shell chaque jour, chaque heure ou de manière conditionnelle
    • Pour une exécution nocturne, il est possible d’activer Keep Computer Awake dans les réglages
  • WebBridge reçoit un objectif via un prompt, puis explore plusieurs onglets et effectue de façon autonome des clics, du défilement et de l’extraction de données
    • Il peut consulter les dernières actualités d’un site web et les résumer, ou collecter des données boursières historiques et les enregistrer dans un fichier Excel local
  • Agent Swarm orchestre automatiquement plusieurs agents spécialisés pour décomposer et résoudre simultanément des problèmes à plusieurs niveaux
    • Il peut convertir les résultats de recherche en présentations PowerPoint professionnelles ou en feuilles Excel

Données financières et contrôle des fichiers locaux

  • Les données de marché des actions chinoises A-shares, de Hong Kong et des États-Unis sont intégrées par défaut, sans configuration API complexe
    • Il permet de charger des rapports de résultats en langage naturel, d’analyser des anomalies de marché et de comparer des feuilles de calcul
  • Le contrôle des fichiers locaux reste entre les mains de l’utilisateur
    • La protection Ask before acting demande une approbation explicite avant toute modification ou tout écrasement de fichiers dans les répertoires locaux, ainsi qu’avant toute exécution de code
    • Aucune de ces opérations n’est effectuée sans le consentement de l’utilisateur

1 commentaires

 
Avis sur Hacker News
  • Kimi Work est un agent local qui monte des dossiers locaux, navigue sur le web via WebBridge, et exécute du code Python ainsi que des tâches planifiées en arrière-plan
    Le design rappelle surtout Codex, mais l'objectif de Kimi semble moins être de créer dès le départ une UI d'agent futuriste que d'atteindre ce qui paraît être une parité fonctionnelle avec les grands labos
    Son principal atout compétitif est un modèle peu coûteux mais proche de l'état de l'art, auquel il suffit d'ajouter une couche applicative. Cette reproduction montre aussi très bien que la couche applicative elle-même peut devenir un produit générique
    • Tout le monde est déjà en train de reproduire la couche applicative. Il existe déjà plus de 30 clones de Claude Code, Codex a lui aussi copié Cowork, et Grok comme Gemini vont dans la même direction
    • En regardant Kimi Code, il est difficile de croire qu'il repose sur une base de code différente de Claude Code
    • Kimi a un avantage de coût, donc il lui suffit d'être suffisamment utilisable puis de copier. Cela pourrait marquer le début du déclin pour les labos américains
    • Dans ce cas, ne faudrait-il pas une base open source d'exécution d'agents capable d'agréger la demande ?
    • K3 devance Fable sur plusieurs benchmarks. Cela veut-il dire que Fable 5 n'est pas non plus un modèle de pointe, et qu'est-ce qu'on considère exactement comme un modèle de pointe ?
  • Dire que c'est un clone n'est pas faux, mais si on peut proposer la même chose pour un cinquième du prix, ce n'est plus un clone, c'est un produit qui peut réussir
    • Les vélos, les voitures, les appareils photo, les ponts, les barrages et les smartphones se ressemblent tous. L'essentiel de l'UX, c'est de rendre le produit utilisable et familier pour l'utilisateur
      Dire d'un GPU qui fonctionne comme un GPU qu'il ne s'agit que d'une copie, c'est montrer qu'on ne comprend pas l'ingénierie. La partie difficile n'est pas d'imaginer le concept général, mais de le faire réellement fonctionner ; on peut démonter un produit pour l'étudier, mais le concevoir et le fabriquer soi-même demande une expertise considérable
      Imaginer qu'un ordinateur personnel pourrait devenir plus rapide, plus petit et tenir dans une poche n'a rien de difficile. Moins on comprend son fonctionnement interne, plus on a tendance à surcommenter des éléments superficiels comme l'UI ou les coins arrondis
    • Je doute que Kimi soit réellement à un cinquième du prix. Sur Artificial Analysis, il est au même prix que GPT 5.6 Sol, avec des performances inférieures
    • Si le produit est incapable de répondre à une simple question sur les Ouïghours ou la place Tian'anmen, alors même s'il réussit commercialement, c'est un produit fragile
  • Kimi semble avoir copié Codex presque à l'identique, ce qui est particulièrement voyant. Il y avait déjà Conductor et plusieurs GUI avant Codex, mais cette fois on dirait que le code lui-même a été copié
    Même la notice sur la confidentialité est trompeuse. Elle dit qu'une approbation est demandée avant modification, écrasement de fichier ou exécution de code, mais elle ne précise pas que le droit de lecture des fichiers est accordé sans consentement et sans limitation
    • Il semble assez normal qu'un agent de code ait un accès en lecture aux fichiers. C'est un peu comme se plaindre que Dropbox ait un accès illimité aux fichiers
    • Je me demande si certains croient encore que les logiciels chinois espionnent forcément, alors que les logiciels américains n'espionneraient pas s'ils ne l'annoncent pas
      Il est plus raisonnable de partir du principe que tout logiciel collecte autant de données que possible dès qu'on le lui permet, quel que soit son pays d'origine. À moins d'exécuter du code open source compilé et audité soi-même, on ne peut rien garantir
    • Plus que semblable à Codex, cela ressemble à un site web de chat IA assez standard, avec une zone de chat IA sur le côté et des actions fréquentes en haut
    • Le partage mutuel entre entreprises d'IA, que ce soit via la collecte de données sur Internet ou la mobilité des employés entre sociétés, ressemble déjà presque à une tradition du secteur
    • Il me semble que Codex est sous Apache 2.0 : https://github.com/openai/codex
  • C'est un clone assez assumé, mais cela montre aussi à quel point il est facile de copier. OpenAI et Anthropic avaient un avantage de premier entrant, mais un avantage facile à obtenir peut aussi disparaître facilement
    • On peut pratiquement considérer qu'il n'y a plus de barrière à l'entrée
  • Le plus surprenant dans le boom de l'IA, c'est que personne n'a réussi à construire un vrai verrouillage fournisseur. Changer de service reste bien trop facile
  • J'aimerais voir des options comme un hébergement aux États-Unis ou une politique de non-rétention des données (NDR). Le prix et les performances me plaisent, mais je m'inquiète pour la souveraineté des données et les fuites de propriété intellectuelle vers des entreprises étrangères
    • Juste après la publication des poids de K3 le 27 juillet, il est probable que plusieurs fournisseurs américains hébergeront le modèle
      C'est distinct de Kimi Work lui-même, mais il devrait y avoir une option américaine pour accéder à K3 d'ici une semaine. Pour les fournisseurs qui hébergent K2.6, voir OpenRouter : https://openrouter.ai/moonshotai/kimi-k2.6
    • Une fois les poids de K3 publiés, il y a de fortes chances qu'il arrive aussi sur Amazon Bedrock
    • Je n'ai aucune intention d'envoyer des données à une entreprise chinoise. Au-delà des questions de propriété intellectuelle, même si elle cherche à atténuer son image chinoise comme ByteDance, il est très probable qu'elle subisse malgré tout des restrictions de service aux États-Unis
  • Ils ont recopié sans changer un seul mot la phrase de l'UI de Claude Cowork, « Let's take something off your plate », et l'ont même mise telle quelle sur le premier écran de l'image principale
  • Je me demande à quel moment on comprendra que la solution, plus que l'exécution en local, c'est l'auto-hébergement on-premise
  • Si la tendance passée se répète, on verra probablement dès la semaine prochaine un modèle distillé un peu moins bon que GPT 5.6 ou Mythos, mais légèrement devant Kimi K3
  • J'aimerais une intégration de l'UI Code en onglets comme dans Claude Code Desktop. Il n'y a aucune raison de séparer l'outil ou de ne proposer qu'une TUI dans le terminal
    En installant Kimi CLI, on peut déjà lancer une UI web locale : https://www.kimi.com/help/kimi-code/cli-getting-started
    kimi server run --foreground
    En revanche, le bouton pour arrêter le suivi des sous-agents ne fonctionne pas, certains interrupteurs des réglages ne peuvent pas être modifiés, et quand une conversation dépasse 600 tours, la saisie au clavier devient si lente qu'il y a plusieurs secondes de délai
    Personnellement, j'ai quand même préféré ZCode. Je compte aussi écrire un retour sur K3 : la base d'exécution des agents doit encore être peaufinée, mais le modèle lui-même est excellent