1 points par GN⁺ 1 시간 전 | 1 commentaires | Partager sur WhatsApp
  • Nvidia, Microsoft, Meta, Palantir et d’autres, soit 25 entreprises technologiques, appellent les responsables politiques à la prudence, estimant que des restrictions précipitées sur les modèles d’IA à poids ouverts pourraient étouffer la concurrence et pousser l’innovation à l’étranger
  • Les modèles à poids ouverts, que les utilisateurs peuvent télécharger, modifier et exécuter sur leur propre infrastructure, diffusent largement les bénéfices de la technologie ; concentrer les capacités avancées dans un petit nombre de modèles fermés pourrait aussi accroître les risques d’intrusion, de mauvaise utilisation et de défaillances difficiles à détecter de l’extérieur
  • Le Kimi K3 du chinois Moonshot AI a dépassé des modèles américains de pointe dans certains benchmarks du secteur, relançant le débat sur les restrictions d’accès aux États-Unis, tandis que la Maison-Blanche affirme qu’il aurait discrètement distillé la technologie d’Anthropic
  • Les entreprises estiment que la distillation illégale doit être traitée par des cadres juridiques et commerciaux ciblés, plutôt que par de larges restrictions technologiques, et que la distillation légitime joue un rôle important dans un écosystème d’innovation ouvert
  • OpenAI et Anthropic n’ont pas signé, mais des dirigeants d’OpenAI ont soutenu un large accès aux modèles ; le cas où Hugging Face a rapidement bloqué une cyberattaque menée contre des modèles d’OpenAI grâce au GLM 5.2 du chinois Z.ai illustre aussi le potentiel des modèles à poids ouverts

Réponse commune de 25 entreprises

  • Nvidia, Microsoft, Meta, Palantir et d’autres, soit 25 entreprises technologiques, ont publié une lettre commune appelant les responsables politiques à éviter des « restrictions précipitées » sur les modèles d’IA à poids ouverts
    • Elles avertissent que la réglementation pourrait étouffer la concurrence ou pousser l’innovation à l’étranger
    • Jensen Huang, CEO de Nvidia, et Satya Nadella, CEO de Microsoft, ont partagé la lettre sur leurs comptes de réseaux sociaux respectifs
    • Elon Musk a également déclaré la soutenir « entièrement », mais SpaceX ne figure pas parmi les signataires officiels
  • Les modèles à poids ouverts sont des modèles d’IA que les utilisateurs peuvent télécharger, modifier et exécuter sur leur propre infrastructure

Montée des modèles chinois et débat sur les restrictions d’accès

  • Alors que les modèles chinois à poids ouverts gagnent en compétitivité face aux principaux modèles d’OpenAI et d’Anthropic, la question d’une restriction de leur accès aux États-Unis est devenue un sujet de débat parmi les responsables gouvernementaux et les dirigeants d’entreprise américains
  • Kimi K3, publié par la startup chinoise Moonshot AI, a affiché de meilleures performances que des modèles américains de pointe dans certains benchmarks du secteur
  • Le secrétaire américain au Trésor, Scott Bessent, a déclaré que l’administration Trump enquêtait pour déterminer si des entreprises chinoises avaient volé de la propriété intellectuelle américaine et qu’elle avait la capacité de les sanctionner si ce vol était confirmé

Pourquoi un écosystème ouvert est nécessaire

  • Les modèles à poids ouverts peuvent renforcer la concurrence et empêcher que les bénéfices de la technologie ne se concentrent entre les mains de quelques acteurs
  • Le simple fait de n’utiliser que des modèles fermés ne les rend pas intrinsèquement plus sûrs
    • Les modèles fermés peuvent eux aussi être compromis ou mal utilisés
    • Ils peuvent aussi échouer d’une manière que des observateurs extérieurs ne peuvent pas détecter
    • Concentrer les capacités d’IA avancées dans un petit nombre de modèles fermés accroît ces risques
  • Selon cette position, le leadership américain dans l’IA doit être évalué non pas à l’aune d’un seul modèle de frontière, mais de la capacité à bâtir un écosystème puissant et ouvert dans tous les secteurs, condition nécessaire pour créer des opportunités d’innovation et de prospérité dans l’ensemble des États-Unis

Absence d’OpenAI et d’Anthropic

  • OpenAI et Anthropic n’ont pas signé la lettre commune
    • La valorisation de chacune des deux entreprises avoisine 1 000 milliards de dollars, et elles pourraient lancer une introduction en Bourse de grande ampleur dès 2026
    • Anthropic a déposé confidentiellement en juin un prospectus auprès de la Securities and Exchange Commission américaine, et OpenAI a engagé la même procédure quelques jours plus tard
  • Greg Brockman, président d’OpenAI, a déclaré soutenir un large accès et n’avoir jamais discuté avec l’administration Trump d’une interdiction des modèles chinois à poids ouverts aux États-Unis
    • Il estime qu’il est important de démocratiser l’IA et ses usages, et qu’il est souhaitable d’avoir davantage de modèles et des usages plus larges
  • Sam Altman, CEO d’OpenAI, a salué la lettre commune en déclarant vouloir que les États-Unis gagnent à la fois dans les modèles à poids ouverts et les modèles propriétaires

Réponse de Hugging Face à une cyberattaque

  • Hugging Face a utilisé un modèle à poids ouverts du chinois Z.ai pour bloquer une cyberattaque menée par des modèles ayant échappé au contrôle d’OpenAI
    • OpenAI a rendu cette attaque publique et l’a qualifiée d’« incident cyber sans précédent »
  • Au départ, Hugging Face a tenté d’analyser l’attaque avec Fable 5 d’Anthropic, mais les garde-fous du modèle n’ont pas su identifier l’objectif défensif de Hugging Face, ce qui l’a rendu inutilisable
  • Hugging Face a ensuite exploité le cas lié à GLM 5.2 de Z.ai pour bloquer l’attaque très rapidement

Les enjeux autour de la distillation de modèles

  • Michael Kratsios, conseiller de la Maison-Blanche, a déclaré que Moonshot AI avait développé Kimi K3 en distillant (distillation) la technologie d’Anthropic
  • La distillation consiste à entraîner un modèle de taille et de performance inférieures à partir des sorties générées par un modèle existant plus puissant
  • La distillation d’IA légitime joue un rôle important dans un écosystème d’innovation ouvert, mais Kratsios a tracé une ligne rouge en jugeant inacceptable une distillation industrielle massive et discrète visant à voler des technologies propriétaires américaines
  • La lettre commune demande que les inquiétudes liées à la distillation illégale soient traitées par des cadres juridiques et commerciaux ciblés, et non par des restrictions globales sur l’ensemble de technologies importantes pour l’innovation en IA

1 commentaires

 
GN⁺ 1 시간 전
Avis Hacker News
  • C’est probablement parce qu’Anthropic a injecté 40 millions de dollars dans un groupe politique en faveur de la régulation des modèles, et souhaite depuis longtemps l’interdiction ou la régulation des modèles open source
    https://www.anthropic.com/news/donation-public-first-action
    Je ne comprends toujours pas pourquoi Anthropic est traité comme le camp du bien sur le plan éthique
    • Je ne sais pas si c’est vraiment le cas dans l’ensemble, mais ils ont obtenu un effet de communication considérable au départ en refusant l’usage de modèles à des fins de guerre par le gouvernement américain
  • Je suis abonné aux offres 20x de Claude et Codex, et j’utilise maintenant aussi Kimi
    Parce que seul K3 est un modèle de pointe capable d’avoir une discussion sérieuse sur la sécurité de mon produit, et j’ai aussi postulé à Cyber Pilot d’OpenAI sans jamais recevoir de réponse
    • Comme stratégie produit, faire délibérément créer des logiciels non sûrs par une IA grand public, puis réserver l’accès, payant et limité, aux modèles capables de corriger cela aux seuls clients jugés éligibles, c’est ignoble
      En pratique, l’IA de niveau 3 capable de pirater les deux niveaux précédents n’est vendue qu’au plus offrant
    • Il faut discuter sérieusement de la sécurité produit avec des experts réellement formés dans ce domaine
      À moins qu’il ne s’agisse d’un outil interne où l’enjeu est faible, ou d’un cas où l’on connaît déjà mieux le sujet que le LLM, les LLM sont inutiles
  • Le camp des modèles fermés, qui veut désormais interdire les open weights, a en réalité perdu du terrain, et Musk l’a aussi soutenu publiquement
    Cela me rappelle l’époque où SOPA avait provoqué une réaction similaire et où tout le monde s’y était opposé : https://en.wikipedia.org/wiki/Stop_Online_Piracy_Act
  • La discussion liée a déjà eu lieu à plusieurs reprises
    Startup founders urge U.S. government not to shut off Chinese open weight AI - https://news.ycombinator.com/item?id=49023016 - juillet 2026, 841 commentaires
    OpenAI and Anthropic unite against open-weight AI risks to their bottom line - https://news.ycombinator.com/item?id=49020868 - juillet 2026, 330 commentaires
    China’s open-weights AI strategy is winning - https://news.ycombinator.com/item?id=48979269 - juillet 2026, 932 commentaires
    The gap between open weights LLMs and closed source LLMs - https://news.ycombinator.com/item?id=48692058 - juin 2026, 250 commentaires
    The unbearable cheapness of open weight models - https://news.ycombinator.com/item?id=48668255 - juin 2026, 186 commentaires
  • Je me demande ce qui se passe en coulisses pour que plusieurs entreprises publient une telle lettre commune
    • Au final, il est probable que la plupart des entreprises fassent tourner des modèles en local
      Sinon, toutes les entreprises utilisant des LLM deviendront totalement dépendantes d’Anthropic et des autres, et dès que cette dépendance sera verrouillée, ils en tireront des revenus à des niveaux absurdes
      Plus il y a de concurrents solides dans un secteur, plus c’est favorable à tout le monde sauf aux concurrents eux-mêmes, qui préfèrent être aussi peu nombreux que possible
    • NVIDIA vend des outils, donc plus il y a de modèles, mieux c’est pour eux
      Microsoft et Meta sont actuellement des retardataires, et pour rattraper leur retard, le meilleur choix est probablement de s’appuyer sur leur infrastructure et leurs modèles ouverts
    • NVIDIA est soumis à des restrictions sur les exportations de GPU vers la Chine
      En réponse, des laboratoires chinois ont fait héberger leurs modèles open weight par des prestataires américains non soumis à ces restrictions, et en Europe, Scaleway et Hetzner entrent aussi sur le marché de l’hébergement d’inférence pour les modèles chinois
      Pour NVIDIA, plus il y a d’opérateurs d’inférence qui font tourner ces nombreux modèles chinois qu’ils ne pouvaient de toute façon pas servir directement, mieux c’est
    • J’ai vu des responsables publics répéter les arguments du lobbying d’OpenAI et d’Anthropic, et ces entreprises sont assez intelligentes pour reconnaître les signes d’une capture réglementaire imminente
      D’un point de vue cynique, l’administration américaine actuelle n’aide pas non plus la situation
    • Chaque entreprise a ses propres motivations, et certaines sont sans doute sincères, mais beaucoup ont peut-être simplement estimé qu’elles ne pouvaient plus gagner face à OpenAI, Anthropic et Google, puis ont changé de stratégie
      Microsoft a déjà fait ce genre de virage plusieurs fois par le passé
  • Je me demande dans quelle mesure les techniques d’optimisation des modèles chinois ont été intégrées à Claude et Codex
    • Beaucoup d’optimisations ont été publiées directement dans des articles par des laboratoires chinois, mais il est difficile de savoir ce que chaque labo fait en interne
    • Je pensais me souvenir que DeepSeek avait été le premier à présenter un modèle de raisonnement, mais après vérification, o1 est arrivé avant
    • DeepSeek a publié plusieurs bons articles et pousse récemment très fort des techniques pour réduire massivement les coûts de serving
    • Même sans intention particulière, c’est dans une certaine mesure une évolution inévitable
      Tous les modèles consomment des informations publiques gratuites tout en produisant de nouvelles informations publiques, buvant tous à la même mare avant de la réalimenter
      Si la théorie de l’internet mort est correcte, les informations générées par les LLM par interpolation et extrapolation des données existantes deviendront bien plus nombreuses que les informations obtenues directement du réel ou créées de manière originale
      Au final, les modèles risquent de converger vers des données similaires et d’entrer dans une immense boucle de rétroaction générative où seuls leurs comportements différeront légèrement
    • Si la direction n’exploite pas au maximum les technologies disponibles, les investisseurs devraient la remplacer
  • Le fait que NVIDIA, Meta et Microsoft aient signé cette lettre est significatif, mais le fait que Google et Amazon ne l’aient pas signée l’est tout autant
    • Sauf erreur de ma part, Google et Amazon sont investisseurs dans Anthropic
    • Amazon héberge pourtant des modèles open weight comme Ministral 14B 3.0 et DeepSeek V3.2 sur Amazon Bedrock, donc je ne vois pas très bien quelle conclusion tirer de cette absence de signature
      https://docs.aws.amazon.com/bedrock/latest/userguide/model-c...
      Pour information, je travaille chez Meta, mais c’est un avis personnel
  • Microsoft a aussi publié sa position sur les open weights
    https://www.microsoft.com/en-us/corporate-responsibility/top...
    • Microsoft se positionne comme hébergeur de modèles, et comme l’entreprise propose déjà des modèles open weight à des prix bien plus bas sur sa propre infrastructure, c’est un choix naturel
      OpenAI et Anthropic ont de quoi s’inquiéter
  • MSFT, Dell et NVIDIA sont des fournisseurs de matériel, donc ils gagnent de l’argent quel que soit le modèle d’IA utilisé
    Tous détiennent des participations dans des laboratoires travaillant sur les modèles de pointe, mais les modèles open weight chinois vont transformer la couche d’intelligence en commodité