Tech

Le Trésor menace de sanctions après que la Maison-Blanche a accusé Moonshot d'avoir distillé le Fable d'Anthropic

TechCrunchil y a 1 h
Une salle de serveurs représentant une infrastructure informatique d'IA à grande échelle
Une salle de serveurs représentant une infrastructure informatique d'IA à grande échellePhoto: panumas nikhomkhai / Pexels

Un différend entre Washington et un laboratoire chinois d'intelligence artificielle s'est intensifié cette semaine après que le département du Trésor américain a menacé de sanctions concernant des allégations selon lesquelles l'entreprise chinoise Moonshot aurait distillé le modèle Fable d'Anthropic sans autorisation. La Maison-Blanche a publiquement soutenu cette accusation, et l'épisode a intensifié un débat déjà tendu à Washington sur la manière dont le gouvernement américain devrait répondre aux capacités croissantes des modèles d'IA chinois à poids ouverts.

La distillation de modèle est une technique bien établie dans le développement de l'IA, dans laquelle un modèle plus petit et moins coûteux est entraîné à imiter le comportement d'un modèle plus grand et plus performant, souvent en apprenant à partir des sorties de ce dernier. La technique elle-même n'est pas intrinsèquement problématique et est couramment utilisée dans l'ensemble du secteur de l'IA, y compris par des laboratoires entraînant leurs propres petits modèles à partir de leurs propres grands modèles. Le différend en question porte sur l'allégation de la Maison-Blanche selon laquelle Moonshot aurait utilisé les sorties du modèle Fable d'Anthropic, un système propriétaire, sans autorisation pour entraîner ou améliorer ses propres modèles.

Anthropic n'a pas détaillé publiquement les preuves spécifiques derrière cette allégation, et Moonshot n'a pas publié de réponse publique directement évoquée dans l'article de TechCrunch. Les accusations de distillation de ce type sont notoirement difficiles à prouver de manière définitive de l'extérieur, car un modèle entraîné en partie sur les sorties d'un autre modèle peut présenter des similitudes comportementales sans laisser d'empreinte technique claire ressemblant aux preuves habituelles de copie, contrairement à du code source copié ou des données d'entraînement dupliquées.

La menace de sanctions du département du Trésor représente une escalade au-delà du type de différend qui serait normalement traité par des canaux juridiques d'entreprise ou un engagement diplomatique. Les sanctions sont un outil que le gouvernement américain applique de plus en plus aux entreprises technologiques chinoises ces dernières années, le plus souvent autour des exportations de semi-conducteurs et, plus récemment, autour du développement de modèles d'IA, reflétant la conviction de Washington selon laquelle les capacités avancées en IA ont des implications directes pour la sécurité nationale.

L'épisode survient dans le cadre d'un débat plus large et permanent à Washington sur la montée rapide des modèles d'IA chinois à poids ouverts, des systèmes dont les paramètres sous-jacents sont publiés publiquement et peuvent être téléchargés, modifiés et déployés par des développeurs partout dans le monde. Des laboratoires chinois, dont Moonshot, ont publié une série de modèles à poids ouverts au cours des deux dernières années qui ont obtenu de solides résultats de référence et une adoption rapide par les développeurs, bousculant les hypothèses à Washington sur le pays qui détient l'avance dans le développement de l'IA de pointe.

Certains décideurs politiques américains considèrent la prolifération de modèles chinois à poids ouverts performants comme une préoccupation stratégique, arguant que l'adoption mondiale généralisée de systèmes d'IA fabriqués en Chine pourrait étendre l'influence technologique de Pékin même dans des pays n'ayant aucune relation commerciale directe avec la Chine, puisqu'un modèle à poids ouverts peut être téléchargé une fois et exécuté n'importe où. D'autres, dans ce débat politique, estiment que les modèles à poids ouverts, quel que soit leur pays d'origine, profitent généralement au développement mondial de l'IA en rendant des systèmes performants plus largement accessibles et auditables.

L'allégation de distillation ajoute une nouvelle dimension à ce débat : plutôt qu'une préoccupation quant à la capacité des laboratoires chinois à construire des modèles indépendamment compétitifs, elle soulève la question de savoir si des laboratoires chinois pourraient utiliser les sorties d'entreprises américaines d'IA de premier plan comme données d'entraînement, une pratique qui, si elle était confirmée, compliquerait l'argument selon lequel les modèles chinois à poids ouverts représentent une réussite technique purement indépendante.

Pour Anthropic, cet épisode place l'entreprise au centre d'un différend aux enjeux politiques importants, testant les mécanismes réellement disponibles pour les entreprises américaines d'IA afin de répondre aux allégations d'utilisation non autorisée des sorties de leurs modèles par des concurrents étrangers, un scénario que les cadres juridiques n'ont pas encore pleinement traité alors même qu'il est devenu une préoccupation de plus en plus courante dans le secteur.

Que la menace de sanctions se traduise par une action concrète du Trésor dépendra probablement d'une enquête plus approfondie, ainsi que du calcul diplomatique et commercial plus large entre Washington et Pékin à un moment où la politique en matière d'IA est devenue étroitement liée à la relation commerciale et technologique plus large entre les États-Unis et la Chine. Pour l'instant, cette affaire constitue l'un des exemples les plus directs à ce jour d'un différend sur la distillation atteignant le niveau d'une menace formelle de sanctions du gouvernement américain plutôt que de rester un désaccord commercial privé.

Cet article est un résumé éditorial assisté par IA basé sur TechCrunch. L'image est une photo d'archive de panumas nikhomkhai sur Pexels.

À lire ensuite

Un équipement d'examen ophtalmologique en milieu clinique
Plus dans Tech

La puce de restauration de la vision de Science Corporation obtient l'approbation de l'UE

Science Corporation, la startup biotech fondée par l'ancien président de Neuralink Max Hodak, a obtenu l'approbation réglementaire européenne pour un implant rétinien conçu pour restaurer une vision partielle chez les personnes rendues aveugles par la dégénérescence maculaire liée à l'âge. Cette approbation marque une étape importante pour une entreprise qui cherche encore à prouver la viabilité économique de la neurotechnologie implantable.

TechCrunch
Des équations mathématiques abstraites écrites sur un tableau noir
Tech

Qu'est-ce que la conjecture jacobienne, et pourquoi une conversation de Tao avec ChatGPT à ce sujet est devenue virale

Une conversation ChatGPT partagée, dans laquelle le mathématicien Terence Tao explore un possible contre-exemple à la conjecture jacobienne vieille de plusieurs décennies, a largement circulé parmi les développeurs et chercheurs. Voici ce que dit réellement cette conjecture, et pourquoi utiliser un chatbot d'IA comme caisse de résonance mathématique devient de plus en plus courant chez les mathématiciens en activité.

Hacker Newsil y a 1 h