>

Alerte autour de Kimi : des chercheurs contournent les protections de deux modèles chinois d’IA

30 septembre 2026 - 10:19

Le groupe chinois Moonshot AI a ouvert une enquête interne après que des spécialistes de la cybersécurité sont parvenus à contourner les protections de deux modèles Kimi et à obtenir des réponses concernant les armes biologiques et les assassinats. Les tests ne démontrent pas que ces indications seraient réellement efficaces, mais ils mettent en lumière un problème grandissant : les capacités des intelligences artificielles progressent rapidement tandis que leurs dispositifs de sécurité restent susceptibles d’être contournés.

L’alerte concerne Kimi K2.6 et K3 Swarm, deux modèles développés par Moonshot AI, l’un des acteurs de la montée en puissance de l’intelligence artificielle chinoise. Des chercheurs de Mindgard, une société spécialisée dans les tests de sécurité des systèmes d’IA, ont découvert en juillet que les deux modèles pouvaient être amenés à ignorer certaines restrictions destinées à empêcher la production de contenus dangereux.

Les chercheurs ont utilisé des techniques de jailbreaking, qui consistent à élaborer des séries d’instructions destinées à pousser un modèle à contourner ses propres garde-fous. Une fois ces protections franchies, les systèmes ont répondu à des demandes portant notamment sur les armes biologiques et la commission d’assassinats, alors qu’ils auraient dû refuser d’aborder ces sujets.

Une faille de sécurité, pas une arme éprouvée

La portée de l’expérience doit toutefois être précisément délimitée. Mindgard n’a pas démontré que les informations produites par Kimi permettraient effectivement de fabriquer une arme biologique, ni qu’elles aient été utilisées à cette fin. Le problème mis en évidence est celui de garde-fous qui peuvent être contournés par des utilisateurs suffisamment déterminés.

L’inquiétude est renforcée par les nouvelles capacités des agents d’intelligence artificielle. Les chercheurs estiment qu’un Kimi K2.6 correctement jailbreaké pourrait également exécuter du code et accéder à internet à partir des ressources informatiques mises à sa disposition. Le risque potentiel ne concernerait alors plus seulement la production d’informations sensibles, mais également la capacité d’un système compromis à agir dans un environnement numérique.

Mindgard a informé Moonshot de la vulnérabilité à la fin du mois de juillet avant de rendre ses conclusions publiques en septembre, tout en conservant confidentiels les éléments techniques permettant de reproduire précisément le contournement. Moonshot mène désormais une révision interne et échange avec les chercheurs.

Moonshot examine ses garde-fous

Le développeur chinois affirme que ses évaluations internes montrent que Kimi refuse normalement une proportion élevée de requêtes dangereuses. L’entreprise reconnaît néanmoins l’utilité des évaluations indépendantes pour améliorer la sécurité de ses modèles.

L’affaire intervient au moment où Moonshot s’impose comme l’un des acteurs les plus surveillés de la course chinoise à l’intelligence artificielle, face notamment à Alibaba, DeepSeek, Baidu ou Tencent. Cette compétition ne porte plus uniquement sur la qualité des réponses produites : les nouveaux systèmes sont progressivement capables d’utiliser des outils, d’exécuter du code et d’accomplir des tâches complexes avec une autonomie croissante.

Un risque qui ne concerne pas seulement la Chine

L’incident ne constitue pas une spécificité chinoise. Des entreprises américaines ont elles aussi signalé des tentatives d’utilisation abusive de leurs modèles et identifié des comportements problématiques lors de tests de sécurité. Anthropic a notamment détecté des tentatives visant à exploiter l’intelligence artificielle dans des activités susceptibles de contribuer au développement d’armes biologiques.

Les travaux récents sur les modèles américains comme chinois dessinent ainsi une préoccupation commune. À mesure que les agents deviennent capables d’interagir avec des services extérieurs, d’écrire du code ou de coordonner plusieurs tâches sans intervention humaine constante, la question n’est plus seulement de savoir ce qu’une IA peut dire, mais ce qu’elle pourrait éventuellement être amenée à faire.

La course entre puissance et sécurité

Le cas Kimi illustre finalement l’un des paradoxes centraux de la course mondiale à l’intelligence artificielle. Les laboratoires cherchent à accroître rapidement les capacités de leurs modèles tout en devant construire des protections capables de résister à des utilisateurs qui tentent délibérément de les contourner.

Les chercheurs en sécurité jouent précisément ce rôle : trouver les failles avant qu’elles ne soient exploitées à des fins malveillantes. Mais plus les modèles gagnent en autonomie, plus les conséquences potentielles d’une protection défaillante deviennent importantes.

L’expérience menée sur Kimi ne prouve donc pas qu’une intelligence artificielle soit capable de fabriquer elle-même une arme biologique. Elle met en évidence une réalité plus concrète : les limites imposées par les développeurs à leurs propres systèmes peuvent encore céder lorsqu’elles sont soumises à des attaques suffisamment élaborées.

Partager l'article

Partagez vos idées

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *