if ( !emtpy($headline_subheadline ) ) : ?>
Le flux de travail activé par défaut de Z.ai a envoyé des référentiels locaux entiers vers l’infrastructure cloud, soulevant de nouvelles inquiétudes sur la façon dont les outils d’IA gèrent le code source sensible.
endif; ?>
La société chinoise d’intelligence artificielle Z.ai a dû désactiver plusieurs fonctionnalités de son assistant de codage ZCode cette semaine après qu’un paramètre par défaut ait été détecté, envoyant les référentiels de code locaux des utilisateurs vers les serveurs Alibaba Cloud en Chine sans leur consentement, soulevant de nouvelles inquiétudes pour les entreprises quant à la manière dont les outils d’IA gèrent le code source sensible.
La société s’est excusée et a déclaré qu’elle avait « terminé les mesures correctives nécessaires », désactivant le flux de travail responsable de la génération et du téléchargement des instantanés du référentiel local dans son client ZCode. Il a supprimé la fonctionnalité de la dernière version et a ouvert sa base de code à l’examen public, a-t-il déclaré dans un article sur X.
Les résultats de la communauté ont révélé un transfert complet du référentiel
Le problème est apparu pour la première fois lors d’une enquête technique menée par un blogueur chinois indépendant, qui a décrit avoir découvert une utilisation anormale du disque et l’avoir retracée aux processus d’arrière-plan de ZCode.
« Chaque fois que vous êtes connecté, ZCode emballe silencieusement l’intégralité de votre espace de travail – historique complet .git, cache d’actifs LFS, reflogs et configurations globales des applications – le crypte et le télécharge directement sur Aliyun OSS », a écrit le blogueur chinois Ferstar dans un article de blog détaillant son enquête, selon une traduction automatique fournie.
Selon le blogueur, l’assistant de codage ZCode ne se contentait pas d’accéder aux fichiers actifs, mais capturait l’environnement de développement plus large, créant ainsi un pipeline allant des systèmes locaux au stockage dans le cloud.
Le blogueur a déclaré que les données avaient été téléchargées sur le stockage d’objets Alibaba Cloud, soulevant des inquiétudes quant à la manière dont les bases de code d’entreprise, y compris la logique propriétaire et les informations d’identification intégrées, pourraient être traitées une fois qu’elles ont quitté les environnements locaux.
Z.ai a reconnu le problème, remerciant les développeurs de la communauté de l’avoir identifié et de s’être engagés dans un processus continu de reporting et de réponse aux vulnérabilités.
Corrections, audits et assurances des fournisseurs
Dans le cadre de sa réponse, la société a déclaré avoir désactivé le mécanisme de téléchargement du référentiel, supprimé l’infrastructure de stockage cloud associée et mis en œuvre des modifications dans le client ZCode v3.14.0.
Z.ai a également demandé à l’Académie chinoise des technologies de l’information et des communications (CAICT) et au NSFOCUS de mener des évaluations de sécurité.
« NSFOCUS a confirmé que tous les objets de données du compartiment Alibaba Cloud OSS zcode-prod, ainsi que le compartiment lui-même, ont été supprimés », a ajouté Z.ai dans le message. « Le point d’entrée Repo Wiki et le workflow de génération associé ont été supprimés, et aucun chemin fonctionnel capable de déclencher la génération d’instantanés de référentiel local ou de transmettre des fichiers locaux en externe n’a été identifié. »
La société a également déclaré qu’aucune donnée de ce type n’était conservée et « n’avait jamais été utilisée pour la formation de modèles », répondant ainsi aux préoccupations concernant l’utilisation en aval du code téléchargé.
Les assistants IA brouillent les frontières des données d’entreprise
Dans le cas de Z.ai, les découvertes de Ferstar ont montré qu’un flux de travail activé par défaut pouvait regrouper et transmettre des référentiels entiers depuis des environnements locaux vers une infrastructure cloud sans action explicite de l’utilisateur, comportement que l’entreprise a ensuite abordé dans sa mise à jour corrective.
« Il ne s’agit pas vraiment d’un problème de modèle d’IA, c’est d’un problème d’architecture de sécurité à l’ancienne », a déclaré Cris Thomas, défenseur de la sécurité chez Semgrep. Si un assistant de codage peut « emballer l’intégralité de mon référentiel et l’envoyer dans un endroit que je n’ai pas explicitement approuvé », a-t-il déclaré, le problème réside dans la manière dont l’accès et les autorisations sont appliqués.
« Donner à une IA l’accès au code source propriétaire devrait nécessiter une divulgation claire de ce qui quitte la machine, où il va, combien de temps il est conservé et qui peut y accéder, avec les autorisations minimales activées par défaut, et non maximales », a-t-il déclaré.
Le risque s’étend au-delà des déploiements basés sur le cloud. Les systèmes exécutés localement peuvent toujours exposer des données sensibles s’ils bénéficient d’un accès étendu au système de fichiers et d’une connectivité réseau illimitée, a-t-il ajouté.
Katie Paxton-Fear, défenseure de la sécurité du personnel de Semgrep, a déclaré : « Étant donné la quantité de propriété intellectuelle contenue dans le code, il n’est pas surprenant que les gens s’inquiètent de son envoi à un fournisseur de cloud tiers », ajoutant que les organisations doivent contrôler plus rigoureusement les outils d’IA qu’elles déploient.
Des divulgations récentes d’OpenAI sur le désalignement des modèles et les cadres de reporting ont également souligné des cas de comportement inattendu du système, soulignant comment les systèmes d’IA peuvent fonctionner d’une manière qui n’est pas entièrement anticipée lors du déploiement.
InfoMonde



