Google publiera Gemini 4 Argon sans cyber-garde-fous pour les défenseurs de confiance

L’article ne peut pas être activé avec JavaScript. Vous pouvez également activer JavaScript dans votre navigateur et sur la nouvelle page.

Google affirme qu’il « diffusera Argon sans cyber-garde-fous » à des défenseurs de confiance et à ses propres équipes internes chez Google, afin qu’ils puissent utiliser ce qu’il appelle les « capacités de défense de cybersécurité à l’échelle de la frontière » du modèle. Ce sont les deux seuls groupes nommés par l’entreprise.

Google ne précise pas quelles restrictions sont levées ni ce que les garde-fous empêchent Gemini 4 Argon de faire pendant qu’ils sont activés.

L’accès passe par un programme avec son propre contrôle

Les défenseurs accèdent au modèle via le programme Fairwind, que Google décrit comme donnant « aux défenseurs hautement prioritaires (comme les gouvernements, les prestataires de soins de santé et les services de télécommunications) un accès rapide à des modèles avancés qui les aident à construire de meilleures défenses, avant l’arrivée de nouvelles menaces ». Les partenaires peuvent exécuter Argon seul ou dans CodeMender, l’agent de sécurité du code de Google.

Google donne la priorité à trois types de partenaires : les gouvernements et les cyberautorités nationales, les opérateurs d’infrastructures critiques dans les réseaux de santé, de télécommunications, d’énergie et financiers, ainsi que les plates-formes technologiques de base. Il ajoute qu’il accueille favorablement les candidatures de laboratoires universitaires travaillant sur l’analyse comparative défensive.

«Nous examinons tous les candidats pour nous assurer qu’ils ont fait leurs preuves en matière d’opérations et de recherche éthiques», indique la page du programme. Google affirme également qu’il effectue des vérifications des antécédents des organisations qui postulent, « pour vérifier l’historique de sécurité et analyser leur historique d’opérations éthiques », et que les partenaires ne peuvent pas partager, redistribuer ou vendre l’accès.

Google indique également ce que les partenaires peuvent faire avec le modèle. Ils « ne sont autorisés qu’à effectuer des tâches à double usage, notamment la simulation de menaces autorisées, l’ingénierie inverse et l’analyse de logiciels malveillants à des fins défensives et de recherche universitaire », et Google affirme que les tâches malveillantes telles que la création de logiciels malveillants ne sont pas autorisées.

Google est dans le processus d’accès préliminaire du gouvernement américain

« La libération en toute sécurité de capacités de pointe à ce niveau nécessite une approche progressive », déclare Google, qui exprime sa propre position: « Nous sommes activement engagés dans le processus volontaire du gouvernement américain pour l’accès aux modèles en pré-version, tandis que nous élargissons progressivement l’accès. » Les développeurs, les entreprises et les consommateurs viennent ensuite, et aucune date n’est fixée.

Le chiffre cyber publié pour Argon est CWE-bench v1, où Google affirme que le modèle « est à égalité en première place avec un score élevé de 68 % » pour la correction des vulnérabilités de sécurité. En septembre, la société a également décrit un test de sécurité effectué en mai, au cours duquel Gemini s’est piraté en trois sociétés réelles.

La version large conserve quatre ensembles de garanties

Pour un lancement plus large, Google répertorie quatre domaines qu’il dit renforcer : les refus de demandes cybernétiques et chimiques, biologiques, radiologiques et nucléaires dans le cadre de son cadre de sécurité aux frontières, la résilience contre l’injection indirecte rapide, la surveillance des désalignements et le renforcement des bacs à sable dans lesquels il s’entraîne et évalue.

Le travail de désalignement est la partie que Google décrit le plus en détail. Il dit qu’il surveille la chaîne de pensée d’Argon et ses actions et arrête l’exécution si nécessaire, et qu’il a utilisé un système similaire lors de ses entraînements tout en « prenant des précautions particulières pour ne pas réinjecter les résultats dans l’entraînement afin de ne pas risquer de façonner le raisonnement d’Argon pour échapper à notre surveillance ».

Rien de tout cela ne peut être inspecté de l’extérieur. Argon s’adresse à cette cohorte et à personne d’autre pour l’instant, donc le seul récit de ce que le modèle fait sans ses cyber-garde-fous est celui de Google.