Google dévoile Gemini 4 Argon, déployé d'abord auprès d'un cercle restreint de cyberdéfenseurs, sans date d'ouverture au public
Présenté par Google comme son nouveau modèle de pointe, Gemini 4 Argon a été annoncé le 30 septembre à 21 heures, heure de Casablanca. Fermé au public, le modèle est d'abord déployé auprès d'un ensemble de « cyberdéfenseurs de confiance », par l'intermédiaire de Fairwind, le programme de Google destiné aux acteurs de la cyberdéfense ; le billet évoque aussi une première cohorte de cyberdéfenseurs et de testeurs de confiance, dont les évaluations doivent aider Google à renforcer ses systèmes avant l'ouverture. L'entreprise dit réserver à ces défenseurs, comme à ses propres équipes, une version sans garde-fous cyber, afin qu'ils en exploitent toutes les capacités de défense. Selon la page du programme, les organisations admises ne peuvent confier le modèle qu'à leurs équipes internes de cybersécurité, de réponse aux incidents ou de tests d'intrusion, et doivent tracer qui s'en sert. Google dit vouloir l'ouvrir « dès que possible » aux développeurs, aux entreprises et au grand public, après avoir recueilli les retours de ses premiers testeurs, en commençant par les clients payants de son API et les abonnés Google AI Ultra. Pendant la période d'introduction, dont le billet ne donne pas la durée, le million de jetons coûtera 2 dollars en entrée et 10 dollars en sortie, avant de passer à 4 et 20 dollars. Dans le tableau publié par Google face à GPT-6 Astra, Claude Fable 5.1 et Claude Opus 5.5, Argon arrive en tête sur 13 des 19 lignes, dont DeepSWE v1.1, un banc d'ingénierie logicielle sur des tâches longues, avec 77,9 %. Il est à égalité avec Astra sur CWE-bench v1, à 68 % chacun, et reste derrière au moins un concurrent sur les cinq autres lignes, dont FrontierSWE v2 et Terminal-bench 4.0 ; le classement public de CWE-bench place aussi au premier rang Grok 4.7, absent de ce tableau. Selon la note méthodologique de Google, ses scores sur DeepSWE v1.1 et Terminal-bench 4.0 ont été calculés par Google lui-même, alors que ceux des concurrents sur ces deux bancs viennent de classements publics ou, pour Fable 5.1 et Opus 5.5 sur DeepSWE, de leurs fiches système. Google ajoute qu'Argon a découvert, dans des logiciels de santé utilisés par des hôpitaux du monde entier, une faille critique exposant des données personnelles sensibles, que les modèles de pointe précédents avaient manquée ; le billet ne nomme ni les logiciels ni la faille. Il présente cette démonstration, sans dire qui l'a réalisée, dans le passage consacré à Wiz, qui utilise déjà le modèle dans son programme gratuit Scan for Good ; Wiz appartient à Google, comme le rappelle SiliconANGLE.
Pourquoi c'est important
Un acheteur qui compare les modèles dispose déjà de mesures indépendantes, parues le 30 septembre. Artificial Analysis attribue 53 points à Argon sur son indice synthétique, autant que GPT-6 Astra une fois arrondi, et 58 à Claude Opus 5.5, d'après The Decoder qui relaie ce classement ; Vals AI le classe au contraire premier de son propre indice, avec 68,90 %, devant Claude Sonnet 5.5. Sur le coût, tout dépend du concurrent retenu. Au tarif d'introduction, une tâche de l'indice d'Artificial Analysis revient à 1,99 dollar avec Argon, environ 60 % du coût de GPT-6 Astra mais 2,7 fois celui de GPT-6.1 Sol ; face à Astra, l'avantage tient au prix des jetons, puisqu'Argon en produit en moyenne 62 000 en sortie par tâche, contre 27 000, et le coût par tâche remonte à 3,98 dollars au tarif plein, selon l'évaluateur. Dans un article paru quelques minutes avant l'annonce et qui ne nomme pas Argon, Bloomberg rapporte enfin, d'après des personnes ayant un accès direct aux travaux et ayant requis l'anonymat, que Gemini 4 se comporte moins bien quand les salariés de Google s'en servent réellement que sur les bancs d'essai ; Google juge inexact de dire qu'il sous-performe, notamment en programmation.
Source : Google
La FTC confirme enquêter sur OpenAI, Anthropic et d'autres entreprises d'IA au sujet des risques potentiels pour les consommateurs
La Federal Trade Commission, l'autorité fédérale américaine de la concurrence et de la protection des consommateurs, a confirmé le mercredi 30 septembre, par la voix d'un porte-parole, à CBS News, à CNBC et à l'Associated Press qu'elle enquête sur Anthropic, OpenAI et d'autres entreprises d'IA, au sujet des risques que leur technologie pourrait faire peser sur les consommateurs. Le New York Post avait révélé l'enquête plus tôt dans la journée. Selon le porte-parole cité par CBS, l'agence examine si les actions de ces entreprises enfreignent le FTC Act et prévoit de leur demander des informations, y compris au groupe de recherche à but non lucratif METR ; elle a refusé de nommer les autres entreprises visées, précise CNBC. L'enquête est antérieure à cette confirmation : CBS la dit lancée cet été, et un haut responsable de la FTC a déclaré au New York Post que son président, Andrew Ferguson, l'avait engagée « il y a quelques semaines ». Selon le journal, qui cite des responsables de l'administration, l'agence rédige des demandes d'investigation civile, des demandes formelles comparables à des citations à comparaître, pour obtenir des documents et contraindre des dirigeants à témoigner. Le haut responsable de la FTC les dit attendues dans les prochaines semaines. Il a ajouté que l'agence ne disait, à ce stade, aux entreprises ni de s'arrêter ni de faire quoi que ce soit, et qu'elle se trouvait en phase d'enquête. Reuters rapporte aussi, d'après un haut responsable de la FTC, que l'agence mène une enquête à l'échelle du secteur et prévoit d'émettre des demandes formelles d'information et de contraindre à témoigner des dirigeants de grands développeurs d'IA, dont Anthropic et OpenAI, ainsi que du groupe de recherche METR. Anthropic, OpenAI et METR n'avaient pas répondu dans l'immédiat aux sollicitations de Reuters.
Pourquoi c'est important
Pour la direction juridique d'une entreprise qui exploite des agents d'IA, la façon dont le président de la FTC conçoit la responsabilité mérite l'attention. Le 25 septembre, lors d'un événement organisé par Reuters à Austin, Andrew Ferguson a dit qu'il résisterait à l'idée de décrire les agents d'IA comme des acteurs autonomes qui s'émanciperaient avec « des volontés et des désirs propres ». Ses propos suggéraient, selon l'agence de presse, que la responsabilité des dommages reviendrait aux développeurs qui donnent des instructions aux agents ; dans son article du 30 septembre, Reuters rattache cette idée aux tests de cybersécurité qui aboutissent à des intrusions. Un haut responsable de la FTC a indiqué à Reuters que l'incident de Hugging Face, en juillet, au cours duquel des agents d'OpenAI ont sondé la plateforme à la recherche de failles avant de l'attaquer à grande échelle, avait accru l'urgence du dossier, les préoccupations d'Andrew Ferguson lui étant antérieures. Le Washington Post relève que l'étendue de l'enquête reste floue, la FTC disposant de larges pouvoirs pour examiner les pratiques déloyales ou trompeuses.
Source : CBS News
OpenAI attribue en partie à des personnes associées à Moonshot AI une campagne visant à extraire le raisonnement de ses modèles
OpenAI indique, dans un billet de sécurité publié le 30 septembre, avoir repéré puis perturbé une campagne coordonnée destinée à extraire le « raisonnement protégé » de ses modèles, c'est-à-dire, selon sa définition, le registre interne dont le modèle se sert pour traiter une tâche et dont l'extraction peut révéler des informations tenues à l'écart de la réponse finale. L'entreprise juge cette activité compatible avec de la distillation adversariale, soit l'usage systématique et non autorisé des sorties ou du raisonnement d'un modèle pour aider à en entraîner, en reproduire ou en améliorer un autre. L'activité a commencé le 1er juillet à faible volume, puis a culminé les 24 et 25 juillet avec 16 000 requêtes suivant un schéma d'extraction, émanant de plus de 4 000 utilisateurs ; OpenAI précise qu'il s'agit de tentatives, qui n'ont pas nécessairement abouti. Son enquête a ensuite mis au jour une activité apparentée dans un groupe de plus de 15 000 utilisateurs, entièrement neutralisé au 28 juillet. Parmi les procédés tentés, OpenAI cite la copie d'un raisonnement chiffré d'une conversation à une autre, où un modèle était invité à le déchiffrer et à le transcrire. Selon l'entreprise, les opérateurs n'ont ni cassé son chiffrement, ni compromis une base de données, ni obtenu d'accès direct aux conversations stockées des utilisateurs. OpenAI écrit qu'il n'est pas clair que tous les opérateurs observés sur la période proviennent d'un même acteur, mais attribue un noyau de l'activité à des personnes associées à Moonshot AI, le développeur de Kimi.
Pourquoi c'est important
Le passage du billet sur le travail restant intéresse les entreprises qui utilisent les modèles d'OpenAI chez un partenaire : les déploiements hébergés par des partenaires ont besoin des mêmes protections que les services d'OpenAI elle-même, écrit l'entreprise, qui dit poursuivre la diffusion des contrôles pertinents auprès de ses partenaires cloud, sans les nommer. Elle affirme avoir banni ou restreint les comptes frauduleux, renforcé ses contrôles d'inscription et d'infrastructure, et fermé une voie qui permettait à une personne déjà en possession du raisonnement chiffré d'un autre utilisateur de le rejouer pour en récupérer le contenu. Elle écrit que la manipulation employée, qui consistait à faire reproduire le raisonnement protégé sous une forme visible du demandeur, n'est pas une vulnérabilité propre à ses modèles. Elle dit avoir partagé ses constats pertinents par le Frontier Model Forum et par des canaux gouvernementaux d'échange d'informations appropriés, afin que d'autres développeurs de pointe et des partenaires du secteur public puissent rechercher des activités similaires. Le lien avec Moonshot AI est une attribution d'OpenAI, dont le billet n'expose pas les éléments sur lesquels elle s'appuie. Moonshot AI n'avait pas répondu dans l'immédiat aux sollicitations de CNBC ; Caroline Zier, qui dirige chez OpenAI les initiatives stratégiques de politique de sécurité nationale, a déclaré à Bloomberg, selon The Next Web, que la préoccupation de l'entreprise porte sur la violation de ses conditions d'utilisation, à l'exclusion des modèles ouverts et de la distillation légitime.
Source : OpenAI
En Californie, une loi interdira de sanctionner ou de licencier un salarié sur la seule foi d'un système de décision automatisée
Le gouverneur de Californie, Gavin Newsom, a promulgué le 30 septembre SB 947, texte du sénateur Jerry McNerney que son auteur et CNBC appellent le « No Robo Bosses Act ». Il fait partie des treize textes énumérés dans un même communiqué sur l'encadrement de l'IA, promulgués le dernier jour dont le gouverneur disposait pour signer les textes de la session ou leur opposer son veto, selon l'Associated Press. D'après la version transmise au gouverneur, publiée sur le site de la Législature de Californie, un employeur ne pourra pas s'appuyer uniquement sur un système de décision automatisée pour décider d'une sanction disciplinaire ou d'un licenciement. La définition retenue est large : tout processus informatique issu de l'apprentissage automatique, de la modélisation statistique, de l'analyse de données ou de l'IA qui produit un résultat simplifié, comme un score, une classification ou une recommandation, servant à assister ou à remplacer une décision humaine discrétionnaire et ayant un effet important sur des personnes physiques, à l'exclusion notamment des filtres anti-spam, des pare-feu, des antivirus, des calculatrices et des bases de données. S'il s'appuie principalement sur un tel système, l'employeur devra faire corroborer la décision par un humain, à partir des données ayant servi au système ou d'autres informations, comme des évaluations hiérarchiques, des dossiers du personnel ou des entretiens avec des témoins. Le salarié recevra alors un avis écrit au moment où la décision lui est annoncée. Il pourra aussi demander, et l'employeur devra lui fournir, une description de ses propres données utilisées par le système. La loi s'appliquera à partir du 1er juillet 2027 ; l'employeur qui l'enfreint s'exposera notamment à une amende civile de 500 dollars par infraction, que le Labor Commissioner, qui dirige la division chargée de faire respecter le droit du travail dans l'État, et les procureurs publics pourront faire appliquer. Parmi les exceptions figurent les parties couvertes par une convention collective qui écarte la loi en termes clairs et non équivoques, règle expressément les salaires et les conditions de travail et prévoit une protection contre la gestion algorithmique. Le même jour, Gavin Newsom a notamment signé SB 951. Ce texte complète l'avis que la loi californienne impose avant un licenciement collectif, une relocalisation ou une fermeture dans les établissements qui emploient, ou ont employé au cours des douze derniers mois, au moins 75 personnes, lorsque l'opération est causée en tout ou en partie substantielle par un système d'IA ou une autre technologie automatisée qui remplace ou automatise des postes : l'employeur devra y indiquer, entre autres, le nombre, la classification ou la profession et le lieu de travail des licenciements substantiellement dus au remplacement ou à l'automatisation par l'IA ou une autre technologie automatisée.
Pourquoi c'est important
Le texte de SB 947 diffère de la version à laquelle Gavin Newsom avait opposé son veto en octobre 2025 : selon CNBC, l'obligation d'informer les salariés avant l'usage d'un système de décision automatisée a disparu, de même que l'extension aux travailleurs des plateformes. Pour une direction des ressources humaines, la règle s'appliquera à partir du 1er juillet 2027 : un employeur qui fondera principalement une sanction ou un licenciement sur un tel système devra faire corroborer la décision par un humain. Si l'employeur ne parvient pas à corroborer le résultat du système, ou si l'humain chargé de la vérification le juge inexact, incomplet ou trompeur, l'employeur ne pourra pas s'en servir pour décider d'une sanction ou d'un licenciement, précise le texte. Au Maroc, la loi 09-08 sur la protection des données personnelles pose à son article 11 un principe général proche, sans viser spécifiquement l'emploi. Selon ce texte, aucune décision produisant des effets juridiques à l'égard d'une personne ne peut être prise sur le seul fondement d'un traitement automatisé destiné à définir son profil ou à évaluer certains aspects de sa personnalité. Le même article précise que ne sont pas considérées comme prises sur ce seul fondement les décisions prises dans le cadre de la conclusion ou de l'exécution d'un contrat lorsque la personne a été mise à même de présenter ses observations, ni celles qui satisfont ses demandes. L'article marocain ne prévoit pas, en revanche, la corroboration humaine ni l'avis écrit qu'impose la loi californienne.
Source : Gouverneur de Californie
Auditer ses outils RH de notation automatisée →Google étend les « skills » aux conversations de Gemini et annonce l'arrêt des Gems à partir de novembre pour les comptes personnels
Les « skills » de Gemini permettent d'enregistrer une fois ses instructions les plus utilisées pour les relancer à volonté, en tapant une barre oblique suivie de leur nom ; Google a annoncé le 30 septembre leur déploiement dans la conversation de son assistant. Gemini peut aider à en construire à partir des conversations de l'utilisateur et les déclencher de lui-même quand une demande correspond, et l'utilisateur peut en empiler plusieurs pour une même tâche. Une skill peut désormais contenir des fichiers de référence : documents texte, PDF ou images. Annoncé comme mondial, le déploiement se fait par étapes. Il commence par les personnes de 18 ans ou plus connectées avec un compte Google personnel ; les clients Workspace des offres Business, Enterprise, associatives et éducation doivent l'obtenir dans les semaines à venir. Les skills remplaceront les Gems, jusqu'ici l'outil de Gemini pour adapter les instructions à une tâche précise. Google cessera de prendre en charge les Gems à partir de novembre pour les comptes personnels, de mars 2027 pour les clients Workspace des offres Business, Enterprise et associatives, et de juin 2027 pour l'éducation, et convertira automatiquement les Gems existantes en skills au moment de leur retrait. Opal, son expérience de création de mini-applications, s'arrêtera en novembre.
Pourquoi c'est important
Pour un utilisateur régulier des Gems, tout ne suivra pas au basculement. Selon les pages d'aide de Google, la plupart des outils par défaut disponibles dans les Gems, dont Canvas, Deep Research et la création de vidéos, ne fonctionnent pas encore avec les skills. Une autre page d'aide de Gemini précise que les fichiers Word et Excel ne sont pas acceptés comme fichiers de référence d'une skill. Google annonce que les skills permettront, dans les prochaines semaines, le partage ainsi que l'ajout de fichiers Drive ou de notebooks. Les Gems de Google Labs s'arrêteront aussi et ne seront pas converties. Côté entreprises, l'aide destinée aux administrateurs de Workspace précise que le retrait des Gems n'interviendra pas avant le 1er mars 2027 pour les offres Business et Enterprise, ni avant le 1er juin 2027 pour l'éducation. Selon la même aide, les Gems restantes de l'application Gemini seront alors converties en brouillons de skills inactifs, que leur créateur devra activer ; pour l'instant, une Gem utilisée dans Workspace doit être recréée à la main sous forme de skill dans Workspace Studio pour être transférée. Quant aux flux de Workspace Studio dont une étape fait appel à une Gem, ils cesseront de fonctionner, au plus tôt à ces mêmes échéances. Les skills reposent sur SKILL.md, un format ouvert fondé sur Markdown d'après Google, dont le site du standard Agent Skills attribue la conception à Anthropic ; l'aide de Gemini indique que l'on peut importer des skills créées ailleurs, pour l'instant depuis le site web de Gemini et l'application pour Mac.
Source : Google
Se former à la rédaction d'instructions pour l'IA générative →Reddit arrêtera ses flux RSS le 13 novembre et fermera l'accès public restant à son API en mars 2027
Reddit cessera de prendre en charge ses flux RSS le 13 novembre, a annoncé l'entreprise le 30 septembre dans un message aux modérateurs, au motif qu'ils sont devenus une voie courante de collecte massive de données et d'abus automatisés. Les modérateurs qui s'en servent pour leurs alertes sont invités à passer à des applications de la plateforme de développement de Reddit, comme Discord Relay. Pour les flux situés en dehors d'une communauté que l'on modère, prévient l'entreprise, il n'existe aucun remplacement. Un message distinct, publié le même jour sur le forum r/redditdev à l'intention des développeurs et auquel renvoie le premier, fixe le calendrier de l'API publique. Reddit n'acceptera plus de nouvelle demande d'accès à partir du 31 octobre, commencera dès le 12 janvier 2027 à retirer l'accès des applications et utilisateurs qui ne se sont ni enregistrés ni manifestés auprès de lui, puis fermera l'accès public restant en mars 2027. Les applications et robots qui utilisent l'API publique doivent migrer vers la Developer Platform de Reddit ; plus de 14 000 se sont enregistrés. Ce message mentionne un programme d'aide à la migration d'un million de dollars, qui prévoit des versements de 1 000 dollars à des applications éligibles réussissant leur migration, sur candidature, via le formulaire d'enregistrement des applications, au plus tard le 30 novembre 2026. Le message aux modérateurs ajoute que, dans les prochains mois, l'accès connecté à l'ancienne interface, Old Reddit, sera limité aux comptes qui l'ont utilisée au cours des six derniers mois, les modérateurs connectés restant exemptés de cette condition.
Pourquoi c'est important
Aucun des deux messages de Reddit n'invoque l'intelligence artificielle pour justifier ces mesures. Celui destiné aux modérateurs motive l'arrêt du RSS par la collecte massive et les abus automatisés, et la prochaine limitation d'accès à Old Reddit par la lutte contre les abus automatisés ; celui destiné aux développeurs évoque le passage à « une fondation plus sécurisée ». Le cadrage par l'IA vient de la presse : TechCrunch a titré sur les robots d'IA, The Next Web sur la collecte par l'IA, et TechCrunch estime que les assistants d'IA, aujourd'hui capables de puiser dans Reddit pour répondre, auront besoin d'accords commerciaux une fois l'API publique fermée. Pour un développeur ou un utilisateur de l'API publique qui n'a pas migré vers la plateforme de Reddit, le calendrier d'accès comporte trois jalons : le 31 octobre, à partir duquel Reddit n'accepte plus de nouvelle demande d'accès ; le 12 janvier 2027, début des retraits d'accès pour les applications et utilisateurs qui ne se sont ni enregistrés ni manifestés auprès de Reddit ; et mars 2027, fermeture de l'accès public restant. S'y ajoute, pour qui vise les versements de 1 000 dollars du programme d'aide à la migration, la date limite de candidature du 30 novembre. Le 5 août, Reddit jugeait déjà son API publique inadaptée à l'échelle actuelle, aux abus automatisés et à la collecte commerciale, et annonçait une restriction progressive des nouvelles demandes tout en disant maintenir un accès public limité ; le message du 30 septembre destiné aux développeurs fixe un calendrier et annonce la fin de l'accès public restant.
Source : Reddit