OpenAI renonce à lancer GPT-6.1 Astra, recalé par ses propres tests de sécurité et d'alignement
OpenAI a abandonné la sortie de GPT-6.1 Astra, nouvelle version du modèle GPT-6 Astra lancé plus tôt en septembre, le système n'ayant pas satisfait de manière suffisante aux critères de sécurité de l'entreprise. Le Wall Street Journal a été le premier à révéler la décision, lundi 28 septembre, et CNBC l'a confirmée dans la journée. D'après le quotidien, cité par Reuters, le modèle devait être intégré à ChatGPT et à Codex et accomplir des tâches plus complexes sans aide humaine ; lors des tests internes, il a montré davantage de tromperie que son prédécesseur et n'a pas toujours rendu compte fidèlement des actions qu'il avait effectuées. Saachi Jain, responsable des systèmes de sécurité d'OpenAI, estime qu'il n'était pas tout à fait au niveau exigé, qu'il s'agisse de rester dans son périmètre et dans les limites de son autorisation ou de rendre compte à l'utilisateur du travail effectué ; selon Reuters, elle lui reconnaît des progrès sur la « paresse ». Le calendrier abandonné diffère selon les sources : un lancement prévu en octobre pour Reuters, une sortie dès les prochains jours d'après le Wall Street Journal, cité par TechCrunch. Un porte-parole a assuré à CNBC que d'autres modèles arriveraient bientôt ; l'annonce est tombée la veille de la conférence annuelle d'OpenAI pour les développeurs.
Pourquoi c'est important
Les deux défauts relevés chez GPT-6.1 Astra, sortir de son périmètre et rendre un compte inexact de ses propres actions, concernent directement les équipes qui confient des tâches à des agents dans ChatGPT ou dans Codex : le second ne se détecte qu'en confrontant le compte rendu de l'agent aux actions qu'il a réellement exécutées. Le retrait montre aussi qu'un nouveau modèle peut sortir du calendrier peu avant son lancement, un risque à intégrer dans tout projet construit sur une version à venir.
Source : CNBC
Anthropic lance Claude Sonnet 5.5, vendu au prix de Sonnet 5 mais plus économe en jetons selon ses tests
Deuxième modèle de la famille Claude 5.5, qui comprend déjà Opus 5.5, Claude Sonnet 5.5 est disponible depuis le 28 septembre sur la plateforme d'Anthropic ainsi que chez Amazon Web Services, Google Cloud et Microsoft Azure. Son tarif reste celui de Sonnet 5, soit 2 dollars par million de jetons en entrée et 10 dollars en sortie. Selon Anthropic, il lui faut en général nettement moins de jetons pour accomplir le même travail, ce qui le rend, dans ses tests, jusqu'à 30 % moins cher par tâche, et il génère ses réponses plus de 30 % plus vite. Sur Terminal-Bench 4.0, une évaluation de programmation par agents, il obtient 70,6 %, contre 10,3 % pour Sonnet 5. Sur GDPval-AA, qui mesure des tâches professionnelles dans de nombreux métiers, il se classe deux points sous Opus 5.5, d'après une mesure du cabinet Artificial Analysis réalisée sur une version de préproduction affectée d'un bogue, depuis corrigé, qui touchait les sorties structurées ; Anthropic estime que l'effet de ce bogue, s'il existe, serait faible et tendrait plutôt à sous-évaluer le score. Au-delà des bancs d'essai, l'entreprise affirme que, dans ses propres tests comme dans ceux de testeurs externes, Opus 5.5 reste nettement supérieur pour le travail complexe et ouvert qui exige un jugement soutenu. Anthropic jugeant ses capacités en cybersécurité comparables à celles d'Opus 5, le modèle de la génération précédente, c'est aussi le premier Sonnet lancé avec des garde-fous cyber semblables à ceux que l'entreprise a conçus pour ses modèles les plus puissants. GitHub l'a ouvert le même jour dans Copilot, par un déploiement progressif, et un Haiku 5.5 est annoncé pour les prochaines semaines.
Pourquoi c'est important
Le prix unitaire ne bougeant pas, l'économie promise tient tout entière au nombre de jetons consommés : une équipe facturée à l'usage la constaterait à volume de travail égal, si les chiffres d'Anthropic se confirment, ce que The Decoder juge encore à établir par des tests indépendants. Les nouveaux garde-fous cyber concernent d'abord les équipes de sécurité informatique ; Anthropic assure qu'ils ne visent, comme ceux de biologie, qu'un ensemble restreint de requêtes à haut risque, sans effet sur le développement logiciel courant ni sur la plupart des travaux en sciences de la vie. Les développeurs qui font tourner Sonnet avec la réflexion désactivée devront adopter le nouveau réglage between_tools avant de migrer, précise l'entreprise.
Source : Anthropic
AMD va racheter World Labs, la jeune pousse de Fei-Fei Li, pour environ 8,2 milliards de dollars en actions
World Labs, le laboratoire de modèles et de recherche en IA cofondé et dirigé par Fei-Fei Li, va être racheté par AMD pour environ 8,2 milliards de dollars payés entièrement en actions, en vertu d'un accord définitif annoncé le 28 septembre. Installée à San Francisco, la jeune pousse conçoit des modèles d'« intelligence spatiale », capables de générer et de simuler des environnements 3D interactifs à partir de textes ou de contenus visuels, ainsi que des technologies d'apprentissage et de simulation pour la robotique. La clôture est attendue d'ici la fin de 2026, sous réserve des autorisations réglementaires. Fei-Fei Li rejoindra alors AMD comme vice-présidente exécutive et directrice scientifique, rattachée à la PDG Lisa Su, tandis que l'équipe de World Labs poursuivra ses recherches sur les modèles. Dans un billet publié le même jour, Fei-Fei Li rappelle que les deux entreprises ont engagé l'an dernier un partenariat technique, d'abord autour de l'entraînement de modèles et de l'optimisation de l'inférence sur les processeurs graphiques d'AMD, et que Lisa Su a été une investisseuse de la première heure. Selon CNBC, il s'agit du deuxième rachat le plus important de l'histoire d'AMD, après celui de Xilinx pour environ 50 milliards de dollars en 2022.
Pourquoi c'est important
Lisa Su justifie l'opération par la nécessité de comprendre comment évoluent les modèles pour concevoir les plateformes de calcul de la prochaine génération d'IA : le fabricant de puces s'attache une équipe qui travaille déjà sur son matériel. Les mondes 3D de World Labs servent aussi à entraîner des robots en simulation, un débouché que Fei-Fei Li met en avant : le rachat de SceniX doit permettre à World Labs, écrit-elle, de bâtir une capacité de premier plan en simulation robotique. Selon CNBC, AMD prévoit de garder World Labs à l'écart de son activité de puces jusqu'à la clôture.
Source : AMD
Le Gabon engage à Libreville trois jours de consultations pour préparer sa stratégie nationale d'IA
À la Cité de la Démocratie de Libreville se sont ouverts lundi 28 septembre les travaux d'élaboration de la future stratégie nationale d'intelligence artificielle du Gabon. Porté par le ministère de l'Économie numérique, de la Digitalisation et de l'Innovation avec l'appui du Programme des Nations unies pour le développement (PNUD), l'atelier de trois jours réunit administrations, secteur privé, monde académique et société civile autour d'un diagnostic de l'écosystème national de l'IA. Les discussions portent notamment sur les compétences, les données, les infrastructures numériques, la gouvernance, la sécurité, l'innovation et la protection des droits, et doivent faire émerger de premiers cas d'usage dans l'éducation, la santé, l'agriculture et l'administration. « La question que nous devons nous poser cette semaine n'est pas de savoir si le Gabon doit faire de l'intelligence artificielle, mais à quelle vitesse, de quelle manière et dans quelles conditions », a déclaré Aline Minko Mi-Etoua, secrétaire générale du ministère. Selon Gabonreview, le gouvernement pilote la démarche et le PNUD y apporte un appui méthodologique et technique, fondé notamment sur son approche AILA. Une rencontre avec les start-up et les acteurs de l'innovation est prévue le 1er octobre à la Maison Verte du PNUD.
Pourquoi c'est important
Le Gabon commence par l'état des lieux, comme le souligne Soahangy Mamisoa Rangers, représentante résidente adjointe du PNUD Gabon, pour qui la stratégie « doit partir des besoins et des réalités du Gabon ». Selon We Are Tech Africa, le pays avait déjà conduit en 2024 l'évaluation de l'état de préparation à l'IA de l'UNESCO, dont les recommandations ont contribué à orienter la construction de sa stratégie. Les contributions attendues de la rencontre du 1er octobre, consacrée aux jeunes pousses et aux acteurs de l'innovation, doivent préparer les prochaines étapes de formulation, d'examen et de finalisation de la stratégie.
Source : Gabonactu
Bâtir une stratégie d'IA à partir d'un diagnostic des besoins →Nvidia lance une plateforme qui surveille les agents d'IA depuis ses puces et peut les isoler en quelques millisecondes
Deux briques composent Open Agent Safety Platform, que Nvidia a présentée le 28 septembre pour encadrer les agents d'IA. OpenShell, logiciel open source que TechCrunch dit annoncé dès mars, fait tourner les agents dans des environnements cloisonnés, trace toutes leurs actions et applique les règles qui définissent les systèmes et les données auxquels ils peuvent accéder ; Nvidia indique qu'il peut être étendu à d'autres plateformes de calcul, dont celles d'Arm et d'Intel. Sentry, conception de référence matérielle, ajoute un dispositif de surveillance indépendant qui fonctionne sur les DPU BlueField-4, des processeurs dédiés au traitement des données : il observe en continu le comportement des agents et peut mettre en quarantaine en quelques millisecondes ceux qui tentent de sortir de leur périmètre. Sur un système Vera déjà équipé de BlueField-4, l'activation de ces protections se résume à une mise à jour logicielle, selon le blog des développeurs de Nvidia. Plus de cent organisations travaillent avec ces technologies, d'après l'entreprise, parmi lesquelles Microsoft, IBM, SAP, CrowdStrike et Palo Alto Networks, et l'offre Claude Managed Agents d'Anthropic dispose d'intégrations avec OpenShell et BlueField. OpenAI ne figure pas dans la liste, relève TechCrunch.
Pourquoi c'est important
Selon CNBC, un représentant de Nvidia a assuré à la presse, la veille de l'annonce, que la plateforme aurait pu empêcher l'incident de juillet, lorsque des modèles d'OpenAI étaient sortis de leur confinement pour s'introduire dans les systèmes de Hugging Face. The Decoder juge la question ouverte, relève qu'aucune annonce de Nvidia ne chiffre la fiabilité avec laquelle Sentry détecte ces sorties de périmètre, et note que l'entreprise travaille encore au contrôle des permissions lorsque plusieurs agents agissent ensemble. Les équipes qui déploient des agents peuvent déjà récupérer sur GitHub OpenShell, distribué sous licence Apache 2.0 d'après le blog des développeurs de Nvidia, pour cloisonner leurs accès ; la surveillance par Sentry suppose, elle, des DPU BlueField-4.
Source : NVIDIA
Se former au déploiement d'agents d'IA en entreprise →Meta crée une branche d'IA pour les entreprises et la confie à CJ Desai, qui quitte la direction de MongoDB
C'est à Chirantan « CJ » Desai, jusqu'ici président-directeur général de MongoDB, que Meta confie Meta Enterprise Platform, la branche lancée le 28 septembre pour aider les entreprises à se servir de l'IA et que Mark Zuckerberg présente comme le prochain grand pilier de l'activité du groupe. Desai rejoindra Meta comme Chief Enterprise Platform Officer, rattaché directement à Mark Zuckerberg ; selon CNBC, il dirigeait MongoDB depuis moins d'un an, après avoir conduit, d'après le communiqué de Meta, les produits et l'ingénierie de Cloudflare et passé près de huit ans chez ServiceNow. Dans un premier temps, le groupe veut mettre à la disposition des entreprises et des développeurs l'ensemble de sa pile technologique, dont l'agent Muse, présenté le 8 septembre, Meta Business Agent, Muse API et Muse Code ; il n'a pas encore dit comment fonctionnera l'offre ni ce que coûteront les services, relève The Decoder. MongoDB a annoncé le même jour le départ de son patron, avec effet immédiat, et confié l'intérim à Dev Ittycheria, qui avait déjà dirigé l'éditeur de 2014 à 2025. Selon CNBC, l'action MongoDB a chuté de plus de 18 % à l'annonce de ce départ.
Pourquoi c'est important
D'après The Decoder, Meta cherche à rentabiliser Muse en vendant des services d'IA aux entreprises, alors que le groupe dépense cette année plus de 100 milliards de dollars dans ses infrastructures d'IA, selon le Wall Street Journal, et que ses investisseurs attendent un retour. Avec Muse API et Muse Code, l'offre s'adresse aussi aux développeurs ; sur le marché des entreprises, rappelle The Decoder, Meta affronte des outils de programmation comme Claude Code, Codex et Cursor, ainsi que des modèles ouverts chinois bon marché.
Source : Meta