OpenAI commence à déployer GPT-6 dans l'onglet Chat de ChatGPT, avec des réponses qui peuvent intégrer graphiques, boutons et formulaires
Le déploiement de GPT-6 dans l'onglet Chat de ChatGPT a commencé le 7 octobre pour les formules Plus, Pro, Business et Enterprise, l'accès des comptes Enterprise dépendant des réglages de l'administrateur de l'espace de travail, et doit s'étendre le lendemain aux formules Free et Go, d'après le billet d'OpenAI. Selon ce billet, les quatre premières sont servies par GPT-6 Sol et les deux autres le seront par GPT-6 Luna ; les modèles qui animent Work et Codex ne changent pas à cette occasion. OpenAI rappelle avoir présenté en septembre ses premiers modèles GPT-6 aux clients payants, dans une phrase qui ne les nomme pas. Ses billets de septembre datent GPT-6 Astra du 3, puis GPT-6 Sol et GPT-6 Luna du 22 : selon ce second billet, ces deux derniers étaient alors proposés dans Work et Codex, et GPT-6 Luna aussi aux comptes Free et Go dans l'application de bureau, mais pas encore dans Chat. Le changement le plus visible s'appelle Intelligent UI. GPT-6 a été entraîné, écrit l'entreprise, à composer ses réponses avec du texte, des visuels et des éléments interactifs : une réponse peut inclure des graphiques, des boutons, des formulaires, ou un outil créé à la demande dans la conversation, comme un calculateur qui simule la croissance d'une épargne. OpenAI reconnaît qu'il reste du travail pour améliorer le jugement du modèle en matière de design et élargir ce qu'il sait créer. Pour les questions qui nécessitent une recherche sur le web, elle avance que GPT-6 Instant commence à répondre 44 % plus tôt en moyenne que GPT-5.6 Instant ; le graphique du billet situe ce délai avant le début de la réponse à 2,47 secondes contre 4,42 secondes, sur le trafic de production du modèle gratuit. Ces chiffres viennent d'OpenAI. Elle évalue à plus de 1,2 milliard le nombre de personnes qui utilisent ChatGPT chaque semaine.
Pourquoi c'est important
Les utilisateurs des anciennes applications de bureau de ChatGPT pour macOS et Windows ne verront pas ces réponses interactives : la page d'aide d'OpenAI, plus détaillée que le billet, indique qu'elles ne prennent pas en charge Intelligent UI et renvoie vers la version web. La fonction est en cours de déploiement sur le web et dans les applications compatibles mises à jour. Elle n'est pas disponible avec le niveau d'effort Pro, qui reste assuré par GPT-6 Astra. Sur la version web, un réglage, « Layout and visuals », permet de réduire les éléments visuels ; certains peuvent subsister, car il ne fait pas basculer l'ensemble de la réponse vers un mode uniquement textuel. La même page prévient que GPT-6 peut ne pas être encore disponible pour un compte donné et que, dans les espaces de travail Business et Enterprise, les administrateurs peuvent contrôler les modèles accessibles. Consultée le 8 octobre, elle décrivait les utilisateurs Free et Go comme servis par GPT-5.6 Luna, alors que le billet leur annonce GPT-6 Luna à partir du 8 octobre. La fiche système (« system card ») publiée le 7 octobre distingue les versions d'octobre de GPT-6 Sol et de GPT-6 Luna, lancées dans Chat, de celles de septembre, que Work et Codex continuent d'utiliser. Pour les versions d'octobre, elle signale, par rapport aux versions GPT-5.6 correspondantes, des régressions statistiquement significatives sur plusieurs évaluations de sécurité. Sur des jeux de prompts qu'OpenAI dit avoir conçus pour être difficiles, et dont les taux d'erreur ne sont pas, selon elle, représentatifs du trafic moyen, elles concernent l'automutilation pour GPT-6 Sol, et l'automutilation, les contenus sanglants (« gore ») et les contenus sexuels pour GPT-6 Luna. Dans les évaluations consacrées aux moins de 18 ans, qui reposent, selon la fiche, sur des cas difficiles et ne doivent pas être lues comme une fréquence en usage courant, les régressions statistiquement significatives portent sur les contenus à âge restreint, les contenus sexuels et la dépendance émotionnelle pour les deux modèles, ainsi que sur les contenus sanglants pour GPT-6 Luna. OpenAI dit avoir examiné la régression sur la dépendance émotionnelle et juge son évaluation trop sensible à l'emploi, par le modèle, de surnoms bénins comme « bro » ou « bestie », un emploi qui n'est pas considéré comme interdit lorsque l'utilisateur le demande explicitement.
Source : OpenAI
Anthropic lance Claude Haiku 5.5 à partir de 0,10 dollar le million de jetons en entrée et réduit de moitié le prix de lecture du cache de Sonnet 5.5
À 0,10 dollar le million de jetons en entrée et 0,50 dollar en sortie pour les prompts, c'est-à-dire les requêtes envoyées au modèle, jusqu'à 100 000 jetons, Claude Haiku 5.5, lancé le 7 octobre par Anthropic, est facturé sur son API 90 % de moins par jeton que Haiku 4.5, proposé à 1 dollar et 5 dollars. Les jetons sont les fragments de texte qui servent d'unité de facturation. Au-delà de 100 000 jetons de prompt, les tarifs montent à 0,50 dollar en entrée et 2,50 dollars en sortie, soit 50 % de moins que Haiku 4.5 ; 90 % des requêtes adressées à ce dernier ne dépassaient pas ce seuil, précise l'entreprise. Anthropic estime que Haiku 5.5 coûte en moyenne environ 75 % de moins à l'usage que Haiku 4.5, un calcul qui tient compte d'un nouveau tokenizer, le composant qui découpe le texte en jetons. L'annonce précise que Haiku 5.5 utilise « slightly more tokens per task », légèrement plus de jetons par tâche ; le guide de migration situe à environ 30 % le surcroît de jetons pour un même texte, variable selon le contenu. Haiku 5.5 est le premier modèle de la gamme Haiku doté d'un niveau d'effort réglable. Les scores mis en avant sont mesurés au niveau maximal, indique la fiche système : sur GDPval-AA v2.1, une évaluation conduite de façon indépendante par Artificial Analysis et notée en points Elo, un score de classement relatif entre modèles, Haiku 5.5 obtient 1 620 points à ce niveau, contre 1 277 au niveau par défaut ; Sonnet 5.5 en obtient 1 840, et Haiku 4.5, qui n'a pas de réglage d'effort, 735. Anthropic ramène par ailleurs, sur son API, de 0,20 à 0,10 dollar par million de jetons le prix de lecture du cache de Sonnet 5.5, c'est-à-dire la réutilisation d'une partie de prompt déjà mise en cache, ce qui réduit selon elle d'environ 20 % le coût de ce modèle sur la plupart des tâches agentiques, celles où le modèle enchaîne lui-même plusieurs actions ; les écritures de cache et les autres tarifs ne changent pas, précisent les notes de version.
Pourquoi c'est important
Le Maroc figure sur la liste des pays où Anthropic propose un accès commercial à son API, dont les tarifs sont libellés en dollars. Pour un développeur ou une PME qui la paie au volume, la facture dépend aussi du nombre de jetons : un même texte en compte environ 30 % de plus qu'avec Haiku 4.5, selon le guide de migration. La fenêtre de contexte, soit la quantité de texte que le modèle peut prendre en compte en une fois, atteint un million de jetons, mais les prix en entrée et en sortie sont multipliés par cinq dès que le prompt dépasse 100 000 jetons. Ces tarifs sont ceux de l'API d'Anthropic ; Amazon Bedrock et Google Cloud appliquent leur propre tarification, indique la documentation. Artificial Analysis, qui a mesuré le modèle au niveau d'effort maximal (« Claude Haiku 5.5 (Max) »), le juge en outre très verbeux : 440 millions de jetons générés pour établir son indice d'intelligence, contre une médiane de 100 millions, écrit-il sur la page du modèle. Le passage de Haiku 4.5 à Haiku 5.5 demande aussi une vérification du code, qui peut cesser de fonctionner avec le nouveau modèle, préviennent les notes de version. Anthropic juge Haiku 5.5 surtout adapté à des tâches étroitement délimitées, comme la synthèse ou le travail de sous-agent, et continue de recommander Sonnet 5.5 et Opus 5.5 pour les tâches complexes de programmation agentique. Sa fiche système reconnaît que, dans son audit comportemental automatisé, le modèle a opposé plus de refus injustifiés que tous les autres modèles testés, Haiku 4.5 compris, tout en refusant moins souvent que ce dernier les requêtes légitimes portant sur des sujets sensibles, posées en un seul tour (0,17 % contre 0,44 % sur l'API, sans prompt système). Chez OpenAI, GPT-6 Luna affiche les mêmes prix, 0,10 dollar en entrée et 0,50 dollar en sortie, sur un palier plus large, qui s'étend jusqu'à 272 000 jetons en entrée.
Source : Anthropic
Simple., marque d'Attijariwafa bank, ouvre en avant-première Simple AI, un assistant bancaire utilisable par écrit ou par la voix, notamment en darija
Simple. a annoncé le mercredi 7 octobre l'ouverture en avant-première de Simple AI, un assistant bancaire virtuel « conversationnel et transactionnel » fondé, selon l'entreprise, sur l'intelligence artificielle générative et agentique. Le texte de l'annonce, publié par Hespress, qui n'y nomme pas Attijariwafa bank, paraît aussi sur Le360 sous la mention « Contenu de marque », où Simple. est présentée comme une « néobanque d'Attijariwafa bank » ; Le Matin, qui le reprend, présente Simple. comme une marque d'Attijariwafa bank, et les mentions légales du site simple.ma indiquent que la banque en est l'éditeur. Intégré à l'application Simple., l'assistant permet au client de s'adresser à sa banque par écrit ou par la voix, « notamment en darija marocaine ». Annoncé en six langues, dont quatre sont nommées (la darija, l'arabe, le français et l'anglais), il peut notamment, selon l'annonce, répondre aux questions sur les produits et services de la banque, aider à naviguer dans l'application et fournir au client des informations sur le comportement de son compte. Le client peut aussi exécuter des opérations courantes, dont le texte cite en exemples le virement, le paiement de factures et celui de la vignette. Lorsque l'opération nécessite une validation, le client conserve la maîtrise de la décision et valide lui-même l'opération, précise l'annonce. L'assistant permet également d'ouvrir une réclamation et d'en suivre l'avancement. L'accès est d'abord ouvert à une « première communauté de clients », avant une ouverture « à plus grande échelle » dont ni la date ni l'ampleur ne sont données.
Pourquoi c'est important
Pour un client de la banque, l'annonce laisse deux questions ouvertes. Elle ne précise pas quelles opérations exigent une validation. Elle affirme, par la voix de Hiba Fergag, Product Manager Data, IA et Marketing Automation, que les données des clients restent sous le contrôle de la banque, « protégées et hébergées au sein de ses propres infrastructures sécurisées », mais elle ne nomme ni le modèle d'IA utilisé ni son fournisseur. La formule « une première au Maroc » est celle de l'entreprise. Le Matin la reprend dans son titre ; dans le corps de l'article, il écrit toutefois que Simple AI est « présenté comme » le premier assistant bancaire conversationnel et transactionnel basé sur l'intelligence artificielle au Maroc, et qu'il « ne sera pas immédiatement accessible à l'ensemble des utilisateurs ». Le nom circulait déjà : au lancement de Simple., en mai, le même quotidien décrivait Simple AI comme un module d'intelligence artificielle conversationnelle qui permettrait « bientôt » d'exécuter des transactions ou de déposer des réclamations par commande vocale.
Source : Hespress
Concevoir un assistant conversationnel pour ses clients →Common Sense Media classe ChatGPT for Teens en « risque inacceptable » ; OpenAI conteste la méthode des tests
ChatGPT présente un « risque inacceptable » (« Unacceptable Risk ») pour tous les moins de 18 ans, estime le Youth AI Safety Institute de Common Sense Media dans son évaluation de ChatGPT for Teens, mise en ligne le 7 octobre et fondée sur plus de 4 000 prompts testés avant et après le lancement de ce mode. Annoncé le 18 août, ChatGPT for Teens désigne, explique l'institut, un ensemble de réglages, d'invites, de classificateurs et de fonctions d'interface que ChatGPT active pour les comptes connus ou soupçonnés d'appartenir à des jeunes de 13 à 17 ans, sans application ni modèle distincts. Le premier constat de l'institut porte sur les alertes envoyées aux parents. Sur plus d'une douzaine de comptes neufs liés à un compte parental, ses testeurs n'ont reçu aucune alerte, dans des conversations de moins de cinq minutes à une heure, après avoir évoqué explicitement des pensées suicidaires, l'automutilation ou des troubles alimentaires. Les alertes ne sont arrivées que sur des comptes ayant des semaines d'historique sur des sujets sensibles, ce qui suggère, selon lui, qu'elles dépendent de l'historique accumulé du compte plutôt que de la gravité de ce que dit l'adolescent. L'institut reconnaît que, dans ses tests, ChatGPT n'a pas directement facilité le suicide, l'automutilation ou les troubles alimentaires. Il appelle OpenAI à suspendre la promotion du produit et à tenir les adolescents à l'écart de ChatGPT tant qu'une expérience sûre et adaptée à leur développement n'est pas proposée ; sa première recommandation est de couper leur accès jusqu'à ce que des tests indépendants vérifient que les protections annoncées fonctionnent comme prévu.
Pourquoi c'est important
Pour les parents qui comptent sur ces alertes, deux versions s'opposent, que les éléments publiés ne permettent pas de départager. Selon Eric Porterfield, porte-parole d'OpenAI cité par The Verge, l'examen de la méthode montre que l'essentiel des tests a pu commencer et s'achever avant que l'activation du contrôle parental soit complète, ce qui rend à ses yeux les constats inexacts ; dans ce cas, ajoute-t-il, les tests n'établiraient pas si les notifications parentales fonctionnent comme prévu. L'institut rapporte qu'OpenAI lui a indiqué, en relisant l'évaluation, que les comptes du parent et de l'adolescent doivent être liés depuis environ trois heures avant de pouvoir recevoir des alertes. L'institut répond, dans une note de sa page, que certains de ses comptes de test étaient liés depuis moins de trois heures et d'autres depuis plus de trois heures ; son directeur exécutif, Tom Siegel, précise dans The Verge que certains l'étaient depuis nettement plus longtemps sans avoir déclenché d'alerte. L'institut maintient son interprétation. Sur les troubles alimentaires, il date lui-même le lancement des alertes au 10 septembre, sans indiquer à quelles dates son test consacré aux alertes a eu lieu ; Tom Siegel dit, dans The Verge, avoir confirmé auprès d'OpenAI, avant de commencer les tests, que des fonctions comme ces alertes étaient pleinement lancées. L'institut signale par ailleurs des limites de son travail : les tests ont été menés aux États-Unis, depuis des comptes de la région de San Francisco, et sur deux périodes successives, de sorte qu'un changement du modèle entre juillet et fin septembre se confond avec l'effet des réglages. Il se dit financé par la philanthropie et par l'industrie ; sa page de présentation range l'OpenAI Foundation, avec Anthropic et Pinterest, parmi ses financeurs liés à l'industrie, et affirme une indépendance éditoriale complète. Il précise qu'OpenAI a relu un brouillon pour une vérification factuelle, dont l'institut dit avoir intégré les corrections jugées fondées, sans que l'entreprise ait de droit de regard éditorial sur ses conclusions, ses notations ou ses recommandations. Le même jour, OpenAI a publié un billet distinct sur ChatGPT for Teens, qui ne mentionne pas cette évaluation ; OpenAI y affirme, sans détailler la base de ce calcul, que les adolescents passent en moyenne moins de 15 minutes par jour sur ChatGPT.
Source : Common Sense Media
Biohub annonce un total de 1,8 milliard de dollars, avec le département américain de l'Énergie, les NIH, Google DeepMind et Meta, pour des données d'IA en biologie
Biohub chiffre à 1,8 milliard de dollars, en financement, en données, en calcul et en technologies de mesure, l'ensemble annoncé le 7 octobre avec le département américain de l'Énergie (DOE), les National Institutes of Health (NIH) et de nouveaux partenaires, pour étendre un effort international de production de données destinées à des modèles d'IA prédictifs de la biologie. Le communiqué ne décompose pas ce total. Il cite plusieurs engagements. Le DOE investira plus de 500 millions de dollars sur cinq ans en mesures de laboratoire, en modélisation et en calcul. Les NIH coordonneront l'apport de jeux de données, de dépôts et de bases de connaissances pertinents, développés grâce à plus de 500 millions de dollars d'investissements fédéraux antérieurs en lien avec cette initiative. Google DeepMind, Isomorphic Labs et Meta investissent ensemble 300 millions de dollars, sans répartition entre eux. Le texte rappelle enfin l'engagement fondateur de 500 millions de dollars de Biohub, annoncé dans un communiqué du 29 avril. Reuters attribue le total de 1,8 milliard à Biohub, qu'elle décrit comme une initiative philanthropique de Mark Zuckerberg, le directeur général de Meta, et de son épouse. Alex Rives, responsable scientifique (« Head of Science ») de Biohub, a indiqué, selon l'agence, que les partenaires visent un premier jeu de données dans environ un an et qu'il s'attend à des modèles prédictifs précis d'ici cinq ans.
Pourquoi c'est important
Pour un laboratoire ou une jeune entreprise de biotechnologie qui compte utiliser ces données, la question pratique est celle de l'accès. Le communiqué parle d'une ressource ouverte. Alex Rives a toutefois indiqué, selon Reuters, que les financeurs commerciaux disposent de périodes d'embargo, pendant lesquelles ils peuvent travailler sur les données avant qu'elles deviennent une ressource scientifique publique ; les travaux financés par l'État, menés en parallèle, ne comporteront pas de telles restrictions, a-t-il ajouté. The Next Web, qui cite un entretien du même responsable avec Axios, évoque un an d'accès exclusif pour ces financeurs. Une partie de l'annonce est antérieure : l'engagement de 500 millions de dollars de Biohub date d'avril, et l'apport des NIH porte sur des jeux de données issus d'investissements fédéraux passés. Biohub présente l'ensemble comme le plus grand engagement coordonné à ce jour pour produire des données biologiques prêtes pour l'IA. Alex Rives formule les retombées au conditionnel : un modèle prédictif précis de la biologie pourrait accélérer considérablement la découverte scientifique (« could dramatically accelerate scientific discovery »), dit-il dans le communiqué.
Source : Biohub (communiqué)
Le Trésor américain annonce sa première pénalité civile au titre du contrôle des investissements sortants, pour un investissement non notifié dans une société chinoise d'IA
Pour ne pas avoir notifié un investissement d'environ 92 478 dollars dans une société chinoise d'intelligence artificielle, Amidi, LLC s'est vu infliger une pénalité civile de 200 000 dollars par le Trésor américain, qui l'a annoncé le 7 octobre. La pénalité elle-même a été prononcée en juillet 2026, précise le communiqué. C'est la première pénalité civile prononcée au titre de l'Outbound Investment Security Program (OISP), le programme américain de contrôle des investissements sortants, en vigueur depuis le 2 janvier 2025. L'investissement a été réalisé le 19 avril 2025 par un fonds chinois, filiale d'Amidi, dans Shanghai Qiongche Intelligent Technology Company Limited, dite Noematrix. Le Trésor décrit cette dernière comme une société chinoise privée qui développe de l'intelligence artificielle, de la robotique et de l'intelligence incarnée (« embodied intelligence »). Amidi est aussi la maison mère de l'organisation qui exerce sous le nom de Plug and Play Tech Center, indique le communiqué. Le Trésor dit avoir repéré la transaction dans le cadre de son suivi régulier de la conformité et du marché.
Pourquoi c'est important
Le manquement sanctionné est un défaut de notification, et la règle en cause vise toute personne américaine qui contrôle une entité étrangère : le programme lui impose de déclarer au Trésor toute transaction de cette entité qui serait à notifier si une personne américaine la réalisait. Dans ce dossier, l'obligation a joué par l'intermédiaire d'une filiale, pour un investissement inférieur à 100 000 dollars. Le South China Morning Post relève que l'annonce ne qualifie pas l'investissement d'interdit, n'impute aucune faute à Noematrix et n'explique pas le calcul des 200 000 dollars, un montant supérieur au double de la somme investie ; le quotidien dit avoir sollicité Amidi et Noematrix, sans faire état d'une réponse. Le programme soumet à notification certains types d'investissements et en interdit d'autres, lorsqu'ils sont réalisés par des personnes américaines dans des entités situées en Chine, à Hong Kong ou à Macao, ou liées à ces territoires, qui exercent certaines activités dans l'informatique quantique, l'intelligence artificielle et les semi-conducteurs. Le communiqué indique que le Congrès a adopté en décembre 2025 une loi, dite COINS, qui étendra la compétence du programme aux investissements réalisés dans d'autres pays et d'autres secteurs technologiques.
Source : Département du Trésor des États-Unis