Hacker News
-
GPT 6.1 Sol: Near-Astra intelligence for a fifth of the price
D'après le titre, une annonce présenterait GPT 6.1 Sol, un modèle décrit comme offrant une intelligence « quasi-Astra » pour un cinquième du prix. Le texte de l'article n'est pas disponible au-delà du titre, aucun détail supplémentaire ne peut donc être confirmé.
La discussion porte moins sur les mérites de GPT-6.1 Sol que sur le rythme de publication d'OpenAI et la guerre des prix. Plusieurs commentateurs relèvent que GPT-6 Sol est sorti une semaine seulement avant cette 6.1, ce qui est sans précédent ; l'hypothèse dominante est que Sol 6 était en réalité un renommage panique (peut-être du modèle Terra, distillé d'Astra) précipité après la sortie d'Opus 5.5, jugée « un coup de massue », et que 6.1 est le « vrai » modèle. Certains notent aussi des rumeurs de modèle « Astra-Minor » trouvé dans les fichiers, et qu'on ne peut faire qu'un post-training mineur en une semaine.
Sur les prix, le consensus est que la vraie annonce est le cache d'entrée à 0,10 $/M tokens (50 % moins cher que GPT-6 Sol, moitié moins cher qu'Opus 5.5 sur toutes les métriques API). Mais plusieurs tempèrent : OpenAI a simultanément réduit de moitié les quotas de l'abonnement Pro à 200 $ (usage Codex passé de 20x à 10x, caps GPT-6 Pro de 200 à 100/semaine) et lancé un plan Pro à 500 $/mois, si bien que l'économie réelle pour les abonnés serait plutôt de 2,5x. Un commentaire estime qu'OpenAI, profondément déficitaire, n'a pas d'autre choix que de remonter les prix, et d'autres voient dans la prix-écrémage une position classique de gamme avec un milieu volontairement dégradé pour pousser vers le haut.
Les retours de terrain sont contrastés : beaucoup jugent Sol 6 décevant (régressions par rapport à Sol 5.6, modèles « dégradés » après quelques jours selon certains), tandis qu'Opus 5.5 fait quasi l'unanimité pour le code et les tâches complexes ; un test image→html montre Opus supérieur sur la finition et les animations SVG, même si 6.1 Sol est rapide et bon marché. Les amateurs de DeepSeek soulignent qu'à 6 mois de retard la frontière « suffit largement » pour bien moins cher. Sur les benchmarks, un commentateur s'interroge sur des scores d'effort « high » supérieurs à « xhigh » et sur le protocole de test ; la course au prix est vue par certains comme signe de « commoditisation » de l'IA, bonne pour les consommateurs, inquiétante pour les investisseurs.
-
You Are No Longer Invited to Dinner
La fréquence des réceptions à domicile aux États-Unis s'est effondrée : d'après des enquêtes DDB Needham reprises par Robert Putnam dans Bowling Alone, puis répliquées par Data For Progress, la part des Américains recevant amis ou famille au moins une fois par mois est passée de 42 % en 1975 à 12 % en 2026, soit une baisse de 70 % en un demi-siècle. Les autres formes de sociabilité (jeux de cartes, bars, bénévolat) reculent également, et le temps passé chez soi a fortement augmenté depuis les années 2010, ce qui écarte l'idée d'un simple déplacement de la sociabilité vers les restaurants ou de nouvelles activités.
L'article explore plusieurs explications : le « loisir pressé » des ménages bi-acteurs, l'entrée massive des femmes sur le marché du travail depuis 1970 sans relais masculin sur l'organisation du calendrier social, le parenting intensif qui a fait exploser le temps parental, et le rétrécissement des réseaux d'amitiés, en particulier chez les personnes non mariées et modestes.
Les commentateurs nuancent fortement l'article sur le déclin des dîners entre amis. Plusieurs contestent d'abord la causalité « réseaux sociaux » : le déclin préexiste à Internet, et surtout l'omission du COVID est jugée flagrante — un graphique montrant une explosion du temps passé à domicile dès 2020 sans mentionner la pandémie serait une faille évidente ; plusieurs témoignages confirment que leurs habitudes sociales ont basculé autour du COVID, avec une anxiété résiduelle face aux rassemblements. Une correction factuelle importante est aussi apportée : l'enquête citée (DDB Needham) n'incluait que les ménages mariés avant 1985, ce qui fragilise la statistique de baisse de 70 %. Les causes avancées sont multiples et divergentes : obligation sociale héritée (les lettres d'une mère dans les années 70 révèlent une corvée subie plutôt qu'un plaisir), enfants surbookés par le sport et les activités rendant les réunions de couples quasi impossibles, épuisement des hôtes (un couple a arrêté de recevoir après s'être senti « une société de traiteur » avec des invités qui ne partaient jamais), accumulation d'objets et honte du désordre, ou encore hyperétiquette empêchant de proposer une visite sans invitation explicite.
Le clivage principal oppose les gens qui organisent et ceux qui ne le font jamais : un commentateur décrit organiser des fêtes comme une source d'énergie sociale fondamentale, tandis que d'autres rappellent que pour des introvertis c'est épuisant, et que les préférences évoluent avec l'âge — certains ont simplement cessé d'y trouver de l'intérêt. Plusieurs témoignages soulignent l'importance d'un hôte talentueux dans le foyer comme condition du maintien de ces traditions.
Des nuances culturelles complètent le tableau : en Espagne ou au Japon, on ne fait pas de dîners à l'américaine (logements trop petits, socialisation au bar ou au restaurant), ce qui relativise le constat. Un anecdote marquante illustre la défiance ambiante : un père jugeait « bizarre » que ses voisins l'invitent et proposent de garder ses enfants.
-
America.gov
Aucun contenu n'est disponible au-delà du titre « America.gov ». Impossible de déterminer le sujet réel de l'article ou de l'identifier à l'une des thématiques suivies.
La discussion autour du site America.gov, un chatbot gouvernemental propulsé par Gemini (Google est le partenaire annoncé), partage le locus sur un point : l'idée d'un assistant IA pour naviguer dans le labyrinthe des services publics est unanimement jugée excellente, car les sites gouvernementaux sont réputés illisibles et propices au phishing. Plusieurs commentateurs rapportent des tests concluants : recherche d'informations sur les allocations chômage, réponses correctes et contextuelles, et même le chatbot qui indique correctement le résultat de l'élection de 2020 (Biden, 306 grands électeurs). Un utilisateur note que le modèle télécharge côté navigateur un modèle ONNX de suppression de PII (50 Mo au premier chargement), ce qui serait une approche cohérente pour éviter que des données personnelles n'atteignent les serveurs.
Mais la exécution est critiquée : le site aurait été lancé trop vite, avec des images cassées dans les captures marketing, des erreurs CSS, des boutons inopérants, un chat qui renvoie des erreurs 429, et un Laptop qui gèle au chargement — d'où les accusations de « vibe coding ». Plusieurs nuances techniques sont apportées : d'aucuns s'interrogent sur la confidentialité réelle (les conversations disparaissent-elles vraiment, que conserve le fournisseur du modèle ?), d'autres répondent que des options de rétention nulle existent chez les grands hébergeurs. Un commentaire soulève un risque original : les boutons pouce vers le haut/bas pourraient être manipulés par des acteurs malveillants pour influencer un éventuel post-training. Le modèle serait protégé par des garde-fous solides contre les injections de prompt, et les rumeurs d'un modèle chinois sous le capot semblent infondées vu le partenariat Google.
Enfin, la discussion corrige l'article sur des détails factuels : une capture d'écran censée montrer la Caroline du Nord montrerait autre chose, et un passeport noir affiché en « coming soon » ne correspond à aucun passeport américain standard.
-
Dots: Always-on agents
Présentation de « Dots », un projet décrit comme des agents toujours actifs (always-on). Le texte disponible se limite au titre ; aucune information supplémentaire n'est fournie.
La discussion autour de Dots (agents toujours actifs d'OpenAI) tourne moins autour du produit lui-même que de la stratégie des grands labos : plusieurs commentateurs voient dans ces agents une couche d'abstraction destinée à verrouiller les utilisateurs, l'intégration aux comptes, l'historique de travail et la mémoire rendant le changement de fournisseur coûteux, alors que les modèles eux-mêmes deviennent des commodités. Un utilisateur illustre ce verrouillage avec ses tâches récurrentes ChatGPT (veille politique, musique, livres) qui l'empêchent de partir ; d'autres décrivent des parades techniques (harnais agnostiques, OpenWebUI, fichiers de configuration centralisés dans des dépôts git, wrappers CLI) pour rester transférables entre outils.
-
How Delhi cut electricity loss from 50 to 5 percent
Récit détaillé de la modernisation du réseau électrique de Delhi : au début des années 2000, la capitale indienne subissait des coupures quotidiennes et perdait plus de la moitié de son électricité (équipements obsolètes et vols). En vingt-cinq ans, grâce aux efforts du gouvernement et des distributeurs (notamment Tata Power), les pertes sont passées de plus de 50 % à 5-6 %, et l'indice de fiabilité de 70 % à plus de 99,9 %.
L'article explique les causes techniques des pertes (courant réactif, résistance des lignes, surcharge de réseaux vieillissants) et décrit les remèdes appliqués : remplacement des lignes aériennes par des câbles souterrains, modernisation des compteurs et des équipements, meilleure responsabilisation des distributeurs. Le mix électrique de la ville repose pour près de moitié sur le charbon, avec du gaz naturel et de l'hydraulique.
L'auteur, professeur en systèmes électriques, présente cette transformation comme un modèle pour d'autres régions (Albanie, Argentine, Bangladesh, Brésil, Kenya, Pakistan…) qui subissent encore des pertes massives dans leurs réseaux de distribution.
Les commentateurs s'accordent à saluer l'exploit décrit par l'article : la réduction des pertes d'électricité à Delhi de 50 % à 5 %, attribuée avant tout à la privatisation de la distribution au profit de Tata Power et BSES, qui a modernisé l'infrastructure et fermé les_failles de corruption. Plusieurs résidents de Delhi confirment le changement de terrain : coupures quotidiennes dans les années 1990, amélioration dès 2000, quasi-disparition des délestages après 2006. Un commentaire nuance la terminologie (les délestages sont des coupures programmées, publiées dans la presse). D'autres précisent que la tarification est restée stable et soulignent que la clé fut autant politique que technique : la volonte d'appliquer les règles face au vol d'électricité, parfois toléré voire organisé politiquement (exemple chiffré d'Hyderabad : environ 2 millions de kWh perdus par jour, soit 50 à 60 millions de dollars par an, avec des collecteurs de factures menacés par des élus locaux).
-
DraftKings Is Using AI to Behaviorally Target Chronic Gamblers
DraftKings entraîne un modèle de machine learning sur les historiques de paris de ses clients pour identifier les parieurs perdants, puis leur envoie des publicités ciblées pour les inciter à revenir parier. Le New York Times relève que les « joueurs problématiques » sont particulièrement susceptibles d'être ciblés par ces promotions.
L'EFF, à l'origine de l'article, y voit une illustration des dangers de la publicité comportementale amplifiés par l'IA : les modèles incitent à collecter toujours plus de données, fonctionnent comme des boîtes noires, et alimentent une industrie de la surveillance dont se saisissent aussi assureurs, banques et agences fédérales comme ICE ou CBP.
DraftKings utilisant uniquement des données de première partie, l'EFF estime que limiter le partage de données tierces ne suffirait pas et plaide pour une interdiction pure et simple de la publicité comportementale.
La discussion confirme l'article sans réel débat : les commentateurs s'accordent massivement sur le fait que DraftKings cible délibérément les joueurs les plus addictés, et que ce comportement est structurel dans toute l'industrie du jeu. Un point factuel notable corrige l'intuition de plusieurs : on pourrait croire que les revenus proviennent des « whales » au jeu pari-mutuel, mais une étude de 2024 du Connecticut montre que 1,8 % des joueurs problématiques génèrent 51 % des revenus des paris sportifs — le modèle repose donc bien sur les perdants chroniques, pas sur une commission neutre. Plusieurs témoignages de terrain illustrent cette réalité : un ancien cadre raconte que lorsqu'un gros joueur veut faire une pause, le service VIP lui offre voyages et attentions pour le retenir ; un autre a quitté son poste dans une loterie d'État ciblant les acheteurs compulsifs parce qu'il jugeait cela moralement inacceptable. Un ancien de l'adtech précise que DraftKings et FanDuel refusaient d'être qualifiés d'entreprises de jeu, et qu'il a couvert 250 M$ de marketing à Boston dès 2015.
Le clivage porte moins sur les faits que sur la réponse à y apporter. Certains estiment que l'interdiction est possible et que le pari en ligne n'est pas une institution séculaire (il n'existait pas il y a 15 ans) ; un commentateur cite le Brésil qui vient d'interdire les plateformes de jeu. D'autres balaient la surprise : toute entreprise vendant un produit addictif agit ainsi, et un ancien du secteur « gaming » affirme que cela concerne toute l'industrie depuis le début des années 2010. Sur la régulation, un désaccord technique apparaît : faut-il encadrer l'usage de l'IA ou interdire le comportement lui-même ? Un commentateur nuance aussi le terme « AI » : il s'agit de simples modèles de machine learning, en citant Money Stuff qui pointe que chez DraftKings, la fonction qui identifie les clients rentables et celle qui « protège » les joueurs à risque trouvent les mêmes personnes.
-
500k facial scans at UK stations yield no arrests, 1 false positive
Un essai de six mois de reconnaissance faciale en temps réel (LFR) mené par la British Transport Police dans les gares londoniennes a coûté plus de 320 000 £ et mobilisé près de 100 heures de temps policier, pour un bilan d'une seule alerte, s'étant révélée être une fausse identification, et aucune arrestation directe. Plus de 500 000 visages ont été scannés entre février et juillet dans les principaux hubs de transport de la capitale.
Malgré ces résultats, le BTP a annoncé l'extension de l'essai de quatre mois supplémentaires, étendue aux stations du London Underground, avec le soutien de Transport for London, qui présente la technologie comme un moyen de lutter contre les violences faites aux femmes. Trois alertes positives ont été signalées depuis l'extension. Selon Liberty Investigates, plus de la moitié des forces de police d'Angleterre et du Pays de Galles déploient désormais la LFR, et la mairie de Londres prévoit des caméras fixes dans le West End et sur Oxford Street.
Des critiques s'élèvent : un rapport du comité parlementaire conjoint sur les droits humains qualifie le déploiement de la LFR d'« exemple particulièrement clair de risque », la députée Bell Ribeiro-Addy demande une suspension en l'absence de cadre juridique et de garanties renforcées.
Les commentateurs s'accordent largement pour y voir un outil de surveillance coûteux et peu efficace : 500 000 scans sur six mois pour zéro arrestation et un faux positif paraissent, à première vue, un échec cuisant, et plusieurs comparent le résultat aux caméras Flock/ALPR installées aux États-Unis dans de petites villes sans criminalité violente, qui ne servent qu'à verbaliser des enregistrements de véhicules périmés — tout en étant présentées comme des « outils de lutte contre le crime ». Le débat sur la rentabilité (ROI) revient souvent : pour certains, l'objectif réel n'est pas de prévenir le crime mais de justifier des budgets ou de rassurer l'électorat.
Cependant, la discussion corrige et nuance fortement le titre de l'article. Un commentateur précise que la watchlist ne contenait qu'environ 450 personnes, ciblées par la police des transports, que le dispositif était affiché, actif seulement 3 à 6 heures par jour, avec des itinéraires alternatifs non filmés — des conditions qui expliquent en partie l'absence d'arrestations, les suspects contournant simplement les caméras. D'autres rappellent qu'un scan équivaut à peu près à deux jours de trafic de Liverpool Street, et que beaucoup de visages scannés sont des habitués. On cite aussi un autre déploiement britannique revendiquant 103 arrestations et une baisse de 12 % de la délinquance, ce qui tempère la conclusion d'échec. Plusieurs s'accordent néanmoins que le fardeau de la preuve incombe au système : démontrer son efficacité et son coût, y compris les externalités sur la vie privée.
Au-delà du bilan, deux inquiétudes ressortent : l'effet d'escalade (« si ça ne marche pas, c'est qu'il n'y en a pas assez » — le projet est déjà prolongé et étendu au métro londonien) et la crainte d'une dérive d'usage, notamment la lutte anti-fraude tarifaire comme future justification officielle. Un commentateur rapporte de l'intérieur que la signalisation prévenant du filtrage permet aux criminels d'emprunter la route non enregistrée. Un avis minoritaire estime au contraire que caméras et IA peuvent améliorer la sécurité, notamment pour les femmes, dans un système judiciaire britannique jugé plus fiable qu'ailleurs.
-
macOS Golden Gate Is a Buggy Mess
L'auteur dresse un inventaire critique des bugs de macOS 27 « Golden Gate », version présentée par Apple comme une année de stabilité et de raffinements à la manière de Snow Leopard, après les déconvenues de Tahoe. Il recense des défauts d'alignement dans l'interface, des éléments oubliés (guide utilisateur de l'an dernier, anciens logos de Siri), des bugs fonctionnels variés — crashs de la barre de menus, recherche de System Settings défaillante, fenêtres mal dimensionnées, jusqu'au gel complet du système via l'outil pipette — et des détails de finition discutables. Il conclut qu'une version « sans rien de sacrifié » ne devrait pas comporter autant de défauts faciles à trouver en usage quotidien, et suggère que le cycle annuel de publication pourrait être en cause.
La discussion révèle un fort clivage : pour plusieurs commentateurs, macOS 27 « Golden Gate » est au contraire une nette amélioration par rapport à Tahoe (macOS 26) — l'un cite même la correction de vieux bugs audio, un autre note un bug ancien du Dock enfin résolu — tandis que d'autres décrivent un système toujours bancal. Plusieurs estiment que l'article est de mauvaise foi ou hyperbolique : les problèmes cités (centrage d'icônes, zoom 20x, détails esthétiques) seraient des nitpicks, l'auteur utiliserait des utilitaires tiers perturbant la barre de menus, et certains bugs attribués à macOS relèveraient en réalité de Firefox. Un commentateur rappelle que des verres anamorphiques produisent des lentilles ovales, corrigeant l'argument de l'article sur la caméra.
Les critiques sérieuses concernent surtout Mission Control, jugé inutilisable par plusieurs retours : raccourcis de changement d'espace cassés après la sortie de veille, miniatures décalées, fenêtres qui se réorganisent aléatoirement, espaces plein écran défaillants, scintillements. S'y ajoutent des doubles-clics ignorés dans le Finder, des fenêtres vides après une recherche, des options supprimées (affichage des fichiers cachés non persistant), Safari et les outils de développement qui gèlent, et un iOS 27 signalé pour sa lenteur et sa consommation de batterie. Un utilisateur d'Ableton rapporte que sa DAW est cassée malgré les corrections audio.
Au-delà des bugs, le débat porte sur la qualité globale de macOS : beaucoup s'accordent sur une dégradation continue sur une décennie, Sequoia → 26 → 27 restant une régression même si 26 → 27 améliore. La culture du « shippage » à date fixe et le rythme annuel de publication sont mis en cause. Côté pratique, plusieurs partagent leurs stratégies : ne pas mettre à jour avant février (voire x.2.2), sauter des versions, ou rester sur Sequoia — jugeant qu'« il n'y a aucun bénéfice à passer à Golden Gate ». Un avis plus conciliant souligne que cette version est la première orientée entreprise, avec des travaux sous le capot pour les admins IT, et qu'il faudrait réserver les plaintes aux vraies défaillances plutôt qu'à l'alignement des boutons.
-
Ask HN: What are you reading?
Fil de discussion « Ask HN : que lisez-vous ? », sans contenu disponible au-delà du titre. Aucune thématique traitée.
Ce fil « Ask HN: What are you reading? » est une simple collecte de recommandations de lectures, sans débat ni contradiction à signaler : la discussion n'apporte rien au-delà d'une longue liste de titres et d'impressions personnelles.
Quelques lignes de force se dégagent. La fiction domine largement : la série Dungeon Crawler Carl de Matt Dinniman revient plusieurs fois comme lecture plaisir après le travail, tout comme les classiques de SF — Vernor Vinge (A Fire Upon The Deep, A Deepness In The Sky), Cryptonomicon et Neal Stephenson, Le Problème à trois corps, Philip K. Dick. Plusieurs commentateurs citent aussi des classiques littéraires : Lonesome Dove, décrit avec humour comme du « horsepunk » par un lecteur qui détestait les westerns avant de l'adorer, L'Est d'Éden, Le Comte de Monte-Cristo (un lecteur avoue avoir abandonné après la quarantième introduction de personnage), Musashi de Yoshikawa — étonnamment moderne et à l'origine de nombreux tropes du manga et de l'anime —, ainsi que Le Maître et Marguerite et Paradise Lost, qualifié de lecture « studieuse ». Côté non-fiction, les praticiens mentionnent Thinking in Systems de Donella Meadows (vu comme un cadre accessible pour nommer des intuitions), Deep Work de Cal Newport, A Philosophy of Software Design d'Ousterhout, The Design of Everyday Things de Don Norman, et 10x Org, qui argumente avec le « paradoxe Ferrari » : donner une Ferrari à tout le monde n'améliore pas le trafic, de même qu'imposer la vitesse par l'IA.
On note aussi une curiosité originale pour Peter Kingsley, académique mystique soutenant que les origines de la civilisation occidentale sont mystiques plutôt qu'intellectuelles (Parménide, Empédocle), hélas indisponible en Kindle, et pour The Nature of Tyranny d'El Kawakibi, texte arabe centenaire jugé très actuel. Un commentateur partage enfin la liste des « top geek novels » du Guardian d'il y a vingt ans, qui fait le bonheur des threads de ce type.
-
A Privacy Analysis of Web and Mobile Conversational AI Agents [pdf]
Une analyse (PDF) de la vie privée des agents conversationnels IA sur le web et sur mobile. Aucun contenu supplémentaire n'est disponible au-delà du titre.
L'article présente une étude montrant que de nombreux fournisseurs d'agents conversationnels (web et mobile) transmettent à des tiers (régies publicitaires, services de tracking comme Datadog) des artefacts dérivés des conversations : titres, prompts, captures d'écran, souvent accompagnés d'identifiants persistants permettant l'attribution à un utilisateur. Certains exposent même des permaliens de conversation sans contrôle d'accès, lisibles par les trackers.
Les commentateurs sont massivement peu surpris : plusieurs estiment que c'est « le modèle économique, pas une fuite » et critiquent le vocabulaire de l'article, qui déresponsabiliserait ces pratiques volontaires. Un commentaire nuance toutefois en soulignant l'absurdité stratégique : ces données partent vers des régies concurrentes directes des fournisseurs d'IA, ce qui suggère des implémentations bâclées sous pression des investisseurs — confirmé par un retour de terrain sur des plateformes IA « vibecodées » jamais testées. Un avis suggère au contraire qu'OpenAI n'a pas intérêt à divulguer ces données : mieux vaut les garder en interne pour cibler soi-même les publicités (modèle Meta), mais d'autres répliquent que ces entreprises ont besoin d'argent immédiatement. Plusieurs points concrets : un utilisateur a observé que ChatGPT envoie au serveur les prompts non terminés en cours de frappe (endpoint « conversation/prepare »), permettant théoriquement de suivre le rythme d'écriture et l'évolution des idées ; d'autres dénoncent les URLs à UUID comme fausse-garantie de confidentialité (security by obscurity, écho du scandale d'indexation des artefacts Claude par Google) et rappellent que la « confidentialité » est vendue comme argument des plans entreprise sans raison de croire qu'elle y soit réelle. Une limite de l'étude est notée : elle ne couvre pas le traitement des données API, ni le moment exact d'envoi des artefacts.
Les conclusions partagées : ne rien confier de sensible à un modèle cloud, préférer les modèles locaux ouverts ou les interfaces intermédiaires (Open WebUI, TypingMind), et s'attendre à ce que la publicité finisse intégrée directement dans les modèles.
-
Show HN: Real-time Solar System with 526k asteroids and all tracked satellites
Un projet « Show HN » présente une visualisation en temps réel du système solaire, avec 526 000 astéroïdes et l'ensemble des satellites suivis. Aucun contenu supplémentaire n'est disponible au-delà du titre.
Le projet, présenté par son auteur, agrège des TLE de CelesTrak (propagation SGP4), les astéroïdes et comètes du JPL SBDB et les positions de sondes via JPL Horizons, le tout mis à jour quotidiennement et rendu en WebGL2 sans moteur, avec la propagation exécutée dans des web workers. Plusieurs commentateurs saluent la fluidité : l'auteur précise qu'aucun culling n'est utilisé — le vertex shader résout l'équation de Kepler pour chaque astéroïde à chaque frame, le CPU ne les touche presque pas. Développé en « quelques soirées » comme sous-produit d'un autre projet, sans dépôt GitHub public pour l'instant.
-
US sanctions force The Netherlands off Microsoft and toward alternative NixOS
Après les sanctions américaines contre la Cour pénale internationale (CPI) à La Haye — qui ont privé son procureur général de l'accès aux services Microsoft, dont la messagerie — le gouvernement néerlandais a lancé le programme DAWO (Digitaal Autonome Werkomgeving Overheid) afin de réduire sa dépendance aux logiciels et services américains.
Le système repose sur NixOS, dont le gestionnaire de paquets Nix permet des configurations immuables, signées et facilement reproductibles d'une machine à l'autre (jusqu'à 90 % de configuration transférable), et qui peut tourner sur des machines réusées par Windows 11. Trois prestataires (SSC-ICT, DICTU et DUO-ICT) sont chargés du déploiement, sous la supervision du ministère de l'Intérieur. Huit municipalités testent la plateforme, avec une première version stable attendue fin 2027.
Les Pays-Bas ne sont pas les seuls : l'Allemagne a déjà abandonné les systèmes Microsoft, tandis que le Danemark et la France mènent des réflexions similaires sur la souveraineté numérique européenne.
La discussion porte sur la migration du gouvernement néerlandais (et de l'ICC, touchée par les sanctions américaines qui ont bloqué l'accès des juges à leurs comptes bancaires et services Microsoft) vers NixOS. Les commentateurs s'accordent sur le fond : la dépendance à un prestataire américain est devenue un risque géopolitique, et les sanctions agissent comme un catalyseur de souveraineté numérique européenne. Plusieurs voient cette migration comme une « bénédiction déguisée », l'occasion de quitter Windows et de développer une infrastructure de paiement domestique, plutôt qu'une sanction subie.
Le débat se cristallise sur le choix de NixOS. Un commentateur s'interroge sur la logique de ne pas standardiser l'UE autour de SUSE, distribution éprouvée déjà présente en Europe ; on lui répond que les Pays-Bas craignent une revente de SUSE à un fonds de private equity américain, et qu'un commentaire précise que NixOS a une forte communauté néerlandaise. Un autre fait valoir que les Pays-Bas avaient déjà utilisé openSUSE puis Fedora, mais ont choisi NixOS car aucune entreprise ne la contrôle, ce qui renforce la souveraineté. D'autres ironisent sur le goût de la bureaucratie européenne pour des technologies « bizarres » (Scala, Flatpak, NixOS). Un précédent est rappelé : la migration de Munich sous Linux, qui aurait été annulée après un changement de gouvernement — d'où le pessimisme de certains sur la pérennité du projet après les prochaines élections néerlandaises.
Sur le fond géopolitique, les avis divergent : certains voient dans les sanctions américaines une destruction du soft power américain, d'autres rappellent que plus de la moitié du chiffre d'affaires des géants tech vient de l'étranger et qu'en pratique l'Europe reste un client majeur sans dégradation notable constatée. Un commentateur nuance l'article en soulignant que le passage de l'OS de bureau ne règle pas en soi l'accès aux e-mails ou aux services bancaires bloqués par les sanctions — la réponse étant que le gouvernement veut anticiper une extension possible des sanctions aux licences OS.
-
Vermont replacing power plants with home batteries
Au Vermont, le programme de batteries domestiques de Green Mountain Power (GMP) a donné naissance à la plus grande source d'énergie de l'État : une centrale virtuelle agrégeant plus de 5 500 batteries installées chez des particuliers pour 55 $ par mois sur un bail de 10 ans.
Ces batteries protègent les foyers des coupures de courant, fréquentes dans cet État rural sujet aux tempêtes et inondations, tout en étant pilotées par logiciel pour réduire la demande au niveau du réseau. GMP, qui dessert plus de 75 % du Vermont, a ainsi pu décommissionner des centrales de pointe au fioul et au gaz, et vise l'élimination totale des coupures d'ici 2030, allant jusqu'à proposer d'offrir des batteries à certains clients.
Les centrales virtuelles représentent déjà plus de 40 GW aux États-Unis, et un rapport du ministère de l'Énergie estime que 160 GW pourraient être débloqués d'ici 2030, soit environ 20 % de la demande de pointe attendue, à un coût souvent bien inférieur à celui des centrales d'appoint traditionnelles.
La discussion dépasse largement l'article et apporte plusieurs corrections factuelles. Un commentateur signale que le chiffre de 110 MW avancé est faux : il s'agit de 53 MW de batteries domestiques, soit, selon ses calculs basés sur une consommation moyenne de 621 MW, environ 1 % des besoins quotidiens du Vermont. Il souligne aussi que l'État importe 73 % de son électricité (notamment l'hydroélectricité d'Hydro-Québec, dont les réservoirs stockent une énergie sans commune mesure) et juge « stupide » de vouloir remplacer de la génération par du stockage. D'autres nuancent fortement ce point : les batteries ne visent pas à remplacer la production de base mais les centrales « peaker » activées aux pics de demande, et deux de ces centrales ont effectivement été fermées dans le Vermont grâce au programme.
Les retours de terrain sont nombreux et plutôt positifs : un participant au programme (en place depuis 8-9 ans) décrit des batteries louées à ~55 $/mois incluant deux Tesla Powerwalls, qui ont remplacé un générateur et protègent des coupures, avec déconnexion automatique du réseau virtuel en cas d'orage. Des témoignages comparables viennent de Caroline du Nord (~50 $/batterie/mois, mobilisation jusqu'à 36 fois par an) et d'Australie, où la tarification de gros aux 5 minutes permet de gagner quelques centaines de dollars lors de pics de prix. Plusieurs s'accordent sur le modèle gagnant-gagnant : le foyer gagne de l'argent, le réseau évite d'allumer des centrales fossiles aux pics.
Les critiques portent sur les limites structurelles : un praticien craint un « death spiral » du réseau (les autosuffisants se déconnectent, chargeant les autres) et rappelle que les économies viennent surtout des frais de distribution évités, pas de l'arbitrage énergétique ; d'autres répondent que le Vermont, avec ses arbres et son manque de soleil, s'y prête peu. Un obstacle concret est signalé : le code du bâtiment impose 3 pieds entre les batteries et toute ouverture, ce qui a dissuadé un candidat faute de mur assez large — alors qu'un générateur au propane, également dangereux, passe sans problème.
-
PS5 Relapse Exploit
Publication de « Relapse », un exploit pour PS5 fonctionnant sur les firmwares 7.00 à 13.60. Il combine un exploit WebKit (fuites d'info JSC et corruption de typedarray via un mismatch de pool d'objets structured clone) et un exploit noyau (fuite d'adresse combinée à une race UAF sur aio_multi_wait) pour obtenir une lecture/écriture kernel, avec un loader ELF écoutant sur le port 9021.
L'auteur précise que le navigateur peut nécessiter plusieurs tentatives et que l'exploit kernel peut faire planter la console. Le projet est destiné à des fins éducatives et de recherche en sécurité, exclut tout usage pirate, et crédite plusieurs développeurs de la scène (Sonic_Iso, Jordy, TheFlow, Sleirsgoevy, etc.).
La discussion porte sur un exploit (« Relapse ») permettant le jailbreak de la PS5, fonctionnant sur les firmwares antérieurs à la 13.6 et corrigé dans la 14.0, qui exploiterait une faille dans JavaScriptCore (le moteur JS de WebKit). Plusieurs commentateurs s'étonnent que Sony utilise des technologies web pour son interface système, ce qui élargit la surface d'attaque, et se demandent si Sony désactivera le JIT pour se protéger — au risque de dégrader les performances de l'UI.
Les usages attendus se concentrent sur quelques thèmes : la sauvegarde des sauvegardes de jeux sur USB, interdite par Sony au grand dam d'un parent dont la fille a perdu un an de sauvegardes Minecraft (ce qui le fait hésiter sur une prochaine console Sony) ; l'installation de Linux, qui nécessiterait toutefois un exploit hyperviseur supplémentaire selon plusieurs commentateurs — l'exploit étant au niveau kernel, il ne suffit pas encore. On évoque aussi le portage d'émulateurs (un port d'Eden pour Switch tourne déjà sur PS5), un projet « AnyPS5 » pour jouer à des jeux Steam, et la perspective que GTA VI, non sorti sur PC, soit un moteur majeur de décompilation/recompilation assistée par LLM une fois copié depuis une console hackée. Un ancien de la scène note un changement d'époque : des nouveaux venus découvrent des failles avec l'aide de l'IA et les divulguent immédiatement, laissant Sony les patcher avant exploitation.
Le débat sur la légitimité du hack divise : plusieurs jugent aberrant de devoir hacker du matériel légalement possédé pour en avoir le contrôle total, quand d'autres rétorquent que les restrictions sont connues à l'achat et que Sony vend ses consoles à perte, son modèle reposant sur la vente de jeux — d'où l'impossibilité d'un « PS5 jailbreaké officiel ». Un commentaire critique le disclaimer « éducatif » du projet comme un euphémisme couvrant la piraterie, ce qui est contesté : la piraterie passe historiquement plutôt par des puces modifiées que par ce type d'exploits. Des digressions (split-screen sur PS3, manettes accessibles, consoles Apple hypothétiques) n'apportent rien d'essentiel.
-
NASA asked several former SR-71A staffers to help secret restart
D'après Aviation Week, la NASA aurait secrètement lancé un projet de remise en vol du SR-71A Blackbird (Tail No. 844), retiré de son mât d'exposition à Edwards AFB début 2025 et placé dans un hangar. L'agence a proposé des contrats à d'anciens ingénieurs d'essai du programme, dont Mike Relja et Tim Conners, qui expriment de sérieux doutes sur la faisabilité : moteur non entretenus depuis près de 30 ans, stock de pièces détachées détruit en 2007, carburant JP-7 et équipements au sol disparus. Le processus n'a pas été confirmé officiellement, mais l'administrateur de la NASA Jared Isaacman a teasé un nouvel X-plane reprenant la silhouette du Blackbird lors du All-In Summit, dans le cadre d'une relance du programme d'aéronautique de l'agence.
La discussion reste très sceptique sur l'annonce du redémarrage d'un SR-71A par la NASA. Plusieurs commentateurs y voient un projet de prestige ou un choix budgétaire imposé politiquement — certains parlant explicitement de nostalgie déplacée, d'un « projet de vanité » coûteux, ou d'une manière pour la NASA d'obtenir des financements en se coulant dans les priorités actuelles (projets de prestige, applications militaires/hypersoniques) plutôt qu'un vrai besoin technique. Un avis minoritaire suggère même que l'histoire publique pourrait servir de couverture pour sonder l'intérêt autour d'un véritable programme classifié, dont les intéressés ne travailleraient pas sur le SR-71 lui-même.
Les obstacles concrets soulignés : les outillages, gabarits et pièces détachées (600 millions de dollars de spares) ont été détruits en 2007 — plusieurs précisent que « détruit » signifie très probablement refondu, donc irrécupérable, contrairement à l'espoir d'un commentateur de retrouver des outils ou pièces ; le carburant spécifique JP-7 n'est plus produit et aucun avion ne l'utilise ; les ravitailleurs doivent être reconverti ; et certaines connaissances de fabrication peuvent être perdues, comme l'illustre le cas du « Fogbank » dans l'arsenal nucléaire américain, recréé avec des procédés modernes trop « propres » qui ont dû être compensés en réajoutant des impuretés. Sur le choix de l'appareil, un débat technique porte sur le serial 61-7980, stocké à Edwards en extérieur mais sans doute plus complet, face à un exemplaire de musée (61-7964) probablement vidée de ses systèmes internes.
Les partisans du projet mettent en avant la valeur de préserver des expertises disparues : reconstruire un SR-71 enseignerait des méthodes transposables à d'autres technologies aérospatiales abandonnées, et l'expérience opérationnelle de systèmes analogiques résistants au brouillage GPS et aux cyberattaques serait utile aux ingénieurs actuels. D'autres répliquent qu'il existe des moyens modernes et moins coûteux d'obtenir des vols très rapides et très hauts, sans pilote ni soute à vie support, voire avec des moteurs classiques de chasseur poussés au-delà de Mach 3.
-
Backblaze drive stats for Q2 2026
Le rapport trimestriel Drive Stats de Backblaze pour le Q2 2026 porte sur 354 415 disques durs analysés. Le taux de défaillance annualisé du trimestre atteint 1,73 %, le plus élevé depuis un certain temps, avec 10 modèles sur 31 au-dessus de 3 % d'AFR. Trois modèles dépassent le seuil d'outlier (6,95 %) : un HGST 12TB (7,63 %), un Seagate 10TB (9,33 %) et un Seagate 14TB (8,26 %), pour des raisons d'âge ou de faible effectif. Les Seagate dominent le tableau d'honneur avec plusieurs modèles sans aucune défaillance.
Deux modèles HGST (4TB et 8TB) sont entièrement retirés du parc après environ huit à neuf ans de service, et aucun nouveau modèle n'apparaît pour le second trimestre consécutif, les déploiements se concentrant sur les disques de 20TB et plus, qui représentent désormais plus de 25 % du parc. L'AFR à vie s'établit à 1,41 %.
L'article explique aussi les technologies d'enregistrement : le SMR chevauche les pistes comme des tuiles de toit, permettant d'augmenter la densité de 10 à 25 %, au prix de contraintes de réécriture. Trois variantes existent (drive-managed, host-managed, host-aware). Le contexte industriel inclut l'annonce d'un disque UltraSMR 40TB par WD, avec une feuille de route vers 100TB d'ici 2029.
Le constat central de la discussion porte sur la fiabilité remarquablement améliorée des disques durs : un commentateur compare les données Backblaze de 2013 (~14 % de taux d'échec à 3 ans, durée de vie utile ~4 ans), 2021 (~14 % à 7 ans 9 mois, ~6 ans) et 2025 (~5 % à 10 ans, ~10 ans de durée de vie), et en déduit que l'ancienne règle du « remplacer à 5 ans » est dépassée. Plusieurs s'étonnent de cette progression et suggèrent que le segment HDD s'est déplacé vers des gammes de qualité, la consommation de masse étant passée aux SSD ; d'autres confirment de mémoire que les pannes étaient bien plus fréquentes au début des années 2000.
Les points de friction : d'abord, des critiques méthodologiques de l'article — un commentateur estime que l'analyse est mal menée car les taux d'échec sont confondus avec l'âge des disques, et demande des courbes de survie de Kaplan-Meier plutôt que des taux trimestriels ; une réponse cite la réponse de Backblaze à une critique similaire (données gratuites, analyse statistique avancée laissée aux lecteurs), ce qui nuance sans invalider la critique. Ensuite, des anecdotes personnelles divergent des statistiques : pannes précoces de WD Red 6TB et de Seagate IronWolf, ce qui rappelle que les données agrégées ne protègent pas des cas individuels.
Le contexte de marché domine le reste des échanges : hausse des prix (un même disque 6TB passé de 198 € à ~340 € en 18 mois), modèles haut de gamme réservés aux hyperscalers avec commandes « pré-allouées », et frustration vis-à-vis de la demande liée à l'IA. Plusieurs évoquent aussi l'usage des gros disques de forte capacité (lecture multi-journée, reconstruction RAID longue) : adaptés aux sauvegardes, archives et stockage objet avec erasure coding, pas au RAID classique. Sont également discutés l'absence de SMR host-managed chez Backblaze (surprenant, Dropbox l'utilisant depuis plus de 7 ans, mais coûts de développement jugés dissuasifs) et des soucis de fiabilité des SSD NVMe attribués à la chaleur.
-
Tcl/Tk 9.1
Annonce de la sortie de Tcl/Tk 9.1, nouvelle version du langage de script et de sa boîte à outils graphique. Aucun détail sur le contenu de cette version n'est disponible dans le texte fourni.
La sortie de Tcl/Tk 9.1 suscite surtout de la nostalgie et un consensus sur les qualités historiques de l'outil : Tk reste pour plusieurs commentateurs le système GUI le plus simple pour démarrer, et Tcl est loué comme langage d'extension embarquable, avec des interpréteurs multiples sans GIL ni sérialisation, un modèle de threading jugé en avance sur son temps. Un commentaire souligne le lien historique avec SQLite, dont D. Richard Hipp dit qu'il est « une extension Tcl échappée dans le monde sauvage ». Les usages de niche persistent : consoles Tcl dans les outils de CAO VLSI, scripting sur routeurs Cisco, serveurs type AOLserver (aujourd'hui Naviserver), et distributions Windows maintenues (BAWT/Magicsplat).
La discussion nuance pourtant l'enthousiasme : plusieurs rappellent que Tcl est moribond — absent du classement TIOBE, encore en 8.6 sur la plupart des distributions Linux (Arch), la migration vers 9.0 ayant été freinée par des incompatibilités, même si Fedora l'embarque depuis un an. Point critiqué : l'absence de support natif Wayland, prévu seulement pour Tk 9.2 l'an prochain via un projet GSoC. Un utilisateur note aussi que Perl/Tk est un fork dur qui n'a pas intégré les évolutions récentes de Tk. Sur le choix d'un langage de « glue » aujourd'hui, un avis estime que Lua serait préféré, tandis qu'un autre lui reproche son design « tout est table ».
Les apports concrets incluent l'amélioration de l'accessibilité dans Tk 9.1, saluée par un utilisateur malvoyant, et des retours d'expérience : un développeur ayant construit en quelques jours un banc de test hardware-in-the-loop avec les bindings Tcl de VxWorks, ou des observations que les LLM actuels (Claude) savent générer des applications Tcl/Tk complètes avec tests, la stabilité de l'API C rendant ce domaine propice à la génération de code. Grippe fréquente : l'annonce ne contient aucun screenshot des capacités du toolkit, comblé seulement par des liens communautaires (wiki.tcl-lang.org).
-
1 in 8 cancer cases worldwide are caused by infections, study finds
Une étude du CIRC (OMS) publiée dans The Lancet Oncology estime que les infections ont causé 2,3 millions de nouveaux cas de cancer dans le monde en 2024, soit 12 % du total. H. pylori (cancers gastriques), HPV (cancers du col et autres) et hépatites B et C figurent parmi les principaux agents responsables ; le virus d'Epstein-Barr, désormais reconnu, est lié à environ 260 000 cas. Les chercheurs soulignent de fortes disparités régionales selon l'accès au dépistage et à la vaccination, et au Canada, où la part attribuable est de 4 %, des experts appellent à renforcer la vaccination HPV et le dépistage de H. pylori.
La discussion apporte surtout des précisions et des mises en perspective plutôt que des critiques de l'article. Plusieurs commentateurs rappellent que la causalité infection → cancer n'est pas toujours évidente : certains s'interrogent sur le rôle possible d'une dégradation du système immunitaire, qui favoriserait à la fois l'infection et la croissance tumorale — beaucoup de personnes portent des virus sans développer de cancer. Un autre répond que cela dépend de l'infection, en citant des études sur le COVID qui affaiblit durablement le système immunitaire. Un contributeur apporte un éclairage historique utile : jusqu'aux années 1970, les infections virales étaient la théorie dominante de la cancérogenèse (découvertes de src, ras, EBV), avant que les recherches ne se concentrent sur les facteurs génétiques ; ces agents infectieux n'ont jamais disparu, ils sont simplement moins présents dans l'inconscient collectif.
Le fil insiste sur des interventions concrètes : plusieurs commentateurs recommandent fortement le vaccin HPV comme l'une des mesures préventives les plus simples, avec des témoignages de personnes vaccinées à 33, 51 ans, etc. Un point nuance l'article : le tabagisme augmente significativement le risque d'infection, ce qui entremêle les facteurs de risque classiques et infectieux. Un avis souligne aussi que le problème est en partie logistique : beaucoup de cancers liés à des infections disposent déjà de vaccins, de dépistages ou de traitements efficaces, mais l'accès et l'adoption sont très inégaux ; il suggérerait des estimations distinguant ce qui est évitable avec les outils existants de ce qui ne l'est pas.
Sur les facteurs de risque globaux, un commentateur rappelle que la majorité des cancers sont environnementaux, principalement liés à l'obésité, l'alimentation, le tabac et l'alcool — un autre note avec surprise le faible poids de l'alcool face à l'obésité et au régime alimentaire, ce qui rend selon lui le « moral panic » récent sur l'alcool exagéré, et pointe la viande transformée aux nitrates.
-
U.S. postal inspectors shut down website selling counterfeit postage labels
Le U.S. Postal Inspection Service a saisi le domaine LabelsBank.com et inculpé Faheem Akram, un ressortissant pakistanais de 33 ans, pour avoir allegedly vendu plus de 5,1 millions d'étiquettes d'affranchissement contrefaites de l'USPS, causant plus de 126 millions de dollars de pertes. Le site vendait des étiquettes à prix fixe, environ 2 dollars, quel que soit le poids ou la destination du colis, à plus de 5 000 clients. Akram est poursuivi pour conspiration pour frauder les États-Unis, contrefaçon de timbres-poste et fraude informatique ; les charges restent des allégations et il est présumé innocent.
La discussion montre que le phénomène est loin d'être isolé : plusieurs commentateurs rapportent avoir acheté sur eBay à des vendeurs utilisant ce type d'étiquettes contrefaites, avec un schéma récurrent — numéro de suivi valide affichant « Item seized - counterfeit postage », puis relivraison avec un nouveau numéro. Un rapport de l'inspecteur général de l'USPS, cité, confirmerait l'explosion de cette fraude cette année ; certains regrettent qu'il soit fortement expurgé sur les détails techniques, tout comme le mode opératoire exact reste inconnu (identifiants volés chez des transporteurs, cartes bancaires volées, remboursements après expédition, ou simple vol de timbres). Plusieurs s'étonnent qu'aucune vérification intégrée n'existe côté USPS et un praticien rapporte des failles équivalentes chez UPS, où une étiquette revendue peut être réutilisée à un autre poids et une autre adresse.
Les témoignages élargissent le sujet au-delà de l'article : un ancien détenu explique que les timbres servent de monnaie en prison (une « flat » de 20 timbres valait environ 13-14 $, un carnet 10 $), usage illégal rappelé par les inspecteurs postaux ; on évoque aussi la contrefaçon de timbres comme un vieux phénomène, et les solutions adoptées ailleurs — codes imprimables hachés en Allemagne très difficiles à falsifier, QR codes obligatoires au Royaume-Uni ayant éliminé le problème. Sur le fond, l'article est nuancé : l'auteur de la fraude, au Pakistan, est inculpé mais vraisemblablement pas arrêté, et plusieurs commentateurs doutent de l'efficacité des poursuites et suggèrent que la fraude identifiée ne serait que la partie émergée (un avis parle d'un facteur 100). Une question demeure sans réponse : comment de telles étiquettes passent le tri USPS aussi facilement, et combien d'autres opèrent à plus petite échelle.
Des digressions sur les stages de fraude et le nombre de chefs d'inculpation apparaissent, mais l'essentiel est là : le scepticisme domine quant à l'ampleur réelle du problème et la capacité de l'USPS à le prévenir.
-
GLM-5.3 and the spread of advanced cyber capabilities
Une analyse d'Anthropic (équipe Red Team) évalue GLM-5.3, dernier modèle de Zhipu AI (Z.ai), jugé capable de construire de manière autonome des exploits informatiques de bout en bout, au niveau de Claude Mythos Preview. Le modèle estime que cette capacité, réservée il y a cinq mois à un accès restreint via Project Glasswing (plus de 10 000 vulnérabilités trouvées par des défenseurs de confiance), se diffuse désormais via un modèle à poids ouverts publié sans garde-fous efficaces.
Les tests montrent que GLM-5.3 développe des exploits complets sur ExploitBench (50 réussites sur 410) et des détournements de flux de contrôle sur un benchmark interne (4 %), un seuil franchi par rapport aux modèles précédents comme Claude Opus 4.6 et GLM-5.2. En expérimentation avec des experts humains, le modèle a découvert et chaîné des vulnérabilités inédites dans le moteur JavaScript d'un navigateur sous Linux (divulgation faite au mainteneur), ainsi que des failles dans des pilotes sans fil et graphiques. GLM-5.3-Flash a aussi produit en 20 minutes d'attention humaine (8 heures de calcul, ~20 $) un exploit chaîné pour deux failles connues de Chrome, contournant la protection PAC sur ARM64.
La discussion est presque unanime pour lire l'article d'Anthropic sur GLM-5.3 comme une publicité involontaire (ou assumée) pour le modèle chinois : en détaillant ses capacités offensives en cybersécurité, Anthropic met en avant un modèle open-weight peu censoré, alors que ses propres modèles refusent couramment des travaux de sécurité légitimes. Plusieurs commentateurs rapportent des retours concrets dans ce sens : forensic et reverse engineering réussis avec DeepSeek ou Qwen, analyse d'une infection malware réelle, résolution de questions sur les buffer overflows refusées par Claude mais répondues immédiatement par un modèle chinois via OpenRouter. Un commentateur cite aussi l'incident Hugging Face où les modèles d'OpenAI et Anthropic bloquaient, forçant le recours à GLM pour l'analyse défensive.
Le consensus dominant y voit une stratégie d'intérêt privé plutôt qu'un avertissement de sécurité : avec un IPO annoncé et des résultats financiers faibles, Anthropic chercherait à préparer l'opinion (et surtout les régulateurs) à restreindre les modèles open-weight chinois, faute de moat technologique et de compétitivité prix/performance. Certains nuancent en soulignant le faible capital politique d'Anthropic auprès de l'administration Trump, et un avis minoritaire estime au contraire qu'un ban mondial des open weights ne servirait pas les intérêts des labs américains à long terme, qui profitent d'une escalade offense/défense subventionnée par la régulation. D'autres contestent la méthodologie : un taux de jailbreak de 0 % pour les modèles d'Anthropic suggère un cherry-picking ou un red teaming défaillant plutôt qu'une réelle sécurité.
Plusieurs corrections factuelles et mises en garde ressortent. Un commentateur précise que GLM 5.3 Flash n'est pas une version réduite de GLM 5.3 : ce sont des architectures et pretrains entièrement distincts (5.3 est un post-train de 5.2, 5.3 Flash est multimodal issu d'une autre lignée). Des praticiens notent aussi les contraintes pratiques de l'inférence locale : faire tourner GLM 5.3 en quantization 4-bit exige beaucoup de VRAM et de GPU coûteux.