Hacker News
-
Mario Meets Pareto
Article expliquant comment choisir la meilleure combinaison de personnage, kart, pneus et planeur dans Mario Kart 8 en utilisant le concept d'efficacité de Pareto. Les statistiques de vitesse et d'accélération créent des compromis, et certains choix sont dominés (ex. Koopa par Cat Peach ou Toadette). La frontière de Pareto permet d'éliminer objectivement les options sous-optimales, avant de choisir selon ses préférences. L'article généralise ensuite à d'autres problèmes multi-objectifs (qualité/coût, risques/rendements, etc.).
La discussion salue l'article pour sa pédagogie : présenter le Pareto à travers Mario Kart rend le concept accessible. Plusieurs commentateurs généralisent l'idée à d'autres domaines, comme le compromis sécurité/expérience utilisateur, en rappelant que l'on ne peut parler de trade-off inévitable que si l'on se trouve déjà sur la frontière. D'autres soulignent que tous les problèmes n'ont pas de solution unique : la frontière peut comporter plusieurs points efficaces, et l'optimisation peut devenir NP-hard.
Sur le fond, l'article est corrigé sur plusieurs points. Un commentateur affirme que l'accélération est en réalité peu importante dans Mario Kart, le choix optimal dépendant surtout de la vitesse et du mini-turbo. D'autres nuancent selon le contexte : pour un speedrun, Bowser est recommandé ; pour battre des novices, Toadette fait des merveilles ; et dans un groupe d'amis, choisir un personnage sous-optimal peut servir de handicap. Un échange précise que Rosalina n'est pas Pareto-optimale car Donkey Kong offre la même accélération pour plus de vitesse — la ressemblance visuelle vient de l'affichage superposé des statistiques entières.
Enfin, les commentaires apportent des ressources concrètes : lien vers la discussion précédente, un site appliquant la frontière de Pareto aux mini-PC, un outil d'optimisation par algorithme génétique, et des composants CSS pour reproduire les cartes 3D. Certains signalent des problèmes d'accessibilité : le site ne fonctionne pas bien sur mobile et le mode lecture ne montre pas le contenu interactif généré par JavaScript. La majorité reste néanmoins enthousiaste, même si quelques voix regrettent des exemples de la vie courante discutables, comme le critère « facile » pour un emploi.
-
AMD acquires Taalas to boost inference performance by etching models in silicon
AMD acquiert Taalas, une startup qui grave des modèles d'IA dans le silicium, afin d'améliorer les performances d'inférence.
La discussion s'accorde sur l'idée que la gravure de modèles dans le silicium pourrait rendre l'inférence extrêmement rapide et bon marché, ouvrant des usages inédits, comme l'augmentation d'information en temps réel ou la génération massive d'agents en parallèle. Plusieurs commentateurs comparent cela à la décodeur vidéo 4K ou au PhysX. Mais beaucoup s'inquiètent de l'obsolescence : les modèles évoluent si vite qu'un modèle gravé serait dépassé dès sa sortie. Un avis minoritaire répond que la vitesse compense largement : même un modèle plus faible peut devenir très utile si on peut l'exécuter 1000 fois plus vite, et que de nombreuses tâches ne nécessitent pas le meilleur modèle. Certains prédisent un modèle économique de revente de puces comme on achète un processeur, avec une obsolescence plus rapide.
Sur le plan technique, un praticien affirme avoir déjà fait tourner un modèle sur une carte AMD (Xilinx Kria) à 60k tokens/s avec les poids gravés en URAM/BRAM et sans DRAM dans la boucle, mais avec un petit modèle (3,16M de paramètres) et un contexte limité. Cela nuance l'article : la thèse de Taalas n'est pas entièrement nouvelle, et le bénéfice vient peut-être surtout de la grande quantité de SRAM. Plusieurs commentaires mentionnent que Cerebras fait déjà tourner des modèles comme Kimi ou GLM à 30x la vitesse normale. Un autre signale que Google travaille déjà sur des TPU avec modèles quantifiés. L'acquisition est jugée positivement mais avec un risque que l'équipe soit absorbée sans rien livrer.
La discussion corrige ou nuance l'article sur plusieurs points. Certains soulignent que le « gravé » n'est pas l'essentiel : ce qui compte, c'est d'avoir beaucoup de mémoire près du calcul. Un commentaire ironique note que le démo chatjimmy se plaint de ne pas tourner sur la puce. Plus important, un intervenant rappelle que les modèles d'il y a un an (o3, Opus 4.1, Gemini 2.5 Pro) sont déjà largement surpassés par des modèles presque gratuits, rendant la gravure risquée.
-
Crime Pays but Botany Doesn't
L'article est un guide informel pour apprendre la botanique en autodidacte : utilisation de la terminologie latine, notions de taxonomie et d'évolution, et recommandations de manuels (Plant Systematics, Raven's Biology of Plants, etc.). Aucun lien avec les thématiques technologiques ou économiques suivies.
La discussion est dominée par un large consensus : les commentateurs considèrent la chaîne YouTube « Crime Pays but Botany Doesn't » et son animateur comme une ressource exceptionnelle. Plusieurs citent des vidéos précises (Chicago River, un parking de New York, la série sur Tucson, Berkeley Bowl) et louent son approche qui mêle botanique, géologie, écologie urbaine et critique sociale. Son parcours improbable d'ancien cheminot devenu botaniste et ses talents de graffeur sont également mentionnés. Certains témoignent que la chaîne les a initiés à l'identification des plantes et à la compréhension des écosystèmes.
Un second fil concerne les outils et méthodes. L'application gratuite Flora Incognita est chaudement recommandée par deux commentateurs, l'un demandant si elle est supérieure à PlantNet. Le créateur d'un nouveau projet d'agrégation de données botaniques (meso.cloud) sollicite des retours. Un commentaire critique vivement le système linnéen, pointant des luttes politiques (l'exemple de l'acacia), un biais occidental et des rangs taxonomiques artificiels ; d'autres répondent que c'est une convention utile, comparable à l'anglais comme langue internationale, et qu'il ne faut pas jeter le bébé avec l'eau du bain. Ce débat nuance l'article qui semblait célébrer Linnaeus sans réserve.
Les retours de terrain apportent des correctifs concrets : un diplômé en horticulture relate des salaires très bas et qualifie la botanique de « travail d'amour ». Un autre conseille de se concentrer sur la santé du sol plutôt que sur les plantes elles-mêmes. Un commentaire estime que l'article relève du « comment dessiner une chouette », sous-estimant la complexité, mais un autre rétorque que des tutoriels existent. Enfin, plusieurs partagent un intérêt croissant pour les plantes avec l'âge, et l'un recommande une interview poignante d'un vieux botaniste (Gerould Wilhelm) sur la destruction des écosystèmes et le rôle de l'eau – un angle qui complète l'article sans le contredire directement.
-
Taste Is All That's Left
Un essai sur l'impact de l'IA générative sur le métier de développeur : alors que la distance entre l'idée et l'artefact s'est effondrée, la valeur se déplace vers le goût, ce jugement rapide et difficilement justifiable qui distingue le bon du plausible. L'auteur soutient que la friction (le coût de production) était le véritable curriculum qui formait ce goût, et que sa disparition risque de produire une génération fluide mais sans discernement.
Il examine aussi l'économie du goût : ceux qui l'ont ne sont pas récompensés car le marché mesure la vitesse, pas la qualité préventive. Il compare la production de masse de code « acceptable » au bullshit de Harry Frankfurt, et cite Sturgeon pour conclure que la baisse du coût de production rend le bruit infini, sans améliorer le signal.
La discussion tourne principalement autour de la notion de « goût » (taste) face à l'IA, avec des avis partagés. Plusieurs commentateurs contestent la thèse de l'article selon laquelle le goût serait le dernier avantage compétitif : l'un souligne que les concurrents copient rapidement les fonctionnalités et que le goût a une demi-vie de plus en plus courte, citant l'exemple du pull-to-refresh. D'autres défendent que le goût n'est pas seulement l'innovation mais la capacité à discerner des choix cohérents, et que des entreprises comme Microsoft n'ont jamais réussi à égaler le goût d'Apple malgré toutes leurs ressources. Un avis récurrent est que la qualité des logiciels générés par IA reste médiocre : un praticien déplore que les LLMs produisent du code bavard sans signal, nécessitant de lire 500 mots pour comprendre un module. Plusieurs commentaires insistent sur la distinction entre goût et jugement, ce dernier étant considéré comme plus fondamental, et renvoient à Kant ou Hume pour une analyse philosophique plus rigoureuse, critiquant au passage la myopie des développeurs. Certains défendent l'article avec gratitude, tandis que d'autres le jugent mal écrit et creux, allant jusqu'à soupçonner qu'il soit lui-même généré par IA : des vérifications avec des détecteurs comme Pangram indiqueraient une forte probabilité, mais un commentateur avoue que si c'est humain, il préférerait que ce soit de l'IA. La discussion corrige l'article en soulignant que « le goût n'est pas seulement ce qui reste », mais qu'il est aussi coûteux et difficile à maintenir : la première version d'un logiciel devient gratuite, mais comprendre pourquoi elle est subtilement fausse, la déboguer et la maintenir reste cher. Un commentateur compare à l'époque où le design a été automatisé par Figma : le goût a eu son moment puis s'est standardisé, et il prédit qu'il en sera de même pour l'IA.
-
Qwen3.8 Max now ranked as the best overall model by agentic index
Le titre annonce que le modèle Qwen3.8 Max est désormais classé meilleur modèle global selon l'indice agentique d'Artificial Analysis. Le corps du texte est une présentation de la plateforme Artificial Analysis, qui propose des évaluations indépendantes de l'intelligence, du coût, de la vitesse et de l'ouverture des modèles d'IA, avec divers classements et benchmarks (AA-Briefcase, AA-Omniscience, GDPval-AA, etc.). Aucun détail supplémentaire sur Qwen n'est fourni dans le texte.
La discussion tourne principalement autour de la fiabilité des classements d'Artificial Analysis. Plusieurs commentateurs constatent que les scores changent en quelques secondes, et l'un explique que la méthodologie vient d'être mise à jour. Un autre relève que la page dédiée aux agents de codage ne mentionne même pas Qwen, tandis que la page du modèle n'affiche pas le titre de « meilleur modèle » : l'article serait donc trompeur. Des avis divergent sur la validité des benchmarks : certains refusent de croire qu'Opus 5 puisse battre Fable 5, d'autres estiment que ces indices ignorent des aspects clés comme la clarté des comptes rendus dans un agent de codage.
Les retours d'expérience concrets sont contradictoires. Un commentateur loue Qwen pour le débogage, le jugeant meilleur que Kimi K3. Mais un autre le trouve bâclé, laissant des choses cassées et n'écrivant pas de tests. Plusieurs signalent que les modèles chinois (Deepseek, GLM, Kimi, Qwen) sont prometteurs mais incohérents, avec une variance de qualité plus élevée que les modèles OpenAI/Anthropic. Côté coûts, un utilisateur déplore d'avoir brûlé 260 $ de crédits Anthropic en 25 minutes sans résultat, tandis qu'un autre note que l'abonnement à 200 $ permet une utilisation intensive sans limite. Un commentateur affirme que les modèles open source ne peuvent pas augmenter leurs prix arbitrairement face à la concurrence, mais un autre remarque que Qwen Max coûte presque autant que GPT-5.6, sans bénéfice de confidentialité.
La discussion nuance fortement le classement : plusieurs commentateurs évoquent des problèmes de fiabilité et de communication avec Opus 5, certains préférant GPT-5.6 Sol. L'enthousiasme se porte surtout sur les futurs modèles plus petits, notamment Qwen 3.8 27B, qui pourrait tourner localement. Un commentateur mentionne que des modèles locaux comme DeepSeek 4 Flash quantifié sont déjà comparables à Opus pour un usage personnel. Enfin, une question sur la distillation reçoit des réponses techniques sur la génération d'exemples synthétiques et la nécessité d'obtenir les distributions de probabilité complètes.
-
GitHub Actions and Pages are experiencing degraded availability
GitHub Actions et GitHub Pages connaissent une disponibilité réduite. Les déclencheurs webhook sont limités, environ 15 % des événements sont traités, et 65 % des jobs en file d'attente aboutissent (en amélioration). Les runners auto-hébergés et hébergés par GitHub sont affectés, ainsi que Copilot code review, Copilot coding agent et les migrations Enterprise Importer.
La discussion porte principalement sur la répétition des pannes GitHub et leurs causes présumées. Plusieurs commentateurs relèvent des chiffres de croissance impressionnants : 275 millions de commits par semaine, et les minutes d'utilisation d'Actions seraient passées de 500 M/semaine en 2023 à 2,1 milliards actuellement. Un avis partagé par certains est que le trafic généré par les agents IA (commits automatiques, polling intensif, boucles de vérification) expliquerait cette surcharge, avec des retours de terrain confirmant une multiplication par 10 à 100 de l'activité réseau. D'autres rejettent cette excuse, estimant que Microsoft, propriétaire de GitHub, a les moyens de gérer cela et que la qualité s'est effondrée depuis le rachat. Un commentateur note que GitHub serait passé de « quatre neuf » de disponibilité à un seul, et que sur les 4 dernières semaines, 8 jours ont connu des pannes d'Actions, souvent de plusieurs heures.
Un point largement souligné est que même les runners auto-hébergés sont affectés, car c'est l'API d'orchestration des workflows qui tombe en panne, pas seulement l'infrastructure d'exécution. Plusieurs praticiens décrivent des files d'attente bloquées pendant plus de 7 heures, y compris avec des runners tiers comme Blacksmith. La discussion contraste avec l'article en montrant que le statut de GitHub a parfois annoncé un retour à la normale avant de se rétracter, ce qui aggrave la frustration. Certains proposent des alternatives : GitLab, Forgejo auto-hébergé, ou des services comme Hugging Face Jobs pour exécuter les pipelines, mais un commentateur fait remarquer que ces solutions dépendent souvent encore de GitHub pour le déclenchement.
Un débat oppose ceux qui veulent migrer immédiatement et ceux qui jugent le coût de changement supérieur aux inconvénients malgré tout. Un commentateur chiffre : « GitHub Actions étant down si souvent coûte toujours moins cher que de tout migrer ». D'autres estiment que la réputation de GitHub se dégrade rapidement et que l'entreprise ne semble plus « sérieuse ».
-
Almost no skill required to cook a steak
L'auteur compare la cuisine d'un steak réussi au développement logiciel avec l'IA. Cuisiner un steak correct demande peu de compétences, mais un vrai bon steak exige de comprendre la cuisson, le matériau et le jugement. De même, l'IA permet de produire beaucoup de code rapidement, mais les résultats sont inconstants : parfois excellents, parfois convaincants mais faux. Payer des outils ou agences premium ne résout pas toujours le problème, car ils reposent souvent sur les mêmes modèles.
Il conclut que pour bien utiliser l'IA, il faut apprendre à « cuisiner » : comprendre le code, savoir formuler ce qu'on veut, évaluer les résultats et détecter les erreurs. L'IA automatise le répétitif et accélère, mais ne remplace pas le jugement, la définition de la qualité ou les arbitrages. La solution est de continuer à apprendre, échouer et maîtriser le sujet, plutôt que d'espérer un résultat parfait sans effort.
La discussion conteste l'analogie centrale de l'article : cuire un steak ne demanderait presque aucune compétence, ce qui affaiblit la comparaison avec le développement logiciel. Plusieurs commentateurs soulignent qu'avec un thermomètre à viande et la technique du 'reverse sear', obtenir un excellent steak est à la portée de tous ; l'un d'eux estime même que c'est l'un des plats les plus faciles à maîtriser. D'autres rétorquent que cela suppose quand même des connaissances (choisir la coupe, connaître les températures, le repos) et un équipement que peu de cuisiniers amateurs possèdent. L'article est également accusé de parler au nom de tous les ingénieurs avec un 'nous' jugé abusif, et plusieurs commentaires pointent un texte probablement généré par IA (détecté comme tel par l'outil Pangram).
Sur le fond, les commentateurs s'accordent sur des recettes concrètes : méthode du grill avec rotation à 90°, cuisson 2 minutes par face, ou encore la technique du 'cold sear' de Lan Lam présentée comme infaillible. Certains mentionnent des appareils comme l'Optigrill ou le grill à IA Perfecta, ce qui relativise la difficulté. Un commentaire remarque que la demande en logiciels n'est pas la perfection mais des compromis coût/délai, citant GitHub comme exemple de code imparfait assumé.
Enfin, le débat glisse vers l'IA et l'ingénierie : certains y voient un outil pour augmenter la réflexion humaine, d'autres un remplaçant potentiel des ingénieurs, réduits à des 'utilisateurs avec du goût'. Un avis minoritaire affirme que les agents d'IA réussiront seuls, tandis qu'un autre insiste sur la nécessité de comprendre les décisions d'architecture. Plusieurs commentateurs expriment leur lassitude face aux articles sur l'IA, et l'un d'eux ironise sur le fait que l'auteur voulait juste attirer l'attention. Globalement, la discussion apporte plus de recul sur l'analogie que l'article, mais sans trancher.
-
Quake – 30th Anniversary Update
id Software et MachineGames célèbrent les 30 ans de Quake avec une mise à jour gratuite intitulée Dawn of the Machine. Cet épisode inédit propose 19 nouvelles maps, une bande-son originale, des secrets, un hub dédié et une map deathmatch. Il introduit de nouveaux ennemis (Rocket Ogre, Demo Dog, Blood Shambler) et des variantes d'armes (Super Axe, Laser Cannon), ainsi qu'une structure en boucle avec des améliorations persistantes et des changements de dimension.
La mise à jour inclut aussi l'id Vault (galerie de contenus de développement et maps jouables), trois nouveaux succès, un menu de triche, et divers correctifs sur toutes les plateformes (amélioration de l'interpolation, options de bobbing, optimisations de performance). Disponible sur Xbox, PlayStation, Switch et Steam, elle n'est en revanche pas proposée sur les versions Epic Games Store et GOG de Quake, ce qui peut générer des messages d'erreur lors d'invitations cross-plateforme.
La discussion est d'abord portée par une vague de nostalgie : plusieurs commentateurs racontent leurs LAN parties d'époque, les CRT transportés chez les uns et les autres, les modems 33.6k avec 300 ms de ping, et l'émerveillement face à la 3D de Quake. Un lien vers une vidéo de John Romero commentant la conception du jeu est partagé, ainsi qu'une référence au livre de Michael Abrash, considéré comme un excellent compagnon de lecture. L'ambiance est chaleureuse, mais certains notent que l'expérience multijoueur a mal vieilli : un joueur ayant tenté de revenir sur les serveurs rapporte qu'il est très difficile d'affronter 30 ans de mémoire musculaire.
Sur le plan technique, les commentaires apportent des précisions importantes qui nuancent l'article. Un commentateur recommande vivement d'installer la remasterisation Kex, puis d'utiliser en réalité le moteur source IronWail, qui charge les PAK du remaster et débloque les succès Steam. D'autres signalent que la nouvelle extension « Dawn of the Machine » pourrait ne pas fonctionner immédiatement avec les moteurs open source, en raison de modifications de chaînes de texte, et qu'il faudra attendre des mises à jour. Plusieurs voix s'étonnent que la mise à jour ne soit pas disponible sur GOG ; la FAQ indiquerait « pas encore », et un commentateur évoque des difficultés de publication sur cette plateforme. Un autre déplore l'absence de support macOS, tout en expliquant que le Game Porting Toolkit ne peut pas être redistribué pour des raisons de licence.
Des divergences apparaissent quant à la stratégie de l'éditeur. Certains jugent l'attention insuffisante, rappelant l'abandon rapide de Quake Champions et la préférence de la communauté PvP pour Quake Live, tandis que d'autres estiment que les échecs de plusieurs jeux d'arène ne sont pas imputables aux développeurs. La question de l'accès pour les possesseurs des CD d'origine est soulevée : la mise à jour ne concerne que les plateformes numériques modernes, ce qui est perçu comme une forme de verrouillage.
-
Humans missed 1 in 3 threats approving AI agent commands across 40k game runs
Un jeu navigateur simulant le rôle d'un humain dans la boucle de supervision d'un agent IA de codage a généré des données sur plus de 40 000 parties et 409 000 décisions d'approbation. Les joueurs ont manqué en moyenne 1 menace sur 3 (précision de 66,3 %), et 32,9 % des sessions se sont terminées par un score négatif. Les commandes exfiltrant des identifiants sont trois fois plus souvent approuvées que les commandes destructrices évidentes.
La commande la plus ratée est `npm run analyze`, approuvée à 64,7 % : elle exécute un script arbitraire défini dans package.json, dont le contenu malveillant est pourtant affiché dans l'historique. Les menaces cachées derrière des noms de scripts familiers doublent leur taux de succès malgré l'affichage du payload. L'article souligne la fatigue de permission, le bruit des commandes bénignes bloquées, et les limites du modèle d'approbation de commandes individuelles.
La discussion conteste fortement la portée des résultats de l'article. Plusieurs commentateurs jugent le jeu invalide comme mesure réelle : absence de conséquences, pression artificielle du chronomètre, et le fait que les participants savent qu'ils passent un test. Un commentaire souligne que le modèle « cliquer pour accepter » n'a jamais été un mécanisme de sécurité sérieux, mais une simple protection juridique pour les fournisseurs d'IA. L'auteur du jeu répond en donnant des chiffres précis (40 000 parties, 409 000 décisions, 1 menace sur 3 manquée) et précise avoir intégré les retours du précédent fil, notamment sur la commande npm run.
Les commentateurs praticiens apportent des retours concrets : lassitude face aux demandes de permission répétées, commandes trop longues tronquées à l'écran, et contournement de l'allowlisting via des scripts inline. Plusieurs proposent le sandboxing comme alternative, mais d'autres objectent que les sandbox ne sont pas infaillibles et que l'accès réseau reste dangereux. Un commentaire relate même des collègues laissant Codex s'exécuter sans aucune permission sur la machine hôte. La discussion nuance l'article en soulignant que les vrais agents comme Claude Code ou Codex ont des systèmes de permission insuffisamment expressifs, incapables de bloquer des flags dangereux à des positions arbitraires.
Le débat porte aussi sur l'avenir du human-in-the-loop : certains prônent une approche centrée sur la configuration et des demandes seulement en cas de doute, d'autres comparent cela à de l'anti-phishing et doutent que les fournisseurs aient intérêt à imposer des contrôles stricts. Un avis minoritaire estime qu'un autre LLM pourrait mieux surveiller les actions qu'un humain fatigué. Globalement, les commentaires contredisent l'idée que le taux d'erreur humain est le problème principal : ils pointent le modèle même de demandes de permission comme fondamentalement inadapté, sans qu'un consensus ne se dégage sur une solution.
-
Nashville uses eminent domain to block data center near zoo
La ville de Nashville utilise le domaine éminent (expropriation) pour bloquer la construction d'un centre de données à proximité du zoo.
La discussion porte sur l'usage de l'expropriation (eminent domain) par Nashville pour bloquer un centre de données près du zoo. Plusieurs commentateurs s'accordent sur le précédent dangereux que représente ce mécanisme, tout en reconnaissant que l'opposition locale est légitime : bruit, consommation d'énergie, impact sur les animaux. Un avis minoritaire estime que c'est une bonne chose de voir le gouvernement agir concrètement, même avec un outil aussi radical ; un autre ironise sur le fait que la ville n'a pas hésité à subventionner massivement un stade. Plusieurs voix soulignent que le vrai problème est l'absence de planification zonage et de régulation en amont : il faudrait des limites de bruit, de puissance, des incitations fiscales plutôt que des blocages.
Des informations concrètes sont apportées : un commentateur a géolocalisé le site, entouré de bureaux, entrepôts, voies ferrées et du zoo, et propose des compromis (échange de terrain, limitation de puissance, toits solaires). Un autre relève que le conseil métropolitain a voté 27-5, et précise qu'il s'agit d'un gouvernement ville-comté consolidé. Des corrections apparaissent : l'affirmation selon laquelle Nashville serait la première consolidation est contredite par San Francisco en 1856. Un praticien de l'immobilier commercial dit n'avoir jamais vu de centre de données totalement insonorisé ; un autre témoigne du sifflement aigu des générateurs qu'il perçoit à plusieurs pâtés de maisons. Plusieurs commentateurs notent que le problème dépasse le cas local : la perception publique des datacenters a changé à cause de l'IA, et certains distinguent les centres traditionnels des fermes de GPU.
La discussion corrige l'article en soulignant que ce n'est pas une simple affaire de NIMBY : il y a un contexte politique et économique plus large. Certains y voient la montée d'un backlash contre les big tech, d'autres une stratégie des politiciens pour prélever une rente. Un commentaire évoque les NDAs imposés aux communautés locales, empêchant tout débat démocratique avant le début des travaux.
-
Improving GPT‑5.6 Sol in ChatGPT, expanding GPT‑5.6 Luna access for free users
L'article annonce une amélioration de GPT-5.6 Sol dans ChatGPT et une extension de l'accès à GPT-5.6 Luna aux utilisateurs gratuits. Aucun détail supplémentaire n'est fourni dans le texte disponible.
La discussion tourne autour de la stratégie d'OpenAI avec GPT-5.6 Luna en accès gratuit. Plusieurs commentateurs y voient une manœuvre réfléchie plutôt qu'un signe de désespoir : Luna est un petit modèle efficace, et offrir un accès gratuit permettrait de contrer la commoditisation des modèles de fondation. Certains comparent avec Claude, qui donne déjà Sonnet aux utilisateurs gratuits, mais avec des limites de débit jugées exécrables. D'autres s'interrogent sur les coûts d'inférence : offrir un modèle plus capable à des millions d'utilisateurs gratuits semble coûteux, même si des gains d'efficacité ou la collecte de données d'entraînement pourraient justifier la dépense.
Plusieurs informations concrètes émergent : Luna est environ 50 % moins cher pour les tâches différées et assez performant pour le codage, mais certains le jugent peu fiable sur des tâches complexes. L'ajout d'un bouton « Réfléchir » pour les utilisateurs gratuits est vu comme un changement potentiellement majeur pour le grand public. Des commentaires relèvent aussi des problèmes d'interface (auto-formatage Markdown bugué) et une confusion sur les versions de Sol selon le contexte (Chat vs Work). Un participant note qu'OpenAI n'a pas encore mis à jour sa page de notes de version.
La discussion corrige ou nuance l'article sur plusieurs points. Un commentaire affirme que les utilisateurs gratuits sont en réalité perdants, car Luna serait équivalente au niveau nano, moins bon que le GPT-5.5 disponible auparavant pour quelques messages ; mais d'autres rétorquent que Luna est bien supérieure au nano des générations précédentes, et qu'il faut juger sur pièces. Plusieurs voix dénoncent aussi un « dark pattern » : les abonnés payants sont eux aussi routés par défaut sur le modèle instantané, sans le savoir. Enfin, un débat sur la signification du terme AGI, employé par OpenAI dans son annonce, divise : certains y voient une revendication légitime, d'autres une simple posture marketing.
-
Show HN: I spent 2 years designing a mechanical Magic Keyboard
Altar II est un clavier mécanique ultra-fin (4,75 mm) présenté sur Hacker News après deux ans de conception. Il combine des switches mécaniques complets avec une course de 1,8 mm grâce à un ressort latéral, un châssis en acier et aluminium. Il inclut une molette M-Dial amovible, un retour haptique (Harmonic Synthesiser), un rétroéclairage amber-red, et une application macOS native. Autonomie annoncée : 30 jours, avec 2 jours d'usage pour 2 minutes de charge. Réservation à 249 $ (au lieu de 349 $), lancement sur Kickstarter prévu le 10 novembre 2026.
Le projet séduit par son design soigné et son site vitrine, mais la typographie des touches numériques concentre les critiques : plusieurs commentateurs la jugent « bizarre », « disproportionnée » ou « digne d'une calculatrice pour malvoyants », certains espérant qu'il s'agit d'un rendu non définitif (des symboles comme - et = semblent manquer). L'absence de capteur d'empreinte est mentionnée par beaucoup, mais un commentaire souligne que c'est techniquement impossible ; un autre contredit en partageant un lien vers une réalisation similaire, et un troisième suggère une alternative avec un bouton U2F ou un passe-through USB pour Yubikey. Le site web, bien que salué, est aussi critiqué pour son inconfort sur desktop et pour déclencher des nausées chez certains.
Le créateur apporte des précisions techniques : les switches sont sur mesure, avec une course de 1,8 mm et un pré-course très court, le toucher étant « plus sec et plus réactif » que celui des MacBook ; des touches Windows sont possibles. Le prix final sera de 349 $ (249 $ en précommande), et le lancement a été retardé pour garantir la fabricabilité. Le firmware sera open source, ce qui répond en partie aux questions sur la compatibilité Linux. Plusieurs commentateurs soulèvent des demandes de fonctionnalités : format split, repose-poignets inclinable, batterie remplaçable, touche Ctrl en gravure, pavé numérique style Mac/vt-100, ou encore une fonction d'actionnement à mi-course type hall-effect. Un utilisateur compare le produit au Mistel Airone et au Nuphy Air 60 HE, relevant des problèmes de fiabilité sur les switches low-profile.
La discussion révèle des divergences sur la finalité du retour haptique : certains s'interrogent sur son utilité sur un clavier mécanique, le créateur précise qu'il sert pour le pavé rotatif et les raccourcis, avec une configuration possible. Un commentateur sceptique doute de la tenue dans le temps à ce prix, tandis que d'autres applaudissent la prise de risque. Plusieurs amateurs de layouts ergonomiques (HHKB, colonnaire) regrettent de ne pas pouvoir adopter ce clavier.
-
Herdr is joining Y Combinator. The runtime stays open
Annonce de Can, créateur de Herdr : le projet rejoint Y Combinator (batch F26) tout en restant open source. Herdr est un runtime pour agents de codage en ligne de commande, avec une interface TUI, qui permet de gérer des agents persistants dans des terminaux. Le projet compte 25 000 étoiles, 340 000 téléchargements et plus de 500 plugins.
Le runtime reste sous licence Apache-2.0 et gratuit. Can souhaite constituer une petite équipe pour développer l'outil en conservant un noyau léger, tout en connectant les différentes machines où les agents s'exécutent. Il prévoit d'ajouter d'autres clients au-delà de la TUI et de s'appuyer sur l'écosystème d'extensions.
La discussion mêle félicitations sincères et scepticisme marqué face à l'entrée de Herdr chez Y Combinator. Plusieurs commentateurs soulignent que le marché des multiplexeurs terminaux orientés agents est déjà très encombré, avec de nombreux concurrents financés par YC (Superset, cmux, Emdash, Orca, Bullet, Conductor, etc.) et d'autres comme Superlogical ou Agentastic. Un avis récurrent : l'open source est souvent utilisé comme un levier de traction tactique, mais les incitations changent après une levée de fonds. Un commentateur évoque même l'open source comme une arme défensive contre les stratégies de type « embrace-extend-extinguish ». La discussion corrige ou nuance l'article sur la licence : le passage d'AGPL à Apache est interprété par certains comme un signe que l'open source n'est pas viable tel quel pour les investisseurs, avec des formules comme « on ne peut pas gagner de l'argent si les utilisateurs doivent partager leur code source ».
Côté retours terrain, de nombreux utilisateurs se disent conquis : Herdr est devenu leur outil quotidien pour gérer plusieurs agents (Claude Code, opencode, Codex), en remplacement de tmux ou zellij. Ils vantent la vue dédiée aux agents, la configuration simple, la prise en charge des worktrees, et la possibilité de reprendre une session à distance via SSH ou mosh (avec l'intégration Moshi). D'autres expriment des avis plus critiques : un utilisateur n'a pas aimé Herdr et estime que l'orchestration des agents devrait vivre au niveau du terminal lui-même, évoquant un futur fork de Ghostty. Certains disent retourner à tmux, ne voyant pas de différence majeure, tandis que d'autres répondent en listant les fonctionnalités spécifiques (statut des agents, raccourcis simplifiés). Un commentateur signale aussi un problème de RAM avec cmux, ce qui l'a poussé vers Herdr.
La crainte dominante reste l'enshittification post-financement, illustrée par le précédent Warp. Plusieurs participants rappellent que Herdr est un logiciel open source local, donc facile à forker si la direction venait à déplaire.
-
Launch HN: ProvenMetal (YC S26) delivers circuit boards in days instead of weeks
ProvenMetal, une startup de la promotion YC S26, propose la fabrication et l'assemblage de cartes électroniques en cinq jours minimum, contre plusieurs semaines habituellement. Elle achète les composants auprès de fournisseurs américains, les vérifie par rapport à la nomenclature, puis confie fabrication et assemblage à des partenaires américains. Chaque carte est testée et livrée avec un dossier qualité complet. Un délai plus long est possible à prix réduit, et les révisions ultérieures partent de la dernière version pour aller plus vite. Un mode entièrement domestique (États-Unis) est disponible.
Plusieurs commentateurs saluent l'initiative et soulignent le besoin réel d'une chaîne d'approvisionnement de PCB aux États-Unis, notamment pour la défense et l'ITAR. Ils s'accordent sur le fait que concurrencer la Chine sur les prix est impossible : un praticien cite des coûts de 10 à 20 dollars par carte simple en Chine, tandis que le fondateur reconnaît que les prix sont plus élevés aux États-Unis en raison des frais de NRE et d'un support faible pour la petite série. La différenciation attendue porte donc sur la rapidité (sept jours), la conformité et l'intégration avec les outils de conception. Plusieurs commentateurs estiment que l'innovation clé est de connecter le logiciel de CAO aux stocks de composants, car le goulot d'étranglement est souvent la disponibilité des pièces, pas l'assemblage.
La discussion corrige et nuance l'article. Un commentateur conteste l'affirmation selon laquelle l'infrastructure américaine se dissout, citant MacroFab, CircuitHub, Sierra Circuits et d'autres acteurs toujours actifs. Un autre relève une contradiction dans le récit du fondateur : nous passions 90 % de notre temps à assembler versus l'assemblage n'est pas le goulot. Le fondateur clarifie que son équipe manquait d'automatisation, mais que l'industrie de l'assemblage est commoditisée. Plusieurs critiques portent sur le site web : capacités techniques absentes (nombre de couches, flex, micro-vias), contenu visiblement généré par IA, définition floue des tests et de la gestion des pièces consignées. Les fondateurs reconnaissent ces manques et promettent des mises à jour. Un avis minoritaire estime que la dépendance aux PCB bruts chinois reste un risque stratégique non résolu.
Concrètement, un fabricant ayant utilisé MacroFab compare : trois semaines de délai, un prix compétitif, et voit dans l'offre de sept jours un avantage pour certains projets. D'autres rapportent des difficultés d'approvisionnement en composants aux États-Unis, avec des ruptures fréquentes chez DigiKey et Mouser, et une préférence pour les fournisseurs chinois plus rapides. La question des matériaux (pour le mmWave) et des capacités réelles pour les cartes complexes (8-12 couches) reste en suspens.
-
On non-rooted Android 17, ADB uninstall of system apps fails
L'article signale que sur Android 17 non rooté, la désinstallation d'applications système via ADB échoue.
La discussion exprime une large frustration face au verrouillage croissant d'Android, perçu comme une atteinte à la propriété de l'appareil et au « general-purpose computing ». Plusieurs commentateurs dénoncent la prolifération des logiciels préinstallés (bloatware) et des services Google qui tournent en arrière-plan, citant des exemples concrets comme des applications réactivées à chaque redémarrage sur certains téléphones Motorola. Un avis minoritaire relativise en rappelant que la désactivation (disable) reste possible et qu'elle est souvent plus sûre que la désinstallation, ce qui nuance le titre de l'article.
Les divergences portent sur les solutions. Certains recommandent GrapheneOS ou des ROM custom pour échapper au problème, mais d'autres objectent que ces options ne conviennent pas à tous, notamment pour les applications bancaires. La piste d'un téléphone sous GNU/Linux est évoquée, mais rejetée pour des raisons pratiques (gestion de la batterie, compatibilité des applications). Un commentateur propose d'utiliser Shizuku et des outils associés comme pseudo-root, mais plusieurs répondent que cette méthode repose sur les mêmes privilèges ADB et sera donc probablement affectée par le changement.
La discussion apporte des précisions techniques qui corrigent l'article : désinstaller une application système via ADB ne la supprime pas réellement de la partition système, elle revient simplement à la version d'origine après une mise à jour. Un commentaire cite le code du changement pour révéler que la nouvelle version transforme la désinstallation en désactivation, ce qui aggrave le problème des applications non désactivables imposées par les opérateurs. Plusieurs participants y voient une stratégie de « faire bouillir la grenouille » de la part de Google, et appellent à une régulation des préchargements publicitaires et malveillants.
-
Welcoming the Nepalese Government to Have I Been Pwned
Le Népal devient le 47e gouvernement à rejoindre le service gouvernemental gratuit de Have I Been Pwned (HIBP). Son Centre national de cybersécurité peut désormais surveiller les domaines gouvernementaux népalais, identifier les expositions d'adresses email officielles et réagir en cas de fuite de données, renforçant ainsi la surveillance des menaces et la réponse aux incidents.
Plusieurs commentateurs saluent l'intégration du Népal dans Have I Been Pwned (HIBP) mais en profitent pour critiquer l'état désastreux des services informatiques gouvernementaux népalais : formulaires exigeant de modifier le fuseau horaire, endpoints sans validation d'entrée permettant des requêtes arbitraires sur des données biométriques, et une faille volontairement non corrigée qui servirait à la corruption. Un avis généralise ce constat à l'Asie et à l'Afrique, où des vulnérabilités graves sont visibles lors d'une utilisation normale, mais où les signaler expose à des problèmes. D'autres notent que l'intégration de fuites dans HIBP a un côté positif : cela documente les défaillances et donne des arguments aux bons éléments au sein des gouvernements pour pousser à des réformes, même si les services de renseignement et les criminels ont sans doute déjà exploité ces systèmes depuis des années.
La discussion contraste avec l'article sur un point : plusieurs commentateurs jugent le titre trompeur, car il suggère que le gouvernement népalais « rejoint » HIBP alors qu'il s'agit plutôt d'ajouter les données de fuites népalaises à la base. Un lien vers d'autres annonces similaires de Troy Hunt montre que c'est un format récurrent, mais un commentaire ironise sur le fait que Hunt monétise les fuites de données. Par ailleurs, une digression sur Cloudflare suscite des réponses : certains utilisateurs se plaignent de ne pas pouvoir passer le CAPTCHA, ce qui rend le service inaccessible, avec des témoignages sur l'inefficacité du support client et des entreprises qui changent de fournisseur à cause de cela.
Enfin, un débat de fond oppose les commentateurs sur l'idée de faire de HIBP un service public sous contrôle gouvernemental. Les partisans y voient une garantie de surveillance et de protection contre un usage abusif par les forces de l'ordre, mais les opposants soulèvent des questions pratiques : quel gouvernement serait responsable, comment gérer les ressortissants étrangers, et pourquoi dupliquer ce service dans chaque pays. Des demandes mineures sont également exprimées, comme la possibilité de changer d'adresse e-mail sur HIBP sans recréer un compte.
-
Bioengineered chewing gum may offer a way to fight HPV and other microbes
Des chercheurs de l'Université de Pennsylvanie ont développé un chewing-gum bio-ingénieré à base de haricots lablab contenant la protéine antivirale FRIL et un peptide antimicrobien. Dans des échantillons oraux de patients atteints de carcinome épidermoïde de la tête et du cou, il a réduit les niveaux de HPV de 93% dans la salive et de 80% dans les rinçages buccaux, et a presque éliminé deux bactéries liées au cancer (Porphyromonas gingivalis et Fusobacterium nucleatum). Le traitement préserve les bactéries buccales bénéfiques, contrairement à la radiothérapie. Publiée dans Scientific Reports, l'étude suggère une utilisation comme thérapie d'appoint ou prophylaxie.
La discussion part sur une tangente : un commentateur cite une étude sur les champignons médicinaux (reishi et queue de dinde) qui aurait éliminé le HPV à haut risque chez 88 % des patients, mais un autre commentateur démonte cette étude en détail : auteur unique sans affiliation académique, journal à faible impact spécialisé sur les champignons, et promotion parallèle de remèdes douteux. Il la juge invraisemblable et appelle à la réplication. Ce contraste illustre le scepticisme de nombreux participants face aux allégations santé non confirmées.
Plusieurs commentaires apportent des informations pratiques. Le xylitol dans les chewing-gums est connu pour réduire le risque de caries : un commentateur explique le mécanisme biochimique par lequel les bactéries gaspillent leur énergie sur le xylitol-5-phosphate, tandis qu'un autre prévient que le xylitol est toxique pour les chiens. Un participant évoque la gomme mastic comme alternative, avec un retour d'expérience sur son goût et sa texture. Une question sur la non-éradication du HPV par rapport au VIH reçoit deux réponses : le HPV est souvent bénin et ne justifie pas un investissement massif, contrairement au VIH. Un échange sur les microplastiques des gommes est nuancé : un commentateur rappelle que la gomme originale est à base de chicle naturel, et d'autres moquent les conclusions alarmistes.
Globalement, la discussion ne contredit pas directement l'article sur la gomme bio-ingénierée, mais elle en élargit le contexte avec des préoccupations sur la sécurité des chewing-gums, des alternatives naturelles et la validité des études. Quelques commentaires relèvent juste l'envie d'acheter le produit ou plaisantent, sans apport.
Notons aussi une précision juridique sur Singapour : l'interdiction du chewing-gum n'empêche pas la possession ou l'importation pour usage personnel, seule la vente est concernée.
-
My phone detects going on a run as “someone snatching my phone and running off”
Le téléphone de l'auteur détecte une course à pied comme « quelqu'un qui m'arrache le téléphone et s'enfuit », illustrant une erreur de détection de l'activité.
La discussion confirme que le problème décrit dans l'article est courant : plusieurs commentateurs rapportent des déclenchements intempestifs de fonctions similaires. Un utilisateur de Pixel 7a raconte que son téléphone se verrouille seul avec l'alerte anti-vol alors qu'il est assis à son bureau. D'autres évoquent des faux positifs sur d'autres appareils : une montre Apple qui interprète un arrêt brutal sur tapis de course comme une chute et envoie une alerte d'urgence à un proche, ou une Galaxy Watch qui annonce « Great, you're moving again » pendant des turbulences en avion. Un commentateur précise que son Apple Watch met automatiquement en pause sa randonnée lors des montées lentes, malgré un rythme cardiaque élevé, ce qu'il juge absurde.
Plusieurs commentaires corrigent ou nuancent l'article. Un utilisateur de Pixel 7a indique qu'il est possible de désactiver cette fonction dans les paramètres (Sécurité et confidentialité > Protection contre la perte > Détection de vol), ce qui contredit l'affirmation de l'auteur selon laquelle il n'y a aucun moyen de la désactiver. D'autres notent que la détection se déclenche aussi dans les transports en commun, par exemple dans le métro de Londres au démarrage du train. Un commentateur estime que le problème vient d'une mauvaise hypothèse : associer une course soudaine à un vol, alors que les développeurs n'ont apparemment pas testé le scénario de la course à pied.
La discussion est partagée entre ceux qui jugent la fonction plus gênante qu'utile et ceux qui préfèrent privilégier la sécurité, malgré les faux positifs. Un commentateur souligne que le vol de téléphone à l'arraché est un vrai fléau à Londres et au Brésil, avec des applications gouvernementales dédiées. Plusieurs défendent l'option en disant qu'il vaut mieux un verrouillage intempestif qu'un téléphone déverrouillé entre les mains d'un voleur. Un utilisateur de Pixel 7a, qui court régulièrement avec son téléphone dans une ceinture, n'a eu qu'un seul déclenchement en trois ans, et l'attribue au fait de tenir le téléphone à la main.