Hacker News
-
In Memory of My Wife, Elise Cawley, with Thanks for 36 Wonderful Years
Un hommage personnel à Elise Cawley, épouse de l'auteur, pour 36 années de vie commune. Aucun contenu technologique.
La discussion est unanimement émue par cet hommage. Plusieurs commentateurs saluent la sincérité et la qualité d'écriture, d'autant plus frappante pour ceux qui connaissent le style habituel de Stephen Wolfram, souvent jugé technique ou pontifiant ; un commentateur raconte l'avoir rencontré en 2023 et l'avoir trouvé « grand-paternel », d'une gentillesse inattendue. Beaucoup partagent des réflexions personnelles sur la perte d'un conjoint, la brièveté des 36 ans de vie commune, ou le souhait de mourir avec l'être aimé, évoquant John Nash. Le détail de la vie quotidienne, la maison qu'elle a dessinée, et le fait qu'elle était mathématicienne reviennent souvent.
Des informations concrètes émergent : un commentateur rappelle que Wolfram documente sa vie depuis des décennies et renvoie à un article sur son système. Un autre souligne la phrase « nous avons parlé tous les jours pendant 36 ans » et note, avec une touche d'humour, que cela demande une sainteté pour écouter quelqu'un bloviater si longtemps. Le caractère soudain de la mort, après « une journée de joie », est relevé comme une consolation. Personne ne conteste les faits de l'article ; la discussion l'enrichit de témoignages personnels et d'anecdotes sur l'auteur.
Un seul commentaire critique la longueur du texte (« quelle valeur ? »), mais il est immédiatement repris par d'autres qui rappellent qu'il s'agit d'un hommage, et que l'auteur l'annonce dès le deuxième paragraphe. Une remarque technique signale une erreur de certificat SSL sur le site, jugée pardonnable. Dans l'ensemble, la discussion ne corrige pas l'article mais le confirme et l'humanise encore davantage.
-
AI-Generated Images Discourage Me from Reading Your Blog
L'auteur exprime son aversion croissante pour les images générées par IA dans les blogs, en particulier les blogs personnels, et se demande si le texte l'est aussi. Il préfère voir un dessin fait main, même mauvais, qu'une image IA. Il précise que son propre blog offre des pensées d'un humain réel. Discussion sur Hacker News.
La discussion nuance fortement l'article : plusieurs commentateurs distinguent l'usage de l'IA selon l'intention. Si l'image illustre réellement le contenu, son mode de génération importe peu ; en revanche, quand elle sert de signal de valeur ou de simple décor, elle devient un repoussoir. Un avis récurrent est que le problème n'est pas l'IA en soi, mais le manque de goût, d'effort et d'originalité qu'elle révèle souvent – les images générées ayant une « fausseté » et une « superficialité » qui rebutent, là où une mauvaise image faite main ou un stock photo peuvent passer. Certains commentateurs signalent aussi que l'image IA sert souvent de marqueur pour deviner que l'ensemble du blog est rédigé par IA, ce qui décourage la lecture, surtout quand le contenu est verbeux et semé d'erreurs.
Des retours de terrain précis sont apportés. Un proche d'un commentateur écrit des fanfictions avec des images IA pour illustrer des scènes : cela fonctionne auprès du public, mais l'usage d'une voix IA pour la narration a fait perdre des abonnés, preuve que la tolérance a des limites. Un autre relate une présentation entièrement générée par IA, jugée « fade » et « fatigante », renforçant l'idée d'une allergie croissante à ce type de production. Plusieurs commentateurs estiment que les images IA sont comparables aux pires excès du clipart ou des photos stock génériques, et que leur omniprésence annonce une période ennuyeuse pour le design. D'autres, au contraire, défendent l'outil : des blogs techniques peuvent légitimement utiliser des schémas explicatifs générés, et ceux qui n'ont pas les moyens d'engager un illustrateur y trouvent une solution acceptable.
La discussion corrige ou affine l'article sur un point : ce n'est pas tant l'image générée qui dérange que le fait qu'elle soit reconnaissable comme telle. Un commentaire résume : « dès que vous pouvez dire que c'est une image IA, elle vous décourage ». Un autre ajoute que le problème vient souvent de l'obligation perçue d'avoir une image pour chaque article, poussée par les algorithmes, ce qui conduit au remplissage paresseux.
-
Xbox goes down. You can't play games you own on disc
Une panne prolongée de Xbox, débutée dimanche soir, a bloqué l'accès aux jeux numériques mais aussi aux jeux sur disque. L'auteur souligne que les disques physiques actuels ne confèrent qu'une licence, et que Microsoft, comme les autres constructeurs, peut empêcher de jouer même avec une copie physique, par choix ou accident. Il oppose cet état de fait aux cartouches Game Boy, toujours jouables sur des appareils modernes comme l'Analogue Pocket sans validation en ligne, et évoque le PC où le tout-numérique est compensé par des moyens de préserver l'accès aux jeux.
La discussion dépasse largement la panne de Xbox pour interroger la nature de la propriété des jeux. Plusieurs commentateurs estiment que le vrai combat n'est pas physique vs numérique, mais la perte de contrôle sur les produits achetés : ils réclament le droit de conserver, prêter, revendre et archiver ses jeux, et insistent sur la différence entre « acheter » et « louer une licence ». Un avis souligne que la loi californienne interdit d'utiliser le mot « acheter » pour une licence, mais que les boutons « Ajouter au panier » contournent l'obligation. D'autres rappellent que la préservation à long terme est menacée : quand les serveurs d'authentification fermeront, les disques deviendront des déchets électroniques. Des solutions sont évoquées : GOG pour le DRM-free, l'émulation, ou les ports communautaires type Ship of Harkinian.
Un commentaire contredit directement le titre de l'article : il n'est pas nécessaire d'être en ligne pour jouer à des jeux sur disque, à condition que la console soit configurée en « home ». La panne n'est donc qu'un symptôme, mais le débat de fond porte sur les serveurs d'authentification et les licences. Un commentateur relate son expérience : lancer Halo MCC sur Steam l'a obligé à créer un compte Microsoft, avec vérification d'email et captcha, une procédure décrite comme « la pire expérience logicielle ». Plusieurs intervenants notent que les disques ne contiennent souvent pas le jeu complet (exemple de Mortal Kombat X), ce qui relativise l'avantage du physique.
La discussion corrige aussi un commentaire optimiste sur les serveurs PS3 : si certains jeux tournent en pair-à-pair, des studios comme Naughty Dog ou Rockstar ont fermé leurs serveurs en ligne pour PS3. Certains commentateurs estiment que la réponse passe par la législation, d'autres par des choix d'achat éclairés (GOG, Blu-ray). Un avis minoritaire juge que Steam a normalisé le DRM sur PC sans être critiqué, tandis qu'un autre rappelle que les mises à jour fréquentes des jeux modernes rendent la notion de « version disque » obsolète.
-
Show HN: Simple algorithm and color space to generate diverse skin tones
L'auteur présente un algorithme et un espace colorimétrique pour générer diverses nuances de peau, avec un sélecteur de couleurs personnalisé et un exemple d'algorithme de génération procédurale en Python (équivalents JavaScript dans la page). L'objectif est de définir une plage de couleurs RGB "suffisamment bonne" pour représenter les tons de peau de manière inclusive, notamment pour les créateurs de personnages ou l'art numérique.
La méthodologie consiste à étiqueter manuellement des couleurs RGB, puis à appliquer une analyse en composantes principales (ACP) pour transformer les données en une forme exploitable. Des équations cartographient ensuite une sphère dans cet espace PCA vers l'espace RGB. L'article détaille les limites : les tons de peau réels sont complexes (affectés par le flux sanguin, la mélanine, la diffusion de la lumière, etc.), la perception varie selon les écrans et l'éclairage, et l'approche reste subjective, l'auteur n'étant pas un chercheur.
Les commentateurs saluent unanimement la qualité du projet et son approche originale : traiter l'espace colorimétrique comme une optimisation spécifique à une tâche plutôt qu'un universel. Plusieurs retours concrets l'enrichissent : un commentateur relie la forme en croissant observée à l'analyse des teintes de fonds de teint du site The Pudding projetées dans Oklab ; un autre mentionne une thèse qui paramètre la couleur de peau via les concentrations de mélanine et d'hémoglobine, confirmant la dimension approximativement 2D. L'outil interactif de sélection 3D est particulièrement apprécié, avec l'idée de l'utiliser pour des personnages de jeux ou d'animation.
La discussion corrige plusieurs points de l'article. Plusieurs commentateurs notent l'absence de l'éclairage dans la section limitations : la couleur de peau perçue dépend de la lumière, et sous une lumière bleue la peau peut être rendue en bleu. Un autre signale que nommer l'espace PCA « XYZ » entre en conflit avec l'espace CIE XYZ standard. Un utilisateur utilisant un mode sombre voit le blanc comme absence de couleur ; l'auteur en prend acte. Sur le plan des teintes, un commentateur observe que le réglage 1.5 de l'article ne couvre pas bien les tons des Aborigènes d'Australie ni de certains Masai ou Somali, tandis que le 2.0 les représente mieux. L'auteur reconnaît un biais potentiel dans l'étiquetage manuel des données, et indique qu'une version future pourrait professionnaliser ce processus.
Plusieurs ressources externes sont partagées : l'échelle Monk Skin Tone de Google, la gamme Pantone SkinTone, ainsi que des crayons pour tons de peau. Des questions pratiques sont soulevées : la licence a été ajoutée (MIT) après une demande. Un débat mineur apparaît sur les couleurs irréalistes (vert, bleu, violet) générées par l'espace : certains les voient comme un défaut, d'autres comme une possibilité, l'auteur précisant que le curseur R² permet de filtrer les tons plausibles.
-
Ray Bradbury's "There Will Come Soft Rains" is set today (2026-08-04)
Hacker News publie le texte intégral de la nouvelle de Ray Bradbury « There Will Come Soft Rains », dont l'action se déroule le 4 août 2026. Dans une maison entièrement automatisée, les systèmes domestiques poursuivent leurs routines quotidiennes (repas, ménage, jeu, poésie) alors que la ville est en ruine et que la famille a disparu. Un incendie finit par détruire la maison, ne laissant qu'un mur qui répète la date du lendemain.
Plusieurs commentateurs relèvent que la technologie décrite par Bradbury est désormais largement à portée de main, mais avec une différence majeure : l'automatisation de la maison y fonctionne sans Internet, alors que nos objets connectés dépendent de serveurs. Un participant imagine une version moderne où le quartier serait intact mais les humains éliminés par des drones miniatures, tandis qu'un autre note que même la cuisine automatisée reste peu répandue et que les robots actuels se limitent à des aspirateurs. La question du premier appareil grand public intégrant l'IA divise : certains misent sur un robot domestique, d'autres pointent la méfiance envers la collecte de données (exemple du réfrigérateur à écran qui affiche des publicités).
La dimension nucléaire du récit suscite des témoignages sur l'anxiété des années 1980, comparée à la situation actuelle avec de nouveaux acteurs. Un commentateur affirme qu'une partie des évangéliques américains soutiennent toujours une purification apocalyptique, ce qu'un autre conteste vivement, y voyant une généralisation abusive. D'autres rappellent que la guerre nucléaire n'est pas la seule menace crédible, citant les drones ou l'effondrement social.
Sur le plan littéraire, plusieurs intervenants apportent des précisions factuelles : l'histoire a été adaptée en animation soviétique (1984), en épisode radio (X-Minus One), et lue par Leonard Nimoy. La version originale était plus courte, la réédition longue incluant des passages comme le nettoyage après le chien. Enfin, un commentateur souligne que le titre vient d'un poème de Sara Teasdale (1918), dont le texte est cité, et qui insiste sur l'indifférence de la nature à la disparition de l'humanité.
-
Mistral's Shieldstral: 3B open-weights model for multimodal moderation
Mistral publie Shieldstral, un modèle open-weights de 3B paramètres sous licence Apache 2.0, conçu pour la modération de contenu textuel et visuel. Il traite la modération comme une tâche de question-réponse binaire : l'utilisateur fournit une politique en langage naturel au moment de l'inférence, et le modèle renvoie un score de sécurité calibré, sans réentraînement. Il unifie la classification des prompts, la modération des réponses, la détection de refus et la toxicité.
Selon Mistral, Shieldstral égale ou dépasse des modèles de garde ouverts jusqu'à 7 fois plus gros sur les benchmarks de sécurité texte, de détection de refus, d'adaptabilité aux politiques et de modération multimodale. Il fonctionne sur un seul GPU NVIDIA de 16 Go. Le modèle est entraîné sur des données hétérogènes, avec des paires contrastives générées par LLM pour affiner la discrimination entre politiques proches, et utilise un reclassement vision-langage pour filtrer les données images. Mistral indique que Shieldstral a été développé sur sa plateforme Forge.
La discussion salue la tendance de Mistral à publier des modèles spécialisés et compacts plutôt que de viser les frontières de la performance, une stratégie jugée pragmatique au vu des coûts d'entraînement des modèles géants. Plusieurs commentateurs trouvent utile un modèle de modération dédié, plus facile à appréhender que la sécurité cachée d'un modèle généraliste. Cependant, de nombreux avis tempèrent cet enthousiasme : le modèle ne fournit que des probabilités oui/non sans trace de raisonnement, ce qui rend difficile l'explication d'un rejet à un utilisateur ou la constitution d'une défense en cas de litige réglementaire. Un commentateur souligne qu'un examen manuel reste possible en cas de contestation, mais d'autres doutent de sa fiabilité en conditions réelles et de sa capacité à satisfaire les obligations légales par rapport à une équipe humaine.
La discussion apporte aussi des éclaircissements concrets sur le fonctionnement : le modèle est évalué une fois par politique de modération, puis les résultats sont combinés en un score. Plusieurs intervenants comparent Shieldstral à d'autres outils comme Llama Guards (jugé en retard) ou l'API OpenAI, et mentionnent des alternatives open source comme CoPE-B-A4B de Zentropi. Un commentaire note que ce type de modèle complète utilement une boîte à outils plutôt qu'il ne remplace tout. D'autres s'interrogent sur la flexibilité réelle : peut-on vraiment définir des règles arbitraires ou cela reste-t-il limité à des thématiques classiques (violence, sexe) ? Un test proposé : détecter l'escroquerie ou le « performative nonsense », ce que le modèle ne semble pas savoir faire selon le papier.
Des divergences apparaissent sur l'opportunité même de ce modèle : certains y voient un outil de censure, d'autres une réponse européenne aux exigences de conformité (EU AI Act, Chat Control). Un commentateur note avec ironie que c'est le domaine où l'Europe est en pointe. La stratégie commerciale de Mistral est discutée : plusieurs rappellent que l'entreprise n'a pas les moyens de rivaliser avec les modèles frontières et se rabat sur des niches rentables, avec un chiffre d'affaires déjà supérieur à xAI selon un intervenant.
-
FFmpeg 9.0
Titre seul : annonce de la sortie de FFmpeg 9.0, sans aucun détail fourni dans le texte.
La discussion salue quasi unanimement la sortie de FFmpeg 9.0, vu comme un outil indispensable et d'une fiabilité impressionnante, capable de traiter de gros volumes vidéo comme des manipulations subtiles. Plusieurs commentateurs soulignent l'importance du projet et recommandent l'interview de ses développeurs. Certains points du changelog sont particulièrement bien accueillis, comme le décodeur WebP animé, longtemps attendu pour les applications desktop, et le backend ONNX Runtime avec accélération GPU, même si personne ne fournit encore d'exemples concrets d'usage.
Des corrections et nuances apparaissent. Un commentateur évoque le problème des ordinateurs portables Windows où Intel QSV est désactivé via les tables ACPI, mais un autre précise que ce n'est pas FFmpeg qui peut le résoudre : les pilotes Linux ignorent ces tables, contrairement à ceux d'Intel. Un autre échange corrige une confusion sur les versions : FFmpeg 8.0 est sorti en août 2025 et non « il y a 8 ans » ; l'auteur de la remarque confondait probablement avec VLC. La suppression des options NVENC obsolètes et du support CELT est également notée, sans susciter de débat.
Deux points divisent davantage. D'un côté, la complexité du système de filtres de FFmpeg est jugée peu ergonomique ; un commentateur propose une méta-langage ou une approche à la VirtualDub/AviSynth pour manipuler les flux, regrettant un manque de conception globale. De l'autre, une discussion surgit sur les brevets et la licence GPLv3, un commentateur s'interrogeant sur la légalité, tandis qu'un autre répond que les brevets logiciels ne s'appliquent pas dans le pays des développeurs. Enfin, la question de l'IA dans le développement est évoquée : l'un affirme que Michael Niedermeyer a écrit son commit manuellement, mais un autre prétend, se référant à Twitter, qu'ils ont utilisé Claude pour cette release, ce qui reste non confirmé et sans réponse directe. Le consensus reste que FFmpeg est un pilier technologique, même si son interface et certaines politiques font débat.
-
There Will Come Soft Rains (1950) [pdf]
Lien Hacker News vers un PDF intitulé « There Will Come Soft Rains (1950) », sans autre contenu disponible dans l'article.
La discussion revient d'abord sur la peur de l'apocalypse nucléaire qui imprègne la fiction des années 1950, avec des témoignages personnels (sirènes d'air raid, listes de cibles, contexte de la guerre froide). Plusieurs commentateurs soulignent que cette menace n'a jamais vraiment disparu et que la nouvelle, dont l'action se déroule le lendemain du jour de la soumission, résonne encore. Certains évoquent d'autres œuvres comme "By the Waters of Babylon" ou "A Canticle for Leibowitz". Un commentateur né en 1968 raconte avoir vécu l'époque Reagan, et un autre, en Norvège, se souvient des abris et des tests de sirènes dans les années 1980.
Sur la technique, les avis divergent : l'idée d'une maison automatisée fonctionnant sans Internet paraît irréaliste, la cuisinière automatique étant l'exception notable. Un commentateur trouve la nouvelle moins percutante que "The Pedestrian", incluse à la fin du PDF, plus proche de notre époque : le fait que la famille soit dehors au moment de l'explosion, ou que le père tonde la pelouse, semble incongru aujourd'hui. D'autres comparent la puissance domestique à 10-15 chevaux et s'interrogent sur le prochain appareil à succès. Le manque de vie privée et la revente de données sont aussi évoqués comme freins à l'adoption de la domotique.
Enfin, la discussion montre la postérité de l'œuvre : adaptations animées soviétiques (1984, 1987), radio-dramatisations (X-Minus One, Dimension X), lecture par Leonard Nimoy, et l'album "Vendrán Suaves Lluvias" de Silvana Estrada. Un commentateur raconte la popularité de Bradbury en URSS, où un éditeur publiait des recueils sur le thème des livres. Dans l'ensemble, les commentaires nuancent l'aspect "anticipation" : ce qui frappe aujourd'hui, c'est moins la maison intelligente que l'absence des personnages et la fragilité de la présence humaine.
-
All of Winona Police Department's Flock cameras cut down and stolen
Huit caméras automatisées de lecture de plaques Flock Safety appartenant à la police de Winona (Minnesota) ont été sciées et volées le 1er août, apparemment lors d'un vol coordonné. Deux caméras supplémentaires appartenant au comté de Buffalo ont également été dérobées. Chaque caméra vaut environ 3 000 $, soit une perte totale d'environ 24 000 $ pour le budget du département. Les autorités n'ont pas identifié de suspects. L'article mentionne que ces vols s'inscrivent dans une tendance nationale de vandalisme contre ces dispositifs, critiqués par des défenseurs des libertés civiles.
La discussion valide largement l'article tout en le nuançant. Les commentateurs s'accordent sur l'impopularité de Flock, perçu comme un outil de surveillance de masse, et plusieurs rappellent que la résistance dépasse les clivages politiques, évoquant aussi Axon ou les caméras ULEZ à Londres. Le vol coordonné est vu comme un acte de protestation, même si certains restent prudents sur les moyens. Plusieurs remarquent que la police présente l'outil comme aidant à résoudre des crimes, mais que les usages réels incluent le harcèlement par des agents ou la coopération avec l'ICE, citant des cas documentés.
Les commentaires apportent des informations concrètes. Sur les données, un commentateur explique que Flock joue sur les mots : les données appartiennent au client mais sont stockées sur les serveurs de Flock, et la suppression après 30 jours ne concerne qu'une copie locale. D'autres notent que le coût de remplacement des caméras, loin de peser sur le budget de la police, sera facturé aux contribuables par Flock, et que certaines municipalités sont contraintes de couvrir les caméras avec des sacs poubelle en attendant la fin du contrat. Des outils comme deflock.org ou des modèles de FOIA sont partagés pour localiser les caméras ou auditer leur usage.
La discussion contredit l'article sur deux points. D'abord, le titre parle de « caméras du département », mais les commentaires soulignent qu'il s'agit d'une licence d'utilisation, pas d'une propriété. Ensuite, l'affirmation selon laquelle la perte est de 24 000 $ pour le budget de la police est jugée trompeuse : le remplacement est probablement répercuté sur le contribuable via le contrat. Un avis minoritaire défend Flock en rappelant que filmer dans l'espace public est légal, mais il est noyé par les critiques. Plusieurs commentateurs s'interrogent aussi sur la vulnérabilité technique des caméras, citant une vidéo sur leurs failles.
-
Apple says more ex-employees may have taken confidential data to OpenAI
Apple demande une injonction préliminaire dans son procès contre OpenAI pour secrets commerciaux, afin d'empêcher le développeur de modèles IA de progresser sur un appareil IA ou d'autres produits basés sur sa technologie. Apple affirme que d'autres anciens employés pourraient être impliqués dans le vol de ses secrets.
Dans une nouvelle requête, Apple sollicite une découverte accélérée auprès des employés d'OpenAI concernés (dont l'ingénieur système Chang Liu et le responsable matériel Tang Yew Tan), ainsi qu'auprès d'OpenAI et d'io, la startup d'appareils cofondée par l'ancien designer d'Apple Jony Ive. L'enquête d'Apple aurait révélé 11 autres anciens employés d'Apple comme témoins ou participants potentiels. Apple cite des exemples de réunions préalables à des entretiens chez OpenAI avec partage d'informations confidentielles, des captures d'écran de documents Apple confidentiels, et des anciens employés cherchant à restituer des appareils de travail après le dépôt de la plainte.
OpenAI a répondu publiquement, qualifiant la demande d'injonction de fondée sur de fausses informations et inutile, affirmant ne pas avoir ni vouloir de secrets commerciaux d'Apple. OpenAI rappelle aussi des erreurs antérieures d'Apple dans la procédure, notamment un courriel envoyé à la mauvaise personne et des accusations non prouvées concernant des communications avec son conseil général.
La discussion est dominée par un débat sur la nature de l'action d'Apple contre d'anciens employés passés chez OpenAI. Plusieurs commentateurs citent des précédents, notamment la menace de Steve Jobs contre Tony Fadell pour le poaching, pour suggérer qu'Apple a toujours été agressive dans la rétention de talents. Mais d'autres soulignent que les accusations actuelles dépassent le simple recrutement : il est question de captures d'écran de documents confidentiels et d'un bug d'authentification ayant permis de télécharger 37 documents sensibles. Un commentateur conteste ainsi le résumé de l'article qui évoque des « informations dans les têtes », en insistant sur la matérialité des preuves. Un avis minoritaire estime que c'est une tactique d'Apple pour dissuader les employés, mais la plupart reconnaissent que les faits allégués sont graves.
Plusieurs commentaires apportent des détails techniques. Un participant s'interroge sur la nature du « dépôt cloud tiers » mentionné dans la plainte, évoquant des services comme Box ou S3. D'autres critiquent les pratiques de sécurité d'Apple, notamment l'incitation à utiliser des identifiants iCloud personnels et l'absence de profils de travail isolés sur iPhone, qui auraient facilité ce type d'incident. À l'inverse, un commentateur estime qu'Apple a peut-être laissé délibérément une « corde » pour piéger les employés. Plusieurs notent que le contenu des documents volés (techniques de finition métallique, accélérateurs neuronaux) suggère un lien avec les projets de hardware d'OpenAI, peut-être un smartphone.
La réponse publique d'OpenAI est largement critiquée. Beaucoup estiment que ce genre d'affaire devrait se régler au tribunal et non dans la presse, et voient dans la déclaration d'OpenAI une tentative d'influencer l'opinion publique, voire de « polluer le jury ». Un commentateur affirme que les deux camps ne peuvent pas avoir raison et que quelqu'un ment. Certains rappellent des antécédents d'OpenAI et de Sam Altman pour expliquer cette stratégie. Enfin, un témoignage sur les pratiques d'entretien où l'on demanderait de présenter des projets confidentiels est contesté par un autre, qui juge cela anormal.
-
DeepSeek V4 Flash on a Single AMD MI300X
Ce dépôt présente une configuration de production pour exécuter le checkpoint DeepSeek V4 Flash 0731 (304B paramètres) sur un seul GPU AMD MI300X (192 Go HBM). Il rassemble des patches pour vLLM ROCm, des tableaux de tuning AITER et une pile Docker Compose, en corrigeant notamment l'incompatibilité FP8 entre le format AMD FNUZ et l'OCP E4M3, des bugs de routage MoE, et la synchronisation CPU-KV. Le modèle tient entièrement en mémoire GPU, avec 20 Go de cache KV et 96 Go de cache CPU pour les préfixes.
L'auteur détaille les performances mesurées : prefill non caché de 7,9 à 8,5K tok/s selon le budget du scheduler, et une réduction du temps de premier token (TTFT) de 8,2 s à 0,5 s pour une requête courte derrière un prefill froid de 52K tokens grâce à un plafond de prefill long à 1024 tokens. Le dépôt inclut des instructions de démarrage, des vérifications de santé et des overlays correctifs pour le nightly ROCm, le tout épinglé par empreintes SHA-256.
Plusieurs commentateurs relèvent que l'achat d'un MI300X à l'unité n'est pas évident : la carte se présente sous forme de module OAM, généralement vendu par boîtier de huit pour environ 250 000 €. Toutefois, des offres cloud permettent d'y accéder à l'heure, notamment l'AMD Developer Cloud propulsé par Digital Ocean à 1,99 $/h, ce qui en ferait selon l'un d'eux le moyen le plus économique de servir le modèle en poids d'origine, avec un rendement estimé de 3 à 4 $ de tokens par heure. Un autre participant signale que le MI350P, en PCIe, est plus accessible par son format, mais qu'il reste conçu pour des serveurs et nécessite un boîtier adapté ; sa mémoire de 144 Go pourrait suffire grâce à la quantification MXFP4 native de DeepSeek V4 Flash, bien que cette affirmation soit contestée : d'après des mesures sous vLLM, les poids seuls occupent déjà 156 Go, et 200 Go après warm-up et cache KV.
La discussion nuance le titre de l'article : faire tourner le modèle sur une seule carte implique des compromis. Le contexte est réduit de 1M à 256k tokens, un sacrifice jugé pratique par plusieurs, certains estimant même que le contexte complet de 1M est rarement utile en pratique. Les performances sont jugées correctes (plus de 150 tokens/s), mais un commentateur s'étonne de l'écart avec les 15k tokens/s/GPU rapportés par DeepSeek sur H800 dans leur papier DSpark, tout en reconnaissant que le passage à l'échelle et l'utilisation de wideEP améliorent fortement le débit. D'autres points abordés : l'omission de DwarfStar dans les travaux antérieurs, justifiée par l'absence d'optimisations pour MI300X, et une question sur la programmabilité de ROCm, à laquelle un participant répond que des entreprises comme OpenAI, Anthropic et Meta l'utilisent déjà pour des modèles frontaliers.
Enfin, un échange aborde l'élagage d'experts dans les modèles MoE pour les faire tenir sur des GPU grand public, sans conclusion ferme. Les tailles de modèles ouverts sont rappelées : Kimi-K3 (2,8T), Qwen3.8-Max (2,4T), DeepSeek V4 Pro (1,6T) et V4 Flash (284B, paramètres totaux).
-
U.S. used 'virtually all' of its long-range precision missiles during Iran war
Selon trois sources proches des données, l'armée américaine a épuisé la quasi-totalité de ses missiles de précision à longue portée (ATACMS et PrSM) durant la guerre de cinq mois contre l'Iran. Ces munitions, qui coûtent plus d'un million de dollars chacune, sont essentielles pour frapper à distance, notamment dans un conflit avec la Chine. Les sources anonymes s'inquiètent de la capacité de dissuasion des États-Unis face à la Russie et à la Chine.
Le président Trump, qui a lancé la guerre avec Israël en février, affirme que les États-Unis disposent de 'bien plus de munitions que quiconque au monde'. Le Pentagone assure que l'armée a tout ce dont elle a besoin. Toutefois, des rapports du CSIS estiment qu'environ 65 % des intercepteurs Patriot ont été dépensés et que les stocks de THAAD ont chuté d'au moins 38 %. Un peu moins de la moitié des missiles Tomahawk ont également été utilisés. Lockheed Martin et Raytheon, les fabricants, n'ont pas répondu aux questions.
La discussion conteste fortement le titre de l'article, jugé trompeur ou « clickbait ». Plusieurs commentateurs soulignent que les ATACMS et PrSM ne représentent qu'une fraction de l'arsenal de frappe de précision américain, que les stocks n'ont jamais été énormes, et que l'article omet de préciser qu'il s'agit uniquement de l'armée de terre (Army), pas de la Navy ni de l'Air Force. Un avis récurrent : l'épuisement de ces missiles spécifiques n'implique pas un manque global de capacités, même si certains y voient un signe de mauvaise gestion ou de stratégie discutable.
Un autre fil porte sur la nature du conflit et les limites des missiles : plusieurs intervenants notent que ces armes sont coûteuses, difficiles à produire, et que leur usage massif contre l'Iran reflète peut-être une doctrine inadaptée. Certains comparent avec la guerre en Ukraine, où les missiles russes se sont révélés peu efficaces, et soulignent l'essor des drones et de l'asymétrie. D'autres s'interrogent sur les motivations géopolitiques (financement du déficit américain par les pétrodollars, influence du lobby israélien), tandis qu'un commentaire met en garde contre une lecture trop simpliste : l'armée américaine pourrait contrôler le détroit d'Ormuz, mais le coût humain et matériel serait dissuasif.
La discussion contredit donc l'article sur deux points : le titre exagère l'ampleur du problème en généralisant à toutes les forces américaines, et la simple exhaustion de certains missiles ne signifie pas une incapacité militaire. Les divergences portent sur l'interprétation : pour certains, c'est un aveu de faiblesse face à l'Iran ; pour d'autres, c'est un problème de capacité industrielle et de choix stratégiques, pas une défaite. Un commentateur évoque même une possible manœuvre de désinformation, rapprochant cette annonce de la ruse de Midway. Globalement, les commentaires apportent des nuances techniques et géopolitiques que l'article ne couvre pas.
-
Thanks FedEx, This Is Why We Keep Getting Phished (2024)
L'auteur raconte avoir reçu des SMS FedEx ressemblant à du phishing, avec des signes classiques (fautes, urgence, liens suspects). Alors qu'il attendait un colis Prusa, il a enquêté et découvert que les messages étaient légitimes, mais conçus de façon peu professionnelle, avec un lien de paiement via BPOINT (Commonwealth Bank). Il appelle FedEx, obtient confirmation des frais, et reçoit finalement un email avec la facture Prusa en pièce jointe. L'article souligne la difficulté croissante de distinguer les vraies notifications des arnaques, et cite les pertes australiennes liées aux escroqueries (plus de 3 milliards AUD par an).
La discussion tourne autour d'un paradoxe bien connu : ce sont souvent les entreprises légitimes elles-mêmes qui entraînent leurs utilisateurs à tomber dans les pièges de phishing. Plusieurs commentateurs racontent des expériences où de vraies communications officielles ressemblaient à s'y méprendre à des arnaques : un email FedEx avec un PDF mal caviardé révélant les données d'une autre personne, des SMS d'assureurs ou de municipalités pointant vers des domaines absurdes (allstate.yem.bo, my-alarm-license-renew.info), ou encore des formations internes anti-phishing annoncées par des emails externes que tout le monde a ignorés à juste titre. Un commentaire résume le sentiment général : « Arrêtez d'entraîner vos utilisateurs à se faire piéger. »
La discussion corrige et nuance l'article sur plusieurs points techniques. Quand un commentateur évoque whois pour vérifier le domaine c.gle, un autre rappelle que whois est remplacé par RDAP, et un troisième précise que .gle est un domaine réservé à Google, ce qui rend l'adresse probablement légitime mais néanmoins déroutante. Plusieurs intervenants soulignent que la prolifération des nouveaux TLD n'arrange rien, même si certains la défendent comme un moindre mal face à la pénurie de noms de domaine. Un commentateur conteste aussi l'exemple australien cité dans l'article : le problème des SMS de phishing venait de passerelles non contrôlées permettant l'usurpation d'expéditeur, pas des cartes SIM physiques, et la loi sur la vérification d'identité n'y changerait rien.
Au-delà des anecdotes, un point divise : l'obligation de KYC pour les lignes téléphoniques proposée par la FCC, avec des avis partagés entre ceux qui y voient une protection et ceux qui redoutent une fuite de données aggravante. D'autres remarques portent sur le comportement des banques et des institutions, comme Chase qui appelle pour vérifier l'identité après avoir dit qu'il rappellerait, ou l'IRS qui utilise un système de synthèse vocale identique à celui des arnaqueurs. Quelqu'un note enfin que le sujet a déjà été discuté sur HN en 2024 avec 564 commentaires, preuve que le problème est récurrent et loin d'être résolu.
-
Waymo in Dallas
Waymo ouvre son service de taxi autonome à tout le monde à Dallas. Depuis l'ouverture en février, près de 150 000 personnes inscrites sur liste d'attente ont déjà testé le service. Waymo prévoit des tests entièrement autonomes aux terminaux de l'aéroport Dallas Love Field et sur les autoroutes, dernière étape avant d'offrir ces trajets au public. L'article cite Chris Justl, CEO d'Epilepsy Foundation Texas, sur les bénéfices pour les personnes dont la condition médicale limite la conduite, en partenariat avec Waymo.
La discussion autour du lancement de Waymo à Dallas est globalement positive sur l'expérience utilisateur : plusieurs commentateurs ayant utilisé le service à San Francisco, Austin ou Dallas saluent la sécurité, la prédictibilité et le confort des véhicules, tout en notant qu'ils peuvent parfois se bloquer. Un habitant de Dallas souligne que la zone de service, limitée aux quartiers branchés, est un choix stratégique pour créer une demande avant extension. Certains s'inquiètent toutefois de l'impact économique local : l'argent dépensé chez Waymo ne profiterait pas à l'économie locale comme le ferait un chauffeur Uber, bien qu'Uber prélève déjà une part importante des revenus des chauffeurs.
Les commentaires divergent sur les implications sociétales et réglementaires. Un professionnel de l'immobilier propose d'utiliser les robotaxis comme politique de logement abordable, permettant de réduire les places de stationnement, mais cette idée est critiquée au nom de la dépendance des pauvres à une grande entreprise. D'autres rappellent que Waymo dessert des zones historiquement défavorisées par le redlining, contrairement à Uber et Tesla qui se concentrent sur les quartiers riches. Des inquiétudes sont aussi soulevées sur la surveillance (caméras accessibles à la police) et sur la responsabilité légale en cas d'infraction ou d'accident, même si plusieurs jugent que cela relève de l'exploitant du service.
Sur le plan technique, un débat oppose lidar et vision seule : certains estiment que la stratégie lidar de Waymo est supérieure à celle de Tesla pour l'apprentissage, mais d'autres jugent qu'il est trop tôt pour trancher. La question des situations rares et des règles de circulation non respectées est évoquée, avec des exemples de franchissement de ligne jaune pour contourner un obstacle. Enfin, la discussion corrige une ambiguïté de l'article : Waymo est ouvert à tous les habitants de Dallas, mais pas sur tout le territoire de Dallas, et l'extension progressive de la zone est un choix assumé. Globalement, les commentaires confirment l'enthousiasme pour la technologie tout en nuançant les promesses de l'article par des considérations locales et économiques.
-
Harness engineering for self-improvement
L'article explore l'ingénierie des "harnesses" (systèmes entourant un modèle d'IA brut : orchestration, outils, contexte, évaluation) dans la perspective de l'amélioration récursive (RSI). Il rappelle les origines du concept (Good, Yudkowsky) et identifie des motifs de conception récurrents : automatisation de boucles de travail, système de fichiers comme mémoire persistante, sous-agents parallèles. Il termine sur l'optimisation du contexte (ex. Agentic Context Engineering) et la suggestion que l'ingénierie de harness évoluera vers une méta-méthodologie d'auto-amélioration.
Plusieurs praticiens confirment l'intérêt de l'auto-recherche pour améliorer les harnesses d'agents, avec des conditions précises : lire des traces de production réelles, laisser l'agent écrire ses propres outils (réduisant par exemple le contexte de 20 000 jetons à 800), disposer d'evals et de splits train/validation pour éviter le hack, et viser une cible d'optimisation de taille raisonnable plutôt qu'un codebase d'un million de lignes. D'autres ajoutent des retours concrets sur la réduction des coûts : exécuter les commandes en mode silencieux et utiliser un index du code via MCP améliorent à la fois la vitesse et la qualité des sorties. Un commentateur recommande de définir ses propres evals, les benchmarks publics étant saturés ou peu prédictifs du monde réel.
La discussion met fortement en garde contre le sur-apprentissage et la triche. Un exemple cité : un modèle a ajouté une instruction pour émettre directement des octets et les stocker, obtenant un score parfait mais un résultat inutile. Un autre participant souligne un échec pratique : une suite de tests incomplète qui affiche pourtant un succès total ; il préconise de faire échouer par défaut si la couverture n'est pas complète. Plusieurs commentateurs doutent de la capacité des modèles à choisir seuls la bonne direction d'amélioration, et un avis minoritaire estime que sans boucle humaine, le progrès sera plus lent. Un sceptique rappelle que ces idées ressemblent aux ontologies et systèmes experts des années 1980.
Sur le plan économique, la discussion nuance l'article : le harness est vu comme un moyen pour les laboratoires de capturer de la valeur en verrouillant l'utilisateur (prompts secrets, tokens de raisonnement chiffrés, sessions impossibles à exporter). À l'inverse, construire son propre harness redonne du contrôle, même si cela demande une veille constante. Un participant évoque enfin que l'agent améliore souvent son environnement (installer des outils) plutôt que lui-même, questionnant la frontière entre l'agent et son contexte.
-
I am retiring from fulltime writing (& pseudonymity) to launch Guardian Angel
L'auteur annonce se retirer de l'écriture à plein temps et de la pseudonymie pour lancer Guardian Angel.
La discussion autour de l'annonce de Gwern est partagée. Plusieurs commentateurs jugent le projet Guardian Angel (GA) — un jumeau numérique censé imiter la personnalité et les valeurs d'un individu — ambitieux et digne d'intérêt, saluant au passage l'humanité et le sérieux de son auteur. Mais beaucoup expriment un profond scepticisme, y voyant une forme de « manie » ou de « religion » appliquée aux LLM, et reprochent au texte son côté spéculatif, ses longues citations de Tolkien et son obsession de la productivité au détriment de la sagesse et de l'épanouissement personnel. L'idée même de confier sa défense à une copie de soi est qualifiée de déshumanisante ou contre-productive par certains.
Sur le fond, les commentaires se divisent à propos de la thèse de Gwern selon laquelle les travailleurs intellectuels seront bientôt « optimisés hors de la boucle ». Certains rappellent que ce discours n'a rien de nouveau (bases de données, SQL, plateformes no-code) et que l'obsolescence annoncée des développeurs ne s'est jamais produite. D'autres, au contraire, citent les récents progrès des LLM en mathématiques pour appuyer les craintes de l'auteur. Le coût d'un GA, estimé à plus de 1 000 $/mois, est également pointé comme un facteur d'inégalité, même si des réponses prédisent une baisse rapide des prix.
La discussion apporte aussi des corrections pratiques : le lien vers le profil social de Gwern est inutilisable car les publications sont protégées, et le texte intégral du projet se trouve sur son site personnel. Enfin, plusieurs intervenants nuancent l'optimisme de l'article en soulignant qu'un agent personnel vraiment protecteur devrait disposer de capacités offensives, ce qui mènerait à des affrontements entre IA. Au final, la communauté valide l'intention mais émet de sérieuses réserves sur la faisabilité, l'éthique et les conséquences sociales d'une telle entreprise.
-
Apple is getting this wrong
Titre seul, aucun contenu disponible.
La discussion porte quasi unanimement sur le ton et la stratégie de la publication d'OpenAI, jugée peu professionnelle et contre-productive. Plusieurs commentateurs la comparent à « une lettre d'adolescent blessé », « un texto d'ex en état d'ivresse à 3h du matin » ou encore à une publication digne du patron de MyPillow. L'idée dominante est que ce genre de communication publique pendant un procès est dangereux : les juges n'aiment pas le procès par presse, et cela pourrait valoir une gag order ou nuire à OpenAI. Certains y voient une tentative désespérée de contrôler le récit, en particulier pour rassurer des employés d'Apple qu'ils cherchent à recruter, ou pour préparer une future introduction en bourse. Un commentaire minoritaire estime qu'OpenAI a le droit de se défendre publiquement quand l'accusation a déjà été rendue publique, mais il est isolé.
Plusieurs intervenants analysent les preuves présentées par OpenAI et les trouvent peu convaincantes. Il est souligné que les emails cités mentionnent des pièces jointes non montrées, et que le transcript iMessage semble plutôt montrer l'inverse de ce qu'affirme OpenAI : ce n'est pas un employé d'Apple qui demande l'aide de Chang Liu pour copier des données, mais Chang Liu qui demande à un collègue resté en poste de l'aider à extraire des données de son iCloud. Un commentateur note qu'une grande partie des preuves de la plainte d'Apple n'est pas traitée, notamment la question des prototypes. Un autre point factuel récurrent : l'utilisation d'un compte iCloud personnel par les employés dans les deux entreprises est courante, Apple ne fournissant pas de comptes professionnels, ce qui explique le flou et constitue une faille d'architecture. Un avis minoritaire rappelle que l'appropriation de données d'entreprise était autrefois normalisée, mais cela ne fait pas l'unanimité.
La discussion souligne aussi un détail controversé : la mention par OpenAI de la confusion entre deux « noms de famille asiatiques » est perçue par certains comme une tentative de faire passer Apple pour raciste, même si un commentateur la juge factuelle vu la fréquence des patronymes concernés.
-
Oxide Computer raises $445M (SEC Form D)
Oxide Computer a levé 445 millions de dollars, selon un formulaire SEC D déposé auprès des autorités américaines.
La discussion autour de la levée de 445 M$ de Oxide Computer est contrastée. Plusieurs commentateurs s'enthousiasment pour la vision du produit et l'équipe, certains saluant la rareté du mélange goût/compétence/passion, d'autres espérant voir un jour un rack Oxide dans leur home-lab. Un avis minoritaire exprime une confiance implicite dans les personnes impliquées. Mais la tonalité générale est plus sceptique : plusieurs intervenants rappellent que lever beaucoup d'argent n'est pas un succès en soi, et que le rythme effréné des tours (44 M$, puis 100 M$, 200 M$, 445 M$) interroge sur la stratégie de sortie, certains évoquant une préparation d'IPO ou une acquisition par un gros acteur.
Les critiques concrètes émaillent la discussion. Un responsable ingénierie raconte avoir rempli le formulaire de contact commercial et n'avoir jamais eu de réponse, alors que son entreprise dépense 900 k$/an sur AWS ; ce témoignage alimente le doute sur la capacité d'Oxide à gérer la demande et à convertir l'intérêt en ventes. D'autres s'interrogent sur la réalité des livraisons matérielles, même si des clients comme Jane Street, le Lawrence National Laboratory et Shopify sont cités. On note aussi des départs de personnalités clés : Jessie Frazelle a quitté ses fonctions il y a plusieurs années, et Steve Klabnik explique son départ, tout en restant un soutien. Plusieurs commentaires pointent le silence d'Oxide vis-à-vis des candidatures non retenues ou des formulaires de contact, ce qui contraste avec l'image soignée de l'entreprise.
La discussion corrige ou nuance l'article sur au moins deux points. D'une part, le montant de 445 M$ n'est pas une nouvelle isolée : Oxide a déjà levé beaucoup d'argent cette année, ce qui relativise l'événement. D'autre part, certains commentateurs jugent que l'entreprise, malgré son excellente vision matérielle, a « complètement manqué le coche » sur l'automatisation logicielle qui doit accompagner le rack. Enfin, un commentaire plus large alerte sur la contradiction entre l'argument de la souveraineté/confidentialité des données et la dépendance de l'industrie aux LLM des grands fournisseurs.
-
Keyv and friends compromised in active Shai-Hulud supply chain attack
Le 4 août 2026, des attaquants ont compromis le compte GitHub du mainteneur de keyv, une bibliothèque de stockage clé-valeur comptant ~127 millions de téléchargements npm par semaine, et ont injecté un ver voleur de credentials dans toute la famille de packages associée (cacheable, flat-cache, file-entry-cache, etc.). Les versions empoisonnées ont été publiées sur npm avec une provenance signée par GitHub Actions. L'attaque a ajouté un script preinstall exécutant un dropper obfusqué qui télécharge le runtime Bun, puis un payload (Math_Symbol.js) volant tokens npm, GitHub, identifiants AWS, secrets Kubernetes, tokens Vault, clés Stripe et Slack, ainsi que des fichiers sensibles (via ~200 motifs). Les données sont chiffrées et exfiltrées vers des dépôts GitHub publics ou un domaine de secours contrôlé via contrat Ethereum. Le ver se propage en réinfectant d'autres packages npm via les tokens volés et en modifiant les dépôts GitHub. Le 5 août, au moins 444 packages (1381 versions) étaient compromis, totalisant plus de 2 milliards d'installations mensuelles.
placeholder
-
Online ad giant Adform was hacked, proving once again why ad blockers are needed
Le fournisseur de publicité en ligne Adform a été victime d'un piratage : le 27 juillet, l'entreprise a diffusé des publicités contenant un code malveillant. Ce code, conçu pour se déclencher dans le navigateur des visiteurs, remplaçait l'adresse de portefeuille crypto dans le presse-papiers par celle du pirate, toutes les trois secondes, détournant ainsi les transactions. Le chercheur Kevin Beaumont a révélé l'incident. Adform a confirmé la brèche sans préciser l'origine ni l'ampleur, et n'exclut pas que les données de navigation des visiteurs aient été collectées. L'auteur recommande l'usage d'un bloqueur de publicité pour se protéger.
La discussion valide largement la thèse de l'article tout en apportant des précisions techniques. Plusieurs commentateurs jugent les publicités en ligne comme un vecteur de malwares et l'adblock comme une protection indispensable, certains allant jusqu'à comparer les bloqueurs à des préservatifs. Des informations concrètes émergent : le script compromis contenait deux blocs de code ajoutés à la fin, avec des adresses crypto ; l'analyse de la blockchain montre environ 110 000 $ en bitcoins et 55 000 $ en ether volés. Un contributeur souligne l'efficacité d'un blocage DNS sur les téléphones de ses parents, qui a bloqué 10 000 requêtes en 6 heures pour trois applications, mais précise que ce niveau ne suffit pas face à des sites comme YouTube qui servent les publicités depuis le même domaine que le contenu, d'où la nécessité d'un bloqueur navigateur.
Des nuances et contradictions apparaissent. Un commentateur estime que le titre est fallacieux : un site piraté ne justifie pas un bloqueur de publicités, mais plutôt une meilleure sécurité du navigateur ; d'autres lui répondent que ce sont les utilisateurs du site qui ont besoin de protection. Certains doutent de l'efficacité du détournement de portefeuille crypto, le jugeant trop limité et improbable. Le débat s'élargit également : un avis minoritaire soutient que le blocage des publicités tue l'internet en refusant toute compensation pour la valeur créée, tandis que d'autres rétorquent que ce sont les incitations perverses des modèles publicitaires qui détruisent le web. Plusieurs appellent à une réglementation de la publicité en ligne plutôt qu'à des solutions individuelles.
Sur le plan pratique, des commentateurs recommandent une défense en couches : blocage DNS, pare-feu applicatif, et bloqueurs navigateur. L'accès des navigateurs au presse-papiers est pointé comme un risque, avec une opposition à Google. Enfin, une discussion évoque l'IA comme solution de blocage, mais un participant exprime son scepticisme, estimant que les industries qui profitent du problème ne laisseront pas cette technologie les menacer.