HN Digest
Briefing personnel.

Edition quotidienne

Lire vite. Garder l'essentiel.

Les meilleurs longs formats de Hacker News, relus plus calmement.

7989 articles Page 1/799 Sans filtre

06:08

Google will expand age checks on Android worldwide till the end of the year

Google annonce l'expansion mondiale de l'API Play Age Signals pour tous les développeurs Play, avec disponibilité déjà au Brésil, déploiement en Australie et au Canada mi-août et lancement global prévu plus tard cette année. L'API est un outil respectueux de la vie privée qui permet aux parents de partager la tranche d'âge de leur enfant via Google Family Link et aux adultes de communiquer leur âge si demandé par l'application. Les développeurs reçoivent ces signaux d'âge pour adapter le contenu, les fonctionnalités et les paramètres de leurs applications de façon appropriée à l'audience, au lieu d'imposer des règles uniformes. Le partage des tranches d'âge n'est pas activé par défaut et les parents peuvent gérer, mettre à jour ou désactiver ces paramètres en un seul endroit pour éviter de configurer chaque application séparément. Cette nouveauté vient compléter les protections existantes de Google Play, comme les politiques pour les applications familiales et les outils Play Console et Family Link destinés à protéger les enfants en ligne.

06:08

"the very foundation of modern academia has been blown to bits"

Autrefois, la recherche doctorale exigeait l'accès aux bibliothèques physiques, la mémorisation des articles importants et dépendait fortement de l'orientation du directeur de thèse. L'apparition du web puis d'outils comme Google Scholar a rendu possible en quelques jours ce qui prenait autrefois des années en donnant un accès largement centralisé à la littérature. Parallèlement, le nombre de thèses a fortement augmenté dans de nombreux pays tandis que le partage de code et de données ainsi que l'automatisation expérimentale ont simplifié certaines tâches de recherche. L'émergence d'IA autonomes permet désormais de générer des thèses plausibles et, comme beaucoup de thèses sont peu lues et parfois médiocres, les soutenances orales, souvent difficiles à rater pour des raisons sociales, offrent une protection limitée contre cette automatisation. Selon l'auteur, ces évolutions ont profondément remis en cause les fondements traditionnels de l'académie.

06:07

Exploring the "Dario and Amanda" Prompt

Claude Opus 5 génère du contenu qui ressemble à une fuite de journaux de discussion privés d'Anthropic pour 2024–2025, mais il s'agit très probablement d'hallucinations. L'auteur a rassemblé de nombreux ratés de cache et les a partagés dans un dépôt public sur GitHub. Parmi les exemples figurent des messages d'utilisateurs vulnérables adressés à la direction, de la correspondance interne et des extraits ressemblant à des discussions Slack. Certains passages sont troublants, évoquant tant des détails personnels alarmants qu'un contenu lié à des projets et contrats internes. Ces éléments font se poser la question de savoir si le modèle invente des informations ou s'il a été entraîné à partir de données internes de ses créateurs.

06:07

Why don't people use formal methods? (2019)

Les méthodes formelles englobent la spécification formelle (décrire précisément ce qu’un système doit faire) et la vérification formelle (prouver que le système satisfait cette spécification), et l’auteur distingue pour la clarté la vérification du code et la vérification du design. Les spécifications de code se présentent sous trois formes principales — théorèmes indépendants, assertions et contrats intégrés au code, et systèmes de types dépendants — qui forment un continuum de garanties allant des tests aux preuves complètes. Réaliser des preuves est très difficile et requiert des compétences mathématiques et des connaissances pointues des outils, mais l’arrivée des solveurs SMT comme Z3 et de bibliothèques prêtes à l’emploi a fortement automatisé certaines tâches et rendu possibles des projets tels que CompCert ou IronFleet. La vérification partielle, le typage avancé et les techniques intermédiaires (par ex. Cleanroom, Rust, SPARK) offrent des compromis coût/valeur utiles, tandis que la vérification de design et le model checking permettent de trouver des erreurs d’architecture complexes (exemples : Alloy, TLA+ et découvertes chez Chord ou AWS). Le principal frein à une adoption plus large n’est pas seulement technique mais social et culturel, car les développeurs doutent souvent de la valeur des specifications formelles et n’intègrent pas facilement ces artefacts non codés, ce qui maintient la vérification de code comme discipline spécialisée malgré des gains potentiels.

06:07

Solving poker in custom WebGPU kernels

L'auteur voulait créer un solveur de poker open source fonctionnant dans le navigateur mais a été freiné par l'absence d'une bibliothèque de tenseurs pour WebGPU. Il a demandé à un agent de génération de code d'écrire des kernels WebGPU reproduisant le comportement d'une référence PyTorch, obtenu la parité en un prompt, puis laissé optimiser les kernels pour obtenir un gain de vitesse supérieur à 10x. L'expérience montre que, lorsque la génération de code est peu coûteuse et que l'implémentation de référence et les tests sont fiables, un kernel sur-mesure peut dépasser une bibliothèque générale, bien que cela nécessite un calcul bien défini et des tests couvrant le comportement important. Les modèles d'IA ont évolué au point de pouvoir implémenter des articles, explorer des variantes de l'algorithme CFR et exécuter des essais autonomes, mais l'auteur reste la couche de planification et de supervision et a consacré des mois à encadrer le projet. Le solveur heads-up et son code sont disponibles publiquement, mais il demeure limité par rapport aux outils commerciaux en termes de fonctionnalités, de puissance de calcul et de force de jeu.

06:07

Are We Stuck with Lean?

L'auteur explique que la possibilité d'une alternative sérieuse à Lean dépend de la définition de "sérieuse", et cite Prove-It et Mizar selon le critère retenu. Il soutient que l'expérience utilisateur et le financement sont essentiels à l'adoption, en insistant sur l'importance de bibliothèques bien conçues, d'un bon onboarding et d'outils réactifs. Il note que Lean a bénéficié d'un soutien institutionnel permettant, par exemple, un éditeur web hébergé, et que des développeurs à plein temps, bien que coûteux, sont nécessaires pour une maintenance de qualité. Sur les fondations, il rappelle le bogue de sûreté du noyau de Lean lié aux types inductifs imbriqués mais estime que baser un assistant sur la théorie des ensembles n'est pas la solution évidente. Il préconise une conception descendante centrée sur l'ergonomie mathématique, citant la lourdeur bureaucratique de la théorie des catégories dans Mathlib et refusant que les fondations priment sur l'expérience utilisateur.

06:07

RFC 8890 – The Internet is for End Users (2020)

L'IAB a publié un document demandant que l'IETF fonde ses décisions sur l'intérêt des utilisateurs finaux et prenne des mesures positives en ce sens. L'article souligne que les choix techniques ont des implications politiques et sociales parce qu'ils favorisent ou désavantagent certains acteurs et usages. Des exemples comme DNS-over-HTTPS et l'Encrypted Client Hello illustrent les tensions entre opérateurs, défenseurs de la vie privée, autorités et gestionnaires de réseau, et montrent le besoin de consultations plus larges. L'auteur préconise que l'IETF formalise des principes guidant ses décisions, consulte davantage les parties prenantes et conçoive pour un environnement le plus défavorable possible plutôt que pour des intérêts locaux. Le texte rappelle que la publication de l'IAB est persuasive mais non contraignante et que l'application de ces principes dépendra de l'engagement des participants et de la communauté Internet.

06:06

Making Postgres queues scale

L'article montre que, contrairement à l'idée reçue, Postgres peut gérer des files de travaux à grande échelle si on applique des optimisations ciblées. La première optimisation consiste à utiliser FOR UPDATE SKIP LOCKED pour permettre à de nombreux workers de sélectionner et verrouiller simultanément des lots de tâches sans contention. Ils ont observé que REPEATABLE READ provoquait des échecs de sérialisation à haute concurrence et ont rendu le niveau d'isolation conditionnel, en utilisant READ COMMITTED pour les queues sans contrôle global et REPEATABLE READ seulement quand un ordre global est requis. Pour réduire le coût CPU et l'impact d'autovacuum, ils ont rendu les index plus sélectifs et ordonnés, notamment des index partiels triés sur priorité et timestamp pour le statut ENQUEUED et des index d'observabilité maintenus uniquement quand nécessaire. Ces changements ont permis d'atteindre plus de 30 000 exécutions de workflows par seconde (environ 80 milliards par mois) et DBOS publie documentation et code pour reproduire cette approche.

06:06

Destroying a Community with a Gigantic "Clogged Vacuum Cleaner"

Un journaliste local de Detroit a diffusé un reportage montrant un bruit perçant et continuel émanant d'un centre de données qui affecte des riverains. Les habitants disent que le son est présent 24 heures sur 24 et les images montrent l'impact visible sur une résidente qui en souffre depuis des années. Le site de Dowagiac est exploité par Hyperscale Data, appartenant à Alliance Cloud Services, et le bruit proviendrait principalement d'installations de minage de cryptomonnaies. Des relevés indiquent des niveaux autour de 50 à 70 dB et la ville a infligé une amende au centre pour dépassement des limites sonores, que l'exploitant conteste. Hyperscale affirme réduire progressivement le minage, se reconvertir vers des activités d'intelligence artificielle et de robotique, et prévoit d'arrêter complètement le minage dans les trois prochains mois pour réduire les émissions sonores.