HN Digest
Briefing personnel.

Edition quotidienne

Lire vite. Garder l'essentiel.

Les meilleurs longs formats de Hacker News, relus plus calmement.

7649 articles Page 1/765 Sans filtre

06:06

Automated sign detection across the Electronic Babylonian Library

Lire les tablettes cunéiformes est extrêmement exigeant, et seule une petite fraction des quelque demi-million de tablettes mises au jour a été analysée par les assyriologues. Les auteurs exploitent le plus grand jeu de données annoté de signes cunéiformes à ce jour et évaluent un modèle de détection d'objets basé sur Deformable DETR selon deux granularités de classes (173 et 106). Le système combine une extraction automatique des côtés de tablette, un regroupement heuristique des lignes et une évaluation de similarité textuelle par n-grammes pour relier la détection visuelle des signes à la structure textuelle. Sur des métriques de détection de type COCO, la méthode améliore de manière consistante les résultats antérieurs jusqu'à 28–37 % et, en inférence, elle a été appliquée à 87 668 fragments de la bibliothèque électronique babylonienne pour produire près de 2,9 millions de détections de signes. La méthode fonctionne sans connaissances linguistiques a priori et reste sensible aux dommages et à la variabilité de mise en page, mais elle offre une base évolutive et interprétable pour l'analyse corpusielle et l'intégration future de modèles multimodaux et linguistiques.

06:06

Building watchable digital twins of 64 World Cup games

Plusieurs entreprises extraient des données de match via vision par ordinateur appliquée aux diffusions et fournissent des couches comme détection d'objets, OCR, transformée des coordonnées et annotation d'événements. Les données se structurent en catégories (match, roster, événements, tracking) et leur résolution varie selon le fournisseur, de quelques dizaines de frames à 30 Hz pour un suivi complet. L'auteur a comparé cinq fournisseurs proposant des échantillons gratuits et conclut que PFF offre les données les plus complètes avec tracking à 30 Hz notamment pour la Coupe du Monde 2022. Le projet vise à construire un lecteur vidéo interactif avec API, endpoint de streaming et visualiseur web capable de restituer d'abord une vue 2D puis une reconstitution 3D en combinant coordonnées et scènes de repli basées sur les événements. Les données et le code du constructeur de flux et du visualiseur ont été publiés en open source pour permettre à d'autres de reproduire ou d'étendre ces visualisations, y compris des éléments comme animations de joueurs et foule simulée.

06:05

Introducing selfie for sign-in: a new way to access your Google Account

Google annonce une nouvelle option de connexion par vidéo selfie permettant d'accéder à son compte lorsque l'on est verrouillé ou sans ses appareils habituels. La configuration consiste à filmer un court selfie vidéo en effectuant quelques mouvements de tête guidés pour capturer plusieurs angles. Pour se reconnecter, un nouvel enregistrement est comparé au selfie sauvegardé afin de confirmer l'identité de l'utilisateur. Le selfie vidéo est enregistré et stocké de manière chiffrée avec le consentement de l'utilisateur, peut être supprimé à tout moment et n'est utilisé que pour la connexion sauf consentement contraire. Google indique que des protections contre les usurpations comme les deepfakes et ses pratiques habituelles de détection des connexions suspectes sont appliquées, et que cette option complète d'autres méthodes comme les clés d'accès et les contacts de récupération.

06:05

Open Problems: Why Reading Every Herculaneum Scroll Is Still a Challenge

L'équipe a démontré en 2026 qu'un rouleau d'Herculanum peut être virtuellement déroulé et lu, mais l'enjeu principal est d'automatiser et de rendre fiable ce processus à grande échelle pour tous les rouleaux. L'imagerie repose sur la microtomographie synchrotron haute résolution, où l'encre carbonée se confond souvent avec le papyrus carbonisé et où des régions compressées génèrent un brouillard causé par la décohésion du faisceau, imposant des compromis sur la taille de voxel, l'énergie et la distance échantillon‑détecteur. Le dépliage combine des prédictions de surface 3D (souvent nnU‑Net), la construction et l'optimisation de maillages (GrowPatch, lasagna), le traçage de fibres et un ajustement spiral global, mais reste semi‑automatique en raison d'erreurs topologiques et de la qualité approximative des annotations. La détection d'encre utilise des rendus conditionnés à la surface, l'apprentissage sur fragments et une boucle de pseudo‑étiquetage qui a permis de lire PHerc. 1667, tandis que la segmentation volumétrique directe est possible dans des cas favorables comme PHerc. Paris 4, mais la généralisation et l'ambiguïté de profondeur demeurent des problèmes ouverts. Pour passer à l'échelle, le projet mise sur des formats et infrastructures cloud‑friendly (OME‑Zarr, VC3D), des représentations auto‑supervisées (DINO) et sollicite des contributions communautaires ciblées en géométrie, traçage de fibres, qualité des labels, fonctions de coût et deep learning 3D afin de rendre le flux reproductible et robuste.

06:05

Escape Analysis in Go: Stack vs. Heap Allocations Explained

L'article explique l'analyse d'échappement en Go, un processus du compilateur qui décide si une valeur peut rester sur la pile ou doit être allouée sur le tas. Il détaille les causes courantes d'échappement, notamment le retour de pointeurs locaux, les closures et goroutines capturant des variables, le passage via des interfaces et le stockage dans des slices, maps ou structures persistantes. On y décrit comment inspecter ces décisions grâce au compilateur (go build -gcflags="-m") et pourquoi les logs bruts sont bruyants et difficiles à relier au code source. La fonctionnalité d'analyse d'échappement de l'IDE GoLand parse les sorties du compilateur pour afficher des marqueurs dans l'éditeur, filtrer et comparer les résultats, et faciliter l'investigation sans changer de contexte. Enfin l'article recommande de prioriser la mesure et le profilage, de se concentrer sur les chemins critiques et de privilégier la lisibilité du code plutôt que des micro‑optimisations prématurées.

06:05

Splink – Fast, accurate and scalable probabilistic data linkage

Ce package Python effectue du rapprochement probabiliste de fichiers et la déduplication d'enregistrements en l'absence d'identifiants uniques. Il implémente une variante du modèle de Fellegi‑Sunter et propose des ajustements pour la fréquence des termes ainsi qu'une logique d'appariement floue configurable afin d'améliorer la précision. L'outil est conçu pour être rapide et évolutif, capable d'exécuter des millions d'appariements localement via DuckDB ou sur des environnements big data comme AWS Athena ou Spark, et les modèles peuvent être entraînés de manière non supervisée. Les données d'entrée doivent être standardisées et contenir plusieurs colonnes peu corrélées pour de meilleurs résultats, l'approche étant déconseillée pour un unique champ de type "bag of words". Il est largement utilisé par des administrations, des institutions de recherche et des organisations internationales, fournit des sorties interactives et une documentation, bénéficie d'un forum de support et a reçu plusieurs distinctions.

06:05

For most US drivers, EVs offer emissions benefits and cost savings

Une nouvelle étude de chercheurs du MIT conclut que, malgré les variations régionales, les véhicules électriques émettent moins de gaz à effet de serre et ne coûtent pas plus que des véhicules à essence comparables pour la plupart des conducteurs et des flottes aux États-Unis. Les auteurs ont intégré des données détaillées par code postal et par conducteur — incluant météorologie, durée et distance des trajets, congestion, composition du mix électrique et prix moyens des carburants — et ont finalisé l'analyse fin 2024 et début 2025. Les résultats montrent que les véhicules 100 % électriques réduisent les émissions de 40 à 60 % en plupart d'endroits, avec des gains plus importants en zone urbaine, que les climats froids diminuent moins les bénéfices qu'on le pense souvent, et que les comportements de conduite comptent autant que le mix électrique régional. Sur le plan des coûts, les modèles indiquent que les véhicules électriques sont compétitifs en coût total de possession dans la plupart des régions, parfois moins chers que les hybrides ou les véhicules thermiques quand l'électricité est bon marché, même sans crédits d'impôt. Les chercheurs, dont Marco Miotti et Jessika Trancik, publient l'étude dans Environmental Research Letters, mettent à jour l'outil public carboncounter.com et prévoient d'ajouter une dimension temporelle et d'étendre l'analyse à d'autres régions et types de véhicules.

06:04

JEP 540: Simple JSON API (Now in Incubator)

La proposition introduit une API incubatrice légère dans le JDK pour analyser et générer des documents JSON conformes à la RFC 8259 sans dépendances externes. L'API vise à être petite et simple, facilitant la navigation et l'extraction de données via un modèle en arbre centré sur JsonValue et ses sous-types, avec des conversions vers les types Java courants. La méthode de parsing est stricte : aucune extension syntaxique n'est autorisée, les objets avec noms de membres dupliqués sont rejetés et les erreurs produisent des exceptions détaillées pour un échec rapide. L'API fournit des moyens pour gérer l'évolution des documents et les valeurs optionnelles ou nulles (tryGet, tryValue) et propose des conversions numériques contrôlées (asInt, asLong, asDouble) ainsi que l'usage de BigDecimal pour un traitement sans perte. Le projet exclut le data binding et le streaming afin de rester minimal, sera rigoureusement testé, suppose des documents tenus en mémoire et s'utilise en incubation via l'option --add-modules jdk.incubator.json.

06:04

Show HN: Remux – an open-source tmux workspace designed for iPhone

Remux permet de gérer des sessions, fenêtres et panneaux tmux depuis un appareil iOS avec une interface pensée pour le mobile. Il offre des aperçus de fichiers et de serveurs de développement, l'upload de photos et fichiers avec balisage d'images, ainsi que des contrôles de curseur et une palette de raccourcis enregistrés. La navigation inclut le balayage entre fenêtres, la sélection de panneaux via une feuille inférieure avec prévisualisations en direct, et des options pour diviser, zoomer ou fermer les panneaux. L'application se connecte directement en SSH sans relais ni compte central, en stockant mots de passe et clés privées dans le trousseau iOS et en mémorisant les clés hôtes de confiance. Remux est disponible en bêta publique sur TestFlight, peut être compilé depuis les sources avec Xcode et GhosttyKit, et utilise le cœur terminal Ghostty ainsi que Citadel pour SSH.