HN Digest
Briefing personnel.

Lire vite.
Garder l'essentiel.

Les meilleurs longs formats de Hacker News, relus plus calmement.

11293 articles Page 1092/1130 Sans filtre

15 years of FP64 segmentation, and why the Blackwell Ultra breaks the pattern

L’article explique que l’écart FP64:FP32 chez Nvidia s’est aggravé sur quinze ans, passant d’un ratio proche de 1:2 sur Fermi à 1:64 sur les GPUs grand public récents, l’essor de l’IA remettant en cause cette logique. Entre GTX 480 (2010) et RTX 5090 (2025), le FP64 n’a augmenté que de 9,65x, tandis que le FP32 a progressé d’environ 77,63x, accentuant le décalage. Nvidia a segmenté le marché en maintenant des GPUs d’entreprise avec un FP64 plus élevé et des GeForce avec des limitations, et a même publié une EULA en 2017 interdisant l’utilisation des GeForce dans les data centers. Face à la demande croissante d’IA, le FP64 est partiellement remplacé par des approches d’emulation utilisant FP32 et par le schéma Ozaki, avec cuBLAS ajoutant le support d’Ozaki en 2025. La génération Blackwell B300 réduit le ratio FP64:FP32 à 1:64, alors que le RTX 5090 affiche un ratio FP16:FP32 de 1:1, ce qui suggère une transition vers des architectures axées sur les faibles précisions et l’émulation plutôt qu’un abandon total du FP64.

Sizing chaos

Le texte décrit l’absence de standardisation des tailles vestimentaires, qui varient d’une marque à l’autre et compliquent l’essayage en magasin ou en ligne. Il précise que les tailles pour enfants et adolescents évoluent et que les coupes tween et junior ne s’alignent pas nécessairement sur les morphologies des femmes adultes. Le passage met en évidence le vanity sizing, pratique consistant à étiqueter des tailles plus petites que les mesures réelles afin de stimuler les achats, et ses effets sur la confiance des consommatrices. L’auteur raconte son apprentissage de la couture et la création d’un patron personnalisé, démontrant que les tailles standardisées visent la production de masse plutôt que les corps individuels. Le texte conclut en appelant à des systèmes de taille plus inclusifs et transparents, s’appuyant sur des données anthropométriques et des comparaisons de chartes de tailles pour mieux servir les femmes et les adolescentes.

Show HN: 6cy – Experimental streaming archive format with per-block codecs

Le projet est en développement actif et n’est pas stable, et le format ainsi que les API peuvent changer sans préavis. Il vise le benchmarking, la recherche et le prototypage d’écosystèmes et n’est pas recommandé pour une utilisation en production pour le moment. Sixcy est un format de conteneur moderne et robuste conçu pour le stockage et la transmission de données à haute performance, avec un accent sur le streaming efficace et la récupérabilité des données. Il offre une conception orientée streaming, une récupération via des blocs auto-descriptifs et des points de contrôle, le support de plusieurs algorithmes de compression dans une même archive et une architecture de plugins. L’implémentation de référence en Rust est performante et sûre en mémoire, et sert de référence canonique pour la spécification Sixcy, avec des composants bloc, codec, index, récupération et E/S, ainsi que des outils de tests et de benchmarks.

Approaches to writing two-sentence journal entries

L'article présente des méthodes pour composer des entrées de journal en deux phrases et partage l'expérience de l'auteur pour aider les lecteurs. Il décrit trois approches principales: écrire sur papier brouillon puis transférer, noter et réviser dans Google Keep, et écrire directement dans le journal en fin de journée. Dans la méthode sur papier brouillon, l'auteur griffonne rapidement, réécrit et remplace les phrases au fur et à mesure jusqu'à obtenir une version finale. Pour Google Keep, il crée une note datée et taguée, collecte des réflexions tout au long de la journée et transfère la version finale dans le journal physique et le fichier Markdown numérique. Le texte détaille aussi les formats, expliquant l'organisation du journal analogique et du journal numérique en Markdown, et justifie les choix pour la portabilité, la lisibilité et la continuité du récit.

The Godless Students of London University

Dans les années 1820, Londres était la plus grande ville du monde et le centre d’un empire en expansion. La ville était aussi un lieu d’apprentissage, les étudiants en médecine se formant dans les hôpitaux londoniens et les Inns of Court assurant l’enseignement du droit. Pourtant, elle ne possédait pas d’université. Le récit examine la controverse entourant la fondation de la première université londonienne et les allégations sur la politique radicale et le comportement tumultueux des étudiants. Il cherche à déterminer dans quelle mesure ces affirmations reflétaient la réalité de l’époque.

Hamming Distance for Hybrid Search in SQLite

Cet article présente comment ajouter une recherche sémantique dans SQLite en utilisant des embeddings binaires et la distance de Hamming, afin de proposer une recherche hybride sans bases de données vectorielles externes. FTS5 offre le texte avec BM25, mais ne prend pas en charge la recherche sémantique; l’approche combine la correspondance des mots et la compréhension du sens des textes. Les embeddings binaires quantifient chaque dimension en un seul bit, ce qui réduit considérablement le stockage et fait passer la métrique de similarité à la distance de Hamming, calculable par XOR et comptage de bits. L’implémentation est une extension SQLite chargée dynamiquement qui expose la fonction hamming_distance et retourne une distance entre deux BLOB, avec des performances mesurées autour de 35 ms pour 1 million d’entrées en mémoire et des limites liées à l’absence de table virtuelle. Pour fusionner BM25 et sémantique, l’article détaille la fusion de rangs (RRF) utilisant des scores de type 1/(k+rank+1) avec k souvent fixé à 60, afin de produire un classement final.

Sub-Millisecond RAG on Apple Silicon. No Server. No API. One File

Le système réunit mémoire et récupération d’informations en un seul fichier .mv2s qui regroupe documents, embeddings et index. Il n’exige aucune infrastructure serveur et fonctionne hors connexion, sans appels réseau ni dépendances externes. Le système prend en charge le texte, la mémoire photo et la mémoire vidéo, avec une recherche hybride utilisant BM25 et des index vectoriels (HNSW) et un budget de tokens déterministe. Son format est append-only et intègre un WAL pour la récupération après crash et un TOC pour l’intégrité des métadonnées. Des performances mesurées sur Apple Silicon montrent des latences faibles et une ingestion efficace, tout en assurant portabilité et confidentialité des données.