HN Digest
Briefing personnel.

Lire vite.
Garder l'essentiel.

Les meilleurs longs formats de Hacker News, relus plus calmement.

11293 articles Page 35/1130 Sans filtre

One month coding with GLM 5.3 Flash

L'équipe avait pour objectif de passer tout le mois sur le modèle GLM 5.3 Flash et a réussi à y consacrer la première moitié du mois. La consommation et le coût pendant cette période étaient faibles, mais la seconde moitié a basculé vers d'autres modèles et a généré environ un milliard de tokens supplémentaires. Un prototype expérimental du serveur Wagtail MCP utilisant du "vibe coding" a provoqué un choix de modèle inapproprié qui a coûté environ 450 millions de tokens, 150 dollars et 5 kWh malgré une démonstration fonctionnelle. Des problèmes de disponibilité d'infrastructure chez les fournisseurs d'inférence ont aussi obligé l'équipe à basculer vers des modèles alternatifs comme DeepSeek V4.1 Flash et Qwen 3.8 Flash pour maintenir les performances. Les leçons tirées incluent la nécessité de mesurer localement l'usage et l'énergie, de budgéter l'expérimentation, d'améliorer la sélection de prompts et d'agents, et de viser l'essentiel des inférences sur des modèles flash efficaces.

The first packet sent via RFC1149 avian carrier is up for auction at Christie's

En 1990, un ingénieur réseau américain a rédigé la RFC 1149, une spécification humoristique publiée le 1er avril qui décrit la transmission de paquets IP par pigeons voyageurs. En avril 2001, un groupe d'utilisateurs Linux en Norvège a réalisé une mise en œuvre complète en imprimant des paquets IP sous forme hexadécimale, en les fixant aux pattes de pigeons de course et en les transmettant entre deux colombiers distants d'environ trois miles. Neuf paquets furent expédiés et quatre réponses valides furent retournées lors de l'expérience. L'objet décrit est l'un de ces paquets physiques : un parchemin imprimé de 41 x 210 mm présentant des plis d'enroulement dus à l'attache sur la patte, présenté encadré et avec, au verso du support, l'inscription « Property of » suivie du nom du destinataire. Cette mise en œuvre est régulièrement citée comme un exemple emblématique de la bidouille inventive d'Internet, illustrant la ludicité, l'ingéniosité technique et l'esprit collaboratif de la communauté.

Anatomy of a Lean proof for software engineers

L'article présente un langage dont les symboles sont des colonnes de trois bits et qui contient les mots dont la troisième ligne est la somme binaire des deux premières, et il pose la question de montrer que ce langage est régulier. La solution consiste à reconnaître la version renversée du langage pour lire les bits de poids faible d'abord et à construire un automate fini déterministe qui garde en mémoire un seul bit de retenue (0 ou 1) plus un état mort. La formalisation en Lean définit l'alphabet Sigma3, la spécification du langage, l'implémentation de la fonction de transition dfaStep et l'automate adderDFA, avec des vérifications d'exemples au moment de la compilation. La preuve centrale établit un invariant de parcours par induction sur la liste de colonnes, s'appuie sur des lemmes auxiliaires (split_run, first_step_adds, least_significant_bit_split) pour relier l'exécution de l'automate aux égalités arithmétiques colonne par colonne, puis montre que adderDFA.accepts coïncide avec la réversion du langage et conclut par la fermeture des langages réguliers par renversement. L'article conclut en observant que la formalisation exige beaucoup de détails et d'analyses de cas et que, bien que des tactiques et des procédures décisionnelles automatisent une grande partie du travail, la compréhension humaine des preuves reste importante.

Blogging with Gleam, Org-Mode and Pandoc

L'auteur présente une chaîne de publication centrée sur Emacs et Org-mode pour écrire les contenus et intégrer code, citations et diagrammes de façon reproductible. Le pipeline convertit les fichiers .org en Markdown avec Pandoc (plus quelques filtres Lua), puis utilise Gleam, Blogatto et Lustre pour générer un site statique typé et vérifiable. D2 et Babel sont employés pour produire des diagrammes et exécuter des blocs de code depuis les documents Org, permettant de régénérer les résultats directement dans l'éditeur. Nix, flakes et devenv assurent un environnement de développement reproductible et verrouillé qui rend les builds et les développements locaux prévisibles. L'auteur défend qu'Org-mode, bien qu'il ressemble à du « bloat » aux yeux de la philosophie Unix, fournit un modèle interactif et cohérent supérieur au Markdown pour des travaux mêlant texte et calcul.

Show HN: Made an open-source Lego AI generator

Ce projet fournit une application web permettant à des agents d'IA de concevoir des modèles 3D exécutables en langage LDraw et de produire le code source LDraw ainsi que des vues 3D, des fichiers .glb éditables dans Blender et l'historique de discussion. Les agents lisent la documentation fournie, planifient la construction, créent des scripts Python générateurs qui produisent les fichiers LDraw, rendent des images pour inspecter le résultat et itèrent jusqu'à considération du modèle comme terminé. L'application s'installe via Docker en clonant deux dépôts synchronisés, en construisant l'image puis en lançant le service accessible en HTTP/HTTPS localement, la VR étant disponible via HTTPS avec certificat auto-signé. Le système peut utiliser un moteur de recherche sémantique re-ranké (jev-rerank) si une clé TypeSafe est fournie, sinon il retombe sur une recherche textuelle complète pouvant nuire à la qualité des pièces trouvées. Les limites actuelles incluent la lenteur et le coût des générations, des problèmes de performance en VR, des résultats perfectibles pour certaines familles de modèles et le besoin d'améliorer l'efficacité et la compatibilité avec des agents moins puissants.

What if AI worked at 1.000.000 tokens per seconds?

L'article distingue quatre sens différents pour un grand chiffre de débit : la capacité de contexte, la vitesse de lecture des entrées, le débit global d'un service et la vitesse d'écriture d'un seul agent. Une grande fenêtre de contexte (par exemple 1M tokens) signifie une mémoire, pas une vitesse d'écriture, et des techniques comme le batching ou le décodage spéculatif améliorent le throughput sans supprimer la dépendance sérielle entre tokens. Avec une molette imaginaire, l'auteur illustre que des milliers d'ébauches peuvent être générées très vite en écriture seule, mais que ces chiffres excluent la lecture, le classement, les tests et le fait qu'un token n'est pas un mot. La loi d'Amdahl appliquée ici montre qu'un contrôle fixe après génération peut faire retomber l'accélération globale bien en dessous du gain d'écriture pur, comme l'exemple des quarante brouillons où un contrôle d'une minute réduit un gain théorique de 10 000× à environ 132×. Lorsque la génération devient bon marché, ce qui reste rare et critique, c'est le jugement — goût, spécifications, tests, fidélité et coûts — et l'article recommande de définir ce qu'est "fini", poser des critères, identifier l'étape lente et demander des options contradictoires.

OKI Develops 124-Layer PCB Technology

Face à l'augmentation des échanges de données entre GPU et mémoire pour l'IA, OKI a développé une technologie de PCB répondant aux exigences de transfert haute vitesse, haute fréquence et grande densité. En combinant des matériaux ultra-fins, des outillages adaptés et un système automatique de transport pour matériaux ultra-fins, l'entreprise a porté le nombre de couches à 124 tout en conservant une épaisseur de carte de 7,6 mm. Cette avancée surmonte la limite précédente de 108 couches et vise à soutenir des applications telles que la mémoire empilée HBM, les semi-conducteurs miniaturisés, l'aérospatiale, la défense, la robotique et les communications de nouvelle génération. OKI, qui propose des services EMS couvrant la conception, la production et les tests de fiabilité, prévoit de poursuivre le développement de technologies PCB pour accompagner l'évolution des semiconducteurs. La société présentera cette technologie au salon PCB East 2025 (Boxboro Regency Hotel, Massachusetts) du 30 avril au 2 mai 2025 au stand 305.

Billions of Triangles Redux

NVIDIA a mis à jour l'exemple open source vk_lod_clusters avec une nouvelle scène Zorah en glTF et un rendu pathtracé utilisant les fonctionnalités de raytracing groupé exposées par le pilote, ce qui a motivé des améliorations de la prise en charge du LOD groupé hiérarchique dans meshoptimizer. Les fichiers glTF utilisent désormais les extensions de compression meshoptimizer (EXT_meshopt_compression en v0 et KHR_meshopt_compression en v1), ce qui permet environ deux fois moins de données géométriques sur disque et de meilleurs ratios et débits de décompression avec la v1. Côté traitement, clusterlod.h a été amélioré pour mieux gérer les attributs via la simplification consciente des attributs, la mode permissive stabilisée et un bridage (clamping) de l'erreur d'attribut inspiré d'Unreal qui réduit fortement l'empreinte mémoire et les surcharges de streaming. La simplification de la végétation posait un problème d'érosion des feuilles car la réduction mène à la suppression coordonnée des éléments, et la solution retenue consiste à préserver ou dilater sélectivement les bords afin de redistribuer la surface et maintenir la couverture visuelle, exposée comme option d'activation. Enfin, un nouveau codec de meshlet très rapide et compact a permis de diviser notablement la taille des index de triangles et, avec les autres évolutions intégrées dans meshoptimizer 1.3, l'ensemble offre des gains importants tout en laissant ouverts des compromis et des questions d'adoption pour le LOD groupé.