15 years of FP64 segmentation, and why the Blackwell Ultra breaks the pattern
L’article explique que l’écart FP64:FP32 chez Nvidia s’est aggravé sur quinze ans, passant d’un ratio proche de 1:2 sur Fermi à 1:64 sur les GPUs grand public récents, l’essor de l’IA remettant en cause cette logique. Entre GTX 480 (2010) et RTX 5090 (2025), le FP64 n’a augmenté que de 9,65x, tandis que le FP32 a progressé d’environ 77,63x, accentuant le décalage. Nvidia a segmenté le marché en maintenant des GPUs d’entreprise avec un FP64 plus élevé et des GeForce avec des limitations, et a même publié une EULA en 2017 interdisant l’utilisation des GeForce dans les data centers. Face à la demande croissante d’IA, le FP64 est partiellement remplacé par des approches d’emulation utilisant FP32 et par le schéma Ozaki, avec cuBLAS ajoutant le support d’Ozaki en 2025. La génération Blackwell B300 réduit le ratio FP64:FP32 à 1:64, alors que le RTX 5090 affiche un ratio FP16:FP32 de 1:1, ce qui suggère une transition vers des architectures axées sur les faibles précisions et l’émulation plutôt qu’un abandon total du FP64.