COMPUTE ATLAS Supercomputer supply-chain graph
1153 systems 482 sites Sourced data

Supercomputers/Analysis/Performance per watt

Analysis 13

Performance per watt, 2000 to today

The 382 systems in this dataset that report both a measured Rmax and a power draw delivered a median of 0.20 GFlop/s per watt when they first ran in 2005 to 2009, and 42 in 2025 to date: 206 times as much. A straight line through the logarithm of the points doubles every 2.3 years (R² 0.81). The most efficient machine here, Otus, delivers 68. Accelerated systems lead by 3.8 times in the latest era.

This is the ranked world only. Efficiency here is a measured FP64 benchmark result divided by the power drawn during that run, so it exists only for systems that submitted one: 382 of the 735 systems with an Rmax in this dataset. The AI clusters being built today mostly report low-precision peak figures and no power draw at all, and are not on this page, which is why the line it draws is the efficiency of the machines a ranking can see, not of compute in general.

Phase 1 seed dataset, compiled by hand. These rows were built from public operator, laboratory and vendor sources. A mechanical second-reader pass has since fetched every cited source: 1092 of 1153 systems have a readable citation that names them, and 40 are genuinely weakly sourced. Every claim carries its source and a confidence tier. Treat anything below verified as a lead, not a citation.

  • CPU-only
  • Accelerated
Measured performance per watt by first-light year, 2000-2026 Log-scale dot plot of measured HPL performance per watt for every system that reports both Rmax and power, by the year it first ran, coloured by whether it has accelerators, with a line through the five-year medians. 0.010.1110100200020052010201520202025 median per five years BlueGene/L CPU-only 0.334 GFlop/s per watt, 2004 Stella CPU-only 0.205 GFlop/s per watt, 2005 BGW CPU-only 0.204 GFlop/s per watt, 2005 ASC Purple CPU-only 0.0379 GFlop/s per watt, 2005 JUBL CPU-only 0.209 GFlop/s per watt, 2006 TSUBAME1.0 CPU-only 0.0318 GFlop/s per watt, 2006 JUGENE CPU-only 0.379 GFlop/s per watt, 2007 New York Blue CPU-only 0.204 GFlop/s per watt, 2007 Encanto CPU-only 0.147 GFlop/s per watt, 2007 HLRB-II CPU-only 0.0571 GFlop/s per watt, 2007 Honeywell x3650 Cluster CPU-only 0.0510 GFlop/s per watt, 2007 Hexagon CPU-only 0.468 GFlop/s per watt, 2008 Roadrunner Accelerated 0.438 GFlop/s per watt, 2008 Intrepid CPU-only 0.364 GFlop/s per watt, 2008 Brutus CPU-only 0.341 GFlop/s per watt, 2008 Kraken CPU-only 0.269 GFlop/s per watt, 2008 Franklin CPU-only 0.232 GFlop/s per watt, 2008 Chebyshev CPU-only 0.178 GFlop/s per watt, 2008 Ranger CPU-only 0.163 GFlop/s per watt, 2008 Netuno CPU-only 0.125 GFlop/s per watt, 2008 Bluefire CPU-only 0.0890 GFlop/s per watt, 2008 Shaheen CPU-only 0.379 GFlop/s per watt, 2009 Lomonosov Accelerated 0.322 GFlop/s per watt, 2009 Baku (HLRS) Accelerated 0.273 GFlop/s per watt, 2009 Colosse CPU-only 0.232 GFlop/s per watt, 2009 Tachyon II CPU-only 0.216 GFlop/s per watt, 2009 VSC-1 CPU-only 0.199 GFlop/s per watt, 2009 JUROPA CPU-only 0.177 GFlop/s per watt, 2009 Galileu CPU-only 0.150 GFlop/s per watt, 2009 JSS FX1 CPU-only 0.108 GFlop/s per watt, 2009 Tianhe-1A Accelerated 0.635 GFlop/s per watt, 2010 Hopper (NERSC) CPU-only 0.362 GFlop/s per watt, 2010 Tera-100 CPU-only 0.229 GFlop/s per watt, 2010 Haeon CPU-only 0.185 GFlop/s per watt, 2010 Red Sky CPU-only 0.0998 GFlop/s per watt, 2010 HokieSpeed Accelerated 0.954 GFlop/s per watt, 2011 Zin CPU-only 0.837 GFlop/s per watt, 2011 K computer CPU-only 0.830 GFlop/s per watt, 2011 Carter (Purdue) CPU-only 0.742 GFlop/s per watt, 2011 Sunway BlueLight MPP CPU-only 0.741 GFlop/s per watt, 2011 Dawson2 (UCLA) Accelerated 0.732 GFlop/s per watt, 2011 Tianhe-1A Hunan Solution Accelerated 0.668 GFlop/s per watt, 2011 Mustang (LANL) CPU-only 0.427 GFlop/s per watt, 2011 Guillimin CPU-only 0.404 GFlop/s per watt, 2011 Cielo CPU-only 0.279 GFlop/s per watt, 2011 SANAM Accelerated 2.97 GFlop/s per watt, 2012 Turing (IDRIS) CPU-only 2.18 GFlop/s per watt, 2012 DiRAC BlueGene/Q CPU-only 2.18 GFlop/s per watt, 2012 KEK SAKURA CPU-only 2.18 GFlop/s per watt, 2012 Mira CPU-only 2.18 GFlop/s per watt, 2012 Avoca CPU-only 2.18 GFlop/s per watt, 2012 Sequoia CPU-only 2.18 GFlop/s per watt, 2012 Fermi CPU-only 2.18 GFlop/s per watt, 2012 Vulcan CPU-only 2.18 GFlop/s per watt, 2012 Titan Accelerated 2.14 GFlop/s per watt, 2012 JUQUEEN CPU-only 2.10 GFlop/s per watt, 2012 Blue Joule CPU-only 2.10 GFlop/s per watt, 2012 Sisu CPU-only 1.84 GFlop/s per watt, 2012 MVS-10P Accelerated 1.69 GFlop/s per watt, 2012 HA-PACS Accelerated 1.04 GFlop/s per watt, 2012 Virgo (IIT Madras) CPU-only 0.933 GFlop/s per watt, 2012 MareNostrum 3 Accelerated 0.911 GFlop/s per watt, 2012 Midway (UChicago) CPU-only 0.911 GFlop/s per watt, 2012 Yellowstone CPU-only 0.877 GFlop/s per watt, 2012 Gordon CPU-only 0.865 GFlop/s per watt, 2012 SuperMUC CPU-only 0.846 GFlop/s per watt, 2012 Cab CPU-only 0.825 GFlop/s per watt, 2012 Formosa 5 Accelerated 0.818 GFlop/s per watt, 2012 Abel (UiO) CPU-only 0.787 GFlop/s per watt, 2012 Triolith CPU-only 0.785 GFlop/s per watt, 2012 Oakleaf-FX CPU-only 0.745 GFlop/s per watt, 2012 Vilje CPU-only 0.739 GFlop/s per watt, 2012 Tianhe-1A Guangzhou Solution CPU-only 0.733 GFlop/s per watt, 2012 Grifo04 Accelerated 0.688 GFlop/s per watt, 2012 Curie CPU-only 0.637 GFlop/s per watt, 2012 Raijin (NCI) CPU-only 0.610 GFlop/s per watt, 2012 Helios (IFERC) CPU-only 0.562 GFlop/s per watt, 2012 SuperMike-II Accelerated 0.555 GFlop/s per watt, 2012 Abisko CPU-only 0.522 GFlop/s per watt, 2012 Keeneland Accelerated 0.252 GFlop/s per watt, 2012 Blue Brain IV CPU-only 2.18 GFlop/s per watt, 2013 Conte Accelerated 1.92 GFlop/s per watt, 2013 PARAM Yuva II Accelerated 1.85 GFlop/s per watt, 2013 Cascade (PNNL) Accelerated 1.83 GFlop/s per watt, 2013 Cartesius CPU-only 1.54 GFlop/s per watt, 2013 Big Red II Accelerated 1.30 GFlop/s per watt, 2013 Stampede Accelerated 1.15 GFlop/s per watt, 2013 Aaditya CPU-only 0.911 GFlop/s per watt, 2013 Argus CPU-only 0.911 GFlop/s per watt, 2013 Spirit (AFRL) CPU-only 0.881 GFlop/s per watt, 2013 TEIDE-HPC CPU-only 0.878 GFlop/s per watt, 2013 Makman-1 CPU-only 0.874 GFlop/s per watt, 2013 Amazon EC2 C3 Instance Cluster CPU-only 0.795 GFlop/s per watt, 2013 ARCHER CPU-only 0.497 GFlop/s per watt, 2013 L-CSC Accelerated 5.54 GFlop/s per watt, 2014 HPC2 Accelerated 2.60 GFlop/s per watt, 2014 Cypress (Tulane) Accelerated 2.54 GFlop/s per watt, 2014 Camellia (Kyoto) Accelerated 2.30 GFlop/s per watt, 2014 QB-2 Accelerated 2.10 GFlop/s per watt, 2014 Tianhe-2 LvLiang Solution Accelerated 2.08 GFlop/s per watt, 2014 COMA (PACS-IX) Accelerated 2.04 GFlop/s per watt, 2014 Magnus CPU-only 1.58 GFlop/s per watt, 2014 SuperMIC Accelerated 1.51 GFlop/s per watt, 2014 CNIC Era Accelerated 1.44 GFlop/s per watt, 2014 Lobachevsky Accelerated 1.43 GFlop/s per watt, 2014 VSC-3 CPU-only 1.32 GFlop/s per watt, 2014 Faris CPU-only 1.15 GFlop/s per watt, 2014 Konrad (HLRN-III) CPU-only 1.13 GFlop/s per watt, 2014 ForHLR I CPU-only 1.01 GFlop/s per watt, 2014 Edison CPU-only 0.442 GFlop/s per watt, 2014 XStream Accelerated 4.11 GFlop/s per watt, 2015 Sango Accelerated 3.22 GFlop/s per watt, 2015 DKRZ Mistral CPU-only 2.70 GFlop/s per watt, 2015 Abel CPU-only 2.24 GFlop/s per watt, 2015 Beskow CPU-only 2.14 GFlop/s per watt, 2015 Nagoya FX100 CPU-only 2.11 GFlop/s per watt, 2015 Prometheus Accelerated 2.07 GFlop/s per watt, 2015 Sekirei (ISSP System B) Accelerated 2.03 GFlop/s per watt, 2015 Makman-2 CPU-only 1.98 GFlop/s per watt, 2015 Shaheen II CPU-only 1.95 GFlop/s per watt, 2015 SORA-MA CPU-only 1.91 GFlop/s per watt, 2015 HOKUSAI GreatWave Accelerated 1.91 GFlop/s per watt, 2015 Plasma Simulator FX100 CPU-only 1.91 GFlop/s per watt, 2015 SuperMUC Phase 2 CPU-only 1.90 GFlop/s per watt, 2015 PSNC Eagle CPU-only 1.84 GFlop/s per watt, 2015 Shirokane3 Accelerated 1.84 GFlop/s per watt, 2015 Taurus Accelerated 1.77 GFlop/s per watt, 2015 Nuri CPU-only 1.77 GFlop/s per watt, 2015 Miri CPU-only 1.77 GFlop/s per watt, 2015 ILGTI Cray XC30 Accelerated 1.75 GFlop/s per watt, 2015 JURECA Accelerated 1.71 GFlop/s per watt, 2015 Hummel CPU-only 1.63 GFlop/s per watt, 2015 Hazel Hen CPU-only 1.56 GFlop/s per watt, 2015 SahasraT CPU-only 1.48 GFlop/s per watt, 2015 Abacus 2.0 Accelerated 1.44 GFlop/s per watt, 2015 Earth System Numerical Simulator CPU-only 1.37 GFlop/s per watt, 2015 Swierk Computing Centre CPU-only 1.27 GFlop/s per watt, 2015 Tryton CPU-only 1.17 GFlop/s per watt, 2015 ARIS Accelerated 1.10 GFlop/s per watt, 2015 Cherry Creek Accelerated 0.871 GFlop/s per watt, 2015 Sky Bridge CPU-only 0.789 GFlop/s per watt, 2015 Thunder (AFRL) Accelerated 0.649 GFlop/s per watt, 2015 Grace (UCL) CPU-only 0.554 GFlop/s per watt, 2015 Intel SC D2P4 CPU-only 0.541 GFlop/s per watt, 2015 Galileo Accelerated 0.242 GFlop/s per watt, 2015 Sakura (PEZY) Accelerated 16.7 GFlop/s per watt, 2016 GOSAT-2 RCF2 Accelerated 9.80 GFlop/s per watt, 2016 Sunway TaihuLight CPU-only 6.05 GFlop/s per watt, 2016 QPACE3 CPU-only 5.78 GFlop/s per watt, 2016 Oakforest-PACS CPU-only 4.98 GFlop/s per watt, 2016 Camphor 2 Accelerated 4.09 GFlop/s per watt, 2016 SciPhi-XVI CPU-only 3.84 GFlop/s per watt, 2016 Cori Accelerated 3.56 GFlop/s per watt, 2016 Phoenix (Adelaide) Accelerated 3.34 GFlop/s per watt, 2016 Cheyenne CPU-only 2.77 GFlop/s per watt, 2016 Grizzly CPU-only 2.52 GFlop/s per watt, 2016 Ollie CPU-only 2.48 GFlop/s per watt, 2016 Reedbush-U CPU-only 2.31 GFlop/s per watt, 2016 Laurel 2 CPU-only 2.30 GFlop/s per watt, 2016 BinAC Accelerated 2.22 GFlop/s per watt, 2016 Owens Accelerated 2.18 GFlop/s per watt, 2016 BrENIAC CPU-only 2.15 GFlop/s per watt, 2016 ECMWF Cray XC40 CPU-only 2.08 GFlop/s per watt, 2016 NEMO bwForCluster CPU-only 2.05 GFlop/s per watt, 2016 Tera-1000-1 CPU-only 1.79 GFlop/s per watt, 2016 ForHLR II CPU-only 1.77 GFlop/s per watt, 2016 Lonestar 5 CPU-only 1.74 GFlop/s per watt, 2016 Okeanos CPU-only 1.55 GFlop/s per watt, 2016 Lengau CPU-only 1.50 GFlop/s per watt, 2016 ASPIRE 1 CPU-only 0.871 GFlop/s per watt, 2016 Caliburn CPU-only 0.673 GFlop/s per watt, 2016 Suiren2 Accelerated 16.8 GFlop/s per watt, 2017 Gyoukou Accelerated 14.2 GFlop/s per watt, 2017 Kukai Accelerated 14.0 GFlop/s per watt, 2017 AIST AI Cloud Accelerated 12.7 GFlop/s per watt, 2017 Wilkes-2 Accelerated 10.4 GFlop/s per watt, 2017 TSUBAME3.0 Accelerated 10.3 GFlop/s per watt, 2017 Reedbush-L Accelerated 10.2 GFlop/s per watt, 2017 Piz Daint Accelerated 8.91 GFlop/s per watt, 2017 CNIC Era-AI Accelerated 8.60 GFlop/s per watt, 2017 Reedbush-H Accelerated 8.55 GFlop/s per watt, 2017 Cedar (SFU) Accelerated 8.02 GFlop/s per watt, 2017 Theta CPU-only 5.41 GFlop/s per watt, 2017 Joliot-Curie SKL CPU-only 4.43 GFlop/s per watt, 2017 MareNostrum 4 CPU-only 3.96 GFlop/s per watt, 2017 Tera-1000-2 CPU-only 3.77 GFlop/s per watt, 2017 CMA PAI-A CPU-only 3.30 GFlop/s per watt, 2017 IMS Molecular Simulator CPU-only 3.29 GFlop/s per watt, 2017 Mogon II CPU-only 3.00 GFlop/s per watt, 2017 Centennial (ARL) CPU-only 2.92 GFlop/s per watt, 2017 AWE Damson CPU-only 2.86 GFlop/s per watt, 2017 Pratyush CPU-only 2.78 GFlop/s per watt, 2017 Mihir CPU-only 2.69 GFlop/s per watt, 2017 Trinity Accelerated 2.66 GFlop/s per watt, 2017 Serrano (Sandia) CPU-only 2.55 GFlop/s per watt, 2017 Cayenne (Sandia) CPU-only 2.55 GFlop/s per watt, 2017 Graham Accelerated 2.25 GFlop/s per watt, 2017 Sator CPU-only 2.07 GFlop/s per watt, 2017 Summit Accelerated 14.7 GFlop/s per watt, 2018 Sierra Accelerated 12.7 GFlop/s per watt, 2018 ABCI Accelerated 12.1 GFlop/s per watt, 2018 MareNostrum P9 CTE Accelerated 11.9 GFlop/s per watt, 2018 Sugon Advanced Computing System PreE CPU-only 11.4 GFlop/s per watt, 2018 HPC4 Accelerated 9.25 GFlop/s per watt, 2018 Lemhi CPU-only 4.56 GFlop/s per watt, 2018 JUWELS Cluster Accelerated 4.54 GFlop/s per watt, 2018 ATERUI II CPU-only 4.21 GFlop/s per watt, 2018 JFRS-1 CPU-only 4.00 GFlop/s per watt, 2018 Taiwania Accelerated 3.99 GFlop/s per watt, 2018 Niagara CPU-only 3.92 GFlop/s per watt, 2018 Gaïa (EDF) CPU-only 3.87 GFlop/s per watt, 2018 Makman-3 CPU-only 3.82 GFlop/s per watt, 2018 PALMA II CPU-only 3.73 GFlop/s per watt, 2018 CMA PAI-B Accelerated 3.59 GFlop/s per watt, 2018 CLAIX-2018 Accelerated 3.58 GFlop/s per watt, 2018 COBRA Accelerated 3.43 GFlop/s per watt, 2018 Electra CPU-only 3.23 GFlop/s per watt, 2018 Astra CPU-only 1.53 GFlop/s per watt, 2018 A64FX Prototype CPU-only 16.9 GFlop/s per watt, 2019 AiMOS Accelerated 16.3 GFlop/s per watt, 2019 NA-1 Accelerated 16.2 GFlop/s per watt, 2019 Satori (MIT) Accelerated 15.5 GFlop/s per watt, 2019 Pangea III Accelerated 13.1 GFlop/s per watt, 2019 Artemis (G42) Accelerated 10.8 GFlop/s per watt, 2019 Béluga Accelerated 9.50 GFlop/s per watt, 2019 Fênix Accelerated 8.11 GFlop/s per watt, 2019 Oakbridge-CX CPU-only 5.08 GFlop/s per watt, 2019 MagicCube3 Accelerated 4.90 GFlop/s per watt, 2019 Aitken CPU-only 4.51 GFlop/s per watt, 2019 Sawtooth CPU-only 4.04 GFlop/s per watt, 2019 Attaway CPU-only 3.63 GFlop/s per watt, 2019 TX-GAIA Accelerated 3.59 GFlop/s per watt, 2019 Puhti Accelerated 2.92 GFlop/s per watt, 2019 CARA Accelerated 1.46 GFlop/s per watt, 2019 MN-3 Accelerated 40.9 GFlop/s per watt, 2020 Lyapunov Accelerated 39.7 GFlop/s per watt, 2020 NVIDIA DGX SuperPOD (A100) Accelerated 26.2 GFlop/s per watt, 2020 JUWELS Booster Accelerated 25.0 GFlop/s per watt, 2020 Spartan2 Accelerated 24.3 GFlop/s per watt, 2020 JURECA-DC Accelerated 24.3 GFlop/s per watt, 2020 Selene Accelerated 24.0 GFlop/s per watt, 2020 HPC5 Accelerated 15.7 GFlop/s per watt, 2020 Fugaku CPU-only 14.8 GFlop/s per watt, 2020 Marconi-100 Accelerated 14.7 GFlop/s per watt, 2020 JADE2 Accelerated 13.0 GFlop/s per watt, 2020 Atlas (Petrobras) Accelerated 8.01 GFlop/s per watt, 2020 Bell (Purdue) Accelerated 5.15 GFlop/s per watt, 2020 Raijin Accelerated 5.09 GFlop/s per watt, 2020 Mahti CPU-only 5.04 GFlop/s per watt, 2020 Hawk CPU-only 4.95 GFlop/s per watt, 2020 Taranis CPU-only 4.90 GFlop/s per watt, 2020 Belenos CPU-only 4.64 GFlop/s per watt, 2020 Lichtenberg II CPU-only 4.57 GFlop/s per watt, 2020 Manzano CPU-only 4.46 GFlop/s per watt, 2020 NIMS Materials Simulator CPU-only 4.46 GFlop/s per watt, 2020 Toubkal CPU-only 4.19 GFlop/s per watt, 2020 NYU Greene Accelerated 4.09 GFlop/s per watt, 2020 Magma (LLNL) CPU-only 3.65 GFlop/s per watt, 2020 CRONOS CPU-only 3.51 GFlop/s per watt, 2020 Frontier TDS Accelerated 62.2 GFlop/s per watt, 2021 Galushkin Accelerated 48.5 GFlop/s per watt, 2021 Chervonenkis Accelerated 36.9 GFlop/s per watt, 2021 Athena Accelerated 34.5 GFlop/s per watt, 2021 Tethys Accelerated 31.6 GFlop/s per watt, 2021 Wilkes-3 Accelerated 30.8 GFlop/s per watt, 2021 MeluXina CPU-only 27.0 GFlop/s per watt, 2021 Raven-GPU Accelerated 22.9 GFlop/s per watt, 2021 HoreKa Accelerated 22.4 GFlop/s per watt, 2021 Tursa Accelerated 21.4 GFlop/s per watt, 2021 Narval Accelerated 18.9 GFlop/s per watt, 2021 AlphaCentauri Accelerated 15.8 GFlop/s per watt, 2021 Wisteria/BDEC-01 CPU-only 15.1 GFlop/s per watt, 2021 Dragão Accelerated 9.52 GFlop/s per watt, 2021 Earth Simulator 4 Accelerated 7.18 GFlop/s per watt, 2021 Tryton Plus CPU-only 5.64 GFlop/s per watt, 2021 Guru CPU-only 5.46 GFlop/s per watt, 2021 Maru CPU-only 5.46 GFlop/s per watt, 2021 Fritz CPU-only 5.33 GFlop/s per watt, 2021 SQUID Accelerated 5.00 GFlop/s per watt, 2021 Ares Accelerated 4.81 GFlop/s per watt, 2021 CEA-HF CPU-only 4.69 GFlop/s per watt, 2021 CARO CPU-only 4.33 GFlop/s per watt, 2021 Altair Accelerated 4.26 GFlop/s per watt, 2021 Henri Accelerated 65.4 GFlop/s per watt, 2022 Dardel Accelerated 59.0 GFlop/s per watt, 2022 Setonix Accelerated 57.0 GFlop/s per watt, 2022 Adastra Accelerated 50.0 GFlop/s per watt, 2022 THX.A.B Accelerated 40.7 GFlop/s per watt, 2022 Champollion Accelerated 38.5 GFlop/s per watt, 2022 Komondor Accelerated 28.1 GFlop/s per watt, 2022 Discovery 5 Accelerated 27.1 GFlop/s per watt, 2022 LANTA Accelerated 26.3 GFlop/s per watt, 2022 Robert CPU-only 6.00 GFlop/s per watt, 2022 Underhill CPU-only 6.00 GFlop/s per watt, 2022 ECMWF HPCF-AA CPU-only 5.56 GFlop/s per watt, 2022 HSUper CPU-only 5.32 GFlop/s per watt, 2022 Noctua 2 Accelerated 4.82 GFlop/s per watt, 2022 Anvil CPU-only 4.49 GFlop/s per watt, 2022 VSC-5 Accelerated 4.48 GFlop/s per watt, 2022 Dhabi Supercomputer Accelerated 36.6 GFlop/s per watt, 2023 ISEG Accelerated 35.3 GFlop/s per watt, 2023 Aurora Accelerated 26.2 GFlop/s per watt, 2023 fortytwo Accelerated 22.5 GFlop/s per watt, 2023 CWA FX1000 CPU-only 16.6 GFlop/s per watt, 2023 JMA PRIMEHPC FX1000 CPU-only 14.8 GFlop/s per watt, 2023 Gemini (Petrobras) Accelerated 13.4 GFlop/s per watt, 2023 AOBA-S Accelerated 12.4 GFlop/s per watt, 2023 Deucalion CPU-only 10.7 GFlop/s per watt, 2023 Carpenter CPU-only 10.6 GFlop/s per watt, 2023 MareNostrum 5 GPP CPU-only 6.97 GFlop/s per watt, 2023 Shaheen III CPU-only 6.73 GFlop/s per watt, 2023 Camphor 3 CPU-only 6.54 GFlop/s per watt, 2023 Conesus CPU-only 6.33 GFlop/s per watt, 2023 SPR-HBM CPU-only 6.08 GFlop/s per watt, 2023 Barnard CPU-only 5.69 GFlop/s per watt, 2023 Crossroads CPU-only 4.78 GFlop/s per watt, 2023 JEDI Accelerated 66.9 GFlop/s per watt, 2024 Portage Accelerated 66.3 GFlop/s per watt, 2024 JETI Accelerated 63.4 GFlop/s per watt, 2024 Isambard-AI Accelerated 63.4 GFlop/s per watt, 2024 rzAdams Accelerated 62.8 GFlop/s per watt, 2024 AMD Ouranos Accelerated 62.1 GFlop/s per watt, 2024 ROMEO-2025 Accelerated 61.6 GFlop/s per watt, 2024 El Dorado Accelerated 61.3 GFlop/s per watt, 2024 Alps Accelerated 61.0 GFlop/s per watt, 2024 Cardinal Accelerated 61.0 GFlop/s per watt, 2024 El Capitan Accelerated 60.9 GFlop/s per watt, 2024 Helios Accelerated 60.4 GFlop/s per watt, 2024 Venado Accelerated 59.3 GFlop/s per watt, 2024 HPC6 Accelerated 56.5 GFlop/s per watt, 2024 Capella Accelerated 54.1 GFlop/s per watt, 2024 GMO GPU Cloud Accelerated 53.8 GFlop/s per watt, 2024 amplitUDE Accelerated 51.3 GFlop/s per watt, 2024 CEA-HE Accelerated 51.3 GFlop/s per watt, 2024 ARF-ACC Accelerated 50.6 GFlop/s per watt, 2024 Helma Accelerated 49.5 GFlop/s per watt, 2024 TSUBAME4.0 Accelerated 48.6 GFlop/s per watt, 2024 Minerva Accelerated 46.3 GFlop/s per watt, 2024 fortythree Accelerated 43.5 GFlop/s per watt, 2024 Gautschi AI Accelerated 43.2 GFlop/s per watt, 2024 Ubilink H100 Cluster Accelerated 43.0 GFlop/s per watt, 2024 Kuma Accelerated 42.2 GFlop/s per watt, 2024 Gefion Accelerated 38.0 GFlop/s per watt, 2024 CLAIX-2023 Accelerated 33.8 GFlop/s per watt, 2024 Marvin Accelerated 24.0 GFlop/s per watt, 2024 Genkai Accelerated 6.43 GFlop/s per watt, 2024 Forerunner 1 CPU-only 5.74 GFlop/s per watt, 2024 Arunika CPU-only 4.81 GFlop/s per watt, 2024 Arka CPU-only 4.11 GFlop/s per watt, 2024 Otus Accelerated 68.3 GFlop/s per watt, 2025 Hunter Accelerated 64.7 GFlop/s per watt, 2025 JUPITER Accelerated 63.3 GFlop/s per watt, 2025 Viper-GPU Accelerated 62.2 GFlop/s per watt, 2025 Tillicum Accelerated 61.5 GFlop/s per watt, 2025 Tuolumne Accelerated 61.4 GFlop/s per watt, 2025 Olivia Accelerated 60.3 GFlop/s per watt, 2025 Cosmos (SDSC) Accelerated 52.3 GFlop/s per watt, 2025 Torch Accelerated 51.3 GFlop/s per watt, 2025 PERUN Accelerated 51.1 GFlop/s per watt, 2025 Miyabi Accelerated 47.6 GFlop/s per watt, 2025 Cannon2-H200 Accelerated 46.3 GFlop/s per watt, 2025 Space HPC Accelerated 42.2 GFlop/s per watt, 2025 Fir Accelerated 42.0 GFlop/s per watt, 2025 ABCI-Q Accelerated 40.7 GFlop/s per watt, 2025 ABCI 3.0 Accelerated 40.3 GFlop/s per watt, 2025 ISEG2 Accelerated 38.2 GFlop/s per watt, 2025 Harpia Accelerated 37.5 GFlop/s per watt, 2025 Matrix Accelerated 36.9 GFlop/s per watt, 2025 Nano 4 Accelerated 36.8 GFlop/s per watt, 2025 Rorqual Accelerated 30.5 GFlop/s per watt, 2025 Cirrus CPU-only 12.9 GFlop/s per watt, 2025 NASA Athena CPU-only 12.4 GFlop/s per watt, 2025 DWD SX-Aurora (2025) Accelerated 8.03 GFlop/s per watt, 2025 CRESCO8 CPU-only 6.75 GFlop/s per watt, 2025 SELENA CPU-only 4.69 GFlop/s per watt, 2025 HPC7 Accelerated 65.4 GFlop/s per watt, 2026 Arrhenius Accelerated 61.4 GFlop/s per watt, 2026 LineShine CPU-only 52.1 GFlop/s per watt, 2026 ASPIRE 2B (GPU Partition) Accelerated 40.0 GFlop/s per watt, 2026 Sunrise Accelerated 24.8 GFlop/s per watt, 2026 Teton CPU-only 13.3 GFlop/s per watt, 2026 ASPIRE 2B (CPU Partition) CPU-only 10.7 GFlop/s per watt, 2026 OtusJEDIPortage
Each dot is one system: GFlop/s per watt on a logarithmic axis, so equal vertical steps are equal multiples. The line joins the median of each five-year group with at least five systems.
Table view: Measured performance per watt by first-light year
YearsSystemsMedian GFlop/s per WAccelerated (n)CPU-only (n)Most efficient
2000 to 200410.33-0.33 (1)BlueGene/L 0.33
2005 to 2009290.200.32 (3)0.20 (26)Hexagon 0.47
2010 to 2014800.911.5 (28)0.87 (52)L-CSC 5.5
2015 to 20191243.04.1 (55)2.5 (69)A64FX Prototype 17
2020 to 20241152237 (77)5.5 (38)JEDI 67
2025 to date334247 (26)12 (7)Otus 68
How this was calculated

Efficiency is Rmax in PFlop/s times 1,000, divided by power in kW (one PFlop/s at one thousand kilowatts is exactly one GFlop/s per watt). A system is included if it has both figures and a first-operational date, and is placed at that year. Power is the figure recorded on the system's row, almost always the measured draw reported with a benchmark run, not a facility's connected capacity.

Two kinds of row are left out because their Rmax and power describe a later, larger configuration than the year they would be plotted at: anything recorded as upgraded, and Pleiades, whose 2010s figures would otherwise appear as an efficiency jump in 2008. A system expanded in place and not marked upgraded is still dated to its first light, so a few early points may sit slightly too early; the five-year medians are robust to a handful of them.

“Accelerated” means the system has at least one accelerator edge in the component graph. The doubling time is the least-squares slope of log base two of the efficiency on the year, so it is a trend through scattered points, not the pace of any one supplier.

The efficiency frontier

The most efficient system to have run as of each date, so each row beat every system before it.

First lightSystemCountryGFlop/s per WMeasured RmaxPower
2004 BlueGene/L USA 0.33 478 TF 1.4 MW
2007 JUGENE Germany 0.38 191 TF 504 kW
2008 Hexagon Norway 0.47 160 TF 342 kW
2010 Tianhe-1A China 0.64 2.6 PF 4.0 MW
2011 HokieSpeed USA 0.95 120 TF 126 kW
2012 SANAM Saudi Arabia 3.0 533 TF 179 kW
2014 L-CSC Germany 5.5 317 TF 57 kW
2016 Sakura (PEZY) Japan 17 825 TF 50 kW
2017 Suiren2 Japan 17 798 TF 47 kW
2019 A64FX Prototype Japan 17 2.0 PF 118 kW
2020 MN-3 Japan 41 2.2 PF 53 kW
2021 Frontier TDS USA 62 19.2 PF 309 kW
2022 Henri USA 65 2.9 PF 44 kW
2024 JEDI Germany 67 4.5 PF 67 kW
2025 Otus Germany 68 4.7 PF 68 kW

The read

The curve is steeper than the headline suggests, and not smooth. Efficiency crept through the 2000s, when the median system delivered about a fifth of a GFlop/s per watt, then climbed by a factor of 15 between the 2005 and 2015 groups. The step that shows in the frontier is accelerators: the first GPU-heavy machines (Tianhe-1A, then SANAM and L-CSC) opened a gap over CPU-only designs that has not closed, and every machine to set the frontier since 2020 is accelerated.

The gap between the accelerated and CPU-only medians is the practical cost of choosing a design that does not use them: in the latest group the CPU-only median is 12 against 47. Some of those CPU-only systems are deliberate, bought for codes that do not map onto GPUs, so the lesson is not that they are wrong but that they pay for it in power.

What the page cannot say is whether the large AI campuses are efficient. They are measured in megawatts of facility capacity and in low-precision petaFLOPS, neither of which belongs on this axis. The build pipeline is where their power appears; no equivalent measured efficiency exists for them yet.