Supercomputers / Analysis / Performance per watt
Analysis 13
Performance per watt, 2000 to today
The 382 systems in this dataset that report both a measured Rmax and a power draw
delivered a median of 0.20 GFlop/s per watt when they first ran in
2005 to 2009, and 42 in 2025 to date: 206 times as much. A
straight line through the logarithm of the points doubles every 2.3 years
(R² 0.81). The most efficient machine here, Otus, delivers 68. Accelerated systems lead by 3.8 times in the latest era.
This is the ranked world only. Efficiency here is a measured FP64 benchmark
result divided by the power drawn during that run, so it exists only for systems that
submitted one: 382 of the 735 systems with an Rmax in this dataset. The AI
clusters being built today mostly report low-precision peak figures and no power draw at
all, and are not on this page, which is why the line it draws is the efficiency of the
machines a ranking can see, not of compute in general.
Phase 1 seed dataset, compiled by hand.
These rows were built from public operator, laboratory and vendor sources. A
mechanical second-reader pass has since fetched every
cited source: 1092 of 1153 systems have a readable citation that names
them, and 40 are genuinely weakly sourced. Every claim carries its source and a
confidence tier. Treat anything below
verified as a lead, not a citation.
Measured performance per watt by first-light year, 2000-2026
Log-scale dot plot of measured HPL performance per watt for every system that reports both Rmax and power, by the year it first ran, coloured by whether it has accelerators, with a line through the five-year medians.
0.01 0.1 1 10 100 2000 2005 2010 2015 2020 2025
median per five years
BlueGene/L
CPU-only
0.334 GFlop/s per watt, 2004
Stella
CPU-only
0.205 GFlop/s per watt, 2005
BGW
CPU-only
0.204 GFlop/s per watt, 2005
ASC Purple
CPU-only
0.0379 GFlop/s per watt, 2005
JUBL
CPU-only
0.209 GFlop/s per watt, 2006
TSUBAME1.0
CPU-only
0.0318 GFlop/s per watt, 2006
JUGENE
CPU-only
0.379 GFlop/s per watt, 2007
New York Blue
CPU-only
0.204 GFlop/s per watt, 2007
Encanto
CPU-only
0.147 GFlop/s per watt, 2007
HLRB-II
CPU-only
0.0571 GFlop/s per watt, 2007
Honeywell x3650 Cluster
CPU-only
0.0510 GFlop/s per watt, 2007
Hexagon
CPU-only
0.468 GFlop/s per watt, 2008
Roadrunner
Accelerated
0.438 GFlop/s per watt, 2008
Intrepid
CPU-only
0.364 GFlop/s per watt, 2008
Brutus
CPU-only
0.341 GFlop/s per watt, 2008
Kraken
CPU-only
0.269 GFlop/s per watt, 2008
Franklin
CPU-only
0.232 GFlop/s per watt, 2008
Chebyshev
CPU-only
0.178 GFlop/s per watt, 2008
Ranger
CPU-only
0.163 GFlop/s per watt, 2008
Netuno
CPU-only
0.125 GFlop/s per watt, 2008
Bluefire
CPU-only
0.0890 GFlop/s per watt, 2008
Shaheen
CPU-only
0.379 GFlop/s per watt, 2009
Lomonosov
Accelerated
0.322 GFlop/s per watt, 2009
Baku (HLRS)
Accelerated
0.273 GFlop/s per watt, 2009
Colosse
CPU-only
0.232 GFlop/s per watt, 2009
Tachyon II
CPU-only
0.216 GFlop/s per watt, 2009
VSC-1
CPU-only
0.199 GFlop/s per watt, 2009
JUROPA
CPU-only
0.177 GFlop/s per watt, 2009
Galileu
CPU-only
0.150 GFlop/s per watt, 2009
JSS FX1
CPU-only
0.108 GFlop/s per watt, 2009
Tianhe-1A
Accelerated
0.635 GFlop/s per watt, 2010
Hopper (NERSC)
CPU-only
0.362 GFlop/s per watt, 2010
Tera-100
CPU-only
0.229 GFlop/s per watt, 2010
Haeon
CPU-only
0.185 GFlop/s per watt, 2010
Red Sky
CPU-only
0.0998 GFlop/s per watt, 2010
HokieSpeed
Accelerated
0.954 GFlop/s per watt, 2011
Zin
CPU-only
0.837 GFlop/s per watt, 2011
K computer
CPU-only
0.830 GFlop/s per watt, 2011
Carter (Purdue)
CPU-only
0.742 GFlop/s per watt, 2011
Sunway BlueLight MPP
CPU-only
0.741 GFlop/s per watt, 2011
Dawson2 (UCLA)
Accelerated
0.732 GFlop/s per watt, 2011
Tianhe-1A Hunan Solution
Accelerated
0.668 GFlop/s per watt, 2011
Mustang (LANL)
CPU-only
0.427 GFlop/s per watt, 2011
Guillimin
CPU-only
0.404 GFlop/s per watt, 2011
Cielo
CPU-only
0.279 GFlop/s per watt, 2011
SANAM
Accelerated
2.97 GFlop/s per watt, 2012
Turing (IDRIS)
CPU-only
2.18 GFlop/s per watt, 2012
DiRAC BlueGene/Q
CPU-only
2.18 GFlop/s per watt, 2012
KEK SAKURA
CPU-only
2.18 GFlop/s per watt, 2012
Mira
CPU-only
2.18 GFlop/s per watt, 2012
Avoca
CPU-only
2.18 GFlop/s per watt, 2012
Sequoia
CPU-only
2.18 GFlop/s per watt, 2012
Fermi
CPU-only
2.18 GFlop/s per watt, 2012
Vulcan
CPU-only
2.18 GFlop/s per watt, 2012
Titan
Accelerated
2.14 GFlop/s per watt, 2012
JUQUEEN
CPU-only
2.10 GFlop/s per watt, 2012
Blue Joule
CPU-only
2.10 GFlop/s per watt, 2012
Sisu
CPU-only
1.84 GFlop/s per watt, 2012
MVS-10P
Accelerated
1.69 GFlop/s per watt, 2012
HA-PACS
Accelerated
1.04 GFlop/s per watt, 2012
Virgo (IIT Madras)
CPU-only
0.933 GFlop/s per watt, 2012
MareNostrum 3
Accelerated
0.911 GFlop/s per watt, 2012
Midway (UChicago)
CPU-only
0.911 GFlop/s per watt, 2012
Yellowstone
CPU-only
0.877 GFlop/s per watt, 2012
Gordon
CPU-only
0.865 GFlop/s per watt, 2012
SuperMUC
CPU-only
0.846 GFlop/s per watt, 2012
Cab
CPU-only
0.825 GFlop/s per watt, 2012
Formosa 5
Accelerated
0.818 GFlop/s per watt, 2012
Abel (UiO)
CPU-only
0.787 GFlop/s per watt, 2012
Triolith
CPU-only
0.785 GFlop/s per watt, 2012
Oakleaf-FX
CPU-only
0.745 GFlop/s per watt, 2012
Vilje
CPU-only
0.739 GFlop/s per watt, 2012
Tianhe-1A Guangzhou Solution
CPU-only
0.733 GFlop/s per watt, 2012
Grifo04
Accelerated
0.688 GFlop/s per watt, 2012
Curie
CPU-only
0.637 GFlop/s per watt, 2012
Raijin (NCI)
CPU-only
0.610 GFlop/s per watt, 2012
Helios (IFERC)
CPU-only
0.562 GFlop/s per watt, 2012
SuperMike-II
Accelerated
0.555 GFlop/s per watt, 2012
Abisko
CPU-only
0.522 GFlop/s per watt, 2012
Keeneland
Accelerated
0.252 GFlop/s per watt, 2012
Blue Brain IV
CPU-only
2.18 GFlop/s per watt, 2013
Conte
Accelerated
1.92 GFlop/s per watt, 2013
PARAM Yuva II
Accelerated
1.85 GFlop/s per watt, 2013
Cascade (PNNL)
Accelerated
1.83 GFlop/s per watt, 2013
Cartesius
CPU-only
1.54 GFlop/s per watt, 2013
Big Red II
Accelerated
1.30 GFlop/s per watt, 2013
Stampede
Accelerated
1.15 GFlop/s per watt, 2013
Aaditya
CPU-only
0.911 GFlop/s per watt, 2013
Argus
CPU-only
0.911 GFlop/s per watt, 2013
Spirit (AFRL)
CPU-only
0.881 GFlop/s per watt, 2013
TEIDE-HPC
CPU-only
0.878 GFlop/s per watt, 2013
Makman-1
CPU-only
0.874 GFlop/s per watt, 2013
Amazon EC2 C3 Instance Cluster
CPU-only
0.795 GFlop/s per watt, 2013
ARCHER
CPU-only
0.497 GFlop/s per watt, 2013
L-CSC
Accelerated
5.54 GFlop/s per watt, 2014
HPC2
Accelerated
2.60 GFlop/s per watt, 2014
Cypress (Tulane)
Accelerated
2.54 GFlop/s per watt, 2014
Camellia (Kyoto)
Accelerated
2.30 GFlop/s per watt, 2014
QB-2
Accelerated
2.10 GFlop/s per watt, 2014
Tianhe-2 LvLiang Solution
Accelerated
2.08 GFlop/s per watt, 2014
COMA (PACS-IX)
Accelerated
2.04 GFlop/s per watt, 2014
Magnus
CPU-only
1.58 GFlop/s per watt, 2014
SuperMIC
Accelerated
1.51 GFlop/s per watt, 2014
CNIC Era
Accelerated
1.44 GFlop/s per watt, 2014
Lobachevsky
Accelerated
1.43 GFlop/s per watt, 2014
VSC-3
CPU-only
1.32 GFlop/s per watt, 2014
Faris
CPU-only
1.15 GFlop/s per watt, 2014
Konrad (HLRN-III)
CPU-only
1.13 GFlop/s per watt, 2014
ForHLR I
CPU-only
1.01 GFlop/s per watt, 2014
Edison
CPU-only
0.442 GFlop/s per watt, 2014
XStream
Accelerated
4.11 GFlop/s per watt, 2015
Sango
Accelerated
3.22 GFlop/s per watt, 2015
DKRZ Mistral
CPU-only
2.70 GFlop/s per watt, 2015
Abel
CPU-only
2.24 GFlop/s per watt, 2015
Beskow
CPU-only
2.14 GFlop/s per watt, 2015
Nagoya FX100
CPU-only
2.11 GFlop/s per watt, 2015
Prometheus
Accelerated
2.07 GFlop/s per watt, 2015
Sekirei (ISSP System B)
Accelerated
2.03 GFlop/s per watt, 2015
Makman-2
CPU-only
1.98 GFlop/s per watt, 2015
Shaheen II
CPU-only
1.95 GFlop/s per watt, 2015
SORA-MA
CPU-only
1.91 GFlop/s per watt, 2015
HOKUSAI GreatWave
Accelerated
1.91 GFlop/s per watt, 2015
Plasma Simulator FX100
CPU-only
1.91 GFlop/s per watt, 2015
SuperMUC Phase 2
CPU-only
1.90 GFlop/s per watt, 2015
PSNC Eagle
CPU-only
1.84 GFlop/s per watt, 2015
Shirokane3
Accelerated
1.84 GFlop/s per watt, 2015
Taurus
Accelerated
1.77 GFlop/s per watt, 2015
Nuri
CPU-only
1.77 GFlop/s per watt, 2015
Miri
CPU-only
1.77 GFlop/s per watt, 2015
ILGTI Cray XC30
Accelerated
1.75 GFlop/s per watt, 2015
JURECA
Accelerated
1.71 GFlop/s per watt, 2015
Hummel
CPU-only
1.63 GFlop/s per watt, 2015
Hazel Hen
CPU-only
1.56 GFlop/s per watt, 2015
SahasraT
CPU-only
1.48 GFlop/s per watt, 2015
Abacus 2.0
Accelerated
1.44 GFlop/s per watt, 2015
Earth System Numerical Simulator
CPU-only
1.37 GFlop/s per watt, 2015
Swierk Computing Centre
CPU-only
1.27 GFlop/s per watt, 2015
Tryton
CPU-only
1.17 GFlop/s per watt, 2015
ARIS
Accelerated
1.10 GFlop/s per watt, 2015
Cherry Creek
Accelerated
0.871 GFlop/s per watt, 2015
Sky Bridge
CPU-only
0.789 GFlop/s per watt, 2015
Thunder (AFRL)
Accelerated
0.649 GFlop/s per watt, 2015
Grace (UCL)
CPU-only
0.554 GFlop/s per watt, 2015
Intel SC D2P4
CPU-only
0.541 GFlop/s per watt, 2015
Galileo
Accelerated
0.242 GFlop/s per watt, 2015
Sakura (PEZY)
Accelerated
16.7 GFlop/s per watt, 2016
GOSAT-2 RCF2
Accelerated
9.80 GFlop/s per watt, 2016
Sunway TaihuLight
CPU-only
6.05 GFlop/s per watt, 2016
QPACE3
CPU-only
5.78 GFlop/s per watt, 2016
Oakforest-PACS
CPU-only
4.98 GFlop/s per watt, 2016
Camphor 2
Accelerated
4.09 GFlop/s per watt, 2016
SciPhi-XVI
CPU-only
3.84 GFlop/s per watt, 2016
Cori
Accelerated
3.56 GFlop/s per watt, 2016
Phoenix (Adelaide)
Accelerated
3.34 GFlop/s per watt, 2016
Cheyenne
CPU-only
2.77 GFlop/s per watt, 2016
Grizzly
CPU-only
2.52 GFlop/s per watt, 2016
Ollie
CPU-only
2.48 GFlop/s per watt, 2016
Reedbush-U
CPU-only
2.31 GFlop/s per watt, 2016
Laurel 2
CPU-only
2.30 GFlop/s per watt, 2016
BinAC
Accelerated
2.22 GFlop/s per watt, 2016
Owens
Accelerated
2.18 GFlop/s per watt, 2016
BrENIAC
CPU-only
2.15 GFlop/s per watt, 2016
ECMWF Cray XC40
CPU-only
2.08 GFlop/s per watt, 2016
NEMO bwForCluster
CPU-only
2.05 GFlop/s per watt, 2016
Tera-1000-1
CPU-only
1.79 GFlop/s per watt, 2016
ForHLR II
CPU-only
1.77 GFlop/s per watt, 2016
Lonestar 5
CPU-only
1.74 GFlop/s per watt, 2016
Okeanos
CPU-only
1.55 GFlop/s per watt, 2016
Lengau
CPU-only
1.50 GFlop/s per watt, 2016
ASPIRE 1
CPU-only
0.871 GFlop/s per watt, 2016
Caliburn
CPU-only
0.673 GFlop/s per watt, 2016
Suiren2
Accelerated
16.8 GFlop/s per watt, 2017
Gyoukou
Accelerated
14.2 GFlop/s per watt, 2017
Kukai
Accelerated
14.0 GFlop/s per watt, 2017
AIST AI Cloud
Accelerated
12.7 GFlop/s per watt, 2017
Wilkes-2
Accelerated
10.4 GFlop/s per watt, 2017
TSUBAME3.0
Accelerated
10.3 GFlop/s per watt, 2017
Reedbush-L
Accelerated
10.2 GFlop/s per watt, 2017
Piz Daint
Accelerated
8.91 GFlop/s per watt, 2017
CNIC Era-AI
Accelerated
8.60 GFlop/s per watt, 2017
Reedbush-H
Accelerated
8.55 GFlop/s per watt, 2017
Cedar (SFU)
Accelerated
8.02 GFlop/s per watt, 2017
Theta
CPU-only
5.41 GFlop/s per watt, 2017
Joliot-Curie SKL
CPU-only
4.43 GFlop/s per watt, 2017
MareNostrum 4
CPU-only
3.96 GFlop/s per watt, 2017
Tera-1000-2
CPU-only
3.77 GFlop/s per watt, 2017
CMA PAI-A
CPU-only
3.30 GFlop/s per watt, 2017
IMS Molecular Simulator
CPU-only
3.29 GFlop/s per watt, 2017
Mogon II
CPU-only
3.00 GFlop/s per watt, 2017
Centennial (ARL)
CPU-only
2.92 GFlop/s per watt, 2017
AWE Damson
CPU-only
2.86 GFlop/s per watt, 2017
Pratyush
CPU-only
2.78 GFlop/s per watt, 2017
Mihir
CPU-only
2.69 GFlop/s per watt, 2017
Trinity
Accelerated
2.66 GFlop/s per watt, 2017
Serrano (Sandia)
CPU-only
2.55 GFlop/s per watt, 2017
Cayenne (Sandia)
CPU-only
2.55 GFlop/s per watt, 2017
Graham
Accelerated
2.25 GFlop/s per watt, 2017
Sator
CPU-only
2.07 GFlop/s per watt, 2017
Summit
Accelerated
14.7 GFlop/s per watt, 2018
Sierra
Accelerated
12.7 GFlop/s per watt, 2018
ABCI
Accelerated
12.1 GFlop/s per watt, 2018
MareNostrum P9 CTE
Accelerated
11.9 GFlop/s per watt, 2018
Sugon Advanced Computing System PreE
CPU-only
11.4 GFlop/s per watt, 2018
HPC4
Accelerated
9.25 GFlop/s per watt, 2018
Lemhi
CPU-only
4.56 GFlop/s per watt, 2018
JUWELS Cluster
Accelerated
4.54 GFlop/s per watt, 2018
ATERUI II
CPU-only
4.21 GFlop/s per watt, 2018
JFRS-1
CPU-only
4.00 GFlop/s per watt, 2018
Taiwania
Accelerated
3.99 GFlop/s per watt, 2018
Niagara
CPU-only
3.92 GFlop/s per watt, 2018
Gaïa (EDF)
CPU-only
3.87 GFlop/s per watt, 2018
Makman-3
CPU-only
3.82 GFlop/s per watt, 2018
PALMA II
CPU-only
3.73 GFlop/s per watt, 2018
CMA PAI-B
Accelerated
3.59 GFlop/s per watt, 2018
CLAIX-2018
Accelerated
3.58 GFlop/s per watt, 2018
COBRA
Accelerated
3.43 GFlop/s per watt, 2018
Electra
CPU-only
3.23 GFlop/s per watt, 2018
Astra
CPU-only
1.53 GFlop/s per watt, 2018
A64FX Prototype
CPU-only
16.9 GFlop/s per watt, 2019
AiMOS
Accelerated
16.3 GFlop/s per watt, 2019
NA-1
Accelerated
16.2 GFlop/s per watt, 2019
Satori (MIT)
Accelerated
15.5 GFlop/s per watt, 2019
Pangea III
Accelerated
13.1 GFlop/s per watt, 2019
Artemis (G42)
Accelerated
10.8 GFlop/s per watt, 2019
Béluga
Accelerated
9.50 GFlop/s per watt, 2019
Fênix
Accelerated
8.11 GFlop/s per watt, 2019
Oakbridge-CX
CPU-only
5.08 GFlop/s per watt, 2019
MagicCube3
Accelerated
4.90 GFlop/s per watt, 2019
Aitken
CPU-only
4.51 GFlop/s per watt, 2019
Sawtooth
CPU-only
4.04 GFlop/s per watt, 2019
Attaway
CPU-only
3.63 GFlop/s per watt, 2019
TX-GAIA
Accelerated
3.59 GFlop/s per watt, 2019
Puhti
Accelerated
2.92 GFlop/s per watt, 2019
CARA
Accelerated
1.46 GFlop/s per watt, 2019
MN-3
Accelerated
40.9 GFlop/s per watt, 2020
Lyapunov
Accelerated
39.7 GFlop/s per watt, 2020
NVIDIA DGX SuperPOD (A100)
Accelerated
26.2 GFlop/s per watt, 2020
JUWELS Booster
Accelerated
25.0 GFlop/s per watt, 2020
Spartan2
Accelerated
24.3 GFlop/s per watt, 2020
JURECA-DC
Accelerated
24.3 GFlop/s per watt, 2020
Selene
Accelerated
24.0 GFlop/s per watt, 2020
HPC5
Accelerated
15.7 GFlop/s per watt, 2020
Fugaku
CPU-only
14.8 GFlop/s per watt, 2020
Marconi-100
Accelerated
14.7 GFlop/s per watt, 2020
JADE2
Accelerated
13.0 GFlop/s per watt, 2020
Atlas (Petrobras)
Accelerated
8.01 GFlop/s per watt, 2020
Bell (Purdue)
Accelerated
5.15 GFlop/s per watt, 2020
Raijin
Accelerated
5.09 GFlop/s per watt, 2020
Mahti
CPU-only
5.04 GFlop/s per watt, 2020
Hawk
CPU-only
4.95 GFlop/s per watt, 2020
Taranis
CPU-only
4.90 GFlop/s per watt, 2020
Belenos
CPU-only
4.64 GFlop/s per watt, 2020
Lichtenberg II
CPU-only
4.57 GFlop/s per watt, 2020
Manzano
CPU-only
4.46 GFlop/s per watt, 2020
NIMS Materials Simulator
CPU-only
4.46 GFlop/s per watt, 2020
Toubkal
CPU-only
4.19 GFlop/s per watt, 2020
NYU Greene
Accelerated
4.09 GFlop/s per watt, 2020
Magma (LLNL)
CPU-only
3.65 GFlop/s per watt, 2020
CRONOS
CPU-only
3.51 GFlop/s per watt, 2020
Frontier TDS
Accelerated
62.2 GFlop/s per watt, 2021
Galushkin
Accelerated
48.5 GFlop/s per watt, 2021
Chervonenkis
Accelerated
36.9 GFlop/s per watt, 2021
Athena
Accelerated
34.5 GFlop/s per watt, 2021
Tethys
Accelerated
31.6 GFlop/s per watt, 2021
Wilkes-3
Accelerated
30.8 GFlop/s per watt, 2021
MeluXina
CPU-only
27.0 GFlop/s per watt, 2021
Raven-GPU
Accelerated
22.9 GFlop/s per watt, 2021
HoreKa
Accelerated
22.4 GFlop/s per watt, 2021
Tursa
Accelerated
21.4 GFlop/s per watt, 2021
Narval
Accelerated
18.9 GFlop/s per watt, 2021
AlphaCentauri
Accelerated
15.8 GFlop/s per watt, 2021
Wisteria/BDEC-01
CPU-only
15.1 GFlop/s per watt, 2021
Dragão
Accelerated
9.52 GFlop/s per watt, 2021
Earth Simulator 4
Accelerated
7.18 GFlop/s per watt, 2021
Tryton Plus
CPU-only
5.64 GFlop/s per watt, 2021
Guru
CPU-only
5.46 GFlop/s per watt, 2021
Maru
CPU-only
5.46 GFlop/s per watt, 2021
Fritz
CPU-only
5.33 GFlop/s per watt, 2021
SQUID
Accelerated
5.00 GFlop/s per watt, 2021
Ares
Accelerated
4.81 GFlop/s per watt, 2021
CEA-HF
CPU-only
4.69 GFlop/s per watt, 2021
CARO
CPU-only
4.33 GFlop/s per watt, 2021
Altair
Accelerated
4.26 GFlop/s per watt, 2021
Henri
Accelerated
65.4 GFlop/s per watt, 2022
Dardel
Accelerated
59.0 GFlop/s per watt, 2022
Setonix
Accelerated
57.0 GFlop/s per watt, 2022
Adastra
Accelerated
50.0 GFlop/s per watt, 2022
THX.A.B
Accelerated
40.7 GFlop/s per watt, 2022
Champollion
Accelerated
38.5 GFlop/s per watt, 2022
Komondor
Accelerated
28.1 GFlop/s per watt, 2022
Discovery 5
Accelerated
27.1 GFlop/s per watt, 2022
LANTA
Accelerated
26.3 GFlop/s per watt, 2022
Robert
CPU-only
6.00 GFlop/s per watt, 2022
Underhill
CPU-only
6.00 GFlop/s per watt, 2022
ECMWF HPCF-AA
CPU-only
5.56 GFlop/s per watt, 2022
HSUper
CPU-only
5.32 GFlop/s per watt, 2022
Noctua 2
Accelerated
4.82 GFlop/s per watt, 2022
Anvil
CPU-only
4.49 GFlop/s per watt, 2022
VSC-5
Accelerated
4.48 GFlop/s per watt, 2022
Dhabi Supercomputer
Accelerated
36.6 GFlop/s per watt, 2023
ISEG
Accelerated
35.3 GFlop/s per watt, 2023
Aurora
Accelerated
26.2 GFlop/s per watt, 2023
fortytwo
Accelerated
22.5 GFlop/s per watt, 2023
CWA FX1000
CPU-only
16.6 GFlop/s per watt, 2023
JMA PRIMEHPC FX1000
CPU-only
14.8 GFlop/s per watt, 2023
Gemini (Petrobras)
Accelerated
13.4 GFlop/s per watt, 2023
AOBA-S
Accelerated
12.4 GFlop/s per watt, 2023
Deucalion
CPU-only
10.7 GFlop/s per watt, 2023
Carpenter
CPU-only
10.6 GFlop/s per watt, 2023
MareNostrum 5 GPP
CPU-only
6.97 GFlop/s per watt, 2023
Shaheen III
CPU-only
6.73 GFlop/s per watt, 2023
Camphor 3
CPU-only
6.54 GFlop/s per watt, 2023
Conesus
CPU-only
6.33 GFlop/s per watt, 2023
SPR-HBM
CPU-only
6.08 GFlop/s per watt, 2023
Barnard
CPU-only
5.69 GFlop/s per watt, 2023
Crossroads
CPU-only
4.78 GFlop/s per watt, 2023
JEDI
Accelerated
66.9 GFlop/s per watt, 2024
Portage
Accelerated
66.3 GFlop/s per watt, 2024
JETI
Accelerated
63.4 GFlop/s per watt, 2024
Isambard-AI
Accelerated
63.4 GFlop/s per watt, 2024
rzAdams
Accelerated
62.8 GFlop/s per watt, 2024
AMD Ouranos
Accelerated
62.1 GFlop/s per watt, 2024
ROMEO-2025
Accelerated
61.6 GFlop/s per watt, 2024
El Dorado
Accelerated
61.3 GFlop/s per watt, 2024
Alps
Accelerated
61.0 GFlop/s per watt, 2024
Cardinal
Accelerated
61.0 GFlop/s per watt, 2024
El Capitan
Accelerated
60.9 GFlop/s per watt, 2024
Helios
Accelerated
60.4 GFlop/s per watt, 2024
Venado
Accelerated
59.3 GFlop/s per watt, 2024
HPC6
Accelerated
56.5 GFlop/s per watt, 2024
Capella
Accelerated
54.1 GFlop/s per watt, 2024
GMO GPU Cloud
Accelerated
53.8 GFlop/s per watt, 2024
amplitUDE
Accelerated
51.3 GFlop/s per watt, 2024
CEA-HE
Accelerated
51.3 GFlop/s per watt, 2024
ARF-ACC
Accelerated
50.6 GFlop/s per watt, 2024
Helma
Accelerated
49.5 GFlop/s per watt, 2024
TSUBAME4.0
Accelerated
48.6 GFlop/s per watt, 2024
Minerva
Accelerated
46.3 GFlop/s per watt, 2024
fortythree
Accelerated
43.5 GFlop/s per watt, 2024
Gautschi AI
Accelerated
43.2 GFlop/s per watt, 2024
Ubilink H100 Cluster
Accelerated
43.0 GFlop/s per watt, 2024
Kuma
Accelerated
42.2 GFlop/s per watt, 2024
Gefion
Accelerated
38.0 GFlop/s per watt, 2024
CLAIX-2023
Accelerated
33.8 GFlop/s per watt, 2024
Marvin
Accelerated
24.0 GFlop/s per watt, 2024
Genkai
Accelerated
6.43 GFlop/s per watt, 2024
Forerunner 1
CPU-only
5.74 GFlop/s per watt, 2024
Arunika
CPU-only
4.81 GFlop/s per watt, 2024
Arka
CPU-only
4.11 GFlop/s per watt, 2024
Otus
Accelerated
68.3 GFlop/s per watt, 2025
Hunter
Accelerated
64.7 GFlop/s per watt, 2025
JUPITER
Accelerated
63.3 GFlop/s per watt, 2025
Viper-GPU
Accelerated
62.2 GFlop/s per watt, 2025
Tillicum
Accelerated
61.5 GFlop/s per watt, 2025
Tuolumne
Accelerated
61.4 GFlop/s per watt, 2025
Olivia
Accelerated
60.3 GFlop/s per watt, 2025
Cosmos (SDSC)
Accelerated
52.3 GFlop/s per watt, 2025
Torch
Accelerated
51.3 GFlop/s per watt, 2025
PERUN
Accelerated
51.1 GFlop/s per watt, 2025
Miyabi
Accelerated
47.6 GFlop/s per watt, 2025
Cannon2-H200
Accelerated
46.3 GFlop/s per watt, 2025
Space HPC
Accelerated
42.2 GFlop/s per watt, 2025
Fir
Accelerated
42.0 GFlop/s per watt, 2025
ABCI-Q
Accelerated
40.7 GFlop/s per watt, 2025
ABCI 3.0
Accelerated
40.3 GFlop/s per watt, 2025
ISEG2
Accelerated
38.2 GFlop/s per watt, 2025
Harpia
Accelerated
37.5 GFlop/s per watt, 2025
Matrix
Accelerated
36.9 GFlop/s per watt, 2025
Nano 4
Accelerated
36.8 GFlop/s per watt, 2025
Rorqual
Accelerated
30.5 GFlop/s per watt, 2025
Cirrus
CPU-only
12.9 GFlop/s per watt, 2025
NASA Athena
CPU-only
12.4 GFlop/s per watt, 2025
DWD SX-Aurora (2025)
Accelerated
8.03 GFlop/s per watt, 2025
CRESCO8
CPU-only
6.75 GFlop/s per watt, 2025
SELENA
CPU-only
4.69 GFlop/s per watt, 2025
HPC7
Accelerated
65.4 GFlop/s per watt, 2026
Arrhenius
Accelerated
61.4 GFlop/s per watt, 2026
LineShine
CPU-only
52.1 GFlop/s per watt, 2026
ASPIRE 2B (GPU Partition)
Accelerated
40.0 GFlop/s per watt, 2026
Sunrise
Accelerated
24.8 GFlop/s per watt, 2026
Teton
CPU-only
13.3 GFlop/s per watt, 2026
ASPIRE 2B (CPU Partition)
CPU-only
10.7 GFlop/s per watt, 2026
Otus JEDI Portage
Each dot is one system: GFlop/s per watt on a logarithmic axis, so equal vertical steps are equal multiples. The line joins the median of each five-year group with at least five systems. Table view: Measured performance per watt by first-light year Years Systems Median GFlop/s per W Accelerated (n) CPU-only (n) Most efficient 2000 to 2004 1 0.33 - 0.33 (1) BlueGene/L 0.33 2005 to 2009 29 0.20 0.32 (3) 0.20 (26) Hexagon 0.47 2010 to 2014 80 0.91 1.5 (28) 0.87 (52) L-CSC 5.5 2015 to 2019 124 3.0 4.1 (55) 2.5 (69) A64FX Prototype 17 2020 to 2024 115 22 37 (77) 5.5 (38) JEDI 67 2025 to date 33 42 47 (26) 12 (7) Otus 68
How this was calculated
Efficiency is Rmax in PFlop/s times 1,000, divided by power in kW (one PFlop/s at one
thousand kilowatts is exactly one GFlop/s per watt). A system is included if it has both
figures and a first-operational date, and is placed at that year. Power is the figure
recorded on the system's row, almost always the measured draw reported with a benchmark
run, not a facility's connected capacity.
Two kinds of row are left out because their Rmax and power describe a later, larger
configuration than the year they would be plotted at: anything recorded as upgraded, and
Pleiades, whose 2010s figures would otherwise appear as an efficiency jump in 2008. A system
expanded in place and not marked upgraded is still dated to its first light, so a few early
points may sit slightly too early; the five-year medians are robust to a handful of them.
“Accelerated” means the system has at least one accelerator edge in the component graph.
The doubling time is the least-squares slope of log base two of the efficiency on the year,
so it is a trend through scattered points, not the pace of any one supplier.
The efficiency frontier
The most efficient system to have run as of each date, so each row beat every system before it.
First light System Country GFlop/s per W Measured Rmax Power 2004 BlueGene/L USA 0.33 478 TF 1.4 MW 2007 JUGENE Germany 0.38 191 TF 504 kW 2008 Hexagon Norway 0.47 160 TF 342 kW 2010 Tianhe-1A China 0.64 2.6 PF 4.0 MW 2011 HokieSpeed USA 0.95 120 TF 126 kW 2012 SANAM Saudi Arabia 3.0 533 TF 179 kW 2014 L-CSC Germany 5.5 317 TF 57 kW 2016 Sakura (PEZY) Japan 17 825 TF 50 kW 2017 Suiren2 Japan 17 798 TF 47 kW 2019 A64FX Prototype Japan 17 2.0 PF 118 kW 2020 MN-3 Japan 41 2.2 PF 53 kW 2021 Frontier TDS USA 62 19.2 PF 309 kW 2022 Henri USA 65 2.9 PF 44 kW 2024 JEDI Germany 67 4.5 PF 67 kW 2025 Otus Germany 68 4.7 PF 68 kW
The read
The curve is steeper than the headline suggests, and not smooth. Efficiency crept through
the 2000s, when the median system delivered about a fifth of a GFlop/s per watt, then
climbed by a factor of 15 between
the 2005 and 2015 groups. The step that shows in the frontier is accelerators: the first
GPU-heavy machines (Tianhe-1A, then SANAM and L-CSC) opened a gap over CPU-only designs that has
not closed, and every machine to set the frontier since 2020 is accelerated.
The gap between the accelerated and CPU-only medians is the practical cost of choosing a
design that does not use them: in the latest group the CPU-only median is 12
against 47. Some of those CPU-only systems are deliberate, bought for codes that do
not map onto GPUs, so the lesson is not that they are wrong but that they pay for it in power.
What the page cannot say is whether the large AI campuses are efficient. They are
measured in megawatts of facility capacity and in low-precision petaFLOPS, neither of which
belongs on this axis. The build pipeline
is where their power appears; no equivalent measured efficiency exists for them yet.