Measured in 16-bit floating point operations, ML hardware performance has increased at a rate of 36% per year, doubling every 2.3 years. A similar trend exists in 32-bit performance. Optimized ML number formats and tensor cores provided additional improvements.
| Series | Hardware | Manufacturer | FP32 FLOP/s | Release date | FP16 FLOP/s | TF32 (19-bit) FLOP/s | Tensor-FP16/BF16 FLOP/s |
|---|---|---|---|---|---|---|---|
| FP32 | NVIDIA Blackwell Ultra | NVIDIA | 8 x 10^13 | 2025-08-22 | |||
| FP32 | NVIDIA H200 SXM | NVIDIA | 6.7 x 10^13 | 2024-11-18 | |||
| FP32 | AMD Instinct MI325X | AMD | 1.6 x 10^14 | 2024-10-10 | |||
| FP32 | Intel Habana Gaudi3 | Intel | 1.4 x 10^13 | 2024-09-24 | |||
| FP32 | NVIDIA GB200 NVL2 (per GPU) | NVIDIA | 9 x 10^13 | 2024-06-02 | |||
| FP32 | Meta MTIA v2 | Meta | 2.8 x 10^12 | 2024-04-10 | |||
| FP32 | NVIDIA B200 | NVIDIA | 6.2 x 10^13 | 2024-03-18 | |||
| FP32 | MTT S4000 | Moore Threads (Tencent) | 2.5 x 10^13 | 2023-12-19 | |||
| FP32 | AMD Instinct MI300X | AMD | 1.6 x 10^14 | 2023-12-06 | |||
| FP32 | AMD Radeon Instinct MI308X | AMD | 8.2 x 10^13 | 2023-12-06 | |||
| FP32 | Sunway SW26010-Pro | Sunway | 2.8 x 10^13 | 2023-11-26 | |||
| FP32 | NVIDIA HGX H20 | NVIDIA | 4.4 x 10^13 | 2023-11-09 | |||
| FP32 | NVIDIA L2 PCle | NVIDIA | 2.4 x 10^13 | 2023-11-09 | |||
| FP32 | NVIDIA L20 PCle | NVIDIA | 5.9 x 10^13 | 2023-09-16 | |||
| FP32 | NVIDIA GH200 | NVIDIA | 6.7 x 10^13 | 2023-08-08 | |||
| FP32 | MetaX MXC500 (PCIe) | MetaX | 1.5 x 10^13 | 2023-06-13 | |||
| FP32 | Meta MTIA v1 | Meta | 1.6 x 10^12 | 2023-05-18 | |||
| FP32 | AWS Inferentia2 | Amazon AWS | 4.8 x 10^13 | 2023-04-13 | |||
| FP32 | NVIDIA H800 SXM5 | NVIDIA | 5.9 x 10^13 | 2023-03-21 | |||
| FP32 | NVIDIA GH100 | NVIDIA | 6.7 x 10^13 | 2023-03-21 | |||
| FP32 | NVIDIA L4 | NVIDIA | 3 x 10^13 | 2023-03-21 | |||
| FP32 | NVIDIA GeForce RTX 4070 | NVIDIA | 2.9 x 10^13 | 2023-02-08 | |||
| FP32 | Intel Data Center GPU Max 1100 | Intel | 2.2 x 10^13 | 2023-01-10 | |||
| FP32 | Intel Data Center GPU Max 1350 | Intel | 4.4 x 10^13 | 2023-01-10 | |||
| FP32 | Intel Data Center GPU Max 1550 | Intel | 5.2 x 10^13 | 2023-01-10 | |||
| FP32 | AMD Radeon Instinct MI300 | AMD | 4.8 x 10^13 | 2023-01-04 | |||
| FP32 | AMD Instinct MI300A | AMD | 1.2 x 10^14 | 2023-01-04 | |||
| FP32 | Baidu Kunlun RG800 | Kunlunxin Baidu | 3.2 x 10^13 | 2023-01-01 | |||
| FP32 | MetaX MXC500 (OAM) | MetaX | 1.8 x 10^13 | 2023-01-01 | |||
| FP32 | Tianshu Zhixin Zhikai 100 | Iluvatar CoreX | 2.4 x 10^13 | 2022-12-20 | |||
| FP32 | NVIDIA RTX 6000 Ada Generation | NVIDIA | 9.1 x 10^13 | 2022-12-03 | |||
| FP32 | NVIDIA A800 PCIe 40 GB | NVIDIA | 1.9 x 10^13 | 2022-11-08 | |||
| FP32 | AMD Radeon RX 7900 XTX | AMD | 6.1 x 10^13 | 2022-11-03 | |||
| FP32 | NVIDIA A800 PCIe 80 GB | NVIDIA | 1.9 x 10^13 | 2022-11-03 | |||
| FP32 | Amazon Trainium1 | Amazon AWS | 4.8 x 10^13 | 2022-10-15 | |||
| FP32 | NVIDIA L40 | NVIDIA | 9.1 x 10^13 | 2022-10-13 | |||
| FP32 | NVIDIA H100 PCIe | NVIDIA | 5.1 x 10^13 | 2022-09-20 | |||
| FP32 | NVIDIA GeForce RTX 4090 | NVIDIA | 8.3 x 10^13 | 2022-09-20 | |||
| FP32 | NVIDIA H100 SXM5 80GB | NVIDIA | 6.7 x 10^13 | 2022-09-20 | |||
| FP32 | NVIDIA GeForce RTX 4080 | NVIDIA | 4.9 x 10^13 | 2022-09-20 | |||
| FP32 | Biren BR100 | Biren | 2.6 x 10^14 | 2022-08-22 | |||
| FP32 | NVIDIA A800 SXM | NVIDIA | 1.9 x 10^13 | 2022-08-11 | |||
| FP32 | NVIDIA GeForce RTX 3090 Ti | NVIDIA | 4 x 10^13 | 2022-03-29 | |||
| FP32 | Cambricon MLU370-X8 | Cambricon | 2.4 x 10^13 | 2022-03-21 | |||
| FP32 | Huawei Ascend 910B | Huawei | 9.4 x 10^13 | 2022-03-17 | |||
| FP32 | Baidu Kunlun R100 (75W) | Kunlunxin Baidu | 1.8 x 10^13 | 2022-01-01 | |||
| FP32 | Baidu Kunlun R100 (100W) | Kunlunxin Baidu | 2 x 10^13 | 2022-01-01 | |||
| FP32 | Baidu Kunlun R200 (150W) | Kunlunxin Baidu | 3.2 x 10^13 | 2022-01-01 | |||
| FP32 | Baidu Kunlun R200-8F (160W) | Kunlunxin Baidu | 3.2 x 10^13 | 2022-01-01 | |||
| FP32 | AMD Radeon Instinct MI250X | AMD | 4.8 x 10^13 | 2021-11-08 | |||
| FP32 | Cambricon MLU370-S4/S8 | Cambricon | 1.8 x 10^13 | 2021-11-03 | |||
| FP32 | Cambricon MLU370-X4 | Cambricon | 2.4 x 10^13 | 2021-11-03 | |||
| FP32 | Cambricon MLU370-S8 | Cambricon | 1.8 x 10^13 | 2021-11-03 | |||
| FP32 | Cambricon MLU370-S4 | Cambricon | 1.8 x 10^13 | 2021-11-03 | |||
| FP32 | Tesla D1 Dojo | Tesla | 2.3 x 10^13 | 2021-08-21 | |||
| FP32 | NVIDIA RTX A4000 | NVIDIA | 1.9 x 10^13 | 2021-04-12 | |||
| FP32 | NVIDIA A10G | NVIDIA | 3.2 x 10^13 | 2021-04-12 | |||
| FP32 | NVIDIA RTX A5000 | NVIDIA | 2.8 x 10^13 | 2021-04-12 | |||
| FP32 | NVIDIA A10 PCIe | NVIDIA | 3.1 x 10^13 | 2021-04-12 | |||
| FP32 | Tianshu Zhixin Tiangai 100 (BI-V100) | Iluvatar CoreX | 3.2 x 10^13 | 2021-03-31 | |||
| FP32 | NVIDIA A100 SXM4 80 GB | NVIDIA | 1.9 x 10^13 | 2020-11-16 | |||
| FP32 | NVIDIA RTX A6000 | NVIDIA | 3.9 x 10^13 | 2020-10-05 | |||
| FP32 | NVIDIA A40 PCIe | NVIDIA | 3.7 x 10^13 | 2020-10-05 | |||
| FP32 | NVIDIA GeForce RTX 3080 | NVIDIA | 3 x 10^13 | 2020-09-01 | |||
| FP32 | NVIDIA GeForce RTX 3090 | NVIDIA | 3.6 x 10^13 | 2020-09-01 | |||
| FP32 | NVIDIA A100 PCIe | NVIDIA | 1.9 x 10^13 | 2020-06-22 | |||
| FP32 | NVIDIA A100 SXM4 40 GB | NVIDIA | 1.9 x 10^13 | 2020-05-14 | |||
| FP32 | NVIDIA A100 | NVIDIA | 2 x 10^13 | 2020-03-01 | |||
| FP32 | Baidu Kunlun K200 | Kunlunxin Baidu | 1.6 x 10^13 | 2020-01-01 | |||
| FP32 | NVIDIA Tesla V100S PCIe 32 GB | NVIDIA | 1.6 x 10^13 | 2019-11-26 | |||
| FP32 | Baidu Kunlun I | Kunlunxin Baidu | 1.6 x 10^13 | 2019-01-01 | |||
| FP32 | NVIDIA Quadro RTX 4000 | NVIDIA | 7.1 x 10^12 | 2018-11-13 | |||
| FP32 | NVIDIA GeForce RTX 2080 Ti 11GB | NVIDIA | 1.3 x 10^13 | 2018-09-20 | |||
| FP32 | NVIDIA Tesla T4 | NVIDIA | 8.1 x 10^12 | 2018-09-13 | |||
| FP32 | NVIDIA Quadro RTX 6000 | NVIDIA | 1.6 x 10^13 | 2018-08-13 | |||
| FP32 | NVIDIA Quadro RTX 5000 | NVIDIA | 1.1 x 10^13 | 2018-08-13 | |||
| FP32 | NVIDIA Quadro RTX 8000 | NVIDIA | 1.6 x 10^13 | 2018-08-13 | |||
| FP32 | NVIDIA Tesla V100 DGXS 16 GB | NVIDIA | 1.6 x 10^13 | 2018-03-27 | |||
| FP32 | NVIDIA Tesla V100 PCIe 32 GB | NVIDIA | 1.4 x 10^13 | 2018-03-27 | |||
| FP32 | NVIDIA Tesla V100 DGXS 32 GB | NVIDIA | 1.6 x 10^13 | 2018-03-27 | |||
| FP32 | NVIDIA Tesla V100 SXM3 32 GB | NVIDIA | 1.6 x 10^13 | 2018-03-27 | |||
| FP32 | NVIDIA Tesla V100 SXM2 32 GB | NVIDIA | 1.6 x 10^13 | 2018-03-27 | |||
| FP32 | NVIDIA Titan V | NVIDIA | 1.5 x 10^13 | 2017-12-01 | |||
| FP32 | NVIDIA Tesla V100 SXM2 | NVIDIA | 1.6 x 10^13 | 2017-07-01 | |||
| FP32 | NVIDIA Tesla V100 SXM2 16 GB | NVIDIA | 1.6 x 10^13 | 2017-06-21 | |||
| FP32 | NVIDIA Tesla V100 PCIe 16 GB | NVIDIA | 1.4 x 10^13 | 2017-06-21 | |||
| FP32 | NVIDIA V100 | NVIDIA | 1.6 x 10^13 | 2017-06-21 | |||
| FP32 | PEZY-SC2 | PEZY | 8.2 x 10^12 | 2017-06-01 | |||
| FP32 | Google TPU v2 | 3 x 10^12 | 2017-05-01 | ||||
| FP32 | NVIDIA TITAN Xp | NVIDIA | 1.2 x 10^13 | 2017-04-06 | |||
| FP32 | NVIDIA GeForce GTX 1080 Ti | NVIDIA | 1.1 x 10^13 | 2017-03-10 | |||
| FP32 | NVIDIA Quadro P600 | NVIDIA | 1.2 x 10^12 | 2017-02-07 | |||
| FP32 | NVIDIA Quadro P4000 | NVIDIA | 5.3 x 10^12 | 2017-02-06 | |||
| FP32 | MT-2000 | National University of Defense Technology | 4.9 x 10^12 | 2017-01-01 | |||
| FP32 | NVIDIA Quadro P5000 | NVIDIA | 8.9 x 10^12 | 2016-10-01 | |||
| FP32 | NVIDIA Quadro P6000 | NVIDIA | 1.3 x 10^13 | 2016-10-01 | |||
| FP32 | NVIDIA P40 | NVIDIA | 1.2 x 10^13 | 2016-09-13 | |||
| FP32 | NVIDIA Tesla P4 | NVIDIA | 5.7 x 10^12 | 2016-09-13 | |||
| FP32 | NVIDIA Tesla P100 PCIe 16GB | NVIDIA | 9.5 x 10^12 | 2016-06-20 | |||
| FP32 | NVIDIA Tesla P100 PCIe 12GB | NVIDIA | 9.5 x 10^12 | 2016-06-20 | |||
| FP32 | NVIDIA P100 PCIe 16GB | NVIDIA | 9.6 x 10^12 | 2016-06-20 | |||
| FP32 | NVIDIA GeForce GTX 1080 | NVIDIA | 8.9 x 10^12 | 2016-05-27 | |||
| FP32 | NVIDIA Tesla P100 SXM2 | NVIDIA | 1.1 x 10^13 | 2016-04-05 | |||
| FP32 | NVIDIA P100 | NVIDIA | 9.3 x 10^12 | 2016-04-05 | |||
| FP32 | NVIDIA Tesla P100 DGXS | NVIDIA | 1.1 x 10^13 | 2016-04-05 | |||
| FP32 | NVIDIA M40 | NVIDIA | 6.8 x 10^12 | 2015-11-10 | |||
| FP32 | NVIDIA TESLA M60 | NVIDIA | 9.6 x 10^12 | 2015-08-30 | |||
| FP32 | NVIDIA Quadro M4000 | NVIDIA | 2.6 x 10^12 | 2015-06-29 | |||
| FP32 | NVIDIA GeForce GTX TITAN X | NVIDIA | 6.7 x 10^12 | 2015-03-17 | |||
| FP32 | NVIDIA Quadro K1200 | NVIDIA | 1.2 x 10^12 | 2015-01-28 | |||
| FP32 | NVIDIA Tesla K80 | NVIDIA | 8.1 x 10^12 | 2014-11-17 | |||
| FP32 | NVIDIA GeForce GTX 980 | NVIDIA | 5 x 10^12 | 2014-09-19 | |||
| FP32 | NVIDIA GTX Titan Black | NVIDIA | 5.6 x 10^12 | 2014-02-18 | |||
| FP32 | NVIDIA Tesla K40s | NVIDIA | 5 x 10^12 | 2013-11-22 | |||
| FP32 | NVIDIA Tesla K40t | NVIDIA | 5 x 10^12 | 2013-11-22 | |||
| FP32 | NVIDIA Quadro K6000 | NVIDIA | 5.2 x 10^12 | 2013-07-23 | |||
| FP32 | NVIDIA GeForce GTX 780 | NVIDIA | 4.2 x 10^12 | 2013-05-23 | |||
| FP32 | NVIDIA Quadro K4000 | NVIDIA | 1.2 x 10^12 | 2013-03-01 | |||
| FP32 | NVIDIA GeForce GTX TITAN | NVIDIA | 4.7 x 10^12 | 2013-02-19 | |||
| FP32 | NVIDIA Tesla K20c | NVIDIA | 3.5 x 10^12 | 2012-11-12 | |||
| FP32 | NVIDIA Tesla K20X | NVIDIA | 3.9 x 10^12 | 2012-11-12 | |||
| FP32 | NVIDIA Tesla C2050 | NVIDIA | 1 x 10^12 | 2011-07-25 | |||
| FP32 | NVIDIA GeForce GTX 580 | NVIDIA | 1.6 x 10^12 | 2010-11-09 | |||
| FP32 | NVIDIA GeForce GTX 280 | NVIDIA | 6.2 x 10^11 | 2008-06-16 | |||
| FP16 | NVIDIA Blackwell Ultra | NVIDIA | 2025-08-22 | 2.5 x 10^15 | |||
| FP16 | AMD Instinct MI325X | AMD | 2024-10-10 | 1.3 x 10^15 | |||
| FP16 | Intel Habana Gaudi3 | Intel | 2024-09-24 | 2.9 x 10^13 | |||
| FP16 | NVIDIA B200 | NVIDIA | 2024-03-18 | 2.2 x 10^15 | |||
| FP16 | MTT S4000 | Moore Threads (Tencent) | 2023-12-19 | 4.9 x 10^13 | |||
| FP16 | AMD Instinct MI300X | AMD | 2023-12-06 | 1.3 x 10^15 | |||
| FP16 | AMD Radeon Instinct MI308X | AMD | 2023-12-06 | 6.5 x 10^14 | |||
| FP16 | Sunway SW26010-Pro | Sunway | 2023-11-26 | 5.5 x 10^13 | |||
| FP16 | NVIDIA L20 PCle | NVIDIA | 2023-09-16 | 5.9 x 10^13 | |||
| FP16 | MetaX MXC500 (PCIe) | MetaX | 2023-06-13 | 2.4 x 10^14 | |||
| FP16 | Meta MTIA v1 | Meta | 2023-05-18 | 5.1 x 10^13 | |||
| FP16 | AWS Inferentia2 | Amazon AWS | 2023-04-13 | 1.9 x 10^14 | |||
| FP16 | NVIDIA L4 | NVIDIA | 2023-03-21 | 3 x 10^13 | |||
| FP16 | NVIDIA GeForce RTX 4070 | NVIDIA | 2023-02-08 | 2.9 x 10^13 | |||
| FP16 | Intel Data Center GPU Max 1100 | Intel | 2023-01-10 | 2.2 x 10^13 | |||
| FP16 | Intel Data Center GPU Max 1350 | Intel | 2023-01-10 | 4.4 x 10^13 | |||
| FP16 | Intel Data Center GPU Max 1550 | Intel | 2023-01-10 | 5.2 x 10^13 | |||
| FP16 | AMD Radeon Instinct MI300 | AMD | 2023-01-04 | 3.8 x 10^14 | |||
| FP16 | AMD Instinct MI300A | AMD | 2023-01-04 | 9.8 x 10^14 | |||
| FP16 | Baidu Kunlun RG800 | Kunlunxin Baidu | 2023-01-01 | 1.3 x 10^14 | |||
| FP16 | MetaX MXC500 (OAM) | MetaX | 2023-01-01 | 2.8 x 10^14 | |||
| FP16 | Tianshu Zhixin Zhikai 100 | Iluvatar CoreX | 2022-12-20 | 9.6 x 10^13 | |||
| FP16 | NVIDIA RTX 6000 Ada Generation | NVIDIA | 2022-12-03 | 9.1 x 10^13 | |||
| FP16 | NVIDIA A800 PCIe 40 GB | NVIDIA | 2022-11-08 | 7.8 x 10^13 | |||
| FP16 | AMD Radeon RX 7900 XTX | AMD | 2022-11-03 | 1.2 x 10^14 | |||
| FP16 | NVIDIA A800 PCIe 80 GB | NVIDIA | 2022-11-03 | 7.8 x 10^13 | |||
| FP16 | Amazon Trainium1 | Amazon AWS | 2022-10-15 | 1.9 x 10^14 | |||
| FP16 | NVIDIA L40 | NVIDIA | 2022-10-13 | 9.1 x 10^13 | |||
| FP16 | NVIDIA H100 PCIe | NVIDIA | 2022-09-20 | 2 x 10^14 | |||
| FP16 | NVIDIA GeForce RTX 4090 | NVIDIA | 2022-09-20 | 8.3 x 10^13 | |||
| FP16 | NVIDIA H100 SXM5 80GB | NVIDIA | 2022-09-20 | 1.3 x 10^14 | |||
| FP16 | NVIDIA GeForce RTX 4080 | NVIDIA | 2022-09-20 | 4.9 x 10^13 | |||
| FP16 | NVIDIA A800 SXM | NVIDIA | 2022-08-11 | 7.8 x 10^13 | |||
| FP16 | NVIDIA GeForce RTX 3090 Ti | NVIDIA | 2022-03-29 | 4 x 10^13 | |||
| FP16 | Cambricon MLU370-X8 | Cambricon | 2022-03-21 | 9.6 x 10^13 | |||
| FP16 | Huawei Ascend 910B | Huawei | 2022-03-17 | 3.8 x 10^14 | |||
| FP16 | Baidu Kunlun R100 (75W) | Kunlunxin Baidu | 2022-01-01 | 6.4 x 10^13 | |||
| FP16 | Baidu Kunlun R100 (100W) | Kunlunxin Baidu | 2022-01-01 | 8.5 x 10^13 | |||
| FP16 | Baidu Kunlun R200 (150W) | Kunlunxin Baidu | 2022-01-01 | 1.3 x 10^14 | |||
| FP16 | Baidu Kunlun R200-8F (160W) | Kunlunxin Baidu | 2022-01-01 | 1.3 x 10^14 | |||
| FP16 | AMD Radeon Instinct MI250X | AMD | 2021-11-08 | 3.8 x 10^14 | |||
| FP16 | Cambricon MLU370-S4/S8 | Cambricon | 2021-11-03 | 7.2 x 10^13 | |||
| FP16 | Cambricon MLU370-X4 | Cambricon | 2021-11-03 | 9.6 x 10^13 | |||
| FP16 | Cambricon MLU370-S8 | Cambricon | 2021-11-03 | 7.2 x 10^13 | |||
| FP16 | Cambricon MLU370-S4 | Cambricon | 2021-11-03 | 7.2 x 10^13 | |||
| FP16 | NVIDIA RTX A4000 | NVIDIA | 2021-04-12 | 1.9 x 10^13 | |||
| FP16 | NVIDIA A10G | NVIDIA | 2021-04-12 | 3.2 x 10^13 | |||
| FP16 | NVIDIA RTX A5000 | NVIDIA | 2021-04-12 | 2.8 x 10^13 | |||
| FP16 | NVIDIA A10 PCIe | NVIDIA | 2021-04-12 | 3.1 x 10^13 | |||
| FP16 | Tianshu Zhixin Tiangai 100 (BI-V100) | Iluvatar CoreX | 2021-03-31 | 1.3 x 10^14 | |||
| FP16 | NVIDIA A100 SXM4 80 GB | NVIDIA | 2020-11-16 | 7.8 x 10^13 | |||
| FP16 | NVIDIA RTX A6000 | NVIDIA | 2020-10-05 | 3.9 x 10^13 | |||
| FP16 | NVIDIA A40 PCIe | NVIDIA | 2020-10-05 | 3.7 x 10^13 | |||
| FP16 | NVIDIA GeForce RTX 3080 | NVIDIA | 2020-09-01 | 3 x 10^13 | |||
| FP16 | NVIDIA GeForce RTX 3090 | NVIDIA | 2020-09-01 | 3.6 x 10^13 | |||
| FP16 | NVIDIA A100 PCIe | NVIDIA | 2020-06-22 | 7.8 x 10^13 | |||
| FP16 | NVIDIA A100 SXM4 40 GB | NVIDIA | 2020-05-14 | 7.8 x 10^13 | |||
| FP16 | NVIDIA A100 | NVIDIA | 2020-03-01 | 7.8 x 10^13 | |||
| FP16 | Baidu Kunlun K200 | Kunlunxin Baidu | 2020-01-01 | 6.4 x 10^13 | |||
| FP16 | NVIDIA Tesla V100S PCIe 32 GB | NVIDIA | 2019-11-26 | 3.3 x 10^13 | |||
| FP16 | Baidu Kunlun I | Kunlunxin Baidu | 2019-01-01 | 6.4 x 10^13 | |||
| FP16 | NVIDIA Quadro RTX 4000 | NVIDIA | 2018-11-13 | 1.4 x 10^13 | |||
| FP16 | NVIDIA GeForce RTX 2080 Ti 11GB | NVIDIA | 2018-09-20 | 2.7 x 10^13 | |||
| FP16 | NVIDIA Tesla T4 | NVIDIA | 2018-09-13 | 6.5 x 10^13 | |||
| FP16 | NVIDIA Quadro RTX 6000 | NVIDIA | 2018-08-13 | 3.3 x 10^13 | |||
| FP16 | NVIDIA Quadro RTX 5000 | NVIDIA | 2018-08-13 | 2.2 x 10^13 | |||
| FP16 | NVIDIA Quadro RTX 8000 | NVIDIA | 2018-08-13 | 3.3 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 DGXS 16 GB | NVIDIA | 2018-03-27 | 3.2 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 PCIe 32 GB | NVIDIA | 2018-03-27 | 2.8 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 DGXS 32 GB | NVIDIA | 2018-03-27 | 3.1 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 SXM3 32 GB | NVIDIA | 2018-03-27 | 3.1 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 SXM2 32 GB | NVIDIA | 2018-03-27 | 3.1 x 10^13 | |||
| FP16 | NVIDIA Titan V | NVIDIA | 2017-12-01 | 3 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 SXM2 | NVIDIA | 2017-07-01 | 3.1 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 SXM2 16 GB | NVIDIA | 2017-06-21 | 3.1 x 10^13 | |||
| FP16 | NVIDIA Tesla V100 PCIe 16 GB | NVIDIA | 2017-06-21 | 2.8 x 10^13 | |||
| FP16 | NVIDIA V100 | NVIDIA | 2017-06-21 | 3.1 x 10^13 | |||
| FP16 | PEZY-SC2 | PEZY | 2017-06-01 | 1.6 x 10^13 | |||
| FP16 | NVIDIA Tesla P100 PCIe 16GB | NVIDIA | 2016-06-20 | 1.9 x 10^13 | |||
| FP16 | NVIDIA Tesla P100 PCIe 12GB | NVIDIA | 2016-06-20 | 1.9 x 10^13 | |||
| FP16 | NVIDIA P100 PCIe 16GB | NVIDIA | 2016-06-20 | 1.9 x 10^13 | |||
| FP16 | NVIDIA Tesla P100 SXM2 | NVIDIA | 2016-04-05 | 2.1 x 10^13 | |||
| FP16 | NVIDIA P100 | NVIDIA | 2016-04-05 | 1.9 x 10^13 | |||
| FP16 | NVIDIA Tesla P100 DGXS | NVIDIA | 2016-04-05 | 2.1 x 10^13 | |||
| TF32 (19-bit) | NVIDIA Blackwell Ultra | NVIDIA | 2025-08-22 | 1.2 x 10^15 | |||
| TF32 (19-bit) | NVIDIA H200 SXM | NVIDIA | 2024-11-18 | 4.9 x 10^14 | |||
| TF32 (19-bit) | AMD Instinct MI325X | AMD | 2024-10-10 | 6.5 x 10^14 | |||
| TF32 (19-bit) | Intel Habana Gaudi3 | Intel | 2024-09-24 | 4.6 x 10^14 | |||
| TF32 (19-bit) | NVIDIA GB200 NVL2 (per GPU) | NVIDIA | 2024-06-02 | 1.2 x 10^15 | |||
| TF32 (19-bit) | NVIDIA B100 | NVIDIA | 2024-03-18 | 8.8 x 10^14 | |||
| TF32 (19-bit) | NVIDIA B200 | NVIDIA | 2024-03-18 | 1.1 x 10^15 | |||
| TF32 (19-bit) | MTT S4000 | Moore Threads (Tencent) | 2023-12-19 | 5 x 10^13 | |||
| TF32 (19-bit) | AMD Instinct MI300X | AMD | 2023-12-06 | 6.5 x 10^14 | |||
| TF32 (19-bit) | NVIDIA HGX H20 | NVIDIA | 2023-11-09 | 7.4 x 10^13 | |||
| TF32 (19-bit) | NVIDIA L2 PCle | NVIDIA | 2023-11-09 | 4.8 x 10^13 | |||
| TF32 (19-bit) | NVIDIA L20 PCle | NVIDIA | 2023-09-16 | 6 x 10^13 | |||
| TF32 (19-bit) | NVIDIA GH200 | NVIDIA | 2023-08-08 | 4.9 x 10^14 | |||
| TF32 (19-bit) | MetaX MXC500 (PCIe) | MetaX | 2023-06-13 | 1.2 x 10^14 | |||
| TF32 (19-bit) | AWS Inferentia2 | Amazon AWS | 2023-04-13 | 1.9 x 10^14 | |||
| TF32 (19-bit) | NVIDIA H800 SXM5 | NVIDIA | 2023-03-21 | 4.5 x 10^14 | |||
| TF32 (19-bit) | NVIDIA GH100 | NVIDIA | 2023-03-21 | 4.9 x 10^14 | |||
| TF32 (19-bit) | NVIDIA L4 | NVIDIA | 2023-03-21 | 6 x 10^13 | |||
| TF32 (19-bit) | AMD Instinct MI300A | AMD | 2023-01-04 | 4.9 x 10^14 | |||
| TF32 (19-bit) | MetaX MXC500 (OAM) | MetaX | 2023-01-01 | 1.4 x 10^14 | |||
| TF32 (19-bit) | NVIDIA A800 PCIe 40 GB | NVIDIA | 2022-11-08 | 1.6 x 10^14 | |||
| TF32 (19-bit) | NVIDIA A800 PCIe 80 GB | NVIDIA | 2022-11-03 | 1.6 x 10^14 | |||
| TF32 (19-bit) | Amazon Trainium1 | Amazon AWS | 2022-10-15 | 1.9 x 10^14 | |||
| TF32 (19-bit) | NVIDIA H100 PCIe | NVIDIA | 2022-09-20 | 3.8 x 10^14 | |||
| TF32 (19-bit) | NVIDIA GeForce RTX 4090 | NVIDIA | 2022-09-20 | 8.3 x 10^13 | |||
| TF32 (19-bit) | NVIDIA H100 SXM5 80GB | NVIDIA | 2022-09-20 | 4.9 x 10^14 | |||
| TF32 (19-bit) | Biren BR100 | Biren | 2022-08-22 | 5.1 x 10^14 | |||
| TF32 (19-bit) | NVIDIA A800 SXM | NVIDIA | 2022-08-11 | 1.6 x 10^14 | |||
| TF32 (19-bit) | NVIDIA GeForce RTX 3090 Ti | NVIDIA | 2022-03-29 | 4 x 10^13 | |||
| TF32 (19-bit) | AMD Radeon Instinct MI250X | AMD | 2021-11-08 | 9.6 x 10^13 | |||
| TF32 (19-bit) | NVIDIA A100 SXM4 80 GB | NVIDIA | 2020-11-16 | 1.6 x 10^14 | |||
| TF32 (19-bit) | NVIDIA A40 PCIe | NVIDIA | 2020-10-05 | 7.5 x 10^13 | |||
| TF32 (19-bit) | NVIDIA A100 PCIe | NVIDIA | 2020-06-22 | 1.6 x 10^14 | |||
| TF32 (19-bit) | NVIDIA A100 SXM4 40 GB | NVIDIA | 2020-05-14 | 1.6 x 10^14 | |||
| TF32 (19-bit) | NVIDIA A100 | NVIDIA | 2020-03-01 | 1.6 x 10^14 | |||
| Tensor-FP16/BF16 | Huawei Ascend 920 | Huawei | 2025-10-01 | 9 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Blackwell Ultra | NVIDIA | 2025-08-22 | 2.5 x 10^15 | |||
| Tensor-FP16/BF16 | NVIDIA B300 | NVIDIA | 2025-08-15 | 2.5 x 10^15 | |||
| Tensor-FP16/BF16 | Amazon Trainium2 | Amazon AWS | 2024-12-03 | 6.7 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA H200 SXM | NVIDIA | 2024-11-18 | 9.9 x 10^14 | |||
| Tensor-FP16/BF16 | Intel Habana Gaudi3 | Intel | 2024-09-24 | 1.7 x 10^15 | |||
| Tensor-FP16/BF16 | Maia 100 (M100) | Microsoft | 2024-08-27 | 8 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA GB200 NVL2 (per GPU) | NVIDIA | 2024-06-02 | 2.5 x 10^15 | |||
| Tensor-FP16/BF16 | Google TPU v6e Trillium | 2024-05-14 | 9.2 x 10^14 | ||||
| Tensor-FP16/BF16 | Meta MTIA v2 | Meta | 2024-04-10 | 1.8 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA B100 | NVIDIA | 2024-03-18 | 1.8 x 10^15 | |||
| Tensor-FP16/BF16 | NVIDIA B200 | NVIDIA | 2024-03-18 | 2.2 x 10^15 | |||
| Tensor-FP16/BF16 | MTT S4000 | Moore Threads (Tencent) | 2023-12-19 | 1 x 10^14 | |||
| Tensor-FP16/BF16 | Google TPU v5p | 2023-12-06 | 4.6 x 10^14 | ||||
| Tensor-FP16/BF16 | AMD Instinct MI300X | AMD | 2023-12-06 | 1.3 x 10^15 | |||
| Tensor-FP16/BF16 | NVIDIA HGX H20 | NVIDIA | 2023-11-09 | 1.5 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA L2 PCle | NVIDIA | 2023-11-09 | 9.6 x 10^13 | |||
| Tensor-FP16/BF16 | NVIDIA L20 PCle | NVIDIA | 2023-09-16 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | Google TPU v5e | 2023-08-29 | 2 x 10^14 | ||||
| Tensor-FP16/BF16 | NVIDIA GH200 | NVIDIA | 2023-08-08 | 9.9 x 10^14 | |||
| Tensor-FP16/BF16 | Meta MTIA v1 | Meta | 2023-05-18 | 5.1 x 10^13 | |||
| Tensor-FP16/BF16 | AWS Inferentia2 | Amazon AWS | 2023-04-13 | 1.9 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA H800 SXM5 | NVIDIA | 2023-03-21 | 9.9 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA GH100 | NVIDIA | 2023-03-21 | 9.9 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA L4 | NVIDIA | 2023-03-21 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | AMD Instinct MI300A | AMD | 2023-01-04 | 9.8 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA A800 PCIe 40 GB | NVIDIA | 2022-11-08 | 3.1 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA A800 PCIe 80 GB | NVIDIA | 2022-11-03 | 3.1 x 10^14 | |||
| Tensor-FP16/BF16 | Amazon Trainium1 | Amazon AWS | 2022-10-15 | 1.9 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA L40 | NVIDIA | 2022-10-13 | 1.8 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA H100 PCIe | NVIDIA | 2022-09-20 | 7.6 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA GeForce RTX 4090 | NVIDIA | 2022-09-20 | 3.3 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA H100 SXM5 80GB | NVIDIA | 2022-09-20 | 9.9 x 10^14 | |||
| Tensor-FP16/BF16 | Biren BR100 | Biren | 2022-08-22 | 1 x 10^15 | |||
| Tensor-FP16/BF16 | NVIDIA A800 SXM | NVIDIA | 2022-08-11 | 3.1 x 10^14 | |||
| Tensor-FP16/BF16 | Intel Habana Gaudi2 | Intel | 2022-05-10 | 4.5 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA GeForce RTX 3090 Ti | NVIDIA | 2022-03-29 | 1.6 x 10^14 | |||
| Tensor-FP16/BF16 | AMD Radeon Instinct MI250X | AMD | 2021-11-08 | 3.8 x 10^14 | |||
| Tensor-FP16/BF16 | Tesla D1 Dojo | Tesla | 2021-08-21 | 3.6 x 10^14 | |||
| Tensor-FP16/BF16 | Google TPU v4 | 2021-05-20 | 2.8 x 10^14 | ||||
| Tensor-FP16/BF16 | NVIDIA A100 SXM4 80 GB | NVIDIA | 2020-11-16 | 3.1 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA A40 PCIe | NVIDIA | 2020-10-05 | 1.5 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA A100 PCIe | NVIDIA | 2020-06-22 | 3.1 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA A100 SXM4 40 GB | NVIDIA | 2020-05-14 | 3.1 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA A100 | NVIDIA | 2020-03-01 | 3.1 x 10^14 | |||
| Tensor-FP16/BF16 | Google TPU v4i | 2020-01-01 | 1.4 x 10^14 | ||||
| Tensor-FP16/BF16 | NVIDIA Tesla V100S PCIe 32 GB | NVIDIA | 2019-11-26 | 1.3 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA GeForce RTX 2080 Ti 11GB | NVIDIA | 2018-09-20 | 1.1 x 10^14 | |||
| Tensor-FP16/BF16 | Google TPU v3 | 2018-05-18 | 1.2 x 10^14 | ||||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 DGXS 16 GB | NVIDIA | 2018-03-27 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 PCIe 32 GB | NVIDIA | 2018-03-27 | 1.1 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 DGXS 32 GB | NVIDIA | 2018-03-27 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 SXM3 32 GB | NVIDIA | 2018-03-27 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 SXM2 32 GB | NVIDIA | 2018-03-27 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 SXM2 | NVIDIA | 2017-07-01 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 SXM2 16 GB | NVIDIA | 2017-06-21 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA Tesla V100 PCIe 16 GB | NVIDIA | 2017-06-21 | 1.1 x 10^14 | |||
| Tensor-FP16/BF16 | NVIDIA V100 | NVIDIA | 2017-06-21 | 1.2 x 10^14 | |||
| Tensor-FP16/BF16 | Google TPU v2 | 2017-05-01 | 4.5 x 10^13 |
The improvement was driven by increasing transistor counts and other semiconductor manufacturing improvements, as well as specialized design for AI workloads. This improvement lowered cost per FLOP, increased energy efficiency, and enabled large-scale AI training.
Epoch's work is free to use, distribute, and reproduce provided the source and authors are credited under the Creative Commons BY license.