Skip to content
KernelIndex
Search⌘K

torch / matmulff95bc

torch_matmul_ff95bc · FlashInfer-Bench baselines · python · Apache-2.0

Use it

Vendorable · source mirrored · Apache-2.0View source →

No package. Vendor the mirrored source: 6 lines, Apache-2.0, pinned at da91508.

main.py
curl "https://kernelindex.com/api/v1/implementations/flashinfer-torch-matmul-ff95bc?include=source"
interfacepython
revisionda915083d4c7
symbolrun
pathmain.py
Compatibility
measured onNVIDIA B200
declared hardwareNVIDIA B200
architecturesunknown
dtypesfp16

Benchmark evidence

43 measurements across 1 GPU, fastest first.

Operation / workload
Hardware
Latency
Rank
Observed
GEMM n2048 k8192fp16 · [2, 8192]
NVIDIA B200
15.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [1, 8192]
NVIDIA B200
16.3µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [16, 8192]
NVIDIA B200
16.5µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [4, 8192]
NVIDIA B200
16.7µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [8, 8192]
NVIDIA B200
16.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [7, 8192]
NVIDIA B200
16.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [70, 8192]
NVIDIA B200
17.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [72, 8192]
NVIDIA B200
17.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [15, 8192]
NVIDIA B200
17.6µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [24, 8192]
NVIDIA B200
17.9µs
#1 of 1
2026-04-20
Show all 43 measurements ›
GEMM n2048 k8192fp16 · [32, 8192]
NVIDIA B200
18.4µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [64, 8192]
NVIDIA B200
18.5µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [48, 8192]
NVIDIA B200
18.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [35, 8192]
NVIDIA B200
18.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [40, 8192]
NVIDIA B200
18.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [96, 8192]
NVIDIA B200
19.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [56, 8192]
NVIDIA B200
19.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [120, 8192]
NVIDIA B200
19.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [104, 8192]
NVIDIA B200
19.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [80, 8192]
NVIDIA B200
19.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [88, 8192]
NVIDIA B200
19.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [112, 8192]
NVIDIA B200
19.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [144, 8192]
NVIDIA B200
19.1µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [160, 8192]
NVIDIA B200
19.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [152, 8192]
NVIDIA B200
20.1µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [136, 8192]
NVIDIA B200
20.7µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [128, 8192]
NVIDIA B200
20.7µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [192, 8192]
NVIDIA B200
20.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [216, 8192]
NVIDIA B200
20.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [176, 8192]
NVIDIA B200
20.9µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [184, 8192]
NVIDIA B200
21.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [224, 8192]
NVIDIA B200
21.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [200, 8192]
NVIDIA B200
21.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [208, 8192]
NVIDIA B200
21.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [240, 8192]
NVIDIA B200
21.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [232, 8192]
NVIDIA B200
21.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [248, 8192]
NVIDIA B200
21.0µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [256, 8192]
NVIDIA B200
21.1µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [168, 8192]
NVIDIA B200
23.1µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [972, 8192]
NVIDIA B200
34.2µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [2053, 8192]
NVIDIA B200
56.1µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [2379, 8192]
NVIDIA B200
59.7µs
#1 of 1
2026-04-20
GEMM n2048 k8192fp16 · [8192, 8192]
NVIDIA B200
194.7µs
#1 of 1
2026-04-20

Reported · How evidence levels are derived →

Source and license

sourcehttps://huggingface.co/datasets/flashinfer-ai/flashinfer-trace
commitda915083d4c7c5e61aa3005e3d17ae488e0fc71c
revision digestsha256:998384d633eaae861899f715f33187bca651506c1d4759c244d6ab04c6dc9850
license declaredApache-2.0
license concludedApache-2.0
authorsbaseline
imported2026-08-16

Kernel source

main.py6 lines
import torch
from torch.nn.functional import linear

def run(A: torch.Tensor, B: torch.Tensor):
    return linear(A, B)

Source code from FlashInfer-Bench (flashinfer-ai/flashinfer-trace) · Apache-2.0

Best evidence level for this revision: reported

JSON