Skip to content

Commit d00944d

Browse files
authored
Merge pull request #86 from AMD-Ecosystem/annier.rocmfp4-support
Annier.rocmfp4 support
2 parents 42aff9e + f81c5b0 commit d00944d

25 files changed

Lines changed: 1359 additions & 1 deletion

ggml/include/ggml.h

Lines changed: 10 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -430,7 +430,9 @@ extern "C" {
430430
GGML_TYPE_NVFP4 = 40, // NVFP4 (4 blocks, E4M3 scale)
431431
GGML_TYPE_Q1_0 = 41,
432432
GGML_TYPE_Q2_0 = 42,
433-
GGML_TYPE_COUNT = 43,
433+
GGML_TYPE_Q4_0_ROCMFP4 = 100, // ROCmFP4 experimental UE4M3 scales + packed AMD FP4 blocks
434+
GGML_TYPE_Q4_0_ROCMFP4_FAST = 101, // ROCmFP4 single-scale speed layout
435+
GGML_TYPE_COUNT = 102,
434436
};
435437

436438
// precision
@@ -475,6 +477,13 @@ extern "C" {
475477
GGML_FTYPE_MOSTLY_NVFP4 = 26, // except 1d tensors
476478
GGML_FTYPE_MOSTLY_Q1_0 = 27, // except 1d tensors
477479
GGML_FTYPE_MOSTLY_Q2_0 = 28, // except 1d tensors
480+
GGML_FTYPE_MOSTLY_Q4_0_ROCMFP4 = 100, // except 1d tensors
481+
GGML_FTYPE_MOSTLY_Q4_0_ROCMFP4_LEAN = 101, // ROCmFP4 with Q5_K token embeddings
482+
GGML_FTYPE_MOSTLY_Q4_0_ROCMFP4_COHERENT = 102, // ROCmFP4 with Q6_K token embeddings
483+
GGML_FTYPE_MOSTLY_Q4_0_ROCMFP4_FAST = 103, // ROCmFP4 single-scale speed layout
484+
GGML_FTYPE_MOSTLY_Q4_0_ROCMFP4_FAST_COHERENT = 104, // ROCmFP4 fast with Q6_K token embeddings
485+
GGML_FTYPE_MOSTLY_Q4_0_ROCMFP4_STRIX = 105, // ROCmFP4 Strix Halo quality/speed recipe
486+
GGML_FTYPE_MOSTLY_Q4_0_ROCMFP4_STRIX_LEAN = 106, // ROCmFP4 Strix Halo size-biased K/V recipe
478487
};
479488

480489
// available tensor operations:

0 commit comments

Comments
 (0)