This website requires JavaScript.
Explore
Help
Sign In
millaguie
/
llama.cpp
Watch
1
Star
0
Fork
0
Code
Issues
Pull Requests
Actions
27
Packages
Projects
Releases
Wiki
Activity
Files
5eca4e3cabad9c92ccbf290d8406fbe7c110a680
llama.cpp
/
ggml
/
src
/
ggml-cpu
/
arch
T
History
ragz4125
20a04b2206
ggml-cpu: use UE4M3 LUT in ARM NVFP4 dot product (
#25331
)
2026-07-06 19:06:40 +08:00
..
arm
ggml-cpu: use UE4M3 LUT in ARM NVFP4 dot product (
#25331
)
2026-07-06 19:06:40 +08:00
loongarch
ggml : add some lsx support (
#23798
)
2026-05-30 11:53:26 +03:00
powerpc
ggml: add Q1_0 1-bit quantization support (CPU) (
#21273
)
2026-04-06 20:55:21 +02:00
riscv
ggml-cpu: extend RVV quantization vec dot to higher VLENs (
#22754
)
2026-06-04 08:03:40 +03:00
s390
ggml: add Q1_0 1-bit quantization support (CPU) (
#21273
)
2026-04-06 20:55:21 +02:00
wasm
ggml: vectorize ggml_vec_dot_q4_1_q8_1 with WASM SIMD128 (
#22209
)
2026-06-04 16:12:38 +03:00
x86
ggml-cpu: add AVX2 optimization for nvfp4 dot product and use UE4M3 LUT (
#23961
)
2026-07-01 15:31:20 +08:00