CoolFace
Apppublic

Xenobd/whisper.cpp

sourceHugging Faceupdated 10mo agoView on Hugging Face
0likes
50 commits on main
0d923d010mo ago

Update Dockerfile

Xenobd
84f8c681y ago

remove unnecessary output

3v324v23
e408c7b1y ago

Unified return format

3v324v23
6c8a2301y ago

fix cmd

3v324v23
a1a7aac1y ago

fix cmd

3v324v23
1b9b1181y ago

fix build

3v324v23
d937c3a1y ago

fix build

3v324v23
03ff3a51y ago

fix dockerfile path

3v324v23
36ff0ea1y ago

add meta

3v324v23
aa000f71y ago

chore: track binaries with git-lfs

3v324v23
f33d63d1y ago

chore: track binaries with git-lfs

3v324v23
46ebeba1y ago

add sync task

3v324v23
6e115ac1y ago

Handle negative value in padding (#3389)

Treboko
0b658311y ago

models : update`./models/download-ggml-model.cmd` to allow for tdrz download (#3381)

Thea Mukhi, danbev
43216001y ago

talk-llama : sync llama.cpp

ggerganov
a0af6fc1y ago

sync : ggml

ggerganov
4b3da1d1y ago

ggml: Add initial WebGPU backend (llama/14521)

Reese Levine
6dd510c1y ago

ggml : initial zDNN backend (llama/14975)

taronaeo
fd4c0e11y ago

common : handle mxfp4 enum

ggerganov
a575f571y ago

ggml-quants : fix make_qp_quants NANs and IQ1 assertion errors (llama/15379)

compilade
cf24af71y ago

vulkan: disable spirv-opt for bfloat16 shaders (llama/15352)

jeffbolznv
054584a1y ago

vulkan: Use larger workgroups for mul_mat_vec when M is small (llama/15355)

jeffbolznv, OccamRazor
e5406c01y ago

vulkan: support sqrt (llama/15370)

Dong Won Kim
80a188c1y ago

vulkan: Optimize argsort (llama/15354)

jeffbolznv
ad199b11y ago

vulkan: fuse adds (llama/15252)

jeffbolznv
41a76e61y ago

vulkan: Support mul_mat_id with f32 accumulators (llama/15337)

jeffbolznv
a6fa78e1y ago

vulkan: Add missing bounds checking to scalar/coopmat1 mul_mat_id (llama/15334)

jeffbolznv
8ece1ee1y ago

OpenCL: add initial FA support (llama/14987)

mrfatso
1a0281c1y ago

opencl: add initial mxfp4 support via mv (llama/15270)

lhez, shawngu-quic
78a18651y ago

vulkan : fix out-of-bounds access in argmax kernel (llama/15342)

ggerganov
e3107ff1y ago

vulkan : fix compile warnings on macos (llama/15340)

ggerganov
449e1a41y ago

ggml: initial IBM zDNN backend (llama/14975)

taronaeo
6e3a7b61y ago

CUDA: fix negative KV_max values in FA (llama/15321)

JohannesGaessler
7cdf9cd1y ago

HIP: Cleanup hipification header (llama/15285)

uvos, JohannesGaessler
d48d5081y ago

vulkan: perf_logger improvements (llama/15246)

jeffbolznv
44968621y ago

ggml: fix ggml_conv_1d_dw bug (ggml/1323)

jasonni2
59c694d1y ago

cuda : fix GGML_CUDA_GRAPHS=OFF (llama/15300)

Sigbjørn Skjæret
f585fe71y ago

finetune: SGD optimizer, more CLI args (llama/13873)

Jonathan Graehl, OccamRazor, JohannesGaessler
58a38021y ago

HIP: bump requirement to rocm 6.1 (llama/15296)

uvos
b4896dc1y ago

ggml : update `ggml_rope_multi` (llama/12665)

Judd, ggerganov
db4407f1y ago

ggml : repack block_iq4_nlx8 (llama/14904)

ggerganov
c7688241y ago

CUDA: Optimize `reduce_rows_f32` kernel, leading up to 25x perf improvement on kernel-level and 10% perf increase for Gemma3n (llama/15132)

ORippler
c8284f21y ago

ggml-rpc: chunk send()/recv() to avoid EINVAL for very large tensors over RPC (macOS & others) (llama/15188)

aixsatoshi, Shinnosuke Takagi
8fca6dd1y ago

HIP: disable sync warp shuffel operators from clr amd_warp_sync_functions.h (llama/15273)

uvos
7b868ed1y ago

sycl: Fix and disable more configurations of mul_mat (llama/15151)

Romain Biessy
345810b1y ago

opencl: allow mixed f16/f32 `add` (llama/15140)

mrfatso
008e1691y ago

CUDA cmake: add `-lineinfo` for easier debug (llama/15260)

am17an
73e90ff1y ago

CANN: GGML_OP_CPY optimization (llama/15070)

Chenguang Li
4168dda1y ago

musa: fix failures in test-backend-ops for mul_mat_id op (llama/15236)

yeahdongcn
db87c9d1y ago

CANN: Add broadcast for softmax and FA (llama/15208)

hipudding