/
vshmidt
/
llama.cpp
ОбзорДокументацияВойти
/
vshmidt
/
llama.cpp
Код
Запросы
0
Задачи
Вики
Пакеты
0
Релизы
0
Аналитика
Безопасность
ДокументацияПоддержка
Политика конфиденциальностиПользовательское соглашениеПолитика использования «cookies»Согласие субъекта персональных данных
2026 ©
llama.cpp/
ggml/src/
..
ggml-blas

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-cann

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-cpu

ggml-cpu: Optimized x86 and generic cpu q1_0 dot (follow up) (#21636)

4 месяца назад
ggml-cuda

ggml-cuda: flush legacy pool on OOM and retry (#22155)

4 месяца назад
ggml-hexagon

hexagon: optimize HMX matmul operations (#21071)

4 месяца назад
ggml-hip

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-metal

metal: Implement ROLL op (#21946)

4 месяца назад
ggml-musa

ggml-cuda: native bf16 flash attention for vec kernel (#20525)

5 месяцев назад
ggml-opencl

opencl: refactor q8_0 set_tensor and mul_mat host side dispatch for Adreno (#21938)

4 месяца назад
ggml-openvino

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-rpc

rpc : refactor the RPC transport (#21998)

4 месяца назад
ggml-sycl

[SYCL] Fix reorder MMVQ assert on unaligned vocab sizes (#22035)

4 месяца назад
ggml-virtgpu

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-vulkan

vulkan: Support F16 OP_FILL (#22177)

4 месяца назад
ggml-webgpu

ggml-webgpu: updated matrix-vector multiplication (#21738)

4 месяца назад
ggml-zdnn

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-zendnn

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
CMakeLists.txt

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-alloc.c

ggml : remove ggml-ext.h (#21869)

4 месяца назад
ggml-backend-dl.cpp

hexagon: enable offloading to Hexagon on Windows on Snapdragon (#19150)

6 месяцев назад
ggml-backend-dl.h

hexagon: enable offloading to Hexagon on Windows on Snapdragon (#19150)

6 месяцев назад
ggml-backend-impl.h

ggml: backend-agnostic tensor parallelism (experimental) (#19378)

4 месяца назад
ggml-backend-meta.cpp

Tensor-parallel: Fix delayed AllReduce on Gemma-4 MoE (#22129)

4 месяца назад
ggml-backend-reg.cpp

ggml : add OpenVINO backend (#15307)

5 месяцев назад
ggml-backend.cpp

ggml: add graph_reused (#21764)

4 месяца назад
ggml-common.h

ggml: add Q1_0 1-bit quantization support (CPU) (#21273)

4 месяца назад
ggml-impl.h

ggml: add graph_reused (#21764)

4 месяца назад
ggml-opt.cpp

fix: free ctx_copy in ggml_opt_free to plug per-training-session leak (#21592)

4 месяца назад
ggml-quants.c

ggml: add Q1_0 1-bit quantization support (CPU) (#21273)

4 месяца назад
ggml-quants.h

ggml: add Q1_0 1-bit quantization support (CPU) (#21273)

4 месяца назад
ggml-threading.cpp

ggml : build backends as libraries (#10256)

2 года назад
ggml-threading.h

remove CMAKE_WINDOWS_EXPORT_ALL_SYMBOLS (#10797)

2 года назад
ggml.c

ggml: add graph_reused (#21764)

4 месяца назад
ggml.cpp

ggml : Print backtrace on uncaught C++ exceptions (ggml/1232)

год назад
gguf.cpp

llama: fix llama-model-saver (#20503)

5 месяцев назад