Logo
Explore Help
Sign In
LLM-Inference/ik_llama.cpp
Watch 1
Star 0
Fork 0
mirror of https://github.com/ikawrakow/ik_llama.cpp.git synced 2026-08-12 22:29:39 +04:00
Code Issues Packages Projects Releases Wiki Activity
Files
main
ik_llama.cpp/ggml/include
T
History
KawrakowandGitHub 707374b3c3 DS4: faster long-context TG (#2201)
* DS4: faster long-context TG

* Also this
2026-07-30 13:13:42 +03:00
..
ggml-alloc.h
Merge mainline llama.cpp (#3)
2024-07-27 07:55:01 +02:00
ggml-backend.h
Add --prefetch-experts to stream mmap'd MoE experts into page cache (#2101)
2026-07-11 10:43:42 +03:00
ggml-cann.h
Merge mainline llama.cpp (#3)
2024-07-27 07:55:01 +02:00
ggml-cpp.h
Port mdmd from mainline + Qwen2/2.5-VL support (#798)
2025-09-27 08:45:29 +02:00
ggml-cuda.h
Split mode graph for dense Gemma4 assistant (#2022)
2026-06-24 18:29:32 +02:00
ggml-metal.h
Merge mainline - Aug 12 2024 (#17)
2024-08-12 15:14:32 +02:00
ggml-rpc.h
server: improve speed of speculative decoding (#1119)
2026-01-10 08:01:22 +02:00
ggml-sycl.h
Merge mainline llama.cpp (#3)
2024-07-27 07:55:01 +02:00
ggml-vulkan.h
Vulkan: a fresh start (#608)
2025-07-15 08:03:13 +02:00
ggml.h
DS4: faster long-context TG (#2201)
2026-07-30 13:13:42 +03:00
Powered by Gitea Version: 1.27.0 Page: 157ms Template: 3ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API