llama.cpp/src at a4417ddda98fd0558fb4d802253e68a933704b59 - llama.cpp - Cat's Mantra

tqcq/llama.cpp

mirror of https://github.com/ggml-org/llama.cpp.git synced 2025-07-29 21:54:07 -04:00

Files

History

lexasub a5203b4465 llama : minor fixes for up llama load model speed (#11448 )

* impl::load change map bpe_ranks to onordered map for reduce time of impl::load on 30%

* llama_model_loader::init_mapping - replace new llama_mmap to std::make_unique<llama_mmap> for clean code & reduce (/2) time of running init_mappings

* Update src/llama-vocab.cpp

---------

Co-authored-by: lexasub <empty@empty.ru>
Co-authored-by: Diego Devesa <slarengh@gmail.com>

2025-01-27 14:42:09 +01:00

..

CMakeLists.txt

Add Jinja template support (#11016 )

2025-01-21 13:18:51 +00:00

llama-adapter.cpp

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-adapter.h

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-arch.cpp

Add Jinja template support (#11016 )

2025-01-21 13:18:51 +00:00

llama-arch.h

Add Jinja template support (#11016 )

2025-01-21 13:18:51 +00:00

llama-batch.cpp

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-batch.h

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-chat.cpp

llama : add support for Deepseek-R1-Qwen distill model (#11310 )

2025-01-20 14:35:07 +01:00

llama-chat.h

llama-chat : add phi 4 template (#11148 )

2025-01-09 10:07:33 +01:00

llama-context.cpp

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-context.h

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-cparams.cpp

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-cparams.h

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-grammar.cpp

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-grammar.h

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-hparams.cpp

llama: add support for QRWKV6 model architecture (#11001 )

2025-01-10 09:58:08 +08:00

llama-hparams.h

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-impl.cpp

GGUF: C++ refactor, backend support, misc fixes (#11030 )

2025-01-07 18:01:58 +01:00

llama-impl.h

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-kv-cache.cpp

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-kv-cache.h

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-mmap.cpp

mmap: add include for cerrno (#11296 )

2025-01-20 16:02:43 +02:00

llama-mmap.h

mmap : fix fileno macro clash (#11076 )

2025-01-06 10:52:38 +02:00

llama-model-loader.cpp

llama : minor fixes for up llama load model speed (#11448 )

2025-01-27 14:42:09 +01:00

llama-model-loader.h

llama : add llama_model_load_from_splits (#11255 )

2025-01-16 13:54:08 +01:00

llama-model.cpp

rpc: fix register position (#11424 )

2025-01-26 16:20:34 +01:00

llama-model.h

rpc : early register backend devices (#11262 )

2025-01-17 10:57:09 +02:00

llama-quant.cpp

llama : add llama_model_load_from_splits (#11255 )

2025-01-16 13:54:08 +01:00

llama-quant.h

llama : refactor src/llama.cpp (#10902 )

2025-01-03 10:18:53 +02:00

llama-sampling.cpp

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-sampling.h

llama : add llama_vocab, functions -> methods, naming (#11110 )

2025-01-12 11:32:42 +02:00

llama-vocab.cpp

llama : minor fixes for up llama load model speed (#11448 )

2025-01-27 14:42:09 +01:00

llama-vocab.h

llama : remove notion of CLS token (#11064 )

2025-01-12 12:15:53 +02:00

llama.cpp

llama: refactor llama_decode_impl (#11381 )

2025-01-27 12:07:12 +01:00

unicode-data.cpp

…

unicode-data.h

…

unicode.cpp

cmake : add sanitizer flags for llama.cpp (#11279 )

2025-01-18 16:18:15 +02:00

unicode.h

…