diff options
| author | Sadeep Madurange <sadeep@asciimx.com> | 2026-08-16 12:38:36 +0800 |
|---|---|---|
| committer | Sadeep Madurange <sadeep@asciimx.com> | 2026-08-16 12:45:56 +0800 |
| commit | e7e1ab12dd42936e389f1d56ad22f45d795d79a7 (patch) | |
| tree | 0f8eb21c5b56e169c1427b9ca452653104f1dee3 /llm.c | |
| parent | 01b9c204777c3f7e541241180bac0d3d93721af0 (diff) | |
| download | lex-e7e1ab12dd42936e389f1d56ad22f45d795d79a7.tar.gz | |
Change load mode to auto, benchmarks from RPi5.
Diffstat (limited to 'llm.c')
| -rw-r--r-- | llm.c | 7 |
1 files changed, 5 insertions, 2 deletions
@@ -91,8 +91,11 @@ struct llm_ctx *llm_init(const char *model_path) mparams = llama_model_default_params(); mparams.n_gpu_layers = 0; /* force all layers onto CPU */ - mparams.load_mode = LLAMA_LOAD_MODE_MLOCK; /* Force model to RAM, - * don't swap/compress */ + + /* LLAMA_LOAD_MODE_MLOCK (force model to RAM, no swap/compression) + * would have been preferrable. But my Raspberry Pi5 doesn't have + * enough memory. */ + mparams.load_mode = LLAMA_LOAD_MODE_NONE; llm = MALLOC(sizeof(*llm)); llm->model = llama_model_load_from_file(model_path, mparams); |
