b2923

github-actions released this 18 May 14:59

0f98acf

llama : add support for larger Granite Code Models (20B, 34B) (#7324)

Tie the weights for ARCH_STARCODER to support the larger Granite code models.
Partially addresses ggerganov/issues/7116

There still remains to be a few things to fix.
Currently requires `--override-kv tokenizer.ggml.add_bos_token=bool:false`

Assets 21

Provide feedback

Saved searches

Use saved searches to filter your results more quickly

b2923