A more memory-efficient rewrite of the HF transformers implementation of Llama for use with quantized weights.
| Тип | Репозиторий |
| Категория | GitHub-проекты / Из awesome-списка |
| Цена | открытый код |
| Платформа | Своё развёртывание |
| Системы | исходный код |
| Язык сайта | en |
| GitHub | turboderp/exllama |