

Em 10 de março de 2023, Georgi Gerganov fez o primeiro commit do llama.cpp no GitHub. A biblioteca, escrita em C e C++, tinha um único objetivo: executar os modelos LLaMA da Meta no processador de um laptop sem GPU.
Ainda não há GIFs para este tópico.