github Actively maintained

turboderp-org/exllamav2

A fast inference library for running LLMs locally on modern consumer-class GPUs

2 awesome lists

Quick read

Stars
4,598
Forks
340
Open issues
159
Commits
1,459

Activity and growth

Latest capture 2026-08-03 03:13

Stars · last 7 days
No history
Commits · last 7 days
No history
Stars since tracking
+64
Stored snapshots
6

Metadata

Language
Python
License
MIT
Default branch
master
Created
2023-08-30
First commit
2023-08-30
Last pushed
2026-03-04
GitHub updated
2026-08-02
Last synced
2026-08-03 03:13
Stack scanned
2026-08-03 03:13
Archived
No

AI development signals

0 paths

Agent instructions and tool configuration found in this repository.

No config files detected.

Growth history

Tracked growth

6 observed captures since 2026-05-25. Observed captures are shown by default.

Stars from first capture +64

Chart data

Observed captures only

Time horizon

All tracked data

Custom date range

Stars history

Observed snapshots

Commits history

Observed snapshots

Similar repositories

Nearest indexed repositories by embedding similarity.

meta-llama/llama

Inference code for Llama models

59,556 stars
Python 1 awesome list

ikawrakow/ik_llama.cpp

llama.cpp fork with additional SOTA quants and improved performance

2,989 stars
C++ 1 awesome list

getumbrel/llama-gpt

A self-hosted, offline, ChatGPT-like chatbot. Powered by Llama 2. 100% private, with no data leaving your device. New: Code Llama support!

10,936 stars
TypeScript 3 awesome lists

gotzmann/llama.go

llama.go is like llama.cpp in pure Golang!

1,398 stars
Go 2 awesome lists