llama-benchy: llama-bench-style LLM benchmarks for any OpenAI-compatible endpoint

If, like me, you run your models locally and sovereignly, you know the problem: I want to know how...

Read More