Werkzeug · Lokaler Runner
llmfit
von Alex Jones (AlexsJones, Open Source)
Terminal-Werkzeug, das die eigene Hardware ausliest und daraus ableitet, welches offene Modell in welcher Quantisierung darauf tatsächlich läuft – samt geschätzter Token pro Sekunde, bevor man 8 GB herunterlädt.
Einschätzung
Der Kassenzettel vor dem Download
Wofür es gut ist
- vor dem Download prüfen, ob ein Modell in den eigenen Speicher passt
- die passende Quantisierungsstufe für die vorhandene Grafikkarte finden
- Token/s auf der eigenen Hardware abschätzen statt raten
- alte oder schwache Geräte realistisch einordnen
Stärken
- Erkennt CPU, RAM und GPU (auch Mehr-GPU-Aufbauten) selbst und schlägt die passende Quantisierung vor
- Gewichtet die vier Kriterien je nach Einsatzzweck unterschiedlich – Chat zählt Geschwindigkeit höher, Reasoning die Qualität
- Breite Installationswege (scoop, brew, Skript, pip/uv, Docker, Quelltext) und MIT-Lizenz
- Gemeinschafts-Bestenliste mit echten Messwerten anderer Nutzer als Gegenprobe zur Schätzung
Schwächen
- Die Token/s sind aus der Speicherbandbreite abgeleitet, nicht gemessen; für nicht gelistete Karten greifen Backend-Konstanten und die Schätzung wird ungenauer
- Zu hohe Schätzwerte waren bereits Gegenstand einer GitHub-Rückmeldung – nachgerüstet wurde daraufhin ein Panel zum Nachjustieren, nicht eine bessere Messung
- Deckt die lokal betreibbaren offenen Modelle ab; für gehostete Frontier-Modelle ist es nicht gedacht
Stimmen aus der Community
Subjektive Einschätzungen Dritter – keine belegten Fakten, jeweils verlinkt.
- positivStellt llmfit als Antwort auf das Quantisierungs-Ratespiel vor und führt es über eine Reihe von Geräten bis hinunter zu einem Raspberry Pi der ersten Generation von 2012 vor. Erklärt die Mechanik der Geschwindigkeitsschätzung korrekt (je Token werden die Gewichte einmal vollständig aus dem Speicher gelesen, also entscheidet die Speicherbandbreite) und benennt selbst die Schwachstelle: Die Schätzungen fielen für manche Modelle zu hoch aus, woraufhin ein Konfigurations-Panel zum Nachjustieren nachgerüstet wurde.Better Stack (YouTube) – „This Tool Finds the Perfect AI Model for Your Hardware (llmfit)“, 26.08.2026 (per oEmbed verifiziert, gegen das Transkript gelesen) · Community, 2026-08-26
Direkt ausprobieren
github.com/AlexsJones/llmfit
ℹ️