
X-Post:0xSero
LLM-Benchmark-Ergebnisse bei 3-Bit-Quantisierung
Ein Beitrag auf X diskutiert unerwartet hohe Leistungswerte eines Sprachmodells bei 3-Bit-Quantisierung (exl-3bits). Bei einem Benchmark-Score von 78,6 % wurden Durchsätze von 100 Token pro Sekunde bei einer Spitzenleistungsaufnahme von 1400 Watt erzielt.
36Lesezeichen11.045Aufrufe