Der Abliterations-Prüfstand — was das Entsperren wirklich nimmt, und was es kostet
Teil 8 endete mit einer Ankündigung: als Nächstes messe ich, was Abliteration einem Modell tatsächlich nimmt. Der Ratschlag dazu steht in jedem Forum — nimm die…
Blog
Infrastruktur, KI, Werkzeuge – und die Entscheidungen dahinter.
Teil 8 endete mit einer Ankündigung: als Nächstes messe ich, was Abliteration einem Modell tatsächlich nimmt. Der Ratschlag dazu steht in jedem Forum — nimm die…
Bis heute lief jede Messung dieser Serie auf einer Grafikkarte. 24 Gigabyte, und damit war die Grenze klar: was mehr braucht, wurde nicht gemessen. Seit heute…
Sieben Teile lang hat diese Serie gemessen, was lokale Modelle antworten, wenn man sie fragt. Dieser Teil handelt von der Frage davor, die ich nie gestellt…
Modelle, die „denken können“, haben in Ollama einen Schalter dafür. Die Serie hat ihn von Anfang an ausgeschaltet und das in jedem Beitrag dazugeschrieben: gemessen mit…
Jede Messung dieser Serie läuft mit temperature 0 und drei Seeds. Der Gedanke dahinter war: falls das Modell doch streut, fangen drei Durchgänge es ab. Beim…
Eine X299-Workstation von 2020 wird zum Proxmox-Hauptknoten. Teil 1: Hardware, ZFS-Layout, GPU-Passthrough. Teil 2: sieben Fallstricke von pct remote-migrate — darunter einer, der bei rc=0 still…
Ein Agent ist kein Chat. Die Frage ist nicht, ob das Modell klug klingt, sondern ob es das richtige Werkzeug zieht — und ob es die…
Drei Ratschläge stehen in jedem Prompt-Leitfaden: sag dem Modell, es soll Schritt für Schritt denken. Gib ihm eine Rolle. Zeig ihm ein Beispiel. Alle drei klingen…
Ein abliteriertes Modell fiel im Logikrätsel auf exakt null von 45 Punkten. „Abliteration zerstört das Denken" wäre eine gute Überschrift gewesen. Sie war nur nicht wahr…
Elf lokale Modelle, drei echte Arbeitsaufgaben, zwei RTX-3090-Hosts, 198 Anfragen, null Fehler. 90 von 99 Ausgaben kamen über beide Rechner hinweg byteidentisch zurück — und die…