Schlagwort: Qwen3.8-27B
-

Wie Qwen3.8-27B auf der RTX Pro 6000 zum lokalen KI-Monster wird
KI lokal mit über 200 Tokens pro Sekunde In unserem letzten Artikel haben wir bewiesen, dass man das sagenumwobene 27-Milliarden-Parameter-Modell Qwen3.8-27B mit Müh und Not auf eine billige 8-GB-Grafikkarte quetschen kann. Das Ergebnis? Phänomenaler Code, aber eine Schneckengeschwindigkeit von 4 Tokens pro Sekunde, ideal für Tee-Liebhaber, die nach jedem Prompt eine halbe Stunde Däumchen drehen…
-

Qwen3.8-27B auf einer 8-GB-Grafikkarte
Genialer Hack oder teure Geduldsprobe? Stell dir vor: Du lädst ein brandneues 27-Milliarden-Parameter-Modell herunter, das in aktuellen Benchmarks KI-Schwergewichte wie Claude Opus 4.6 beim Coden und in Agenten-Workflows alt aussehen lässt. Du willst es lokal ausführen, ohne Cloud-Kosten, vollkommen privat. Aber dann wirfst du einen Blick auf deinen PC und siehst dort keine 5.000 Euro…
-

Qwen3.8-27B auf der RTX 5060 Ti
Brauchen lokale KI-Modelle wirklich 24 GB VRAM? Ein 27-Milliarden-Parameter-Modell auf einer Mittelklasse-Grafikkarte mit nur 16 GB VRAM? Was zunächst nach einer technischen Grenze klingt, ist offenbar möglich. Ein Community-Test zeigt, dass Qwen3.8-27B auf einer einzelnen GeForce RTX 5060 Ti* mit bis zu 47,6 Tokens pro Sekunde laufen kann. Dafür sind allerdings eine besonders speichersparende Quantisierung…
-

Qwen3.8-27B lokal auf AMD R9700
Das steckt hinter AMDs Day-0-Versprechen Ein 27-Milliarden-Parameter-Modell, lokal auf einem Mini-PC oder einer einzelnen Grafikkarte und das direkt zum Start? Genau dieses Versprechen macht AMD mit Qwen3.8-27B. Der neue Ableger aus der Qwen-Modellfamilie soll nicht nur leistungsfähig, sondern auch vergleichsweise einfach lokal einsetzbar sein. AMD nennt dabei bis zu 24,5 Tokens pro Sekunde auf einem…



