
9 min
24-GB-Mac: Warum mein lokales NVFP4-Setup scheiterte
Qwen3.6-35B auf M4 Pro mit 24 GB: technisch geladen und 100 % GPU, aber nur 0,1 Tokens/s. Diagnose, fünf Lektionen und Hardware-Empfehlungen.
Behind the Scenes
Notizen aus meiner KI-Praxis: Agentic Coding, Multi-Agent-Architektur, Mittelstand-Use-Cases.

Qwen3.6-35B auf M4 Pro mit 24 GB: technisch geladen und 100 % GPU, aber nur 0,1 Tokens/s. Diagnose, fünf Lektionen und Hardware-Empfehlungen.

Nach zwei Monaten OpenClaw stellte ich Clanks KI-Schicht auf Hermes Agent (Nous Research) um: Lernschleife, Skill-System und 200+ Modelle gaben den Ausschlag.

CLOUD Act, DSGVO, Self-Hosting: Welcher KI-Stack passt zu Ihrem Projekt? Eine Entscheidungshilfe mit echten Kosten und Szenarien.