Hallo Stephan, danke für deine Videos und das man hier kommunizieren kann darüber. Ich bin zwar nicht aus der Webentwicklung, aber aus dem Software Deployment und leidenschaftlich mit lokalen KI-Modellen unterwegs. Ich nutze sie via llama.cpp (hip und vulkan), aber nutze auch LM-Studio um Einstellungen zu sehen und zu testen. Vor allen Dingen wegen 'Estimated Memory Usage', also vermutlicher Speicherverbrauch. Das stimmt zwar nicht immer ganz so, aber meistens ist es eine gute Richtung.