Guter Punkt mit der Steckdose, Jörg. Die Metapher trifft es besser als das meiste, was ich zu MCP gelesen habe, denn genau das ist es: nicht mehr Intelligenz, sondern endlich Hände. Ich kann aus der Praxis bestätigen, was du beschreibst, weil bei mir genau diese Strecke schon läuft: Quelle rein, Gespräch wird geschrieben, mit meiner eigenen geklonten Stimme und einer zweiten KI-Stimme vertont, fertige MP3 fällt hinten raus. Ein Auftrag, kein Kopieren, kein Runterladen, kein Hochladen. Dein Satz „MCP nimmt dir nicht die Arbeit ab, sondern die Klickerei dazwischen" ist dabei exakt richtig, und ich würde noch einen draufsetzen: Die Klickerei war vorher auch der Grund, warum man es dann doch nicht gemacht hat. Wenn der Weg von der Idee zur Folge ein Satz ist, produziert man plötzlich wirklich. Eine kleine Ergänzung zur Einordnung: Den ElevenLabs-MCP gibt es schon seit Frühjahr 2025 zum Selbst-Einrichten. Wirklich neu ist die gehostete Variante direkt in Claude, bei der das lokale Setup wegfällt. Für alle ohne Technik-Lust ist genau das der eigentliche Durchbruch. Zu deiner Frage, woran es hakt, drei Dinge aus meinen ersten Wochen mit der Strecke: 𝗘𝗿𝘀𝘁𝗲𝗻𝘀 die Stimmverwechslung. Wenn im ElevenLabs-Konto mehrere ähnliche Stimmen liegen, greift die Automatik gern die falsche. Die Stimm-ID gehört fest verdrahtet, nicht über den Namen ausgewählt. 𝗭𝘄𝗲𝗶𝘁𝗲𝗻𝘀 die Aussprache von Eigennamen. Firmennamen und Fachbegriffe spricht die KI erstmal falsch, das fällt erst beim Anhören auf. Ich habe mir für meine Namen feste Schreibweisen hinterlegt, die richtig klingen. 𝗗𝗿𝗶𝘁𝘁𝗲𝗻𝘀, und das ist der wichtigste Punkt: Der Engpass war nie die Vertonung, sondern das Skript. Eine mittelmäßige Textvorlage wird eine mittelmäßige Folge, egal wie gut die Stimme klingt. Die Vertonung ist bei mir der letzte Schritt von fünf, nicht der erste. Ich dokumentiere solche Abläufe gerade Stück für Stück in meiner eigenen KI-Community, deshalb freue ich mich immer, wenn jemand wie du das Thema praktisch angeht statt nur anzukündigen.