Neu · Model Context Protocol

Audio-MCP-Server fĂĽr Claude, Cursor, ChatGPT und beliebige KI-Agenten

Gesang entfernen, Stems aufteilen, Aufnahmen bereinigen und vieles mehr – direkt in Claude, Cursor oder ChatGPT. Sag einfach, was du möchtest, und du erhältst die fertige Datei zurück.

In weniger als einer Minute eingerichtet – dann übernimmt dein Assistent die Arbeit.

Funktioniert mit Claude· Cursor· Windsurf· Cline· Zed· ChatGPT · 22 Tools · 18 kostenlos

Frag einfach, in natĂĽrlicher Sprache

Sobald die Verbindung hergestellt ist, gib einfach ein, was du möchtest – dein Assistent ruft das richtige Tool auf und gibt dir einen Download-Link zurück.

ChatGPT
VocalRemover · verbunden
Entferne den Gesang aus diesem Song und gib mir die Karaoke-Version.
Bezeichnet als separate_audio · Aufgabe: instrumental
Fertig – der Gesang wurde mit unserem HQ-Fusion-Modell entfernt. Hier ist dein Karaoke-Track: karaoke.mp3 Audio · bereit
Teile nun das Original in einzelne Spuren auf – Gesang, Schlagzeug, Bass, Gitarre und Klavier.
Bezeichnet als separate_audio · Aufgabe: Stems
Mit Multi-Stem HQ in 5 Stems aufgeteilt. Hier sind deine Downloads: vocals.mp3 drums.mp3 bass.mp3 guitar.mp3 piano.mp3
Schreib deinem Assistenten eine Nachricht…

Weitere Fragen, die du stellen kannst

Konvertiere dieses Interview in das MP3-Format und entferne die Hintergrundgeräusche. Entferne den Hall aus dieser Sprachaufnahme. Erstelle eine 8D-Version dieses Songs und kürze sie auf 30 Sekunden. Extrahiere den Ton aus diesem Video als WAV-Datei.
Entwickelt fĂĽr Agent-Pipelines

„Nimm diese 12 Übungsaufnahmen, konvertiere jede in MP3 und entferne dann den Gesang“ – der gesamte Prozess läuft durchgängig in einer einzigen Agent-Sitzung ab: konvertieren, trennen, abfragen, 12 Links zurückgeben. Kein Wechsel zwischen Apps, kein Glue-Code.

Was du tun kannst

Kostenlos · Audio-Tools

Alltägliche Audiobearbeitung, kostenlos

  • Konvertiere zwischen MP3, WAV, FLAC, OGG, M4A, AAC und OPUS.
  • Einen Clip auf eine exakte Startzeit und Länge zuschneiden.
  • Extrahiere die Audiospur aus beliebigen Videodateien.
  • Ermittelt die Dauer, Bitrate und das Format einer Datei.
KI · Studioqualität

KI-Separation in Studioqualität

  • Entferne den Gesang oder extrahiere die Instrumentalversion fĂĽr Karaoke.
  • Einen Song in einzelne Spuren aufteilen: Gesang, Schlagzeug, Bass, Gitarre, Klavier.
  • Sprachaufnahmen bereinigen – Störgeräusche und Raumecho entfernen.
  • Verfolge den Fortschritt und rufe Ergebnisse ab, ohne den Chat zu verlassen.

Unsere eigenen hochmodernen Modelle

Viele Audio-MCP-Server verwenden ältere Open-Source-Trennungsmodelle. Wir nutzen unsere eigenen Modelle – dieselben, die auch vocalremover.com zugrunde liegen – und fügen zusätzlich einen Restaurierungsschritt hinzu.

HQ Fusion

Unser Flaggschiff-Produkt fĂĽr klarere Gesangs- und Instrumentalstimmen in komplexen Mixes.

Multi-Stem HQ

Teilt einen Track in Gesangs-, Schlagzeug-, Bass-, Gitarren- und Klavier-Stems auf.

Stimmrestaurierung

Stellt die Klarheit und Detailtreue von bearbeiteten oder qualitativ minderwertigen Audioaufnahmen wieder her.

In 60 Sekunden anschlieĂźen

Am einfachsten geht es über eine Ein-Klick-Verbindung in ChatGPT oder Claude.ai – einfach anmelden und zustimmen, kein API-Schlüssel muss eingefügt werden.

Empfohlen

Verbindung zu ChatGPT oder Claude.ai herstellen

Einfach anmelden – nichts einfügen
  1. 1
    Connector-Einstellungen öffnen

    In ChatGPT: Einstellungen → Apps → Entwicklermodus aktivieren → App erstellen, dann die Server-URL in das Feld „Verbindung“ einfügen. In Claude.ai: Einstellungen → Konnektoren → Benutzerdefinierten Konnektor hinzufügen.

  2. 2
    FĂĽge die Server-URL ein

    Füge diese Adresse in das Feld „Connector-URL“ ein:

    https://vocalremover.com/mcp/audio
  3. 3
    Anmelden und genehmigen

    Du wirst zu VocalRemover weitergeleitet, um dich anzumelden und den Zugriff zu genehmigen – es muss nichts eingefügt werden.

  4. âś“
    Einfach fragen

    Gib „Entferne den Gesang aus diesem Titel“ ein, und dein Assistent ruft das Tool auf und gibt einen Download-Link zurück. Das war’s schon.

Erweitert: Verbindung mit einem API-Token herstellen

Für Claude Desktop, Cursor, Windsurf, Cline, Zed und Claude Code – füge den Server mit einem Bearer-API-Token hinzu.

Hol dir zunächst deinen API-Token

Erstelle dein VocalRemover-Konto, kopiere anschlieĂźend deinen API-Token von der API-Seite und fĂĽge ihn in die untenstehende Konfiguration ein.

API-Seite öffnen

Claude Desktop

Füge dies zur Datei „claude_desktop_config.json“ hinzu und starte Claude anschließend neu.

{
  "mcpServers": {
    "vocalremover": {
      "command": "npx",
      "args": [
        "-y", "mcp-remote", "https://vocalremover.com/mcp/audio",
        "--header", "Authorization:${AUTH}"
      ],
      "env": { "AUTH": "Bearer YOUR_API_TOKEN" }
    }
  }
}

Cursor · Windsurf · Cline · Zed

Native Remote-MCP – zur Datei „mcp.json“ des Clients hinzufügen.

{
  "mcpServers": {
    "vocalremover": {
      "url": "https://vocalremover.com/mcp/audio",
      "headers": {
        "Authorization": "Bearer YOUR_API_TOKEN"
      }
    }
  }
}

Claude-Code (CLI)

Ein Befehl – natives Remote-MCP, keine Bridge.

claude mcp add --transport http \
  vocalremover https://vocalremover.com/mcp/audio \
  -H "Authorization: Bearer YOUR_API_TOKEN"

Deine Audiodatei wird von der von dir angegebenen URL abgerufen, verarbeitet und anschließend gelöscht – es werden keine Daten gespeichert. Dein Zugriff ist auf dein Konto beschränkt und kann jederzeit widerrufen werden.

Benötigst du weitere Informationen? Lies die vollständige Dokumentation

Kostenloser Einstieg

Alltägliche Audio-Tools

Kostenlos

Konvertiere, schneide, extrahiere und bereinige Audio-Dateien nach Belieben – völlig kostenlos.

KI-Trennung

Kostenlos testen

Gesangsentfernung und Stem-Aufteilung in Studioqualität – direkt in deinem Assistenten.

In 60 Sekunden einrichten

Entwickelt fĂĽr

Karaoke & Begleitmusik

Verwandle jeden Song auf Knopfdruck in eine Instrumentalversion.

Podcast-Bereinigung

Entfernen von Hall und Rauschen aus Sprachaufnahmen in einem Schritt.

Musikproduktion

Lade saubere Stems zum Remixen und Sampling herunter.

Agenten-Pipelines

Ganze Ordner innerhalb eines einzigen Agent-Laufs stapelweise verarbeiten.

Häufig gestellte Fragen

Was ist ein MCP-Server fĂĽr Audio?

Ein MCP-Server (Model Context Protocol) ermöglicht es KI-Assistenten wie Claude oder Cursor, Audio-Tools als native Funktionen zu nutzen. Du gibst einfach „Entferne den Gesang aus diesem Titel“ ein, und der Assistent erledigt das – ohne App-Wechsel und ohne manuelles Hochladen.

Ist die Nutzung kostenlos?

Du kannst kostenlos loslegen. Viele Audio-Tools – Formatkonvertierung, Zuschneiden, Extrahieren von Audio aus Videos und vieles mehr – stehen kostenlos zur Verfügung, und du kannst die KI-Tools (Stimmenentfernung, Stem-Trennung, Rauschunterdrückung, Hallentfernung) selbst ausprobieren.

Mit welchen AI-Clients funktioniert es?

Claude Desktop, Claude Code, Cursor, Cline, Windsurf, Zed und die Anthropic Messages API verbinden sich direkt mit deinem Bearer-Token. Die gleiche Verarbeitung ist auch ĂĽber unsere REST-API verfĂĽgbar.

Kann ich es mit ChatGPT verwenden?

Ja. Öffne in ChatGPT „Einstellungen“ → „Apps“, aktiviere den Entwicklermodus, wähle „App erstellen“ und füge die Server-URL in das Feld „Verbindung“ ein; bei Claude.ai fügst du sie unter „Einstellungen“ → „Konnektoren“ hinzu. Du meldest dich bei VocalRemover an und genehmigst den Zugriff über OAuth – es muss kein Token eingefügt werden.

Ist dies der offizielle MCP-Standard?

Ja. Es basiert auf dem offenen Model Context Protocol und funktioniert daher in jedem kompatiblen Client – es handelt sich um einen Standard-Konnektor, nicht um ein proprietäres Plugin.

Was passiert mit meinen Dateien?

Deine Audiodatei wird verarbeitet und anschließend sofort gelöscht – wir speichern sie nicht, unabhängig davon, ob du einen Link übergibst oder sie direkt hochlädst. Dein Zugriff ist auf dein Konto beschränkt und kann jederzeit widerrufen werden.

Wie gut ist die Trennqualität?

Unsere KI-Trennung basiert auf unseren eigenen hochmodernen Modellen – HQ Fusion, Vocals HQ und Multi-stem HQ – und umfasst einen Vocal-Restoration-Durchlauf für zusätzliche Klarheit. Viele andere Audio-MCP-Server verwenden ältere Open-Source-Modelle.

Welche Audio- und Videoformate werden unterstĂĽtzt?

MP3-, WAV-, FLAC-, M4A-, OGG-, AAC- und OPUS-Audiodateien sowie gängige Videoformate (MP4, MKV, MOV, AVI) zur Audioextraktion. Übermittle Dateien als öffentlichen Link oder lade sie direkt hoch (Base64), jeweils bis zu 100 MB.

Kann ich es in automatisierten Agenten-Pipelines verwenden?

Ja – das ist ein hervorragender Anwendungsfall. MCP wurde für die Agenten-Orchestrierung entwickelt, sodass du Audioaufgaben über viele Dateien hinweg in einem einzigen Agentenlauf verketten kannst, zum Beispiel „Gesang aus jedem Titel in diesem Ordner extrahieren“.

Kann ich mit diesem MCP-Server Karaoke-Titel erstellen?

Ja. Bitte deinen Assistenten, „den Gesang zu entfernen“ oder „mir die Instrumentalversion zu geben“, und du erhältst eine karaoke-taugliche Begleitmusik. Du kannst dies für einen einzelnen Song tun oder einen ganzen Ordner in einem einzigen Durchlauf des Agenten bearbeiten.

Kann es Podcasts und Sprachaufnahmen bereinigen?

Ja. Die Tools zur Rauschunterdrückung und Hallentfernung entfernen Raumklang und Hintergrundgeräusche aus Sprachaufnahmen, was ideal für Podcaster, Sprecher und Transkriptionsprozesse ist.

Benötige ich einen API-Schlüssel?

Nicht für ChatGPT oder die Claude.ai-Web-App – dort fügst du den Server als benutzerdefinierten Konnektor hinzu und meldest dich mit OAuth an, sodass kein Schlüssel eingefügt werden muss. Für Clients wie Claude Desktop, Cursor oder Cline generierst du auf der API-Seite ein Token und fügst es als Bearer-Token hinzu.

Verleihe deinem KI-Assistenten Ohren

Verbinde den Server mit deinem KI-Assistenten und lass Claude, Cursor oder ChatGPT die Audiodateien fĂĽr dich bearbeiten.

In 60 Sekunden verbinden