Eleven v4 Turbo: Latenz, Preis und Grenzen im Überblick
Eleven v4 Turbo ist die Echtzeitvariante der Sprachmodelle, die ElevenLabs am 28. September 2026 zusammen mit Eleven v4 veröffentlicht hat. Sie ist für Sprachagenten gedacht und über API und ElevenAgents nutzbar. Fast alle Angaben zu Latenz, Preis und Funktionen stammen vom Hersteller; unabhängige Tests und Hörvergleiche für Deutsch fehlen bisher.
Von Heisenberg IT5 Min. Lesezeit

Das Wichtigste in Kürze
- Eleven v4 zielt auf produzierte Audioinhalte, v4 Turbo auf Echtzeit-Agenten; beide sind seit dem 28.09.2026 verfügbar.
- Die drei genannten Latenzwerte (~100 ms, ~150 ms, 81 ms) messen Verschiedenes und sind reine Herstellerangaben.
- Der API-Aktionspreis von $0,011 je 1.000 Zeichen für Turbo gilt laut Preisseite bis 12.10.2026; der Preis danach ist offen.
- Wie gut v4 Deutsch klingt, ist nicht belegt; ein eigener Test mit realen Texten ist nötig.
- Datenschutzoptionen wie Zero Retention und EU-Datenresidenz sind für v4 Turbo nicht ausdrücklich bestätigt.
Was ist neu bei Eleven v4 und v4 Turbo?
ElevenLabs hat am 28. September 2026 zwei Sprachmodelle veröffentlicht: Eleven v4 und Eleven v4 Turbo. Beide sind in ElevenAgents, ElevenCreative und über die API verfügbar [1].
Eleven v4 ist das Qualitätsmodell für produzierte Audioinhalte. Es unterstützt Audio-Tags wie [laughs] und Mehrsprecher-Dialog [2][3]. Eleven v4 Turbo ist die Echtzeitvariante für Agenten, mit bidirektionalem Streaming: Text geht hinein, Audio kommt heraus [2][3]. ElevenAgents ist die Plattform des Herstellers für Sprachagenten [4].
Stand: 30. September 2026.
Worin unterscheiden sich v4, v4 Turbo und v3?
Laut Hersteller unterstützt v4 mehr als 90 Sprachen und 10.000 Zeichen pro Anfrage. Der Vorgänger v3 kommt auf mehr als 70 Sprachen und 5.000 Zeichen [3]. Turbo setzt auf Streaming statt auf Ausdrucksvielfalt.
| Merkmal | v3 | v4 | v4 Turbo |
|---|---|---|---|
| Sprachen | 70+ | 90+ | 90+ (Stimmbibliothek laut Hersteller mit 17.500+ Stimmen) |
| Zeichenlimit | 5.000 | 10.000 | nicht angegeben |
| Audio-Tags | – | ja | nicht angegeben |
| Mehrsprecher-Dialog | – | ja | nicht angegeben |
| Streaming | – | – | bidirektional |
| Model-ID | – | eleven_v4 | eleven_v4_turbo |
Quellen: [2][4][3]. Das Zeichenlimit und den Mehrsprecher-Dialog bei Turbo nennt der Hersteller nicht. Prüfen Sie das vor der Planung in der Dokumentation.
Für v3 nennt die Dokumentation außerdem eine Variante „Conversational“ mit rund 280 ms Latenz [3]. Das Stimmklonen als Professional Voice Clone (PVC), also ein hochwertig trainierter Stimmklon, wurde bei v3 nicht unterstützt. Bei v4 ist es wieder möglich [2].
Wie schnell ist v4 Turbo wirklich?
Darauf gibt es keine belastbare Antwort, denn bisher liegen nur Herstellerangaben vor. Sie nennen drei Werte, die Verschiedenes messen:
- ~100 ms Inferenzlatenz (Median): reine Modelllaufzeit, ohne Anwendungs- und Netzwerklatenz [3].
- ~150 ms bis zur ersten Sprache (Median): Zeit von der Anfrage bis zur hörbaren Sprache [2].
- 81 ms im WebSocket-Streaming: Zeit bis zum Audio, dazu 61 ms Stille davor, gemessen im September 2026 [4].
Die Werte lassen sich daher nicht gegeneinander verrechnen. In einem Telefonagenten kommen Spracherkennung, Sprachmodell und Telefonnetz hinzu. Wie viel davon bei Ihnen ankommt, zeigt nur eine Messung in der eigenen Strecke.
Wie schneidet Turbo im Herstellervergleich ab?
ElevenLabs vergleicht die Zeit bis zur ersten Sprache mit anderen Anbietern [2]:
| Modell | Zeit bis zur ersten Sprache (Herstellerangabe) |
|---|---|
| Eleven v4 Turbo | 150 ms |
| Cartesia Sonic 3.6 | 262 ms |
| OpenAI GPT-4o mini TTS | 814 ms |
Der Test lief laut Hersteller mit identischen Skripten und Standardeinstellungen [2]. Die Produktseite für ElevenAgents nennt weitere Wettbewerber [4]. Ein Herstellertest ist jedoch kein unabhängiger Beleg. Die Wahl der Skripte und Einstellungen liegt beim Hersteller.
Wie gut spricht v4 Deutsch?
Belegt ist nur die Zahl der Sprachen: mehr als 90 [2]. Wie natürlich Deutsch klingt, ist nicht belegt. Auf der Produktseite für ElevenAgents ist eine deutsche Beispielstimme („Ava – German“) aufgeführt [4]. Hörvergleiche zu Betonung, Eigennamen, Dialekten oder Anglizismen liegen nicht vor.
Ein Test vor dem Einsatz ist deshalb nötig. Sinnvoll sind Texte aus dem echten Betrieb:
- Eigennamen, Straßen und Produktnamen aus Ihrem Alltag.
- Zahlen, Uhrzeiten, Datumsangaben und Beträge.
- Englische Begriffe mitten im deutschen Satz.
- Lange Sätze mit Nebensätzen.
Für schwierige Wörter bietet der Hersteller ein Aussprachewörterbuch auf Basis von IPA, der Lautschrift (Phoneme) [2]. Ob das bei v4 Turbo alle Fälle abdeckt, zeigt nur der Test.
Was kostet Eleven v4 Turbo?
In der API kostet v4 Turbo laut Preisseite $0,011 je 1.000 Zeichen (Stand: 30.09.2026); der durchgestrichene Vergleichspreis auf der Preisseite beträgt $0,04. Für v4 gelten $0,022, durchgestrichen steht dort $0,08. Das entspricht einem Rabatt von rund 72 %, befristet bis 12.10.2026. v3 kostet $0,08 [5].
| Modell | Aktionspreis je 1.000 Zeichen | Durchgestrichener Vergleichspreis |
|---|---|---|
| v4 | $0,022 | $0,08 |
| v4 Turbo | $0,011 | $0,04 |
| v3 | $0,08 | – |
Quelle: [5]. ElevenLabs nennt den Aktionspreis auf X als $22 bzw. $11 je eine Million Zeichen „für die nächsten zwei Wochen“ [6]. Der Vergleichspreis steht nur als durchgestrichener Preis auf der Preisseite [5]. Ob er nach dem 12.10.2026 gilt, ist nicht geklärt.
Pläne: Der kostenlose Plan enthält 10.000 Credits pro Monat. Bezahlpläne beginnen bei $6 pro Monat mit 30.000+ Credits und PVC. Enterprise gibt es nach Preisanfrage [2]. Für Agenten nennt die Produktseite im kostenlosen Plan 15 Minuten Anrufe, ab $6 pro Monat 75 Minuten und mehr [4]. Einen Minutenpreis für Agenten mit v4 Turbo gibt es nicht.
Wie nutzt man v4 Turbo und wechselt das Modell?
Das Modell wird per model_id gewählt: eleven_v4 oder eleven_v4_turbo [2][3]. Laut Hersteller ist Turbo über die API und in ElevenAgents verfügbar [2].
Wer bisher v3 nutzt, ändert im Kern den Modellwert. Prüfen Sie zusätzlich:
- Texte mit mehr als 5.000 Zeichen: Das Zeichenlimit von v4 beträgt 10.000 [3]. Für Turbo ist keines angegeben.
- Audio-Tags: Sie sind für v4 genannt, für Turbo nicht [2].
- Vortrag über lange Texte: Context bzw. Request Stitching sorgt für einen gleichbleibenden Vortrag [2].
Stimmklonen: Ein Klon entsteht aus zehn Sekunden Audio oder als PVC. PVC funktioniert laut Hersteller in v4 und v4 Turbo identisch [2].
Ist der Einsatz DSGVO-konform?
Das lässt sich pauschal nicht beantworten. Der Hersteller nennt auf Produktseiten SOC 2 Type II, HIPAA, PCI DSS L1 und GDPR, dazu einen Zero-Retention-Modus (keine Speicherung der Inhalte) und Datenresidenz in den USA, der EU und Indien [7]. Das sind Herstellerangaben, nicht geprüft. Die Dokumentation zur Datenresidenz ist älter und stammt nicht aus dem Launch [8]. Ob alle Optionen für v4 Turbo gelten, ist nicht belegt.
Wer Telefonagenten betreibt, sollte vor dem Produktivbetrieb klären:
- Welche Datenschutzoptionen gelten für das gewählte Modell und den gewählten Plan?
- Liegt eine Auftragsverarbeitung nach Art. 28 DSGVO vor, und passt sie zum Einsatz?
- In welcher Region werden Daten verarbeitet?
Lassen Sie das im Einzelfall prüfen. Dieser Artikel ist keine Rechtsberatung.
Muss ein Telefonagent als KI kenntlich sein?
Das ist eine Rechtsfrage, die dieser Artikel nicht bewertet. Prüfen Sie dazu insbesondere Art. 50 der KI-Verordnung, der Transparenzpflichten regelt. Bei geklonten Stimmen kommt die Einwilligung der betroffenen Person hinzu. Holen Sie dazu eine rechtliche Einschätzung ein. Dieser Artikel ist keine Rechtsberatung.
Grenzen: Was ist noch ungeklärt?
Fast alle Zahlen stammen vom Hersteller. Offen sind:
- Latenz: Es gibt keine unabhängigen Messungen, auch nicht in realen Telefonstrecken [2][4].
- Deutsch: Die Qualität ist nicht belegt.
- Preis: Der Preis nach dem 12.10.2026 und der Minutenpreis in ElevenAgents sind nicht geklärt [5].
- Datenschutz: Die Gültigkeit von Zero Retention und EU-Datenresidenz für Turbo ist nicht bestätigt [7][8].
- Funktionen: Zeichenlimit und Mehrsprecher-Dialog bei Turbo sind nicht angegeben.
Wann sich Turbo nicht lohnt: wenn Sie vor allem produzierte, ausdrucksstarke Audioinhalte brauchen. Dafür ist laut Hersteller v4 mit Audio-Tags und Mehrsprecher-Dialog gedacht [2][3]. Auch wenn Sie ohne Test und ohne geklärten Datenschutz in den Betrieb gehen wollen, sollten Sie warten.
Fazit: Für wen lohnt sich der Test?
Wer Sprachagenten baut, kann Turbo solange der Aktionspreis gilt mit eigenem deutschem Skript und in der realen Telefonstrecke testen [2][4][5]. Preis, Datenschutz und Kennzeichnung sollten vor dem Produktivbetrieb geklärt sein. Für produzierte Audioinhalte ist v4 das passendere Modell.
Häufige Fragen
Kann ich v4 Turbo auch außerhalb von ElevenAgents nutzen?
Laut Hersteller ist Eleven v4 Turbo neben ElevenAgents auch über die API verfügbar [2]. Das Modell wählen Sie per model_id. Ob Zeichenlimit und Funktionsumfang bei Turbo von denen bei v4 abweichen, nennt der Hersteller nicht. Prüfen Sie das in der Dokumentation, bevor Sie planen.
Funktioniert Stimmklonen mit v4 Turbo?
Ja, laut Hersteller funktioniert Stimmklonen mit v4 Turbo. Ein Klon entsteht aus zehn Sekunden Audio oder als Professional Voice Clone (PVC), und PVC arbeitet in v4 und Turbo identisch [2]. Bei v3 war PVC nicht unterstützt. Zur Einwilligung der betroffenen Person sollten Sie vorab rechtlichen Rat einholen.
Gilt der Rabatt auch für Abos oder nur für die API?
Der Rabatt von rund 72 % ist für die API belegt, bis 12.10.2026 [5]. Für Pläne wird eine Credit-Aktion genannt, aber widersprüchlich: Die Produktseiten sprechen von 3x Credits bei Creator+ [2][4], die Ankündigung auf X von bis zu 2x Credits in ElevenCreative [6]. Prüfen Sie die Bedingungen direkt vor dem Abschluss.
Was passiert nach dem 12.10.2026 mit den Preisen?
Das ist nicht geklärt. Die Preisseite zeigt $0,08 für v4 und $0,04 für v4 Turbo je 1.000 Zeichen nur als durchgestrichene Vergleichspreise [5]. Ob diese Werte ab 13.10.2026 gelten, steht dort nicht. Auch der Minutenpreis in ElevenAgents ist offen. Planen Sie Kosten daher vorsichtig und prüfen Sie die Preisseite erneut.
Gibt es EU-Datenresidenz und Zero Retention für v4 Turbo?
Der Hersteller nennt Zero Retention und Datenresidenz in der EU, den USA und Indien für Unternehmenskunden [7][8]. Ob diese Optionen für v4 Turbo gelten, ist nicht belegt, und die Dokumentation zur Datenresidenz stammt nicht aus dem Launch. Lassen Sie sich das vor dem Einsatz schriftlich bestätigen und die Auftragsverarbeitung nach Art. 28 DSGVO prüfen.
Welche Model-ID brauche ich für v4 Turbo?
Die Model-ID lautet eleven_v4_turbo [3]. Für das Qualitätsmodell Eleven v4 verwenden Sie eleven_v4. Das Modell wechseln Sie über den Parameter model_id [2]. Wer von v3 umsteigt, sollte danach Zeichenlimit, Audio-Tags und Aussprache mit eigenen deutschen Texten prüfen, bevor er produktiv geht.
Quellen
- ElevenLabs Launches Eleven V4 With Low-Latency Turbo Variant, Unite.AI
- Eleven v4 and Eleven v4 Turbo Text to Speech models, ElevenLabs
- Models, ElevenLabs
- Eleven v4 Turbo in ElevenAgents | Fast, Expressive Agents, ElevenLabs
- ElevenAPI Pricing for creators and businesses of all sizes, ElevenLabs
- ElevenLabs on X: „For the next two weeks, we're making it even easier to try out Eleven v4 and Eleven v4 Turbo…“, ElevenLabs
- AI Agent Builder - Voice-First Platform for Developers, ElevenLabs
- Data residency, ElevenLabs
Artikel teilen
Mit KI-Unterstützung recherchiert und geschrieben, fachlich geprüft von Hannes Ftuni am 1. Oktober 2026. Herausgeber: Heisenberg IT GmbH, Bochum.


