TORONTO / LONDON (IT BOLTWISE) – ElevenLabs liefert die KI-„Voice Layer“, die aus Text natürlich klingende Sprache macht. Im Interview nennt der CEO Mati Staniszewski eine aktuelle Größe von 600 Millionen US-Dollar jährlichen wiederkehrenden Umsätzen und verortet den Schwerpunkt bei über 55 % Enterprise-Kunden. Er erwartet dennoch, dass sich Audio-Modelle langfristig angleichen und zielt auf einen Turing-Test für konversationelle KI. Zudem plädiert er für Transparenz, wenn ein Kunde mit einem Agenten statt mit einem Menschen spricht.

ElevenLabs im Interview: Voice-KI zwischen Turing-Test und Enterprise-ARR
ElevenLabs im Interview: Voice-KI zwischen Turing-Test und Enterprise-ARR (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

ElevenLabs ist längst nicht mehr nur die Technologie hinter einzelnen Demo-Clips. Der Anbieter baut eine „Voice Layer“ für Künstliche Intelligenz, also Modelle, die Text in Sprache übersetzen, die für Hörerinnen und Hörer zunehmend menschlich wirkt. Viele Unternehmen nutzen die Lösung, ohne im Gespräch damit groß aufzutreten: Von Telefon-Hotlines im Kundenservice bis zu Sprachbausteinen in Plattformen und staatlichen Projekten entsteht die Praxis dorthin, wo heute schon Millionen Anrufe stattfinden. Genau an dieser Schwelle arbeitet ElevenLabs im Interview besonders konkret: Die Voice-Komponente soll nicht nur gut klingen, sondern in realen Dialogen verlässlich funktionieren, inklusive Tempo, Tonalität und dem Umgang mit Erwartungen des Gegenübers.

Die wirtschaftliche Einordnung fällt dabei in Zahlen aus dem Gespräch heraus: Laut CEO Mati Staniszewski liegt die Firma inzwischen bei 600 Millionen US-Dollar im Jahresumsatz auf wiederkehrender Basis. Mehr als 55 % davon ordnet er als „klassische Enterprise“-Nachfrage ein; der Rest entfällt vor allem auf kleinere und mittlere Unternehmen sowie auf Entwickler, die die Technologie in eigene Produkte integrieren. Damit wird auch klar, warum sich ElevenLabs stärker in Richtung Plattform- und Anwendungslogik bewegen muss: Wenn eine Stimme allein nicht reicht, braucht es ein zusammenhängendes Setup aus Modellauswahl, Wissensbasis, Zugriffskontrolle und Gesprächssteuerung. Der CEO beschreibt außerdem, dass sich die Architekturgrenzen in der Branche zunehmend verwischen: Modellanbieter werden zu Plattformanbietern, Plattformen zu Anwendungslandschaften.

Technisch zeigt sich dieser Wandel auch daran, wie ElevenLabs über „Reasoning“-Optionen entscheidet und welche Rolle verschiedene Modellklassen in Kundenprojekten spielen. Für reine Informationsdialoge, bei denen keine Aktionen ausgelöst werden, könne man stärker auf Open-Source-Modelle setzen, weil die Wissensbasis definiert, was eine gute Nutzererfahrung ausmacht. Sobald es jedoch um Finanzdienstleistungen geht, nennt Staniszewski Anforderungen wie Authentifizierung, Transaktionskontext und Vorgänge wie Rückerstattungen. Dann sei kein Platz für Fehler, und Frontier-Modelle führten aus seiner Sicht. Interessant ist dabei weniger die konkrete Modellwahl als die Logik dahinter: ElevenLabs behandelt die Auswahl nicht als Schwarz-Weiß-Entscheidung, sondern als risikogesteuerte Kombination aus Sprachqualität, Dialogfähigkeiten und Sicherheitsanforderungen.

Dass auch die Wahl zwischen Closed-Source, Open-Weight und selbst feinjustierten Varianten nicht nur eine technische, sondern auch eine regulatorische und operative Frage ist, führt der CEO anhand von Deployments aus. Er nennt dabei unterschiedliche Anforderungen etwa in Polen oder Brasilien und beschreibt, dass man je nach Use Case auch mit Datenresident-Constraints arbeiten muss. In Polen geht es laut seinen Angaben um ein Gesundheitszenario im öffentlichen System: Patientinnen und Patienten buchen Termine, 18 % erscheinen laut Beschreibung nicht. In der Umsetzung setzen sie auf Agenten, die anrufen oder Erinnerungen zustellen, wobei Modelle und Stimmen an die jeweilige Wissensumgebung optimiert werden und gleichzeitig die Datenhaltung angepasst bleibt. Solche Details zeigen, dass „Voice AI“ im Unternehmensalltag weniger eine einzelne Software-Komponente ist, sondern ein Betriebsmodell mit klaren Grenzen.

Auf der Produkt- und Ethikseite adressiert Staniszewski außerdem eine Frage, die viele Unternehmen noch zögern lässt: Soll Kundinnen und Kunden offenlegen werden, wenn sie mit einem KI-Agenten sprechen? Er sagt, es gebe aktuell gute Gründe für Transparenz, weil Menschen nicht das Gefühl haben wollen, „ausgebeutet“ oder getäuscht zu werden. Gleichzeitig skizziert er eine Verschiebung des Erwartungshorizonts: In einigen Jahren könnten viele Nutzerinnen und Nutzer eigene Agenten anrufen lassen und dann „erwarten“, mit einem Agenten zu interagieren. Bis dahin empfiehlt er, bei längeren Wartezeiten eine Wahl anzubieten, etwa zwischen menschlichem Support und Agentenlösung, wobei die Nutzer in der Praxis dann häufig überrascht seien, wie gut die Erfahrung sein kann.

Beim Blick auf Wettbewerb und Sicherheit ist im Gespräch zudem die Grenze zwischen Kunden und Konkurrenten sichtbar. ElevenLabs trifft laut Beschreibung auf Anbieter, die ihre Voice-Produktlinie zunächst auf ElevenLabs trainiert haben und heute eigene Abfragen mit eigenen Modellen laufen lassen. Gleichzeitig betont der CEO: Gerade in dieser Konstellation müssen sich „Agentenfähigkeiten“ und Bereitstellungslogiken sauber voneinander trennen. Er sagt, die eigene Technologie ermögliche es nicht, dass Agenten selbstständig weitere Agenten erzeugen (also keine self-replicating oder rekursive Teile der Intelligenz). Zudem erwähnt er KYC für Kunden und führt Cybersecurity als echtes Risiko an, dem man mit Vorsichtsmaßnahmen begegnen will. Für Unternehmen heißt das: Ein Voice- oder Agentenprojekt wird weniger zum Experimentierfeld, wenn die Betreiber klar definieren, welche Teile der Intelligenz innerhalb des eigenen Kontrollbereichs bleiben.

Auch das große strategische Ziel – und damit die Messlatte für die nächsten Jahre – stellt er prominent in den Raum. Staniszewski bewertet seine frühere Aussage, Audio-Modelle würden in wenigen Jahren „kommoditisiert“, als weiterhin nicht widerlegt: Es sei zwar schon viel Fortschritt erzielt worden, aber die Qualitätsdifferenz, die man allein auf Modell-Ebene erzielen kann, sei noch immer groß. Langfristig erwartet er jedoch eine Annäherung. Sein Schwerpunkt liegt deshalb auf einem anderen Test: Er will als Erstes in Richtung eines Turing-Tests für konversationelle KI gehen, also nicht nur Sprachklang, sondern auch emotionale Intelligenz, inklusive des Erkennens von Emotionen und der Fähigkeit, das Gespräch gezielt zu verlangsamen oder aufzunehmen. Für Firmen, die Voice AI einsetzen, verschiebt sich damit die Priorität: Nicht „nur“ akustische Natürlichkeit, sondern situative Dialogführung und verantwortbare Umsetzung.

Für die Marktdynamik ist das ein doppelter Impuls. Einerseits bedeutet die Kommerzialisierung auf Basis von Enterprise-ARR, dass die Anbieter stärker in Betrieb, Implementierung und Wertbeweis investieren müssen – und Staniszewski lässt erkennen, dass er Margen nicht als Selbstzweck sieht, solange der Kundennutzen wächst. Andererseits wird die kommende Differenzierung wahrscheinlich aus dem Zusammenspiel kommen: Welche Modelle sind in welchen Situationen zuverlässig, wie werden Wissensbasen integriert, und wie wird sichergestellt, dass Agentenfähigkeiten im Rahmen bleiben. Wenn sich diese Bausteine stabilisieren, wird Voice AI vom „Feature“ zu einer Kernschicht für Customer Experience und Branchenprozesse – genau dort, wo heute schon die ersten Millionen Gespräche laufen.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
1.501 Bewertungen
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
  • 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - ElevenLabs im Interview: Voice-KI zwischen Turing-Test und Enterprise-ARR - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "ElevenLabs im Interview: Voice-KI zwischen Turing-Test und Enterprise-ARR".
Stichwörter AI Artificial Intelligence Customer-service Cybersecurity Datenhaltung Enterprise Finanzdienstleistungen KI Konversation Künstliche Intelligenz Kyc Sprachmodell Stimme Text-to-Speech
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!

Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "ElevenLabs im Interview: Voice-KI zwischen Turing-Test und Enterprise-ARR" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "ElevenLabs im Interview: Voice-KI zwischen Turing-Test und Enterprise-ARR" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »ElevenLabs im Interview: Voice-KI zwischen Turing-Test und Enterprise-ARR« bei Google Deutschland suchen, bei Bing oder Google News!


    1.320 Leser gerade online auf IT BOLTWISE
    KI-Jobs