Echtzeit-Sprachgespräche mit James — niedrigste Latenz, natürliche Unterbrechungen, native Audio-Qualität. OpenAI Realtime und Gemini Live im Hintergrund. Plus: Long-Press auf den Lautsprecher aktiviert Premium-Stimmen für jede geschriebene Antwort.
Verfügbar auf allen deinen Apple-Geräten — inkl. CarPlay
Sechs Verbesserungen gegenüber klassischer KI-Voice-Modi — die zusammen das „Telefonat"-Gefühl ergeben.
James antwortet quasi sofort. Keine merkbare Verzögerung zwischen deiner letzten Silbe und seinem ersten Ton — fühlt sich wie ein Telefonat.
Du kannst James jederzeit unterbrechen. Er stoppt sofort, hört zu und antwortet auf das Neue — wie in einem echten Gespräch.
James kann während des Sprechens googeln und Ergebnisse einweben. „Wie ist das Wetter morgen in Lissabon?" — er sucht im Hintergrund.
Justus klingt anders als Olivia, Mia anders als Pastor. Jeder der 12 Charaktere hat eine sorgfältig ausgewählte Premium-Stimme.
3 Schnauzer pro 10 Sekunden AI-Sprache. Stille, eigene Worte und View-offen-lassen kosten nichts.
Talk läuft auch auf Apple Watch und in CarPlay. Im Auto: reine Voice-Interaktion, Blick bleibt auf der Straße.
Wir haben jede Charakter-Persona mit einer passenden Premium-TTS-Stimme gepaart. Same Charakter — same voice, jedes Mal.

Warm, butler-haft, leicht britisch. Die Default-Stimme für allgemeine Themen — vertraut und ausgewogen.

Jung, business-direkt, kein Schnörkel. Für Markt-Briefings und Karriere-Themen.

Lebendig, Gen-Z, freundlich-frech. Die Stimme, die Trends so klingen lässt, wie sie sind.

Warm, mütterlich, beruhigend. Wenn du Empathie und Trost statt Optimierungs-Logik suchst.

Sachlich-präzise, mit Autorität. Klingt nach einem Arzt, dem du zuhörst, weil er weiß, was er tut.

Rau, rebellisch, unzensiert. Wenn der Querdenker-Tonfall passend rüberkommen soll.
Plus 6 weitere Charakter-Stimmen. Alle 12 Charaktere →
In jedem Chat, ohne Talk-Modus zu starten — natürliche Stimmen für jede geschriebene Antwort.
In jedem Chat (Standard, Multi-Chat, Research) bekommst du eine Antwort.
Neben jeder AI-Antwort findest du ein Lautsprecher-Symbol. Tap = iOS-Standard-Stimme. Long-Press = Premium-TTS.
OpenAI gpt-4o-mini-tts oder Gemini TTS, je nach Charakter. Default ist Gemini TTS für natürlichste Prosodie.
Einmal generierte Audio wird gecacht — beim zweiten Tap auf dieselbe Antwort kommt sie sofort, ohne Server-Roundtrip.
Sechs konkrete Situationen, in denen ein Tipp-freies Gespräch besser ist als Text.
Beim Kochen, beim Sport, im Auto — Talk läuft, James hört zu und antwortet sofort. Ideal für alles, was deine Hände gerade braucht.
Übe Englisch, Spanisch oder Französisch im Gespräch — Olivia oder Mia geben Korrekturen und Tipps in Echtzeit.
Mutter Agathe oder Pastor — Charaktere mit empathischem Tonfall — sind in Talk besonders stark, wenn du nur reden willst.
Im Interpreter-Modus übersetzt James simultan zwischen zwei Sprachen — perfekt für Reisen und internationale Meetings.
Statt Notizen zu tippen, sprichst du laut und James verarbeitet. Memories und wichtige Punkte landen automatisch im Profil.
Lass James eine Gute-Nacht-Geschichte erzählen — als Echtzeit-Talk oder als Premium-TTS-Vorlesen einer schon erstellten Story.
Alle gängigen — Deutsch, Englisch, Französisch, Spanisch, Italienisch, Portugiesisch, Russisch, Türkisch, Japanisch, Chinesisch, Hindi, Bulgarisch und mehr. Sowohl du als auch James können sprachübergreifend wechseln.
Bei 3 Schnauzer pro 10 Sek AI-Output → ca. 18 Schnauzer pro Minute, vorausgesetzt James spricht durchgehend. In der Praxis ist es deutlich weniger.
Eine Variante von Talk: zwei Sprachen gleichzeitig, James übersetzt simultan in beide Richtungen. Perfekt für Reisen oder mehrsprachige Meetings.
Aktuell ja. Long-Press auf Lautsprecher → Premium-TTS ohne Schnauzer-Verbrauch.
Nein, Talk braucht eine Online-Verbindung (Realtime-API). Roadmap V9.1 plant einen Offline-Modus für Text-Chats mit lokalem Modell.
Aktuell sind Charakter-Stimmen fest gemappt für Konsistenz. Eine eigene Voice-Auswahl pro Charakter ist auf der Roadmap.