Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

seekingalpha+1cnet+1reuters+1OpenAI hat am Mittwoch GPT-Live-1 und GPT-Live-1 mini veröffentlicht, ein Paar von Vollduplex-Sprachmodellen, die es ChatGPT ermöglichen, gleichzeitig zuzuhören und zu sprechen – eine Abkehr von den wechselseitigen Interaktionen, die bisherige KI-Sprachassistenten definierten. Die Modelle werden ab heute weltweit ausgerollt.cnet+1
Die neue GPT-Live-Architektur adressiert eine der häufigsten Frustrationen bei KI-Sprachassistenten: die Unfähigkeit, mit natürlicher Gesprächsüberschneidung umzugehen. Anstatt Nutzer in ein starres Frage-Antwort-Muster zu zwingen, kann GPT-Live-1 Unterbrechungen aufnehmen, kurze Bestätigungen geben und weiter sprechen, ohne den Kontext zu verlieren.openthemagazine+1
„GPT-Live kann weiterhin im Gespräch mit dem Nutzer bleiben“, sagte Kundan Kumar, Forschungsleiter für das GPT-Live-Modell, und beschrieb es als OpenAIs „intelligentestes Sprachmodell“ bisher. Kumar, ein Forscher für KI-Stimmen, der von Character.AI zu OpenAI kam, leitet die Entwicklung der Audiomodelle des Unternehmens seit Anfang 2026.siliconangle+2
Wenn GPT-Live-1 auf Anfragen stößt, die tieferes logisches Denken oder Echtzeitinformationen erfordern, leitet es diese automatisch zur Verarbeitung an die Textmodelle von OpenAI weiter, einschließlich Websuchfunktionen – alles unter Beibehaltung des Sprachgesprächs. Das verbesserte Modell ergänzt Diskussionen über Themen wie Wetter, Aktien und Sport zudem mit KI-generierten Grafiken, die relevante Informationen zeigen und die Lücke zwischen reiner Sprachinteraktion und multimodaler Interaktion schließen.theverge+2
Der Start von GPT-Live fällt in eine der arbeitsreichsten Wochen für KI in diesem Jahr. OpenAI bereitet sich zudem auf die öffentliche Veröffentlichung von GPT-5.6 Sol am Donnerstag vor, seinem fortschrittlichsten Textmodell, nachdem eine von der Regierung geforderte Verzögerung aufgehoben wurde. Meta hat diese Woche sein Muse-Bildgenerierungsmodell gestartet, und xAI bereitet Berichten zufolge ein neues Modell in Partnerschaft mit Anysphere vor, dem Unternehmen hinter dem Programmiertool Cursor.bloomberg+2
Die GPT-Live-Modelle stellen den Höhepunkt der verbraucherorientierten Arbeit dar, die mit OpenAIs entwicklerfokussiertem GPT-Realtime-2 im Mai begann, welches GPT-5-Klasse-Logik über API in Sprachinteraktionen brachte. Da Vollduplex-Audio nun die Hunderte Millionen Nutzer von ChatGPT erreicht, setzt OpenAI darauf, dass Sprache zu einer primären Schnittstelle für KI wird – nicht nur zu einem Komfortmerkmal.reuters+1