Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

seekingalpha+1cnet+1reuters+1OpenAI släppte på onsdagen GPT-Live-1 och GPT-Live-1 mini, ett par full-duplex röstmodeller som gör att ChatGPT kan lyssna och tala samtidigt – ett avsteg från de turordningsbaserade interaktioner som definierat AI-röstassistenter. Modellerna rullas ut globalt från och med idag.cnet+1
Den nya GPT-Live-arkitekturen adresserar en av de vanligaste frustrationerna med röst-AI: oförmågan att hantera naturlig överlappning i samtal. Istället för att tvinga användare in i ett stelt mönster av frågor och svar, kan GPT-Live-1 hantera avbrott, ge korta bekräftelser och fortsätta tala utan att tappa sammanhanget.openthemagazine+1
"GPT-Live kan fortfarande förbli i samtal med användaren", sade Kundan Kumar, forskningsledare för GPT-Live-modellen, och beskrev den som OpenAI:s "smartaste röstmodell" hittills. Kumar, en forskare inom röst-AI som började på OpenAI från Character.AI, har lett företagets utveckling av ljudmodeller sedan början av 2026.siliconangle+2
När GPT-Live-1 möter frågor som kräver djupare resonemang eller information i realtid, dirigerar den automatiskt dessa till OpenAI:s textmodeller för bearbetning, inklusive webbsökningsfunktioner – allt medan röstkonversationen bibehålls. Den uppgraderade modellen kompletterar även diskussioner om ämnen som väder, aktier och sport med AI-genererade visuella element som visar relevant information, vilket överbryggar klyftan mellan röst-endast och multimodal interaktion.theverge+2
GPT-Live-lanseringen sker under en av de mest intensiva veckorna för AI i år. OpenAI förbereder sig även på att offentligt lansera GPT-5.6 Sol på torsdagen, deras mest avancerade textmodell, efter att en regeringsbegärd fördröjning hävts. Meta lanserade sin Muse-bildgenereringsmodell denna vecka, och xAI uppges förbereda en ny modell i samarbete med Anysphere, företaget bakom kodningsverktyget Cursor.bloomberg+2
GPT-Live-modellerna representerar kulmen på det konsumentinriktade arbete som inleddes med OpenAI:s utvecklarfokuserade GPT-Realtime-2 i maj, som förde GPT-5-klass resonemang till röstinteraktioner via API. Med full-duplex ljud som nu når hundratals miljoner ChatGPT-användare, satsar OpenAI på att rösten kommer att bli ett primärt gränssnitt för AI – inte bara en bekvämlighetsfunktion.reuters+1