Thursday, July 9, 2026

OpenAI Unveils GPT-Live to Make ChatGPT Voice More Natural

OpenAI Unveils GPT-Live to Make ChatGPT Voice More Natural


OpenAI Unveils GPT-Live to Make ChatGPT Voice More Natural


OpenAI has officially launched GPT-Live, a next-generation voice model engineered to make conversations with ChatGPT feel significantly more human-like. 


Rolling out globally across iOS, Android, and web platforms, the technology introduces a full-duplex architecture. 


This allows the AI to listen and speak simultaneously, enabling users to interrupt mid-sentence, experience faster back-and-forth exchanges, and enjoy fluid dialogue that closely mimics real human interaction.


To support seamless conversations, GPT-Live can handle ongoing dialogue while delegating complex tasks to OpenAI's latest frontier model, GPT-5.5, in the background. 


This integration allows the AI to perform deeper reasoning and live web searches without pausing the conversation. 


To give users more control over their experience, ChatGPT Voice now features adjustable Instant, Medium, and High reasoning modes, letting individuals prioritize either rapid response times or deep analysis.


The global rollout introduces two distinct versions of the model: GPT-Live-1 and GPT-Live-1 mini. 


Premium subscribers on ChatGPT Go, Plus, and Pro tiers will automatically transition to GPT-Live-1 as their default voice model, while Free users will gain access to the streamlined GPT-Live-1 mini. 


OpenAI also announced plans to make these models available to developers through its API in the near future.


In addition to structural upgrades, OpenAI has remastered ChatGPT’s nine built-in voices to sound more expressive and responsive. 


The new system includes natural conversational cues, such as "mhmm" or "got it," and is designed to wait patiently during pauses while filtering out background noise to prevent accidental interruptions. 


Furthermore, the voice experience now supports interactive visual cards for real-time data like weather, stocks, and sports, alongside existing features like memory, image generation, and file uploads.


Addressing safety concerns, OpenAI has implemented strict, voice-specific safeguards and expanded risk testing to cover areas like emotional dependence, violence, and self-harm, alongside new parental controls for teenagers. 


The model is also hardcoded to prevent voice impersonation by restricting output to a predefined set of verified voices. 


While video and real-time screen sharing are not supported at launch, OpenAI confirmed these capabilities are actively under development alongside expanding multilingual support.



OpenAI ने ChatGPT वॉइस को और नेचुरल बनाने के लिए GPT-Live लॉन्च किया

OpenAI ने ऑफिशियली GPT-Live लॉन्च किया है, जो एक नेक्स्ट-जेनरेशन वॉइस मॉडल है जिसे ChatGPT के साथ बातचीत को काफी ज़्यादा इंसानी बनाने के लिए डिज़ाइन किया गया है।

iOS, Android और वेब प्लेटफॉर्म पर दुनिया भर में रोल आउट हो रही यह टेक्नोलॉजी एक फुल-डुप्लेक्स आर्किटेक्चर पेश करती है।

यह AI को एक साथ सुनने और बोलने की सुविधा देता है, जिससे यूज़र बीच में वाक्य को रोक सकते हैं, तेज़ी से आगे-पीछे बातचीत का अनुभव कर सकते हैं, और ऐसे आसान डायलॉग का आनंद ले सकते हैं जो असली इंसानी बातचीत की काफी नकल करते हैं।

बिना रुकावट वाली बातचीत को सपोर्ट करने के लिए, GPT-Live चल रहे डायलॉग को हैंडल कर सकता है, जबकि बैकग्राउंड में OpenAI के लेटेस्ट फ्रंटियर मॉडल, GPT-5.5 को मुश्किल काम सौंप सकता है।

यह इंटीग्रेशन AI को बातचीत को रोके बिना गहरी सोच और लाइव वेब सर्च करने की सुविधा देता है।

यूज़र को उनके अनुभव पर ज़्यादा कंट्रोल देने के लिए, ChatGPT वॉइस में अब एडजस्टेबल इंस्टेंट, मीडियम और हाई रीज़निंग मोड हैं, जिससे लोग तेज़ी से रिस्पॉन्स टाइम या डीप एनालिसिस को प्रायोरिटी दे सकते हैं।

 ग्लोबल रोलआउट में मॉडल के दो अलग-अलग वर्शन पेश किए गए हैं: GPT-Live-1 और GPT-Live-1 मिनी।

ChatGPT Go, Plus, और Pro टियर पर प्रीमियम सब्सक्राइबर अपने डिफ़ॉल्ट वॉइस मॉडल के तौर पर अपने आप GPT-Live-1 पर चले जाएंगे, जबकि फ्री यूज़र्स को आसान GPT-Live-1 मिनी का एक्सेस मिलेगा।

OpenAI ने यह भी बताया कि वह जल्द ही अपने API के ज़रिए इन मॉडल्स को डेवलपर्स के लिए उपलब्ध कराएगा।

स्ट्रक्चरल अपग्रेड के अलावा, OpenAI ने ChatGPT की नौ बिल्ट-इन वॉइस को ज़्यादा एक्सप्रेसिव और रिस्पॉन्सिव बनाने के लिए रीमास्टर किया है।

नए सिस्टम में "mhmm" या "got it" जैसे नैचुरल बातचीत के संकेत शामिल हैं, और इसे अचानक रुकावट को रोकने के लिए बैकग्राउंड नॉइज़ को फ़िल्टर करते हुए पॉज़ के दौरान सब्र से इंतज़ार करने के लिए डिज़ाइन किया गया है।

इसके अलावा, वॉइस एक्सपीरियंस अब मेमोरी, इमेज जेनरेशन और फ़ाइल अपलोड जैसे मौजूदा फ़ीचर्स के साथ-साथ मौसम, स्टॉक्स और स्पोर्ट्स जैसे रियल-टाइम डेटा के लिए इंटरैक्टिव विज़ुअल कार्ड्स को सपोर्ट करता है।

 सुरक्षा से जुड़ी चिंताओं को देखते हुए, OpenAI ने टीनएजर्स के लिए नए पेरेंटल कंट्रोल्स के साथ-साथ इमोशनल डिपेंडेंस, हिंसा और खुद को नुकसान पहुंचाने जैसे एरिया को कवर करने के लिए सख्त, आवाज़ के हिसाब से सुरक्षा उपाय लागू किए हैं और रिस्क टेस्टिंग को बढ़ाया है।

मॉडल को आवाज़ की नकल को रोकने के लिए भी हार्डकोड किया गया है, ताकि आउटपुट को वेरिफाइड आवाज़ों के पहले से तय सेट तक सीमित रखा जा सके।

हालांकि लॉन्च के समय वीडियो और रियल-टाइम स्क्रीन शेयरिंग सपोर्टेड नहीं हैं, OpenAI ने कन्फर्म किया है कि इन क्षमताओं पर एक्टिव रूप से डेवलपमेंट चल रहा है, साथ ही मल्टीलिंगुअल सपोर्ट भी बढ़ाया जा रहा है।

చాట్‌జీపీటీ వాయిస్‌ను మరింత సహజంగా మార్చేందుకు ఓపెన్‌ఏఐ జీపీటీ-లైవ్‌ను ఆవిష్కరించింది

చాట్‌జీపీటీతో సంభాషణలను మరింత మానవ-సహజంగా అనిపించేలా రూపొందించిన తదుపరి తరం వాయిస్ మోడల్ అయిన జీపీటీ-లైవ్‌ను ఓపెన్‌ఏఐ అధికారికంగా ప్రారంభించింది.

ఐఓఎస్, ఆండ్రాయిడ్, మరియు వెబ్ ప్లాట్‌ఫారమ్‌లలో ప్రపంచవ్యాప్తంగా అందుబాటులోకి వస్తున్న ఈ టెక్నాలజీ, ఫుల్-డ్యూప్లెక్స్ ఆర్కిటెక్చర్‌ను పరిచయం చేస్తుంది.

ఇది ఏఐ ఏకకాలంలో వినడానికి మరియు మాట్లాడటానికి అనుమతిస్తుంది. దీనివల్ల వినియోగదారులు వాక్యం మధ్యలో అంతరాయం కలిగించడం, వేగవంతమైన పరస్పర సంభాషణలను అనుభవించడం, మరియు నిజమైన మానవ పరస్పర చర్యను దగ్గరగా అనుకరించే నిరర్గళమైన సంభాషణను ఆస్వాదించడం సాధ్యమవుతుంది.

నిరంతరాయ సంభాషణలకు మద్దతుగా, జీపీటీ-లైవ్ కొనసాగుతున్న సంభాషణను నిర్వహిస్తూనే, నేపథ్యంలో క్లిష్టమైన పనులను ఓపెన్‌ఏఐ యొక్క సరికొత్త ఫ్రాంటియర్ మోడల్ అయిన జీపీటీ-5.5కు అప్పగించగలదు.

ఈ అనుసంధానం, సంభాషణకు అంతరాయం కలగకుండానే ఏఐ లోతైన తార్కిక విశ్లేషణ మరియు లైవ్ వెబ్ శోధనలు చేయడానికి అనుమతిస్తుంది.

వినియోగదారులకు వారి అనుభవంపై మరింత నియంత్రణను అందించడానికి, చాట్‌జీపీటీ వాయిస్‌లో ఇప్పుడు సర్దుబాటు చేయగల ఇన్‌స్టంట్, మీడియం, మరియు హై రీజనింగ్ మోడ్‌లు ఉన్నాయి. ఇవి వ్యక్తులు వేగవంతమైన ప్రతిస్పందన సమయాలకు లేదా లోతైన విశ్లేషణకు ప్రాధాన్యత ఇవ్వడానికి వీలు కల్పిస్తాయి.

 ప్రపంచవ్యాప్త విడుదల ఈ మోడల్ యొక్క రెండు విభిన్న వెర్షన్‌లను పరిచయం చేస్తోంది: GPT-Live-1 మరియు GPT-Live-1 మినీ.

ChatGPT Go, Plus, మరియు Pro శ్రేణులలోని ప్రీమియం సబ్‌స్క్రైబర్‌లు తమ డిఫాల్ట్ వాయిస్ మోడల్‌గా స్వయంచాలకంగా GPT-Live-1కి మారతారు, అయితే ఉచిత వినియోగదారులు సరళీకృత GPT-Live-1 మినీని పొందుతారు.

త్వరలో తన API ద్వారా ఈ మోడల్‌లను డెవలపర్‌లకు అందుబాటులోకి తీసుకురావాలనే ప్రణాళికలను కూడా OpenAI ప్రకటించింది.

నిర్మాణాత్మక అప్‌గ్రేడ్‌లతో పాటు, OpenAI ChatGPT యొక్క తొమ్మిది అంతర్నిర్మిత వాయిస్‌లను మరింత భావవ్యక్తీకరణతో మరియు ప్రతిస్పందనగా ఉండేలా రీమాస్టర్ చేసింది.

ఈ కొత్త సిస్టమ్‌లో "మ్మ్మ్" లేదా "గాట్ ఇట్" వంటి సహజమైన సంభాషణ సంకేతాలు ఉన్నాయి మరియు ఇది అనుకోని అంతరాయాలను నివారించడానికి నేపథ్య శబ్దాన్ని ఫిల్టర్ చేస్తూ, విరామ సమయంలో ఓపికగా వేచి ఉండేలా రూపొందించబడింది.

అంతేకాకుండా, మెమరీ, ఇమేజ్ జనరేషన్ మరియు ఫైల్ అప్‌లోడ్‌ల వంటి ఇప్పటికే ఉన్న ఫీచర్‌లతో పాటు, వాతావరణం, స్టాక్‌లు మరియు క్రీడల వంటి రియల్-టైమ్ డేటా కోసం ఇంటరాక్టివ్ విజువల్ కార్డ్‌లకు ఇప్పుడు ఈ వాయిస్ అనుభవం మద్దతు ఇస్తుంది.

 భద్రతాపరమైన ఆందోళనలను పరిష్కరిస్తూ, OpenAI కఠినమైన, స్వరానికి సంబంధించిన భద్రతా చర్యలను అమలు చేసింది. అలాగే, భావోద్వేగ ఆధారపడటం, హింస, మరియు స్వీయ-హాని వంటి అంశాలను కవర్ చేయడానికి రిస్క్ టెస్టింగ్‌ను విస్తరించింది. వీటితో పాటు, టీనేజర్ల కోసం కొత్త పేరంటల్ కంట్రోల్స్‌ను కూడా చేర్చింది.

ముందుగా నిర్వచించిన, ధృవీకరించబడిన స్వరాల సమితికి మాత్రమే అవుట్‌పుట్‌ను పరిమితం చేయడం ద్వారా, స్వరాల అనుకరణను నిరోధించడానికి ఈ మోడల్‌లో హార్డ్‌కోడ్ కూడా చేయబడింది.

ప్రారంభంలో వీడియో మరియు రియల్-టైమ్ స్క్రీన్ షేరింగ్‌కు మద్దతు లేనప్పటికీ, బహుభాషా మద్దతును విస్తరించడంతో పాటు ఈ సామర్థ్యాలు కూడా చురుకుగా అభివృద్ధిలో ఉన్నాయని OpenAI ధృవీకరించింది.

No comments:

Post a Comment

Please Dont Leave Me