OpenAI امروز از GPT-Live رونمایی کرد؛ نسل تازه ای از مدل های صوتی که قرار است تجربه صحبت با ChatGPT را به مکالمه ای نزدیک تر به گفت وگوی واقعی تبدیل کند. این سیستم عملا جایگزین تجربه صوتی فعلی ChatGPT می شود و تمرکز آن روی تعامل پیوسته و طبیعی است، نه صرفا پاسخ دادن به دستورات.
مکالمه ای که قطع نمی شود
برخلاف نسخه های قبلی، GPT-Live می تواند همزمان گوش بدهد و صحبت کند. این یعنی کاربر می تواند وسط حرف ChatGPT سوال بپرسد، مکث کند یا حتی مسیر گفتگو را تغییر دهد؛ بدون اینکه تعامل به شکل خشک و مرحله ای پیش برود. مدل جدید به طور پویا تصمیم می گیرد چه زمانی صحبت کند، چه زمانی گوش بدهد، مکث کند یا حتی حرف کاربر را قطع کند تا پاسخ دقیق تری بدهد.
یکی از جزئیاتی که OpenAI روی آن تاکید کرده، استفاده از نشانه های شنیداری طبیعی است؛ عباراتی مثل «mhmm» یا «got it» که نشان می دهد سیستم در حال دنبال کردن صحبت های شماست. همین نکته ساده، حس یک گفت وگوی واقعی را تقویت می کند؛ چیزی که در نسخه های قبلی کمتر دیده می شد.
پایه فنی: مدل های پیشرفته تر و پاسخ هوشمندتر
OpenAI می گوید GPT-Live هوشمندترین مدل صوتی این شرکت تا امروز است و از جدیدترین مدل مرزی (در حال حاضر GPT-5.5) برای کارهایی مثل جستجوی وب، تحلیل عمیق و انجام وظایف پیچیده استفاده می کند. نکته مهم اینجاست که حتی در حین انجام یک کار، مکالمه متوقف نمی شود؛ یعنی ChatGPT می تواند همزمان با شما صحبت کند و بعد از اتمام پردازش، نتیجه را ارائه دهد.
این رفتار چندوظیفه ای باعث می شود تجربه استفاده بیشتر شبیه تعامل با یک انسان باشد تا یک ابزار پاسخ گو. کاربر می تواند در حین انتظار، سوالات جدید بپرسد یا مسیر گفتگو را تغییر دهد.
قابلیت هایی فراتر از مکالمه ساده
GPT-Live فقط به گفت وگوی صوتی محدود نمی شود. OpenAI اعلام کرده این سیستم از ترجمه زنده هم پشتیبانی می کند و می تواند اطلاعات را در قالب کارت های بصری نمایش دهد؛ از وضعیت آب وهوا گرفته تا سهام و نتایج ورزشی. این یعنی خروجی صرفا متن یا صدا نیست و ترکیبی از اطلاعات قابل مشاهده هم در اختیار کاربر قرار می گیرد.
همچنین 9 صدای مختلف ChatGPT برای این نسل جدید بازطراحی شده اند تا طبیعی تر و روان تر به نظر برسند.
نحوه دسترسی و مدل های عرضه
OpenAI از امروز عرضه GPT-Live را برای کاربران ChatGPT در سراسر جهان آغاز کرده است. دو نسخه از این مدل ارائه شده:
- GPT-Live-1 به عنوان گزینه پیش فرض برای کاربران Go، Plus و Pro
- GPT-Live-1 mini به عنوان گزینه پیش فرض برای کاربران رایگان
برای استفاده از این قابلیت کافی است کاربران روی دکمه Voice در ChatGPT بزنند و مکالمه را شروع کنند.
قابلیت هایی که هنوز اضافه نشده اند
در حال حاضر GPT-Live از تعامل صوتی همراه با ویدیو یا اشتراک گذاری صفحه پشتیبانی نمی کند. با این حال OpenAI تایید کرده که روی اضافه کردن این قابلیت ها کار می کند و احتمالا در آینده نزدیک به ChatGPT اضافه خواهند شد.
با توجه به تغییراتی که GPT-Live معرفی می کند، مسیر حرکت ChatGPT به سمت یک دستیار مکالمه ای واقعی تر از همیشه مشخص تر شده؛ مدلی که نه فقط پاسخ می دهد، بلکه واقعا «گوش می دهد» و در جریان گفتگو باقی می ماند.
