همانطور که TechCrunch گزارش داد، OpenAI ویژگی‌های عاملی مبتنی بر صدا را به برنامه تلفن همراه ChatGPT می‌آورد و به کاربران اجازه می‌دهد کار واقعی - تهیه پیش‌نویس اسناد، خلاصه کردن ایمیل‌ها، ساختن ارائه‌ها - را به سادگی با صحبت کردن آغاز کنند.

این راه‌اندازی به قابلیت‌های گوشی‌های هوشمندی که OpenAI قبلاً بر روی دسک‌تاپ ارائه می‌کرد، گسترش می‌یابد، و زمانی که صدا به یکی از سریع‌ترین راه‌های تعامل کاربران با دستیارهای هوش مصنوعی برای کارهای پیچیده تبدیل می‌شود، ارائه می‌شود.

کارهایی که مشترکین می توانند با صدا انجام دهند

مشترکین Plus و Pro می‌توانند از تب Work در برنامه تلفن همراه ChatGPT برای ایجاد اسناد، پیش‌نویس ایمیل‌ها یا خلاصه کردن پیام‌های Slack به صورت صوتی استفاده کنند. همین گردش کار صوتی، کارهای سنگین‌تری را که تب Work قبلاً پشتیبانی می‌کند، پوشش می‌دهد، مانند ساخت سایت‌ها، ایجاد ارائه، استفاده از مرورگر ابری، و حفاری در بخش مالی ChatGPT.

کاربران Free and Go بخش محدودتری از به‌روزرسانی را دریافت می‌کنند و توانایی کار با افزونه‌ها و برنامه‌های متصل را به دست می‌آورند.

OpenAI گفت مکالمات صوتی اکنون خروجی متن غنی تری تولید می کند و کاربران می توانند به راحتی بین حالت های صوتی و متنی حرکت کنند. شاید کاربردی ترین افزودنی برای افرادی که در رفت و آمدها و دسکتاپ ها دستکاری می کنند: مکالمه ای که در حال حرکت شروع شده است را می توان بعداً در برنامه دسکتاپ از سر گرفت.

جاده از GPT-Live به نمایندگان تلفن همراه

این به‌روزرسانی فصل موبایل داستانی است که OpenAI در ماه جولای آغاز شد، زمانی که GPT-Live، مدل مکالمه جدید خود را راه‌اندازی کرد و بعداً آن را به برنامه دسکتاپ متصل کرد تا کاربران بتوانند وظایف برگه Work را تکمیل کنند و برنامه‌ها را در تب Codex به صورت صوتی بسازند. اعلامیه روز چهارشنبه با آوردن همان اجرای کار مبتنی بر صدا در تلفن ها، حلقه را می بندد.

چرا عوامل صوتی در تلفن همراه مهم هستند

این تغییر نشان دهنده چگونگی تغییر الگوهای استفاده است. کاربران بیشتری برای صدور فرمان به دستیاران هوش مصنوعی برای کارهای پیچیده به صدا روی می آورند، و تلفن جایی است که این دستورات به طور طبیعی اتفاق می افتد - بین جلسات، در ماشین یا دور از صفحه کلید.

تا به حال، قدرتمندترین ویژگی های عامل در ChatGPT روی دسکتاپ وجود داشت. کاربرانی که می‌خواستند ChatGPT یک ارائه بسازد یا یک کار تحقیقاتی چند مرحله‌ای را اجرا کند، باید در رایانه خود باشند و دستورالعمل‌ها را در برگه Work تایپ کنند. اپلیکیشن موبایل، با همه محبوبیتش، تا حد زیادی یک سطح مکالمه بود. به‌روزرسانی روز چهارشنبه این تمایز را از بین می‌برد: تلفن با کانال صوتی به عنوان رابط، مکانی قانونی برای شروع کار اساسی می‌شود.

تقسیم اشتراک

این عرضه همچنین خطوط بین لایه های اشتراک ChatGPT را تشدید می کند. مشترکین Plus و Pro - طرح‌هایی که در حال حاضر دارای بالاترین محدودیت‌های استفاده و دسترسی به توانمندترین مدل‌های OpenAI هستند - از تجربه کامل زبانه Work مبتنی بر صدا، از جمله ایجاد سند، تهیه پیش‌نویس ایمیل و خلاصه‌سازی Slack برخوردار می‌شوند. آنها همچنین می توانند سایت بسازند، ارائه ها ایجاد کنند، از مرورگر ابری استفاده کنند و به بخش مالی ChatGPT دسترسی داشته باشند، همه به صورت صوتی.

کاربران Free and Go مجموعه محدودتری از قابلیت‌ها را با محوریت افزونه‌ها و برنامه‌های متصل دریافت می‌کنند. این ردیف‌بندی از یک الگوی آشنا برای OpenAI پیروی می‌کند: یک قابلیت را در دسک‌تاپ اثبات کنید، سپس نسخه موبایلی را بیاورید که با ارزش‌ترین ویژگی‌های آن، کاربران را به سمت برنامه‌های پولی سوق می‌دهد. برای OpenAI، این حرکت در زمانی که رقبا به شدت با همان کاربران تماس می گیرند، خندق را در اطراف سطوح پرداختی خود عمیق تر می کند.

چگونه با رویکرد آنتروپیک مقایسه می شود

پس زمینه رقابتی در اینجا اهمیت دارد. TechCrunch اشاره می‌کند که Anthropic اخیراً ارتباط بین موبایل و دسکتاپ را برای کاربران خود آسان‌تر کرده و رابط‌های Cowork و Chat خود را در یک تجربه ادغام کرده است. در مقابل، OpenAI همچنان چت و فضاهای کاری را از هم جدا نگه می‌دارد - یک تقسیم محصول عمدی که مکالمات معمولی را از فضای کاری که فایل‌ها، پروژه‌ها و ابزارها در آن زندگی می‌کنند متمایز می‌کند.

این دو شرکت به طور موثر آزمایش‌های متضادی را در طراحی گردش کار با دستیار هوش مصنوعی انجام می‌دهند. رابط ادغام شده Anthropic شرط بندی می کند که کاربران یک سطح واحد می خواهند که آنها را در سراسر دستگاه ها دنبال کند. شرط OpenAI این است که چت و فضاهای کاری ساختاریافته نیازهای مختلفی را برآورده می کنند و باید متمایز بمانند و صدا به عنوان بافت همبند عمل می کند - کار را با صحبت کردن در تلفن همراه شروع کنید، آن را با صفحه کلید روی دسکتاپ اصلاح کنید.

بعدی چه چیزی را تماشا کنیم

سوال واضح بعدی این است که عوامل صوتی از تب Work چقدر فاصله دارند. ادغام دسکتاپ OpenAI در حال حاضر به Codex، ابزار ساخت برنامه آن رسیده است و برابری تلفن همراه در آنجا تلفن ها را به سطوح توسعه کامل تبدیل می کند. OpenAI زمان بندی آن را اعلام نکرده است.

همچنین قابلیت اطمینان حل نشده است. وظایف صوتی نماینده - تهیه پیش نویس، خلاصه کردن، مرور - شامل اجرای چند مرحله ای است که در آن خطاها ترکیب می شوند و محیط های تلفن همراه وقفه و تغییر متن را اضافه می کنند. تجربه اولیه کاربر تعیین می کند که آیا کار مبتنی بر صدا به یک عادت روزانه تبدیل می شود یا یک ویژگی دموپسند باقی می ماند.

در هر صورت، مسیر سفر مشخص است: دستیار که دو سال پیش به صورت صوتی به سؤالات پاسخ می داد، اکنون انتظار می رود قبل از رسیدن به میز کار، کار را تمام کند. با به‌روزرسانی روز چهارشنبه، کاربران تلفن همراه OpenAI می‌توانند این کار را با یک جمله شروع کنند - و وقتی وارد شدند آن را روی یک صفحه بزرگتر انتخاب کنند.

---

از هوش مصنوعی جلوتر بمانید

آخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.

بیشتر بخوانید اخبار هوش مصنوعی →