همانطور که TechCrunch گزارش داد، OpenAI ویژگیهای عاملی مبتنی بر صدا را به برنامه تلفن همراه ChatGPT میآورد و به کاربران اجازه میدهد کار واقعی - تهیه پیشنویس اسناد، خلاصه کردن ایمیلها، ساختن ارائهها - را به سادگی با صحبت کردن آغاز کنند.
این راهاندازی به قابلیتهای گوشیهای هوشمندی که OpenAI قبلاً بر روی دسکتاپ ارائه میکرد، گسترش مییابد، و زمانی که صدا به یکی از سریعترین راههای تعامل کاربران با دستیارهای هوش مصنوعی برای کارهای پیچیده تبدیل میشود، ارائه میشود.
کارهایی که مشترکین می توانند با صدا انجام دهند
مشترکین Plus و Pro میتوانند از تب Work در برنامه تلفن همراه ChatGPT برای ایجاد اسناد، پیشنویس ایمیلها یا خلاصه کردن پیامهای Slack به صورت صوتی استفاده کنند. همین گردش کار صوتی، کارهای سنگینتری را که تب Work قبلاً پشتیبانی میکند، پوشش میدهد، مانند ساخت سایتها، ایجاد ارائه، استفاده از مرورگر ابری، و حفاری در بخش مالی ChatGPT.
کاربران Free and Go بخش محدودتری از بهروزرسانی را دریافت میکنند و توانایی کار با افزونهها و برنامههای متصل را به دست میآورند.
OpenAI گفت مکالمات صوتی اکنون خروجی متن غنی تری تولید می کند و کاربران می توانند به راحتی بین حالت های صوتی و متنی حرکت کنند. شاید کاربردی ترین افزودنی برای افرادی که در رفت و آمدها و دسکتاپ ها دستکاری می کنند: مکالمه ای که در حال حرکت شروع شده است را می توان بعداً در برنامه دسکتاپ از سر گرفت.
جاده از GPT-Live به نمایندگان تلفن همراه
این بهروزرسانی فصل موبایل داستانی است که OpenAI در ماه جولای آغاز شد، زمانی که GPT-Live، مدل مکالمه جدید خود را راهاندازی کرد و بعداً آن را به برنامه دسکتاپ متصل کرد تا کاربران بتوانند وظایف برگه Work را تکمیل کنند و برنامهها را در تب Codex به صورت صوتی بسازند. اعلامیه روز چهارشنبه با آوردن همان اجرای کار مبتنی بر صدا در تلفن ها، حلقه را می بندد.
چرا عوامل صوتی در تلفن همراه مهم هستند
این تغییر نشان دهنده چگونگی تغییر الگوهای استفاده است. کاربران بیشتری برای صدور فرمان به دستیاران هوش مصنوعی برای کارهای پیچیده به صدا روی می آورند، و تلفن جایی است که این دستورات به طور طبیعی اتفاق می افتد - بین جلسات، در ماشین یا دور از صفحه کلید.
تا به حال، قدرتمندترین ویژگی های عامل در ChatGPT روی دسکتاپ وجود داشت. کاربرانی که میخواستند ChatGPT یک ارائه بسازد یا یک کار تحقیقاتی چند مرحلهای را اجرا کند، باید در رایانه خود باشند و دستورالعملها را در برگه Work تایپ کنند. اپلیکیشن موبایل، با همه محبوبیتش، تا حد زیادی یک سطح مکالمه بود. بهروزرسانی روز چهارشنبه این تمایز را از بین میبرد: تلفن با کانال صوتی به عنوان رابط، مکانی قانونی برای شروع کار اساسی میشود.
تقسیم اشتراک
این عرضه همچنین خطوط بین لایه های اشتراک ChatGPT را تشدید می کند. مشترکین Plus و Pro - طرحهایی که در حال حاضر دارای بالاترین محدودیتهای استفاده و دسترسی به توانمندترین مدلهای OpenAI هستند - از تجربه کامل زبانه Work مبتنی بر صدا، از جمله ایجاد سند، تهیه پیشنویس ایمیل و خلاصهسازی Slack برخوردار میشوند. آنها همچنین می توانند سایت بسازند، ارائه ها ایجاد کنند، از مرورگر ابری استفاده کنند و به بخش مالی ChatGPT دسترسی داشته باشند، همه به صورت صوتی.
کاربران Free and Go مجموعه محدودتری از قابلیتها را با محوریت افزونهها و برنامههای متصل دریافت میکنند. این ردیفبندی از یک الگوی آشنا برای OpenAI پیروی میکند: یک قابلیت را در دسکتاپ اثبات کنید، سپس نسخه موبایلی را بیاورید که با ارزشترین ویژگیهای آن، کاربران را به سمت برنامههای پولی سوق میدهد. برای OpenAI، این حرکت در زمانی که رقبا به شدت با همان کاربران تماس می گیرند، خندق را در اطراف سطوح پرداختی خود عمیق تر می کند.
چگونه با رویکرد آنتروپیک مقایسه می شود
پس زمینه رقابتی در اینجا اهمیت دارد. TechCrunch اشاره میکند که Anthropic اخیراً ارتباط بین موبایل و دسکتاپ را برای کاربران خود آسانتر کرده و رابطهای Cowork و Chat خود را در یک تجربه ادغام کرده است. در مقابل، OpenAI همچنان چت و فضاهای کاری را از هم جدا نگه میدارد - یک تقسیم محصول عمدی که مکالمات معمولی را از فضای کاری که فایلها، پروژهها و ابزارها در آن زندگی میکنند متمایز میکند.
این دو شرکت به طور موثر آزمایشهای متضادی را در طراحی گردش کار با دستیار هوش مصنوعی انجام میدهند. رابط ادغام شده Anthropic شرط بندی می کند که کاربران یک سطح واحد می خواهند که آنها را در سراسر دستگاه ها دنبال کند. شرط OpenAI این است که چت و فضاهای کاری ساختاریافته نیازهای مختلفی را برآورده می کنند و باید متمایز بمانند و صدا به عنوان بافت همبند عمل می کند - کار را با صحبت کردن در تلفن همراه شروع کنید، آن را با صفحه کلید روی دسکتاپ اصلاح کنید.
بعدی چه چیزی را تماشا کنیم
سوال واضح بعدی این است که عوامل صوتی از تب Work چقدر فاصله دارند. ادغام دسکتاپ OpenAI در حال حاضر به Codex، ابزار ساخت برنامه آن رسیده است و برابری تلفن همراه در آنجا تلفن ها را به سطوح توسعه کامل تبدیل می کند. OpenAI زمان بندی آن را اعلام نکرده است.
همچنین قابلیت اطمینان حل نشده است. وظایف صوتی نماینده - تهیه پیش نویس، خلاصه کردن، مرور - شامل اجرای چند مرحله ای است که در آن خطاها ترکیب می شوند و محیط های تلفن همراه وقفه و تغییر متن را اضافه می کنند. تجربه اولیه کاربر تعیین می کند که آیا کار مبتنی بر صدا به یک عادت روزانه تبدیل می شود یا یک ویژگی دموپسند باقی می ماند.
در هر صورت، مسیر سفر مشخص است: دستیار که دو سال پیش به صورت صوتی به سؤالات پاسخ می داد، اکنون انتظار می رود قبل از رسیدن به میز کار، کار را تمام کند. با بهروزرسانی روز چهارشنبه، کاربران تلفن همراه OpenAI میتوانند این کار را با یک جمله شروع کنند - و وقتی وارد شدند آن را روی یک صفحه بزرگتر انتخاب کنند.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →