مرگ رابط کاربری: چشم‌انداز گرگ براکمن برای آینده‌ای نامرئی از هوش مصنوعی

گرگ براکمن، از بنیان‌گذاران OpenAI، معتقد است که ما در حال نزدیک شدن به عصری هستیم که یادگیری کار با نرم‌افزارها منسوخ خواهد شد. به‌جای پیمایش در منوها و دکمه‌های پیچیده، کاربران با یک «لایه نامرئی» از هوش تعامل خواهند داشت که وظایف را به‌صورت خودکار انجام می‌دهد.

فراتر رفتن از شکست پلاگین‌ها

مسیر رسیدن به ادغام بی‌وقفه هوش مصنوعی بدون چالش نبوده است. براکمن اخیراً درباره شکست قابلیت «Plugins» شرکت OpenAI که در سال ۲۰۲۳ عرضه شد، صحبت کرد؛ قابلیتی که هدف آن متصل کردن ChatGPT به سرویس‌های شخص ثالث مانند Gmail و جستجوی وب بود. با وجود تبلیغات گسترده، این ابتکار نتوانست جایگاه قابل توجهی پیدا کند. براکمن این شکست را مستقیماً به فناوری زیربنایی نسبت داد و اظهار داشت که مدل‌های هوش مصنوعی در آن زمان به‌سادگی توانایی کافی برای مدیریت هماهنگی‌های پیچیده مورد نیاز برای عملکرد قابل اعتماد پلاگین‌ها را نداشتند.

گذار از اپلیکیشن‌ها به عامل‌های خودگردان

چشم‌انداز بلندمدت براکمن تفاوت چشمگیری با روند فعلی «تورم ویژگی‌ها» (feature bloating) دارد؛ روندی که در آن اپلیکیشن‌های نرم‌افزاری مدام دکمه‌ها و ابزارهای بیشتری را برای حفظ رقابت‌پذیری خود اضافه می‌کنند. او استدلال می‌کند که هدف نهایی، «تقریباً بدون رابط کاربری» و «بدون محصول» بودن است.

در این آینده، تجربه کاربری به‌جای یک اپلیکیشن سنتی، توسط یک عامل (agent) مداوم و آگاه به متن (context-aware) تعریف می‌شود. به‌جای اینکه انسان یاد بگیرد چگونه برای انجام یک کار در یک نرم‌افزار خاص پیمایش کند، هوش مصنوعی به‌عنوان یک میانجی دیجیتال عمل می‌کند، قصد کاربر را درک می‌کند و جریان‌های کاری لازم را در پس‌زمینه و در سیستم‌های مختلف اجرا می‌کند. این نشان‌دهنده گذار از «هوش مصنوعی به‌عنوان یک ابزار» به «هوش مصنوعی به‌عنوان یک عامل» است.

شکاف میان چشم‌انداز و واقعیت

اگرچه چشم‌انداز یک رابط کاربری نامرئی جذاب است، اما موانع فنی قابل توجهی همچنان باقی است. قابلیت‌های فعلی هوش مصنوعی اغلب برای دستیابی به حتی سطح متوسطی از قابلیت اطمینان، نیازمند مهندسی پرامپت (prompt engineering) سنگین و ادغام‌های سفارشی هستند. توسعه ابزارهایی مانند Codex توسط خود OpenAI — که به‌طور خاص برای کدنویسی طراحی شده است — یادآور این نکته است که ما هنوز در عصر نرم‌افزارهای تخصصی با رابط‌های کاربری پر از امکانات هستیم.

مسیر فعلی صنعت نیز این اصطکاک را برجسته می‌کند. بازیگران اصلی مانند OpenAI، Anthropic و Microsoft تیم‌ها و نهادهای تخصصی را برای کمک به کسب‌وکارها در ادغام هوش مصنوعی ایجاد کرده‌اند. این تلاش‌ها برای ادغام در محل نشان می‌دهد که در آینده‌ای قابل پیش‌بینی، پر کردن شکاف میان قدرت خام مدل و اجرای خودکار و قابل اعتماد، نیازمند مداخله انسانی و سفارشی‌سازی ساختاری سنگین است.

چرا این موضوع برای چشم‌انداز هوش مصنوعی اهمیت دارد

اگر چشم‌انداز براکمن درست باشد، اقتصاد بنیادی توسعه نرم‌افزار تغییر خواهد کرد. ارزش از طراحی رابط کاربری (UI) و تجربه کاربری (UX) به سمت استحکام موتور استدلال زیربنایی و توانایی عامل در تعامل با APIهای متنوع تغییر خواهد کرد. برای توسعه‌دهندگان و بنیان‌گذاران، چالش اصلی عبور از ساخت اپلیکیشن‌های «باغ محصور» (walled garden) و حرکت به سمت ایجاد سرویس‌های تعامل‌پذیر خواهد بود که یک عامل خودگردان بتواند به‌راحتی در آن‌ها پیمایش کرده و آن‌ها را مدیریت کند.

نکات کلیدی

  • تحلیل شکست پلاگین‌ها: ابتکار پلاگین OpenAI در سال ۲۰۲۳ شکست خورد زیرا مدل‌های زبانی بزرگ (LLMs) زیربنایی، فاقد قابلیت‌های استدلالی لازم برای مدیریت قابل اعتماد ادغام‌های شخص ثالث بودند.
  • هدف «نامرئی»: آینده هوش مصنوعی در عامل‌های آگاه به متن نهفته است که نیاز به رابط‌های کاربری سنتی را از بین می‌برند و از نرم‌افزارهای پر از ویژگی‌های اضافی فاصله می‌گیرند.
  • واقعیت پیاده‌سازی: شکاف‌های فعلی در قابلیت اطمینان هوش مصنوعی، نیازمند مهندسی پرامپت سنگین و خدمات ادغام حرفه‌ای از سوی شرکت‌هایی مانند Microsoft و Anthropic است.