مقدمه: چت دیگر فقط چت نیست
تا همین چند وقت پیش، هر پاسخ یک مدل زبانی در نهایت یک تکه متن بود. اگر میخواستید سه گزینه را مقایسه کنید، متن جدولمانند میگرفتید؛ اگر میخواستید عددی را تغییر دهید و نتیجه را ببینید، باید دوباره سؤال میپرسیدید.
در ۱۵ مهر ۱۴۰۵ (۷ اکتبر ۲۰۲۶) OpenAI قابلیتی به نام Intelligent UI را همراه با GPT-6 در ChatGPT عرضه کرد. طبق توضیح خود این شرکت، پاسخها میتوانند شامل تصویر، دکمههای قابل لمس، فرم، نمودار و ابزارهای تعاملی باشند که مستقیم داخل گفتگو کار میکنند. این ایده در دنیای محصول با نام Generative UI یا «رابط کاربری تولیدی» شناخته میشود و فقط به یک شرکت محدود نیست.
در این مقاله میبینیم Generative UI دقیقاً چیست، چطور کار میکند، کجا مفید است و چه چیزهایی باید قبل از استفاده در محصول خودتان در نظر بگیرید.
Generative UI دقیقاً چیست؟
در یک رابط معمولی، طراح و برنامهنویس از قبل مشخص میکنند چه صفحهای با چه اجزایی نمایش داده شود. در Generative UI، خودِ مدل در لحظه تصمیم میگیرد پاسخ بهتر چه شکلی داشته باشد: یک پاراگراف، یک جدول مقایسه، یک نمودار یا یک فرم کوچک.
چند مثال ساده:
- کاربر میپرسد «کدام وام برای من بهصرفهتر است؟» و بهجای متن، یک ماشینحساب با اسلایدر مبلغ و مدت بازپرداخت میگیرد.
- کاربر میخواهد هزینه شام را بین پنج نفر تقسیم کند و یک فرم با فیلد نام و مبلغ هر نفر میبیند.
- کاربر داده فروش را میفرستد و بهجای توضیح، یک نمودار قابل تغییر دریافت میکند. نکته مهم این است که پاسخ متنی حذف نمیشود. وقتی یک جواب کوتاه کافی است، همان متن ساده بهترین رابط است.
پشت صحنه چطور کار میکند؟
OpenAI جزئیات فنی داخلی این قابلیت را کامل توضیح نداده است، اما الگوی رایج در اغلب سیستمهای مشابه اینطور است:
- مجموعهای از اجزای مجاز از قبل ساخته میشود؛ مثلاً نمودار، جدول، فرم، دکمه و اسلایدر.
- مدل بهجای نوشتن HTML آزاد، یک توصیف ساختاریافته (معمولاً JSON) برمیگرداند که میگوید کدام جزء با چه دادهای نمایش داده شود.
- برنامه این توصیف را بررسی و با اجزای واقعی رندر میکند.
- وقتی کاربر روی دکمهای میزند یا مقداری را تغییر میدهد، آن رویداد بهصورت یک پیام یا فراخوانی ابزار (tool call) دوباره به مدل یا به منطق برنامه برمیگردد. دلیل استفاده از اجزای از پیش تعریفشده این است که هم ظاهر یکدست میماند و هم امنیت بالاتر میرود: مدل نمیتواند کد دلخواه اجرا کند، فقط از «لگوهایی» که شما اجازه دادهاید استفاده میکند.
کجا مفید است و کجا نه؟
جاهایی که Generative UI میدرخشد:
-
مقایسه چند گزینه با معیارهای مختلف
-
محاسبه و شبیهسازی (وام، قیمتگذاری، سرمایهگذاری)
-
جمعآوری اطلاعات ساختاریافته از کاربر (فرم رزرو، ثبت درخواست)
-
نمایش داده و گزارشهای سریع جاهایی که احتیاط لازم است:
-
تصمیمهای حساس مثل پزشکی، حقوقی یا مالی، که رابط زیبا ممکن است به پاسخ اشتباه ظاهر قابلاعتماد بدهد
-
فرایندهایی که قانون یا استاندارد فرم مشخصی را الزامی کرده است
-
محصولاتی که کاربرانشان برای تکرارپذیری، صفحه ثابت و قابلپیشبینی میخواهند خود OpenAI هم میگوید هنوز برای بهتر کردن «قضاوت طراحی» مدل کار باقی مانده است. یعنی مدل ممکن است گاهی قالب نامناسب انتخاب کند.
چالشهای طراحی و امنیت
اگر قصد دارید چنین قابلیتی را در محصول خودتان بسازید، این فهرست را در نظر داشته باشید:
- اعتبارسنجی خروجی: هر ساختاری که مدل برمیگرداند باید با یک اسکیما بررسی شود، نه اینکه مستقیم رندر شود.
- فهرست محدود اجزا: هرچه مجموعه اجزا کوچکتر و آزمونشدهتر باشد، رفتار قابلپیشبینیتر است.
- دسترسپذیری: اجزا باید با صفحهکلید و صفحهخوان کار کنند. در زبان فارسی، راستبهچپ بودن (RTL) و قالب اعداد را از ابتدا تست کنید.
- اقدامهای حساس: دکمهای که پول جابهجا میکند یا اطلاعات را حذف میکند باید تأیید صریح کاربر داشته باشد.
- لاگ و بازبینی: ثبت کنید مدل چه رابطی ساخته و کاربر چه واکنشی نشان داده است تا بتوانید خطاها را بررسی کنید.
جمعبندی
Generative UI نشان میدهد گفتگو با هوش مصنوعی در حال تبدیل شدن از «پرسش و پاسخ» به «ساخت ابزار در لحظه» است. برای کسبوکارها، یعنی انتظار کاربران از دستیارهای هوشمند به سمت فرم، نمودار و داشبورد تعاملی میرود.
شروع خوب این است که یک سناریوی محدود (مثلاً مقایسه محصول یا فرم درخواست) را انتخاب کنید، مجموعه اجزای کوچکی برایش تعریف کنید و خروجی مدل را قبل از نمایش اعتبارسنجی کنید. بعد از آن میتوانید دامنه را گسترش دهید.





