ارباب حلقه‌ها: یاران حلقه

وقتی از AI agent حرف می‌زنیم، معمولا تصویر ساده‌ای توی ذهنمون داریم: یک انسان prompt می‌نویسه، یک LLM اون رو می‌خونه و کاری انجام می‌ده.

اما در یک workflow واقعی، حلقه فقط از انسان و LLM تشکیل نشده. بسته به کاری که می‌خوایم انجام بدیم، آدم‌ها، مدل‌ها، agent harness، ابزارها و APIها، context و memory، policy و sandbox، test، eval و observability می‌تونن بخشی از این گروه باشن. ممکنه یک workflow همه اون‌ها رو داشته باشه و یکی دیگه فقط به چندتاشون نیاز داشته باشه.

همون‌طور که توی قسمت قبلی گفتم، خود این حلقه‌ها هم چیز جدیدی نیستن. ما قبل از LLMها هم اون‌ها رو با روش‌های مختلف می‌ساختیم و اجرا می‌کردیم، حالا فقط اعضای جدیدی مثل LLM و agent به این گروه اضافه شدن.

من همیشه یه قاعده برای خودم دارم: اگر یک کار رو سه بار پشت سر هم، بدون تغییر، انجام می‌دی و هنوز اسکریپتی برای خودکار کردنش نداری، احتمالاً یه جای مسیر رو اشتباه می‌ری.

البته LLMها این قاعده رو عوض نکردن، فقط دامنه کارهایی رو که می‌شه خودکار کرد بزرگ‌تر کردن. حالا اگر هر بار همون prompt رو برای یک agent می‌نویسیم و فقط بهش می‌گیم شروع کن، شاید وقتشه خود همین مرحله هم بخشی از workflow بشه. این به معنی حذف انسان نیست؛ اگر قراره داخل حلقه باشیم، بهتره برای تصمیم گرفتن و قضاوت اونجا باشیم، نه فقط برای زدن دکمه شروع.

نکته اینه که هیچ‌کدوم به‌تنهایی حلقه رو کامل نمی‌کنن. چیزی که ما به‌عنوان رفتار یک agent می‌بینیم، نتیجه همکاری همین اعضا و مرزهاییه که بین نقش‌هاشون تعریف کردیم.

با این حال، ما معمولا تمام اعتبار یا تقصیر یک سیستم Agentic رو به LLM نسبت می‌دیم، در حالی که مدل فقط یکی از یاران حلقه‌ست. یک مدل خوب در یک workflow بد همچنان می‌تونه نتیجه بدی تولید کنه.

در ابتدای مسیر agentic کردن پروسه‌ها، نقش ما انسان‌ها بیشتر شبیه گاندلف هست. قرار نیست همه کارها رو خودمون انجام بدیم یا در تک‌تک قدم‌ها دخالت کنیم. وظیفه ما اینه که مسیر رو بشناسیم، یاران رو کنار هم نگه داریم و مرزهایی رو مشخص کنیم که نباید ازشون عبور کرد.

البته اوایل این مسیر احتمالا بیشتر از چیزی که دوست داریم باید جلوی بالروگ‌ها بایستیم. مثلا وقتی یک agent می‌خواد بدون تست روی production دیپلوی کنه، اطلاعات حساس رو به یک سرویس بیرونی بفرسته یا تغییری غیرقابل‌ بازگشت انجام بده، هنوز به یک انسان نیاز داریم که جلوی اون بایسته و بگه:

You shall not pass!

اما آیا انسان باید همیشه وسط مسیر و روی پل بایسته، یا می‌تونه به‌مرور از داخل حلقه به ناظر اون تبدیل بشه؟ این همون چیزیه که در قسمت بعد بررسیش می‌کنیم.