v3.1.0
v1.0، v2.0، v3.0، v3.1.0 . . . انگار الان وسط یک آپدیت کوچک هستیم 😶 یادداشتهایی درباره AI، LLM و بعد از آن
کانال تلگرامنگاهی به Output Prompt قبلا خیلی خلاصه دربارهی کوتاه کردن خروجی LLM نوشته بودم، توی اون مطلب نوشته بودم که چطور خروجی رو خیلی کوتاه و مختصر کنیم. این بار میخوام کمی بیشتر درباره دستورهایی بنویسم که شکل خروجی رو مشخص م
۱۰ شهریور ۱۴۰۵ساختن یا خریدن، مسئله این است! تا چند سال پیش، برای خیلی از نیازهای کوچک یک تصمیم تقریبا مشخص داشتیم: یا باید ماهانه پول یک SaaS رو پرداخت میکردیم، یا اینکه یک یا چند نفر رو برای ساختن و نگهداری نسخه داخلی اون استخدام م
۲۹ مرداد ۱۴۰۵ارباب حلقهها: پل خازاددووم در قسمت قبل درباره بخشی از کاربردهای «انسان در میان حلقه» نوشتم. تمرکز مطلب بیشتر روی کارهای حساسی مثل دیپلوی روی production بود، اما اگر کمی zoom out کنیم، افراد بیشتری رو داخل حلقه میبینیم؛
۲۶ مرداد ۱۴۰۵ارباب حلقهها: حامل حلقه در قسمت اول گفتم در حالت Human in the Loop، سیستم یک مرحله رو انجام میده، منتظر تصمیم یا تأیید انسان میمونه و بعد ادامه میده. اما پیادهسازی HITL فقط اضافه کردن یک دکمه Yes و No وسط workflow ن
۲۳ مرداد ۱۴۰۵ارباب حلقهها: یاران حلقه وقتی از AI agent حرف میزنیم، معمولا تصویر سادهای توی ذهنمون داریم: یک انسان prompt مینویسه، یک LLM اون رو میخونه و کاری انجام میده. اما در یک workflow واقعی، حلقه فقط از انسان و LLM تشکیل ن
۲۲ مرداد ۱۴۰۵ارباب حلقهها: انواع حلقهها وقتی درباره سیستمهای مبتنی بر AI حرف میزنیم، معمولاً سه اصطلاح زیاد تکرار میشن: Human in the Loop، Human on the Loop و Human out of the Loop. در حالت Human in the Loop یا HITL، انسان بخشی
۲۰ مرداد ۱۴۰۵قبلا وقتی درباره Disaster Recovery یا همان DR حرف میزدیم، معمولا سناریوها مشخص بود: اگر دیتابیس یا یک region از دسترس خارج شد چهکار کنیم؟ آخرین backup کجاست و چقدر طول میکشه سرویس رو برگردونیم؟ اما حالا یک dependency
۱۵ مرداد ۱۴۰۵وقتی یه AI agent به shell دسترسی داره، دیگه فقط یه ابزار ساده تولید متن و کد نیست، میتونه فایل تغییر بده، command اجرا کنه و به network و اطلاعات حساس دسترسی پیدا کنه. بعد از ماجرای خارج شدن مدلهای OpenAI از محیط ایزول
۹ مرداد ۱۴۰۵قدیم تر وقتی یک وب سایت یا رابط کاربری برای یک سرویس آنلاین طراحی می کردیم، یکی از اولین سوال ها این بود که آیا responsive هست یا نه. بعدتر هم اصطلاح Mobilefirst جدی شد؛ یعنی از ابتدا تجربه استفاده روی موبایل رو در طراحی
۸ مرداد ۱۴۰۵داستانها و فیلمها زیاد در مورد هوش مصنوعی که از کنترل خارج شده دیدیم و خوندیم. از ادیسه ۲۰۰۱ یا ترمینتور و یا حتی ماتریکس. اما به نظر من یکی از جالبترین و ترسناکترین اینها Ex Machina بوده. توی ماجرای اخیری که بین openA
۶ مرداد ۱۴۰۵وقتی میگیم باید از LLM استفاده کنیم، منظور فقط این نیست که ازش بخوایم فایلهای YAML کوبرنتیز رو برامون بنویسه یا لاگ یک پاد مشکلدار رو براش کپی کنیم و بپرسیم ایراد کجاست. این کارها مفیدن، اما هنوز استفاده موردی از LLM
۱ مرداد ۱۴۰۵فرض کنید یک Skill برای بررسی PRها ساختید و بعد از چند بار استفاده، به نتیجه خوبی رسیدید. فایلش رو برای بقیه اعضای تیم میفرستید. یکی کپی میکنه داخل .agents/skills، یکی میذاره داخل .claude/skills و یکی هم چند خطش رو تغی
۲۹ تیر ۱۴۰۵اوایل جام جهانی بود که یه پست در Medium دیدم که نویسندهاش با استفاده از Claude برنده جام جهانی ۲۰۲۶ رو پیشبینی کرده بود. البته کلمه «پیشبینی» اینجا خیلی درست نیست و بهتره بگم احتمال برنده شدن تیمها رو محاسبه کرده بود
۲۵ تیر ۱۴۰۵ابزارهایی مثل OpenClaw، Hermes یا Manus گاهی میان روی آنتن همه یوتیبرها و گاهی میرن. یکی میگه وای، خیلی خطر داره. یکی میگه همه زندگی من رو به باد داد. یکی هم ویدئو میذاره و میگه من دیگه همهچیز رو واگذار کردم به یکی
۱۸ تیر ۱۴۰۵جری ساینفلد، کمدین آمریکایی، یه جمله بامزه درباره AI داره: ما اونقدر باهوش بودیم که AI رو اختراع کنیم، اونقدر خنگ بودیم که بهش نیاز پیدا کنیم، و اونقدر احمقیم که نمیتونیم بفهمیم اصلاً کار درستی کردیم یا نه. 😂😂😂 چن
۱۶ تیر ۱۴۰۵یکی از چیزهایی که همیشه باهاش مشکل داریم، کدهای قدیمیه. میراثی از گذشتگان، یا گاهی میراثی از نسخه احمقتر خودمون در گذشته 😁 حالا کاری که این روزها میکنیم چیه؟ میایم همین کدهای حساس و قدیمی رو میدیم به سیستمی که کارش ح
۱۵ تیر ۱۴۰۵🧠 یکی از لایههایی که باید جداگانه بهش نگاه کنیم، همین بحث effort و thinking است. این گزینهها فقط یک دکمه ساده برای «جواب بهتر بده» نیستن. وقتی effort رو بالا میبریم، در واقع داریم به مدل اجازه میدیم قبل از جواب نهای
۱۳ تیر ۱۴۰۵🧠 اوایل استفاده از مدلها خیلی راحت بود. تصمیم میگرفتید سؤال رو از کی بپرسید: ChatGPT، Claude، Gemini یا حتی همهشون. بعد agentها و harnessها اومدن و باید تصمیم میگرفتیم کدوم harness از کدوم مدل استفاده کنه. ⚙️ کمکم
۱۰ تیر ۱۴۰۵📊 وقتی یک مدل جدید معرفی میشه، معمولاً کنار اسمش یکسری عدد هم میبینیم؛ مثل MMLU، HumanEval، SWEbench، GPQA، Math و کلی benchmark دیگه. این عددها مهمن، ولی به نظرم گاهی بیشتر از چیزی که باید جدی گرفته میشن. در نهایت be
۹ تیر ۱۴۰۵⛈ طی یکی دو ماه اخیر، خیلیها با یک واقعیت نسبتاً تلخ روبهرو شدن: استفاده از LLMها دیگر مثل قبل یک هزینه ساده و قابل پیشبینی ماهانه نیست. تا همین چند وقت پیش، خیلی از ابزارهای AI مثل «اشتراک ماهانه» بودن. یعنی یک مبلغ
۸ تیر ۱۴۰۵🖥 این روزها اگر کمی توی اینترنت یا یوتیوب بگردید، با کلی عنوان شبیه این روبهرو میشید: «Run AI locally for FREE» یا «بدون پرداخت هزینه، ChatGPT خودت رو روی لپتاپ اجرا کن» ⚠️ این جمله از یک نظر درسته، اما از یک نظر خیل
۷ تیر ۱۴۰۵🔓 این روزها خیلی از LLMها رو با عنوان «Open Source» معرفی میکنن، اما شاید بهتر باشه کمی دقیقتر بهش نگاه کنیم. هر مدلی که بشه دانلودش کرد، لزوماً متنباز نیست. بین اینها فرق وجود داره: 🧠 مدل Openweight: یعنی وزنهای
۶ تیر ۱۴۰۵📝 قبلاً درباره این نوشتم که نوشتن rules توی AGENTS.md بهتنهایی کافی نیست. 👨💻 از نظر من coding agentها شبیه برنامهنویس جونیوری هستن که کتاب و ویدئو زیاد دیدن و شدیداً علاقه دارن با کارشون شما رو تحت تأثیر قرار بدن.
۴ تیر ۱۴۰۵🤖 یکی از بحثهایی که با آمدن AI Agentها جدیتر شده اینه که اگر یک ایجنت خرابکاری کرد، مقصر کیه؟ مدل؟ ابزار؟ هارنس؟ یا کسی که اون ایجنت رو راه انداخته؟ ⚠️ اسپویلر آلرت: مسئولیت نهایی همچنان با آدمه 😁😈. فرقی نمیکنه کد
۳ تیر ۱۴۰۵🌐 تقریباً هر زمان که بخوام با یک مدل درباره موضوعات فنی صحبت کنم، سراغ انگلیسی میرم. اوایل این کار رو برای گرفتن جواب بهتر انجام میدادم و البته توضیح دادن موضوعات فنی به انگلیسی هم راحتتر بود. بعد کمکم تبدیل به عادت
۲ تیر ۱۴۰۵🛠 بین دهها «Code Harness» مختلف، تا الان فرصت کار با اینها رو داشتم: GitHub Copilot OpenCode Pi Kiro CLI Claude Code 🚀 شروع کار من هم مثل خیلیها با GitHub Copilot بود، اما کمکم به سمت ابزارهای ترمینالمحور و مستقل
۱ تیر ۱۴۰۵دنیای فیلمها و داستانهای علمیتخیلی معمولاً نگاه تاریکی به هوش مصنوعی دارد، از Skynet گرفته تا انواع سناریوهای آخرالزمانی اما یک استثنای بزرگ وجود دارد: ایزاک آسیموف. آسیموف نهفقط خالق «سه قانون رباتیک» بود، بلکه دهه
۳۱ خرداد ۱۴۰۵⚔️ در اکوسیستم LLMها هم مثل بسیاری از حوزههای نرمافزار، به نظر میرسد دو جبهه وجود دارد: Open Source و Closed Source. 🚨 جالب است که بخش قابل توجهی از هشدارها درباره خطرات AI، رگولیشن و محدود کردن دسترسی عمومی، از سمت
۳۰ خرداد ۱۴۰۵🧠 بیشتر LLMهایی که امروز با آنها کار میکنیم یک ویژگی مشترک دارند: تلاش برای «کامل بودن». 💬 حتی اگر یک سؤال کوتاه بپرسید، معمولاً سعی میکنند پاسخی جامع، مفصل و پوششدهنده تمام جوانب ارائه دهند. برای یک Bash Script سا
۲۹ خرداد ۱۴۰۵بیشتر افراد میگویند: «من از Cursor AI استفاده میکنم» یا «دارم یک AI Agent میسازم.» اما اینها لایههای متفاوتی از یک فناوری هستند: 🤖 ایجنتها (Agents) ← جریانهای کاری ساختهشده از پرامپتها، ابزارها، مجوزها و مدلها
۲۹ خرداد ۱۴۰۵هدف این کانال فقط معرفی مدلهای جدید LLM یا ابزارهای مرتبط با آنها نیست. تلاش من این است که صرفاً کپیکننده نباشم؛ یعنی هر چیزی را که ترند شد یا احتمالاً کلیک میخورد، بدون فکر اینجا بازنشر نکنم. ممکن است درباره یک مدل