en
Feedback
Control Engineering

Control Engineering

Open in Telegram

جهت ارتباط با ادمین‌ها، به گروه کانال مراجعه کنین. https://t.me/+k1OZ6I6uW5YzY2I8

Show more
2 300
Subscribers
+524 hours
+167 days
+6330 days
Posts Archive
۹. تطبیق پیشوند (Prefix Matching) را یاد بگیر این مکانیسم پشت پرده‌ی کش کردن پرامپت است که اکثر برنامه‌نویسان از آن بی‌خبرند.
۹. تطبیق پیشوند (Prefix Matching) را یاد بگیر این مکانیسم پشت پرده‌ی کش کردن پرامپت است که اکثر برنامه‌نویسان از آن بی‌خبرند. سیستم‌های AI کانتکست را بر اساس تطبیق پیشوندها کش می‌کنند، یعنی ابتدای پرامپت شما باید بین درخواست‌ها یکسان باشد تا از مزیت کش استفاده کنید.

نکته کلیدی: پرامپت سیستمی و دستورات پروژه‌تان را ثابت نگه دارید. هر بار که آن‌ها را تغییر دهید، کش را بی‌اعتبار می‌کنید و دوباره هزینه‌ی کامل را می‌پردازید. اگر مستقیماً با API انتروپیک کار می‌کنید، کش کردن پرامپت می‌تواند هزینه را تا ۹۰٪ در فراخوانی‌های تکراری با کانتکست یکسان کاهش دهد.

۸. کش کردن پرامپت (Prompt Caching) را درک کن (و از آن استفاده کن) سیستم‌های هوش مصنوعی مدرن، ابتدای کانتکست شما را کش می‌کنند
۸. کش کردن پرامپت (Prompt Caching) را درک کن (و از آن استفاده کن) سیستم‌های هوش مصنوعی مدرن، ابتدای کانتکست شما را کش می‌کنند تا هر بار دوباره پردازشش نکنند.

یک نشست تازه با یک خلاصه‌ی تمیز، همیشه از یک نشست طولانی و انباشته بهتر عمل می‌کند.

۷. از تحویل نشست (Session Handoffs) استفاده کن نشست‌های طولانی تحلیل می‌روند. نه فقط از نظر هزینه‌ی توکن، بلکه از نظر کیفیت.
۷. از تحویل نشست (Session Handoffs) استفاده کن نشست‌های طولانی تحلیل می‌روند. نه فقط از نظر هزینه‌ی توکن، بلکه از نظر کیفیت. AI دیگر زنجیره‌ی مکالمه را از دست می‌دهد. گردش کار من الان:

برخی ابزارها مانند Caveman Mode این کار را به طور خودکار انجام می‌دهند.

۶. پاسخ‌های پرحرفی (Verbose) AI را کاهش بده هر کلمه‌ای که AI امروز می‌نویسد، فردا بخشی از کانتکست شما خواهد شد. پاسخ‌های طولا
۶. پاسخ‌های پرحرفی (Verbose) AI را کاهش بده هر کلمه‌ای که AI امروز می‌نویسد، فردا بخشی از کانتکست شما خواهد شد. پاسخ‌های طولانی → کانتکست بزرگتر → پاسخ بعدی کندتر → توکن مصرفی بیشتر → این چرخه تکرار می‌شود. به‌طور مشخص بخواهید که پاسخ مختصر باشد، مثلاً: «در یک پاراگراف برایم توضیح بده» یا «تنها کد را به من نشان بده».

۵. لاگ‌ها را قبل از ارسال، فشرده کن (Compress) لاگ‌ها، قاتلان خاموش توکن هستند. ابزارهایی مثل RTK می‌توانند لاگ‌ها را خلاصه ک
۵. لاگ‌ها را قبل از ارسال، فشرده کن (Compress) لاگ‌ها، قاتلان خاموش توکن هستند. ابزارهایی مثل RTK می‌توانند لاگ‌ها را خلاصه کنند قبل از اینکه وارد پنجره‌ی کانتکست شوند. کاهش بالقوه: ۸۰ تا ۹۹٪.

۴. به جای چسباندن داکیومنت، از Context7 استفاده کن اگر این کار را کرده‌اید: [Pastes 40 pages of Next.js docs] "Here's the doc
۴. به جای چسباندن داکیومنت، از Context7 استفاده کن اگر این کار را کرده‌اید:
[Pastes 40 pages of Next.js docs]
"Here's the documentation, now help me fix this routing issue"
Context7 MCP این مشکل را حل می‌کند. به جای چسباندن کل داکیومنت، فقط بخش مربوطه را در لحظه‌ای که نیاز دارید، دریافت می‌کند.

۳. به جای بارگذاری کل مخزن، از CodeGraph استفاده کن ‏CodeGraph مخزن شما را ایندکس می‌کند و به AI اجازه می‌دهد فقط فایل‌های مر
۳. به جای بارگذاری کل مخزن، از CodeGraph استفاده کنCodeGraph مخزن شما را ایندکس می‌کند و به AI اجازه می‌دهد فقط فایل‌های مرتبط از نظر معنا (Semantically Relevant) را دریافت کند، نه همه‌ی چیزها را. کاهش بالقوه: ۳۰ تا ۷۰٪ کانتکست کمتر در هر درخواست.

هر خط از آن فایل، در هر درخواستی، بارگذاری می‌شود و شما برایش هزینه می‌دهید. فایل راهنمای شما باید به اطلاعات اشاره کند، نه اینکه خودش حاوی همه‌ی اطلاعات باشد.

۲. فایل‌های claude.md و AGENTS.md را کوچک نگه دارید برنامه‌نویسانی را دیده‌ام که فایل‌های راهنمایی (Instruction Files) به این
۲. فایل‌های claude.md و AGENTS.md را کوچک نگه دارید برنامه‌نویسانی را دیده‌ام که فایل‌های راهنمایی (Instruction Files) به این شکل درست می‌کنند:

● شما چه باید بکنید؟ @ControlEngineering98
● شما چه باید بکنید؟ @ControlEngineering98

۱۵ راهکار برای رهایی از این مشکل ۱. قبل از کدنویسی، برنامه‌ریزی کن گران‌ترین الگوی مصرف توکن، کدنویسی به روش «خطا و آزمایش» (
۱۵ راهکار برای رهایی از این مشکل ۱. قبل از کدنویسی، برنامه‌ریزی کن گران‌ترین الگوی مصرف توکن، کدنویسی به روش «خطا و آزمایش» (Trial-and-Error) با AI است. ● اکثر برنامه‌نویسان چه می‌کنند؟

هوش مصنوعی توکن‌های بیشتری را برای پردازش کانتکست مصرف می‌کند تا برای حل مشکل شما! من به این می‌گویم «بدهی کانتکست» (Context Debt)، معادل هوش مصنوعی برای «بدهی فنی» (Technical Debt). بی‌صدا جمع می‌شود تا اینکه ناگهان روز سه‌شنبه، تا ظهر به محدودیت خود می‌رسید.

چرا برنامه‌نویسان اینقدر توکن هدر می‌دهند (بدون اینکه متوجه شوند) این چیزی است که یک جلسه‌ی معمولی کدنویسی با AI در واقع شبیه
چرا برنامه‌نویسان اینقدر توکن هدر می‌دهند (بدون اینکه متوجه شوند) این چیزی است که یک جلسه‌ی معمولی کدنویسی با AI در واقع شبیه آن است:

مهندسی کانتکست چیست؟ مهندسی کانتکست، هنر و دانش کنترل کردن این موضوع است که چه چیزی وارد پنجره‌ی کانتکست (Context Window) مدل
مهندسی کانتکست چیست؟ مهندسی کانتکست، هنر و دانش کنترل کردن این موضوع است که چه چیزی وارد پنجره‌ی کانتکست (Context Window) مدل هوش مصنوعی می‌شود و چه چیزی نمی‌شود. اکثر برنامه‌نویسان روی این تمرکز می‌کنند که از AI چه سوالی بپرسند. اما مهندسی کانتکست درباره‌ی این است که AI قبل از اینکه شما بپرسید، چه چیزی را می‌بیند. هدف: حذف اطلاعات نامربوط اولویت‌بندی اطلاعات مرتبط بهبود کیفیت پاسخ‌ها کاهش مصرف توکن به آن به چشم مدیریت حافظه برای هوش مصنوعی نگاه کنید.

ماه پیش، دو بار در یک روز به سقف مجاز مصرف اکانت GitHub Copilot PRO+ خودم خوردم. کار خارق‌العاده‌ای انجام نمی‌دادم. بین سه پروژه در حال جابه‌جا شدن بودم: یک پلتفرم پزشکی از راه دور، یک محصول منشی تلفنی هوشمند، و پروژه‌های کدنویسی برای مشتریان. جلسات کاری معمولی، سوالات معمولی. تا ظهر، سقف مصرفم پر می‌شد. اولین غریزه‌ام این بود که پلن اشتراکم را ارتقا دهم. اما بعد مکث کردم و سوال اصلی را پرسیدم: چرا اینقدر سریع توکن‌ها را می‌سوزانم؟ پاسخ، پلن من نبود. پاسخ، نحوه‌ی تغذیه‌ی کانتکست به AI بود. من سال‌هاست که نرم‌افزار می‌سازم و پایگاه‌های داده، APIها و زیرساخت‌های ابری را بهینه‌سازی کرده‌ام. اما با کانتکست هوش مصنوعی مثل یک منبع نامحدود رفتار می‌کردم. هر چیزی را که داشتیم، می‌ریختیم توی محفظه‌اش و امیدوار بودیم که بهترین نتیجه را بگیریم. این طرز فکر، با مهندسی کانتکست (Context Engineering) عوض می‌شود.

کتابچه مهندسی کانتکست هوش مصنوعی: ۱۵ راه برای جلوگیری از سوختن توکن‌ها و گرفتن بازدهی بیشتر از ابزارهای AI @ControlEngineering98

اگر دانشجو هستید، با ایمیل‌های .ac.ir و .edu می‌تونید اشتراک 120 دلاری سالانه‌ی Zed رو با مدل‌های Calude Sonnet 4.6, GPT 5.5,5.4,5.3, Gemini 3.1 Pro بگیرید به رایگان. 10 دلار هم کردیت از API خودش می‌ده. به شدت هم IDE سبک و خوبیه از اینجا می‌تونید اقدام کنید: https://zed.dev/education