مفاهیم هوش مصنوعی

۹ نوشته در این دسته.

از پایه: توکن، کانتکست، معماری ترنسفورمر، آموزش و تنظیم مدل، تا روش‌های ارزیابی و تفاوت مدل‌ها.

چطور رمزگشایی گویایی حدسی توزیع را عوض نمی‌کند؟ مفاهیم هوش مصنوعی 2026-10-04 / ۱۲ مهر ۱۴۰۵, ۱۷:۰۵ چطور رمزگشایی گویایی حدسی توزیع را عوض نمی‌کند؟ رمزگشایی گویایی یعنی یک توکن در هر پاس شبکه، و کل مدل باید هر بار از حافظه خوانده شود. رمزگشایی گویایی حدسی این را عوض می‌کند: یک مدل کوچک چند توکن را پیشنهاد … چطور بلوک استدلال رمزگذاری‌شده را از لاگ ایجنت پیدا کنیم؟ مفاهیم هوش مصنوعی 2026-10-03 / ۱۱ مهر ۱۴۰۵, ۱۶:۰۷ چطور بلوک استدلال رمزگذاری‌شده را از لاگ ایجنت پیدا کنیم؟ بلوک‌های رمزگذاری‌شده‌ی استدلال در لاگ نشست‌های ایجنت شما می‌مانند و هر کسی که لاگ را ببیند می‌تواند با یک ترفند replay آن‌ها را به متن تبدیل کند. در این نوشته با … چطور روتر top-k در مدل Mixtral کار می‌کند؟ مفاهیم هوش مصنوعی 2026-10-02 / ۱۰ مهر ۱۴۰۵, ۱۹:۲۲ چطور روتر top-k در مدل Mixtral کار می‌کند؟ در معماری مخلوط متخصص‌ها، یک لایه به جای یک شبکه‌ی کامل، چند شبکه‌ی کوچک دارد و برای هر توکن فقط دو تای آن‌ها را حساب می‌کند. در Mixtral 8x7B این یعنی ۴۶٫۷ میلیارد … کش پرامپت چطور کار می‌کند و چقدر واقعی پس‌اندازی می‌کند مفاهیم هوش مصنوعی 2026-09-29 / ۷ مهر ۱۴۰۵, ۲۱:۳۲ کش پرامپت چطور کار می‌کند و چقدر واقعی پس‌اندازی می‌کند کش پرامپت یعنی پیشوند ثابت پرامپت را یک بار می‌نویسی و تا نیم ساعت با کمتر از یک‌دهم قیمت می‌خوانی. برای یک اجرای ۲۰ نوبتی ایجنت با پیشوند ۸۰۰۰ توکنی روی GPT-6.1 … توجه گروهی چیست و چطور کش کلید-مقدار را از config.json تشخیص دهیم مفاهیم هوش مصنوعی 2026-09-29 / ۷ مهر ۱۴۰۵, ۰۸:۱۶ توجه گروهی چیست و چطور کش کلید-مقدار را از config.json تشخیص دهیم وقتی یک مدل ۶۴ سر پرسش دارد و فقط ۸ سر کلید و مقدار، کش کلید-مقدار هر توکن از ۲۵۶۰ کیلوبایت به ۳۲۰ کیلوبایت می‌افتد؛ یعنی ۸ برابر. این همان کاری است که توجه گروهی … RMSNorm چیست و چطور آن را از config.json مدل‌ها تشخیص دهیم مفاهیم هوش مصنوعی 2026-09-28 / ۶ مهر ۱۴۰۵, ۱۸:۵۵ RMSNorm چیست و چطور آن را از config.json مدل‌ها تشخیص دهیم RMSNorm نرمال‌سازی استاندارد در مدل‌های تازه است و یک کلمه از LayerNorm کم دارد: کم کردن میانگین، و بایاسی که فقط برای همان کار لازم بود. روی برداری که خودمان … RoPE چیست و چطور پنجره‌ی زمینه را در llama.cpp بزرگ کنیم مفاهیم هوش مصنوعی 2026-09-28 / ۶ مهر ۱۴۰۵, ۰۱:۰۶ RoPE چیست و چطور پنجره‌ی زمینه را در llama.cpp بزرگ کنیم مدل زبانی از جای توکن در جمله بی‌خبر است و تنها چیزی که به او می‌گوید «این توکن هفتم جمله است»، چرخاندن بردار پرسش و کلید است. RoPE این کار را با یک ضرب ساده انجام … چطور توجه کار می‌کند: جذر d_k و هزینه‌ی n×n مفاهیم هوش مصنوعی 2026-09-27 / ۵ مهر ۱۴۰۵, ۰۴:۱۲ چطور توجه کار می‌کند: جذر d_k و هزینه‌ی n×n توجه با سه ضرب کار می‌کند: ضرب داخلی کلید و پرس، نرم‌افزار روی امتیازها، و یک میانگین وزنی از مقدارها. هر سه در بیست خط پایتون بدون هیچ کتابخانه‌ای پیاده شدند … توکن، پنجره‌ی زمینه و حافظه: عددهای پشت صورتحساب مفاهیم هوش مصنوعی 2026-09-25 / ۳ مهر ۱۴۰۵, ۰۰:۰۰ توکن، پنجره‌ی زمینه و حافظه: عددهای پشت صورتحساب مدل‌های زبانی متن را نمی‌خوانند، توکن می‌خوانند، و همین یک تفاوت ساده پشت هر عددی است که در صورتحساب می‌بینید. در این نوشته با کتابخانه‌ی توکن‌ساز همین را اندازه …