آرشیو

نوشته‌ها و یادداشت‌ها

تحلیل‌های فنی و مدیریتی؛ گاهی هم سفرنامه و دلنوشته.

همهٔ موضوع‌ها و دسته‌ها
نمایش آرشیو

صفحه ۳ / ۷ · ۷۵ نوشته

زیرساخت هوش مصنوعی

انتشار ۲۹ اردیبهشت ۱۴۰۴ · بازبینی ۱۹ مرداد ۱۴۰۵ · ۱۰ دقیقه

DGX، HGX یا سرور معمولی GPU؟

تحلیل تفاوت DGX، HGX و سرور PCIe و اینکه چرا بیشتر سازمان‌های ایرانی از مزیت اضافه‌ای که بابت DGX می‌پردازند استفاده نمی‌کنند. ادامه مطلب ←
مدل‌های زبانی

انتشار ۲۲ تیر ۱۴۰۵ · ۱۸ دقیقه

چهاربیتی‌کردن مدل چه چیزی را ارزان می‌کند و چه چیزی را تغییر می‌دهد؟

چهاربیتی‌کردن چگونه حجم وزن‌ها و هزینهٔ اجرا را کاهش می‌دهد و چه اثری بر کیفیت، سرعت، KV cache و ظرفیت سرویس دارد؟ همراه با مقایسهٔ واقعی نسخه‌های Qwen3-8B. ادامه مطلب ←
راهنمای فنی

انتشار ۲۵ خرداد ۱۴۰۵ · ۱۷ دقیقه

RAG، CAG، KAG، Fine-tuning و Instruction tuning؛ چه تفاوتی دارند و کدام را انتخاب کنیم؟

وقتی مدل پاسخ مناسبی نمی‌دهد، واقعاً به آموزش دوباره نیاز داریم یا فقط باید دانش درست را در اختیارش بگذاریم؟ با مثال‌هایی ساده، تفاوت RAG، CAG و KAG را با Fine-tuning و Instruction tuning بررسی می‌کنیم؛ از بازیابی سند و کش‌کردن دانش تا استدلال روی روابط و تغییر رفتار مدل. جدول مقایسه و سناریوهای عملی کمک می‌کنند پیش از صرف هزینهٔ آموزش، تشخیص دهیم مشکل از کمبود دانش است یا شیوهٔ پاسخ‌گویی، و کدام روش یا ترکیب برای پروژه مناسب‌تر است. ادامه مطلب ←