آرشیو

نوشته‌ها و یادداشت‌ها

تحلیل‌های فنی و مدیریتی؛ گاهی هم سفرنامه و دلنوشته.

همهٔ موضوع‌ها و دسته‌ها
نمایش آرشیو

صفحه ۱ / ۷ · ۷۵ نوشته

سیاست‌گذاری هوش مصنوعی

انتشار ۱ مهر ۱۴۰۵ · ۱۵ دقیقه

هوش مصنوعی بر دوش متن‌باز؛ چرا به قانون حمایت از متن‌باز نیاز داریم؟

دسترسی کم‌هزینه به نرم‌افزارهای جهان به یادگیری یک نسل کمک کرد؛ اما برای ساختن و نگهداری هوش مصنوعی، آزادی استفاده باید پشتوانهٔ حقوقی داشته باشد. از اعتبار مجوزهای آزاد و حقوق پدیدآورنده تا خرید دولتی، دادهٔ آموزشی و تأمین هزینهٔ نگهداری. ادامه مطلب ←
سیاست‌گذاری هوش مصنوعی

انتشار ۳۱ شهریور ۱۴۰۵ · ۱۵ دقیقه

پروانه اپراتوری هوش مصنوعی؛ دو پاسخ و چندین پرسش بی‌پاسخ

توضیح وزارت ارتباطات درباره معافیت شرکت‌های کوچک و نقش بنگاه‌های لنگر، پرسش‌های اصلی درباره دامنه پروانه AISP، شروط ورود، رقابت، حقوق شرکت‌های مستقل و امنیت زیرساخت را پاسخ نمی‌دهد. نقد مصوبه و پیشنهاد تفکیک اعتبارسنجی زیرساخت از مجوز عمومی فعالیت در هوش مصنوعی. ادامه مطلب ←
زیرساخت هوش مصنوعی

انتشار ۲۸ شهریور ۱۴۰۵ · ۱۸ دقیقه

سربار پردازش محرمانه روی GPU از کجا می‌آید؟

تحلیل آزمون‌های پردازش محرمانه روی B200؛ چرا یک پشته ۳۹ درصد افت توان عملیاتی دارد و پیکربندی دیگر تنها چند درصد؟ نقش ارسال فرمان، PCIe، NVLink و نرم‌افزار استنتاج را با اعداد پژوهش بررسی می‌کنیم. ادامه مطلب ←
مدل‌های زبانی

انتشار ۲۴ شهریور ۱۴۰۵ · بازبینی ۲۸ شهریور ۱۴۰۵ · ۲۳ دقیقه

Ollama، vLLM، SGLang یا llama.cpp؛ برای اجرای مدل کدام را انتخاب کنیم؟

مقایسهٔ فنی چهار ابزار اجرای مدل؛ از هم‌زمانی و KV cache تا GGUF، چند GPU، پایش و آزمون بار. کجا سادگی Ollama کافی است و چه زمانی vLLM یا SGLang انتخاب مناسب‌تری می‌شود؟ ادامه مطلب ←
مدل‌های زبانی

انتشار ۱۱ شهریور ۱۴۰۵ · بازبینی ۲۸ شهریور ۱۴۰۵ · ۱۹ دقیقه

مدل خوب برای فارسی را چگونه بسنجیم؟

از روانی متن تا درستی پاسخ و موفقیت در کاربرد واقعی؛ راهنمای عملی انتخاب معیار، ساخت نمونه‌های فارسی و استفاده از بنچمارک‌ها، با ارجاع به پژوهش‌های فارسی و کارهای دانشگاهی ایران. ادامه مطلب ←
مدل‌های زبانی

انتشار ۲ شهریور ۱۴۰۵ · بازبینی ۲۸ شهریور ۱۴۰۵ · ۱۸ دقیقه

تکمیل کد، دستیار کد و عامل برنامه‌نویسی؛ سه نیاز با سه معیار انتخاب

تکمیل کد به پیشنهاد سریع، دستیار کد به اصلاح درست و عامل برنامه‌نویسی به انجام موفق کار با ابزار نیاز دارد. چهار جدول برای انتخاب مدل، معیار ارزیابی و زیرساخت متناسب با هر نقش. ادامه مطلب ←
مدل‌های زبانی

انتشار ۲۱ مرداد ۱۴۰۵ · بازبینی ۲۸ شهریور ۱۴۰۵ · ۱۹ دقیقه

برای دستیار اسناد سازمانی، مدل زبانی، embedding و reranker را چگونه انتخاب کنیم؟

برای پاسخ‌های روزمره از اسناد سازمان، مدل کوچک اغلب نقطهٔ شروع مناسبی است. معیار انتخاب جداگانهٔ embedding، reranker و پاسخ‌گو، نامزدهای عملی و تشخیص محل خطا را با چهار جدول بررسی می‌کنیم. ادامه مطلب ←
مدل‌های زبانی

انتشار ۱۱ تیر ۱۴۰۵ · بازبینی ۲۸ شهریور ۱۴۰۵ · ۲۰ دقیقه

روی RTX 4090 چه مدل‌هایی اجرا می‌شوند؟ تفاوت ۲۴ و ۴۸ گیگابایت در عمل

کدام مدل‌ها روی ۲۴ و ۴۸ گیگابایت جا می‌شوند، چند 4090 چه زمانی برای سرویس سازمانی کافی‌اند و چه زمانی H100، H200 یا کارت حرفه‌ای ارزش هزینهٔ بیشتر را دارند؟ ادامه مطلب ←
مدل‌های زبانی

انتشار ۲۸ خرداد ۱۴۰۵ · بازبینی ۲۸ شهریور ۱۴۰۵ · ۱۸ دقیقه

برای هر کاربرد واقعاً چه اندازه مدلی لازم داریم؟ از مدل تخصصی و SLM تا LLM

برای چت ساده، پاسخ مستند، دستیار کد و تحلیل پیچیده چه اندازه مدلی مناسب است؟ مرور تناسب کاربردها، انتخاب میان RAG، CAG، KAG و تنظیم مدل، و اثر اندازه و طول زمینه بر هزینه و ظرفیت سرویس‌دهی. ادامه مطلب ←
امنیت

انتشار ۲۷ شهریور ۱۴۰۵ · ۲۴ دقیقه

ZTAI برای عامل‌های خودکار؛ اختیار محدود در تمام مسیر اجرا

حذف مشاهده مستقیم داده توسط انسان، نباید به واگذاری اختیار نامحدود به عامل تبدیل شود. از هویت و مجوز مأموریت تا RAG، حافظه، MCP، اجرای ابزار، توقف و ارزیابی مستقل؛ چگونه اختیار عامل را در تمام مسیر اجرا محدود و قابل آزمون نگه داریم؟ ادامه مطلب ←
مدل‌های زبانی

انتشار ۲۵ شهریور ۱۴۰۵ · بازبینی ۲۵ شهریور ۱۴۰۵ · ۱۹ دقیقه

هزینهٔ واقعی اجرای مدل زبانی؛ خرید، اجاره یا API

خرید سرور، اجارهٔ GPU یا API برای یک کسب‌وکار ایرانی؟ مقایسهٔ هزینه با تعرفه‌های سرویس‌های ایرانی، قیمت قطعات سیستم 4090 و محاسبهٔ دوسالهٔ مالکیت. ادامه مطلب ←