→ بازگشت به مجله
آموزش و راهنما

نصب هوش مصنوعی روی کامپیوتر خودت

هوش مصنوعی لازم نیست همیشه روی سرور یک شرکت دیگر اجرا شود. می‌توانی مدل‌ها را مستقیم روی کامپیوتر خودت اجرا کنی: بدون اشتراک ماهانه، بدون اینکه حرف‌هایت جایی ارسال شود، و بعد از دانلود، حتی بدون اینترنت.

اول دانلود را شروع کن

فایل نصب حدود ۵۹۰ مگابایت است و مستقیماً از سایت رسمی سازنده هست. همین حالا بزن و تا دانلود کامل میشه، ادامهٔ راهنما را بخوان.

شروع دانلود
ویندوز ۶۴ بیتی حدود ۵۹۰ مگابایت رایگان

همین فایل را از سایت رسمی هم می‌توانی بگیری — lmstudio.ai

💡
دانلود گاهی به VPN نیاز دارد — هم برای همین فایل، هم برای دانلود مدل در مرحلهٔ بعد. اگر دانلود شروع نشد، VPN را روشن کن و دوباره امتحان کن.

۱. نصب برنامه

وقتی فایل دانلود شد، اجرایش کن. کل نصب هشت کلیک است و هیچ تنظیم خاصی ندارد:

فایل نصب دانلودشده در پوشه
۱. روی فایل دانلودشده دوبار کلیک کن
هشدار امنیتی ویندوز برای اجرای فایل
۲. ویندوز تأیید می‌خواهد؛ Run
صفحهٔ قوانین استفاده
۳. I Agree
انتخاب نصب برای همهٔ کاربران
۴. گزینهٔ اول، بعد Next
تأیید دوبارهٔ قوانین
۵. دوباره I Agree
انتخاب محل نصب
۶. محل نصب را دست نزن؛ Install
نوار پیشرفت نصب
۷. چند لحظه صبر کن
پایان نصب و اجرای برنامه
۸. Finish — برنامه باز می‌شود

۲. دانلود مدل

برنامه بدون مدل کاری نمی‌کند. مدل همان «مغز» است و باید یک‌بار دانلودش کنی. از این مرحله VPN را روشن کن.

۱از نوار کناری، ذره‌بین جست‌وجوی مدل را بزن (یا Ctrl + Shift + M)
آیکون جست‌وجوی مدل در نوار کناری
۲اسم مدلی که می‌خواهی را تایپ کن

در این راهنما از Nemotron 3 Nano 4B استفاده می‌کنیم؛ مدل کوچکی از NVIDIA که تقریباً روی هر کامپیوتری، حتی لپ‌تاپ‌های قدیمی، اجرا می‌شود. اگر سیستم قوی‌تری داری، جدول بخش بعد را ببین.

نسخه‌های مختلف یک مدل برای دانلود
هر مدل چند نسخه دارد. هرچه عدد بالاتر، کیفیت بهتر و حجم بیشتر.
۳دو نشانه به تو می‌گویند کدام نسخه را بگیری
👍
علامت لایک: یعنی «بر اساس سخت‌افزار تو، این گزینه پیشنهاد می‌شود». اگر تازه‌کاری، همین را انتخاب کن و بقیه را نادیده بگیر.
علامت پیشنهاد بر اساس سخت‌افزار
برچسب سبز Full GPU Offload Possible: یعنی این نسخه کامل داخل حافظهٔ کارت گرافیک جا می‌شود. کارت گرافیک خیلی سریع‌تر از پردازنده است، پس این نسخه محسوس تندتر جواب می‌دهد. اگر دیدیش، انتخاب خوبی است.
توضیح برچسب سبز اجرای کامل روی کارت گرافیک
۴دکمهٔ Download را بزن
دکمهٔ دانلود مدل
۵پیشرفت دانلود را از آیکون بالا-راست ببین
پنجرهٔ پیشرفت دانلود مدل
بسته به سرعت اینترنتت ممکن است چند دقیقه تا نیم‌ساعت طول بکشد.

۳. کدام مدل برای کامپیوتر من؟

ساده‌ترین قانون: حجم مدل باید از حافظهٔ کارت گرافیکت کمتر باشد. اگر کارت گرافیک مجزا نداری، از رم سیستم استفاده می‌شود و کندتر است — ولی باز هم کار می‌کند.

سیستم ساده

لپ‌تاپ‌های قدیمی، بدون کارت گرافیک مجزا، حدود ۸ گیگ رم

خیلی سریعNemotron 3 Nano 4B — Q4_K_M۲٫۸ گیگ
سریعGemma 4 E2B — Q4_K_M۴٫۱ گیگ
متوسطLFM2.5 8B A1B — Q4~۵ گیگ

سیستم متوسط

کارت گرافیک ۸ گیگ (مثل RTX 3060 یا 4060)، ۱۶ گیگ رم

خیلی سریعNemotron 3 Nano 4B — Q8_0۴٫۲ گیگ
سریعGemma 4 12B — Q4_K_M۷ گیگ
متوسطGemma 4 26B A4B — Q4~۱۴ گیگ

سیستم قدرتمند

کارت گرافیک ۲۴ تا ۳۲ گیگ (مثل RTX 4090 یا 5090)، ۳۲ گیگ رم به بالا

خیلی سریعGemma 4 12B — Q4_K_M۷ گیگ
سریعQwen3.8 27B — Q4_K_M~۱۷ گیگ
متوسطMuse Glimmer 30B — Q4~۲۰ گیگ
💡
«متوسط» یعنی کندتر ولی باهوش‌تر. اگر جواب‌ها برایت خیلی آهسته آمد، یک رده پایین‌تر برو؛ کیفیت کمی پایین می‌آید ولی تجربه‌ات خیلی روان‌تر می‌شود. حجم‌ها تقریبی‌اند و ممکن است با نسخه‌های جدیدتر کمی فرق کنند.

۴. اجرای مدل

۱از بالای صفحه Select a model to load را بزن و مدلت را انتخاب کن
فهرست مدل‌های دانلودشده برای بارگذاری
۲دو تنظیم می‌بینی. لازم نیست تغییرشان بدهی، ولی خوب است بدانی چه هستند
📏
Context Length — حافظهٔ کوتاه‌مدت مدل. یعنی در یک گفتگو چقدر متن را همزمان می‌تواند در نظر بگیرد. عدد بزرگ‌تر یعنی می‌تواند متن طولانی‌تری بخواند، ولی رم بیشتری مصرف می‌کند.
توضیح تنظیم طول زمینه
🎮
GPU Offload — چه مقدار از مدل روی کارت گرافیک اجرا شود. کارت گرافیک چند برابر پردازنده سریع‌تر است، پس عدد بالاتر یعنی جواب سریع‌تر — به شرطی که حافظهٔ کارت گرافیکت جا داشته باشد. برنامه خودش عدد مناسب را پیشنهاد می‌دهد؛ دست نزنی بهتر است.
توضیح تنظیم اجرا روی کارت گرافیک
۳دکمهٔ Load Model را بزن
پنجرهٔ بارگذاری مدل با دکمهٔ Load Model
۴تمام. سؤالت را بپرس
گفتگوی فارسی با هوش مصنوعی روی کامپیوتر شخصی
از این لحظه به بعد، اینترنت را هم قطع کنی باز جواب می‌دهد.

عددهای زیر جواب سرعت را نشان می‌دهند. tok/sec یعنی چند کلمه در ثانیه تولید می‌شود — هرچه بیشتر، روان‌تر.

حالا چه کار کنم؟

مدل روی کامپیوتر توست و مال خودت است. می‌توانی ازش بخواهی متن بنویسد، کد توضیح بدهد، ایمیل ترجمه کند یا ایده بدهد — بدون اینکه چیزی از کامپیوترت بیرون برود. اگر مدل کند بود، از جدول بالا یک رده پایین‌تر امتحان کن؛ اگر جواب‌ها سطحی بود، یک رده بالاتر.

هنوز فایل نصب را نگرفته‌ای؟

دانلود برای ویندوز
مسیر یادگیری بعدی

این راهنما بخشی از مسیرهای عملی آموزش هوش مصنوعی در AIwithSaeed است.

دیدن مسیرهای یادگیری ←

پرسش‌های متداول

آیا LM Studio رایگان است؟

بله. برای استفادهٔ شخصی رایگان است و نیازی به اشتراک ماهانه ندارد. مدل‌ها هم رایگان دانلود می‌شوند.

برای استفاده از مدل‌ها به اینترنت نیاز دارم؟

فقط یک‌بار برای دانلود مدل. بعد از آن مدل روی کامپیوتر شماست و کاملاً آفلاین کار می‌کند؛ حتی با قطع اینترنت جواب می‌دهد.

آیا برای نصب به VPN نیاز دارم؟

احتمالاً بله. لینک دانلود در این صفحه مستقیم به سایت رسمی سازنده وصل می‌شود و ممکن است از داخل ایران باز نشود؛ اگر دانلود شروع نشد یا وسط راه قطع شد، VPN را روشن کنید. برای دانلود خودِ مدل‌ها هم قطعاً به VPN نیاز دارید. بعد از نصب و دانلود مدل، دیگر به هیچ‌کدام نیاز ندارید.

حداقل سیستم مورد نیاز برای اجرای هوش مصنوعی محلی چیست؟

حدود ۸ گیگابایت رم کافی است. با یک مدل کوچک مثل Nemotron 3 Nano 4B که حدود ۲٫۸ گیگابایت است، روی لپ‌تاپ‌های قدیمی و بدون کارت گرافیک مجزا هم اجرا می‌شود.

اطلاعات و گفتگوهایم جایی ارسال می‌شود؟

خیر. مدل روی کامپیوتر خودتان اجرا می‌شود و چیزی به سرور بیرونی فرستاده نمی‌شود. این مهم‌ترین تفاوت اجرای محلی با سرویس‌های آنلاین است.

Context Length و GPU Offload یعنی چه؟

Context Length حافظهٔ کوتاه‌مدت مدل است؛ یعنی چقدر متن را همزمان می‌تواند در نظر بگیرد. GPU Offload مشخص می‌کند چه مقدار از مدل روی کارت گرافیک اجرا شود که چند برابر پردازنده سریع‌تر است. برای شروع لازم نیست تغییرشان بدهید.

ادامه یادگیری

مطلب‌های بعدی