آموزش Ollama: اجرای مدلهای هوش مصنوعی روی سرور خودتان
نصب Ollama 0.34 روی لینوکس با systemd، اجرای مدل روی GPU، انتخاب مدل بر اساس VRAM، API سازگار با OpenAI، ایمن سازی دسترسی شبکه و نصب روی سرور آفلاین.
مدلهای زبانی، مقایسهی سرویسها، ابزارها و زیرساخت اجرای هوش مصنوعی.
نصب Ollama 0.34 روی لینوکس با systemd، اجرای مدل روی GPU، انتخاب مدل بر اساس VRAM، API سازگار با OpenAI، ایمن سازی دسترسی شبکه و نصب روی سرور آفلاین.
برای اجرای مدل زبانی روی سرور چه GPU و چقدر VRAM لازم است؛ حساب حافظهی مدل و KV cache، نقش پهنای باند، مقایسهی GPUها، برق و خنک کنندگی و سه سناریوی نمونه.
DeepSeek یا ChatGPT؟ فرق دو سرویس در توانایی، هزینهی API، دسترسی از ایران، حریم خصوصی و اجرا روی سرور داخلی، و انتخاب برای کاربر، برنامه نویس و سازمان.
مقایسهی ChatGPT، Claude، Gemini و DeepSeek در شهریور ۱۴۰۵؛ مدلها، نقاط قوت، دسترسی از ایران، حریم خصوصی و انتخاب برای کدنویسی، اسناد و اجرای داخلی.
مدل زبانی بزرگ (LLM) چطور متن میسازد؛ توکن، پارامتر، پنجرهی context، مراحل آموزش، علت اطلاعات غلط و سخت افزار لازم برای اجرا، به زبان مهندس زیرساخت.