صفحه اصلی > نرم‌افزارهای AI و نرم‌افزارهای ویندوز و دسکتاپ : دانلود Gemma 3 و Gemma 3n؛ نصب و اجرای هوش مصنوعی گوگل

دانلود Gemma 3 و Gemma 3n؛ نصب و اجرای هوش مصنوعی گوگل

دانلود Gemma 3 و Gemma 3n؛ نصب و اجرای هوش مصنوعی گوگل

دانلود Gemma 3 و Gemma 3n؛ اجرای مدل هوش مصنوعی گوگل روی کامپیوتر

مدل‌های Gemma 3 و Gemma 3n از خانواده مدل‌های هوش مصنوعی متن‌باز گوگل هستند که برای اجرای وظایف مختلف هوش مصنوعی روی رایانه، لپ‌تاپ، تبلت و حتی گوشی طراحی شده‌اند. این مدل‌ها می‌توانند برای چت، تولید محتوا، خلاصه‌سازی، ترجمه، برنامه‌نویسی، پاسخ‌گویی به پرسش‌ها و در برخی نسخه‌ها برای تحلیل تصویر استفاده شوند.

برخلاف بسیاری از ابزارهای آنلاین، می‌توان مدل‌های Gemma را به‌صورت محلی و با استفاده از ابزارهایی مانند Ollama اجرا کرد. در این حالت، درخواست‌های شما برای پردازش معمولی نیاز نیست به یک سرویس ابری ارسال شوند و کنترل بیشتری روی فایل‌ها و اطلاعات خود خواهید داشت.

در این مطلب از ترفندا، تفاوت Gemma 3 و Gemma 3n، نسخه‌های مختلف، قابلیت‌ها، حجم تقریبی، روش دانلود و نصب با Ollama، نیازمندی‌های سخت‌افزاری، کاربردها و محدودیت‌های این مدل‌ها را بررسی می‌کنیم.

خلاصه سریع: Gemma 3 برای اجرای مدل‌های متنی و تصویری در اندازه‌های مختلف مناسب است؛ اما Gemma 3n با تمرکز ویژه بر اجرای کم‌مصرف روی گوشی، تبلت و لپ‌تاپ ساخته شده و ورودی متن، تصویر، ویدئو و صدا را پشتیبانی می‌کند.

Gemma 3 چیست؟

Gemma 3 خانواده‌ای از مدل‌های زبانی سبک و بازِ گوگل است که با الهام از فناوری مدل‌های پیشرفته این شرکت توسعه داده شده‌اند. این مدل‌ها نسبت به مدل‌های بسیار بزرگ ابعاد کوچک‌تری دارند و می‌توانند روی سخت‌افزارهای شخصی اجرا شوند.

Gemma 3 در اندازه‌های مختلف عرضه شده است تا کاربران بتوانند بر اساس مقدار RAM، قدرت پردازنده، کارت گرافیک و نوع استفاده، مدل مناسب را انتخاب کنند. نسخه‌های کوچک‌تر برای چت و تولید متن روی سیستم‌های معمولی مناسب‌تر هستند، در حالی که مدل‌های 12B و 27B به منابع سخت‌افزاری بیشتری نیاز دارند، اما در وظایف پیچیده‌تر عملکرد قدرتمندتری ارائه می‌دهند.

مدل‌های 4B، 12B و 27B از ورودی تصویر پشتیبانی می‌کنند و می‌توانند علاوه بر متن، محتوای تصویری را نیز تحلیل کنند. نسخه‌های 270M و 1B عمدتاً متنی هستند و برای سیستم‌های ضعیف‌تر یا استفاده‌های سبک‌تر گزینه مناسب‌تری محسوب می‌شوند.

Gemma 3n چیست؟

Gemma 3n نسخه‌ای از خانواده Gemma است که با تمرکز بر اجرای کارآمد روی دستگاه‌های روزمره ساخته شده است. حرف n در نام آن به نسل جدیدی از طراحی مدل اشاره دارد که برای اجرای چندوجهی و کم‌مصرف روی دستگاه‌هایی مانند تلفن همراه، تبلت و لپ‌تاپ بهینه شده است.

Gemma 3n در دو اندازه اصلی E2B و E4B ارائه می‌شود. حرف E نشان‌دهنده تعداد «پارامترهای مؤثر» است و لزوماً به معنی تعداد کل پارامترهای ذخیره‌شده در مدل نیست. به همین دلیل، این مدل‌ها می‌توانند با منابع محدودتر، قابلیت‌هایی نزدیک به مدل‌های بزرگ‌تر ارائه کنند.

یکی از تفاوت‌های مهم Gemma 3n با نسخه‌های پایه Gemma 3، پشتیبانی گسترده‌تر از ورودی‌های چندرسانه‌ای است. Gemma 3n می‌تواند متن، تصویر، ویدئو و صدا را دریافت کند و خروجی متنی تولید نماید.

تفاوت Gemma 3 و Gemma 3n در یک نگاه

ویژگی Gemma 3 Gemma 3n
نسخه‌ها 270M، 1B، 4B، 12B و 27B E2B و E4B
ورودی‌ها متن؛ تصویر در نسخه‌های 4B به بالا متن، تصویر، ویدئو و صدا
پنجره زمینه 32K در 270M و 1B؛ 128K در 4B، 12B و 27B حداکثر 32K توکن
هدف اصلی چت، تولید متن، استدلال و تحلیل تصویر اجرای چندوجهی و کم‌مصرف روی دستگاه‌های شخصی
دستگاه مناسب کامپیوتر، لپ‌تاپ و سرورهای شخصی گوشی، تبلت، لپ‌تاپ و دستگاه‌های کم‌منبع

نسخه‌های مختلف Gemma 3

مدل Gemma 3 در پنج اندازه اصلی عرضه می‌شود. عدد کنار نام مدل، تعداد تقریبی پارامترهای آن را نشان می‌دهد. هرچه تعداد پارامترها بیشتر باشد، معمولاً مدل برای وظایف پیچیده‌تر توانمندتر است؛ اما به RAM، فضای ذخیره‌سازی و قدرت پردازشی بیشتری نیاز دارد.

مدل نوع ورودی پنجره زمینه حجم تقریبی در Ollama مناسب برای
gemma3:270m متن 32K حدود 292 مگابایت کارهای بسیار سبک و آزمایشی
gemma3:1b متن 32K حدود 815 مگابایت سیستم‌های ضعیف و پاسخ‌های کوتاه
gemma3:4b متن و تصویر 128K حدود 3.3 گیگابایت چت روزمره و تحلیل تصویر
gemma3:12b متن و تصویر 128K حدود 8.1 گیگابایت تولید محتوا و استدلال قوی‌تر
gemma3:27b متن و تصویر 128K حدود 17 گیگابایت کارهای سنگین‌تر و سیستم‌های قدرتمند

حجم‌های جدول تقریبی هستند و ممکن است بر اساس نوع کوانتایز، قالب فایل، نسخه مدل و تگ انتخابی تغییر کنند. نسخه‌های کوانتایزشده معمولاً فضای کمتری نسبت به نسخه‌های دقیق‌تر مانند FP16 یا BF16 اشغال می‌کنند.

Gemma 3n چه نسخه‌هایی دارد؟

Gemma 3n در دو مدل اصلی E2B و E4B عرضه می‌شود. این مدل‌ها از معماری‌هایی استفاده می‌کنند که بخشی از پارامترها را به‌صورت انتخابی فعال می‌کنند. در نتیجه، تعداد پارامترهای مؤثر هنگام اجرا با تعداد کل پارامترهای ذخیره‌شده یکسان نیست.

تگ Ollama حجم تقریبی پنجره زمینه کاربرد پیشنهادی
gemma3n:e2b حدود 5.6 گیگابایت 32K گوشی، تبلت و دستگاه‌های کم‌منبع
gemma3n:e4b حدود 7.5 گیگابایت 32K لپ‌تاپ و گوشی‌های قدرتمندتر
gemma3n:e2b-it-fp16 حدود 8.9 گیگابایت 32K اجرای دقیق‌تر با مصرف فضای بیشتر
gemma3n:e4b-it-fp16 حدود 14 گیگابایت 32K سیستم‌های دارای RAM و فضای ذخیره‌سازی بیشتر

قابلیت‌های اصلی Gemma 3

پردازش متن

تمام نسخه‌های اصلی Gemma 3 برای کار با متن طراحی شده‌اند. از آن‌ها می‌توان برای پاسخ‌گویی به پرسش‌ها، بازنویسی، خلاصه‌سازی، ترجمه، دسته‌بندی متن و تولید پیش‌نویس استفاده کرد. کیفیت پاسخ به نسخه انتخابی، زبان، نوع درخواست و سخت‌افزار وابسته است.

تحلیل تصویر

نسخه‌های 4B، 12B و 27B امکان دریافت تصویر و تولید پاسخ متنی بر اساس محتوای تصویر را دارند. این قابلیت برای توصیف تصاویر، خواندن برخی محتوای تصویری، بررسی نمودارهای ساده و پرسش‌وپاسخ درباره عکس کاربرد دارد. دقت مدل در OCR فارسی یا تحلیل تصاویر پیچیده باید به‌صورت عملی آزمایش شود.

پنجره زمینه بزرگ

نسخه‌های 4B، 12B و 27B Gemma 3 از پنجره زمینه حداکثر 128 هزار توکن برخوردارند. این ظرفیت برای کار با متن‌های طولانی، اسناد بزرگ و مکالمه‌های طولانی مفید است. نسخه‌های 270M و 1B پنجره زمینه 32 هزار توکنی دارند.

پشتیبانی زبانی

خانواده Gemma برای استفاده در زبان‌های مختلف توسعه داده شده است و منابع رسمی از پشتیبانی گسترده زبانی صحبت می‌کنند. بااین‌حال، کیفیت پاسخ در فارسی ممکن است بین مدل‌ها و وظایف مختلف تفاوت داشته باشد. برای تولید محتوای حرفه‌ای فارسی، ویرایش انسانی همچنان ضروری است.

قابلیت‌های ویژه Gemma 3n

Gemma 3n با هدف اجرای کم‌مصرف روی دستگاه‌های روزمره توسعه داده شده است. این مدل از چند فناوری برای کاهش مصرف حافظه، محاسبات، انرژی و زمان پاسخ استفاده می‌کند.

  • معماری MatFormer: امکان فعال‌سازی انتخابی بخشی از پارامترها را فراهم می‌کند.
  • کش‌کردن PLE: بخشی از نمایش‌های لایه‌ای می‌تواند روی ذخیره‌سازی سریع محلی نگهداری شود.
  • بارگذاری شرطی: پارامترهای مرتبط با صدا و تصویر در صورت نیاز بارگذاری می‌شوند.
  • پردازش چندوجهی: امکان دریافت متن، تصویر، ویدئو و صدا وجود دارد.
  • اجرای روی دستگاه: مدل برای موبایل، تبلت و لپ‌تاپ بهینه شده است.

در Gemma 3n، مدل E4B شامل پارامترهای مدل E2B است و معماری مدل امکان ساخت اندازه‌های میانی بین 2B و 4B را نیز فراهم می‌کند. این طراحی به توسعه‌دهندگان کمک می‌کند تعادل مناسب‌تری میان کیفیت و مصرف منابع ایجاد کنند.

دانلود Gemma 3 و Gemma 3n با Ollama

یکی از ساده‌ترین روش‌ها برای اجرای Gemma روی ویندوز، مک و لینوکس استفاده از Ollama است. Ollama امکان دانلود مدل، اجرای چت محلی و استفاده از API را از طریق خط فرمان فراهم می‌کند.

مراحل نصب Ollama

  1. به صفحه رسمی دانلود Ollama بروید.
  2. نسخه مناسب سیستم‌عامل خود را دریافت کنید.
  3. فایل نصب را اجرا و مراحل نصب را کامل کنید.
  4. ترمینال یا PowerShell را باز کنید.
  5. برای بررسی نصب، دستور زیر را اجرا کنید.
ollama --version

اجرای Gemma 3

برای اجرای مدل‌های مختلف، نام تگ را بعد از دستور ollama run قرار دهید:

ollama run gemma3:1b

اگر سیستم شما منابع بیشتری دارد، می‌توانید نسخه 4B را امتحان کنید:

ollama run gemma3:4b

برای مدل‌های قدرتمندتر نیز می‌توان از دستورات زیر استفاده کرد:

ollama run gemma3:12b
ollama run gemma3:27b

اجرای Gemma 3n

برای آزمایش نسخه کم‌مصرف‌تر Gemma 3n، ابتدا مدل E2B را اجرا کنید:

ollama run gemma3n:e2b

اگر لپ‌تاپ یا کامپیوتر شما منابع بیشتری دارد، مدل E4B گزینه مناسب‌تری است:

ollama run gemma3n:e4b

پس از اجرای دستور، Ollama در صورت نیاز مدل را دانلود می‌کند و محیط گفت‌وگو را در ترمینال در اختیار شما قرار می‌دهد. زمان دانلود به سرعت اینترنت و حجم مدل بستگی دارد.

کدام نسخه Gemma برای سیستم من مناسب است؟

انتخاب مدل به RAM، کارت گرافیک، سیستم‌عامل و نوع کاری که انجام می‌دهید بستگی دارد. حجم فایل مدل به‌تنهایی معیار کاملی برای انتخاب نیست؛ هنگام اجرا، مدل به حافظه اضافی برای پردازش ورودی و تولید پاسخ نیز نیاز دارد.

وضعیت سیستم مدل پیشنهادی برای شروع کاربرد مناسب نکته
سیستم بسیار ضعیف gemma3:270m یا gemma3:1b پاسخ‌های کوتاه و آزمایش مدل محلی سرعت و کیفیت محدودتر است.
لپ‌تاپ معمولی gemma3:4b یا gemma3n:e2b چت، خلاصه‌سازی و تولید محتوای سبک برای شروع انتخاب متعادل‌تری است.
لپ‌تاپ قدرتمند یا GPU معمولی gemma3:12b یا gemma3n:e4b تولید محتوای بهتر و وظایف پیچیده‌تر مصرف حافظه و زمان پردازش بیشتر است.
سیستم حرفه‌ای gemma3:27b استدلال و پردازش‌های سنگین‌تر به RAM، فضای ذخیره‌سازی و قدرت پردازشی بالا نیاز دارد.

اگر هدف شما اجرای مدل روی گوشی یا تبلت است، Gemma 3n به‌طور خاص گزینه قابل بررسی‌تری است. برای اجرای دسکتاپی با Ollama، Gemma 3 4B معمولاً نقطه شروع مناسبی برای بسیاری از کاربران محسوب می‌شود.

کاربردهای Gemma 3 و Gemma 3n

تولید و بازنویسی محتوا

می‌توانید از این مدل‌ها برای ساخت پیش‌نویس مقاله، بازنویسی متن، پیشنهاد عنوان، خلاصه‌سازی و اصلاح ساختار محتوا استفاده کنید. برای محتوای فارسی، بهتر است دستورها را دقیق بنویسید و خروجی را از نظر لحن، واقعیت اطلاعات و نگارش بررسی کنید.

خلاصه‌سازی اسناد

مدل‌های دارای پنجره زمینه بزرگ برای خلاصه‌سازی متن‌های طولانی کاربرد دارند. می‌توانید یک گزارش، مقاله یا متن آموزشی را به بخش‌های مشخص تقسیم کنید و از مدل بخواهید نکات اصلی، اصطلاحات یا نتیجه‌گیری را استخراج کند.

کمک به برنامه‌نویسی

Gemma می‌تواند برای توضیح کد، نوشتن نمونه‌های ساده، شناسایی خطاهای رایج و پیشنهاد ساختار برنامه به کار رود. مانند هر مدل زبانی دیگر، کد تولیدشده باید اجرا، آزمایش و از نظر امنیتی بررسی شود.

تحلیل تصویر

نسخه‌های تصویری Gemma 3 برای توصیف تصویر و پاسخ‌گویی به پرسش‌های مرتبط با عکس مناسب هستند. برای استخراج دقیق متن فارسی از تصویر، بهتر است نتیجه را با یک ابزار تخصصی OCR نیز مقایسه کنید؛ زیرا مدل بینایی عمومی الزاماً جایگزین کامل OCR تخصصی نیست.

ساخت دستیار خصوصی

با استفاده از Ollama و API داخلی آن، توسعه‌دهندگان می‌توانند نمونه اولیه یک دستیار محلی بسازند. چنین دستیارهایی می‌توانند برای جست‌وجو در فایل‌ها، پاسخ به پرسش‌های داخلی سازمان، تولید متن یا کمک به تیم پشتیبانی استفاده شوند.

نسخه‌های کوانتایزشده Gemma چه هستند؟

کوانتایز کردن روشی برای کاهش حجم و مصرف حافظه مدل است. در این فرایند، نمایش عددی وزن‌های مدل با دقت پایین‌تری ذخیره می‌شود تا اجرا روی سخت‌افزارهای معمولی آسان‌تر شود.

نسخه‌های کوانتایزشده معمولاً فضای کمتری اشغال می‌کنند و ممکن است سرعت اجرای بهتری روی سیستم‌های محدود داشته باشند. در مقابل، بسته به نوع کوانتایز ممکن است مقداری از کیفیت، دقت یا پایداری پاسخ کاهش پیدا کند. برای استفاده روزمره، نسخه‌های کوانتایزشده انتخاب مناسبی هستند؛ اما برای آزمایش‌های تخصصی باید تفاوت کیفیت آن‌ها را با نسخه‌های دقیق‌تر بررسی کنید.

در کتابخانه Ollama می‌توانید تگ‌های مختلفی مانند نسخه‌های QAT، Q8 و FP16 را مشاهده کنید. نام تگ دقیق، حجم مدل و نیازمندی‌های آن ممکن است با به‌روزرسانی کتابخانه تغییر کند.

مزایای اجرای Gemma به‌صورت محلی

  • کاهش وابستگی به سرویس‌های ابری برای کارهای روزمره
  • امکان استفاده از مدل حتی در زمان قطعی اینترنت پس از دانلود
  • کنترل بیشتر روی فایل‌ها و ورودی‌های شخصی
  • امکان آزمایش مدل‌های مختلف بدون پرداخت هزینه هر درخواست
  • قابلیت اتصال به نرم‌افزارها از طریق API محلی Ollama
  • مناسب برای توسعه نمونه اولیه ابزارهای هوش مصنوعی

محدودیت‌ها و نکات مهم قبل از نصب

  • مدل‌های محلی به فضای ذخیره‌سازی قابل توجهی نیاز دارند.
  • مدل‌های بزرگ‌تر ممکن است روی CPU معمولی کند اجرا شوند.
  • کیفیت زبان فارسی در همه نسخه‌ها یکسان نیست.
  • مدل ممکن است اطلاعات نادرست تولید کند؛ پاسخ‌های مهم را بررسی کنید.
  • اجرای مدل‌های تصویری به نسخه مناسب Ollama و سخت‌افزار کافی نیاز دارد.
  • حجم تگ‌ها و مدل‌ها ممکن است با تغییر نسخه کتابخانه تغییر کند.
  • مجوز مدل و شرایط استفاده تجاری را پیش از استفاده در محصول نهایی مطالعه کنید.

Gemma 3 بهتر است یا Gemma 3n؟

پاسخ به این پرسش به دستگاه و نوع استفاده شما بستگی دارد. اگر به یک مدل متنی یا تصویری برای اجرای دسکتاپی نیاز دارید و می‌خواهید اندازه‌های مختلفی در اختیار داشته باشید، Gemma 3 انتخاب انعطاف‌پذیرتری است. نسخه 4B برای شروع و نسخه‌های 12B و 27B برای سیستم‌های قدرتمندتر مناسب هستند.

اگر اجرای مدل روی گوشی، تبلت یا لپ‌تاپ کم‌مصرف برایتان اهمیت دارد و می‌خواهید ورودی‌های صوتی و تصویری را نیز آزمایش کنید، Gemma 3n گزینه جذاب‌تری است. مدل E2B برای دستگاه‌های محدودتر و E4B برای دستگاه‌های قوی‌تر طراحی شده است.

پیشنهاد برای شروع: کاربران کامپیوتر می‌توانند ابتدا gemma3:4b را امتحان کنند. برای آزمایش اجرای کم‌مصرف و چندوجهی، gemma3n:e2b نقطه شروع مناسبی است.

سوالات متداول درباره Gemma 3 و Gemma 3n

آیا Gemma 3 رایگان است؟

وزن مدل‌های Gemma برای استفاده در ابزارها و محیط‌های مختلف منتشر شده‌اند، اما باید شرایط مجوز و قوانین استفاده مسئولانه گوگل را پیش از استفاده تجاری یا انتشار محصول بررسی کنید.

آیا Gemma 3 روی ویندوز اجرا می‌شود؟

بله. با نصب Ollama در ویندوز می‌توانید مدل‌هایی مانند gemma3:1b یا gemma3:4b را دانلود و اجرا کنید.

برای سیستم ضعیف کدام مدل Gemma مناسب است؟

نسخه‌های 270m و 1b از Gemma 3 برای شروع روی سیستم‌های ضعیف مناسب‌تر هستند. Gemma 3n E2B نیز برای اجرای کم‌مصرف طراحی شده، اما حجم فایل آن با نسخه‌های کوچک متنی یکسان نیست.

آیا Gemma 3 از تصویر پشتیبانی می‌کند؟

بله، اما طبق جدول رسمی مدل‌ها، قابلیت دریافت تصویر در نسخه‌های 4B، 12B و 27B Gemma 3 ارائه می‌شود. نسخه‌های 270M و 1B برای ورودی متنی هستند.

آیا Gemma 3n صدا و ویدئو را می‌فهمد؟

Gemma 3n برای دریافت متن، تصویر، ویدئو و صدا طراحی شده است و خروجی آن متنی است. نحوه استفاده از هر ورودی ممکن است به ابزار اجرا، نسخه مدل و پلتفرم بستگی داشته باشد.

حجم Gemma 3 در Ollama چقدر است؟

حجم تقریبی مدل‌ها از حدود 292 مگابایت برای نسخه 270M تا حدود 17 گیگابایت برای نسخه 27B متغیر است. نوع تگ و کوانتایز می‌تواند حجم نهایی را تغییر دهد.

آیا Gemma برای تولید محتوای فارسی مناسب است؟

Gemma می‌تواند متن فارسی تولید کند، اما کیفیت خروجی به نسخه مدل، دستور شما و پیچیدگی موضوع وابسته است. برای انتشار حرفه‌ای، متن باید از نظر واقعیت اطلاعات، نگارش، نیم‌فاصله و لحن بازبینی شود.

جمع‌بندی

Gemma 3 و Gemma 3n دو گزینه مهم برای اجرای مدل‌های هوش مصنوعی گوگل روی دستگاه‌های شخصی هستند. Gemma 3 با نسخه‌های 270M، 1B، 4B، 12B و 27B انتخاب‌های متنوعی برای سیستم‌های مختلف ارائه می‌دهد و در نسخه‌های بزرگ‌تر از تصویر نیز پشتیبانی می‌کند.

Gemma 3n بیشتر بر اجرای چندوجهی و کم‌مصرف تمرکز دارد و می‌تواند متن، تصویر، ویدئو و صدا را دریافت کند. این مدل برای گوشی، تبلت و لپ‌تاپ طراحی شده و در دو نسخه E2B و E4B در دسترس است.

برای کاربران مبتدی، نصب Ollama و اجرای gemma3:4b یا gemma3n:e2b ساده‌ترین روش شروع است. پیش از دانلود، فضای ذخیره‌سازی، RAM و توان پردازشی سیستم خود را بررسی کنید و برای انتخاب نسخه نهایی، سرعت و کیفیت پاسخ را روی کار واقعی خود آزمایش نمایید.

نویسنده و مدیر محتوای ترفندا؛ علاقه‌مند به هوش مصنوعی، ابزارهای دیجیتال و ترفندهای کاربردی برای ساده‌تر کردن زندگی روزمره. در ترفندا تلاش می‌کنم ابزارها، اپلیکیشن‌ها و روش‌های هوشمندی را معرفی کنم که به کاربران کمک می‌کنند سریع‌تر یاد بگیرند، بهتر انتخاب کنند و از تکنولوژی استفاده مفیدتری داشته باشند.
مقالات مرتبط

دانلود AnythingLLM؛ چت با فایل‌های PDF با هوش مصنوعی

تصور کنید کتابخانه‌ای از هزاران فایل PDF، اسناد کاری و مقالات تحقیقاتی…

دانلود Ollama رایگان برای ویندوز، مک و لینوکس

اگر می‌خواهید مدل‌های زبانی بزرگ را بدون وابستگی به اینترنت و با…

دیدگاهتان را بنویسید