دانلود Gemma 3 و Gemma 3n؛ اجرای مدل هوش مصنوعی گوگل روی کامپیوتر
مدلهای Gemma 3 و Gemma 3n از خانواده مدلهای هوش مصنوعی متنباز گوگل هستند که برای اجرای وظایف مختلف هوش مصنوعی روی رایانه، لپتاپ، تبلت و حتی گوشی طراحی شدهاند. این مدلها میتوانند برای چت، تولید محتوا، خلاصهسازی، ترجمه، برنامهنویسی، پاسخگویی به پرسشها و در برخی نسخهها برای تحلیل تصویر استفاده شوند.
برخلاف بسیاری از ابزارهای آنلاین، میتوان مدلهای Gemma را بهصورت محلی و با استفاده از ابزارهایی مانند Ollama اجرا کرد. در این حالت، درخواستهای شما برای پردازش معمولی نیاز نیست به یک سرویس ابری ارسال شوند و کنترل بیشتری روی فایلها و اطلاعات خود خواهید داشت.
در این مطلب از ترفندا، تفاوت Gemma 3 و Gemma 3n، نسخههای مختلف، قابلیتها، حجم تقریبی، روش دانلود و نصب با Ollama، نیازمندیهای سختافزاری، کاربردها و محدودیتهای این مدلها را بررسی میکنیم.
Gemma 3 چیست؟
Gemma 3 خانوادهای از مدلهای زبانی سبک و بازِ گوگل است که با الهام از فناوری مدلهای پیشرفته این شرکت توسعه داده شدهاند. این مدلها نسبت به مدلهای بسیار بزرگ ابعاد کوچکتری دارند و میتوانند روی سختافزارهای شخصی اجرا شوند.
Gemma 3 در اندازههای مختلف عرضه شده است تا کاربران بتوانند بر اساس مقدار RAM، قدرت پردازنده، کارت گرافیک و نوع استفاده، مدل مناسب را انتخاب کنند. نسخههای کوچکتر برای چت و تولید متن روی سیستمهای معمولی مناسبتر هستند، در حالی که مدلهای 12B و 27B به منابع سختافزاری بیشتری نیاز دارند، اما در وظایف پیچیدهتر عملکرد قدرتمندتری ارائه میدهند.
مدلهای 4B، 12B و 27B از ورودی تصویر پشتیبانی میکنند و میتوانند علاوه بر متن، محتوای تصویری را نیز تحلیل کنند. نسخههای 270M و 1B عمدتاً متنی هستند و برای سیستمهای ضعیفتر یا استفادههای سبکتر گزینه مناسبتری محسوب میشوند.
Gemma 3n چیست؟
Gemma 3n نسخهای از خانواده Gemma است که با تمرکز بر اجرای کارآمد روی دستگاههای روزمره ساخته شده است. حرف n در نام آن به نسل جدیدی از طراحی مدل اشاره دارد که برای اجرای چندوجهی و کممصرف روی دستگاههایی مانند تلفن همراه، تبلت و لپتاپ بهینه شده است.
Gemma 3n در دو اندازه اصلی E2B و E4B ارائه میشود. حرف E نشاندهنده تعداد «پارامترهای مؤثر» است و لزوماً به معنی تعداد کل پارامترهای ذخیرهشده در مدل نیست. به همین دلیل، این مدلها میتوانند با منابع محدودتر، قابلیتهایی نزدیک به مدلهای بزرگتر ارائه کنند.
یکی از تفاوتهای مهم Gemma 3n با نسخههای پایه Gemma 3، پشتیبانی گستردهتر از ورودیهای چندرسانهای است. Gemma 3n میتواند متن، تصویر، ویدئو و صدا را دریافت کند و خروجی متنی تولید نماید.
تفاوت Gemma 3 و Gemma 3n در یک نگاه
| ویژگی | Gemma 3 | Gemma 3n |
|---|---|---|
| نسخهها | 270M، 1B، 4B، 12B و 27B | E2B و E4B |
| ورودیها | متن؛ تصویر در نسخههای 4B به بالا | متن، تصویر، ویدئو و صدا |
| پنجره زمینه | 32K در 270M و 1B؛ 128K در 4B، 12B و 27B | حداکثر 32K توکن |
| هدف اصلی | چت، تولید متن، استدلال و تحلیل تصویر | اجرای چندوجهی و کممصرف روی دستگاههای شخصی |
| دستگاه مناسب | کامپیوتر، لپتاپ و سرورهای شخصی | گوشی، تبلت، لپتاپ و دستگاههای کممنبع |
نسخههای مختلف Gemma 3
مدل Gemma 3 در پنج اندازه اصلی عرضه میشود. عدد کنار نام مدل، تعداد تقریبی پارامترهای آن را نشان میدهد. هرچه تعداد پارامترها بیشتر باشد، معمولاً مدل برای وظایف پیچیدهتر توانمندتر است؛ اما به RAM، فضای ذخیرهسازی و قدرت پردازشی بیشتری نیاز دارد.
| مدل | نوع ورودی | پنجره زمینه | حجم تقریبی در Ollama | مناسب برای |
|---|---|---|---|---|
gemma3:270m |
متن | 32K | حدود 292 مگابایت | کارهای بسیار سبک و آزمایشی |
gemma3:1b |
متن | 32K | حدود 815 مگابایت | سیستمهای ضعیف و پاسخهای کوتاه |
gemma3:4b |
متن و تصویر | 128K | حدود 3.3 گیگابایت | چت روزمره و تحلیل تصویر |
gemma3:12b |
متن و تصویر | 128K | حدود 8.1 گیگابایت | تولید محتوا و استدلال قویتر |
gemma3:27b |
متن و تصویر | 128K | حدود 17 گیگابایت | کارهای سنگینتر و سیستمهای قدرتمند |
حجمهای جدول تقریبی هستند و ممکن است بر اساس نوع کوانتایز، قالب فایل، نسخه مدل و تگ انتخابی تغییر کنند. نسخههای کوانتایزشده معمولاً فضای کمتری نسبت به نسخههای دقیقتر مانند FP16 یا BF16 اشغال میکنند.
Gemma 3n چه نسخههایی دارد؟
Gemma 3n در دو مدل اصلی E2B و E4B عرضه میشود. این مدلها از معماریهایی استفاده میکنند که بخشی از پارامترها را بهصورت انتخابی فعال میکنند. در نتیجه، تعداد پارامترهای مؤثر هنگام اجرا با تعداد کل پارامترهای ذخیرهشده یکسان نیست.
| تگ Ollama | حجم تقریبی | پنجره زمینه | کاربرد پیشنهادی |
|---|---|---|---|
gemma3n:e2b |
حدود 5.6 گیگابایت | 32K | گوشی، تبلت و دستگاههای کممنبع |
gemma3n:e4b |
حدود 7.5 گیگابایت | 32K | لپتاپ و گوشیهای قدرتمندتر |
gemma3n:e2b-it-fp16 |
حدود 8.9 گیگابایت | 32K | اجرای دقیقتر با مصرف فضای بیشتر |
gemma3n:e4b-it-fp16 |
حدود 14 گیگابایت | 32K | سیستمهای دارای RAM و فضای ذخیرهسازی بیشتر |
قابلیتهای اصلی Gemma 3
پردازش متن
تمام نسخههای اصلی Gemma 3 برای کار با متن طراحی شدهاند. از آنها میتوان برای پاسخگویی به پرسشها، بازنویسی، خلاصهسازی، ترجمه، دستهبندی متن و تولید پیشنویس استفاده کرد. کیفیت پاسخ به نسخه انتخابی، زبان، نوع درخواست و سختافزار وابسته است.
تحلیل تصویر
نسخههای 4B، 12B و 27B امکان دریافت تصویر و تولید پاسخ متنی بر اساس محتوای تصویر را دارند. این قابلیت برای توصیف تصاویر، خواندن برخی محتوای تصویری، بررسی نمودارهای ساده و پرسشوپاسخ درباره عکس کاربرد دارد. دقت مدل در OCR فارسی یا تحلیل تصاویر پیچیده باید بهصورت عملی آزمایش شود.
پنجره زمینه بزرگ
نسخههای 4B، 12B و 27B Gemma 3 از پنجره زمینه حداکثر 128 هزار توکن برخوردارند. این ظرفیت برای کار با متنهای طولانی، اسناد بزرگ و مکالمههای طولانی مفید است. نسخههای 270M و 1B پنجره زمینه 32 هزار توکنی دارند.
پشتیبانی زبانی
خانواده Gemma برای استفاده در زبانهای مختلف توسعه داده شده است و منابع رسمی از پشتیبانی گسترده زبانی صحبت میکنند. بااینحال، کیفیت پاسخ در فارسی ممکن است بین مدلها و وظایف مختلف تفاوت داشته باشد. برای تولید محتوای حرفهای فارسی، ویرایش انسانی همچنان ضروری است.
قابلیتهای ویژه Gemma 3n
Gemma 3n با هدف اجرای کممصرف روی دستگاههای روزمره توسعه داده شده است. این مدل از چند فناوری برای کاهش مصرف حافظه، محاسبات، انرژی و زمان پاسخ استفاده میکند.
- معماری MatFormer: امکان فعالسازی انتخابی بخشی از پارامترها را فراهم میکند.
- کشکردن PLE: بخشی از نمایشهای لایهای میتواند روی ذخیرهسازی سریع محلی نگهداری شود.
- بارگذاری شرطی: پارامترهای مرتبط با صدا و تصویر در صورت نیاز بارگذاری میشوند.
- پردازش چندوجهی: امکان دریافت متن، تصویر، ویدئو و صدا وجود دارد.
- اجرای روی دستگاه: مدل برای موبایل، تبلت و لپتاپ بهینه شده است.
در Gemma 3n، مدل E4B شامل پارامترهای مدل E2B است و معماری مدل امکان ساخت اندازههای میانی بین 2B و 4B را نیز فراهم میکند. این طراحی به توسعهدهندگان کمک میکند تعادل مناسبتری میان کیفیت و مصرف منابع ایجاد کنند.
دانلود Gemma 3 و Gemma 3n با Ollama
یکی از سادهترین روشها برای اجرای Gemma روی ویندوز، مک و لینوکس استفاده از Ollama است. Ollama امکان دانلود مدل، اجرای چت محلی و استفاده از API را از طریق خط فرمان فراهم میکند.
مراحل نصب Ollama
- به صفحه رسمی دانلود Ollama بروید.
- نسخه مناسب سیستمعامل خود را دریافت کنید.
- فایل نصب را اجرا و مراحل نصب را کامل کنید.
- ترمینال یا PowerShell را باز کنید.
- برای بررسی نصب، دستور زیر را اجرا کنید.
ollama --version
اجرای Gemma 3
برای اجرای مدلهای مختلف، نام تگ را بعد از دستور ollama run قرار دهید:
ollama run gemma3:1b
اگر سیستم شما منابع بیشتری دارد، میتوانید نسخه 4B را امتحان کنید:
ollama run gemma3:4b
برای مدلهای قدرتمندتر نیز میتوان از دستورات زیر استفاده کرد:
ollama run gemma3:12b
ollama run gemma3:27b
اجرای Gemma 3n
برای آزمایش نسخه کممصرفتر Gemma 3n، ابتدا مدل E2B را اجرا کنید:
ollama run gemma3n:e2b
اگر لپتاپ یا کامپیوتر شما منابع بیشتری دارد، مدل E4B گزینه مناسبتری است:
ollama run gemma3n:e4b
پس از اجرای دستور، Ollama در صورت نیاز مدل را دانلود میکند و محیط گفتوگو را در ترمینال در اختیار شما قرار میدهد. زمان دانلود به سرعت اینترنت و حجم مدل بستگی دارد.
کدام نسخه Gemma برای سیستم من مناسب است؟
انتخاب مدل به RAM، کارت گرافیک، سیستمعامل و نوع کاری که انجام میدهید بستگی دارد. حجم فایل مدل بهتنهایی معیار کاملی برای انتخاب نیست؛ هنگام اجرا، مدل به حافظه اضافی برای پردازش ورودی و تولید پاسخ نیز نیاز دارد.
| وضعیت سیستم | مدل پیشنهادی برای شروع | کاربرد مناسب | نکته |
|---|---|---|---|
| سیستم بسیار ضعیف | gemma3:270m یا gemma3:1b |
پاسخهای کوتاه و آزمایش مدل محلی | سرعت و کیفیت محدودتر است. |
| لپتاپ معمولی | gemma3:4b یا gemma3n:e2b |
چت، خلاصهسازی و تولید محتوای سبک | برای شروع انتخاب متعادلتری است. |
| لپتاپ قدرتمند یا GPU معمولی | gemma3:12b یا gemma3n:e4b |
تولید محتوای بهتر و وظایف پیچیدهتر | مصرف حافظه و زمان پردازش بیشتر است. |
| سیستم حرفهای | gemma3:27b |
استدلال و پردازشهای سنگینتر | به RAM، فضای ذخیرهسازی و قدرت پردازشی بالا نیاز دارد. |
اگر هدف شما اجرای مدل روی گوشی یا تبلت است، Gemma 3n بهطور خاص گزینه قابل بررسیتری است. برای اجرای دسکتاپی با Ollama، Gemma 3 4B معمولاً نقطه شروع مناسبی برای بسیاری از کاربران محسوب میشود.
کاربردهای Gemma 3 و Gemma 3n
تولید و بازنویسی محتوا
میتوانید از این مدلها برای ساخت پیشنویس مقاله، بازنویسی متن، پیشنهاد عنوان، خلاصهسازی و اصلاح ساختار محتوا استفاده کنید. برای محتوای فارسی، بهتر است دستورها را دقیق بنویسید و خروجی را از نظر لحن، واقعیت اطلاعات و نگارش بررسی کنید.
خلاصهسازی اسناد
مدلهای دارای پنجره زمینه بزرگ برای خلاصهسازی متنهای طولانی کاربرد دارند. میتوانید یک گزارش، مقاله یا متن آموزشی را به بخشهای مشخص تقسیم کنید و از مدل بخواهید نکات اصلی، اصطلاحات یا نتیجهگیری را استخراج کند.
کمک به برنامهنویسی
Gemma میتواند برای توضیح کد، نوشتن نمونههای ساده، شناسایی خطاهای رایج و پیشنهاد ساختار برنامه به کار رود. مانند هر مدل زبانی دیگر، کد تولیدشده باید اجرا، آزمایش و از نظر امنیتی بررسی شود.
تحلیل تصویر
نسخههای تصویری Gemma 3 برای توصیف تصویر و پاسخگویی به پرسشهای مرتبط با عکس مناسب هستند. برای استخراج دقیق متن فارسی از تصویر، بهتر است نتیجه را با یک ابزار تخصصی OCR نیز مقایسه کنید؛ زیرا مدل بینایی عمومی الزاماً جایگزین کامل OCR تخصصی نیست.
ساخت دستیار خصوصی
با استفاده از Ollama و API داخلی آن، توسعهدهندگان میتوانند نمونه اولیه یک دستیار محلی بسازند. چنین دستیارهایی میتوانند برای جستوجو در فایلها، پاسخ به پرسشهای داخلی سازمان، تولید متن یا کمک به تیم پشتیبانی استفاده شوند.
نسخههای کوانتایزشده Gemma چه هستند؟
کوانتایز کردن روشی برای کاهش حجم و مصرف حافظه مدل است. در این فرایند، نمایش عددی وزنهای مدل با دقت پایینتری ذخیره میشود تا اجرا روی سختافزارهای معمولی آسانتر شود.
نسخههای کوانتایزشده معمولاً فضای کمتری اشغال میکنند و ممکن است سرعت اجرای بهتری روی سیستمهای محدود داشته باشند. در مقابل، بسته به نوع کوانتایز ممکن است مقداری از کیفیت، دقت یا پایداری پاسخ کاهش پیدا کند. برای استفاده روزمره، نسخههای کوانتایزشده انتخاب مناسبی هستند؛ اما برای آزمایشهای تخصصی باید تفاوت کیفیت آنها را با نسخههای دقیقتر بررسی کنید.
در کتابخانه Ollama میتوانید تگهای مختلفی مانند نسخههای QAT، Q8 و FP16 را مشاهده کنید. نام تگ دقیق، حجم مدل و نیازمندیهای آن ممکن است با بهروزرسانی کتابخانه تغییر کند.
مزایای اجرای Gemma بهصورت محلی
- کاهش وابستگی به سرویسهای ابری برای کارهای روزمره
- امکان استفاده از مدل حتی در زمان قطعی اینترنت پس از دانلود
- کنترل بیشتر روی فایلها و ورودیهای شخصی
- امکان آزمایش مدلهای مختلف بدون پرداخت هزینه هر درخواست
- قابلیت اتصال به نرمافزارها از طریق API محلی Ollama
- مناسب برای توسعه نمونه اولیه ابزارهای هوش مصنوعی
محدودیتها و نکات مهم قبل از نصب
- مدلهای محلی به فضای ذخیرهسازی قابل توجهی نیاز دارند.
- مدلهای بزرگتر ممکن است روی CPU معمولی کند اجرا شوند.
- کیفیت زبان فارسی در همه نسخهها یکسان نیست.
- مدل ممکن است اطلاعات نادرست تولید کند؛ پاسخهای مهم را بررسی کنید.
- اجرای مدلهای تصویری به نسخه مناسب Ollama و سختافزار کافی نیاز دارد.
- حجم تگها و مدلها ممکن است با تغییر نسخه کتابخانه تغییر کند.
- مجوز مدل و شرایط استفاده تجاری را پیش از استفاده در محصول نهایی مطالعه کنید.
Gemma 3 بهتر است یا Gemma 3n؟
پاسخ به این پرسش به دستگاه و نوع استفاده شما بستگی دارد. اگر به یک مدل متنی یا تصویری برای اجرای دسکتاپی نیاز دارید و میخواهید اندازههای مختلفی در اختیار داشته باشید، Gemma 3 انتخاب انعطافپذیرتری است. نسخه 4B برای شروع و نسخههای 12B و 27B برای سیستمهای قدرتمندتر مناسب هستند.
اگر اجرای مدل روی گوشی، تبلت یا لپتاپ کممصرف برایتان اهمیت دارد و میخواهید ورودیهای صوتی و تصویری را نیز آزمایش کنید، Gemma 3n گزینه جذابتری است. مدل E2B برای دستگاههای محدودتر و E4B برای دستگاههای قویتر طراحی شده است.
gemma3:4b را امتحان کنند. برای آزمایش اجرای کممصرف و چندوجهی، gemma3n:e2b نقطه شروع مناسبی است.سوالات متداول درباره Gemma 3 و Gemma 3n
آیا Gemma 3 رایگان است؟
وزن مدلهای Gemma برای استفاده در ابزارها و محیطهای مختلف منتشر شدهاند، اما باید شرایط مجوز و قوانین استفاده مسئولانه گوگل را پیش از استفاده تجاری یا انتشار محصول بررسی کنید.
آیا Gemma 3 روی ویندوز اجرا میشود؟
بله. با نصب Ollama در ویندوز میتوانید مدلهایی مانند gemma3:1b یا gemma3:4b را دانلود و اجرا کنید.
برای سیستم ضعیف کدام مدل Gemma مناسب است؟
نسخههای 270m و 1b از Gemma 3 برای شروع روی سیستمهای ضعیف مناسبتر هستند. Gemma 3n E2B نیز برای اجرای کممصرف طراحی شده، اما حجم فایل آن با نسخههای کوچک متنی یکسان نیست.
آیا Gemma 3 از تصویر پشتیبانی میکند؟
بله، اما طبق جدول رسمی مدلها، قابلیت دریافت تصویر در نسخههای 4B، 12B و 27B Gemma 3 ارائه میشود. نسخههای 270M و 1B برای ورودی متنی هستند.
آیا Gemma 3n صدا و ویدئو را میفهمد؟
Gemma 3n برای دریافت متن، تصویر، ویدئو و صدا طراحی شده است و خروجی آن متنی است. نحوه استفاده از هر ورودی ممکن است به ابزار اجرا، نسخه مدل و پلتفرم بستگی داشته باشد.
حجم Gemma 3 در Ollama چقدر است؟
حجم تقریبی مدلها از حدود 292 مگابایت برای نسخه 270M تا حدود 17 گیگابایت برای نسخه 27B متغیر است. نوع تگ و کوانتایز میتواند حجم نهایی را تغییر دهد.
آیا Gemma برای تولید محتوای فارسی مناسب است؟
Gemma میتواند متن فارسی تولید کند، اما کیفیت خروجی به نسخه مدل، دستور شما و پیچیدگی موضوع وابسته است. برای انتشار حرفهای، متن باید از نظر واقعیت اطلاعات، نگارش، نیمفاصله و لحن بازبینی شود.
جمعبندی
Gemma 3 و Gemma 3n دو گزینه مهم برای اجرای مدلهای هوش مصنوعی گوگل روی دستگاههای شخصی هستند. Gemma 3 با نسخههای 270M، 1B، 4B، 12B و 27B انتخابهای متنوعی برای سیستمهای مختلف ارائه میدهد و در نسخههای بزرگتر از تصویر نیز پشتیبانی میکند.
Gemma 3n بیشتر بر اجرای چندوجهی و کممصرف تمرکز دارد و میتواند متن، تصویر، ویدئو و صدا را دریافت کند. این مدل برای گوشی، تبلت و لپتاپ طراحی شده و در دو نسخه E2B و E4B در دسترس است.
برای کاربران مبتدی، نصب Ollama و اجرای gemma3:4b یا gemma3n:e2b سادهترین روش شروع است. پیش از دانلود، فضای ذخیرهسازی، RAM و توان پردازشی سیستم خود را بررسی کنید و برای انتخاب نسخه نهایی، سرعت و کیفیت پاسخ را روی کار واقعی خود آزمایش نمایید.

