گوگل با رونمایی از خانواده مدلهای Gemma 4 تحول بزرگی در حوزه هوش مصنوعی متنباز ایجاد کرده است. این نسل جدید با پشتیبانی گسترده از ورودیهای صوتی، تصویری و ویدیویی، معماریهای پیشرفته و انتشار تحت مجوز آزاد Apache 2.0، یکی از مهمترین بهروزرسانیهای اکوسیستم متنباز AI بهشمار میرود.
به گزارش آی سی تی نیوز گوگل بهصورت رسمی نسل تازهای از مدلهای هوش مصنوعی متنباز خود را با نام Gemma 4 معرفی کرد؛ مجموعهای قدرتمند که در چهار اندازه مختلف ارائه شده و همگی توانایی پردازش تصویر و ویدیو را دارند. دو مدل کوچکتر این خانواده حتی از ورودی صوتی نیز پشتیبانی میکنند تا کاربردهای گستردهتری برای توسعهدهندگان و کاربران فراهم شود.
دو نسخه سبک با ۲ میلیارد و ۴ میلیارد پارامتر که با نامهای E2B و E4B شناخته میشوند، برای دستگاههای معمولی مانند گوشیهای هوشمند طراحی شدهاند. این مدلها علاوهبر اجرای سریع، مصرف انرژی بسیار پایینی دارند. در مقابل، مدل قدرتمند۲۶ میلیارد پارامتری با معماری MoE و نسخه ۳۱ میلیارد پارامتری با معماری Dense برای سیستمهای پیشرفته و حرفهای در نظر گرفته شدهاند.
از نظر عملکرد نیز خانواده Gemma 4 نتایج چشمگیری ثبت کرده است. در رتبهبندی Arena AI، مدل ۳۱ میلیارد پارامتری موفق شده رتبه سوم جهان را میان مدلهای متنباز کسب کند و نسخه ۲۶ میلیاردی نیز در رتبه ششم قرار گرفته است. گوگل اعلام کرده این مدلها حتی رقبای ۲۰ برابر بزرگتر از خود را پشت سر گذاشتهاند.
قابلیتهای کلیدی Gemma 4 تنها به ورودیهای چندرسانهای محدود نمیشود. این نسل جدید از تولید کد آفلاین، پشتیبانی از بیش از ۱۴۰ زبان زنده دنیا و حالتی ویژه با نام حالت تفکر پشتیبانی میکند که امکان استدلال گامبهگام و دقیقتر را فراهم میسازد.
یکی از بزرگترین تغییرات این سری، انتشار تمامی مدلها تحت مجوز آزاد Apache 2.0است. در نتیجه، توسعهدهندگان میتوانند بدون محدودیت از مدلها استفاده تجاری داشته باشند، آنها را سفارشیسازی کنند، کنترل دادهها را در دست بگیرند و در محیطهای مختلف بهصورت امن مستقر نمایند.
مدلهای Gemma 4 از هماکنون روی پلتفرمهایی مانند Hugging Face، Ollama، Google AI Studio و Kaggle قابل دریافت و استفاده هستند.