به گزارش آی سی تی نیوز؛ گوگل با معرفی Gemini 4 Argon وارد مرحله تازه‌ای از رقابت مدل‌های هوش مصنوعی شده است؛ مدلی که تمرکز آن فقط بر پاسخ‌گویی به پرسش‌های روزمره نیست و برای انجام وظایف پیچیده، مهندسی نرم‌افزار، کارهای سازمانی و امنیت سایبری توسعه یافته است. هم‌زمان، گوگل قابلیت‌های تازه‌ای برای تولید ویدئوی رایگان با هوش مصنوعی نیز ارائه کرده که بخشی از موج جدید محصولات این شرکت در حوزه هوش مصنوعی محسوب می‌شود.

Gemini 4 Argon؛ تمرکز بر کارهای پیچیده

گوگل می‌گوید Gemini 4 Argon برای اجرای workflowهای پیچیده طراحی شده و در حوزه‌هایی مانند مهندسی نرم‌افزار، دانش سازمانی، امور حقوقی و مالی و امنیت سایبری عملکرد سطح بالایی دارد.

یکی از ویژگی‌های مهم این مدل، امکان کار با یک میلیون توکن خروجی است؛ ظرفیتی که برای پروژه‌های طولانی، بررسی حجم زیادی از کد و انجام زنجیره‌های چندمرحله‌ای اهمیت دارد.

گوگل همچنین اعلام کرده که Argon پیش از عرضه عمومی در بخش‌هایی از فعالیت‌های داخلی شرکت مورد استفاده قرار گرفته است. از جمله کاربردهای اعلام‌شده می‌توان به بهینه‌سازی‌های مرتبط با محاسبات کوانتومی، مهاجرت کدهای C و C++ به Rust و بهینه‌سازی برخی کتابخانه‌های نرم‌افزاری اشاره کرد.

امنیت سایبری؛ یکی از میدان‌های اصلی Argon

بخش قابل توجهی از معرفی Gemini 4 Argon به قابلیت‌های امنیت سایبری اختصاص دارد. گوگل می‌گوید این مدل می‌تواند در کشف آسیب‌پذیری، اعتبارسنجی و حتی کمک به اصلاح آن‌ها مورد استفاده قرار گیرد.

این شرکت همچنین از همکاری با برنامه Fairwind برای دسترسی برخی نهادهای دولتی و مدافعان امنیت سایبری به مدل خبر داده است. این دسترسی مرحله‌ای و تحت کنترل انجام می‌شود و بخشی از رویکرد گوگل برای آزمایش قابلیت‌های پیشرفته مدل در محیط‌های حساس است.

گوگل هم‌زمان تأکید کرده که توسعه Argon با مجموعه‌ای از تدابیر ایمنی همراه بوده است؛ از جمله مقابله با سوءاستفاده‌های سایبری، حملات prompt injection، رفتارهای ناهمسو و سخت‌سازی محیط اجرای مدل.

رقابت مدل‌ها در بنچمارک‌ها

Gemini 4 Argon در برخی ارزیابی‌های عمومی نیز توجه زیادی جلب کرده است. در رتبه‌بندی منتشرشده توسط Arena، نسخه Gemini 4 Argon (High) با امتیاز ۱۵۲۵ در Text Arena در جایگاه نخست قرار گرفته است.

این مدل همچنین در بخش WebDev امتیاز ۱۶۷۹ را به دست آورده و در زمان انتشار داده‌ها در رتبه هشتم قرار داشته است. البته رتبه‌بندی‌های Arena پویا هستند و با ورود مدل‌های جدید یا تغییر تعداد رأی‌ها ممکن است تغییر کنند؛ بنابراین این اعداد باید به‌عنوان وضعیت ثبت‌شده در زمان انتشار در نظر گرفته شوند، نه یک برتری دائمی.

قیمت‌گذاری و عرضه مرحله‌ای

گوگل برای شروع عرضه API، قیمت ۲ دلار به ازای هر یک میلیون توکن ورودی و ۱۰ دلار برای هر یک میلیون توکن خروجی را اعلام کرده است. این قیمت‌گذاری در ادامه افزایش خواهد یافت و به ۴ دلار برای ورودی و ۲۰ دلار برای خروجی خواهد رسید.

با این حال، Gemini 4 Argon هنوز به شکل یک محصول عمومی و بدون محدودیت در اختیار همه کاربران قرار نگرفته و گوگل اعلام کرده عرضه آن به‌صورت مرحله‌ای انجام می‌شود.

این رویکرد نشان می‌دهد که گوگل تلاش دارد هم‌زمان با افزایش توان مدل، زمان بیشتری برای ارزیابی ایمنی و کنترل ریسک‌های آن داشته باشد.

تولید ویدئوی رایگان؛ اتفاقی جدا از Gemini 4 Argon

در همین بازه، گوگل از قابلیت جدید تولید ویدئو در Google Vids نیز خبر داده است. کاربران دارای حساب گوگل یا Workspace می‌توانند از قابلیت‌های هوش مصنوعی این سرویس برای تولید ویدئوهای 1080p استفاده کنند.

نکته مهم این است که این قابلیت مستقیماً بخشی از Gemini 4 Argon نیست. تولید ویدئو در Google Vids با استفاده از Gemini Omni 1.1 Flash انجام می‌شود و گوگل برای ویدئوهای تولیدشده نیز واترمارک دیجیتال در نظر گرفته است.

در مجموع، اتفاقات اخیر گوگل نشان می‌دهد رقابت هوش مصنوعی دیگر فقط به ساخت مدل‌هایی با امتیاز بالاتر در بنچمارک‌ها محدود نیست. توانایی انجام کارهای طولانی و چندمرحله‌ای، استفاده در نرم‌افزار و امنیت سایبری، دسترسی سازمانی و دولتی، کنترل ریسک و همچنین تبدیل هوش مصنوعی به ابزارهای روزمره مانند تولید ویدئو، اکنون هم‌زمان در حال تبدیل شدن به میدان رقابت شرکت‌های بزرگ فناوری است.