
گوگل دیروز جدیدترین مدل پرچمدار خود، Gemini 4، را با امتیازهای چشمگیر معرفی کرد؛ اما گزارش تازهای نشان میدهد که این مدل ممکن است در برخی موارد کاربرد واقعی با چالش روبهرو شود.
به گزارش بلومبرگ، برخی کارمندان گوگل در ارزیابیهای داخلی دریافتهاند که عملکرد Gemini 4 در دنیای واقعی همیشه با امتیازهای بنچمارک (Benchmark) آن همخوانی ندارد. در مراسم معرفی Gemini 4 Argon، گوگل نشان داد که مدل جدیدش در بسیاری از حوزههای کلیدی از رقبایی مانند GPT-6 Astra شرکت OpenAI پیشی گرفته است.
اختلاف نظر داخلی درباره عملکرد مدل
این گزارش به نقل از کارمندان گوگل میگوید مدل هنگام استفاده عملی عملکرد ضعیفتری دارد و در انجام برخی وظایف برنامهنویسی (Coding Tasks) دچار مشکل میشود. گوگل در پاسخ به بلومبرگ اعلام کرد که «نادرست است بگوییم Gemini 4 در حوزههایی مانند برنامهنویسی عملکرد ضعیفی دارد.» این شرکت همچنین به اظهارات کورای کاووکاوغلو (Koray Kavukcuoglu)، رئیس Google DeepMind، در اواخر سپتامبر اشاره کرد که گفته بود «مسلم است که ما همیشه در مرز فناوری خواهیم بود.»
در ادامه گزارش، یک کارمند گوگل از «اجماع گسترده» میان کارمندان درباره قرار داشتن Gemini 4 در مرز فناوری خبر داده، در حالی که برخی دیگر نگراناند که این مدل همچنان از مدلهای رقیب Anthropic و OpenAI عقب بماند. به این ترتیب، دیدگاه کارمندان درباره عملکرد این مدل یکدست نیست.
قابلیتها و قیمتگذاری Gemini 4 Argon
Gemini 4 Argon ارتقاهای قابلتوجهی را به همراه دارد؛ از جمله افزایش محدودیت خروجی (Output Limit) تا یک میلیون توکن (Token). گوگل همچنین توضیح داده است که این مدل «در دفاع امنیت سایبری (Cybersecurity Defense) بسیار توانمند است» و در دیگر موارد استفاده نیز «عملکرد پیشرو» دارد.
قیمتگذاری Gemini 4 Argon برای هر یک میلیون توکن ورودی ۴ دلار و برای هر یک میلیون توکن خروجی ۲۰ دلار اعلام شده است؛ اما قیمت معرفی (Introductory Pricing) آن نصف این مبالغ خواهد بود.
واکنش گوگل و چشمانداز رقابت
گوگل با رد ادعای ضعف عملکرد، بر جایگاه Gemini 4 در خط مقدم فناوری تأکید کرده است. با این حال، گزارش بلومبرگ از نگرانی بخشی از کارمندان درباره رقابت با Anthropic و OpenAI حکایت دارد؛ موضوعی که میتواند بر آینده پذیرش این مدل در کاربردهای واقعی اثر بگذارد.