تخطى إلى المحتوى الرئيسي

جوجل تطلق Gemini 3.8 Live: منافسة GPT-Live-1 بنصف التكلفة

فريق جليتش نيوز
17 سبتمبر0 مشاهدة5 دقائق
جوجل تطلق Gemini 3.8 Live: منافسة GPT-Live-1 بنصف التكلفة

في 15 سبتمبر 2026، أطلقت جوجل Deepmind نماذج Gemini 3.8 Live و Extended Thinking بسعر $0.005 للدقيقة، متفوقة على OpenAI في التكلفة.

مقدمة تحليلية

في 15 سبتمبر 2026، أطلقت جوجل Deepmind نموذجي الصوت Gemini 3.8 Live و Gemini 3.8 Live Extended Thinking للمطورين. هذه النماذج الجديدة متاحة عبر Gemini API و Google AI Studio، وتستهدف بشكل مباشر سوق وكلاء الصوت التفاعلي. جوجل حددت تكلفة خدمة Gemini 3.8 Live عند $0.005 للدقيقة للمدخلات الصوتية و$0.018 للدقيقة للمخرجات. هذا السعر يضعها في منافسة مباشرة وشرسة مع نموذج GPT-Live-1 من OpenAI، الذي يكلف $0.05 للدقيقة. الفارق السعري يعكس تراجعاً حاداً في تكلفة المحادثات الصوتية القائمة على الذكاء الاصطناعي، حيث تكلف ساعة واحدة من المحادثة مع جوجل حوالي $1.38، بينما تبلغ تكلفتها مع OpenAI ما لا يقل عن $3.00. هذه الخطوة من جوجل لا تقتصر على تقديم تقنية جديدة، بل تضع معياراً سعرياً جديداً يجبر المنافسين على إعادة تقييم استراتيجياتهم. النموذج يدعم أكثر من 97 لغة، مما يوسع نطاق تطبيقه عالمياً، ويشير إلى تركيز جوجل على الانتشار الواسع.

التحليل التقني

تتمثل القوة التقنية لـ Gemini 3.8 Live في بنيته التي تمكن وكلاء الصوت من إجراء استدعاءات API في الخلفية، ومعالجة المدخلات البصرية، ومواصلة المحادثة في نفس الوقت دون انقطاع. هذه الوظيفة المتزامنة تعزز من فعالية وكلاء الذكاء الاصطناعي في المهام المعقدة التي تتطلب تفاعلاً مستمراً مع المستخدمين ووصولاً فورياً للبيانات الخارجية، مثل البحث عن معلومات أو التحكم في أجهزة أخرى أثناء الحوار. النموذج يدعم أكثر من 97 لغة، مما يدل على قدرته على التوسع عالمياً.

الأداء القياسي يضع نموذج Gemini 3.8 Live Extended Thinking في صدارة قائمة Artificial Analysis Speech-to-Speech Leaderboard. وقد حقق هذا النموذج نسبة 82.6 بالمائة، متفوقاً على أحدث نماذج GPT-Live-1 من OpenAI في هذا المقياس المحدد لـ "agentic performance vs. cost to run". هذا التفوق يشير إلى كفاءة جوجل في تحقيق أداء جيد مع الحفاظ على التكلفة. النماذج متاحة للمطورين عبر Gemini API و Google AI Studio، مع توفر تطبيقات نموذجية على GitHub لتسهيل البدء.

التنافسية الهندسية ومفاضلات التصميم

على الرغم من تفوق جوجل في التكلفة والأداء على بعض مقاييس الكفاءة، فإن OpenAI لا تزال تحتفظ بميزة تقنية في جوانب أخرى حاسمة. نموذج GPT-Live-1 من OpenAI مصمم لتقديم محادثات أكثر طبيعية بفضل تقنية "full duplex"، التي تسمح للنموذج بالاستماع والتحدث في آن واحد. هذا يعني أن المستخدم لا يحتاج إلى انتظار انتهاء النموذج من حديثه ليتحدث هو، مما يخلق تفاعلاً سلساً وقريباً من المحادثة البشرية. هذا التصميم يختلف عن النهج الذي يبدو أن جوجل قد اتبعته، والذي يركز على الكفاءة السعرية والقدرات المتعددة الأوجه للوكيل، حتى لو كان ذلك على حساب سلاسة المحادثة الفورية. الملاحظات الأولية المستندة إلى العروض التوضيحية تشير أيضاً إلى أن جودة الصوت في نموذج OpenAI أفضل، مما يعزز الفرضية بأن جوجل اختارت تحسين التكلفة على حساب الجودة النهائية لتجربة المستخدم السمعية. جوجل قدمت حلاً اقتصادياً وقوياً وظيفياً، بينما حافظت OpenAI على الأفضلية في جودة وتلقائية التفاعل.

السياق وتأثير السوق

إطلاق جوجل لنموذجي Gemini 3.8 Live و Extended Thinking يعيد تشكيل ديناميكيات سوق الذكاء الاصطناعي الصوتي بشكل ملموس. المنافسة المباشرة مع OpenAI ونموذجها GPT-Live-1 لم تعد تدور فقط حول القدرات التقنية الخام، بل امتدت لتشمل عامل التكلفة كعنصر حاسم في استراتيجية التبني الواسع. جوجل تقدم نموذجاً لساعة من المحادثة الصوتية بسعر $1.38 تقريباً، وهو أقل بكثير من $3.00 التي يفرضها OpenAI لنفس المدة على الأقل. هذا الفارق السعري الهائل، والذي يصل إلى أكثر من 50%، سيجبر الشركات والمطورين على إعادة تقييم خياراتهم، خاصةً تلك التي تعتمد على عمليات واسعة النطاق تتضمن تفاعلات صوتية مكثفة.

قبل هذا الإطلاق، كانت OpenAI مع GPT-Live-1 هي المعيار الأساسي للنماذج الصوتية التفاعلية ذات القدرة على المحادثة الطبيعية بفضل تقنية full duplex. الآن، جوجل تقدم بديلاً أكثر كفاءة من حيث التكلفة، حتى لو كان ذلك على حساب بعض الجوانب المتعلقة بالجودة الصوتية أو سلاسة التفاعل الفوري، كما تشير العروض التوضيحية. الشركات الناشئة والمطورون ذوو الميزانيات المحدودة سيجدون في عرض جوجل فرصة جذابة لدمج وكلاء الصوت في تطبيقاتهم دون تحمل التكاليف الباهظة التي كانت سائدة. هذا يضع ضغطاً مباشراً على OpenAI إما لتخفيض أسعارها أو لتقديم قيمة مضافة لا يمكن لجوجل مجاراتها، مثل جودة التفاعل غير المسبوقة. تأثير السوق سيكون فورياً: زيادة في تبني وكلاء الصوت المدعومين بالذكاء الاصطناعي نتيجة لانخفاض حاجز التكلفة، وتحول محتمل في حصة السوق نحو جوجل في قطاعات محددة. التحدي الآن لـ OpenAI هو تبرير سعرها الأعلى في مواجهة بديل فعال من حيث التكلفة.

تحليل ورأي المحرر

رؤية Glitch4Techs

تؤكد جوجل من خلال إطلاق Gemini 3.8 Live و Extended Thinking أولويتها الواضحة: احتلال السوق من خلال التكلفة. القرار بتقديم نماذج قادرة على الأداء التنافسي، كما يظهر من تصدر Gemini 3.8 Live Extended Thinking لقائمة Artificial Analysis Speech-to-Speech Leaderboard بنسبة 82.6 بالمائة، بسعر يبلغ $0.005 للدقيقة للمدخلات و$0.018 للمخرجات، هو هجوم مباشر على هامش ربح OpenAI ومكانتها الرائدة. هذا ليس ابتكاراً ثورياً في جودة التجربة، بل هو تحسين جذري في كفاءة التكلفة. ومع ذلك، فإن هذه الاستراتيجية تنطوي على تنازل واضح في الجودة. الملاحظات المستندة إلى العروض التوضيحية تشير إلى أن نماذج OpenAI لا تزال تقدم محادثات أكثر طبيعية وجودة صوتية أفضل بفضل تقنية full duplex. إن تركيز جوجل على "السعر فوق الجودة" يعني أنهم يستهدفون قطاعاً من السوق يفضل الكفاءة الاقتصادية على التجربة المتفوقة. هذا الرهان سيؤتي ثماره في تطبيقات تتطلب حجماً كبيراً من التفاعلات الروتينية، لكنه لن يزعزع موقع OpenAI في التطبيقات التي تتطلب أعلى مستويات من التفاعل البشري والطبيعي.

أعجبك المقال؟ شاركه

النشرة البريدية

كن أول من يعرف بمستقبل التقنية

أهم الأخبار والتحليلات التقنية مباشرة في بريدك.

مقالات قد تهمك