ai-machine-learning

أسعار Gemini Omni API: ما نعرفه، وما يحلّ محلّه، وكم سيكلّف (مايو 2026)

بقلم Techsy Editorial Team
May 19, 2026
15 قراءة
أسعار Gemini Omni API: ما نعرفه، وما يحلّ محلّه، وكم سيكلّف (مايو 2026)

أسعار Gemini Omni API: ما نعرفه، وما يحلّ محلّه، وكم سيكلّف (مايو 2026)

أطلقت Google نموذج Gemini Omni في مؤتمر I/O 2026 قبل نحو خمس ساعات، وخانة سعر Gemini Omni API على صفحة التسعير الرسمية لا تزال فارغة حرفياً. فيما يلي ما نعرفه اليوم، وحسابات التوقع المنطقي للأسعار استناداً إلى Veo 3.1 وGemini 3.5 Flash، والحزمة المكوّنة من أربعة نماذج التي يختصرها Omni في استدعاء واحد. آخر تحقق: 2026-05-19. سأحدّث هذا المنشور فور نشر Google للأسعار الرسمية.

الإجابة السريعة: أسعار Gemini Omni API غير منشورة بعد حتى 19 مايو 2026. وصول المستهلكين يبدأ بـ $20 شهرياً (AI Plus) و**$30 شهرياً** (AI Pro) و**$100 شهرياً** (AI Ultra). من المتوقع إطلاق الوصول عبر Vertex AI خلال أسابيع. استناداً إلى Veo 3.1 وGemini 3.5 Flash، الأسعار التقديرية المتوقعة هي $1.50–$2.50 لكل مليون رمز للإدخال و**$0.20–$0.60 لكل ثانية** من مخرجات الفيديو.

ما هو Gemini Omni؟

Gemini Omni هو أول نموذج "من أي شيء إلى أي شيء" متعدد الوسائط من Google، أُعلن عنه في I/O 2026 في 19 مايو 2026. يقبل النموذج نصاً وصوراً وصوتاً وفيديو كمدخلات، ويُخرج حالياً فيديو فقط (إخراج الصور والصوت موعود "في وقت لاحق" وفق تعبير Google). يُطلَق النموذجان عند الإصدار: Omni Flash للمقاطع السريعة المدتها 10 ثوانٍ، وOmni Pro للمقاطع الأطول ذات الجودة العالية.

ما يجعل هذا النموذج مثيراً من منظور هندسة الأنظمة هو أن Omni لا يُضيف ميزة إلى قائمة نماذج Gemini، بل يختصر أربعة نماذج منفصلة في استدعاء API واحد. ما كان يتطلب توليد نص ورؤية حاسوبية وتحويل كلام إلى نص وتوليد فيديو أصبح رحلة واحدة. النموذج مبني على أساس فيديو Veo 3.1، لذا معيار جودة الفيديو محدد مسبقاً (وكل مخرجات تحمل علامة مائية SynthID وفق إعلان إطلاق Omni).

بعض التفاصيل الجديرة بالمعرفة قبل قراءة بقية المنشور:

  • حدّ 10 ثوانٍ في Omni Flash هو ما تصفه Google بـ"قرار نشر وليس قيداً على النموذج". اقرأ: من المحتمل أن يتوسّع.
  • بطاقة النموذج من DeepMind تؤكد إدخال نص + صورة + صوت + فيديو، مع مخرجات فيديو فقط حالياً.
  • يُشير كلٌّ من تحليل TechCrunch وتفاصيل إطلاق 9to5Google إلى أن خارطة طريق "وسائط إخراج إضافية لاحقاً" هي القصة الأكبر.

إن كنت هنا بحثاً عن جدول أسعار، القسم التالي هو الجزء الصادق الذي جئت من أجله. وإن كنت هنا لحسابات التوقع المنطقي، فاقفز إلى ما بعد قسمين.

كم تكلّف Gemini Omni API اليوم؟ (الجواب: لا شيء، بعد)

أسعار Gemini Omni API غير منشورة بعد. صفحة التسعير الرسمية على ai.google.dev/gemini-api/docs/pricing (تحقق في 19 مايو 2026) تُدرج كل نماذج Gemini باستثناء Omni. الخانة فارغة. الوصول الاستهلاكي متاح عبر مستويات تطبيق Gemini؛ أما الوصول عبر Vertex AI API فـ"قادم في الأسابيع المقبلة" وفق تعبير Google في إطلاق النموذج.

تحققت من صفحة التسعير في الساعة 8 صباحاً بتوقيت الساحل الشرقي ثم مرة أخرى في الساعة 1 ظهراً. النتيجة ذاتها في كلتا المرتين. الصفحة تُدرج 14 نموذجاً من Gemini. Omni ليس أحدها. بعد.

النموذجالإدخال ($/مليون رمز)الإخراج ($/مليون رمز)إدخال الصوتملاحظات
Gemini 3.5 Flash$1.50$9.00$3.00نص/صورة/صوت داخل؛ نص خارج
Gemini 3.1 Pro$2.00 / $4.00 (>200k)$12.00 / $18.00 (>200k)$3.00ضعف السعر فوق 200k رمز
Gemini 3.1 Flash-Lite$0.10$0.40$0.30أرخص نموذج في الإنتاج
Gemini 2.5 Pro$1.25$10.00$3.00قديم، مدعوم حتى الآن
Veo 3.1 (فيديو)غير مطبّق$0.40/ثانيةغير مطبّقفوترة لكل ثانية من المخرجات
Gemini Omniغير منشور بعدغير منشور بعدغير مطبّقراجع جدول التوقع أدناه

المصدر: ai.google.dev/gemini-api/docs/pricing، تحقق في 2026-05-19.

الأرقام الوحيدة المتاحة اليوم لـ Omni هي اشتراكات المستهلكين:

  • AI Plus: $20 شهرياً
  • AI Pro: $30 شهرياً
  • AI Ultra: $100 شهرياً

مدونة اشتراكات AI من Google توضّح ما يتيحه كل مستوى. مسار API منقسم كالعادة: Vertex AI لعقود المؤسسات (من المحتمل أن يُطلَق أولاً)، وAI Studio للدفع حسب الاستخدام (يتبعه عادة بأسابيع قليلة). لا توجد إشارة لمستوى مجاني لـ Omni بعد. تحليل VentureBeat للمؤسسات يؤكد صياغة "الأسابيع المقبلة". هذه هي أقوى إشارة زمنية لدينا.

لذا إن كنت بحثت عن "أسعار Gemini Omni API" اليوم وتنقّلت بين خمس علامات تبويب من جداول Gemini 3.1 Pro القديمة، فأنت لست المشكلة. الأسعار لم تُنشر بعد ببساطة.

ما الذي ستكون عليه أسعار Gemini Omni API فعلاً؟ (حسابات التوقع المنطقي)

الأسعار التقديرية المتوقعة لـ Gemini Omni API، مستنبطة من Veo 3.1 ($0.05–$0.60/ثانية للمخرجات) وGemini 3.5 Flash ($1.50/$9 لكل مليون رمز): الحالة المنخفضة $1.50 إدخال / $0.20/ثانية مخرجات، الحالة المتوسطة $2.00 إدخال / $0.40/ثانية مخرجات، الحالة المرتفعة $2.50 إدخال / $0.60/ثانية مخرجات لكل مليون رمز. إدخال الصوت تقديري عند $3–$5 لكل مليون رمز. كل رقم هنا تقديري وليس مؤكداً.

إليك كيف وصلنا إلى ذلك. Veo 3.1 يُفوتر $0.40 لكل ثانية من مخرجات الفيديو اليوم، وOmni Pro مبني على نفس أساس الفيديو. لذا من المحتمل أن يقع سعر Omni Pro للثانية ضمن نطاق Veo 3.1. أما إدخال/إخراج نص Gemini 3.5 Flash فهو $1.50/$9 لكل مليون رمز؛ إدخال/إخراج نص Omni Flash من المحتمل أن يقع في نطاق 0.7–1.5× من ذلك، لأن Google تسعّر تاريخياً متغيرات Flash متعددة الوسائط بالقرب من نظيراتها النصية فقط.

الحالةالإدخال ($/مليون)مخرجات النص ($/مليون)مخرجات الفيديو ($/ثانية)إدخال الصوت ($/مليون)نموذج الاستناد
منخفضة (تقديرية)$1.50$7.00$0.20$3.00Gemini 3.5 Flash + Veo 3.1 Lite
متوسطة (تقديرية)$2.00$10.00$0.40$4.00مزج Flash/Pro + Veo 3.1 القياسي
مرتفعة (تقديرية)$2.50$14.00$0.60$5.00Gemini 3.1 Pro + Veo 3.1 القياسي

جميع الأسعار لكل مليون رمز ما لم يُشر إلى غير ذلك. مُقارنة مع أسعار OpenAI وأسعار Claude من Anthropic للتحقق من الحدود المنطقية.

بعض ما يمكن توقعه فوق الأسعار الأساسية:

  • مستويات Batch / Flex / Priority. كل نماذج Gemini الأخرى تقدّمها. Batch يخفض التكلفة عادة بنحو 50%؛ Priority يضيف ضمانات التأخر بعلاوة سعرية. من شبه المؤكد أن Omni يتبع النمط ذاته.
  • التسعير بحسب مستوى السياق. Gemini 3.1 Pro يُفوتر بضعف السعر فوق 200k رمز. من المحتمل أن يتبع Omni القاعدة ذاتها، خاصة أن عدد الإطارات في الفيديو يرفع إجمالي الرموز بسرعة.
  • ترميز إدخال الصوت. الصوت مُفوتَر لكل رمز (مُرمَّز)، لا لكل ثانية. نحو 32 رمزاً لكل ثانية صوت بأسعار Gemini الحالية، لذا ضعها في الحسبان.

استناداً إلى Veo 3.1 وGemini 3.5 Flash، من المحتمل أن يكلّف Omni Flash $1.50–$2.50 لكل مليون رمز إدخال و$0.20–$0.60 لكل ثانية من مخرجات الفيديو. أجرينا الحسابات مرتين (مرة مستنداً فقط إلى Veo، ومرة ممزوجاً مع Flash) والنطاقات بقيت داخل $0.50/ثانية في الحد الأعلى. حين يُطلق Omni ستحتاج إلى توجيه الطلبات بذكاء، ودليلنا لتخفيض تكاليف API لنماذج اللغة يتناول توجيه البوابة وطبقات التخزين المؤقت التي يستحق إعدادها الآن.

"التكلفة التقديرية لكل مليون رمز (إدخال + إخراج مدمجان)"

جدول البيانات
"التكلفة التقديرية لكل مليون رمز (إدخال + إخراج مدمجان)"
"دولار لكل مليون رمز"السلسلة 1
"Gemini Omni (توقع منخفض)"3.5
"Gemini Omni (توقع متوسط)"5.5
"Gemini Omni (توقع مرتفع)"8
"Gemini 2.5 Pro"7
"GPT-4o"12.5
"Claude Sonnet 4.6"9

النطاق التقديري لتكلفة Gemini Omni مقارنةً بمعدلات الإدخال/الإخراج المدمجة للمنافسين حتى 2026-05-19. أرقام Omni مستنبطة من Veo 3.1 وGemini 3.5 Flash؛ يُحدَّث هذا الرسم البياني يوم نشر Google للأسعار.

ما الذي يحلّ محله Gemini Omni؟ ورقة عمل اختصار المنظومة

Omni يحلّ محل منظومة متعددة النماذج: GPT-4o للنص، وGPT-4o Vision لتقييم الصور، وWhisper لنسخ الصوت، وVeo 3.1 لتوليد الفيديو. سير عمل فيديو مدته 30 ثانية مع راوٍ صوتي يكلّف اليوم نحو $12.27 عبر أربعة استدعاءات API. بالأسعار التقديرية المتوسطة لـ Omni، ينخفض سير العمل ذاته إلى $4–$18 للمقطع الواحد في استدعاء واحد (نعم، الحد الأعلى أوسع مما تتمنى، لكن تابع القراءة).

في منظوماتنا الإنتاجية، ننفّذ هذا الشكل الرباعي الخطوات لسير عمل فيديو تشريحي للعملاء. إليك أين تذهب التكاليف اليوم مقابل أين ستذهب مع Omni Pro بالأسعار التقديرية المتوسطة:

الخطوةالنموذج الحاليالتكلفة الحاليةاستدعاء Omniالتكلفة التقديرية
نسخ الصوت المُدخَلWhisper$0.006/دقيقةمدمج في إدخال Omniمشمولة
تقييم الصورة المُدخَلةGPT-4o Vision$8 لكل مليون رمز إدخال (صورة)مدمجمشمولة
توليد النص/السيناريوGPT-4o$2.50 / $10 لكل مليون رمزمدمجمشمولة
توليد فيديو 30 ثانيةVeo 3.1$0.40/ثانية × 30 = $12.00Omni Pro تقديري $0.20–$0.60/ثانية × 30تقديري $6–$18
إجمالي لكل مقطع~$12.27تقديري $4–$18 (نطاق)

مخطط يُظهر أربعة واجهات API منفصلة (GPT-4o وGPT-4o Vision وWhisper وVeo 3.1) تنضوي في استدعاء Gemini Omni API واحد
منظومة متعددة الوسائط ذات أربعة استدعاءات تتقلص إلى استدعاء Omni واحد

إليك التحفّظ الصادق. عند الحد الأعلى من نطاق التوقع، قد يكون Omni Pro أغلى لكل مقطع من المنظومة الحالية المكوّنة من أربعة موردين. إخراج الفيديو هو البند التكلفوي المهيمن، وإذا سعّرت Google Omni Pro بسعر Veo 3.1 الكامل $0.40+/ثانية (إضافةً إلى هامش رموز الإدخال للسياق متعدد الوسائط)، فقد لا تحقق سير العمل الكثيفة بالفيديو وفورات مالية يوم الإطلاق.

إذن أين تأتي الوفورات الفعلية؟ نصيحة احترافية: إذا كنت تدفع اليوم لـ Whisper + Vision + GPT-4o + Veo 3.1، فمكسبك الحقيقي من Omni ليس دائماً بالدولارات. إنه التخلص من 3 موردين و3 حزم تطوير برمجي و3 اتفاقيات مستوى خدمة في استدعاء واحد. هذا ما سيوقّع عليه مدير التقنية، لا حسابات التكلفة لكل مقطع. ينخفض التأخر ويتقلص كود معالجة الأخطاء وتتوقف منطق إعادة المحاولة عن التفرع عبر أربعة تصنيفات للأخطاء.

حين يُطلق API، ستريد اختبار Omni أمام منظومتك الحالية بمرايا حركة المرور، لا التبديل المباشر. دليل Responses API من OpenAI يتناول منظومة الوسائط المتعددة التي Omni مصمم لاختصارها، وبوابة LLM تُيسّر الاختبار المقارن دون إعادة كتابة كل موقع استدعاء.

هل Gemini Omni مجدٍ لأتمتة Instagram؟

بالنسبة لأتمتة Instagram المقتصرة على التعليقات النصية، GPT-4o-mini بـ $0.15/$0.60 لكل مليون رمز يظل أرخص من الأسعار التقديرية لـ Omni: نحو $1.60 لكل 100 منشور مقابل $4–$10 لكل 100 منشور بالحالة التقديرية المتوسطة لـ Omni. Omni يتفوق حين يتضمن سير عملك توليد الصورة أو الفيديو. بالنسبة للتعليقات النصية فقط على صور موجودة، التزم بسلسلة GPT-4o-mini. ليست إجابة موحّدة.

سير العمل الذي يستخدمه معظم المطورين المستقلين حالياً هو قالب أتمتة Instagram من n8n: n8n + توليد تعليق بـ GPT-4o-mini + تقييم صورة بـ GPT-4o Vision + توليد وسوم بـ GPT-4o-mini + نشر بـ Buffer. الأرقام الحقيقية لكل 100 منشور اليوم:

  • التعليقات (GPT-4o-mini، ~500 رمز إدخال / 100 رمز إخراج × 100 منشور): ~$0.30
  • تقييم الصور (GPT-4o Vision، صورة واحدة × 100 منشور): ~$1.20
  • توليد الوسوم (GPT-4o-mini، ~200 رمز × 100): ~$0.10
  • الإجمالي: ~$1.60 لكل 100 منشور من إنفاق API الخام

بالأسعار التقديرية المتوسطة لـ Omni (استدعاء متعدد الوسائط لكل منشور: إدخال صورة + توليد نص، إخراج نص فقط، لا فيديو للمنشورات الثابتة على Instagram)، ستقع في نطاق $4–$10 لكل 100 منشور. هذا أغلى بمقدار 2.5–6 أضعاف من سلسلة GPT-4o-mini لمخرجات مطابقة تماماً.

الحكم الصادق: إذا كنت تُنتج Instagram Reels (فيديو)، فـ Omni خيار واضح ما إن يُطلَق API لأنه لا يوجد بديل يُخرج فيديو 30 ثانية في استدعاء واحد. أما إذا كنت تنشر صوراً ثابتة مع تعليقات بالذكاء الاصطناعي، فـ GPT-4o-mini لا يزال يتفوق في التكلفة بنحو 3 أضعاف. لا تنتقل من أجل الانتقال ذاته.

"التكلفة لكل 100 منشور على Instagram (تعليق + تقييم صورة + وسوم)"

جدول البيانات
"التكلفة لكل 100 منشور على Instagram (تعليق + تقييم صورة + وسوم)"
"المنظومة"السلسلة 1
"سلسلة GPT-4o-mini (اليوم)"1.6
"سلسلة Gemini 2.5 Flash-Lite"1.2
"Gemini Omni (توقع متوسط)"6
"سلسلة GPT-4o الكاملة"11.4

للمنشورات الثابتة على Instagram، GPT-4o-mini لا يزال يتصدر من حيث التكلفة. Omni لا يتفوق إلا حين تكون مخرجات الفيديو ضرورية. رقم Omni التقديري مستند إلى الحالة المتوسطة (مزج Veo 3.1 + Gemini 3.5 Flash) حتى 2026-05-19.

إذا كنت جديداً على بناء هذه المنظومات، دليل عملاء الذكاء الاصطناعي في n8n يتناول الأساسيات. ولسير عمل الوكالات عالية الحجم، أنماط أتمتة سير عمل الذكاء الاصطناعي للمؤسسات تتناول منطق التوجيه الذي سيندمج فيه Omni.

Gemini Omni مقابل GPT-4o مقابل Claude Sonnet 4.6: المقارنة الصادقة

مقارنة Gemini Omni بـ GPT-4o وClaude Sonnet 4.6 اليوم ليست مقارنة عادلة. Omni يُخرج فيديو (الآخران لا)، GPT-4o يدعم الصوت الفوري (Omni لا، بعد)، وClaude يملك أطول نافذة سياق للعمل مع المستندات الطويلة. السؤال الصحيح هو أي نقاط قوة النموذج تتطابق مع حمل عملك، لا أيها أرخص.

الميزةGemini Omni (تقديري)GPT-4oClaude Sonnet 4.6
وسائط الإدخالنص + صورة + صوت + فيديونص + صورة + صوتنص + صورة
وسائط الإخراجفيديو (صورة/صوت لاحقاً)نص + صوت (فوري)نص
الصوت الفوريلانعملا
نافذة السياق1M (افتراضي لعائلة Gemini)128k1M
السعر (إدخال/إخراج لكل 1M)تقديري $1.50–$2.50 / $7–$14$2.50 / $10$3 / $15
توفر API اليوملا (قادم قريباً)نعمنعم

أسعار المصدر مأخوذة من أسعار OpenAI وأسعار Claude، تحقق في 2026-05-19.

Omni لا يتفوق على GPT-4o أو Claude في السعر. يتفوق في تغطية الوسائط. إذا كنت تحتاج إلى إخراج فيديو اليوم، Omni هو الخيار الوحيد ضمن الثلاثة الكبار (Veo 3.1 لا يزال الأفضل للفيديو الخالص، لكن Omni يضيف طبقة الإدخال متعدد الوسائط). إذا كنت تحتاج إلى صوت فوري، GPT-4o لا يزال يملك تلك المساحة. إذا كنت تحتاج إلى نافذة سياق 1M رمز لسير عمل المستندات، فقد وسّع Claude Opus 4.7 الأمور أبعد. وللعمل الكثيف بالاستعلامات المحدودة التكلفة، البدائل متعددة الوسائط مفتوحة المصدر تغطي المساحة ذاتها بصفر تكلفة لكل رمز (مع مقايضاتها الخاصة في الإعداد والإنفاق على GPU).

متى لا تستخدم Gemini Omni

تجنّب Gemini Omni لـ سير العمل النصي الخالص (RAG، التصنيف، الدردشة)، والمنظومات عالية الحجم ذات الهامش المنخفض (استخدم Gemini 2.5 Flash-Lite أو GPT-4o-mini بتكلفة أقل بـ 10–50 ضعفاً)، وتطبيقات الصوت الفوري (GPT-4o Realtime لا يزال يهيمن هنا)، أو أي شيء يتطلب ضبطاً دقيقاً. Omni مخصص للمهام التي تكون فيها الوسائط المتعددة هي القيمة المضافة، لا للتشغيل الأرخص لروبوت دردشة.

تحديداً، تجنّب Omni إذا:

  • كان حمل عملك نصياً خالصاً وبحجم كبير: استخدم Gemini 2.5 Flash-Lite ($0.10/$0.40) أو GPT-4o-mini ($0.15/$0.60)
  • كنت تحتاج صوتاً فورياً: GPT-4o Realtime هو الخيار
  • كنت تحتاج ضبطاً دقيقاً: Veo 3.1 لا يدعمه، وOmni مبني على نفس الأساس، لذا افترض غياب الضبط الدقيق عند الإطلاق
  • كنت تحتاج إخراج صورة اليوم: Imagen 4 أو DALL-E 3 (Omni يُخرج فيديو لا صوراً عند الإطلاق)
  • كنت تحتاج إخراج صوت اليوم: ElevenLabs أو OpenAI TTS أو Gemini TTS، إذ إخراج صوت Omni "قادم لاحقاً"
  • كنت تحتاج مقاطع أطول من 10 ثوانٍ على Flash: انتظر مستوى Pro أو استخدم Veo 3.1 مباشرة
  • كانت تجربة المستخدم تتطلب استجابة دون ثانية: استدعاءات الوسائط المتعددة أبطأ من النصية الخالصة؛ خصّص هامش تأخر إضافياً

قبل تبديل أي استدعاء إنتاجي واحد، قيّم Omni أمام منظومتك الحالية باستخدام مجموعة تقييم مشتركة. Omni الخيار الخاطئ للدردشة والتصنيف وRAG. إنه نموذج للمهام متعددة الوسائط، لا نموذج للرموز الرخيصة.

ورقة الغش للترحيل: من استدعاءات متعددة إلى استدعاء Omni واحد

حين يُطلق API، الترحيل من منظومة 4 استدعاءات إلى استدعاء Omni واحد يستلزم تقريباً 15 سطراً من التعديلات في الكود. الشكل أدناه كود وهمي (pseudocode). توقيعات SDK الحقيقية ستظهر مع API. تُشير اتفاقية تسمية Google إلى gemini-omni-flash وgemini-omni-pro استناداً إلى نمط Veo 3.1.

اليوم: أربعة استدعاءات منفصلة عبر موردين.

python
# اليوم: أربعة استدعاءات API، موردان، أربعة تصنيفات للأخطاء
from openai import OpenAI
from google import genai

openai = OpenAI()
google = genai.Client()

transcript = openai.audio.transcriptions.create(model="whisper-1", file=audio)
vision = openai.chat.completions.create(model="gpt-4o", messages=[
    {"role": "user", "content": [{"type": "image_url", "image_url": image_url}]}])
caption = openai.chat.completions.create(model="gpt-4o", messages=[
    {"role": "user", "content": f"Caption for {vision.choices[0].message.content}"}])
video = google.models.generate_videos(model="veo-3.1", prompt=caption.choices[0].message.content)

غداً (تقديري): استدعاء Omni واحد.

python
# تقديري: استدعاء Omni واحد (كود وهمي — SDK الحقيقي يصدر مع API)
from google import genai

client = genai.Client()
response = client.models.generate_content(
    model="gemini-omni-flash",  # أو "gemini-omni-pro" للمقاطع الأطول
    contents=[text_prompt, image, audio, video_reference],
    config={"output_modality": "video", "duration_seconds": 10}
)

حين يُطلق API، الترحيل يعني في معظمه حذف كود. راقب اسم النموذج يوم الإطلاق، وضعه في ثابت حتى تتمكن من التبديل بين omni-flash وomni-pro حسب حمل العمل دون لمس مواقع الاستدعاء. نمط Python SDK الحالي لـ Gemini يدعم بالفعل محتويات متعددة الوسائط، لذا الشكل أعلاه يندمج بسلاسة.

كيف تفكر Techsy في ترحيل Omni

حين نُقيّم أي تبديل لمنظومة نماذج للعملاء، نطرح ثلاثة أسئلة: ما ميزانية التأخر، هل يغطي النموذج الجديد الوسائط التي يستخدمها حمل عملك فعلاً، وهل ثمة مكسب في توحيد المورّدين يستحق تكلفة إعادة البناء؟ اثنان من هذه الأسئلة يجيبان عن أنفسهما عادةً؛ الثالث هو حيث تُقنع معظم عمليات الترحيل نفسها بالوجود للسبب الخاطئ.

نحن لا نوصي العملاء بإعادة البناء على Omni اليوم. API لم يُطلق، الأسعار لم تُنشر، ونطاق التوقع أداة تخطيط لا ضوءاً أخضر للشحن. ما نفعله الآن هو تجهيز طبقة البوابة التي تتيح A/B بين Omni ومنظومتك الحالية لحظة إطلاق API. خزّن الاستدعاءات متعددة الوسائط بقوة (مدخلات الصور والصوت حتمية بما يكفي لضرب التخزين المؤقت كثيراً)، واحتفظ بعلامة تبديل للاسم التنبؤي للنموذج.

هل تبني منظومة ذكاء اصطناعي تستوعب إطلاقات النماذج دون إعادة كتابة كاملة كل ستة أسابيع؟ احصل على استشارة مجانية وسنضغط اختبار أين يناسب Omni (أو لا يناسب).

أسئلة متكررة

كم تكلّف Gemini Omni API؟

حتى 19 مايو 2026، لم تُنشر أسعار Gemini Omni API. صفحة التسعير من Google تُدرج كل نماذج Gemini باستثناء Omni. استناداً إلى Veo 3.1 وGemini 3.5 Flash، الأسعار التقديرية هي $1.50–$2.50 لكل مليون رمز إدخال و$0.20–$0.60 لكل ثانية من مخرجات الفيديو. هذه أرقام تقديرية، لا أسعاراً مؤكدة.

متى سيُطلق Gemini Omni API؟

قالت Google إن API سيُطلق "في الأسابيع المقبلة" خلال I/O 2026 في 19 مايو. وصول Vertex AI يُطلق عادةً أولاً لنماذج Gemini الجديدة، ويتبعه AI Studio للدفع حسب الاستخدام بأسابيع قليلة. منشور الإطلاق الرسمي هو المرجع الزمني المعتمد. سنُحدّث هذا المنشور يوم نشر الأسعار.

هل Gemini Omni أرخص من GPT-4o؟

يعتمد على حمل العمل. لإخراج الفيديو، Omni هو الخيار الوحيد ضمن الثلاثة الكبار الذي يُخرج توليداً في استدعاء واحد، إذ GPT-4o لا يُخرج فيديو. للعمل النصي الخالص، GPT-4o-mini بـ $0.15/$0.60 لكل مليون رمز يتفوق على الأسعار التقديرية لـ Omni بنحو 3 أضعاف. اختر النموذج الذي يتطابق مع الوسائط التي ينتجها خط أنابيبك فعلاً.

ما الذي يحلّ محله Gemini Omni في منظومتي؟

لسير العمل متعدد الوسائط للفيديو، Omni يحلّ محل أربعة استدعاءات API منفصلة: Whisper للنسخ، وGPT-4o Vision لفهم الصور، وGPT-4o لتوليد النص، وVeo 3.1 لتوليد الفيديو. المكسب الأكبر عادةً هو التخلص من ثلاث حزم تطوير و3 اتفاقيات مستوى خدمة و3 تصنيفات للأخطاء، لا التوفير المالي الخام. راجع ورقة عمل اختصار المنظومة أعلاه لحسابات التكلفة لكل مقطع.

هل يمكنني استخدام Gemini Omni عبر API اليوم؟

لا. حتى 19 مايو 2026، الوصول عبر API غير متاح بعد. الوصول الاستهلاكي متاح عبر مستويات تطبيق Gemini: AI Plus بـ $20 شهرياً، وAI Pro بـ $30 شهرياً، وAI Ultra بـ $100 شهرياً، وفق مدونة اشتراكات AI من Google. إطلاق API عبر Vertex AI "في الأسابيع المقبلة" وفق تعبير Google.

هل يدعم Gemini Omni الضبط الدقيق؟

لم يُعلَن عن ذلك حتى يوم الإطلاق. Veo 3.1 لا يدعم الضبط الدقيق أيضاً، وOmni مبني على نفس أساس الفيديو، لذا افترض غياب الضبط الدقيق عند الإطلاق. أضافت Google تاريخياً الضبط الدقيق لنماذج الوسائط المتعددة بعد أشهر من الإتاحة العامة، لذا الجدول الزمني المحتمل هو الربع الثالث أو الرابع من 2026، غير مؤكد.

كيف تعمل فوترة Gemini Omni؟

من المتوقع أن تتبع النمط القياسي لـ Google: أسعار لكل مليون رمز للإدخال (نص وصورة وصوت وإطارات فيديو) بالإضافة إلى الفوترة لكل ثانية لمخرجات الفيديو. مستويات Batch (خصم ~50% تقريباً) وFlex وPriority من المحتمل متاحة كسائر نماذج Gemini. التسعير بحسب مستوى السياق (ضعف السعر فوق 200k رمز) من المحتمل أن يُطبَّق نظراً لرفع إطارات الفيديو إجمالي الرموز بسرعة.

ما الفرق بين Omni Flash وOmni Pro؟

Omni Flash هو المتغير الأسرع والأقل تكلفة، محدود بمقاطع 10 ثوانٍ. Omni Pro يُشغّل مقاطع أطول بجودة أعلى وتكلفة تقديرية أعلى. كلاهما يغطي نفس مصفوفة الوسائط (نص وصورة وصوت وفيديو إدخالاً؛ فيديو إخراجاً اليوم). Google تصف حد 10 ثوانٍ لـ Flash بأنه "قرار نشر وليس قيداً على النموذج"، لذا توقع توسعاً.

هل سيحلّ Gemini Omni محل GPT-4o لأتمتة Instagram الخاصة بي؟

يعتمد على ما تُنتج. لـ Reels (مخرجات فيديو): نعم في نهاية المطاف، إذ Omni هو الخيار الوحيد لاستدعاء واحد لتوليد فيديو 30 ثانية. للمنشورات الثابتة مع تعليقات ووسوم بالذكاء الاصطناعي: على الأرجح لا. GPT-4o-mini لا يزال يتفوق على الأسعار التقديرية لـ Omni بنحو 3 أضعاف، وسلسلة n8n + GPT-4o-mini أثبتت جدارتها في الإنتاج.

خلاصة

ثلاثة أشياء تستحق الاحتفاظ بها:

  • أسعار Gemini Omni API غير منشورة حتى 19 مايو 2026. خانة صفحة التسعير فارغة، المستويات الاستهلاكية متاحة بـ $20–$100 شهرياً، والوصول عبر API عبر Vertex AI "في الأسابيع المقبلة".
  • النطاق التقديري: $1.50–$2.50 لكل مليون رمز إدخال و$0.20–$0.60 لكل ثانية من مخرجات الفيديو، مستنداً إلى Veo 3.1 وGemini 3.5 Flash. إدخال الصوت تقديري عند $3–$5 لكل مليون رمز. جميع الأرقام تقديرية، ليست حقائق.
  • وفورات اختصار المنظومة ليست دائماً مالية. إنها التخلص من 3 موردين و3 حزم تطوير و3 اتفاقيات مستوى خدمة في استدعاء متعدد الوسائط واحد. خطّط للترحيل حول توحيد المورّدين والتأخر، لا على أساس التكلفة الخام لكل مقطع.

آخر تحقق: 2026-05-19 (جدول التحديث: 24 ساعة بعد نشر Google للأسعار). سأُحدّث هذا المنشور يوم نشر Google لأسعار API. أضفه إلى المفضلة.

أنتجت فريق Techsy التحريري منظومات وسائط متعددة على GPT-4o + Veo 3.1 + Whisper منذ 2024. نُحدّث هذا المنشور حين تنشر Google أسعار Omni.

الوسوم

asaar-gemini-omni-apigemini-omnillm-pricingmultimodal-aivertex-ai

شارك هذا المقال

مقالات ذات صلة

المزيد في ai-machine-learning

ai-machine-learning
Aug 29, 2026

أفضل وكلاء الذكاء الاصطناعي لخدمة العملاء: 8 أدوات مصنفة حسب التسليم لا الضجيج

ثمانية وكلاء ذكاء اصطناعي لخدمة العملاء مصنفون حسب جودة التسليم، وحسب ما إذا كان الروبوت يستشهد بمقال المصدر. أسعار حية سُحبت في 17 أغسطس 2026 من الصفحات الرسمية، وتشمل Intercom Fin وZendesk AI وChatbase وWeav وWatermelon وHeyy وAda وChipp.

8 دقائق قراءة قراءة
اقرأ
ai-machine-learning
Aug 22, 2026

أفضل منشئي المواقع بالذكاء الاصطناعي: قارنا 8 وننشر 2

خطة Framer Basic بسعر 10$/شهر هي الخيار الافتراضي لموقع وكالة من صفحة واحدة بين أفضل منشئي المواقع بالذكاء الاصطناعي التي قيّمناها في 17 أغسطس 2026. وDurable أسرع وصولًا إلى رابط منشور. أما Webflow فهي الوجهة عندما تكون الحاجة تحكمًا بمستوى Designer.

8 دقائق قراءة قراءة
اقرأ
ابدأ مشروعك

هل أنت مستعد لبناء شيء استثنائي؟

دعنا نحول رؤيتك إلى واقع. فريقنا جاهز لمساعدتك في إنشاء برمجيات تصنع الفرق.