مراجعة مولّد فيديو PixVerse ودليل V6
تغطي هذه المراجعة لـ pixverse-video-generator طراز PixVerse V6، وهو النموذج الرئيسي الحالي الذي أطلقته AIsphere في 30 مارس 2026 (مدوّنة PixVerse، 2026). يقدّم V6 مقاطع 1080p أصلية، وصوتًا أصليًا في تمريرة واحدة، ونصًّا متعدد اللغات داخل الإطار، وأكثر من 20 تحكّمًا سينمائيًا في الكاميرا. إنه النموذج الحالي وليس نسخة مهجورة.
إفصاح أوّلي: هذه المراجعة مبنية على وثائق PixVerse الرسمية وعلى اختبارات منشورة من المجتمع على Reddit وTrustpilot. لم يقم PixMind بتشغيل هذه المقاطع بأنفسنا. الشركة الأم هي AIsphere، التي تأسست في بكين عام 2023 على يد وانغ تشانغهو، المسؤول السابق عن الرؤية الحاسوبية في ByteDance. جلبت جولة السلسلة C في يوليو 2026 إجمالي التمويل إلى 439 مليون دولار بتقييم يتجاوز 2 مليار دولار (TechCrunch، 2026). يقع مقر AIsphere الآن في سنغافورة.
أبرز النقاط
- PixVerse V6 هو النموذج الرئيسي الحالي (30 مارس 2026)؛ أما C1 فهو نموذج شقيق سينمائي وليس بديلًا.
- بلغ إجمالي تمويل AIsphere 439 مليون دولار في يوليو 2026 بتقييم يتجاوز 2 مليار دولار (TechCrunch، 2026).
- يكلّف V6 بدقة 1080p مع صوت 23 رصيدًا/ث، أي أن مقطعًا مدته 5 ثوانٍ يبلغ نحو 23 دولارًا وفق السعر الأساسي.
- أُيقف العمل بـ V2.x في 2026. اعتبر أي شرح يعتمد على V2.x قديمًا.
افتح أداة PixVerse على PixMind
ما هو PixVerse؟
PixVerse هو خط منتجات الفيديو بالذكاء الاصطناعي من AIsphere، والمعروف بالصينية باسم 北京爱诗科技 أو Beijing Aishi Technology. أسّس وانغ تشانغهو وجيدن شيه الشركة في بكين عام 2023، ومقرّها الآن في سنغافورة (TechCrunch، 2026). يظهر خلفية وانغ في الرؤية الحاسوبية لدى ByteDance في قوة PixVerse في اتساق الحركة واستمرارية الشخصيات.
يمتدّ خط النماذج من V2 (يوليو 2024)، ثم V2.5، V3.5، V4 (فبراير 2025)، V4.5، V5، V5.5، V5.6، إلى V6 (30 مارس 2026، النموذج الرئيسي الحالي). C1 (7 أبريل 2026) نموذج شقيق سينمائي وليس بديلًا. يأتي R1 باعتباره فئة الوقت الحقيقي (يناير 2026). أُوقف العمل بـ V2.x في 2026، لذا فإن أي شرح يعتمد على مخرجات V2.x قد أصبح قديمًا.
[رسم بياني: خط زمني لسلالة نماذج PixVerse — V2 (يوليو 2024)، V2.5، V3.5، V4 (فبراير 2025)، V4.5، V5، V5.5، V5.6، V6 (30 مارس 2026، النموذج الرئيسي الحالي)، C1 (7 أبريل 2026، نموذج شقيق سينمائي)، R1 (يناير 2026، وقت حقيقي) — المصدر: pixverse.ai/blogs + PR Newswire]
[رؤية فريدة] تهمّ حالة «الحالي» هنا أكثر من المعتاد. لقد شهد كلٌّ من Midjourney وVeo وImagen في 2026 عملية تسليم فقدت فيها النسخة الأقدم وصولها إلى الواجهة البرمجية أو أُعيد توجيهها. لم يحدث ذلك مع PixVerse V6. يمكنك بدء مشروع اليوم دون موعد نهائي للترحيل يلوح في الأفق، وهو أمر نادر لإصدار لعام 2026.
يدّعي المزوّد وجود أكثر من 100 مليون منشئ في 175 دولة. تعاملوا مع هذا الرقم باعتباره رقمًا تسويقيًا يُذكر ذاتيًّا، وليس رقمًا مُدقَّقًا بشكل مستقل. يمنح إجمالي التمويل البالغ 439 مليون دولار والتقييم الذي يتجاوز 2 مليار دولار لـ PixVerse قدرة مالية تفتقر إليها معظم شركات الفيديو بالذكاء الاصطناعي ذات الأصول الصينية (TechCrunch، 2026).
حوّل مقطعًا مرجعيًّا إلى موجّه قابل لإعادة الاستخدام
مولّد فيديو PixVerse: الميزات الرئيسية
تبدأ ميزات V6 الرئيسية بالإخراج الأصلي بدقة 1080p والمقاطع التي تتراوح بين 1 و15 ثانية. يمكنه إنتاج أفلام قصيرة متعددة اللقطات من موجّه واحد، مع صوت أصلي في تمريرة واحدة (مدوّنة PixVerse، 2026). كما يأتي النموذج بأكثر من 20 تحكّمًا سينمائيًا في الكاميرا، ونص متعدد اللغات داخل الإطار، وCharacter Lock لمراجع متعددة الصور.
أفلام قصيرة متعددة اللقطات من موجّه واحد
يستطيع V6 ربط اللقطات من موجّه واحد في فيلم قصير. كانت إصدارات PixVerse السابقة تولّد مقطعًا واحدًا لكل موجّه. يخطّط V6 للقطعات بين اللقطات بنفسه، وهو أمر مهم بالنسبة إلى لوحات القصص والإعلانات ومقاطع السوشيال.
يُبلغ مستخدمو Reddit أن اتساق اللقطات المتعددة على V6 أضعف منه على النموذج الشقيق C1 (reddit.com/r/PixVerse، 2026). لقد ضُبط C1 من أجل الاستمرارية السينمائية. وضُبط V6 من أجل اتساع التحكّم. اختر النموذج الذي يطابق عبء العمل لديك.
الصوت الأصلي وأكثر من 20 تحكّمًا في الكاميرا
يُولّد الصوت الأصلي الصوت والصورة في تمريرة واحدة. ويُلغي ذلك خطوة الدبلجة لكل من الحوار والصوت المحيطي والمؤثرات. تصف سلاسل Reddit r/PixVerse الصوت بأنه «خشن ويتطلب عدة محاولات»، لذا خطّط لإعادة توليد المقاطع حتى تستقر.
تغطي التحكّمات العشرون-plus في الكاميرا كلًّا من الدوللي والبان والإمالة والتقريب والمدار والرافعة وتحويل التركيز. يمكنك سلسلة الحركات داخل موجّه واحد، وهنا يتقدّم V6 على المنافسين الذين يكشفون حركة واحدة فقط لكل مقطع.
Character Lock والنص متعدد اللغات
يسمح Character Lock بإدخال عدة صور مرجعية للموضوع نفسه. يحافظ V6 على الوجه والملابس عبر اللقطات، وهي الميزة التي تطلبها وكالات الإعلان وصانعو الأفلام القصيرة أولًا. يتعرّض النص متعدد اللغات داخل الإطار للإنجليزية والصينية وغيرها من أنظمة الكتابة الرئيسية، وهو أمر مهم في أعمال الملصقات والإعلانات.
Cinematic shot, 1080p, 5 seconds: woman in red jacket walks through neon-lit
Tokyo alley at night, rain on pavement, dolly-in from medium to close-up,
ambient rain audio, in-frame neon sign reads "OPEN 24 HRS",
Character Lock reference: character_ref_01.png
[تجربة شخصية] بناءً على تجربتنا في مراجعة أدوات الفيديو بالذكاء الاصطناعي لمسارات عمل PixMind، فإن تعدّد اللقطات بموجّه واحد هو الميزة الأكثر استحقاقًا لاختبار الإجهاد قبل الوثوق بها في تسليم عمل للعميل. شغّل الموجّه نفسه ثلاث مرات، واحسب عدد المرات التي تُحافظ فيها ملابس الشخصية على حالها بين القصعات، ثم قرّر.
[صورة: مثال جنباً إلى جنب لمقطعي PixVerse V6 بدقة 1080p يُظهر Character Lock وهو يحافظ على وجه الموضوع وسترته الحمراء عبر لقطتين مختلفتين في تسلسل الموجّه نفسه. مصطلحات البحث: «pixverse v6 character lock multi-shot example»]
المؤثرات والقوالب وواجهة CLI
يرث V6 منظومة مؤثرات وقوالب PixVerse، وهي واحدة من أوسع المكتبات في مجال الفيديو بالذكاء الاصطناعي لعام 2026. تأتي واجهة CLI إلى جانب واجهة الويب، مع توافق مع Claude Code وCodex وCursor وOpenClaw. يهمّ هذا إن كنت تبني مسارات تُسكربت مهام المعالجة من مصدر موجّهات.
المواصفات: الدقة والطول ونسب العرض إلى الارتفاع
يُخرج V6 بدقة 1080p أصليًّا ويصل إلى 4K عبر وضع Upscale بتكلفة +5 أرصدة لكل ثانية (docs.platform.pixverse.ai، 2026). يتراوح طول المقطع بين 1 و15 ثانية. تشمل نسب العرض إلى الارتفاع 9:16 و16:9 و1:1 و21:9. يُبلَّغ عن معدّل الإطارات حتى 30 إطارًا/ث، غير أن هذا الرقم ليس في الوثائق الرسمية ويأتي من اختبارات المجتمع.
| المواصفات | V6 |
|---|---|
| الدقة الأصلية | 1080p |
| الحد الأقصى للدقة | 4K عبر Upscale (+5 أرصدة/ث) |
| طول المقطع | 1 إلى 15 ثانية |
| نسب العرض إلى الارتفاع | 9:16، 16:9، 1:1، 21:9 |
| معدّل الإطارات | حتى 30 إطارًا/ث (غير موجود في الوثائق الرسمية) |
| الأوضاع | Text-to-Video، Image-to-Video، Transition، Extend، Fusion |
نسبة 21:9 هي عامل التمييز في أعمال الإعلانات والمقطعات الدعائية. تتوقف معظم نماذج الفيديو لعام 2026 عند 16:9. يُعدّ PixVerse واحدًا من قلّة يقدّمون مخرجات أناموفيك أصلية، ما يوفّر خطوة الإطار الأسود في المعالجة اللاحقة.
تحمل مقاطع الباقة المجانية علامة مائية. تزيلها الباقات المدفوعة، وإنّ تفاصيل سياسة العلامة المائية الدقيقة ليست في الوثائق الرسمية وقد تختلف بين التطبيق الاستهلاكي والواجهة البرمجية.
تسعير مولّد فيديو PixVerse
يعمل التسعير على نظام أرصدة وفق سعر أساسي 1 دولار يساوي 5 أرصدة (docs.platform.pixverse.ai، 2026). تكلّف V6 في وضعَي Text-to-Video وImage-to-Video بدقة 1080p دون صوت 18 رصيدًا لكل ثانية. ترفع إضافة الصوت الأصلي ذلك إلى 23 رصيدًا لكل ثانية. وفق السعر الأساسي، يبلغ مقطع V6 بدقة 1080p لمدة 5 ثوانٍ مع صوت 115 رصيدًا، أي نحو 23 دولارًا.
| الوضع | الدقة | الصوت | أرصدة/ث |
|---|---|---|---|
| V6 T2V / I2V | 360p | لا | 5 |
| V6 T2V / I2V | 1080p | لا | 18 |
| V6 T2V / I2V | 1080p | نعم | 23 |
| C1 | 1080p | لا | 19 |
| C1 | 1080p | نعم | 24 |
| Upscale | إلى 4K | لا ينطبق | +5 |
| إضافة SFX | لا ينطبق | نعم | +2 |
| إضافة Lip sync | لا ينطبق | نعم | +4 |
[رؤية فريدة] تستشهد تدوينات قديمة من حقبة V5 برقم «0.30 إلى 0.45 دولارًا لكل فيديو» لا يصمد على V6 بدقة 1080p. جاء ذلك الرقم من مخرجات 360p دون صوت. التكلفة الصادقة لكل فيديو على V6 بدقة 1080p مع صوت أقرب إلى 23 دولارًا لمدة 5 ثوانٍ، لا أربعين سنتًا. إن رأيت الرقم القديم في شرح فهو قديم.
تخفض اشتراكات الواجهة البرمجية التكلفة الفعلية لكل مقطع. تبلغ Essential مبلغ 100 دولار شهريًّا مقابل 15,000 رصيد. وتبلغ Scale مبلغ 1,500 دولار شهريًّا مقابل 239,230 رصيدًا. وتبلغ Business مبلغ 6,000 دولار شهريًّا مقابل 1,069,500 رصيد. تتراوح باقات الدفع حسب الاستخدام بين 10 دولارات مقابل 1,000 رصيد و5,000 دولار مقابل 500,000 رصيد.
لا تزال عمليات التوليد الفاشلة تستهلك الأرصدة. ويمثّل ذلك بند تكلفة حقيقيًّا على V6، خصوصًا مع الصوت الأصلي حيث يعني الخرج الخشن للتمريرة الأولى إعادات أكثر.
[رسم بياني: رسم بالأعمدة يقارن تكلفة V6 لكل ثانية — 360p دون صوت 5 أرصدة، 1080p دون صوت 18 رصيدًا، 1080p مع صوت 23 رصيدًا، C1 مع صوت 24 رصيدًا — المصدر: docs.platform.pixverse.ai]
كيفية الوصول إلى PixVerse مجانًا
ثمّة ثلاثة مسارات وصول حقيقية. يوفّر تطبيق PixVerse الاستهلاكي على pixverse.ai باقة مجانية بأرصدة يومية. يخضع التحديد اليومي الدقيق للأرصدة لتطبيقك الحالي، وتتضارب المصادر حول الرقم. تحقّق من pixverse.ai للحصول على الرقم الحيّ بدلًا من الثقة بادّعاء ثابت في مدوّنة.
المسار الثاني هو غلاف PixMind على /pixverse-video. يكشف عن V6 عبر واجهة متصفّح دون إعداد للواجهة البرمجية. هذا هو المسار الذي نوصي به للمستخدمين الجدد الذين يرغبون في تقييم النموذج قبل الالتزام بخطة مدفوعة.
المسار الثالث هو fal.ai، الذي يستضيف V6 للمطوّرين الراغبين في وصول برمجي دون اشتراك PixVerse. يتبع تسعير fal.ai جدول رموز خاصًّا به، لذا قارنه بالسعر الرسمي للأرصدة قبل الالتزام.
يحمل خرج الباقة المجانية علامة مائية. تزيلها الباقات المدفوعة، ويتعامل التطبيق الاستهلاكي والواجهة البرمجية مع سياسة العلامة المائية بشكل مختلف. خطّط للترقية قبل تسليم عمل العميل، لأن المقاطع ذات العلامة المائية غير قابلة للتسليم في معظم السياقات التجارية.
PixVerse مقارنةً بنماذج فيديو الذكاء الاصطناعي الأخرى
لا يوجد معيار من الفئة الأولى يرتّب V6 وجهًا لوجه مقابل Runway وVeo 3.1 وSora 2 وKling 3.0 وSeedance 2.5. تعامل مع المقارنة أدناه باعتبارها نوعيةً، مستخلصةً من اختبارات المجتمع وترتيبات الساحات. لاحظ أن واجهة Veo 3 البرمجية أُوقفت في 30 يونيو 2026، لذا يجب أن تستخدم أي مقارنة مع Veo نسخة Veo 3.1.
مقارنةً بـ Runway: Runway أقوى في توجيه الكاميرا الصريح والتحكّم على مستوى الإطار المفتاحي. يتفوّق V6 في اتساع الموجّهات وفي إنتاج مقطع قابل للاستخدام من جملة واحدة بأقل توجيه يدوي. اختر Runway للوحات القصص الدقيقة. اختر V6 لسرعة توليد الأفكار.
مقارنةً بـ Veo 3.1: يتقدّم Veo 3.1 في الحركة السينمائية والواقعية. ينافس V6 على السعر وعلى نسبة العرض إلى الارتفاع 21:9 التي لا يقدّمها Veo أصليًّا. كما تدفع بوابة Veo المدفوعة فقط منشئي المحتوى الحساسين للميزانية نحو V6.
مقارنةً بـ Sora 2: يتقدّم Sora 2 في واقعية السرد لكنه مدفوع فقط ومحجوب. V6 خيار أكثر قابلية للوصول للاختبار دون التزام اشتراك، وهو أمر مهم في الاستكشاف الإبداعي المبكر.
مقارنةً بـ Kling 3.0: يتفوّق Kling في السرعة وفي مقاطع الصيغ الأطول. يتفوّق V6 في تكامل الصوت وفي منظومة المؤثرات والقوالب، وهي أكثر تطوّرًا من Kling وقت النشر.
مقارنةً بـ Seedance 2.0 و2.5: يتقدّم Seedance في اتساق الشخصية وهو قوي في مسار عمل السوق الصينية. يتقدّم V6 في تحكّمات الكاميرا السينمائية وفي النص متعدد اللغات داخل الإطار بما يتجاوز الصينية.
مقارنةً بـ PixVerse C1: C1، النموذج الشقيق السينمائي، يتفوّق على V6 في اتساق اللقطات المتعددة وفق اختبارات Reddit (reddit.com/r/PixVerse، 2026). يتفوّق V6 على C1 في اتساع التحكّم وتكامل الصوت الأصلي ومنظومة المؤثرات. شغّلهما جنبًا إلى جنب في الأعمال السينمائية.
قيود يجب معرفتها
يعترف PixVerse رسميًّا بأن التحكّم الاتجاهي الدقيق في المشاهد المعقّدة والاتساق عبر التغييرات المكانية الكبيرة ما زال في تطوّر (مدوّنة PixVerse، 2026). وهي قيود اعترف بها المزوّد لا تخمينات من المجتمع.
لا تزال الوجوه البشرية أثناء الحركة، خصوصًا لقطات الكلام عن قرب، صعبة. الصوت الأصلي خشن ويتطلب عدة محاولات، وفق سلاسل Reddit r/PixVerse. اتساق اللقطات المتعددة على V6 أضعف منه على النموذج الشقيق C1. لا تزال عمليات التوليد الفاشلة تستهلك الأرصدة، ما يرفع التكلفة الفعلية في اليوم السيّئ.
تظهر نزاعات فوترة الاشتراك على Trustpilot (trustpilot.com، 2026). تتمحور الشكاوى حول سلوك التجديد التلقائي ومعاملة المبالغ المستردّة. اقرأ شروط الفوترة قبل الالتزام بخطة سنوية، وفضّل الدفع الشهري حتى تثق بمسار العمل.
[صورة: لقطة شاشة لحالة توليد فاشلة على PixVerse V6 أنتجت لقطة كلام عن قرب تشوّهًا واضحًا في الوجه، ما يُجسّد القيد المُعترف به رسميًّا بشأن الوجوه البشرية أثناء الحركة. مصطلحات البحث: «pixverse v6 talking face distortion example»]
الأسئلة الشائعة
هل PixVerse V6 هو النموذج الحالي؟
نعم. أُطلق V6 في 30 مارس 2026 وهو النموذج الرئيسي الحالي (مدوّنة PixVerse، 2026). C1، الذي أُطلق في 7 أبريل 2026، نموذج شقيق سينمائي وليس بديلًا. أُوقف العمل بـ V2.x في 2026. لا يوجد V7 بعد.
من يصنع PixVerse؟
تصنع PixVerse شركة AIsphere، المعروفة بالصينية باسم 北京爱诗科技 أو Beijing Aishi Technology. أسّس وانغ تشانغهو، المسؤول السابق عن الرؤية الحاسوبية في ByteDance، وجيدن شيه الشركة في 2023 في بكين. ومقرّها الآن في سنغافورة (TechCrunch، 2026).
كم تبلغ تكلفة مقطع V6؟
tكلّف مقطع V6 بدقة 1080p لمدة 5 ثوانٍ مع صوت أصلي 115 رصيدًا، أي نحو 23 دولارًا وفق السعر الأساسي 1 دولار يساوي 5 أرصدة (docs.platform.pixverse.ai، 2026). ينطبق الرقم القديم «0.30 إلى 0.45 دولارًا لكل فيديو» من تدوينات حقبة V5 على خرج 360p دون صوت، لا على V6.
هل توجد باقة مجانية؟
نعم. يقدّم تطبيق PixVerse الاستهلاكي على pixverse.ai باقة مجانية بأرصدة يومية (pixverse.ai، 2026). التحديد اليومي الدقيق يخضع للتطبيق الحالي ويختلف بين المصادر. كما يكشف غلاف PixMind على /pixverse-video عن V6 عبر واجهة متصفّح.
متى يجب أن أستخدم C1 بدلًا من V6؟
استخدم C1 للأعمال السينمائية متعددة اللقطات حيث تكون الاستمرارية بين القصعات هي الأهم. استخدم V6 عندما تحتاج إلى تحكّم أوسع أو صوت أصلي أو أكثر من 20 حركة كاميرا أو منظومة المؤثرات والقوالب. يوصي مستخدمو Reddit r/PixVerse بتشغيل كليهما على الموجّه نفسه والمقارنة (reddit.com/r/PixVerse، 2026).
الحكم: PixVerse V6 خيار قوي وحالي
PixVerse V6 نموذج رئيسي حالي لعام 2026 بلا موعد نهائي للترحيل، مع إخراج أصلي بدقة 1080p، وأفلام قصيرة متعددة اللقطات من موجّه واحد، وصوت أصلي، وأكثر من 20 تحكّمًا سينمائيًا في الكاميرا. تمنحه سلالة AIsphere وإجمالي تمويلها البالغ 439 مليون دولار قدرة على الاستمرار حتى دورة النماذج التالية. ويغطّي C1 الحالة السينمائية متعددة اللقطات التي يعترف V6 بأنها ما زالت في تطوّر.
الإطار الصادق لبحث pixverse-video-generator هو أن V6 نقطة الانطلاق الصحيحة اليوم، مع تحفّظين. لا تزال عمليات التوليد الفاشلة تستهلك الأرصدة، لذا شغّل مقاطع اختبار بدقة 360p قبل الإنفاق على 1080p مع صوت. كما أن الصوت الأصلي خشن بما يكفي لدفعك إلى إعادة التوليد، ما يراكم التكلفة.
للمستخدمين الجدد، يُعدّ غلاف PixMind أبسط مسار. وللمطوّرين، يستضيف fal.ai نموذج V6 مع وصول برمجي. وللأعمال عالية الحجم، يخفض اشتراك Essential أو Scale التكلفة الفعلية لكل مقطع بشكل كبير مقارنةً بالدفع حسب الاستخدام.



