← جميع المقالات

الاتجاه: فتاة في مدرجات مباراة كورية - كيف يفعلون ذلك

إطار الذكاء الاصطناعي بأسلوب بث KBO: فتاة مع مروحة على المنصة

باختصار عن الشيء الرئيسي (BLUF)

الاتجاه الحالي: فتاة تجلس على مدرجات مباراة كورية والمصورة تجوب المنصة بين الجمهور. نشرح قالبين — للصور وللفيديو — وكيف تعمل التقنية تحت الغطاء، وكيف تصنع مقطعاً مشابهاً بنفسك، وأين يفشل هذا الأسلوب.

انظر إلى أي من هذه القضبان بعناية. قناة تلفزيونية كورية، شعار SPOTV، لوحة النتائج مع الأدوار. تنظر الكاميرا إلى المنصة - الفتاة تجلس ولا تنظر إلى العدسة وتنظر إلى مكان ما نحو الحقل. 5 ثواني. الجميع.

الفيديو حصل على مليون مشاهدة. في التعليقات: "من أين حصلت على هذا الفيديو"، "هل كنت حقًا في كوريا"، "هل هذه شبكة عصبية أم شبكة حية". ومعظم الناس لا يستطيعون معرفة ذلك. هذا هو السبب.

لقد جمعنا نموذجين جاهزين -افتح "الاتجاهات" على NeuralSpace. تلتقط إحدى البطاقات صورة، بينما تلتقط الثانية مقطع فيديو.

قالبين: الصور والفيديو

"الفتاة على المنصة - الصورة."يلتقط صورة لوجهك ويضع إطارًا من الصفر بأسلوب بث SPOTV: المدرجات، وأضواء الملعب، والمشجعين الكوريين النموذجيين في الخلفية، وزجاج بلاستيكي في يدك، ومروحة على الجانب. بدون مظهر مصقول بتقنية الذكاء الاصطناعي - على العكس من ذلك، مع ضوضاء الضغط وضبابية الحركة الخفيفة والجلد الحقيقي. الهدف هو جعلها تبدو وكأنها لقطة تم بثها بشكل عشوائي، وليس مثل جلسة تصوير أزياء. تحت الغطاء - صورة GPT 2. من 6 رموز لكل جيل.

"الفتاة على المنصة - فيديو."نفس الوجه، ولكن في الحركة. تقوم بتحميل صورة - يقوم نموذج تحويل الصورة إلى فيديو Kling 3.0 بإنشاء مقطع مدته 5 ثوانٍ "مباشر من الملعب": نفس زاوية بث الكاميرا، والحشد في الخلفية، ونفس الوضع المريح. 50 رمزًا في الوضع القياسي، أو أكثر في الوضع الاحترافي.

مدرجات مباراة كورية وكأس من أعواد الثقاب - مشهد لاتجاه شائع في مجال الذكاء الاصطناعي

كيف يعمل تحت غطاء محرك السيارة

صورة. لا يوجد إطار، يتم إنشاؤه من الصفر. لكن بقواعد صارمة: لا تنقيح ولا "تكبير العيون" ولا لمعان بلاستيكي. وينص الطلب صراحة على أنه يجب أن يبدو وكأنه لقطات حقيقية من كاميرا بث منخفضة الجودة، مع كل عيوبها - تلطيخ طفيف، وضوضاء رقمية، وهج من العرق. وهذا ما يعطي الشعور بـ "الإطار الحقيقي" وليس "الخلايا العصبية".

فيديو. يأخذ برنامج Kling 3.0 من الصورة إلى الفيديو صورتك كإطار أول ويحرك المشهد عند الطلب: دوران طفيف للرأس، وحركة الحشد في الخلفية، وميض، وتعبيرات الوجه "نظرة مركزة بشكل مدهش على الميدان". من الواضح أن المطالبة تتطلب إطارًا أفقيًا بنسبة 16:9 وجودة بث بحيث تتناسب مع تنسيق rils المقصوص ولا تبدو مثل I2V مع امتداد عمودي.

كيف نفعل ذلك يدويا

إذا كنت لا تريد استخدام القالب:

للصور.هل أنت ذاهب لقسم الصور، حدد صورة GPT 2، وأرفق صورة شخصية كمرجع واكتب طلبًا باللغة الكورية (يفهم النموذج ذلك بشكل أفضل في سياق التلفزيون الكوري):

업로드한 인물 얼굴은 실제 그대로 유지하고, AI 미남미녀 느낌 말고 «진짜 KBO 생중계 카메라에 우연히 잡힌 일반인 관중» 처럼 자연스럽게 생성. SPOTV KBO 방송 캡처 느낌, 관중석 직캠 구도. 얼굴 과보정 금지, 눈 키우기 금지, 피부 뽀샤시 금지.

للفيديو.هل أنت ذاهب لقسم الفيديو، حدد Kling 3.0، وأرفق نفس الصورة (يمكنك التقاطها أولاً في قالب صورة)، 16:9، اطلب:

Realistic sports broadcast screenshot-style documentary video set in the spectator stands of a Korean professional baseball game. The person from the attached image is sitting in the stadium seats with delicate facial features and a surprised yet focused expression as he/she looks toward the field. The person wears a baseball team jersey. Horizontal 16:9 broadcast frame, realistic TV capture quality.

أي مسار عمل: أولاً قالب صورة (تحصل على إطار "البث" المثالي)، ثم تضع هذا الإطار في قالب فيديو - وتحصل على 5 ثوانٍ من نسخة متحركة من نفس الشخص على المنصة.

حيث ينكسر

صورة. الصورة الشخصية المرجعية واضحة جدًا ومشرقة - يحاول النموذج سحب "لمعانه" إلى الإطار، والنتيجة ليست بثًا، بل لقطة أزياء. تعمل الصورة الذاتية البسيطة بدون مرشحات بشكل أفضل. إذا كانت النتيجة جميلة جدًا، قم بتجديدها؛ يحتوي الطلب بالفعل على جميع المحظورات المفروضة على التنقيح، ولكن في بعض الأحيان لا يزال النموذج موجهًا نحو "المؤثر".

فيديو. يوفر Kling 3.0 حركة جيدة للرأس والخلفية، ولكن إذا كانت الصورة "استوديو" (خلفية بيضاء مسطحة وإضاءة مثالية) - فإنها تسحب هذا الضوء إلى مشهد الاستاد، وتحصل على مزيج غريب. تعمل الصور الشخصية بشكل أفضل مع الإضاءة المتوسطة، بدون ظلال صلبة.

يحاول

قالبين جاهزينقسم الاتجاهات. إذا كنت تريد إطارًا ثابتًا لمنشور ما، فاستخدم بطاقة صورة على GPT Image 2. وإذا كنت تريد مقطع فيديو مدته 5 ثوانٍ للبكرة، فاستخدم بطاقة فيديو على Kling 3.0. يمكنك القيام بذلك في مجموعة: أولاً صورة، ثم من هذه الصورة - فيديو.

Two NeuralSpace trend cards:
The working pipeline: GPT Image 2 builds a broadcast-style still from your selfie, then Kling 3.0 turns that frame into a 5-second clip
Two NeuralSpace trend cards:
The working pipeline: GPT Image 2 builds a broadcast-style still from your selfie, then Kling 3.0 turns that frame into a 5-second clip

الأسئلة المتداولة (الأسئلة الشائعة)

سؤال: كيف تحصل على أفضل نتيجة من الشبكة العصبية؟
الإجابة: استخدم المطالبات التفصيلية (الأوصاف) باللغة الإنجليزية، واضبط نمط المشهد وتفاصيله.

سؤال: هل يمكن استخدام هذه المواد لأغراض تجارية؟
الإجابة: نعم، المحتوى الذي تم إنشاؤه ملك لك بالكامل.