छवि और वीडियो जनरेशन AI समाचार — 2026-09-13
OpenAI का Sora इस महीने के अंत में API बंद करके हट रहा है, जबकि Google के Nano Banana Pro/Veo 3.1 और चीन के Seedance 2.5/Kling 3.0 क्लोज़्ड-सोर्स क्षेत्र के प्रमुख बन रहे हैं। ओपन-सोर्स में Wan2.2, FLUX.2 और Qwen Image व्यावहारिक SOTA के रूप में स्थापित होकर बड़े पैमाने के उत्पादन चरण में प्रवेश कर चुके हैं।
छवि और वीडियो जनरेशन AI की ताज़ा खबरें — 2026-09-13
चलो, सभी 6 SNS (Reddit, X, YouTube, Bluesky, Lemmy, Pinterest) खंगाल आए 🔥 निष्कर्ष साफ है: क्लोज़्ड-सोर्स खेमे में पूरी तरह नेतृत्व बदलाव चल रहा है! OpenAI का Sora 24/9 को API सहित बंद हो रहा है, और उसकी जगह Google का Veo 3.1 व Nano Banana Pro (Gemini 3 Pro Image), साथ ही ByteDance का Seedance 2.5 और Alibaba का Kling 3.0, “अभी इस्तेमाल करने लायक टूल” के रूप में ज़बरदस्त चर्चा में हैं 😳 दूसरी ओर, Wan2.2, FLUX.2, Qwen Image और LTX जैसे ओपन-सोर्स मॉडल मानक बन चुके हैं। वे अब “खिलौने” नहीं, बल्कि क्लोज़्ड मॉडल से सीधे तुलना किए जाने वाले वास्तविक SOTA (सर्वश्रेष्ठ) मॉडल हैं 💪 हालांकि, X और Bluesky से संग्रह ठीक से नहीं हो पाया, इसलिए वहाँ जानकारी सीमित है।
सभी प्लेटफ़ॉर्म पर
- Sora बंद → Google/चीनी मॉडल केंद्र में: Reddit, YouTube, Lemmy और Pinterest सभी एक ही कहानी बता रहे हैं: “OpenAI Sora सिमट रहा है या हट रहा है; Veo/Nano Banana Pro/Seedance/Kling की ओर बढ़ो।” YouTube के अनुसार, 2026 का कोई भी वीडियो अब Sora को “जिस टूल पर नज़र रखनी चाहिए” नहीं मानता (YouTube #1)। Lemmy पर भी “OpenAI के Sora बंद करने से $30M की AI फिल्म रुक गई” वाली खबर मिली (Lemmy #9)।
- Nano Banana Pro (Gemini 3 Pro Image) ने चर्चा पर कब्ज़ा किया: YouTube पर कई चैनलों ने एक साथ “INSANE” और “TERRIFYING” जैसे शीर्षकों के साथ प्रतिक्रिया दी (YouTube #2)। Bluesky पर वॉटरमार्क पहचान सुविधा चर्चा में रही (Bluesky #1)। Reddit पर $0.039 प्रति छवि जैसी ठोस कीमत के साथ इसका नाम आया। तीन स्वतंत्र प्लेटफ़ॉर्म पर एक ही मॉडल को लेकर यह प्रतिक्रिया एक मजबूत संकेत है 💥
- ओपन सोर्स “उत्पादन चरण” में: Lemmy ने FLUX, MiniMax H3, LTX-2.5 और Boogu-Image-0.1 जैसे नए मॉडल व अडैप्टर लगभग रोज़ जारी होते देखे (Lemmy #4)। YouTube भी Wan2.2, FLUX और Qwen Image को स्थानीय SOTA कहता है (YouTube #10)। निजी GPU पर चलने वाले VRAM-अनुकूलित संस्करणों, जैसे 24GB संस्करण, में खास रुचि है।
- चीनी वीडियो मॉडल हर जगह तेज़ी से उभर रहे हैं: Seedance 2.5 (ByteDance) और Kling 3.0 (Alibaba) का नाम Reddit, YouTube, Lemmy और Pinterest, सभी पर मिला। Pinterest पर इन्हें “China Just Took AI Video Too Far” जैसे उकसाऊ शीर्षकों और फिल्म-पोस्टर जैसे विज़ुअल के साथ पेश किया गया (Pinterest #42 के अनुरूप आइटम; मूल Pinterest छवि में है)।
- “असली या नकली?” की चिंता बढ़ रही है: Reddit का r/isthisAI (4.1 लाख सदस्य) जनरेटेड सामग्री पहचानने का एक प्रमुख समुदाय है। Pinterest पर “FAKE” स्टैंप और “Which is AI?” क्विज़ वाली कई छवियाँ हैं। Apple के नए iPhone द्वारा तस्वीर लेते समय सत्यापन रिकॉर्ड सहेजने की सुविधा भी चर्चा में रही। उत्पादन तकनीक से अधिक उसे पहचानने वाली तकनीक में बढ़ती रुचि उल्लेखनीय है।
प्लेटफ़ॉर्म अनुसार
Reddit: 8 सबरेडिट और 12 थ्रेड का विश्लेषण हुआ। सबसे उल्लेखनीय था “अनसेंसर्ड एग्रीगेटर” का सहज उल्लेख—WildOwl जैसे प्लेटफ़ॉर्म Seedream/Kling/Veo/GPT Image को जोड़कर फिर से बेचते हैं—और “असीमित” वीडियो-जनरेशन सब्सक्रिप्शन पर गहरा अविश्वास। सबसे अधिक सहभागिता (4,841pt) किसी टूल समाचार को नहीं, बल्कि AI-जनित छवि से विवाद भड़काने की कोशिश को Community Notes द्वारा पकड़े जाने को मिली; यह Reddit की प्रकृति को दिखाता है 😂 ओपन-सोर्स रुझान को सीधे संबोधित करने वाले थ्रेड लगभग नहीं मिले, जो इस छह-प्लेटफ़ॉर्म ब्रीफ की स्पष्ट कमी है।
X: ईमानदारी से कहें तो यह चरण लगभग पूरी तरह विफल रहा 😇 इकट्ठे किए गए 40 पोस्ट वास्तव में X Explore के क्रोएशिया-आधारित ट्रेंड शब्दों—Slack, Chelsea, Houthis आदि—की खोज से आए और छवि/वीडियो जनरेशन AI से असंबंधित थे। केवल Cursor के कोडिंग एजेंट से जुड़ा एक पोस्ट और चीन में बनी 96GB RTX 5090 (स्थानीय AI के लिए GPU) से जुड़ा एक पोस्ट थोड़ा संबंधित था। अपेक्षित लगभग 20 पोस्ट के विश्लेषण से बहुत कम, इसलिए X के बारे में इस बार लगभग कोई उपयोगी निष्कर्ष नहीं है।
YouTube: 12 वीडियो देखे गए; छह प्लेटफ़ॉर्म में सबसे समृद्ध जानकारी यहीं मिली। Sora का अंत, Nano Banana Pro की बेहद उत्साही प्रतिक्रिया, Kling 3.0 बनाम Veo 3.1 बनाम Runway Gen-4.5 की सीधी तुलना, और FLUX.2 की जटिल लाइसेंस परतें—Apache 2.0 वाले Schnell/Klein से गैर-व्यावसायिक Dev तक, तथा सशुल्क Pro/Flex तक—स्पष्ट रूप से सामने आए। हालांकि YouTube पेज JS-रेंडर्ड हैं, इसलिए व्यू और सब्सक्राइबर की लाइव संख्या नहीं ली जा सकी और द्वितीयक स्रोतों पर निर्भर रहना पड़ा।
Bluesky: आधिकारिक सर्च API ने 403 दिया और लिंक प्रीव्यू से केवल 5 पोस्ट ही पुनर्स्थापित हो सके। फिर भी Google Veo 3, Nano Banana Pro और SynthID वॉटरमार्क डिटेक्शन जैसे क्लोज़्ड मॉडल विषयों के साथ-साथ Stable Diffusion (RealisticVision) इस्तेमाल करने वाले एक क्रिएटर की पोस्ट भी मिली। Bluesky की नीति कि उपयोगकर्ता सामग्री को AI प्रशिक्षण में इस्तेमाल नहीं किया जाएगा, के कारण AI-जनित सामग्री के प्रति माहौल Reddit या X की तुलना में अधिक सतर्क है।
Lemmy: !«メールアドレス» केंद्र में रहा और 16 पोस्ट इकट्ठे हुए, जो 20 के लक्ष्य से कम है। ओपन-सोर्स पक्ष FLUX 3, MiniMax H3, LTX-2.5 और Boogu-Image-0.1 की लगभग रोज़ होने वाली रिलीज़ के “उत्पादन चरण” जैसा दिखता है। क्लोज़्ड पक्ष में नई चमकदार सुविधाओं की अपेक्षा “Sora का सिमटना”, “Google Earth AI का एक दिन में बंद होना”, और “Midjourney के चिकित्सा उपकरणों की ओर जाने” पर व्यंग्य जैसे विवाद व समस्याएँ अधिक दिखीं। Lemmy का समग्र स्वर AI हाइप के प्रति संदेहपूर्ण भी है।
Pinterest: 50 पिन का विश्लेषण किया गया। अधिकतर “Best 5 AI Video Tools” जैसे अफ़िलिएट-शैली इन्फोग्राफ़िक थे, न कि AI-निर्मित कलाकृतियों की गैलरी। चीनी मॉडल, जैसे Seedance और Vidu S1, चमकदार फिल्म-पोस्टर सरीखे विज़ुअल के साथ पेश हुए, जो पश्चिमी टूलों की सपाट तुलना-सूचियों से अलग थे। ओपन-सोर्स शोकेस—जैसे ComfyUI स्क्रीन—लगभग बिल्कुल नहीं थे; Stable Video Diffusion का नाम सिर्फ़ एक बार आया। लाइक और सेव जैसी सहभागिता मेट्रिक्स भी नहीं मिल सकीं।
किन बातों पर नज़र रखें
- Sora API समाप्ति (2026/9/24) — OpenAI का Sora API महीने के अंत में पूरी तरह बंद होगा। देखना होगा कि उपयोगकर्ता Veo, Seedance और Kling में से किसकी ओर जाते हैं (YouTube)।
- FLUX.2 की लाइसेंस परतें — Schnell/Klein मुफ़्त हैं, Dev गैर-व्यावसायिक है और Pro/Flex सशुल्क हैं। व्यावसायिक इस्तेमाल चाहने वालों के लिए यह महत्वपूर्ण चेतावनी बन रही है (YouTube)।
- Wan 3.0 (Alibaba) ओपन-वेट होगा या नहीं — 30-सेकंड नेटिव वीडियो वाला नया मॉडल है, लेकिन फिलहाल इसे ओपन-वेट नहीं माना जा रहा। पक्की जानकारी का इंतज़ार है (YouTube #Limits देखें)।
- EU AI Act Article 50 की लेबलिंग बाध्यता (2026/8/2 से लागू) — EU दर्शकों के लिए AI-जनित वीडियो प्रकाशित करते समय मशीन-पठनीय लेबल लगाना अब क्रिएटर समुदाय में नया प्रतिबंध बनकर उभर रहा है।
- अनसेंसर्ड एग्रीगेटर (WildOwl आदि) — Seedream/Kling/Veo/GPT Image को जोड़कर फिर बेचने वाली सेवाओं को Reddit पर स्वाभाविक समर्थन मिल रहा है (Reddit)।
- प्रामाणिकता-जांच सुविधाओं का विस्तार — iPhone 18 Pro की कैप्चर-टाइम रिकॉर्डिंग और SynthID डिटेक्शन जैसी “क्या यह AI है?” पहचान तकनीकें कितनी व्यापक होती हैं, यह देखना होगा।
सिफ़ारिशें
- अगले X चरण में क्षेत्रीय ट्रेंड शब्दों के बजाय छवि/वीडियो जनरेशन AI से जुड़े कीवर्ड की सीधी खोज की जाए।
- Bluesky का आधिकारिक खोज API 403 से अवरुद्ध है, इसलिए प्रमाणित सत्र के माध्यम से संग्रह मार्ग तैयार किया जाए।
- Lemmy पर
lemmy.mlऔरlemm.eeजैसे अन्य इंस्टेंस भी खोजे जाएँ, ताकि पूर्ण 20-आइटम विश्लेषण के करीब पहुँचा जा सके। - Sora API के 24/9 को बंद होने के बाद वास्तविक माइग्रेशन गंतव्यों को आगामी Reddit/YouTube चरणों में ट्रैक किया जाए।
- Pinterest के लिए लाइक और सेव जैसी सहभागिता मेट्रिक्स लेने की विधि खोजी जाए, जिससे लोकप्रियता का समर्थन हो सके।
- FLUX लाइसेंस स्तर जैसे “क्या व्यावसायिक उपयोग संभव है?” विषयों को ओपन-सोर्स ट्रेंड रिपोर्ट में नियमित निगरानी बिंदु बनाया जाए।
डेटा गुणवत्ता
X पर लगभग पूरी तरह असफलता रही: इकट्ठे 40 पोस्ट विषय से असंबंधित थे और प्रभावी रूप से सिर्फ़ 2 काम आए। Bluesky पर आधिकारिक API 403 से अवरुद्ध रहा; सिर्फ़ 5 पोस्ट सत्यापित हो सकीं और सहभागिता मेट्रिक्स शून्य रहे। Lemmy पर शोर के कारण लक्ष्य 20 की जगह 16 पोस्ट मिलीं। Reddit, YouTube और Pinterest पर पर्याप्त सामग्री मिली, लेकिन Reddit में ओपन-सोर्स रुझान लगभग गायब थे, Pinterest पर लाइक/सेव जैसे लोकप्रियता संकेतक नहीं मिले और YouTube पर लाइव व्यू/सब्सक्राइबर आँकड़े उपलब्ध नहीं हुए।
प्लेटफ़ॉर्म-वार सारांश
Reddit — छवि और वीडियो जनरेशन AI समाचार
चर्चा कहाँ हो रही है
खोज शब्द “Image and Video Generation AI News” से 8 सबरेडिट के 12 थ्रेड इकट्ठे किए गए।
| सबरेडिट | सदस्य | इकट्ठे थ्रेड |
|---|---|---|
| r/AItips101 | 1,350 | 1 |
| r/aivideomaking | 6,871 | 3 |
| r/generativeAI | 152,676 | 3 |
| r/Seedance_AI | 20,826 | 1 |
| r/AIdaily_news | 2,002 | 1 |
| r/isthisAI | 410,165 | 1 |
| r/AIVideos_SFW | 25,950 | 1 |
| r/GetNoted | 298,687 | 1 |
सबसे बड़े समुदाय r/isthisAI (4.1 लाख) और r/GetNoted (2.99 लाख) सीधे AI-जनित सामग्री के विशेषज्ञ सबरेडिट नहीं हैं; उनका उपयोग “क्या यह AI है?” पहचानने या AI-निर्मित गलत सूचना को उजागर करने के लिए होता है। अधिक विशेषज्ञ r/aivideomaking और r/generativeAI 10,000 से 1.5 लाख सदस्यों के हैं और मुफ़्त कोटा, कीमत तथा सेंसरशिप जैसे व्यावहारिक टूल प्रश्नों पर केंद्रित हैं।
प्रतिक्रियाएँ और राय
- थ्रेड #1 (r/AItips101, 161pt, 103 टिप्पणियाँ, 2026-09-07) https://www.reddit.com/r/AItips101/comments/1w9yftp/ — “2026 अनसेंसर्ड AI इमेज जनरेटर रैंकिंग” में WildOwl.ai को पहले स्थान पर रखा गया। इसने Qwen Image, Flux, Seedream, Wan, Kling, Seedance, Veo और GPT Image समेत 35 से अधिक क्लोज़्ड-सोर्स मॉडल को एक प्लेटफ़ॉर्म पर जोड़कर “ढीले फ़िल्टर” को मुख्य ताकत बताया। शीर्ष टिप्पणी (u/randmar, 14pt) ने तुरंत कहा कि Seedream 5.0 Pro का न होना निराशाजनक है।
- थ्रेड #5 (r/generativeAI, 1pt, 12 टिप्पणियाँ, 2026-09-07) https://www.reddit.com/r/generativeAI/comments/1wa4k88/ — “सबसे सस्ता असीमित 1080p image-to-video जनरेशन कौन सा है?” के जवाब में u/ai_art_is_art (3pt) ने कहा: “Unlimited झूठ है। आप $550 डालते हैं, $200 का आउटपुट मिलता है और हर जनरेशन के बीच 24 घंटे इंतज़ार करना पड़ता है।” Runway जैसे उच्च-स्तरीय प्लान की कीमत $76–95 प्रति माह भी बताई गई।
- थ्रेड #6 (r/Seedance_AI, 0pt, 22 टिप्पणियाँ, 2026-09-07) https://www.reddit.com/r/Seedance_AI/comments/1w9zqac/ — मशहूर हस्तियों के वीडियो बनाने की कानूनी ज़िम्मेदारी पर u/Jean_velvet (7pt) ने लिखा कि हालिया अदालती मामले ज़िम्मेदारी उपयोगकर्ता पर डालते हैं और संभावित अपराध वितरण व साझा करना है।
- थ्रेड #7 (r/AIdaily_news, 42pt, 76 टिप्पणियाँ, 2026-09-11) https://www.reddit.com/r/AIdaily_news/comments/1wdkanm/ — रिपोर्ट कि iPhone 18 Pro कैप्चर के समय का ऐसा रिकॉर्ड सहेजेगा जिससे AI-परिवर्तन सत्यापित किए जा सकें। शीर्ष टिप्पणी (u/Not_my_Name464, 7pt) ने इसे क्लाउड स्टोरेज भरवाकर अतिरिक्त शुल्क लेने का बहाना कहा; अगली टिप्पणी (u/pianoboy777, 2pt) ने संदेह जताया कि Apple अंततः छवियों को प्रशिक्षण डेटा के लिए ही खींचेगा।
- थ्रेड #8 (r/isthisAI, 0pt, 31 टिप्पणियाँ, 2026-09-09) https://www.reddit.com/r/isthisAI/comments/1wbspxo/ — “क्या यह वीडियो AI है या असली?” पर u/smalltiddygothb (16pt) ने पूछा कि क्या नेकलेस गायब होकर फिर दिखाई नहीं दे रहा; u/EmergencyWaffleBox (14pt) ने उसी विसंगति के आधार पर इसे AI बताया।
- थ्रेड #10 (r/AIVideos_SFW, 2pt, 1 टिप्पणी, 2026-09-13) https://www.reddit.com/r/AIVideos_SFW/comments/1wet79p/ — Google Flow से बनी समाचार-कार्यक्रम शैली की वीडियो, जिसमें 16 क्लिप में एक ही AI एंकर, सेट और परिधान स्थिर रखे गए। निर्माता u/presentofai ने अपना “reuse-prompt pipeline” बताया: किरदार स्थिर रखना, स्क्रिप्ट से न मिलने वाले टेक को स्वतः दोबारा बनाना और ffmpeg से शब्द-स्तरीय टाइमस्टैम्प पर सबटाइटल, chyron, दर्शक हँसी और म्यूज़िक डकिंग को स्वचालित रूप से मिलाना।
- थ्रेड #11 (r/generativeAI, 0pt, 31 टिप्पणियाँ, 2026-09-10) https://www.reddit.com/r/generativeAI/comments/1wced4g/ — “इसे कैसे बनाया गया!?” के उत्तर में u/lagbit_original (3pt) ने बताया कि Seedance 2.5, एक प्रॉम्प्ट, उपयुक्त संदर्भ छवि, संगीत और संपादन सॉफ़्टवेयर में कुछ कट्स से ऐसा परिणाम बन सकता है।
- थ्रेड #12 (r/GetNoted, 4,841pt, 348 टिप्पणियाँ, 2026-09-10) https://www.reddit.com/r/GetNoted/comments/1wcw3n9/ — संग्रह में सबसे ऊँचा स्कोर। X पर AI-जनित समय-सारणी छवि—जिसमें “Handloags” और “BCDDs” जैसे टूटे हुए अक्षर थे—से विवाद भड़काने वाली पोस्ट को Community Notes ने उजागर किया। u/Competitive-Bee-3250 (193pt) ने व्यंग्य किया कि यह निश्चित ही असली वर्णमाला है; टूटे अक्षर तत्काल AI होने के प्रमाण बन गए।
- थ्रेड #2–#4 (r/aivideomaking, 10pt/16pt/4pt, 2026-09-06–09) https://www.reddit.com/r/aivideomaking/comments/1w953eo/ 、https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/ 、https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/ — लगातार तीन पोस्ट ने “मुफ़्त और असीमित वीडियो AI” पूछा। u/balltongueee (1pt, थ्रेड #2) ने कहा कि एक भी मुफ़्त नहीं है और निकट भविष्य में होने की कल्पना भी नहीं की जा सकती। u/NewLifeWares (2pt, थ्रेड #3) ने 45-सेकंड वीडियो के लिए कहा कि डेटा-सेंटर स्तर का हार्डवेयर चाहिए; व्यावहारिक विकल्प 5-सेकंड क्लिप जोड़ना है। ElevenLabs (आवाज़), Suno (संगीत), Flux1 (किरदार संदर्भ), Veo/Kling (दृश्य) और DaVinci Resolve (संपादन) का केवल मुफ़्त कोटा वाला वर्कफ़्लो भी सुझाया गया।
- थ्रेड #9 (r/generativeAI, 0pt, 6 टिप्पणियाँ, 2026-09-07) https://www.reddit.com/r/generativeAI/comments/1w9fomb/ — SFW इमेज-एडिटिंग टूल पूछे जाने पर u/magicdoorai (1pt) ने Google Nano Banana 2 ($0.039/छवि), Flux.1 Kontext Pro ($0.04/छवि) और ChatGPT Image 2 ($0.15/छवि) की कीमतें दीं।
संकेत
- ऊपर की ओर: “अनसेंसर्ड/ढीले फ़िल्टर” को बेचकर Seedream, Kling, Veo, GPT Image और Seedance जैसे क्लोज़्ड मॉडल को जोड़कर पुनर्विक्रय करने वाले एग्रीगेटर—WildOwl, cyberbara, Venice आदि—कई थ्रेड में स्वाभाविक रूप से सामने आए। Reddit पर वास्तविक क्लोज़्ड-सोर्स रुझान इस पुनर्विक्रय परत की प्रतिस्पर्धा जैसा दिखता है।
- ऊपर की ओर: छवि और वीडियो प्रामाणिकता जांच—Apple का कैप्चर रिकॉर्ड और r/isthisAI का अस्तित्व—स्वतंत्र विषय बन रहे हैं। जनरेशन तकनीक से ज़्यादा पहचान व सत्यापन में रुचि का संकेत 4.1 लाख सदस्य वाला समुदाय है।
- खारिज किया जा रहा है: “असीमित” वीडियो जनरेशन सब्सक्रिप्शन को थ्रेड #5 और #2–#4 में “झूठ” तथा “अव्यावहारिक” कहकर ठुकराया गया; कीमत-केंद्रित मार्केटिंग पर अविश्वास गहरा है।
- आश्चर्यजनक: सबसे अधिक सहभागिता (4,841pt / 348 टिप्पणियाँ, थ्रेड #12) AI टूल खबर नहीं, बल्कि AI छवि के जरिये विवाद भड़काने को Community Notes द्वारा पकड़ना था। Reddit पर जनरेटिव AI सबसे ज़्यादा तब चर्चा में आता दिखता है जब उसका दुरुपयोग होता है और उसे पहचाना जाता है।
- टकराव: सेलिब्रिटी वीडियो बनाने और कानूनी ज़िम्मेदारी पर u/Jean_velvet ने कहा कि ज़िम्मेदारी साझा/वितरित करने वाले की है, जबकि u/Alchemist42 ने संकेत दिया कि Seedance में आधिकारिक रूप से सेलिब्रिटी नहीं बनाए जा सकते और इसलिए टूल ही इस्तेमाल नहीं किया गया। तकनीकी रूप से कौन सा टूल सक्षम है और कानूनी ज़िम्मेदारी किसकी है, ये अलग बहसें हैं।
- कमज़ोर क्षेत्र: ओपन-सोर्स रुझान पर सीधे केंद्रित थ्रेड लगभग नहीं हैं। ComfyUI, Flux1 और स्थानीय जनरेशन का उल्लेख है, मगर केवल मुफ़्त कोटा समाप्त होने पर विकल्प के रूप में। इस संग्रह में ओपन-सोर्स मॉडल पर स्वतंत्र समाचार-सदृश पोस्ट नहीं थी।
सीमाएँ
- खोज केवल “Image and Video Generation AI News” शब्द से हुई। Stable Diffusion, Flux, Wan, HunyuanVideo या r/StableDiffusion जैसे विशेष ओपन-सोर्स मॉडल/समुदाय लक्षित नहीं किए गए, इसलिए रिपोर्ट क्लोज़्ड-सोर्स की ओर झुकी है।
- हर थ्रेड से अधिकतम छह टिप्पणियों के अंश लिए गए; वास्तविक टिप्पणी संख्या के मुकाबले केवल ऊपर का छोटा हिस्सा ही दिखता है।
- इकट्ठी फ़ाइलों में कुछ थ्रेड (#2, #6, #9, #11) का मूल पोस्ट टेक्स्ट अनुपस्थित था; वहाँ केवल टिप्पणियों पर निर्भर रहना पड़ा।
- समयावधि 2026-09-06 से 09-13, लगभग एक सप्ताह, तक सीमित है; पुराने रुझान इसके बाहर हैं।
X
X — Image and Video Generation AI News
output/x.posts.md के शीर्ष पर Explore की ट्रेंड सूची Croatia के लिए भू-स्थित है। यह एक देश की ट्रेंड सूची है, वैश्विक नहीं, और इसके दसों ट्रेंड—“Slack”, “$SONG”, “Saudi”, “Chelsea”, “China”, “Yemen”, “The OS”, “London”, “Correct”, “Houthis”—छवि या वीडियो जनरेशन AI से संबंधित नहीं हैं। कार्यकर्ता ने इन्हीं दस शब्दों से 37 खातों के 40 पोस्ट इकट्ठे किए। यानी संग्रह ने शोध विषय के लिए X से वास्तव में क्वेरी की ही नहीं—इस चरण पर इसके प्रभाव के लिए ## Limits देखें।
खाते
संग्रह के 37 खातों में कोई भी समर्पित AI खाता नहीं है। केवल दो का उल्लेख उपयुक्त है क्योंकि उनकी पोस्ट विषय से कुछ हद तक जुड़ती हैं:
- @akira_papa_IT (あきらパパ【生成AI活用エンジニア&3児のパパ】) — स्वयं को “generative-AI engineer और तीन बच्चों का पिता” कहने वाला खाता; एक पोस्ट, 6 लाइक। पोस्ट Cursor जैसे AI कोडिंग टूल पर है, छवि/वीडियो जनरेशन पर नहीं।
- @C_of_Creativity (PIYO) — एक पोस्ट, 1,421 लाइक, लगभग 200,000 व्यू; चीन में बिक रहे संशोधित Nvidia GPU पर। जापानी में स्थानीय जनरेटिव मॉडल चलाने वाले हार्डवेयर के बारे में पोस्ट करता है।
अन्य सभी खाते—@Osinttechnical, @IranTimes72/01, @MOSSADil, @the_Lawrenz, @_kobbyphocus, @Rusia_HD, @PrakazVijay_Of, @ActorVijayTeam आदि—Saudi पाइपलाइन हमले, Yemen/Houthi संघर्ष, Chelsea FC, BBNaija या तमिल अभिनेता की London उपस्थिति पर पोस्ट कर रहे थे; कोई भी छवि/वीडियो जनरेशन AI से प्रासंगिक क्रिएटर, कंपनी या टिप्पणीकार नहीं था।
पोस्ट
इकट्ठे 40 पोस्ट में सिर्फ़ दो किसी रूप में विषय से जुड़े हैं, और दोनों भी सीधे छवि/वीडियो जनरेशन पर नहीं हैं:
-
@akira_papa_IT, 2026-09-11, 6 लाइक · लगभग 1,100 व्यू —
https://x.com/akira_papa_IT/status/2098270955219132842【PC बंद कर दें, फिर भी लंबा विकास चलता रहता है। Cursor Projects आ गया है】... समन्वयक स्वयं कोड नहीं लिखता, बल्कि हज़ारों उप-एजेंटों को काम सौंपता है।
यह Cursor की नई “Projects” कोडिंग-एजेंट सुविधा पर है, छवि/वीडियो जनरेशन पर नहीं; इसे केवल इसलिए दर्ज किया गया कि यह संग्रह में एकमात्र जनरेटिव-AI पोस्ट थी। -
@C_of_Creativity, 2026-09-11, 1,421 लाइक · 359 रीपोस्ट · लगभग 200,000 व्यू —
https://x.com/C_of_Creativity/status/2098498590134182035चीन में संशोधित Nvidia RTX 5090, 96GB की बड़ी मेमोरी के साथ, $4,000 से कम में Alibaba पर आ गई है। मूल कीमत के 65% पर VRAM तीन गुना है।
यह चीन में संशोधित 96GB VRAM RTX 5090 है, जो Alibaba पर $4,000 से कम में सूचीबद्ध है। पोस्टर ने इसी तरह की 48GB 4090 बिना समस्या चलाने की बात कही। यह ओपन-सोर्स छवि/वीडियो जनरेशन से निकटवर्ती विषय है—बड़ा स्थानीय VRAM बड़े ओपन-वेट मॉडल चलाने देता है—पर पोस्ट किसी विशेष मॉडल या रिलीज़ पर नहीं है।
बाकी 38 पोस्ट में Midjourney, Sora, Runway, Veo, Stable Diffusion, Flux, Kling, ComfyUI या किसी अन्य क्लोज़्ड/ओपन छवि-वीडियो मॉडल, लैब या रिलीज़ का उल्लेख नहीं था।
संकेत
- विषय पर क्या उभर रहा है या क्या खारिज हो रहा है, यह नहीं बताया जा सकता; एकत्र पोस्ट विषय से संबंधित ही नहीं हैं। पूरे संकेत केवल दो निकटवर्ती पोस्ट हैं: एक कोडिंग एजेंट पर और दूसरी स्थानीय मॉडल चलाने हेतु सस्ते उच्च-VRAM हार्डवेयर पर।
- आश्चर्यजनक निष्कर्ष कोई ट्रेंड नहीं बल्कि प्रक्रिया की समस्या है: खोज शब्द Croatia-आधारित Explore ट्रेंड थे, इसलिए यह चरण असल में “Slack / Chelsea / Houthis” की खोज था, छवि या वीडियो जनरेशन AI की नहीं।
सीमाएँ
- खोज शब्द शोध ब्रीफ से मेल नहीं खाते थे। दसों शब्द X Explore की Croatia-आधारित सूची से आए, न कि शोध विषय से। इसलिए 40 में से सिर्फ़ ऊपर दिए दो निकटवर्ती पोस्ट उपयोगी हैं और रिपोर्ट ब्रीफ की अपेक्षित 5–12 विषयगत खोज या लगभग 20 पोस्ट विश्लेषण पूरा नहीं कर सकती।
- प्लेबुक के अनुसार इस चरण में केवल signed-in कार्यकर्ता के
output/x.posts.md/.jsonसंग्रह को पढ़ा गया; अतिरिक्त खोज नहीं की गई। - फ़ाइल में सत्र समाप्ति या खाली परिणाम का संदेश नहीं था; कमी गलत क्वेरी की है, टूटे/समाप्त सत्र की नहीं।
- Explore सर्वर स्थान के अनुसार Croatia-आधारित है; सही पढ़ाई भी केवल Croatia की फ़ीड बताएगी, वैश्विक X रुझान नहीं।
YouTube
YouTube — छवि और वीडियो जनरेशन AI समाचार (क्लोज़्ड-सोर्स बनाम ओपन-सोर्स)
चैनल
- Matt Wolfe / Future Tools (@mreflow) — लगभग 965K सब्सक्राइबर। सामान्य AI समाचार राउंडअप, जिनमें Sora, Veo, Nano Banana और ओपन रिलीज़ दोनों आते हैं। https://www.youtube.com/@mreflow
- MattVidPro AI (@MattVidPro) — मध्यम आकार का AI-टूल चैनल; Midjourney/Veo/Kling अपडेट श्रृंखला लंबे समय से चला रहा है। https://www.youtube.com/@MattVidPro
- All About AI (Kristian Fagerlie) — लगभग 222K सब्सक्राइबर। व्यावहारिक बिल्ड/ट्यूटोरियल चैनल, जैसे “5 Nano Banana Pro 'Million Dollar' Apps I Built In ONE Day।” https://www.youtube.com/watch?v=VRNEr8_cTj8
- Theoretically Media (फिल्ममेकर “Tim”) — कार्यरत फिल्ममेकर के नज़रिए से AI वीडियो टूल समीक्षा; Kling/Runway/Wan/Seedance के नियमित हैंड्स-ऑन परीक्षण। https://theoreticallymedia.com/videos/
- कई मध्यम आकार के ComfyUI-केंद्रित ट्यूटोरियल चैनल ओपन-सोर्स पक्ष को आगे बढ़ा रहे हैं; Wan2.2/FLUX/Qwen Image ट्यूटोरियल खोज परिणामों में बार-बार दिखे, भले एक प्रमुख सब्सक्राइबर संख्या न मिली हो।
वीडियो
- “The Ultimate Guide to AI Video Generation (Sora 2, Runway 4.5, Veo 3.1, Nano Banana Pro)” — तुलना/ट्यूटोरियल चैनल, 2026। Sora 2 को पहले से फीका पड़ता हुआ बताता है; Sora के हटने के बाद क्रिएटर Veo 3.1 और Runway Gen-4.5 की ओर सिमट रहे हैं। https://www.youtube.com/watch?v=Kib8UcDiNJA
- “NANO Banana Pro is FINALLY Here! (And it is INSANE!)” — 21 नवंबर 2025। Google के Gemini 3 Pro Image की आरंभिक प्रतिक्रिया; टेक्स्ट रेंडरिंग व इन्फोग्राफ़िक क्षमता को AI इमेज मॉडल में पहली बड़ी उपलब्धि बताता है। https://www.youtube.com/watch?v=4EowH7eif3U
- “Gemini 3 Is Cool… But Nano Banana Pro Is TERRIFYING” — 21 नवंबर 2025। तर्क है कि Nano Banana Pro की फोटो-यथार्थता और एडिट सटीकता, आधार Gemini 3 लॉन्च से बड़ी छलांग है। https://www.youtube.com/watch?v=DTYD-ddOwAY
- “5 Nano Banana Pro 'Million Dollar' Apps I Built In ONE Day” — All About AI, 21 नवंबर 2025। मॉडल के आसपास एक दिन में पाँच व्यावसायिक मिनी-प्रोडक्ट बनाकर इसका वाणिज्यिक पक्ष दिखाता है। https://www.youtube.com/watch?v=VRNEr8_cTj8
- “Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison” — 10 मार्च 2026। चार प्रमुख क्लोज़्ड वीडियो जनरेटर की सीधी तुलना; Kling को मात्रा/ऑडियो, Veo को सिनेमाई गुणवत्ता और Runway को कैमरा नियंत्रण में बेहतर बताता है। https://www.youtube.com/watch?v=x5fMQvhKP60
- “Runway Gen-3 vs Kling AI 2026 — I Tested Both for 30 Days” — 17 मई 2026। 30-दिन समानांतर प्रयोग का निष्कर्ष: Kling ने पश्चिमी टूलों की गुणवत्ता दूरी का अधिकतर हिस्सा बहुत कम कीमत पर बंद कर दिया है। https://www.youtube.com/watch?v=fAX7eOQ1j-k
- Midjourney अपडेट श्रृंखला — “Midjourney Update | January 2026: NEW NIJI 7!… V8, Edit Model” / “…February 2026: V8 Incoming!” / “…March 2026: V8 Alpha, BIG Changes Coming.” V7 से V8/V8.1/V8.2 और नए इन-ऐप वीडियो/एडिट टूल तक Midjourney की धीमी प्रगति को ट्रैक करने वाली मासिक श्रृंखला। https://www.youtube.com/watch?v=n8Iv3ZPh8yY
- “Seedance 2.5 AI Video Generator Full Review: I Tested EVERY New Feature” — लगभग अगस्त 2026 के अंत में। ByteDance Seedance 2.5 का हैंड्स-ऑन, जिसमें 30-सेकंड सिंगल-पास क्लिप और अधिकतम 50 मल्टीमॉडल रेफरेंस इनपुट शामिल हैं। https://www.youtube.com/watch?v=132JGS2Rz3I
- “Seedance 2.5 Made a $1,000,000 Infomercial. Still Think It's a Joke?” — अगस्त 2026। Seedance 2.5 और Higgsfield से उच्च उत्पादन-मूल्य वाला नकली इन्फोमर्शियल बनाया गया; इसे क्लोज़्ड वीडियो AI के ब्रॉडकास्ट गुणवत्ता तक पहुँचने का तर्क बताया गया। https://www.youtube.com/watch?v=QOG1iNp_zz8
- “Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models” — 18 अगस्त 2025। Wan2.2 (वीडियो), FLUX और Qwen Image को ComfyUI से स्थानीय रूप से चलाए जाने वाले वर्तमान ओपन-सोर्स SOTA के रूप में प्रस्तुत करता है। https://www.youtube.com/watch?v=3BFDcO2Ysu4
- “FLUX.2 DEV First Look – The Best LOCAL Image Model Yet?” — 26 नवंबर 2025। Black Forest Labs के FLUX.2 [dev] का पहला परीक्षण; मल्टी-रेफरेंस कंडीशनिंग और स्थानीय हार्डवेयर पर 4-मेगापिक्सेल एडिटिंग को आज़माता है। https://www.youtube.com/watch?v=9LyfKYPuY8w
- “Is FLUX 2.0 The New Open Source King?” — 27 नवंबर 2025। Nano Banana Pro और Midjourney के मुकाबले FLUX.2 की pro/flex/dev/klein श्रृंखला की समीक्षा; निष्कर्ष कि ओपन [dev]/[klein] वेट्स ने मालिकाना अग्रणी मॉडल से अधिकांश दूरी बंद की है। https://www.youtube.com/watch?v=YQuTkPVkCS8
संकेत
- क्लोज़्ड-सोर्स गति OpenAI से Google/ByteDance/Alibaba की ओर चली गई है। Sora का ऐप और वेब UI अप्रैल 2026 में बंद हुआ, उसका API 24 सितंबर 2026 को हट रहा है, और इन वीडियो में क्रिएटर पहले ही Veo 3.1, Seedance 2.0/2.5 और Kling 3.0 की ओर बढ़ चुके हैं। 2026 का कोई वीडियो Sora को देखने लायक टूल नहीं कहता।
- “Nano Banana Pro” (Gemini 3 Pro Image) अवधि का सबसे अधिक प्रतिक्रिया पाने वाला क्लोज़्ड इमेज मॉडल है, क्योंकि लॉन्च के कुछ ही दिनों में अलग-अलग चैनलों के “INSANE”, “TERRIFYING”, “MIND BLOWING” जैसे शीर्षक एक साथ दिखाई दिए; यह Midjourney के क्रमिक V8.x अपडेट से अधिक केंद्रित प्रतिक्रिया थी।
- ओपन-सोर्स वीडियो ने 2026 में गुणवत्ता अंतर का अधिकतर हिस्सा बंद किया है: ट्यूटोरियल और तुलना वीडियो के अनुसार Wan2.2 (Apache 2.0, MoE संरचना), HunyuanVideo 1.5 और Lightricks LTX-2.3/2.5—नेटिव सिंगल-पास ऑडियो+वीडियो वाला एकमात्र ओपन मॉडल—अब Sora/Veo के साथ सीधे बेंचमार्क किए जाते हैं, खिलौनों की तरह नहीं।
- लाइसेंसिंग लगातार ओपन-सोर्स विवाद-बिंदु है: FLUX.2 की स्तरीय रिलीज़—Schnell/Klein/VAE के लिए Apache 2.0, Dev के लिए गैर-व्यावसायिक, Pro/Flex के लिए मालिकाना—को समीक्षक व्यावसायिक अधिकार बनाम स्थानीय प्रयोग के लिए अहम बताते हैं।
- दोनों खेमों से ऊपर एक मेटा-ट्रेंड है: Hailuo, Suno आदि इस्तेमाल करने वाले AI-जनित चैनल 2025 के मध्य तक YouTube के शीर्ष सब्सक्राइबर-वृद्धि चार्ट पर हावी थे। एक चैनल “Masters of Prophecy” चार महीनों में कुछ सौ से 30M+ सब्सक्राइबर तक पहुँचा; AI वीडियो की सामग्री और उसका दर्शक वर्ग तेज़ी से एक ही परिघटना बन रहे हैं।
- EU AI Act Article 50 का प्रवर्तन (2 अगस्त 2026 से), जो मशीन-पठनीय AI-कंटेंट लेबलिंग माँगता है, EU दर्शकों के लिए AI वीडियो प्रकाशित करने वाले क्रिएटरों की चर्चा में आना शुरू हो गया है।
सीमाएँ
- YouTube खोज और वॉच पेज बहुत अधिक JS-रेंडर्ड हैं; सीधे
youtube.com/watch?v=...और/results?search_query=...पढ़ने पर केवल स्थिर फुटर/नेविगेशन मिला। व्यू, सब्सक्राइबर या टिप्पणी आँकड़े सीधे नहीं मिल सके। - दिए गए व्यू/सब्सक्राइबर आँकड़े द्वितीयक स्रोतों से हैं, लाइव YouTube पेज से नहीं। कुछ AI-चैनल वृद्धि आँकड़े 2025 के मध्य के हैं और केवल संदर्भ हैं, नई खोज नहीं।
- किसी वीडियो की शीर्ष टिप्पणियाँ सत्यापित नहीं हो सकीं।
- Wan 3.0, जिसे Alibaba ने 6 अगस्त 2026 को 30-सेकंड नेटिव क्लिप के साथ घोषित किया, के ओपन वेट की पुष्टि नहीं हुई। स्रोत इसे ओपन-वेट नहीं बताते, इसलिए इसे केवल क्लोज़्ड-सोर्स संकेत के रूप में शामिल किया गया।
- Reddit, X, Bluesky, Lemmy और Pinterest अलग चरण थे और यहाँ नहीं आज़माए गए।
Bluesky
Bluesky — क्लोज़्ड-सोर्स/ओपन-सोर्स छवि और वीडियो जनरेशन AI रुझान
खाते
- @todaystopainews.bsky.social — AI समाचार समेटने वाला खाता; स्थानीय रूप से चलने वाले इमेज मॉडल जैसे विषय पोस्ट करता है।
https://bsky.app/profile/did:plc:rrpul7rxm2s4opncn6pwr475 - @stablediffusion.bsky.social — Stable Diffusion आधारित ऑनलाइन जनरेशन टूल पेश करने वाला खाता।
https://bsky.app/profile/stablediffusion.bsky.social - @dfl.bsky.social — Stable Diffusion (RealisticVision परिवार) से बनी छवियाँ निरंतर पोस्ट करने वाला क्रिएटर।
https://bsky.app/profile/dfl.bsky.social - @google-ai.bsky.social — Google AI का आधिकारिक मिरर खाता; Nano Banana Pro (Gemini 3 Pro Image) घोषणाएँ यहाँ आती हैं।
https://bsky.app/profile/google-ai.bsky.social - @simonwillison.net — प्रसिद्ध डेवलपर/AI पर्यवेक्षक; SynthID वॉटरमार्क डिटेक्शन जैसी नई मॉडल विशेषताओं को समझाते हैं।
https://bsky.app/profile/simonwillison.net - @ostonox.com — Google Veo 3 से बनी वीडियो साझा करने वाला क्रिएटर।
https://bsky.app/profile/ostonox.com - @artsekai.com — “JP AI Artists” स्टार्टर पैक का निर्माता, Bluesky के जापानी AI कला समुदाय का केंद्र।
https://bsky.app/profile/artsekai.com - @furyonai.bsky.social — “Yaoi AI Art” AI-कला स्टार्टर पैक का निर्माता; AI समर्थक समुदाय की ओर।
https://bsky.app/profile/furyonai.bsky.social - @yunexa.bsky.social / @backyardvampire.bsky.social — “oc artists”, “World of Warcraft Artists” जैसे “No AI” कला स्टार्टर पैक के निर्माता; AI विरोधी समुदाय की ओर।
https://bsky.app/profile/yunexa.bsky.social - @bsky.app (आधिकारिक) — बार-बार कहता है कि उपयोगकर्ता सामग्री को जनरेटिव AI प्रशिक्षण के लिए इस्तेमाल नहीं किया जाएगा। प्लेटफ़ॉर्म का यह रुख उपयोगकर्ता समुदाय का माहौल बनाता है।
https://bsky.app/profile/bsky.app
पोस्ट
-
@simonwillison.net (तारीख अज्ञात, 2026 के भीतर; Gemini 3 Pro Image संबंधी पोस्ट)
सार यह है कि Nano Banana Pro द्वारा छवियों में डाले गए अदृश्य SynthID वॉटरमार्क को केवल Gemini ऐप में अपलोड कर पहचान लेने की नई सुविधा चुपचाप बहुत प्रभावशाली है। यह Google के क्लोज़्ड-सोर्स तकनीकी रुझान का प्रमुख उदाहरण है।
https://bsky.app/profile/simonwillison.net/post/3m637bxy5yc2c
※ लाइक/रीपोस्ट संख्या उपलब्ध नहीं है (Limits देखें) -
@ostonox.com (तारीख अज्ञात, 2026 के भीतर)
“ऑडियो वाला संस्करण यहाँ है। यह वीडियो पूरी तरह Google ‘Veo 3’ AI से बनाया गया है।” क्लोज़्ड-सोर्स वीडियो जनरेशन AI का सीधा प्रदर्शन।
https://bsky.app/profile/ostonox.com/post/3lppvqrj2pk2v
※ लाइक/रीपोस्ट संख्या उपलब्ध नहीं है -
@dfl.bsky.social (तारीख अज्ञात)
“AI image generation #StableDiffusion #realisticVisionV51 #fantasy #landscape #moonlight #bamboo।” ओपन-सोर्स Stable Diffusion और RealisticVision से बनी चाँदनी वाले बाँस के जंगल की छवि। Bluesky पर हैशटैग में मॉडल नाम स्पष्ट लिखना सामान्य है।
https://bsky.app/profile/dfl.bsky.social/post/3kcmft6l5eg2e
※ लाइक/रीपोस्ट संख्या उपलब्ध नहीं है -
@bsky.app (आधिकारिक) (पुरानी पोस्ट, कई बार संदर्भित)
आधिकारिक कथन का सार: Bluesky पर आने वाले कलाकार व क्रिएटर अन्य प्लेटफ़ॉर्मों द्वारा AI प्रशिक्षण में सामग्री उपयोग को लेकर चिंतित हैं; Bluesky उपयोगकर्ता सामग्री को जनरेटिव AI प्रशिक्षण में कभी इस्तेमाल नहीं करेगा। यह जनरेटिव AI समाचार नहीं है, लेकिन वहाँ AI सामग्री कैसे देखी जाती है, यह तय करने वाला महत्वपूर्ण संदर्भ है।
https://bsky.app/profile/bsky.app/post/3layuzbto2c2x
※ लाइक/रीपोस्ट संख्या उपलब्ध नहीं है -
@todaystopainews.bsky.social (लगभग 30 जून 2026)
नई स्थानीय AI इमेज जनरेशन टूल के आने और शुरुआत से ही अनसेंसर्ड होने संबंधी पोस्ट। ओपन-सोर्स/स्थानीय मॉडल जगत से मिली गिनी-चुनी खोजों में से एक।
https://bsky.app/profile/did:plc:rrpul7rxm2s4opncn6pwr475/post/3mpj2zr7nrb2l
※ लाइक/रीपोस्ट संख्या उपलब्ध नहीं है
संकेत
- समर्थन और विरोध स्टार्टर पैक के रूप में दिखते हैं: “AI Art”, “JP AI Artists”, “Yaoi AI Art” जैसे AI समर्थक परिचय-सूची 40 से अधिक हैं, वहीं “oc artists ♡ (कलाकार तलाशें, AI और NFT पूरी तरह निषिद्ध)” और “World of Warcraft Artists (No AI, no bigots)” जैसी स्पष्ट AI-विरोधी सूची भी हैं। दोनों गुट एक ही प्लेटफ़ॉर्म पर साथ मौजूद हैं।
- Bluesky की बनावट ही प्रतिकूल संदर्भ है: प्लेटफ़ॉर्म कहता है कि पोस्ट को जनरेटिव AI प्रशिक्षण में इस्तेमाल नहीं किया जाएगा और X द्वारा Grok प्रशिक्षण के लिए पोस्ट इस्तेमाल करने की नीति के विरोध में कई चित्रकार यहाँ आए। इसलिए AI-जनित सामग्री का प्रचार Reddit या X की तुलना में अधिक सावधानी व प्रतिरोध के संदर्भ में आता है।
- क्लोज़्ड-सोर्स में Google के विषय प्रमुख हैं: मिले ठोस पोस्ट Veo 3, Nano Banana Pro (Gemini 3 Pro Image), और SynthID वॉटरमार्क डिटेक्शन पर हैं। सर्च इंजन से Sora 2 या Midjourney का उल्लेख लगभग नहीं मिला।
- ओपन-सोर्स सामग्री सीमित व्यक्तिगत पोस्ट तक है: Stable Diffusion/RealisticVision की कलाकृतियाँ मिलीं, मगर ComfyUI, Flux, Wan या HunyuanVideo जैसे ताज़ा ओपन मॉडल पर प्रत्यक्ष Bluesky पोस्ट इस शोध में नहीं मिलीं। संभव है कि तकनीकी ओपन-सोर्स चर्चा अन्य प्लेटफ़ॉर्मों पर केंद्रित हो।
सीमाएँ
- Bluesky का सार्वजनिक API (
public.api.bsky.app/xrpc/app.bsky.feed.searchPosts) सीधे और प्रॉक्सी, दोनों तरह की पहुँच पर लगातार HTTP 403 Forbidden देता रहा। इसलिए कीवर्ड-आधारित ताज़ा पोस्ट, लाइक, रीपोस्ट और टाइमस्टैम्प नहीं मिल सके। bsky.appक्लाइंट-साइड JavaScript ऐप है; खोज व हैशटैग पृष्ठ सीधे लेने पर पोस्ट टेक्स्ट नहीं दिखता।- विकल्प के रूप में Google/Bing से मिले व्यक्तिगत पोस्ट URL और Bluesky लिंक-प्रीव्यू API (
cardyb.bsky.app) द्वारा शीर्षक व टेक्स्ट अंश पुनर्प्राप्त किए गए। यह केवल बाहरी रूप से संदर्भित पोस्ट तक सीमित है; लक्ष्य लगभग 20 पोस्ट के व्यापक विश्लेषण तक नहीं पहुँचा। वास्तव में केवल 5 पोस्ट का टेक्स्ट मिला। - इन सीमाओं के कारण लाइक, रीपोस्ट और रिप्लाई संख्या बिल्कुल नहीं मिली।
- Sora 2, Midjourney V7/V8, Flux, Wan, HunyuanVideo और ComfyUI के नाम से भी खोज की गई, पर सर्च इंजन इंडेक्स में व्यक्तिगत Bluesky पोस्ट बहुत कम थीं।
Lemmy
Lemmy — छवि और वीडियो जनरेशन AI समाचार
Lemmy छोटा फेडिवर्स SNS है, पर !«メールアドレス» केंद्र में ओपन-सोर्स AI छवि/वीडियो समुदाय सक्रिय है। क्लोज़्ड-सोर्स खबरें !technology, !ai_reddit, !hackernews, !«メールアドレス» जैसी सामान्य टेक समुदायों में छिटपुट आती हैं।
समुदाय
!«メールアドレス»— 5,710 सब्सक्राइबर, जिनमें 893 स्थानीय; 25 साप्ताहिक सक्रिय उपयोगकर्ता; 1.4K पोस्ट और 1.93K टिप्पणियाँ। ओपन-सोर्स छवि/वीडियो मॉडल समाचार व टूल साझा करने का मुख्य केंद्र।!«メールアドレス»— एनीमे-शैली AI सामग्री के उदाहरण पोस्ट करने वाला समुदाय; सब्सक्राइबर संख्या उपलब्ध नहीं।!«メールアドレス»— Civitai संबंधित उदाहरण और मॉडल परिचय; सर्वर त्रुटि के कारण विवरण उपलब्ध नहीं।!«メールアドレス»— 88K सब्सक्राइबर, जिनमें 41K स्थानीय; सामान्य टेक समाचार में बड़ी AI जनरेशन खबरें आती हैं।!ai_reddit— Reddit के AI-संबंधित थ्रेड क्रॉसपोस्ट करने वाला समुदाय।!«メールアドレス»(sh.itjust.worksआदि से मिरर) — AI हाइप के प्रति संदेहपूर्ण समुदाय; आलोचनात्मक लेख साझा करता है।!openai— OpenAI समाचार-केंद्रित समुदाय।!«メールアドレス»— यूरोपीय AI/LLM रुझानों का छोटा समुदाय।
पोस्ट
- Black Forest Labs ने FLUX 3 घोषित किया — छवि तथा अधिकतम 20 सेकंड के ऑडियो-सहित वीडियो जनरेशन का सीमित रिलीज़ —
!technology, score 1, 2026-07-24।https://bfl.ai/blog/flux-3 — ओपन-वेट क्षेत्र का प्रमुख BFL वीडियो जनरेशन में गंभीर प्रवेश कर रहा है। - Black Forest Labs ने FLUX Creator Program खोला —
!«メールアドレス», score 3, 2026-05-06।https://xcancel.com/bfl_ml/status/2051723708046233688 - black-forest-labs/FLUX.2-klein-9b-kv-fp8 Hugging Face पर जारी —
!«メールアドレス», score 8, 2026-03-14।https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8 — हल्का fp8 संस्करण निजी GPU पर चलाने योग्य होने के कारण चर्चा में। - MiniMax-H3 के लिए ComfyUI अनुकूलन “ComfyUI-VDN-H3-24GB” —
!«メールアドレス», score 4, 2026-09-12。https://github.com/Speach1sdef178/ComfyUI-VDN-H3-24GB — 24GB VRAM पर चलाने के लिए अनुकूलित। - MiniMax-H3-Image-Training-Adapter जारी; MiniMax H3 का LoRA प्रशिक्षण संभव —
!«メールアドレス», score 4, 2026-09-12।https://huggingface.co/circlestone-labs/MiniMax-H3-Image-Training-Adapter - LTX-2.5-22b-IC-LoRA-Ingredients — संदर्भ छवि से वीडियो जनरेशन कंडीशन करने वाला LoRA —
!«メールアドレス», score 3, 2026-09-12।https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Ingredients - Boogu-Image-0.1 — दक्षता-केंद्रित ओपन इमेज जनरेशन बेस मॉडल —
!«メールアドレス», score 5, 2026-06-17。https://boogu.org/ - SCoPE: Wan2.2 आधारित कैमरा-नियंत्रण योग्य वीडियो डिफ्यूज़न मॉडल शोध —
!«メールアドレス», score 2, 2026-08-16。https://visual-ai.github.io/scope/ — Wan2.2 के 5B/14B मॉडल पर प्रदर्शन। - OpenAI ने Sora को घटाया, $30M की AI फिल्म रुक गई —
!ai_reddit, 2026-05-27。https://www.reddit.com/r/ArtificialInteligence/comments/1tovuid/openai_shutting_down_sora_just_killed_a_30m_ai/ - OpenAI के Sora वीडियो ऐप का सिमटना जिन समस्याओं को दिखाता है —
!openai, score 2, 2026-04-13।Times of India लेख का परिचय। - Google ने अनुचित छवि जनरेशन के कारण “Earth AI” को लॉन्च के अगले दिन बंद किया —
!ai_reddit, 2026-08-07。https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/ - Google का नया इमेज मॉडल “Nano Banana 2 Lite” जारी —
!hackernews/ स्विस!swisstechnews, 2026-06-30–07-02。https://deepmind.google/models/gemini-image/flash-lite/ - Seedream 5.0 Pro की प्रत्यक्ष तुलना समीक्षा —
!ai_reddit, 2026-07-10。https://www.reddit.com/r/ArtificialInteligence/comments/1usc03q/ - Midjourney ने Hollywood स्टूडियो से AI उपयोग का खुलासा माँगा —
!technology, score 73, 2026-07-05。https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-reveal-ai-usage/ - Midjourney के चिकित्सा अल्ट्रासाउंड स्कैनर व्यवसाय की “पिवट” पर आलोचना (Theranos से तुलना वाला व्यंग्य लेख) —
!«メールアドレス», score 40, 2026-06-19。https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — विविधीकरण रणनीति पर संदेहपूर्ण दृष्टि। - Elon Musk ने Grok से “Odyssey” की पूरी AI फिल्म बनाने की घोषणा की —
!films(lemy.nl), 2026-07-22。https://lemy.nl/post/4342454 (डच लेख)
संकेत
- ओपन-सोर्स खेमे में “बड़े पैमाने पर मॉडल रिलीज़” का चरण: FLUX, MiniMax H3, LTX-2.5 और Boogu-Image-0.1 जैसे मॉडल, अडैप्टर और ComfyUI विस्तार Hugging Face/GitHub पर लगभग रोज़ आ रहे हैं। 24GB जैसे VRAM अनुकूलन में रुचि अधिक है और निजी स्थानीय उपयोग मुख्य लक्ष्य बना हुआ है।
- वीडियो जनरेशन में Wan2.2 / LTX Video वास्तविक ओपन-सोर्स मानक बन चुके हैं; उन पर कैमरा नियंत्रण और LoRA कंडीशनिंग जैसे अनुप्रयोग शोध जोड़े जा रहे हैं।
- क्लोज़्ड-सोर्स पक्ष में “सिमटना और विवाद” अधिक दिखते हैं: Sora का सिमटना, Google Earth AI का एक दिन में हटना, और Midjourney के चिकित्सा उपकरण रुख पर व्यंग्य; नई बड़ी सुविधाओं की अपेक्षा समस्याएँ व आलोचना अधिक दिखाई दी।
- Lemmy समुदाय का AI के प्रति संदेहपूर्ण तापमान:
!techtakesजैसे समुदाय क्लोज़्ड कंपनियों की गतिविधियों का मज़ाक उड़ाने वाले लेख साझा करते हैं; Reddit क्रॉसपोस्ट समुदायों में भी AI हाइप पर संदेह प्रमुख है। - Black Forest Labs (FLUX) “ओपन लेकिन व्यावसायिक झुकाव वाला” मॉडल-प्रदाता है और क्लोज़्ड व ओपन के बीच की स्थिति में बार-बार आता है।
सीमाएँ
- Lemmy कुल मिलाकर छोटा है और छवि/वीडियो जनरेशन AI के लिए मुख्य समुदाय लगभग सिर्फ़
!«メールアドレス»है; Reddit या X की तुलना में पोस्ट और चर्चा दोनों हल्की हैं। !«メールアドレス»ने HTTP 500 दिया; इसकी सामग्री नहीं देखी जा सकी।!«メールアドレス»की सदस्य संख्या HTTP 500 के कारण नहीं मिली।lemmy.caका!imageaiसमुदाय “Access Denied” त्रुटि से नहीं खुला।- खोज API परिणाम में राजनीति और गेम समीक्षा जैसे असंबंधित लेखों का बड़ा शोर था। 20 पोस्ट का पूर्ण लक्ष्य नहीं मिला; कई कीवर्ड से मिली वास्तविक प्रासंगिक पोस्ट लगभग 16 ही थीं।
lemmy.mlऔरlemm.eeपर अतिरिक्त खोज शोर और समय-वितरण के कारण नहीं की गई।
Pinterest — Image and Video Generation AI News
दृश्य विषय
- नियॉन-लोगो “AI News” रिएक्शन थंबनेल — चमकते 3D OpenAI, Google, Microsoft, Meta, Nvidia और Gemini आइकन के घेरे के साथ चौंके दाढ़ी वाले क्रिएटर का चेहरा। यही टेम्पलेट अलग-अलग समाचारों में दोहराया गया।
[2, 16, 19, 39] - गहरे नेवी/सायन-पर्पल “साइबरपंक AI” ग्रेडिएंट सामान्य “AI generated content” और “AI is everywhere” पिन में प्रमुख हैं—चमकती सर्किट लाइनें, क्रोम रोबोट सिर और अंतरिक्ष में तैरते होलोग्राफिक इमेज ग्रिड।
[1, 4, 46, 50] - क्रमांकित टूल-रैंकिंग इन्फोग्राफ़िक — “Best 5/6/10 AI Video Generation Websites/Tools”, जिनमें हर टूल का लोगो, सुविधा चेकलिस्ट और नमूना थंबनेल होता है। Runway, Pika, Kling AI, Luma/Dream Machine, Canva, Hailuo, Veed, Synthesia और Pictory आते हैं। यह सबसे सामान्य प्रारूप है और AI कला से अधिक अफ़िलिएट ब्लॉग मार्केटिंग जैसा है।
[7, 10, 21, 26] - पहले/बाद के परिवर्तन ग्रिड — एक स्रोत वीडियो को Lego, ओरिगामी, लकड़ी के ब्लॉक और फूल जैसे रूपों में बदलना; साथ में स्थिर फोटो को वीडियो बनाने वाले प्रचार।
[6, 13] - विश्वास/पहचान चिंता रूपक — बिल्ली की फोटो पर “FAKE” स्टैंप लगाता रोबोट, हरे-काले कोड मैट्रिक्स में घुलता चेहरा, “Which is AI?” पर्वत फोटो क्विज़ और वॉइस-डिटेक्टर प्रतिशत।
[3, 4, 50] - आधिकारिक मॉडल लॉन्च प्रेस-स्टिल — Google Veo 2 रील, Microsoft VASA-1 की सिंगल-फोटो-टू-टॉकिंग-हेड ग्रिड, तथा ShengShu Vidu S1 का एनीमे अवतार प्रचार; ये उपयोगकर्ता पोस्ट से अधिक स्टूडियो प्रेस किट लगते हैं।
[5, 30, 40] - वीडियो मॉडल में चीन बनाम पश्चिम का फ्रेम — ByteDance Seedance 2.5 (“One Laptop = One Film”) और ShengShu Vidu S1 चमकदार साइंस-फिक्शन फिल्म पोस्टर शैली अपनाते हैं, जो Runway/Pika/Kling राउंडअप की सपाट पश्चिमी इन्फोग्राफ़िक शैली से अलग है।
[30, 42] - नीति की केवल एक छवि — राज्य विधानभवन/Statue of Liberty क्षितिज और “AI-GENERATED NEWS” प्रसारण स्क्रीन में बँटा शहर; कैप्शन “Human Journalism vs Machine-Generated Media।”
[12]
उल्लेखनीय पिन
- [1] AI Image and Video Creation — इस सेट की कवर-जैसी नीली होलोग्राफिक सामग्री-ग्रिड छवि; सामान्य AI पृष्ठभूमि सजावट के रूप में बार-बार दिखती है।
- [21] 5+ Best AI Video Generation Websites 2026 — Runway, Pika, Kling AI, Luma, Canva, Hailuo का नाम लेती है और Pinterest को आउटपुट वितरण चैनल के रूप में भी लिखती है।
- [26] AI Tools for Video Editing — What Creators Actually Use — जनरेशन → एडिटिंग → वॉइसओवर → स्टॉक → पब्लिशिंग की 20-टूल वर्गीकरण सूची; सेट का सबसे पूर्ण टूल मानचित्र और Stable Video Diffusion को ओपन-सोर्स कहने वाला एकमात्र पिन।
- [42] China Just Took AI Video Too Far — ByteDance Seedance 2.5 — “One laptop = one film” टैगलाइन; चीनी वीडियो मॉडल का खुला प्रचारात्मक/राष्ट्रवादी फ्रेम।
- [30] ShengShu Technology Unveils Vidu S1 — “real-time interactive generation”, तकनीकी घोषणा की बजाय एनीमे key visual जैसा प्रस्तुतीकरण।
- [40] Microsoft Unveils VASA-1 — एक फोटो + ऑडियो क्लिप से जीवंत बोलता चेहरा; अभिव्यक्तिपूर्ण चेहरों की वास्तविक शोध-चित्र ग्रिड के रूप में दिखाया गया।
- [6] Google video-reskin demo (Lumiere-tagged) — एक ही स्रोत क्लिप का Lego, ओरिगामी, लकड़ी-ब्लॉक और फूल संस्करण; पूरे सेट का सबसे प्रभावशाली “वाह” विज़ुअल।
- [12] New York's Bold Gambit: Inside the Legislative... — 50 में एकमात्र AI नियमन/नीति कोण, मानव पत्रकारिता बनाम AI मीडिया चित्रण के साथ।
- [9] Adobe udvikler AI-model til opskalering af videoer — धुंधले फुटेज को HD में अपस्केल करने वाले Adobe मॉडल पर डैनिश-भाषा पिन; विषय के गैर-अंग्रेज़ी दर्शकों तक पहुँचने का संकेत।
- [4] AI content and social media concerns — “FAKE” स्टैंप वाली बिल्ली फोटो/वीडियो देखता रोबोट; सेट में deepfake-संदेह का सबसे स्पष्ट दृश्य।
संकेत
- Pinterest सेट का झुकाव लिस्टिकल/अफ़िलिएट मार्केटिंग ग्राफ़िक—“Best N AI video tools”—की ओर बहुत अधिक है, AI-निर्मित कला की ओर नहीं। अधिकांश पिन किसी ब्लॉग पोस्ट या YouTube वीडियो को बेचते हैं, तैयार AI सामग्री को नहीं।
- चीनी वीडियो मॉडल अधिक चमकदार और सिनेमाई ढंग से पेश होते हैं—Seedance 2.5 और Vidu S1—जबकि पश्चिमी टूल फ्लैट तुलना इन्फोग्राफ़िक में हैं। इससे चीन की वीडियो-AI पहल एक स्वतंत्र हाइप कहानी के रूप में उभरती है।
- Deepfake और विश्वास चिंता मौजूद है, पर प्रमुख नहीं: FAKE स्टैंप, “which is AI?” क्विज़ और वॉइस-डिटेक्टर प्रतिशत।
- अनुपस्थित: कोई ओपन-सोर्स समुदाय शोकेस नहीं—न ComfyUI वर्कफ़्लो स्क्रीनशॉट, न Stable Diffusion/LoRA प्रॉम्प्ट-आउटपुट गैलरी, न GitHub स्क्रीनशॉट। एक टूल-राउंडअप में Stable Video Diffusion का एक नाम छोड़कर, कोई पिन ओपन मॉडल पर उसी तरह केंद्रित नहीं है जैसे Runway, Pika, Kling, Veo, Sora या Grok पर है।
- अनुपस्थित: कीमत/तुलना स्प्रेडशीट और विरोध/बैकलैश विज़ुअल नहीं। “Everyone's Mad At Anthropic Now” जैसे शीर्षक सामान्य रिएक्शन टेम्पलेट या स्टॉक फोटो से दर्शाए गए हैं, वास्तविक विवाद के दस्तावेज़ से नहीं।
- एकत्र डेटा में सहभागिता, सेव संख्या या टाइमस्टैम्प नहीं हैं; Pinterest से अकेले ताजगी और लोकप्रियता सत्यापित नहीं की जा सकती।
सीमाएँ
- प्लेबुक के अनुसार पिन कार्यकर्ता द्वारा पहले से एकत्र किए गए थे; इस चरण में Pinterest को सीधे ब्राउज़ नहीं किया गया, केवल
output/pinterest.pins.mdऔर छवि फ़ाइलें पढ़ी गईं। - सभी 50 पिन एक ही अनलेबल्ड शैली (
g01-*) में आए; अलग-अलग शैलियों की तुलना हेतु तालिका में अलग अनुभाग नहीं थे। - 50 में से 30 छवियों को सीधे देखा गया—सूचकांक 1–13, 15, 16, 18–21, 24, 26, 30, 31, 34, 39, 40, 42, 43, 46, 50। शेष लगभग 20 का मूल्यांकन केवल शीर्षक से हुआ, क्योंकि दृश्य विषय पहले ही संतृप्त हो चुके थे।
- कई पिन शीर्षक थंबनेल छवि से मेल नहीं खाते। Pinterest अक्सर सामान्य “AI News” रिएक्शन टेम्पलेट या असंबंधित स्टॉक फ़ोटो को अलग समाचार शीर्षकों में दोबारा इस्तेमाल करता है। ऐसे पिनों के शीर्षक-आधारित दावे दृश्य रूप से सत्यापित नहीं हो सके।
अनुशंसित कार्रवाइयाँ
- अगले X चरण की लॉजिक को क्षेत्रीय ट्रेंड शब्दों के बजाय छवि/वीडियो जनरेशन AI से जुड़े कीवर्ड सीधे खोजने के लिए बदला जाए।
- Bluesky का आधिकारिक खोज API 403 से अवरुद्ध है; प्रमाणित सत्र के ज़रिए संग्रह पथ बनाया जाए।
- Lemmy के अन्य इंस्टेंस—
lemmy.ml,lemm.eeआदि—पर भी खोज हो, ताकि 20 पोस्ट के लक्ष्य के करीब पहुँचा जाए। - Sora API के 2026/9/24 को बंद होने के बाद वास्तविक माइग्रेशन गंतव्यों को आगामी Reddit/YouTube चरणों में ट्रैक किया जाए।
- Pinterest में लाइक और सेव जैसी सहभागिता मेट्रिक जुटाने की विधि की जाँच की जाए।
एकत्र छवियाँ


















































डेटा गुणवत्ता नोट
X के 40 इकट्ठे पोस्ट विषय से असंबंधित थे और प्रभावी रूप से केवल 2 उपयोगी निकले। Bluesky का आधिकारिक API 403 से अवरुद्ध था; केवल 5 पोस्ट देखी जा सकीं और सहभागिता संकेतक नहीं मिले। Lemmy भी 20 के लक्ष्य के बजाय 16 पोस्ट तक रहा। Reddit, YouTube और Pinterest में पर्याप्त मात्रा में डेटा मिला, लेकिन क्रमशः ओपन-सोर्स जानकारी की कमी, लाइव व्यू आदि का अभाव और सहभागिता मेट्रिक्स की अनुपस्थिति जैसी अलग-अलग कमियाँ बनी रहीं।



