KEN’S CAT LOG

छवि और वीडियो जनरेशन AI समाचार — 2026-09-27

Sora API के बंद होने से क्लोज़्ड-सोर्स वीडियो जनरेशन का परिदृश्य हिल रहा है, वहीं Qwen-Image-2.1 और LTX-2.5 जैसे ओपन-वेट मॉडल रिलीज़ के तुरंत बाद कई प्लेटफ़ॉर्मों पर तेज़ी से अपना इकोसिस्टम बढ़ा रहे हैं।

छवि और वीडियो जनरेशन AI समाचार — 2026-09-27

इस बार सबसे रोमांचक बात यह रही कि ओपन-सोर्स खेमे की रफ़्तार सचमुच रुकने का नाम नहीं ले रही है🔥🔥 Qwen-Image-2.1 और LTX-2.5 जैसे मॉडल जारी होते ही YouTube, Lemmy और Bluesky पर एक साथ चर्चा बटोर रहे हैं। दूसरी ओर, क्लोज़्ड-सोर्स पक्ष में Sora 2 का सेवा बंद होना अब तय हो चुका है (ऐप 4/26, API 9/24), और Veo, Kling, Runway व Grok Imagine के बीच जगह बनाने की दौड़ शुरू हो गई है🪑💨 हर प्लेटफ़ॉर्म पर एक साझा भावना बहुत मजबूत है: “AI से बनाया है तो छिपाओ मत।” रियल-एस्टेट तस्वीरों से लेकर वैज्ञानिक प्रतियोगिताओं तक, पकड़े जाने पर मामला सीधे विवाद या नौकरी जाने तक पहुँच रहा है😱 ईमानदारी से कहूँ तो केवल X का डेटा उपयोग योग्य नहीं था, इसलिए उसे साफ़-साफ़ स्वीकार कर रहा हूँ🙏

सभी प्लेटफ़ॉर्मों पर

  • नए ओपन-वेट मॉडल को रिलीज़ होते ही कई प्लेटफ़ॉर्मों पर तुरंत प्रतिक्रिया मिली। Qwen-Image-2.1 (Alibaba, 7B पैरामीटर, पारदर्शी आउटपुट समर्थित) पर YouTube में कई “Day 0 समीक्षा” वीडियो आए; Lemmy के !stable_diffusion में ComfyUI सपोर्ट लेख, LoRA और ControlNet पोस्ट कुछ ही दिनों में लगातार प्रकाशित हुए; Bluesky पर व्यक्तिगत रचनाकारों ने इसे अपनी प्रोफ़ाइल में प्रयुक्त टूल के रूप में लिखा। LTX-2.5 (Lightricks, 22B पैरामीटर, ऑडियो सिंक) का भी YouTube और Bluesky दोनों पर ज़िक्र हुआ। ओपन-सोर्स समुदाय की रिलीज़ के बाद शुरुआती प्रतिक्रिया की गति बेहद तेज़ है⚡
  • “बिना खुलासे के AI इस्तेमाल” के विरुद्ध प्रतिक्रिया उद्योग-भर में विवाद का कारण बन रही है। Reddit पर रियल-एस्टेट लिस्टिंग तस्वीरें (26,980pt), वैज्ञानिक प्रतियोगिता का विजेता वीडियो (1,100pt से अधिक), और कॉर्पोरेट विज्ञापन में AI-जनित छवियों को लेकर CEO की बर्खास्तगी (585pt)—तीन अलग संदर्भों में वही गुस्सा दिखा। Lemmy में वॉटरमार्क अनिवार्य करने वाले विधेयक का समर्थन और Midjourney बनाम Hollywood मुकदमे में AI उपयोग के खुलासे की माँग भी इसी विषय से जुड़ी है। Pinterest पर डीपफेक और गलत सूचना की आशंका बढ़ाने वाली छवियाँ एक स्वतंत्र श्रेणी के रूप में बड़ी मात्रा में हैं। यह अब अलग-अलग घटनाओं का विवाद नहीं, बल्कि संरचनात्मक मुद्दा बन रहा है🔥
  • Nano Banana (Google) व्यावहारिक तुलना का मानक बन गया है। YouTube पर Grok Imagine 2.0 को “Nano Banana Pro से 15 गुना सस्ता” बताने वाले वीडियो और ओपन-सोर्स Qwen-Image-2.1 को “Nano Banana से बेहतर” बताने वाले वीडियो, दोनों मिले। क्लोज़्ड और ओपन—दोनों पक्ष इसे पैमाने की तरह इस्तेमाल कर रहे हैं👀
  • ComfyUI डेवलपर समुदाय का साझा इंफ्रास्ट्रक्चर है। Reddit पर मुफ्त वीडियो बनाने के इच्छुक लोगों के लिए स्थानीय सेटअप की सलाह, YouTube पर LTX-2.5 और Qwen-Image-2.1 सेटअप वीडियो, तथा Lemmy पर दो सप्ताह में पाँच से अधिक एक्सटेंशन नोड—हर जगह ComfyUI सामने आया। यह ओपन-सोर्स समुदाय का घरेलू मैदान लगता है🏠

प्लेटफ़ॉर्म के अनुसार

Reddit — 12 थ्रेड एकत्र किए गए (20 के लक्ष्य तक नहीं पहुँचे)। टूल सिफारिश पूछने वाले थ्रेड और “AI से संपादित होने को मत छिपाओ” वाले विवाद मुख्य रहे। क्लोज़्ड/ओपन की दो धुरियों को सीधे संबोधित करने वाली पोस्ट कम थीं, लेकिन r/generativeAI से Seedance 2.5 और Grok Imagine Video जैसे विशिष्ट मॉडलों के व्यावहारिक उपयोग पर सलाह मिली।

X — यह चरण लगभग पूरी तरह खाली गया😂 एकत्र की गई 40 पोस्ट केवल ट्रेंडिंग शब्दों (यूगोस्लाविया, सेलिब्रिटी, स्वीपस्टेक्स विज्ञापन आदि) के ज़रिए आईं और छवि/वीडियो जनरेशन AI पर एक भी पोस्ट नहीं थी। कारण यह था कि वर्कर की खोज विषय से बिल्कुल जुड़ी नहीं थी; अगली बार “Midjourney” या “Sora 2” जैसे सीधे कीवर्ड से फिर से संग्रह करना होगा।

YouTube — खोज स्निपेट के माध्यम से 12 वीडियो देखे गए (WebFetch वास्तविक YouTube पेज प्राप्त नहीं कर सका)। क्लोज़्ड पक्ष में Grok Imagine 2.0 की तेज़ बढ़त और Sora बंद होने के बाद विकल्पों की तुलना दिखी; ओपन पक्ष में Qwen-Image-2.1, FLUX 3 की अवधारणा और LTX-2.5 हालिया रिलीज़ के रूप में प्रमुख रहे।

Bluesky — क्लोज़्ड और ओपन दोनों पक्षों के आधिकारिक कॉर्पोरेट खाते लगभग निष्क्रिय हैं। Midjourney आधिकारिक खाता एकमात्र सक्रिय खाता था, फिर भी उसकी नवीनतम पोस्ट लगभग एक वर्ष पुरानी थी; Stability AI, Black Forest Labs और Kling AI के खाते शून्य या रुके हुए हैं। वास्तविक उत्साह व्यक्तिगत रचनाकारों की प्रोफ़ाइल में Qwen-Image, LTX-2 और Wan Video जैसे विशिष्ट टूल नामों से दिखा।

Lemmy — !«メールアドレス» में ओपन-सोर्स की प्राथमिक जानकारी लगभग केंद्रित है। Qwen-Image-2.1, Krea 2, MiniMax H3 और Wan2GP पर पिछले दो सप्ताह में एक साथ अपडेट आए; विकास की गति के हिसाब से ओपन खेमे की चर्चा क्लोज़्ड पक्ष से आगे रही। क्लोज़्ड पक्ष पर Sora API समाप्ति और Midjourney बनाम Hollywood मुकदमे जैसे “समाचार/कानूनी” संदर्भ मुख्य रहे।

Pinterest — 50 में से 30 पिन देखे गए। सामग्री प्राथमिक घोषणाएँ नहीं, बल्कि YouTube थंबनेल-जैसे समाचार सार, “Top 10 वीडियो जनरेटर” प्रकार की एफिलिएट सूचियाँ और डीपफेक की आशंका बढ़ाने वाली छवियाँ थीं। ओपन-सोर्स वर्कफ़्लो जैसे ComfyUI स्क्रीनशॉट या LoRA एक भी नहीं मिला; क्लोज़्ड और ओपन, दोनों के लिए द्वितीयक वितरण सामग्री ही प्रमुख थी।

क्या देखना है

सिफारिशें

  • X संग्रह चरण को ट्रेंडिंग शब्दों के बजाय “Midjourney”, “Sora 2”, “Stable Diffusion” जैसे ब्रीफ़ से सीधे जुड़े कीवर्ड पर दोबारा चलाना चाहिए।
  • Qwen-Image-2.1 और LTX-2.5 रिलीज़ के तुरंत बाद तेज़ी से अपना इकोसिस्टम बढ़ा रहे हैं; उन्हें आगे भी प्राथमिकता से देखना चाहिए।
  • “बिना खुलासे के AI इस्तेमाल” के ऐसे मामलों पर निरंतर नज़र रखें जो बर्खास्तगी, मुकदमे और नियमन तक पहुँच रहे हैं।
  • Sora के हटने के बाद Veo, Kling, Runway और Grok Imagine के शक्ति-संतुलन की नियमित तुलना उपयोगी रहेगी।
  • Bluesky पर आधिकारिक कॉर्पोरेट संचार लगभग काम नहीं कर रहा है; इसलिए व्यक्तिगत रचनाकारों की प्रोफ़ाइल पर केंद्रित शोध अधिक प्रभावी होगा।
  • Pinterest प्राथमिक स्रोत के रूप में कमजोर है; इसका उपयोग द्वितीयक सामग्री—समाचार सार और एफिलिएट सामग्री—के रुझान मापने तक सीमित रखें।

डेटा गुणवत्ता

X पूरी तरह विफल रहा: केवल ट्रेंडिंग शब्दों से विषय से असंबद्ध पोस्ट मिलीं, इसलिए पुनः संग्रह अनिवार्य है। YouTube पर WebFetch ने YouTube को ब्लॉक कर दिया, इसलिए खोज स्निपेट आधारित केवल 12 परिणाम मिले और कई चैनल नाम व व्यू संख्या अज्ञात हैं। Reddit (12), Bluesky (API 403 के कारण 20 से कम अकाउंट-विशिष्ट फ़ीड) भी 20 के लक्ष्य तक नहीं पहुँचे। Lemmy में 20 से अधिक आइटम मिले, लेकिन अधिकतर शून्य टिप्पणी वाले रिलीज़-नोटिफ़िकेशन बॉट थे और चर्चा का ताप कम था। Pinterest में 50 में से केवल 30 पिन देखे गए।

प्लेटफ़ॉर्म-वार सारांश

Reddit

Reddit — छवि और वीडियो जनरेशन AI समाचार (Image and Video Generation AI News)

कहाँ

एकत्र किए गए 12 थ्रेड 9 सबरेडिट से आए।

सबरेडिट सदस्य संख्या एकत्र थ्रेड संख्या
r/mildlyinfuriating 12,597,694 1
r/labrats 726,858 2
r/WhitePeopleTwitter 3,145,714 1
r/generativeAI 157,421 3
r/DeepSeek 141,431 1
r/isthisAI 423,156 1
r/Earth199999 54,355 1
r/CriticalState 39,741 1
r/aivideomaking 7,823 1

यह विषय जनरेटिव AI के छोटे विशेष समुदायों (r/aivideomaking, r/generativeAI) और मीम/बातचीत वाले विशाल सबरेडिटों (r/mildlyinfuriating, r/WhitePeopleTwitter), दोनों में फैला हुआ है। सभी खोज शब्द “Image and Video Generation AI News” से मिले।

लोग क्या कह रहे हैं
  • #1 r/aivideomaking・24pt・58 टिप्पणियाँ・2026-09-20 — मुफ्त AI वीडियो बनाने की चाह रखने वाले व्यक्ति को u/AztecWheels(2pt) ने उत्तर दिया: “Pinokio से डाउनलोड करें, ComfyUI से छवियाँ बनाएं और FramePack से वीडियो में बदलें। कम-विशिष्टताओं वाले सिस्टम पर भी 1–120 सेकंड के वीडियो स्थानीय रूप से बनाए जा सकते हैं।” स्थानीय जनरेशन और क्लाउड भुगतान के बीच उलझन जताने वाली कई प्रतिक्रियाएँ थीं। (https://www.reddit.com/r/aivideomaking/comments/1wled0f/)
  • #2 r/labrats・1,103pt・133 टिप्पणियाँ・2026-09-23 — Nikon Small World in Motion के विजेता वीडियो के AI-जनित/संपादित होने का मामला। शीर्ष टिप्पणी u/Barkinsons(630pt): “वैज्ञानिक सूक्ष्मदर्शी चित्रों में AI टूल के लिए कोई जगह नहीं है; हमारा दायित्व छवि को यथासंभव सटीक रूप से पुनरुत्पादित करना है।” (https://www.reddit.com/r/labrats/comments/1wo0j5e/)
  • #4 r/labrats・416pt・90 टिप्पणियाँ・2026-09-24 — उपरोक्त की अगली रिपोर्ट। लेखक ने माना कि उसने असुपरवाइज़्ड AI से संरचनाओं को सेगमेंट/लेबल किया था। u/Feline_Diabetes(299pt) ने कहा कि वह जानना चाहता है कि मूल छवि में कितना वास्तविक है और कितना AI का भ्रम। Nikon के पुरस्कार पर पुनर्विचार की जानकारी भी आई। (https://www.reddit.com/r/labrats/comments/1woxdhk/)
  • #3 r/generativeAI・7pt・40 टिप्पणियाँ・2026-09-23 — “लंबे AI वीडियो कैसे बनाएँ” के उत्तर में u/kaboom-o(2pt) ने मॉडल नाम गिनाए: “चेहरे को लंबे समय तक स्थिर रखने के लिए Seedance 2.5 (लगभग 30 सेकंड तक, नेटिव ऑडियो)। सस्ते मोशन ड्राफ्ट के लिए Grok Imagine Video (480p, 5 सेकंड)। फोटो-यथार्थवादी अंतिम आउटपुट के लिए Gemini Omni Flash।” बहुत से छोटे क्लिप बनाकर DaVinci में जोड़ना व्यावहारिक मानक बताया गया। (https://www.reddit.com/r/generativeAI/comments/1wog53q/)
  • #6 r/generativeAI・4pt・17 टिप्पणियाँ・2026-09-22 — u/jmbirn(2pt): “Magnific AI (या Fal, Krea) जैसी सेवा में साइन अप करने पर एक खाते से कई मॉडल आज़मा सकते हैं।” u/sharktank123456(2pt) ने बताया कि Dream Machine ने नए पंजीकरण रोक दिए हैं और उसके बदले Luma Agents उपलब्ध है। (https://www.reddit.com/r/generativeAI/comments/1wngj3w/)
  • #8 r/generativeAI・2pt・20 टिप्पणियाँ・2026-09-26 — मुफ्त छवि-जनरेशन टूल माँगने पर u/Scuzzy_Womack(3pt): “ComfyUI को इंटरनेट से अलग रखकर चलाएँ तो यह मुफ्त है।” Yodayo/MoescapeAI (हर 24 घंटे में 50 क्रेडिट) और Leonardo (रोज़ मुफ्त टोकन) भी सुझाए गए। (https://www.reddit.com/r/generativeAI/comments/1wqfleb/)
  • #5 r/mildlyinfuriating・26,980pt・723 टिप्पणियाँ・2026-09-21 — रियल-एस्टेट लिस्टिंग तस्वीरों में AI से “प्रेरणादायक” आंतरिक साज-सज्जा चित्र इस्तेमाल करने पर गुस्सा। पोस्टर ने कहा: “रेडिएटर हटाने जैसी ऐसी सजावट दिखाई गई है जो वास्तविकता में दोहराई नहीं जा सकती।” u/BojackWorseman13(1,140pt) ने उस एजेंसी के पेज पर शिकायतों की बाढ़ लाने का सुझाव दिया। (https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/)
  • #7 r/WhitePeopleTwitter・585pt・64 टिप्पणियाँ・2026-09-25 — AI-जनित “Lake America” स्वेटर छवि को लेकर CEO निकाले जाने का मामला। u/samanime(294pt): “अगर ऐसे मूर्खों को अधिक जवाबदेह ठहराया जाए, तो ऐसे लोग कम होंगे।” AI-जनित सामग्री का विवाद सीधे रोजगार तक पहुँचने का उदाहरण। (https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/)
  • #9 r/DeepSeek・318pt・53 टिप्पणियाँ・2026-09-21 — DeepSeek का DAU 120 मिलियन से 200 मिलियन (+66.7%) हुआ, लेकिन कंप्यूट संसाधन केवल +8.3% बढ़े; इसे गुणवत्ता गिरने का कारण बताया गया। Huawei Ascend 960DT के 160,000 यूनिट ऑर्डर कर कंप्यूट कमी दूर करने की जानकारी भी आई। u/Equivalent-Grass-527(14pt): “मांग और कंप्यूट शक्ति का असंतुलन हाल की अधिकांश गिरावट समझाता है।” (https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)
  • #10 r/CriticalState・1,280pt・13,849 टिप्पणियाँ・2026-09-21 — “AI-जनित छवियों और लेखन पर वॉटरमार्क दिखाना अनिवार्य होना चाहिए” प्रस्ताव वाला थ्रेड। टिप्पणियों की संख्या असाधारण रूप से अधिक रही, और u/Timedforfun(19pt) सहित कई उच्च-रेटेड टिप्पणियों ने मतदान रूप में “समर्थन✅” जताया। (https://www.reddit.com/r/CriticalState/comments/1wmktek/)
  • #12 r/isthisAI・605pt・104 टिप्पणियाँ・2026-09-23 — कम-सब्सक्राइबर YouTube चैनल के चित्रकारी वीडियो पर “AI या असली” बहस। u/chekhovsdickpic(444pt) ने फ्रेम-दर-फ्रेम जाँच कर निष्कर्ष निकाला कि संपादन है, पर AI नहीं; बाद में लेखक ने स्वयं टिप्पणी करके पुष्टि की। (https://www.reddit.com/r/isthisAI/comments/1wohq6s/)
संकेत
  • जो बढ़ रहा है: लंबे AI वीडियो अब “एक बार में जनरेशन” नहीं, बल्कि Seedance 2.5 या Grok Imagine Video जैसे टूल से बड़ी संख्या में 5–30 सेकंड क्लिप बनाकर उन्हें DaVinci या Capcut में संपादित व जोड़े जाने वाले वर्कफ़्लो की ओर बढ़ रहे हैं (#3)। “मुफ्त × उच्च गुणवत्ता × बिना वॉटरमार्क” तीनों एक साथ देने वाला टूल नहीं है—यह साझा समझ बन चुकी है (#6 में u/Jenna_AI का “तीन में से दो चुनो और रोओ” वाला कथन इसका प्रतीक है)। विकल्प स्थानीय रन (ComfyUI) या सस्ता सब्सक्रिप्शन (जैसे Grok $10/माह) रह गया है (#1, #8)।
  • जिसे नज़रअंदाज़/अस्वीकार किया जा रहा है: AI से संपादित होने की बात छिपाना या अस्पष्ट रखना तीव्र प्रतिक्रिया पैदा करता है। वैज्ञानिक प्रतियोगिता (#2, #4), रियल-एस्टेट तस्वीरें (#5), और कॉर्पोरेट विज्ञापन (#7)—तीनों में बिना खुलासे के AI उपयोग की तीखी आलोचना हुई। r/mildlyinfuriating (#5) के 26,980pt और r/CriticalState (#10) की 13,849 टिप्पणियाँ दिखाती हैं कि यह प्रतिक्रिया केवल किसी छोटे समुदाय तक सीमित नहीं है।
  • आश्चर्यजनक बिंदु: r/labrats के दो थ्रेड (#2, #4) में वैज्ञानिक समुदाय का तकनीकी गुस्सा “AI ने संरचना को hallucinate किया” पर है, लेकिन लेखक के प्रति कुछ सहानुभूति भी दिखती है। u/holydiver18 (#4, 55pt) जैसे लोगों ने कहा कि कुछ आलोचना उचित है। विवाद का केंद्र AI का उपयोग मात्र नहीं, बल्कि खुलासा और सत्यापन-योग्यता है।
  • प्लेटफ़ॉर्म आपूर्ति सीमा का संदर्भ: DeepSeek (#9) की तेज़ वृद्धि और कंप्यूट संसाधनों की कमी, छवि/वीडियो जनरेशन AI के पीछे मौजूद आधारभूत मॉडलों की मांग-आपूर्ति तंगी का अप्रत्यक्ष संकेत है।
सीमाएँ
  • केवल 12 थ्रेड मिले, जबकि ब्रीफ़ में हर प्लेटफ़ॉर्म पर लगभग 20 की अपेक्षा थी। खोज शब्द केवल “Image and Video Generation AI News” था; Midjourney, Sora, Veo, Stable Diffusion, Flux या HunyuanVideo जैसे विशिष्ट उत्पादों व रिलीज़ समाचार के लिए अतिरिक्त खोज नहीं की गई।
  • इसलिए संग्रह का बड़ा भाग टूल अनुशंसा माँगने वाले सवालों और AI सामग्री पर नैतिक प्रतिक्रिया तक सीमित रहा। ओपन बनाम क्लोज़्ड-सोर्स को सीधे तुलना करने वाले थ्रेड नहीं मिले; संश्लेषण दूसरे प्लेटफ़ॉर्मों के परिणामों से करना होगा।
  • इस चरण में वर्कर ने केवल पहले से एकत्र output/reddit.threads.md / .json पढ़े; प्लेबुक के अनुसार Reddit पर सीधी पहुँच या अतिरिक्त खोज नहीं की गई।

X

X — Image and Video Generation AI News

खाते

output/x.posts.json के 39 खाते X पर AI छवि/वीडियो जनरेशन चर्चा चलाने वालों का प्रतिनिधित्व नहीं करते—सीमाएँ देखें। रिकॉर्ड के लिए, @Amateraspi0x (जंगल चैनल, 2 पोस्ट, कुल 0 लाइक) को छोड़कर सभी 39 खातों से एक-एक पोस्ट आई। एंगेजमेंट के हिसाब से सबसे बड़े एकल पोस्ट @LagunaBiotchIG (28,975 लाइक, Taylor-in-Cleveland तस्वीर), @_daddydisco (60,755 लाइक, आदमी का चेहरा “मिट्टी में बदलने” वाले स्पोकन-वर्ड क्लिप), @NIKKE_en (5,608 लाइक, मोबाइल गेम स्क्रीनशॉट इवेंट), और @newheightshow (11,282 लाइक, “Shoutout Cleveland!”) से थे। इनमें से कोई भी खाता जनरेटिव AI टूलिंग, मॉडल या कला पर पोस्ट नहीं करता—ये खेल/सेलिब्रिटी फैन खाते, गाचा-गेम आधिकारिक खाता और गिवअवे बॉट हैं (@Miledge1, @CSharp66427821, @RaeWirth ने वही Fanatics “Quad Goals #sweepstakes” विज्ञापन पोस्ट किया)।

पोस्ट

संग्रहीत 40 पोस्ट में से 0 में छवि-जनरेशन या वीडियो-जनरेशन AI, कोई AI मॉडल या AI टूल का उल्लेख है। किसी ने Midjourney, Stable Diffusion, Sora, Veo, Runway, Flux, Grok Imagine, Nano Banana या किसी अन्य जनरेटिव सिस्टम का उल्लेख नहीं किया। दृश्य-मीडिया के सबसे निकट पोस्ट #4 (@vintagemapstore, 234 लाइक, 52 रीपोस्ट, लगभग 13,000 व्यू, 2026-09-26, https://x.com/vintagemapstore/status/2103834220624068946) है—यूगोस्लाविया के विघटन का हाथ से बना मानचित्र एनीमेशन, जिसे स्पष्ट रूप से “Work by me” कहा गया है, अर्थात गैर-AI के रूप में प्रस्तुत। इस सेट में और कुछ भी जनरेटिव मीडिया से परोक्ष रूप से भी संबंधित नहीं है। यहाँ कोई निष्कर्ष नहीं बताया जा सकता; असंबद्ध पोस्ट की सूची देना X के रुख को गलत रूप में पेश करेगा।

संकेत

इस डेटासेट में छवि/वीडियो जनरेशन AI का कोई संकेत नहीं है। डेटा यह ज़रूर दिखाता है कि क्यों: वर्कर के खोज शब्द (Yugoslavia, #chance, Taylor, #sweepstakes, #giveaways, Czechia, #gaming, Goddess, Lando, Cleveland) ब्रीफ़ से बिल्कुल असंबंधित हैं। वे संग्रह समय पर X Explore की ट्रेंडिंग सूची से ज्यों-के-त्यों लिए गए थे (देखें output/x.posts.json, "source": "trending")। दस में आठ “Trending in Croatia” चिह्नित थे; शेष राष्ट्रीय/वैश्विक राजनीति, संगीत, खेल, गेमिंग और मोटरस्पोर्ट ट्रेंड थे। Explore उस स्थान के अनुसार दिखता है जहाँ से सत्र X तक पहुँचा—इस रन में संभवतः क्रोएशिया—इसलिए यह स्थानीय ट्रेंडिंग साइडबार है, वैश्विक दृश्य नहीं, और शोध-विषय की खोज तो बिल्कुल नहीं थी।

सीमाएँ
  • संग्रह में विषय खोजा ही नहीं गया। output/x.posts.json में "query": "Image and Video Generation AI News" दर्ज है, लेकिन "source": "trending" तथा "terms" पूरी तरह X Explore के ट्रेंड से लिए गए हैं। यह वास्तविक कीवर्ड खोज की बजाय एक फॉलबैक पथ लगता है, इसलिए यह फ़ाइल ब्रीफ़ का उत्तर नहीं दे सकती।
  • इस कारण इस रन में X के लिए विषय-संबंधित खाते, पोस्ट या संकेत नहीं हैं—सभी 40 पोस्ट सेलिब्रिटी फैंडम, खेल स्कोर, मोबाइल गेम, गिवअवे विज्ञापन, पुराने मानचित्र एनीमेशन या Formula 1 फैन विवाद से जुड़ी हैं।
  • इसे ठीक करने के लिए अपनी खोज नहीं चलाई जा सकी: प्लेबुक के अनुसार गुमनाम/अप्रमाणित X रीड से कुछ नहीं मिलता, और केवल वर्कर के पूर्व-प्रमाणित सत्र से पोस्ट संग्रह हो सकता है। इस चरण के लिए कोई वैकल्पिक डेटा स्रोत नहीं है।
  • अगली बार X संग्रह चरण को ब्रीफ़-संबंधित स्पष्ट शब्दों—“Midjourney,” “Sora 2,” “Stable Diffusion,” “Runway Gen-4,” “Nano Banana,” “Veo 3,” “open-source image model,” “open weights video model”—के साथ चलाया जाना चाहिए, ताकि वास्तविक चर्चा मिल सके।

YouTube

YouTube — छवि और वीडियो जनरेशन AI समाचार (Image and Video Generation AI News)

चैनल

YouTube पर इस विषय को लगातार कवर करने वाले बड़े चैनल, जिन्हें खोज से पहचाना गया:

  • Matt Wolfe(@mreflow) — लगभग 690,000–970,000 सब्सक्राइबर (स्रोतों के अनुसार अलग संख्या)। व्यापक दृष्टिकोण के साथ AI समाचार समेटने वाला प्रमुख चैनल।
  • Wes Roth — लगभग 321,000 सब्सक्राइबर। रोज़ाना संक्षिप्त AI समाचार ब्रीफ़िंग प्रारूप।

ये दोनों नाम बाहरी लेखों (atakinteractive.com, vidiq.com) में सामान्य AI समाचार के स्थापित चैनलों के रूप में आए हैं। यह पुष्टि नहीं हुई कि इस बार एकत्र व्यक्तिगत वीडियो इन्हीं दोनों चैनलों के हैं (नीचे सीमाएँ देखें)। अधिकांश मिले वीडियो में YouTube खोज स्निपेट में चैनल नाम नहीं था।

वीडियो

क्लोज़्ड-सोर्स पक्ष:

  1. Grok Imagine 2.0 Just WIPED OUT Expensive Design Tools (Full Asset Workflow) — लगभग अगस्त 2026 — https://www.youtube.com/watch?v=jH7-krxfarU — दावा है कि xAI का 7 अगस्त 2026 में जारी छवि मॉडल “Grok Imagine 2.0” मौजूदा महंगे डिज़ाइन टूलों का पूरा वर्कफ़्लो बदल सकता है।
  2. [Image Gen AI] Grok Imagine 2.0 Hits #2 Globally — लगभग अगस्त 2026 — https://www.youtube.com/watch?v=X6PChZ59LrQ — Grok Imagine 2.0 के वैश्विक छवि-जनरेशन रैंकिंग में दूसरे स्थान तक पहुँचने की रिपोर्ट।
  3. Grok Imagine 2 is out of control (And It's 15x Cheaper Than Nano Banana Pro) — लगभग अगस्त 2026 — https://www.youtube.com/watch?v=NE2_w4_aDig — दावा है कि Grok Imagine 2 Nano Banana Pro से 15 गुना सस्ता है, लेकिन गुणवत्ता प्रतिस्पर्धी स्तर की है।
  4. BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives — 27 मार्च 2026 — https://www.youtube.com/watch?v=Zf9979o8RGk — OpenAI के Sora 2 बंद होने (ऐप 26 अप्रैल, API 24 सितंबर को पूर्ण रोक) के बाद विकल्पों को आज़मा कर तुलना। सितंबर तक यह बंद होना वास्तविकता बन चुका है।
  5. Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison — लगभग मार्च 2026 — https://www.youtube.com/watch?v=x5fMQvhKP60 — चार क्लोज़्ड-सोर्स वीडियो मॉडल की सीधी तुलना। Kling को लंबे वीडियो, 4K और मोशन ट्रांसफ़र में; Veo को ऑडियो गुणवत्ता और संदर्भ-छवि नियंत्रण में बेहतर बताया गया।
  6. Midjourney V8 Is Close: Here's What We Know — लगभग 2026 — https://www.youtube.com/watch?v=aEVvqmwDVu8 — Midjourney V8 (V8.1 14 अप्रैल को पहले ही जारी हो चुका) के अगले चरण के बारे में उपलब्ध जानकारी का सार।

ओपन-सोर्स पक्ष:

  1. Qwen-Image-2.1 Is INSANE… Just 7B Parameters?! — लगभग 20–21 सितंबर 2026 — https://www.youtube.com/watch?v=3qGl0wiv2G0 — Alibaba Qwen के 20 सितंबर को जारी “Qwen-Image-2.1” (7B पैरामीटर, टेक्स्ट-टू-इमेज व एडिटिंग एकीकृत, नेटिव पारदर्शी बैकग्राउंड, अधिकतम 10 संदर्भ छवियों का संयोजन) की त्वरित समीक्षा।
  2. Qwen Image 2.1 best open source Image Editor. Better than Nano Banana - 10 refs transparency faster — लगभग सितंबर 2026 — https://www.youtube.com/watch?v=AIgYj5RG-FQ — ComfyUI डेमो सहित Nano Banana से बेहतर बताए गए बिंदुओं—10 संदर्भ छवियाँ, पारदर्शिता और गति—की जाँच।
  3. FLUX 3 Might Be the Open Source Sora 2 We Deserve — 24 जुलाई 2026 — https://www.youtube.com/watch?v=1s3zslFOSh0 — Black Forest Labs के FLUX परिवार को छवि से आगे वीडियो, ऑडियो और रोबोटिक्स तक विस्तारित करने वाले मल्टीमॉडल “FLUX 3” विचार का परिचय।
  4. LTX-2.5 Is Open Weights - Full Setup and Test on ComfyUI — 18 अगस्त 2026 — https://www.youtube.com/watch?v=sIOC9pzHzjs — Lightricks के ओपन-वेट MP में जारी 22B पैरामीटर वाले सिंक्रनाइज़्ड ऑडियो वीडियो मॉडल “LTX-2.5” को ComfyUI में सेटअप व परीक्षण।
  5. New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local) — 12 अगस्त 2026 — https://www.youtube.com/watch?v=pA2BQw9LY8A — LTX-2.5 को स्थानीय वातावरण में चलाकर उसकी तेज़ जनरेशन गति पर जोर।
  6. Z Image Undistilled Just Dropped | Day 0 Review — नवंबर 2025–फरवरी 2026 के बीच (प्रकाशन तिथि अनिश्चित) — https://www.youtube.com/watch?v=mtk4IL-Bv28 — Apache-2.0 लाइसेंस वाले हल्के ओपन-सोर्स “Z-Image” परिवार के Undistilled संस्करण की Day 0 समीक्षा।
संकेत
  • ओपन-सोर्स पक्ष की गति मजबूत है: इस चरण में पाए गए पिछले 60 दिनों के वीडियो में Grok Imagine 2.0 (क्लोज़्ड, अगस्त) को छोड़कर Qwen-Image-2.1 (20 सितंबर), FLUX 3 विचार (24 जुलाई), LTX-2.5 (12–26 अगस्त, कई चैनलों द्वारा) जैसे ओपन-सोर्स विषय प्रमुख रहे। विशेष रूप से Qwen-Image-2.1 और LTX-2.5 के लिए रिलीज़ के तुरंत बाद कई “Day 0 समीक्षा” और स्थानीय सेटअप वीडियो आए, जो समुदाय की तेज़ प्रतिक्रिया दिखाते हैं।
  • “क्या Nano Banana (Google) को हराया या बदला जा सकता है?” वाली भाषा मानक बन गई है: ओपन पक्ष के वीडियो (#8 “Better than Nano Banana”) और क्लोज़्ड पक्ष के वीडियो (#3 “15x Cheaper Than Nano Banana Pro”) दोनों Nano Banana (Gemini छवि जनरेशन) को तुलना बिंदु बनाते हैं। Google का Nano Banana परिवार इस क्षेत्र का वास्तविक तुलना-मानक बन चुका है।
  • क्लोज़्ड-सोर्स वीडियो जनरेशन का नक्शा “Sora के हटने” से फिर बन रहा है: Sora 2 का ऐप 26 अप्रैल और API 24 सितंबर को बंद हुआ (#4)। नतीजतन Veo 3.1, Kling 3.0, Grok Imagine और Runway Gen-4.5 की चार-तरफ़ा तुलना (#5) क्लोज़्ड पक्ष का सामान्य प्रारूप बन रही है।
  • आश्चर्यजनक बिंदु: LTX-2.5 और HunyuanVideo 1.5 जैसे ओपन-सोर्स वीडियो मॉडल की समीक्षा में प्रदर्शन से अधिक ComfyUI सेटअप और VRAM आवश्यकताएँ प्रमुख हैं; लोगों की दिलचस्पी इस बात में अधिक है कि मॉडल उनके अपने PC पर चलेगा या नहीं।
सीमाएँ
  • YouTube खोज और वीडियो पेज को WebFetch से खोलने पर केवल कुकी सहमति/फुटर टेम्पलेट मिला; वास्तविक शीर्षक सूची, चैनल, सब्सक्राइबर, व्यू, प्रकाशन तिथि, विवरण और टिप्पणियाँ नहीं मिलीं। इसलिए वीडियो जानकारी खोज स्निपेट पर आधारित है।
  • परिणामस्वरूप प्रत्येक वीडियो के चैनल नाम, सब्सक्राइबर और ठोस व्यू संख्या सत्यापित नहीं हुई। वीडियो खंड की अपेक्षित जानकारी में चैनल व व्यू अधिकांश मामलों में अज्ञात हैं और तिथियाँ भी अनुमानित हैं।
  • प्रत्येक प्लेटफ़ॉर्म पर लगभग 20 पोस्ट/वीडियो के लक्ष्य तक नहीं पहुँचा गया; विस्तृत पेज-जाँच प्रक्रिया काम न करने से 12 परिणाम ही रखे गए।
  • 24 सितंबर की Sora API समाप्ति पर सितंबर के YouTube वीडियो नहीं मिले; मार्च की शुरुआती घोषणा वाला वीडियो (#4) विकल्प के रूप में इस्तेमाल किया गया। सितंबर में वास्तविक बंद होने को सीधे रिपोर्ट करने वाला वीडियो सत्यापित नहीं है।
  • Matt Wolfe / Wes Roth नाम बाहरी लेखों से सामान्य प्रतिनिधि चैनल के रूप में लिए गए; यह पुष्टि नहीं हुई कि ऊपर #1–12 में कोई वीडियो उन्हीं का है।

Bluesky

Bluesky — छवि और वीडियो जनरेशन AI (क्लोज़्ड/ओपन-सोर्स) समाचार शोध

खाते
  • Midjourney आधिकारिक @midjourneyofficial.bsky.social — क्लोज़्ड-सोर्स पक्ष का एकमात्र नियमित पोस्ट करने वाला आधिकारिक खाता। सामग्री दैनिक छवि/वीडियो पोस्ट और Style Explorer जैसे फीचर परिचय तक सीमित है; बड़ी समाचार-स्तरीय घोषणाएँ लगभग नहीं हैं।
  • Stability AI @stabilityai.bsky.social — ओपन-वेट (Stable Diffusion परिवार) का आधिकारिक खाता। नवीनतम पोस्ट 19 नवंबर 2025 की Warner Music Group साझेदारी घोषणा है; सितंबर 2026 तक लगभग 10 महीने से कोई पोस्ट नहीं।
  • Black Forest Labs (FLUX निर्माता) @blackforestlabs.bsky.social — हैंडल मौजूद है, लेकिन कोई पोस्ट नहीं; व्यवहार में निष्क्रिय खाता।
  • ComfyUI आधिकारिक-संबंधित खाते (real-comfyui.bsky.social / comfy-ui.bsky.social) — दोनों में कोई पोस्ट नहीं। ComfyUI समुदाय ने Bluesky पर आधिकारिक संचार नहीं रखा है।
  • Civitai अपडेट Bot @civitai-bot.bsky.social (जिसे “CivitaiCheckPoint अपडेट BOT” भी कहते हैं, जापानी संचालन) — Civitai चेकपॉइंट अपडेट का स्वचालित बॉट। पुष्टि की गई नवीनतम पोस्ट 9 मई 2024 की है; संभवतः Bluesky का स्वचालित समन्वय रुक गया है।
  • Kling AI आधिकारिक @klingai.bsky.social — हैंडल है, लेकिन कोई पोस्ट नहीं।
  • OpenAI, Google DeepMind और Adobe Firefly के प्राथमिक आधिकारिक खाते नहीं मिले; परिणाम गैर-आधिकारिक मिरर/बॉट (जैसे openai-m.extwitter.link, googledeepmind.zpravobot.news.ap.brid.gy) या कंपनियों के एंबेसडर/कर्मचारी व्यक्तिगत खाते थे।
  • व्यक्तिगत रचनाकार (ओपन-सोर्स के वास्तविक उपयोग के प्रमाण वाले खाते):
    • @you32081.bsky.social — Qwen-Image और Z-Image-Turbo से बनाए कार्य पोस्ट करता है
    • @andyt79.bsky.social — प्रोफ़ाइल में “LTX-2 Qwen Image” उपयोग लिखता है और Midjourney प्रॉम्प्ट-साझाकरण #QP में भाग लेता है
    • @generate-cmyxt.bsky.social — ComfyUI, Qwen Image Edit, Wan Video और BindWeave वर्कफ़्लो समझाने की घोषणा करता है (X लिंक)
पोस्ट
  1. Midjourney “Happy Friday!” वीडियो पोस्ट — 2025-08-22, 64 likes / 4 reposts / 3 replies। देखी गई Midjourney पोस्टों में सबसे अधिक प्रतिक्रिया, लेकिन यह फीचर समाचार नहीं बल्कि सामान्य एंगेजमेंट पोस्ट थी।
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lwz7idyu4k27
  2. Midjourney Style Explorer विस्तार घोषणा — 2025-09-10, 10 likes / 1 repost / 1 quote। वीडियो/छवि Explore पेज की तरह Style खोजने की सुविधा का परिचय।
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lyj6kbu47k2c
  3. Midjourney Style Explorer में स्टाइल संख्या कई गुना बढ़ने की घोषणा — 2025-09-18, 10 likes / 2 reposts / 1 quote। fuzzy style search फीचर भी जोड़ा गया।
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c
  4. Midjourney “Time for some chaos?” वीडियो — 2025-10-08, 12 likes / 1 repost / 1 bookmark। देखी गई सबसे नई पोस्ट; उसके बाद लगभग एक वर्ष से अपडेट रुका है।
    https://bsky.app/profile/midjourneyofficial.bsky.social/post/3m2ndua75gc26
  5. “Odin's Chariot does not exist” उपयोगकर्ता पोस्ट पर Midjourney आधिकारिक प्रतिक्रिया — मूल पोस्ट 2025-09-04 की थी, बॉट @ttaships.airminded.org की स्वचालित कला पोस्ट, 20 likes / 2 reposts। Midjourney आधिकारिक खाते ने उत्तर दिया; इससे पता चलता है कि समुदाय बॉट से संवाद ही उसके मुख्य क्रियाकलापों में है।
    https://bsky.app/profile/ttaships.airminded.org/post/3lxzwpuriuf2y
  6. Stability AI × Warner Music Group साझेदारी घोषणा — 2025-11-19, “ethically trained models” से संगीत-निर्माण टूल संयुक्त रूप से विकसित करने की घोषणा। फिर भी केवल 1 like / 2 replies / 0 repost की प्रतिक्रिया।
    https://bsky.app/profile/stabilityai.bsky.social/post/3m5ynoibe3s2k
  7. Civitai अपडेट Bot “Carrot Caramel Batake updated” — 2024-05-09, SD1.5-आधारित चेकपॉइंट अपडेट सूचना, 3 likes (porn label सहित)।
    https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24
  8. Civitai अपडेट Bot “AnimeMixV2 updated” — 2024-05-09, SD1.5-आधारित, 2 likes। यही वर्तमान में देखी जा सकने वाली बॉट की नवीनतम पोस्ट हैं; मई 2024 के बाद अपडेट लगभग रुक गए।
    https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nn7lydr2y
  9. व्यक्तिगत रचनाकार प्रोफ़ाइल से दिखता ओपन-वेट नवीन परिदृश्य — @you32081.bsky.social ने Qwen-Image व Z-Image-Turbo, @andyt79.bsky.social ने LTX-2 व Qwen Image, और @generate-cmyxt.bsky.social ने ComfyUI + Qwen Image Edit + Wan Video + BindWeave वर्कफ़्लो लिखा है। व्यक्तिगत पोस्टों की प्रतिक्रिया संख्या सत्यापित नहीं हुई, पर 2026 में Bluesky व्यक्तियों द्वारा इस्तेमाल हो रहे ओपन-वेट मॉडल स्पष्ट हैं।
  10. Black Forest Labs आधिकारिक खाते में शून्य पोस्ट — ओपन-वेट छवि जनरेशन के अग्रणी FLUX परिवार की डेवलपर कंपनी का आधिकारिक Bluesky खाता मौजूद है, पर उसने कभी पोस्ट नहीं की। संभवतः अग्रिम-पंक्ति ओपन-सोर्स सूचना X/GitHub/Discord जैसे प्लेटफ़ॉर्मों पर केंद्रित है।
    https://bsky.app/profile/blackforestlabs.bsky.social
संकेत
  • क्लोज़्ड-सोर्स Bluesky संचार बेहद कमजोर है। OpenAI, Google DeepMind, Adobe Firefly, Runway, Kling AI और Ideogram में से कोई भी सक्रिय प्राथमिक आधिकारिक खाते के रूप में नहीं मिला। केवल Midjourney नियमित रूप से पोस्ट करता था, लेकिन उसकी नवीनतम पोस्ट अक्टूबर 2025 की है।
  • ओपन-सोर्स का आधिकारिक संचार भी ठहरा हुआ है। Stability AI की Warner Music Group जैसी बड़ी साझेदारी को भी केवल 1 like मिला। Black Forest Labs और ComfyUI संबंधी खाते शून्य पोस्ट पर हैं; Civitai अपडेट बॉट मई 2024 से रुका है।
  • वास्तविक तापमान व्यक्तिगत रचनाकारों के बायो और पोस्ट में है। Qwen-Image, Qwen-Image-Edit, Z-Image-Turbo, Wan Video/WanAnimate, LTX-2 और BindWeave जैसे हालिया ओपन-वेट छवि/वीडियो मॉडल कई व्यक्तिगत खातों में उपयोग-टूल के रूप में लिखे हैं। Bluesky पर यह “समाचार” से अधिक “लोग शांतिपूर्वक इस्तेमाल कर रहे हैं” वाला स्तर है।
  • कुल मिलाकर Bluesky, X जैसी प्राथमिक उद्योग-सूचना जगह नहीं है। कॉर्पोरेट खातों की उपस्थिति बेहद सीमित है; सक्रिय हिस्से व्यक्तिगत AI कला समुदाय, रचनाएँ साझा करने वाले, #QP जैसे प्रॉम्प्ट-साझाकरण आयोजन और जापानी AI-इल्युस्ट्रेशन/Civitai संबंधी समुदाय हैं।
सीमाएँ
  • Bluesky का पूर्ण-पाठ खोज API (app.bsky.feed.searchPosts) WebFetch के ज़रिए लगातार HTTP 403 Forbidden देता रहा। इसलिए “Stable Diffusion”, “Midjourney” जैसे शब्दों से पूर्ण खोज या गिनती नहीं हुई; app.bsky.actor.searchActors और app.bsky.feed.getAuthorFeed से खातों व फ़ीड का अध्ययन किया गया। अतः विषय/हैशटैग के आधार पर 20 आइटम का व्यापक संग्रह नहीं हुआ।
  • शोध के दौरान यदि WebFetch को “कच्चा JSON ज्यों का त्यों लौटाओ” न कहा जाए, तो एक बार वास्तविक API प्रतिक्रिया से अलग सारांश मिला जिसमें मौजूद न होने वाले data.sample_accounts जैसे फ़ील्ड थे। इसके बाद हर बार “verbatim, no summarization” कहकर कच्चा JSON लिया गया; उस एक बार के परिणाम को इस रिपोर्ट में कहीं उपयोग नहीं किया गया।
  • Runway, Luma AI, Pika, Hailuo, Ideogram, Leonardo AI, Adobe Firefly, OpenAI (DALL-E/Sora), Google DeepMind (Veo/Nano Banana) के लिए खाते खोजने पर आधिकारिक प्राथमिक खाते नहीं मिले। इसलिए इनके Bluesky प्राथमिक-स्रोत संचार का लगभग अभाव स्वयं निष्कर्ष है।
  • getAuthorFeed में प्रति खाते अधिकतम 20 पोस्ट मिलीं और पेजिनेशन नहीं किया गया। प्राप्त दायरे में बड़ी मॉडल घोषणाएँ नहीं थीं, पर इससे यह सिद्ध नहीं होता कि Bluesky पर वे बिल्कुल मौजूद नहीं हैं।

Lemmy

Lemmy — छवि और वीडियो जनरेशन AI की नवीनतम गतिविधियाँ

समुदाय
  • !«メールアドレス» — स्थानीय सदस्य 1,230 / फेडरेटेड कुल 5,710। दैनिक सक्रिय 3, साप्ताहिक 20 और मासिक 67 के साथ छोटा समुदाय, लेकिन Hugging Face / GitHub के नए मॉडल, LoRA और टूल बॉट से स्वचालित पोस्ट करता है; ओपन-सोर्स छवि/वीडियो जनरेशन के प्राथमिक स्रोतों में सबसे सघन है।
  • !«メールアドレス» — उसी इंस्टेंस का कार्य-साझाकरण समुदाय। समाचार के बजाय SDXL/Flux कला पोस्ट प्रतिदिन कई बार आती हैं, इसलिए प्रवृत्ति विश्लेषण के लिए उपयुक्त नहीं।
  • !«メールアドレス» — 8,531 सदस्य, Lemmy के बड़े AI छवि समुदायों में एक, पर स्कोर कभी नकारात्मक और व्यू/चर्चा दोनों कमज़ोर।
  • !«メールアドレス» — सामान्य टेक समाचार समुदाय; Midjourney मुकदमे जैसी क्लोज़्ड-सोर्स खबरें यहाँ आती हैं।
  • !ai_reddit — Lemmy पर Reddit क्रॉसपोस्ट समुदाय; r/ArtificialIntelligence की पोस्टों से Sora API बंद होने जैसी खबरें मिलीं।
  • !«メールアドレス» — विकेंद्रीकृत, मुफ्त Stable Diffusion जनरेशन सेवा AI Horde का घोषणा समुदाय; ओपन-सोर्स संघ के लिए विशिष्ट विषय।
पोस्ट
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing — !«メールアドレス», 2026-09-22, score 13
    https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
    Alibaba Qwen-Image-2.1 का ComfyUI में आधिकारिक समर्थन। पारदर्शी आउटपुट समर्थित एडिटिंग सुविधा वाले ओपन-वेट मॉडल के रूप में परिचय।

  2. Kijai/QwenImage_experimental — Qwen Image 2.1 Fun_controlnet_union — !«メールアドレス», 2026-09-26, score 1
    https://huggingface.co/Kijai/QwenImage_experimental/tree/main/model_patches
    प्रसिद्ध डेवलपर Kijai द्वारा Qwen-Image-2.1 के लिए ControlNet इंटीग्रेशन मॉडल पैच।

  3. PrunaAI/Pruna-Qwen-Image-2.1 — Few-step LoRA adapters — !«メールアドレス», 2026-09-26, score 1
    https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1
    Qwen-Image-2.1 में जनरेशन स्टेप कम करने वाले गति-वर्धक LoRA।

  4. Cierpliwy/krea2-inpaint-edit — LoRAs for Krea-2-Raw और lvladikov/Krea2-Turbo-Distill-2step-LoRA — !«メールアドレス», 2026-09-26 / 2026-09-13–16, score 0–2
    https://huggingface.co/Cierpliwy/krea2-inpaint-edit ・ https://huggingface.co/lvladikov/Krea2-Turbo-Distill-2step-LoRA
    Black Forest Labs परिवार के “Krea 2” मॉडल के लिए इनपेंट एडिट LoRA और दो स्टेप तक डिस्टिल किया गया तेज़ LoRA लगातार पोस्ट हुआ।

  5. SupraLabs/Supra2-IMG — tiny 100M parameters text-to-image model — !«メールアドレス», 2026-09-22, score 8
    https://huggingface.co/SupraLabs/Supra2-IMG
    केवल 100 मिलियन पैरामीटर का अति-हल्का टेक्स्ट-टू-इमेज मॉडल; स्थानीय और कम-विशिष्टता वातावरण की प्रवृत्ति का उदाहरण।

  6. MiniMax H3 परिवार के टूलों की तेज़ बढ़त(ComfyUI-Fizgig-H3-Tweaks / ComfyUI_MinimaxH3_AutoContext / 3d-Camera-control-H3-Minimax / MiniMax-H3-Image-Training-Adapter / TaoMate-H3-3Step-ComfyUI) — !«メールアドレス», 2026-09-12–09-26, score 1–5
    उदाहरण: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext (लंबे वीडियो जनरेशन के लिए) ・ https://github.com/NyckM/3d-Camera-control-H3-Minimax (3D कैमरा नियंत्रण)
    ओपन-वेट वीडियो मॉडल “MiniMax H3” के लिए ComfyUI एक्सटेंशन नोड दो सप्ताह में पाँच से अधिक आए; आसपास का इकोसिस्टम तेज़ी से तैयार हो रहा है।

  7. g3n3rativ3/wan2gp-h3-latent-continue — !«メールアドレス», 2026-09-16, score 1
    https://github.com/g3n3rativ3/wan2gp-h3-latent-continue
    Alibaba-आधारित वीडियो जनरेशन GUI “Wan2GP” में latent से वीडियो को आगे जारी रखने का फ़ंक्शन जोड़ा गया।

  8. The AI Horde has a new Interface, a new Image generation frontend, new backend, and all new documentation! — !«メールアドレス» / !aihorde, 2026-09-19, score 8 / -2
    https://haidra.net/an-image-generation-studio-and-documentation-on-aihorde-net/
    कंप्यूट संसाधन साझा करके मुफ्त Stable Diffusion प्रकार की छवि जनरेशन देने वाली विकेंद्रीकृत सेवा “AI Horde” ने फ्रंटएंड, बैकएंड और दस्तावेज़ नए किए।

  9. OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !ai_reddit, 2026-09-20, score 1
    https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/openai-is-shutting_down-soras-api-next-week-while/
    OpenAI के वीडियो जनरेशन AI “Sora” की API सेवा बंद होने के बीच, चीनी प्रतिस्पर्धी के $3 अरब जुटाने वाली पोस्ट। क्लोज़्ड-सोर्स वीडियो जनरेशन के बदलते शक्ति-संतुलन का संकेत।

  10. OpenAI's Identity Crisis(The Atlantic) — !theatlantic, 2026-03-26, score 2
    https://www.theatlantic.com/technology/2026/03/sora-openai-identity-crisis/686544/
    Sora समाप्ति की पृष्ठभूमि में, राजस्व के दबाव में OpenAI के लगातार फीचर व व्यापार मॉडल बदलने की आलोचना। उच्च कंप्यूट लागत को पीछे हटने का प्रमुख कारण बताया गया।

  11. Midjourney Wants Hollywood Studios to Reveal AI Usage Details(TechCrunch) — !«メールアドレス», 2026-07-05, score 73
    https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
    Disney, Universal और Warner Bros. से कॉपीराइट मुकदमे में Midjourney ने स्टूडियो से आंतरिक AI प्रशिक्षण और प्रॉम्प्ट उपयोग सहित AI उपयोग का पूरा खुलासा माँगा। क्लोज़्ड-सोर्स बड़ी कंपनियों का कॉपीराइट संघर्ष तेज़ हुआ।

संकेत
  • Lemmy पर ओपन-सोर्स छवि/वीडियो जनरेशन AI चर्चा लगभग पूरी तरह !«メールアドレス» में केंद्रित है। अधिकतर मानवीय चर्चा नहीं, बल्कि Hugging Face/GitHub रिलीज़ को स्वतः पुनर्प्रकाशित करने वाले बॉट पोस्ट हैं, जिनमें टिप्पणियाँ लगभग शून्य हैं; यह समाचार स्थान से अधिक रिलीज़ फ़ीड है।
  • केवल पिछले दो सप्ताह (2026-09-12–09-26) में Qwen-Image-2.1, Krea 2, MiniMax H3 और Wan2GP—चार स्वतंत्र ओपन-वेट परिवार—LoRA, ComfyUI नोड और स्पीड एडॉप्टर जैसे सहायक टूलों के साथ समानांतर अपडेट हुए। विकास-गति में ओपन-सोर्स खेमा क्लोज़्ड-सोर्स की चर्चा मात्रा से आगे है।
  • Lemmy पर क्लोज़्ड-सोर्स विषय तकनीकी समुदायों में उत्पाद-गुणवत्ता चर्चा की तुलना में समाचार, मुकदमे और प्रबंधन संदर्भ—Sora API समाप्ति, Midjourney बनाम Hollywood—में अधिक आते हैं।
  • स्कोर और टिप्पणियाँ अधिकतर एक-अंकीय से दर्जन भर तक ही हैं; Reddit/X की तुलना में Lemmy पर समग्र चर्चा की तीव्रता कम है।
सीमाएँ
  • Lemmy का उपयोगकर्ता व पोस्ट आधार छोटा है, इसलिए प्रति प्लेटफ़ॉर्म लगभग 20 स्वतंत्र चर्चाओं का लक्ष्य संभव नहीं था। 20 से अधिक पोस्ट देखी गईं, लेकिन अधिकतर शून्य-टिप्पणी रिलीज़-नोटिफ़िकेशन बॉट पोस्ट हैं, सक्रिय बातचीत नहीं।
  • “Nano Banana”, “Midjourney v7”, “Gemini छवि जनरेशन”, “Flux 2” जैसे क्लोज़्ड-सोर्स नवीन मॉडल के विशेष विषय खोजे गए, पर समर्पित पोस्ट नहीं मिली; परिणाम सामान्य टेक लेखों और असंबद्ध पोस्टों में दब गए।
  • Alibaba “Wan 2.1” के ओपन-सोर्स वीडियो मॉडल और AI पोर्न उपयोग की आलोचना पर सामग्री मिली, लेकिन वह मार्च 2025 की थी और सितंबर 2026 के नवीन रुझान से बाहर होने के कारण शामिल नहीं की गई।
  • lemmy.world खोज API ने कई क्वेरी पर 500 त्रुटि दी; कुछ पेज प्राप्त नहीं हो सके।

Pinterest

Pinterest — Image and Video Generation AI News

एकत्र 50 पिन में से 30 को छवि के रूप में खोला और पढ़ा गया (तालिका output/pinterest.pins.md में एक सपाट सूची है, शैली-खंडों में विभाजित नहीं; इसलिए यह शैली-दर-शैली के बजाय एकल समीक्षा है)।

दृश्य विषय
  • Pinterest पर पुनर्प्रकाशित YouTube-थंबनेल शैली के “AI NEWS” सार। आश्चर्यचकित चेहरे वाला प्रस्तुतकर्ता और चमकते विक्रेता लोगो—OpenAI, Google, Microsoft, Anthropic का घुमावदार लोगो, Meta का अनंत चिह्न, Notion का N। [1, 20]
  • घने “वे X अपडेट जिन्हें आपको जानना चाहिए” इन्फ़ोग्राफ़िक। एक कार्ड में कई कहानियाँ: GPT-6 Astra, Gmail/Docs/Slides में Gemini का “agentic” बनना, Adobe Premiere में टाइमलाइन-आधारित जनरेटिव वीडियो/ध्वनि, Cognition की $2B Series E; अलग कार्ड में Google I/O 2026 (Gemini 3.5 Flash, Gemini Omni, AI Overviews से खोज का स्थान लेना, Android XR ग्लास)। [22, 35]
  • “Top N AI video generator” सूची, हर बार वही नाम—Kling AI, Runway, Pika, Luma Dream Machine, HeyGen, Hailuo AI, Google Veo, OpenAI Sora, Synthesia, D-ID—SEO/एफिलिएट ब्लॉग के फ़ोन-स्क्रीन या पोस्टर ग्राफ़िक में। [27, 47, 49]
  • ह्यूमनॉइड रोबोट हीरो आर्ट टूल-प्रमोशन पिन पर सामान्य सजावट के रूप में: OpenAI लोगो थामे क्रोम रोबोट हाथ, स्क्रीन पर नारंगी-काँच एंड्रॉइड, आधी मानव/आधी सर्किटरी साइबोर्ग महिला। [16, 21, 41]
  • डीपफेक/गलत सूचना की आशंका वाली छवियाँ: बर्फ में नकली संवाददाता का NBC News-ब्रांडेड “AI GENERATED” क्लिप, “Human Journalism vs. Machine-Generated Media” स्प्लिट स्क्रीन, नकली एंगेजमेंट संख्या वाली AI बिल्ली के पास “FAKE” रोबोट, फ़ोन-आसक्त ज़ॉम्बी को नियंत्रित करता “AI” दानव, और 9/11 पृष्ठभूमि वाले कॉकपिट में अंगूठा उठाए Trump की सिंथेटिक तस्वीर। [4, 19, 26, 30, 44]
  • शैली-संगति तकनीकी डेमो: एक वीडियो को पाँच रूपों में फिर से रेंडर किया गया—लकड़ी के ब्लॉक, ओरिगेमी, Lego ईंट और फूलों से ढकी शैली में एक ही व्यक्ति व कार—वीडियो मॉडल वॉटरमार्क के साथ, एक क्लिप को बहु-शैली में बदलने का प्रदर्शन। [2]
  • छोटे व्यवसायों के AI वीडियो-सेवा विज्ञापन: Gemini से “AI Video Generation” या “Professional AI Video Creation” देने वाले फ्रीलांसर/एजेंसी के WhatsApp-संपर्क ग्राफ़िक; समाचार की बजाय ट्रेंड पर सवार। [9, 24, 37]
  • AI सामग्री के बिना सामान्य कॉर्पोरेट स्टॉक तस्वीरें, AI-संबंधित शीर्षक के बावजूद—लैपटॉप देखती ऑफिस टीम, चमकती स्मृति-दीवार में संयोजित पिता-पुत्र, “Amuse 3.0” के लिए वृद्ध मछुआरे का पोर्ट्रेट विज्ञापन (AMD के स्थानीय छवि जनरेटर का संकेत केवल छोटे लोगो से)। [13, 28, 40, 45]
उल्लेखनीय पिन
  • [1] “AI News: Anthropic Leak Shows Us The Future of AI...” — OpenAI/Google/Microsoft/Anthropic को साथ रखने वाला सामान्य प्रस्तुतकर्ता-थंबनेल प्रारूप; शीर्षक Anthropic लीक का वादा करता है पर छवि में ठोस जानकारी नहीं।
  • [2] “Just Nail It 🎥” — एक व्यक्ति और कार वाले स्रोत वीडियो को लकड़ी-ब्लॉक, ओरिगेमी, Lego और फूल शैली में बदलती 3×5 ग्रिड, “Lumiere” नामक वीडियो मॉडल वॉटरमार्क के साथ; सेट में सबसे स्पष्ट वास्तविक उत्पाद डेमो।
  • [10] “Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API” — क्लोज़्ड-सोर्स Google टूल; गति और नेटिव ऑडियो को अंतरकारी विशेषता बताता है।
  • [14] “Kling.ai AI-Powered Text-to-Video Generation” — क्लोज़्ड-सोर्स चीनी टूल (Kuaishou), पश्चिमी टूलों के साथ “top pick” के रूप में प्रस्तुत।
  • [15] “ByteDance and Hollywood reach global deal on AI copyright” — ByteDance/MPA का वैश्विक समझौता, ByteDance के AI छवि/वीडियो टूलों में IP सुरक्षा मजबूत करने के लिए; सेट की दुर्लभ कानूनी/नीति कहानी।
  • [23] “Google's Gemini Omni Turns Anything Into Video” — Google के Omni मॉडल घोषणा को एजेंसी Osiz Technologies ने पुनर्प्रकाशित किया।
  • [30] “AI news videos blur line between real and fake reports” — बर्फ में गढ़े हुए संवाददाता का NBC News-लेबल “AI GENERATED” क्लिप, भरोसे की समस्या को सीधे दिखाता है।
  • [34] “Google Makes AI Watermarks Optional for Images and...” — शीर्षक संकेत देता है कि Google SynthID/वॉटरमार्क की आवश्यकताएँ ढीली कर रहा है।
  • [35] “4 Major AI Updates You Need to Know in 2026” — GPT-6 Astra, Gemini की एजेंटिक दिशा, Adobe Premiere की टाइमलाइन जनरेटिव मीडिया और Cognition की $48B मूल्यांकन पर $2B फंडिंग वाला इन्फ़ोग्राफ़िक।
  • [43] “Stability AI's Stable Diffusions Maker Can Now Build AI Generative Video” — वीडियो के लिए किसी ओपन-वेट वंश का नाम लेने वाला एकमात्र पिन; केवल Stability AI ब्रांड का उल्लेख, मॉडल या तकनीक का नहीं।
संकेत
  • वर्तमान आपूर्ति मुख्यतः द्वितीयक एग्रीगेशन है—YouTube-थंबनेल समाचार सार, एक जैसे लगभग 12 वीडियो टूल की रैंकिंग वाली एफिलिएट सूचियाँ और इन्फ़ोग्राफ़िक व्याख्याएँ—न कि प्राथमिक घोषणाएँ या व्यावहारिक जनरेशन। हर सूची में चीनी क्लोज़्ड-सोर्स टूल (Kling, Hailuo) पश्चिमी टूलों (Veo, Sora, Runway) के बराबर दिखाई देते हैं। डीपफेक/गलत सूचना की चिंता स्वतंत्र दृश्य श्रेणी के रूप में बार-बार आती है, जो दिखाती है कि टूलों से अधिक भावनात्मक एंगेजमेंट का आधार यही चिंता है।
  • अनुपस्थित पक्ष: Pinterest की सामान्य मूडबोर्ड/रचनात्मक ताकत के बावजूद एक भी पिन ओपन-सोर्स वर्कफ़्लो नहीं दिखाता—न ComfyUI स्क्रीनशॉट, न LoRA/फाइन-ट्यूनिंग, न Flux, SDXL, HunyuanVideo या Wan से संबंध, न कलाकार समुदाय के सौंदर्य बोर्ड। केवल एक पिन ([43]) ने ओपन-सोर्स वंश का नाम लिया, वह भी मॉडल या तकनीक के बजाय ब्रांड स्तर पर। छोटे व्यवसायों और फ्रीलांसरों के “AI वीडियो सेवाएँ” विज्ञापन वास्तविक उत्पाद समाचार से अधिक हैं।
सीमाएँ
  • 50 में से 30 पिन (60%) पढ़े गए; समय के कारण शेष 20 नहीं खुले, इसलिए उल्लेखनीय सामग्री कम प्रतिनिधित्व पा सकती है।
  • पिन तालिका में शैली खंड नहीं हैं; एक खोज के नीचे सपाट सूची होने से इस सार को शैली-दर-शैली विभाजित नहीं किया जा सका।
  • 50 में से 12 पिन का शीर्षक नहीं था (“(untitled)”); कई सामान्य स्टॉक तस्वीरें निकलीं जिनमें AI सामग्री आकस्मिक या अनुपस्थित थी, इसलिए केवल शीर्षक-सूची को संकेत मानना सीमित है।
  • शीर्षक टूटे-फूटे अंग्रेज़ी SEO/एफिलिएट स्पैम की ओर झुके हैं (“AI For Image And video Generation”, “AI black GPT”); छवियाँ इसी पैटर्न की पुष्टि करती हैं, लेकिन कई उल्लेखनीय शीर्षक लिंक किए पिन से अधिक विशिष्टता का वादा करते हैं।

अनुशंसित कार्रवाई

  • X संग्रह चरण को ट्रेंडिंग शब्दों के बजाय स्पष्ट कीवर्ड (Midjourney, Sora 2, Stable Diffusion आदि) से दोबारा चलाएँ
  • Qwen-Image-2.1 और LTX-2.5 जैसे रिलीज़ के तुरंत बाद तेज़ी से इकोसिस्टम बढ़ाने वाले ओपन-वेट परिवारों को प्राथमिकता से देखें
  • AI-जनित सामग्री का बिना खुलासे उपयोग बर्खास्तगी, मुकदमों और नियमन में बदलने वाले मामलों पर लगातार नज़र रखें
  • Sora के हटने के बाद Veo, Kling, Runway और Grok Imagine के शक्ति-संतुलन की नियमित निगरानी करें
  • Bluesky पर आधिकारिक कॉर्पोरेट संचार लगभग निष्क्रिय है, इसलिए व्यक्तिगत रचनाकारों की प्रोफ़ाइल पर केंद्रित शोध करें

एकत्र छवियाँ

AI News: Anthropic Leak Shows Us The Future of AI...Google announces ultra-high quality video...Just Nail It 🎥AI सामग्री और सोशल मीडिया संबंधी चिंताएँअपने विचारों को शानदार दृश्यों में बदलें! 🎥सर्किट बोर्ड में AI चिप, 4k वीडियोकंटेंट मार्केटिंग के लिए AI-जनित वीडियोछवि और वीडियो जनरेशन के लिए AIटेक्स्ट को छवियों में बदलने का AI टूलVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI छवि जनरेशनटेक्स्ट, छवि, संगीत और वीडियो जनरेशन आइकन के साथ AI कंटेंट क्रिएशन अवधारणा – 57 स्टॉक फ़ोटो, वेक्टर और वीडियो देखेंछविKling.ai AI-Powered Text-to-Video GenerationछविछविछविAIन्यूयॉर्क का साहसिक दाँव: विधायी पहल के भीतर...‎🚨 AI डरावने ढंग से अच्छा हो रहा है।छविछविGoogle’s Gemini Omni Turns Anything Into Videoपेशेवर AI वीडियो निर्माण | सिनेमाई AI वीडियो | कस्टम वीडियो संपादनAI News: OpenAI Finally Released What We Asked Forछवि2025 के शीर्ष AI वीडियो जनरेटरछविछविAI समाचार वीडियो वास्तविक और नकली रिपोर्टों की सीमा धुंधली करते हैंAI छवि जनरेशन और मनोरंजन उद्योगछविजनरेटिव AI समझाया गया: एक पूर्ण शुरुआती मार्गदर्शिका (2026)Google छवियों और... के लिए AI वॉटरमार्क वैकल्पिक बनाता है2026 के 4 प्रमुख AI अपडेट जिन्हें आपको जानना चाहिएLuma Dream Machine का परिचय - अगली पीढ़ी का AI वीडियोछविAI समाचार और नवीनतम अपडेट | कृत्रिम बुद्धिमत्ता रुझान और सफलताएँAI-जनित वीडियो: अच्छे या बुरे? सच जानें! 🤖🎥जब AI ने मनुष्यों को अपनी यादें फिर से देखने दींAIवीडियो और AI में महारत: प्रमुख सोशल मीडिया मार्केटिंग रुझान 2025Stability AI’s Stable Diffusions Maker Can Now Build AI Generative Video"ब्रेकिंग न्यूज़ के साथ बने रहने में AI चैटबॉट क्यों विफल होते हैं"AI ब्लैक GPTAI फ़ोटो और वीडियो बेचकर ऑनलाइन पैसे कमाएँ2026 के 22 सर्वश्रेष्ठ और मुफ्त AI वीडियो जनरेटर 🎬🤖 | AI से शानदार वीडियो बनाएँछवि2026 के 12 सर्वश्रेष्ठ AI वीडियो जनरेटर (मुफ्त और भुगतान) | Google Veo, Sora, Runway और अन्यElon Musk का नया AI पहले ही जनरेट करने के लिए इस्तेमाल हो रहा है...

डेटा गुणवत्ता नोट

X में ट्रेंडिंग शब्दों से केवल असंबद्ध पोस्ट मिलीं, इसलिए विषय-संबंधित डेटा व्यावहारिक रूप से शून्य है। Reddit, YouTube, Bluesky और Pinterest भी लगभग 20 आइटम के पूर्णता लक्ष्य तक नहीं पहुँचे। YouTube और Bluesky में तकनीकी बाधाओं (WebFetch अवरोध, खोज API 403) के कारण संग्रह विधि बदली गई।

गैलरी