छवि और वीडियो जनरेशन AI समाचार — 2026-09-08
क्लोज़्ड-सोर्स पक्ष में एक नई श्रेणी—जिसमें डिफ्यूज़न मॉडल के बजाय LLM एजेंट (GPT-6 Astra) GUI टूल और Blender को संचालित करके चित्र और 3D वीडियो बनाते हैं—Reddit, X और Bluesky पर स्वतंत्र रूप से चर्चा में रही। दूसरी ओर, ओपन-सोर्स गतिविधियां Lemmy के ComfyUI समुदाय और YouTube के परीक्षण चैनलों में केंद्रित रहीं; Bluesky, Pinterest, Reddit और X पर वे लगभग दिखाई नहीं दीं।
छवि और वीडियो जनरेशन AI समाचार — 2026-09-08
छह प्लेटफ़ॉर्मों में किए गए इस सर्वेक्षण का सबसे प्रमुख निष्कर्ष यह था कि क्लोज़्ड-सोर्स पक्ष में एक नई श्रेणी—"डिफ्यूज़न मॉडल नहीं, बल्कि LLM एजेंट (GPT-6 Astra) GUI टूल या Blender को सीधे चलाकर चित्र और 3D वीडियो बनाते हैं"—तीन प्लेटफ़ॉर्मों पर स्वतंत्र रूप से चर्चा का विषय बनी। ओपन-सोर्स पक्ष कुल मिलाकर अपेक्षाकृत कम दिखाई दिया, लेकिन Lemmy के !stable_diffusion समुदाय में MiniMax H3 वीडियो मॉडलों के लिए ComfyUI को तेज़ करने वाले 5–6 नोड एक ही सप्ताह में लगातार जारी हुए। YouTube पर Flux.2/Flux 2 Klein और Qwen-Image के बीच बढ़त की प्रतिस्पर्धा की लगातार जांच हो रही है, जिससे डेवलपर समुदाय में सक्रियता स्पष्ट है। Pinterest और Reddit/X की अधिकांश पोस्ट क्लोज़्ड-सोर्स उत्पाद नामों—Midjourney, Sora, Veo, Runway, Kling, Nano Banana, Seedream आदि—पर केंद्रित थीं; ओपन-सोर्स के विशिष्ट नाम लगभग नहीं दिखे। कुल मिलाकर, तकनीकी रुझानों से अधिक "यह AI है या नहीं" वाली प्रामाणिकता की बहस और "AI एजेंट मानव भूमिकाएं व काम संभाल रहे हैं" वाला सामाजिक प्रभाव Reddit और Pinterest पर प्रमुख रहा।
सभी प्लेटफ़ॉर्मों में
- GPT-6 Astra की एजेंट-आधारित विज़ुअल जनरेशन तीन प्लेटफ़ॉर्मों पर स्वतंत्र रूप से चर्चा में रही: Astra द्वारा Blender चलाकर रेंडर बनाने का मामला Reddit (r/DefendingAIArt) और Bluesky (@simonwillison.net) दोनों पर अलग-अलग उठाया गया। Astra से 3D शहर बनाने के डेमो ने X (@synabreu, @GulatiYajat) पर नकल की श्रृंखला पैदा की। "डिफ्यूज़न मॉडल का विकास" नहीं, बल्कि "LLM एजेंट मौजूदा टूलों का इस्तेमाल कर चित्र और 3D बनाते हैं" वाला यह नया दृष्टिकोण सर्वेक्षण का सबसे बड़ा साझा विषय था।
- वीडियो जनरेशन में चरित्र और दृश्य की निरंतरता अभी भी अनसुलझी है—इस पर राय बंटी हुई है: Reddit (r/generativeAI, r/aivideomaking) और X—Seedance 2.5 की प्रशंसा करने वाले @atlas_remake तथा जटिल दृश्यों में टूटन बताने वाले @Aiden_Tech_Ai—दोनों पर इसी मुद्दे के पक्ष और विपक्ष में पोस्ट लगभग एक ही समय पर आईं।
- ओपन-सोर्स की उपस्थिति प्लेटफ़ॉर्म के अनुसार बहुत असमान है: Lemmy का
!stable_diffusionMiniMax H3 के लिए ComfyUI नोड—ComfyUI-Ref2VA-VSA समेत—लगातार जारी होने जितना सक्रिय है, और YouTube पर Qwen-Image, FLUX और Wan 2.2 के तुलना-परीक्षण लगातार आ रहे हैं। इसके विपरीत Bluesky, Pinterest, Reddit और X पर Stable Diffusion के नए संस्करण, FLUX, Wan या HunyuanVideo जैसे ओपन-सोर्स मॉडल नामों वाली पोस्ट लगभग नहीं मिलीं। यह स्पष्ट नहीं है कि ओपन-सोर्स चर्चा में नहीं था या क्लोज़्ड-सोर्स-केंद्रित खोज शब्दों के कारण छूट गया; कई प्लेटफ़ॉर्मों की Limits में यही संरचनात्मक कमजोरी दर्ज है। - प्रामाणिकता विवाद और सामाजिक प्रभाव तकनीकी रुझानों के साथ-साथ चल रहे हैं: असली या जनरेटेड होने पर विभाजित राय वाली पोस्ट—Reddit r/isthisAI, r/pj_explained बनाम r/NewRockstars की Thor फुटेज—AI चित्रों को स्वचालित रूप से लेबल करने वाला Bluesky का aimod.social, न्यूयॉर्क गवर्नर चुनाव का फेक वीडियो (Bluesky/404media), और Pinterest के "FAKE" स्टैंप वाले थंबनेल—कई प्लेटफ़ॉर्मों पर "बनाने" से अधिक "पहचानने और संदेह करने" की दिशा को दिखाते हैं।
प्लेटफ़ॉर्म के अनुसार
Reddit में 12 थ्रेडों में छवि/वीडियो AI-विशेष सबरेडिट—r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI—की तुलना में AI-विवाद और प्रामाणिकता-जांच वाले सबरेडिट—r/antiai, r/aiwars, r/DefendingAIArt, r/isthisAI, r/pj_explained, r/NewRockstars—में अधिक एंगेजमेंट था। एक ही खोज शब्द इस्तेमाल होने के कारण क्लोज़्ड और ओपन-सोर्स का सार्थक तुलनात्मक विश्लेषण लगभग संभव नहीं हुआ।
X पर NVIDIA के Sol-H3—रीयल-टाइम प्लेबैक से तेज़ वीडियो इन्फ़रेंस—की घोषणा, उसका स्थानीय स्तर पर व्यक्तिगत पुनर्निर्माण, और GPT-6 Astra से 3D शहर जनरेशन की नकल-श्रृंखला मुख्य विषय रहे। 40 में केवल सीमित पोस्ट ही सीधे छवि/वीडियो जनरेशन AI से संबद्ध थीं; क्रोएशिया क्षेत्र के Explore ट्रेंड के मिश्रण से कई असंबद्ध पोस्ट शामिल हो गईं।
YouTube पर JavaScript रेंडरिंग के कारण व्यू और चैनल सब्सक्राइबर संख्या नहीं मिल सकी, लेकिन क्लोज़्ड-सोर्स—Midjourney V8.2, Grok Imagine, Google Gemini "Omni"—और ओपन-सोर्स—Qwen-Image-2.0, FLUX, Wan 2.2—दोनों पर तुलना व व्याख्या करने वाले चैनल मिले। छह प्लेटफ़ॉर्मों में यह क्लोज़्ड/ओपन तुलना के लिए सबसे उपयुक्त स्रोत था।
Bluesky पर खोज API (app.bsky.feed.searchPosts) लगातार 403 लौटाता रहा, इसलिए ज्ञात खातों—@simonwillison.net, @404media.co आदि—की फीड अलग-अलग देखनी पड़ी। इस कारण "20 पोस्ट का विश्लेषण" पूरा करने का मानदंड हासिल नहीं हुआ। ओपन-सोर्स की ठोस पोस्ट केवल Qwen 3.7 27B के स्थानीय निष्पादन की एक रिपोर्ट थी।
Lemmy में Midjourney के चिकित्सा अल्ट्रासाउंड स्कैनर दिशा-परिवर्तन विवाद (!techtakes) ने एकल विषय के रूप में सबसे अधिक चर्चा पाई। ओपन-सोर्स पक्ष पर MiniMax H3 के लिए ComfyUI नोडों के लगातार रिलीज़ और Qwen-Image-Bench पर LLaDA-Image तथा Boogu-Image-0.1 जैसी बेंचमार्क प्रतिस्पर्धा के रूप में छह प्लेटफ़ॉर्मों में सर्वाधिक ठोस प्राथमिक जानकारी मिली।
Pinterest में पहले से एकत्र 50 में से 30 पिन देखे गए। बिना श्रेणी-विभाजन वाले एकल क्वेरी की वजह से क्लोज़्ड-सोर्स उत्पादों की तुलना और हाउ-टू इन्फ़ोग्राफ़िक का बहुमत था; ओपन-सोर्स मॉडल या प्रोजेक्ट नाम एक भी नहीं मिला। पोस्ट समय और एंगेजमेंट संख्या manifest में नहीं थी, इसलिए ताजगी का आकलन नहीं हो सका।
किन बातों पर नज़र रखें
- MiniMax H3 / Sol-H3 की रीयल-टाइम से तेज़ वीडियो इन्फ़रेंस और ComfyUI ऑप्टिमाइज़ेशन नोडों की बाढ़ — X (@xieenze_jr) / Lemmy (ComfyUI-Ref2VA-VSA आदि)। क्लाउड घोषणा और ओपन-वेट पुनर्निर्माण के बीच अंतर कितना कम होता है।
- GPT-6 Astra की एजेंट-आधारित विज़ुअल जनरेशन का विस्तार — Reddit (r/DefendingAIArt) / Bluesky (@simonwillison.net) / X (@synabreu)। नकल और अपनाने का विस्तार कितना होता है।
- FLUX.2/Flux 2 Klein बनाम Qwen-Image में ओपन-सोर्स बढ़त की प्रतिस्पर्धा — YouTube (SECourses, Urban Decoders)। 700 से अधिक परीक्षणों के नतीजे भविष्य के अपनाने को कैसे प्रभावित करते हैं।
- Midjourney के चिकित्सा उपकरण दिशा-परिवर्तन (Midjourney Medical) विवाद की अगली जानकारी — Lemmy (pivot-to-ai.com के माध्यम से)। छवि जनरेशन कंपनी का पिवट मज़ाक साबित होता है या लागू होता है।
- राजनीतिक विज्ञापनों में AI वीडियो के दुरुपयोग—न्यूयॉर्क गवर्नर चुनाव—के असर — Bluesky (404media.co)। क्या नियामक और प्लेटफ़ॉर्म प्रतिक्रिया देंगे।
- वीडियो जनरेशन में चरित्र/दृश्य निरंतरता की समस्या में प्रगति — Reddit (r/generativeAI) / X (@Aiden_Tech_Ai)। क्या ऑल-इन-वन टूल वास्तव में समाधान के निकट हैं।
सिफारिशें
- GPT-6 Astra की एजेंट-आधारित विज़ुअल जनरेशन—Blender नियंत्रण और 3D शहर जनरेशन—को अगली रिपोर्टों में अलग ट्रैकिंग विषय के रूप में लगातार देखें।
- ओपन-सोर्स घोषणाएं न छूटें, इसके लिए अगली बार सभी प्लेटफ़ॉर्मों पर "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" और "ComfyUI" जैसे विशिष्ट नामों को खोज शब्दों में जोड़ें।
- Bluesky सर्वेक्षण में खोज API के 403 जारी रहने की संभावना मानकर पहले से निगरानी खातों की सूची बढ़ाएं।
- Pinterest पर पोस्ट समय और एंगेजमेंट संख्या उपलब्ध नहीं हैं; इसलिए इसे ताज़ा ब्रेकिंग तुलना के बजाय टूल जागरूकता के स्थिर अवलोकन तक सीमित रखें।
- Midjourney चिकित्सा उपकरण दिशा-परिवर्तन विवाद की सत्यता और वास्तविक स्थिति अनिश्चित है; Midjourney की आधिकारिक प्राथमिक घोषणा तक निर्णायक उद्धरण से बचें।
- Lemmy के
!stable_diffusionऔर YouTube के परीक्षण-केंद्रित चैनलों को ओपन-सोर्स रुझान देखने के प्रमुख स्रोतों के रूप में प्राथमिकता दें।
डेटा गुणवत्ता
Bluesky—खोज API लगातार 403, केवल व्यक्तिगत खाता जाँच, 20 पोस्ट के मानदंड तक न पहुंचना—और Pinterest—manifest में पोस्ट समय व एंगेजमेंट नहीं, ताजगी अज्ञात, एकल क्वेरी में ओपन-सोर्स उल्लेख नहीं—में सूचना सबसे कम थी। Reddit और X पर केवल एक खोज शब्द, अर्थात ब्रीफ़ का शीर्षक, इस्तेमाल हुआ; इसलिए क्लोज़्ड और ओपन-सोर्स को स्पष्ट रूप से तुलना करने वाली पोस्ट जानबूझकर एकत्र नहीं की गईं। परिणामस्वरूप ओपन-सोर्स चर्चा Lemmy और YouTube में केंद्रित रही। YouTube में JavaScript रेंडरिंग के कारण व्यू और चैनल सब्सक्राइबर संख्या उपलब्ध नहीं हुई।
प्लेटफ़ॉर्म-वार सारांश
Reddit — छवि और वीडियो जनरेशन AI समाचार
चर्चा के प्रमुख स्थान (सबरेडिट)
एकत्रित 12 थ्रेड अलग-अलग सबरेडिट से एक-एक करके लिए गए। छवि और वीडियो जनरेशन AI के विशेष समुदाय कम थे; फिल्म/फेक-जांच और AI सांस्कृतिक विवाद वाले सबरेडिट अधिक प्रमुख रहे।
| सबरेडिट | सदस्य संख्या | एकत्रित थ्रेड संख्या |
|---|---|---|
| r/whenthe | 813,975 | 1 |
| r/isthisAI | 406,607 | 1 |
| r/antiai | 317,903 | 1 |
| r/aiwars | 167,158 | 1 |
| r/generativeAI | 151,385 | 1 |
| r/RemoteWorkers | 75,332 | 1 |
| r/DefendingAIArt | 72,770 | 1 |
| r/pj_explained | 96,256 | 1 |
| r/NewRockstars | 15,523 | 1 |
| r/freetoolsAI | 7,887 | 1 |
| r/aivideomaking | 6,517 | 1 |
| r/GoogleFlow | 1,789 | 1 |
खोज शब्द केवल "Image and Video Generation AI News" था। नतीजे छवि/वीडियो AI के विशेष सबरेडिट—r/generativeAI, r/aivideomaking, r/GoogleFlow, r/freetoolsAI—से ज्यादा AI पक्ष-विपक्ष विवाद—r/antiai, r/aiwars, r/DefendingAIArt—और "क्या यह AI है?" जांच—r/isthisAI, r/pj_explained, r/NewRockstars, r/whenthe—की ओर झुके।
लोगों की प्रतिक्रियाएं
- GPT-6 माउस से चित्र को "हाथ से बना" दिखा सकता है और टाइमलैप्स भी नकली बना सकता है (थ्रेड 2, r/antiai, 7,013pt・1,009 टिप्पणियां, 2026-09-05, https://www.reddit.com/r/antiai/comments/1w81kdd/)। डिफ्यूज़न मॉडल की बजाय LLM (GPT-6) को माउस और कीबोर्ड नियंत्रण देकर डिजिटल ड्रॉइंग सॉफ़्टवेयर में चित्र बनवाने और "असली" जैसा टाइमलैप्स उत्पन्न करने वाली पोस्ट। शीर्ष टिप्पणी में u/Nayutantantan (2,507pt) ने कहा कि अब रिकॉर्ड के लिए टाइमलैप्स बनाने की भी हिम्मत नहीं बची।
- GPT-6 "Astra" ने Blender में फोटो-रियलिस्टिक रेंडर बनाया (थ्रेड 9, r/DefendingAIArt, 143pt・13 टिप्पणियां, 2026-09-06, https://www.reddit.com/r/DefendingAIArt/comments/1w970uy/)। चर्चा इस बात पर थी कि AI ने वीडियो सीधे जनरेट नहीं किया, बल्कि एजेंट ने Blender को चलाकर रेंडर बनाया। u/TheMaliciousSquid: "GPT-6 विज़ुअल काम में सबसे मजबूत हो सकता है; देखना होगा कि क्या यह कोडिंग में Claude को भी पीछे छोड़ता है।"
- Google Flow एक्सटेंशन "AutoFlow" में लगातार वीडियो जनरेशन समर्थन (थ्रेड 12, r/GoogleFlow, 12pt・6 टिप्पणियां, 2026-09-01, https://www.reddit.com/r/GoogleFlow/comments/1w4eeyp/)। "Continue from Last Frame" फीचर पिछले क्लिप का अंतिम फ्रेम अगले क्लिप के पहले फ्रेम में अपने-आप ले जाता है; कई जनरेशन की कतार और रेफ़रेंस छवियां भी प्रबंधित हो सकती हैं। आगे क्लिप को निर्बाध रूप से एक करने की सुविधा की घोषणा है।
- "मुफ़्त AI छवि जनरेशन टूल" के प्रचार में मजबूत मांग (थ्रेड 3, r/freetoolsAI, 39pt・48 टिप्पणियां, 2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/)। मुफ़्त, असीमित और बिना साइन-अप सेवा के परिचय पर टिप्पणियां आईं। u/Puzzleheaded_Lab4757 ने कहा कि इससे सैकड़ों डॉलर और घंटों की बचत हुई, जबकि u/thecragmire ने संचालन लागत और टिकाऊपन पर सवाल उठाया।
- AI वीडियो में लंबाई और चरित्र निरंतरता सबसे बड़ी बाधा (थ्रेड 10, r/generativeAI, 4pt・15 टिप्पणियां, 2026-09-07, https://www.reddit.com/r/generativeAI/comments/1w9klb7/)। 2–4 मिनट की साइंस-फिक्शन सिनेमैटिक वीडियो बनाना चाहने वाले पोस्टर को u/Missy_Desu ने सलाह दी: GPT Image 2 से फ्रेम बनाएं, Seedance 2.5 से वीडियो करें, और अंतिम एक मिनट पर लगभग $100 खर्च मानें। u/KissinglyPolished ने कहा कि स्थिर चित्र से वीडियो में जाते समय चरित्र निरंतरता बनाए रखना बेहद कठिन है और ऑल-इन-वन टूल अभी इसे हल नहीं कर पाए हैं।
- मुफ़्त और हल्के हार्डवेयर पर वीडियो जनरेशन अब भी अव्यावहारिक (थ्रेड 8, r/aivideomaking, 6pt・15 टिप्पणियां, 2026-09-07, https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/)। केवल फ़ोन और iPad से 45 सेकंड का मुफ़्त AI वीडियो बनाने की इच्छा पर u/NewLifeWares ने कहा कि 45 सेकंड डेटा-सेंटर स्तर की मांग है; मुफ़्त में अधिकतम 5 सेकंड और वॉटरमार्क मिलेंगे, जिन्हें जोड़ना होगा।
- खाद्य विज्ञापनों के AI चित्रों को अब भी "अनाकर्षक" कहा गया (थ्रेड 4, r/aiwars, 4pt・177 टिप्पणियां, 2026-09-03, https://www.reddit.com/r/aiwars/comments/1w69cdj/)। कंपनियों द्वारा विज्ञापनों में AI-जनरेटेड भोजन चित्र इस्तेमाल करने पर प्रश्न उठे। u/LCI_Jake ने इसे जानबूझकर बनाई गई भद्दी छवि बताया, जबकि u/Bassed_Hummble ने स्थानीय Krea 2 पर 40 सेकंड जनरेशन का उदाहरण देकर कहा कि अच्छे प्रॉम्प्ट से नतीजे सुधर सकते हैं।
- AI कैप्शन मूल्यांकन की वर्क-फ्रॉम-होम नौकरी पर प्रतिक्रियाओं की बाढ़ (थ्रेड 5, r/RemoteWorkers, 152pt・739 टिप्पणियां, 2026-09-04, https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/)। गलत पहचानी वस्तु, रंग और टेक्स्ट जैसी AI-जनरेटेड कैप्शन त्रुटियों को $30 प्रति घंटे पर जांचने की नौकरी। अधिकांश टिप्पणियां आवेदन लिंक मांगने वाली थीं; विषय पर चर्चा सीमित रही।
- "बहुत असली लगने वाले AI वीडियो" पर वास्तविकता-विवाद की दो घटनाएं (थ्रेड 1/6, r/NewRockstars और r/pj_explained, एक ही पोस्ट का पुनर्प्रसार, 2026-09-02)। Thor के खंभे से टकराने की लीक फुटेज को CGI, AI नहीं, बताने वाली पोस्ट का r/pj_explained में शीर्ष टिप्पणी u/ceaserisnothome ने विरोध किया: विस्फोट का पूर्ण वृत्त में फैलना AI का प्रमाण है। एक ही वीडियो के बारे में निर्णय बंटा हुआ है।
- खिड़की के भीतर दिखाई देती लहरें: AI या असली वीडियो? (थ्रेड 7, r/isthisAI, 0pt・79 टिप्पणियां, 2026-09-07, https://www.reddit.com/r/isthisAI/comments/1w9cyub/)। पोस्टर ने खिड़की तोड़े बिना पानी के भीतर आने की अस्वाभाविकता बताई। u/RioReiser85 ने इसे परिप्रेक्ष्य की गलतफहमी और असली वीडियो कहा, जबकि u/bulbousEd ने जहाज़ के आगे की झाग को भौतिक रूप से असंभव बताकर AI कहा।
संकेत
- जो बढ़ रहा है: AI के "AI जैसा न दिखने" को लेकर सतर्कता। थ्रेड 2—7,013pt और 1,009 टिप्पणियां—से स्पष्ट है कि LLM द्वारा GUI टूलों का सीधा नियंत्रण और "हाथ से बनाने के प्रमाण" तक की नकल को लेकर गहरी चिंता है।
- जिसे हल्के में लिया या खारिज किया जा रहा है: "मुफ़्त में लंबा और उच्च-गुणवत्ता वीडियो" बनाने की मांग को समुदाय ने बार-बार नकारा है (थ्रेड 8, 10)। हार्डवेयर और लागत सीमाएं अब भी कठोर हैं—यह Reddit की साझा समझ है।
- आश्चर्यजनक पहलू: जनरेशन AI के "विशेष" सबरेडिट की तुलना में प्रामाणिकता-जांच और AI-विवाद समुदायों में बातचीत की तीव्रता और एंगेजमेंट दोनों अधिक थे। Reddit पर AI छवि/वीडियो "समाचार" अब मॉडल सुधार से ज्यादा "यह AI है या नहीं" वाली सामाजिक खींचतान के रूप में चर्चा में है।
- विरोधी संकेत: Thor टकराव वाली एक ही लीक फुटेज पर r/NewRockstars और r/pj_explained में "AI नहीं" तथा "AI है" के बिल्कुल विपरीत निष्कर्ष हैं। थ्रेड 7 में भी असली वीडियो और AI समर्थक बराबरी पर हैं, जिससे दिखता है कि आम उपयोगकर्ता का दृश्य-आधारित निर्णय अब भरोसेमंद नहीं रहा।
सीमाएं
- खोज केवल "Image and Video Generation AI News" तक सीमित रही; अन्य शब्द—जैसे "Stable Diffusion", "Midjourney", "Sora", "Kling", "ओपन-सोर्स इमेज जनरेशन"—नहीं खोजे गए। इसलिए क्लोज़्ड-सोर्स और ओपन-सोर्स की स्पष्ट तुलना वाली पोस्ट लगभग एकत्र नहीं हुईं।
- 12 थ्रेड 12 अलग सबरेडिट से केवल एक-एक हैं; किसी एक समुदाय में उसी विषय के कई थ्रेड की गहराई से तुलना नहीं हो सकी।
- थ्रेड 9 और 11 में मुख्य पाठ खाली था; केवल शीर्षक और टिप्पणियां थीं, इसलिए प्राथमिक संदर्भ सीमित है।
- थ्रेड 1 और 6 मूलतः एक ही पोस्ट के अलग सबरेडिट पुनर्प्रकाशन हैं; उन्हें दो स्वतंत्र घटनाएं मानने पर वास्तविक नमूना आकार लगभग 11 हो जाता है।
- ब्राउज़र संग्रह की प्रकृति के कारण इस run में Reddit पर अतिरिक्त खोज, दूसरे शब्दों से पुनः खोज, या पूरे कमेंट थ्रेड खोलना नहीं किया गया।
X
X — छवि और वीडियो जनरेशन AI समाचार
खाते
एकत्रित 40 पोस्ट 37 खातों से थीं। अधिकांश "एक पोस्ट से वायरल/गुम" प्रकार की थीं। छवि और वीडियो जनरेशन AI से संबद्ध खाते में केवल @yu_ichi_suzuki (鈴木憂一) ने कई पोस्ट का थ्रेड बनाया।
| खाता | पोस्ट संख्या | रुझान |
|---|---|---|
| @yu_ichi_suzuki(鈴木憂一) | 2 | स्थानीय RTX 5090 पर MiniMax H3 चलाने वाला तकनीकी थ्रेड (कुल 309 लाइक); एकल वायरल पोस्ट की बजाय प्रक्रिया-व्याख्या |
| @xieenze_jr(Enze Xie) | 1 | MiniMax शोधकर्ता की नई मॉडल घोषणा (349 लाइक, लगभग 85,000 व्यू) |
| @voxelphotonics | 1 | Duke Nukem 3D का वॉल्यूमेट्रिक डिस्प्ले डेमो; 6,097 लाइक और लगभग 297,000 व्यू के साथ वायरल |
| @synabreu | 1 | GPT-6 Astra से सियोल का 3D शहर मॉडल; 2,700 लाइक और लगभग 235,000 व्यू |
| @GulatiYajat(Yajat Gulati) | 1 | GPT-6 Astra से गुरुग्राम का 3D शहर; 574 लाइक |
| @luccacerf | 1 | Blender MCP + Astra + Tripo डेमो; 445 लाइक |
| @He1s_Sammy | 1 | "चेहरा दिखाए बिना AI बच्चों के वीडियो" के व्यवसाय बनने पर लंबा थ्रेड; 388 लाइक |
| @SD_Tutorial(Stable Diffusion Tutorials) | 1 | Sol-H3 तकनीकी व्याख्या; 22 लाइक के साथ सीमित प्रतिक्रिया |
| @Strength04_X, @atlas_remake, @Aiden_Tech_Ai, @alphafox | प्रत्येक 1 | Seedance 2.5 और AI वीडियो की गुणवत्ता/सीमाओं पर छोटे-मध्यम खातों की चर्चा |
@xieenze_jr को छोड़कर ये डेवलपर नहीं, बल्कि "इसे आज़माया/बनाया" प्रकार के उपयोगकर्ता हैं। चर्चा को बड़े वायरल पोस्ट—@voxelphotonics, @synabreu—और तकनीकी व्यक्तियों की प्रक्रिया-साझाकरण पोस्ट—@yu_ichi_suzuki, @SD_Tutorial—का दो-स्तरीय ढांचा आगे बढ़ा रहा है।
पोस्ट
- MiniMax ने रीयल-टाइम प्लेबैक से तेज़ वीडियो जनरेशन "Sol-H3" जारी किया (#2 @xieenze_jr, 349 लाइक・62 रीपोस्ट・23 रिप्लाई・लगभग 85,000 व्यू, 2026-09-07, https://x.com/xieenze_jr/status/2097000082927399012)। 8× NVIDIA B300 Blackwell पर 1344×768 वीडियो के पांच सेकंड को 1.653 सेकंड में जनरेट करने की घोषणा। यह X Explore के नंबर-एक ट्रेंड "NVIDIA Speeds Up AI Video Generation Past Real-Time Playback" का मूल पोस्ट था।
- उपरोक्त तकनीकी व्याख्या फैली (#3 @SD_Tutorial, 22 लाइक・लगभग 2,100 व्यू, 2026-09-07, https://x.com/SD_Tutorial/status/2097061880175141224)। इसे NVIDIA Research द्वारा विकसित उच्च-प्रदर्शन वीडियो इन्फ़रेंस स्टैक बताया गया जो MiniMax-H3 को रीयल-टाइम से तेज़ चलाता है और nvlabs.github.io के Sol-Engine/Sol-H3 पृष्ठ से जोड़ा गया। गैर-आधिकारिक तकनीकी खाते भी तुरंत पीछे आए।
- स्थानीय RTX 5090 पर MiniMax H3 चलाने की प्रक्रिया प्रकाशित (#4–5 @yu_ichi_suzuki, 295+14 लाइक・लगभग 18,000+1,100 व्यू, 2026-09-07, https://x.com/yu_ichi_suzuki/status/2096819288997065192)। स्थानीय MiniMax H3 से लगभग नौ मिनट में 15 सेकंड का 2K से अधिक वीडियो बनाने, Alibaba distillation LoRA से 480p चयन और RTX Video Super Resolution से 2688×1536 तक अपस्केल करने की कार्यप्रणाली GitHub नोट्स के साथ साझा की गई। यह क्लाउड घोषणा के मुकाबले ओपन-वेट को व्यक्तिगत रूप से चलाने वाली गतिविधि है।
- Seedance 2.5 से फैशन वीडियो जनरेट (#1 @Strength04_X, 68 लाइक・2 रीपोस्ट・35 रिप्लाई・लगभग 7,700 व्यू, 2026-09-06, https://x.com/Strength04_X/status/2096441159887274302)। "Seedance 2.5 on Dreamina_ai" से 30 सेकंड का फोटो-रियल सिनेमैटिक फैशन-ट्रैवल म्यूजिक वीडियो बनाया गया; पूरा प्रॉम्प्ट शामिल है।
- Seedance 2.5 से Toy Story-जैसी दुनिया जनरेट (#14 @atlas_remake, 3 लाइक・लगभग 133 व्यू, 2026-09-07, https://x.com/atlas_remake/status/2096847522602139995)। कई एनिमेटेड चरित्रों और वस्तुओं को संभालने की Seedance 2.5 क्षमता की सकारात्मक समीक्षा।
- "AI वीडियो अब भी स्लॉट मशीन है"—समस्याओं की ओर इशारा (#12 @Aiden_Tech_Ai, 1 लाइक・2 रीपोस्ट・4 रिप्लाई・लगभग 494 व्यू, 2026-09-07, https://x.com/Aiden_Tech_Ai/status/2097020441470836791)। अनेक स्थानों, कैमरा मूवमेंट, चरित्र ब्लॉकिंग और निरंतरता वाले जटिल दृश्य में कमजोरी बताई गई। एंगेजमेंट कम है, लेकिन #5 के आशावादी दृष्टिकोण का प्रतिवाद है।
- Duke Nukem 3D को वॉल्यूमेट्रिक 3D डिस्प्ले पर फिर बनाया गया (#10 @voxelphotonics, 6,097 लाइक・921 रीपोस्ट・130 रिप्लाई・लगभग 297,000 व्यू, 2026-09-07, https://x.com/voxelphotonics/status/2096833425043005562)। अवधि की सबसे अधिक एंगेजमेंट वाली पोस्टों में एक। यह सीधे जनरेशन AI नहीं बल्कि रेंडरिंग/डिस्प्ले तकनीक डेमो है, लेकिन Explore ट्रेंड नंबर 3 का प्रमुख कारण बना।
- GPT-6 "Astra" से पूरा सियोल 3D शहर में बदला (#20 @synabreu, 2,700 लाइक・451 रीपोस्ट・81 रिप्लाई・लगभग 235,000 व्यू, 2026-09-06, https://x.com/synabreu/status/2096557555086725159)। संवादात्मक 3D जनरेशन के प्रयोग के रूप में बहुत फैला।
- उसी तरह GPT-6 Astra से गुरुग्राम का 3D शहर (#22 @GulatiYajat, 574 लाइक・28 रीपोस्ट・53 रिप्लाई・लगभग 46,000 व्यू, 2026-09-06, https://x.com/GulatiYajat/status/2096659142534676684)। #8 से प्रेरित होकर प्रयोग करने वाले उपयोगकर्ता का प्रत्यक्ष उदाहरण; साइट gurgaon-3d-atlas.cratorlabs-2435.chatgpt.site भी जारी की गई।
- Blender MCP + Astra + Tripo संयोजन डेमो (#21 @luccacerf, 445 लाइक・20 रीपोस्ट・11 रिप्लाई・लगभग 31,000 व्यू, 2026-09-07, https://x.com/luccacerf/status/2097047098281672782)। MCP के माध्यम से अनेक AI टूलों को जोड़ने का उदाहरण।
- "चेहरा दिखाए बिना AI बच्चों के वीडियो" कंटेंट व्यवसाय बन रहा है (#23 @He1s_Sammy, 388 लाइक・96 रीपोस्ट・17 रिप्लाई・लगभग 19,000 व्यू, 2026-09-06, https://x.com/He1s_Sammy/status/2096492880017736056)। फ़ोन, लैपटॉप या iPad से प्रयोग शुरू करने की बात करते हुए AI वीडियो से साइड-बिज़नेस और कमाई की पोस्ट फैली।
संकेत
- जो बढ़ रहा है: बातचीत वाले एजेंट से 3D दुनिया बनवाने की गतिविधि—GPT-6 Astra से शहर और Blender MCP एकीकरण—ने सर्वाधिक अनुकरण पैदा किया। #8 देखकर #9 के GulatiYajat ने स्पष्ट रूप से कहा कि सबको डेमो बनाते देख उन्होंने भी आज़माया; यह केवल एक समाचार नहीं, नकल की श्रृंखला है।
- जो बढ़ रहा है (दूसरा): रीयल-टाइम से तेज़ वीडियो इन्फ़रेंस—Sol-H3—और स्थानीय GPU पर उसका व्यक्तिगत उपयोग लगभग साथ-साथ दिखे। क्लोज़्ड-सोर्स घोषणा और ओपन-वेट फॉलो-अप X पर बिना समय अंतराल के समानांतर चले।
- जिसे कम आंका जा रहा है या जिस पर मतभेद हैं: अनेक चरित्र और स्थानों वाली AI वीडियो की निरंतरता पर प्रशंसा और असंतोष दोनों एक ही अवधि में आए; X पर निर्णय अब भी तय नहीं है।
- आश्चर्यजनक पहलू: इस run में मिले 40 पोस्टों का स्रोत बने Explore के 9 ट्रेंडों में केवल शीर्ष 3 ही सीधे छवि/वीडियो AI से जुड़े थे। शेष—Croatian, Building, $song, Harvey, Ukrainian, Democrats—इस सेशन में सर्वर को दिख रहे स्थानीय ट्रेंड थे और विषय से असंबद्ध। फिर भी "Building" खोज से Astra के 3D शहर डेमो जैसे उपयोगी परिणाम मिले।
- VTuber Veibae मामला: Explore के दूसरे नंबर ट्रेंड "VTuber Veibae Teases Return with Sunflower Farm Animation" को खोजने पर केवल असंबंधित उत्तर अमेरिकी बॉक्स ऑफिस सारांश खातों की प्रतिलिपि पोस्ट मिलीं। Veibae या एनीमेशन निर्माण से जुड़ी कोई पोस्ट नहीं मिली।
सीमाएं
- शीर्ष तीन Explore ट्रेंडों में "VTuber Veibae Teases Return with Sunflower Farm Animation" संभवतः छवि/वीडियो जनरेशन AI से संबद्ध हो सकता था, लेकिन संबंधित पोस्ट नहीं मिलीं। इस संग्रह से यह सत्यापित नहीं है कि Veibae के एनीमेशन में AI इस्तेमाल हुआ था या नहीं।
- शेष छह Explore ट्रेंड मुख्यतः विषय से असंबंधित स्थानीय या समसामयिक ट्रेंड थे। उनसे आई 40 में 29 पोस्ट रिपोर्ट से बाहर रखी गईं।
- खोज केवल ट्रेंड शीर्षक के शब्दों तक सीमित थी; "Stable Diffusion", "Midjourney", "Sora", "Kling" और "ComfyUI" जैसे विशिष्ट नाम नहीं खोजे गए। अतः क्लोज़्ड और ओपन-सोर्स की स्पष्ट तुलना वाली पोस्ट लगभग नहीं मिलीं।
- Explore इस सेशन के सर्वर स्थान—संभवतः क्रोएशिया क्षेत्र—से भौगोलिक रूप से संबद्ध था और पूरे X का प्रतिनिधि नहीं है।
- संग्रह 40 पोस्ट पर रोक दिया गया; उसी खाते की अन्य पोस्ट, रिप्लाई और हैशटैग खोज की आगे जांच इस run में नहीं हुई।
YouTube
YouTube — छवि और वीडियो जनरेशन AI के नवीनतम रुझान
चैनल
- 動画編集の中の人(चैनल)— छवि जनरेशन AI के व्यावहारिक तुलना वीडियो बड़ी संख्या में प्रकाशित करता है।
- AI大学【AI&ChatGPT最新情報】(चैनल)— जनरेटिव AI टूलों की मासिक संक्षिप्त वीडियो इसका मुख्य प्रारूप है।
- 【さき】のAIでええやん。(चैनल)— Google I/O और Gemini अपडेट की व्याख्या।
- Qwen(公式)(चैनल)— Qwen-Image श्रृंखला की आधिकारिक घोषणा वीडियो।
- AIOnTrend(चैनल)— ओपन-सोर्स छवि मॉडलों की समानांतर तुलना।
- Urban Decoders(चैनल)— Flux मॉडलों की आर्किटेक्चर व्याख्या।
- SECourses(चैनल)— स्थानीय छवि जनरेशन का बड़े पैमाने पर परीक्षण, जैसे 700+ टेस्ट।
- Woollyfern(चैनल)— Midjourney के मासिक अपडेट का सतत अवलोकन चैनल।
- 寺田部チャンネル(चैनल)— ComfyUI के साथ स्थानीय वीडियो जनरेशन की व्यावहारिक समीक्षा।
- 東京大学 吉田幸 研究室(चैनल)— जनरेटिव AI तकनीकी रुझानों की नियमित व्याख्या, विश्वविद्यालय से।
YouTube खोज और वीडियो पृष्ठ JavaScript से रेंडर होने के कारण चैनल सब्सक्राइबर संख्या नहीं मिल सकी।
वीडियो
क्लोज़्ड-सोर्स पक्ष
- 【डो-काकिन करके पता चला】2026 के सुझाए गए इमेज जनरेशन AI यही हैं! NanoBananaPro, Seedream4.0, Midjourney, AdobeFirefly की गहन तुलना! — 動画編集の中の人 — https://www.youtube.com/watch?v=vJLDbXaSKW4 — भुगतान करके Nano Banana Pro, Seedream 4.0, Midjourney और Adobe Firefly की वास्तविक तुलना तथा 2026 की अनुशंसा।
- 【2026 सर्दियों का नवीनतम】पिछले कुछ महीनों में सबसे ज्यादा विकसित हुए 6 लोकप्रिय मुफ़्त वीडियो जनरेशन AI टूल—Sora 2, Veo 3.1, Kling 2.6 आदि — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=T9iIlhittDc — Sora 2, Veo 3.1 और Kling 2.6 समेत छह मुफ़्त वीडियो जनरेशन AI टूलों और हालिया प्रगति का परिचय।
- 【प्रदर्शन रैंकिंग में विश्व नंबर 1】xAI के वीडियो जनरेशन AI "Grok Imagine" की विस्तृत व्याख्या! मुफ़्त में Sora/Veo-जैसे वीडियो बनाने का तरीका — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=0cYPwxg8le8 — Grok Imagine को विश्व नंबर 1 बताने और मुफ़्त में Sora/Veo स्तर के वीडियो बनाने की विधि का दावा।
- 【नवीनतम】Google के AI Gemini मॉडल का बड़ा अपडेट! Google I/O 2026 में घोषित वीडियो जनरेशन Omni की व्याख्या — 【さき】のAIでええやん。 — https://www.youtube.com/watch?v=vKtwoKCSGyE — Google I/O 2026 में घोषित Gemini अपडेट और नए वीडियो जनरेशन मॉडल "Omni" की व्याख्या।
- Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI Style Creator, and More! — Woollyfern — https://www.youtube.com/watch?v=dvfH5HzCARY — Midjourney V8.2 की रिलीज़, personalization और NIJI Style Creator की जानकारी; V8 Alpha से V8.1, V8.2 preview और औपचारिक V8.2 तक मासिक अपडेट क्रम।
ओपन-सोर्स पक्ष
- 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Qwen आधिकारिक चैनल — https://www.youtube.com/watch?v=1tM7Wd0lEeI — Alibaba Qwen टीम का Qwen-Image-2.0 का आधिकारिक घोषणा वीडियो; अगली पीढ़ी के ओपन-सोर्स इमेज जनरेशन मॉडल के रूप में प्रस्तुति।
- Qwen Image Dominates Text-to-Image: 700+ Tests Reveal Why It's Better Than FLUX - Presets Published — SECourses — https://www.youtube.com/watch?v=R6h02YY6gUs — 700 से अधिक परीक्षणों के आधार पर Qwen Image की FLUX पर बढ़त का परीक्षण और प्रीसेट जारी।
- Flux 2 Klein vs Qwen vs Z Image Turbo vs Nano Banana Pro - Which AI Image Wins? — AIOnTrend — https://www.youtube.com/watch?v=CkAtP2EVhSM — Flux 2 Klein, Qwen और Z Image Turbo जैसे ओपन-सोर्स मॉडलों की Nano Banana Pro के साथ एक ही प्रॉम्प्ट पर तुलना।
- Flux.2 New Open Source King? Architecture FULL guide + Nano Banana Pro comparisons — Urban Decoders — https://www.youtube.com/watch?v=Iu9Dm7lBeAk — Black Forest Labs के Flux.2 की आर्किटेक्चर व्याख्या और Nano Banana Pro से तुलना कर "नया ओपन-सोर्स राजा" होने की जांच।
- Flux 2 Klein Just Dropped—This Image Editing Model Isn't Just About Speed! — https://www.youtube.com/watch?v=JXgBe3twxbc — Black Forest Labs के हल्के, स्थानीय रूप से चलने योग्य इमेज एडिटिंग मॉडल Flux 2 Klein पर त्वरित रिपोर्ट।
- Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — Alibaba Wan 2.2, FLUX और Qwen Image जैसे ओपन-सोर्स SOTA छवि व वीडियो मॉडलों के अपडेट का संयुक्त ट्यूटोरियल।
- 【मुफ़्त・ComfyUI】स्थानीय वीडियो जनरेशन AI से लंबी वीडियो बनाना आसान है? बेहद कठिन है — 寺田部チャンネル — https://www.youtube.com/watch?v=I8_wKOLnSlI — ComfyUI और स्थानीय वीडियो जनरेशन AI से लंबी वीडियो बनाने की व्यावहारिक रिपोर्ट, जिसमें ईमानदार असफलताएं और सीख शामिल हैं।
संकेत
- क्लोज़्ड-सोर्स की मुख्य प्रतिस्पर्धा "कम कीमत और गति" बनाम "गुणवत्ता" है: कई तुलना सामग्री में Nano Banana Pro के फोटो-रियलिज़्म परीक्षणों में 63% जीतने का दावा है, जबकि Grok Imagine जैसे मुफ़्त/कम-कीमत विकल्प "Sora/Veo स्तर मुफ़्त में" कहकर प्रचारित हैं।
- Midjourney V8 श्रृंखला में मासिक गति से सुधार जारी रखे हुए है: V8 घोषणा, Alpha, V8.1, V8.2 preview और V8.2 की औपचारिक रिलीज़ तक तेज़ कैडेंस दिखता है।
- Google I/O 2026 में Gemini वीडियो जनरेशन "Omni" की घोषणा को बड़ी स्वतंत्र खबर माना गया और जापानी चैनलों पर भी त्वरित व्याख्या आई।
- ओपन-सोर्स में Qwen Image और FLUX की बढ़त की होड़: SECourses के 700+ टेस्ट और Urban Decoders की आर्किटेक्चर व्याख्या जैसे गहन चैनल लगातार जांच रहे हैं कि कौन बेहतर है।
- Black Forest Labs का "Flux 2 Klein" हल्के और स्थानीय निष्पादन पर केंद्रित व्युत्पन्न मॉडल के रूप में अलग से ध्यान पा रहा है।
- Alibaba के Wan और Qwen Image को ओपन-सोर्स के वीडियो और छवि के दो पहियों की तरह साथ में लिया जा रहा है।
- स्थानीय वीडियो जनरेशन अब भी कठिन है: ComfyUI से लंबी वीडियो बनाने की व्यावहारिक समीक्षा में संचालन का बोझ ओपन-सोर्स वीडियो जनरेशन की बड़ी चुनौती है।
सीमाएं
- YouTube के खोज परिणाम और watch पृष्ठ JavaScript से सामग्री रेंडर करते हैं। WebFetch को केवल स्थिर HTML—फुटर नियम और कॉपीराइट लिंक—मिला; इसलिए वीडियो सूची, व्यू, प्रकाशित तारीख, विवरण और टिप्पणियां प्रत्यक्ष रूप से नहीं पढ़ी जा सकीं।
- वैकल्पिक सत्यापन में
site:youtube.comवेब खोज और YouTubeoembedएंडपॉइंट का उपयोग हुआ। फिर भी व्यू, चैनल सब्सक्राइबर, पूर्ण विवरण और टिप्पणियां नहीं मिलीं और ऊपर शामिल नहीं हैं। - अगस्त और सितंबर 2026 के जापानी समाचार खोज में छवि/वीडियो AI की विशिष्ट खबरें नहीं मिलीं; सामान्य AI दैनिक समाचार और असंबद्ध मौसम समाचार मिश्रित थे। 1–8 सितंबर की विशेष ब्रेकिंग रिपोर्ट नहीं मिली।
- Reddit/X/Bluesky/Lemmy/Pinterest इस चरण के दायरे में नहीं थे और नहीं देखे गए।
Bluesky
Bluesky — छवि और वीडियो जनरेशन AI समाचार
खाते
| हैंडल | प्रकार | फॉलोअर आदि | टिप्पणी |
|---|---|---|---|
| @simonwillison.net | व्यक्ति—प्रसिद्ध AI तकनीकी ब्लॉगर, Datasette के निर्माता | — | नए मॉडल के साथ अपने "साइकिल चलाते पेलिकन" बेंचमार्क से छवि क्षमता की तुलना करते हैं; इस संग्रह का सबसे समृद्ध स्रोत। |
| @404media.co | मीडिया—404 Media संपादकीय और पत्रकार खाते | — | निगरानी पर केंद्रित रिपोर्टिंग, लेकिन AI-जनरेटेड मीडिया से संबंधित स्कूप भी। |
| @aimod.social | समुदाय संचालन—संदिग्ध AI चित्र लेबलर | 2,555 फॉलोअर・94 पोस्ट | संदिग्ध AI-जनरेटेड चित्रों को लेबल करने वाली Bluesky सेवा; समाचार स्रोत के बजाय बुनियादी ढांचा। |
| @stablediffusion.bsky.social | व्यक्ति—SDXL/Stable Diffusion प्रॉम्प्ट साझा करना | — | जनवरी 2025 के बाद निष्क्रिय। |
| @bm63ai.bsky.social | व्यक्ति—ComfyUI/Flux/Midjourney कला पोस्ट | — | अप्रैल 2025 तक AI कला पोस्ट; जून 2026 की अंतिम पोस्ट Codex से ऐप वाइब-कोडिंग पर थी, AI कला पोस्ट लगभग समाप्त। |
| @petapixel.bsky.social | मीडिया—फोटोग्राफी विशेषज्ञ मीडिया | — | Adobe की जनरेटिव AI सुविधाओं की आलोचनात्मक कवरेज; नवीनतम पोस्ट फरवरी 2025 की है। |
पोस्ट
- GPT-6 Astra से पेलिकन-साइकिल बेंचमार्क फिर (@simonwillison.net, 2026-09-04, 202 लाइक・9 रीपोस्ट・18 रिप्लाई, https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c)। GPT-6 Astra, GPT-5.6 Sol, Terra और Luna के चार मॉडल तथा तीन रीज़निंग स्तरों में साइकिल पर पेलिकन के SVG चित्रों का ग्रिड प्रकाशित किया गया। Alt text के अनुसार Astra के नतीजे परिष्कृत और स्थिर, Sol में अनुपात असमान, Terra में शरीर रचना अजीब और Luna में सरल, कठोर मुद्रा थी।
- GPT-6 Astra ने Blender चलाकर पेलिकन का 3D दृश्य बनाया (@simonwillison.net, 2026-09-05, 400 लाइक・30 रीपोस्ट, https://bsky.app/profile/simonwillison.net/post/3murtmdynq22s)। तीन चरणों के निर्देशों से कोडिंग एजेंट के माध्यम से Blender में 3D दृश्य रेंडर कराया गया। यही विषय Reddit के r/DefendingAIArt में भी स्वतंत्र रूप से आया, जिससे इसके क्रॉस-प्लेटफ़ॉर्म प्रसार की पुष्टि होती है।
- ओपन-सोर्स Qwen 3.7 27B ने स्थानीय रूप से पेलिकन बनाया (@simonwillison.net, 2026-08-14, 183 लाइक・14 रीपोस्ट, https://bsky.app/profile/simonwillison.net/post/3mt2ynhrlk22z)। 17GB GGUF के रूप में LM Studio पर M5 Max MacBook Pro में चल रहे मॉडल को लैपटॉप पर चल सकने वाले मॉडलों में सबसे अच्छा पेलिकन चित्र बनाने वाला बताया गया।
- न्यूयॉर्क गवर्नर उम्मीदवार ने प्रतिद्वंद्वी पर AI-जनरेटेड फेक वीडियो से हमला किया (@404media.co, 2026-09-02, 124 लाइक・22 रीपोस्ट・7 रिप्लाई, https://bsky.app/profile/404media.co/post/3muka24vu4v2q)। राजनीतिक विज्ञापन में वीडियो जनरेशन AI से गलत सूचना के उपयोग का मामला।
- Cocomelon की निर्माता कंपनी ने कलाकारों को AI प्रयोग का निर्देश दिया (@404media.co, 2026-09-06, 84 लाइक・23 रीपोस्ट・21 रिप्लाई, https://bsky.app/profile/404media.co/post/3musx3wgdvc2n)। बच्चों की वीडियो सामग्री जैसे प्रमुख उपयोग क्षेत्र में AI अपनाने की घोषणा, हालांकि "human in the loop" बनाए रखने की बात कही गई।
- संदिग्ध AI चित्र लेबलर aimod.social के 2,500 से अधिक फॉलोअर (प्रोफ़ाइल जांच, https://bsky.app/profile/aimod.social)। संदिग्ध AI छवियों को चिह्नित करने वाला लेबलर, जिसमें मानदंड हैंडबुक और अपील चैनल भी है। इससे AI-चित्र पहचान और स्वचालित लेबलिंग की सामुदायिक मांग दिखती है।
- पुराने AI कला खाते व्यापक रूप से शांत (@stablediffusion.bsky.social, @bm63ai.bsky.social की फीड जांच)। पहला जनवरी 2025 से अपडेट नहीं हुआ; दूसरा AI कला से कोडिंग एजेंट द्वारा संगीत ऐप बनाने वाली पोस्ट की ओर चला गया।
- Adobe की जनरेटिव AI सुविधाओं की आलोचना—पुराने चक्र का संदर्भ (@petapixel.bsky.social, 2025-02-12・2025-01-09)। टेक्स्ट-टू-वीडियो को कीमत लेने के लिए तैयार न बताने और Lightroom Generative Remove में Bitcoin लोगो बन जाने जैसे उदाहरण। यह सितंबर 2026 के समाचार चक्र से पहले का संदर्भ है।
संकेत
- जो बढ़ रहा है: GPT-6 Astra की विज़ुअल गतिविधियां—पेलिकन SVG और Blender में 3D रेंडर—Reddit और Bluesky दोनों पर स्वतंत्र रूप से आईं। हालांकि यह डिफ्यूज़न आधारित छवि जनरेशन नहीं, बल्कि LLM एजेंट द्वारा कोड/3D टूल से दृश्य बनाना है।
- जिसे कम महत्व मिल रहा है: ओपन-सोर्स पक्ष अत्यंत कम दिखा; Qwen 3.7 27B की स्थानीय रिपोर्ट के अलावा FLUX, Stable Diffusion के नए संस्करण, Wan या HunyuanVideo की ठोस पोस्ट नहीं मिली।
- आश्चर्यजनक पहलू: 2025 की शुरुआत तक सक्रिय AI कला खाते शांत हैं, जबकि संदिग्ध AI छवियों को स्वचालित रूप से लेबल करने वाली सेवा स्वतंत्र सामुदायिक ढांचे के रूप में बनी और बढ़ी है। संभव है कि Bluesky पर फोकस "बनाने" से "पहचानने/नियंत्रित करने" की ओर खिसक रहा हो।
- विरोधी संकेत: वीडियो जनरेशन AI की स्पष्ट खबरें मॉडल प्रतिस्पर्धा से ज्यादा राजनीतिक विज्ञापन में दुरुपयोग जैसे सामाजिक विवाद के रूप में दिखीं। Bluesky पर तकनीकी रुझान से अधिक सामाजिक समस्या की दृश्यता है।
सीमाएं
- Bluesky का सार्वजनिक खोज API
app.bsky.feed.searchPostsअंग्रेज़ी और जापानी, दोनों तरह की सभी क्वेरी—"image generation AI", "Stable Diffusion", "Midjourney", "Sora", "Veo", "Kling" आदि—पर लगातार HTTP 403 देता रहा। bsky.app/searchक्लाइंट-साइड रेंडरिंग वाला SPA है और वेब संग्रह उपकरण वास्तविक खोज नतीजे नहीं पढ़ सका।- इसलिए सामान्य कीवर्ड खोज के बजाय ज्ञात खातों की फीड व्यक्तिगत रूप से जाँची गई। यह खाता-नमूना है, व्यापक खोज का विकल्प नहीं।
- OpenAI, Google DeepMind, Midjourney, Runway, Stability AI, Black Forest Labs, Krea, TechCrunch, The Verge, Ars Technica और Engadget जैसे अपेक्षित खाते मौजूद नहीं मिले या उनमें संबंधित पोस्ट नहीं मिलीं।
- प्रति प्लेटफ़ॉर्म लगभग 20 पोस्ट के विश्लेषण का लक्ष्य पूरा नहीं हुआ। वास्तविक विश्लेषण योग्य सामग्री आठ पोस्ट और एक संदर्भ पोस्ट तक सीमित रही।
- FLUX, Stable Diffusion, Wan और HunyuanVideo जैसे ओपन-सोर्स छवि/वीडियो मॉडलों की ठोस पोस्ट नहीं मिली; यह चर्चा की कमी है या खोज सीमा के कारण छूटना, इसे अलग नहीं किया जा सकता।
Lemmy
Lemmy — छवि और वीडियो जनरेशन AI समाचार
Lemmy Reddit से कहीं छोटा फेडरेटेड सोशल नेटवर्क है, इसलिए यहां "वायरल" होने का अर्थ सैकड़ों नहीं बल्कि दर्जनों अपवोट भी हो सकता है। फिर भी उपयोगी और घनी जानकारी मिली। मुख्य रूप से !«メールアドレス»—ComfyUI और मॉडल रिलीज़—, !ai_reddit—r/ArtificialIntelligence का रीपोस्ट बॉट—और !technology तथा !techtakes समुदायों को खोजा गया। lemmy.world/api/v3/search पर कई कीवर्ड के साथ खोज की गई।
समुदाय
!«メールアドレス»— 5,709 सब्सक्राइबर, जिनमें 893 स्थानीय। ComfyUI कस्टम नोड और मॉडल रिलीज़ का हब; लगभग रोज़ पोस्ट।!«メールアドレス»— 2,362 सब्सक्राइबर। Stable Diffusion/Flux/Krea2 से बनी कला की गैलरी।!«メールアドレス»— एनीमे AI कला के लिए; सब्सक्राइबर संख्या सार्वजनिक नहीं, लेकिन सक्रियता समान रूप से अधिक।!«メールアドレス»— 87,904 सब्सक्राइबर। बड़ी तकनीकी खबरों के पुनर्प्रकाशन; Midjourney विवाद भी यहां चर्चा में था।!«メールアドレス»— 2,690 सब्सक्राइबर। AI उद्योग पर व्यंग्य वाला समुदाय।!«メールアドレス»— r/ArtificialIntelligence का RSS पुनर्प्रकाशन खाता; समाचार घनत्व सबसे अधिक।!«メールアドレス»— 8,154 सब्सक्राइबर। AI-विरोधी समुदाय; जनरेटिव AI सप्लाई चेन की आलोचना भी यहां आई।
पोस्ट
क्लोज़्ड-सोर्स की ओर झुकी पोस्ट
- Midjourney ने चिकित्सा अल्ट्रासाउंड स्कैनर "Midjourney Medical" की ओर रुख किया (?) — 2026-06-18–19,
!techtakesऔर!hackernewsमें चर्चा। The Register ने व्यंग्य किया और pivot-to-ai.com ने इसे Theranos की ओर पिवट जैसा बताया। स्कोर 40–58।
https://lemmy.world/post/48384985 (मूल लेख: pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/) - Midjourney ने हॉलीवुड स्टूडियो से AI उपयोग का खुलासा मांगा — TechCrunch लेख,
!technologyमें स्कोर 73; कॉपीराइट मुकदमों की कड़ी।
https://lemmy.world/post/49069400 - Google ने Nano Banana 2 Lite जारी किया — DeepMind का हल्का इमेज जनरेशन मॉडल।
https://lemmy.world/post/48857780 (deepmind.google/models/gemini-image/flash-lite/) - Microsoft का MAI-Image-2.5 बेंचमार्क में Nano Banana 2 के बराबर पहुंचा —
!ai_reddit, 2026-05-28।
https://the-decoder.com/microsofts-mai-image-2-5-pulls-even-with-googles-nano-banana-2-on-benchmarks/ - ByteDance Seedream 5.0 Pro की विस्तृत तुलना समीक्षा — संपादन और बार-बार जनरेशन की क्षमता पर चर्चा।
https://www.reddit.com/gallery/1usc03q - Google का Earth AI फीचर लॉन्च के अगले दिन बंद — वास्तविक स्थानों पर फर्जी छवियां ओवरले करने के दुरुपयोग के बाद रिपोर्ट।
https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature-a-day-after-its-rollout-after-users-made-no-no-images/ - Runway का एंटरप्राइज़ कारोबार NRR 300% से अधिक के साथ दोगुना — वीडियो जनरेशन कंपनी की B2B वृद्धि।
https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/runway_says_enterprise_business_doubled_nrr_over/ - Amnesty International ने प्रमुख AI सिस्टमों को डिजाइन से ही अवैध बताया — जनरेटिव AI के नियामक दबाव का व्यापक संदर्भ।
https://reddit.com/r/ArtificialInteligence/comments/1ue64s2 - Pax Silica: AI सप्लाई चेन का हथियारीकरण — अमेरिकी-चीनी AI चिप और कंप्यूट संसाधन संघर्ष का विश्लेषण।
https://thecradle.co/articles/pax-silica-and-the-weaponization-of-ai-supply-chains-the-new-front-in-us-global-economic-warfare - "Astra 6 max" से भावनात्मक कला बनवाने का प्रयोग — व्यावसायिक क्लोज़्ड मॉडल से दार्शनिक, आत्म-संदर्भित कला जनरेशन।
https://i.redd.it/3h241pocalnh1.png
ओपन-सोर्स की ओर झुकी पोस्ट
- LLaDA-Image जारी — 6B Diffusion Transformer और frozen विज़ुअल-लैंग्वेज समझ मॉड्यूल वाला LLaDA2.0-Mini आधारित मॉडल। Qwen-Image-Bench में अंग्रेज़ी 53.53 और चीनी 53.38 SOTA स्कोर; 2–4 चरणों वाला तेज़ LLaDA-Image-Turbo भी जारी। वेट, ट्रेनिंग कोड और रेसिपी खुले हैं।
https://lemmy.dbzer0.com/post/74988021 (पेपर: arxiv.org/abs/2609.03796, कोड: github.com/inclusionAI/LLaDA-Image) - Boogu-Image-0.1 जारी — Base/Turbo/Edit वेरिएंट वाला ओपन मॉडल परिवार; Apache-2.0 लाइसेंस और व्यावसायिक उपयोग की अनुमति। 10B पैरामीटर तथा Qwen-Image-Bench पर 53.58 का उच्चतम ओपन-सोर्स स्कोर।
https://boogu.org/ (पेपर: arxiv.org/abs/2607.13125) - ComfyUI-Ref2VA-VSA: MiniMax H3 के लिए तेज़ इन्फ़रेंस नोड — वीडियो जनरेशन इन्फ़रेंस गति में बड़ा सुधार।
https://github.com/Kablex/ComfyUI-Ref2VA-VSA - ComfyUI-AetherScale: NVIDIA GPU-नेटिव वीडियो अपस्केलर —
!stable_diffusion, 2026-09-05।
https://github.com/vizart-vj/ComfyUI-AetherScale - ComfyUI-VDN-H3: Video Delta Net हाइब्रिड अटेंशन — वीडियो जनरेशन मॉडल दक्षता नोड।
https://github.com/Saganaki22/ComfyUI-VDN-H3 - ComfyUI-Majoor-OmniCam: कैमरा लेआउट और एनीमेशन टूल — वीडियो/छवि जनरेशन में कैमरा कार्य नियंत्रित करने वाला नोड।
https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam - FastH3-Ref2V-Stream-Controller — MiniMax H3 वीडियो जनरेशन के लिए स्ट्रीमिंग नियंत्रण टूल।
https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller - ComfyUI-InpaintCanvas: Krita-जैसा इनपेंटिंग UI —
!stable_diffusion, 2026-09-08।
https://github.com/DenRakEiw/ComfyUI-InpaintCanvas - ComfyUI-MiniMax-H3-MotionCache-FastVAE / ComfyUI-H3VAE_TRT / ComfyUI-MiniMaxH3-CLSS — MiniMax H3 के लिए गति और हल्केपन के तीन नोड एक के बाद एक 2026-09-01–02 को पोस्ट हुए। यह ओपन-सोर्स वीडियो जनरेशन इकोसिस्टम की तीव्र सक्रियता दर्शाता है।
https://github.com/Mozer/ComfyUI-MiniMax-H3-MotionCache-FastVAE - InterleaveThinker: एजेंटिक इंटरलीव्ड जनरेशन पर रिइनफोर्समेंट लर्निंग शोध — मौजूदा इमेज जनरेशन मॉडलों में मल्टी-एजेंट तरीके से क्रमिक टेक्स्ट↔छवि जनरेशन जोड़ने का शोध।
https://arxiv.org/abs/2606.13679 - Flux/Krea2 turbo से बनी कला की लगातार पोस्ट —
!stable_diffusion_artऔर!share_anime_artमें Flux और Krea2 जनरेटेड कला व एनीमे चित्र रोज़ कई पोस्ट के स्तर पर आते रहे। यह दर्शाता है कि ओपन-वेट मॉडल दैनिक उपयोग में हैं।
https://lemmy.dbzer0.com/post/75150630 ほか多数
संकेत
- 🔥 सबसे बड़ा विषय Midjourney का भटकाव था। इमेज जनरेशन AI कंपनी के चिकित्सा अल्ट्रासाउंड स्कैनर क्षेत्र में जाने की बात
!techtakesऔर!technologyदोनों में काफी चर्चा में रही, और प्रतिक्रिया सकारात्मक नहीं थी। क्लोज़्ड-सोर्स समाचारों में इसका स्कोर सबसे ऊंचा—40–73—रहा। - 🛠️ ओपन-सोर्स पक्ष में MiniMax H3 वीडियो मॉडलों के ComfyUI नोड एक ही सप्ताह में 5–6 की संख्या में आए। यह उस पैटर्न का उदाहरण है जिसमें डेवलपर समुदाय किसी खास वीडियो जनरेशन बेस मॉडल पर एक साथ पहुंचकर ऑप्टिमाइज़ेशन प्रतिस्पर्धा करता है।
- 📊 बेंचमार्क-केंद्रित समुदाय Qwen-Image-Bench को साझा मानक बना रहा है। LLaDA-Image और Boogu-Image-0.1 दोनों उसी बेंचमार्क पर प्रतिस्पर्धा कर रहे हैं, जिससे ओपन-सोर्स मॉडलों की प्रदर्शन होड़ संख्यात्मक रूप में दिखती है।
- 😤 AI-विरोधी समुदायों तक क्लोज़्ड-सोर्स कंपनियों के भू-राजनीतिक जोखिम की सामग्री पहुंच रही है, जिससे स्पष्ट है कि जनरेटिव AI चर्चा तकनीकी समुदाय से बाहर भी फैल गई है।
- 🤖 Lemmy का उपयोगकर्ता आधार छोटा है, इसलिए वायरल होने का पैमाना Reddit/X से पूरी तरह अलग है। स्कोर 70 के आसपास भी बड़ी खबर मानी जाती है; पूर्ण संख्या के बजाय सापेक्ष चर्चा देखनी चाहिए।
सीमाएं
- Lemmy फेडरेटेड है और खोज प्रत्येक इंस्टेंस पर अलग है।
lemmy.worldAPI से मुख्यतः उसके अपने या फेडरेटेड इंस्टेंसों के पोस्ट मिले;lemm.eeऔरlemmy.mlको इस बार व्यापक रूप से नहीं खोजा गया। - "Kling AI", "Stability AI", "Wan 2.2" और "Runway Gen" जैसे खोज शब्दों के नतीजे शून्य या असंबद्ध थे। Lemmy पर चीनी वीडियो मॉडल और Stability AI की अलग चर्चा लगभग नहीं मिली; वीडियो मॉडल चर्चा MiniMax H3 और ComfyUI डेवलपर समुदाय तक सीमित रही।
!ai_redditr/ArtificialIntelligence का स्वचालित रीपोस्ट बॉट है; इसे Lemmy की मूल प्राथमिक सूचना नहीं माना जा सकता।- लगभग 20 पोस्ट का विश्लेषण लक्ष्य पूरा हुआ, लेकिन Lemmy का कुल पोस्ट आधार Reddit/X से बहुत छोटा है; प्राथमिक स्रोतों की गुणवत्ता में यह अन्य प्लेटफ़ॉर्मों की तुलना में सीमित है।
Pinterest — छवि और वीडियो जनरेशन AI समाचार
पहले एकत्र किए गए 50 पिन—output/pinterest.pins.md / images/pinterest/manifest.json—में से 30 की छवियां सीधे खोली गईं। ये निष्कर्ष उन्हीं पर आधारित हैं।
दृश्य विषय
- क्लिकबेट-जैसे "AI समाचार" थंबनेल: चौंके हुए दाढ़ी वाले पुरुष, नीयन टूल लोगो, विस्फोट पृष्ठभूमि में Sam Altman-जैसी मुस्कान, आधे रोबोट समाचार एंकर जैसे दृश्य बहुत थे। अधिकांश पिन लेख के बजाय YouTube वीडियो की ओर ले जाते हैं।
- क्लोज़्ड-सोर्स उत्पादों के "best of" रैंकिंग इन्फ़ोग्राफ़िक: Runway, Pika, Kling AI, Luma, Canva, Hailuo AI, HeyGen, Synthesia, InVideo, Sora और Google Veo की सूची बार-बार दिखी।
- AI रोबोट/एंकर के मानवीय भूमिका रूपक: समाचार डेस्क पर रोबोट, महिला एंकर-जैसे सिंथेटिक वीडियो और रोबोट-नर्स दृश्य जैसे रूपक, टूल स्क्रीनशॉट से ज्यादा प्रमुख थे।
- डीपफेक और प्रामाणिकता की चिंता भड़काने वाले दृश्य: बिल्ली की फोटो पर "FAKE" स्टैंप, "Which is AI?" प्रश्न, और AI-जनरेशन डिटेक्टर जैसे उदाहरण।
- स्टॉक-जैसे सामान्य AI दृश्य: बैंगनी-नीयन, मस्तिष्क आकार, सर्किट बोर्ड और कण प्रभाव पर केवल शीर्षक टेक्स्ट वाले दृश्य।
- image-to-video से पहले/बाद के डेमो ग्रिड: एक छवि या वीडियो को LEGO, ओरिगामी या फूलों जैसी शैलियों में बदलते तुलना ग्रिड और एक फोटो से पांच-फ्रेम टाइमलाइन बनाने वाले चित्र।
- विशिष्ट उत्पाद नाम अधिकतर क्लोज़्ड-सोर्स: Veo 2/3, VASA-1, Grok, Sora, ChatGPT और Nano Banana जैसे नाम आए, पर देखे गए 30 पिनों में कोई स्पष्ट ओपन-सोर्स मॉडल या रिपॉज़िटरी नाम नहीं था।
- "AI पाइपलाइन" इन्फ़ोग्राफ़िक: वायरल वीडियो लिंक से "Scout→Script→Generate→Animate" चार एजेंटों द्वारा स्वचालित vlog बनाने का प्रवाह; इससे वीडियो जनरेशन के अकेले टूल से स्वचालित वर्कफ़्लो की ओर बढ़ने का संकेत मिलता है।
उल्लेखनीय पिन
- [1] Image to Video AI: How It Works and Why It Matters — एक स्थिर छवि से motion intensity, temporal consistency और visual control स्लाइडरों के माध्यम से वीडियो टाइमलाइन बनने का सबसे स्पष्ट तकनीकी चित्र।
- [7] (शीर्षकहीन, LEGO/origami/flowers रूपांतरण ग्रिड) — व्यक्ति, पांडा खिलौने और Tesla वाले मूल वीडियो को लकड़ी के ब्लॉक, ओरिगामी, LEGO और फूल शैली में बदलने का 3x5 तुलना ग्रिड।
- [9] 10 FREE AI VIDEO TOOLS IN 2026 — Pictory, Runway ML, Veed.io, Synthesia, InVideo, Kling AI, D-ID, Lumen5, Canva और Hyperwrite सहित दस मुफ़्त AI वीडियो टूल।
- [24] (शीर्षकहीन, बैंगनी मॉन्स्टर कैरेक्टर का image-to-video) — एक इनपुट चित्र को सर्वर रूम, पानी के नीचे के खंडहर और कैंडी शहर जैसी अलग पृष्ठभूमियों में रखे तीन आउटपुट वीडियो। शीर्षक Veo 3 से जुड़ा है।
- [27] 5+ Best AI Video Generation Websites — Runway/Pika/Kling AI/Luma/Canva/Hailuo तुलना और YouTube Shorts, TikTok, Pinterest वीडियो पिन तथा उत्पाद परिचय वीडियो के उपयोग का उल्लेख।
- [36] Top AI Image Generation Tools — ChatGPT, Nano Banana, GenTube, Ideogram और Z-Image की सूची; नए नाम Pinterest SEO लेखों तक पहुंच चुके हैं।
- [39] The Latest AI Developments — न्यू ऑरलियंस 911 पर AI की प्राथमिक प्रतिक्रिया, Meta का मुफ़्त ऑफ़लाइन एजेंट मॉडल Muse Glimmer, और उत्तर कोरियाई Kimsuky द्वारा AI स्टैक से फ़िशिंग दस्तावेज़ बनाने की तीन खबरों वाला एकमात्र ठोस समाचार-जैसा पिन।
- [41] Microsoft Unveils VASA-1 — एक छवि और ऑडियो क्लिप से कई लोगों के रीयल-टाइम बातचीत वाले चेहरे एनिमेट करने की Microsoft Research तकनीक।
- [16] AI Image Video: Best Quality vs Best Free — ChatGPT Plus, Gemini Advanced, Midjourney, Adobe Firefly, Recraft, Runway Gen-3, Luma, Pika Pro, Kaiber, Synthesia आदि को भुगतान-उच्च गुणवत्ता और मुफ़्त विकल्पों के रूप में तुलना करने वाला निर्णय गाइड।
- [47] AI video creation just got crazy — चार एजेंटों से वायरल वीडियो लिंक को तैयार vlog में बदलने वाली स्वचालित पाइपलाइन।
संकेत
- Pinterest पर "Image and Video Generation AI" विषय मुख्यतः SEO/एफ़िलिएट टूल तुलना और हाउ-टू इन्फ़ोग्राफ़िक है, ताज़ा समाचार नहीं। आधिकारिक घोषणाओं, शोधपत्रों या सोशल पोस्टों के प्राथमिक लिंक लगभग नहीं मिले; अधिकांश ब्लॉग या YouTube की ओर ले जाते हैं।
- वास्तविक समाचार घटनाएं [39] की तीन खबरों और Veo 2/3, VASA-1 तथा Grok की उत्पाद घोषणाओं वाले पिनों तक सीमित रहीं।
- क्लोज़्ड-सोर्स की मौजूदगी अत्यधिक मजबूत है: Runway, Pika, Kling AI, Luma, Canva, Hailuo, HeyGen, Synthesia, Sora, Veo, ChatGPT/Nano Banana और Ideogram बार-बार आए। इसके विपरीत देखी गई सामग्री में कोई ओपन-सोर्स मॉडल या परियोजना नाम नहीं मिला।
- AI के मानव भूमिकाएं—न्यूज़ एंकर, नर्स, 911 ऑपरेटर—संभालने की छवियां और उत्पन्न सामग्री की प्रामाणिकता पर संदेह—FAKE स्टैंप, Which is AI?, डिटेक्टर—दोनों बार-बार दिखाई देते हैं। तकनीक से ज्यादा सामाजिक प्रभाव और भरोसे की चिंता प्रमुख है।
- वीडियो जनरेशन में एक फोटो को एनिमेट करना और मौजूदा वीडियो की शैली बदलना प्रमुख उपयोग-प्रस्ताव हैं; शुद्ध text-to-video से अधिक रूपांतरण-आधारित उपयोग मामलों पर जोर है।
सीमाएं
- पहले एकत्रित 50 पिनों में genre फ़ील्ड खाली थी और सभी एक क्वेरी से आए थे; उन्हें क्लोज़्ड-सोर्स/ओपन-सोर्स अक्षों के लिए जानबूझकर अलग खोजा नहीं गया।
- समय की सीमा के कारण 50 में से केवल 30 छवियां खोली गईं। शेष शीर्षक
pinterest.pins.mdमें हैं और अधिकतर पहले से मिले lip-sync, वीडियो संपादन और AI सामग्री पहचान विषयों से मिलते हैं। - Pinterest को सीधे ब्राउज़ नहीं किया गया; निर्णय पहले से एकत्रित छवियों और शीर्षकों पर आधारित है। manifest और pins तालिका में पोस्ट समय या एंगेजमेंट नहीं है, इसलिए ताजगी और प्रसार का आकलन नहीं हो सका।
- Pinterest पर ओपन-सोर्स संबंधी उपयोगी उल्लेख न मिलने के कारण, ओपन-सोर्स रुझानों के निष्कर्ष के लिए इसे आधार नहीं माना जाना चाहिए।
अनुशंसित कार्रवाइयां
- GPT-6 Astra की एजेंट-आधारित विज़ुअल जनरेशन—Blender नियंत्रण और 3D शहर जनरेशन—को अगली रिपोर्टों में स्वतंत्र ट्रैकिंग विषय बनाकर देखें।
- ओपन-सोर्स घोषणाएं न छूटें, इसके लिए "FLUX", "Stable Diffusion", "Qwen-Image", "Wan" और "ComfyUI" जैसे नामों को प्लेटफ़ॉर्म-व्यापी खोज में जोड़ें।
- Bluesky पर 403 खोज API को ध्यान में रखकर निगरानी खातों की सूची पहले से बढ़ाएं।
- Pinterest को ताज़ा खबरों की तुलना के बजाय टूल जागरूकता के स्थिर अवलोकन के लिए सीमित रखें।
- Midjourney के चिकित्सा उपकरण दिशा-परिवर्तन विवाद को प्राथमिक स्रोत मिलने तक निर्णायक रूप से उद्धृत न करें।
- Lemmy का
!stable_diffusionऔर YouTube के परीक्षण चैनल ओपन-सोर्स रुझानों के प्राथमिक स्रोत होने चाहिए।
एकत्रित छवियां


















































डेटा गुणवत्ता नोट
Bluesky पर खोज API लगातार 403 देता रहा और 20 पोस्ट के पूर्णता मानदंड तक नहीं पहुंचा जा सका। Pinterest पर पोस्ट समय और एंगेजमेंट संख्या उपलब्ध नहीं थी, इसलिए ताजगी का निर्णय संभव नहीं हुआ। Reddit और X की एकल-शब्द खोज के कारण क्लोज़्ड और ओपन-सोर्स की तुलना जानबूझकर नहीं हो सकी; इसलिए ओपन-सोर्स चर्चा Lemmy और YouTube में केंद्रित है।



