छवि और वीडियो जनरेशन AI समाचार — 2026-09-05
इस सप्ताह X और Bluesky पर बंद-स्रोत चर्चा में GPT-6 "Astra" का दबदबा रहा, जबकि ओपन-सोर्स वीडियो/इमेज मॉडल (LTX-2.5, MiniMax H3, Qwen-Image-3.0) लगभग पूरी तरह ComfyUI इकोसिस्टम के भीतर बराबरी से आगे बढ़े। कुल मिलाकर सबसे बड़ी कहानी यह रही कि Midjourney ने इमेज जनरेशन से हटकर मेडिकल अल्ट्रासाउंड हार्डवेयर की ओर रुख किया।
छवि और वीडियो जनरेशन AI समाचार सारांश 〜क्लोज्ड बनाम ओपन〜 — 2026-09-05
हाय! इस हफ्ते छवि/वीडियो जनरेशन AI की दुनिया सच में बेहद अराजक रही www🔥 क्लोज्ड पक्ष में OpenAI का GPT-6 "Astra" X (पूर्व Twitter) पर 10 करोड़ से अधिक व्यूज़ के साथ वायरल हुआ और पूरी चर्चा अपने नाम कर ली😳 दूसरी ओर, ओपन-सोर्स पक्ष भी पीछे नहीं रहा: LTX-2.5, MiniMax H3, और Qwen-Image-3.0 जैसे बेहद शक्तिशाली मॉडल लगातार ओपन-वेट्स के रूप में आए, और ComfyUI एक गंभीर मदरशिप की तरह उभर रहा है🛠️ एक और चुपचाप बड़ी खबर यह थी कि Midjourney ने इमेज जनरेशन छोड़कर मेडिकल अल्ट्रासाउंड स्कैनर कंपनी की दिशा में पिवट किया😱 यह वाकई चौंकाने वाला था। इस बार एक और खोज यह रही कि तकनीकी प्रगति से अधिक, “AI-जनित सामग्री के कानूनी दर्जे” की बहस Reddit उपयोगकर्ताओं को प्रभावित कर रही थी।
प्लेटफ़ॉर्म्स के पार
- GPT-6 Astra उत्सव:X और Bluesky दोनों पर तुरंत चर्चा में आया (Simon Willison का पेलिकन इमेज बेंचमार्क)।X: https://x.com/OpenAI/status/2095595741528125780 / Bluesky: https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c ।दिलचस्प बात यह है कि इसे “इमेज/वीडियो जनरेशन AI” के रूप में प्रचारित नहीं किया गया, फिर भी लोग Astra को 3D मॉडलिंग और एनीमेशन में टेस्ट कर रहे हैं😂
- ComfyUI वास्तविक ओपन-सोर्स मुख्यालय बन गया:YouTube और Lemmy दोनों पर Wan, FLUX, Qwen-Image, LTX-2.5, MiniMax H3 और Trellis.2 तक सभी की चर्चा ComfyUI के साथ हो रही है।YouTube: https://www.youtube.com/watch?v=3BFDcO2Ysu4 / Lemmy: https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
- MiniMax H3 का “ओपन है, लेकिन व्यावसायिक उपयोग पेड है” मुद्दा:Lemmy पर भी चर्चा में रहा (RTX3060-स्तर के हार्डवेयर पर चलने वाला वीडियो मॉडल होने के बावजूद Comfy के माध्यम से पेड लाइसेंस चाहिए) https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。ओपन/क्लोज्ड की सीमा सच में धुंधली होती जा रही है🤔
- तकनीक से अधिक “विवाद और बदलाव” बढ़ते हैं:Reddit (AI-जनित CSAM पर न्यायिक निर्णय में 800 से अधिक टिप्पणियाँ) https://www.reddit.com/r/news/comments/1w5k6pr/ और Lemmy (Midjourney का मेडिकल-डिवाइस पिवट, स्कोर 58〜73) https://lemmy.zip/post/66397234 में एक समान पैटर्न दिखा।
प्लेटफ़ॉर्म दर प्लेटफ़ॉर्म
Reddit:r/StableDiffusion का मासिक सारांश (Qwen3.8, DeepSeek-V4-Pro, Ling-3.0, Gemma-4-31B जैसे ओपन मॉडल के बड़े पैमाने पर रिलीज़; इतनी तेज गति कि टिप्पणियाँ भी पीछे रह जाएँ) शानदार थ्रेड है https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/ 。World Labs का Atlas भी ध्यान देने योग्य है—वीडियो/फोटो से तुरंत 3D विश्व बनाना, जो रोबोटिक्स की दिशा से भी जुड़ता है https://www.reddit.com/r/accelerate/comments/1w5ye9s/ 。लेकिन सबसे अधिक चर्चा तकनीकी खबर की नहीं, बल्कि “AI-जनित बाल अश्लील सामग्री संवैधानिक रूप से संरक्षित है” फैसले की थ्रेड की हुई; Reddit पर कानून और नैतिकता की चर्चा अधिक गर्म लगती है।
X:खोज केवल Astra से जुड़े चार पोस्ट तक सीमित रह गई, और GPT-6 Astra का एकछत्र दबदबा रहा🎤 108,000,000 व्यूज़ वाले घोषणा-ट्वीट के साथ, डेवलपर @Dimillian का “Blender से UE5” 3D पाइपलाइन डेमो सबसे तकनीकी पोस्ट थाhttps://x.com/Dimillian/status/2095596700815516004 。इस खोज दायरे में Stable Diffusion, Flux या Wan जैसे ओपन-सोर्स विषयों का एक भी परिणाम नहीं मिला—यह एक वास्तविक कमी है।
YouTube:क्लोज्ड पक्ष पर Nano Banana 2, Kling 3.0 बनाम Veo3.1 बनाम Sora2, Seedance2.5 और Seedream5.0 Pro जैसी तुलना-आधारित समीक्षाएँ भरपूर थीं https://www.youtube.com/watch?v=AAD7wJ3DWiA 。ओपन पक्ष पर LTX-2.5 (10 सेकंड 720p को 6.8 सेकंड में बनाने वाला अत्यंत तेज मॉडल) https://www.youtube.com/watch?v=RjlbDhs1MPk 、HunyuanImage3.0 (80B पैरामीटर MoE) https://www.youtube.com/watch?v=U-8RjjU7x14 जैसे मॉडल रिलीज़ होते ही क्लोज्ड विकल्पों से तुलना किए जा रहे हैं।OpenAI के Sora API बंद करके अगली पीढ़ी के मॉडल “Spud” पर संसाधन केंद्रित करने की बात भी सामने आई (YouTube वीडियो स्वयं सत्यापित नहीं हुआ; समाचार स्रोत के माध्यम से)।
Bluesky:Simon Willison का नियमित “पेलिकन इमेज बेंचमार्क” क्लोज्ड मॉडल गुणवत्ता जांच का एक स्थिर अवलोकन केंद्र बन गया है https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c 。Replicate का आधिकारिक अकाउंट Kling3.0, Seedance2.0, Runway Gen-4.5 और Vidu Q3 जैसे वीडियो मॉडल के रिलीज़-अपडेट हब की भूमिका निभा रहा है https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c 。ओपन-सोर्स पक्ष से प्राथमिक पोस्ट लगभग नहीं हैं; LoRA टूल डेवलपर ostris ने स्वयं कहा कि “AI/ML समुदाय लगभग पूरी तरह X (Twitter) पर बचा है”😅 जापानी पक्ष में केवल GIGAZINE लेख का Qwen-Image-3.0 शेयर मिला https://gigazine.net/news/20260722-qwen-image-3/ 。
Lemmy:!«メールアドレス» ओपन पक्ष के लिए सबसे अधिक सूचना-घनत्व वाला स्थान था।MiniMax H3 संबंधी पोस्टों (Comfy का वाणिज्यिक रीसेलर बननाhttps://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 、16GB VRAM पर चलने वाले टूल आदि) ने लगभग आधे पोस्ट घेरे।पूरी ट्रेनिंग रेसिपी प्रकाशित करने वाला LLaDA-Image https://arxiv.org/abs/2609.03796 भी महत्वपूर्ण है।क्लोज्ड पक्ष में नए मॉडल की तुलना में “Midjourney का इमेज जनरेशन से मेडिकल अल्ट्रासाउंड स्कैनर व्यवसाय में पिवट” वाला समाचार कहीं अधिक स्कोर (58〜73) लेकर Lemmy उपयोगकर्ताओं की मुख्य रुचि बना।
Pinterest:दृश्य पहलू में क्लोज्ड मॉडल पूरी तरह हावी रहे—Google Veo2/3, Microsoft VASA-1, Grok4.6 और Gemini के 1 अरब उपयोगकर्ताओं के आंकड़े सारांश छवियों के विषय बने, जबकि ओपन पक्ष का विशिष्ट नाम केवल AMD के लोकल टूल “Amuse 3.0” जैसा दिखा।“चेहरा चलाना/बनाना” वाले उपयोग-मामले (लिप-सिंक, भाव-भंगिमा पुनर्निर्माण, पोर्ट्रेट जनरेशन) भी बेहद अधिक हैं; यह Pinterest के उपयोगकर्ता आधार (सौंदर्य और सोशल पोस्ट आइडिया) तथा AI वीडियो की अच्छी संगति को दर्शाता है।
नज़र रखने योग्य बातें
- GPT-6 Astra से जुड़ी इमेज/वीडियो-केंद्रित आगे की खबरें — X, https://x.com/flowith/status/2095750768204877858(GPT-6 Astra बनाम GPT-5.6 एनीमेशन मुकाबला, जल्द आने की घोषणा)
- Sora API का अंत → अगला मॉडल “Spud” — YouTube जांच के अनुसार, API 2026-09-24 को बंद होने वाला है।वास्तविक वीडियो या सुविधाओं की पुष्टि अब तक किसी ने नहीं की है
- MiniMax H3 के वाणिज्यिक लाइसेंस का भविष्य — Lemmy, https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller (ओपन-वेट्स होने पर भी वाणिज्यिक उपयोग के लिए भुगतान वाले हाइब्रिड रास्ते का स्थायी होना)
- Midjourney का मेडिकल-डिवाइस पिवट — Lemmy, https://lemmy.zip/post/66397234 (क्या पुराना क्लोज्ड दिग्गज सचमुच AI इमेज जनरेशन से हटेगा)
- LLaDA-Image की पूरी तरह ओपन ट्रेनिंग रेसिपी — Lemmy/arXiv, https://arxiv.org/abs/2609.03796 (Qwen-Image-Bench के शीर्ष मॉडल की नकल आगे कितनी होगी)
- World Labs का Atlas — Reddit, https://www.reddit.com/r/accelerate/comments/1w5ye9s/ (वीडियो से 3D वर्ल्ड जनरेशन को रोबोट प्रशिक्षण डेटा में कैसे अपनाया जाएगा)
सिफारिशें
- X के खोज शब्दों को ट्रेंड पर छोड़ने के बजाय “Stable Diffusion”, “ComfyUI”, “Flux”, “Wan”, “Kling”, “Sora” जैसे विशिष्ट टैग तक सीमित कर फिर से संग्रह करना चाहिए।
- Bluesky का
searchPostsAPI 403 दे रहा था, इसलिए अगली बार Google खोज से मिले ज्ञात अकाउंट्स की सूची पहले से बढ़ा लेना अधिक प्रभावी होगा। - MiniMax H3 जैसे “ओपन-वेट्स लेकिन वाणिज्यिक उपयोग पेड” मॉडल को रिपोर्ट में केवल “ओपन” कहकर वर्गीकृत करने के बजाय स्पष्ट नोट जोड़ना अधिक सटीक होगा।
- Midjourney के पिवट और OpenAI के Sora बंद होने जैसी “बड़ी कंपनियों की वापसी/दिशा-परिवर्तन” खबरों के लिए आगे निरंतर निगरानी श्रेणी बनानी चाहिए, क्योंकि वे तकनीकी खबरों से अधिक पाठक रुचि खींचती हैं।
- Pinterest में प्राथमिक जानकारी कम है, इसलिए इसे तकनीकी रुझान-समझने की जगह “आम उपभोक्ता इसे कैसे देख रहे हैं” के तापमान-मापी के रूप में उपयोग करना बेहतर होगा।
- Reddit और Lemmy पर दिखी “न्यायिक निर्णय और नैतिक विवाद तकनीकी खबरों से अधिक वायरल होते हैं” प्रवृत्ति को अगली ब्रीफ में अलग सिग्नल के रूप में उठाना उपयोगी होगा।
डेटा गुणवत्ता
- X:संग्रहित पोस्ट भौगोलिक रूप से क्रोएशिया क्षेत्र के ट्रेंड से शुरू हुए थे, इसलिए GPT-6 Astra से जुड़े 4 पोस्ट के अलावा अधिकांश असंबद्ध शोर थे (क्रिप्टोकरेंसी, इलॉन-संबंधित सामग्री, खेल आदि)।ओपन-सोर्स का उल्लेख शून्य था, और ब्रीफ में अपेक्षित “20 पोस्ट विश्लेषण” पूरा नहीं हुआ।
- Bluesky:आधिकारिक खोज API 403 के कारण उपलब्ध नहीं था, इसलिए ज्ञात खातों की व्यक्तिगत फीड जांच पद्धति अपनाई गई।विषय से सीधे जुड़ी केवल लगभग 12 पोस्ट मिलीं; ओपन-सोर्स की प्राथमिक जानकारी लगभग नहीं मिल सकी।
- Reddit:केवल एक खोज शब्द के कारण 12 थ्रेड और 9 सबरेडिट तक सीमित रहा, जो 20 के मानक से कम है।हालाँकि हर थ्रेड के अधिकतम 6 शीर्ष टिप्पणियाँ दर्ज की गईं।
- YouTube:खोज परिणाम और वीडियो पृष्ठ JavaScript से रेंडर होने के कारण व्यूज़, सब्सक्राइबर और सही प्रकाशित तिथि सीधे सत्यापित नहीं हो सकी; तिथि स्निपेट की सापेक्ष अभिव्यक्ति से अनुमानित है।
- Lemmy:फेडरेटेड प्रकृति के कारण एक इंस्टेंस में खोज करने पर दूसरे इंस्टेंस की पोस्ट छूट जाती हैं।क्लोज्ड वीडियो-जनरेशन सेवाओं (Sora, Kling, Veo आदि) की सीधी खोज से लगभग कोई परिणाम नहीं मिला।
- Pinterest:50 में से केवल 24 छवियाँ वास्तव में खोलकर देखी गईं; शेष के लिए केवल शीर्षक देखे गए।लाइक या सेव जैसी एंगेजमेंट मेट्रिक्स संग्रहित डेटा में नहीं थीं।
प्लेटफ़ॉर्म-वार सारांश
Reddit — इमेज और वीडियो जनरेशन AI समाचार
कहाँ
संग्रहित 12 थ्रेड 9 सबरेडिट से हैं।खोज शब्द केवल “Image and Video Generation AI News” था।
| सबरेडिट | सदस्य | संग्रहित थ्रेड |
|---|---|---|
| r/generativeAI | 150,575 | 4 |
| r/GrokAiDiscussion | 4,883 | 1 |
| r/freetoolsAI | 7,616 | 1 |
| r/StableDiffusion | 1,000,814 | 1 |
| r/accelerate | 77,800 | 1 |
| r/news | 31,531,475 | 1 |
| r/antiai | 313,317 | 1 |
| r/allthequestions | 127,064 | 1 |
| r/teenagers | 3,673,210 | 1 |
संख्या के हिसाब से r/generativeAI सबसे बड़ा था (4 पोस्ट), और टूल खोजने व तुलना करने वाली सहज पोस्टों का केंद्र था।अन्य प्रत्येक सब से केवल एक पोस्ट आई; खास बात यह है कि विषय r/news और r/teenagers जैसे गैर-विशेषज्ञ इमेज/वीडियो जनरेशन सबरेडिट तक भी फैल गया।
लोग क्या कह रहे हैं
- #4 r/StableDiffusion「Local AI News You Missed - August 2026」(201pt・22 टिप्पणियाँ・2026-08-31, https://www.reddit.com/r/StableDiffusion/comments/1w3rwoe/) — अगस्त में ही Qwen3.8, DeepSeek-V4-Pro-0813, Ling-3.0 श्रृंखला और Gemma-4-31B जैसे भारी मात्रा में ओपन-सोर्स मॉडल रिलीज़ होने का मासिक सारांश।टिप्पणियों में लगातार अतिरिक्त रिपोर्टें आईं: u/Narutobirama(20)「You probably missed Qwen3.8 Flash Next.」、u/MoJaKF(14)「Anima-3.8B its already on its 1.1 release that just released 3h ago」— गति इतनी तेज है कि सारांश पोस्ट स्वयं पीछे रह जाती है।
- #5 r/accelerate「…They built an AI that looks at a few casual real-world videos or photos and instantly turns them into a full 3D playground」(763pt・76 टिप्पणियाँ・2026-09-03, https://www.reddit.com/r/accelerate/comments/1w5ye9s/) — World Labs का Atlas वीडियो/फोटो से इंटरैक्टिव 3D वर्ल्ड बनाता है।u/stainless_steelcat(48)「Matrix bullet time comes to real life...now I know it wasn't ambitious enough.」जैसी प्रतिक्रियाएँ बेहद उत्साही थीं, और वीडियो जनरेशन तकनीक को रोबोटिक्स प्रशिक्षण डेटा में जोड़ने की संभावना पर चर्चा हुई।
- #6 r/generativeAI「Same prompt. Same 30 seconds. Two different AI video models.」(98pt・30 टिप्पणियाँ・2026-09-03, https://www.reddit.com/r/generativeAI/comments/1w60fip/) — Seedance 2.5 और Wan 3.0 की एक ही प्रॉम्प्ट से तुलना।u/SpecialistDragonfly9(5) ने 「seedance is the by FAR superior one」कहा, जबकि u/Positive-Key6640(4) ने 「Same-prompt comparisons are fun but they mostly measure which model happens to like your prompt style, not which one is better」कहकर तुलना पद्धति पर ही सवाल उठाया।
- #2 r/GrokAiDiscussion「Have they loosened the image to video generation moderation」(14pt・28 टिप्पणियाँ・2026-08-29, https://www.reddit.com/r/GrokAiDiscussion/comments/1w1w0e8/) — Grok Imagine की मॉडरेशन नीति पर उपयोगकर्ता अनुभव बंटे हुए हैं।u/Miserable_Appeal515(2)「it has gotten better」के विपरीत u/joderrelldalejr(2) ने कहा 「Hell no it gets worse and then they start to limit how many images you can even do in a week」।
- #1 r/generativeAI「List of daily AI video generative websites」(38pt・27 टिप्पणियाँ・2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3frr2/) — मुफ्त कोटा भरपूर उपयोग करने वाले लोगों के लिए जानकारी-साझा करने की पोस्ट।Kling AI में 「66 free credits every 24 hours」हैं, u/Murky-Race-3443(1) ने कहा 「capcut gives daily free credits btw」、और u/Julia_Leeds94(1) ने YalleryLabs को 「$3 के बजट में 5-सेकंड 720p वीडियो $0.18 से」बताया।
- #3 r/freetoolsAI「Free AI Image Generator」(31pt・31 टिप्पणियाँ・2026-09-04, https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/) — मुफ्त व बिना साइन-अप इमेज जनरेशन साइट के प्रचार पोस्ट पर टिप्पणियाँ आईं, और u/Odd-Lingonberry1516(2) ने Deepany, Aifun, Perchance जैसे विकल्प गिनाए।u/thecragmire(1) ने पूछा 「How do you maintain this? It's got to cost you something, right?」।
- #11 r/generativeAI「GOOD image-to-video ??」(1pt・13 टिप्पणियाँ・2026-08-29, https://www.reddit.com/r/generativeAI/comments/1w20rq1/) — Kling AI को 「practically king of the hill for realistic human motion」、Runway को 「The gold standard for creative control」बताया गया, और स्थानीय विकल्प के रूप में u/Ok-Addition1264(2) ने ComfyUI+WAN22/LTX2.3 सुझाया।
- #7 r/generativeAI「Any good Ai video site ? Even if it paid ?」(0pt・15 टिप्पणियाँ・2026-08-31, https://www.reddit.com/r/generativeAI/comments/1w3kptg/) — u/Previous-Course-5160(1) ने Runway gen-3 को 「actually handles motion pretty well compared to a lot of the jank」कहा, जबकि Pika को 「fun for quick little loops...but the output gets samey after a while」बताया।
- #8/#10 r/news「Federal Judge rules AI generated child sex abuse material is protected by First Amendment.」(1,379pt・545 टिप्पणियाँ・2026-09-02, https://www.reddit.com/r/news/comments/1w5k6pr/) और r/allthequestions「Why did a federal judge declare the creation of AI generated child porn as legal?」(31pt・277 टिप्पणियाँ・2026-08-31, https://www.reddit.com/r/allthequestions/comments/1w3hf3o/) — AI-जनित सामग्री की कानूनी स्थिति की बहस ने असाधारण एंगेजमेंट जुटाया।u/Ntroepy(414) ने 「The headline reads like click-bait...bound by a 2002 Supreme Court ruling」कहकर भ्रामक हेडलाइन की ओर इशारा किया, और r/allthequestions में u/TheGracefulCrane(31) ने कहा 「judges dont make laws and the law hasnt been updated to make it illegal ergo the ruling」।
- #9 r/antiai「AI generated images are becoming harder to detect」(113pt・30 टिप्पणियाँ・2026-08-30, https://www.reddit.com/r/antiai/comments/1w2mr8g/) — शीर्षक के विपरीत, असली टिप्पणियाँ u/GurInside278(31)「why are her feet her hands」जैसे अंग-विकृति मज़ाकों पर केंद्रित थीं; यह एक विडंबनापूर्ण अंतर है।
- #12 r/teenagers「To all AI image/video generator users」(7pt・41 टिप्पणियाँ・2026-08-31, https://www.reddit.com/r/teenagers/comments/1w2y305/) — “AI कला में कलाकार काम नहीं करता” दावे के विरोध में पोस्ट।u/LiterallyGarbage_0(5)「people who use ai to make "art" genuinely make me so upset...pick up a pencil」जैसी टिप्पणियाँ किशोर समूह में मजबूत एंटी-AI भावना दिखाती हैं।
संकेत
- उभरता हुआ: ओपन-सोर्स लोकल मॉडल (LLM/इमेज/वीडियो) की रिलीज़ गति इतनी तेज है कि केवल थ्रेड #4 की टिप्पणियाँ भी उसे नहीं पकड़ पा रहीं।World Labs के Atlas (#5) जैसी “वीडियो जनरेशन → रोबोटिक्स ट्रेनिंग डेटा” दिशा भी चर्चा का नया क्षेत्र है।
- मतभेद: Grok Imagine की मॉडरेशन (#2) पर “बेहतर हुआ” और “खराब हुआ” की रिपोर्टें पूरी तरह विभाजित हैं।Seedance बनाम Wan (#6) में भी “Seedance की भारी जीत” और “समान प्रॉम्प्ट तुलना का अर्थ ही सीमित है” दोनों मत मौजूद हैं।इसे एक निष्कर्ष में नहीं समेटा जा सकता।
- कम आंका गया / प्रश्नों के घेरे में: समान प्रॉम्प्ट से मॉडल तुलना का सामान्य प्रारूप (#6) स्वयं u/Positive-Key6640 द्वारा पद्धति के तौर पर आलोचित है।
- अप्रत्याशित बात: “AI इमेज पहचानना कठिन हो रहा है” शीर्षक वाला #9 थ्रेड वास्तव में हाथ-पैर की गलतियों के मज़ाक से मनोरंजन पैदा कर रहा था, यानी दावे और प्रतिक्रिया में अंतर है।साथ ही उत्पाद समाचारों से अधिक न्यायिक फैसलों (#8 और #10, संयुक्त रूप से 800+ टिप्पणियाँ) ने एंगेजमेंट पाया; Reddit पर “तकनीकी प्रगति” की तुलना में “AI-जनित सामग्री का कानूनी और नैतिक व्यवहार” सबसे बड़ा विवाद-बिंदु है।
सीमाएँ
- खोज शब्द केवल “Image and Video Generation AI News” था; इसलिए केवल 12 थ्रेड और 9 सबरेडिट मिले।यह brief.md की “हर नेटवर्क पर लगभग 20 पोस्ट” की अपेक्षा तक नहीं पहुँचता।
- इस चरण में कार्यकर्ता द्वारा पहले से एकत्रित
output/reddit.threads.md/.threads.jsonको ही पढ़ा गया; अतिरिक्त खोज शब्दों से पुनःसंग्रह या व्यक्तिगत थ्रेड/टिप्पणियों तक सीधी पहुँच नहीं की गई (प्लेबुक निर्देश के अनुसार)।कोई कमी हो तो वह इस एक खोज शब्द के दायरे से बाहर होने की संभावना है। - प्रत्येक थ्रेड की अधिकतम 6 शीर्ष टिप्पणियाँ ही दर्ज हैं; नीचे की प्रतिक्रियाएँ और अल्पमत इस रिपोर्ट में शामिल नहीं हैं।
X
X — इमेज और वीडियो जनरेशन AI समाचार
अकाउंट्स
इस संग्रह में 34 अकाउंट्स में से केवल चार ने इमेज/वीडियो जनरेशन AI से संबंधित कुछ पोस्ट किया—और सभी एक ही लॉन्च के बारे में, एक ही 24 घंटों में (2026-09-03):
- @OpenAI (OpenAI) — एक पोस्ट, लेकिन वही पूरी कहानी है: 309,095 लाइक,
55,587 रीपोस्ट, ~108,000,000 व्यूज़।अकाउंट ने न्यूनतम काम किया (इमेज वाला एक घोषणा ट्वीट) और बाकी काम पैमाने ने कर दिया। - @MatthewBerman (Matthew Berman) — AI-इन्फ्लुएंसर अकाउंट, एक पोस्ट
(4,054 लाइक, ~1,500,000 व्यूज़), जिसे “early access” के साथ हैंड्स-ऑन फर्स्ट-लुक थ्रेड के रूप में पेश किया गया; खुद को स्रोत के बजाय परीक्षक के रूप में रखा। - @Dimillian (Thomas Ricouard) — एक पोस्ट (7,199 लाइक, ~2,300,000 व्यूज़), सामान्य प्रचार के बजाय एक विशिष्ट पाइपलाइन (Blender → Unreal Engine 5) दिखाने वाला डेवलपर—इस सेट में सबसे ठोस तकनीकी दावा।
- @flowith (Flowith) — यहाँ सबसे छोटा अकाउंट (947 लाइक, ~115,000 व्यूज़), पिछले मॉडल के साथ सीधी तुलना कर लॉन्च की लहर का लाभ लेने वाला प्रोडक्ट अकाउंट।
संग्रह में मौजूद बाकी सभी अकाउंट्स (कुल 34, 40 पोस्ट)—क्रिप्टो/मीम अकाउंट्स (@songoncardano, @nmkr_io, @legsdotfun, @robincatonhood), Elon/Tesla फैन अकाउंट्स (@LunarOptimus, @Optimus_RH, @HeavyMetalShip), साइबरसिक्योरिटी इन्फ्लुएंसर (@corewarrior, @hackerzspace), Poland/Africa/Bosnia समाचार-और-मीम अकाउंट्स, Ariana Grande फैन अकाउंट्स (@vodolove ने अपनी 4 में से 3 चीज़ें पोस्ट कीं), और बीयर-ब्रांड स्वीपस्टेक्स अकाउंट्स (@naturallight, @ChinookCi)—का इमेज या वीडियो जनरेशन AI से कोई संबंध नहीं है।उन्हें केवल इसलिए दर्ज किया गया है क्योंकि संग्रह में वास्तव में वही लौटे; Limits देखें।
पोस्ट्स
1. GPT-6 "Astra" लॉन्च — @OpenAI
- 309,095 लाइक · 55,587 रीपोस्ट · 7,713 जवाब · ~108,000,000 व्यूज़ · 2026-09-03
- https://x.com/OpenAI/status/2095595741528125780
"This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast."
पूरे संग्रह में सबसे बड़ा पोस्ट, अन्य सभी से एक क्रम बड़ा।इसे एक सामान्य कंप्यूटर-उपयोग एजेंट के रूप में पेश किया गया है, इमेज/वीडियो-विशिष्ट मॉडल के रूप में नहीं—लेकिन नीचे अन्य अकाउंट्स के डेमो सभी विज़ुअल/3D हैं, जो संकेत देता है कि Astra की प्रदर्शित क्षमताएँ उस दिशा में झुकती हैं।
2. एनीमेशन केंद्रित Astra बनाम पिछला मॉडल — @flowith
- 947 लाइक · 69 रीपोस्ट · 19 जवाब · ~115,000 व्यूज़ · 2026-09-04
- https://x.com/flowith/status/2095750768204877858
"GPT-6 Astra VS GPT-5.6 on animation coming soon to flowith.io"
एक थर्ड-पार्टी प्रोडक्ट अकाउंट Astra बनाम पिछली पीढ़ी की एनीमेशन तुलना स्पष्ट रूप से तैयार कर रहा है—यह ठोस संकेत है कि Astra को केवल सामान्य कंप्यूटर उपयोग नहीं, विशेष रूप से एनीमेशन-जनरेशन क्षमता पर भी परीक्षण और विपणन किया जा रहा है।
3. अर्ली-एक्सेस हैंड्स-ऑन थ्रेड — @MatthewBerman
- 4,054 लाइक · 494 रीपोस्ट · 210 जवाब · ~1,500,000 व्यूज़ · 2026-09-03
- https://x.com/MatthewBerman/status/2095595892464333065
"Astra (GPT-6) is here!!! I've had early access and tested it like crazy with things like games, code, writing, browser control, presentations and general knowledge work. This is the best model I've ever used. Period."
खास बात वह है जिसका स्पष्ट उल्लेख नहीं हुआ: क्षमताओं की सूची में इमेज या वीडियो जनरेशन का नाम नहीं है, जबकि थ्रेड नीचे “incredible demos” का वादा करता है।
4. Blender से Unreal Engine 5 वॉकथ्रू — @Dimillian
- 7,199 लाइक · 1,145 रीपोस्ट · 259 जवाब · ~2,300,000 व्यूज़ · 2026-09-03
- https://x.com/Dimillian/status/2095596700815516004
"Astra is very good at 3D modeling, and I can't wait for all of you to experience it, for now here is a little walkthrough on how I built the demo house for our launch blog post. From a Blender scene to a Unreal Engine 5 walkable experience."
संग्रह का सबसे ठोस, टूल-विशिष्ट दावा: वास्तविक 3D कंटेंट पाइपलाइन (Blender → UE5) में Astra का उपयोग, जो इस रन में X द्वारा दिखाए गए किसी भी अन्य विषय से इमेज/वीडियो जनरेशन कार्यप्रवाह के अधिक करीब है।
संकेत
- उभरता हुआ: GPT-6 "Astra" इस संग्रह में सामने आई एकमात्र इमेज/वीडियो-संबंधी कहानी है, और एंगेजमेंट में पूरी तरह हावी है (सिर्फ लॉन्च पोस्ट पर ~108M व्यूज़ बनाम बाकी सबके कम लाखों)।24 घंटों में प्रतिक्रियाओं का समूह—प्रोडक्ट तुलना, इन्फ्लुएंसर हैंड्स-ऑन, डेवलपर 3D पाइपलाइन डेमो—स्वाभाविक खोज नहीं, समन्वित लॉन्च जैसा दिखता है।
- गायब / अनुपस्थित: इस संग्रह में कोई भी ओपन-सोर्स इमेज या वीडियो जनरेशन मॉडल (Stable Diffusion, Flux, Wan, HunyuanVideo, Kling, ComfyUI आदि) नहीं दिखा।यदि X पर इस समय ओपन-सोर्स AI वीडियो/इमेज कार्य हो रहा है, तो यह खोज उसे नहीं पहुँची।
- अप्रत्याशित: “AI” लॉन्च चर्चा में इमेज या वीडियो जनरेशन को सुविधा के रूप में नाम से कितनी कम बार बताया गया—Matthew Berman की अर्ली-एक्सेस सूची में यह पूरी तरह गायब है, और Astra को सामान्य एजेंट (“anything you can do on a computer”) के रूप में बेचा गया है।इमेज/वीडियो कोण OpenAI की अपनी प्रस्तुति से नहीं, बल्कि शुरुआती परीक्षकों द्वारा चुने गए डेमो (3D मॉडलिंग, एनीमेशन तुलना) से अनुमानित है।
सीमाएँ
- एकत्र की गई खोजों ने इस विषय को लक्षित ही नहीं किया। वास्तव में खोजे गए दस शब्द—“Astra”, “$SONG”, “Robinhood”, “Elon”, “#CyberSecurity”, “Poland”, “Africa”, “Bosnia”, “ariana”, “#Sweepstakes”—इस सत्र की X की ट्रेंडिंग टॉपिक सूची थी (
x.posts.mdकी Explore तालिका देखें), इमेज/वीडियो जनरेशन AI के लिए चुने गए खोज शब्द नहीं।केवल “Astra” खोज (पोस्ट #1–4) विषय पर थी; अन्य 36 पोस्ट असंगत शोर थीं। - इस डेटा से पूर्णता मानदंड नहीं पूरे होते। ब्रीफ विषय के विरुद्ध प्रति प्लेटफ़ॉर्म लगभग 20 पोस्ट के विश्लेषण की माँग करता है; इस संग्रह में केवल 4 उपयोगी पोस्ट हैं, सभी एक क्लोज्ड-सोर्स लॉन्च (GPT-6 Astra) पर, और ओपन-सोर्स इमेज/वीडियो जनरेशन पर शून्य।X को ठीक से कवर करने के लिए “Stable Diffusion”, “ComfyUI”, “Flux”, “Kling AI”, “Runway”, “Sora”, “Midjourney”, “Wan 2.x”, या “HunyuanVideo” जैसे शब्दों से नया पास चाहिए।
- भौगोलिक चेतावनी: इस सत्र में X की Explore ट्रेंडिंग सूची क्रोएशिया-आधारित थी (अधिकांश प्रविष्टियों पर स्पष्ट रूप से “Trending in Croatia” लिखा था), इसलिए क्रिप्टो टोकन, बोस्नियाई फुटबॉल और बाल्कन-क्षेत्र समाचार/मीम हावी रहे—यह वैश्विक चित्र नहीं, एक सर्वर स्थान की ट्रेंड सूची है।
- ओपन-सोर्स कवरेज बिल्कुल नहीं। इस संग्रह में ओपन-सोर्स इमेज/वीडियो जनरेशन समाचार, टूल या रिलीज़ का कोई उल्लेख नहीं है—यह अंतर आंशिक नहीं, पूर्ण है।
YouTube
YouTube — छवि और वीडियो जनरेशन AI समाचार (क्लोज्ड सोर्स / ओपन सोर्स)
चैनल्स
YouTube खोज परिणामों और समाचार खोज से पाए गए चैनल।कई वीडियो पृष्ठ JavaScript से रेंडर होने के कारण सब्सक्राइबर संख्या सीधे सत्यापित नहीं हो सकी (विवरण के लिए ## Limits देखें)।
- Theoretically Media — Wan / FLUX / Qwen-Image जैसे ओपन-सोर्स जनरेटिव AI को हर बार ComfyUI में जांचने वाला जाना-पहचाना चैनल।("Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial..." https://www.youtube.com/watch?v=3BFDcO2Ysu4)
- Matt Wolfe / The Next Wave — Runway, Kling, Veo और Sora जैसे क्लोज्ड-सोर्स AI टूल्स की तुलना वाली सामग्री के लिए प्रसिद्ध।
- LTX-2.5, MiniMax H3 और Nano Banana 2 जैसे अलग-अलग मॉडल की समीक्षा करने वाले कई व्यक्तिगत AI-टूल चैनल (खोज परिणाम में चैनल नाम नहीं दिखे; केवल वीडियो शीर्षक सत्यापित हुए)।
वीडियो
क्लोज्ड-सोर्स पक्ष
- 「Nano Banana 2 Is INSANE – Full Test of Google's New Image Model!」 — लगभग 2026-02-26 — https://www.youtube.com/watch?v=k0dujOUePeU — Google के Gemini 3.1 Flash Image (उपनाम Nano Banana 2) को वास्तविक रूप से परीक्षण कर गति और इमेज गुणवत्ता के बीच समझौता खत्म होने का दावा।
- 「Nano Banana 2 vs Nano Banana Pro: I Tested Both So You Don't Have To」 — फरवरी 2026 के अंत में — https://www.youtube.com/watch?v=B1d3SIfoQLk — सामान्य और Pro आउटपुट की तुलना कर किसे चुनना चाहिए, इसकी जांच।
- 「Kling 3.0 Surprised Me! Compared To Veo 3.1 & Sora 2」 — लगभग 2026-02-05 — https://www.youtube.com/watch?v=AAD7wJ3DWiA — Kuaishou के Kling 3.0 को Veo 3.1 और Sora 2 से सीधे तुलना कर वीडियो यथार्थवाद और कैमरा कार्य में मजबूत बताया गया।
- 「Is Kling 3.0 Actually Good? (I Spent $500 Testing For You)」 — लगभग 2026-02-04 — https://www.youtube.com/watch?v=Rme22R7a9O8 — भुगतान करके Kling 3.0 के मल्टी-शॉट और 4K60fps आउटपुट का परीक्षण।
- 「Seedream 5.0 Tested & Seedance 2.5 Leaks Are Unreal!」 — लगभग 2026-07-15 — https://www.youtube.com/watch?v=pn-YwWn3kkM — ByteDance के Seedream 5.0 Pro इमेज मॉडल और अप्रकाशित Seedance 2.5 का परीक्षण (Seedance 2.1 को छोड़ देने का उल्लेख)।
- 「Seedance 2.5 Is Insane — 30 Seconds In ONE Shot?」 — लगभग 2026-06-23 — https://www.youtube.com/watch?v=8sGVhuoPOXI — Seedance 2.5 के एक शॉट में 30 सेकंड का सतत वीडियो बनाने की क्षमता का परीक्षण।
- 「MiniMax H3 Review | Testing Hailuo's New 2K AI Video Model」 — अगस्त 2026 की शुरुआत — https://www.youtube.com/watch?v=67CCQBAwZiA — 2026-07-31 रिलीज़ MiniMax H3 (Hailuo 3.0) का हैंड्स-ऑन परीक्षण; 2K, 15 सेकंड और मूल स्टीरियो ऑडियो की पुष्टि।
- 「Hailuo AI's NEW MiniMax H3 Model Is INCREDIBLE! (Full Test)」 — अगस्त 2026 के आसपास — https://www.youtube.com/watch?v=la0iBk8g8_g — MiniMax H3 की ऑम्निमोडल (टेक्स्ट, इमेज, वीडियो और ऑडियो को एक साथ इनपुट) सुविधा का व्यापक परीक्षण।
- 「FLUX 3 Sneak Peek」 — 2026-07-23 — https://www.youtube.com/watch?v=PCPhl8qMF_Y — Black Forest Labs के FLUX 3 (इमेज, 20-सेकंड वीडियो, ऑडियो और एक्शन वाला मल्टीमॉडल मॉडल; 2026-08-04 को Video GA) का शुरुआती परिचय।
- 「Gen-4.5 Updates — Research Demo Day 2025 | Runway」 — 2025-12-16 — https://www.youtube.com/watch?v=yNXxuzmiwEo — Runway के आधिकारिक चैनल से Gen-4.5 का तकनीकी अपडेट (कैमरा नियंत्रण और चरित्र निरंतरता)।
- 「All in one AI | Text to Image & Video AI | Kling, Veo, Sora, Nano Banana Pro | Daily Free Credits!」 — हाल का — https://www.youtube.com/watch?v=SnmRpf_VfgU — कई क्लोज्ड-सोर्स AI (Kling, Veo, Sora, Nano Banana Pro) को मुफ्त कोटा से एक साथ उपयोग करने की विधि।
ओपन-सोर्स पक्ष
- 「LTX 2.5 In ComfyUI — Setup, First Gens, And The Catch」 — अगस्त 2026 के मध्य (पोस्ट के लगभग तीन सप्ताह पहले, 2026-08-11 के LTX-2.5 ओपन-वेट्स रिलीज़ के बाद) — https://www.youtube.com/watch?v=RjlbDhs1MPk — Lightricks के 22B वर्ल्ड मॉडल LTX-2.5 को ComfyUI में मूल रूप से स्थापित कर, 10 सेकंड 720p वीडियो को 6.8 सेकंड में बनाने की गति की जांच।
- 「LTX 2.5 ComfyUI: Physics Test vs MiniMax H3 + Free Workflows」 — लगभग तीन सप्ताह पहले — https://www.youtube.com/watch?v=WpKNXZZqQEU — ओपन-वेट्स LTX-2.5 और गैर-सार्वजनिक MiniMax H3 को फिज़िक्स और मल्टी-शॉट में सीधे टकराकर तुलना।
- 「New LTX 2.5 Video Model is INSANELY Fast (ComfyUI Local)」 — लगभग तीन सप्ताह पहले — https://www.youtube.com/watch?v=pA2BQw9LY8A — स्थानीय निष्पादन की गति पर केंद्रित परीक्षण।
- 「Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models」 — Theoretically Media — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — Wan 2.2 (MoE वीडियो मॉडल), FLUX, FLUX Krea और Qwen Image को ComfyUI में एक साथ समझाया।Wan 2.2 को Sora के करीब निरंतरता वाला और FLUX को विवरण में बेहतर बताया गया।
- 「HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet」 — 2025-09-30 — https://www.youtube.com/watch?v=U-8RjjU7x14 — Tencent के 80B पैरामीटर MoE इमेज मॉडल का परिचय।Seedream 4.0, Nano Banana और GPT-Image के खिलाफ मामूली जीत दर का उल्लेख।
- 「Flux.2 Dev: Full Review, Pros & Cons, ComfyUI Setup!」 — लगभग 2025-11-26 — https://www.youtube.com/watch?v=MoAwonm53hQ — Black Forest Labs के FLUX.2 (ओपन-वेट्स संस्करण सहित) का ComfyUI सेटअप और समीक्षा।अधिकतम 10 संदर्भ छवियों से विषय की निरंतरता बनाए रखने की सुविधा दिखाई गई।
- 「FLUX 2 Released! 🤯 ComfyUI Install, Workflow & The "Active Parameter" Secret」 — लगभग 2025-11-26 — https://www.youtube.com/watch?v=nfeDS_EoblE — FLUX.2 को ComfyUI में स्थापित करने और नई सुविधाओं का विवरण।
- 「Qwen Image First Look & LOCAL Testing (The BEST New Image Model?)」 — 2025-08-05 — https://www.youtube.com/watch?v=ex2YCqtTHSY — Alibaba Qwen-Image के स्थानीय निष्पादन का प्रारंभिक परीक्षण (बाद के Qwen-Image-2512 का पूर्ववर्ती)।
- 「Qwen Image Edit 2511–Local Image Editing in ComfyUI | Multi-Reference Style Transfer & GGUF Workflow」 — 2025-12-26 — https://www.youtube.com/watch?v=iFnTqZmsRIc — Qwen Image Edit के बहु-संदर्भ इमेज स्टाइल ट्रांसफर को ComfyUI के GGUF वर्कफ़्लो में परीक्षण।
- 「MiniMax H3: The New Open-Source Video Champ?」 — अगस्त 2026 के आसपास — https://www.youtube.com/watch?v=3R5GROj8Tcg — MiniMax H3 को ओपन-वेट्स ऑम्निमोडल वीडियो मॉडल के रूप में प्रस्तुत किया गया (वीडियो एडिटिंग रैंकिंग में प्रथम होने के आकलन का उल्लेख)।
संकेत
- ओपन-वेट्स अत्याधुनिक मॉडल के बेहद करीब: LTX-2.5 (2026-08-11) और MiniMax H3 (2026-07-31) दोनों हाल के 60 दिनों में ओपन-वेट्स के रूप में आए, और वीडियो तुलना थंबनेल में “क्लोज्ड-सोर्स MiniMax H3 के बराबर/बेहतर” का दृष्टिकोण दिखाई देता है।ओपन-सोर्स अब केवल पीछे चलने वाला नहीं, बल्कि रिलीज़ के तुरंत बाद तुलना का विषय है।
- ByteDance का तेज रिलीज़ चक्र: Seedream 5.0 Pro और Seedance 2.5 (2.1 छोड़ा गया) हर कुछ महीनों में अपडेट हुए, और YouTuber टेस्ट वीडियो “Tested” और “Leaks” जैसी तात्कालिक भाषा रखते हैं।
- Google पक्ष का पुनर्गठन: पूरा Imagen लाइनअप 2026-08-17 को बंद होने वाला है और Nano Banana (Gemini 3.x Image श्रृंखला) की ओर संक्रमण जारी है।Nano Banana 2 (2026-02-26) के लिए भी पहले ही कई उत्तराधिकारी तुलना वीडियो (vs Pro) आ चुके हैं।
- क्लोज्ड-सोर्स दिग्गज की वापसी: OpenAI का Sora API 2026-09-24 को बंद कर अगली पीढ़ी के “Spud” मॉडल की ओर कंप्यूट संसाधन मोड़ने का इरादा है (खोज परिणाम से; YouTube वीडियो सत्यापित नहीं)।यह क्लोज्ड-सोर्स प्रवृत्ति में एक बड़ा बदलाव है।
- ComfyUI वास्तविक ओपन-सोर्स परीक्षण आधार: Wan, FLUX, Qwen-Image और LTX-2.5 जैसे ओपन-सोर्स मॉडल की लगभग सभी समीक्षा वीडियो ComfyUI इंस्टॉलेशन के साथ प्रस्तुत होती हैं।
सीमाएँ
- YouTube खोज परिणाम पृष्ठ (
youtube.com/results?...) और वीडियो पृष्ठ (youtube.com/watch?v=...) JavaScript से रेंडर होते हैं; सीधे फेच पर केवल फ़ूटर नेविगेशन लिंक मिले और व्यूज़, सब्सक्राइबर संख्या व पोस्ट तिथि का मूल डेटा (ytInitialDataआदि) नहीं पढ़ा जा सका।इसलिए तिथियाँ खोज इंजन स्निपेट में आई जानकारी (“3 weeks ago” जैसे सापेक्ष संकेतों या लेख उल्लेखों) से अनुमानित हैं; अधिकांश वीडियो के सही व्यूज़ व सदस्य संख्या की पुष्टि नहीं हुई। - OpenAI के Sora बंद होने और उत्तराधिकारी “Spud” पर सीधा YouTube वीडियो नहीं मिला; यह आइटम समाचार लेख के उल्लेख पर आधारित है (YouTube की प्रतिक्रिया वीडियो सत्यापित नहीं)।
- Runway Gen-4.5 या Midjourney के हालिया अपडेट पर आधिकारिक घोषणा वीडियो तो मिलीं, लेकिन स्वतंत्र समीक्षकों की हाल की (60 दिन के भीतर) परीक्षण वीडियो इस खोज में नहीं मिलीं।
- Nano Banana Pro की अलग समीक्षा वीडियो (शीर्षक “Nano Banana Pro… wtf” आदि) के लिंक सत्यापित हुए, लेकिन चैनल नाम और व्यूज़ नहीं मिल सके।
Bluesky
Bluesky — इमेज और वीडियो जनरेशन AI की नवीनतम प्रवृत्तियाँ
अकाउंट्स
- Simon Willison @simonwillison.net — LLM और इमेज मॉडल मूल्यांकन के लिए प्रसिद्ध डेवलपर।नए मॉडल के साथ नियमित “पेलिकन इमेज बेंचमार्क” तुलना पोस्ट करते हैं।फॉलोअर्स की प्रतिक्रिया भी अधिक है, इसलिए क्लोज्ड-सोर्स समाचारों का उपयोगी प्राथमिक स्रोत हैं।
- fofr @fofr.ai — Replicate से जुड़े इमेज-जनरेशन प्रॉम्प्ट विशेषज्ञ।Nano Banana Pro (Gemini 3 Pro Image) के व्यावहारिक उपयोग नियमित रूप से पोस्ट करते हैं।
- Replicate(आधिकारिक) @replicate.com — AI मॉडल API होस्टिंग कंपनी का आधिकारिक अकाउंट।हर नए मॉडल के Replicate पर आने पर घोषणा करता है, और क्लोज्ड/ओपन दोनों वीडियो मॉडल के रिलीज़ अपडेट का स्रोत बनता है।
- Amanda Silberling(TechCrunch रिपोर्टर) @amanda.omg.lol — AI इमेज जनरेशन के सांस्कृतिक पहलू पर रिपोर्ट करने वाली पत्रकार।
- AI News Updates @ai-latestnews.bsky.social — AI उद्योग समाचारों को स्वचालित रूप से पोस्ट करने वाला बॉट अकाउंट।
- gigowat @gigowat.bsky.social — जापानी गैजेट समाचार साइट GIGAZINE के लेख Bluesky पर साझा करने वाला अकाउंट।जापानी में इमेज जनरेशन AI समाचार के कुछ गिने-चुने स्रोतों में एक।
- ostris @ostris.com — ओपन-सोर्स LoRA प्रशिक्षण टूल “AI-Toolkit” के डेवलपर।Flex मॉडल संबंधी पोस्ट हैं, लेकिन उनके अनुसार “AI/ML समुदाय लगभग Twitter पर ही रह गया है”, इसलिए Bluesky पर अपडेट कम हैं।
पोस्ट्स
-
Simon Willison — GPT-6 Astra तथा GPT-5.6 Sol/Terra/Luna का पेलिकन इमेज तुलना ग्रिड पोस्ट किया (क्लोज्ड-सोर्स, OpenAI इमेज मॉडल तुलना)।2026-09-04, 👍91・🔁6・💬12。
https://bsky.app/profile/simonwillison.net/post/3mupxubgrls2c
फॉलो-अप में जनरेट की गई इमेज का पूर्ण आकार संस्करण भी पोस्ट किया (alt text भी GPT-5-astra द्वारा जनरेट)।👍23。
https://bsky.app/profile/simonwillison.net/post/3mupxztoyqs2c -
Simon Willison — Google Gemini 3.7 Flash द्वारा जनरेट पेलिकन इमेज की तुलना पोस्ट की।2026-09-02, 👍6。
https://bsky.app/profile/simonwillison.net/post/3muitt5g3q22r -
fofr — Nano Banana Pro(Gemini 3 Pro Image)में रेट्रो गेम जैसे रेंडरिंग को पुनःनिर्मित करने का विस्तृत प्रॉम्प्ट साझा किया।2026-01-19, 👍31。
https://bsky.app/profile/fofr.ai/post/3mcrt3avp222p
उसी दिन Street View-जैसे स्क्रीनशॉट जनरेशन का प्रॉम्प्ट भी पोस्ट किया।👍10。
https://bsky.app/profile/fofr.ai/post/3mcrilugr5c2m -
Replicate(आधिकारिक) — OpenAI का “GPT Image 2” Replicate पर उपलब्ध होने की घोषणा।फोटोरियलिज़्म, टेक्स्ट रेंडरिंग सटीकता और UI/डिज़ाइन उपयोग के लिए मजबूती बताई गई (क्लोज्ड-सोर्स)।2026-04-21。
https://bsky.app/profile/replicate.com/post/3mjzygaefs224 -
Replicate(आधिकारिक) — ByteDance का वीडियो जनरेशन मॉडल “Seedance 2.0” सभी उपयोगकर्ताओं के लिए खुलने की घोषणा।टेक्स्ट, इमेज, वीडियो और ऑडियो को एक दृश्य में मिलाता है और समकालिक स्टीरियो ऑडियो भी जनरेट करता है (क्लोज्ड-सोर्स)।2026-04-09。
https://bsky.app/profile/replicate.com/post/3mj3junhvnh26 -
Replicate(आधिकारिक) — Runway का Gen-4.5 Replicate में जोड़ा गया।भौतिक यथार्थवाद पर जोर देने वाला वीडियो जनरेशन मॉडल (क्लोज्ड-सोर्स)।2026-02-18。
https://bsky.app/profile/replicate.com/post/3mf5fbf6u4l2c -
Replicate(आधिकारिक) — Kuaishou का Kling 3.0(+o3)Replicate में जोड़ा गया।मल्टी-शॉट 4K और ऑडियो सिंक समर्थित (क्लोज्ड-सोर्स)।2026-02-17。
https://bsky.app/profile/replicate.com/post/3mf35lkhoyw2q -
Replicate(आधिकारिक) — वीडियो जनरेशन मॉडल “Vidu Q3” Replicate में जोड़ा गया।टेक्स्ट/इमेज/start-end फ्रेम से जनरेशन, अधिकतम 16 सेकंड और 1080p समर्थित (क्लोज्ड-सोर्स)।2026-03-11。
https://bsky.app/profile/replicate.com/post/3mgsan3ddpl2w -
Amanda Silberling(TechCrunch) — AI-जनित भोजन की तस्वीरों का रूप अक्सर अलग क्यों होता है, इस पर विशेषज्ञ टिप्पणियाँ मांगने वाली पोस्ट।AI इमेज जनरेशन की सौंदर्यात्मक आदतों पर रिपोर्टिंग अनुरोध।2026-08-28, 👍17・🔁5・💬4。
https://bsky.app/profile/amanda.omg.lol/post/3mu5itcncgc2x -
AI News Updates(बॉट) — रिपोर्ट किया कि “Midjourney Inc. ने ज्योतिष ऐप Co-Star खरीदा और नया इमेज जनरेशन ऐप शुरू करेगा।”2026-07-25।यह TechCrunch और Bloomberg की रिपोर्ट (2026-07-24; अधिग्रहण इस वसंत में पूरा होने की खबर) से मेल खाता है और सत्यापन योग्य है।
https://bsky.app/profile/ai-latestnews.bsky.social/post/3mrh6gdxnqy2s -
gigowat(GIGAZINE लेख का जापानी शेयर) — ओपन-सोर्स इमेज जनरेशन AI “Qwen-Image-3.0” आने और इलस्ट्रेशन व जापानी टेक्स्ट रेंडरिंग के प्रदर्शन का परीक्षण करने वाले GIGAZINE लेख को साझा किया।2026-07-22。
https://bsky.app/profile/gigowat.bsky.social/post/3mr7dvb332z2q
(मूल लेख: https://gigazine.net/news/20260722-qwen-image-3/ ) -
ostris — ओपन-सोर्स इमेज जनरेशन मॉडल “Flex.2-preview”(text-to-image, universal control और inpainting को एकीकृत करने वाला)की रिलीज़ घोषणा।कुछ पुरानी पोस्ट (2025-04-22), लेकिन Bluesky पर ओपन-सोर्स मॉडल डेवलपर की प्रत्यक्ष पोस्ट के दुर्लभ उदाहरणों में एक।👍4。
https://bsky.app/profile/ostris.com/post/3lngo5cf66k2a
संकेत
- क्लोज्ड-सोर्स का पलड़ा भारी:Bluesky पर वास्तविक एंगेजमेंट वाली पोस्ट GPT, Gemini (Nano Banana Pro) और Midjourney जैसे बड़े क्लोज्ड मॉडल पर केंद्रित थीं।विशेषकर Simon Willison का “पेलिकन इमेज बेंचमार्क” हर नए मॉडल के साथ स्थिर तुलना देता है और व्यवहार में क्लोज्ड इमेज मॉडल गुणवत्ता-जांच स्थल बन गया है।
- Replicate अकाउंट वीडियो जनरेशन का त्वरित अपडेट हब:Kling 3.0, Seedance 2.0, Runway Gen-4.5 और Vidu Q3 जैसे 2026 के प्रमुख वीडियो मॉडल रिलीज़ लगातार Replicate आधिकारिक अकाउंट के माध्यम से आए।लाइक कम (1〜2) होने पर भी मॉडल आगमन क्रम का पता लगाने में उपयोगी रहा।
- Bluesky पर ओपन-सोर्स पक्ष की पोस्टिंग कमज़ोर:Wan 2.7 (Alibaba), HunyuanVideo 1.5 (Tencent), Chroma और LTX-2.3 जैसे 2026 के प्रमुख ओपन-वेट्स मॉडल पर Bluesky में प्राथमिक उल्लेख लगभग नहीं मिला।ओपन-सोर्स LoRA प्रशिक्षण टूल के डेवलपर ostris ने भी लिखा कि “AI/ML समुदाय लगभग Twitter पर ही बचा है”, जिससे समुदाय का केंद्र X पर झुका हुआ दिखता है।
- जापानी पोस्ट मुख्यतः GIGAZINE साझा करने तक सीमित:जापानी भाषा की पोस्ट gigowat जैसे समाचार साइट लेखों के पुनर्प्रकाशन पर केंद्रित थीं; मौलिक प्राथमिक विश्लेषण नहीं मिला।
सीमाएँ
- Bluesky की आधिकारिक पोस्ट खोज API(
app.bsky.feed.searchPosts)ने इस सत्र के WebFetch टूल में लगातार403 Forbiddenलौटाया, जिससे कीवर्ड-आधारित, लाइक व रीपोस्ट संख्या सहित व्यापक संग्रह नहीं हो सका (getProfile、getAuthorFeed、getPostThreadऔर oEmbed सामान्य रूप से काम करते थे)।इसलिए Google खोज से मिले ज्ञात अकाउंट्स कोgetAuthorFeedसे व्यक्तिगत रूप से जांचने की पद्धति अपनाई गई। bsky.appका खोज पृष्ठ JavaScript-रेंडर्ड SPA है, इसलिए WebFetch (HTML→Markdown रूपांतरण मात्र) से पोस्ट का मुख्य टेक्स्ट नहीं मिल सका।- इन बाधाओं के कारण “विशिष्ट मॉडल नाम से खोजकर सभी संबंधित पोस्ट जांचना” जैसा व्यापक सर्वे नहीं हो सका; प्रमुख अकाउंट्स की हाल की पोस्टों में से विषय-संगत पोस्ट चुनी गईं।कुल मिलाकर 20 से अधिक पोस्ट/फीड देखे गए, लेकिन इमेज/वीडियो जनरेशन AI से सीधे जुड़ी लगभग 12 पोस्ट ही मिलीं।
- Wan, HunyuanVideo, Chroma, Z-Image और LTX-2.3 जैसे ओपन-सोर्स मॉडल के लिए Bluesky पर संबंधित कई अकाउंट देखे गए, पर 2026 की संबंधित पोस्ट नहीं मिलीं।huggingface.bsky.social की पोस्ट फीड खाली थी और civitai-bot.bsky.social मई 2024 से अपडेट नहीं हुआ था।
- “Midjourney Meta.ai का हिस्सा बन गया” अर्थ वाली निजी अकाउंट पोस्ट (फरवरी 2026) मिली, पर बाहरी रिपोर्ट से सत्यापन करने पर यह वास्तव में अगस्त 2025 का लाइसेंस समझौता था (Midjourney स्वतंत्र रहा), अधिग्रहण नहीं; इसलिए गलत जानकारी के रूप में रिपोर्ट में शामिल नहीं किया गया।
Lemmy
Lemmy — इमेज और वीडियो जनरेशन AI की नवीनतम प्रवृत्तियाँ (क्लोज्ड/ओपन सोर्स)
समुदाय (Communities)
- !«メールアドレス» — 5,708 लोग।ओपन-वेट्स इमेज और वीडियो जनरेशन AI पर तकनीकी चर्चा।इस सर्वे में सबसे अधिक सूचना-घनत्व वाला समुदाय।
- !«メールアドレス» — 2,360 लोग।Stable Diffusion मॉडल से बने कार्यों का स्थान।समाचार स्वयं कम हैं।
- !«メールアドレス» — 1,593 लोग।एनीमे AI कला के लिए विशेष।समाचार मूल्य कम।
- !«メールアドレス» — 50 लोग।Reddit RSS के स्वचालित पुनर्प्रकाशन वाला समुदाय (बॉट संचालन); मानवीय चर्चा न होने पर ध्यान दें।
- !«メールアドレス» और !«メールアドレス» — सामान्य तकनीकी समाचार।इमेज/वीडियो जनरेशन AI के अलग हिट कम हैं और सामान्य AI लेखों में दबे रहते हैं।
- इमेज/वीडियो जनरेशन AI के लिए Reddit के r/StableDiffusion स्तर का बड़ा समुदाय Lemmy पर नहीं है; विषय ऊपर के छोटे समुदायों में बंटा हुआ है।
पोस्ट्स (Posts)
ओपन-सोर्स पक्ष
- MiniMax H3: Comfy व्यावसायिक लाइसेंस का आधिकारिक रीसेलर बना — !«メールアドレス»、स्कोर 4、2026-08-28。मूल लेख: https://blog.comfy.org/p/comfy-is-now-the-only-official-reseller 。MiniMax H3 अगस्त 2026 में प्रकाशित ओपन-वेट्स वीडियो जनरेशन मॉडल है, जो RTX 3060-स्तर GPU पर स्थानीय रूप से चलकर 2K और मूल स्टीरियो ऑडियो वाले वीडियो बना सकता है।Comfy व्यावसायिक लाइसेंस (Professional/Enterprise) का विक्रेता बना, और Enterprise में बिना डिस्टिल किया मॉडल तक इस्तेमाल हो सकता है।
- LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes — !«メールアドレス»、स्कोर 2、2026-09-04。https://arxiv.org/abs/2609.03796 。पूरी तरह प्रकाशित ट्रेनिंग रेसिपी वाला इमेज मॉडल, Qwen-Image-Bench पर शीर्ष स्तर का स्कोर और तेज डिस्टिल्ड टर्बो संस्करण भी है।
- Trellis.2 और Pixal3D का ComfyUI में मूल एकीकरण — !«メールアドレス»、स्कोर 4、2026-09-01。https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native 。घोषणा: “सर्वश्रेष्ठ ओपन 3D जनरेशन मॉडल अब ComfyUI कोर का हिस्सा हैं।”
- ComfyUI-MiniMaxH3-CLSS — !«メールアドレス»、स्कोर 0、2026-09-01。https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS 。MiniMax H3 के लिए टूल, जो 16GB VRAM के उपभोक्ता हार्डवेयर पर भी किसी भी लंबाई के ऑडियो-सहित वीडियो जनरेशन को संभव बनाने का दावा करता है।
- Fizgig LoRA/LoKR Studio — !«メールアドレス»、स्कोर 4、2026-08-30。https://github.com/shootthesound/Fizgig 。Krea 2, MiniMax और Klein 9B सहित कई मॉडल परिवारों के लिए LoRA/LoKR ट्रेनिंग और निष्कर्षण का ओपन टूल।
- VibeVoice-ComfyUI(Microsoft के ओपन TTS को ComfyUI में एकीकृत करना) — !«メールアドレス»、स्कोर 1、2026-08-28。https://github.com/nikhilprasanth/VibeVoice-ComfyUI 。वीडियो जनरेशन वर्कफ़्लो में ऑडियो शामिल करने की दिशा का एक उदाहरण।
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス»、स्कोर 5、2026-06-17。हल्का और दक्षता-केंद्रित ओपन इमेज जनरेशन फाउंडेशन मॉडल।
क्लोज्ड-सोर्स पक्ष
- Midjourney का इमेज जनरेशन AI से मेडिकल अल्ट्रासाउंड स्कैनर व्यवसाय की ओर पिवट — !«メールアドレス»、स्कोर 58、2026-06-18。https://lemmy.zip/post/66397234 。संबंधित थ्रेड कई हैं (Hacker News मिरर आदि, स्कोर 40〜), जहाँ “Midjourney Medical” और “Ultrasonic CT” पर बड़ी बहस हुई।पुराने क्लोज्ड इमेज जनरेशन सेवा के दिशा-परिवर्तन की सबसे बड़ी खबर।
- Midjourney ने हॉलीवुड स्टूडियो से AI उपयोग का विस्तृत खुलासा माँगा — !«メールアドレス»、स्कोर 73、2026-07-05。https://lemmy.today/post/56011946
- Google का नया इमेज जनरेशन मॉडल “Nano Banana 2 Lite” रिलीज़ — !«メールアドレス»、स्कोर 0、2026-07-02。https://lemmy.world/post/48936394(hackernews मिरर: https://lemmy.bestiver.se/post/1199483 )
- Microsoft का MAI-Image-2.5 बेंचमार्क में Google के Nano Banana 2 के करीब पहुँचा — !«メールアドレス»、स्कोर 1、2026-05-28。https://lemmy.durstig.online/post/35068
- Seedream 5.0 Pro की वास्तविक तुलना समीक्षा — !«メールアドレス»、स्कोर 1、2026-07-10。https://lemmy.durstig.online/post/46063
- Runway ने एंटरप्राइज़ व्यवसाय दोगुना और नेट रेवेन्यू रिटेंशन 300% से अधिक बताया — !«メールアドレス»、स्कोर 0、2026-08-30。https://lemmy.durstig.online/post/56937
- Google का Earth AI फ़ीचर, रिलीज़ के अगले दिन NSFW जनरेशन मुद्दे पर चुपचाप वापस लिया गया — !«メールアドレス»、स्कोर 1、2026-08-07。https://lemmy.durstig.online/post/52162
संकेत (Signals)
- ओपन-सोर्स पक्ष “MiniMax H3” से भरा हुआ:अगस्त अंत से सितंबर आरंभ तक stable_diffusion समुदाय की लगभग आधी पोस्ट MiniMax H3 (वीडियो जनरेशन, RTX 3060-स्तर पर लोकल चलना, ऑडियो सहित) से जुड़े ComfyUI एक्सटेंशन और गति-वृद्धि टूल पर थीं।यह ओपन वीडियो जनरेशन का वास्तविक मानक बनता दिख रहा है।
- ओपन और क्लोज्ड की सीमा धुंधली:MiniMax H3 “ओपन-वेट्स” है, लेकिन व्यावसायिक उपयोग Comfy के पेड लाइसेंस से होता है।मुफ्त उपयोग, पर वाणिज्यिक उपयोग के लिए भुगतान—ऐसा ओपन/क्लोज्ड हाइब्रिड मॉडल मुख्यधारा बनने के संकेत हैं।
- क्लोज्ड पक्ष की सबसे बड़ी खबर “वापसी”:नए मॉडल प्रतिस्पर्धा से ज्यादा, Midjourney के इमेज जनरेशन से मेडिकल उपकरणों की ओर जाने वाली खबर का स्कोर बहुत अधिक (58〜73) था और Lemmy उपयोगकर्ताओं की रुचि का केंद्र बनी।
- 3D जनरेशन भी ComfyUI में शामिल हो रहा है:Trellis.2 और Pixal3D जैसे ओपन Text/Image-to-3D मॉडल ComfyUI की मुख्य सुविधाओं का हिस्सा बने, और इमेज/वीडियो के साथ 3D एसेट जनरेशन भी स्थानीय वर्कफ़्लो में आ रहा है।
- Lemmy में इमेज/वीडियो जनरेशन AI का कोई बड़ा विशेष समुदाय नहीं है、इसलिए चर्चा हजारों सदस्यों वाले तकनीकी stable_diffusion समुदायों और Reddit लेखों को ऑटो-पोस्ट करने वाले 50-सदस्यीय ai_reddit जैसे छोटे बॉट समुदायों में बँटी है।
सीमाएँ (Limits)
- Lemmy फेडरेटेड (fediverse) है और खोज API केवल एक इंस्टेंस के इंडेक्स को कवर करती है, इसलिए
lemmy.worldAPI खोज मेंlemmy.dbzer0.comऔरlemmy.todayजैसे अन्य इंस्टेंस की पोस्ट छूट जाती हैं।इस बार कई इंस्टेंस के API और खोज को मिलाकर पूरक किया गया, लेकिन यह पूर्ण कवरेज नहीं है। lemmy.mlकेlocalllamaसमुदाय की प्रत्यक्ष समुदाय जानकारी (/api/v3/community) 404 के साथ विफल हुई और विवरण नहीं देखा जा सका।!«メールアドレス»Reddit RSS को यांत्रिक रूप से पुनर्प्रकाशित करने वाला बॉट समुदाय है; 50 सदस्य हैं और मानवीय चर्चा लगभग नहीं है।यह प्राथमिक समाचार स्रोत के रूप में उपयोगी हो सकता है, मगर “Lemmy में चर्चा की गर्मी” का सूचक नहीं है।- Sora, Kling, Runway Gen और Veo जैसी क्लोज्ड वीडियो जनरेशन सेवाओं के लिए Lemmy पर सीधी खोज (
Sora、Kling AI、Veo、Runway Gen) में लगभग असंबद्ध पोस्ट ही मिले (स्थान-नाम, व्यक्ति-नाम और सामयिक समाचार)।Runway पर वित्तीय परिणाम से जुड़ी केवल एक पोस्ट मिली। - Reddit आदि की तुलना में पोस्ट संख्या बहुत कम है (स्कोर मुख्यतः एकल अंक से कुछ दर्जन), इसलिए केवल Lemmy पर “20 पोस्ट पढ़कर रुझान बताने” जितना आधार नहीं है।इस बार सात प्रकार की संबंधित खोज क्वेरी और कई इंस्टेंस चलाकर वास्तविक पोस्टों में से प्रतिनिधि उदाहरण चुने गए।
Pinterest — इमेज और वीडियो जनरेशन AI समाचार
दृश्य विषय
- “YouTube थंबनेल/ब्लॉग हीरो इमेज” शैली की भारी बहुलता। काला से गहरा नीला बैकग्राउंड, नियॉन नीला, बैंगनी और नारंगी ग्रेडिएंट, और मोटे sans-serif शीर्षक (“AI NEWS”, “THE FUTURE IS AI”, “BREAKING NEWS”, “AI IS CHANGING EVERYTHING!” आदि)।असल जनरेटेड आउटपुट से अधिक “AI पर बात करने वाले लेख/वीडियो” के कवर दिखे [2, 7, 11, 38, 39, 42, 48]
- मानवीय चेहरा और पोर्ट्रेट केंद्रीय मोटिफ। भाव-भंगिमा एनीमेशन, लिप-सिंक, चेहरा पुनर्निर्माण (Microsoft VASA-1), AI पोर्ट्रेट शूट (ChatGPT+Higgsfield) जैसे “चेहरा चलाना/बनाना” उपयोग बार-बार दिखे [13, 14, 18, 23, 50]
- ह्यूमनॉइड/रोबोट दृश्य “AI” का सामान्य प्रतीक बनकर बहुत उपयोग हुए। विशिष्ट टूल से असंबद्ध सफेद रोबोट के साइड प्रोफाइल और साइबॉर्ग जैसी महिलाओं की सामान्य स्टॉक छवियाँ अधिक थीं [2, 39]
- “Before/After”, एक इनपुट इमेज से कई स्टाइल आउटपुट ग्रिड। वास्तविक वीडियो को लकड़ी, ओरिगामी, Lego ब्लॉक या फूलों में बदलने वाले तुलना ग्रिड (Luma-प्रकार टूल का अनुमान), और प्लश कैरेक्टर को वास्तविक बैकग्राउंड में मिलाने वाली तुलना छवियाँ [3, 31]
- टूल तुलना और रैंकिंग इन्फोग्राफिक। लोगो के साथ सूची, “Best Quality (Paid) vs Best Free” तुलना तालिका, चेकमार्क वाली सुविधा तुलना जैसे टूल चयन में सहायक सारांश चित्र दिखे [7, 37]
- वास्तविक प्रसिद्ध व्यक्ति जैसे चेहरे वाले थंबनेल। Jeff Bezos-जैसे AI पोर्ट्रेट, दाढ़ी वाले YouTuber-सदृश “AI NEWS” व्याख्याता, NVIDIA के Jensen Huang की भाषण फोटो जैसी चीज़ें विश्वास या चर्चा आकर्षित करने हेतु इस्तेमाल हुईं [11, 36, 40]
- फेस-मेश/वायरफ्रेम ओवरले दृश्य। चेहरे और गर्दन पर ग्रिडलाइन और संख्यात्मक लेबल वाला, भाव विश्लेषण या बायोमेट्रिक पहचान जैसा दृश्य विज्ञापनात्मक पिनों में था [23, 50]
- रंग पैलेट की एकरूपता। डार्क आधार के साथ सियान/मैजेंटा/पीला नियॉन ऐक्सेंट AI टूल पिनों की लगभग साझा दृश्य भाषा थी [2, 7, 38, 39, 42]
उल्लेखनीय पिन
- [1] Image to Video AI: How It Works and Why It Matters — एक स्थिर छवि से बहु-फ्रेम “वीडियो टाइमलाइन” बनाने की प्रणाली को समझाने वाले लेख का हीरो चित्र।
- [3] Google announces ultra-high quality video...(वास्तव में Luma-प्रकार की पहचान-संरक्षित स्टाइल ट्रांसफर डेमो) — स्रोत वीडियो को लकड़ी, ओरिगामी, Lego और फूल जैसे पदार्थों में बदलने वाला 3×5 ग्रिड।एक ही व्यक्ति और कार की निरंतरता रखते हुए केवल टेक्सचर बदलने के तकनीकी डेमो के रूप में स्पष्ट।
- [7] 6+ Best AI Video Generation Websites — Runway, Pika, Kling AI, Luma AI (Dream Machine), Canva AI और Hailuo AI के छह टूलों को सुविधाएँ, लक्षित उपयोगकर्ता और मुफ्त योजना सहित दर्शाने वाला सहेजने योग्य इन्फोग्राफिक।
- [10] Veo 2 — Google के VideoFX का प्रचार पिन।माइक्रोस्कोप में देखते फोटो-जैसे शॉट, पानी के नीचे तैराक और तारामंडल के साथ नाचती एनीमे-शैली महिला सहित कई वीडियो शैलियों को एक चित्र में रखा गया।
- [14] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Gemini API से इमेज से वीडियो जनरेशन उपलब्ध होने का प्रचार चित्र, जिसमें मूल ऑडियो समर्थन पर जोर है।
- [23] Microsoft Unveils VASA-1 — केवल एक फोटो, एक ऑडियो क्लिप और मनचाहे नियंत्रण संकेत से लगभग रियल-टाइम, भावपूर्ण बोलता चेहरा वीडियो बनाने की तकनीक।कई नस्लों और अभिव्यक्तियों के थंबनेल साथ दिखते हैं।
- [27] ShengShu Technology Unveils Vidu S1 — चीनी ShengShu Technology के “रियल-टाइम, इंटरैक्टिव जनरेशन” दावे वाले Vidu S1 का घोषणा पिन।साइबरपंक-शैली कैरेक्टर दृश्य।
- [31] Google announces video generation AI 'Veo 3' — इनपुट इमेज (बैंगनी मॉन्स्टर प्लश) को वास्तविक सर्वर रूम, पानी के भीतर खंडहर और कैंडी सिटी में मिलाने वाले चार आउटपुट उदाहरण।
- [33] 'Amuse 3.0', an AI art creation tool — AMD के लोकल-रन (Stable Diffusion-आधारित) इमेज जनरेशन टूल के नए संस्करण की घोषणा।क्लोज्ड-सोर्स सामग्री के बहुमत में, स्थानीय/ओपन दिशा का दुर्लभ ठोस संकेत।
- [42] Breaking News Latest AI Developments — Grok 4.6 एजेंट फीचर, Gemini के 1 अरब उपयोगकर्ता (प्रति दिन 15 करोड़ इमेज जनरेशन), और Honor AI रोबोट फोन वाली तीन-भाग समाचार सारांश छवि (12 अगस्त 2026)।
संकेत
- क्लोज्ड-सोर्स की उपस्थिति उल्लेखनीय। Google Veo 2/Veo 3, Microsoft VASA-1, OpenAI, Grok 4.6 और Gemini (1 अरब उपयोगकर्ता) जैसी बड़ी घोषणाएँ सीधे पिन विषय बनती हैं।इसके विपरीत, Stable Diffusion, ComfyUI, Flux, Wan, HunyuanVideo और LTX जैसे सामान्य ओपन-सोर्स नामों में से नमूना छवियों में [33] Amuse 3.0 (AMD का लोकल टूल) के अलावा लगभग कोई नहीं मिला।Pinterest तकनीकी समुदाय के बजाय सामान्य उपभोक्ता और मार्केटर के सारांश/तुलना कंटेंट की ओर झुका लगता है।
- चेहरे को चलाने और बनाने वाले उपयोगों पर एकाग्रता। लिप-सिंक, चेहरे के भाव पुनर्निर्माण, पोर्ट्रेट फोटोग्राफी के विकल्प और समाचार एंकर-जैसे AI वीडियो बार-बार दिखे।यह Pinterest की खोज मांग (सौंदर्य, स्वयं-सुधार और सोशल पोस्ट आइडिया) तथा AI वीडियो मार्केटिंग के मेल का परिणाम प्रतीत होता है।
- प्राथमिक जानकारी से अधिक द्वितीयक सारांश। वास्तविक मॉडल आउटपुट स्क्रीनशॉट की तुलना में “व्याख्याता का चेहरा + हेडलाइन टेक्स्ट” थंबनेल और टूल-तुलना इन्फोग्राफिक अधिक हैं।Pinterest प्राथमिक घोषणा फैलाने के स्थान से अधिक ब्लॉग, YouTube वीडियो और एफिलिएट लेखों का प्रवेश-बिंदु है।
- अनुपस्थिति का संकेत: नमूने में जापानी भाषा पोस्ट या कंपनियों (उदाहरण के लिए जापानी AI स्टार्टअप या घरेलू वीडियो जनरेशन सेवाएँ) का उल्लेख नहीं मिला।लगभग पूरा हिस्सा अंग्रेज़ीभाषी टूल और समाचारों का था।
सीमाएँ
output/pinterest.pins.mdके 50 में से प्रतिनिधित्व ध्यान में रखकर 24 छवियाँ वास्तव में खोलकर जांची गईं (बाकी 26 के लिए केवल शीर्षक; अनुमान है कि वे भी खुले चित्रों जैसे इन्फोग्राफिक/चेहरे के पोर्ट्रेट/टूल तुलना पैटर्न में आते हैं)।- आठ पिन के शीर्षक “(untitled)” थे ([12, 19, 20, 30, 35, 39, 46, 50]); इनमें [39] और [50] की इमेज देखी गई, बाकी नहीं।
- इस चरण के कार्यकर्ता संग्रह डेटा में शैली विभाजन नहीं था (
pinterest.pins.mdएक फ्लैट सूची है), इसलिए शैली-वार विभाजन नहीं बनाया गया। - Pinterest को इस बार सीधे ब्राउज़ नहीं किया गया; प्लेबुक निर्देश के अनुसार केवल कार्यकर्ता की पूर्व-संग्रहित छवियों और शीर्षकों से विश्लेषण हुआ।पिन के लाइक, सेव और टिप्पणी जैसी एंगेजमेंट मेट्रिक्स उपलब्ध नहीं थीं।
अनुशंसित कार्य
- ट्रेंडिंग टॉपिक सूची पर निर्भर रहने के बजाय X पर स्पष्ट मॉडल/टूल शब्दों (Stable Diffusion, ComfyUI, Flux, Wan, Kling, Sora) के साथ खोज फिर चलाएँ।
- चूँकि इस रन में app.bsky.feed.searchPosts ने 403 लौटाया, getAuthorFeed के जरिए पोल करने के लिए ज्ञात Bluesky अकाउंट्स की स्थायी सूची बनाएँ।
- MiniMax H3 जैसे हाइब्रिड ओपन/वाणिज्यिक मॉडल को किसी एक सरल ओपन-सोर्स श्रेणी में डालने के बजाय स्पष्ट रूप से चिह्नित करें।
- बड़े विक्रेताओं के पिवट या शटडाउन (Midjourney का मेडिकल पिवट, Sora API का अंत) के लिए बार-बार निगरानी आइटम रखें, क्योंकि Reddit और Lemmy पर उन्हें शुद्ध प्रोडक्ट-लॉन्च समाचार से ज्यादा प्रतिक्रिया मिली।
- ओपन-सोर्स कवरेज लगभग न होने के कारण Pinterest को प्राथमिक तकनीकी स्रोत के बजाय उपभोक्ता भावना के संकेतक के रूप में देखें।
संग्रहित छवियाँ


















































डेटा गुणवत्ता नोट
X और Bluesky दोनों ब्रीफ के प्रति-प्लेटफ़ॉर्म लगभग 20 पोस्ट मानक से बहुत पीछे रहे (X ने केवल चार विषय-संगत पोस्ट दिखाईं, सभी क्लोज्ड-सोर्स; Bluesky की खोज API ने 403 दिया, इसलिए कवरेज ज्ञात अकाउंट्स पर निर्भर रहा)।Reddit, Lemmy और YouTube ने भी लक्ष्य से कम सामग्री एकत्र की, और JavaScript-रेंडर्ड पृष्ठों के कारण YouTube व्यू/सब्सक्राइबर संख्या की पुष्टि नहीं हो सकी।



