图像与视频生成 AI 新闻 — 2026-09-30
OpenAI 已全面终止 Sora 应用和 API;与此同时,来自中国的开源/开放权重模型——包括阿里巴巴的 Qwen-Image-2.1 与 Z-Image,以及腾讯的 HunyuanVideo 1.5——正在 Lemmy、Bluesky、Reddit 和 YouTube 上同步崛起。
图像与视频生成 AI 最新新闻 — 2026-09-30
坦白说,目前最火的两件事就是「Sora 消失」和「中国开源模型狂欢」🔥。在闭源阵营,OpenAI 于 2026-09-24 完全终止 Sora 应用和 API,是一条真正重磅的消息;Google 的 Nano Banana Pro(Gemini 3 Pro Image)则看起来正在争夺图像生成的王座。开放阵营方面,阿里巴巴的 Qwen-Image-2.1、Z-Image,以及腾讯的 HunyuanVideo 1.5,正在 Reddit、Lemmy、Bluesky 和 YouTube 多点爆发,几乎成了中国团队一枝独秀的局面🐉。不过,Qwen-Image-2.1 也到处被指出「虽然是开放权重,但许可证不允许商业使用」,因此它究竟能不能称为“开源”也成为争论的一部分。此外,整体来看,比起技术新闻本身,「AI 制作的图像/视频被识破或被滥用」类的争议话题似乎更容易传播。
跨平台观察
- 中国开源三剑客(Qwen-Image-2.1 / Z-Image / HunyuanVideo 1.5)在四个平台上被独立观察到。Lemmy 的 !stable_diffusion 中出现了大量 ComfyUI 集成帖子(LanPaint、fooocus-qwen-image-2.1 等);Bluesky 上也有个人账号进行最快速的报道;Reddit 的 r/StableDiffusion 帖子「Vlo 0.3」内置了 Qwen2.1 工作流;YouTube 上也有多个频道密集发布评测视频。这无疑是当前最热的共同趋势🔥
- 「开放权重但不是真正开源」的问题在 YouTube 与 Lemmy 上被同时指出。YouTube 端明确提到 Qwen-Image-2.1 使用研究用途许可证、不允许商业再分发;Lemmy 端也零星出现了有关许可证的讨论。
- Sora 终止的余波不只影响 YouTube,也波及 Reddit。r/SoraAi 中,「是不是为 Sora 3 铺路?」「听说核心开发者已经离职」之类的猜测讨论很热闹(帖子 7,55pt),氛围和 YouTube 上一波「替代工具介绍视频」如出一辙。
- AI 生成内容「被识破/被滥用」的话题,分别在 Reddit、Lemmy、Pinterest 上浮现。Nikon 摄影比赛的 AI 处理争议(Reddit r/labrats,1,113pt)、Google Earth AI 批量生成屠杀伪图后 24 小时内撤回(Lemmy)、NBC 新闻在天气播报员视频上标注「AI GENERATED」(Pinterest)——虽然类别不同,但每个社交平台都弥漫着「太像真的反而很危险」的气氛。
- 企业官方账号并未有效承担新闻发布源的角色。在 Bluesky 上,Black Forest Labs 与 Kling AI Video 均为 0 帖,RunwayML 两年内也只有 1 帖。无论哪个平台,个人技术账号与专业社区(Lemmy 的 !stable_diffusion、Reddit 专业子版)都比官方渠道更快、更详细。
按平台划分
Reddit — 由于搜索词只有一个固定短语,仅找到 11 个帖子(约为 20 条目标的一半),而且 r/StableDiffusion、r/SoraAi 等专业子版也各只有一帖。尽管如此,r/singularity 中获得 1,554pt 的帖子「Video models are getting good」里充满了对逼真视频的震惊评论,清楚反映出闭源视频的质量正在快速跃升📈。开放阵营中,ComfyUI 本地运行用户所说的「除了电费全免费」尤其令人印象深刻。
X — 完全扑空😅。收集到的 40 条帖子中,实际上几乎没有任何一条涉及 AI 图像或视频生成。搜索词直接来自 X Explore(克罗地亚地区趋势),内容是意大利对土耳其足球、Big Brother 等话题,与图像/视频生成 AI 毫无关系。唯一因为「Anthropic」命中的帖子也是股价和 Skills 工具相关,和图像/视频生成无关。这不是 X 平台本身的局限,而是本次收集方法——通过 Explore 获取搜索词——与研究主题不匹配所致。
YouTube — 信息密度最高🎬。可以较完整地追踪 Sora 终止的时间线(应用于 4 月 26 日下线、API 于 9 月 24 日停止,以及据称每天 15 亿日元级别的运行成本是原因),多个频道也都在谈 Nano Banana Pro 的领先优势。开放阵营方面,Qwen-Image-2.1、Z-Image Turbo/Base、HunyuanVideo 1.5 的快速评测齐全,是最能从数据和内容量感受到中国团队势头的平台。不过,YouTube 搜索结果页面本身由 JS 渲染,无法直接读取,播放量等数据主要依赖二手信息。
Bluesky — 帖子搜索 API 被 403 封锁,只能靠逐个检查账号的笨办法💪。尽管如此,仍找到了 Qwen-Image-2.1 的最快个人报告(81 个赞,是本次确认中反响最大的帖子),以及 SkyReels V1、HunyuanVideo I2V 的测试帖子。相反,一个意外发现是 Black Forest Labs、Kling AI Video 等官方账号均为零发帖,因此它几乎没有作为企业新闻发布渠道发挥作用。此外,许多插画师明确标注「NO AI」,使 Bluesky 给人一种反 AI 情绪相当浓厚的平台印象。
Lemmy — 开源信息量绝对第一🏆。仅 !«メールアドレス» 在最近两周就发布了 20 多个工具与模型帖子,能实时看到围绕 Qwen-Image-2.1 的 ComfyUI 集成热潮。反过来,闭源侧只会以新闻转载或「Grok 滥用导致自杀」之类的事件性语境出现;Lemmy 整体也强烈批评“AI slop”,因此对 AI 保持怀疑态度。
Pinterest — 是闭源 SaaS 对比内容的聚集地🖼️。大量信息图并列 Runway、Pika、Kling、Luma、Canva、Hailuo,讲解「该选哪个」;也能找到 Veo 3、Gemini Omni,以及中国的 ShengShu Vidu S1 等具体新模型公告。开源方面只有 AMD Amuse 3.0 零星出现,几乎没有 ComfyUI、LoRA 等技术社区色彩——考虑到 Pinterest 的普通消费者用户群,这种偏向并不意外。
值得关注
- OpenAI 的下一代视频模型(据称代号为“Spud”)——作为 Sora 终止后的接班者,值得重点关注。YouTube「OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans」 https://www.youtube.com/watch?v=9rhmczPT6Jk
- Qwen-Image-2.1 的许可证问题——开放权重但不允许商业使用,未来走向如何值得观察。Lemmy「Qwen-Image-2.1 in ComfyUI」 https://lemmy.dbzer0.com/post/75874773
- Nano Banana Pro / Gemini 3 Pro Image 的领先态势——尽管存在 Google Earth AI 撤回之类的事故,仍是图像生成的热门候选。YouTube「Google Nano Banana Pro: The BEST Image Model!」 https://www.youtube.com/watch?v=GEtiY-0fzO0
- HunyuanVideo 1.5 / Wan 2.7 的「开源视频第一」之争——可在消费级 GPU 上运行的视频模型战线。YouTube「We have a new #1 open-source AI video generator!」 https://www.youtube.com/watch?v=6EQP8-D37bs
- AI 生成内容披露标签义务化的趋势——NBC 新闻的「AI GENERATED」标识,以及 ByteDance 与好莱坞的版权协议,可能成为未来监管的试金石。Pinterest 中通过「ByteDance and Hollywood reach global deal on AI copyright」文章缩略图确认。
- Civitai 的检查点通知 BOT 自 2024 年起停止运行——值得关注开源社区的基础设施从 Bluesky 迁移到了哪里。Bluesky「@civitai-bot.bsky.social」 https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24
建议
- 下次应在 Reddit、X 直接搜索「Qwen-Image」「Sora」「Nano Banana」「HunyuanVideo」等专有名称,以减少趋势词带来的噪声。
- X 的收集方式应从依赖 X Explore 趋势词,改为预先提供图像/视频生成 AI 相关关键词列表。
- 持续监控 Bluesky 的 searchPosts API 403 问题,一旦恢复,立即切换至关键词全覆盖搜索。
- 将 Qwen-Image-2.1 的许可证动态(是否可商业使用)设为下一次追踪的固定检查项目。
- 持续将 Lemmy 的 !stable_diffusion 社区作为定点观察对象(其开源快讯性最高)。
- 将 Pinterest「工具对比信息图」中出现的新模型名(例如此次的 ShengShu Vidu S1)提取出来,在其他平台交叉验证。
数据质量
本次 X 几乎完全扑空,原因是搜索词依赖 X Explore 趋势(足球、娱乐话题)——这不是平台本身的局限,而是收集方法与主题不匹配。Reddit 相对于 20 条完成标准只收集到 11 条,而且由于搜索词仅为一个固定短语,r/StableDiffusion、r/SoraAi 等专业子版各仅命中 1 条,内容偏向社会争议。由于 Bluesky 的 searchPosts API 被 403 封锁,无法进行全覆盖搜索,只能逐条通过 Google 搜索找到的 URL 调用 API 确认,收集数量也未达到完成标准。YouTube 搜索结果页和单个视频页均为 JS 渲染,无法读取,播放量和日期大多依赖 Social Blade 等二手信息。Lemmy 和 Pinterest 获取信息相对稳定,但 Lemmy 的闭源内容较薄弱,Pinterest 的开源内容较薄弱,呈现相反方向的偏差。
平台分别总结
Reddit — 图像与视频生成 AI 新闻
来源
工作人员仅使用搜索词 "Image and Video Generation AI News",从 10 个 subreddit 收集到共 11 个帖子。专注于 AI 图像/视频生成的社区(r/StableDiffusion、r/SoraAi)均只命中一条;其余多来自 K-pop、科学、电影、宗教等周边话题。
| Subreddit | 成员数 | 收集帖子数 |
|---|---|---|
| r/kpop | 3,893,257 | 1 |
| r/generativeAI | 158,551 | 2 |
| r/labrats | 727,204 | 1 |
| r/GenAI4all | 48,939 | 1 |
| r/Earth199999 | 54,744 | 1 |
| r/SoraAi | 91,381 | 1 |
| r/StableDiffusion | 1,026,986 | 1 |
| r/singularity | 3,998,454 | 1 |
| r/perchance | 31,545 | 1 |
| r/Catholicism | 370,445 | 1 |
即使把 r/generativeAI(图像/视频生成实用咨询社区)以及 r/SoraAi、r/StableDiffusion(分别对应闭源/开源的专业社区)合计,也只占收集到的 11 条中的 4 条;其余 7 条偏向围绕 AI 生成内容的伦理与社会争议(K-pop 深度伪造、科学图像不端、Thanos 梗图、弥撒中使用 AI 图像)。
人们怎么说
- 开源:帖子 8「Vlo 0.3」(r/StableDiffusion・980pt・71 条评论・2026-09-28)https://www.reddit.com/r/StableDiffusion/comments/1wsmat4/ — 与 ComfyUI 结合的开源 AI 视频编辑/生成工具,内置 Minimax H3、Qwen2.1、Krea2、LTX2.5 工作流。最高评论 u/Amazing_Upstairs(16pt)希望加入「FastH3 support please」,u/DeepHomage(10pt)则报告「your update.bat file was detected as a malicious script by BitDefender」的安装问题。
- 开源/实践知识:帖子 3「How are people making long AI generated videos?」(r/generativeAI・11pt・53 条评论・2026-09-23)https://www.reddit.com/r/generativeAI/comments/1wog53q/ — u/kaboom-o(3pt)解释当前会组合使用多个模型的工作流:「Nobody is generating a long video in one shot... Seedance 2.5 (up to ~30s, native audio)... Grok Imagine Video at 480p, 5s... Gemini Omni Flash」。u/WritingPrestigious78(2pt)则强调本地 ComfyUI 的成本优势:「With my 5090, comfyui, minimax h3, no api costs all free just the electricity cost😄」。
- 闭源:帖子 7「A new video model being announced?」(r/SoraAi・55pt・46 条评论・2026-09-28)https://www.reddit.com/r/SoraAi/comments/1wsozf3/ — OpenAI 的帖子引发对 Sora 后继模型的期待。u/aigooner34(6pt)还提到人才流失的猜测:「Maybe they just took a step back while they finalized Sora 3, but... the main person that made Sora 2 possibly already left open ai」。u/Early-Attitude4046(10pt)表示仍愿意付费:「Even if Sora is now a paid subscription I would pay to use it」。
- 闭源/质量认知:帖子 9「Video models are getting good」(r/singularity・1,554pt・168 条评论・2026-09-26)https://www.reddit.com/r/singularity/comments/1wqbytd/ — 高分帖子中,u/ichii3d(98pt)惊叹:「Just replacing the people and relighting? I find it hard to believe AI video could be so good」,u/CHG__(35pt)则说:「The lip syncing is very impressive, first time I've seen that personally」。就连用于判断伪造的线索,也开始因 AI 画面的精细程度而失效(u/Rust2:「I know it's AI because Elizabeth Holmes looks too human here」,446pt)。
- 免费图像生成工具选择:帖子 2「Best AI image generator?」(r/generativeAI・3pt・44 条评论・2026-09-26)https://www.reddit.com/r/generativeAI/comments/1wqfleb/ — 对偏好免费的用户,u/Scuzzy_Womack(3pt)推荐「Comfy ui not connected to the Internet and free」;此外还提到 Yodayo/MoescapeAI、Leonardo 等提供每日免费额度的工具,可见闭源 SaaS 的免费层与开源本地运行并存。
- 可信度的反弹(科学领域):帖子 4「Nikon Image Competition」(r/labrats・1,113pt・133 条评论・2026-09-23)https://www.reddit.com/r/labrats/comments/1wo0j5e/ — 经 AI 强化处理的显微镜视频在 Nikon Small World in Motion 获得第一名,引发争议。最高分评论 u/Barkinsons(631pt)表示:「AI tools have no place in scientific microscopy images because we have the obligation to reproduce our images as truthfully as possible」。u/holydiver18(55pt)严厉批评:「Author's explanation is pissing on all of our legs and telling us it's raining」。
- 深度伪造监管动向:帖子 1「SM Entertainment Announces Strict Legal Action」(r/kpop・723pt・52 条评论・2026-09-28)https://www.reddit.com/r/kpop/comments/1wsdr6d/ — 经纪公司宣布对 AI 生成恶意图像采取法律行动。u/themichaelfalk(138pt)称:「a Korean article explicitly mentions rumors about AI-generated images showing her as pregnant」。经纪公司的应对强化在 Reddit 上也受到正面欢迎(u/llamacana:「glad sm is taking action」,166pt)。
- 文化反感(宗教):帖子 11「AI Generated Images at Mass」(r/Catholicism・48pt・89 条评论・2026-09-28)https://www.reddit.com/r/Catholicism/comments/1wskb30/ — 人们反对教区在弥撒中用 LED 屏幕展示 AI 图像。u/JacquesdeVee(47pt)表示:「Looking at those pictures while listening to the readings is creating false images in us instead of God speaking to us through His Word」。创作者本人(发帖者)透露,他曾无偿提出提供人类创作的艺术作品,但被拒绝。
- 被梗化的生成内容:帖子 6「I hate AI-Generated images of Thanos」(r/Earth199999・829pt・44 条评论・2026-09-25)https://www.reddit.com/r/Earth199999/comments/1wqaxgh/ — 发帖者以「It feels so insensitive... to waste more water on this dude」批评生成 AI 的环境负担(水资源),获得 829pt 的高度共鸣。
- 对视频生成的失望与过高期待之间的温差:帖子 10「AI Video Generator」(r/perchance・0pt・13 条评论・2026-09-23)https://www.reddit.com/r/perchance/comments/1woin1z/ — u/SSFx93(7pt)认为:「Good realistic (high quality), no limit, and free do not come together. Especially with video ai generation.」,即免费、高质量、无限制三者无法兼得。相对地,帖子 5「Just a reminder, these were the AI videos going viral in 2024」(r/GenAI4all・199pt・67 条评论・2026-09-24)https://www.reddit.com/r/GenAI4all/comments/1wou5vb/ 中,u/MinosAristos 称赞:「That video is absolute cinema. Using the 'weaknesses' of synthetic media as a strength」。
信号
- 正在增长:闭源视频生成模型达到「与实拍难以分辨」的水准(帖子 9,r/singularity 1,554pt),人们的惊叹与警惕并存。对 Sora 后继模型的期待(帖子 7)也是持续话题。
- 正在增长(开源侧):以 ComfyUI 为核心的本地低成本运行实践知识正在积累(帖子 3、帖子 8)。「no api costs all free just the electricity cost」这类说法显示出成本比较优势正受到支持。
- 遭到忽视或反对:针对 AI 生成内容「未经许可使用/不当标示」的反弹在多个领域显现——科学图像(帖子 4)、宗教仪式(帖子 11)、艺人肖像(帖子 1)、梗图式批评(帖子 6 的水资源批评)。无论类型,「真实性」越高,可信度与伦理层面的反弹也越强,呈现反向关系。
- 令人意外之处:搜索词带来了大量不是 AI 生成技术本身、而是应用与滥用语境的帖子(K-pop 深度伪造、Nikon 争议、弥撒 AI 图像、Thanos 梗图)。这暗示「图像/视频生成 AI 新闻」更多是在社会摩擦而非工具介绍的语境中被讨论。
- 观点分歧:帖子 9 和帖子 5 都在谈 AI 视频质量提升,但帖子 9 是带有警惕的「真实得令人害怕」,帖子 5 则是「绝佳电影体验」的纯粹赞美。同样的质量提升事实,在不同语境下(伪造担忧 vs. 创意表达)有截然不同的接受方式。
局限
- 完成标准要求每个社交网络分析约 20 个帖子,但 Reddit 仅收集 11 个帖子,约为目标的一半。若使用更多搜索词(例如 "Sora 2"、"Stable Diffusion"、"Qwen image"、"Nier open source video model" 等)进行抓取,可能能扩大样本;但本阶段只读取工作人员已收集的文件,并未追加搜索。
- 搜索词只有单一定型短语
"Image and Video Generation AI News",没有针对闭源/开源的具体工具或模型名称搜索,因此 r/StableDiffusion、r/SoraAi 等直接相关社区各只收集到一条。 - 收集的 11 条中约有 7 条(如帖子 1、4、6、9 的部分内容、11)偏向 AI 生成内容引发的社会摩擦与伦理争议,而非生成技术本身的进展;仅凭 Reddit 数据,很难满足简报所需的闭源和开源各至少 10 条洞见,必须由其他平台补充。
X
X — 图像与视频生成 AI 新闻
账号
收集到的 40 条帖子来自 35 个账号,实际上没有一个账号专门谈论图像/视频生成 AI。以下两个账号值得单独提及,因为它们是整份数据中唯二勉强触及主题的账号:
- @tetumemo(テツメモ|AI図解×検証|Newsletter) — 一条帖子(327 个赞、28 次转发、约 48,000 次浏览),也是整个集合中唯一真正聚焦 AI 的账号。其日语帖子讨论 Anthropic 的内部「Skills」工具,而非图像或视频生成。
https://x.com/tetumemo/status/2104689964315447445 - @PalantirHotline 和 @zephyr_z9 — 各一条帖子,均是对 Anthropic 公司的反应(IPO 猜测、定价),而非任何图像/视频生成产品或发布。
其余所有账号(35 个中的 33 个)均在推动完全无关的趋势:意大利对土耳其足球反应(@Luxboii、@CHUUFFINO、@UTDbrims、@tchato18)、西班牙对克罗地亚足球(@rkaydee_、@BlackKyle5、@wohwki、@Am_NORBERT、@ChivicEmpire21、@Bpassuwanile1、@ivana_croatian)、Big Brother 28 粉丝圈(@BBTeamNorth、@syphafan、@TAYXBURROW、@paige_lilith)、WWE Raw(@reigns_era — 3 条帖子,合计 7,267 个赞 — @greatness_1316)、Taylor Swift/「Tayflop」梗图围攻(@outztheslammer — 2 条帖子 — @TayloVis、@s0mbr3nd3r),以及有关 Lando Norris 的 Formula 1 八卦(@Polvodehadasm、@lnfourss — 2 条帖子 — @oIliebearman)。它们都没有谈及 AI、图像生成或视频生成;只是对体育结果和明星八卦的一次性反应,并非该领域的持续发声者。
帖子
我无法从这份收集中给出 5–12 条有关图像/视频生成 AI 的发现,因为集合中不包含这类内容。最接近主题的只有:
- @tetumemo(327 个赞、28 次转发、约 48,000 次浏览、2026-09-28)——集合中唯一真正与 AI 有关的帖子,但讨论的是文本/HTML 工具,而非图像:「Anthropicのチームが社内で大人気のSkillsELI5」ですが、5歳児でもわかるレベルで図解中心にHTML形式で解説してってSkills"(Anthropic 团队内部有一个很受欢迎的「ELI5」Skill,会以 5 岁孩子也能理解的图解式 HTML 形式进行解释)。没有提及 Claude 生成图像或视频;内容是说明性 HTML 输出。
https://x.com/tetumemo/status/2104689964315447445 · 通过搜索「Anthropic」找到 - @PalantirHotline(447 个赞、31 次转发、约 49,000 次浏览、2026-09-29)——纯粹的股市猜测,不是产品新闻:「$PLTR Anthropic considering to IPO at $2T only means that Palantir is worth at least $20T」。
https://x.com/PalantirHotline/status/2104744865468989486 · 通过搜索「Anthropic」找到 - @zephyr_z9(1,480 个赞、36 次转发、约 115,000 次浏览、2026-09-28)——没有产品背景的一句反应:「Are they planning to price out everyone from the market」。结合上面的 IPO 帖子来看,这似乎是有关 Anthropic 定价/市场的一般讨论,而不是图像或视频模型。
https://x.com/zephyr_z9/status/2104717396900745337 · 通过搜索「Anthropic」找到 - @xilo2991(172 个赞、51 次转发、约 12,000 次浏览、2026-09-29)——因「Anthropic」搜索出现,但收集器没有抓到任何帖子文本,因此除了它的存在以外,没有其他可报告的信息。
https://x.com/xilo2991/status/2104912748794589515 · 通过搜索「Anthropic」找到
这就是全部与 AI 勉强相关的帖子。其余 40 条中的另外 36 条全是足球、WWE、Big Brother 28、Taylor Swift 梗图或 Formula 1,与闭源或开源的图像/视频生成 AI 均无关联。
信号
- 该主题没有任何上升信号。 此集合中没有可辨识的开源或闭源图像/视频生成信号——没有提及 Midjourney、Sora、Veo、Runway、Kling、Stable Diffusion、Flux、HunyuanVideo、Wan 或类似工具和发布。
- 令人意外的不是趋势,而是收集结果:本次运行中的每个搜索词(
Italy、Spain、Jubjub、Holy、#bb28、Roman、Tayflop、Anthropic、#Croatia、Lando)都直接取自 X Explore 页面显示的趋势名称(见工作人员记录的表格,定位在克罗地亚),与研究简报无关。十个词中仅「Anthropic」与 AI 有关,且结果是公司融资/定价讨论和一条不相关的工具帖子,而不是图像或视频生成内容。 - 遭到忽视的内容: 不适用——这里没有主题相关讨论可供判断哪些内容在上升或被忽视。
局限
- 驱动这份收集的搜索词与研究主题无关。 搜索的十个词(
Italy、Spain、Jubjub、Holy、#bb28、Roman、Tayflop、Anthropic、#Croatia、Lando)均为此会话中 X Explore 的趋势(在output/x.posts.md的「What X says is happening」中列出),按表格的「Where」列显示,地理位置为克罗地亚(多数是「Trending in Croatia」或通用体育趋势)。只有「Anthropic」与 AI 略有关系,但也没有找到图像/视频生成内容。 - 没有使用图像/视频生成专用词搜索——如「Sora」「Midjourney」「Stable Diffusion」「Veo」「Runway」「Kling」「Flux」「text-to-video」「text-to-image」或开放权重模型名称等——因此这份文件无法报告本次 X 上的闭源/开源图像视频生成新闻。
- 40 条收集帖子中仅 4 条提到「Anthropic」,且没有一条涉及图像或视频生成;另外 36 条是无关的体育/娱乐趋势。
- 本平台阶段没有收集图片(
images/x/不存在),因此也没有可交叉参考的视觉材料。 - 根据工作流程,我没有亲自浏览 X(工作人员的无头、已登录会话是本阶段唯一的 X 数据路径);本总结严格局限于
output/x.posts.md和output/x.posts.json的内容,而这些数据并未覆盖简报主题。
YouTube
YouTube — 图像与视频生成 AI 新闻
频道
- Matt Wolfe (@mreflow,约 925K 订阅者) — 每日 AI 新闻摘要频道;是搜索结果中最常被推荐用于追踪该领域的 AI YouTuber,但本次搜索未找到其 9 月份有关图像/视频模型的具体视频。
- TheAIGRID (@TheAiGrid,约 370K 订阅者、总播放量 61.3M;据 Social Blade 统计,最近 30 天约 540K 播放量) — 每日 AI 新闻频道,频繁覆盖闭源前沿发布(Sora、Nano Banana Pro)和开放权重模型。
- Theoretically Media (@TheoreticallyMedia) — 专注开源/本地生成的频道(“Tim”);在 Z-Image、Wan、HunyuanVideo 内容中反复出现,是搜索引擎直接关联到该领域的频道,不过本次没有找到其单支视频播放量。
- Nerdy Rodent 和 Sebastian Kamph — ComfyUI/本地 AI 教程频道,持续制作新开放权重图像/视频模型安装指南(HunyuanVideo、Qwen-Image、Flux)。
- 大量以「The BEST AI Video Generator 2026!」为标题的工具对比型频道,会反复比较 Sora 2、Veo 3.1、Runway、Kling 和 Grok Imagine——它们看起来更像 SEO 驱动的联盟推广/教程频道,而非稳定的单一声音,但在闭源工具搜索结果中占据绝大多数。
视频
- 「OpenAI Just Killed Sora」 — 搜索摘要未确认频道,2026-03-24。报道 OpenAI 当天宣布将停止 Sora 应用和 Sora-2 API,把 GPU 容量转向新的内部模型。
https://www.youtube.com/watch?v=PKKN5be_my0 - 「BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives」 — 2026-03-27。将终止描述为正在发生的事件,并介绍 Kling、Runway、Veo 作为 Sora 用户的替代方案。
https://www.youtube.com/watch?v=Zf9979o8RGk - 「OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened?」 — 2026-03-26。认为终止(应用于 4 月 26 日下线、API 于 2026 年 9 月 24 日终止)是由据称约每天 1,500 万美元的运行成本和芯片短缺驱动,而不是模型质量不足。
https://www.youtube.com/watch?v=9rhmczPT6Jk - 「The Ultimate Guide to AI Video Generation (Sora 2, Runway 4.5, Veo 3.1, Nano Banana Pro)」 — 2026 年近期上传。将 Sora 2、Runway 4.5、Veo 3.1 和 Google Nano Banana Pro 视作当前闭源前沿,尽管 Sora API 在同一个月内已经终止。
https://www.youtube.com/watch?v=Kib8UcDiNJA - **「Google Nano Banana Pro: The BEST Image Model!」**及同类视频(「NANO Banana Pro is FINALLY Here!」「Google won image generation (it's not even close) — NANO BANANA PRO BREAKDOWN」)— 自 2025-11-21 以来的一组上传内容。这组视频反复主张:基于 Gemini 3 Pro Image 的 Nano Banana Pro 在文本渲染、信息图生成与 4K 输出方面领先,是 Google 面向 Midjourney/Sora 周边图像工作的闭源答案。
https://www.youtube.com/watch?v=GEtiY-0fzO0 · https://www.youtube.com/watch?v=UV9GqinedQ8 - 「Runway 4.5 vs Veo 3.1 vs Sora 2 — Full AI Video Generator Comparison」 — 2025-12-23。在 Sora 后来终止前,该视频认为 Runway 4.5 的镜头控制优于 Veo 3.1,而 Sora 2 的原始真实感更强。
https://www.youtube.com/watch?v=Rm_Ok-MHZfA - 「Qwen-Image-2.1 Is INSANE… Just 7B Parameters?!」 — 2026-09-20(与发布同日)。认为阿里巴巴的 7B 参数开放权重模型已能编辑图片、在最多 10 张参考图间保持主体/产品身份,并生成透明抠图;但也指出其许可证仅限研究用途,不能算真正的开源。
https://www.youtube.com/watch?v=3qGl0wiv2G0 - 「Qwen Image 2512 Just Dropped – I Had to Test It Immediately vs Nanobanana Pro (12 Tests)」 — 2025 年末/2026 年。对开放权重 Qwen Image 2512 与 Google 闭源 Nano Banana Pro 做 12 项测试,认为开放与闭源图像质量之间的差距几乎已经缩小。
https://www.youtube.com/watch?v=_TGz5xB6i8w - 「Z-Image Turbo Released - Fast Distilled Image Model」和「Z-Image Base Released – AI That Nails Hands, Textures & Human Emotions!」 — 阿里巴巴 Tongyi-MAI 实验室于 2025-11-26 发布 Z-Image Turbo(亚秒级、8 步推理;据描述文本,在 Artificial Analysis 文生图排行榜中开源第 1、总榜第 8),随后又发布完整「Base」检查点。两者都催生了 Nerdy Rodent、Theoretically Media 类型频道的教程/安装视频。
https://www.youtube.com/watch?v=3mT7KnotPqk · https://www.youtube.com/watch?v=s7ppsl_LbzI - 「HunyuanVideo 1.5: Open Source Video Generation (Instruction Following & Physics)」和「Tencent HunyuanVideo 1.5 has been officially open-sourced!」 — 腾讯 8.3B 参数开放视频模型,被宣传为可运行在消费级 GPU 上;多个频道立即将其与 Wan 2.2/2.5/2.7 对比。
https://www.youtube.com/watch?v=4HTBZg5Zhqc · https://www.youtube.com/watch?v=MJShdc8tkkA - 「AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)」 — 认为开放模型(Wan)和闭源模型(Kling)的发布节奏快到难以逐一追踪,并以 Wan 的「Wanimate」角色动画功能作为标题新能力。
https://www.youtube.com/watch?v=vFXe3uXb75k - 「We have a new #1 open-source AI video generator!」 — 将一个新模型称为新的冠军(语境围绕 HunyuanVideo 1.5/Wan 2.7 比较),反映快速变化的开源视频排行榜。
https://www.youtube.com/watch?v=6EQP8-D37bs
信号
- 当前最主要的闭源故事不是新模型,而是 OpenAI 终止了一个产品。 Sora 应用和 Sora-2 API(sora-2、sora-2-pro 和带日期快照)已于 2026-09-24 全面关闭,距本次调研仅 6 天;OpenAI 早在 2026-03-24 就宣布了该决定。多个视频将其描述为 OpenAI 将 GPU 容量转向下一代内部模型(据称代号「Spud」),放弃一个据报道每天运行成本约 1,500 万美元的产品。这比本次找到的任何单一新发布都更具闭源侧信号意义。
- Google 的 Nano Banana Pro(Gemini 3 Pro Image)是按视频数量计的闭源图像领跑者。 围绕它的视频远多于围绕 Midjourney 或任何单一 Runway 图像发布的视频;频道反复称其在文本渲染和信息图式生成方面达到最佳水平。
- 开放权重图像模型正在快速缩小与闭源模型的差距,但许可证让「开源」标签变得模糊。 Qwen-Image-2.1(7B 参数,2026-09-20 发布)在自身报道中被描述为「开放权重,而非开源」——研究用途许可证、不允许商业再分发;多支视频在赞赏能力的同时明确指出这一点。
- 中国实验室(阿里巴巴 Tongyi-MAI/Qwen、腾讯 Hunyuan)是目前图像和视频领域最活跃的开源发布者。Z-Image Turbo/Base、Qwen-Image-2.1/2512、HunyuanVideo 1.5 都在大约四个月内推出,并立即获得彼此对比以及与闭源模型对比的视频。
- 视频模型比较内容(「Sora vs Veo vs Runway vs Kling vs Wan」)本身已经成为一种内容类型,工具比较频道几乎每周都在制作——适合追踪最受关注的名称,但不太适合作为某一条具体新闻事件的指标。
局限
- YouTube 搜索结果页(
youtube.com/results?search_query=…)通过 JavaScript 渲染,对本次页面抓取器只返回页脚/导航样板;大多数视频无法直接读取确切播放量、上传时间和订阅数。以上所有播放量/订阅数/日期均来自 WebSearch 结果摘要和相关二手来源(Social Blade、vidiq、博客回顾),而非直接打开 YouTube 页面,应将数值视为近似值,并受二手来源最后更新时间影响。 - 单支观看页(
youtube.com/watch?v=…)也遇到同样的 JavaScript 渲染障碍——通常能恢复标题,但无法读取播放量、确切频道名称和描述,因此上述若干条目只列标题和日期、不列频道或播放量。 - 尽管 Matt Wolfe 在搜索结果中被最常推荐为 AI 新闻源,但本次未找到其关于该主题、已确认日期为 2026 年 9 月的上传内容——其出现在「频道」部分是基于声誉,而非经过验证的近期视频。
- 此处没有尝试与 Bluesky/Lemmy/Pinterest 交叉参考;根据工作流程,YouTube 数据独立收集。
- 报道偏向工具比较/教程频道,因为它们主导了 YouTube 的相关关键词排名;这可能低估了小型创作者或非英语频道(搜索中确实出现法语 Z-Image 视频和日语 Qwen-Image 视频,但未深入分析)。
Bluesky
Bluesky — 图像与视频生成 AI 新闻
关于调查方法的说明
工作流程所示的 public.api.bsky.app/xrpc/app.bsky.feed.searchPosts(帖子搜索 API)在本次访问中持续返回 403 Forbidden,而 bsky.app/search?q=... 网页搜索页也因 JS 渲染而无法获取内容(详情见文末 ## 局限)。因此,改用未被封锁的 app.bsky.actor.searchActors(账号搜索)识别可能与主题相关的账号,并通过 app.bsky.feed.getAuthorFeed(特定账号的帖子列表)和 app.bsky.feed.getPostThread(单个帖子的正文、时间、点赞数、转发数)逐条核实实际内容。所有帖子均在下方附上真实 URL。
账号
- @testingcatalog.com(🚨 AI News | TestingCatalog)— 综合 AI 快讯 bot,每天发布数条帖子,图像/视频生成 AI 话题只是偶尔混入。 https://bsky.app/profile/testingcatalog.com
- @genainews.bsky.social(Gen AI News)— 同样是综合 AI 快讯 bot。检查最近 30 条动态后,没有发现图像/视频生成 AI 相关帖子,主要内容为代理、LLM 和公司新闻。
- @sungkim.bsky.social(Sung Kim)— 追踪开放权重模型发布的个人账号。其 Qwen-Image-2.1 发布帖子有 81 个赞、10 次转发,是本次确认内容中反响最大的。 https://bsky.app/profile/sungkim.bsky.social
- @compvis.bsky.social(CompVis, LMU Munich)— Stable Diffusion 原始论文作者研究组的账号。不过近期帖子不是单个模型发布,而是普遍性的扩散模型/GAN 研究介绍。 https://bsky.app/profile/compvis.bsky.social
- @stabilityai.bsky.social(Stability AI 官方)— 唯一活跃的主要闭源/开放领域企业账号,但过去一年几乎全部帖子都在谈音频生成(Stable Audio 2.5)以及与 Universal Music/Warner Music 的合作,没有看到新的图像/视频生成发布。 https://bsky.app/profile/stabilityai.bsky.social
- @civitai-bot.bsky.social(CivitaiCheckPoint 更新 BOT)— 自动通知开源模型/LoRA 更新的 bot,但最后一帖为 2024 年 5 月 9 日,已停止一年多。
- @dahara1.bsky.social / @luok.ai — 个人实验与验证账号,发布 HunyuanVideo、SkyReels V1 等开源视频生成模型的试用报告。
- @trashcanroxanne.bsky.social(TrashCanRoxanne)— 参与 Runway/Hailuo/Freepik/Kling 等「Creator Partner Program」的 AI 影像创作者,持续发布新功能测试和 AI 短片电影节投稿报告。
- @blackforestlabs.bsky.social(Black Forest Labs 官方)、@klingaivideo.bsky.social(Kling AI Video 官方)、@runwayml.bsky.social(RunwayML 官方)— 三家公司都存在 Bluesky 账号,但 Black Forest Labs 和 Kling AI Video 的帖子数为 0,RunwayML 也仅在 2024 年 10 月发布过 1 条。作为图像/视频生成 AI 企业的官方发布渠道,Bluesky 几乎没有发挥作用。
- 搜索 Stable Diffusion / Civitai 相关账号时,绝大多数不是新闻,而是个人 AI 艺术帖子(相当大比例为 NSFW/兽人向内容)。
- 相反,
fuzichoco.bsky.social、jametc.bsky.social、devinellekurtz.bsky.social、artbutmakeitsports.bsky.social等许多插画师账号,都在个人资料中明确写有「NO AI」「禁止 AI 训练」,显示出 Bluesky 特有的反 AI 社群存在。
帖子
-
Nano Banana 2.1(闭源) — @testingcatalog.com,2026-09-27,1 个赞、0 次转发。「New Google Flow build now points to Nano Banana 2.1」。报道 Google Flow 内图像模型名称从 Nano Banana 2.5 变为 Nano Banana 2.1,并推测这是一项小规模迭代更新。
https://bsky.app/profile/testingcatalog.com/post/3mwiz3uw7nl2e -
Qwen-Image-2.1 开放权重发布(开源) — @sungkim.bsky.social,2026-09-20,81 个赞、10 次转发(本次确认帖子中反响最大)。报道阿里巴巴发布了一个将生成和编辑整合到一起的 7B 轻量开放权重模型。后续帖子介绍直接生成 RGBA 图层、最多输入 10 张参考图、支持全景/虚拟试穿,以及 GitHub/ModelScope/Hugging Face 链接。评论区持续讨论 LM Studio 本地部署和 ComfyUI 支持等技术问题。
https://bsky.app/profile/sungkim.bsky.social/post/3mvxr2bj2ck2r -
Stability AI 的 Stable Audio 2.5 与 Universal Music 合作(显示其从图像/视频转向的间接信号) — @stabilityai.bsky.social,2025-10-30,1 个赞、0 次转发。「Today we announced a strategic alliance with Universal Music Group to co-develop professional AI music creation tools」。Stability AI 在 Bluesky 上近期的沟通主要是音频生成模型和企业合作,未发现图像/视频生成模型的新发布。
https://bsky.app/profile/stabilityai.bsky.social/post/3m4fwolv4k22z -
Kling 2.1 首尾帧功能测试(闭源) — @trashcanroxanne.bsky.social,2025-08-25,4 个赞、0 次转发。「Testing out the new Kling 2.1 — first and last frame feature in Freepik」。从实践者角度报告通过 Freepik 测试 Kling AI 新功能。
https://bsky.app/profile/trashcanroxanne.bsky.social/post/3lxas5x3uf22s -
SkyReels V1(开源) — @luok.ai,2025-02-18,3 个赞、1 次转发。「SkyReels V1 is the first open-source human-centric video foundation model. By fine-tuning HunyuanVideo on over 10 million high-quality film and television clips, it captures 33 facial expressions and over 400 natural movement combinations」。介绍基于 HunyuanVideo 的开源人物视频模型。
https://bsky.app/profile/luok.ai/post/3lihm6qiuyk27 -
HunyuanVideo I2V Beta 测试(开源) — @dahara1.bsky.social,2025-03-06,0 个赞、0 次转发。「参加了视频生成 AI(HunyuanVideo)的 Beta 测试,现在可以从一张图生成视频」,并在线程中报告了对动画风格口型同步视频的测试结果。
https://bsky.app/profile/dahara1.bsky.social/post/3ljozva2gcs27 -
CivitaiCheckPoint 更新 BOT 停止(开源社区停滞信号) — @civitai-bot.bsky.social,最后帖子为 2024-05-09(均为不超过 3 个赞的小规模帖子)。该 bot 曾每小时发布如「✨Carrot Caramel Batake updated✨ baseModel: SD 1.5」之类的 LoRA/检查点更新通知,但在 2024 年 5 月 9 日后中断。
https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24 -
Decentralized Diffusion Models(开源研究) — @compvis.bsky.social(Stable Diffusion 原作者研究组),2025-01-10,20 个赞、2 次转发。「Decentralized Diffusion Models, a way to train diffusion models on decentralized compute with no communication between nodes」。这是分布式训练方法论文介绍,而非特定模型发布。
https://bsky.app/profile/compvis.bsky.social/post/3lfexk45ek227 -
RunwayML 官方账号的实际沉默(闭源企业缺乏发声的信号) — @runwayml.bsky.social,唯一帖子为 2024-10-24,386 个赞、24 次转发,内容却是「Let's put a blanket down & watch the day fade away」这种与产品无关的情景描述,之后再未发帖。
https://bsky.app/profile/runwayml.bsky.social/post/3l7bzv5idqg2t -
Diffusion models for image and video generation | ML in PL 2025(Google DeepMind 研究者演讲预告) — @sedielem.bsky.social(Imagen/Veo 研究者 Sander Dieleman),2026-03-16,17 个赞、6 次转发。预告一场大规模讲解视频/图像生成模型训练的演讲,而不是具体产品发布。
https://bsky.app/profile/sedielem.bsky.social/post/3mh7g2dv4nc25
信号
- 官方账号缺席是最大的发现。 Black Forest Labs(Flux 开发方)为 0 帖,Kling AI Video 为 0 帖,RunwayML 两年内仅 1 帖。图像/视频生成 AI 的主要参与者几乎不用 Bluesky 作为新闻快讯渠道;不同于 X/Reddit,Bluesky 并未形成 CEO 或官方账号直接发布消息的文化。
- 只有 Stability AI 较活跃,但话题已转向音频。 2025 年 9 月至 11 月的帖子主要是 Stable Audio 2.5,以及与 Universal Music Group、Warner Music Group 的合作;同期没有发现 Stable Diffusion 系图像模型的新发布。
- 有现场感的开源报告来自个人账号,而不是企业账号。 Qwen-Image-2.1(@sungkim.bsky.social)、SkyReels V1(@luok.ai)、HunyuanVideo I2V 测试(@dahara1.bsky.social)均由个人技术账号进行一手报告,往往比官方公告更早、细节更多。
- Civitai 的检查点 BOT 从 2024 年 5 月起停运,因此 Bluesky 作为开源 LoRA/模型分享社区通知基础设施可能已衰落(推测已迁移到 Discord/Civitai 本体,但尚未验证)。
- 闭源视频生成(Runway、Hailuo、Kling、Luma、Pika 等)主要由参与「Creator Partner Program」的网红型账号群讨论。 @trashcanroxanne、@aziz4ai、@azed-ai、@uncanny-harry、@koldohuici 等账号作为多个工具的大使,发布新功能测试和 AI 短片电影节投稿报告;重心更偏创作者社区,而非技术新闻。
- NSFW/兽人向内容占 Stable Diffusion、Civitai 相关账号搜索结果的大多数。 在 Bluesky 上,开源图像生成社区的主流看起来是个人 AI 艺术创作(其中相当比例面向成人),而不是技术新闻。
- 许多插画师账号明确标注「NO AI」(如 @fuzichoco.bsky.social、@jametc.bsky.social、@devinellekurtz.bsky.social、@artbutmakeitsports.bsky.social)。反对图像生成 AI、拒绝训练的立场在个人资料中已成常态;相较 X/Reddit,Bluesky 创作者群体中的反 AI 情绪更为明显。
局限
- 帖子搜索 API(
app.bsky.feed.searchPosts)持续返回 403 Forbidden。 工作流程称其无需登录即可访问,但本环境中,即使是q=stable diffusion、q=cats这样的简单查询也返回 403,无法访问。同一环境中的app.bsky.actor.searchActors(账号搜索)、app.bsky.feed.getAuthorFeed(帖子列表)、app.bsky.feed.getPostThread(单帖)则正常工作,因此很可能只有搜索 API 受限(可能是改为需要认证或强化限流,但未验证)。 bsky.app/search?q=...网页搜索页通过 JavaScript 渲染,获取到的 HTML 中不包含帖子内容,无法读取。 单帖页面(bsky.app/profile/.../post/...)同样如此,只能通过 API 的 getPostThread 获取正文。- 受上述限制,没有通过关键词进行全覆盖式帖子收集,而是通过 Google 搜索找到单个 bsky.app URL,再逐条经 API 验证。因此无法执行工作流程预期的「多个关键词全覆盖搜索」,收集到的帖子并不完整,只限于偶然找到的内容。
- 完成标准中的「分析约 20 条帖子」无法通过这种绕行方法达到。相关性较高的帖子为 10 条,可参考的账号/信号为十余项。Blackforest Labs、Kling AI Video 等官方账号甚至为 0 帖,判断继续沿同一路径挖掘也不会产生新的第一手信息。
- 通过 Google 搜索发现的
en.yasue.org/report/image-and-video-generation-ai-news-2026-09-10可能是与本报告同类的过往 AI 生成报告,未将其视为一手信息,也未引用。
Lemmy
Lemmy — 图像与视频生成 AI 话题(以开源为主,闭源较薄弱)
社区
- !«メールアドレス» — 5.71K 订阅者。与图像/视频生成 AI 相关、活动最密集的社区。ComfyUI 节点、新模型 GitHub 仓库几乎每天都有帖子;开源动态几乎都集中于此。
- !ai_reddit@(多个实例,经 lemmy.world 等转发) — 将 Reddit 上的生成 AI 帖子转发到 Lemmy 的社区;偶尔出现闭源作品案例(Runway、GPT 等)。
- !«メールアドレス» — 被 Anubis(反机器人系统)拦截,无法完整查看;从搜索结果看帖子较少,部分分数为负。
- !«メールアドレス» / !«メールアドレス» / !«メールアドレス» — 生成 AI 批评/反 AI 艺术社区。内容以情绪化帖子而非新闻为主,但闭源 AI 滥用事件容易集中在这里。
- !«メールアドレス» — 泛科技社区,偶尔出现 Midjourney 等公司新闻,不是专业社区。
帖子
开源类(来自 !«メールアドレス»,最近 1–2 周)
- LanPaint — 无需训练、可用于任意 SD 模型的高质量局部重绘,支持 ComfyUI。分数 7,2026-09-29。 https://lemmy.dbzer0.com/post/76205128
- PxTicks/vlo — 免费、本地、开源且包含 AI 功能的视频编辑器。分数 4,2026-09-29。 https://lemmy.dbzer0.com/post/76205126
- SatoDive/Minimax-H3-Latent-Continuation — 基于 MiniMax H3 的长视频、无缝多镜头续写生成。分数 3,2026-09-29。 https://lemmy.dbzer0.com/post/76205130
- Qwen-Image-2.1 in ComfyUI — 开放权重图像生成/编辑模型 Qwen-Image-2.1 的 ComfyUI 集成。分数 13(该线程最高分),约 2026-09-22。 https://lemmy.dbzer0.com/post/75874773
- ogoun/fooocus-qwen-image-2.1 / Kijai/QwenImage_experimental / PrunaAI/Pruna-Qwen-Image-2.1 — 围绕 Qwen-Image-2.1 的 WebUI、ControlNet 集成、加速 LoRA 同时多点发布。2026-09-26 至 27。 https://lemmy.dbzer0.com/post/76110120
- SupraLabs/Supra2-IMG — 仅有 1 亿参数的紧凑型文生图模型。分数 7,约 2026-09-22。 https://lemmy.dbzer0.com/post/75874769
- The AI Horde 新界面 — 分布式、免费的 AI 图像生成网络「AI Horde」更新了前端、后端和文档。分数 8,约 2026-09-19。 https://lemmy.dbzer0.com/post/75736717
- Cierpliwy/krea2-inpaint-edit・lvladikov/Krea2-Turbo-Distill-2step-LoRA — Krea-2 系列局部重绘编辑 LoRA 与两步快速蒸馏 LoRA。2026-09-16 至 17。 https://lemmy.dbzer0.com/post/76065378
- 本地 SDXL + LoRA 抽象艺术帖子 — 本地运行 SDXL 1.0、训练自定义 LoRA,并使用 GIMP/Inkscape 完成的抽象作品。分数 4,2026-09-18。 https://lemmy.today/post/60272629
闭源类(零散,经其他社区)
- Midjourney 要求好莱坞披露 AI 使用情况 — 报道称 Midjourney 要求好莱坞制片厂详细披露 AI 使用情况。!technology,2026-07-05。 https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/
- Google Earth AI(集成 Nano Banana)24 小时内撤回 — Google Earth 集成 Nano Banana 图像生成功能的次日,用户批量生成伪造图像(屠杀、灾难的虚假卫星照片等),功能因此停止。评论中还提出「应该用加密签名区分真实卫星图像」的技术建议。经 !ai_reddit,2026-08-07。 https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
- 用 Runway 在 6 小时内制作 AI 公司广告 — 使用 Runway Gen-4 等工具,不使用拍摄团队或模特,制作一支 40 秒 Nike 风格广告概念的帖子。!ai_reddit,分数 1,2026-09-26。 https://v.redd.it/awqo4jp13yrh1
- 利用 Grok 生成 7,000 张继子女色情图像后自杀的事件 — 作为闭源 AI(Grok)滥用的严重事件,在 !fuck_ai 中讨论。2026-07-09。 https://lemmy.dbzer0.com/post/71983645
- 斯坦福承认使用 AI 对学生照片进行「种族转换」 — !nottheonion,2026-09-23。 https://san.com/cc/stanford-university-admits-ai-was-used-to-race-swap-student-photo/
信号
- Lemmy 的生成 AI 讨论几乎清一色为开源。 仅 !«メールアドレス» 最近两周就有 20 多个仓库/工具帖子,Qwen-Image-2.1(阿里巴巴系开放权重模型)与 MiniMax H3(视频)周边生态(ComfyUI 节点、LoRA、WebUI)是明确的当前趋势;Krea、SupraLabs 等新兴轻量模型也在出现。
- 闭源(Midjourney、Sora、Veo、Grok、Google Nano Banana 等)在 Lemmy 上只会作为「新闻转载」或「滥用/争议事件」出现。 它们不是以工具使用或作品分享的形式出现,而更常置于公司批评、监管、事件性语境。
- 社区整体氛围偏向 AI 怀疑甚至敌对。 !fuck_ai 之类的「反生成 AI」社区横跨多个实例,「AI slop」(AI 粗制滥造内容)一词频繁出现。作品帖一旦被怀疑是 AI,常有分数变负的例子(如 score -8、-6)。
- 搜索 API 的关键词匹配不太稳定 — 搜索「Flux」「Veo 3」等专有名称时,常混入 Discord 替代应用等无关结果;直接查看 !stable_diffusion 社区更可靠。
局限
- Lemmy 整体活跃用户数和帖子量相比 Reddit 等平台小得多,较接近「开发者社区的仓库分享板」而非「最新新闻」。仅靠 Lemmy 几乎无法捕捉闭源动态(新模型发布、对比评测等)。
- !«メールアドレス» 受到 Anubis(反机器人系统)拦截,无法直接浏览社区页面,只能通过搜索结果查看片段信息。
- 分数(赞成票)整体很低(多数为个位数),Lemmy 上几乎不存在可称为「爆款」的帖子;由于社区样本小,需谨慎解读数值。
- 相对于分析 20 个帖子的标准,开源侧可在 !stable_diffusion 一个地方确认 20 多个帖子,但闭源侧即使横跨多个关键词与多个社区,也只勉强达到约 10 个。这反映的是 Lemmy 的话题偏向(开源占优),而非搜索覆盖不足。
Pinterest — 图像与视频生成 AI 新闻
搜索查询只有一个(未分类),共收集 50 个 Pin,全部以图片形式确认。和 Pinterest 常见的「精美图片」相比,这里大多数是 AI 工具推广缩略图、对比信息图和 YouTube 风格的「AI NEWS」视频缩略图,整体偏向科技博客/联盟推广风格的看板。
视觉主题
- 蓝白发光的人形机器人+发光眼睛是整体的代表视觉。穿西装、类似「AI 新闻主播」的机器人 [1, 22, 29, 31, 47],以及手掌上漂浮着电路纹样「AI」标志的图像 [9, 46, 50] 不断重复,直观呈现「AI 替代人类工作」的形象。
- 深海军蓝×霓虹(青色/洋红/紫色)的电路板纹理主导背景 [4, 8, 14, 16, 32, 45]。几乎所有帖子都使用相近调色板,显示 AI 类缩略图正在模板化。
- 工具比较、排行榜型信息图很多,会并列 Logo,整理「免费 vs 付费」「6 个最佳 AI 视频生成网站」等内容 [3, 9]。Runway、Pika、Kling AI、Luma AI、Canva AI、Hailuo AI、ChatGPT/Midjourney/Adobe Firefly/Ideogram/SeaArt/Playground/Krea/CapCut 等闭源服务的 Logo 密集排列。
- 质疑「真实 vs AI 生成」的演出(放大镜、「FAKE」印章、「Human or AI?」左右对比、97% AI 检测率展示)是显著类别 [1, 26, 27]。对真伪辨别的关注在视觉上非常强烈。
- AI 接管新闻报道的主题反复出现 [5, 34, 37, 39, 44]。NBC News 的实际视频中,有一段天气主播风格片段在左上角标有「AI GENERATED」[44],是新闻制作中的特殊实例。
- 多张纵向信息图以**步骤说明图(1→6)**介绍从「图像生成视频」的过程 [6, 24]。提示词输入→AI 处理→渲染→导出的工作流已成为常见模板。
- 写实但没有明显破绽的人物肖像(老人脸部特写、雕塑与大提琴演奏的合成、少年英雄)被作为品牌宣传范例画面 [12, 15, 49],意在展示写实图像生成的质量。
- 多张带企业 Logo 的产品发布视觉图(Google Veo 2 / VideoFX [16, 33]、Gemini Omni [21]、ShengShu 的 Vidu S1 [48]、AMD 的 Amuse 3.0 [49])作为具体新模型公告,比通用 AI 图像的信息密度更高。
值得注意的 Pin
- [2] Meta Muse Spark AI Model 2026 — 宣称「个人超级智能」的 Meta Muse 解读文章缩略图。通过戴头显的女性、房屋、车辆与 VR 合成,强调「万能个人助手」路线。
- [3] 6+ Best AI Video Generation Websites — 并列比较 Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI 的信息图,能一眼看到电影、社交媒体、初学者等不同用途的区分。
- [9] AI Image Video: Best Quality vs Best Free — 按用途分类付费工具(ChatGPT Plus、Gemini Advanced、Midjourney、Adobe Firefly、Recraft、Runway Gen-3、Luma、Pika Pro、Kaiber、Synthesia)和免费工具(Ideogram、Gemini Free、SeaArt、Playground、Krea、Canva、CapCut、Pika Free、Runway Free)的决策流程图。
- [15] ByteDance and Hollywood reach global deal on AI copyright — 新闻文章截图,称 ByteDance 与电影协会(MPA)就 AI 图像/视频生成工具的版权保护达成全球协议,展示了闭源领域的法规动态。
- [16] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — Google Veo 系最新模型解读。
- [21] Google's Gemini Omni Turns Anything Into Video — 介绍 Gemini Omni 能把图像、音频、文本整合为视频的新功能。
- [31] Discover how Grok is revolutionizing video... — 关于 xAI 的 Grok 进入视频领域的 Pin。
- [44] AI news videos blur line between real and fake reports — NBC News 实际视频中,天气播报员风格片段标有「AI GENERATED」。这是主流媒体开始落实 AI 生成内容披露标识的实例。
- [48] ShengShu Technology Unveils Vidu S1 — 宣传「实时、交互式生成」的中国 AI 视频模型 Vidu S1 发布视觉图。
- [49] 'Amuse 3.0' — AMD-powered AI art creation tool — 在 AMD GPU 上运行的本地 AI 艺术创作工具新版本公告,是少数偏向开放/本地运行的具体例子。
信号
- 闭源存在感压倒性强:Google(Veo/Gemini/Omni)、Meta(Muse)、OpenAI(ChatGPT/DALL-E 系 Logo)、Runway、Pika、Luma、Kling、Canva、Hailuo、ShengShu(Vidu)、xAI(Grok)等商业 SaaS 的 Logo 与产品名不断重复。Pinterest 的内容中心是面向「该使用哪个工具」的比较型内容,反映强烈的购买/选型意图。
- 开源/自托管内容薄弱:Stable Diffusion 系产品名仅 1 条(28,标题存在但图像是泛用 AI 人物图),AMD Amuse 3.0(49)作为偏本地运行的内容较突出;没有任何 ComfyUI、LoRA、检查点共享等技术社区色彩的 Pin。Pinterest 面向普通消费者和营销人员,专业 OSS 工具链话题没有出现。
- 人们强烈关注「AI 生成内容的真伪」:FAKE 印章、Human or AI? 对比、检测率百分比等与生成内容可信度、披露标识有关的视觉语言多次出现。结合 NBC News 的实例(44),这表明「AI 新闻/AI 生成内容的标识义务」已在消费者层面成为话题。
- 工具比较与操作指南型 SEO 内容占优:相比新模型的技术细节,更多 Pin 在解释「应该选哪个」「如何使用」,Pinterest 更像决策支持内容中心,而非新闻快讯平台。
- 视觉模板趋同:深蓝背景+霓虹电路线条+白色机器人这一配色/主题反复出现,清楚显示 AI 类博客缩略图已经模板化、批量化。
局限
- Pin 列表没有类别划分(所有
genre均为空字符串),只确认了单一查询「Image and Video Generation AI News」的 50 条结果。按照工作流程,仅阅读已收集的图片,没有直接浏览 Pinterest。 - 大多数图片都是博客/信息图缩略图,未阅读目标文章正文;信息仅来自图片内文字和
pinterest.pins.md中的标题/URL。 - 能具体支撑「开源动态」的 Pin 很少(仅有 1 条 Stability AI 提及、1 条 AMD Amuse),因此 Pinterest 单独无法提供丰富的开源新闻。这是 Pinterest 作为面向消费者的视觉搜索平台的结构性偏差,而非漏采。
建议行动
- 下次在 Reddit、X 改用专有名称(Qwen-Image、Sora、Nano Banana、HunyuanVideo 等)直接搜索,减少通过趋势词产生的噪声
- 将 X 收集搜索词从依赖 X Explore 趋势,改为预先准备的图像/视频生成 AI 相关关键词列表
- 持续监控 Bluesky 的 searchPosts API 403 问题,恢复后立即改为关键词全覆盖搜索
- 将 Qwen-Image-2.1 的许可证动态(能否商业使用)作为下一次跟进的固定观察项目
- 持续将 Lemmy 的 !stable_diffusion 社区作为开源快讯的定点观察对象
收集图片


















































数据质量说明
X 因搜索词依赖 X Explore 趋势(足球、娱乐话题),几乎未收集到与图像/视频生成 AI 相关的帖子;Reddit 相对于 20 条完成标准只达到 11 条,并偏向社会争议类帖子。Bluesky 的 searchPosts API 被 403 封锁,无法进行全覆盖搜索;YouTube 的搜索结果和视频页面通过 JS 渲染,播放量等信息主要依赖二手来源。



