KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-10-02

中国开源模型(Qwen-Image-2.1、Z-Image Turbo)正在逼近闭源领先者;与此同时,闭源模型因安全护栏、滥用风险和 Sora 的经济性问题而不断失去信任。

图像与视频生成 AI 新闻 — 2026-10-02

说真的,现在图像与视频生成 AI 圈子正变得非常疯狂😤。闭源阵营(OpenAI 的 GPT Image 2.5、Google 的 Veo 3.1/Nano Banana 2.0、Kling 2.5、Seedance 2.5 等)仍在不停进行功能竞赛;但与此同时,强化安全护栏、深度伪造和 Sora 巨额亏损等导致信任下滑的话题也在持续发酵💸。另一方面,以 Alibaba(Qwen-Image-2.1、Z-Image Turbo)为代表的中国开源阵营势头显著增强,而围绕 ComfyUI 在本地深度折腾的文化,也在 Reddit、Lemmy 和 Bluesky 上全面可见🔥。这次查看了 Reddit、X、YouTube、Bluesky、Lemmy、Pinterest 六个平台,但 X 完全扑空,下面会如实说明👇。

跨平台观察

按平台观察

Reddit 🟠 分析了 12 个帖子、9 个 subreddit。闭源方面,最受关注的是 Seedance 2.5(经 Higgsfield)已经能让一人完成带一致角色的 10 分钟短片(784 分,https://www.reddit.com/r/accelerate/comments/1wqqr4p/);开源方面,面向 MiniMax-H3 的 ComfyUI 节点被称为“我用过最好的节点”(https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/)。这里对安全护栏的不满也最为具体。

X ⚫️ 这里确实完全扑空😅。收集的 40 条帖子(33 个账号)全是足球、K-pop、英国政治、真人秀话题,完全没有 AI 图像或视频生成内容。原因是工作人员使用的搜索词是“Halloween”“Ronaldo”“#bb28”等 X 趋势页原词,而没有使用 AI 相关词。本次 X 部分没有能为报告贡献的信息。

YouTube 🔴 闭源方面,GPT Image 2.5 的“Sketch”功能(https://www.youtube.com/watch?v=LYUr4BY33h4)、Veo 3.1 免费开放(https://www.youtube.com/watch?v=uj6eD31OxkA),以及称 Nano Banana 2.0“超越 Photoshop”(https://www.youtube.com/watch?v=u22-XoQvI4I)的视频在同期集中出现,功能竞赛速度极快。开源方面,FLUX.2、Z-Image、Qwen-Image-Edit 的内容大量以“如何在 ComfyUI 中运行”的教程形式出现。需要注意的是,因 JavaScript 渲染问题,无法取得播放量、订阅数和评论,因此分析仅基于标题和 oEmbed 信息。

Bluesky 🔵 通过直接调用 AT Protocol API,从 100 多条真实数据中筛选。闭源方面,Veo 3 生成种族主义内容的问题(❤️842,https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y)和 Sora2 的经济崩溃话题(❤️1,375)遥遥领先;开源方面,Simon Willison、Ethan Mollick 等真正进行实机验证的研究者账号在讨论 Qwen-Image 与 GLM-5.3。也确认到许多使用 ComfyUI + Krea2 的日常创作帖子。

Lemmy 🟢 !«メールアドレス» 是核心社区,但分数通常只有 1 到 10 左右,规模较小。尽管如此,围绕 Qwen-Image-2.1 的工具(WebUI、LoRA、ControlNet)在同一周连续发布,可见其势头。闭源新闻(Sora API 停止、Nano Banana 2 的 Google Earth 功能因滥用一天内撤回 https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/)大多来自 !ai_reddit 的 Reddit 镜像机器人,几乎没有 Lemmy 自身的讨论。

Pinterest 🟣 实际打开核查了 50 个结果中的 18 个。绝大多数是闭源阵营(OpenAI/Google/Meta/Grok 标志加惊讶表情缩略图)的新闻汇总图片;开源方面只有 AMD Amuse 3.0 等少数具体名称。以皱纹、材质细节俱佳的人像展示逼真生成能力,是各家公司共同采用的基准式视觉语言。这是一个有趣发现。不过无法取得互动数(收藏/点赞),且仅使用了工作人员预先收集的图钉。

值得关注

建议

  1. 下次应使用“Midjourney”“Sora”“Nano Banana”“ComfyUI”“Flux”等 AI 直接关键词重新收集 X(Twitter)数据。
  2. 应持续将 Qwen-Image-2.1 生态的快速成长作为开源趋势的固定观察点。
  3. 应追踪 Sora2 的运营成本与收入关系,将其作为闭源视频生成模型整体盈利能力的指标。
  4. 应持续绘制由安全护栏导致的用户迁移图谱:用户从哪些工具离开,又迁往哪些工具。
  5. Pinterest 应将图像采样扩展至全部 50 个结果,或寻找可获取互动数的替代方案。
  6. 考虑到 Lemmy 的 !ai_reddit 依赖本质上是 Reddit 转发,应将 Lemmy 特有声音的观察范围聚焦于 !stable_diffusion 类社区。

数据质量

X 的收集数据与研究主题完全无关(误抓趋势页),此次未能提供任何贡献。YouTube 由于 JavaScript 渲染,无法确认播放量、发布日期、订阅数和评论,只能分析标题与 oEmbed 信息。Pinterest 只目视确认了 50 个结果中的 18 个,且未取得互动数(收藏/点赞)。Lemmy 虽然确认了帖子,但整体分数仅为 0 到 10,讨论热度低于其他平台。Reddit 与 Bluesky 基于真实收集/API 数据,可信度相对更高。

按平台汇总

Reddit

Reddit — 图像与视频生成 AI 新闻

分布位置

收集集内有 9 个 subreddit 承载这一主题(共 12 个帖子,均通过单一搜索词“Image and Video Generation AI News”找到):

  • r/generativeAI — 159,938 名成员 — 3 个帖子(#1、#2、#7)
  • r/TopologyAI — 24,052 名成员 — 1 个帖子(#3)
  • r/StableDiffusion — 1,027,672 名成员 — 1 个帖子(#4)
  • r/LocalLLaMA — 838,632 名成员 — 1 个帖子(#5)
  • r/AI_Agents — 452,911 名成员 — 1 个帖子(#6)
  • r/accelerate — 93,680 名成员 — 2 个帖子(#8、#12)
  • r/aifails — 39,194 名成员 — 1 个帖子(#9)
  • r/VideoEditors — 81,700 名成员 — 1 个帖子(#10)
  • r/mildlyinfuriating — 12,610,232 名成员 — 1 个帖子(#11)
用户在说什么
  • 闭源“免费”视频生成是一个神话,这是社区共识 — 帖子 #1,r/generativeAI,71 分,46 条评论,2026-09-30(https://www.reddit.com/r/generativeAI/comments/1wty6zj/)。发帖者认为云 GPU 成本使真正无限制的免费视频生成不可能存在;u/opengradient 补充说:“视频不像廉价 LLM,没人能免费送给你”(5 分)。
  • 闭源 NSFW 过滤正在收紧,推动用户转向开源/未过滤替代品 — 帖子 #2,r/generativeAI,7 分,14 条评论,2026-09-30(https://www.reddit.com/r/generativeAI/comments/1wtzefv/)。DreamFort.ai 加强了基于 WAN 3.0 的过滤;u/opengradient 指出“很多闭源模型提供商最近引入了更严格的控制(包括拥有 Wan 3.0 的 Alibaba)”,并推荐 Seedream 2.0 Unfiltered 与 MiniMax H3。
  • 开源 + Blender 3D 工作流被宣传为解决视频生成可控性的方案,但社区并不确定它是否真实有效 — 帖子 #3,r/TopologyAI,437 分,19 条评论,2026-09-28(https://www.reddit.com/r/TopologyAI/comments/1wsmvvm/)。尽管得分很高,热门评论主要是困惑的问题(“这是哪种‘3d AI’?”— u/stevester911,5 分),以及 u/amon_de_no 的直接否定:“那是假的真实 AI”(5 分)。
  • 面向 MiniMax-H3 的开源参考一致性工具反响极佳 — 帖子 #4,r/StableDiffusion,690 分,51 条评论,2026-09-30(https://www.reddit.com/r/StableDiffusion/comments/1wtu82e/)。一款免费的 ComfyUI 节点(Fantastic-MiniMaxH3-PromptBuilder)修复了参考图视频编辑中的身份泄漏;u/ClassicUse2579 表示:“H3 media loader 这东西是我用过最好的 Comfy 节点之一,实在太棒了!”(3 分)。
  • 开源本地图像/聊天栈已经成熟到可作为怀旧展示项目运行 — 帖子 #5,r/LocalLLaMA,194 分,96 条评论,2026-10-01(https://www.reddit.com/r/LocalLLaMA/comments/1wuxzdg/)。一台 1990 年代的 Tandy 1000 通过 WiFi 驱动本地运行的 Qwen3.8-27B + Krea 2(ComfyUI)进行聊天和图像生成。但热门评论质疑这一说法:u/Aggravating-Push-207(113 分)称:“这不是运行在 Tandy 上,只是在你家网络里发请求。”
  • 闭源安全护栏足以令普通用户受挫并转向替代品 — 帖子 #6,r/AI_Agents,0 分,22 条评论,2026-09-29(https://www.reddit.com/r/AI_Agents/comments/1wt7jqr/)。一名用户无法让 ChatGPT 绘制超级英雄,持续遭到安全护栏拒绝;评论者将其引向 Midjourney、Grok、VeniceAI 与开放的“未审查 sdxl”模型。
  • 在免费/低价端,闭源每日额度工具仍主导面向普通用户的推荐 — 帖子 #7,r/generativeAI,4 分,59 条评论,2026-09-26(https://www.reddit.com/r/generativeAI/comments/1wqfleb/)。推荐出现分化:u/Scuzzy_Womack 推荐离线 ComfyUI(3 分,开源),其他人则因每日免费额度推荐 Yodayo/MoescapeAI 和 Leonardo(闭源)。
  • 闭源视频(Higgsfield 上的 Seedance 2.5)如今已足以完成一人制作的 10 分钟叙事短片 — 帖子 #8,r/accelerate,784 分,196 条评论,2026-09-26(https://www.reddit.com/r/accelerate/comments/1wqqr4p/)。每个镜头都使用角色设定图以保持 Captain Walker 跨场景一致;u/JoseLunaArts(95 分)认为“零预算”的说法低估了 token 成本,u/Nabugu(7 分)则指出反复出现的“AI 帅脸”同质化问题。
  • 图像生成仍会以荒谬、适合做梗的方式失败——被当作娱乐,而非趋势 — 帖子 #9,r/aifails,526 分,76 条评论,2026-09-28(https://www.reddit.com/r/aifails/comments/1ws6jzs/)。一个鸡的解剖提示词生成了荒谬的解剖结果;u/kasimirvendom 的热门评论说:“万物皆有尽头,只有鸡有两个”(52 分)。
  • 视频编辑者被明确告诫:目前不要依赖 AI 工具 — 帖子 #10,r/VideoEditors,4 分,39 条评论,2026-09-26(https://www.reddit.com/r/VideoEditors/comments/1wqkx27/)。热门评论(u/VisibleExplanation,33 分)称:“忘掉所有 AI 工具。下载 Davinci Resolve 并学会如何使用它……除非你具备基础知识,否则任何 AI 工具都不会给你好结果。”
  • 闭源编辑工具悄悄将轻微修改重标为“生成式 AI”,正在引发信任反弹 — 帖子 #11,r/mildlyinfuriating,1,268 分,136 条评论,2026-09-28(https://www.reddit.com/r/mildlyinfuriating/comments/1wsupkx/)。据称 Photoshop/Apple Photos 会将简单裁剪标为 AI 编辑并删除版权署名;u/Kagevjijon(41 分)称:“这种状态不可能继续下去。这就是偷窃。”u/teh_maxh(135 分)则反驳:“我刚试过用 Photoshop 裁剪图片,它没有添加声明我用了 GAI 的元数据。”
  • AI 生成游戏模组(开放、社区驱动)正迎来高光时刻 — 帖子 #12,r/accelerate,193 分,35 条评论,2026-09-30(https://www.reddit.com/r/accelerate/comments/1wuhyiw/)。u/Chopstik0-0(38 分)描述 VR 模组社区如何从抵制转向兴奋,因为大家认识到“实际上没人再制作新的 VR 游戏了”。
信号
  • **上升中:**开源参考一致性工具(帖子 #4 的 ComfyUI 节点、帖子 #5 的本地 Qwen+Krea2 栈)获得了样本中最明确的赞誉——高分与真正积极、技术性的热门评论相结合,而不只是炒作。
  • **上升中:**闭源视频生成已跨入长篇叙事领域——帖子 #8 中具有一致重复角色的 10 分钟短片,是收集到的互动最高帖子(784 分、196 条评论),社区批评的焦点是剧本和配音,而不是视觉效果。
  • 被否定:“真正免费”的闭源视频生成器已被视为一个结论已定、略显乏味的话题(帖子 #1)——讨论已转向“哪种开源本地配置”,而非“哪个免费网站”。
  • **存在分歧:**帖子 #3 显示表面兴奋(437 分)与评论层面对展示内容的怀疑/困惑之间存在落差——提醒我们,关于“3D AI”工作流的模糊帖子即使没人真正认同它是什么,也能在这个搜索词下获得高分。
  • **意外发现——安全护栏如今是用户切换平台的反复驱动力,而非单纯烦恼:**帖子 #2(闭源 NSFW 过滤收紧)和帖子 #6(ChatGPT 的安全护栏阻止非露骨的超级英雄图像)都显示,用户正因为审核离开闭源工具,转向另一款闭源工具(Grok、VeniceAI)或开源工具(Seedream Unfiltered、未审查 SDXL)。
  • **意外发现——帖子 #11 中对闭源工具的信任反弹完全不是因为内容过滤:**它关乎署名/元数据(把普通编辑自动标为“生成式 AI”并删除版权信息),这是与样本中其他安全护栏不满不同的投诉。
限制
  • 收集者只使用了一个搜索词“Image and Video Generation AI News”,找到了跨 9 个 subreddit 的 12 个帖子——少于任务完成标准中每个网络约 20 个帖子的目标。根据操作手册,我只阅读工作人员已收集的内容(output/reddit.threads.md),没有自行浏览 Reddit 补充,因为 Reddit 会阻止 WebFetch,且网页搜索会导向相关页面。
  • 帖子 #9、#11 和 #12 没有抓取到正文开头(仅有标题),因此这些发现完全依赖评论与分数。
  • 没有帖子专门呈现闭源实验室的重要公告(例如 OpenAI/Google/Midjourney 的具名模型发布)——收集集偏向用户体验、工具和安全护栏摩擦,而非产品发布新闻。

X

X — 图像与视频生成 AI 新闻

账号

收集数据中没有任何账号在讨论图像或视频生成 AI,无论是闭源还是开源。记录的 33 个账号(@Davesonude、@rcostadoazeite、@ChrisExcel102、@Louissaikyoo、@DlugoszMarcin、@khtaeverse 及其他 27 个)是体育梗图账号、K-pop 粉丝账号、《Big Brother》(#BB28)粉丝账号、英国政治账号(Restore Britain)和普通梗图/灌水账号。它们没有将 AI 图像或视频工具作为主题,因此无法报告“谁在 X 上推动这一话题”——参见 ## 限制。

帖子

output/x.posts.md 中没有任何帖子(40 条帖子、33 个账号)提到图像生成 AI、视频生成 AI 或相关产品、公司或开源项目(没有 Midjourney、Sora、Stable Diffusion、Flux、Runway、Veo、Nano Banana、ComfyUI 等类似词)。对互动最高帖子的抽查也证实了这一点:

这些帖子以及剩余的 36 条帖子,没有一条涉及研究主题。我不会在这里列出 5–12 条关于 AI 图像/视频生成的“发现”,因为收集材料中根本没有这些内容——这样做意味着编造,而本次运行的操作手册明确禁止如此。

信号

无法从这份数据集中读取任何关于开源或闭源图像/视频生成 AI 的信号。但数据确实显示:用于收集的十个搜索词(“Halloween”“Ronaldo”“Britain”“Yess”“JubJub”“Gold”“China”“#bb28”“Messi”“Balkans”)是本会话所在地 X Explore 页的趋势词,而非 AI 媒体生成主题。output/x.posts.md 中的 Explore 表格确认:10 个趋势中 6 个明确标注为“Trending in Croatia”,其他词(“Ronaldo”“Britain”“China”“Messi”)则是全球体育/政治趋势——没有一个与 AI 或科技有关。这似乎是收集阶段的错配:工作人员抓取了 X 所称的热门话题,而非搜索 AI 图像/视频生成术语,因此收集到的 40 条帖子涉及足球、英国政党(Restore Britain)、K-pop 粉圈纠纷、真人秀季(#BB28)和无关梗图。

限制
  • **收集数据没有覆盖研究任务。**任务要求研究闭源和开源图像/视频生成 AI 新闻;而工作人员的 10 个搜索词是本会话中 X 的通用趋势话题(根据 Explore 表格主要定位于克罗地亚),不是 AI 相关查询。人工审阅了全部 40 条帖子,无一符合主题。
  • 根据本阶段的操作手册,我没有自行浏览 X(匿名读者在 X 上看不到内容),仅依赖已收集的 output/x.posts.md / output/x.posts.json。
  • 虽然完成标准“每个社交网络分析约 20 条帖子”在数量上已满足(分析了 40 条),但在相关性上没有满足,因此 X 阶段无法为综合结论贡献任何闭源或开源发现。应以“Midjourney”“Sora”“Stable Diffusion”“Flux”“Runway”“Veo”“Nano Banana”“ComfyUI”等搜索词重新运行 X 阶段,而不是本次使用的通用趋势词。

YouTube

YouTube — 图像与视频生成 AI 新闻(闭源/开源)

频道
  • AI WITH Rithesh(Rithesh Sreenivasan)— 在 ChatGPT/OpenAI 系发布当天即进行测试的个人频道。
  • Bart Slodyczka — 汇总新模型发布后“有哪些变化”的频道。
  • Learn with LEESI — 专注 Google Gemini/Veo/Flow 系教程的频道。
  • WorldofAI(@intheworldofai)— 每周回顾闭源 AI 新闻。
  • MattVidPro — 以 AI 视频生成模型对比和速报闻名的大型 AI 频道。
  • There's An AI For That(@theresanaiforit)— 新模型速报与对比频道。
  • Promptus AI(@promptusai)— 专注开源图像/视频模型本地部署教程。
  • AI Late to Class(@ailatetoclass)— 开源图像编辑模型评测频道。
  • MaxonShire — 专注本地视频生成模型对比(HunyuanVideo、Wan、LTX 等)。
  • smallzero(@webdot3)— 使用 ComfyUI 应用开源模型(如 Z-Image)。
  • FlyMyAI — 提供每日/每周 AI 新闻简报。
  • Lev Selector(@lev-selector)— 每周 AI 更新汇总频道。

由于 YouTube 搜索结果 HTML 由 JavaScript 渲染,无法直接确认频道订阅数(参见限制)。

视频
闭源
  1. “ChatGPT Images 2.5 Is INSANE… 48 Hours Later, I'm Still Shocked!” — AI WITH Rithesh / 2026 年 9 月上旬 — 测试 OpenAI 于 2026 年 9 月 8 日推出的 GPT Image 2.5(新增从草图生成图像的“Sketch”功能,生成速度最高提升 50%)。 https://www.youtube.com/watch?v=LYUr4BY33h4
  2. “ChatGPT Image 2.5 Just Dropped — Here's Everything That's New” — Bart Slodyczka / 2026 年 9 月 — 全面介绍 GPT Image 2.5 的新功能。 https://www.youtube.com/watch?v=dvpQHWwuaIo
  3. “Google Just Made VEO 3.1 FREE for Everyone with Unlimited AI Video Generation” — Learn with LEESI — 介绍 Google 通过 Flow/Vids 免费开放 Veo 3.1(支持图生视频和三张参考图)。 https://www.youtube.com/watch?v=uj6eD31OxkA
  4. “Google's Nano Banana 2.0: Best Text-To-Image Generation Model EVER! The Photoshop killer!” — WorldofAI — 测试 Google DeepMind 的 Nano Banana 2.0(Gemini 系图像生成),评价其“超越 Photoshop”。 https://www.youtube.com/watch?v=u22-XoQvI4I
  5. “Kling 2.5 goes BEAST MODE for AI Video!” — MattVidPro — 报告 Kling 2.5 在动作动态性方面有明显进化。 https://www.youtube.com/watch?v=SGUxHC1cI1c
  6. “AI Video Models Are Getting Out of Control! (WAN 2.5, Kling 2.5, Wanimate)” — MattVidPro — 横向对比闭源 Kling 与开源 Wan,认为竞争正在升温。 https://www.youtube.com/watch?v=vFXe3uXb75k
  7. “Your AI news brief for September 3, 2026.” — FlyMyAI — 截至 2026 年 9 月 3 日的综合 AI 新闻简报,包含图像/视频生成话题。 https://www.youtube.com/watch?v=JK6w9tA2jH8
  8. “Exciting AI Updates Weekly - September 25, 2026” — Lev Selector — 最近一周 AI 更新汇总,包含图像和视频生成模型话题的周更系列。 https://www.youtube.com/watch?v=iyZHPCNd8jI
开源
  1. “Is FLUX 2.0 The New Open Source King?” — There's An AI For That — 将 Black Forest Labs 的 FLUX.2 评价为最强候选开放权重图像/编辑模型。 https://www.youtube.com/watch?v=YQuTkPVkCS8
  2. “New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial”(oEmbed 标题为“Z-Image Open-Source Image Generator: Free Online and Local Setup”)— Promptus AI — 介绍 Alibaba Tongyi-MAI 的 Z-Image Turbo(60 亿参数、可在 6GB VRAM 上运行)超过 Flux 2。 https://www.youtube.com/watch?v=JF4Q5hXh-_Q
  3. “Z-Image Full Release: The New King of AI Influencers in ComfyUI?” — smallzero — 在 ComfyUI 中测试 Z-Image 的未蒸馏完整发布版(Base)。 https://www.youtube.com/watch?v=ClVY5ll1sDU
  4. “Qwen Image 2.1 best open source Image Editor. Better than Nano Banana” — AI Late to Class — 评价 Alibaba Qwen-Image-Edit 最新版支持十张参考图、透明背景且速度更快,可媲美或超过 Nano Banana。 https://www.youtube.com/watch?v=AIgYj5RG-FQ
  5. “HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?” — MaxonShire — 比较 Tencent HunyuanVideo 1.5 与 Alibaba Wan 2.7 两种本地视频生成模型。 https://www.youtube.com/watch?v=4GNT4-QYekg
信号
  • **闭源阵营以“功能增加速度”竞争:**OpenAI(GPT Image 2.5“Sketch”,2026/9/8)、Google(Veo 3.1 免费开放并整合 Google Vids/Flow)、Kling 2.5 的更新几乎同期出现,按月持续进行功能竞赛。
  • **开源阵营中,中国团队(Alibaba Tongyi-MAI、Qwen)势头增强:**Z-Image Turbo 和 Qwen-Image-Edit 反复以“可在 6GB/低 VRAM 运行”“质量媲美 Nano Banana”为切入点出现,并与 Black Forest Labs 的 FLUX.2 直接比较。
  • “开源 vs 闭源”对比视频已成为一个内容类型:“WAN 2.5 is Open Source Veo3”“Z-Image vs Flux 2”等标题非常普遍,开源模型被作为闭源替代品讨论。
  • 在 ComfyUI 中本地运行的教程(Promptus AI、MaxonShire、smallzero)已成为开源模型的主要内容形式——每当新模型发布,“如何在 ComfyUI 中安装”的视频就迅速出现。
  • 周刊/日报 AI 新闻简报频道(FlyMyAI、Lev Selector)持续报道图像与视频生成话题,单个模型新闻也通过这些定期更新频道传播。
限制
  • YouTube 搜索结果页(youtube.com/results?search_query=...)和视频页(youtube.com/watch?v=...)由 JavaScript 渲染,因此 WebFetch 无法直接取得视频列表或页面正文(播放量、发布日期、频道订阅数、评论)。标题和频道名通过各视频的 youtube.com/oembed 端点(JSON)确认;发布日期和背景则以网页搜索摘要及相关报道补充。
  • 因此,各视频的准确播放量、发布日期和频道订阅数尚未确认。部分视频在搜索结果中显示“几天前”等相对时间,但其中许多已超过 60 天(有的超过 300 天),所以本报告优先采用可明确判断为 60 天内的话题(GPT Image 2.5:2026/9/8;以及明确标注日期的周报视频)。
  • 虽然确认存在 Runway Gen-4.5、Grok Imagine、Seedream 4.0、Midjourney V8 等相关 YouTube 视频,但未取得足够信息确认发布时间或频道细节,因此未纳入 Videos 栏(网页搜索已确认其存在)。
  • 因无法取得视频页正文,本次未分析评论区内容。

Bluesky

Bluesky — 图像与视频生成 AI 新闻(闭源/开源)

调查方法:由于 Bluesky 官方网站(bsky.app)是用 JavaScript SPA 渲染搜索结果,无法直接获取内容,因此直接调用 Bluesky 的 AT Protocol 公开 API(https://api.bsky.app/xrpc/app.bsky.feed.searchPosts,无需认证)取得真实帖子数据(正文、作者、点赞数、发布时间)。使用“Nano Banana”“Sora 2”“Flux”“ComfyUI”“Z-Image”“Qwen Image”“open weights”“Veo 3”等关键词搜索,共核查 100 多条真实帖子,再筛选出符合主题的内容。

账号
  • Eliot Higgins(eliothiggins.bsky.social,Bellingcat 创始人,Bluesky 已验证)— 持续讨论 Veo 3 造成虚假信息与深度伪造的风险。
  • Simon Willison(simonwillison.net,独立 AI 研究者,Bluesky 已验证)— 在本地实际运行 Qwen-Image / Qwen-Image-Edit 等开放权重模型,并发布技术笔记。
  • Ethan Mollick(emollick.bsky.social,沃顿商学院教授,Bluesky 已验证)— 定期评论开放权重模型的风险与能力。
  • 404 Media 记者(Jason Koebler jasonkoebler.bsky.social、Sam Cole samleecole.bsky.social)— 调查报道 Sora 2 的版权与内容审核问题。
  • obeca(obeca.bsky.social,土耳其语圈)— 几乎每天发布用 Nano Banana 2 生成图片的个人账号。
  • Ria_Tatibana(ria-tatibana.bsky.social,日语圈)— 用 ComfyUI + Krea2(开源模型)每日发布插画。
  • cubby.jpg(cubby-ai.bsky.social)— 大量发布使用 Z-Image / Qwen-Image 等开源图像模型生成的 AI 艺术作品。
  • AlternativeTo(alternativeto.net)— 软件新闻自动发布账号,快速报道 Qwen-Image-2.1 等模型发布。
帖子
闭源
  1. Google Veo 3 能生成种族主义内容的问题 — Eliot Higgins,2025-06-22,❤️842。“Google Veo 3 正在提供新的、令人兴奋的种族主义方式。” https://bsky.app/profile/eliothiggins.bsky.social/post/3ls6ridsm4s2y
  2. TIME 记者成功使用 Veo 3 生成穆斯林纵火、印度教寺庙着火等假视频;Google 在被追问后增加了可见水印 — Aman Batheja(TIME 记者),2025-06-03,❤️431、🔁192、引用 107。“最新消息:TIME 记者能够使用 Google 的 AI 视频工具制作穆斯林焚烧印度教寺庙的逼真视频……” https://bsky.app/profile/amanbatheja.bsky.social/post/3lqpalskjp22h
  3. Sora 2 年运营成本约 50 亿美元、迄今为 OpenAI 带来约 140 万美元收入的说法 — Peter Labuza,2026-02-10,❤️1,375、🔁368、引用 192。“据说 Sora 2 每年运行成本约为 50 亿美元,而迄今为 OpenAI 赚了约 140 万美元。” https://bsky.app/profile/labuzamovies.com/post/3mek2c2xipk2o
  4. 批评文章认为,Sora 象征着 AI 公司“不使用版权作品训练”的表面说法已经崩塌 — Jason Koebler(404 Media),2025-10-01,❤️1,508、引用 44。“Sora 这件事非常黯淡,显示我们已离 AI 公司假装没有用版权材料训练模型的时代多远。” https://bsky.app/profile/jasonkoebler.bsky.social/post/3m25uzxbcak23
  5. 报道称 Sora 2 一禁止生成版权角色,用户便大规模不满 — Sam Cole(404 Media),2025-10-08,❤️435、引用 37。“看起来人们唯一想在 Sora 上做的事情,就是生成版权角色图片;现在做不到了,他们彻底崩溃。” https://bsky.app/profile/samleecole.bsky.social/post/3m2ovizmqks2t
  6. 关于 Nano Banana(2)系列生成图片“骗过自己”的体验谈 — furuakasaber.bsky.social,2026-07-03,❤️333。“这破 Nano Banana 骗过了我,虽然我觉得有点不对劲。挺可怕的。” https://bsky.app/profile/furuakasaber.bsky.social/post/3mpr6djkzsk2e
  7. 对 Nano Banana 风格信息图(“看起来很 AI 的图解”)的疲劳感 — garrison.corporate.fm,2026-03-15,❤️73、🔁9。“必须不惜一切代价阻止 nano banana 信息图。” https://bsky.app/profile/garrison.corporate.fm/post/3mh4g5avqp22p
开源
  1. Alibaba Qwen 以 Apache 2.0 许可证发布首个图像生成模型“Qwen-Image” — Simon Willison,2025-08-04,❤️46。“Qwen 今天发布了首个图像生成模型 Qwen-Image;和他们的 LLM 一样采用 Apache 2.0。” https://bsky.app/profile/simonwillison.net/post/3lvlvsxkzp223
  2. Qwen-Image-Edit 实机测试:Mac 上几乎耗尽 64GB RAM,需 54GB 磁盘空间 — Simon Willison,2025-08-19,❤️77。“在我的 Mac 上运行新 Qwen-Image-Edit 模型的笔记……它几乎用掉了我的全部 64GB RAM,并需要 54GB 磁盘空间。” https://bsky.app/profile/simonwillison.net/post/3lws3xfzhv22u
  3. Alibaba 以开放权重发布 70 亿参数“Qwen-Image-2.1”,并更改许可协议 — AlternativeTo,2026-09-24,❤️6。“Alibaba Cloud 发布了一个 70 亿参数模型 Qwen-Image-2.1……许可协议发生了变化。” https://bsky.app/profile/alternativeto.net/post/3mwaq75byhn2a
  4. Apple 发布用于图像和视频生成的 Transformer 自回归流模型“STARFlow”“STARFlow-V”开放权重 — Sung Kim,2025-12-02,❤️13。“Apple 发布了 STARFlow 与 STARFlow-V 的开放权重,这是面向高质量图像和视频生成的先进 Transformer 自回归流模型。” https://bsky.app/profile/sungkim.bsky.social/post/3m6xsab2zj22w
  5. 警告称开放权重模型“GLM-5.3”性能强但几乎没有安全护栏,甚至具备攻击性网络能力 — Ethan Mollick,2026-08-28,❤️88。“开放权重模型实际上没有安全护栏,而且只提供最低限度的风险测试。” https://bsky.app/profile/emollick.bsky.social/post/3mu5xtm24zk2o
  6. 用 ComfyUI + Krea2(开源图像模型)每日发布插画,单帖❤️50–80 — Ria_Tatibana,2026-09-28 至 10-01 的多条帖子(例:https://bsky.app/profile/ria-tatibana.bsky.social/post/3mwtrqf7glc2t,❤️53)。ComfyUI 标签的热门搜索结果大多是 AI 插画作者的日常作品分享。
  7. 对于 Z-Image(Alibaba Tongyi 制作的轻量开源图像模型)即将发布的期待与讽刺 — theophite.bsky.social,2025-11-27,❤️30。“并不期待 z-image 的发布。” https://bsky.app/profile/theophite.bsky.social/post/3m6ldsilaz22f
信号
  • **Veo 3 已形成“虚假信息工具”的声誉:**Eliot Higgins(Bellingcat 创始人)反复讨论这一问题,TIME 的调查报道也被广泛传播(❤️431、引用 107)。闭源视频生成最主要的争议已从“质量”转向“滥用”。
  • **Sora 2 在经济上也面临困境,争议仍在延续:**年运营成本 50 亿美元、收入 140 万美元的数据(❤️1,375)广泛传播。随着版权角色生成限制加严,用户不满爆发(❤️435);“闭源条款改变 → 用户反弹”的结构一再出现。
  • **Nano Banana(Google)已成为普通用户默认的图像生成工具:**obeca.bsky.social 等个人账号几乎每天发布生成图,在土耳其语、日语等非英语圈也已普及。但“难以分辨、令人害怕”的意见(❤️333)也很强烈。
  • **开源图像生成中,“Qwen-Image 系列”是技术社群的核心话题:**Simon Willison 等 AI 研究者会进行实机验证,甚至记录 VRAM/磁盘占用;其 Apache 2.0 许可证也受到积极评价。不过 Qwen-Image-2.1 出现了许可变更(❤️6 的帖子提及),开源一侧也存在“这到底是否真正开放”的紧张感。
  • **ComfyUI 仍是开源图像生成的事实标准工作流:**大部分搜索结果是用 ComfyUI + 特定模型(Krea2、SDXL 等)创作的日常 AI 插画帖子,显示它已不只是技术新闻,而是融入日常的工具。
  • **专家警告:开放权重意味着高性能,但也意味着缺少安全护栏:**Ethan Mollick 等知名研究者账号开始讨论 GLM-5.3 等开放权重模型的攻击性能力及最少风险测试。Apple(STARFlow)等大型公司也加入开放权重发布,开源阵营正在扩大。
限制
  • Bluesky 官方网站(bsky.app)为 SPA,直接使用 WebFetch 不能取得正文;public.api.bsky.app 搜索端点也返回 403。最终发现同一 API 的 api.bsky.app(无“public.”)版本无需认证便可响应,因此使用其取得真实数据。
  • “Flux”“Kling”“Wan”等容易与普通名词或其他领域(游戏、天气、人名)冲突的关键词搜索噪音很高,无法收集足够相关帖子(Flux 搜索 15 条中,实质与图像生成 AI 有关的为 0)。未能确认 Bluesky 上有足够关于 Black Forest Labs FLUX.2 的特定讨论。
  • 对 Kling 2.5、Wan 2.5、HunyuanVideo、Seedance 等视频生成开源/闭源模型,使用本次搜索关键词未能获得足够命中,因此无法确认它们在 Bluesky 上是否形成话题(YouTube 等平台可能更活跃)。
  • 搜索 API 即使指定 sort=top 也不一定是真正按热度排序(基于 cursor 的分页中可见日期混杂);所选“代表性帖子”并非严格人气排名,而是从已确认相关且真实存在的帖子中筛选。

Lemmy

Lemmy — 图像与视频生成 AI(闭源/开源)动态

社区
  • !«メールアドレス» — 开源新模型和工具发布的核心社区。发帖频率高,但每帖分数通常在 1 到 10 左右,规模较小。
  • !«メールアドレス» / !«メールアドレス» — Civitai 联动自动发布的社区,每日推送生成图片(Krea、SDXL 系模型等)。新闻性不强,但可作为开源模型日常使用的证据。
  • !«メールアドレス» / !«メールアドレス» — 将同一图像交叉发布的抽象艺术示例社区。
  • !«メールアドレス» — 由机器人镜像 Reddit AI 子版块(r/ArtificialIntelligence 等)的社区。闭源新闻(Sora、Nano Banana、Seedream 等)主要经此流入,但分数几乎都为 0–1,几乎没有讨论。
  • !«メールアドレス» / !«メールアドレス» / !tech — Black Forest Labs 的 FLUX 相关新闻偶尔会出现在这里。
  • !«メールアドレス» / !casual_perchance — 免费浏览器图像生成服务 Perchance.org 的用户社区。
  • 由于 Lemmy.world 端的社区页面(/c/<name>)持续返回 500/400 错误,且 API(/api/v3/community)参数不明,无法确认各社区订阅数(参见限制)。
帖子
偏开源
  1. scraed/LanPaint — 可用于任意 Stable Diffusion 模型、无需训练的高质量修补工具(支持 ComfyUI)/ !«メールアドレス» / score 8 / 2026-09-29 / https://github.com/scraed/LanPaint/
  2. DenRakEiw/scumble — 支持图层、文本选择和自定义画笔的 AI 修补专用桌面编辑器。可使用自建 ComfyUI 或 API 提供商绘制,支持 MCP / !«メールアドレス» / score 3 / 2026-09-29 / https://github.com/DenRakEiw/scumble
  3. ogoun/fooocus-qwen-image-2.1 — 面向 Qwen-Image-2.1 的 WebUI / !«メールアドレス» / score 2 / 2026-09-27 / https://github.com/ogoun/fooocus-qwen-image-2.1
  4. PrunaAI/Pruna-Qwen-Image-2.1 — 面向 Qwen-Image-2.1 的少步 LoRA 适配器(与 Kijai 的 QwenImage_experimental ControlNet union 衍生版本同期出现,围绕 Qwen-Image-2.1 的工具群迅速增加)/ !«メールアドレス» / score 0 / 2026-09-26 / https://huggingface.co/PrunaAI/Pruna-Qwen-Image-2.1
  5. black-forest-labs/FLUX.2-klein-9b-kv-fp8 — Black Forest Labs 开放权重 90 亿参数模型的 FP8 量化版本 / !«メールアドレス» / score 8 / 2026-03-14 / https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8
  6. Alice v1: Distillation-Enhanced Video Generation Surpassing Closed-Source Models — 声称通过增强蒸馏超过闭源视频模型的开源视频生成模型 / !«メールアドレス» / score 5 / 2026-05-13 / (附 webm,lemmy.dbzer0.com pictrs)
偏闭源
  1. Black Forest Labs 发布“FLUX 3” — 除图像生成外,还能生成带音频的 20 秒视频,首先限量开放 / !«メールアドレス» / score 1 / 2026-07-24 / https://bfl.ai/blog/flux-3
  2. OpenAI 将在下周(9/24)停止 Sora API;与此同时,中国竞争者融资 30 亿美元 — 分析称面向消费者的 AI 视频不赚钱,Kling 等面向企业的产品则获得资金 / !«メールアドレス» / score 1 / 2026-09-20 / https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
  3. Google 一天内撤回 Google Earth 的 AI 功能(Nano Banana 2) — 因滥用而停止功能 / !«メールアドレス» / score 1 / 2026-08-07 / https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/
  4. Seedream 5.0 Pro 的诚实对比与技术解析(对阵 Nano Banana Pro) / !«メールアドレス» / score 1 / 2026-07-10 / https://www.reddit.com/gallery/1usc03q
  5. “用四种 AI 给《剑风传奇》同一跨页上色”对比 — 并列测试 ChatGPT Images 2.5 / Wan 2.7 Pro / Nano Banana Pro / Seedream 5.0 Pro,有意见认为 GPT 获胜 / !«メールアドレス» / score 1 / 2026-09-14 / https://www.reddit.com/gallery/1wfyqdy
  6. 让 6 个 AI 视频模型使用同一提示词,并由约 40 人盲测 — Google Veo 第一,前三名差距很小 / !«メールアドレス» / score 1 / 2026-09-17 / https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
  7. ByteDance 发布 Seedance 2.5 — 增加一镜到底生成和灵活参考功能 / !«メールアドレス» / score 3 / 2026-08-01 / https://seed.bytedance.com/en/blog/one-take-creation-flexible-referencing-introducing-seedance-2-5
  8. Runway 称其企业业务翻倍、NRR 超过 300% / !«メールアドレス» / score 0 / 2026-08-30 / https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/
信号
  • **Qwen-Image-2.1 是 Lemmy 开源阵营的核心:**WebUI(fooocus 衍生)、ControlNet(Kijai)和少步 LoRA(PrunaAI)在同一周(9/26–27)连续出现,Qwen-Image 系列已成为当前 ComfyUI/Stable Diffusion 社区的主战场。
  • **“闭源阵营自己打破边界”的趋势:**原本强调开放权重的 Black Forest Labs,在 FLUX 3 中将视频+音频功能设为“闭源限量发布”;同时也发布 FLUX.2-klein-9b 等开放权重版本,开放/闭源的边界正变得模糊。
  • **Nano Banana 2 既是热点也是导火索:**整合进 Google Earth 后因滥用一天内撤回,是最具事件性的消息,并获得最高分(score 6,其他大多分数低)。
  • **AI 视频呈现“面向消费者不赚钱”的论调:**通过 Reddit 镜像的多条帖子对比了 OpenAI 停止 Sora API,与 Kling/Seedance/Runway 专注企业市场并在融资、收入上取得优势的情况。
  • **横向比较内容很多:**反复出现将 Nano Banana Pro / Seedream 5.0 Pro / Wan 2.7 Pro / ChatGPT Images 2.5 在同等条件下比较的帖子——用户比起单独新闻,更关心“哪个最强”。
  • **几乎没有 Lemmy 独有的讨论:**大部分帖子来自 !ai_reddit(Reddit 镜像机器人),分数为 0–1、评论不多。Lemmy 原生分析主要只有 !«メールアドレス» 的工具帖子。
限制
  • Lemmy 没有专门面向图像/视频生成 AI 的大型社区;话题分散在小型 !«メールアドレス»(工具与模型帖子,分数个位数)和转发 Reddit 帖子的机器人社区 !ai_reddit(分数 0–1)。后者本质上是 Reddit 再发布,不代表 Lemmy 独立观点。
  • 无法取得社区订阅数。https://lemmy.world/c/<community> 反复返回 HTTP 500,https://lemmy.world/api/v3/community?name=... 返回 HTTP 400(可能是参数规范与通常 v3 文档不同,或实例端有限制)。
  • 对“Grok Imagine”“Kling AI”“Runway Gen”“HunyuanVideo”“Flux”等独立关键词的搜索几乎没有相关帖子(仅有噪音),说明这些名称在 Lemmy 上提及很少。
  • lemmy.world 的搜索 API 声称可进行跨实例(联邦)搜索,但实际返回的主要是 lemmy.world / lemmy.ml / lemmy.dbzer0.com / lemmy.today / lemmy.zip 来源帖子;没有足够时间单独搜索 lemmy.ml 或 lemm.ee。
  • 帖子总分普遍很低(多数 0–10),不足以称得上“热烈讨论”。这既与 Lemmy 本身规模较小有关,也与图像/视频生成 AI 在其上缺少专门社区有关。

Pinterest

Pinterest — 图像与视频生成 AI 新闻

已收集 50 个图钉(未分类,单一集合)。实际打开并核查了标题和缩略图。

视觉主题
  • “惊讶表情 YouTuber + 一堆标志”缩略图 — OpenAI、Google、Meta、Microsoft、Anthropic 标志以霓虹风排列,旁边配有惊讶男性面孔的“AI NEWS”视频缩略图多次出现。闭源阵营的最新新闻几乎都采用这一固定格式 [2, 7, 23, 41]
  • 机器人=新闻主播 的视觉反复出现。白色仿生机器人穿西装坐在“BREAKING NEWS”面板前,或以 AI 主播接管新闻演播室来想象未来 [23, 45]
  • 逼真人物肖像演示图 — 连皱纹、胡须、材质细节都精细呈现的老年男性面孔,被反复作为新模型发布的亮点图(AMD Amuse 3.0、Luma Dream Machine 的眼部特写等)。逼真度成为当前的基准 [43, 47]
  • 将同一源视频转换为多种风格的网格对比图 — 用木雕、折纸、乐高、花卉装饰等材质重新生成同一人物或车辆,展示“风格一致性” [4]
  • 霓虹未来 UI 模拟图 — 发光图标、带电路板纹理的头部轮廓、全息感仪表盘等抽象宣传图很多,用来整合推广“图像/视频/音乐/文本生成” [5, 9, 22, 50]
  • 工具比较与速查信息图 — 将 ChatGPT/Midjourney/Gemini/Runway/Pika/Krea 等标志排成网格,并按“付费选这个、免费选这个”分类的霓虹赛博风图表 [40]
  • 假内容检测与 AI 伦理警示视觉 — 机器人质疑带有“FAKE”印章的猫图、通过眼睛前后对比提醒“不要只凭外表相信”的信息图等,围绕 AI 生成内容不信任与验证的主题占有一定比例 [1, 20, 32, 37]
  • 标题与图片不匹配的图钉也时常出现 — 例如标题称“Stability AI 进入视频生成”,实际图片却是奇幻风情绪板拼贴。这类为吸引点击而重复使用的缩略图很多 [29]
值得注意的图钉
  1. [2] AI News: Anthropic Leak Shows Us The Future of AI... — OpenAI、Google、Microsoft、Anthropic 标志发光的典型“AI NEWS”缩略图。汇总闭源阵营动态的视频。
  2. [4] Google announces ultra-high quality video... — 将同一人物和车辆重新生成木材/折纸/乐高/花卉风格的网格对比图,是清晰的风格一致性演示。
  3. [5] Meta Unveils Muse Image and Muse Video Generative... — “Meta Muse Spark AI Model 2026”的科幻风横幅,强调个人 AI 助手路线。
  4. [23] Discover how Grok is revolutionizing video... — 白色仿生机器人新闻主播坐在“BREAKING NEWS”面板前的视觉图,呈现 AI 制作新闻的未来想象。
  5. [26] Google's Gemini Omni Turns Anything Into Video — 以“Omni”标志为中心,汇集图像、视频、音频和文本图标,宣传多模态整合。
  6. [38] Google Unveils Veo 2: Advanced AI Video Generation... — Veo2 官方风横幅,标有“state-of-the-art video generation model”文案,并列实拍和动画样例。
  7. [43] Introducing Luma Dream Machine - Next Generation AI Video — 眼部特写配“Dream Machine”排版,以象征性画面强调逼真生成能力。
  8. [47] 'Amuse 3.0', an AI art creation tool that includes... — AMD 的本地运行 AI 艺术工具。以老渔夫的逼真面部作为演示图,强调可在 GPU 上进行高质量生成;这是少数偏开源/本地且出现具体名称的工具。
  9. [40] Top AI Video Generators of 2025 — 将 ChatGPT Plus、Midjourney、Runway、Pika、Kaiber 等按“画质优先”和“免费优先”分类的霓虹比较表,提供工具选择的实用信息。
  10. [20] 'AI is getting scary good.' — 汇总 AI 视频生成、语音检测、提示词工程的警示型信息图,体现“不要只凭外观相信”的生成式 AI 素养论调。
信号
  • Pinterest 上的“图像与视频生成 AI 新闻”中,闭源阵营(OpenAI、Google Veo/Gemini Omni、Meta Muse、Grok、Midjourney、Runway、Pika)的新闻缩略图占压倒性多数。仿佛直接把 YouTube 视频缩略图钉到平台上的“惊讶表情+标志集合”格式占主导,点击吸引力强于信息深度。
  • 开源/本地生成内容很少。出现具体名称的只有Stability AI(但仅见标题,图像是无关情绪板)和AMD Amuse 3.0(本地 GPU 工具)等;没有发现 ComfyUI、Hugging Face 或扩散模型架构图等社区出发的技术视觉内容。
  • 逼真人物生成(包括皱纹和材质细节的面孔)被各家公司重复作为“现在能做到这个程度”的基准式视觉展示——表明技术成熟度的信号。
  • 围绕对 AI 生成内容的不信任与验证(判断真假、判断声音真伪、伦理)的信息图占有一定比例,显示人们除了关注生成本身,也很关心“如何辨别”和“如何正确使用”。
  • **缺失的是:**正面讨论特定开源模型名称(Stable Diffusion、FLUX、Wan、HunyuanVideo 等)的图钉、GitHub/技术博客截图、展示论文或基准数值的图钉。由于 Pinterest 的性质,其核心是二手新闻汇总、比较表和广告式横幅,而非技术社区的一手信息。
限制
  • output/pinterest.pins.md 没有分类(genre 为空),只提供单一的 50 项集合,因此无法按操作手册预期进行“按类别总结”——只能将整体视作一个集合分析。
  • 50 个图像中实际打开核查了 18 个(考虑标题具体度和主题分散性采样)。剩余 32 个未核查,但已核查内容的格式重复性很高,足以识别模式。
  • 多个图钉的标题与实际图片不一致(例如 [29] 关联 Stability AI 的标题配以无关的情绪板图),对此类图钉,提及的是标题语境而非图像内容。
  • 未直接在浏览器中查看 Pinterest(只使用工作人员预先收集的图像和标题),因此无法确认每个图钉的实际互动数(收藏、点赞)或链接文章正文。

建议行动

  • 使用 AI 直接关键词(Midjourney、Sora、Nano Banana、ComfyUI、Flux)重新运行 X 阶段,而不是使用通用趋势词。
  • 持续关注 Qwen-Image-2.1 生态(WebUI、LoRA、ControlNet),作为开源势头的领先指标。
  • 将 Sora 2 的成本与收入差距作为闭源视频生成盈利能力的代理指标进行追踪。
  • 绘制闭源工具收紧安全护栏时用户会转向哪些工具的迁移图谱。
  • 将 Pinterest 采样从 50 个中的 18 个扩大,或寻找可获取互动数的方法。
  • 在评估其发现时,将 Lemmy 的 !ai_reddit 社区视为 Reddit 镜像,而非独立信号。

收集图片

AI 内容与社交媒体担忧AI 新闻:Anthropic 泄露展示 AI 的未来……一击命中 🎥Google 宣布超高质量视频……Meta 发布 Muse 图像与 Muse 视频生成式……图像GPT 5.2、实时视频编辑器、AI 立体视频、移动 AI 代理、全身控制:AI 新闻从图片创建视频用于图像和视频生成的 AI图像迪拜 AI 视频制作|更快、更智能的内容将文本转换为图片的 AI 工具人类与 AI 共创——执导稀树草原愿景图像图像将你的想法转化为惊艳视觉效果!🎥图像图像专业 AI 视频创作|电影感 AI 视频|定制视频编辑‎🚨 AI 正变得可怕地强大。图像含文本、图像、音乐和视频生成图标的 AI 内容创作概念人工智能图片——浏览 68 张素材图片、矢量图和视频了解 Grok 如何革新视频……人工智能图像Google 的 Gemini Omni 可将任何内容变成视频图像如何制作 AI 视频:使用 AI 创建视频的分步指南Stability AI 的 Stable Diffusion 制作者现在可构建 AI 生成视频Google 的 Flow AI 获得声音:为视频添加语音生成图像“为什么 AI 聊天机器人无法跟上突发新闻”AI 生成视频:好还是坏?这是真相!🤖🎥AI图像图像AI 新闻视频模糊真实报道与虚假报道的界线Google 发布 Veo 2:先进 AI 视频生成……AI 的奇迹与惊人益处2025 年顶尖 AI 视频生成器AI 新闻:OpenAI 终于发布了我们想要的内容当 AI 让人类重访自己的记忆推出 Luma Dream Machine——下一代 AI 视频无尽隧道AI 新闻主播与创作者主导报道接管美国媒体!掌握视频与 AI:2025 年关键社交媒体营销趋势“Amuse 3.0”,一款包含……的 AI 艺术创作工具借助 AI 图像技术将你的想法转化为惊艳视觉效果别再滑了……这个故事将彻底改变你看待 AI 的方式!AI 图像生成与娱乐产业

数据质量说明

X 阶段从通用趋势话题而非 AI 相关搜索中收集帖子,因此没有任何贡献;YouTube 和 Pinterest 因 JavaScript 渲染与采样限制,无法确认互动指标(播放量/订阅数或收藏/点赞);Reddit 和 Bluesky 则基于真实收集/API 数据,是这里最可靠的来源。

图库