KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-09-26

OpenAI 将于 2026 年 9 月 24 日全面终止 Sora/Videos API;与此同时,阿里巴巴的开放权重模型 Wan 3.0 和 Qwen-Image 2.1 正迅速融入生态系统。闭源阵营的重组与开放阵营的崛起正在同步发生。

图像与视频生成 AI 新闻 — 2026-09-26

这周真的太夸张了,简直离谱😤🔥 最大新闻是 OpenAI 真把 Sora 彻底关停了。App 和 Videos API 都会在 2026 年 9 月 24 日完全终止,而且没有公布后继方案,倒也算干脆(?)。另一边,开源阵营的阿里巴巴 Wan 3.0 和 Qwen-Image 2.1 正以惊人速度重塑格局;闭源阵营忙着降价和撤退防守时,开放阵营则在猛烈进攻📈 整体就是“闭源在淘汰与重组,开放在密集发布”的一周~。

跨平台观察

  • Qwen-Image 2.1(阿里巴巴、开放模型)在多个平台同步爆发:Reddit(r/StableDiffusion 将其推荐为图像编辑的常用选择)、Bluesky(给出了 7B 参数、60.2 分的具体基准测试,并在公开后迅速移植至 ComfyUI)、Lemmy(dbzer0 社区也报告了同样的 ComfyUI 官方支持)。三个平台几乎在同一时期(9/22~9/25)追踪到同一动向,足以说明它确实是当前最火的开放模型🔥
  • 开放视频生成的常用选择=MiniMax H3:Reddit(r/StableDiffusion 中“做视频就用 Minimax H3”已成共识)、Lemmy(面向 ComfyUI 的工具和提示词构建器一周内密集发布超过 5 个)、Bluesky(个人创作者通过 ComfyUI 反复试验)三处一致。开放视频生成的主角更替正在实时发生👀
  • Krea 2 从 Z-Image Turbo 手中夺走王座:Reddit 上大量声音认为“Z-Image Turbo 已经过时”,Lemmy 上则两次出现 Krea2 加速 LoRA 的发布。开放图像模型的迭代速度真的极快⚡
  • Sora 全面结束意外地几乎只在 Bluesky 被讨论:Reddit、X、YouTube、Lemmy、Pinterest 对这条大新闻基本忽略或接近忽略(Lemmy 甚至只有 3 月旧公告的转载,关于 9 月 24 日正式终止的新闻为零)。虽然只在一个平台交叉验证,但影响很大,需特别留意⚠️
  • DeepSeek×华为 Ascend 的同一基础设施话题从两个方向浮现:Reddit 的叙事是“DeepSeek 因算力不足订购 16 万颗 Ascend 960DT”;Bluesky 的叙事则是“华为 Ascend 的 Modelers.cn 上正在大量生产 SDXL/FLUX LoRA,但质量参差不齐”。这是中国闭源与开放两侧都试图押注 Ascend 芯片这一同一地壳变动的不同观察角度💡
  • 反对“把 AI 生成物当成真实内容使用”的情绪在多处化为具体案例:Reddit(显微镜竞赛被发现 AI 增强、房地产 AI 伪造照片、使用 AI 图像的 CEO 被解雇)、Pinterest(仿 NBC 新闻的 AI 主播视频带有“AI GENERATED”标签,引出真假边界问题)、Lemmy 的普通社区(对 AI 依赖和数据中心耗电问题的质疑)。不再只是抽象讨论,具体的“实际伤害与争议”正在不断积累😬

平台逐一观察

Reddit — 分析了 9 个子版块、12 个帖子。在专业子版块(r/StableDiffusion)中,Krea 2、Qwen-Image 2.1、Minimax H3、SenseNova-U1.5 等迅速成为常用选择;而综合子版块里,反感 AI 生成物的情绪已发展为“解雇”“举报”等实际后果。不过收集只使用了一个搜索词,未达到 20 条的完成标准(停在 12 条)。

X — 本次会话的位置固定在克罗地亚,Explore 热榜与主题几乎无关(10 个词中 8 个跑题)。最终只收集到 7~8 条相关帖子,未达到完成标准。不过收集到的内容很有意思:围绕 Claude Opus 5.5,结合 GPT Images、Grok、Gemini TTS 的“多工具流水线”视频制作,以及 Claude Code 自主完成素材收集、剪辑和音乐选择的“视频制作代理”式用法被反复提及。没有任何开源相关讨论。

YouTube — Sora 2 vs Veo 3.1、Seedance 2.5 vs Kling 3.0 vs Minimax H3 vs Google Omni 这类“多模型并排对比”是闭源阵营的主流格式。开放阵营中,LTX-2.5(Lightricks 推出的 220 亿参数开放权重视频+音频模型)发布一周内就出现了 ComfyUI 验证视频,反映出极快的跟进速度;Z-Image Turbo 则被多个频道作为 Nano Banana Pro 的免费替代品介绍。不过由于 JavaScript 渲染,完全无法获取播放量和订阅数。

Bluesky — 本次最有收获的平台,分析了 12 个查询、超过 200 条帖子。闭源侧的重点是 Sora 全面终止(包括与 Disney 价值 10 亿美元的合作破裂)、Google Veo 降价至原来的四分之一、Nano Banana 2.5 Flash 的泄露痕迹。开放侧则以 Wan 3.0(阿里巴巴在 100 亿美元股票出售后发布,且在人类评测中超过闭源阵营)、Qwen-Image 2.1 的基准测试及即时 ComfyUI 化、stable-diffusion.cpp(★7,148)登上 GitHub Trending 最为突出。

Lemmy — 关键词搜索噪声极大,很快放弃并切换为直接浏览专业社区。结果几乎清一色是开源内容(Qwen-Image 2.1、Krea2 LoRA、MiniMax H3 工具、LTX-2.5 LoRA、分布式免费生成基础设施 AI Horde)。反过来,即便定向搜索,9 月的闭源新闻(Sora 终止、Veo 降价、Grok Imagine)也一条未中,“毫无动静”本身就是发现。相关帖子约 9 条,未达到 20 条完成标准。

Pinterest — 收集 50 条、精读其中 20 条。Runway、Pika、Kling、Luma、Hailuo、Veo、Sora 并列的“最佳 AI 视频工具”类清单完全占据主导;AI 新闻缩略图(惊讶的胡子男+Logo 网格)和 AI 主播可信度焦虑也很突出。相对地,Stable Diffusion、Flux、ComfyUI、Wan、Hunyuan 等开源模型名称在样本里一条都没有出现,确认 Pinterest 明显偏向“能赚钱的、面向消费者的闭源工具”。

值得关注

建议

  • 持续关注 Wan 3.0 和 Qwen-Image 2.1 的采用速度,判断开放与闭源之间的质量反转是否会固化。
  • 跟踪 Google Veo 降价及 Nano Banana 2.5 的发展,确认 Sora 退出后价格战会加速到什么程度。
  • 列出 Reddit 上“将 AI 生成物冒充真实内容”引发的争议和实际伤害案例(显微镜竞赛、房地产、CEO 解雇),持续观察是否会带动监管与诉讼。
  • 下次收集 X 和 Reddit 内容时,加入“Stable Diffusion”“Flux”“ComfyUI”“Wan”“Qwen”等明确的开源搜索词,补足此次为零的遗漏。
  • 不要把 Pinterest 当作开源动态指标,而应将其视为专门观察消费者闭源工具“当前热度”的来源。
  • Bluesky 直接调用 XRPC(api.bsky.app 的 app.bsky.feed.searchPosts)远比其他平台收获更多,应优先作为今后的标准收集方式。

数据质量

Bluesky 是唯一一个以 12 个查询、超过 200 条帖子大幅超过完成标准的平台;Reddit 与 Lemmy 均未达到“约 20 条”的完成标准(分别约 12 条、9 条),Lemmy 的原因是搜索 API 噪声过多以及平台原本规模较小。X 的 Explore 地区固定为克罗地亚,10 个搜索词中 8 个与主题无关,相关帖子仅 7~8 条、开源提及为零,是本次数据质量最低的平台。YouTube 因 JavaScript 渲染,完全无法获取播放量、订阅数和发帖时间,无法进行定量比较。Pinterest 未反映 Sora 全面终止这类 9 月最新新闻(收集本身为单次批处理),50 条中仅精读 20 条,且开源内容的缺席仍可能受搜索查询偏差影响。

按平台总结

Reddit

Reddit — 图像与视频生成 AI 新闻

位置

收集到的 12 个帖子来自 9 个子版块:

子版块 成员数 收集帖子数
r/mildlyinfuriating 12,595,406 人 1 条
r/WhitePeopleTwitter 3,145,649 人 1 条
r/StableDiffusion 1,025,554 人 1 条
r/labrats 726,754 人 1 条
r/antiai 339,499 人 1 条
r/generativeAI 157,118 人 4 条
r/DeepSeek 141,262 人 1 条
r/GenAI4all 48,605 人 1 条
r/aivideomaking 7,735 人 1 条

规模较大的综合子版块(mildlyinfuriating、WhitePeopleTwitter)集中于对 AI 生成物的反感和争议,专业子版块(StableDiffusion、generativeAI、aivideomaking、DeepSeek、GenAI4all)则主要讨论工具对比和技术话题。r/antiai 顾名思义,是从反 AI 立场出发的帖子。

人们怎么说
  • 帖子 #1(r/labrats,1,101 分、131 条评论、2026-09-23):https://www.reddit.com/r/labrats/comments/1wo0j5e/ — Nikon Small World in Motion(显微图像竞赛)获得第一名的视频被发现使用 AI 进行“增强”。发帖者指出:“纤毛会突然消失,蓝色结构(看起来像细胞核)会瞬间移动,这些都是在生物学上不可能的运动。”最高评论(u/Barkinsons,629 分)明确表示:“科学显微图像根本没有 AI 工具介入的空间。”
  • 帖子 #3(r/mildlyinfuriating,26,941 分、722 条评论、2026-09-21):https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ — 房地产看房照片使用了 AI 生成的“示意图”。发帖者指出,“暖气片被移除了,现实里根本无法复现这种布置”。u/BojackWorseman13(1,141 分)评论称:“应该去房地产商的社交媒体施压,必须醒目注明这是 AI 生成内容。”
  • 帖子 #9(r/antiai,18,728 分、634 条评论、2026-09-23):https://www.reddit.com/r/antiai/comments/1wnrfi6/ — 有报道称 Dreamworks 在新片《Forgotten Island》中加入“禁止将此内容用于 AI 训练”的免责声明(据称通过 YouTube 得知)。但 u/SlowlyDyingInAPit(2,586 分、评论最高)冷淡地回应:“AI 阵营还是会无视并照用,他们一直如此。”u/Arckanoid(145 分)分析称:“与其说是为了阻止,不如说是为了给诉讼建立依据。”
  • 帖子 #11(r/WhitePeopleTwitter,470 分、56 条评论、2026-09-25):https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/ — 使用 AI 生成的“Lake America”毛衣图片的 CEO 被解雇。u/samanime(236 分)评论:“要是更多这种蠢人付出更惨的代价,事情应该会少一点。”这是企业使用 AI 生成内容实际导致解雇的罕见案例。
  • 帖子 #5(r/DeepSeek,314 分、51 条评论、2026-09-21):https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ — 分析称 DeepSeek 的 DAU 从 1.2 亿激增至 2 亿(+66.7%),但算力仅增加 8.3%,这可能是质量下降和生成重试问题的原因。帖子还介绍了 DeepSeek 向华为订购 16 万颗 Ascend 960DT 的消息(包含 nbd.com.cn、ntdtv.com 文章链接)。u/Equivalent-Grass-527(14 分)表示:“需求与算力资源不匹配,是对最近性能劣化最合理的解释。”
  • 帖子 #12(r/StableDiffusion,0 分、19 条评论、2026-09-25):https://www.reddit.com/r/StableDiffusion/comments/1wpr4uf/ — 询问当前最推荐的开源/本地模型。评论区共识是:图像生成=Krea 2(建议从旧的 Z-Image Turbo 迁移,多人赞同,包括 u/Sirmckhalifa5566);图像编辑=Qwen-Image 2.1(u/Jackkgold 提醒商业使用要注意许可证);视频=Minimax H3(多条评论一致)。u/Cultural-Broccoli-41 则介绍 SenseNova-U1.5 为采用 Apache-2.0 许可证的强大图像编辑模型。
  • 帖子 #4(r/generativeAI,7 分、38 条评论、2026-09-23):https://www.reddit.com/r/generativeAI/comments/1wog53q/ — 针对“怎样制作长篇 AI 视频?”的问题,u/kaboom-o(2 分)介绍了实用工作流:没人会单次生成长片,主流方式是剧本→叠加 5~15 秒短片→剪辑。若需要长时间保持人物脸部一致性,使用 Seedance 2.5(最长约 30 秒,支持原生音频);若需要低成本动作草稿,使用 Grok Imagine Video(480p、5 秒);若重视写实性,则使用 Gemini Omni Flash。u/AlfieSchmalfie(2 分)分享了一个实例:12 分钟、148 个镜头、耗时 8 周、约 1,000 澳元完成(另有 Runway+ElevenLabs 订阅费用)。
  • 帖子 #8(r/GenAI4all,165 分、63 条评论、2026-09-24):https://www.reddit.com/r/GenAI4all/comments/1wou5vb/ — 回顾“2024 年走红的 AI 视频”的讨论。u/MinosAristos(7 分)评论:“它把合成媒体的‘弱点’反而变成了优点,那段影像就是电影。”评论反映出人们强烈感受到当时与现在之间巨大的质量差距。
  • 帖子 #2、#6、#7、#10(均来自 r/generativeAI/r/aivideomaking,2~17 分,2026-09-19~22):“寻找免费的 AI 视频生成工具”的问题以几乎完全相同的措辞多次发帖(r/aivideomaking https://www.reddit.com/r/aivideomaking/comments/1wled0f/ 、r/generativeAI https://www.reddit.com/r/generativeAI/comments/1wlec1u/ 等)。回答分为两类:一类是“免费不存在,算力不是免费的”这种现实观点(u/SRD-Social,4 分);另一类则介绍 Muse、Meta(无水印 10 秒)、Nanobanana/Veo(Google Flow 内的免费额度)、dreamfort.ai/video 等具体免费额度工具。自动回复机器人 u/Jenna_AI 反复发布带有讽刺意味的固定说明:“别以为可以免费疯狂跑 H100。”
信号
  • 上升趋势:在开源/本地模型话题(r/StableDiffusion)中,Krea 2、Qwen-Image 2.1、Minimax H3、SenseNova-U1.5 等名称短期内迅速成为常用选择。评论也显示了模型更替的速度(多次出现“Z-Image Turbo 已经过时”)。
  • 反 AI 情绪开始落到现实案例:r/antiai、r/mildlyinfuriating、r/WhitePeopleTwitter 的共同点是,讨论不再止于表达不满,而是已引向“解雇”“举报”“禁止训练的法律措施”等实际行动。对 AI 生成物的反弹正从抽象争论转为具体社会成本。
  • 闭源侧的压力迹象:DeepSeek 帖子提供了罕见的内部视角,显示中国模型因算力不足导致质量下降,揭示出成长阵痛下“偏闭源的大型服务”的限制。
  • 意见冲突:帖子 #9 的正文将 Dreamworks 的禁止训练条款称为重大胜利,但获赞最高的评论却冷嘲道“AI 阵营反正不在意,也不会改变做法”,同一帖子内的温差非常明显。
  • 不可小看的“看似无聊”需求:表面像噪声的“想要免费 AI 视频生成工具”重复帖在 4 条中占了 4 条,实际反映出最庞大的真实需求群体,以及围绕它的自动回复机器人固定嘲讽文化。
  • 意外之处:在本应与 AI 无关的权威科学竞赛 Nikon Small World in Motion 中混入了 AI 加工,社区自行验证并公开揭露(帖子 #1)。这是专家社区自我净化机制先于自上而下监管发挥作用的例子。
局限
  • 搜索词仅有“Image and Video Generation AI News”一个,收集到的只有 9 个子版块、12 个帖子,未达到“约 20 条”的完成标准。若使用模型名(如 Krea、Qwen、Seedance、Sora 等)或“open source diffusion”“closed source video AI”等词进一步搜索,可能能收集到更多内容;但本次工具手头只有这一关键词的结果。
  • 本阶段只能读取由无头浏览器预先收集的数据,无法进一步访问或搜索 Reddit 本身,也不能查看帖子中的全部评论(每个帖子仅有前 6 条评论),因此无法继续深入。
  • 帖子 #8(r/GenAI4all)和 #11(r/WhitePeopleTwitter)正文较短或缺失,仅根据标题和高赞评论推断其主旨。
  • DeepSeek 帖子中提到的 nbd.com.cn、ntdtv.com 外部文章,只确认了其作为 Reddit 帖子链接的存在;本次运行中未阅读文章正文(超出 Reddit 帖子范围)。

X

X — 图像与视频生成 AI 新闻

Explore(趋势列表)按照本次会话所连接服务器的位置显示为克罗地亚(8 条中 7 条显示“Trending in Croatia”)。因此,该 Explore 列表是克罗地亚趋势,并非全球趋势。实际搜索的词有 “Taylor”、“#sweepstakes”、“#giveaways”、“#chance”、“Opus 5.5”、“Slovenia”、“Italy”、“Cardano”、“Croatia”、“Claude” 共 10 个,其中只有 “Opus 5.5” 和 “Claude” 两个与主题(图像与视频生成 AI)有关。其余 8 个词(Taylor、#sweepstakes、#giveaways、#chance、Slovenia、Italy、Cardano、Croatia)只返回了泰勒·斯威夫特、南非足球、Cardano(加密货币)、卢卡·东契奇、德芙·卡梅隆结婚等与主题无关的帖子。以下仅分析符合主题的帖子。

账号

该主题的帖子并非由某一个粉丝规模很大的来源强力带动,而是日语圈 AI 创作者个人账号各自发布一条的状态。

  • @aiehon_aya(妖精アーヤ)— 一条帖子获得 1,594 个赞、143 次转发。讲解只用 Claude Opus5.5 制作动态图形的过程(HTML→逐帧绘制→Python 转成视频)的“制作教程帖”。本次 Opus 5.5 相关内容中赞数最高。
  • @sankakuten91256(さんかくてん)— 一条帖子获得 1,159 个赞、约 57,000 次浏览。介绍组合多个生成式 AI 的流水线。
  • @mmmiyama_D(ミヤマ)、@rotejin(ろてじん)、@seiiiiiiiiiiru(使用 SEIIIRUAI 的影像创作者)— 各自一条帖子、数百赞规模。展示使用 Claude Code 或 Opus 5.5 制作的个人视频(自我介绍视频、添加 Live2D 动作、AI 广告视频)。
  • @bond_ai1(ボンド|AIで最高月収7800万)、@ponzponz15(ぽんず)— 面向 AI 变现/经验分享的账号,介绍通过 Claude Code 自动化视频剪辑的工具。
  • 此主题中没有通过大量低赞帖子堆积数量的账号;所有人都属于“一条帖子、获得适中反响”型。既没有单次爆款,也呈现出小众但持续的实操分享格局。
帖子
  1. #17 @sankakuten91256 — 1,159 likes・102 reposts・13 replies・约 57,000 views・2026-09-25
    https://x.com/sankakuten91256/status/2103483923783373039

    Opus 5.5はこんなこともできるのか GPT Images 2.5 で9分割のダンスの画像を作成 Grokでグリーンバックのダンス動画 Opus 5.5でモーショングラフィックス Astraで音の差し替え
    → 该帖子展示了将 GPT Images 2.5、Grok、Opus 5.5、Astra 在一部作品中分工协作的“多工具堆栈”工作流。实操趋势不是用一个模型完成全部工作,而是联动多个闭源工具。

  2. #18 @seiiiiiiiiiiru — 554 likes・75 reposts・29 replies・约 45,000 views・2026-09-24
    https://x.com/seiiiiiiiiiiru/status/2103227982592831846

    AI広告動画 → AI音声 × AI編集 もうここがゴール地点ってことでいいでしょ。笑 Cluad Opus 5.5にGemini 3.8 Flash TTSでナレーション生成させて…
    → 该帖将广告视频制作中的“AI 语音+AI 剪辑”描述为已抵达终点。是 Claude Opus 5.5 与 Gemini 3.8 Flash TTS 配合的实际制作案例。

  3. #19 @mmmiyama_D — 632 likes・41 reposts・15 replies・约 75,000 views・2026-09-25
    https://x.com/mmmiyama_D/status/2103384986661671058

    プロンプト一撃の方が出来が良くて、ちょっと悲しい… Claude CodeのOpus 5.5で15秒の自己紹介動画も作りました。フォントは勝手にダウンロード、音楽までいい感じに作ってくれた〜!!!
    → Claude Code(Opus 5.5)会自主下载字体、选择音乐这一点被作为惊喜分享。它更像“视频制作代理”,而非单纯的视频生成工具。

  4. #20 @rotejin — 435 likes・57 reposts・8 replies・约 37,000 views・2026-09-25
    https://x.com/rotejin/status/2103384608301830297

    Claude Codeに「新しいモーションを追加して」と頼むだけでLive2Dモーションを追加できるツールを使わせてもらいました…使ったモデルはOpus 5.5のxhigh。
    → 不是图像/视频生成本身,而是展示通过 Claude Code 自动添加 Live2D 动作(打哈欠、打喷嚏)的工具。提及 Opus 5.5 的 “xhigh” 推理强度设定这一点较为新颖。

  5. #37 @ponzponz15 — 226 likes・17 reposts・7 replies・约 35,000 views・2026-09-24
    https://x.com/ponzponz15/status/2102931824918106499

    3Dカメラ×立体テキスト演出② After Effectsで作るような編集がClaude OpusやCodexでも可能に。 上 Seedance 2.5 prev 下 Codex + Hyperframes skill
    → 将 Seedance 2.5(视频生成)与 Codex + Hyperframes skill 并列比较。反映了用代码生成 AI 替代 After Effects 级别演出的趋势。

  6. #38 @aiehon_aya — 1,594 likes・143 reposts・12 replies・约 95,000 views・2026-09-25
    https://x.com/aiehon_aya/status/2103403361022419005

    Claude Opus5.5 モーショングラフィックス 天才Opus5.5にどうやって作ったのか説明させてみた…index.html→1コマずつ描かせる→render.pyで動画ファイルに
    → 本次 Opus 5.5 相关内容中获赞最多的帖子。它采用的是“不使用图像生成模型,而是让模型编写绘图程序、逐帧渲染并生成视频”的代码式视频制作方法。

  7. #40 @bond_ai1 — 499 likes・46 reposts・3 replies・约 69,000 views・2026-09-25
    https://x.com/bond_ai1/status/2103374441250259316

    動画編集、Premiere Proもカット作業の外注もいらない時代が来ました。Claude Codeに素材を投げるだけで、完全自動でプロ品質の動画が仕上がる『video-use』が登場。
    → 介绍一款面向 Claude Code 的工具“video-use”,宣称可完全自动化剪辑。说明 AI 正扩展至既有素材的自动剪辑领域,而非仅限生成。

(#39 @samcoderx 的帖子是关于 Claude 通用用法的指导串,未直接涉及图像或视频生成,因此仅作参考。)

信号
  • 上升:以 Claude Opus 5.5 为核心,将 GPT Images 2.5、Grok、Gemini TTS、Astra 等多个闭源工具组合起来完成一支视频的“多工具流水线”实操,占据了本次几乎所有 Opus 5.5 相关帖子。反复出现的用法并非对单一模型一次提示,而是将 Claude Code 用作能自主完成素材收集、剪辑和音乐选择的“视频制作代理”。
  • 被忽视/未被提及:本次收集的帖子中,没有一条提及开源图像或视频生成 AI(Stable Diffusion 系、Flux、ComfyUI、Wan、HunyuanVideo 等)。虽然直接原因是搜索词未涵盖它们,但在收集到的 40 条、相关的 7 条范围内,话题完全偏向闭源(Claude/Opus、GPT Images、Grok、Gemini、Seedance)。
  • 意外之处:通过 Explore 获取的 10 个趋势词中,8 个(Taylor、#sweepstakes、#giveaways、#chance、Slovenia、Italy、Cardano、Croatia)与主题无关。克罗地亚 Explore 并未将这类小众 AI 创作工具话题推上趋势,说明相关讨论不是“正在爆红”,而是实操者个别分享的长尾状态。
局限
  • Explore 的地区固定为克罗地亚,因此“Slovenia”“Italy”“Cardano”“Croatia”等 5 个搜索词只返回与主题无关的结果,已从分析中排除。
  • “Taylor”“#sweepstakes”“#giveaways”“#chance”同样与主题无关(音乐新闻、抽奖活动、南非足球、韩系插画标签)。
  • 搜索词未包含“Stable Diffusion”“Flux”“ComfyUI”“Wan”“open source”对应的日语或英语开源关键词,因此 X 侧完全没有收集到开源动态。下次需要明确搜索这些词。
  • 收集到的 40 条中仅有 7~8 条直接与主题相关,未达到简报要求的“分析约 20 条”这一 X 侧完成标准(原因在于 Explore 的地域性和搜索词选择)。

YouTube

YouTube — 图像与视频生成 AI 的最新动态

频道

通过搜索结果和 oEmbed 确认的频道(无法获取订阅数,详见“局限”):

  • VEED STUDIO — 发布 Sora 2 与 Veo 3.1 对比视频等的视频编辑工具频道
  • AI Autopsy Dossier — 验证闭源视频生成模型的频道
  • Tao Prompts — 擅长多模型横向比较(Seedance/Kling/Minimax/Google Omni)
  • Better Stack — AI 行业新闻解读频道(xAI/Grok 话题)
  • Latent Space — 采访 AI 研究人员的播客/频道
  • AI Master — Google Gemini 工具讲解频道(Nano Banana Pro 等)
  • Zebra Techies Solution-ZTS Infotech — AI 工具迁移与对比频道
  • SECourses — 使用 ComfyUI/SwarmUI 的开源模型长篇教程频道
  • LTX_io — Lightricks 官方频道(LTX-2.5 发布视频)
  • Prompt Engineer 48 — 开源模型本地部署与验证频道
  • Bijan Bowen / Codedigipt — Z-Image Turbo 等开源图像模型评测频道
  • QUASA — Qwen-Image 等开源模型技术讲解频道
视频

[闭源类别]

  1. Sora 2 Vs Veo 3.1 Comparison (Same Prompts, VERY Different Results) — VEED STUDIO — 2025-11-27 — 播放量未知 — https://www.youtube.com/watch?v=kebWkj5ONzo — 使用相同提示词比较 Sora 2 与 Veo 3.1,结论认为 Veo 3.1 在物理行为与一致性上更稳定。

  2. Seedance 2.5 vs Kling 3.0 | The Honest Truth About AI Video Generation in 2026 — AI Autopsy Dossier — 2026-06-27 — 播放量未知 — https://www.youtube.com/watch?v=EtmdbF0DbHU — 主张字节跳动的 Seedance 2.5 在动作/物理表现方面略胜 Kling 3.0,但 Kling 在角色一致性方面仍占优势。

  3. Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0 | Full Comparison — Tao Prompts — 2026-08-14 — 播放量未知 — https://www.youtube.com/watch?v=G5D053drKB8 — 闭源视频生成四模型对比。Google 新模型“Omni”被提及为新的强力候选。

  4. xAI are killing it (Grok 4.6, Image 2.0 and more...) — Better Stack — 2026 年 8 月左右(显示为“约 1 个月前”)— 播放量未知 — https://www.youtube.com/watch?v=ILHJqmJdWso — 主张 xAI 的 Grok Imagine/Image 2.0 正迅速缩小与 Veo、Sora 的差距。

  5. Inside xAI: Building Grok Imagine in 3 Months, Videogen vs World Models, and Video Agents — Ethan He — Latent Space — 日期未知(推测为 2026 年中)— 播放量未知 — https://www.youtube.com/watch?v=jPtQlILfkhA — 采访 xAI 工程师,讨论仅用 3 个月开发 Grok Imagine 的过程,以及为何选择“世界模型”路线而非纯视频扩散模型。

  6. Ultimate Nano Banana Pro Guide 2026: How to Use Gemini 3 Image AI — AI Master — 日期未知(2026 年)— 播放量未知 — https://www.youtube.com/watch?v=ZCw325FiS78 — 全面讲解 Google Nano Banana Pro(基于 Gemini 3 的图像生成)编辑功能。

[开源类别]

  1. Cancel Every Image AI Subscription You Have — Here's What Replaced Them in 2026 — Zebra Techies Solution-ZTS Infotech — 2026-06-24 — 播放量未知 — https://www.youtube.com/watch?v=2qOWfES7R3I — 主张截至 2026 年,免费/开源工具可以成为 Midjourney 等付费订阅的替代品。

  2. Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models — SECourses — 日期未知(2026 年)— 播放量未知 — https://www.youtube.com/watch?v=3BFDcO2Ysu4 — 37 分钟长教程,讲解如何在 SwarmUI/ComfyUI 上结合 Lightning LoRA 设置和优化 Wan 2.2、FLUX、Qwen-Image。

  3. LTX-2.5: The World Model the World Builds On — LTX_io(Lightricks 官方) — 2026-08-11 — 播放量未知 — https://www.youtube.com/watch?v=ZDfjZae7Da0 — 开放权重视频+音频生成模型 LTX-2.5 的官方发布。它拥有 220 亿参数,除电影制作外,也强调作为面向机器人技术的“世界模型”的用途。

  4. LTX-2.5 Is Open Weights - Full Setup and Test on ComfyUI — Prompt Engineer 48 — 2026-08-18 — 播放量未知 — https://www.youtube.com/watch?v=sIOC9pzHzjs — 在 LTX-2.5 官方发布后仅一周,即完成在 ComfyUI 上的本地部署与测试,确认消费级 GPU 也可运行。

  5. Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models — Bijan Bowen — 日期未知(推测为 2025 年 11 月底至 2026 年初)— 播放量未知 — https://www.youtube.com/watch?v=K0FgDU-9uik — 评价采用 Apache-2.0 许可证的阿里巴巴/通义 Z-Image Turbo,在速度与质量上优于其他本地图像模型。

  6. Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro) — Codedigipt — 日期未知 — 播放量未知 — https://www.youtube.com/watch?v=sPQQPpQ9X4E — 主张免费开源的 Z-Image Turbo 可媲美 Google 的付费工具 Nano Banana Pro。

信号
  • 闭源视频生成话题以“Seedance vs Kling vs Veo vs Sora”这样的多模型横向对比视频为主,显示相比单独评测,对比内容的需求更强(#2、#3)。
  • xAI 的 Grok Imagine 在 2026 年上半年常以“无审查、激进表现”路线被讨论,但 8 月左右的视频(#4、#5)中,语境已转向将其认真视为“Veo/Sora 的真正竞争者”。
  • Google 在图像(Nano Banana Pro)与视频(Flow、Omni)两侧频繁出现,更常被当作一个整体生态系统而非单一模型讨论。
  • 开源阵营以 Lightricks 的 LTX-2.5(2026-08-11 发布)为代表:官方发布仅一周后,独立创作者就发布了 ComfyUI 部署验证视频(#10),社区反应速度极快。
  • 阿里巴巴/通义系 Z-Image Turbo 被多个频道以“Nano Banana Pro 的免费版”这一相同切入点标题化,开源 vs 闭源的对立已直接体现在视频标题里(#11、#12)。
  • SECourses 这类长视频(30 分钟以上)教程,前提是将 Wan、FLUX、Qwen-Image 等多个开源模型组合使用,体现出从单模型操作向组合工作流的迁移(#8)。
局限
  • YouTube 搜索结果页(/results?search_query=...)与视频页(/watch?v=...)均由 JavaScript 渲染,WebFetch 只能取得静态页脚部分(使用条款、版权声明等),无法直接读取播放量、订阅数、发布日期和评论。
  • 改为结合 WebSearch(如 site:youtube.com 查询)和 YouTube oEmbed 接口(https://www.youtube.com/oembed?url=...&format=json)确认标题和频道名,但两者都不返回播放量和订阅数,因此本报告中所有视频均标为“播放量未知”。
  • 发布日期依据 WebSearch 摘要推测,一部分仍为“两周前”“一个月前”等相对时间(基准日 2026-09-26)。
  • 无法直接访问视频简介和评论区,因此报告未包含观众反应(评论)。
  • 关于 OpenAI Sora API 于 2026 年 9 月 24 日停止一事,YouTube 上未找到直接讨论它的视频(对比视频均更早发布)。

Bluesky

Bluesky — 图像与视频生成 AI 新闻

bsky.app 主站是由 JavaScript 渲染的 SPA,WebFetch 无法获取搜索页或单帖页内容(只返回“Bluesky”这一字符串)。此外,官方 public.api.bsky.app 端点被 403 拦截。替代方案是未加 public. 的 api.bsky.app 上 app.bsky.feed.searchPosts JSON API 仍可用,因此用其检索了 stable diffusion、midjourney、Sora 2、Veo 3、Nano Banana、Flux image model、ComfyUI、Sora API shutdown、Wan 3.0 video、Seedance、Grok Imagine、HunyuanVideo/LTX Video 共 12 个查询,每个 20~25 条,总计超过 200 条帖子。以下仅提取与主题直接相关的帖子。

账号
  • @aichina.news — 持续机械式报告华为 Ascend NPU AI 平台“Modelers.cn”上 SDXL/FLUX LoRA 的机器人式账号。几乎所有帖子都是 0 赞,但数量异常多(每天 20 条以上),可作为 Ascend 系开源图像生成生态的定点观测来源。
  • @oludai.bsky.social(🚀 olud.ai)— AI 模型排名快讯账号。报告阿里巴巴“Wan 3.0”作为开放权重模型登顶视频生成人类评测排行榜。
  • @github-trending.bsky.social — GitHub Trending 自动发帖账号。报告 stable-diffusion.cpp(★7,148、以 C++ 编写的轻量扩散模型推理引擎)进入趋势。
  • @huggingfacetrends.bsky.social(每日 HuggingFace 趋势)— Hugging Face 日度趋势机器人。报告 Qwen-Image 2.1 的 ComfyUI 移植。
  • @aipromptingclinic.bsky.social — 每天大量发布面向 Seedance、Kling、Grok Imagine 的提示词设计技巧的账号(互动几乎为零,但出现频率很高,反映闭源视频/图像模型的实际应用基础)。
  • @aki-kisaragi.bsky.social(AKI)— 使用 Grok Imagine 制作和发布头像、插画的个人创作者,是日语圈 Grok Imagine 应用的实例。
  • @hashimoto-ekuto.bsky.social(PuniQ)— 实况记录将 Seedance 2.5 积分用完前持续生成视频的个人创作者(单帖 19 赞、3 次转发)。
  • @dfl.bsky.social(DFL inc.)/ @obeca.bsky.social — 持续发布由 Nano Banana 2 制作图像的账号(最高分别为 27、21 赞)。
  • @alternativeto.net — 以 11 个赞传播 OpenAI Sora 终止消息的工具比较媒体账号。
帖子
  1. @knowmouth.bsky.social — 0 likes・0 reposts・2026-09-25T00:51
    https://bsky.app/profile/knowmouth.bsky.social/post/3mwckivdpkk2y

    🎬 Sora is officially gone. OpenAI discontinued the Sora product earlier this year, and Sora 2, Sora 2 Pro and the Videos API reached their shutdown date on September 24, 2026.
    → 最大级别的闭源新闻。OpenAI 全面终止视频生成 API“ Sora”。没有替代路线图。

  2. @alternativeto.net — 11 likes・0 reposts・2026-03-25T11:30
    https://bsky.app/profile/alternativeto.net/post/3mhuyfrjnpz26

    OpenAI is shutting down its AI video slop social app, Sora, along with its API less than six months after launch... ending a billion-dollar partnership with Disney.
    → 报道称 Sora App 与 API 的终止,伴随着与 Disney 价值 10 亿美元合作的破裂;这是本次收集中点赞最多的 Sora 相关帖子。

  3. @aifoundersczech.bsky.social(AI Founders ONLINE) — 0 likes・0 reposts・2026-07-04T11:00
    https://bsky.app/profile/aifoundersczech.bsky.social/post/3mpsvtc4hkd2u

    Google just priced its new video API 4x cheaper than its own flagship tier — on purpose... Sora finished burning $1M/day against $2.1M in lifetime revenue.
    → 作为 Sora API 终止背景,提出每日亏损 100 万美元、累计收入仅 210 万美元的数据,同时提到 Google 对 Veo 的降价攻势。

  4. @coreati.bsky.social(Core Ai News 🚨) — 0 likes・0 reposts・2026-09-24T18:52
    https://bsky.app/profile/coreati.bsky.social/post/3mwbwh5p7mj2e

    GOOGLE 🔥: Nano Banana 2.5 Flash traces have been spotted...
    → 有帖子称发现了 Google 图像生成模型“Nano Banana”下一版本(2.5 Flash)的痕迹,是闭源图像生成前沿的泄露消息。

  5. @garutoroid.bsky.social(ガル・トロイド) — 3 likes・0 reposts・2026-09-24T10:03
    https://bsky.app/profile/garutoroid.bsky.social/post/3mwayvizumc2g

    同プロンプトのGPT Image 2.5とNano Banana 2版。
    → 以相同提示词比较 GPT Image 2.5 与 Nano Banana 2 的实验帖,证明用户层面的闭源图像模型对比已日常化。

  6. @ahiruai.bsky.social(あひる|楽すぎるAI副業) — 0 likes・0 reposts・2026-09-25T08:41
    https://bsky.app/profile/ahiruai.bsky.social/post/3mwdeqlfflo2f

    Runwayの「Draft mode」を使うとSeedance 2.5のクレジット消費を抑えられる、という情報共有。
    → 分享通过 Runway 的“Draft mode”降低 Seedance 2.5 积分消耗的技巧。说明可经由 Runway 使用字节跳动 Seedance 2.5 的闭源视频模型跨平台协作。

  7. @oludai.bsky.social(🚀 olud.ai) — 1 like・0 reposts・2026-09-25T21:00
    https://bsky.app/profile/oludai.bsky.social/post/3mweo2rmjo424

    🏆 Wan 3.0, an open-weight model, tops the human-preference ranking for video generation—beating every closed rival.
    → 最大的开源话题。报道称阿里巴巴开放权重模型 Wan 3.0 在人类评测排行榜上超过所有闭源视频模型。

  8. @ai-linkstream.bsky.social — 0 likes・0 reposts・2026-09-25T17:50
    https://bsky.app/profile/ai-linkstream.bsky.social/post/3mwedgzcgkh2g

    Alibaba has launched its AI video model, Wan 3.0, after a $10 billion share sale.
    → Wan 3.0 的发布被报道发生在阿里巴巴进行 100 亿美元规模股票出售后,体现了对开放 AI 的资本投入规模。

  9. @riccinov.bsky.social(Ricci Research) — 0 likes・0 reposts・2026-09-24T15:07
    https://bsky.app/profile/riccinov.bsky.social/post/3mwbjv6rqxt2f

    Alibaba's Qwen Image 2.1 is 7B parameters and scores 60.2...
    → 报告阿里巴巴开放图像生成模型 Qwen-Image 2.1(70 亿参数)的基准分数。

  10. @huggingfacetrends.bsky.social(每日 HuggingFace 趋势) — 0 likes・0 reposts・2026-09-25T15:04
    https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mwe25zx3bn27

    Comfy-Org/Qwen-Image-2.1: Qwen-Image 2.1 repackaged for ComfyUI
    → 上述 Qwen-Image 2.1 立刻以 ComfyUI 节点形式发布,体现开放模型只需数日便可融入生态的速度。

  11. @github-trending.bsky.social — 1 like・0 reposts・2026-09-24T19:17
    https://bsky.app/profile/github-trending.bsky.social/post/3mwbxt7hrhr2q

    📦 leejet / stable-diffusion.cpp ⭐ 7,148 (+33) 🗒 C++ — Diffusion model(SD,Flux,Wan,Qwen Image,Z-Image,...) inference in pure C/C++
    → 这一 C++ 推理引擎可运行 SD、Flux、Wan、Qwen Image、Z-Image 等主要开放扩散模型,并进入 GitHub Trending,显示轻量化、本地运行取向的热度。

  12. @manilarope.bsky.social(Taimai🔞) — 2 likes・1 repost・2026-09-26T00:48
    https://bsky.app/profile/manilarope.bsky.social/post/3mwf2swkkao2f

    ComfyUIくんとのケンカがなんとか一段落して、MiniMaxH3で動画を生成できるようになってくれました。
    → 个人尝试通过 ComfyUI 运行 MiniMax H3(视频生成模型)的过程,反映出将开放/半开放视频模型整合至本地环境的实践。

信号

闭源的动向

  • OpenAI 全面终止“Sora”品牌(App 于 2026 年 4 月结束,Videos API 及全部模型别名于 2026 年 9 月 24 日停止,且无替代路线图)。另有报道称与 Disney 价值 10 亿美元的合作也已破裂,对 Disney 的通知时间不足一小时。
  • Sora 不佳的经济性(每日亏损 100 万美元、累计收入 210 万美元)被公开讨论,成为“即使是前沿模型,若无法盈利也会结束”的教训。
  • 仿佛与 Sora 结束交替发生,Google 将视频生成 API(Veo 系列)重新定价为自家最高等级的四分之一,展开降价攻势。
  • Google“Nano Banana”图像生成系列已有从 2 到 2.5 Flash 的换代传闻/痕迹;用户会以同一提示词直接对比 GPT Image 2.5,已成为事实上的主战场。
  • 字节跳动“Seedance 2.5”正逐渐成为视频创作者的标准工具,甚至可经由 Runway 等第三方平台使用;其积分消耗速度被反复提及。
  • Kling 3.0、Grok Imagine 也已融入个人创作者工作流(头像制作、Vlog 风视频、自动导演功能中的多模型协作等)。
  • Sora API 停止后,也出现了点名推荐 Seedance 2.0、LTX、Runway 作为迁移目标的咨询帖。

开源的动向

  • 据报道,阿里巴巴开放权重视频模型“Wan 3.0”在人类评测排行榜上超过闭源模型,并且发布时点紧随 100 亿美元规模股票出售之后。
  • 阿里巴巴图像生成模型“Qwen-Image 2.1”(70 亿参数、基准分数 60.2)公开后不久,就被 ComfyUI 官方(Comfy-Org)节点化,数日内融入生态。
  • 面向轻量、本地运行的 C++ 推理引擎 stable-diffusion.cpp(★7,148)横跨支持 SD、Flux、Wan、Qwen Image、Z-Image 等主流开放模型,并进入 GitHub Trending。
  • 华为 Ascend NPU 生态系统(Modelers.cn 平台)中正在大量生产 SDXL/FLUX LoRA,但许多缺少模型卡、触发词和样例,质量偏低;采用 Apache-2.0 许可证、可商用且无需再训练的高质量 LoRA 相对少见,这一格局被反复指出。
  • 可观察到个人创作者尝试经由 ComfyUI 在本地运行 MiniMax H3 视频生成模型,并出现性能对比文章。
  • 总体来看,开源阵营通过“阿里巴巴大型模型(Wan/Qwen)迅速移植至 ComfyUI”的速度,以及“华为 Ascend 生态的草根 LoRA 大量生产”这两个层次推进。
局限
  • bsky.app 搜索页和单帖页都是客户端渲染 SPA,WebFetch 完全无法获取正文(只返回“Bluesky”)。
  • 官方文档所列的 public.api.bsky.app XRPC 端点在本次会话中始终被 403 Forbidden 拦截。无 public. 的 api.bsky.app 可用,因此改用该端点,但未来也可能被反机器人措施封锁。
  • 从 Bash 直接使用 curl 会因沙盒网络访问要求审批而无法在无人执行环境中运行,因此全部通过 WebFetch 完成。
  • Veo 3 关键词会被西班牙语第一人称动词“veo”(我看见)和广播节目“Logan Veo”等结果淹没,噪声很大。本次查询中直接提及 Google Veo 的只有 1 条(Nano Banana 相关串中的提及),没有再用“Google Veo”等专用词检索。
  • HunyuanVideo / LTX Video 查询均为 0 命中,按本次关键词未找到 Bluesky 上关于这两个模型的特定讨论。
  • 搜索 API 的 limit=25 似乎是上限,每个查询最多获取 25 条且只按最新排序,无法进行回溯式长期趋势分析。

Lemmy

Lemmy — 图像与视频生成 AI 新闻

在 Lemmy 中,针对“image generation AI”“video generation AI”“Sora shutdown”“Nano Banana”“Grok Imagine”“Wan 2.2 OR Wan 3”“Flux image model”等多个关键词调用了 lemmy.world 的搜索 API(/api/v3/search),但结果大多被无关帖子淹没(全文搜索甚至会命中评论正文的部分匹配)。因此很快放弃术语搜索,切换到直接浏览专注于 AI 图像生成的既有社区。

社区
社区 实例 订阅者数 特征
!«メールアドレス» lemmy.dbzer0.com 5,713 人 持续机械发布新开源模型、LoRA、ComfyUI 节点 HuggingFace/GitHub 链接的信息流。几乎每日更新,最近仍活跃至 2026-09-22。dbzer0 同时也是众包式 SD 推理网络“AI Horde”的运营方。
!«メールアドレス» lemmy.dbzer0.com 2,363 人 镜像发布来自 Civitai 的 AI 生成插画的图像展示社区。每天十几条,最近更新至 2026-09-26。
!«メールアドレス» lemmy.world 1,985 人 免费 AI 生成工具“Perchance”(图像生成采用 Flux)的讨论社区。
!«メールアドレス» lemmy.ml 1,662 人 曾经活跃但实质停滞。最近有实质内容的是 2026-02-12(Qwen-Image-2.0 发布消息),此前主要是 2024 年 Stability AI 经营危机新闻。
!«メールアドレス» lemmy.world 1,258 人 综合 ML/AI 新闻。几乎没有专门讨论图像/视频生成的帖子(最近是数据中心电力问题、Microsoft 的 AI 战略等)。
!«メールアドレス»(Generative Artificial Intelligence) sopuli.xyz 328 人 生成式 AI 综合聊天社区。图像/视频生成的具体新闻很少,最近实质帖子停留在 2026-04-30(Gemini app 的文件生成功能)。
!«メールアドレス» lemmy.durstig.online 52 人 机械镜像 Reddit AI 子版块的 RSS Bot。分数清一色固定为 1 分(机械导入,不代表真实互动)。
!«メールアドレス» sh.itjust.works 172 人 AI 艺术案例社区,但在 2023 年停止更新,已完全沉寂。
帖子
  1. Qwen-Image-2.1 in ComfyUI(!«メールアドレス»,13 分、0 条评论、2026-09-22)
    https://lemmy.dbzer0.com/post/75874773 → 链接帖称阿里巴巴开放模型 Qwen-Image 2.1 已获得 ComfyUI 官方博客(blog.comfy.org)正式支持。其他平台(Bluesky)也在同期报告同一动向,证明它是开源阵营的主要主题。

  2. Supra2-IMG Model(!«メールアドレス»,8 分、0 条评论、2026-09-22)
    https://lemmy.dbzer0.com/post/75874769 → 宣布 HuggingFace 上新的图像生成模型“SupraLabs/Supra2-IMG”公开。

  3. AI Horde New Interface(!«メールアドレス»,9 分、0 条评论、2026-09-19)
    https://lemmy.dbzer0.com/post/75736717 → haidra.net 发布众包、分布式免费图像生成基础设施“AI Horde”的新界面和文档。这是 Lemmy 社区自身参与的开源、去中心化生成基础项目。

  4. 面向 MiniMax H3 的 ComfyUI 工具集中发布(!«メールアドレス»,各 1~3 分、2026-09-12~09-16)
    https://lemmy.dbzer0.com/post/75586072(MiniMaxH3-PromptBuilder)、
    https://lemmy.dbzer0.com/post/75586070(wan2gp-h3-latent-continue)、
    https://lemmy.dbzer0.com/post/75427444(3d-Camera-control-H3-Minimax)等
    → 面向字节跳动系视频模型“MiniMax H3”的 ComfyUI 自定义节点与提示词构建器,在一周内连续发布超过 5 条。这与 Reddit StableDiffusion 串中“视频=Minimax H3”的共识一致,说明开放工具阵营正在快速跟进。

  5. Krea2-Turbo-Distill-2step-LoRA(!«メールアドレス»,2026-09-13/09-16 两次发布,各 1~2 分)
    https://lemmy.dbzer0.com/post/75427441 / https://lemmy.dbzer0.com/post/75586071 → 用于以两步加速图像生成模型 Krea 2 的 LoRA 在 HuggingFace 公开。说明在 Reddit 提到“Krea 2 是当前首选”的趋势背后,加速适配器的完善也在并行推进。

  6. LTX-2.5-22b-IC-LoRA-Ingredients(!«メールアドレス»,3 分、0 条评论、2026-09-12)
    https://lemmy.dbzer0.com/post/75382763 → 面向 Lightricks 开放视频模型“LTX”的 LoRA 公开。

  7. Waters & World's Edge 等来自 Civitai 的每日生成插画帖子(!«メールアドレス»,最高 12 分、2026-09-22~09-26)
    https://lemmy.dbzer0.com/post/75841792 等十余条 → 虽然更接近作品展示而非新闻,但每日持续发布本身就证明本地生成社区的活动没有中断。

  8. We are saying goodbye to Sora(!«メールアドレス»,-11 分、4 条评论、2026-03-24)
    https://lemmy.world/post/44702049 → 原样转载 OpenAI 自身关于初代 Sora App 结束的公告,内容为“感谢所有在 Sora 上创作作品的人”。但 Lemmy 用户反应冷淡,分数为负。未发现关于 9 月底全面关闭(Sora 2/Videos API 结束)的新帖;这一 3 月公告是 Lemmy 上唯一成规模的 Sora 相关帖子。

  9. Interesting Facts about Perchance(!«メールアドレス»,3 分、18 条评论、2026-08-05)
    https://lemmy.world/post/50319371 → 讨论免费 AI 生成网站“Perchance”的图像生成功能采用开放模型 Flux,也使用 DeepSeek 免费开放文本模型。显示开源模型名称已在面向普通用户的“免费 AI 工具”语境中传播。

信号
  • 几乎只有开源侧呈现上升趋势:Lemmy 中唯一活跃的专业社区 !«メールアドレス» 是一个机械收集 HuggingFace/GitHub 新发布内容的信息流。Qwen-Image 2.1、Krea 2、MiniMax H3、LTX 等名称在最近两周密集出现。Reddit 与 Bluesky 观测到的“当前热门开放模型”几乎同样快速地流入 Lemmy。
  • 闭源话题结构性稀薄:针对 Sora 结束、Nano Banana、Veo 降价、Grok Imagine、Seedance 等 9 月大型闭源话题进行了多次定向搜索,但未发现相应新帖。唯一命中的 Sora 相关帖子是 3 月旧公告转载,且评价不佳(-11 分)。Lemmy 这类“技术人员/自建用户”群体,相比企业闭源服务的新闻,更关注可自行运行的开放模型和工具供给。
  • 互动普遍很低:stable_diffusion 系帖子多为 1~13 分、0 评论,不像 Reddit 那样有热烈讨论。在 Lemmy 上,“话题性”只能用发帖数量和更新频率衡量,不适合用作赞反对或热度强度的指标。
  • 一般社区对 AI 偏怀疑:!fuck_ai(AI 批评类)和 !machinelearning 中,核心不是图像或视频生成,而是“AI 依赖”“数据中心电力问题”“Stability AI 经营危机历史”等外围或批判性话题,直接相关帖子较少。
局限
  • Lemmy 搜索 API 精度很低。使用“image generation AI”“video generation AI”“Sora shutdown”“Nano Banana”“Grok Imagine”“Wan 2.2 OR Wan 3”“Flux image model”等多个关键词,结果大多是无关帖子(包括评论正文的部分匹配)。因此改为直接浏览专业社区,其他实例中仍可能有被搜索遗漏的话题。
  • 未找到 Lemmy 上专门的视频生成社区,视频模型话题只能作为 !«メールアドレス» 内的 ComfyUI 工具帖观察到。
  • 9 月的闭源新闻(OpenAI Sora、Google Nano Banana/Veo、xAI Grok Imagine、字节跳动 Seedance 等)在 Lemmy 上完全未找到,唯一相关内容是 3 月旧公告转载。其他平台广泛报道的话题在 Lemmy 中实质缺席,“毫无动静”本身说明了该平台的性质。
  • 未达到“分析约 20 条帖子”的完成标准。Lemmy 本身规模较小,直接相关的实质帖子约 9 条已接近上限,其余均为噪声(无关搜索结果或已停止更新的社区),与手册中“Lemmy 规模较小”的前提相符。
  • !«メールアドレス» 等只在搜索结果中出现名称的社区,API 返回 404,无法确认实体。

Pinterest

Pinterest — 图像与视频生成 AI 新闻

视觉主题
  • “最佳 AI 工具”清单式信息图主导整个看板:深藏蓝或黑色背景,以霓虹紫/蓝/粉渐变环绕粗体无衬线标题(“6+ BEST AI VIDEO GENERATION WEBSITES”“12 BEST AI VIDEO GENERATORS”),编号行或手机模型框架中,每一行把工具 Logo、单句卖点和一张生成样图配对 [1, 7, 42]。
  • 镀铬/玻璃质感的人形机器人头部,或侧面的仿生人,在蓝色光线下呈现,是所有“AI 正在改变一切”或“AI 的未来”图钉的默认插图。它被混用于图像生成新闻、视频生成新闻和泛 AI 行业新闻,使这些类别难以区分 [2, 16, 19]。
  • 生成式视频工具的真实产品截图通常以信息图内的小型嵌入缩略图出现,而不是独立主视觉;例如 Adobe Premiere 新的时间线内“Generate Video/Sound”面板 [3],以及 Luma AI“Dream Machine”的电影感海浪镜头、Kling AI 的悬崖战士镜头,被作为清单图 [1, 7] 内的演示静帧。
  • 竖向“手机堆叠”拼贴艺术:数十个显示短视频内容(跑步者、猫、山景 B-roll)的智能手机屏幕如摩天大楼般向天空堆叠,用来表现“AI 内容无处不在”/社交视频增长,而非某个具体工具 [6]。
  • YouTube 缩略图风格的 AI 新闻图钉:惊讶或兴奋的胡子男性面孔,旁边是 2~4 个品牌 Logo(OpenAI、Google、Microsoft、Meta、Notion)置于发光的圆角方框中,蓝黑背景和醒目的白色“AI NEWS”文字。这种形式被多个创作者反复使用 [24, 38]。
  • 视频到任意风格的前后对比网格:同一段人物行走源视频被重塑为“木块”“折纸艺术”“彩色玩具积木”“鲜花材质”,形成 5 列网格,并带有 Luma 工具水印。这是样本中最清晰的实际产品演示 [28]。
  • AI 主播 / 深度伪造新闻构图:带有“AI GENERATED”标签的 NBC News 品牌天气播报片段,画面包含雪景和穿派克大衣的主持人,直接呈现“我们还能相信 AI 新闻视频吗”的叙事 [32]。
  • 完整内容流水线的漏斗/思维导图信息图:一个圆形“AI 驱动生态系统”的手持图标图形 [47],以及一张庞大的“面向 YouTube & Instagram 的 AI 驱动视频创作”思维导图,将 ChatGPT、Claude 3、Pictory AI、Runway Gen-3、Synthesia、ElevenLabs、Midjourney、Descript、CapCut AI、VidIQ、Leonardo AI 列为统一工作流,奇怪地链接到一个“免费电影/电视”盗版网站(www.moviesgratis.xyz)[13]。
值得注意的图钉
  • [1] “6+ Best AI Video Generation Websites” — 一张完整的工具排名信息图,列出 Runway、Pika、Kling AI、Luma AI(Dream Machine)、Canva AI Video Generator、Hailuo AI,每个工具配有样图与目标用户标签;这是 Pinterest 创作者目前主推哪些闭源视频工具最清晰的单点快照。
  • [3] “4 Major AI Updates You Need to Know in 2026” — 一张图钉中列出四项具体闭源内容:OpenAI“GPT-6 Astra”、Google Gemini 在 Gmail/Drive/Docs/Slides/Chat 中变得“更具代理能力”、Adobe Premiere 新增时间线内生成视频/声音功能,以及 Cognition(Devin)以 480 亿美元估值完成 20 亿美元 E 轮融资。
  • [7] “12 Best AI Video Generators in 2026” — 第二张更长的排名图(Google Veo、OpenAI Sora、Runway、Kling AI、Pika、Luma Dream Machine、HeyGen、Synthesia、InVideo AI、Vidu AI、Hailuo AI、PixVerse AI)。与图钉 [1] 交叉比较可见,Runway、Pika、Kling、Luma、Hailuo 是独立创作者之间反复出现的名称,也就是当前共识候选清单。
  • [13] “AI Content Studio & Automation Secrets” — moviesgratis.xyz 的思维导图,将 ChatGPT、Claude 3、Pictory AI、Runway Gen-3、Synthesia、Midjourney、ElevenLabs、Descript、CapCut AI、VidIQ、Leonardo AI 捆绑为单一“创意→发布”流水线。它有助于观察 SEO/联盟营销创作者认定的默认视频生成工具栈,但落地站点看起来是盗版流媒体引流页,非可信来源。
  • [24] “AI News: Anthropic Leak Shows Us The Future of AI” — 一张 YouTube 缩略图风格图钉(OpenAI/Google/Microsoft/OpenAI Logo,惊讶创作者面孔),宣称存在 Anthropic 泄露;但图中本身没有 Anthropic 内容,因此无法仅从图片验证实质。
  • [28] “Google announces ultra-high quality video...” — 一个 5 种条件 × 3 类主体的网格(将源视频重塑为木块/折纸/玩具积木/鲜花材质,作用于人物、狗和汽车),带有“Luma”水印;这是样本中最具体的视频生成产品演示,是对真实素材的真实风格迁移,而非营销文案。
  • [32] “AI news videos blur line between real and fake reports” — 带“AI GENERATED”徽标的 NBC News 品牌视频片段,呈现雪景天气报道;它直接可视化了不断扩大的“AI 主播”争议,而不仅是对其命名。
  • [38] “AI News: OpenAI Finally Released What We Asked For” — 又一张惊讶面孔/Logo 网格 AI 新闻缩略图(OpenAI、Google、Meta、Notion);与 [24] 的形式高度相似,似乎是重复使用的频道/缩略图模板,值得作为一种内容格式而非独家新闻看待。
  • [43] “generate ai images, art, illustration, using with midjourney” — 本批中少数直接点名 Midjourney 的图钉之一,而不是将其埋在多工具信息图中;但图像本身只是通用的三屏办公桌模型,没有可见的 Midjourney 输出,因此更像 SEO/联盟营销图钉而不是真实展示。
信号
  • 闭源、面向消费者的视频工具是该平台的主导叙事。 Runway、Pika、Kling AI、Luma(Dream Machine)、Hailuo AI、Google Veo、OpenAI Sora、HeyGen、Synthesia、InVideo AI、Vidu AI、PixVerse AI 在独立标题的图钉 [1, 7] 中反复出现,这比任意单个图钉都是更强的信号:这正是内容营销创作者当前的“最佳工具”共识。
  • 信任/真实性焦虑是可见的次级主题,不只是工具推广:AI 生成新闻主播深度伪造 [32]、“AI 语音检测器”与内容来源水印图 [19, 40],以及“我们还能相信新闻吗”的框架,都与工具清单反复并列出现。
  • 企业/代理型 AI 新闻混入同一看板:Gemini 向 Workspace 应用推进代理能力,以及 Cognition/Devin 20 亿美元融资 [3] 都会出现在“图像/视频 AI”搜索中,说明 Pinterest 算法会把泛 AI 行业新闻混入该细分主题,而不是严格限定于生成媒体。
  • 开源图像/视频模型几乎完全缺席。 样本中没有一个图钉提到 Stable Diffusion、Flux、ComfyUI、LoRA、Hunyuan、Wan 或任何其他开放权重图像/视频模型。Midjourney [43] 和图 [13] 中泛泛提及的“Midjourney/Leonardo AI”已是最接近非超级大公司名称的内容,但它们也都是闭源产品,而非开放权重模型。这本身就是结论:Pinterest 在此主题上的受众/算法偏向可变现的“最佳免费工具”和副业内容,不偏向开源/自托管生成社区。
  • 一手来源很少。 绝大多数图钉是二手聚合内容(清单、AI 新闻缩略图、思维导图),而非公司自身公告或创作者自己的生成结果;图钉 [28] 的 Luma 风格迁移网格是唯一看起来像真正第一方产品演示而不是行业评论的内容。
局限
  • 工作器的无头浏览器搜索针对“Image and Video Generation AI News”只返回一个扁平的 50 个图钉批次,没有按流派细分(所有图钉的 genre 都是 ""),因此本报告无法像手册的其他运行那样按明确子流派比较。
  • 我详细阅读并描述了收集到的 50 张图片中的 20 张(按简报“约 20 个帖子”的完成标准,在完整索引范围内选择有代表性的样本)。其余 30 张未逐一打开,但已查看 output/pinterest.pins.md 中可见的标题,且它们符合这里描述的同类清单/AI 新闻缩略图模式(例如“best free 15 ai tools” [42]、“Latest AI News & Articles” [45],以及数张无标题的图库图钉 [5, 10, 22, 25, 29, 33, 48, 49, 50])。
  • 若干图钉没有标题(“(untitled)”),未打开的图片可能含有有用的文字说明或图中文字。
  • 样本中没有一个图钉出现开源模型名称(Stable Diffusion、Flux、ComfyUI、Wan、Hunyuan 等);无法确认这是 Pinterest 对这一主题的真实缺席,还是特定搜索查询造成的结果。专门以“open source image generation”搜索,可能会得到不同的图钉集合。
  • 按照要求,没有自行浏览 Pinterest,也没有尝试验证内容主张(如图钉 [24] 的“Anthropic 泄露”),仅根据收集到的图片判断;多张 AI 新闻缩略图在标题中提出了无法从缩略图本身验证的主张。

建议行动

  • 持续关注 Wan 3.0 和 Qwen-Image 2.1 的采用速度,判断开放与闭源之间的质量反转是否会固化。
  • 跟踪 Google Veo 降价及 Nano Banana 2.5 的发展,确认 Sora 退出后价格战的加速度。
  • 列出 Reddit 上与 AI 生成内容冒充真实相关的争议和实际伤害案例(显微镜竞赛、房地产、CEO 解雇),观察是否会引向监管和诉讼。
  • 下次收集 X 和 Reddit 内容时,加入 Stable Diffusion、Flux、ComfyUI、Wan、Qwen 等明确的开源搜索词,补足此次为零的遗漏。
  • 不要将 Pinterest 作为开源动态指标,而应把它当作观察消费者闭源工具热度的专门来源。

收集图片

Just Nail It 🎥生成式 AI 将如何重塑每个行业2026 年你需要了解的 4 项重大 AI 更新AI 图像生成图像AI 内容工作室与自动化秘诀 🚀📱2026 年 12 款最佳 AI 视频生成器(免费与付费)| Google Veo、Sora、Runway 等用于图像和视频生成的 AI‎🚨 AI 正变得可怕地强大。图像今晚就能开始的 5 个 ChatGPT 副业 🚀2026 年用于社交媒体内容创作和增长的顶级免费 AI 工具 ✨GPT 5.2、实时视频编辑器、AI 立体视频、移动 AI 代理、全身控制:AI 新闻纽约的大胆一搏:立法内幕...加入我们,每日学习 SEO!🚀 2030 年 AI 的发展空间:人工智能将如何改变我们的未来AI 视频创作服务 | AI 驱动的视频制作面向新闻与时事视频的 AI 配音AI 生成视频:好还是坏?这是事实!🤖🎥2025 年最简单的 AI 赚钱方式5 月 6 日 AI 新闻更新图像Vidu AI 教程 - 全新惊艳的文生视频 AI 生成器AI 新闻:Anthropic 泄露让我们看到 AI 的未来...图像关注 👉 用 AI 更快发展你的品牌 ⚡"为什么 AI 聊天机器人跟不上突发新闻"Google 宣布超高质量视频...图像新闻行业正在快速演变别再刷了……这个故事会彻底改变你看待 AI 的方式!AI 新闻视频模糊了真实报道与虚假报道的界线图像2026 年 AI 驱动的 YouTube 营销为什么 AI 驱动的新闻平台在 2026 年增长得更快AI 正在撰写新闻——我们还能信任新闻业吗?使用 AI 创造病毒式内容AI 新闻:OpenAI 终于发布了我们所要求的内容AI 内容与社交媒体担忧为 AI 内容添加水印:证明来源(2025 年挑战)你还没有准备好迎接这波可怕的 AI 生成视频新浪潮15 个最佳免费 AI 工具使用 Midjourney 生成 AI 图像、艺术和插画听听 AI 营销领域顶尖专家的分享!最新 AI 新闻与文章如何通过文字描述在 Google 搜索中生成 AI 图像AI 生态系统互联的人工智能生态系统图像图像图像

数据质量说明

Bluesky 以 12 个查询、超过 200 条帖子大幅超过完成标准;但 Reddit(12 条)、X(7~8 条,地区固定在克罗地亚且开源提及为零)、Lemmy(约 9 条)均未达到“约 20 条”的完成标准,YouTube 则因 JavaScript 渲染限制而无法获取播放量和订阅数。

图库