图像与视频生成 AI 新闻——2026-09-23
闭源图像/视频 AI 正在大幅收缩(Sora 2 的 API 将于 2026-09-24 关闭,Midjourney 转向医疗设备,Grok Imagine/Seedance 的定价引发反弹);与此同时,以 ComfyUI 为核心的开源工具(Wan、HunyuanVideo、FLUX.2、Qwen-Image、MiniMax H3)正悄然成为实际生产工作的默认选择。
图像与视频生成 AI:开源 vs 闭源的前线,真的太火热了——2026-09-23
看下来,现在真的是一个特别有意思的阶段🔥 闭源阵营(Sora 2、Midjourney、Grok Imagine 等)一边高调发布,另一边却不断撤退、涨价和转向,说实话已经有些摇摇欲坠😳 相比之下,开源阵营(Wan、FLUX.2、Qwen-Image、HunyuanVideo)正汇聚到 ComfyUI 这个枢纽上,虽然不那么高调,却实实在在地打入了真实制作现场💪 综合 Reddit、X、YouTube、Bluesky、Lemmy 和 Pinterest 六个平台,呈现出的格局很清晰:大新闻属于闭源,踏实好用属于开源。此外,公众对于“必须明确标注 AI 生成内容”的呼声也越来越强📢
跨平台观察
- 多个平台都确认了闭源阵营的失速与战略转向。 YouTube 报道称,Sora 2 的应用仅半年便结束服务(2026-04-26),API 也计划在调查次日、2026-09-24 关闭;其每日运营成本约 100 万美元,累计付费收入却仅为 210 万美元(https://www.youtube.com/watch?v=bIL7uU4CYnE)。Lemmy 上也通过 r/ArtificialInteligence 镜像分享了同一则 Sora API 关闭新闻(https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/),并与中国快手(Kling)完成 30 亿美元融资形成对照,进一步强化了“低调的企业级业务才真正赚钱”的论调。
- 开源正以 ComfyUI 为中心,作为“实务基础设施”出现在各处。 Reddit 上有 ComfyUI+FramePack 可在低配电脑生成视频的讨论;Lemmy 在最近一周出现了两项 MiniMax H3 的 ComfyUI 扩展;YouTube 则大量出现 Wan/HunyuanVideo/LTX 的本地运行教程。三个平台都独立地浮现出 ComfyUI 和 Wan 系列这些关键词。
- 对“收费过头了”的不满正集中指向闭源产品。 Reddit 上出现了三条寻找免费 AI 视频生成器的帖子(原因是闭源产品免费额度缩减);Bluesky 上,一位东京艺术家也反复形容 Seedance 2.5 的费用“devastating”(https://bsky.app/profile/metalmickey.bsky.social/post/3mu25rbs4dk2e)。
- 消费者开始因“到底该用哪个工具”而感到比较疲劳。 YouTube 中,Sora 2 vs Seedance 2.0 vs Runway 等对比视频已经成为常态;Pinterest 上,“最佳质量 vs 最佳免费”的决策矩阵也非常流行(YouTube: https://www.youtube.com/watch?v=rb0p_mY3tPs / Pinterest #10)。相比单一模型的拥趸,人们更想知道“现在到底哪个最强”。
- 对 AI 生成内容的不信任和要求强制标识的氛围,跨平台都很一致。 Reddit 的法案提议帖拥有 13,841 条评论,是本次采集内容中讨论量压倒性最高的一条(https://www.reddit.com/r/CriticalState/comments/1wmktek/)。Pinterest 上,“FAKE”印章和 AI 检测徽章也已成为独立的视觉类别。
按平台观察
Reddit — 在采集的 12 个帖子中,只有 4 个来自图像/视频生成 AI 专业社区,其他大多来自普通子版块,主题是“发现 AI 生成内容/对此感到愤怒”。一方面,人们反复表达对免费、本地视频生成的需求;另一方面,DeepSeek(开放权重)因用户数暴涨(DAU 从 1.2 亿增至 2 亿)而算力扩容跟不上、质量下降,也呈现出罕见的“开源因过度受欢迎而接近自毁”的局面(https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)。
X — 以日语账号为中心,掀起了 Claude Opus 5.5 与 Grok 4.7 的“一键生成演示”热潮。@cherry_mx_reds、@NFT_Chen、@riku720720、@chetaslua 在几乎同一时期(9/21~22)发布了不同演示,像是一波发布后的集中验证。开源侧则以 @shinshin86、@GeekCatX 等独立开发者展示 GitHub 星标数的帖子最显眼。不过,40 条采集内容中超过 20 条是无关噪声,源于 X 自身的趋势词,这一点是明显短板。
YouTube — 信息密度最高。Sora 2 的兴衰(高调发布→半年后撤退)是最大话题,Nano Banana 2、GPT Image 2.5、Midjourney V8 系列的更新竞赛也仍在继续。开源侧的主战场则是 Alibaba(Wan)、Tencent(HunyuanVideo)、Black Forest Labs(FLUX)和 Lightricks(LTX);ComfyUI 已经确立为不断加入新节点的“接线面板”。
Bluesky — 没有强势的图像/视频生成 AI 专业枢纽,官方账号(Stability AI、Midjourney、Runway 等)基本处于休眠。唯一持续发声的是 xAI 内部人员 @ethanhe。不过全文搜索 API 始终返回 403,调查只能巡查已知账号,影响很大。
Lemmy — 规模虽小(主要社区也只有 5,713 人),但 !«メールアドレス» 中围绕 ComfyUI 的帖子信息密度很高。闭源侧“撤退与转向”新闻格外醒目:Sora API 关闭、Midjourney 转向医疗设备、Google 的 Earth AI 迅速撤回。相比高调发布,更多讨论集中在战略修正。
Pinterest — 核心不是新闻文章,而是“AI NEWS 缩略图风”图片、对比图表和深度伪造警示视觉。开源方面只找到 AMD 的“Amuse 3.0”,几乎没有存在感。相反,消费者“不知道该选哪个”的焦虑,以及对 AI 生成内容的警惕,已经非常鲜明地形成视觉类别。
值得关注的点
- Sora 2 API 关闭(2026-09-24) — YouTube: https://www.youtube.com/watch?v=bIL7uU4CYnE
- DeepSeek DAU 激增、算力不足导致质量下降 — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- 要求强制标注 AI 生成内容的法案提议(13,841 条评论) — Reddit: https://www.reddit.com/r/CriticalState/comments/1wmktek/
- 面向 ComfyUI+MiniMax H3 的长视频生成扩展不断出现 — Lemmy: https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
- Grok 4.7 在 Blender 中自动生成 3D 场景(41 万观看) — X: https://x.com/cherry_mx_reds/status/2102098340699668865
- Midjourney 从图像生成大幅转向医疗设备(超声 CT 扫描仪)业务 — Lemmy: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
建议行动
- 在闭源产品持续涨价、撤退之际,持续关注 Wan、HunyuanVideo、FLUX.2、ComfyUI+MiniMax H3 这套 OSS 技术栈,视其为最重要的替代方案。
- 提前应对 Reddit 和 Pinterest 上日益强烈的 AI 生成内容强制标注趋势,准备内容来源标识政策。
- 在 Sora 2 API 于 9/24 关闭后,追踪用户将流向 Kling、Seedance 还是 Runway。
- 将 X 上 Opus 5.5/Grok 4.7 的一键生成演示热潮视为发布窗口中的短期炒作,不要高估其对 OSS 心智份额的长期威胁。
- 关注 DeepSeek 这类开放权重模型突然走红时暴露出的自建基础设施上限,将其作为供给约束的先行指标。
- 面对 YouTube 与 Pinterest 明显的“比较与决策疲劳”,应以对比型内容建立触点,而非只发布单一产品新闻。
数据质量
达到完成标准(每个 SNS 分析约 20 条内容)的只有 YouTube 与 Pinterest(分别采集 20 条和 50 条)左右,其他平台均有不足。Reddit 只收集到 12 个帖子,来自专业子版块的仅 4 个。X 收集了 40 条,但超过半数是与主题无关、来自趋势词的噪声,直接相关的大约只有 11 条。Bluesky 的 API(全文搜索)始终 403,只能巡查已知账号,共收集 10 条。Lemmy 平台本身规模较小(主要社区 5,713 人),原本就不可能达到 20 条,而且其中一半是 Reddit 镜像转载。Pinterest 的 50 条中仅人工目视确认了 26 条,也无法取得点赞数等互动指标。
按平台汇总
Reddit — 图像与视频生成 AI 新闻
在哪里(子版块)
采集到的 12 个帖子分布于 10 个子版块。图像与视频生成 AI 专业社区仅占少数,其余是普通子版块中提及或抱怨 AI 生成内容的帖子。
| 子版块 | 成员数 | 采集帖子数 |
|---|---|---|
| r/generativeAI | 156,181 | 3 |
| r/mildlyinfuriating | 12,586,808 | 1 |
| r/aivideomaking | 7,498 | 1 |
| r/CriticalState | 39,096 | 1 |
| r/Instagramreality | 1,155,566 | 1 |
| r/Purdue | 100,731 | 1 |
| r/DeepSeek | 140,681 | 1 |
| r/ImagineAiArt | 19,446 | 1 |
| r/youngpeopletiktoks | 8,226 | 1 |
| r/youtube | 3,459,719 | 1 |
真正专注于生成式 AI 的只有 r/generativeAI、r/aivideomaking、r/DeepSeek、r/ImagineAiArt 四个版块(4 个帖子)。另外 8 个帖子都来自普通子版块,讨论语境是“发现了 AI 生成内容/令人反感”。
大家的反应
- 寻找免费 AI 视频生成器的需求,在三个不同帖子中反复出现(帖子 #2“Which AI video generator can still be used for free?”,r/generativeAI、20pt、73 条评论、2026-09-16;帖子 #3“Looking for a free AI video generator”,r/aivideomaking、7pt、28 条评论、2026-09-20;帖子 #10,同标题,r/generativeAI、4pt、28 条评论、2026-09-20)。闭源工具普遍走向付费化,u/RioMetal(+4)推荐开源方案:“如果能本地运行,Wan 或 Minimax 有很多可选。”
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - “AI 推荐给我的东西全都变成付费了”的不满(帖子 #2 正文)。这是对闭源产品免费额度缩水的典型反应。
https://www.reddit.com/r/generativeAI/comments/1whtesl/ - 本地开源运行的具体方案:u/AztecWheels(+2,帖子 #3)回答称,通过 Pinokio 安装 FramePack,即使低配电脑也可以完成图像→视频转换(无音频、1~120 秒)。ComfyUI+FramePack 被提及为低配置环境下开源视频生成的常见组合。
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - 对“想白嫖”的反感:u/activematrix99(+2,帖子 #3)表示:“这就像去餐厅要求免费吃饭。企业为这项技术投入了数十亿美元。”社区内部对免费需求的意见并不一致。
https://www.reddit.com/r/aivideomaking/comments/1wled0f/ - DeepSeek(开放权重)的快速增长与算力不足:帖子 #7“some deepseek news, if you care”(r/DeepSeek、292pt、45 条评论、2026-09-21)称,DeepSeek 的 DAU 从 1.2 亿激增至 2 亿(+66.7%),但计算能力仅增加 8.3%,导致质量下降和重新生成故障。据称其已订购 16 万颗华为 Ascend 960DT。u/Equivalent-Grass-527(+13)认为:“需求和计算资源的不匹配,是对近期退化最合理的解释。”
https://www.reddit.com/r/DeepSeek/comments/1wmcgex/ - GPT Image 2.5 Flare(闭源)vs KREA 2(开源)的争论:帖子 #9“GPT Image 2.5 Flare — is this actually the best AI image generating model right now?”(r/ImagineAiArt、93pt、62 条评论、2026-09-16)。u/Dependent_Quit_3730(+3,葡萄牙语)认为它很适合想轻松使用的人,但自己仍会使用 KREA 2;u/SeaworthinessFresh16(+2)称 ComfyUI+Krea2 的结果看起来一样。对于闭源新模型的热度,不少人认为实际体验差异很小。
https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/ - 对 AI 生成房地产照片的强烈反弹:帖子 #1“It should be illegal to post AI-generated "inspirational" images in house listing photos.”(r/mildlyinfuriating、25,962pt、706 条评论、2026-09-21,是采集内容中最高分)。u/BojackWorseman13(+1,128)表示:“如果我是房产经纪人,会不停向社交媒体投诉;即使不违法,也应显著标明它是 AI 生成的。”
https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ - 要求强制标注 AI 生成内容的法案提议:帖子 #4“[Law Proposal] Every ai generated image and text must need to have watermark.”(r/CriticalState、1,246pt、13,841 条评论、2026-09-21,采集内容中评论最多)。高赞评论普遍支持,u/Timedforfun(+16)写道:“这不该是需要隐藏的东西,投票支持。”
https://www.reddit.com/r/CriticalState/comments/1wmktek/ - 普通人已经难以辨认的 AI 图像走红:帖子 #5“AI generated images on Reddit with thousands of upvotes and comments”(r/Instagramreality、2,148pt、343 条评论、2026-09-18)。u/Habibti-Mimi81(+146)表示:“我自己没能看出来,灰色瓷砖角落是唯一提示。这是个令人悲伤又危险的时代。”
https://www.reddit.com/r/Instagramreality/comments/1wk0euk/ - 连大学官方公告都在使用 AI 图像,并被批评为“垃圾内容”:帖子 #6“AI generated image on MSEE wall”(r/Purdue、139pt、19 条评论、2026-09-21)。正文写道:“他们请不起平面设计师吗?到处都逃不过 AI 垃圾。”
https://www.reddit.com/r/Purdue/comments/1wmq43f/ - Sora 等视频生成 AI 内容流入 TikTok 转贴子版块:帖子 #11“another ai generated grounded video”(r/youngpeopletiktoks、81pt、35 条评论、2026-09-19)。u/Pretend-Goat-8065(+5)简短评论:“Another Sora ai”,直接点名闭源产品。
https://www.reddit.com/r/youngpeopletiktoks/comments/1wkjvor/ - 对 YouTube 自动生成 AI 章节的反感:帖子 #12(r/youtube、3pt、22 条评论、2026-09-17)。u/avatar0027(+2)称,基于文字转录自动生成的章节更频繁地显示给用户;观众没有统一关闭方式,只有发布者可逐个禁用。虽然不是视频生成本身,但可作为用户对 AI 功能扩张感到疲惫的佐证。
https://www.reddit.com/r/youtube/comments/1wiqamq/
信号
- 上升:对可免费、本地运行的视频生成(Wan 2.2、Minimax H3、ComfyUI+FramePack)的需求,在三个独立帖子中反复出现。闭源产品涨价与付费化正在推高人们对开源的兴趣。
- 上升:公众要求对 AI 生成内容进行“强制标注”(帖子 #4 有 13,841 条评论,是此次采集的最大讨论量)。在 Reddit 整体上,监管和透明度话题的互动量远高于模型性能竞赛。
- 容易被忽略:社区中也有人反感“把免费使用当作理所当然”的要求(如 u/activematrix99)。对此并非所有人都持同样看法。
- 意外发现:DeepSeek(开放权重)在用户数暴涨的同时,因算力不足发生质量下降(帖子 #7)。讨论的不是传统开源/闭源对立,而是“开源模型太受欢迎,运营方自己的基础设施追不上”的新型供给约束。
- 意见分歧:帖子 #9 中围绕闭源新模型 GPT Image 2.5 Flare 和开源 KREA 2 的比较存在分歧;多位用户认为“热度在闭源,但实际体验没有明显差别”。
限制
- 简报的完成标准是每个 SNS 分析约 20 个帖子,但 reddit.threads.md/.json 中只收集到12 个帖子(搜索词仅为一种:“Image and Video Generation AI News”)。由于工作流规定读取既有采集数据,没有进行补充搜索。
- 12 个帖子中,来自图像/视频生成 AI 专业社区(r/generativeAI、r/aivideomaking、r/DeepSeek、r/ImagineAiArt)的只有 4 个。其余 8 个来自普通子版块中的“发现 AI 生成内容”衍生讨论,几乎不包含以闭源/开源新产品或更新本身为主题的新闻帖。
- r/StableDiffusion、r/midjourney、r/runwayml、r/aivideo 等主要图像/视频生成 AI 专业子版块,在采集集合中一个也没有。
- 帖子 #9(GPT Image 2.5 Flare)的正文在完整提示词中途截断,无法确认后续内容或附图。
- 受限于无法自行浏览 Reddit,本调查没有超出这 12 个帖子,未进一步调查其他搜索词或其他帖子。
X
X — 图像与视频生成 AI 新闻
X(Twitter)以日语账号为中心,Claude Opus 5.5 与 Grok 4.7 的视频、动画生成演示正在升温;但收集到的 40 条帖子中,超过一半是与主题无关的噪声(详见下方 Limits)。
账号
- @cherry_mx_reds(Tak) — 本次采集中存在感最强。发布了 Opus 5.5 一键生成动画“Oktoberfest”(373 个赞)以及 Grok 4.7 在 Blender 中创建 3D 场景(1,636 个赞、约 410,000 次观看)两条帖子。一个账号验证两个不同模型的演示,带有比较视角。
- @NFT_Chen(SuSu_酥酥) — 发布过一条 Opus 5.5 用代码将逐帧动画生成出手绘感的演示(151 个赞、约 40,000 次观看)。虽是单条内容,但带有详细说明并获得传播。
- @chetaslua — 发布过一例使用 Opus 5.5、仅靠 JS、没有素材、MCP 或技能的交互式视频生成案例(435 个赞)。偏实现导向的技术演示。
- @riku720720(Rikuo) — 发布过一条 Opus 5.5 生成像素动画的帖子(173 个赞),并在回复中分享提示词,属于实践分享型。
- @old_pgmrs_will(NeuralWire.org 运营者) — 发布两条 Grok 4.7 相关内容:一条是自动生成照片修图应用及演示功能(8 个赞),另一条是反驳对 Grok-4.7 的负面评价,并报告 AI 视频编辑应用的 UI 改进(8 个赞)。规模不大,但作为 AI 新闻账号持续输出。
- @shinshin86(AITuber OnAir 开发者) — 报告开源工具“Still2Rig PSD”(静态图→PSD 自动分层)GitHub 星标超过 60(586 个赞、约 28,000 次观看)。
- @ishitaku39(いしたく) — 介绍了独立开发者将 NVIDIA 研究模型“ARDY”轻量化至浏览器可运行的衍生版“ARDY Mini”(226 个赞)。
- @GeekCatX(知识猫AI实验室) — 报告开源“Hand-drawn Video Skill”(story-to-handdrawn-video)GitHub 星标超过 2,000(103 个赞),并分享一个月以来的更新。
- @so_ainsight — 发布每周 GitHub 快速上升 AI 仓库汇总(573 个赞、约 49,000 次观看)。并非只涵盖图像/视频生成,而是作为相关语境中的 AI 仓库横向盘点。
帖子
闭源(Opus 5.5 / Grok 4.7)
-
#1 @riku720720 — 173 个赞、19 次转发、1 条回复、约 19,000 次观看、2026-09-22。https://x.com/riku720720/status/2102515055116063144
opus 5.5,真的太离谱了……不到 5 分钟就给我生成了这段像素动画。
帖子的核心是对不到五分钟一键生成像素动画这一速度的惊叹。 -
#2 @NFT_Chen — 151 个赞、20 次转发、13 条回复、约 40,000 次观看、2026-09-22。https://x.com/NFT_Chen/status/2102455102896509431
This isn't drawn by a human! Claude Opus 5.5 used code to hand-draw this animation frame by frame. ... 32 seconds, all generated by AI.
“用代码逐帧生成手绘感定格动画”这一生成方式本身,被视为最令人惊讶之处。 -
#3 @cherry_mx_reds — 373 个赞、17 次转发、10 条回复、约 36,000 次观看、2026-09-21。https://x.com/cherry_mx_reds/status/2102493303388475855
Opus 5.5 one-shot this animation in 14m and 48s "Oktoberfest" by Opus 5.5
强调“one-shot”(一键生成),并明确给出耗时 14 分 48 秒。 -
#4 @chetaslua — 435 个赞、23 次转发、10 条回复、约 20,000 次观看、2026-09-22。https://x.com/chetaslua/status/2102501773705670994
Interactive video gen in whatever art style you want by @claudeai Opus 5.5 coded no assets, mcp, skill, only js
这是强调无需素材、MCP、技能,仅用 JS 就可生成互动视频的轻量级技术演示。 -
#17 @AbhinavXJ — 57 个赞、2 次转发、2 条回复、约 3,200 次观看、2026-09-22。https://x.com/AbhinavXJ/status/2102473742723260606
they said pace the frontier and now we have Grok 4.7 Claude Opus 5.5 GPT-6 sol and luna in span of 2 days
讨论重点不在某一模型,而是“两天内出现多个主要模型”所体现的行业发布速度。 -
#19 @cherry_mx_reds — 1,636 个赞、215 次转发、127 条回复、约 410,000 次观看、2026-09-21。
https://x.com/cherry_mx_reds/status/2102098340699668865Grok 4.7 made this in blender. I didn't tell it what to make but only that it should be something it can accomplish in 10 minutes or so.
这是本次采集中互动量最大的 AI 生成演示帖子。其新意在于已经进入 Blender 的 3D 生成。 -
#18 @old_pgmrs_will — 8 个赞、0 次转发、0 条回复、约 611 次观看、2026-09-21。https://x.com/old_pgmrs_will/status/2102182047989338264
用 Grok 4.7 生成了一个自己要用的照片修图应用,并顺便让它实现了自动演示实际操作的功能。
偏实用的使用报告:为个人用途生成应用,并附带演示功能。 -
#20 @old_pgmrs_will — 8 个赞、0 次转发、0 条回复、约 599 次观看、2026-09-22。https://x.com/old_pgmrs_will/status/2102376309020299517
以海外用户为主?偶尔会看到“Grok-4.7 根本不好用”之类的帖子,但要么是黑粉,要么是不会用。
尽管存在对 Grok 4.7 的负面声音,作者以其 AI 视频编辑应用 UI/UX 改进顺利为依据反驳,显示评价存在分歧。
开源
-
#33 @shinshin86 — 586 个赞、59 次转发、2 条回复、约 28,000 次观看、2026-09-21。https://x.com/shinshin86/status/2102163713679577301
能从静态图创建 PSD 的 AI 工具“Still2Rig PSD”,GitHub 星标已超过 60……把图片交给 Codex 等 AI 代理并提出请求后,它们会在 Google Colab 上运行 See-through,完成分层并组装 PSD。
独立开发的 OSS 工具报告 GitHub 星标超过 60,其特点是与 AI 代理联动。 -
#34 @ishitaku39 — 226 个赞、22 次转发、3 条回复、约 9,800 次观看、2026-09-21。https://x.com/ishitaku39/status/2102038146489946532
可以根据评论实时生成角色动作了……我把“ARDY Mini”接入了自制 AITuber。它是个人开发者将 NVIDIA 研究模型“ARDY”轻量化到可以在浏览器运行的衍生版。
这是 OSS 社区将 NVIDIA 研究模型轻量化并投入实际使用的案例。 -
#35 @GeekCatX — 103 个赞、18 次转发、4 条回复、约 7,800 次观看、2026-09-22。https://x.com/GeekCatX/status/2102336276230025224
Hand-drawn Video Skill has been updated again! ...the GitHub Stars for story-to-handdrawn-video have now exceeded 2,000. This time, the focus is on adding more art styles
OSS 项目“story-to-handdrawn-video”的星标已超过 2,000,本次更新重点是加入更多艺术风格。 -
#36 @so_ainsight — 573 个赞、75 次转发、6 条回复、约 49,000 次观看、2026-09-21。
https://x.com/so_ainsight/status/2101871551255830529本周 GitHub 快速上升的 10 个 AI 仓库:1. OpenCodeReview...
这是不限于图像/视频生成的每周 GitHub AI 热门仓库汇总;虽非完全贴题,但可作为 OSS AI 领域活力的背景。
信号
- 正在增长的内容:Claude Opus 5.5 和 Grok 4.7 的个人演示帖——“可在短时间、低成本下一键生成视频/动画”——普遍获得互动。尤其 Opus 5.5,多个独立账号(@riku720720、@NFT_Chen、@cherry_mx_reds、@chetaslua)几乎在同一时期(2026-09-21~22)发布不同演示,显示出发布后的集中验证浪潮。
- 被低估/存在分歧的内容:对 Grok 4.7,赞誉(Blender 3D 生成,约 410,000 次观看)和负评(“根本不好用”)并存,@old_pgmrs_will 还专门发帖反驳。并非一片叫好。
- 意外发现:开源侧最显眼的是日语圈独立开发者(@shinshin86、@ishitaku39、@GeekCatX)以 GitHub 星标作为具体指标展示成果。相较企业发布,更多帖子聚焦“个人将既有研究模型和 AI 代理组合成实用工具”。
- 第二个意外发现:X 搜索词中,真正直接关联图像/视频生成 AI 的只有“Opus 5.5”“Grok 4.7”“GitHub”三个;其余 7 个词(#chance、England、#sweepstakes、#giveaways、Lauren、$SONG、Jesus)均为 X 独有的 Explore 热门词,与主题无关。
限制
- 在 10 个搜索词中,#chance(ABEMA 恋爱真人秀)、England(天气和足球闲聊)、#sweepstakes(Fanatics 应用等抽奖活动)、#giveaways(与印度节庆相关的抽奖帖子)、Lauren(R&B 歌手丑闻及巴西电视剧“Estrelas da Casa”)、$SONG(Cardano 上的加密代币)、**Jesus(宗教语境、游戏行业批评和足球直播)**均与图像/视频生成 AI 无关;在收集的 40 条帖子中,超过 20 条属于这些噪声。它们似乎是从 X 自身 Explore 热门词中机械搜索得到的,对主题没有实质性信号。
- X 的 Explore 趋势列表(按本会话连接服务器所在地)包含“Trending in Croatia”,主要是克罗地亚本地趋势,不能作为全球趋势展示。上述噪声搜索词很可能也源自这一本地趋势列表。
- 无论闭源还是开源,“直接贴合主题的帖子”仅有 Opus 5.5 相关 4 条、Grok 4.7 相关 4 条、GitHub 开源工具 3 条,共 11 条。仅靠 X 帖子分析,无法达到简报要求的“开源与闭源各至少 10 条洞察”,需要与 Reddit 等平台结果结合。
- OpenAI(GPT-6/Sora 系列)、Midjourney、Stable Diffusion、Runway 等其他主要图像/视频生成 AI 厂商,并未包含在此次 X 搜索词中,也没有出现在采集数据里;本次无法确认 X 上对这些厂商的反应。
YouTube
YouTube — 图像与视频生成 AI 最新新闻(闭源/开源)
频道
- OpenAI(官方频道)— 发布 Sora 2、ChatGPT Images 2.5 的官方公告。
- Google / Google DeepMind(官方)— 发布 Gemini“Nano Banana”系列公告。
- Adobe(官方)— 发布 Firefly 多模型部署公告。
- Runway(官方)— 发布 Gen-4.5、MCP 服务器相关公告。
- Lev Selector — 每周汇总 AI 新闻的个人频道(“Exciting AI Updates Weekly”系列)。
- ComfyUI / Stable Diffusion 教程创作者(例如“AI on the Lot”相关频道、ComfyUI 工作流讲解者)— 大量制作 Wan、LTX、Flux、HunyuanVideo 等开源模型的本地运行教程。
- 对比与评测频道(反复使用“Best AI Video Generator”标题的频道群)— 大量横向比较 Sora 2 / Seedance 2.0 / Runway / Kling 的视频。
- 由于页面 HTML 需要 JS 渲染,且搜索结果摘要没有订阅数,频道订阅量未能确认(参见
## Limits)。
视频
闭源
- Introducing Sora 2 — OpenAI 官方 / 2025-09-30 / https://www.youtube.com/watch?v=gzneGhpXwjU — Bill Peebles、Rohan Sahai、Thomas Dimson 登场,发布新一代视频生成模型 Sora 2 和 Sora 应用;其特点是更符合物理规律,并支持同步对白。
- OpenAI Abandons Sora to Refocus on Enterprise Solutions — 解说频道 / 约 2026 年 3 月 / https://www.youtube.com/watch?v=bIL7uU4CYnE — 解说 OpenAI 将于 2026-04-26 停止 Sora 应用,并于 2026-09-24(即调查次日)关闭 API。据报道,每日运营成本约 100 万美元,而生命周期付费收入仅为 210 万美元。
- OpenAI Shuts Down Sora & Kills ChatGPT Integration Plans | What Happened? — 解说频道 / 约 2026 年 3~4 月 / https://www.youtube.com/watch?v=9rhmczPT6Jk — 解说 Sora 关闭背景:据称规模达 10 亿美元的 Disney AI 合作在关闭公告前不久告吹。
- Introducing ChatGPT Images 2.5 — OpenAI 官方 / 约 2026-09-08 / https://www.youtube.com/watch?v=6l7ble9P74o — 发布 GPT Image 2.5(ChatGPT Images 2.5)。生成速度较此前提升 50%,并新增可将手绘草图直接转化为图像的“Sketch”功能。
- Sketch with ChatGPT Images 2.5 — OpenAI 官方 / 2026 年 9 月 / https://www.youtube.com/watch?v=imPtIEAEHSU — 演示在 ChatGPT 中输入“@Sketch”直接绘制草图并将其 AI 化为图像。
- The New Gemini Image Generator is Insane (Nano Banana 2) — 评测频道 / 2026-02-27 / https://www.youtube.com/watch?v=nikIxHM_AQY — 评测 Google 将 Gemini 应用的默认图像生成模型更新为“Nano Banana 2”。
- Midjourney Update | March 2026: V8 Alpha, BIG Changes Coming, New Edit Model + More — Midjourney 解说频道 / 约 2026 年 3 月 / https://www.youtube.com/watch?v=TZ1zWvbXFug — V8 Alpha 发布视频,是此后 V8.1(2026-04-14)→V8.2(画质和个性化增强,并于 2026-08-27 向所有用户开放编辑模型)更新链条的起点。
- Kling 3.0: the biggest advancement in AI video generation? — 评测频道 / 2026 年上半年 / https://www.youtube.com/watch?v=G1VHCrl4jy4 — 评测快手“Kling 3.0”。视频称其是首个支持原生 4K、60fps 视频生成的模型,并在 Artificial Analysis 视频类别中获得第一。
- Grok Imagine 1.5 Preview - Mind-Blowing AI Video Just Dropped 🔥 | xAI — 评测频道 / 2026-06-03 / https://www.youtube.com/watch?v=grxiFAC-NNI — 评测 xAI 的 Grok Imagine 1.5 预览版。
- Sora 2 vs. Seedance 2.0 vs. Runway: The 2026 AI Video War Explained — 对比频道 / 2026-02-13 / https://www.youtube.com/watch?v=rb0p_mY3tPs — 对比 Sora 2、ByteDance“Seedance 2.0”和 Runway 三方竞争。
- Runway Ships an MCP Server - Generate Video From Inside Claude, ChatGPT, Cursor and Replit — Runway 官方 / 约 2026-05-27 / https://www.youtube.com/shorts/t9Bg_4rOQqM — Runway 发布 MCP 服务器,宣布可从 Claude、ChatGPT、Cursor、Replit 中直接生成视频。
开源
- Now that Wan 2.5 (open source model from Alibaba China) can do AI dialogues, AI Lip Syncing to... — 解说频道 / 2026 年上半年 / https://www.youtube.com/watch?v=kzXNJO6caGw — 介绍 Alibaba 的开源模型 Wan 2.5 已支持生成对白和 AI 口型同步。
- Wan2.6: Multi-shot Storytelling & Cinematic Shot Control — 教程频道 / 2025 年末~2026 年初 / https://www.youtube.com/watch?v=VHJ925WoWgw — 讲解 Wan 2.6 的“多镜头叙事”功能:一次提示词可生成最长 15 秒、包含多个镜头的电影感视频。
- Black Forest Labs: FLUX 2 – The King of AI Image Generation — 评测频道 / 2026-06-04 / https://www.youtube.com/watch?v=WZfKzzX65-o — 评测 Black Forest Labs 的 FLUX.2。
- FLUX.2 Just Beat Every AI Image Model — Black Forest Labs' Most Powerful Release Yet — 评测频道 / 2025-11-27 / https://www.youtube.com/watch?v=VMBSUBKON_U — 主张 FLUX.2 在质量、可控性和一致性上超过既有图像生成模型。
- Qwen Image-2512 First Test – The BEST Open Source Image Model! — 评测频道 / 2026 年 / https://www.youtube.com/watch?v=SBaK616nP6Q — 评测 Alibaba Qwen-Image-2.1 系列最新版:整合文本渲染、图像编辑和透明图生成,生成模块为 7B 参数。
- HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model? — 对比频道 / 2026 年 / https://www.youtube.com/watch?v=4GNT4-QYekg — 在本地运行条件下比较 Tencent HunyuanVideo 1.5(8.3B 参数,可在消费级 GPU 上运行)和 Alibaba Wan 2.7。
- LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — 教程频道 / 2026 年 / https://www.youtube.com/watch?v=ytxbq9ZSgxo — 讲解如何在低显存电脑上运行 Lightricks 的 LTX-2;该模型于 2026 年 1 月完全开源,3 月又推出了 LTX-2.3 桌面视频编辑器。
- Best Open-Source AI Video in 2026: WAN 2.2 vs LTX 2.3 — 对比频道 / 2026 年 / https://www.youtube.com/watch?v=ZZ5VH-rqHXQ — 对比开源视频生成两大阵营 Wan 2.2 与 LTX 2.3。
- Inpaint Canvas for ComfyUI: Krita-Style Layers, Colour Match & Retouch in One Node — ComfyUI 解说频道 / 2026 年 9 月上旬(两周前发布) / https://www.youtube.com/watch?v=Lz7AT8SByx8 — 介绍 2026 年 9 月 5 日公开的开源 ComfyUI 自定义节点“Inpaint Canvas”。其提供图层、选区、SAM 辅助选择和 PSD 导出,将 ComfyUI 变成更完整的绘画工具。
信号
- 闭源最大新闻是 Sora 2 的终止:Sora 2 在 2025 年 9 月末高调发布,却仅半年后停止应用服务(2026-04-26),API 也计划在调查日 2026-09-23 的次日、2026-09-24 关闭。多部 YouTube 解说视频提到,其每日运营成本约 100 万美元,累计付费收入仅为 210 万美元。规模据称达 10 亿美元的 Disney 合作也在 Sora 停止公告前夕破裂。
- 图像生成方面,Google、OpenAI、Midjourney 持续快速更新:Nano Banana 2(Gemini,2026-02)、GPT Image 2.5/ChatGPT Images 2.5(2026-09-08,新增草图功能)、Midjourney V8→V8.1→V8.2(2026-03~08,向所有用户开放编辑模型)显示,闭源阵营仍每隔数月推出新模型。
- 视频生成“群雄混战”的对比内容已成为常态:大量视频和 Shorts 横向比较 Sora 2 / Seedance 2.0 / Runway Gen-4.5 / Kling 3.0 / Grok Imagine,说明观众关注点不再是忠于某个工具,而是辨别“现在哪个最强”。
- 开源主战场是 Alibaba(Wan)、Tencent(HunyuanVideo)、Black Forest Labs(FLUX)、Lightricks(LTX):这些模型都在 Hugging Face/GitHub 上发布,围绕 ComfyUI 或本地 GPU 运行的教程大量涌现。Wan 从对白生成、口型同步到多镜头拍摄(2.5→2.6),功能扩展尤其迅速。
- ComfyUI 生态已确立为生成 AI 的“接线面板”:仅 2026 年 9 月就接连出现 Core Sparse Attention Node、Comfy Compiler、Inpaint Canvas、MiniMax H3 RefMods、Krea2T Enhancer 等新节点,作为将开源模型落地到实际生产的中间层,存在感不断增强。
- Adobe Firefly 正成为闭源与开源两边的聚合枢纽:除自家模型外,它还在同一工作区整合 Runway Gen-4.5、Google Nano Banana Pro、OpenAI 图像生成、Black Forest Labs FLUX.2 [pro] 等 30 多个外部模型。企业侧也正从选择单一工具,转向按需组合使用。
- 夸张标题的评测和对比视频占比很高:如“BEST AI Image Generator in 2026 (Don't Choose Wrong!)”这类标题泛滥,模型选择本身已被内容化,有时甚至超过了技术信息本身。
限制
- YouTube 搜索结果页和视频页均需要 JavaScript 渲染,WebFetch 无法获取实际播放量、频道订阅数和发布日期 HTML。因此本报告只依据 WebSearch 摘要中取得的日期与概要,不记载准确播放量。
- 部分视频(Wan 2.6、HunyuanVideo 对比等)搜索结果中仅能确定为“2026 年”,无法确认具体月份,因此无法严格验证其是否符合“60 天内”标准。报告优先选取近期性较明确的内容,如 Sora API 关闭报道、ChatGPT Images 2.5、Inpaint Canvas 等。
- 没有找到专门报道 Sora API 于 2026-09-24 关闭的 YouTube 官方快讯视频,仅确认到解说频道的后续视频。
- 本次搜索查询中日语 YouTube 频道和视频未能排到前列,信息主要来自英语圈。
Bluesky
Bluesky — 图像与视频生成 AI 最新动态
账号
- @stabilityai.bsky.social — Stability AI 官方。不过 2025 年下半年主要发布 Stable Audio(音频生成)和企业合作,几乎没有图像模型信息,点赞数也基本为 0。
- @midjourneyofficial.bsky.social — Midjourney 官方。2025 年 8 月宣布进驻 Bluesky,但最近一次帖子停留在 2025 年 10 月 8 日,没有新消息。
- @promptheroofficial.bsky.social — PromptHero(提示词分享服务)官方,主要发布 Sora 2 等闭源模型的支持情况。
- @ethanhe.bsky.social — xAI Grok Imagine 团队工程师(曾任职 NVIDIA/Meta)。是少数直接发布 Grok Imagine 功能更新和招聘信息的内部人士账号。
- @chorizemabang.bsky.social — 使用 Grok Imagine 生成视频的日语用户,可见从真实使用者角度提出的不满和故障报告。
- @metalmickey.bsky.social(澤村徹) — 居住在东京的艺术家,结合 Seedance 2.5、GPT-6、Suno V6 创作 MV 和展览作品,提供了实际制作成本的直接记录。
- @you32081.bsky.social — 使用 Qwen-Image、Z-Image-Turbo 等开源模型大量创作 R-18 插画的创作者。
- @lijack1001.bsky.social — 大量发布 Nano Banana Pro/Seedance/Sora 2/Veo 3/Wan/GPT-5 Image 等克隆网站(联盟推广)的 SEO 垃圾账号。不是新闻来源,但能反映哪些模型名被当作“能赚钱的关键词”。
- @runwayml.bsky.social / @blackforestlabs.bsky.social / @comfy-ui.bsky.social — Runway、Black Forest Labs、ComfyUI 的官方账号虽存在,但几乎没有帖子,或最近只有 2024 年的一条,基本处于休眠状态。
帖子
- PromptHero:“Sora 2 is now available on Prompthero: No watermarks, Available in Europe, Combine it with other models” — 2025-10-13,0 个赞/0 次转发。帖子
闭源。显示第三方提示词服务正在以“无水印、欧洲可用、可与其他模型组合”的方式转售 Sora 2。 - xAI・Ethan He:“Excited to share our most advanced image generation model at xAI! Grok Imagine Quality mode — enhanced details, stronger text rendering...” — 2026-04-05,0 个赞/0 次转发。帖子
闭源。xAI 官方工程师宣布 Grok Imagine 新增 Quality mode,强化细节与文字渲染。 - xAI・Ethan He:视频训练师招聘公告“familiarity with AI video generation tools (Grok Imagine, Runway, Kling, Sora, Veo, or similar)” — 2026-03-29。帖子
闭源。表明 xAI 正在人力上投资于视频生成模型训练数据制作,并直接列举 Runway/Kling/Sora/Veo 作为对比对象。 - @chorizemabang:“Grok Imagine 真的完全没法生成了,不过一天慢慢做一件作品也别有情趣。” — 2026-06-05,13 个赞/1 次转发。帖子
闭源。用户视角的 Grok Imagine 生成故障报告。 - @chorizemabang:“Grok Imagine 已经不行了,所以作为歉意发些过去的作品……” — 2026-05-31,11 个赞/1 次转发。帖子
闭源。与上一条一起佐证 Grok Imagine 在 5~6 月存在稳定性问题。 - @metalmickey:“road movie rain version. Stitched Seedance2.5's 30-second clips. Fees are devastating.” — 2026-08-27。帖子
闭源。使用 ByteDance 系 Seedance 2.5 进行实际制作(约 5 分钟 AI 公路电影),同时表达对高额费用的不满。 - @metalmickey:“Attempted creating music video entirely AI-delegated without writing a single prompt line. GPT-6 Astra enables voice-directed workflow.” — 2026-09-07。帖子
闭源。以 GPT-6 Astra 仅通过语音指令制作 MV 的新工作流实例。 - Stability AI:“We're launching our Stability AI Image Services on Amazon Bedrock, bringing professional-grade image editing capabilities...” — 2025-09-18,0 个赞/0 次转发。帖子
偏闭源 API。将图像编辑(局部重绘/风格迁移)作为服务部署在 AWS Bedrock 上。 - Midjourney 官方:“#Midjourney is now on BlueSky! Who are the best creators to follow here?” — 2025-08-15,41 个赞/4 次转发。帖子
Midjourney 本身是闭源,但这条帖子之后几乎停止了 Bluesky 更新,可作为“进入但未扎根”的案例记录。 - @you32081:使用 Qwen-Image / Z-Image-Turbo 的 R-18 AI 插画帖子 — 2026-08-01,6 个赞/0 次转发。帖子
开源。显示中国开放权重模型 Qwen-Image 与 Z-Image-Turbo 已在同人、R18 圈子中作为真实制作工具扎根。
信号
- Bluesky 上不存在强势的“图像与视频生成 AI 新闻”专业枢纽。 Midjourney、Stability AI、Runway、Black Forest Labs、ComfyUI 的官方账号近期几乎没有内容,互动也仅为 0 到个位数,实际上处于休眠状态(最近更新多停留于 2025 年 9~11 月)。这里不是像 X/Reddit 那样具有新闻即时性的讨论场。
- 闭源相关话题只能通过模型公司的“内部人士”个人账号出现。 唯一持续输出的是 xAI Grok Imagine 工程师 Ethan He(@ethanhe.bsky.social),其在 2026 年 3~4 月发布了 Quality mode、视频训练师招聘等偏实务的信息。
- Grok Imagine 在 2026 年 5~6 月似乎出现不稳定。 日语用户 @chorizemabang 多次称“无法生成”“已经不行了”(2026-05-31、2026-06-05);而 xAI 在此前 4 月才宣布功能加强,可能是快速扩张后运营能力未能跟上。
- 作为实际制作记录,ByteDance 的 Seedance 2.5 最突出。 东京艺术家 @metalmickey 在 2026 年 8 月用 Seedance 2.5 片段制作约五分钟 AI 公路电影,并反复抱怨成本高昂,反映了闭源/付费 API 的现实问题。
- 开源模型(Flux、Wan、Qwen-Image、Z-Image-Turbo、HunyuanImage、ComfyUI)更多只是作为个人 R-18/同人 AI 艺术帖中的零散标签出现,而不是新闻内容。 Bluesky 上没有发现类似 r/StableDiffusion 的专业新闻发布者。
- 以模型名进行联盟推广/SEO 垃圾信息的情况很多。 像 @lijack1001 这样无差别投放“Nano Banana Pro”“Seedance 2.0”“Sora 2”“Veo 3”“Wan 2.2”“GPT-5 Image”等克隆站链接的账号不止一个。它们可作为名称搜索需求的侧面证据,但对新闻没有价值。
- Nano Banana Pro(Google 系图像生成)在 R-18/AI 艺术圈被频繁提到。 它常在标签和个人简介层面出现,与 Ideogram 4、Krea 2 并列为“当前正在使用的商业工具”。
限制
- Bluesky 官方全文搜索 API(
app.bsky.feed.searchPosts)对本次尝试的所有查询(Stable Diffusion、Midjourney、Flux、test等)都持续返回 HTTP 403,一次也未成功。app.bsky.actor.getProfile、app.bsky.actor.searchActors、app.bsky.feed.getAuthorFeed可正常工作,因此只能通过搜索账号→读取账号帖子列表的间接方式调查。 bsky.app网页版是客户端渲染 SPA,抓取时只返回空页面,必须直接调用公开 JSON API。- 因无法全文搜索,可能遗漏了未被发现账号发布的相关内容,尤其无法判断是否存在专门发布开源模型新闻的账号,还是只是受搜索限制未能找到。
- 虽调查了 Stability AI、Midjourney、Runway、Black Forest Labs、ComfyUI 官方账号,但它们均没有近期图像/视频生成模型新闻。这反映的是 Bluesky 这个平台的特点,不代表其他平台上没有相关讨论。
Lemmy
Lemmy — 图像与视频生成 AI 新闻(开源/闭源)
Lemmy 是一个规模较小的去中心化论坛。AI 图像生成讨论主要集中在 !«メールアドレス»
及其周边社区,以及镜像 Reddit r/ArtificialInteligence 的
!«メールアドレス»(通过 Bot 自动转载账号)。调查使用 lemmy.world 搜索 API(/api/v3/search)和网页搜索,横向检索“image generation”“video
generation”“Stable Diffusion”“Flux”“Qwen Image”“Sora”“Midjourney”“Nano
Banana”“Grok Imagine”“ComfyUI”等关键词。
社区
!«メールアドレス»— 5,713 名订阅者。主要发布开放权重图像/视频生成模型与 ComfyUI 相关技术内容。!«メールアドレス»— 2,361 名订阅者。以生成图像作品分享为主(新闻性较弱)。!«メールアドレス»— 每日大量发布经 civitai 的动漫风格生成图片(不是新闻,而是作品帖子)。!«メールアドレス»(Free Open-Source AI) — 4.84K 名订阅者(其中本地 1.81K)。面向开源 AI 总体,但专注图像/视频生成的帖子较少。!«メールアドレス»— 自动镜像 r/ArtificialInteligence 的社区。需注意,这不是 Lemmy 原生讨论,而是 Reddit 转贴。!stable_diffusion_abstraction(50 人)/!stable_diffusion_furry(52 人)/!stable_diffusion_mycology(97 人) — 小众作品分享社区,订阅者规模很小。
帖子
偏开源
-
Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency
!«メールアドレス»、2026-09-22、score 9
https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight
Alibaba Qwen 团队发布的 70 亿参数开放权重图像生成/编辑模型。支持 RGBA 透明输出(适用于 Logo 和抠图素材)、2048×2048 原生分辨率、最多 10 张参考图输入,并已原生集成到 ComfyUI。 -
Qwen-Image-2.1: Compact, efficient, and unified image creation
!«メールアドレス»、2026-09-20、score 1
https://qwen.ai/blog?id=qwen-image-2.1
Qwen 官方博客发布公告,是上方 ComfyUI 文章的一手来源。 -
supElement/ComfyUI_MinimaxH3_AutoContext: A long video generation solution that breaks through the memory barrier
!«メールアドレス»、2026-09-16、score 1
https://github.com/supElement/ComfyUI_MinimaxH3_AutoContext
面向 MiniMax H3 的 ComfyUI 扩展。它自动将视频切分为片段,并用 Latent 锚定连接片段,以绕开长视频生成时的 VRAM 限制。Apache-2.0、31 个星标、153 次提交。 -
Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
!«メールアドレス»、2026-09-16、score 3
https://github.com/Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder
同样面向 MiniMax H3 的 ComfyUI 提示词构建工具,说明本地视频生成工作流周边生态正在积极更新。 -
Boogu-Image-0.1 — Efficient Image Generation Foundation Model
!«メールアドレス»、2026-06-17、score 5
https://boogu.org/
发布一款强调轻量与高效率的新开源图像生成基础模型。 -
AI video generation is becoming less about the model and more about the workflow
!«メールアドレス»(Reddit 转贴)、2026-09-19、score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wkl4db/
帖子主张,开放权重模型+ComfyUI 式工作流的构建,比模型本身更能决定视频生成质量。
偏闭源
-
OpenAI is shutting down Sora's API next week while a Chinese competitor raised $3B
!«メールアドレス»(Reddit 转贴)、2026-09-20、score 1
https://www.reddit.com/r/ArtificialInteligence/comments/1wluu0n/
讨论 OpenAI 计划于 9/24 停止 Sora 2 API(应用已于 4 月停止)以及中国竞争对手快手(Kling)融资 30 亿美元的对比。主旨是“高调的消费者产品失败了,低调的企业应用才赚钱”。 -
Midjourney pivots from AI image generation to body scanning medical spa(背景文章,6 月的大转向但影响仍在持续)
!«メールアドレス»、2026-06-18、score 58
https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-to-medical-devices/
报道称 Midjourney 从 AI 图像生成大幅转向超声 CT 扫描仪等医疗设备业务。相关的“Midjourney Medical”“Midjourney Ultrasonic CT Scanner”帖子也出现在!«メールアドレス»(均为 2026-06-18)。 -
Midjourney wants Hollywood studios to reveal the details of their AI usage
!«メールアドレス»、2026-07-05、score 73
https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-ai-usage/
后续报道:即便转向医疗领域后,Midjourney 仍因图像/视频生成 AI 的版权与使用情况问题和好莱坞对立。 -
Google lanciert KI-Bildgenerierung Nano Banana 2 Lite
!«メールアドレス»、2026-07-02、score 0
https://www.itmagazine.ch/artikel/87529/
瑞士科技新闻称 Google 发布 Gemini 系图像生成模型“Nano Banana 2 Lite”。!«メールアドレス»也有指向同模型一手来源(deepmind.google)的帖子(2026-06-30)。 -
Seedream 5.0 Pro is here: an honest comparison and technical breakdown
!«メールアドレス»(Reddit 转贴)、2026-07-10、score 1
https://www.reddit.com/gallery/1usc03q
对 ByteDance 系闭源模型“Seedream 5.0 Pro”的评测和技术对比帖子。 -
Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images
!«メールアドレス»(Reddit 转贴)、2026-08-07、score 1
https://fortune.com/2026/08/07/
报道称 Google 在 Earth AI 功能上线后不久,因用户生成不当图像而将其撤回,是闭源厂商护栏问题的一个例子。 -
Elon Musk maakt complete AI-film met zijn versie van The Odyssey
!«メールアドレス»、2026-07-22、score 1
https://lemy.nl/post/4342454
荷兰语文章称,Elon Musk 正使用 Grok(xAI)视频生成功能,制作自己版本的《奥德赛》电影。这是一个营销色彩较强的闭源阵营话题。 -
Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?
!«メールアドレス»(Reddit 转贴)、2026-09-14、score 1
https://www.reddit.com/gallery/1wfyqdy
使用包括 GPT 系图像模型在内的四个 AI,为同一页漫画着色进行比较;帖子认为 GPT 系表现更好。
信号
- Lemmy 上关于图像/视频生成 AI 的“活跃讨论”几乎仅限于
!«メールアドレス»的 ComfyUI 周边工具帖子,以及!ai_reddit的 Reddit 镜像。Lemmy 原生新闻很少。 - 开源侧的帖子更常讨论“ComfyUI 工作流/扩展节点”而非“单一模型”。例如最近一周连续出现两项 MiniMax H3 扩展,显示视频生成的实务工具层很活跃。
- 闭源侧则以“撤退与战略转向”新闻为主(Sora API 关闭、Midjourney 转向医疗设备、Google 迅速撤回 Earth AI)。相较高调发布,收支失败和战略修正更受讨论。
- 诸如
!«メールアドレス»的作品分享社区虽帖子多,但只是 civitai 图像陈列,没有新闻性。
限制
- Lemmy 的规模远小于 Reddit/X,即使
!«メールアドレス»也只有 5,713 名订阅者。其原生新闻量不足以达到简报要求的“分析约 20 个帖子”(符合工作手册预期的“5~12 条”规模)。 !ai_reddit并不是 Lemmy 原生讨论,而是 Reddit 帖子的自动转载(评论数几乎为 0),因此实际上无法观察 Lemmy 社区自身的反应。- Lemmy 官方 API 的
/api/v3/community端点在多数情况下需要指定community_id,部分社区(aiwars、imageai单独搜索等)直接查询会返回 400/404,只能用网页搜索结果补充。 - 对视频生成模型的专门搜索(单独搜索“Wan”“HunyuanVideo”“Kling”)噪声较多,因为它们会与常见词或缩写冲突;没有发现明确可视为 Lemmy 原生的相关帖子。
Pinterest — 图像与视频生成 AI 新闻
视觉主题
- “AI NEWS”YouTuber 缩略图格式:留着胡须、表情震惊或兴奋的创作者,站在 OpenAI、Google、Microsoft、Meta、Notion 霓虹圆角方形 Logo 网格前——这是样本中反复出现最多的一种图钉风格。[1, 8, 30]
- AI 视频生成工具的 SaaS 首屏图:深海军蓝/紫色 UI 模拟图,带发光的“文本提示 → 生成”输入框;或手持场记板的可爱白色卡通机器人吉祥物,搭配功能图标行(Text to Video / AI Editing / Auto Soundtrack / Captions)。[6, 11, 16]
- “最佳工具”对比图和排名清单:带霓虹边框的决策矩阵及“My Top Picks”卡片,按价格层级和使用场景衡量 ChatGPT Plus、Midjourney、Gemini、Ideogram、Kling、Runway、Luma、Pika。[10, 20]
- 深度伪造/错误信息警示图像:红色“FAKE”橡皮章、放大镜下的“?”、半人半线框的眼睛变形、“97% likely AI generated”语音检测徽章,以及画面内烧录“AI GENERATED NEWS CLIP”字幕的虚构主播。[4, 27, 38, 49]
- 换脸和身份融合应用广告:两张脸融入三角网格的“Professional Face Swap”,以及母亲+父亲→预测孩子的三联图“AI Baby in Seconds”。[43, 44]
- 作为风格演示/互动诱饵的 AI 奇幻图像:穿救生衣、站在冲浪板上的超写实水獭,老渔夫肖像,以及城堡、北极熊、武士情侣、蛋糕组成的奇幻图像拼贴,展示的是生成质量而非新闻。[13, 34, 45]
- 通俗解释信息图:面向普通读者的“AI 如何生成视频”八步骤示意图(提示词 → 语言理解 → 潜空间 → 帧扩散 → 一致性检查 → 输出),而非面向开发者。[12]
- 新闻编辑室颠覆和虚拟人经济图像:AI 渲染主播占满墙面屏幕的控制室拼贴、一个写实面孔背后的风格化网红虚拟人网格,以及“Human Journalism vs Machine-Generated Media”的分岔道路图。[38, 40, 23]
值得注意的图钉
- #1 — “AI News: Anthropic Leak Shows Us The Future of AI...”:典型的震惊创作者缩略图,带 OpenAI/Google/Microsoft/ChatGPT Logo;它奠定了其他多数“AI NEWS”图钉模仿的视觉模板。
- #3 — “Google announces ultra-high quality video...”:一个 3×5 网格,将同一源视频转换为“木块/折纸/乐高/花朵”等风格,这是具体的 Lumiere 式视频风格重绘演示,而不只是标题卡。
- #10 — “AI Image Video: Best Quality vs Best Free”:完整决策矩阵(10 个付费工具 vs 10 个免费工具 vs 使用场景),是本组内容中“我究竟该用哪个 AI 工具”焦虑最清晰的单一产物。
- #12 — “AI & Machine Learning: How AI Generates Video Infographic”:来自 LivePhysics.com、面向初学者的八步扩散/帧预测流程说明图,可作为“向朋友解释”的参考图钉。
- #27 — “AI is getting scary good”:将 AI 视频生成器、AI 语音检测器(“97% likely AI generated”)和 AI 伦理合并为一张信息图,是深度伪造焦虑最集中的体现。
- #38 — “AI News Anchors & Creator-Led Coverage Take Over U.S. Media”:新闻编辑室拼贴图,展示 AI 渲染主播占据整面监控墙,直接将 AI 主播取代传统广播人才的现象视觉化。
- #40 — 荷兰语“Het perfecte avatar-tijdperk”(完美虚拟人时代):一个写实面孔置于风格化 AI 虚拟人网格前,反映 AI 网红趋势已作为欧洲 Pinterest 搜索结果的一部分出现,且具有多语种传播。
- #43 — Akool“Professional Face Swap”(西班牙语广告):两位女性的脸通过人脸网格叠加而融合,是直接在 Pinterest 上营销的商业换脸产品,而不只是讨论话题。
- #44 — “AI Baby in Seconds”:母亲/预测孩子/父亲三联图;这是独立形成集群、而非偶然个案的快速增长子类别(AI 宝宝生成器)。
- #49 — “You Are Not Prepared for This Terrifying New Wave of AI-Generated Videos”:一名 AI 生成的虚假新闻主播,画面中直接标有“AI GENERATED NEWS CLIP”,是本组中最直白的警示型图钉。
信号
- 工具决策疲劳是最主要的消费者视角。 大量图钉是对比图、免费 vs 付费矩阵和“我的推荐”卡片,而非某项发布的新闻。Pinterest 用户寻找的更像是购买/采用指南,而非公告。[10, 20, 29]
- 深度伪造/错误信息焦虑已成为独立视觉类别,不是附属话题:FAKE 印章、语音检测徽章和“AI generated”披露标签出现频率几乎与工具推广内容相当。[4, 27, 38, 41, 49]
- AI 新闻主播趋势有明显视觉热度:多个独立图钉(控制室拼贴、Channel1 品牌主播内容、“AI generated news clip”标签)都将 AI 主播视为正在发生、被讨论的现象,而非假设。[38, 49, 50]
- 缺失:开源几乎不可见。 在样本中,唯一明确的本地/开源工具是 AMD 品牌“Amuse 3.0”[34];没有 Stable Diffusion、ComfyUI 或本地模型 UI 截图。与之相比,闭源相关内容非常强势,反复出现 ChatGPT、Gemini、Midjourney、Kling、Runway、Luma 的 Logo 和 UI 模拟图。
- 缺失:最新命名闭源模型的直接产品截图。 样本中没有 Sora 2、Nano Banana 或原生 Veo 3 UI 截图;大多数“闭源”图钉都是创作者或联盟推广缩略图,在谈新闻而不是展示产品界面。
- 警示标记:图钉 #47 标题为“Elon Musk's New AI Already Being Used to Generate...”,但实际图像是 Donald Trump 和一名女性在驾驶舱内竖起大拇指,背景是燃烧中的世贸中心。标题完全没有描述图像。这是一个具体例子:逼真的 AI 合成灾难/政治图像以标题不匹配的点击诱导形式流传,也提醒我们这个数据集中的图钉标题不能被信任为图像内容描述。
限制
- 本次采集没有定义类别(仅对“Image and Video Generation AI News”进行一次未过滤搜索),因此 50 个图钉混杂了创作者缩略图、产品广告、库存图和新闻风格图像,而非预先按主题分类。
- 收集的 50 张图像中,只打开并目视检查了 26 张,覆盖了样本中具有代表性的多种标题/主题;上述结论基于这个样本,而非全部 50 张。
- 多个标题与图像不匹配(最明显的是 #47,见 Signals),意味着任何仅根据标题表建立的主题都不可靠;本报告基于图像实际呈现的内容。
- 收集数据中没有 Pinterest 图钉的转存/点赞数,因此“哪些内容在流行”的判断来自视觉风格在样本中的重复频率,而不是量化热度。
- Pinterest 本身偏向二次创作内容(缩略图、博客页眉、广告素材),而不是一手产品公告。要确认具体产品/版本主张(如 Veo 或 Kling 的准确发布细节),仍需依赖本次调查中覆盖的其他一手平台。
建议行动
- 将 OSS 本地视频技术栈(Wan、HunyuanVideo、FLUX.2、ComfyUI + MiniMax H3)作为在闭源工具涨价、停止产品时的实际替代方案持续跟踪。
- 针对 Reddit 和 Pinterest 上正在形成的 AI 内容披露情绪,尽早准备内容来源/标注沟通方案。
- 关注 Sora 2 API 于 2026-09-24 关闭后用户将迁移至何处(Kling、Seedance、Runway 很可能受益)。
- 将 X 上 Opus 5.5 / Grok 4.7 的一键生成演示热潮视为短暂的发布窗口炒作,而非对 OSS 心智份额的持久威胁。
- 监控 DeepSeek 的算力扩展压力,把它视为开放权重采用速度超过运营方自有基础设施时会发生什么的早期信号。
- 面对 YouTube 和 Pinterest 上可见的“我该用哪个工具”比较疲劳,应以对比型内容而不是单产品新闻满足需求。
收集图像


















































数据质量备注
只有 YouTube 和 Pinterest 大致达到简报约 20 项的目标;Reddit 仅得到 12 个帖子(大多是无关的普通子版块),X 的 40 条帖子中超过一半是无关趋势词噪声,Bluesky 的全文搜索 API 始终返回 403,覆盖范围只能依赖已知账号;Lemmy 的平台规模本来就太小(主要社区约 5,713 名订阅者,且半数帖子是 Reddit 镜像),无法达到 20 条原生帖子。



