图像与视频生成 AI 新闻 — 2026-09-07
闭源阵营中,Sora2 的 API 终止(2026/9/24)与 GPT-6 Astra 向通用智能体演进,标志着主角更替;开源阵营则以 ComfyUI/MiniMax-H3/Qwen-Image-Edit 生态持续扩张,即使消费级 GPU 也已达到实用水平。
图像与视频生成 AI 最新新闻 — 2026年9月7日
这周真的太疯狂了🔥🔥 闭源这边,OpenAI 的「GPT-6 Astra」不再只是图像、视频生成工具,而是作为「能驾驭各种工具的智能体」迅速获得高度评价;反过来,曾经的王者「Sora 2」却意外踏上服务终止之路(Web/App 已于 2026/4/26 停止,API 也计划于本月 2026/9/24 完全终止)😱 与此同时,开源阵营虽低调却异常火热,围绕 ComfyUI 的「MiniMax-H3」「Qwen-Image-Edit」生态几乎每天都在长出新组件,如今已进入即便使用面向消费者的 GPU(AMD 也可以)也能认真做视频生成的时代🛠️✨ 另外,各平台共同显现出一种氛围:一旦被发现是 AI 生成内容,就很容易遭到批评。要求进行真实性标注、反 AI 的声音占据点赞榜前列,这点实在令人意外。
跨平台观察 🌐
- GPT-6 Astra 被当作“操控 AI”而非“生成 AI”来评价:无论是 X(@Yokohara_h、2,156 个赞、https://x.com/Yokohara_h/status/2096622171011666003),还是 YouTube(まさおAI じっくり解説ch、https://www.youtube.com/watch?v=_pAAaBv_G7A),都在热议它如何通过 ComputerUse 操作 Blender 等其他应用,自动化 3DCG 制作流程。两个平台的论调完全一致,确实很热🔥
- Sora 2 的终局开端:YouTube(https://www.youtube.com/watch?v=DSfAZdE5rWA)解读了 API 将于 2026/9/24 终止(也就是三周后!)的消息;Bluesky(https://bsky.app/profile/coah80.com/post/3muulvyomz72c)上也出现了“SORA 2 WAS GENUINELY SO BAD”的严厉批评。几乎找不到替它辩护的声音了😢
- ComfyUI/MiniMax-H3 生态成为开源主战场:Lemmy 的 !«メールアドレス»(https://lemmy.dbzer0.com/post/75036488 等)每天会发布 3~9 个新节点和 LoRA;Reddit(VPIPE 在 Apple Silicon M5 Pro 上以 1024px、8 步约 45 秒运行,https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/)和 Bluesky(“local software like ComfyUI 的功能更多”https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t)也印证了相同趋势。
- “AI 生成=挨批”的氛围成为最大互动来源:Reddit r/antiai 的伪造延时绘画举报帖(6,792 分、994 条评论,https://www.reddit.com/r/antiai/comments/1w81kdd/),以及 Bluesky 点赞最高的两篇帖子(批评生成式 AI,121 和 100 个赞,https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b)都显示,比起工具介绍,“这是不是很糟?”式的批评帖更容易爆火。
各平台情况 📱
Reddit:r/StableDiffusion 的本地生成基准测试帖,以及 r/freetoolsAI 中的免费工具清单(Deepany、Aifun、Perchance 等),提供了很强的开源实用信息;另一方面,r/aiwars 则在批评闭源商用 AI 图像(用于食品广告)的质量(177 条评论,https://www.reddit.com/r/aiwars/comments/1w69cdj/)。由于只用了一个搜索词,最终只收集到 12 个帖子,未达到 20 个的目标。
X:共收集 40 条帖子,但真正相关的只有 4 条😅(其余都是足球、政治以及克罗地亚趋势噪声)。不过这 4 条全都高度赞扬 GPT-6 Astra,而且完全没有提及开源,是彻底的闭源主场。
YouTube:信息最丰富的平台。闭源方面有 Sora2 终止、GPT-6 Astra、Midjourney V7 更新(支持日语语音输入,https://www.youtube.com/watch?v=wFHlG7wcRUQ)、Google Nano Banana 2(https://www.youtube.com/watch?v=nikIxHM_AQY)。开源方面则由 Flux.2(Apache 2.0 的 Dev/Klein,https://www.youtube.com/watch?v=ISRy5Skd04U)和 Qwen-Image-Edit-2511(大量 ComfyUI 教程,https://www.youtube.com/watch?v=ScoIZYsoRwo)领衔,也有在 AMD 消费级 GPU 上运行 Wan2.2 与 Hunyuan1.5 的测试(https://www.youtube.com/watch?v=a_xzC7ckwno)。
Bluesky:呈现使用工具的个人创作者与反 AI 阵营的两极格局。闭源方面,Nano Banana(Gemini 3.1)+Kling 3.0 的组合工作流很受欢迎(https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k),而 xAI 的 Grok Imagine 新模型公告则只有 0 个赞。开源方面,有人积极评价 ComfyUI,也有使用 Stable Diffusion WebUI reForge(AMD ROCm)的人。受 API 限制影响(频繁 403),原定 20 条实际只分析了约 11 条。
Lemmy:开源一侧的热度压倒性领先,仅 !«メールアドレス» 就有 11 条工具帖子(Viggle-Animate、Trellis.2+Pixal3D 的 ComfyUI 原生集成等)。闭源唯一形成规模的话题是「Midjourney 从图像生成业务转向医疗超声扫描业务」的新闻(最高分 73,https://techcrunch.com/2026/07/04/midjourney-wants-hollywood),并被多个实例转载。反而在 Lemmy 上完全找不到 Sora 或 Veo 本身的新闻,这一点也很值得注意。
Pinterest:查看了工作器预先收集的全部 50 个 Pin,几乎被 Veo、Sora、Runway、Kling、Pika、Adobe Firefly 等闭源商用工具的排行榜式信息图占据。开源的提及几乎没有,只有强调可本地运行的「Amuse 3.0」。深度伪造焦虑与检测类内容已形成独立类别,也令人印象深刻。
值得关注 👀
- Sora 2 API 终止(2026/9/24) — 迁移目的地将如何演变。YouTube「AI収益化ラボ」https://www.youtube.com/watch?v=YHPmaUb_X6c
- GPT-6 Astra 的 ComputerUse/3DCG 制作流程自动化 — 它更像是制作中枢而非生成 AI,值得持续观察。X https://x.com/Yokohara_h/status/2096622171011666003
- MiniMax-H3 生态的扩张速度 — Viggle-Animate、H3-World 等新组件每天都在出现。Lemmy https://lemmy.dbzer0.com/post/75036488
- AI 生成内容真实性标注的争议 — 是否会从伪造延时绘画的举报,发展为监管压力。Reddit https://www.reddit.com/r/antiai/comments/1w81kdd/
- Midjourney 的业务转型(图像生成→医疗设备) — 可能预示闭源公司的商业模式变化。Lemmy https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
- Qwen-Image-Edit×ComfyUI 的普及程度 — 其可与闭源编辑工具匹敌的评价将如何扩散。YouTube https://www.youtube.com/watch?v=WOcxMUwKWIk
建议 💡
- 如果工作流依赖 Sora2,应在 API 于 2026/9/24 终止前,立即制定迁往 Kling 3.0 或 Veo 3.1 的计划。
- 应把 GPT-6 Astra 的 ComputerUse 功能当作制作流程自动化工具,而非单一生成 AI 来跟踪评估。
- 若希望降低成本,建议先试用 Qwen-Image-Edit+ComfyUI 的本地编辑,再决定是否订阅闭源服务。
- 为防范伪造延时绘画和 AI 加工引发争议,应提前在组织内部制定公开内容的 AI 使用披露规则。
- Nano Banana(静态图)+Kling 3.0(视频化)的分工式工作流已获多位独立创作者认可,值得尝试。
- 应持续关注 Midjourney 的业务转型,观察其他闭源公司是否也会出现类似多元化。
数据质量 📊
各平台都略未达到 brief.md 的完成标准(每个社交平台约分析 20 条)😅 尤其是 X,收集了 40 条帖子却仅有 4 条相关(搜索词来自克罗地亚地区趋势,充满足球和政治噪声)。Bluesky 也受公开 API 的 403 速率限制影响,尝试的近半搜索词没有结果,实际只有约 11 条。Reddit 因只用了一个搜索词而得到 12 个帖子;Lemmy 则有开源 11 条+闭源 4 条,共 15 条,原因是根本不存在专门的新闻社区。YouTube 按其工作手册标准(5~12 条)收集了 11 个视频并视为完成,但因 JavaScript 渲染限制,未能取得播放量等元数据。Pinterest 虽查看了预收集的全部 50 条,但因为只有单一查询,几乎找不到开源相关 Pin。总体来看,虽然数量未达目标,6 个平台都独立印证了 GPT-6 Astra、Sora2 终止、ComfyUI 生态扩张这些相同方向,因此对于把握大趋势而言,内容仍具相当可信度🙆
平台汇总
Reddit — 图像与视频生成 AI 新闻
分布情况
通过搜索词「Image and Video Generation AI News」收集到 12 个帖子,分布在 11 个子版块。
| 子版块 | 成员数 | 收集帖子数 |
|---|---|---|
| r/antiai | 316,504 | 1 |
| r/generativeAI | 151,065 | 2 |
| r/freetoolsAI | 7,817 | 1 |
| r/StableDiffusion | 1,001,556 | 1 |
| r/teenagers | 3,675,063 | 1 |
| r/aiwars | 166,920 | 1 |
| r/RemoteWorkers | 74,882 | 1 |
| r/aislop | 82,721 | 1 |
| r/TopAITools4U | 2,396 | 1 |
| r/GoogleFlow | 1,750 | 1 |
| r/EyesWideShut | 15,320 | 1 |
从子版块构成来看,专门讨论 AI 生成的社区(r/StableDiffusion、r/generativeAI、r/GoogleFlow、r/TopAITools4U、r/freetoolsAI)与反对或批评 AI 图像的社区(r/antiai、r/aiwars、r/aislop、r/EyesWideShut、r/teenagers)几乎各占一半。r/RemoteWorkers 则是在招聘公告的语境中提及。
人们的声音
-
帖子#1 r/antiai・6,792 分・994 条评论・2026-09-05 — 「Warning: There is a new form of ai generated image」。帖子称,不是扩散模型,而是让 LLM(文中标为 GPT-6)操控鼠标和键盘,就能伪装出连同手绘风延时过程在内的“真实插画”。该帖获得 994 条评论,讨论十分热烈。最高评论(2,483 分,u/Nayutantantan):“Even though i stopped using social media, stopped being an artist online... now the trends of creating fake timelapses are getting common.”——要求“立即强制标注”的声音(u/Soggy_Supermarket100,170 分)也获得强烈支持。
-
帖子#5 r/teenagers・7 分・41 条评论・2026-08-31 — 「To all AI image/video generator users」。其主张是:“AI 只是在执行你的想法,真正绘制的是 AI 自己。”u/LiterallyGarbage_0(5 分)称:“if you want to make art, pick up a pencil and start drawing”。另一方面,u/TheDarkmoore(2 分)辩护称,自己曾在卡牌游戏美术中使用 AI,对不擅长绘画的自己而言这是必要选择,显示同龄人之间也存在分歧。
-
帖子#6 r/aiwars・4 分・177 条评论・2026-09-03 — 「Even a lot of Pros here will admit that current AI models suck at generating appetizing images of food」。177 条评论使讨论尤为突出。u/Your-local-enjoyer(9 分)表示:“拍真实照片能让顾客获得更准确的预期。”作为反驳,u/Bassed_Hummble(5 分)给出了使用本地 Krea 2、40 秒生成的具体提示词,称成功制作出“令人食欲大开的早餐卷饼”,由此也出现了问题在提示词而不在模型的看法。
-
帖子#4 r/StableDiffusion・31 分・10 条评论・2026-09-03 — 「VPIPE: Not Just Video — Local Image Generation Is Fast Too」。在 Apple Silicon(M5 Pro 24GB)上使用 krea/Krea-2-Turbo-M87(16bit)+M87 LoRA,本地生成 1024×1024、8 步图像约需 45 秒/张(8bit 量化实时模式下为 35 秒)的实测数据。u/Glittering-Call8746(1 分)评论称,正考虑 M5 Max 与 M5 Pro 的速度差异,以及和 RTX 5000 系列的比较。
-
帖子#11 r/GoogleFlow・12 分・6 条评论・2026-09-01 — 「AutoFlow just got continuous AI video generation」。面向 Google Flow/Veo 的非官方 Chrome 扩展「AutoFlow」增加了「Continue from Last Frame」功能,可自动将前一段视频的最后一帧用于下一段开头,让长视频更易制作。下一步计划加入将多个片段无缝渲染成单一视频的功能。
-
帖子#10 r/TopAITools4U・1 分・10 条评论・2026-09-01 — 「Tested 4 best AI video generators in 2026 for beginners」。发帖者比较了 Sora 2(电影感强但价格和访问门槛高)、Kling AI(适合真实感 B-roll)、DomoAI(适合动画与风格转换)、Google Veo 3.1(同时生成画面+声音,提供免费额度)。评论中 u/brarkaddy(2 分)还将 Qwen 的免费视频生成列为候选。
-
帖子#3 r/freetoolsAI・38 分・45 条评论・2026-09-04 — 「Free AI Image Generator」。针对宣称免费、无限制、无需注册的 aifreeforever.com,u/Odd-Lingonberry1516(3 分)列出了 Deepany(z-image turbo/illustrious 系)、Aifun(wai illustrious,每天还有 2 次免费视频机会)、Perchance(Stable Diffusion/flux 系)作为替代方案。u/Relevant_Syllabub895(2 分)则表达了对 NSFW 限制的不满。
-
帖子#2 r/generativeAI・43 分・29 条评论・2026-08-31 — 「List of daily AI video generative websites」。u/Jenna_AI(4 分,AI bot)列出 Kling AI 的具体免费额度:“每 24 小时免费 66 个积分,折合 5 秒视频每天约 2~6 条。”u/Julia_Leeds94(2 分)介绍 YalleryLabs:3 美元预算下,5 秒 720p 视频为每条 0.18 美元。
-
帖子#12 r/EyesWideShut・35 分・9 条评论・2026-09-06 — 「AI generated images shouldn't be allowed here」。围绕用 AI 加工库布里克电影截图的帖子,发帖者指责其“传播错误信息”。加工者本人 u/ffcc01(2 分)反驳称,“只是叠加了两张照片,没有改动内容”,社区内对于 AI 加工的容许范围存在冲突。
-
帖子#8 r/RemoteWorkers・130 分・623 条评论・2026-09-04 — 「Get Paid $30/Hour Reviewing AI-Generated Images」。招聘内容为以时薪 30 美元核查 AI 生成说明文字中的事实错误,例如错误识别的物体、颜色和文字。尽管有高达 623 条评论,大部分只是为了索取申请链接而反复发送“images”,几乎没有实质讨论。
-
帖子#9 r/aislop・37 分・4 条评论・2026-09-06 — 「Saw this on a news article, an AI slop image explaining what is AI slop」。新闻文章中一张解释“什么是 AI 垃圾内容”的 AI 生成图片,因为其自指性而成为话题。仅有 4 条评论,没有进一步深入讨论。
信号
- 上升趋势:本地、开源生成的实践报告(帖子#4 的 VPIPE/Krea 2)因附带具体基准数据(秒数、步数、硬件)而受到积极评价。在 r/StableDiffusion,速度与质量的兼顾是主要评价标准。
- 上升趋势:要求为 AI 生成物标注真实性的声音(帖子#1)获得了 994 条评论规模的强烈支持,“伪造延时绘画”成为被明确提出的新风险。
- 被轻视或嘲讽:闭源商用 AI 图像,特别是食品广告用途,在 r/aiwars 中被视为难以辩护的低质量产物(帖子#6);177 条评论的讨论几乎一边倒地偏向批评。
- 意外之处:许多帖子的实际讨论由 AI bot 主导(u/Jenna_AI 同时出现在帖子#2、#7),相比人与人之间的深度交流,“整理免费额度”等实用信息成了主要价值。
- 对立:帖子#12(EyesWideShut)中,“AI 加工=篡改/错误信息”与“只是简单合成、未改变内容”两派针锋相对,说明对 AI 加工的可接受边界并无明确共识。
- 意外之处:帖子#8 有 623 条评论,是本次最高互动量,但绝大部分只是为招聘链接而刷单词,典型说明评论数多不等于讨论深入。
局限
- 只使用了「Image and Video Generation AI News」一个搜索词,没有补充搜索“open source image generation”“closed source video AI”或 Midjourney、Sora、Kling 等具体服务名。因此,数据偏向于能命中通用搜索词的话题。
- 相对于 brief.md 中“每个社交平台分析约 20 个帖子”的完成标准,只收集到 12 个帖子,未达到目标数量。
- 帖子#7、#9 分别只有 1 条和 4 条评论,部分情况只有 bot 回复(u/Jenna_AI),可深入分析的材料较少。
- 收集期仅覆盖 2026-08-31 至 2026-09-06 约一周,无法与此前趋势比较。
- 能按闭源/开源明确分类的帖子有限(偏闭源:#6、#10、#11/偏开源:#3、#4);若要满足最终报告每类 10 条洞察的要求,仍需其他平台数据补足。
X
X — 图像与视频生成 AI 新闻
账号
在收集的 40 条帖子、37 个账号中,真正与主题(图像与视频生成 AI)相关的只有以下 4 个账号。它们均为仅发布 1 条相关帖的个人账号,不是依赖大粉丝基数制造爆款的账号,而是分享实际工具体验的一线使用者。
| 账号 | 名称 | 帖子数 | 点赞 | 属性 |
|---|---|---|---|---|
| @aigeboku | AI様の下僕 | 1 | 1,281 | 尝试使用 GPT-6 Astra ComputerUse 的个人 |
| @MiraMusic_AI | MiraMusic | 1 | 525 | 分享 AI 动画制作的账号 |
| @manaimovie | Mankyu | 1 | 562 | 3D 模型×AI 视频的个人创作者 |
| @Yokohara_h | Hirokazu Yokohara | 1 | 2,156 | 四个账号中反应最高的技术类个人 |
其余 33 个账号(以 @kaihavertz29 的 96,184 个赞为首,包括足球、F1、德国政治、比特币、波斯尼亚相关的个人账号)与主题无关。详情见下方“局限”。
帖子
-
#29 @aigeboku(2026-09-05・1,281 个赞・135 次转发・14 条回复・约 94,000 次浏览)https://x.com/aigeboku/status/2096187322924687799 — 「GPT-6 Astra 如其所说,‘操控其他事物的能力很强’,使用 ComputerUse 后能做的事情确实大幅扩展😎🙌」。该帖将 GPT-6 Astra 评价为可操作其他应用的平台,而不只是图像、视频生成工具。
-
#30 @MiraMusic_AI(2026-09-06・525 个赞・50 次转发・6 条回复・约 26,000 次浏览)https://x.com/MiraMusic_AI/status/2096441679847006358 — 「【AI 动画制作分享①】试着用 GPT-6 Astra 和 blender 造了一座城市!这是 15 分钟做出来的视频,可能不太容易看清……」。展示 GPT-6 Astra 与 Blender 结合制作背景美术的实际案例。
-
#31 @manaimovie(2026-09-05・562 个赞・61 次转发・19 条回复・约 35,000 次浏览)https://x.com/manaimovie/status/2096176821377380677 — 「把用 Tripo 制作的模型交给 Astra 老师,让它动起来后得到的成果。还有不少问题,但比 Fable 或 Sol 时好很多!」。明确与其他相似工具「Fable」「Sol」比较,并认可 Astra 的优势。
-
#32 @Yokohara_h(2026-09-06・2,156 个赞・299 次转发・19 条回复・约 178,000 次浏览,为这四条中反应最高)https://x.com/Yokohara_h/status/2096622171011666003 — 「把图片交给它,它会在 Blender 中自动建模背景街景、自动编辑分解过程。完成度还远远不够,但与过去不同,已经能感受到不再由人手制作 3DCG 的时代开端」。虽承认质量仍在发展中,却肯定了“脱离人手的 3DCG 制作”这一时代转折。
除这 4 条外,收集的 40 条帖子中没有任何一条提及图像或视频生成 AI,无论闭源还是开源。
信号
- 上升趋势:GPT-6 Astra(闭源)因“操作其他工具”的角色而受到关注,包括 ComputerUse 和 Blender 联动。它被描述为自动化整个 3DCG 制作流程的中枢,而非单一图像/视频生成模型(#29、#30、#32)。
- 意外之处:四条帖子都一方面保留地表示“完成度仍粗糙”“还有很多在意之处”,另一方面依然给予正面评价,体现出高度期待与冷静质量判断并存(#31、#32)。
- 被轻视/没有提及:此次收集中,完全没有提到开源图像、视频生成 AI,例如 Stable Diffusion 系、Krea、Kling、Veo 等。X 上的主题相关声音完全偏向闭源的 GPT-6 Astra。
- 作为比较对象被提到的工具:「Fable」「Sol」(#31)。帖文未进一步说明二者详情,需额外调查。
- 与无关趋势(足球最多 96,184 个赞、政治 10,062 个赞等)相比,相关帖的互动规模较小(最多 2,156 个赞),说明该主题当前并未在 X 上形成大规模爆款。
局限
- 搜索词偏离主题:本次搜索词(Arsenal、Kimi、Charles、Chelsea、Harvey、Germany、$SONG、Astra、Bitcoin、Bosnia)直接取自 X Explore 趋势列表。除「Astra」外,其余分别涉及足球、F1、人名/生日话题、德国政治、加密货币、波斯尼亚闲聊,与图像和视频生成 AI 无关。40 条中有 36 条是主题外噪声,真正线索只有通过「Astra」找到的 4 条。
- 未达到完成标准:面对 brief.md “每个社交平台分析约 20 条帖子”的要求,只收集到 4 条主题相关帖。
- Explore 的地域性:在「Where」栏中,「$SONG」和「Bosnia」均明确为“Trending in Croatia”,说明本次 Explore 按克罗地亚/巴尔干地区进行本地化。因此该趋势列表反映的不是全球动向,而是当地趋势。此外,“Posts on X”一列均为空,无法从 X 获得发帖量指标。
- 未找到 X 上的开源动态:本次收集中没有一条开源图像/视频生成 AI 帖子,需要由 Reddit 等其他平台的数据补充。
- 四条主题相关帖全部来自日语圈账号,尚未收集英语圈、中文圈等其他语言社区的反应。
YouTube
YouTube — 图像与视频生成 AI 新闻
频道
| 频道 | 类型 | 内容 |
|---|---|---|
| AI大学【AI&ChatGPT最新情報】 | 日语・讲解类 | 最新 AI 模型讲解视频,包括 GPT-6 Astra |
| まさおAI じっくり解説ch | 日语・讲解类 | AI 模型实测与评测 |
| RKJ VIDEO【イケている動画を作りたいなら】 | 日语・视频生成 AI 专门 | 对比 Sora/Veo/Kling 等视频生成 AI |
| AI収益化ラボ | 日语・变现类 | AI 工具变现与服务终止影响解读 |
| StableDiffusion等 チュートリアル&自作アニメ | 日语・原开源专门 | 原本以 Stable Diffusion 教程为主,现也开始报道 Sora2 终止等闭源新闻 |
| AIたろう | 日语・讲解类 | Midjourney 等图像生成 AI 功能讲解 |
| Teacher's Tech | 英语・讲解类 | Google 工具与 AI 功能评测,中等规模技术频道 |
| OpenArt | 英语・偏官方 | 介绍 Flux.2 等模型所使用的 UI |
| Donato Capitella | 英语・技术者类 | 在本地 GPU(含 AMD)上测试开源图像、视频生成 |
| ErrorFixer | 英语・教程类 | 在 ComfyUI 中运行开源模型的教程 |
| AI Search | 英语・评测类 | 新图像、视频生成 AI 工具的快速评测 |
频道订阅数位于各视频页面的 JavaScript 渲染区域,使用 WebFetch 获取 youtube.com/watch 与 youtube.com/results 时无法取得(详见“局限”)。此处仅记录可由搜索结果摘要及 oEmbed(只返回标题和频道名的轻量 API)确认的内容。
视频
-
「OpenAIの最新AIモデル『GPT-6 Astra』徹底解説!ほぼ全てのベンチマークでClaude Fable 5.1超え、史上最も賢く安全」 — AI大学【AI&ChatGPT最新情報】 — https://www.youtube.com/watch?v=jtavLwXCZeQ — 该视频声称 GPT-6 Astra(2026/9/3 发布)在几乎所有基准中超越 Claude Fable 5.1,是史上最聪明、最安全的模型。重点并非图像、视频生成,而是包括浏览器操作和代码生成在内的通用智能体能力。
-
「【現環境最強】『GPT-6 Astra』を実際に使ってきた結果、最もAGIに近いモデルと感じたので解説」 — まさおAI じっくり解説ch — https://www.youtube.com/watch?v=_pAAaBv_G7A — 基于实际使用体验,将其评为“当前最接近 AGI”的模型。视频高度评价其通过 ComputerUse 操作其他应用的能力,与 X 上观察到的 GPT-6 Astra 评价(参见本报告 X 部分)一致。
-
「VEO 3.1とSORA2どっちがすごい?最新比較!」 — RKJ VIDEO【イケている動画を作りたいなら】 — https://www.youtube.com/watch?v=JuGPYl0V9UA — 对比 Veo 3.1(2025/10/15 发布)与 Sora 2 的功能和画质。发布于 Sora 2 上线后不久(约 2025 年 10 月),早于 60 天窗口,但作为之后 Sora2 终止报道的背景资料而收录。
-
「Sora2完全終了…なぜ突然消えたのか?公式情報で徹底解説」 — StableDiffusion等 チュートリアル&自作アニメ — https://www.youtube.com/watch?v=DSfAZdE5rWA — 根据官方信息解读 Sora 2 的 Web/App 于 2026/4/26 停止、API 也将在 2026/9/24(本报告制作日三周后)终止的经过。视频提及一种观点:原因是为 AGI 开发释放算力资源。
-
「【サービス終了】世界一の動画生成AI『Sora2』が使えなくなったので解説します」 — AI収益化ラボ — https://www.youtube.com/watch?v=YHPmaUb_X6c — 解读 Sora2 终止对依赖其内容进行变现的创作者的影响。提及数据导出(sora.chatgpt.com/sunset)的说明,以及迁往 Kling、Runway 等 API 的必要性。
-
「Midjourney がV7にアップデート!使い方から新機能まで完全解説します!日本語音声入力も可能に。」 — AIたろう — https://www.youtube.com/watch?v=wFHlG7wcRUQ — 解读 Midjourney V7 的新功能,包括视频生成工具、对话模式和日语语音输入,展现这个老牌图像生成服务正将文本转视频功能纳入体系。
-
「The New Gemini Image Generator is Insane (Nano Banana 2)」 — Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — 测试 Google 的 Gemini 图像生成功能「Nano Banana 2」,并评价其相对于上一代有显著提升。这说明闭源图像生成的竞争范围已从 Midjourney/Ideogram 扩大到 Google Gemini。
-
「FLUX.2 Has Landed On OpenArt!」 — OpenArt — https://www.youtube.com/watch?v=ISRy5Skd04U — 介绍 Black Forest Labs 的 Flux.2 系列(Pro/Flex/Dev/Klein,2025/11/25 发布)现可在 OpenArt 上使用。强调 Dev/Klein 系列为 Apache 2.0 开放权重,支持 10 张参考图和 4MP 编辑。
-
「Video and Image Generation on AMD R9700 AI PRO (Qwen Image, Wan 2.2, Hunyuan 1.5)」 — Donato Capitella — https://www.youtube.com/watch?v=a_xzC7ckwno — 测试在面向消费者的 AMD GPU(R9700 AI PRO)上同时运行 Qwen Image、Wan 2.2、Hunyuan 1.5 三个开源模型,表明开源图像和视频生成正逐渐摆脱必须依赖高端 NVIDIA 硬件的前提。
-
「Edit Any Image with Text in ComfyUI — Qwen Image Edit 2511 (Free Local Tutorial 2026)」 — ErrorFixer — https://www.youtube.com/watch?v=ScoIZYsoRwo — 在 ComfyUI 中本地运行阿里巴巴开放权重图像编辑模型 Qwen-Image-Edit-2511(2025/12/26 发布)的教程,演示仅通过文本指令进行图像编辑和多视角生成。
-
「This new AI image editor is a BEAST. Qwen Image Edit tutorial」 — AI Search — https://www.youtube.com/watch?v=WOcxMUwKWIk — 同样测试 Qwen-Image-Edit(200 亿参数、原生支持 ControlNet),并认为其性能足以与闭源编辑工具竞争。
信号
- 闭源最大的热点是 GPT-6 Astra(2026/9/3 发布):它并非作为单一图像或视频生成模型被介绍,而是作为可完成浏览器/应用操作(ComputerUse)和视频编辑任务的通用智能体。这与 X 部分所观察到的“将 GPT-6 Astra 视为 Blender 等制作中枢”的趋势一致,说明跨平台存在相同叙事。
- Sora 2 终止是闭源视频生成领域最大新闻之一:Web/App 已于 2026/4/26 停止,API 也计划于 2026/9/24(距离当日三周)终止。多个频道都在讨论“为何消失”及“迁往何处”,YouTube 的焦点已从 Sora2 的“新功能”转移到“终止后怎么办”。
- 争夺 Sora2 后继位置的是 Kling:从 Kling 2.6(2025/12/3,支持音画同步)到 Kling 3.0(2026/2/4,4K60fps、多镜头)进步迅速,被明确点名为 Sora2 停止后的替代选择。
- 开源图像编辑当前的主角是 Qwen-Image-Edit:ComfyUI 相关教程发布频率高,多个频道已形成系列;其存在感超过了单独的 Stable Diffusion 新教程。Stable Diffusion 相关搜索结果多停留在“安装方法”“模型列表”等常规指南,新模型新闻性较弱。
- 开源视频生成正逐步整理为三条路线:Wan 2.2(阿里巴巴・Apache 2.0)/HunyuanVideo 1.5(腾讯)/LTX-2(Lightricks,2026/1/6,首个支持音视频同步生成的开放模型,支持 4K/50fps)。搜索中还发现多个页面声称“Wan 2.7 开放权重已发布”,但 Wan-AI 官方 HuggingFace/GitHub 中不存在该版本,判断为 SEO 目的的虚假信息(Wan 官方最新开放权重为 2.2)。
- 频道正在跨界:原本以 Stable Diffusion 教程为主的「StableDiffusion等 チュートリアル&自作アニメ」也开始报道闭源 Sora2 终止新闻,说明受众正同时关注开源与闭源两侧。
局限
youtube.com/results(搜索结果页)和youtube.com/watch(视频页)均由客户端 JavaScript 渲染,WebFetch 获取后只返回页脚导航链接,无法直接读取标题、频道名、播放量和发布日期。因此,本报告发现视频依赖 WebSearch 摘要与 YouTube oEmbed API(仅返回标题、频道名的轻量端点)组合。- 受上述限制,绝大部分视频无法获得准确播放量和发布日期。为避免编造,报告中完全未记录播放量;发布日期也仅限于搜索摘要或模型发布日等公开信息能够推断的范围。
- 对工作手册中“优先最近 60 天上传”的要求,无法严格筛选。例如 Veo3.1×SORA2 对比视频预计发布于 Sora 2 上线后不久(约 2025 年 10 月),超过 60 天窗口,但作为 Sora2 终止新闻的背景只收录了一条。
- brief.md 的完成标准(每个社交平台约分析 20 个帖子)与 YouTube 工作手册规定的标准(5~12 个视频)形式不同,因此本部分遵循工作手册标准,收集 11 个视频后视为完成。
- 评论区内容仅能从 WebSearch 摘要中看到有限片段,未能逐条阅读热门评论或进行情绪分析。
- 未将中文频道纳入搜索对象。Qwen(阿里巴巴)和 Kling(快手)都来自中国,本报告未反映中文社区的反应。
Bluesky
Bluesky — 图像与视频生成 AI 新闻
账号
通过 Bluesky 公开 API(https://api.bsky.app/xrpc/app.bsky.feed.searchPosts)搜索「Stable Diffusion」「Sora 2」「Midjourney」「Grok Imagine」「ComfyUI」「Veo 3」「Nano Banana」,并从结果中筛选实际提到图像或视频生成 AI 的账号。
| 账号 | 属性 | 与主题的关系 |
|---|---|---|
| @xai-bot.bsky.social | xAI 官方 Bot | 发布 Grok Imagine(闭源)新模型消息 |
| @codename.cc | 应用更新跟踪 Bot | 发布 Grok iOS 应用 Imagine 功能更新 |
| @drewkav.bsky.social | 个人艺术家 | 分享 Gemini 3.1 Nano Banana 2 与 Kling 3.0 组合创作 |
| @triflingtree.bsky.social | 个人艺术家 | 发布 Nano Banana Pro 作品 |
| @gentile-of-hope.bsky.social(希望の異邦人) | 个人・生成 AI 批评者 | 批评图像生成 AI(Stable Diffusion/ChatGPT/Gemini)的伦理和环境问题 |
| @samperson.bsky.social | 个人・艺术家一方 | 转发支持 Procreate 反生成 AI 立场的内容 |
| @ecutruin.bsky.social | 个人・本地生成实践者 | 评价 ComfyUI 等本地工具的功能优势 |
| @digitalhowl.bsky.social(Fenris) | 个人・视频制作者 | 分享 ComfyUI+Minimax H3 的专业视频制作 |
| @kerzefasta.bsky.social | 个人・二创插画师 | 持续用 Stable Diffusion WebUI reForge(ROCm)发布舰队收藏角色,是该搜索词中获赞最多的创作者 |
| @aichina.news | 自动发布 Bot | 大量逐条自动发布基于 FLUX 的 LoRA(Apache-2.0),互动几乎为零 |
总体而言,Bluesky 上实际发布这一主题内容的并不是新闻报道者,而是“使用工具的人(个人创作者)”与“批评生成 AI 的人”两极。没有发现类似 X 或 Reddit 上的专业新闻账号/子社区。
帖子
-
@xai-bot.bsky.social(2026-09-05・0 个赞)https://bsky.app/profile/xai-bot.bsky.social/post/3mus2woiczo2w — 「Grok Imagine Video 1.5 agent is now available. Powered by our newest Image 2.0 model...」。这是 xAI 官方账号发布的 Grok Imagine(闭源)新视频智能体公告,但赞与转发均为 0,搜索范围内未见可见互动。
-
@codename.cc(2026-09-06・0 个赞)https://bsky.app/profile/codename.cc/post/3muspbmaiq22n — 「SHIPPED: Grok iOS updated to 1.4.33 with improvements to Chat, Voice and Imagine features.」。由个人跟踪账号记录应用版本变更。
-
@drewkav.bsky.social(2026-09-06・9 个赞)https://bsky.app/profile/drewkav.bsky.social/post/3muubykpdfk2k — 题为「Persistent Dream」的作品,明确说明静态图使用 Gemini 3.1 Nano Banana 2,视频化使用 Kling 3.0。是闭源工具组合(Google×Kling)工作流的实例。
-
@triflingtree.bsky.social(2026-09-06・15 个赞・1 次转发)https://bsky.app/profile/triflingtree.bsky.social/post/3mutz2tm3bc2m — 使用 Nano Banana Pro 生成拜占庭风格的“外星母子像”。在本次 Nano Banana 相关帖子中获赞最多。
-
coah80.com(2026-09-06・0 个赞)https://bsky.app/profile/coah80.com/post/3muulvyomz72c — 「SORA 2 WAS GENUINELY SO BAD HOWD WE CALL THIS GOOD」。对闭源 Sora 2 的严厉批评,与 YouTube 部分确认的“其 Web/App 于 2026/4/26 终止、API 将于 2026/9/24 终止”所反映的负面氛围一致。
-
@gentile-of-hope.bsky.social(2026-09-05・100 个赞・42 次转发)https://bsky.app/profile/gentile-of-hope.bsky.social/post/3murgar5zys2j — 「不仅是 Stable Diffusion,ChatGPT 和 Gemini 等 AI 图像生成功能也建立在不道德、大规模的数据掠夺之上。(略)图像生成消耗巨量电力和水资源,破坏环境。」。这是本次收集帖子中点赞最多的之一,显示无论闭源或开源,对生成 AI 本身的批评获得了最大互动。
-
@samperson.bsky.social(2026-09-05・121 个赞・11 次转发)https://bsky.app/profile/samperson.bsky.social/post/3muruvekma22b — 转发支持插画应用 Procreate 反生成 AI 方针的内容。是此次收集中的最高点赞数。
-
@ecutruin.bsky.social(2026-09-06・1 个赞)https://bsky.app/profile/ecutruin.bsky.social/post/3muv2pwq55s2t — 「local software like ComfyUI has more features than the majority of hosted solutions」。评价开源本地生成环境在功能上优于多数托管服务。
-
@digitalhowl.bsky.social(2026-09-06・0 个赞)https://bsky.app/profile/digitalhowl.bsky.social/post/3muuu24tqf22g — 表示正将 ComfyUI 与 Minimax H3 结合,用于“professional grade video work”。这是开源底座+商用模型的混合使用案例。
-
@kerzefasta.bsky.social(2026-09-05~06・多条帖子,最高 29 个赞・10 次转发)https://bsky.app/profile/kerzefasta.bsky.social/post/3muroxdlm4k2j — 使用 Stable Diffusion WebUI reForge(ROCm、AMD GPU)持续发布舰队收藏角色插画。虽没有新闻性,却是“Stable Diffusion”搜索中持续获得最多互动的账号。
-
@aichina.news(2026-09-06・0 个赞,同类帖子每小时超过 20 条)https://bsky.app/profile/aichina.news/post/3muup3wwiad2i — 「Apache-2.0 LoRA for Flux, small enough to drop into ComfyUI or Diffusers」。该 Bot 面向 Huawei Ascend/Modelers.cn,机械式大量发布 FLUX LoRA,没有触发词或样例,仅公告发布。它推高了开源关键词的搜索结果数量,却没有形成实质讨论。
信号
- 闭源:Nano Banana(Gemini 3.1/Nano Banana Pro)最常出现在个人创作者的实际制作中;多篇帖子确认了“静态图用 Nano Banana、视频化用另一工具 Kling 3.0”的分工工作流。
- 闭源:Grok Imagine 新模型(Video 1.5 / Image 2.0)由官方账号发布,但赞和转发均为 0。在这个搜索范围中,新闻稿式公告在 Bluesky 被淹没了。
- 闭源:提到 Sora 2 的内容只有批评(“SORA 2 WAS GENUINELY SO BAD”),未找到辩护性帖子,与 YouTube 部分的服务终止趋势相符。
- 开源:实际使用 ComfyUI 的用户正面评价其具体优势:“本地工具比托管方案功能更多”。
- 开源/噪声:对「Stable Diffusion」「Flux」等开源关键词的搜索结果,大部分由三类内容构成:(1)舰队收藏等二创插画;(2)指向 NSFW 内容的外链帖子;(3)如 @aichina.news 一类零互动的自动 LoRA 公告 Bot。真正具新闻价值的讨论极少。
- 最大互动轴是“批评生成 AI”:收集到的帖子中,点赞数前两名(121、100)都批评或反对生成 AI(不分图像或视频),大幅超过工具使用类帖子(最高仅 15 个赞)。这表明与 X/Reddit 相比,Bluesky 用户群更容易显现反生成 AI 的声音。
局限
- API 限制:
public.api.bsky.app端点所有请求均返回 403(拒绝访问),无法使用。替代的api.bsky.app虽可用,但短时间发送多个新查询时也频繁返回 403 速率限制,因此 “Kling AI”“Wan2.2”“HunyuanVideo”“Qwen Image”“Krea”“Sora shutdown”等近半数尝试过的搜索词从未取得数据。 - 无法获取 Web UI:
bsky.app/search是 JavaScript 渲染的 SPA,WebFetch 无法取得帖子正文(仅有元标题),实际信息源只能依赖 API 搜索结果。 - 数量不足:相对于“分析约 20 条帖子”的完成标准,实际能核实内容的仅约 11 条。API 搜索结果中混杂大量无关噪声,例如“Sora”命中 Kingdom Hearts 角色名、趋势标签统计 Bot 等,真正相关的帖子数量更少。
- 互动指标的局限:Bluesky 公开 API 会返回点赞、转发、回复数,但无法像 X 一样提供浏览量(曝光),因此不清楚帖子的真实阅览规模。
- 帖子详情获取失败:尝试通过
app.bsky.feed.getPostThread单独获取 samperson.bsky.social 帖子正文时返回 400 错误,无法确认超出搜索摘要的完整正文(链接已提供)。 - 账号偏向:搜索结果集中于特定账号,如 @kerzefasta.bsky.social 的舰队收藏插画和 @aichina.news 的自动 LoRA 公告,难以视为广泛用户群体的代表。
Lemmy
Lemmy — 图像与视频生成 AI 最新动态
社区
- !«メールアドレス» — 5,708 名订阅者、1,386 篇帖子。是开源图像与视频生成 AI(模型、ComfyUI 节点、LoRA 等)事实上的主要聚集地。几乎每天都有新工具或模型发布。https://lemmy.dbzer0.com/c/stable_diffusion
- !«メールアドレス» — 2,361 名订阅者、3,500 篇帖子。用于发布由 Stable Diffusion/开放权重模型制作的作品(新闻性较弱,更偏画廊)。https://lemmy.dbzer0.com/c/stable_diffusion_art
- !«メールアドレス» — 4.82K 名订阅者(lemmy.world 本地订阅者约 1.8K)。涵盖自由/开源 AI 整体,专门讨论图像或视频生成的帖子较少。https://lemmy.world/c/fosai
- !«メールアドレス»、!«メールアドレス»、!«メールアドレス» — 闭源 AI 公司(如 Midjourney)的新闻主要流向这些社区。它们并非“图像生成 AI 新闻”专属社区,而是散落在一般科技/新闻社区中。
帖子
偏开源(主要来自 !«メールアドレス»)
- MiniMax-H3_Singularity — MiniMax-H3 系视频生成模型的微调融合模型。score 3、2026-09-06。https://lemmy.dbzer0.com/post/75088455 (原始页面: https://huggingface.co/WarmBloodAban/Minimax-h3_Singularity)
- Qwen3.8-Flash-Next-NVFP4 — NVIDIA 推出的 Qwen 模型 NVFP4 量化版。score 3、2026-09-06。https://lemmy.dbzer0.com/post/75088454 (https://huggingface.co/nvidia/Qwen3.8-Flash-Next-NVFP4)
- ComfyUI-AetherScale — ComfyUI 的新扩展。score 5、2026-09-05。https://lemmy.dbzer0.com/post/75036491 (https://github.com/vizart-vj/ComfyUI-AetherScale)
- Viggle-Animate — 可根据一张重绘图像,在视频中替换角色的视频编辑模型。score 9(本帖列表最高分)、2026-09-05。https://lemmy.dbzer0.com/post/75036488 (https://huggingface.co/Viggle/Viggle-Animate)
- FastH3-Ref2V-Stream-Controller — 用于连续视频生成的 ComfyUI 控制器。score 2、2026-09-04。https://lemmy.dbzer0.com/post/74988027 (https://github.com/EarthDefenceForces/FastH3-Ref2V-Stream-Controller)
- ComfyUI-Majoor-OmniCam — ComfyUI 的相机布局/动画工具。score 4、2026-09-04。https://lemmy.dbzer0.com/post/74988020 (https://github.com/MajoorWaldi/ComfyUI-Majoor-OmniCam)
- H3-World — 被介绍为“首个基于 MiniMax-H3 的交互式世界模型”。score 3、2026-09-02。https://lemmy.dbzer0.com/post/74893520 (https://huggingface.co/DANNY621/H3-World)
- ComfyUI-MiniMaxH3-CLSS — 可在 16GB VRAM 上生成任意长度带声音视频的节点。score 0、2026-09-01。https://lemmy.dbzer0.com/post/74843957 (https://github.com/nazgut/ComfyUI-MiniMaxH3-CLSS)
- Trellis.2 and Pixal3D Now Native in ComfyUI — 3D 生成模型 Trellis.2 与 Pixal3D 原生集成至 ComfyUI。score 4、2026-09-01。https://lemmy.dbzer0.com/post/74843948 (https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native)
- ComfyUI-DLSS5-NR — 使用 NVIDIA DLSS 5 神经渲染的实验性 ComfyUI 支持。score 2、2026-09-01。https://lemmy.dbzer0.com/post/74843949 (https://github.com/lisitskyaa/ComfyUI-DLSS5-NR)
- LLaDA-Image — 基于扩散模型的图像生成研究论文(arXiv)。score 3、2026-09-04。https://lemmy.dbzer0.com/post/74988021 (https://arxiv.org/abs/2609.03796)
偏闭源
- Midjourney pivots from AI image generation to body scanning medical spa — 报道称 Midjourney 将从 AI 图像生成业务转向医疗身体扫描(超声)业务「Midjourney Medical」。score 58、2026-06-18、!«メールアドレス»。https://lemmy.zip/post/66397234 (原文: https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/)
- Midjourney AI pivots to Theranos: Ultrasonic CT — 对同一新闻的批评性评论。score 40、2026-06-19、!«メールアドレス»。https://awful.systems/post/8731127 (https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/)
- Midjourney Medical / Midjourney Ultrasonic CT Scanner — 两条直接链接 Midjourney 官方页面的帖子。score 3、2,2026-06-18、!«メールアドレス»。https://lemmy.bestiver.se/post/1175129 / https://lemmy.bestiver.se/post/1175130
- Midjourney wants Hollywood studios to reveal AI usage details — 关于 Midjourney 要求好莱坞工作室披露 AI 使用详情的文章。score 73、2026-07-05、!«メールアドレス»。https://techcrunch.com/2026/07/04/midjourney-wants-hollywood
信号
- Lemmy 中与图像、视频生成 AI 有关的热度几乎完全偏向开源。中心在
!«メールアドレス»这一处,围绕视频生成基础模型「MiniMax-H3」的生态(LoRA、ComfyUI 节点、VAE 加速、动作缓存等)每天持续发布约 3~9 条工具帖子。Qwen 量化版和 LLaDA-Image 论文也会流入同一社区。 - 闭源一侧唯一形成规模的话题是Midjourney 从图像生成转向医疗超声扫描业务的 2026 年 6 月新闻。它被多个实例(lemmy.zip / awful.systems / lemmy.bestiver.se)转载并引发讨论(分数 40~73,在这一主题中相对较高)。反过来说,Sora、Veo、Kling、Runway、Nano Banana、Flux.2 等 2026 年主要图像/视频生成 AI 发布本身,几乎没有作为新闻文章出现在 Lemmy 上。
- 以「Veo 3」「Kling AI」搜索 Lemmy 时均为零结果;“Runway/Kling/Veo/Gemini image”复合搜索也没有命中。Lemmy 用户更倾向关注能实际在 ComfyUI 中使用的工具(节点、LoRA、优化),而不是新模型本身的发布公告。
局限
- Lemmy 的用户与帖子规模都较小,也没有专门报道图像/视频生成 AI“新闻”的社区。实际信息源基本只有
!«メールアドレス»一个社区,以及零星流入一般科技社区的闭源公司新闻。 - 完成标准中“分析约 20 条帖子”的目标,仅达到开源工具帖 11 条与闭源 Midjourney 相关文章 4 条,合计 15 条。Sora、Veo、Kling、Runway、Nano Banana、Flux.2 等 2026 年主要发布本身,无论 Lemmy 搜索(lemmy.world API)或网页搜索均未找到;“没有找到”本身在此明确记录。
- lemmy.world 的
/c/stablediffusion社区页面直接访问时出现 HTTP 500 错误(可通过搜索 API 替代)。
Pinterest — 图像与视频生成 AI 新闻
已查看全部 50 个 Pin(output/pinterest.pins.md / images/pinterest/manifest.json)。收集时未作类别划分,使用的是单一查询「Image and Video Generation AI News」。
视觉主题
- 海军蓝×霓虹(蓝、紫、粉)的赛博感模板化:带有电路线、粒子辉光、神经网络球体或节点的背景,构成了绝大多数“典型 AI”缩略图。[1, 2, 5, 7, 11, 13, 14, 17, 18, 20, 26, 30, 38, 40]
- “AI 新闻主播”视觉反复出现:白色安卓机器人,或人类与机器半脸融合的主播,以西装坐在新闻台前的构图多次出现。仅替换品牌名的量产感很强。[4, 32, 34, 37, 42]
- 工具对比、排行榜式信息图是最常见格式:Runway、Pika、Kling AI、Luma(Dream Machine)、Canva AI、Hailuo AI、Synthesia、InVideo AI、HeyGen、Vidu AI、PixVerse、Google Veo、OpenAI Sora、Adobe Firefly 等几乎以相同阵容反复进入“Best AI Video Generators”式榜单。[9, 19, 28, 33, 36, 46]
- 从一张原图/视频转换为多种风格的演示网格:同一人物被变为木块风、折纸风、乐高风、花束风,或熊猫玩偶、特斯拉汽车的风格延展,采用强调一致性的前后对比构图。[8, 25, 44]
- 深度伪造焦虑与检测内容:盖有“FAKE”印章的猫图、“Which is AI?”辨认测验、AI 生成图片/文本检测工具介绍,以及带有“所见不再可信”警句的信息图。[4, 12, 18, 26, 47]
- 带日期的“AI News Roundup”新闻卡:用标题+项目符号汇总多个主题的快讯格式,例如 Google I/O 2026、911 报警 AI 化、朝鲜 AI 技术栈等。[21, 29, 31, 35]
- 通用 AI 艺术展示化(偏离主题的帖子):如大理石雕像拉大提琴的写实图、老渔夫肖像等,无新闻价值的 AI 艺术作品宣传 Pin 也混杂其中(目的是推广工具本身)。[49, 50]
- 深色背景+霓虹文字是默认配色,白底企业型信息图(企业蓝、扁平设计)占少数。[3, 10, 27, 33]
值得注意的 Pin
- [11] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — 实际产品介绍,强调通过 Gemini API 使用 Veo 3 进行图生视频+原生音频生成。
- [16] Google Unveils Veo 2 — 采用 Google 官方宣传语气的 Veo 2 推广网格,展示显微镜前的科学家、游泳、动画风少女等多种生成样例。
- [25] Google announces Veo 3 — 展示紫色怪物角色在多个环境中保持一致生成的案例。用一张原图产出三种视频,突出角色一致性。
- [29] Today's AI News: MAY 20, 2026 — Google I/O 2026 专题,列举 Gemini 3.5 Flash / Gemini Omni / Gemini Spark、Apple 辅助功能 AI、Android XR 智能眼镜竞争。
- [35] The Latest AI Developments — 三则快讯:新奥尔良以 AI 响应 911 报警、Meta 发布离线智能体模型 Muse Glimmer、朝鲜 Kimsuky 团体用自建 AI 技术栈自动化网络钓鱼,属于具体事件报道。
- [44] Microsoft Unveils VASA-1 — 介绍可由一张静态人脸图+音频片段(+可选控制信号)生成人脸说话视频的模型,并附多种人脸网格图。
- [48] ShengShu Technology Unveils Vidu S1 — 宣称面向实时 AI 互动的尖端模型 Vidu S1,以赛博朋克风角色的多面展示呈现。
- [8] 风格一致性转换演示(Luma 系)— 将同一人物/动物/汽车变换为“木制积木”“折纸”“乐高”“花朵”等五种风格的比较网格,技术演示说服力较强。
- [46] Future of Video Creation: Best AI Video Generators of 2026 — 涵盖 Pika 2.5、HeyGen、Google Veo 3.1、Runway Gen 4.5、Kling 3.0、Adobe Firefly、Seedance 1.5 Pro,明确列出版本号的最新排行榜。
- [20] More than 20% of YouTube is now AI-generated — 只有一句附带具体统计值的简洁标题,却是 AI 生成内容普及程度的象征性数字。
信号
- 模型代际竞争变得可见:Veo 2→3→3.1、Kling AI→3.0、Runway Gen-3→Gen 4.5、Pika 2.5、Seedance 1.5 Pro 等版本升级频繁出现,显示视频生成 AI 的改进周期很快。[16, 25, 11, 46]
- “智能体化”“实时化”“离线化”成为下一焦点:从一键完成招募→编剧→生成→编辑的流水线工具([24])、实时互动型 Vidu S1([48])、无需网络连接的 Meta Muse Glimmer([35])等可见,关注点正从单纯“生成”转向“智能体/实时/端侧”。
- AI 的实际部署与滥用开始成为话题:AI 引入紧急报警系统([35])、国家级主体(朝鲜)滥用 AI([35])等内容,让讨论超越了生成 AI 本身,延伸至社会应用与安全。
- 闭源商用工具的曝光高度集中:排行榜 Pin 反复出现的是 Google Veo、OpenAI Sora、Runway、Kling AI、Adobe Firefly、Pika、Luma、HeyGen、Synthesia 等闭源服务;开源模型(Stable Diffusion 系、AnimateDiff、Open-Sora、ComfyUI 工作流等)几乎没有提及。「Amuse 3.0」([50])是少数例外,强调可在 AMD Ryzen AI 上本地运行。
- 与一手信息源的连接较弱:50 个 Pin 中,暗示直达企业官方博客或技术论文的极少,主要是 Veo 官方语调的 [16][25]、Microsoft VASA-1 的 [44];绝大多数为联盟营销博客、SEO 文章、Fiverr 营销缩略图(如 [45])。Pinterest 更像是“销售工具的地方”,而不是“追踪新闻的地方”。
- 深度伪造焦虑已成为固定内容类型:检测工具介绍和“辨别测验”构成独立类别,人们消费的更多是“是否可信”的不安,而不是生成技术本身的进步。[4, 12, 18, 26, 47]
局限
- 本部分仅阅读工作器通过无头浏览器预先收集的图片,没有对 Pinterest 本身进行额外搜索或滚动,符合工作手册指定流程。
- 收集使用单一查询且未分类,因此没有针对闭源/开源进行定向搜索,结果几乎看不到开源相关 Pin。这可能确实反映 Pinterest 的发帖趋势,但也不能排除定向深挖可找到更多内容的可能。
- 有 2 个 Pin 标题为
(untitled)([12] 实际可读出为“Which is AI?”内容,另一些则难以辨别)。 - 未实际打开 Pin URL(
pinterest.com/pin/...),只根据图像与标题判断,因此未核实落地页正文、评论、收藏数等互动指标。 - [49](大理石雕像大提琴演奏者)是与主题关联较弱的通用 AI 艺术宣传 Pin,未作为有新闻价值的洞察处理。
建议行动
- Sora2 依赖型工作流应在 API 终止(2026/9/24)前制定迁往 Kling 3.0 或 Veo 3.1 的计划。
- 将 GPT-6 Astra 的 ComputerUse 功能作为制作流程自动化工具,而非单独的生成 AI 来持续跟踪。
- 若目的是降低成本,应先试用 Qwen-Image-Edit + ComfyUI 的本地编辑,再考虑闭源服务付费。
- 为应对 AI 生成内容真实性标注与伪造延时绘画引发争议的风险,应完善公开内容的 AI 使用披露规则。
- 验证 Nano Banana(静态图)+Kling 3.0(视频化)的分工工作流。
- 持续观察 Midjourney 从图像生成转向医疗设备业务的变化,将其作为其他闭源公司多元化的先行指标。
收集图片


















































数据质量说明
6 个平台均未达到 brief.md 的完成标准(每个社交平台约 20 条)。尤其是 X,40 条帖子中仅 4 条相关;Bluesky 因 403 速率限制实际仅约 11 条;Lemmy 因没有专业新闻社区仅达 15 条。不过,GPT-6 Astra、Sora2 终止、ComfyUI 生态扩张等主要趋势已在多个平台得到独立印证。



