图像与视频生成 AI 新闻 — 2026-09-10
阿里巴巴的 Wan 3.0 以不公开权重的付费 API 形式上线,OpenAI 则将于 9 月 24 日停止 Sora 2 API。视频生成 AI 正在中国厂商主导下重组,开放与封闭之间的边界也愈发模糊。
阿里巴巴的 Wan 3.0 以不公开权重的付费 API 形式上线,而 OpenAI 将于 9 月 24 日停止 Sora 2 API。视频生成 AI 正在中国厂商主导下重组,开放与封闭之间的边界也愈发模糊。
图像与视频生成 AI 新闻 — 2026-09-10
在闭源阵营,OpenAI 宣布将于 2026 年 9 月 24 日停止 Sora 2 API;与此同时,Google 的 Nano Banana 系列(Gemini 2.5 Flash Image、对标 ChatGPT Images 2.5)、Meta 的“Muse”及 xAI 的“Grok Imagine”等新模型接连发布,竞争版图仍在快速变化。开源阵营方面,阿里巴巴此前凭借 Wan 2.2 与 Qwen-Image 树立了“开放权重旗手”的形象,却将最新的 Wan 3.0 作为不公开权重的闭源 API 推出;本次最重要的发现正是开放与封闭的边界本身正在动摇。视频生成领域中,来自中国的模型(ByteDance Seedance 2.0、Alibaba Wan、MiniMax-H3)无论在对比视频还是 ComfyUI 生态中都愈发突出;与此同时,多个平台对 AI 生成内容真伪识别及内容审核失灵的担忧也在同步升温。本次调查覆盖 Reddit、X、YouTube、Bluesky、Lemmy 与 Pinterest 六个平台;除 X 外,均以某种形式收集到了与主题相关的内容。
跨平台观察
- 开放/封闭的边界正在动摇:YouTube 上,有人直接批评阿里巴巴 Wan 3.0 与“开源旗手”的招牌相悖,实际上以不公开权重的付费 API 形式上线。Lemmy 同期的开源话题集中在 MiniMax-H3 周边的 ComfyUYI 生态,而闭源话题则偏向争议与诉讼(Nano Banana 对 Earth AI 的滥用、Midjourney 诉讼)。两大阵营已无法用“企业还是个人”这样简单的标准来划分。
- Google“Nano Banana”系列模型成为多个平台的讨论中心:Bluesky 上 dfl.bsky.social 连日发布由 Nano Banana 2 生成的风景图;Lemmy 上,Nano Banana 的 Google Earth 合成功能因遭滥用而在发布一天后撤回;YouTube 上,GPT Image 2 被称作“Nano Banana Pro Killer”,Midjourney V8 也被拿来与 Nano Banana 2 对比。三个平台都出现了独立且明确的点名讨论。
- 对 AI 生成内容的不信任与验证需求正在蔓延:Reddit 上有人讨论识别 AI 内容的具体视觉线索,也有人强烈反对让 LLM 伪装成手绘创作的方法;Pinterest 上出现使用“FAKE”印章和“97% likely AI generated”徽章的验证类信息图;Lemmy 中“AI slop”这一贬称频繁出现,反 AI 社群也颇具存在感。它们从不同角度表达了相同的不安。
- 中国模型正在引领视频生成领域:YouTube 的对比视频中,ByteDance Seedance 2.0 反复以“击败” Kling、Sora 和 Veo 的叙事出现;Lemmy 上,以阿里系 MiniMax-H3 为核心的 ComfyUI 节点、LoRA 与 VAE 加速工具,仅在 2026-09-02 至 09-08 的一周内就有超过 10 条帖子。中国厂商在闭源与开源两端都展现出明显势头。
- 对比与排行榜内容已经成为各平台的原生格式:YouTube 的“X vs Nano Banana/Sora/Kling”式对决视频、Pinterest 的十大免费 AI 视频生成工具信息图,以及 Reddit 的无限制图像生成工具排行帖,都以同样的形式体现了用户“究竟该用哪个”的实用关切。
平台逐一观察
Reddit:分析了已由工作线程收集的 12 个帖子(来自 10 个 subreddit)。一方面,用户讨论对宣称无审查、无限制的图像生成工具(WildOwl、Mage.space、PixelForge)的需求;另一方面,也讨论 Grok、ChatGPT 与 Gemini 对 IP 角色限制的收紧。与此同时,Meta 平台放任 AI 生成儿童虐待视频的问题(772pt,r/TrueReddit)以极高反应量浮现,获得了 1,024 条评论,成为对审核失灵担忧的突出案例。视频生成时长的限制(通常最多 5 至 15 秒)已经成为多个帖子中的共识。
X:收集的 40 条帖子、37 个账号中,真正涉及主题的只有 2 条:@DotCSV 对图像模型更新的简短反应,以及 @QingQ77 对 AI × 3D 生成代码库的介绍。由于搜索词来自当日克罗地亚周边的泛趋势(Apple、$LAPTOP、Hunter Biden 等),而不是图像或视频生成 AI,因此这一阶段实际上没有捕捉到主题的真实情况。
YouTube:从 11 个视频中确认了 OpenAI Sora 将于 2026 年 9 月 24 日停止 API 这一重大闭源新闻、GPT Image 2 与 Midjourney V8 等新模型动向,以及 Alibaba Wan 3.0 从“开放”转向“封闭”的变化。ComfyUI 与本地运行相关的教程视频(DevsKingdom、GeekatPlay)构成开源阵营的主要传播形式。由于页面由 JavaScript 渲染,无法获取播放量及订阅数。
Bluesky:全文搜索 API 对所有查询均返回 403,因此改用从账号出发的间接调查。testingcatalog.com、genainews.bsky.social 等新闻聚合机器人快速报道了 OpenAI“ChatGPT Images 2.5”与 Meta“Muse”的发布;另一方面,Black Forest Labs、Stability AI、Midjourney 官方及 Civitai 通知机器人等开源侧主要账号几乎沉默,未能作为一手信息源发挥作用。
Lemmy:内容高度集中于 !«メールアドレス»,主要是自动发布 HuggingFace/GitHub 新内容的订阅流。最近一周,MiniMax-H3 周边的 ComfyUI 生态是最热门的话题。闭源方面,即使搜索 Sora、Kling、Runway、Ideogram、Veo 3 等主要服务名也没有找到相关帖子;流传的反而只有 Nano Banana 滥用、Midjourney 诉讼等争议与伦理话题。
Pinterest:在 50 个 Pin 中详细检查了 23 个。绝大多数是转发 YouTube 视频缩略图或汇总博客信息图的二手内容,无法获取点赞、收藏等互动指标。Google Veo 2、Microsoft VASA-1 等大厂发布视觉内容较显眼;而开源阵营(Stable Diffusion、Flux、Qwen、Wan 等)只在一张技术图解和工具排行榜的一个条目中出现,存在感极低。
值得关注
- OpenAI Sora 2 API 于 2026 年 9 月 24 日停止,以及是否会有后继模型 — YouTube(Zoom Vantage)https://www.youtube.com/watch?v=H2jVcy5PuBI
- Alibaba Wan 3.0 以不公开权重的付费 API 形式上线一事(偏离开源路线) — YouTube(Prompt Engineer)https://www.youtube.com/watch?v=gbI8XV4Szrk
- MiniMax-H3 周边 ComfyUI 生态的迅速扩张 — Lemmy(!«メールアドレス»)https://huggingface.co/OpenVDN/vdn-minimax-h3
- OpenAI“ChatGPT Images 2.5”(Sketch 功能、Flare/Sunburst API 模型)的发布 — Bluesky(testingcatalog.com)https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27
- Meta 平台上 AI 生成儿童虐待视频被放任,以及审核失灵问题 — Reddit(r/TrueReddit)https://www.reddit.com/r/TrueReddit/comments/1wbnann/
- Google Nano Banana 系列功能遭滥用后,Google Earth 合成图像功能被迅速撤回 — Lemmy(经 !ai_reddit 转发)https://lemmy.durstig.online/post/52162
建议
- 追踪 Sora API 停止(9/24)后,Veo 3.1、Kling 3.0、Seedance 2.0 与 Wan 系列的使用动向。
- 将 Wan 3.0 从“开放”转向“封闭”视为先例,持续监测其他开放权重实验室调整政策的风险。
- 在 Lemmy/HuggingFace 持续观察 MiniMax-H3 周边的 ComfyUI 工具群,以尽早发现下一个主要开源视频模型的信号。
- 将 X 的搜索关键词从依赖地区趋势改为图像与视频生成 AI 的专有词(Stable Diffusion、Sora、Nano Banana 等),并重新调查。
- 将 Meta 等平台对 AI 生成有害内容的审核状况作为监管与声誉风险的先行指标进行跟踪。
- 持续观察 Nano Banana / Gemini Image 系列面向消费者的闭源功能扩展,将其作为竞争对手应对措施的指标。
数据质量
- X:收集了 40 条帖子,但其中仅 2 条(5%)与主题相关。搜索词依赖当日地区趋势(Apple、$LAPTOP、Hunter Biden 等),没有使用任何图像或视频生成 AI 专有词,因此该平台实际上几乎没有获得有效发现。
- Bluesky:官方全文搜索 API(
app.bsky.feed.searchPosts)对所有查询返回 403,无法使用,因此改为通过账号搜索进行间接调查。直接相关帖子约 10 条,未达到 20 条的完成标准。 - Reddit:分析了工作线程收集的 12 个帖子(仅使用一条搜索查询)。未达到约 20 条的完成标准,尤其是针对开源模型的具体话题较少。
- Lemmy:该主题本身帖子量较小,分数大多为个位数至几十。即使搜索 Sora、Kling、Runway、Ideogram、Veo 3 等主要闭源服务名,也没有找到相符帖子。
- YouTube:由于页面由 JavaScript 渲染,WebFetch 无法获取视频网格、播放量和评论;仅通过 oEmbed 确认了视频标题和频道名。播放量和订阅数均标注为“无法获取”并省略。
- Pinterest:Pin 不附带点赞、收藏等互动指标,无法定量比较哪些帖子表现更好。此外,收集内容大多是 YouTube 缩略图和博客文章转载,作为一手信息的价值有限。
各平台汇总
Reddit — 图像与视频生成 AI 新闻
来源
- r/AItips101(订阅者 1,210 人)— 1 条
- r/antiai(订阅者 320,447 人)— 1 条
- r/aivideomaking(订阅者 6,681 人)— 1 条
- r/aiwars(订阅者 167,556 人)— 2 条
- r/generativeAI(订阅者 151,900 人)— 2 条
- r/freetoolsAI(订阅者 7,991 人)— 1 条
- r/isthisAI(订阅者 407,630 人)— 1 条
- r/RemoteWorkers(订阅者 76,520 人)— 1 条
- r/ChatGPT(订阅者 11,626,217 人)— 1 条
- r/TrueReddit(订阅者 628,511 人)— 1 条
共 12 个帖子,搜索查询仅为 "Image and Video Generation AI News"。
用户观点
-
帖子 1“2026 年最佳无限制 AI 图像生成器”(r/AItips101,110pt,45 条评论,2026-09-07)https://www.reddit.com/r/AItips101/comments/1w9yftp/ — 一篇“无审查”AI 图像生成工具排行榜。第一名 WildOwl.ai 可访问 Qwen/Flux/Seedream/Wan/Kling/Seedance/Veo/GPT Image 等超过 35 种模型,卖点是不需要订阅且积分永不过期。评论中,u/reliablemicrophone84 称赞“WildOwl 正好解决了‘使用最新模型还是拥有自由’的二选一问题”;而 u/Clear-Assistance449 则推荐 Mage.space,认为其订阅内可以无限生成。无限制图像工具领域呈现出多产品并立的状态。
-
帖子 2“警告:出现了一种新形式的 AI 生成图像”(r/antiai,7,130pt,1,024 条评论,2026-09-05)https://www.reddit.com/r/antiai/comments/1w81kdd/ — 一种让 LLM(GPT-6)获得鼠标和键盘控制权、直接在数字画板上“作画”的方法出现了;它甚至可以生成看似真实的创作延时视频,因此几乎无法再与“真正的艺术创作”区分。这篇警示帖以 1,024 条评论获得极高热度,是这 12 条中反应最大的帖子。热门评论 u/Nayutantantan(2,510pt)强烈反感:“现在连记录都没有意义了,为什么非要做到这个地步来假装是真正的艺术家?”
-
帖子 11“Facebook 正在托管大量令人毛骨悚然的 AI 生成暴力儿童虐待视频……”(r/TrueReddit,772pt,40 条评论,2026-09-09)https://www.reddit.com/r/TrueReddit/comments/1wbnann/ — 分享一篇揭露 Meta(Facebook)上大量 AI 生成儿童虐待视频被放任的文章。评论者 u/mirh 引述 Meta 公关回应:“无论是实拍还是 AI 生成,描绘身体伤害的内容都有严格规定”,并称这些视频已被删除;但评论也指出,平台明明有检测系统却没有妥善使用。u/NinjaLion 警告称,Meta、X,最终可能还有 Reddit,正在走向“卖剑但不卖盔甲”的审核放弃路线。
-
帖子 9“审查 AI 生成图像可获每小时 30 美元”(r/RemoteWorkers,175pt,828 条评论,2026-09-04)https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/ — 一则远程职位招聘,工作内容是核验 AI 生成字幕,时薪 30 美元。虽然有 828 条评论,但多数只是为了索取申请链接而重复发送“Images”的模板评论,几乎没有实质讨论。这是 AI 验证与评估劳动作为新职业类别迅速出现在 Reddit 上的实例。
-
帖子 4“这是由 GPT 6 - Astra 在 Blender 中制作的渲染图(不是 AI 生成视频)”(r/aiwars,18pt,14 条评论,2026-09-06)https://www.reddit.com/r/aiwars/comments/1w96yaf/ — GPT-6“Astra”操作 Blender 制作渲染内容的视频在 X 上走红后被转发。u/not_food(6pt)表示:“等不及它能本地运行了。只要还存在价格调整、政策变化和服务器关闭后被撤掉梯子的风险,就不能用于工作。”这反映出对闭源依赖风险的意识。u/ComfortPhil(1pt)则困惑地说:“由 GPT-6 制作,但不是 AI 生成?我不明白。”
-
帖子 10“更新后的图像生成器。试着找回‘怪异 AI 艺术’”(r/ChatGPT,32pt,26 条评论,2026-09-09)https://www.reddit.com/r/ChatGPT/comments/1wbdbdj/ — 尝试在当前 ChatGPT 图像生成中复现早期 Disco Diffusion/Stable Diffusion 的“怪异感”。u/Cubic_Inequality504(9pt)指出:“大家难道没发现吗?那些绘画般怪异的纹理还在,2.5 和 Image 2 完全一样。”这显示出部分用户对“更真实、更漂亮”的进化仍感到不满足。
-
帖子 5“即使不少专业人士也会承认,当前 AI 模型很不擅长生成让人有食欲的食物图像”(r/aiwars,4pt,177 条评论,2026-09-03)https://www.reddit.com/r/aiwars/comments/1w69cdj/ — 批评 AI 生成的食品广告图“看起来不好吃”。u/LCI_Jake(14pt)严厉评价:“像是故意做得很恶心,看起来像虫巢。”不过 u/Bassed_Hummble(5pt)反驳称:“即便免费 Krea 2,40 秒生成也可以写出达到这个质量的提示词;企业为什么会用这么差的图?”双方对于问题究竟在模型还是提示词与运营上存在分歧。
-
帖子 6“限制较少的 AI 图像生成器”(r/generativeAI,2pt,3 条评论,2026-09-08)https://www.reddit.com/r/generativeAI/comments/1waapc1/ — 用户咨询想为个人用途制作 Disney 角色同人图,但被 Grok 拦截。这个案例说明闭源大厂(Grok、ChatGPT、Gemini)正在收紧对 IP 角色生成的限制。u/frighten(1pt)建议 PixelForge 可能可以不受限制地运行。
-
帖子 7“免费 AI 图像生成器”(r/freetoolsAI,40pt,51 条评论,2026-09-04)https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/ — 宣传一个无需注册、无限制、无水印的免费图像生成工具(aifreeforever.com)。u/Puzzleheaded_Lab4757(1pt)积极表示:“这个网站帮我节省了数百美元和很多时间”;但 u/Relevant_Syllabub895(2pt)抱怨“为什么大家都禁止 NSFW,不值得”。
-
帖子 8“这个视频是 AI 生成的还是真实的?想听听能识别 AI 的人的意见”(r/isthisAI,0pt,31 条评论,2026-09-09)https://www.reddit.com/r/isthisAI/comments/1wbspxo/ — 希望大家判断视频是真实拍摄还是 AI 生成。u/BouncingSphinx(3pt)评论道:“这个视频正好 15 秒,这似乎就是当前 AI 视频的极限。”可作为反映视频时长技术上限的一手信息。u/smalltiddygothb(16pt)和 u/EmergencyWaffleBox(14pt)指出项链消失又重新出现这一具体伪影,作为识别线索。
-
帖子 3“免费 AI 视频生成器”(r/aivideomaking,12pt,29 条评论,2026-09-07)https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/ — 用户询问是否能仅用手机或 iPad 免费制作 45 秒视频。u/NewLifeWares(2pt)解释了现实限制:“45 秒需要数据中心级别的硬件;免费额度最多也就是带水印的 5 秒视频。”这表明视频 AI 的免费额度仍主要受制于生成时长过短。
信号
- 闭源侧对“无审查/无限制”工具的需求正在上升(WildOwl、Mage.space、PixelForge 等),并且与大厂(Grok、ChatGPT、Gemini)对 IP 角色限制收紧的情况在多个帖子中同时出现。限制越严格,介绍替代工具的帖子需求越高。
- 对“隐藏或伪装 AI 生成身份”技术的强烈反感正在快速上升。帖子 2 中让 LLM 操作鼠标、使延时视频看似“真实”的方法获得 1,024 条评论,反应远超本次其他收集内容。尽管其来自 r/antiai,但“伪装真实性”的议题也与帖子 8 中寻找 AI 视频视觉识别线索的讨论相呼应。
- 视频生成时长的限制(约 5 至 15 秒)仍被视为一道壁垒,帖子 3 和 8 的观点一致。对“免费 45 秒视频”的答复一致认为不可行,更多是共同认知而非立场之争。
- 对画质的评价存在分歧:帖子 10 有人不满“即使进化了,怪异纹理仍未改变”;帖子 5 则认为问题不在模型极限,而在提示词能力。用户对 AI 图像质量该由谁负责有不同看法。
- AI 相关的“人类工作”(字幕核验、时薪 30 美元)开始在 Reddit 招聘板上显眼出现,这表明随着 AI 图像与视频扩张,围绕“验证和监督生成内容”的辅助劳动也在增加。
- 对审核失灵的担忧正成为跨平台话题(帖子 11)。虽然讨论的是 Meta 的个案,但评论者预期 X 与 Reddit 也可能走上同一路径;生成式 AI 扩张与平台审核体系之间的缺口可能成为后续风险点。
局限
- 完成标准要求每个平台分析约 20 个帖子,但本次工作线程仅收集到 12 个帖子(来自 10 个 subreddit)。搜索词也只有 "Image and Video Generation AI News" 一条,未使用日语或其他英语查询(如“Stable Diffusion”“Midjourney”“Sora”“open source diffusion model”等具体工具名)继续搜索。相较于 brief.md 要求的闭源和开源各至少 10 条观察,仅靠本阶段的 12 个帖子可能样本略显不足。
- 本次收集几乎未包含以具体开源模型名为主题的帖子,例如 Stable Diffusion 系列、ComfyUI、Civitai 以外的新模型;与闭源侧(WildOwl、ChatGPT、Grok、GPT-6 等)的讨论相比,开源话题较少。
- r/RemoteWorkers 的帖子 9 虽有 828 条评论,但其中绝大多数为重复“Images”的模板评论,几乎没有可引用的实质讨论。
- 本文件仅根据工作线程已收集的
output/reddit.threads.md/.json编写,没有追加访问 Reddit(WebFetch/搜索),符合 playbook 指示。
X
X — 图像与视频生成 AI 新闻动态
账号
在收集到的 40 条帖子、37 个账号中,真正涉及本次研究主题(图像与视频生成 AI)的实际上只有 2 个账号。
- @DotCSV(Carlos Santana) — 在西班牙语地区知名的 AI YouTuber/评论者。1 条帖子、890 个赞,在收集内容中属于中等规模反应。通过“AI OS”搜索命中,内容是对图像模型更新的简短反应。
- @QingQ77(Geek Lite) — 1 条帖子、24 个赞的小型账号。介绍一个让 AI 代理在 Blender 中生成符合尺寸、可供 3D 打印零件的 GitHub 代码库(jangtrinh/design-os-3d-blender)。这不是图像或视频生成本身,而是 AI × 3D/CAD 生成的相邻领域。
其余 35 个账号每个收集到 1 至 3 条内容,主题包括 Apple 新品发布、$LAPTOP 迷因币、Real Madrid/足球、Hunter Biden、天主教争论、Love Island USA、动画直播(ABEMA“CHANCE & CHANGE”)等,均与图像和视频生成 AI 无关,不能作为本主题的信息源。
帖子
-
#19 @DotCSV — 890 likes・46 reposts・15 replies・约 63,000 views・2026-09-08
https://x.com/DotCSV/status/2097406200006537543(通过“AI OS”搜索命中)"Fuck, and on top of that, they roll out an update to the image model... just in case the math milestone wasn't enough for you."
唯一提到图像模型更新的帖子。但正文无法确认具体是哪一模型或哪家公司,且只是一次性的反应。 -
#17 @QingQ77 — 24 likes・2 reposts・15 replies・约 2,300 views・2026-09-08
https://x.com/QingQ77/status/2097258894280347971(通过“AI OS”搜索命中)"Let AI agents build real parts with correct dimensions and 3D printability according to specifications in Blender 5.2, directly connecting to the printing production stage." (附 GitHub:jangtrinh/design-os-3d-blender 链接)
虽非图像或视频生成本身,但可作为同类趋势已扩展至 3D/CAD 领域的例子:AI 可将生成结果直接接入生产流程。不过互动较少,仍属小众范围。
其余 38 条帖子(通过“Apple”“$LAPTOP”“Hunter Biden”“iPhone”“Real Madrid”“Harvey”“Germans”“#chance”“Catholic”搜索命中,以及“AI OS”命中的另外 2 条)均与图像和视频生成 AI 无关,因此未纳入发现。
信号
- 本阶段最明确的“信号”是,收集到的帖子群本身几乎与主题无关。40 条中只有 2 条涉及图像与视频生成 AI(无论闭源还是开源),且两者都缺乏一手信息价值,只是单次感想或代码库分享。
- 唯一触及主题的 @DotCSV 帖子表明,AI 领域影响者对图像模型更新作出反应时仍可获得一定传播(约 63,000 次浏览),但没有提及具体模型名或功能,无法用于后续验证。
- Stable Diffusion、Midjourney、Flux、Sora、Veo、Runway、Kling、Seedance、ComfyUI、Civitai、Nano Banana 等本应直接关联主题的专有名称,一个都没有出现在搜索词中。因此,本次收集无法说明 X 上有关这些主题的实际讨论量和热度。
局限
- 搜索词与主题不匹配。按照 playbook,工作线程直接使用 X Explore 页面中显示的趋势词;该页面基于本会话连接服务器所在地显示“Trending in Croatia”:Apple/$LAPTOP/Hunter Biden/iPhone/AI OS/Real Madrid/Harvey/Germans/#chance/Catholic。这些是克罗地亚周边当日的泛趋势,而不是围绕图像和视频生成 AI 构建的查询。因此,除“AI OS”外的 9 个词(约 30 条帖子)都与主题无关。
- 即便“AI OS”搜索中,4 条结果里也有 2 条无关(#18 是地区民意调查偏差话题,#20 是“ai os cat beanie”的无关帖子)。
- 完成标准为“每个社交网络分析约 20 条帖子”,但本次收集内容中与主题相关的只有 2 条。与其为了凑数强行分析无关帖子,不如只将真正涉及主题的 2 条作为发现。
- 本文件仅基于已收集的
output/x.posts.md/.posts.json数据编写,未对 X 进行追加搜索或浏览,符合 playbook 指示。因此,若改用 Stable Diffusion、Midjourney、Sora、Veo、开源视频模型等直接相关词重新搜索,很可能会得到不同结果,但这超出本次范围。
YouTube
YouTube — 图像与视频生成 AI 新闻(闭源与开源)
频道
- Qwen(阿里巴巴 Qwen 官方频道)— 直接发布模型上线公告,例如 Qwen-Image-2.0。
- Youri van Hofwegen — AI 视频工具评测者,制作 Seedance/Kling/Veo/Wan 等横向对比。
- DevsKingdom — 开源本地图像生成教程(FLUX.2、ComfyUI 工作流)。
- Vladimir Chopine [GeekatPlay] — 专注 ComfyUI,进行 Qwen、Z-Image、FLUX.2 klein、Ovis、LongCat 等多模型本地文生图对比。
- CyberJungle — 闭源模型发布反应/评测频道(GPT Image 2)。
- Creative AI Show — 闭源模型对比频道(Midjourney 与竞争对手)。
- Codedigipt — 在单个视频中追踪多个闭源模型发布的汇总频道(GPT、Grok Imagine 等)。
- Airt — 高产量 AI 视频生成展示频道(Wan 3.0 大型合集)。
- Prompt Engineer — 对热门说法与实际发布内容进行核查的解说频道(Wan 3.0 许可)。
- Zoom Vantage — 关注商业侧 AI 新闻的解说频道(Sora 停止)。
订阅者数量无法获取,详见 Limits。
视频
-
Why OpenAI Shut Down Sora So Fast: What's Next? — Zoom Vantage — https://www.youtube.com/watch?v=H2jVcy5PuBI — 认为 Sora 每日约 100 万美元的成本以及使用量下滑(峰值约 100 万用户降至不足 50 万,App Store 排名从第 1 名降至第 165 名)促使 OpenAI 关闭消费者应用;并根据官方弃用通知,将于 2026 年 9 月 24 日完全移除 Sora 2 API,且未列出替代模型。(闭源。)
-
🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Qwen(官方)— https://www.youtube.com/watch?v=1tM7Wd0lEeI — 2026 年 2 月 10 日 — 阿里巴巴官方频道宣布 Qwen-Image-2.0:一个 7B 模型,在原生 2K 分辨率下统一生成与编辑。(开源。)
-
Flux.2 Dev: The Best Free Image Generation Model Outperforms Nano Banana — DevsKingdom — https://www.youtube.com/watch?v=NCvbMKV9e8c — 2025 年 12 月 4 日 — 声称 Black Forest Labs 的免费、本地可运行 FLUX.2 Dev 在质量上超过 Google 的闭源 Nano Banana。(开源。)
-
ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat — Vladimir Chopine [GeekatPlay] — https://www.youtube.com/watch?v=IwZbOXCZZGM — 2026 年 3 月 6 日 — 对五个可在 ComfyUI 运行的当前开放权重文生图模型进行本地横向评测。(开源。)
-
OpenAI JUST Dropped GPT Image 2 and It's WILD (Nano Banana Pro Killer?) — CyberJungle — https://www.youtube.com/watch?v=Tj3jFnx5IW0 — 2026 年 4 月 21 日 — 对 GPT Image 2 上线作出反应,将其定位为 OpenAI 对 Google Nano Banana Pro 的回应;称其在 Artificial Analysis Image Arena 中排名第一(Elo 约 1,370),微软 MAI-Image-2.6 正在缩小差距。(闭源。)
-
MIDJOURNEY 8 — Compared to Nano Banana 2 & Midjourney V7 — Creative AI Show — https://www.youtube.com/watch?v=MgMZ6e2NBGA — 2026 年 3 月 19 日 — 将 Midjourney 新版 V8 与自身 V7 及 Google Nano Banana 2 进行基准比较。(闭源。)
-
Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 — Comparison — Youri van Hofwegen — https://www.youtube.com/watch?v=vw_Jk2-phsA — 2026 年 4 月 11 日 — 春季大量近似“Seedance 2.0 击败一切”对比视频之一;反映 ByteDance Seedance 2.0 在与 Kling、Sora、Veo 的视频模型对决中频繁胜出的明显趋势。(闭源。)
-
Best AI Video Generator in 2026 (Don't Choose Wrong) — Youri van Hofwegen — https://www.youtube.com/watch?v=PsJLCiWnZhM — 2026 年 8 月 3 日 — 更近期的汇总,面向 2026 年末用户比较 Seedance 2.0、Gemini“Omni Flash”、Kling 3.0 等。(闭源。)
-
Finally Got FR*EE GPT 5.6 Luna & Grok Imagine Image 2.0 Is INSANE & OpenAI New Cyber Model Astra — Codedigipt — https://www.youtube.com/watch?v=aqiTD2dESFU — 2026 年 8 月 8 日 — 近期汇总,涵盖 xAI Grok Imagine Image 2.0 上线及其他闭源模型新闻。(闭源。)
-
China Did It AGAIN? — 100+ Wan 3.0 AI Videos — Airt — https://www.youtube.com/watch?v=fNvv2u-1cGw — 2026 年 8 月上旬 — 展示 Alibaba Wan 3.0 公开测试(2026 年 8 月 6 日开放):生成时长从 Wan 2.7 的 15 秒提升至 30 秒,支持原生 1080p 与同步音频。名义上属于“开源谱系”,但请见 #11。
-
FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE — Prompt Engineer — https://www.youtube.com/watch?v=gbI8XV4Szrk — 2026 年 8 月下旬 — 核查视频指出,尽管 Wan 有开源声誉,阿里巴巴公开权重发布停留在 Wan 2.2;Wan 3.0 本身仅以计费的闭源付费 API 推出,没有开放权重。(值得注意的开放→封闭转向。)
信号
- Sora 的退出是目前 YouTube 上最大的闭源故事:多个视频将 2026 年 9 月 24 日 API 停止视为视频生成单位经济性的考验,而非能力失败;它们也明确指出 OpenAI 没有后继模型,并建议用户转向 Veo 3.1、Kling 3.0、Seedance 2.0 与 Wan 2.7。
- “X vs. Nano Banana / vs. Sora / vs. Kling”对比视频已成为主导且高度模板化的内容形式。每当新的闭源模型发布,同一批频道(Youri van Hofwegen、Creative AI Show)就会制作相近的对决视频,表明观众强烈需要“我该付费买哪个”的内容。
- 开源内容偏向 ComfyUI/本地安装教程(DevsKingdom、GeekatPlay),而非新闻反应。FLUX.2、Qwen-Image 与 Z-Image 的受众更偏向本地运行模型的开发者和爱好者,而不是普通大众。
- 开源与闭源的界线正在模糊甚至反转:此前作为开放权重代表的阿里巴巴(Wan 2.2、Qwen-Image、Z-Image),将最新旗舰 Wan 3.0 以没有权重的计费闭源 API 推出;专门的视频 #11 直接点出了这一点。
- 中国实验室(Alibaba/Tongyi、ByteDance 的 Seedance)主导了 2026 年中后期的视频生成讨论,在对比视频中反复被描述为击败或替代美国闭源模型(Sora、Veo)。
- 官方模型拥有者频道(如“Qwen”)本身也是 YouTube 上的一手新闻来源,通常与模型上线同步发布公告视频,值得与独立评测者一同视为主要信息源。
局限
- YouTube 搜索结果和观看页面由 JavaScript 渲染;直接 WebFetch
youtube.com/results?...与youtube.com/watch?v=...仅返回静态页脚及法律模板,无法获取视频网格、标题、播放量或评论,也无法读取页面评论。 - 为弥补这一点,使用了网页搜索(
site:youtube.com查询常会回退到非 YouTube 结果)以及 YouTube 公共 oEmbed 接口(youtube.com/oembed)确认列出视频的准确标题和频道名。oEmbed 不提供播放量或订阅量,因此未报告这些数据,所有相关数字都如实省略,而非猜测。 - 当 oEmbed 未提供上传日期时,日期仅为近似值,来自网页搜索摘要;通常精确到日,但偶尔只精确到月。
- 本轮覆盖偏向视频与对比内容,因为这类内容主导了搜索引擎已索引的 YouTube 结果;可能还有未被这些查询发现的较小频道或非英语内容。
Bluesky
Bluesky — 图像与视频生成 AI 新闻
调查方法说明
本次中,public.api.bsky.app 的 app.bsky.feed.searchPosts(全文搜索 API)针对 q=image generation AI、q=Stable Diffusion、q=cats 等多个查询均持续返回 HTTP 403,无法使用(详见 Limits)。因此改用 app.bsky.actor.searchActors(账号搜索,可正常工作)发现相关账号,并直接获取每个账号的 app.bsky.feed.getAuthorFeed 进行调查。
账号
- testingcatalog.com(🚨 AI News | TestingCatalog)https://bsky.app/profile/testingcatalog.com — AI 新闻快讯聚合器。每天发布数条关于代理、模型发布与泄露信息的内容,到 2026 年 9 月仍保持活跃。本次信息量最大的来源。
- genainews.bsky.social(Gen AI News 🅰︎ℹ︎)https://bsky.app/profile/genainews.bsky.social — 独立 AI 新闻聚合器,截至 2026-09-10 仍持续活跃发布。
- dfl.bsky.social(DFL inc.)https://bsky.app/profile/dfl.bsky.social — 类似机器人的账号,几乎每天发布由 Google“Nano Banana 2”生成的风景照片风格图像。2026 年 8 至 9 月持续日更,稳定获得 30 至 90 个赞。
- generate-cmyxt.bsky.social(Generate created Tech)https://bsky.app/profile/generate-cmyxt.bsky.social — 宣传与教程型账号,介绍 ComfyUI 以及开源视频/图像生成工作流,反复涉及 Flux、Wan、LTX、Qwen Image Edit、Ideogram 4、DreamOmni2 等。
- you32081.bsky.social(You32081)https://bsky.app/profile/you32081.bsky.social — 个人简介明确写有“R18 AI Photo/Illustration with Qwen-Image, Z-Image-Turbo”的 NSFW AI 艺术发布者。其个人工具选择反映了开源图像模型的实际使用情况。
- blackforestlabs.bsky.social(Flux 开发商 Black Forest Labs 官方)https://bsky.app/profile/blackforestlabs.bsky.social — 账号存在但帖子为 0,本次获取时信息流为空。
- stabilityai.bsky.social(Stability AI 官方)https://bsky.app/profile/stabilityai.bsky.social — 最新帖子为 2025-11-19,且主要与音乐生成(Stable Audio)有关,近期未见图像/视频模型发布公告。
- midjourneyofficial.bsky.social(Midjourney 官方)https://bsky.app/profile/midjourneyofficial.bsky.social — 仅在 2025-08 至 10 月活跃,之后未更新。
- civitai-bot.bsky.social(CivitaiCheckPoint 更新机器人)https://bsky.app/profile/civitai-bot.bsky.social — 自动发布 Civitai 新检查点的机器人,但获取到的最新帖子为 2024-05-09,之后似乎停止。
- artistsagainstai.bsky.social(Artists Against Billionaires & Their AI)https://bsky.app/profile/artistsagainstai.bsky.social — 反对 AI 艺术的草根账号,但可获取帖子只到 2025 年前半,未确认到近期活跃内容。
帖子
-
“OpenAI launches ChatGPT Images 2.5 with faster editing” — testingcatalog.com,2026-09-09,2 赞/1 转发 https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27 — 据链接文章,ChatGPT Images 2.5 提升了生成速度、输出清晰度、编辑准确性和主体一致性;增加了从手绘草图生成图像的“Sketch”功能,以及面向 API 的“Flare”(适合快速日常使用)与“Sunburst”(适合精细编辑)模型。闭源。
-
“ChatGPT Images 2.5 adds Sketch for doodle-based image generation” — genainews.bsky.social,2026-09-08 https://bsky.app/profile/genainews.bsky.social/post/3muzxnrah542m — 另一家聚合器独立报道了同一 OpenAI 发布。闭源。
-
“Visko launches Orbis, a new real-time AI video model” — testingcatalog.com,2026-08-31/09-01(发布两次)https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j — 据链接文章,Orbis 可在持续实时生成过程中修改提示词,并在长时间生成时保持场景记忆;支持 4K/24fps 输出和亚秒级更新,并声称在视频质量、运动与提示词遵从度测试中居首。闭源。
-
“Exclusive: Early outputs of Muse Video model from Meta” — testingcatalog.com,2026-08-19,2 赞 https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24 — 抢先展示 Meta 视频生成模型“Muse Video”的早期输出。闭源。
-
“Meta's Muse agent enters closed alpha with invite codes” — testingcatalog.com,2026-09-07,2 赞 https://bsky.app/profile/testingcatalog.com/post/3muv7evaa7a24 — Muse(Meta 个人代理,与 Muse 视频模型同属一个系列)进入封闭 alpha,通过邀请码开始部署。闭源。
-
“Tencent released open-source Hy4 preview model” — testingcatalog.com,2026-08-29 https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h — 据链接文章,这是一个拥有 770 亿参数、100 万 token 上下文的模型,面向软件、办公、游戏与研究用途开源;声称在内部测试中超过 GLM 5.3 与 Kimi K3。※这是文本专用 LLM,并非图像/视频生成模型,但作为腾讯将主要模型开源的动向,仍被 Bluesky AI 新闻账号报道。
-
“AI image generation / #Nano Banana 2” 连续发布 — dfl.bsky.social,2026-09-09,21 赞/1 转发(类似帖子几乎每日发布,通常有 30 至 90 个赞) https://bsky.app/profile/dfl.bsky.social/post/3mv4cwoxxks22 — 该账号每天以详细提示词标签发布 Google“Nano Banana 2”生成的日式及自然风景照片风图像。这是闭源模型已融入个人创作者日常使用的实例。
-
“Just dropped a full guide to the ultimate ComfyUI AI video stack 🔥 LTX-2.3 (video + native audio) + SCAIL-2 (perfect motion cloning) + FLUX (insane image quality)” — generate-cmyxt.bsky.social,2026-07-02 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mpo6tdclwk2i — 介绍并推广结合多种开源视频/图像生成工具的 ComfyUI 工作流。开源。
-
“🚀 Unlock Pro AI Design Workflows with Ideogram 4 Local Setup! Run the powerful open-weight text-to-image model locally via ComfyUI. No API costs, full privacy.” — generate-cmyxt.bsky.social,2026-06-13,3 赞 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mo6i5cm26k2q — 介绍 Ideogram 4 已开放权重并可通过 ComfyUI 本地运行。开源。
-
“Turn 1 image into cinematic 360° consistent character — FREE in ComfyUI! Qwen Image Edit + Multiple Angles LoRA” — generate-cmyxt.bsky.social,2026-02-27 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mfsmtbgzgs2n — 介绍将 Qwen Image Edit 与 LoRA 结合的免费工作流。开源。
信号
- Bluesky 的“AI 图像/视频生成新闻”领域由新闻聚合机器人主导,而非个人讨论。 testingcatalog.com、genainews.bsky.social 等快讯机器人每天转发数篇其他媒体文章;几乎看不到 Reddit 式的帖子内支持与反对讨论。
- 模型开发商官方账号在 Bluesky 上几乎处于沉默状态。 Black Forest Labs(Flux 开发商)发帖数为 0;Stability AI 最新帖子为 2025-11-19 且主要是音频生成;Midjourney 官方于 2025-10 停更;Civitai 新检查点通知机器人则在 2024-05 停止。因此,Bluesky 几乎不具备开源图像/视频生成模型“一手信息发布地”的作用。
- 开源相关内容不是由模型开发商,而是由个人工作流介绍和推广账号承担。 generate-cmyxt.bsky.social 等账号不断将 Flux、Wan、LTX、Qwen Image Edit、Ideogram 4、DreamOmni2 等作为 ComfyUI 工作流介绍;它们更多以实用技巧或推广形式传播,而非技术新闻。
- 闭源话题以 OpenAI(ChatGPT Images 2.5)、Google(Nano Banana 2)、Meta(Muse Video)和新兴公司 Visko(Orbis)等大厂或新玩家发布为中心,聚合机器人报道也呈现这一偏向。
- 个人创作者群体(账号搜索命中数十个)主要发布使用 Stable Diffusion/Qwen-Image/Ideogram 4/Krea 2 等工具制作的 AI 艺术及 NSFW 作品,更像创作社区而非新闻社区。也有反对 AI 图像生成的账号(artistsagainstai.bsky.social),但未确认到近期活跃发布。
局限
- Bluesky 官方全文搜索 API
app.bsky.feed.searchPosts对本次尝试的所有查询(image generation AI、video generation AI、Stable Diffusion、cats等,包括不相关测试词)持续返回 HTTP 403 Forbidden,从未可用。与此同时,app.bsky.actor.searchActors(账号搜索)、app.bsky.feed.getAuthorFeed(获取单个账号信息流)和app.bsky.feed.getPostThread(获取帖子详情)均正常工作。由于无法使用 playbook 推荐的“全文帖子搜索”,本次调查仅能做到从账号出发的间接调查。 https://bsky.app/search?q=...搜索结果页是 JavaScript 渲染的 SPA,fetch 工具无法获取正文。- 完成标准要求“分析约 20 条帖子”;受搜索 API 不可用限制,实际确认内容的为上述 10 条,以及各账号信息流中的相关帖子。虽然浏览了数十条一般内容,但可直接作为主题相关内容呈现的约 10 条,未达到 20 条目标。
- Black Forest Labs、Stability AI、Midjourney 官方与 Civitai 通知机器人等开源/工具侧主要账号大多近期停更或低频,导致 2026 年 9 月的 Bluesky 一手信息几乎无法获得。这不是有意遗漏,而是平台本身活动量较低所致。
- 未在 Bluesky 找到 X(Twitter)或 Reddit 那种明确讨论“闭源 vs 开源”的线程式对话。
Lemmy
Lemmy — 图像与视频生成 AI 动态(闭源/开源)
社区
- !«メールアドレス»(订阅者 5,708 人,创建于 2023-06-09)— 开源图像与视频生成工具信息的核心社区。实际主要是自动发布 HuggingFace/GitHub 新版本的机器人式信息流,仅在 2026-09-02 至 09-08 就出现超过 10 个新模型与 ComfyUI 扩展。
- !«メールアドレス»(订阅者 8,532 人)— 分享 AI 生成图像的场所,不限模型;也有使用 Nano Banana(Gemini 2.5 Flash Image)的帖子。
- !«メールアドレス»(订阅者 50 人)— 面向 Stable Diffusion 系抽象图像的小型社区。
- !«メールアドレス»(订阅者 8,176 人)— “为讨厌 AI 的人准备的地方”。以反对和批评生成式 AI 为主,图像/视频生成 AI 也经常成为批评对象。
- !«メールアドレス» — DC 电影相关社区,本次出现一条围绕 AI 使用的内容。
- !«メールアドレス» — 自动转发 Reddit 的 /r/ArtificialInteligence 等内容的镜像社区;需注意这不是 Lemmy 原生讨论。
- !«メールアドレス» — 以本地 LLM 为中心;近期帖子多为语言模型(Qwen3.8、GLM-5.3 等),几乎没有图像/视频生成模型话题。
帖子
-
MiniMax-H3 周边的 ComfyUI 生态迅速增加(开源)— !«メールアドレス»,集中发表于 2026-09-02 至 09-06。
- OpenVDN/vdn-minimax-h3(score 3,2026-09-05)— 面向 MiniMax-H3 的混合注意力加速。
- Saganaki22/ComfyUI-VDN-H3(score 4,2026-09-05)
- DANNY621/H3-World(score 3,2026-09-02)— 被介绍为首个基于 MiniMax-H3 的交互式世界模型。
- 同期还有“motion_enhancer”“MotionCache-FastVAE”“H3VAE_TRT”等超过 6 条连续的 VAE 加速与 LoRA 相关帖子,显示围绕视频生成模型 MiniMax-H3 的周边工具正在快速成长。
-
Viggle/Viggle-Animate(开源)— !«メールアドレス»,score 10,2026-09-05。https://huggingface.co/Viggle/Viggle-Animate — 一种从单张重绘帧替换视频角色的方法,是本次收集内容中得分最高的帖子。
-
Krea2-Turbo-Distill-4step-LoRA(开源)— !«メールアドレス»,score 2,2026-09-08。https://huggingface.co/lvladikov/Krea2-Turbo-Distill-4step-LoRA — 宣称可将步骤数减半、速度提升约 1.6 倍的蒸馏 LoRA。
-
LLaDA-Image: Building Strong Image Generators(开源/论文)— !«メールアドレス»,score 3,2026-09-04。https://arxiv.org/abs/2609.03796 — 一个使用 60 亿参数 Diffusion Transformer 的统一图像生成框架。
-
Google“Nano Banana”的 Earth AI 功能在发布一天后撤回(闭源)— !«メールアドレス»(Reddit 转发),score 1,2026-08-07。https://lemmy.durstig.online/post/52162 — Google Earth 新增通过 Gemini 2.5 Flash Image(Nano Banana)叠加合成图像的功能后,被用于制作核电站和军事设施的虚假图像。Google 次日停止该功能,并称“人们重视 Google Earth 的可信度”。
-
Midjourney 要求好莱坞工作室披露其生成式 AI 使用情况(闭源)— !«メールアドレス»,score 76(↑)/2(↓),2026-07-05。https://lemmy.today/post/56011946(原文:TechCrunch)— 在版权诉讼中,Midjourney 反过来要求涉案工作室披露其自身的 AI 使用情况。评论中有人指出“训练数据也应公开”,也有人认为 Disney 的版权立场存在双重标准。
-
DC Studios 被发现曾在《Supergirl》制作中使用 AI 生成概念图(偏闭源)— !«メールアドレス»,score 33(↑)/1(↓),2026-08-13(距离原帖 27 天)。https://lemmy.today/post/58316222 — 一段意外公开的幕后视频显示了 AI 生成图像工作流,DC 随后删除视频。评论指出界面看起来像 Midjourney 的生成页面。
-
使用 Qwen Image VAE 的动漫风格生成(开源)— !«メールアドレス»,2026-09-09。https://lemmy.dbzer0.com/post/75237492 — 使用 BASBetterAnimeStyleAnimaBase 模型、角色 LoRA 和 qwen_image_vae 生成;参数为 35 步、CFG7、Euler a。虽无评论、反应较少,但展示了 Qwen 图像组件确实在个人创作中被使用。
-
“为什么 dbzer0 到处都是 AI 垃圾和 AI 辩护者?”(反 AI 声音,背景信息)— !«メールアドレス»,2026-09-02。https://futurology.today/post/11938893 — 反对 dbzer0 系社区中大量开源图像生成帖子。显示 Lemmy 整体对 AI 生成内容的敌意氛围依然浓厚。
-
SDNext / stable_diffusion 社区的定期发布帖子(开源,参考)— !«メールアドレス»,从 2025 年下半年至 2026 年持续发布 SDNext 版本说明(例如:score 7,2025-10-31,https://lemmy.dbzer0.com/post/56684869 )。本次目标时间段内未发现对应帖子,但可作为该社区持续性质的背景信息。
信号
- Lemmy 中该主题的讨论实际上 高度集中于 !«メールアドレス»。但其中大多不是人类讨论,而是自动发布 HuggingFace/GitHub 新内容的信息流,评论也大多极少(0 至数条)。
- 最近一周(2026-09-02 至 09-09)开源侧最重要的话题是视频生成模型 MiniMax-H3;围绕它的 ComfyUI 节点、LoRA 和 VAE 加速工具每天出现。相比单一新模型发布,更显著的是“既有模型周边生态的快速扩张”。
- 闭源话题在 Lemmy 上不是围绕“新功能有多强”,而是集中于争议、诉讼和伦理问题(Nano Banana Earth AI 滥用、Midjourney 诉讼、DC Studios 隐性使用 AI)。即使搜索 Sora、Kling AI、Runway Gen、Ideogram、Veo 3 等主要闭源视频/图像服务,也没有找到单独新闻。
- Lemmy 整体对 AI 生成内容存在强烈敌意(如 !fuck_ai),无论开源或闭源,“AI slop”这个贬称都频繁出现。
局限
- Lemmy 搜索 API(
/api/v3/search)相关性较低,使用“image generation AI”等泛关键词时,会返回大量无关的政治和技术新闻,因此需要剔除噪音来筛选相关帖子。 - 对 Sora、Kling AI、Runway Gen、Ideogram、Veo 3、Grok Imagine 等主要闭源视频/图像生成服务逐一搜索后,均未找到相关帖子。可以认为这些话题在 Lemmy 上几乎没有流通。
- !«メールアドレス» 是 Reddit 自动转载,而非 Lemmy 原生社区讨论,因此仅作参考,基本未纳入主要发现。
- Lemmy 整体该主题帖子规模小,分数多为个位数至几十。对于 brief 的“分析约 20 条帖子”要求,直接相关帖子约 10 条已接近上限;再往后只会得到无关噪音(政治新闻、对 AI 泛泛的支持或反对)。应明确指出:Lemmy 在此主题上的样本量本身很小。
Pinterest — 图像与视频生成 AI 新闻
视觉主题
- “惊讶 YouTuber+Logo 墙”模板:在深色背景上,将霓虹蓝紫色的 OpenAI(旋涡)、Google(G)、Microsoft(田字)、Meta(∞)、DeepSeek(鲸鱼)、Nvidia、Notion、Grok(X)等 Logo 排成圆形,并在右侧放置一张留胡子男性的惊讶面孔。“AI NEWS”类缩略图反复采用这一构图,看起来是将 YouTube 视频缩略图直接转载至 Pinterest 的内容。[4, 19, 29, 44]
- 将 AI 拟人化为人形或机器人的面孔:光滑白色脸部的安卓机器人、穿西装的“机器人新闻主播”、透出电路的大脑、由绿色 Matrix 风格文字构成的人脸等,在行业新闻图中被反复使用。[2, 23, 27, 34, 40, 46, 50]
- Before/After・转换演示:将一张实拍图并排转换为“木块风”“折纸艺术”“乐高积木”“花朵构成”的网格(包括汽车转换例);VASA-1 从音频和一张面部照片生成带表情视频的网格;女性→孩子→男性的“AI Baby”合成;以及将黑白旧时代人群与喷涌而出的数字图像用镜头左右分割的“history generative AI”等。“实拍→AI 生成”的前后对比构图很常见。[6, 13, 18, 47]
- 竖版排行榜信息图:以工具 Logo、检查清单和“免费”徽章组成竖向比较表。列出 Runway、Pika、Kling AI、Luma AI(Dream Machine)、Canva AI、Hailuo AI、Synthesia、D-ID、Veed.io、Pictory、InVideo、Lumen5、Hyperwrite 等混合了闭源和开源的工具名。[10, 26]
- 深度伪造焦虑与验证类图形:红色“FAKE”印章、“AI VOICE DETECTORS”及“97% likely AI generated”徽章、放大镜与“?”、戴兜帽的可疑人物剪影等,以煽动对 AI 生成内容不信任和验证需求的图像构成独立主题。[2, 39]
- 企业发布活动与产品预告:Google Veo 2 预告图(游泳的狗、火烈鸟、动漫风少女)、Google Lumiere 演讲者与 Android 风格半身像、漏斗式图解 Gemini API 输入输出、Nvidia CEO Jensen Huang 演讲照片等,多张实际发布活动截图或合成图。[3, 9, 16, 44, 50]
- 技术导向图解非常少:50 条中只有一张展示扩散模型内部结构(Frozen T5 XXL、IF-I-M 400M、Stable Diffusion 4x 放大等)的图解,而且标题也不是技术讲解,而是煽动性的“OpenAI 的秘密图像生成工具即将登场”。[37]
重点 Pin
- #9 “Google Unveils Veo 2...” — Google Veo 2 官方预告图本身(游泳的狗、火烈鸟、动漫风少女)。#3(无标题)也是同一图像,同一素材被多次 Pin,说明存在内容复用或量产型账号。
- #47 “Microsoft Unveils VASA-1...” — 展示仅用一张静态图、音频片段及可选控制信号生成富有表情对话视频的演示网格,是视觉上最易理解的 token head 生成技术案例。
- #13(无标题) — 将实拍视频转换为“木块”“折纸”“乐高”“花朵”的 3×3 网格(含 Lumen 系水印),是视频风格转换病毒式呈现方式的典型。
- #32 “Breaking News Latest AI Developments...” — 日期为 2026 年 8 月 12 日的信息图,包含三项内容:Grok 4.6(自主完成数十步工作并带回成果物)、Gemini 以史上最快速度突破 10 亿用户(每日生成 1.5 亿张图像)、Honor 配备相机云台的机器人手机。
- #22(无标题,实质为“Today's AI News”) — 日期为 2026 年 5 月 20 日,汇总 Google I/O 2026 的搜索大改版(Gemini 3.5 Flash / Gemini Omni / Gemini Spark)、Apple 加强 AI 无障碍功能,以及 AI 智能眼镜竞争加剧。
- #26 “5+ Best AI Video Generation Websites” — 比较 Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI,并明确写着“最适合 Pinterest 视频 Pin、YouTube Shorts、TikTok”。这是以 Pinterest 自身为投稿目的地的工具介绍,具有自指性质。
- #10 “Best 10 AI FREE Video Generation Tools 2026” — Pictory/RunwayML/Veed.io/Synthesia/InVideo/Kling AI/D-ID/Lumen5/Canva AI/Hyperwrite AI 十选,附带“关注并点赞获取更多详细信息”的典型联盟营销引导。
- #2(无标题,"AI content and social media concerns") — 在病毒式猫照片上加盖“FAKE”红色印章,标有 1.2K 点赞/7.4K 浏览,并结合戴帽可疑人物和“?”符号,构成对 AI 生成内容不信任的主题。
- #39 “AI is Changing Everything!” — 以 AI 视频生成、AI 声音检测(97% 判定徽章)、AI 伦理与提示词工程为三大支柱,并附带“眼见不再为实”的警示语,是教育型信息图。
- #6 “7 Best AI Baby Generators...” — 介绍从女性与男性面部“预测孩子长相”的个人娱乐型病毒式 AI 工具。它代表的是消费者娱乐用途,而非行业新闻。
信号
- Pinterest 上浮现的“AI 新闻”几乎全是二手内容:YouTube 视频缩略图与汇总博客信息图,而不是一手信息。同一图片的复用(#3 与 #9 相同)及联盟营销引导(“LIKE & FOLLOW”、带“关注”按钮)很常见,其性质与 Reddit/X 的原生对话差异很大。
- 闭源侧在视觉上压倒性地呈现 Google(Veo 2、Lumiere、Gemini 3.5/Omni/Spark、Gemini 突破 10 亿用户)与 Microsoft(VASA-1)的发布。OpenAI/Anthropic 虽频繁出现名字(主要作为 Logo 墙元素),但 Pinterest 上单独的产品预告图明显少于 Google。
- 工具比较和排行榜式列表(如 #10、#26)是最典型的 Pinterest 原生内容,反映用户对可免费或低成本使用的闭源实用工具(Runway、Pika、Kling AI、Luma、Canva、Synthesia、D-ID、Veed.io、Hailuo)的实际兴趣很高。
- 深度伪造的不信任与检测(#2、#39)作为独立主题存在一定数量;“无法分辨真实与伪造”的焦虑与面向创作者的工具介绍并存。
- 消费者娱乐用途(根据脸预测孩子长相的“AI Baby”、把实拍转换为木块/花朵/乐高的风格转换滤镜)与行业产品发布新闻混在同一搜索结果里,新闻性内容与娱乐内容的边界模糊。
- 开源阵营存在感极低:Stable Diffusion、Flux、Qwen、Wan、Kling(中国开放系)、DeepSeek 等专有名只在一张扩散模型技术图解(#37,且标题偏煽动)和工具排行榜中的一项出现;没有找到介绍社区讨论或具体模型演进的 Pin。
- 有 2026 年 8 月 12 日(#32)、2026 年 5 月 20 日(#22)等含明确日期的信息图,说明收集到的图片集合本身包含近期内容。
局限
- 根据
platforms/pinterest.md的指示,未自行浏览 Pinterest;分析对象为工作线程已收集的output/pinterest.pins.md(50 条)及images/pinterest/manifest.json。 - 50 条中实际打开图像确认内容的是 23 条(#1, 2, 3, 4, 6, 9, 10, 13, 16, 18, 19, 21, 22, 23, 25, 26, 27, 29, 32, 34, 37, 39, 40, 44, 46, 47, 50 — 覆盖 brief.md 约 20 条的完成标准)。其余约 27 条仅检查了标题。
- 有 6 条原本标题为“(untitled)”,通过图片推测内容(#3, #11, #14, #15, #22, #31 中,实际确认图片的是 #3、#22;#11、#14、#15、#31 未确认)。
- Pinterest 的 Pin 不附带点赞、收藏、评论等互动指标,无法像 Reddit/X 一样定量比较哪些帖子表现更好。
- 图片内文字几乎全部为英语,本次 50 条中未发现日语或其他语言的 Pin。
建议行动
- 追踪 Sora API 停止(9/24)后,Veo 3.1、Kling 3.0、Seedance 2.0 与 Wan 系列的使用动向。
- 将 Wan 3.0 从“开放”转向“封闭”视为先例,持续监测其他开放权重实验室调整政策的风险。
- 在 Lemmy/HuggingFace 持续观察 MiniMax-H3 周边的 ComfyUI 工具群,以尽早发现下一个主要开源视频模型的信号。
- 将 X 的搜索关键词从依赖地区趋势改为图像与视频生成 AI 专有词(Stable Diffusion、Sora、Nano Banana 等),并重新调查。
- 将 Meta 等平台对 AI 生成有害内容的审核状况作为监管与声誉风险的先行指标进行跟踪。
- 持续观察 Nano Banana / Gemini Image 系列面向消费者的闭源功能扩展,将其作为竞争对手应对措施的指标。
收集图片


















































数据质量说明
X 收集的 40 条帖子中仅 2 条与主题相关,且搜索词依赖地区趋势,因此实际上未获得有效数据。Bluesky 和 Reddit 也受官方搜索 API 故障或单一查询限制,未达到约 20 条的完成标准。YouTube 和 Pinterest 则因页面结构限制,无法获取播放量、点赞数等互动指标。



