KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-09-10

阿里巴巴的 Wan 3.0 以不公开权重的付费 API 形式上线,OpenAI 则将于 9 月 24 日停止 Sora 2 API。视频生成 AI 正在中国厂商主导下重组,开放与封闭之间的边界也愈发模糊。

阿里巴巴的 Wan 3.0 以不公开权重的付费 API 形式上线,而 OpenAI 将于 9 月 24 日停止 Sora 2 API。视频生成 AI 正在中国厂商主导下重组,开放与封闭之间的边界也愈发模糊。

图像与视频生成 AI 新闻 — 2026-09-10

在闭源阵营,OpenAI 宣布将于 2026 年 9 月 24 日停止 Sora 2 API;与此同时,Google 的 Nano Banana 系列(Gemini 2.5 Flash Image、对标 ChatGPT Images 2.5)、Meta 的“Muse”及 xAI 的“Grok Imagine”等新模型接连发布,竞争版图仍在快速变化。开源阵营方面,阿里巴巴此前凭借 Wan 2.2 与 Qwen-Image 树立了“开放权重旗手”的形象,却将最新的 Wan 3.0 作为不公开权重的闭源 API 推出;本次最重要的发现正是开放与封闭的边界本身正在动摇。视频生成领域中,来自中国的模型(ByteDance Seedance 2.0、Alibaba Wan、MiniMax-H3)无论在对比视频还是 ComfyUI 生态中都愈发突出;与此同时,多个平台对 AI 生成内容真伪识别及内容审核失灵的担忧也在同步升温。本次调查覆盖 Reddit、X、YouTube、Bluesky、Lemmy 与 Pinterest 六个平台;除 X 外,均以某种形式收集到了与主题相关的内容。

跨平台观察

  • 开放/封闭的边界正在动摇:YouTube 上,有人直接批评阿里巴巴 Wan 3.0 与“开源旗手”的招牌相悖,实际上以不公开权重的付费 API 形式上线。Lemmy 同期的开源话题集中在 MiniMax-H3 周边的 ComfyUYI 生态,而闭源话题则偏向争议与诉讼(Nano Banana 对 Earth AI 的滥用、Midjourney 诉讼)。两大阵营已无法用“企业还是个人”这样简单的标准来划分。
  • Google“Nano Banana”系列模型成为多个平台的讨论中心:Bluesky 上 dfl.bsky.social 连日发布由 Nano Banana 2 生成的风景图;Lemmy 上,Nano Banana 的 Google Earth 合成功能因遭滥用而在发布一天后撤回;YouTube 上,GPT Image 2 被称作“Nano Banana Pro Killer”,Midjourney V8 也被拿来与 Nano Banana 2 对比。三个平台都出现了独立且明确的点名讨论。
  • 对 AI 生成内容的不信任与验证需求正在蔓延:Reddit 上有人讨论识别 AI 内容的具体视觉线索,也有人强烈反对让 LLM 伪装成手绘创作的方法;Pinterest 上出现使用“FAKE”印章和“97% likely AI generated”徽章的验证类信息图;Lemmy 中“AI slop”这一贬称频繁出现,反 AI 社群也颇具存在感。它们从不同角度表达了相同的不安。
  • 中国模型正在引领视频生成领域:YouTube 的对比视频中,ByteDance Seedance 2.0 反复以“击败” Kling、Sora 和 Veo 的叙事出现;Lemmy 上,以阿里系 MiniMax-H3 为核心的 ComfyUI 节点、LoRA 与 VAE 加速工具,仅在 2026-09-02 至 09-08 的一周内就有超过 10 条帖子。中国厂商在闭源与开源两端都展现出明显势头。
  • 对比与排行榜内容已经成为各平台的原生格式:YouTube 的“X vs Nano Banana/Sora/Kling”式对决视频、Pinterest 的十大免费 AI 视频生成工具信息图,以及 Reddit 的无限制图像生成工具排行帖,都以同样的形式体现了用户“究竟该用哪个”的实用关切。

平台逐一观察

Reddit:分析了已由工作线程收集的 12 个帖子(来自 10 个 subreddit)。一方面,用户讨论对宣称无审查、无限制的图像生成工具(WildOwl、Mage.space、PixelForge)的需求;另一方面,也讨论 Grok、ChatGPT 与 Gemini 对 IP 角色限制的收紧。与此同时,Meta 平台放任 AI 生成儿童虐待视频的问题(772pt,r/TrueReddit)以极高反应量浮现,获得了 1,024 条评论,成为对审核失灵担忧的突出案例。视频生成时长的限制(通常最多 5 至 15 秒)已经成为多个帖子中的共识。

X:收集的 40 条帖子、37 个账号中,真正涉及主题的只有 2 条:@DotCSV 对图像模型更新的简短反应,以及 @QingQ77 对 AI × 3D 生成代码库的介绍。由于搜索词来自当日克罗地亚周边的泛趋势(Apple、$LAPTOP、Hunter Biden 等),而不是图像或视频生成 AI,因此这一阶段实际上没有捕捉到主题的真实情况。

YouTube:从 11 个视频中确认了 OpenAI Sora 将于 2026 年 9 月 24 日停止 API 这一重大闭源新闻、GPT Image 2 与 Midjourney V8 等新模型动向,以及 Alibaba Wan 3.0 从“开放”转向“封闭”的变化。ComfyUI 与本地运行相关的教程视频(DevsKingdom、GeekatPlay)构成开源阵营的主要传播形式。由于页面由 JavaScript 渲染,无法获取播放量及订阅数。

Bluesky:全文搜索 API 对所有查询均返回 403,因此改用从账号出发的间接调查。testingcatalog.com、genainews.bsky.social 等新闻聚合机器人快速报道了 OpenAI“ChatGPT Images 2.5”与 Meta“Muse”的发布;另一方面,Black Forest Labs、Stability AI、Midjourney 官方及 Civitai 通知机器人等开源侧主要账号几乎沉默,未能作为一手信息源发挥作用。

Lemmy:内容高度集中于 !«メールアドレス»,主要是自动发布 HuggingFace/GitHub 新内容的订阅流。最近一周,MiniMax-H3 周边的 ComfyUI 生态是最热门的话题。闭源方面,即使搜索 Sora、Kling、Runway、Ideogram、Veo 3 等主要服务名也没有找到相关帖子;流传的反而只有 Nano Banana 滥用、Midjourney 诉讼等争议与伦理话题。

Pinterest:在 50 个 Pin 中详细检查了 23 个。绝大多数是转发 YouTube 视频缩略图或汇总博客信息图的二手内容,无法获取点赞、收藏等互动指标。Google Veo 2、Microsoft VASA-1 等大厂发布视觉内容较显眼;而开源阵营(Stable Diffusion、Flux、Qwen、Wan 等)只在一张技术图解和工具排行榜的一个条目中出现,存在感极低。

值得关注

建议

  • 追踪 Sora API 停止(9/24)后,Veo 3.1、Kling 3.0、Seedance 2.0 与 Wan 系列的使用动向。
  • 将 Wan 3.0 从“开放”转向“封闭”视为先例,持续监测其他开放权重实验室调整政策的风险。
  • 在 Lemmy/HuggingFace 持续观察 MiniMax-H3 周边的 ComfyUI 工具群,以尽早发现下一个主要开源视频模型的信号。
  • 将 X 的搜索关键词从依赖地区趋势改为图像与视频生成 AI 的专有词(Stable Diffusion、Sora、Nano Banana 等),并重新调查。
  • 将 Meta 等平台对 AI 生成有害内容的审核状况作为监管与声誉风险的先行指标进行跟踪。
  • 持续观察 Nano Banana / Gemini Image 系列面向消费者的闭源功能扩展,将其作为竞争对手应对措施的指标。

数据质量

  • X:收集了 40 条帖子,但其中仅 2 条(5%)与主题相关。搜索词依赖当日地区趋势(Apple、$LAPTOP、Hunter Biden 等),没有使用任何图像或视频生成 AI 专有词,因此该平台实际上几乎没有获得有效发现。
  • Bluesky:官方全文搜索 API(app.bsky.feed.searchPosts)对所有查询返回 403,无法使用,因此改为通过账号搜索进行间接调查。直接相关帖子约 10 条,未达到 20 条的完成标准。
  • Reddit:分析了工作线程收集的 12 个帖子(仅使用一条搜索查询)。未达到约 20 条的完成标准,尤其是针对开源模型的具体话题较少。
  • Lemmy:该主题本身帖子量较小,分数大多为个位数至几十。即使搜索 Sora、Kling、Runway、Ideogram、Veo 3 等主要闭源服务名,也没有找到相符帖子。
  • YouTube:由于页面由 JavaScript 渲染,WebFetch 无法获取视频网格、播放量和评论;仅通过 oEmbed 确认了视频标题和频道名。播放量和订阅数均标注为“无法获取”并省略。
  • Pinterest:Pin 不附带点赞、收藏等互动指标,无法定量比较哪些帖子表现更好。此外,收集内容大多是 YouTube 缩略图和博客文章转载,作为一手信息的价值有限。

各平台汇总

Reddit

Reddit — 图像与视频生成 AI 新闻

来源
  • r/AItips101(订阅者 1,210 人)— 1 条
  • r/antiai(订阅者 320,447 人)— 1 条
  • r/aivideomaking(订阅者 6,681 人)— 1 条
  • r/aiwars(订阅者 167,556 人)— 2 条
  • r/generativeAI(订阅者 151,900 人)— 2 条
  • r/freetoolsAI(订阅者 7,991 人)— 1 条
  • r/isthisAI(订阅者 407,630 人)— 1 条
  • r/RemoteWorkers(订阅者 76,520 人)— 1 条
  • r/ChatGPT(订阅者 11,626,217 人)— 1 条
  • r/TrueReddit(订阅者 628,511 人)— 1 条

共 12 个帖子,搜索查询仅为 "Image and Video Generation AI News"。

用户观点
  • 帖子 1“2026 年最佳无限制 AI 图像生成器”(r/AItips101,110pt,45 条评论,2026-09-07)https://www.reddit.com/r/AItips101/comments/1w9yftp/ — 一篇“无审查”AI 图像生成工具排行榜。第一名 WildOwl.ai 可访问 Qwen/Flux/Seedream/Wan/Kling/Seedance/Veo/GPT Image 等超过 35 种模型,卖点是不需要订阅且积分永不过期。评论中,u/reliablemicrophone84 称赞“WildOwl 正好解决了‘使用最新模型还是拥有自由’的二选一问题”;而 u/Clear-Assistance449 则推荐 Mage.space,认为其订阅内可以无限生成。无限制图像工具领域呈现出多产品并立的状态。

  • 帖子 2“警告:出现了一种新形式的 AI 生成图像”(r/antiai,7,130pt,1,024 条评论,2026-09-05)https://www.reddit.com/r/antiai/comments/1w81kdd/ — 一种让 LLM(GPT-6)获得鼠标和键盘控制权、直接在数字画板上“作画”的方法出现了;它甚至可以生成看似真实的创作延时视频,因此几乎无法再与“真正的艺术创作”区分。这篇警示帖以 1,024 条评论获得极高热度,是这 12 条中反应最大的帖子。热门评论 u/Nayutantantan(2,510pt)强烈反感:“现在连记录都没有意义了,为什么非要做到这个地步来假装是真正的艺术家?”

  • 帖子 11“Facebook 正在托管大量令人毛骨悚然的 AI 生成暴力儿童虐待视频……”(r/TrueReddit,772pt,40 条评论,2026-09-09)https://www.reddit.com/r/TrueReddit/comments/1wbnann/ — 分享一篇揭露 Meta(Facebook)上大量 AI 生成儿童虐待视频被放任的文章。评论者 u/mirh 引述 Meta 公关回应:“无论是实拍还是 AI 生成,描绘身体伤害的内容都有严格规定”,并称这些视频已被删除;但评论也指出,平台明明有检测系统却没有妥善使用。u/NinjaLion 警告称,Meta、X,最终可能还有 Reddit,正在走向“卖剑但不卖盔甲”的审核放弃路线。

  • 帖子 9“审查 AI 生成图像可获每小时 30 美元”(r/RemoteWorkers,175pt,828 条评论,2026-09-04)https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/ — 一则远程职位招聘,工作内容是核验 AI 生成字幕,时薪 30 美元。虽然有 828 条评论,但多数只是为了索取申请链接而重复发送“Images”的模板评论,几乎没有实质讨论。这是 AI 验证与评估劳动作为新职业类别迅速出现在 Reddit 上的实例。

  • 帖子 4“这是由 GPT 6 - Astra 在 Blender 中制作的渲染图(不是 AI 生成视频)”(r/aiwars,18pt,14 条评论,2026-09-06)https://www.reddit.com/r/aiwars/comments/1w96yaf/ — GPT-6“Astra”操作 Blender 制作渲染内容的视频在 X 上走红后被转发。u/not_food(6pt)表示:“等不及它能本地运行了。只要还存在价格调整、政策变化和服务器关闭后被撤掉梯子的风险,就不能用于工作。”这反映出对闭源依赖风险的意识。u/ComfortPhil(1pt)则困惑地说:“由 GPT-6 制作,但不是 AI 生成?我不明白。”

  • 帖子 10“更新后的图像生成器。试着找回‘怪异 AI 艺术’”(r/ChatGPT,32pt,26 条评论,2026-09-09)https://www.reddit.com/r/ChatGPT/comments/1wbdbdj/ — 尝试在当前 ChatGPT 图像生成中复现早期 Disco Diffusion/Stable Diffusion 的“怪异感”。u/Cubic_Inequality504(9pt)指出:“大家难道没发现吗?那些绘画般怪异的纹理还在,2.5 和 Image 2 完全一样。”这显示出部分用户对“更真实、更漂亮”的进化仍感到不满足。

  • 帖子 5“即使不少专业人士也会承认,当前 AI 模型很不擅长生成让人有食欲的食物图像”(r/aiwars,4pt,177 条评论,2026-09-03)https://www.reddit.com/r/aiwars/comments/1w69cdj/ — 批评 AI 生成的食品广告图“看起来不好吃”。u/LCI_Jake(14pt)严厉评价:“像是故意做得很恶心,看起来像虫巢。”不过 u/Bassed_Hummble(5pt)反驳称:“即便免费 Krea 2,40 秒生成也可以写出达到这个质量的提示词;企业为什么会用这么差的图?”双方对于问题究竟在模型还是提示词与运营上存在分歧。

  • 帖子 6“限制较少的 AI 图像生成器”(r/generativeAI,2pt,3 条评论,2026-09-08)https://www.reddit.com/r/generativeAI/comments/1waapc1/ — 用户咨询想为个人用途制作 Disney 角色同人图,但被 Grok 拦截。这个案例说明闭源大厂(Grok、ChatGPT、Gemini)正在收紧对 IP 角色生成的限制。u/frighten(1pt)建议 PixelForge 可能可以不受限制地运行。

  • 帖子 7“免费 AI 图像生成器”(r/freetoolsAI,40pt,51 条评论,2026-09-04)https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/ — 宣传一个无需注册、无限制、无水印的免费图像生成工具(aifreeforever.com)。u/Puzzleheaded_Lab4757(1pt)积极表示:“这个网站帮我节省了数百美元和很多时间”;但 u/Relevant_Syllabub895(2pt)抱怨“为什么大家都禁止 NSFW,不值得”。

  • 帖子 8“这个视频是 AI 生成的还是真实的?想听听能识别 AI 的人的意见”(r/isthisAI,0pt,31 条评论,2026-09-09)https://www.reddit.com/r/isthisAI/comments/1wbspxo/ — 希望大家判断视频是真实拍摄还是 AI 生成。u/BouncingSphinx(3pt)评论道:“这个视频正好 15 秒,这似乎就是当前 AI 视频的极限。”可作为反映视频时长技术上限的一手信息。u/smalltiddygothb(16pt)和 u/EmergencyWaffleBox(14pt)指出项链消失又重新出现这一具体伪影,作为识别线索。

  • 帖子 3“免费 AI 视频生成器”(r/aivideomaking,12pt,29 条评论,2026-09-07)https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/ — 用户询问是否能仅用手机或 iPad 免费制作 45 秒视频。u/NewLifeWares(2pt)解释了现实限制:“45 秒需要数据中心级别的硬件;免费额度最多也就是带水印的 5 秒视频。”这表明视频 AI 的免费额度仍主要受制于生成时长过短。

信号
  • 闭源侧对“无审查/无限制”工具的需求正在上升(WildOwl、Mage.space、PixelForge 等),并且与大厂(Grok、ChatGPT、Gemini)对 IP 角色限制收紧的情况在多个帖子中同时出现。限制越严格,介绍替代工具的帖子需求越高。
  • 对“隐藏或伪装 AI 生成身份”技术的强烈反感正在快速上升。帖子 2 中让 LLM 操作鼠标、使延时视频看似“真实”的方法获得 1,024 条评论,反应远超本次其他收集内容。尽管其来自 r/antiai,但“伪装真实性”的议题也与帖子 8 中寻找 AI 视频视觉识别线索的讨论相呼应。
  • 视频生成时长的限制(约 5 至 15 秒)仍被视为一道壁垒,帖子 3 和 8 的观点一致。对“免费 45 秒视频”的答复一致认为不可行,更多是共同认知而非立场之争。
  • 对画质的评价存在分歧:帖子 10 有人不满“即使进化了,怪异纹理仍未改变”;帖子 5 则认为问题不在模型极限,而在提示词能力。用户对 AI 图像质量该由谁负责有不同看法。
  • AI 相关的“人类工作”(字幕核验、时薪 30 美元)开始在 Reddit 招聘板上显眼出现,这表明随着 AI 图像与视频扩张,围绕“验证和监督生成内容”的辅助劳动也在增加。
  • 对审核失灵的担忧正成为跨平台话题(帖子 11)。虽然讨论的是 Meta 的个案,但评论者预期 X 与 Reddit 也可能走上同一路径;生成式 AI 扩张与平台审核体系之间的缺口可能成为后续风险点。
局限
  • 完成标准要求每个平台分析约 20 个帖子,但本次工作线程仅收集到 12 个帖子(来自 10 个 subreddit)。搜索词也只有 "Image and Video Generation AI News" 一条,未使用日语或其他英语查询(如“Stable Diffusion”“Midjourney”“Sora”“open source diffusion model”等具体工具名)继续搜索。相较于 brief.md 要求的闭源和开源各至少 10 条观察,仅靠本阶段的 12 个帖子可能样本略显不足。
  • 本次收集几乎未包含以具体开源模型名为主题的帖子,例如 Stable Diffusion 系列、ComfyUI、Civitai 以外的新模型;与闭源侧(WildOwl、ChatGPT、Grok、GPT-6 等)的讨论相比,开源话题较少。
  • r/RemoteWorkers 的帖子 9 虽有 828 条评论,但其中绝大多数为重复“Images”的模板评论,几乎没有可引用的实质讨论。
  • 本文件仅根据工作线程已收集的 output/reddit.threads.md / .json 编写,没有追加访问 Reddit(WebFetch/搜索),符合 playbook 指示。

X

X — 图像与视频生成 AI 新闻动态

账号

在收集到的 40 条帖子、37 个账号中,真正涉及本次研究主题(图像与视频生成 AI)的实际上只有 2 个账号。

  • @DotCSV(Carlos Santana) — 在西班牙语地区知名的 AI YouTuber/评论者。1 条帖子、890 个赞,在收集内容中属于中等规模反应。通过“AI OS”搜索命中,内容是对图像模型更新的简短反应。
  • @QingQ77(Geek Lite) — 1 条帖子、24 个赞的小型账号。介绍一个让 AI 代理在 Blender 中生成符合尺寸、可供 3D 打印零件的 GitHub 代码库(jangtrinh/design-os-3d-blender)。这不是图像或视频生成本身,而是 AI × 3D/CAD 生成的相邻领域。

其余 35 个账号每个收集到 1 至 3 条内容,主题包括 Apple 新品发布、$LAPTOP 迷因币、Real Madrid/足球、Hunter Biden、天主教争论、Love Island USA、动画直播(ABEMA“CHANCE & CHANGE”)等,均与图像和视频生成 AI 无关,不能作为本主题的信息源。

帖子
  • #19 @DotCSV — 890 likes・46 reposts・15 replies・约 63,000 views・2026-09-08
    https://x.com/DotCSV/status/2097406200006537543(通过“AI OS”搜索命中)

    "Fuck, and on top of that, they roll out an update to the image model... just in case the math milestone wasn't enough for you."
    唯一提到图像模型更新的帖子。但正文无法确认具体是哪一模型或哪家公司,且只是一次性的反应。

  • #17 @QingQ77 — 24 likes・2 reposts・15 replies・约 2,300 views・2026-09-08
    https://x.com/QingQ77/status/2097258894280347971(通过“AI OS”搜索命中)

    "Let AI agents build real parts with correct dimensions and 3D printability according to specifications in Blender 5.2, directly connecting to the printing production stage." (附 GitHub:jangtrinh/design-os-3d-blender 链接)
    虽非图像或视频生成本身,但可作为同类趋势已扩展至 3D/CAD 领域的例子:AI 可将生成结果直接接入生产流程。不过互动较少,仍属小众范围。

其余 38 条帖子(通过“Apple”“$LAPTOP”“Hunter Biden”“iPhone”“Real Madrid”“Harvey”“Germans”“#chance”“Catholic”搜索命中,以及“AI OS”命中的另外 2 条)均与图像和视频生成 AI 无关,因此未纳入发现。

信号
  • 本阶段最明确的“信号”是,收集到的帖子群本身几乎与主题无关。40 条中只有 2 条涉及图像与视频生成 AI(无论闭源还是开源),且两者都缺乏一手信息价值,只是单次感想或代码库分享。
  • 唯一触及主题的 @DotCSV 帖子表明,AI 领域影响者对图像模型更新作出反应时仍可获得一定传播(约 63,000 次浏览),但没有提及具体模型名或功能,无法用于后续验证。
  • Stable Diffusion、Midjourney、Flux、Sora、Veo、Runway、Kling、Seedance、ComfyUI、Civitai、Nano Banana 等本应直接关联主题的专有名称,一个都没有出现在搜索词中。因此,本次收集无法说明 X 上有关这些主题的实际讨论量和热度。
局限
  • 搜索词与主题不匹配。按照 playbook,工作线程直接使用 X Explore 页面中显示的趋势词;该页面基于本会话连接服务器所在地显示“Trending in Croatia”:Apple/$LAPTOP/Hunter Biden/iPhone/AI OS/Real Madrid/Harvey/Germans/#chance/Catholic。这些是克罗地亚周边当日的泛趋势,而不是围绕图像和视频生成 AI 构建的查询。因此,除“AI OS”外的 9 个词(约 30 条帖子)都与主题无关。
  • 即便“AI OS”搜索中,4 条结果里也有 2 条无关(#18 是地区民意调查偏差话题,#20 是“ai os cat beanie”的无关帖子)。
  • 完成标准为“每个社交网络分析约 20 条帖子”,但本次收集内容中与主题相关的只有 2 条。与其为了凑数强行分析无关帖子,不如只将真正涉及主题的 2 条作为发现。
  • 本文件仅基于已收集的 output/x.posts.md / .posts.json 数据编写,未对 X 进行追加搜索或浏览,符合 playbook 指示。因此,若改用 Stable Diffusion、Midjourney、Sora、Veo、开源视频模型等直接相关词重新搜索,很可能会得到不同结果,但这超出本次范围。

YouTube

YouTube — 图像与视频生成 AI 新闻(闭源与开源)

频道
  • Qwen(阿里巴巴 Qwen 官方频道)— 直接发布模型上线公告,例如 Qwen-Image-2.0。
  • Youri van Hofwegen — AI 视频工具评测者,制作 Seedance/Kling/Veo/Wan 等横向对比。
  • DevsKingdom — 开源本地图像生成教程(FLUX.2、ComfyUI 工作流)。
  • Vladimir Chopine [GeekatPlay] — 专注 ComfyUI,进行 Qwen、Z-Image、FLUX.2 klein、Ovis、LongCat 等多模型本地文生图对比。
  • CyberJungle — 闭源模型发布反应/评测频道(GPT Image 2)。
  • Creative AI Show — 闭源模型对比频道(Midjourney 与竞争对手)。
  • Codedigipt — 在单个视频中追踪多个闭源模型发布的汇总频道(GPT、Grok Imagine 等)。
  • Airt — 高产量 AI 视频生成展示频道(Wan 3.0 大型合集)。
  • Prompt Engineer — 对热门说法与实际发布内容进行核查的解说频道(Wan 3.0 许可)。
  • Zoom Vantage — 关注商业侧 AI 新闻的解说频道(Sora 停止)。

订阅者数量无法获取,详见 Limits。

视频
  1. Why OpenAI Shut Down Sora So Fast: What's Next? — Zoom Vantage — https://www.youtube.com/watch?v=H2jVcy5PuBI — 认为 Sora 每日约 100 万美元的成本以及使用量下滑(峰值约 100 万用户降至不足 50 万,App Store 排名从第 1 名降至第 165 名)促使 OpenAI 关闭消费者应用;并根据官方弃用通知,将于 2026 年 9 月 24 日完全移除 Sora 2 API,且未列出替代模型。(闭源。)

  2. 🚀 Introducing Qwen-Image-2.0 — our next-gen image generation model! — Qwen(官方)— https://www.youtube.com/watch?v=1tM7Wd0lEeI — 2026 年 2 月 10 日 — 阿里巴巴官方频道宣布 Qwen-Image-2.0:一个 7B 模型,在原生 2K 分辨率下统一生成与编辑。(开源。)

  3. Flux.2 Dev: The Best Free Image Generation Model Outperforms Nano Banana — DevsKingdom — https://www.youtube.com/watch?v=NCvbMKV9e8c — 2025 年 12 月 4 日 — 声称 Black Forest Labs 的免费、本地可运行 FLUX.2 Dev 在质量上超过 Google 的闭源 Nano Banana。(开源。)

  4. ComfyUI Text-to-Image Models Compared (Local): Qwen 2512, Z-Image, FLUX.2 klein, Ovis, LongCat — Vladimir Chopine [GeekatPlay] — https://www.youtube.com/watch?v=IwZbOXCZZGM — 2026 年 3 月 6 日 — 对五个可在 ComfyUI 运行的当前开放权重文生图模型进行本地横向评测。(开源。)

  5. OpenAI JUST Dropped GPT Image 2 and It's WILD (Nano Banana Pro Killer?) — CyberJungle — https://www.youtube.com/watch?v=Tj3jFnx5IW0 — 2026 年 4 月 21 日 — 对 GPT Image 2 上线作出反应,将其定位为 OpenAI 对 Google Nano Banana Pro 的回应;称其在 Artificial Analysis Image Arena 中排名第一(Elo 约 1,370),微软 MAI-Image-2.6 正在缩小差距。(闭源。)

  6. MIDJOURNEY 8 — Compared to Nano Banana 2 & Midjourney V7 — Creative AI Show — https://www.youtube.com/watch?v=MgMZ6e2NBGA — 2026 年 3 月 19 日 — 将 Midjourney 新版 V8 与自身 V7 及 Google Nano Banana 2 进行基准比较。(闭源。)

  7. Seedance 2.0 Just Destroyed Kling 3.0, Sora 2 & VEO 3.1 — Comparison — Youri van Hofwegen — https://www.youtube.com/watch?v=vw_Jk2-phsA — 2026 年 4 月 11 日 — 春季大量近似“Seedance 2.0 击败一切”对比视频之一;反映 ByteDance Seedance 2.0 在与 Kling、Sora、Veo 的视频模型对决中频繁胜出的明显趋势。(闭源。)

  8. Best AI Video Generator in 2026 (Don't Choose Wrong) — Youri van Hofwegen — https://www.youtube.com/watch?v=PsJLCiWnZhM — 2026 年 8 月 3 日 — 更近期的汇总,面向 2026 年末用户比较 Seedance 2.0、Gemini“Omni Flash”、Kling 3.0 等。(闭源。)

  9. Finally Got FR*EE GPT 5.6 Luna & Grok Imagine Image 2.0 Is INSANE & OpenAI New Cyber Model Astra — Codedigipt — https://www.youtube.com/watch?v=aqiTD2dESFU — 2026 年 8 月 8 日 — 近期汇总,涵盖 xAI Grok Imagine Image 2.0 上线及其他闭源模型新闻。(闭源。)

  10. China Did It AGAIN? — 100+ Wan 3.0 AI Videos — Airt — https://www.youtube.com/watch?v=fNvv2u-1cGw — 2026 年 8 月上旬 — 展示 Alibaba Wan 3.0 公开测试(2026 年 8 月 6 日开放):生成时长从 Wan 2.7 的 15 秒提升至 30 秒,支持原生 1080p 与同步音频。名义上属于“开源谱系”,但请见 #11。

  11. FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE — Prompt Engineer — https://www.youtube.com/watch?v=gbI8XV4Szrk — 2026 年 8 月下旬 — 核查视频指出,尽管 Wan 有开源声誉,阿里巴巴公开权重发布停留在 Wan 2.2;Wan 3.0 本身仅以计费的闭源付费 API 推出,没有开放权重。(值得注意的开放→封闭转向。)

信号
  • Sora 的退出是目前 YouTube 上最大的闭源故事:多个视频将 2026 年 9 月 24 日 API 停止视为视频生成单位经济性的考验,而非能力失败;它们也明确指出 OpenAI 没有后继模型,并建议用户转向 Veo 3.1、Kling 3.0、Seedance 2.0 与 Wan 2.7。
  • “X vs. Nano Banana / vs. Sora / vs. Kling”对比视频已成为主导且高度模板化的内容形式。每当新的闭源模型发布,同一批频道(Youri van Hofwegen、Creative AI Show)就会制作相近的对决视频,表明观众强烈需要“我该付费买哪个”的内容。
  • 开源内容偏向 ComfyUI/本地安装教程(DevsKingdom、GeekatPlay),而非新闻反应。FLUX.2、Qwen-Image 与 Z-Image 的受众更偏向本地运行模型的开发者和爱好者,而不是普通大众。
  • 开源与闭源的界线正在模糊甚至反转:此前作为开放权重代表的阿里巴巴(Wan 2.2、Qwen-Image、Z-Image),将最新旗舰 Wan 3.0 以没有权重的计费闭源 API 推出;专门的视频 #11 直接点出了这一点。
  • 中国实验室(Alibaba/Tongyi、ByteDance 的 Seedance)主导了 2026 年中后期的视频生成讨论,在对比视频中反复被描述为击败或替代美国闭源模型(Sora、Veo)。
  • 官方模型拥有者频道(如“Qwen”)本身也是 YouTube 上的一手新闻来源,通常与模型上线同步发布公告视频,值得与独立评测者一同视为主要信息源。
局限
  • YouTube 搜索结果和观看页面由 JavaScript 渲染;直接 WebFetch youtube.com/results?...youtube.com/watch?v=... 仅返回静态页脚及法律模板,无法获取视频网格、标题、播放量或评论,也无法读取页面评论。
  • 为弥补这一点,使用了网页搜索(site:youtube.com 查询常会回退到非 YouTube 结果)以及 YouTube 公共 oEmbed 接口(youtube.com/oembed)确认列出视频的准确标题和频道名。oEmbed 不提供播放量或订阅量,因此未报告这些数据,所有相关数字都如实省略,而非猜测。
  • 当 oEmbed 未提供上传日期时,日期仅为近似值,来自网页搜索摘要;通常精确到日,但偶尔只精确到月。
  • 本轮覆盖偏向视频与对比内容,因为这类内容主导了搜索引擎已索引的 YouTube 结果;可能还有未被这些查询发现的较小频道或非英语内容。

Bluesky

Bluesky — 图像与视频生成 AI 新闻

调查方法说明

本次中,public.api.bsky.appapp.bsky.feed.searchPosts(全文搜索 API)针对 q=image generation AIq=Stable Diffusionq=cats 等多个查询均持续返回 HTTP 403,无法使用(详见 Limits)。因此改用 app.bsky.actor.searchActors(账号搜索,可正常工作)发现相关账号,并直接获取每个账号的 app.bsky.feed.getAuthorFeed 进行调查。

账号
帖子
  1. “OpenAI launches ChatGPT Images 2.5 with faster editing” — testingcatalog.com,2026-09-09,2 赞/1 转发 https://bsky.app/profile/testingcatalog.com/post/3mv3hn2whdz27 — 据链接文章,ChatGPT Images 2.5 提升了生成速度、输出清晰度、编辑准确性和主体一致性;增加了从手绘草图生成图像的“Sketch”功能,以及面向 API 的“Flare”(适合快速日常使用)与“Sunburst”(适合精细编辑)模型。闭源。

  2. “ChatGPT Images 2.5 adds Sketch for doodle-based image generation” — genainews.bsky.social,2026-09-08 https://bsky.app/profile/genainews.bsky.social/post/3muzxnrah542m — 另一家聚合器独立报道了同一 OpenAI 发布。闭源。

  3. “Visko launches Orbis, a new real-time AI video model” — testingcatalog.com,2026-08-31/09-01(发布两次)https://bsky.app/profile/testingcatalog.com/post/3muhthn6m7i2j — 据链接文章,Orbis 可在持续实时生成过程中修改提示词,并在长时间生成时保持场景记忆;支持 4K/24fps 输出和亚秒级更新,并声称在视频质量、运动与提示词遵从度测试中居首。闭源。

  4. “Exclusive: Early outputs of Muse Video model from Meta” — testingcatalog.com,2026-08-19,2 赞 https://bsky.app/profile/testingcatalog.com/post/3mthtr6iu7p24 — 抢先展示 Meta 视频生成模型“Muse Video”的早期输出。闭源。

  5. “Meta's Muse agent enters closed alpha with invite codes” — testingcatalog.com,2026-09-07,2 赞 https://bsky.app/profile/testingcatalog.com/post/3muv7evaa7a24 — Muse(Meta 个人代理,与 Muse 视频模型同属一个系列)进入封闭 alpha,通过邀请码开始部署。闭源。

  6. “Tencent released open-source Hy4 preview model” — testingcatalog.com,2026-08-29 https://bsky.app/profile/testingcatalog.com/post/3mu7v3bdkwo2h — 据链接文章,这是一个拥有 770 亿参数、100 万 token 上下文的模型,面向软件、办公、游戏与研究用途开源;声称在内部测试中超过 GLM 5.3 与 Kimi K3。※这是文本专用 LLM,并非图像/视频生成模型,但作为腾讯将主要模型开源的动向,仍被 Bluesky AI 新闻账号报道。

  7. “AI image generation / #Nano Banana 2” 连续发布 — dfl.bsky.social,2026-09-09,21 赞/1 转发(类似帖子几乎每日发布,通常有 30 至 90 个赞) https://bsky.app/profile/dfl.bsky.social/post/3mv4cwoxxks22 — 该账号每天以详细提示词标签发布 Google“Nano Banana 2”生成的日式及自然风景照片风图像。这是闭源模型已融入个人创作者日常使用的实例。

  8. “Just dropped a full guide to the ultimate ComfyUI AI video stack 🔥 LTX-2.3 (video + native audio) + SCAIL-2 (perfect motion cloning) + FLUX (insane image quality)” — generate-cmyxt.bsky.social,2026-07-02 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mpo6tdclwk2i — 介绍并推广结合多种开源视频/图像生成工具的 ComfyUI 工作流。开源。

  9. “🚀 Unlock Pro AI Design Workflows with Ideogram 4 Local Setup! Run the powerful open-weight text-to-image model locally via ComfyUI. No API costs, full privacy.” — generate-cmyxt.bsky.social,2026-06-13,3 赞 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mo6i5cm26k2q — 介绍 Ideogram 4 已开放权重并可通过 ComfyUI 本地运行。开源。

  10. “Turn 1 image into cinematic 360° consistent character — FREE in ComfyUI! Qwen Image Edit + Multiple Angles LoRA” — generate-cmyxt.bsky.social,2026-02-27 https://bsky.app/profile/generate-cmyxt.bsky.social/post/3mfsmtbgzgs2n — 介绍将 Qwen Image Edit 与 LoRA 结合的免费工作流。开源。

信号
  • Bluesky 的“AI 图像/视频生成新闻”领域由新闻聚合机器人主导,而非个人讨论。 testingcatalog.com、genainews.bsky.social 等快讯机器人每天转发数篇其他媒体文章;几乎看不到 Reddit 式的帖子内支持与反对讨论。
  • 模型开发商官方账号在 Bluesky 上几乎处于沉默状态。 Black Forest Labs(Flux 开发商)发帖数为 0;Stability AI 最新帖子为 2025-11-19 且主要是音频生成;Midjourney 官方于 2025-10 停更;Civitai 新检查点通知机器人则在 2024-05 停止。因此,Bluesky 几乎不具备开源图像/视频生成模型“一手信息发布地”的作用。
  • 开源相关内容不是由模型开发商,而是由个人工作流介绍和推广账号承担。 generate-cmyxt.bsky.social 等账号不断将 Flux、Wan、LTX、Qwen Image Edit、Ideogram 4、DreamOmni2 等作为 ComfyUI 工作流介绍;它们更多以实用技巧或推广形式传播,而非技术新闻。
  • 闭源话题以 OpenAI(ChatGPT Images 2.5)、Google(Nano Banana 2)、Meta(Muse Video)和新兴公司 Visko(Orbis)等大厂或新玩家发布为中心,聚合机器人报道也呈现这一偏向。
  • 个人创作者群体(账号搜索命中数十个)主要发布使用 Stable Diffusion/Qwen-Image/Ideogram 4/Krea 2 等工具制作的 AI 艺术及 NSFW 作品,更像创作社区而非新闻社区。也有反对 AI 图像生成的账号(artistsagainstai.bsky.social),但未确认到近期活跃发布。
局限
  • Bluesky 官方全文搜索 API app.bsky.feed.searchPosts 对本次尝试的所有查询(image generation AIvideo generation AIStable Diffusioncats 等,包括不相关测试词)持续返回 HTTP 403 Forbidden,从未可用。与此同时,app.bsky.actor.searchActors(账号搜索)、app.bsky.feed.getAuthorFeed(获取单个账号信息流)和 app.bsky.feed.getPostThread(获取帖子详情)均正常工作。由于无法使用 playbook 推荐的“全文帖子搜索”,本次调查仅能做到从账号出发的间接调查。
  • https://bsky.app/search?q=... 搜索结果页是 JavaScript 渲染的 SPA,fetch 工具无法获取正文。
  • 完成标准要求“分析约 20 条帖子”;受搜索 API 不可用限制,实际确认内容的为上述 10 条,以及各账号信息流中的相关帖子。虽然浏览了数十条一般内容,但可直接作为主题相关内容呈现的约 10 条,未达到 20 条目标。
  • Black Forest Labs、Stability AI、Midjourney 官方与 Civitai 通知机器人等开源/工具侧主要账号大多近期停更或低频,导致 2026 年 9 月的 Bluesky 一手信息几乎无法获得。这不是有意遗漏,而是平台本身活动量较低所致。
  • 未在 Bluesky 找到 X(Twitter)或 Reddit 那种明确讨论“闭源 vs 开源”的线程式对话。

Lemmy

Lemmy — 图像与视频生成 AI 动态(闭源/开源)

社区
  • !«メールアドレス»(订阅者 5,708 人,创建于 2023-06-09)— 开源图像与视频生成工具信息的核心社区。实际主要是自动发布 HuggingFace/GitHub 新版本的机器人式信息流,仅在 2026-09-02 至 09-08 就出现超过 10 个新模型与 ComfyUI 扩展。
  • !«メールアドレス»(订阅者 8,532 人)— 分享 AI 生成图像的场所,不限模型;也有使用 Nano Banana(Gemini 2.5 Flash Image)的帖子。
  • !«メールアドレス»(订阅者 50 人)— 面向 Stable Diffusion 系抽象图像的小型社区。
  • !«メールアドレス»(订阅者 8,176 人)— “为讨厌 AI 的人准备的地方”。以反对和批评生成式 AI 为主,图像/视频生成 AI 也经常成为批评对象。
  • !«メールアドレス» — DC 电影相关社区,本次出现一条围绕 AI 使用的内容。
  • !«メールアドレス» — 自动转发 Reddit 的 /r/ArtificialInteligence 等内容的镜像社区;需注意这不是 Lemmy 原生讨论。
  • !«メールアドレス» — 以本地 LLM 为中心;近期帖子多为语言模型(Qwen3.8、GLM-5.3 等),几乎没有图像/视频生成模型话题。
帖子
  1. MiniMax-H3 周边的 ComfyUI 生态迅速增加(开源)— !«メールアドレス»,集中发表于 2026-09-02 至 09-06。

    • OpenVDN/vdn-minimax-h3(score 3,2026-09-05)— 面向 MiniMax-H3 的混合注意力加速。
    • Saganaki22/ComfyUI-VDN-H3(score 4,2026-09-05)
    • DANNY621/H3-World(score 3,2026-09-02)— 被介绍为首个基于 MiniMax-H3 的交互式世界模型。
    • 同期还有“motion_enhancer”“MotionCache-FastVAE”“H3VAE_TRT”等超过 6 条连续的 VAE 加速与 LoRA 相关帖子,显示围绕视频生成模型 MiniMax-H3 的周边工具正在快速成长。
  2. Viggle/Viggle-Animate(开源)— !«メールアドレス»,score 10,2026-09-05。https://huggingface.co/Viggle/Viggle-Animate — 一种从单张重绘帧替换视频角色的方法,是本次收集内容中得分最高的帖子。

  3. Krea2-Turbo-Distill-4step-LoRA(开源)— !«メールアドレス»,score 2,2026-09-08。https://huggingface.co/lvladikov/Krea2-Turbo-Distill-4step-LoRA — 宣称可将步骤数减半、速度提升约 1.6 倍的蒸馏 LoRA。

  4. LLaDA-Image: Building Strong Image Generators(开源/论文)— !«メールアドレス»,score 3,2026-09-04。https://arxiv.org/abs/2609.03796 — 一个使用 60 亿参数 Diffusion Transformer 的统一图像生成框架。

  5. Google“Nano Banana”的 Earth AI 功能在发布一天后撤回(闭源)— !«メールアドレス»(Reddit 转发),score 1,2026-08-07。https://lemmy.durstig.online/post/52162 — Google Earth 新增通过 Gemini 2.5 Flash Image(Nano Banana)叠加合成图像的功能后,被用于制作核电站和军事设施的虚假图像。Google 次日停止该功能,并称“人们重视 Google Earth 的可信度”。

  6. Midjourney 要求好莱坞工作室披露其生成式 AI 使用情况(闭源)— !«メールアドレス»,score 76(↑)/2(↓),2026-07-05。https://lemmy.today/post/56011946(原文:TechCrunch)— 在版权诉讼中,Midjourney 反过来要求涉案工作室披露其自身的 AI 使用情况。评论中有人指出“训练数据也应公开”,也有人认为 Disney 的版权立场存在双重标准。

  7. DC Studios 被发现曾在《Supergirl》制作中使用 AI 生成概念图(偏闭源)— !«メールアドレス»,score 33(↑)/1(↓),2026-08-13(距离原帖 27 天)。https://lemmy.today/post/58316222 — 一段意外公开的幕后视频显示了 AI 生成图像工作流,DC 随后删除视频。评论指出界面看起来像 Midjourney 的生成页面。

  8. 使用 Qwen Image VAE 的动漫风格生成(开源)— !«メールアドレス»,2026-09-09。https://lemmy.dbzer0.com/post/75237492 — 使用 BASBetterAnimeStyleAnimaBase 模型、角色 LoRA 和 qwen_image_vae 生成;参数为 35 步、CFG7、Euler a。虽无评论、反应较少,但展示了 Qwen 图像组件确实在个人创作中被使用。

  9. “为什么 dbzer0 到处都是 AI 垃圾和 AI 辩护者?”(反 AI 声音,背景信息)— !«メールアドレス»,2026-09-02。https://futurology.today/post/11938893 — 反对 dbzer0 系社区中大量开源图像生成帖子。显示 Lemmy 整体对 AI 生成内容的敌意氛围依然浓厚。

  10. SDNext / stable_diffusion 社区的定期发布帖子(开源,参考)— !«メールアドレス»,从 2025 年下半年至 2026 年持续发布 SDNext 版本说明(例如:score 7,2025-10-31,https://lemmy.dbzer0.com/post/56684869 )。本次目标时间段内未发现对应帖子,但可作为该社区持续性质的背景信息。

信号
  • Lemmy 中该主题的讨论实际上 高度集中于 !«メールアドレス»。但其中大多不是人类讨论,而是自动发布 HuggingFace/GitHub 新内容的信息流,评论也大多极少(0 至数条)。
  • 最近一周(2026-09-02 至 09-09)开源侧最重要的话题是视频生成模型 MiniMax-H3;围绕它的 ComfyUI 节点、LoRA 和 VAE 加速工具每天出现。相比单一新模型发布,更显著的是“既有模型周边生态的快速扩张”。
  • 闭源话题在 Lemmy 上不是围绕“新功能有多强”,而是集中于争议、诉讼和伦理问题(Nano Banana Earth AI 滥用、Midjourney 诉讼、DC Studios 隐性使用 AI)。即使搜索 Sora、Kling AI、Runway Gen、Ideogram、Veo 3 等主要闭源视频/图像服务,也没有找到单独新闻。
  • Lemmy 整体对 AI 生成内容存在强烈敌意(如 !fuck_ai),无论开源或闭源,“AI slop”这个贬称都频繁出现。
局限
  • Lemmy 搜索 API(/api/v3/search)相关性较低,使用“image generation AI”等泛关键词时,会返回大量无关的政治和技术新闻,因此需要剔除噪音来筛选相关帖子。
  • 对 Sora、Kling AI、Runway Gen、Ideogram、Veo 3、Grok Imagine 等主要闭源视频/图像生成服务逐一搜索后,均未找到相关帖子。可以认为这些话题在 Lemmy 上几乎没有流通。
  • !«メールアドレス» 是 Reddit 自动转载,而非 Lemmy 原生社区讨论,因此仅作参考,基本未纳入主要发现。
  • Lemmy 整体该主题帖子规模小,分数多为个位数至几十。对于 brief 的“分析约 20 条帖子”要求,直接相关帖子约 10 条已接近上限;再往后只会得到无关噪音(政治新闻、对 AI 泛泛的支持或反对)。应明确指出:Lemmy 在此主题上的样本量本身很小。

Pinterest

Pinterest — 图像与视频生成 AI 新闻

视觉主题
  • “惊讶 YouTuber+Logo 墙”模板:在深色背景上,将霓虹蓝紫色的 OpenAI(旋涡)、Google(G)、Microsoft(田字)、Meta(∞)、DeepSeek(鲸鱼)、Nvidia、Notion、Grok(X)等 Logo 排成圆形,并在右侧放置一张留胡子男性的惊讶面孔。“AI NEWS”类缩略图反复采用这一构图,看起来是将 YouTube 视频缩略图直接转载至 Pinterest 的内容。[4, 19, 29, 44]
  • 将 AI 拟人化为人形或机器人的面孔:光滑白色脸部的安卓机器人、穿西装的“机器人新闻主播”、透出电路的大脑、由绿色 Matrix 风格文字构成的人脸等,在行业新闻图中被反复使用。[2, 23, 27, 34, 40, 46, 50]
  • Before/After・转换演示:将一张实拍图并排转换为“木块风”“折纸艺术”“乐高积木”“花朵构成”的网格(包括汽车转换例);VASA-1 从音频和一张面部照片生成带表情视频的网格;女性→孩子→男性的“AI Baby”合成;以及将黑白旧时代人群与喷涌而出的数字图像用镜头左右分割的“history generative AI”等。“实拍→AI 生成”的前后对比构图很常见。[6, 13, 18, 47]
  • 竖版排行榜信息图:以工具 Logo、检查清单和“免费”徽章组成竖向比较表。列出 Runway、Pika、Kling AI、Luma AI(Dream Machine)、Canva AI、Hailuo AI、Synthesia、D-ID、Veed.io、Pictory、InVideo、Lumen5、Hyperwrite 等混合了闭源和开源的工具名。[10, 26]
  • 深度伪造焦虑与验证类图形:红色“FAKE”印章、“AI VOICE DETECTORS”及“97% likely AI generated”徽章、放大镜与“?”、戴兜帽的可疑人物剪影等,以煽动对 AI 生成内容不信任和验证需求的图像构成独立主题。[2, 39]
  • 企业发布活动与产品预告:Google Veo 2 预告图(游泳的狗、火烈鸟、动漫风少女)、Google Lumiere 演讲者与 Android 风格半身像、漏斗式图解 Gemini API 输入输出、Nvidia CEO Jensen Huang 演讲照片等,多张实际发布活动截图或合成图。[3, 9, 16, 44, 50]
  • 技术导向图解非常少:50 条中只有一张展示扩散模型内部结构(Frozen T5 XXL、IF-I-M 400M、Stable Diffusion 4x 放大等)的图解,而且标题也不是技术讲解,而是煽动性的“OpenAI 的秘密图像生成工具即将登场”。[37]
重点 Pin
  • #9 “Google Unveils Veo 2...” — Google Veo 2 官方预告图本身(游泳的狗、火烈鸟、动漫风少女)。#3(无标题)也是同一图像,同一素材被多次 Pin,说明存在内容复用或量产型账号。
  • #47 “Microsoft Unveils VASA-1...” — 展示仅用一张静态图、音频片段及可选控制信号生成富有表情对话视频的演示网格,是视觉上最易理解的 token head 生成技术案例。
  • #13(无标题) — 将实拍视频转换为“木块”“折纸”“乐高”“花朵”的 3×3 网格(含 Lumen 系水印),是视频风格转换病毒式呈现方式的典型。
  • #32 “Breaking News Latest AI Developments...” — 日期为 2026 年 8 月 12 日的信息图,包含三项内容:Grok 4.6(自主完成数十步工作并带回成果物)、Gemini 以史上最快速度突破 10 亿用户(每日生成 1.5 亿张图像)、Honor 配备相机云台的机器人手机。
  • #22(无标题,实质为“Today's AI News”) — 日期为 2026 年 5 月 20 日,汇总 Google I/O 2026 的搜索大改版(Gemini 3.5 Flash / Gemini Omni / Gemini Spark)、Apple 加强 AI 无障碍功能,以及 AI 智能眼镜竞争加剧。
  • #26 “5+ Best AI Video Generation Websites” — 比较 Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI,并明确写着“最适合 Pinterest 视频 Pin、YouTube Shorts、TikTok”。这是以 Pinterest 自身为投稿目的地的工具介绍,具有自指性质。
  • #10 “Best 10 AI FREE Video Generation Tools 2026” — Pictory/RunwayML/Veed.io/Synthesia/InVideo/Kling AI/D-ID/Lumen5/Canva AI/Hyperwrite AI 十选,附带“关注并点赞获取更多详细信息”的典型联盟营销引导。
  • #2(无标题,"AI content and social media concerns") — 在病毒式猫照片上加盖“FAKE”红色印章,标有 1.2K 点赞/7.4K 浏览,并结合戴帽可疑人物和“?”符号,构成对 AI 生成内容不信任的主题。
  • #39 “AI is Changing Everything!” — 以 AI 视频生成、AI 声音检测(97% 判定徽章)、AI 伦理与提示词工程为三大支柱,并附带“眼见不再为实”的警示语,是教育型信息图。
  • #6 “7 Best AI Baby Generators...” — 介绍从女性与男性面部“预测孩子长相”的个人娱乐型病毒式 AI 工具。它代表的是消费者娱乐用途,而非行业新闻。
信号
  • Pinterest 上浮现的“AI 新闻”几乎全是二手内容:YouTube 视频缩略图与汇总博客信息图,而不是一手信息。同一图片的复用(#3 与 #9 相同)及联盟营销引导(“LIKE & FOLLOW”、带“关注”按钮)很常见,其性质与 Reddit/X 的原生对话差异很大。
  • 闭源侧在视觉上压倒性地呈现 Google(Veo 2、Lumiere、Gemini 3.5/Omni/Spark、Gemini 突破 10 亿用户)与 Microsoft(VASA-1)的发布。OpenAI/Anthropic 虽频繁出现名字(主要作为 Logo 墙元素),但 Pinterest 上单独的产品预告图明显少于 Google。
  • 工具比较和排行榜式列表(如 #10、#26)是最典型的 Pinterest 原生内容,反映用户对可免费或低成本使用的闭源实用工具(Runway、Pika、Kling AI、Luma、Canva、Synthesia、D-ID、Veed.io、Hailuo)的实际兴趣很高。
  • 深度伪造的不信任与检测(#2、#39)作为独立主题存在一定数量;“无法分辨真实与伪造”的焦虑与面向创作者的工具介绍并存。
  • 消费者娱乐用途(根据脸预测孩子长相的“AI Baby”、把实拍转换为木块/花朵/乐高的风格转换滤镜)与行业产品发布新闻混在同一搜索结果里,新闻性内容与娱乐内容的边界模糊。
  • 开源阵营存在感极低:Stable Diffusion、Flux、Qwen、Wan、Kling(中国开放系)、DeepSeek 等专有名只在一张扩散模型技术图解(#37,且标题偏煽动)和工具排行榜中的一项出现;没有找到介绍社区讨论或具体模型演进的 Pin。
  • 有 2026 年 8 月 12 日(#32)、2026 年 5 月 20 日(#22)等含明确日期的信息图,说明收集到的图片集合本身包含近期内容。
局限
  • 根据 platforms/pinterest.md 的指示,未自行浏览 Pinterest;分析对象为工作线程已收集的 output/pinterest.pins.md(50 条)及 images/pinterest/manifest.json
  • 50 条中实际打开图像确认内容的是 23 条(#1, 2, 3, 4, 6, 9, 10, 13, 16, 18, 19, 21, 22, 23, 25, 26, 27, 29, 32, 34, 37, 39, 40, 44, 46, 47, 50 — 覆盖 brief.md 约 20 条的完成标准)。其余约 27 条仅检查了标题。
  • 有 6 条原本标题为“(untitled)”,通过图片推测内容(#3, #11, #14, #15, #22, #31 中,实际确认图片的是 #3、#22;#11、#14、#15、#31 未确认)。
  • Pinterest 的 Pin 不附带点赞、收藏、评论等互动指标,无法像 Reddit/X 一样定量比较哪些帖子表现更好。
  • 图片内文字几乎全部为英语,本次 50 条中未发现日语或其他语言的 Pin。

建议行动

  • 追踪 Sora API 停止(9/24)后,Veo 3.1、Kling 3.0、Seedance 2.0 与 Wan 系列的使用动向。
  • 将 Wan 3.0 从“开放”转向“封闭”视为先例,持续监测其他开放权重实验室调整政策的风险。
  • 在 Lemmy/HuggingFace 持续观察 MiniMax-H3 周边的 ComfyUI 工具群,以尽早发现下一个主要开源视频模型的信号。
  • 将 X 的搜索关键词从依赖地区趋势改为图像与视频生成 AI 专有词(Stable Diffusion、Sora、Nano Banana 等),并重新调查。
  • 将 Meta 等平台对 AI 生成有害内容的审核状况作为监管与声誉风险的先行指标进行跟踪。
  • 持续观察 Nano Banana / Gemini Image 系列面向消费者的闭源功能扩展,将其作为竞争对手应对措施的指标。

收集图片

🎨 AI Image and Video CreationAI content and social media concernsimageAI News: Anthropic Leak Shows Us The Future of AI...Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 57 Stock Photos, Vectors, and Video7 Best AI Baby Generators: Predict Your Child's Face (2026)Just Nail It 🎥AI For Image And video GenerationGoogle Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic Features🎬 10 FREE AI VIDEO TOOLS IN 2026 🤯 Create Videos Without Expensive Software!imageThe Secret Weapon for Content Creators: AI-Powered Video GenerationGoogle announces ultra-high quality video...imageimageVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥Adobe udvikler AI-model til opskalering af videoer, gør slørede optagelser HD-kvalitetAI News: OpenAI Finally Released What We Asked ForTop AI Video Generators of 2025Top 10 Lip Sync Tools (2026) – Best AI Lip Sync Software for Realistic Lip Sync VideoimageMore than 20% of YouTube is now AI-generatedAI Video Creation: 10 Smart Ways to Create Engaging Videos FasterWhat is Imagvio AI and how it helps creators...5+ Best AI Video Generation Websites 2026 | Runway, Pika, Kling AI, Canva & MoreOpenAI launches Sora AI video generator — here's...TotalYmage revolutionizes interactive videos...AI News: Everyone's Mad At Anthropic Now |How AI Is Transforming Video EditingimageBreaking News Latest AI Developments - Grok 4.6 Gemini 1B Honor Robot PhoneAI Tools for Video Editing — What Creators Actually Use to Make Content in 2026AI driven image and video analysisMastering Video and AI: Key Social Media Marketing Trends 2025AI Video Creating just got crazy.OpenAI’s Secret Image Generation Tool to Debut SoonI will do ai video creation explainer with synthesia sora ai kling ai runway ai invideo‎🚨 AI is getting scary good.Discover how Grok is revolutionizing video...Transform your ideas into stunning visuals! 🎥AI Video Creation: Complete Guide to Create Professional Videos Faster with AIhistory generative AINvidia #NEW AI Tools 🤯 #news #ai #openai #chatgpt #highlights #shortsFuture of Video Creation: Best AI Video Generators of 2026🔸Current Affairs Images with National and World MapsMicrosoft Unveils VASA-1, Setting New Standards for Generative AI in Video Generation"Transform Your Vision with Personalized AI-Powered 4K Videos 🎥✨"Professional AI Video Creation | Cinematic AI Videos | Custom Video EditingGoogles LUMIERE best text to video generator

数据质量说明

X 收集的 40 条帖子中仅 2 条与主题相关,且搜索词依赖地区趋势,因此实际上未获得有效数据。Bluesky 和 Reddit 也受官方搜索 API 故障或单一查询限制,未达到约 20 条的完成标准。YouTube 和 Pinterest 则因页面结构限制,无法获取播放量、点赞数等互动指标。

图库