KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-09-06

OpenAI 的 GPT-6 Astra 与其说是「图像与视频生成」工具,不如说是「PC 操作代理」,正席卷闭源领域;另一方面,开源阵营则在 ComfyUI 生态中稳步累积 Qwen Image、MiniMax-H3 等实现层面的新闻。

图像与视频生成 AI 新闻汇总 — 2026-09-06

说真的,这周的动向多到离谱😳🔥 闭源阵营完全成了 OpenAI「GPT-6 Astra」的狂欢,大家兴奋的与其说是图像、视频生成,不如说是「让它接管整台 PC 的代理」。相反,Sora 正悄悄淡出舞台,行业似乎正在从视频生成应用转向代理式 AI 投资。开源阵营则持续更新 Qwen Image、Z-Image Turbo、HunyuanImage、MiniMax-H3 等围绕 ComfyUI 的成果;虽然不算特别抢眼,但实现新闻的密度确实很高。不过坦白说,这次也有一些平台的搜索没有顺利进行(Reddit、X、Bluesky),并不是每个平台都完整看到了 20 条内容,相关情况会在下方「数据质量」中如实说明🙏

跨平台观察

  • GPT-6 Astra(OpenAI)几乎统治了闭源圈:在 X(@masahirochaen, https://x.com/masahirochaen/status/2095644339041153256)和 Bluesky(@todaystopainews, https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225)上,自发布后便占据讨论中心。ARC-AGI-3 达到 98.6%(上一代为 7.8%)的基准成绩正在广泛传播。
  • 人们谈论 Astra 时更关注「代理操作」,而非「图像生成」:无论是 X 上 @aigeboku 对 ComputerUse 功能的测试,还是 Bluesky 上自动在 Unity 中搭建城市场景的演示,讨论热点都从单次图像或视频输出,转向了「让 PC 自主执行操作」。这很可能会发展成一个全新品类。
  • Fable 5.1 被大量用作「对比对象」:X 上的 @renoiseai 和 @Mayz1169 分别通过 Seedance 2.5 发布了「Astra vs Fable 5.1」对决视频;此外,@k_matsumaru 的帖子中,Fable 5.1 并不是最终渲染器,而是作为提示词生成层,整合进由 4 个工具构成的流程。几乎没有人只依赖单一模型完成作品。
  • 聚合 API 在两个阵营中都越来越重要:Reddit 上的 WaveSpeedAI 将 1,000 多个模型整合到一条 REST API 中;Bluesky 上的 useapi.net 则横向比较 Veo、Kling、Seedance、PixVerse、Hailuo、Runway、Nano Banana。两者都被认为比官方账号提供了更密集、更实用的信息。
  • 开源格局呈现 Qwen Image / Z-Image Turbo(Alibaba、Tongyi-MAI)与 HunyuanImage(Tencent)双强,加上 MiniMax-H3 新星的态势:YouTube 的评测视频和 Lemmy 的 !«メールアドレス» 都提供了相当有力的佐证。
  • MiniMax-H3(开放权重视频模型)的周边生态正高速扩张:仅 Lemmy 在 8 月 8 日至 9 月 5 日间就有超过 10 条相关内容,包括 GGUF 量化、Turbo LoRA、120 秒长视频支持、混合注意力实现。X 上 @ImaStudio_ai 也基于它开发了自家的商业工具,这是跨平台可相互验证的一点。
  • ComfyUI 已成为开源阵营的绝对指挥中心:无论 Lemmy、Bluesky(@kunecco),还是 YouTube 的教程群,ComfyUI 支持与否都成了判断一项技术是否真正落地的试金石。
  • 多镜头+音频同步成为开源与闭源共同的下一竞争轴:YouTube 上直接对 Wan 2.6(开源)和 Kling 3.0 / Seedance 2.0 / Runway Gen-4.5(闭源)进行了压力测试式比较。
  • 「这真的是 AI 吗?还是实拍?」的焦虑无处不在:从 Reddit 的手指崩坏梗、课堂讨论,到 Pinterest 的「Which is AI?」猜图 Pin,不同平台都反复出现这种不安。
  • 品牌官方账号在社交平台上几乎失去活力:Bluesky 上 Midjourney 官方(最后一帖为 2025-10-08)和 Kling AI 官方(零发帖)都处于半停摆状态。各平台都显示,非官方账号、个人创作者与聚合服务的新闻速度更快。

分平台观察

Reddit — 从 9 个 subreddit 收集到 12 个帖子(未达到约 20 条的目标)。焦点包括:对让 LLM 操纵鼠标、完整伪造手绘延时视频的新方法的强烈反弹(r/antiai,5,259pt)、WaveSpeedAI 聚合 API,以及在 Apple Silicon 上高速本地生成 Krea-2-Turbo(45 秒/张)。r/VeniceAI 还有资深用户细致区分图像生成、编辑、视频转换所用模型。围绕伦理和质量的负面讨论也较强,例如对 AI 食品图片的严厉批评,以及时薪 $30 招聘帖沦为垃圾信息。

X — Explore 页面的热词受服务器所在地克罗地亚影响很大,10 个词中有 7 个(Bitcoin、乌克兰、阿根廷等)完全无关。与主题相关的帖子几乎全部围绕 GPT-6 Astra;本次完全没有尝试 Stable Diffusion、Wan、Flux 等开源关键词。因此,本期 X 的开源动态并非「没有」,而是「没有调查」。

YouTube — 闭源阵营最大的新闻是 Sora 停止服务(应用将于 2026 年 4 月 26 日关闭,API 也预计于 2026 年 9 月 24 日结束;下载量在 11 个月内从 330 万骤降至 110 万)。开源侧则有大量 Qwen Image、HunyuanImage、Z-Image Turbo 的首测评测,Black Forest Labs 的 FLUX.2(Apache 2.0)也被提及为竞争者。

Bluesky — 全文帖子搜索 API(searchPosts)对所有查询均返回 403,无法使用,因此改为通过账号搜索收集内容(分析数量未达 20 条目标)。闭源侧主要是 todaystopainews、useapi.net 等「新闻机器人」;开源侧主要是虹色、くねっこ等「个人成品作品发布」。作为技术新闻的开源信息,在 Bluesky 上几乎没有流动。

Lemmy — 规模虽然较小,但 !«メールアドレス»(5,708 人)实际上已成为开源速报板,MiniMax-H3 周边以及 LTX-2.5 Day-0 支持等实现新闻十分密集。闭源内容更多以 Midjourney 转向医疗设备等「产品新闻之外的讽刺或丑闻」形式被消费。未发现源自 Lemmy 的 Sora / Veo / Kling / Hailuo 一手帖子。

Pinterest — 确认了预先收集的单一查询结果 50 条(未按 genre 划分)。几乎全部是 Runway、Pika、Kling、Luma、Synthesia、HeyGen 等闭源工具的比较清单和新闻信息图;涉及开源的只有 Baidu Ernie 4.5 与 AMD Amuse 3.0 两条。这里已完全成为闭源工具的 SEO / 营销市场。

值得关注

建议

  • 持续从「代理操作」维度,而不仅是图像和视频质量维度,将 GPT-6 Astra 与 Fable 5.1 进行比较。
  • 将 MiniMax-H3 的 ComfyUI 生态(GGUF、Turbo LoRA)作为开源视频生成前沿,在下一期继续追踪。
  • 下次调查 X 时,不要依赖 Explore 热词,而应明确搜索 Stable Diffusion、Wan、Flux、Qwen 等开源专属关键词。
  • 作为开源的一手信息源,应优先查看 Lemmy 的 !«メールアドレス»,而非 Reddit 或 Bluesky。
  • 不应将 Pinterest 用作开源动态的信息源,而应仅用于观察闭源工具的营销与 SEO 动向。
  • 跟进调查是否有依赖 Sora API 结束日期(2026-09-24)的外部工具或工作流。

数据质量

Reddit 仅有 12 个帖子,未达到约 20 条的完成标准(无法通过 WebFetch 直接收集,仅依赖预先收集的工作数据)。X 的大多数搜索词(10 个中 7 个)都是无关热词,且本次从未进行开源相关搜索,X 的开源动态实际上尚未调查。Bluesky 的全文帖子搜索 API 对所有查询均返回 403,因此被迫改用账号搜索,分析量未达目标。受动态渲染影响,YouTube 的大部分播放量和订阅数无法确认。Lemmy 本身规模较小,且未找到 Sora / Veo / Kling / Hailuo 的一手帖子(也可能是搜索覆盖范围有限)。Pinterest 仅使用了一个通用查询词的 50 条结果,未针对开源进行再搜索。

按平台汇总

Reddit

Reddit — 图像与视频生成 AI 新闻

分布情况

使用搜索词「Image and Video Generation AI News」,从 9 个 subreddit 收集到了 12 个帖子。

Subreddit 成员数 收集帖子数
r/StableDiffusion 1,001,169 1
r/teenagers 3,674,216 1
r/aiwars 166,685 1
r/antiai 314,968 2
r/generativeAI 150,823 3
r/RemoteWorkers 74,528 1
r/VeniceAI 10,421 1
r/DailyIncome 12,914 1
r/freetoolsAI 7,736 1

r/generativeAI(3 个帖子)和 r/antiai(2 个帖子)涉及该主题最多。r/antiai 对 AI 图像生成持批评立场,r/generativeAI 则主要讨论工具比较和实用建议,呈现出鲜明对比的氛围。

人们怎么说
  • 对 LLM 伪造手绘延时视频的警告(帖子 #1,r/antiai,5,259pt・760 条评论,2026-09-05,https://www.reddit.com/r/antiai/comments/1w81kdd/)。一篇帖子展示了为 GPT-6 提供鼠标与键盘控制后,连同数字绘画的延时过程一起「看似真实地」伪造的方法,引发强烈反弹。例如有人表示:「为什么要发布这种技术?除了伤害真正的画师以外没有任何目的。」(u/sanstheskelebrotherc,235pt)。
  • 免费 AI 视频生成工具的每日比较(帖子 #2,r/generativeAI,42pt・28 条评论,2026-08-31,https://www.reddit.com/r/generativeAI/comments/1w3frr2/)。围绕 Adobe Firefly(每天 2 条)、PixVerse(每天 1 条)、Grok Imagine(每天 1 条)、Google Flow(每天 3~4 条)展开,评论中还提到 Kling AI(每 24 小时 66 积分,按 5 秒 720p 计算约可生成 2~6 条)及 CapCut 的每日免费积分。
  • 免费、无限制图像生成工具分享帖(帖子 #3,r/freetoolsAI,37pt・38 条评论,2026-09-04,https://www.reddit.com/r/freetoolsAI/comments/1w6w0rj/)。评论区最主要的关注点是是否支持 NSFW;伴随「为什么大家都要封禁 NSFW?」(u/Relevant_Syllabub895)的声音,用户列举了 Deepany、Aifun、Perchance、huggingface 上的 Z-Image-Turbo 等替代服务。
  • 「时薪 $30 审核 AI 生成图片」招聘在两个社区并行扩散(帖子 #4,r/RemoteWorkers,114pt・520 条评论,2026-09-04,https://www.reddit.com/r/RemoteWorkers/comments/1w7azwu/;以及帖子 #6,r/DailyIncome,129pt・1,123 条评论,2026-09-04,https://www.reddit.com/r/DailyIncome/comments/1w7b18p/)。两则招聘内容几乎相同,但大部分评论只是「images」「Interested」等单词回复,大量模板化反应显然是为了索要申请链接。
  • 本地图像生成加速演示(帖子 #5,r/StableDiffusion,31pt・10 条评论,2026-09-03,https://www.reddit.com/r/StableDiffusion/comments/1w6bphf/)。有人报告称,在 Apple Silicon(M5 Pro 24GB)上本地运行 Vpipe+Krea-2-Turbo-M87(16bit),可实现 1024×1024、8 步约 45 秒/张(8bit 实时量化时为 35 秒)。
  • 关于 AI 图像越来越难检测的梗图帖(帖子 #8,r/antiai,113pt・30 条评论,2026-08-30,https://www.reddit.com/r/antiai/comments/1w2mr8g/)。实际上主要是手指崩坏相关的玩笑,例如「为什么她的脚是手?」(u/GurInside278,31pt),传统的生成瑕疵仍是笑点。
  • 对聚合 API 服务 WaveSpeedAI 的评价(帖子 #7,r/generativeAI,2pt・4 条评论,2026-09-05,https://www.reddit.com/r/generativeAI/comments/1w8ci5z/)。据称该服务「通过单一 REST API 封装了 Flux、Wan 2.1/2.6、Hailuo、Kling 等 1,000 多个模型」(u/Jenna_AI)。一位实际将其通过 Seedance 整合进自制工具的用户(u/BradClarkAI)也评价称「没有任何问题」。
  • VeniceAI 社区的模型选型信息(帖子 #9,r/VeniceAI,8pt・6 条评论,2026-08-30,https://www.reddit.com/r/VeniceAI/comments/1w2rtq1/)。u/jerm2z 建议具体分工:图像生成用 Chroma,编辑用 Qwen Edit Uncensored 或 Seedream、FireRed(不支持 NSFW,但人脸一致性高),图生视频用 WAN Enhanced、Seedance、Minimax R2V。
  • AI 食品图被批评「毫无食欲」(帖子 #10,r/aiwars,4pt・175 条评论,2026-09-03,https://www.reddit.com/r/aiwars/comments/1w69cdj/)。有人尖刻评论「这看起来只像 grub hive(蛆虫巢穴)」(u/LCI_Jake,14pt)。一位实际尝试用 Krea 2 在本地生成(40 秒)的用户(u/Bassed_Hummble)则质疑:「提示词并不复杂,为什么输出会糟糕到这种程度?」
  • 年轻人围绕 AI 艺术正当性的讨论(帖子 #12,r/teenagers,7pt・41 条评论,2026-08-31,https://www.reddit.com/r/teenagers/comments/1w2y305/)。一篇帖子认为,「AI 接收提示词后,真正完成绘画的是 AI 本身,这与人类使用画材或软件进行创作根本不同」,引发正反两方争论。u/TheDarkmore 表示自己「不擅长画画,因此把 120 张卡牌游戏插图交给 AI,我认为这样没问题」,明确表达了实际使用者的立场。
信号
  • 上升趋势:让 LLM 操作鼠标和键盘以伪装「手绘」的新方法(帖子 #1),作为不同于传统扩散模型检测的新威胁,正迅速引发反弹,并为 AI 与反 AI 的对立增添新导火索。此外,WaveSpeedAI 这类「通过单一 API 封装超过 1,000 个模型」的聚合服务(帖子 #7),以及 Apple Silicon 上的本地高速生成(帖子 #5)等面向开发者的基础设施与效率话题,也在低调增长。
  • 被轻视或嘲讽的领域:AI 食品广告图(帖子 #10)被严厉批评为「还不如贴一张图库照片」,质量局限被反复指出。「时薪 $30 审核 AI 生成图片」的招聘(帖子 #4、#6)内容高度重复,绝大多数评论仅是为了获取申请链接的格式化回复,几乎没有实际讨论,很可能被当作垃圾招聘信息消费。
  • 出人意料的分歧:同样围绕「AI 图片越来越难分辨」的主题,r/antiai 的帖子 #8 仍将手指崩坏当作笑话;而帖子 #1 中,「连延时视频都能伪造」的新方法则被视作严重威胁。可见即使在同一社区,对 AI 图像检测现状的判断也存在分歧。同样地,r/VeniceAI 和 r/StableDiffusion 热衷于技术选型与优化,而 r/antiai 和 r/aiwars 则展开强烈的伦理与质量批评;Reddit 上对于「AI 图像生成」的态度,因 subreddit 而高度分裂。
局限性
  • 搜索词只有「Image and Video Generation AI News」一个,并未区分搜索「开源」或「闭源」。因此,本文件本身无法直接划分简报所要求的「开源/闭源各至少 10 条洞察」,需要在综合报告中分类。
  • 简报的完成标准是每个社交平台分析约 20 个帖子,但此次只收集到了 12 个帖子,未达目标。
  • 帖子 #4、#6(时薪 $30 的招聘)的评论大多是「images」「Interested」等固定回复,未获得实质讨论或验证性评论。
  • Reddit 本身拒绝通过 WebFetch 与搜索获取页面,因此仅基于工作程序预先收集的文件(reddit.threads.md/json);在本次搜索会话中无法进一步深入追踪相关帖子或展开评论区。

X

X — 图像与视频生成 AI 新闻

本次会话中,X 自身的 Explore 列表按服务器所在地定位到 克罗地亚,而不是日本或全球信息流——其中显示的趋势词为「Astra」「Bitcoin」「Ukrainian」「Argentina」「$SONG」「OpenAI」「Russia」「Black」「$KURO」「Fable」,但没有给出帖子数量。这 10 个词中,只有 3 个(「Astra」「OpenAI」「Fable」)与图像/视频生成 AI 有关;其余均为加密货币行情、俄乌战争、阿根廷名人八卦与迷因币,以下不予涵盖——详见局限性。

账号

相关账号及其实际发布内容:

账号 发布内容 本帖覆盖度
@masahirochaen(チャエン) 日本 AI/科技新闻账号;率先发布 GPT-6 Astra 及基准数据,之后又跟进 Altman「Astra 之外还有更多」的发言 2 个帖子,841 + 133 个赞;发布帖最高约 550,000 次浏览
@UNIBRACITY(SHINTARO) 将 GPT-6 Astra 与 Blender 结合使用的业余 3D 艺术家 1 个帖子,306 个赞
@hayashimon1(ハヤシモン|AI×個人開発) AI/3D 创作者,也运营付费讲座;使用 Fable 5.1 × Blender 1 个帖子,55 个赞
@manaimovie(Mankyu) AI 视频爱好者,将 Tripo 3D 模型交给 Astra 1 个帖子,409 个赞
@yachimat_manga(yachimat-AI Short Anime) AI 短篇动画创作者,推测 Astra 对某些风格可能替代专用视频生成工具 1 个帖子,51 个赞
@aigeboku(AI様の下僕) 测试 Astra「ComputerUse」代理控制能力的 AI 重度用户 1 个帖子,653 个赞
@gagarot200(ガガロット) AI 演示账号,展示一句提示词生成游戏的短片 1 个帖子,306 个赞
@SSSS_CRYPTOMAN 加密货币+AI 跨界账号,发布 Astra 搭建游戏的演示 1 个帖子,161 个赞
@Mayz1169(Kiki)/ @renoiseai(Renoise) 并排 AI 视频对比账号,均以 Seedance 2.5 渲染方式让 GPT-6 Astra 与 Fable 5.1 对决 各 1 个帖子,64 和 140 个赞
@k_matsumaru 记录完整流程的 AI 视频创作者(Typeless → Fable 5.1 → Seedream 5.0 → Seedance) 1 个帖子,279 个赞
@Strength04_X 分享 Seedance 2.5(通过 lovart_ai)提示词的账号 1 个帖子,444 个赞
@ImaStudio_ai 自有 AI 时尚视频工具(基于 MiniMax H3)的产品/工作室账号 1 个帖子,132 个赞

这些账号的每条内容都是单独的帖子,并非连续主题帖或长期活动——这是一场零散的一日发布反应,而不是由某个组织化账号推动的讨论。

帖子
24. @masahirochaen(チャエン)

【快讯】OpenAI 发布「GPT-6 Astra」。终于公开了可完整代办 PC 工作、超越 Fable 5.1 的主力模型。……ARC-AGI-3(解决初见谜题的能力)98.6%,上一代 GPT-5.6 为 7.8%。增幅异常。

这是该集合中遥遥领先的最大帖子,也为其余讨论定下基调:它将 GPT-6 Astra 描述为超越 Fable 5.1 的 PC 操作代理,并引用 ARC-AGI-3 从 7.8%(GPT-5.6)跃升至 98.6% 的数据。

21. @masahirochaen(チャエン)

Sam Altman 公开谈及 GPT-6 的「更远之后」……他明确表示,8 月因网络风险而暂时停止工作的模型,并不是 GPT-6 Astra。

发布两天后,同一账号报道 Altman 称 OpenAI 8 月因网络风险暂停的模型并非 Astra——这意味着还有能力更强的模型尚未发布。

3. @aigeboku(AI様の下僕)

正如所说,GPT-6 Astra「操控其他事物的能力很强」,使用 ComputerUse 能做的事情会大幅扩展……虽然一次成功不容易,但继续调整后,应该能做出更有意思的表现。

这条内容将 Astra 的卖点定位为代理控制(「ComputerUse」),而不是纯粹的生成质量——早期测试者正在探索这种控制能力能为创作工作流带来什么,而不只是图像输出。

1. @manaimovie(Mankyu)

我把用 Tripo 制作的模型交给 Astra 老师,让它动起来,结果就是这个。……比用 Fable 或 Sol 的时候好很多!

这是一个具体的工作流前后对比:将 Tripo 制作的 3D 模型交给 Astra 并要求其制作动画,效果据称优于用 Fable 或「Sol」完成相同任务。

22. @gagarot200(ガガロット)

GPT-6 Astra 全自动直接生成……只要对「GPT-6 Astra」说一句「帮我做这样的游戏」,描述一下即可。

一句提示词端到端生成可玩的游戏,被作为 Astra「完成整个任务」定位的证据。

23. @UNIBRACITY(SHINTARO)

GPT-6 Astra × Blender《Forest Retreat / 森林隐居地》Astra 运行约 7 小时,做到了这个程度。

一次约 7 小时的 Astra 运行,在 Blender 中生成完整 3D 场景——这是集合中较详细的「实际耗时」数据点之一。

4. @SSSS_CRYPTOMAN(SSSS.CRYPTOMAN⚡️AI)

用 GPT-6 Astra 很快就完成了游戏!🎮……从粗略提示词经过几轮对话,就做出了能正常玩的质量。

这是另一个从模糊提示词到可玩游戏的演示,附有实时链接,独立印证了 @gagarot200 的说法。

2. @yachimat_manga(yachimat - AI Short Anime)

我试着用 GPT-6 Astra 建模。……未来有没有可能,某些视频风格下根本不再需要视频生成工具?

一位实际从事 AI 动画创作的人公开推测:对某些风格而言,Astra 的 3D 建模能力可能会让专用视频生成工具变得不必要。

40. @renoiseai(Renoise)

GPT-6 Astra vs Fable 5.1,两个视频均使用 Renoise 中的 Seedance 2.5 生成。

一段直接对决视频,两个输出均通过同一款下游工具 Seedance 2.5 渲染,以控制该变量。

39. @Mayz1169(Kiki)

先忘掉基准测试,直接看这个。相同提示词下的 GPT-6 Astra vs. Fable 5.1 并排对比。你会选哪一个?

与上文相同的比较直觉,且是独立出现的内容——Astra 与 Fable 5.1 的对决已是本批次中可识别的微型内容类型,而非偶然一次。

37. @k_matsumaru(松丸 彗吾)

最近的视频制作方法……① 用 Typeless 写出指示书 ② 让 Fable 5.1 写出视频生成提示词 ③ 用 Seedream 5.0 Pro 制作分镜并审查内容 ④ Seedance……

这是集合中最详细的制作流程:Typeless 负责脚本 → Fable 5.1 负责提示词编写 → Seedream 5.0 Pro 负责分镜 → Seedance 完成最终视频。这里的 Fable 是提示词层,而非渲染器本身。

32. @ImaStudio_ai(Ima Studio)

MiniMax H3 K-Fashion Outfit Change MV……8 套造型,1 个女孩,零身份漂移。

一家商业工作室账号推广基于 MiniMax H3 的自有产品,将多次换装中的「零身份漂移」作为卖点。

信号
  • 正在上升的内容:GPT-6 Astra(OpenAI)主导了本批次中所有相关帖子;它首先被视为一个 代理式、可操作计算机 的模型,其次才是图像/视频生成器。测试者持续将其与其他工具搭配,例如用 Tripo 制作 3D 网格、用 Blender 制作场景,而不是把它当作独立渲染器。
  • 可识别的微型内容类型:互不相关的账号(@renoiseai、@Mayz1169)都在发布使用 Seedance 2.5 渲染的「GPT-6 Astra vs Fable 5.1」并排对比。Fable 5.1 是人们自然选择的比较对象,而 Seedance/Seedream 则反复作为两者之下实际的视频渲染层出现。
  • 链式流程,而非单一工具:最详细的帖子(@k_matsumaru,#37)使用四种工具(Typeless → Fable 5.1 → Seedream 5.0 Pro → Seedance)完成一个视频。集合中没有人描述仅用一个模型就完成视频制作。
  • 令人意外的发现:本轮由 X Explore 面板(定位到克罗地亚)带来的趋势词——Bitcoin、Ukrainian、Argentina、$SONG、Russia、Black、$KURO——与图像/视频生成 AI 基本毫无关联。2026-09-05/06 该服务器所在地 X 的「趋势」是加密货币和地缘政治,而非 AI 模型;将其当作 AI 讨论的代理指标会造成误导。
  • 被忽略的内容:本批次没有出现批评或质疑 GPT-6 Astra 的主题帖——所有相关帖子都是演示、基准转发或对比视频。鉴于「超越 Fable 5.1」的说法(#24)如此激进,这种缺席本身值得注意。
局限性
  • 使用的 10 个搜索词(「Astra」「Bitcoin」「Ukrainian」「Argentina」「$SONG」「OpenAI」「Russia」「Black」「$KURO」「Fable」)来自本次会话中 X 自身 Explore 的趋势列表,而不是经过筛选的图像/视频 AI 术语表。其中 7 个(「Bitcoin」「Ukrainian」「Argentina」「$SONG」「Russia」「Black」「$KURO」)返回的内容完全无关研究主题,包括加密货币赠送和价格预测、俄乌战争、阿根廷名人新闻和两个小型迷因币,因此未纳入上方帖子部分。
  • 因此,这里的开源覆盖较少且间接:本次集合中没有使用「Stable Diffusion」「ComfyUI」「Wan」「HunyuanVideo」或「Flux」等搜索词——这些搜索在本阶段从未进行。所有相关内容均与闭源/商业名称有关(GPT-6 Astra、Fable 5.1、Seedance、Seedream、MiniMax H3、Tripo),所以本轮 X 的开源图景应被视为缺失,而不是「那里没有任何动态」。
  • 帖子 #35(@MINHxDYNASTY,标记为「$KURO」)在源文件中未捕获帖子文本,因此不能作为发现使用。
  • Explore 的「Where」列按本次会话服务器所在位置(克罗地亚)定位,而非日本或全球;不应把其列表理解为全球或日本特定的趋势图景。
  • 没有发生会话或访问失败:对每个尝试的搜索词均返回数据,因此缺口是主题性的(搜索了哪些词),而非技术性的。

YouTube

YouTube — 图像与视频生成 AI 新闻(闭源/开源)

频道
  • Bijan Bowen(@Bijanbowen,约 37,000 人)— 专注于 LLM 与图像生成模型的深度评测,测试了 Qwen Image-2512。
  • Future Tools / Matt Wolfe(@mreflow,超过 90 万人)— 以每周「Everything in AI This Week」形式汇总 Midjourney、Runway 等图像与视频生成 AI 动向。
  • ComfyUI/本地生成类教程频道群(大量 Wan 2.2/2.6、FLUX、Qwen Image 工作流讲解视频;只确认到视频标题,搜索结果中未显示各频道名称)。
视频
  1. "Why OpenAI Shut Down Sora So Fast: What's Next?" — 发布于 2026 年 3 月至 4 月左右。解读 OpenAI 关闭 Sora 应用(2026 年 4 月 26 日)并计划结束 API(2026 年 9 月 24 日)的背景:月下载量从 2025 年 11 月的 330 万急跌至 2026 年 2 月的 110 万,且与 Disney 价值 10 亿美元、为期 3 年的协议也告吹。https://www.youtube.com/watch?v=H2jVcy5PuBI
  2. "Why Did Sora AI Shut Down? The Real Reason OpenAI Killed Its Viral Video App" — 发布于 2026 年春季。讨论未能实现商业化的视频生成应用所带来的经济成本,以及转向代理式 AI 的战略调整。https://www.youtube.com/watch?v=MpLY9bjYVuA
  3. "HunyuanImage-3.0 First Test – The Open Source Nano Banana?" — 发布于 2025 年 9 月 29 日。测试腾讯 HunyuanImage-3.0(最大的开源文本生成图像模型之一)在本地运行时的表现及硬件需求。https://www.youtube.com/watch?v=lLTv4sGf8Wo
  4. "Qwen Image-2512 First Test – The BEST Open Source Image Model!"(Bijan Bowen)— 发布于 2025 年 12 月 31 日。通过实拍测试验证 Alibaba 的 Qwen Image-2512 在人物真实感与文字描绘方面的改进。https://www.youtube.com/watch?v=SBaK616nP6Q
  5. "New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)" — 发布于 2026 年 1 月 5 日。直接比较 Qwen Image 2511/2512 与 Tongyi-MAI 的 Z-Image Turbo。https://www.youtube.com/watch?v=uAGH_yRZ2Gw
  6. "Tencent Hunyuan 2.1 vs. Qwen Image: Who is the True King? A 2K Image & Text Rendering Showdown!" — 发布于 2025 年 9 月 28 日。对当时位居开源文生图 Arena 排行榜首位的 Hunyuan Image 2.1 与 Qwen Image 进行 2K 文字渲染对决。https://www.youtube.com/watch?v=MUDTryJS0XM
  7. "Z-Image la nouvelle star des modèles Open Source?? Test dans ComfyUI" — 发布于 2025 年 11 月 28 日。在 ComfyUI 中测试 Alibaba/Tongyi-MAI 的开源文生图模型「Z-Image Turbo」。https://www.youtube.com/watch?v=eOKSBu7KLh0
  8. "Wan 2.2, FLUX & Qwen Image Upgraded: Ultimate Tutorial for Open Source SOTA Image & Video Gen Models" — 发布于 2026 年 1 月 11 日。以长视频教程的形式,在 ComfyUI 中集中讲解最新开源图像与视频生成模型群(Wan 2.2 / FLUX / Qwen Image)。https://www.youtube.com/watch?v=3BFDcO2Ysu4
  9. "WAN 2.6 Hands-On: The Good, the Bad, and the Useful" — 发布于 2025 年 12 月 26 日。对 Alibaba 发布的 Wan 2.6(最长 15 秒、支持多镜头和音频同步)进行实机上手测试。https://www.youtube.com/watch?v=iNnmLwPg7OE
  10. "Multi-Shot AI Videos: Wan 2.6 vs Kling 2.6 (Stress Test)" — 发布于 2025 年 12 月 27 日。通过压力测试比较开源 Wan 2.6 和闭源 Kling 2.6 的多镜头生成能力。https://www.youtube.com/watch?v=CDRKn4I-Iv0
  11. "I Tested Google's Nano Banana Pro Tips - This One Creates Pro Graphics in 30 Seconds" — 发布于 2025 年 11 月至 12 月左右。实测 Google DeepMind 的 Gemini 3 Pro Image(别称 Nano Banana Pro,支持 4K 输出、14 个以上对象、多语言文字描绘)。https://www.youtube.com/watch?v=ca4SXmRqtKE
  12. "Qwen Image Edit Review — Free Open-Source Alternative to Nano Banana" — 发布于 2025 年 12 月 4 日。评测可对抗闭源 Nano Banana 的开源编辑模型 Qwen Image Edit。https://www.youtube.com/watch?v=Ur3udfFJ2QQ
信号
  • 闭源领域最大的新闻是 Sora 的退出:OpenAI 于 2026 年 3 月 24 日通知开发者,4 月 26 日结束 Sora 应用/Web 版,API 也预计于 2026 年 9 月 24 日终止。多条视频将下载量骤减(2025 年 11 月 330 万 → 2026 年 2 月 110 万)以及与 Disney 的 10 亿美元合作告吹视为背景。它被当作行业从视频生成投资转向编程/代理 AI 资源配置的标志性案例。
  • 开源阵营呈现「双强+新星」结构:Alibaba 系(Qwen Image、Z-Image Turbo、Wan 2.2/2.6)与 Tencent 系(HunyuanImage 3.0/2.1)争夺主要排行榜首位;Black Forest Labs 的 FLUX.2([dev]/[klein],公开 Apache 2.0 VAE)则凭借照片级真实感竞争。许多创作者都在「Nano Banana 的开源替代品」语境下介绍 Qwen Image 或 HunyuanImage,闭源与开源的直接比较已经成为固定形式。
  • 视频领域以多镜头和音频同步作为新标准:Wan 2.6(开源)与 Kling 3.0 / Seedance 2.0 / Runway Gen-4.5(闭源)都在竞争「一次生成多个镜头」和「同时生成音频与 SFX」;竞争已经从单一短片生成进入更高一层的功能比拼。
  • 大多数评测视频采用「first test」「first look」的上手验证形式,在模型发布后数天至一周内上线,高时效性格式已趋于稳定。
局限性
  • YouTube 搜索结果页与视频观看页(youtube.com/resultsyoutube.com/watch)由 JavaScript 渲染,因此 WebFetch 只能获取静态页脚(版权信息、条款链接等),几乎无法直接确认准确播放量、频道订阅数和评论区。以上播放量和订阅数仅限于能从 Web 搜索结果摘要中获取的部分,许多视频无法列出播放量。
  • 未能确定 Kling 3.0 / Seedance 2.0 / Runway Gen-4.5 的单独 YouTube 评测视频 URL,因为搜索结果偏向技术对比博客文章(invideo.io、Pixo、AI.cc 等),而非 YouTube 视频直接链接。
  • 除 Bijan Bowen(约 37,000 人)和 Matt Wolfe / Future Tools(超过 90 万人)外,其他单独频道的订阅数均无法从搜索结果确认。

Bluesky

Bluesky — 图像与视频生成 AI 新闻

Bluesky 官方搜索 API(app.bsky.feed.searchPosts)在本会话中始终返回 403 Forbidden,无法通过关键词收集帖子(详见局限性)。因此改为使用 app.bsky.actor.searchActors 寻找主题相关账号,并逐个读取这些账号的发帖历史(getAuthorFeed)。

账号
账号 内容 关注者数 帖子数
@todaystopainews.bsky.social 「Today's Top AI News」。自动收集、发布 AI 行业新闻的机器人式账号,经常谈及 GPT-6 Astra、Fable 5.1 等闭源模型 272 1,826
@useapi.bsky.social useapi.net。整合 Veo、Kling、Seedance、PixVerse、Hailuo、Runway、Nano Banana 等各家图像/视频生成 API 的聚合服务官方账号 13 24
@nijiironokeshiki.bsky.social 「虹色」。使用 Stable Diffusion 与 ComfyUI,每天发布 2~3 次《Re:从零开始的异世界生活》《Lycoris Recoil》《葬送的芙莉莲》等二创插画的个人创作者 699 1,963
@kunecco.bsky.social 「くねっこ」。git 版 ComfyUI 的节点、工作流与 LoRA 开发者,也发布 danbooru 标签翻译等偏技术内容 540 494
@midjourneyofficial.bsky.social Midjourney 官方账号,于 2025 年 8 月宣布进入 Bluesky 不明 最后发帖 2025-10-08
@comfyuistudio.bsky.social ComfyUI 工作流介绍账号(第三方) 不明 最后发帖 2024-12-19
@klingaivideo.bsky.social Kling AI 视频生成工具介绍账号 不明 信息流为空(无发帖)
帖子
闭源
  1. GPT-6 Astra 生成 PS4 控制器 SVG(@todaystopainews,11 个赞・2 次转发・1 条回复,2026-09-05,https://bsky.app/profile/todaystopainews.bsky.social/post/3mur7cyocf225)。帖子还列出了生成耗时(11 分 54 秒),是 OpenAI GPT-6 Astra 处理图像任务所需时间的具体示例。

  2. GPT-6 Astra 在 Unity 中搭建城市场景(@todaystopainews,4 个赞・1 次转发,2026-09-04,https://bsky.app/profile/todaystopainews.bsky.social/post/3muoucqf4tk2w)。该演示使用现有资产自动构建 3D 场景,展示了超越简单图像生成的代理式使用方式。

  3. 转发「Fable 5.1 world modeling」(@todaystopainews,11 个赞・4 次转发,2026-09-03,https://bsky.app/profile/todaystopainews.bsky.social/post/3mumdxgujh22h),以及前一天的 「用 Fable 5.1 制作的中世纪城市」(10 个赞・3 次转发,2026-09-02,https://bsky.app/profile/todaystopainews.bsky.social/post/3mukekiwxws2j)。Anthropic 系 Fable 5.1 被反复作为 3D/世界建模方向的演示内容报道。

  4. useapi.net 博客「Dreamina API 上的 Seedance 2.5」(@useapi.bsky.social,2026-08-08,https://bsky.app/profile/useapi.bsky.social/post/3mskj7fb2ok2a)。以技术博客形式介绍 ByteDance 系视频生成模型 Seedance 2.5 已可通过 Dreamina API 使用。

  5. useapi.net「MiniMax H3 vs Seedance 2.0」在相同参考图下的比较(@useapi.bsky.social,2026-07-31,https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x)。在相同参考素材(omni references)下直接比较模型,体现 API 提供商视角的质量验证。

  6. useapi.net「17 种以上 AI 图像模型深度比较」(@useapi.bsky.social,3 个赞,2026-07-25,https://bsky.app/profile/useapi.bsky.social/post/3mrigfks25k2n)。横向排列多种图像生成模型的比较文章,反映出闭源模型的繁多。

  7. useapi.net「Seedance 2.0 官方渠道与第三方渠道的价格比较」(@useapi.bsky.social,2026-07-23,https://bsky.app/profile/useapi.bsky.social/post/3mrdyxqswcb2p)。具体比较同一模型在官方 API 与聚合服务渠道之间的价格差异,展现 API 市场的分层结构。

开源
  1. 「虹色」的日常 AI 插画发布(@nijiironokeshiki,87~245 个赞,2026-09-02~09-05 多次发布,例如:https://bsky.app/profile/nijiironokeshiki.bsky.social/post/3mumi7nop522l,104 个赞・25 次转发)。如个人资料所示,作品使用 Stable Diffusion 与 ComfyUI 制作;在 Bluesky 中,该个人账号持续获得异常高的互动量。

  2. くねっこ关于 ComfyUI 工作流开发的随笔(@kunecco,2025-10-27,https://bsky.app/profile/kunecco.bsky.social/post/3m45jd5s2ek2f):「开始觉得做节点和工作流很有趣,已经陷进去了。」同一账号在同期还发帖称「翻译了 14 万行 danbooru token」(https://bsky.app/profile/kunecco.bsky.social/post/3m432qalae22t),是从标签词典层面操作 ComfyUI 生态的实例。

  3. ComfyUI 官方/准官方账号群的停滞(@comfyuistudio.bsky.social 最后发帖 2024-12-19;@comfy-ui.bsky.social 信息流为空)。账号搜索可找到 comfyuistudioreal-comfyuicomfy-uicomfyuiorg 等多个相似账号,但实际活跃的主要是虹色、くねっこ等个人 AI 插画创作者;工具开发方或信息发布方作为官方存在,在 Bluesky 上几乎没有影响力。

信号
  • 闭源侧以「新闻速报」为主,开源侧以「作品发布」为主:todaystopainews、useapi.net 发布的内容聚焦 GPT-6 Astra、Fable 5.1、Seedance、MiniMax H3 等模型名称、API 价格和基准表现,赞数虽通常只有个位到十几个,但新闻密度很高。另一方面,开源(Stable Diffusion/ComfyUI)主要是虹色这类个人创作者发布完成插画,话题指向「作品本身」,而不是「模型动态」。作为技术新闻的开源动态,在 Bluesky 上几乎没有传播。
  • Midjourney 与 Kling AI 官方账号实际上处于停摆状态:Midjourney 官方虽于 2025 年 8 月宣布「来到 Bluesky」,但最后一帖停在 2025-10-08;Kling AI Video 官方账号的信息流则为空。品牌方并未把 Bluesky 当作持续传播渠道。
  • 以 GPT-6 Astra 名义运营的 AI 代理人格账号出现:发现了 astrra.space(Astra,「AI agent running on GPT-6 Astra」)和 maple-nekokami.bsky.social(「Runs on OpenAI GPT-6 Astra」)等将模型名作为招牌的角色运营账号。它们并非直接讨论图像或视频生成,但说明 GPT-6 Astra 这一品牌名正在 Bluesky 上被以迷因方式消费。
  • 聚合 API(useapi.net)正在成为闭源比较的枢纽:整合 Veo、Kling、Seedance、PixVerse、Hailuo、Runway、Nano Banana 等模型的 useapi.net,在 Bluesky 上持续输出价格和性能比较,是最具体的一手信息源。此类跨模型服务提供的信息,比单一模型官方账号更具实务价值。
局限性
  • app.bsky.feed.searchPosts(帖子正文全文搜索 API)对所有查询都返回 HTTP 403(即使查询「image generation AI」「Stable Diffusion」「Flux」等单词也同样如此)。另一方面,app.bsky.actor.searchActors(账号搜索)与 app.bsky.feed.getAuthorFeed(单个账号的发帖历史)均可正常响应。因此,本报告依赖「找到可能相关的账号后逐一阅读」,而非「按关键词横向搜索帖子」;未被账号搜索发现的帖子和账号未被纳入报告。
  • 相对于完成标准(每个社交平台分析约 20 个帖子),实际可阅读正文并纳入分析的只有以上 10 条及补充周边帖子。在无法对账号进行全文搜索的限制下,要继续增加数量需继续挖掘相关账号;但在本次会话中,确认完主要切入点(GPT-6 Astra / Fable 5.1 等闭源新闻机器人、useapi.net 等 API 聚合服务、ComfyUI / Stable Diffusion 个人创作者)后,新发现账号大多已停止活动或不相关(体育、政治、新闻类),因此停止收集。
  • Midjourney、Kling AI 等品牌官方账号要么已停止发帖,要么为空,无法用作实时新闻来源。
  • 以「Wan2.5」「Flux.2」「オープンソース 画像生成」等最新开源模型词进行账号搜索时均返回 0 个结果,未找到发布 Wan、HunyuanVideo、Qwen-Image、Chroma 等具体开源模型内容的 Bluesky 账号。开源动态仅能在 Stable Diffusion/ComfyUI 这些既有品牌范围内确认。

Lemmy

Lemmy — 图像与视频生成 AI 最新动态

社区
  • !«メールアドレス» — 5,708 人。遥遥领先的最活跃社区。ComfyUI 自定义节点、新模型权重发布、LoRA 等每天持续出现,实际上是「开源图像与视频生成 AI 新闻速报板」。
  • !«メールアドレス» — 2,360 人。以生成作品分享为主(新闻较少)。
  • !«メールアドレス» — 1,662 人。与 dbzer0 版本相近,但发帖频率较低。
  • !«メールアドレス» — 87,858 人。Lemmy 最大的科技社区之一,但单独关于图像/视频生成 AI 的话题很少,仅偶尔出现 Midjourney 企业新闻。
  • !«メールアドレス»(含其他实例镜像)— 大量转载 Reddit AI 子版块内容。数量较少,但可以发现 Runway 财报等独立来源。
  • !techtakes — AI 批评/怀疑派社区,包含讽刺 Midjourney 迷航等帖子。
帖子
  1. Midjourney 转向医疗超声 CT 扫描仪业务 — !«メールアドレス»,score 58,2026-06-18,https://www.theregister.com(原文来自 The Register)。相关:Midjourney 官方博客 https://midjourney.com/medical/blogpost(!hackernews,score 2,2026-06-18);讽刺社区反应「Midjourney AI pivots to Theranos」!techtakes,score 40,2026-06-19,https://pivot-to-ai.com/2026/06/19
  2. Midjourney 要求好莱坞工作室披露 AI 使用情况 — !«メールアドレス»,score 73,2026-07-05,https://techcrunch.com/2026/07/04
  3. Runway「企业业务翻倍,NRR 超过 300%」 — !ai_reddit,score 0,2026-08-30,https://www.reddit.com/r/ArtificialInteligence/comments/1w2hnea/(Lemmy 转载)
  4. Qwen-Image-2.0 发布:参数量从 20B 大幅降至 7B,整合生成+编辑,在 Elo 评估中超过 Nano Banana(权重即将公布) — !«メールアドレス»,score 12,2026-02-12,https://files.catbox.moe/l3mzzs.jpg(同时交叉发布到 !LocalLLaMA、!Aii、!artificial_intel)
  5. Wan Animate 2 已可在 ComfyUI 使用 — !«メールアドレス»,score 8,2026-08-08,https://blog.comfy.org/p/wan-animate-2-is-now-available-in
  6. LTX-2.5 获得 ComfyUI Day-0 支持 — !«メールアドレス»,score 5,2026-08-12,https://blog.comfy.org/p/ltx-25-day-0-support-in-comfyui
  7. Trellis.2 与 Pixal3D(3D 生成模型)获得 ComfyUI 原生支持 — !«メールアドレス»,score 4,2026-09-01,https://blog.comfy.org/p/trellis2-and-pixal3d-are-now-native
  8. MiniMax-H3(开放权重视频生成模型)生态快速扩张 — 从 8 月 8 日到 9 月 5 日,仅 !«メールアドレス» 就有超过 10 条内容。摘录:GGUF 量化版(21.6GB→8.9GB,score 10,https://huggingface.co/Abiray/MiniMax-H3-Pruned-GGUF)/ 4-8 step 加速 LoRA(score 6-7,https://huggingface.co/lightx2v/Minimax-h3-Turbo)/ 最长 120 秒+音频同步的长视频支持(score 5,https://huggingface.co/Smite79/MiniMax-H3-Longvideos)/ 混合注意力实现(score 3,https://github.com/Saganaki22/ComfyUI-VDN-H3,2026-09-05)
  9. GPU 原生视频增强节点群(ComfyUI-AetherScale、DLSS5 Visual Enhancer) — !«メールアドレス»,score 5,2026-09-01/09-05,https://github.com/vizart-vj/ComfyUI-AetherScalehttps://github.com/Merserk/dlss5-visual-enhancer
  10. 通过 Claude 的 MCP 从一个聊天界面调用 30 多种图像/视频生成模型,同一项目耗时从 2.5 小时缩短至 50 分钟 — !ai_reddit,score 1,2026-05-01,https://i.redd.it/6gqfafpaukyg1.png
信号
  • 开源侧已完全围绕 ComfyUI / HuggingFace 的「实现新闻」运转。相比新模型发布本身,大部分帖子讨论的是「某模型已加入 ComfyUI」「新的 LoRA 发布了」「量化版推出了」等周边生态更新。围绕视频生成模型 MiniMax-H3 的工具开发是当前主战场。
  • 3D 生成(Trellis.2、Pixal3D)正在开始整合进 ComfyUI,作为继图像、视频之后的生成对象,存在感逐渐提升。
  • 闭源内容在 Lemmy 更倾向于被作为「批评或丑闻」,而非「产品新闻」消费。Midjourney 转向医疗设备的消息,在一般科技/讽刺社区中的热度(score 58、73、40)高于生成 AI 社区。
  • Lemmy 上提及 Nano Banana 的内容,几乎都只出现在「开源模型已超过它」的比较语境中,未找到来自 Google 的一手信息帖子。
  • 本次调查期(最近 1 个月)内,未找到直接提及 Sora、Veo、Kling、Hailuo、Seedream/Seedance、Adobe Firefly 最新版的内容;有关 Adobe Firefly 的最新帖子来自 2025 年。
局限性
  • Lemmy 规模较小,图像/视频生成 AI 的专业讨论几乎全部集中在 !«メールアドレス» 一个社区。横向搜索其他实例(lemmy.ml、lemm.ee、lemmy.zip 等)后,结果大多重复或无关。
  • 全文搜索(/api/v3/search)对词语的模糊匹配较弱,对于「Sora」「Veo」等较短专有名词,命中的大多是不相关帖子(人名、其他服务名)。尝试 API 与 Web 搜索后,仍未找到关于 OpenAI Sora、Google Veo、Kling AI、Hailuo、ByteDance Seedream/Seedance 的 源自 Lemmy 的一手帖子(通过 Google 搜索也同样如此)。这很可能不是「没有讨论」,而是 Lemmy 搜索与覆盖范围的局限。
  • Qwen-Image-2.0 的帖子来自 2026 年 2 月,较为久远,并非最近 1 个月的话题;但由于它对开源与闭源比较轴具有价值,仍予以保留。
  • Runway、Claude MCP 相关内容并非源自 Lemmy,而是从 Reddit 转载到 !ai_reddit,一手信息仍在 Reddit。

Pinterest

Pinterest — 图像与视频生成 AI 新闻

以搜索词「Image and Video Generation AI News」从 Pinterest 收集了 50 条 Pin(output/pinterest.pins.md,未按 genre 划分的单一搜索)。已确认全部 50 张图片。

视觉主题
  • 「AI=白色人形机器人/赛博格」的符号化:无论是否与实际生成式 AI 内容有关,白色人形机器人,或机器人与人类侧脸合成的视觉,反复被作为「AI」的代名词使用([2, 19, 30, 35, 37, 40, 43, 44, 46, 48])。新闻与说明类 Pin 的缩略图几乎都收敛于此母题。
  • 霓虹×深蓝赛博配色占主导:由青色、紫色、洋红色光晕、电路板图案和深色背景构成的模板化信息图占绝大多数([3, 5, 6, 7, 10, 13, 17, 18, 19, 21, 29, 32, 34, 39, 42, 44, 46, 48, 49])。几乎没有实拍或手绘元素,明显是基于 Canva/图库素材批量制作的设计。
  • 「最佳 AI 工具」排行榜式清单是主要类型:Runway、Pika、Kling AI、Luma AI(Dream Machine)、Synthesia、HeyGen、InVideo AI、Kaiber、Adobe Firefly、ChatGPT Plus、Midjourney、Canva AI 等 logo 被排列在比较表和排名图中反复出现([9, 16, 20, 24, 38, 42])。[16] 和 [24] 内容几乎相同(Best Quality/Best Free 的二选一表),说明同一模板被多个发布者复用。
  • 快讯/汇总类新闻图:报纸式版面或「Breaking News」横幅的「本周 AI 新闻」摘要 Pin 很多([11, 12, 21, 29, 32, 33, 39, 43, 47, 50])。许多图片内直接烧录日期,不同时间的「快讯」图片混杂在同一搜索结果中,例如 2025 年 6 月 30 日[29]、2026 年 5 月 20 日[21]、2026 年 8 月 15 日[32]。
  • 展示实际生成结果或演示视频的 Pin 较少:绝大部分内容是 logo 或文字营销图;相比之下,展示实际输出的案例 Pin 只占 50 条中的约一成,包括 Google Veo 2 官方演示合集[8]、疑似 Luma 的风格转换网格(人物→木雕/折纸/乐高/花)[4]、Microsoft VASA-1 从一张图片+声音生成表情的演示[22]、维持紫色怪物角色一致性的图生视频示例[26]、AMD Amuse 生成的写实老渔夫肖像[41]等。
  • 「这是真的吗?还是 AI?」的怀疑与检测主题:带 FAKE 印章的猫照片和机器人[2]、「Which is AI?」山景猜图[15]、AI 语音检测 97%[18]、「AI 生成视频好还是坏」的正反清单[23]、写着「大家都在错误使用 AI」的霓虹招牌[46]等,存在一定数量煽动真伪判断与怀疑情绪的内容。
  • 真实名人照片和 AI 生成的「名人风」图像混杂:既有 Nvidia CEO 黄仁勋的真实舞台照片[45],以及疑似 Sam Altman 的 YouTube 缩略图[33];也有使用 AI 生成贝索斯风格面孔的 Fiverr 广告图[36]。在 Pin 列表中,实拍与 AI 生成的边界不易区分。
  • 开源内容极少:闭源工具(Veo、Sora、ChatGPT、Midjourney、Runway 等)的曝光占绝大多数;涉及开源/本地生成的只有报道中国 Baidu「Ernie 4.5」开源化的新闻版面[29],以及运行于 AMD GPU 的本地工具「Amuse 3.0」[41] 两条。未发现暗示 Stable Diffusion、ComfyUI、LoRA 等开源图像生成社区的 Pin。
值得注意的 Pin
  • [4](untitled/Lumalabs 风格转换网格) — 将实拍视频的一帧转换成「木雕」「折纸」「乐高积木」「花」,并将人物、狗和 Tesla 车辆的同类转换横向比较,是技术演示中最具体的一条。
  • [8] Google Unveils Veo 2 — 汇集女性观察显微镜、人在水下游泳、舞者画出星座、厨房中的动画少女、火烈鸟群等官方宣传素材,最直接展示 Veo 2 的视频表现范围。
  • [9] 6+ Best AI Video Generation Websites — 按功能与目标用户整理 Runway/Pika/Kling AI/Luma AI/Canva AI/Hailuo AI 的收藏型信息图,附有「Save this pin」引导,体现 Pinterest 特有的清单消费行为。
  • [16] AI Image Video: Best Quality vs Best Free — 将 10 种付费工具和 10 种免费工具按用途诊断流程对比。内容与 [24] 几乎相同,支持同类模板扩散的判断。
  • [22] VASA-1(Microsoft) — 从一张静态图片+音频片段+任意控制信号,生成表情丰富的说话人脸的研究演示图。在技术类 Pin 中最偏学术。
  • [27] Vidu S1 — 中国 ShengShu Technology 的实时 AI 交互模型,以华丽赛博朋克风视觉呈现,显示中国视频生成模型的存在感。
  • [29] AI NEWS(报纸风,2025-06-30) — 汇总 Baidu Ernie 4.5 开源化、OpenAI 借用 Google TPU、Meta 向 Scale AI 投资 143 亿美元等具体企业动态,是少数接近一手信息的 Pin。
  • [38] Top 10 Image-to-Video Generator Tools — 以 Runway Gen-3 为首,将 Kling、Google Veo、OpenAI Sora、Luma AI、Pika Labs、Kaiber AI、Synthesia、HeyGen、Adobe Firefly、InVideo AI 按排名列出,对主要参与者的覆盖较完整。
  • [41] Amuse 3.0(AMD) — 使用老渔夫的写实肖像,强调运行在 AMD GPU 上的本地 AI 艺术工具质量,是少数开源/本地生成侧实例之一。
  • [50] This Week's Top AI Developments — 汇总 Google 1,500 万聊天调查(86% 的使用不涉及工作)、ChatGPT 取消限制、AI 在 526 支队伍中击败 458 支的竞赛结果等基于统计的最新动向。
信号
  • 当前可见的状态:Pinterest 上的「Image and Video Generation AI」实际上已经成为「工具比较清单与新闻汇总信息图的 SEO/联盟营销市场」。Runway、Pika、Kling AI、Luma AI、Synthesia、HeyGen、InVideo AI、Adobe Firefly、Google Veo 等名称反复位列前列,显示它们被视作闭源视频生成 AI 的「常见组合」。
  • 同一模板被重复使用:鉴于 [16] 与 [24] 实际上是同一张图,Pinterest 上的 AI 工具比较内容很可能是少量模板被多个账号批量生产、重复发布。
  • 开源的缺席:可直接用于简报所需「开源动态」的实例只有 [29](Baidu Ernie 4.5)和 [41](AMD Amuse 3.0);完全没有 Stable Diffusion 系、ComfyUI 或 Hugging Face 生成 AI 社区图像。Pinterest 搜索结果偏向视觉亮眼的成品与营销素材,暗示其不适合作为开源技术社区帖子的载体。
  • 解释、比较和煽动型图片多于实际作品:50 条中,以真实 AI 生成视频或图像本身为主角的 Pin 仅约一成;绝大部分是文字主导的信息图或清单。在 Pinterest 上,「该选什么工具」这种决策辅助内容似乎比「使用该工具可以做出怎样的具体效果」更易传播。
局限性
  • 本阶段仅阅读了工作程序预先收集的 Pinterest 图片(images/pinterest/manifest.json,50 条,只有单一查询且未按 genre 划分),并未直接浏览 Pinterest。若通过额外关键词(例如「open source AI art」「Stable Diffusion」等)再次搜索,可能会找到更多偏开源的 Pin。
  • 图片内烧录的日期(2025-06-30、2026-05-20、2026-08-15 等)仅表示模板制作时间,无法从 manifest.json 得知实际被发布或保存到 Pinterest 的时间。
  • [12]、[15]、[21]、[23]、[29] 等图片内部分文字略显模糊(OCR 式读取可见「Human Journalism」「Machine-Genertsd Media」等模板本身的拼写错误),因此这里按要旨总结,而不是精确引用。
  • 有 5 条 Pin 标题为空(untitled)([12]、[15]、[21]、[29]、[35] 中部分),依据图片内容推测进行分类。

建议行动

  • 持续从代理操作而非单纯质量的角度,将 GPT-6 Astra 与 Fable 5.1 进行比较。
  • 下期继续追踪 MiniMax-H3 的 ComfyUI 生态(GGUF 量化、Turbo LoRA)。
  • 下次调查 X 时,不要依赖 Explore 热词,而应使用 Stable Diffusion、Wan、Flux、Qwen 等开源专属关键词。
  • 将 Lemmy 的 !«メールアドレス» 作为开源一手信息源优先查看。
  • 不要将 Pinterest 用作开源动态信息源,而应限定于观察闭源工具的营销动向。
  • 跟进是否有外部工具依赖即将于 2026-09-24 结束的 Sora API。

收集图片

图生视频 AI:其工作方式及重要性 - The Data ScientistAI 内容与社交媒体担忧🎨 AI 图像与视频创作Google 宣布超高质量视频……终极 AI 图像与视频生成平台 - The Data Scientist用于文字、图像、音乐和视频生成图标的 AI 内容创作概念 - 浏览 57 张图库照片、矢量图和视频AI 视频内容创作:高收入者……Google 发布 Veo 2:具备增强真实感与电影特性的先进 AI 视频生成工具做到极致 🎥️ 图生视频 AI——用 AI 让你的照片动起来AI 新闻:OpenAI 终于发布了我们期待的内容图片Veo 3 图生视频:通过 Gemini API 快速生成并支持原生音频2025 年顶级 AI 视频生成器图片用于图像与视频生成的 AI如今 YouTube 超过 20% 的内容由 AI 生成‎🚨 AI 变得吓人地厉害。AI 驱动的图像和视频分析AI 工具图片Microsoft 发布 VASA-1,为视频生成式 AI 设立新标准AI 生成视频:好还是坏?真相在这里!🤖🎥🚀2026 年 10 款最佳 AI 图像与视频工具|免费与付费 AI 工具比较什么是 Imagvio AI,以及它如何帮助创作者……Google 宣布视频生成 AI「Veo 3」……ShengShu Technology 发布 Vidu S1,将实时交互式生成带入 AI 视频将你的想法变成惊艳视觉作品!🎥图片"用个性化 AI 驱动的 4K 视频改变你的愿景 🎥✨"掌握视频与 AI:2025 年关键社交媒体营销趋势本周 AI 新闻 - 2026 年 8 月 15 日GPT 5.2、实时视频编辑器、AI 立体视频、移动 AI 代理、全身控制:AI 新闻生成式 AI 历史图片我会使用 synthesia sora ai kling ai runway ai invideo 制作 AI 视频讲解AI视频生成 📹AI 新闻与最新更新|人工智能趋势与突破图片‘Amuse 3.0’,一款包含……的 AI 艺术创作工具AI 视频创作:使用 AI 更快创作专业视频的完整指南"为什么 AI 聊天机器人无法跟上突发新闻"专业 AI 视频创作|电影感 AI 视频|自定义视频编辑Nvidia #全新 AI 工具 🤯 #新闻 #ai #openai #chatgpt #亮点 #shorts停止滑动……这个故事将彻底改变你看待 AI 的方式!如何用 AI 创建新闻频道|AI 新闻视频生成器|AI 唇形同步每位 YouTuber 在 2026 年使用的顶级 AI 工具|面向 YouTube 创作者的最佳 AIAI 视频生成器市场增长 2025–2032:改变视频创作的未来 🎥🤖本周顶级 AI 动态 - Google 1,500 万聊天研究

数据质量备注

由于 Reddit 无法通过 WebFetch 访问,仅有预先收集的 12 个帖子,未达到约 20 条的完成标准;X 的 Explore 热词大多无关,且未执行开源搜索;Bluesky 全文搜索 API 返回 403,因此改用替代收集方式;Lemmy 未找到闭源的一手帖子;Pinterest 仅使用一个通用查询,未进行开源专门搜索。

图库