KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-09-19

闭源阵营(Sora/Kling)正在进入退出与整合阶段,而开源阵营(Wan/LTX/MiniMax H3)则借助 ComfyUI 生态加速连续版本更新。

图像与视频生成 AI 新闻汇总 — 2026-09-19

嗨嗨🔥这次我深入挖掘了 Reddit、X、YouTube、Bluesky、Lemmy 和 Pinterest 六个平台,追踪闭源与开源视频、图像生成 AI 的动态!先说结论:闭源阵营(Sora、Kling、Nano Banana、Veo、Seedance 等)相比推出新功能,更多是「整合、退出、涨价压力」之类的防守型新闻⚡️;反过来,开源阵营(Wan、LTX、MiniMax H3、FLUX 系列)依靠 ComfyUI 生态持续猛烈地推出连续版本更新,势头确实很猛💪。不过,这次 X 只抓到了与主题完全无关的帖子,结果扑空;Reddit 也只收集到目标数量的一半左右,所以这部分会如实说明📉。

跨平台观察

  • 🆓 对“可免费使用的开源视频 AI”的渴望在各处都很明显。在 Reddit(r/generativeAI「Which AI video generator can still be used for free?」14pt、50 条评论,https://www.reddit.com/r/generativeAI/comments/1whtesl/)中,Wan、Minimax H3 和 LTX Video 被直接点名为“稳妥选择”;Lemmy(!«メールアドレス»)过去一周也一下子发布了 8 个以上围绕 MiniMax H3 的 ComfyUI 集成工具。YouTube 上也频繁提到 LTX(2.3→2.5)和 Wan(2.7→3.0)的连续更新,因此开源阵营的势头看起来确实不是虚的😤。
  • 🤝 闭源 API × 开源 OSS 工作流的融合正在成为默认做法。YouTube(ComfyUI 官方频道的 Nano Banana 2 Lite 教程,https://www.youtube.com/watch?v=n4F0htmBBvY)和 Bluesky(@comfyuiorg.bsky.social 将 FLUX.1 Kontext 制作成官方 API 节点的帖子)都呈现了同一现象:把闭源模型嵌入 OSS 工具中使用,已经变得很平常。
  • 📉 闭源阵营接连出现“退出、整合”新闻,而非新功能发布。YouTube(Kling AI 在 23 天内废弃 10 个模型及全部 API,https://www.youtube.com/watch?v=aE4MryHgFTQ/Sora 2 API 终止,https://www.youtube.com/watch?v=Zf9979o8RGk)和 Lemmy(OpenAI 关闭 Sora 平台,https://lemmy.world/post/44699468)相互印证了“闭源阵营正在进入淘汰阶段”的说法。
  • 👻 “能否辨别 AI 内容”的争论正在跨平台发酵。Reddit(r/Instagramreality 的“从细节能看出来”558pt,对比 r/ExplainTheJoke 的“已经分不出来了”70pt)以及 Pinterest 大量带有“FAKE”印章、或标注“这是 AI”的揭露类图片,都显示深度伪造焦虑在视觉和文本层面成为共通氛围。
  • ⚔️ 模型之间的硬核对比内容正在大量涌现。YouTube(Wan 3.0 vs Seedance 2.5、Seedance 2.5 vs Wan 3.0)、Lemmy(约 40 人盲测 Kling 3.0/Sora 2/Veo 3.1/Wan 2.7/LTX 2 Pro/Runway 4.5,Veo 以微弱优势第一)、Bluesky(Perilli 的 Sora vs Hunyuan Video 测试)都表明,闭源和开源顶级模型已经进入正面硬碰硬比较的时代。

分平台观察

Reddit — 只收集到了目标 20 条左右的一半,即 11 个帖子,但内容很扎实。可以看到推荐免费开源工具(Wan/Minimax H3)的趋势;Google Flow 的免费额度受到好评,但 Gemini 本体因收紧配额而引发不满;还有公司要求设计师每周生成 500 张 AI 图片而引发争议(57pt,“500 good AI images? No.”)等真实摩擦👀。

X — 彻底扑空😇。收集到的 40 条帖子全是科索沃政治、迷因币、皇室八卦等内容,零条涉及图像/视频生成 AI。原因是采集器并未使用主题搜索词,而是使用了 X Explore 的趋势词(Kosovo、Jubjub、Trump 等);这并不代表 X 上不存在相关信息。X 是简报指定的平台中唯一“没有可用材料”的平台。

YouTube — 信息密度最高的平台💯。涵盖 Kling 全面废弃、Sora 2 结束、Runway 周度更新、LTX-2.5 和 Qwen Image 3.0 等开源新模型,以及 Wan 3.0 vs Seedance 2.5 这样的硬核比较。不过,受 JavaScript 限制影响,播放量和订阅数未能确认。

Bluesky — 搜索 API 持续被 403 拦截,因此改为直接读取 Replicate、ComfyUI 官方、个人开发者等 9 个已知账户的时间线,获得了 15 条内容。可以看出闭源模型以季度节奏更替(Kling 3.0→Runway Gen-4.5→Vidu Q3→Seedance 2.0→GPT Image 2),但点赞数仅为 1~9,互动较少。Midjourney 和 Hugging Face 官方在 Bluesky 上没有帖子。

Lemmy — 未达到目标 20 条。多数闭源新闻并非源自 Lemmy,而是经由 Reddit 镜像机器人(ai_reddit)转发;开源新闻则高度集中在 !«メールアドレス»。日本政府要求 Sora 2 加强版权限制的新闻(884 个赞、153 条评论)是本次传播最广的内容。

Pinterest — 检查了超过目标数量的 31 张图片(总计 50 张)✅。视觉上,Runway、Pika、Kling、Luma、Midjourney 等闭源面向消费者的工具标志密集出现;Stable Diffusion/Flux/ComfyUI 等开源品牌则几乎不见踪影,因此在“视觉存在感”上闭源阵营完全占优。不过也有诸如“GPT-6 Astra”这类未经证实的信息图,因此不能照单全收⚠️。

值得关注

  1. MiniMax H3 的 ComfyUI 集成热潮(Lemmy,https://lemmy.dbzer0.com/post/75586072)— 开源视频模型的实战部署速度能持续到什么程度。
  2. Kling AI 废弃 10 个模型及 API(23 天内)(YouTube,https://www.youtube.com/watch?v=aE4MryHgFTQ)— 闭源阵营的整合阶段是否会蔓延至其他公司。
  3. Sora 2 API 终止(预计 2026-09-24)及其继任者“Spud”(YouTube,https://www.youtube.com/watch?v=Zf9979o8RGk)— OpenAI 视频战略转向的后续走向。
  4. Google Flow 免费额度 vs Gemini 本体收紧配额(Reddit,https://www.reddit.com/r/GeminiAI/comments/1wjkdb4/)— 同一家 Google 内部采用不同付费压力策略的情况。
  5. LTX-2.5 / Wan 3.0 的连续版本更新(YouTube,https://www.youtube.com/watch?v=ZDfjZae7Da0)— 继续观察开源模型是否已达到可与闭源阵营正面比较的水平。
  6. 企业 AI 图片生成配额问题(Reddit,https://www.reddit.com/r/graphic_design/comments/1wieke2/)— 批量生产压力与质量保障之间的摩擦将如何在实际工作中解决。

建议

  1. 应使用主题专属搜索词(Sora、Nano Banana、Wan、ComfyUI 等)重新采集 X;本次结果为零,无法使用。
  2. 为绕过 Bluesky 搜索 API 的 403,应预先建立主要已知账户(Replicate、ComfyUI 官方、Black Forest Labs 等)清单,改为直接读取时间线,以提高稳定性。
  3. Reddit 和 Lemmy 不应只搜索一次“Image and Video Generation AI News”,而应以各模型名(Sora、Kling、Wan、FLUX、Nano Banana 等)多次搜索,使样本量接近目标的 20 条。
  4. 开源新闻优先关注 Lemmy 的 !stable_diffusion 系社区,闭源新闻优先关注 YouTube 的评测频道;这一组合最能高效获取信息,下次应优先加大覆盖。
  5. 对 Pinterest 中含有未经证实内容的 Pin(如“GPT-6 Astra”),在报告中应始终明确标为“未经证实”。

数据质量

X(40 条中 0 条相关,因搜索词错误而实质采集失败)和 Reddit(11/约 20 条目标)未达到完成标准;Bluesky 和 Lemmy 也未达到 20 条目标,只能通过已知账户的替代采集补足。YouTube 虽确保了内容数量,但播放量、订阅数与精确日期因 JavaScript 渲染限制而未确认。只有 Pinterest 超过目标,精查了 31 条。总体而言,在“数量”上 6 个平台中有 4 个未达标,尤其 X 完全扑空,是本次最大的弱点。

分平台汇总

Reddit

Reddit — 图像与视频生成 AI 新闻

来源

收集的 11 个帖子来自 9 个 subreddit,全部通过搜索词“Image and Video Generation AI News”命中。

Subreddit 成员数 收集帖子数
r/generativeAI 154,683 3
r/Instagramreality 1,155,043 1
r/aivideomaking 7,210 1
r/AIToolTalks 6,646 1
r/aifilmmaking 8,115 1
r/graphic_design 2,929,105 1
r/aitubers 28,732 1
r/GeminiAI 375,193 1
r/ExplainTheJoke 1,846,760 1

r/generativeAI 的内容最多,共 3 个帖子。其他社区各收集到 1 个,成员超过 100 万的大型社区(r/Instagramreality、r/graphic_design、r/ExplainTheJoke)也各有 1 个被采集到。

用户观点
  • 想免费使用视频 AI 的人非常多(帖子 #1「Which AI video generator can still be used for free?」r/generativeAI、14pt、50 条评论、2026-09-16,https://www.reddit.com/r/generativeAI/comments/1whtesl/)。u/RioMetal(4pt) 表示:“If you can go local you have plenty of them, like Wan or Minimax”,整体讨论被引向开源阵营。相同需求的帖子也出现在 #2(r/aivideomaking、0pt、19 条评论)和 #3(r/generativeAI、2pt、7 条评论),三者都反映同一类需求。

  • 开源方面,Wan、Minimax H3 和 LTX Video 被视为稳妥选择(帖子 #9「Need a good video generation AI for image to video of people」r/generativeAI、0pt、20 条评论、2026-09-15,https://www.reddit.com/r/generativeAI/comments/1wh1y9d/)。u/f5alcon(3pt) 表示:“Minimax H3 is the best local generator”;u/jworm0624(1pt) 表示:“Krea 2 turbo for images, minimax h3 for videos. All on comfyui”。对于拥有 RTX 5090 的用户,强烈推荐本地生成。

  • 闭源一侧,Google Flow/Veo 的免费额度颇受欢迎(帖子 #6「Google Flow is giving creators a surprisingly generous amount of free AI video generation right now」r/aifilmmaking、7pt、7 条评论、2026-09-14,https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/)。u/MechanicForward2274(1pt) 对“50 credits a day is actually enough to experiment with a lot”持肯定态度;但 u/Sea-Temporary-6995(1pt) 认为:“It's weak at physics and logic. Even Minimax is far better IME”,评价明显两极化。

  • 同属 Google,Gemini 却在收紧配额(帖子 #10「What are these new limits on models and image/video generation?」r/GeminiAI、4pt、5 条评论、2026-09-18,https://www.reddit.com/r/GeminiAI/comments/1wjkdb4/)。u/Queasy-Pause-3958(4pt) 说:“They want us to upgrade :(”,免费用户与 Pro 用户都将其视为付费引导。

  • Nano Banana Pro 自己生成的图片却被 Flow 的过滤器拦下,形成矛盾(帖子 #9)。原帖作者称:“Even photos made by Nano Banana Pro itself will be flagged by Flow. I've just retried the same generation 60 times without a single one passing”。用户不满闭源产品的安全过滤器妨碍体验。

  • 企业要求设计师每周生成 500 张 AI 图片,引发反弹(帖子 #7「Company expects us to generate 500 AI images PER WEEK. Is this realistic?」r/graphic_design、57pt、126 条评论、2026-09-17,https://www.reddit.com/r/graphic_design/comments/1wieke2/)。热门评论 u/Diligent-Educator409(122pt):“500 AI images? Yes. 500 good AI images? No. 1 good AI image? Also no.” 引发广泛共鸣,直观展示了从业者对批量生产压力的冷淡反应。

  • 一边是 AI 图片已经很容易被识破,另一边则是越来越难辨认,两种情况同时出现。帖子 #4「AI generated images on Reddit with thousands of upvotes and comments」(r/Instagramreality、558pt、145 条评论、2026-09-18,https://www.reddit.com/r/Instagramreality/comments/1wk0euk/)中,u/Smart-Membership-117(91pt) 通过“图片 2 和 3 中她膝盖旁踢脚线不同、窗外绿植完全变化”等细节识破。相对地,帖子 #11「What about the AI generated images?」(r/ExplainTheJoke、70pt、7 条评论、2026-09-19,https://www.reddit.com/r/ExplainTheJoke/comments/1wk79g4/)中,u/Connoralpha(31pt) 认为:“Means they can't tell which images are AI generated anymore”,反映出一种越来越难辨别的幸存者偏差式感受。

  • 社区强烈反对用 AI 全自动生成无露脸 YouTube 视频(帖子 #8「best apps for generating AI videos」r/aitubers、0pt、43 条评论、2026-09-14,https://www.reddit.com/r/aitubers/comments/1wg3duk/)。u/RobJames007(14pt) 表示:“You basically want an AI slop machine... Youtube is trying to reduce AI slop, not allow more of it onto the platform”;u/-NearlyThere-(5pt) 也称:“And I will be there to report and downvote this type of slop”,社区排斥反应很强。

  • 对 AI 整体的社会焦虑也会延伸到图像/视频 AI 话题中(帖子 #5「Are all of you also anxious about recent news about AI?」r/AIToolTalks、12pt、35 条评论、2026-09-13,https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/)。围绕水资源、就业的担忧,与 u/Big-Pops78(3pt) 的反驳“AI is not that much different from other technologies that have come to pass”形成拉锯。这更接近一般 AI 伦理讨论,而非纯图像/视频议题。

  • 免费工具帖里,AI bot(Jenna_AI)亲自长篇介绍“绕过方式”的现象很有意思(反复出现在帖子 #1、#3、#9)。在帖子 #9 中,u/Apprehensive_Oil1475(1pt) 说:“Disregard Jenna bot, it's using outdated info”,用户直接以信息过时为由否定 bot 的回答。

信号
  • 上升趋势:Wan / Minimax H3 / LTX Video 等本地开源视频生成工具,在多个帖子中被点名为“可以认真免费使用的选择”。拥有 RTX 5090 等高端 GPU 的用户正在流向本地生成。
  • 下降/被嘲讽的对象:寻找无露脸 YouTube 视频全自动生成工具会被明确嘲笑为“AI slop”(帖子 #8)。这是一个罕见的、针对“请推荐效率工具”的回答几乎全是讽刺的帖子。
  • 意外分歧:同样是 Google 的闭源策略,Flow/Veo 因“慷慨的免费额度”(帖子 #6)获得正面评价,而 Gemini 本体因“收紧配额、引导付费”(帖子 #10)成为不满对象。同一公司内的用户感受截然相反。
  • 另一处矛盾:关于 AI 图片是否容易识别,r/Instagramreality(帖子 #4)认为“细节失误一眼就能看出”,r/ExplainTheJoke(帖子 #11)则认为“已经越来越分不出来”,两种相反的实际感受同时存在。
  • 企业使用的摩擦:每周 500 张 AI 图片的任务配额(帖子 #7),具体展示了企业“既然买了 AI 工具就批量生产”的期望,与一线设计师“即使能量产也无法保证质量”的反弹之间的温差。
限制
  • 简报的完成标准为每个平台分析约 20 个帖子,但实际只收集到11 个。搜索词仅为“Image and Video Generation AI News”,未进行针对开源/闭源的单独搜索。
  • Stable Diffusion、Flux、Midjourney、Sora、Kling、ComfyUI 更新等,以单个工具公告为主题的帖子并未出现在收集列表中(仅在对话中被提及)。
  • 每个帖子的“热门评论”最多仅收集 6 条,未查看之后数十至数百条评论的讨论发展。尤其帖子 #7(126 条评论)和 #4(145 条评论)可能遗漏了讨论的大部分内容。
  • 因规则禁止对 Reddit 本体进行 WebFetch/WebSearch,本报告仅基于已收集文件(reddit.threads.md / .json)范围内的信息。未对更多 subreddit 或延长时间范围进行额外搜索。

X

X — 图像与视频生成 AI 新闻

账户

收集到的 40 条帖子、35 个账户,属于与图像/视频生成 AI 无关的账户群。按主题分类如下:

主题 主要账户 趋势
科索沃政治 @theDitkaDog(3 条帖子、共 76 个赞), @Cesar_J_Lopez(1 条帖子、16 个赞) 连续发布政治批评
迷因币“$JubJub”炒作 @anwar_azim33010(2 条帖子、89 个赞) 连续炒作小币种
塞尔维亚相关迷因/政治 @darem88, @okhtyanin, @Num1MudkipFan(各 1 条、小规模) 单条闲聊或迷因
批评冯德莱恩(Ursula) @777ursula(1 条 10,194 个赞、约 213,000 浏览), @Chu_Haitang(419 个赞), @DailyMail(238 个赞、351 条回复) 单帖爆红型(@777ursula 特别突出)
批评南非面向外国人的社会保障 @RevoGangSta777(2 条、共 1,189 个赞) 政治类连续发帖
查尔斯·斯宾塞(英国王室八卦) @Sue__Suede(2 条、916 个赞), @hernandez_64876, @eddluxe 八卦传播型
萨格勒布相关(足球博彩、当地帖子) @BDreamz37398, @crnajulija, @zagskii, @SpectatorHR 单条、小规模
加密资产 $ZEC @AltcoinDaily(1,333 个赞、936 条回复), @rhea_finance, @Coinberry, @zKult_ 行情讨论与宣传
特朗普相关新闻 @Reuters(529 个赞), @La_SER(270 个赞), @AntiTrumpCanada(2,911 个赞), @TheOtherBigO(5,939 个赞) 新闻机构与政治爆款
西班牙(足球/迷因) @vspxrr(4,980 个赞), @louiology, @Lisaprotector, @REMOutOfContext 足球闲聊与迷因

其中既有“单条帖子大爆红的账户”(@POLREWK0M 43,987 个赞、@777ursula 10,194 个赞、@TheOtherBigO 5,939 个赞、@vspxrr 4,980 个赞),也有“多条帖子但每条规模都小的账户”(@theDitkaDog、@RevoGangSta777、@Sue__Suede、@anwar_azim33010),但没有任何一个账户在发布图像/视频生成 AI 内容。

帖子

这 40 条中,提及图像生成 AI 或视频生成 AI 的帖子为 0。 例如:

  1. #5 @anwar_azim33010 — “Last chance before 10m candle on $JubJub .”(42 个赞、约 527 浏览、2026-09-18)→ 迷因币投机
  2. #15 @777ursula — “fofopardus fofocayo”(10,194 个赞、约 213,000 浏览、2026-09-18)→ 无意义造词迷因,仅出现在冯德莱恩相关串中
  3. #35 @Reuters — “BREAKING: President Trump banned news outlets CNN, MSNOW and Politico from the White House...” (529 个赞、约 200,000 浏览、2026-09-18)→ 政治新闻
  4. #40 @vspxrr — 关于 Hollow Knight/Silksong 类型名称的争论(4,980 个赞、约 40,000 浏览、2026-09-18)→ 游戏闲聊

在探索到的 40 条中,完全没有涉及 AI 生成图片、视频、Midjourney、Sora、Veo、Nano Banana、Stable Diffusion、Kling、ComfyUI 等关键词的帖子。

信号

无法检测与主题有关的信号(因为相关帖子为零)。但可以发现采集流程本身存在问题:查看 output/x.posts.md 开头的“Searched”栏,搜索词为“Kosovo”“Jubjub”“Serbia”“Ursula”“Africa”“Charles”“Zagreb”“$ZEC”“Trump”“Spain”十个词,与本次会话 Explore 页面中的趋势词(见表)几乎完全一致。也就是说,这次采集没有使用研究简报中的主题词(图像/视频生成 AI),而是直接搜索了 X Explore 的趋势词。Explore 的区域栏还出现了“Trending in Croatia”“Politics · Trending”等,似乎源自巴尔干地区(克罗地亚)的服务器环境,亦非全球共通趋势。

限制
  • 本次 X 采集与主题无关。 在达到完成标准(每个平台分析约 20 个帖子)之前,采集数据中就已经没有任何一条涉及图像/视频生成 AI。因此,本报告没有关于“闭源动态”或“开源动态”的可用材料。
  • 搜索词并非主题关键词(例如“AI video generation”“Midjourney”“Sora”“Stable Diffusion”“Nano Banana”“Veo”等),而是 X Explore 趋势词(Kosovo、Jubjub、Serbia、Ursula、Africa、Charles、Zagreb、$ZEC、Trump、Spain)。这是采集器选择搜索词的问题,并不说明 X 本身没有相关信息。
  • 因此,本报告对 X 上图像/视频生成 AI 的提及只能说“没有找到”,无法得出更多结论。若重新采集,应使用符合主题的搜索词(英文、日文的工具名和专有名词)重新执行。

YouTube

YouTube — 图像与视频生成 AI 新闻(闭源/开源)

频道
  • Runway(官方频道)— 持续发布 Gen-4.5/Aleph 相关的周度更新视频“Runway This Week”系列。
  • LTX_io(Lightricks 官方频道)— 发布 LTX-2.5(开放权重“世界模型”)的发布视频。
  • ComfyUI(官方频道)— 发布大量关于 Nano Banana 2 Lite、Qwen 系开源模型 ComfyUI 集成的教程。
  • Thaeyne — 专注于 Midjourney 各版本比较(如 v8.1 vs v8.2)的个人频道。
  • Skill MD — 讲解 Kling AI 等中国闭源视频生成 AI 新闻的频道。
  • Joseph Martin — 评测 Wan 3.0、Seedance 等开源/闭源混合视频生成 AI 的频道。
  • Codedigipt — 对 Qwen Image 3.0 等最新图像生成 AI 进行快速评测的频道。
  • Sean Standberry — 介绍 AI 工具整体新闻和替代工具的频道。

由于 YouTube 搜索结果 HTML 依赖 JavaScript 渲染,未能获取频道订阅数(详见下方限制)。

视频
  1. Kling AI Is Killing 10 Models in 23 Days. What Creators Need to Know
    频道:Skill MD / 日期:约 2026 年 9 月 15 日 / 播放量:未确认
    https://www.youtube.com/watch?v=aE4MryHgFTQ
    → 闭源。解读 Kling AI 宣布在 23 天内废弃 10 个旧模型、全部 API 以及 119 种视频特效模板的新闻。

  2. Wan 3.0 ACTUALLY BEAT Seedance 2.5... Full Test
    频道:Joseph Martin / 日期:2026 年 9 月上旬(“1 week ago”) / 播放量:未确认
    https://www.youtube.com/watch?v=pchMefSPoSg
    → 开源(Wan、阿里巴巴)与闭源(Seedance、字节跳动)的直接对决。结论称 Wan 3.0 以近乎一半的成本胜过 Seedance 2.5。

  3. BREAKING: Sora 2 is SHUTTING DOWN… So I Tested the Best Alternatives
    频道:Sean Standberry / 日期:2026 年 3 月下旬(Sora 宣布结束后) / 播放量:未确认
    https://www.youtube.com/watch?v=Zf9979o8RGk
    → 闭源。针对 OpenAI 宣布结束 Sora 2(API 预计于 2026 年 9 月 24 日完全停用),实际测试替代工具。

  4. The Ultimate Midjourney v8.2 vs v8.1 Comparison
    频道:Thaeyne / 日期:2026 年 8 月 3 日 / 播放量:未确认
    https://www.youtube.com/watch?v=ltfe2Z1DX9g
    → 闭源。以 100 种提示词比较 Midjourney V8.2(2026 年 7 月 24 日成为默认版本)和 V8.1,确认新版具有更强的身份保持和一致性。

  5. LTX-2.5: The World Model the World Builds On
    频道:LTX_io(官方) / 日期:2026 年 8 月 11 日 / 播放量:未确认
    https://www.youtube.com/watch?v=ZDfjZae7Da0
    → 开源。官方发布 LTX-2.5(220 亿参数的开放权重视频与音频模型),并强调其在机器人和实时应用中的潜力。

  6. Nano Banana 2 Lite in ComfyUI: Fast AI Image Generation
    频道:ComfyUI(官方) / 日期:2026 年 7 月上旬(Nano Banana 2 Lite 发布后) / 播放量:未确认
    https://www.youtube.com/watch?v=n4F0htmBBvY
    → 闭源(通过 API 集成到 OSS 工具)。讲解如何在 ComfyUI 中接入 Google Nano Banana 2 Lite(每张约 4 秒生成,$0.034/1000 张)。

  7. Qwen Image 3.0 : The Ultimate FR*EE AI Image Generation Model
    频道:Codedigipt / 日期:2026 年 7 月 22 日 / 播放量:未确认
    https://www.youtube.com/watch?v=VO4DQfbhN4I
    → 开源。将阿里巴巴 Qwen Image 3.0 介绍为免费且高精度的图像生成模型,并测试排版和 UI 设计生成能力。

  8. Runway This Week | August 10
    频道:Runway(官方) / 日期:2026 年 8 月 10 日 / 播放量:未确认
    https://www.youtube.com/watch?v=greS_-1vA_0
    → 闭源。Runway 官方周度更新,介绍 Gen-4.5/Aleph 周边的新功能和集成(如 Adobe Premiere Pro/After Effects 插件)。

  9. HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?
    频道:不明(仅确认搜索结果) / 日期:约 2026 年 6 月 25 日 / 播放量:未确认
    https://www.youtube.com/watch?v=4GNT4-QYekg
    → 开源模型之间的比较。比较腾讯 HunyuanVideo 1.5 与阿里巴巴 Wan 2.7 的 VRAM 需求、动作质量和物理模拟准确度。

  10. Seedance 2.5 vs Wan 3.0: The Closest AI Video Battle Yet? (Full Comparison)
    频道:不明(仅确认搜索结果) / 日期:2026 年 8 月 16 日 / 播放量:未确认
    https://www.youtube.com/watch?v=_vcNJnAeUKo
    → 闭源(Seedance)和开源(Wan)最新版本的硬核比较。显示两大阵营的顶级模型差距已经非常接近。

信号
  • 闭源阵营的“战略转向”新闻更突出:OpenAI 将于 2026 年 9 月 24 日完全结束 Sora 2 API,并将资源集中到新模型“Spud”;Kling 则在 23 天内废弃 10 个模型及全部 API。连续出现的是舍弃既有产品、向下一阶段推进的新闻,而非简单的新功能发布。
  • 开源阵营保持高频连续版本发布:LTX(2.3→2.5)、Wan(2.7→3.0)、Qwen Image(2512→3.0)都在 2026 年内多次进行大版本更新,已经达到与 Nano Banana、Midjourney、Sora、Kling、Seedance、Runway 等闭源主流模型正面比较的水平。
  • 闭源与开源的功能融合:Google Nano Banana 2 Lite、Qwen Image 3.0 已被嵌入 ComfyUI 等开源工作流中使用;YouTube 教程中,闭源 API + OSS 工具的组合正在成为主流。
  • 视频生成 AI 的主战场正在转向“音频同步、长视频、世界模型化”:Wan 3.0 的 30 秒连续生成和文档转视频、LTX-2.5 面向机器人的世界模型化、Runway 的多模态音频集成,都反映竞争从单纯画质转向应用扩展。
限制
  • YouTube 搜索结果页(youtube.com/results?search_query=...)采用动态 JavaScript 渲染,WebFetch 无法取得实际视频列表(标题、播放量、上传日期),只返回页脚导航链接。单独的视频页面(watch?v=...)同样无法直接获取正文元数据。
  • 因此,报告中的视频信息结合了 WebSearch(经 Google 的 site:youtube.com 搜索)和 YouTube oembed API(只能获取标题和频道名);精确播放量和频道订阅数未能确认。日期也只是基于 WebSearch 摘要的估算。
  • 受上述限制,无法打开单条视频页面直接阅读评论区或描述文字。
  • Reddit/X/Bluesky/Lemmy/Pinterest 在其他阶段处理,因此本文件未涉及;这并非本阶段的遗漏。
  • 搜索本身针对 Sora、Nano Banana、Midjourney、Kling、Wan、Qwen Image、LTX、FLUX.2、Runway、Grok Imagine、Seedance 等主要主题执行了超过 15 个查询,确认 40 多个视频候选后,排除了失效链接、重复内容与较旧的视频(2025 年至 2026 年前半),最终筛选出上述 10 条。

Bluesky

Bluesky — 图像与视频生成 AI 新闻

账户
  • @replicate.com — API 提供商 Replicate 官方账户。每当可通过 Replicate 使用新的闭源模型时便发布公告。仅在 2026 年 2~4 月,便连续发布 GPT Image 2、Seedance 2.0、Vidu Q3、Runway Gen-4.5、Kling 3.0。
  • @luok.ai — AI 视频创作者(luokai)。分享使用 Seedance 2 制作的视频,以及 Jimeng(即梦,字节跳动系 AIGC 视频服务)的介绍等,对实际使用闭源工具的感受进行发帖。
  • @dahara1.bsky.social — 使用日语发帖的 AI/本地 LLM 个人账户。并非只关注图像/视频生成,但会频繁发布对 ChatGPT Images、Gemini、Nano Banana 等时事 AI 工具的简短看法。
  • @comfyuiorg.bsky.social — ComfyUI 官方账户。发布开源工作流介绍,以及 Wan2.1、FLUX.1 Kontext 等支持信息。但最近帖子停留在 2025 年 6 月 24 日,之后未确认有更新。
  • @doctordiffusion.bsky.social — 发布 Stable Diffusion 3.5、Flux Dev 微调模型(如 Absynth 2.0)的个人开发者。通过附带 HuggingFace/Civitai 链接发布新模型。
  • @perilli.com — AI 行业观察者 Alessandro Perilli。其特点是亲自比较闭源和开源工具,例如 Sora 对 Hunyuan Video 的测试,以及 ComfyUI 上 FLUX.1 USO LoRA 对 FLUX Redux 的风格迁移测试。
  • @stablediffusion.bsky.social — 自称“Stable Diffusion online AI”的 AI 艺术社区运营账户。更多用于通过 #DragonTuesday 等标签活动收集用户作品,并非新闻账户;最新帖子停留在 2025 年 2 月。
  • @civitai-bot.bsky.social — 自动发布 Civitai(开源模型共享站)checkpoint 更新的机器人。但可取得的帖子全为 2024 年 5 月,此后时间线中未见更新。
  • @midjourney.bsky.social / @huggingface.bsky.social — 两个句柄都存在,但时间线均为空。Midjourney 与 Hugging Face 官方似乎没有将 Bluesky 作为一手发布渠道。
帖子
信号
  • 闭源视频模型从 2026 年开始以季度节奏迭代:仅 Replicate 账户上就持续出现 Kling 3.0(2 月)→Runway Gen-4.5(2 月)→Vidu Q3(3 月)→Seedance 2.0 全面开放(4 月)→GPT Image 2(4 月)。但每条通常仅有 1~5 个赞,互动不高,给人的印象更像平静的公告频道,而非 Bluesky 上的热潮。
  • 开源阵营的话题更偏向工作流/工具,而非新闻:ComfyUI、DoctorDiffusion、Perilli 的帖子重点不是“新模型发布”,而是“可以怎样组合使用这个模型”的实践报告。Wan2.1、FLUX.1 Kontext、LTX-Video 等更多在工具集成语境中出现,而非新闻快讯。
  • 官方账户并未认真经营 Bluesky:Midjourney、Hugging Face 官方虽有句柄却没有帖子;Stable Diffusion 社区账户也在 2025 年 2 月停止更新;Civitai 机器人也不像在 Reddit 或 X 那样活跃(可获取内容仅为 2024 年 5 月)。作为企业一手公告渠道,Bluesky 明显不如 X/Reddit。
  • 日语用户发布内容处于个人感想层面:dahara1 这样的账户会发布对 ChatGPT Images 2.0、Nano Banana 是否有水印等细节体验的看法,但规模不足以形成活跃讨论串,通常止于单条帖子。
限制
  • Bluesky 公开搜索 API(app.bsky.feed.searchPosts,经 public.api.bsky.app)本次无论更换何种关键词,均持续被HTTP 403 Forbidden拦截;不仅是“image generation AI”这类具体词,即使是“AI”“test”等简单词也同样失败。而 getProfile、getPostThread、getAuthorFeed 等非搜索型只读端点可正常工作。
  • bsky.app 本身是客户端渲染 SPA,直接获取搜索结果或单帖页面也不会返回文本内容(HTML 中仅有 OGP 级别信息)。也无法采用浏览器人工浏览作为替代方案。
  • 因此,通过 Web 搜索从外部索引寻找 Bluesky 账户和帖子 URL 的线索,再依据线索使用 getAuthorFeed/getPostThread 获取真实数据(正文、日期、点赞数、转发数)。Google 等搜索引擎几乎不会索引 Bluesky 帖子正文,因此能发现哪些账户和帖子有很大偶然性。
  • 受上述限制,未能按搜索基础达到简报要求的每个平台约 20 个帖子分析标准。从 9 个账户时间线(总计约 140 条帖子)中,筛选出 15 条符合主题的内容放入本报告的 ## Posts。
  • 已发现内容的新鲜度不一。Replicate、luokai、Dahara1 的帖子相对较新,来自 2026 年 2~5 月;ComfyUI 官方、DoctorDiffusion、Perilli 的帖子主要来自 2025 年 1~10 月,对于 2026 年 9 月的“最新新闻”而言较旧。受搜索阻断影响,无法确认这些账户之后发布了什么。
  • 未能通过搜索发现 Black Forest Labs(Flux 开发方)的官方 Bluesky 账户。

Lemmy

Lemmy — 图像与视频生成 AI 新闻

社区
  • !«メールアドレス» — 5,712 人。db0(AI Horde 运营方)实例的核心社区,以技术导向的模型/LoRA/工具发布为主。仅过去一周就有大量 MiniMax H3 相关工具帖子。
  • !«メールアドレス» — 2,361 人。展示使用 Stable Diffusion / 开放权重模型创作作品的画廊型社区,几乎每天都有帖子。
  • !«メールアドレス» — 1,598 人。专门分享动漫 AI 艺术,仅限 SFW。
  • stable_diffusion_abstract / stable_diffusion_mycology(lemmy.today) — 由个人用户 PapaSkwat 运营的高度小众主题社区,发布本地运行 SDXL + 自定义 LoRA 生成的抽象画和蘑菇图片。规模较小(页面上不显示订阅数)。
  • !«メールアドレス» — Lemmy 最大的综合技术社区之一。Sora、Seedream、Grok 等大型闭源新闻会流入这里。
  • !«メールアドレス» — 8,244 人。面向批评生成式 AI 的社区。当图像/视频生成 AI 新闻以负面方式引起讨论时,常会出现在此处。
  • !ai_reddit(多个实例部署 bot) — 通过 RSS 镜像 Reddit AI 相关 subreddit(如 r/ArtificialInteligence)的机器人群。并非 Lemmy 原创内容,但在 Lemmy 上可阅读的 AI 内容量最大。
帖子

闭源

  • 日本政府要求 OpenAI 的 Sora 2 遏制版权侵权(technology,884 个赞、153 条评论,2025-10-15)— 报道援引政府评论称“漫画和动画角色是日本引以为傲、不可替代的财富”。评论区充满“OpenAI is copyright infringement”等尖锐反应。 https://lemmy.world/post/37391040
  • OpenAI 将关闭 Sora 视频平台(technology,23~29 个赞,2026-03-24)— 引用 Variety 报道,评论认为“未能获得足够用户,属于过度炒作”。 https://lemmy.world/post/44699468
  • 字节跳动 Seedream 4.0 声称超越 Google“Nano Banana”(technology,2 个赞,2025-09-10)— 分享字节跳动新图像生成模型的新闻文章。 https://lemmy.org/post/1711288
  • 以相同提示词比较 6 个视频 AI 模型,约 40 人进行盲测(经 ai_reddit,2026-09-17)— 比较 Kling 3.0 / Sora 2 / Veo 3.1 / Wan 2.7 / LTX 2 Pro / Runway 4.5,结果为“Veo 以微弱优势第一,前三名几乎不分伯仲”。 https://www.reddit.com/r/ArtificialInteligence/comments/1wipgwa/
  • “用 4 种 AI 为同一格《Berserk》漫画上色,最终 GPT 会赢吗?”(经 ai_reddit,2026-09-14)— 比较 Nano Banana Pro 等多个模型的上色效果。 https://www.reddit.com/gallery/1wfyqdy
  • Google 在公开 Earth 应用“Nano Banana”功能次日悄悄移除(经 ai_reddit/Fortune 文章,2026-08-07)— 据报道原因是可能被滥用于生成错误地形图像。
  • 多条 Seedream 5.0 Pro 相关比较与评测帖子(经 ai_reddit,2026 年 2~7 月间断发布)— Seedream 5.0 Lite/4.5/Nano Banana Pro 的并列比较文章被反复分享。
  • 马修·麦康纳为防范 AI 滥用,将自己的标志性口头禅注册商标(technology,2026-01-16)— BBC 报道称,此举是为了应对音频/图像 AI 模仿。 https://www.bbc.co.uk/news/articles/cp87z6vexl3o

开源

  • 围绕 MiniMax H3 的工具在一周内大量发布(!«メールアドレス»,版主 Even_Adder 在 2~8 天前密集发布)— ComfyUI-Fantastic-MiniMaxH3-PromptBuilder、wan2gp-h3-latent-continue、ComfyUI_MinimaxH3_AutoContext、TaoMate-H3-3Step-ComfyUI、ComfyUI-VDN-H3-24GB(24GB VRAM 优化)、MiniMax-H3-Image-Training-Adapter、3d-Camera-control-H3-Minimax、ComfyUI-MiniMax-H3-W4A4-VSA 等,连续介绍面向开放视频生成模型“MiniMax H3”的 ComfyUI 集成、LoRA 和量化工具。 https://lemmy.dbzer0.com/post/75586072 等
  • 发布 Lightricks 开源视频模型 LTX-2.5-22B 的 IC-LoRA“Ingredients”(!stable_diffusion,6 天前)— 用于根据参考表对视频生成进行条件控制的 LoRA。 https://lemmy.dbzer0.com/post/75382763
  • 面向 Krea 2 Turbo 的两种 LoRA(Distill-2step / sda rank-32)(!stable_diffusion,5~8 天前)— 旨在同时减少步数并保留采样多样性的微调发布。
  • fal 发布“FLUX.2-dev-Turbo”蒸馏 LoRA 适配器(!stable_diffusion,2025-12-29)— 面向开放权重 FLUX.2 [dev] 的加速 LoRA。 https://lemmy.dbzer0.com/post/60575090
  • EA 与 Stable Diffusion 开发商 Stability AI 合作,将 AI 用于游戏开发(!«メールアドレス»,2025-10-25)— 被分享为源自开源技术获得大型发行商采用的案例。
  • stable_diffusion_art / share_anime_art 每日发布,成为稳定运行的画廊(截至 2026-09,Even_Adder 几乎每天发布 SDXL/本地模型作品,最近如“Shadowy Lord”7 小时前、11 个赞)— 社区稳定活跃。 https://lemmy.dbzer0.com/post/75684876
  • 个人用户 PapaSkwat 运营 SDXL + 自定义 LoRA 的小众社区(lemmy.today,2026-09-08~18)— 发布如“Arrangement with Circle and Line-1987-No. 1”等明确标注本地运行的作品。 https://lemmy.today/post/60272629
信号
  • “开源新闻”几乎全部集中在 !«メールアドレス»。只看这里就能把握 Lemmy 上的开源动态,但讨论核心并不是新模型发布本身,而是 ComfyUI 生态会以多快速度跟进刚出现的模型(本次是 MiniMax H3)并将其工具化。帖子几乎都是单一版主账户(Even_Adder)的策展,点赞通常仅 1~17,热度不高。
  • 大型闭源新闻(Sora、Seedream、Nano Banana、Grok 等)在 Lemmy 上几乎没有独立原创讨论,大多经由镜像 Reddit AI 社区的 bot 社区(ai_reddit)出现。分数普遍为个位数,因此更像“Reddit 上的话题被原样转发过来”,而非 Lemmy 用户自己的反应。
  • Lemmy 原创高热度话题的例外是“版权与社会担忧”:日本政府要求 Sora 2 遵守版权的新闻(884 个赞、153 条评论)在本次收集内容中互动远超其他。相比技术性能竞争,“AI 正在侵害某些人”的视角更能吸引 Lemmy 用户关注。
  • !fuck_ai(8,244 人)的存在本身就是信号:这个反对包括图像/视频生成 AI 在内的生成式 AI 社区,规模大于技术类社区(stable_diffusion,5,712 人),说明在 Lemmy 整体环境中,怀疑派声音比推动派更容易被看见。
限制
  • Lemmy 搜索 API 的结果复现性较低,同一个关键词在不同执行时间会命中不同帖子。本次以 image generation AI 单独搜索时,命中内容大多无关,因此改用 ComfyUI、Stable Diffusion、Sora 2、Nano Banana、FLUX、Kling、Qwen Image、Seedream、Midjourney、Veo 3、Grok Imagine 等模型名分别搜索。
  • 本次所有连接 mander.xyz(imageai 社区所在实例)的尝试都因 ECONNREFUSED 失败,无法直接查看页面。EA×Stability AI 的帖子也位于 mander.xyz,因此无法确认评分或评论区。
  • 实际收集的帖子数量未达到简报要求的“每个平台约 20 条”。原因很明确:多数闭源话题并非 Lemmy 原创,而是 Reddit 文章的 bot 镜像(ai_reddit);Lemmy 原创的图像/视频生成 AI 新闻则偏向开源的 !stable_diffusion 系社区。playbook 本身也指示“Lemmy 规模小,如数量不足应如实说明”,本报告据此完整总结了可确认范围内的内容。
  • 在搜索范围内未发现日语帖子或日语社区;Lemmy 的图像/视频生成 AI 相关社区主要由英语用户构成。

Pinterest

Pinterest — 图像与视频生成 AI 新闻

本阶段未定义类别;全部 50 个 Pin 都来自单一搜索(“Image and Video Generation AI News”)。我直接打开检查了 50 张图片中的 31 张(索引 1–9、11–14、16、17、19–21、23、28、30、33、38–41、45–47、49、50)——这是一个覆盖广泛、分布均匀的样本,远超过简报要求的约 20 条。

视觉主题
  • 霓虹/暗色“讲解型”科技美学 — 黑色背景、青紫发光电路、漂浮的大脑/网络图形、全息面板。这是通用“什么是生成式 AI”和“AI 正在改变一切”Pin 的默认风格。[1, 3, 5, 11, 20]
  • 镀铬人形机器人作为“AI 新闻”的代表形象 — 白色/镀铬安卓头像配蓝色发光眼睛,有时穿西装坐在新闻台前、屏幕上显示“BREAKING NEWS”,有时拿着手机并配“FAKE”印章。机器人既代表“AI 本身”,也代表“AI 生成的虚假信息”。[8, 39, 42, 50]
  • 胡须 YouTuber 反应脸缩略图 — 戴耳机或睁大双眼的男性,配上粗体白字“AI NEWS”/“huge AI news”,以及一排公司标志(OpenAI、Google、Meta、Notion、类似 Adobe Firefly 的品牌)。这是新闻汇总内容最常见的格式。[4, 16, 19]
  • 工具对比清单式信息图 — 带应用标志的编号卡片(Runway、Pika、Kling AI、Luma/Dream Machine、Canva AI、Hailuo AI、ChatGPT Plus、Gemini、Midjourney、Adobe Firefly、Recraft、Ideogram、SeaArt),以及带勾选的功能要点和“最佳付费 vs 最佳免费”划分。[2, 21, 23]
  • 以逼真人像证明/质疑“这是 AI” — 网红风自拍和家庭照片,配“这是 AI”或“AI-Generated Image”说明,重点在真实感和深度伪造焦虑,而不是展示工具 UI。[6, 28, 39, 41]
  • 同一主体的风格迁移网格 — 将一张源照片/视频重新渲染成木雕、折纸、乐高积木、花朵或毛绒怪兽 CGI,用以展示视频转视频模型控制能力(Higgsfield/Luma 风格)。[12, 40]
  • 电影感演示静帧 — 青橙调色的海洋、森林和城市天际线画面,直接取自 Google Veo 2/Veo 3 及 Runway/Luma 宣传页,被当作“看起来多真实”的证明。[7, 9, 14, 21, 45]
  • 以闭源巨头为主的标志拼贴 — OpenAI 旋涡、Google“G”、Gemini 闪光、Meta 无限符号、Microsoft 四格,以及 Adobe Premiere/Cognition/Devin 品牌,反复出现在“AI 更新”信息图中;开源品牌(Stability AI、Hugging Face、ComfyUI)在图片本身几乎完全不可见。[4, 11, 16, 19]
值得注意的 Pin
  1. #2 — “6+ Best AI Video Generation Websites” —
    https://www.pinterest.com/pin/350717889754837661/ — 一张完整页面的清单图,按用途排名 Runway、Pika、Kling AI、Luma(Dream Machine)、Canva AI Video 和 Hailuo AI;清晰呈现了哪些闭源视频工具是 Pinterest“最佳工具”内容的核心。
  2. #4 — “AI News: Anthropic Leak Shows Us The Future of AI...” —
    https://www.pinterest.com/pin/4596556863345400192/ — YouTube 缩略图风格的 Pin,将 Anthropic 泄露与 Google/Microsoft/OpenAI 标志并列;是少数直接提到 Anthropic 的 Pin 之一。
  3. #6 — “Hollywood Reporter Interviews the First AI Actress...” —
    https://www.pinterest.com/pin/4607675129179333696/ — 有关 AI 女演员“Tilly Norwood”(Instagram @tillynorwood)的电视新闻截图,标注“AI-GENERATED IMAGE”;这是主流媒体对 AI 人才争议的真实报道,并非工具营销。
  4. #9 — “Google Unveils Veo 2...” —
    https://www.pinterest.com/pin/716705728243313502/ — 看起来像 Veo 2 官方宣传图(“Our state-of-the-art video generation model”及 VideoFX 注册 CTA),是样本中三张不同 Veo 2/Veo 3 Pin 之一(另见 [7, 45]),显示 Pinterest 大量再传播 Google 自己的发布素材。
  5. #11 — “4 Major AI Updates You Need to Know in 2026” —
    https://www.pinterest.com/pin/982558843745608433/ — 信息图汇总“OpenAI GPT‑6 Astra”“Gemini 在 Workspace 中全面 Agent 化”“Adobe Premiere 时间线中的生成式媒体”以及“Cognition 的 $2B Series E、估值 $48B(Devin)”。需要特别标注:“GPT‑6 Astra”与任何已确认的 OpenAI 发布均不吻合——应将其视作未经证实的聚合内容,而非已确认公告。
  6. #12 — “AI For Image And video Generation” —
    https://www.pinterest.com/pin/37295503160959330/ — 同一个人/汽车的源视频被重渲染为木块、折纸、乐高积木和花朵等版本;是样本中最清楚地将可控视频转视频风格迁移作为卖点的例子。
  7. #33 — “OpenAI's Secret Image Generation Tool to Debut Soon” —
    https://www.pinterest.com/pin/34410384649773668/ — 标题声称未发布的 OpenAI 图像工具即将登场,但实际图片只是一个通用文生图管线图(冻结的 T5 文本编码器 → 扩散上采样阶段),并非 OpenAI 专属;标题和图片不匹配,评估 Pinterest 标题可信度时应注意。
  8. #39 — “AI is getting scary good.” —
    https://www.pinterest.com/pin/951104015101996491/ — 机器人查看手机,旁边是一张猫图上的“FAKE”印章和一段兜帽人物视频,图片内嵌 1.2K 赞 / 7.4K 浏览标识;将深度伪造焦虑包装为引流内容。
  9. #45 — “Google announces video generation AI 'Veo 3'...” —
    https://www.pinterest.com/pin/4595853127049919616/ — 另一条 Veo 3 内容,再次表明 Google 是本次 Pin 样本中被反复提及最多的闭源视频故事。
  10. #49 — “ShengShu Technology Unveils Vidu S1...” —
    https://www.pinterest.com/pin/151433606217350067/ — 中国实验室生数科技的“Vidu S1: The World's Most Advanced Model for Real-Time AI Interaction”;是样本中唯一突出非美国、非“五大巨头”视频模型的 Pin。
信号
  • 在这里,Pinterest 主要充当工具营销与 SEO 内容农场的展示面,而不是新闻通讯社:大多数 Pin 是“最佳 AI 视频/图像工具”清单、通用讲解信息图,或产品广告式宣传图(Bluetick Solutions、Imagvio AI、Wondershare Virbo),而非一手报道。
  • 闭源消费者工具在视觉上占据主导 — Runway、Pika、Kling AI、Luma、Canva AI、Hailuo AI、OpenAI/ChatGPT、Google Gemini/Veo、Midjourney、Adobe Firefly 与 Recraft 在清单和比较图中反复出现 [2, 21, 23]。
  • 开源信号很弱。 在打开的 31 个 Pin 中,没有任何一个在视觉上突出 Stable Diffusion、Flux、HunyuanVideo、Wan、LTX 或 ComfyUI 品牌;最接近的只是 #33 下方一张没有归属到任何特定开源项目的通用扩散管线说明图。生数科技的 Vidu S1(#49)是唯一出现的非西方大科技模型,但它是商业/闭源发布,不是开放权重。
  • 深度伪造/真实性焦虑是强烈的重复主题 — “FAKE”印章、“This is AI”揭露文案、“Can you spot the fake?”挑战、语音检测信息图(97%“likely AI generated”)出现在多个不相关的 Pin 中,表明这可能是当前 Pinterest 上比任何单一模型发布更强的视觉主线。
  • AI 新闻主播图像会在不依附真实新闻事件的情况下反复出现 — 多张 Pin 展示在“BREAKING NEWS”画面下的镀铬机器人新闻主播,没有对应的具体事件;它更像一种库存图片套路,而非关于真实 AI 主播产品的报道。
  • 样本中缺失:没有 Pin 涉及开放权重发布新闻(没有 Stability AI、Black Forest Labs/Flux、阿里巴巴/Wan、腾讯/Hunyuan 品牌),也没有 Pin 涉及 Anthropic 的图像/视频能力,除了一张以泄露为主题的缩略图(#4)。
限制
  • 本阶段的图片由无头浏览器预先收集;我没有自行浏览 Pinterest,也无法进一步搜索其他类别或关键词。
  • 我打开检查了收集的 50 张图片中的 31 张;剩余 19 张(根据 output/pinterest.pins.md 中标题,多数是更多“无标题”Pin 和工具清单)没有逐一检查,但标题显示它们重复了本报告已覆盖的清单/讲解模式。
  • manifest 中没有互动数据(收藏、点赞、评论数),所以“值得注意的”Pin 是根据新闻相关性与视觉独特性选择的,而不是依据量化热度。
  • 一些 Pin 标题带有标题党性质,或与实际图片内容不匹配(最明显的是 #33)——源表中的标题应带着这一前提阅读,不能视作对 Pin 内容的可靠单句摘要。
  • Pinterest Pin 指向第三方落地页(YouTube 视频、博客文章、工具网站),并不托管完整文章,因此仅凭图片无法向一手来源验证 Pin 标题中的说法(例如 #11 的“GPT‑6 Astra”)。

建议行动

  • 使用主题专属搜索词(Sora、Nano Banana、Wan、ComfyUI 等)重新采集 X;本次因搜索趋势词而得到零条相关结果。
  • 为绕过 Bluesky 搜索 API 403,应预先建立主要账户列表,并切换到直接读取时间线。
  • Reddit、Lemmy 应改用各模型名进行多次搜索,使采集量更接近目标 20 条。
  • 开源内容优先关注 Lemmy 的 !stable_diffusion 系社区,闭源内容优先关注 YouTube 评测频道。
  • 对包含未经证实信息的 Pinterest Pin(例如 GPT-6 Astra),必须在报告中明确标注为未经证实。

收集图片

🎨 AI 图像与视频创作一击即中 🎥带有文本、图像、音乐和视频生成图标的 AI 内容创作概念,人工智能图像 – 浏览 66 张库存照片、矢量图和视频AI 新闻:Anthropic 泄露揭示 AI 的未来……🤯 生成式 AI 解析!🤖✨ AI 如何创作文本、图像、视频及更多内容!Hollywood Reporter 采访首位 AI 女演员……Google 宣布超高质量视频……AI 内容与社交媒体担忧Google 发布 Veo 2:具备更强真实感和电影特性的先进 AI 视频生成工具图片2026 年你需要了解的 4 个重大 AI 更新用于图像和视频生成的 AI用于内容营销的 AI 生成视频Veo 3 图生视频:通过 Gemini API 快速生成并支持原生音频AI 视频、AI 宝宝播客视频和 AI 广告推广视频AI 新闻:OpenAI 终于发布了我们想要的东西纽约的大胆尝试:深入立法……图片GPT 5.2、实时视频编辑器、AI 立体视频、移动 AI 智能体、全身控制:AI 新闻什么是 Imagvio AI,以及它如何帮助创作者……2026 年 5+ 个最佳 AI 视频生成网站 | Runway、Pika、Kling AI、Canva 等带有文本、图像、音乐和视频生成图标的 AI 内容创作概念,人工智能图像 – 浏览 57 张库存照片、矢量图和视频7 个最佳 AI 宝宝生成器:预测你孩子的长相(2026)2025 年顶级 AI 视频生成器内容创作者的秘密武器:AI 驱动的视频生成图片图片使用 ChatGPT + Higgsfield 制作自己的逼真 AI 写真 📸🤖图片AI 生成视频:好还是坏?真相在这里!🤖🎥视频编辑 AI 工具——2026 年创作者实际用来制作内容的工具AI 视频创作软件OpenAI 的秘密图像生成工具即将推出AI 如何改变视频编辑你能找出假的吗?AI 视频 vs 现实生活挑战!AI 驱动的图像与视频分析专业 AI 视频创作 | 电影感 AI 视频 | 定制视频编辑当 AI 让人类重访自己的记忆‎🚨 AI 正变得惊人地强大。TotalYmage 革新互动视频……AI 生成的逼真人像视频 | 温馨室内场景,无需摄影机AI 新闻图片图片Google 宣布视频生成 AI“Veo 3”……AI 图像生成“用个性化 AI 驱动 4K 视频实现你的创意愿景 🎥✨”图片生数科技发布 Vidu S1,为 AI 视频带来实时互动生成了解 Grok 如何革新视频……

数据质量备注

X(40 条中 0 条相关)和 Reddit(11/约 20 条)未达完成标准;Bluesky、Lemmy 也未达到目标 20 条,改以已知账户进行替代采集补充。YouTube 确保了内容数量,但播放量和日期未确认;仅 Pinterest 超过目标,精查了 31 条。

图库