KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-09-28

OpenAI 于 2026-09-24 终止 Sora(应用与 API),封闭式视频生成阵营开始重组;与此同时,轻量级 7B 的 Qwen-Image-2.1 和 Minimax H3 在四个平台上被独立确认是当前最强的开放模型。

OpenAI于2026-09-24终止Sora(应用+API),封闭式视频生成阵营开始重组;与此同时,轻量级7B的Qwen-Image-2.1和Minimax H3在4个平台上被独立确认是当前最强的开放模型。

图像与视频生成AI新闻汇总 — 2026-09-28

耶,大家久等啦!这周图像和视频生成AI圈子真是变化不断,赶紧来汇报🔥🔥 最大新闻是OpenAI在2026-09-24直接砍掉Sora(应用和API)的事,视频生成AI“到底赚不赚钱?”的问题终于浮出水面。另一边,开源阵营里,阿里巴巴的Qwen-Image-2.1(只有7B,却大有逼近大型封闭模型的势头🐉)和Minimax H3已经彻底坐上主角位,社区的热情反而更多集中在这边。不过所有社交平台并不是同一种氛围:技术社区(r/StableDiffusion、Lemmy 的 stable_diffusion 社区、YouTube 的 ComfyUI 用户)在认真比较工具;而普通用户更多的地方(大型 Reddit 子版块、Pinterest),“这些AI图片是不是P得太过了?”这样的不信任反而更容易爆火——这正是本次最重大的发现🙌 另外,X 这次意外扑空(原因后面说明)。

跨平台观察

封闭源阵营的发现(共13条📸)

  1. OpenAI 于2026-09-24全面终止 Sora(应用+开发者 API)。据称这是一次相当仓促的撤退 — Bluesky https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
  2. 对于终止原因,“视频生成的单位经济效益实在太差”的说法被广泛看好 — Bluesky https://bsky.app/profile/richargh.de/post/3mhur4qo3vc2x
  3. 也有报道称,阿里巴巴的 Wan 3.0 已在视频模型排行榜上超过 Sora — YouTube https://www.youtube.com/watch?v=5Hb429VYNUU
  4. GPT Image 2.5 登场,新增 Flare(速度)/Sunburst(细节)两种模式,延迟减半,参考图还原度提升 — YouTube https://www.youtube.com/watch?v=QOfLgJ3TCrQ
  5. Midjourney 在 Alpha 版中实现实时风格预览,并以 V8→V8.1→V8.2 的节奏每月持续更新 — Bluesky https://gen-ai.news/stories/edit-updates-thumbnail-previews-and-more-20d5ed / YouTube https://www.youtube.com/watch?v=dvfH5HzCARY
  6. Adobe 整合 Photoshop、Lightroom、Firefly、Acrobat,可直接从 Gemini/Claude 的聊天界面使用 — Bluesky https://gen-ai.news/stories/adobe-expands-its-ai-integrations-to-gemini-plus-further-powers-up-with-claude-6737b7
  7. Adobe 完成对 Topaz Labs 的收购,计划尽快将 AI 超分辨率技术整合进 Firefly/Photoshop — Bluesky https://gen-ai.news/stories/adobe-s-acquisition-of-topaz-labs-is-complete-as-double-down-on-ai-enhancements--3c3f96
  8. OpenAI 以3亿美元收购图像处理创业公司 Glass Imaging,瞄准从拍摄到生成的完整流程 — Bluesky https://gen-ai.news/stories/openai-reportedly-buys-photo-processing-company-glass-imaging-for-300-million-e004d2
  9. 字节跳动的“Dramagic”是一条完整流水线,可在无需人工摄制团队的情况下生成中国短剧95%的内容 — Bluesky https://gen-ai.news/stories/bytedance-launches-dramagic-a-full-pipeline-ai-platform-for-producing-short-dram-20f217
  10. Runway 正在开发实时世界模型 GWM-1/GWM-2:不是生成片段,而是持续理解环境 — Bluesky https://gen-ai.news/stories/runway-s-worldprompt-and-the-engineering-of-real-time-worlds-80e2b7
  11. Veo3(通过 Gemini API)支持带原生音频的高速图生视频生成,Pinterest 上也在大量出现宣传素材 — Pinterest https://www.pinterest.com/pin/871728071631063018/
  12. Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1 的硬核直接对比视频也受到关注 — YouTube https://www.youtube.com/watch?v=x5fMQvhKP60
  13. 普通用户往往把封闭源AI图像和视频当成“丑闻”来消费:对AI美化过度的房地产图片愤怒(27,008分) — Reddit https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/ ,CEO因AI图片被解雇(594分) — Reddit https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/ ,支持AI强制水印法的评论大量涌入(13,925条评论) — Reddit https://www.reddit.com/r/CriticalState/comments/1wmktek/

开源阵营的发现(这边也有12条🛠️)

  1. 阿里巴巴发布轻量级7B开放权重模型 Qwen-Image-2.1,整合生成+编辑,支持透明图层和最多10张参考图 — Bluesky https://bsky.app/profile/sungkim.bsky.social/post/3mvxr2bj2ck2r 、Lemmy https://lemmy.dbzer0.com/post/75874773 、YouTube https://www.youtube.com/watch?v=3qGl0wiv2G0
  2. 甚至有观点称,Qwen-Image-2.1 在部分任务上超过了 Google 的大型封闭模型“Nano Banana 2.0” — YouTube https://www.youtube.com/watch?v=fwHS0ubmI7I
  3. 在 r/StableDiffusion 用户之间,主角已从 Z-Image Turbo 转向 Krea 2 — Reddit https://www.reddit.com/r/StableDiffusion/comments/1wpr4uf/
  4. 面向 Krea2 的加速 LoRA(Turbo-Distill、inpaint-edit)正不断在 Lemmy 上发布 — Lemmy https://lemmy.dbzer0.com (stable_diffusion 社区)
  5. 视频生成方面,Minimax H3 成为开源阵营的主战场;AutoContext、3D镜头控制 UI、时间线编辑节点、TaoMate-H3 LoRA 等周边工具每周都在增加 — Lemmy https://lemmy.dbzer0.com/post/75586069
  6. SenseNova-U1.5 以 Apache-2.0 许可证发布,并已集成到 ComfyUI — Reddit r/StableDiffusion(帖子11)
  7. LTX-2.5 作为高速开放权重视频模型登场,在速度上与 MiniMax H3、Seedance 2.5 竞争 — YouTube https://www.youtube.com/watch?v=qVGpyw-F-rw
  8. Wan 3.0 目前仅提供 API/公开测试版,尚未发布开放权重(旧 Wan2.x 系列开放);阿里巴巴同时布局开放与封闭两条路线 — YouTube https://www.youtube.com/watch?v=fHK7oYrokZY
  9. SupraLabs/Supra2-IMG:仅1亿参数的极轻量 text-to-image 模型,因“以其规模而言达到最先进画质”而受关注 — Lemmy https://lemmy.dbzer0.com/post/75874769
  10. well9472/Nanosaur2-670M:训练成本仅600美元的插画专用 DiT 模型登场 — Lemmy https://lemmy.dbzer0.com/post/76110122
  11. AI Horde(分布式、免费的图像生成服务)全面升级为新 UI 和新后端 — Lemmy https://lemmy.dbzer0.com/post/75736717
  12. Stability AI 的“Amuse 3.0”——由 AMD 赞助、可本地运行的图像生成工具——也在 Pinterest 上被介绍 — Pinterest https://www.pinterest.com/pin/4601060441986715264/

Qwen-Image-2.1 和 Minimax H3 在 Reddit、Lemmy、Bluesky、YouTube 四个平台上独立得出了相同结论(当前最强开放模型),这一点可信度非常高🙆

分平台观察

Reddit:虽然只用一个搜索词找到12个帖子,但质量很高。在 r/StableDiffusion 的技术讨论中,Krea 2、Qwen-Image 2.1、Minimax H3 被明确点名为最新赢家;而 r/mildlyinfuriating、r/CriticalState 这类面向大众的大型子版块里,“AI夸大了”“AI撒谎了”类争议话题的热度高出数个数量级(数千到逾万分)。技术讨论最高只有13分,而 Nikon Small World 的疑似作弊事件则有1,104分——这种温差正好反映了开放/封闭阵营受到的不同看待方式。

X:这次在主题上几乎完全扑空😅 会话连接被地理定位为克罗地亚,直接拿 Explore 热门词(加密货币、抽奖垃圾信息、F1粉丝圈、前南斯拉夫历史争议、旅游照片、泰勒·斯威夫特)去搜,结果40条帖子里没有一条包含“AI”“图像生成”或“视频生成”。数量目标(20条)达成了,但主题匹配率为0%。

YouTube:通过11支评测视频覆盖了 GPT Image 2.5、Qwen-Image-2.1、LTX-2.5、Wan 3.0 等主要发布。开源相关视频中,验证“在自己的GPU上能跑多快”的 ComfyUI 配置视频很多;封闭源方面则形成了类似 Midjourney 月度更新视频这样的定期观察格式。不过,大多数播放量和频道名称无法获得,因此无法衡量话题本身的规模。

Bluesky:自动新闻账号 gen-ai.news 是本次信息源的核心,封闭源消息密度很高(Runway、Adobe、Midjourney、OpenAI、Meta、字节跳动几乎每天都有发布)。Sora 终止的帖子(3,571个赞)是这个阶段最火的话题。开源方面除 Qwen-Image-2.1(82个赞)外,主要是2025年上半年的旧帖子,几乎没有找到近期关于 Wan/LTX 的个人帖子。

Lemmy:!«メールアドレス» 是唯一实质性的枢纽,几乎每天都会出现 Qwen-Image-2.1 和 Minimax H3 周边的 ComfyUI 工具速报,像是“GitHub/HuggingFace 新链接合集”。封闭源方面没有专门社区,相关内容只会作为争议事件零星流入 technology、nottheonion、dcstudios 等通用社区,例如 Stanford 的种族变更处理、Google Earth 伪造卫星图、Meta 的 nudify 应用广告。

Pinterest:这是一个无法取得互动数值、以视觉内容为主的场所。收集到的50个图钉几乎被 Veo3、Kling AI、Luma Dream Machine、Gemini Omni 等封闭源品牌标志缩略图占据;以开源(ComfyUI、LoRA、中国开源模型)为主题的图片只发现 Stability AI 的1张。“如何分辨AI生成还是实拍”类信息图已成为独立品类,也是 Pinterest 的独特现象。

值得关注

建议

  • 每周查看 Qwen-Image-2.1 与 Minimax H3 周边的 ComfyUI 生态,因为多个平台已独立确认它们是当前最强的开放模型。
  • 下次收集 X 内容时,不再依赖地区趋势词,而是使用“图像生成AI”“Stable Diffusion”“Midjourney”等中英文主题直击关键词重新搜索。
  • 跟踪 Sora 终止后封闭源视频生成阵营(Veo、Kling、Grok、Runway、Seedance)的定价与功能竞争,因为市场正在缩减并重组。
  • Pinterest 缺少衡量话题规模的指标(收藏数、点赞数),因此应更多把它当作观察当前视觉语言的参考,而非趋势热度工具。
  • 持续关注 Reddit、Lemmy、Pinterest 共同呈现的对AI生成内容的不信任扩散,因为这与监管(强制水印)的社会氛围直接相关。
  • 重新收集 Reddit 时,应分别使用“open source”“closed source”专用搜索词,增加样本量以达到简报完成标准(每个平台分析20条)。

数据质量

X 因地理定位错误且依赖趋势词搜索,40条帖子中0条符合主题,实质上是一次收集失败。Bluesky 的官方搜索 API 返回403,内容偏向 gen-ai.news 单一账号的文章。Pinterest 数据没有互动指标(收藏、点赞),无法衡量热度;YouTube 的多数播放量和频道名称无法取得。Lemmy 的开源信息几乎集中在一个社区、1至2位发帖者;Reddit 同样只因一个搜索词获得12个帖子,低于完成标准的20条。

各平台详细汇总

Reddit

Reddit — 图像与视频生成AI新闻

来源

从9个子版块收集了12个帖子,全部由一次搜索触发:“Image and Video Generation AI News”。

子版块 成员数 收集帖子数
r/generativeAI 157,870 3
r/labrats 726,970 2
r/WhitePeopleTwitter 3,145,768 1
r/mildlyinfuriating 12,600,570 1
r/CriticalState 43,691 1
r/aivideomaking 7,949 1
r/ChaiUnofficial 30,105 1
r/StableDiffusion 1,026,206 1
r/AmItheAsshole 24,612,930 1

r/generativeAI 是唯一反复出现的工具推荐讨论中心。其余都是一次性出现——大多是大型大众子版块(r/mildlyinfuriating、r/AmItheAsshole、r/WhitePeopleTwitter)在回应AI生成内容,而不是讨论技术;r/labrats 则围绕同一桩丑闻出现了两个帖子。

人们在说什么
  • 帖子 1(r/generativeAI,10分,2026-09-23)— 关于制作长篇AI视频:u/kaboom-o 说明了当前真实流程——“脚本会变成镜头列表,然后是一堆5–15秒片段,再进行剪辑……对于需要更长时间保持同一张脸的片段,用 Seedance 2.5(最长约30秒,原生音频)……便宜的动作草稿……Grok Imagine Video,480p、5秒。追求写实的成片:Gemini Omni Flash。” — https://www.reddit.com/r/generativeAI/comments/1wog53q/
  • 帖子 1 — u/AlfieSchmalfie 展示了成片的真实成本:“刚完成一支12分钟视频。148个镜头……剪辑了8周。预算约为1,000澳元,不含 Runway 和 ElevenLabs 的订阅……值得。”
  • 帖子 2 和 4(r/labrats,1,104分 / 134条评论和419分 / 90条评论,2026-09-23/24)— 一段AI生成的显微镜视频赢得 Nikon Small World in Motion 竞赛;Nikon 承认使用AI进行“增强”和伪彩色处理。u/Barkinsons(630个赞):“AI工具不该出现在科学显微图像中,因为我们有义务尽可能如实地再现图像。”作者后来承认,使用“无监督AI”分割和标记了从未验证真实存在的结构;u/Feline_Diabetes(301):“这绝对具有误导性……图像应该或多或少是真实的——当然可以处理,但不该是AI渲染。” — https://www.reddit.com/r/labrats/comments/1wo0j5e/ and https://www.reddit.com/r/labrats/comments/1woxdhk/
  • 帖子 3(r/generativeAI,3分,2026-09-26)— 有人想要免费图像生成,被推荐本地/免费选择:u/Scuzzy_Womack 推荐“不连接互联网而且免费的 Comfy ui”,其他人则推荐 Yodayo/MoescapeAI 和 Leonardo 的每日免费额度。— https://www.reddit.com/r/generativeAI/comments/1wqfleb/
  • 帖子 5(r/generativeAI,5分,2026-09-22)— 关于视频生成器,u/sharktank123456 指出平台转变:“Dream Machine 不再向新订阅者开放,但 Luma Agents 可以……它是整合所有主流模型的完整综合平台。”u/jmbirn 指出,聚合服务(Magnific AI、Fal、Krea)是在一个账户下试用多个模型的实用途径。— https://www.reddit.com/r/generativeAI/comments/1wngj3w/
  • 帖子 6(r/WhitePeopleTwitter,594分,2026-09-25)— 一名信用合作社 CEO 因一张AI生成的“Lake America 毛衣”图片被解雇;最高评论(u/samanime,298):“如果更多这种笨蛋承受这样的后果,外面就会少很多这种人。” — https://www.reddit.com/r/WhitePeopleTwitter/comments/1wq3juw/
  • 帖子 7(r/mildlyinfuriating,27,008分,723条评论,2026-09-21)— 用户对AI“摆拍”的房地产照片感到愤怒:“我只想看到房子现在真实的样子,而不是分析什么是真的、什么不是真的……它会把暖气片移除,所以你根本无法按展示的样子布置。”最高评论(u/slothboy,5,794分)指出,AI添加的浴室要实际建造,“会是五位数的花费”。— https://www.reddit.com/r/mildlyinfuriating/comments/1wmja6n/
  • 帖子 8(r/CriticalState,1,314分,13,925条评论,2026-09-21)— 一项要求为所有AI生成图像/文字添加强制水印的投票式“法律提案”获得爆炸性互动;最高评论多是援引虚假信息风险和防范老年人诈骗的一行“赞成 ✅”投票(u/Middle_Juggernaut298:“因为老年人被诈骗之类的问题”)。— https://www.reddit.com/r/CriticalState/comments/1wmktek/
  • 帖子 9(r/aivideomaking,13分,2026-09-23)— 关于AI视频提示词生成,u/3DisMzAnoMalEE:“在写了几百条提示词、调整门限、cfg,尤其是负面提示词之后,Grok 目前远远最好……无论是 SFW 还是 NSFW,都很难击败它。” — https://www.reddit.com/r/aivideomaking/comments/1wo38ww/
  • 帖子 11(r/StableDiffusion,1分,2026-09-25)— 本批最具技术性的开源综述:共识是文本生成图像领域刚从 Z-Image Turbo 转向 Krea 2(“现在不再是 z image,而是 kre2……Krea2 把 z image 能做的一切都做得更好”——u/Sirmckhalifa5566),Qwen-Image 2.1 用于编辑,Minimax H3 领跑视频;u/Cultural-Broccoli-41 则指出,SenseNova-U1.5 是一个强劲的 Apache-2.0 许可替代方案,且已经接入 ComfyUI。— https://www.reddit.com/r/StableDiffusion/comments/1wpr4uf/
  • 帖子 10(r/ChaiUnofficial,5分,2026-09-21)— 付费(“ultra”)用户不满于一个后加的图像/视频生成器:u/ConsistentWolf2076:“生成图片和视频本来应该免费。而且图片和视频也没那么好。我画得都比生成图好,笑死。” — https://www.reddit.com/r/ChaiUnofficial/comments/1wlxxa3/
信号
  • 上升中:命名和版本更迭非常快,实践者会随口跟踪——Z-Image Turbo 已被 Krea 2 取代,Minimax H3 也被反复称为当前最好的视频模型(帖子1、9、11),技术圈几乎没有异议。SenseNova-U1.5 的 Apache-2.0 许可证和原生 ComfyUI 支持(帖子11)是唯一明显获得真切热情的开源数据点。
  • 上升中:聚合/多模型平台(Luma Agents、OneOver、Magnific AI/Fal/Krea)比单模型订阅更受推荐,因为人们会在项目中途切换模型(帖子1、5)。
  • 被否定 / 反弹:在工具导向子版块以外,AI生成图像只要出现在现实情境中,就被视为丑闻而非创新——科学竞赛获奖(labrats,两个帖子,1,104 + 419分)、CEO被解雇(594分)、房地产图片欺诈(27,008分)、水印法投票爆发(13,925条评论)。技术子版块中性看待同样的工具;大众子版块将其视为信任问题。
  • 令人意外:两条 Nikon Small World 帖子引发的互动和道德情绪(1,104和419分,134和90条评论)远超任何“哪个模型最好”的帖子——最高分的 generativeAI/StableDiffusion 工具帖子只有13分。目前在 Reddit,“AI视频做了不诚实的事”比“AI视频做了新东西”更吸引人。
  • 存在分歧:在帖子4中,一些评论者认为在科学图像中使用任何AI都完全是欺诈(“任何篡改实际印迹的人都是骗子”——原帖作者);另一些人(u/thezfisher,44分)则认为图像处理领域一直在进行操作,这只是可见度问题:“如今除非展示 LUT 调整,否则没有图像真正可信。”
局限
  • Reddit 只使用了一个搜索词——“Image and Video Generation AI News”——仅返回12个帖子,低于完成标准要求的约20条;也没有专门搜索“open source”和“closed source”角度,因此这份收集很可能低估了专门的模型发布讨论(例如 r/StableDiffusion 只有一个帖子,没有 r/MachineLearning、r/midjourney、r/OpenAI 或 r/aivideo 的内容)。
  • 本组最切题的技术帖子(r/StableDiffusion,帖子11)只有1个赞和20条评论——内容不错,但说明该搜索词更多捕捉到了争议驱动的爆款,而非技术社区自己的讨论场所。
  • 本组没有帖子直接提到封闭源模型发布、价格变动或公司公告(如 Midjourney、Sora、Veo 或 Runway)——封闭源信号是间接的,来自推荐帖子内的工具提及,而不是专门新闻帖。
  • 无法独立验证任何数值,也不能重新浏览 Reddit——本文件完全基于 output/reddit.threads.md,因为 Reddit 拒绝 WebFetch 并直接封锁搜索结果页面。

X

X — 图像生成・视频生成AI新闻

账号

本次收集的40条帖子、39个账号中,没有发现任何以图像生成AI或视频生成AI(无论封闭源还是开源)为主题发帖的账号。若勉强按领域分类:

  • 加密货币($ADA/$SONG 代币)相关:@Nadalina04(2条帖子,25个赞)、@SintoAndrej、@EAjdarovic — Cardano 社区的宣传帖。
  • 抽奖、赠品活动的垃圾信息式连发:@CSharp66427821、@dwayne_lepley、@DustinThel46652、@Jordan95133426 — 多个账号以不同标签、近似机器人方式发布相同文案“Quad Goals by @Fanatics”(几乎均为0赞)。
  • 游戏/玩家文化:@hotdropfps(PC抽奖,287个赞)、@Maki_D_Luffy、@Indie_RetroNEWS。
  • F1(兰多·诺里斯)粉丝圈:@ckno_ff、@4unclelala、@landoxeneize、@alukelipse — 都有数百至上千赞,围绕粉丝之间对诺里斯的冲突和辩护。
  • 前南斯拉夫/巴尔干政治史(包括民族冲突):@TwiceDeadd(2,282个赞,为最高级别互动之一)、@mctogs、@vbspurs、@axeljarcor、@OssoKuka、@walsh_kirk91371、@jeffreybacic、@vragan95 — 围绕塞尔维亚和克罗地亚历史冲突的争论。基本每个账号1条帖子,真正爆火的是 @TwiceDeadd 单条帖的大规模传播。
  • 意大利风景照片:@prjipata(Tod's 时装系列)、@PrettyCitiesX、@worldparadiseX(3,930个赞)、@naturalbeautyi7(2,666个赞)— 美丽旅游景点的照片。
  • 泰勒·斯威夫特相关:@_daddydisco(67,235个赞、约120万次观看,本次最大爆款)、@psychocrzzzy、@wandasattorney、@TSUpdating — 新专辑销量纪录及 VMAs 相关话题。
帖子

40条帖子中,提到图像生成或视频生成AI的帖子为0。以下列出互动量较大的帖子作为参考,但均与主题无关。

  1. @_daddydisco(67,235个赞、4,941次转发、191条回复、约120万次观看,2026-09-26)https://x.com/_daddydisco/status/2103642992342860157 — 一首以“脸变成黏土”为意象的诗。本次收集最大爆款,但与AI无关。
  2. @wandasattorney(6,842个赞、约13.8万次观看,2026-09-28)https://x.com/wandasattorney/status/2104362546107191455 — “LISA winning best pop over Taylor Swift…” 的 VMAs 相关话题。
  3. @TwiceDeadd(2,282个赞、295次转发、55条回复、约3.5万次观看,2026-09-27)https://x.com/TwiceDeadd/status/2104209913228771333 — “we gotta try yugoslavia again”,一则巴尔干政治话题的大规模传播。
  4. @worldparadiseX(3,930个赞、约9.1万次观看,2026-09-26)https://x.com/worldparadiseX/status/2103775750486986847 — 意大利帕索加乌的风景照片。
  5. @psychocrzzzy(2,995个赞、约6万次观看,2026-09-27)https://x.com/psychocrzzzy/status/2104213800610152704 — 关于泰勒·斯威夫特新歌 Spotify 纪录的话题。

上述内容均与封闭源/开源图像生成或视频生成AI的动态(新模型发布、工具更新、对比讨论等)无关。

信号
  • 本次搜索词偏离主题:使用的搜索词(“$SONG”、“#chance”、“#sweepstakes”、“#giveaways”、“#gaming”、“Lando”、“Yugoslavia”、“Croats”、“Italy”、“Taylor”)与图像/视频生成AI无关,似乎直接来自 X Explore(会话从克罗地亚连接)显示的趋势词。因此,收集到的内容偏向加密货币、抽奖垃圾信息、F1粉丝圈、巴尔干历史争论、旅游照片、泰勒·斯威夫特五类,完全没有AI新闻踪影。
  • 40条帖子中,包含“AI”“图像生成”“视频生成”“Midjourney”“Stable Diffusion”“Sora”等关键词的帖子为零。
  • 唯一可联想到AI的帖子也是零,不应强行建立联系。
局限
  • X 的 Explore(趋势列表)根据本会话连接来源被地理定位为克罗地亚。第1至4位、第8位和第10位标为“Trending in Croatia”,第5位为“Gaming”,第6位为“Motorsport”,第7位为“Politics”,第9位为“Sports”;这些都是克罗地亚的本地趋势,并非全球趋势,更不是AI行业趋势。
  • 实际搜索的10个词($SONG、#chance、#sweepstakes、#giveaways、#gaming、Lando、Yugoslavia、Croats、Italy、Taylor)似乎是工作器直接使用 Explore 趋势词,但它们与图像生成AI、视频生成AI主题无关。因此,没有使用“图像生成AI”“视频生成AI”“Stable Diffusion”“Midjourney”“Sora”等切题关键词重新收集。
  • 完成标准中的“分析约20条帖子”在数量上已达成(40条),但符合主题的帖子为0,因此无法从 X 数据满足封闭源/开源各至少10条发现的要求。
  • 除已收集文件(output/x.posts.md, output/x.posts.json)外,无法进一步访问 X 本身(本阶段只能读取工作器预先收集的数据),因此权限范围内无法用主题关键词重新收集。

YouTube

YouTube — 图像与视频生成AI新闻(封闭源 vs 开源)

频道

本次很难确认频道归属(见局限)——YouTube 的 /watch 和 /results 页面仅向 WebFetch 提供静态页脚内容,因此下列大部分频道名称来自 WebSearch 摘要,而非页面本身。

  • Woollyfern — 运营定期月度“Midjourney Update”系列,覆盖2026年 V8、V8.1、V8.2 的每次版本更新。
  • 多个教程/对比频道逐版本报道开源 ComfyUI 栈(Qwen-Image、LTX、Wan),但仅凭搜索摘要无法确认各个频道名称——标题和链接仍是真实且可追溯的(见下方视频)。
  • 通用“AI新闻汇总”频道(例如“Exciting AI Updates Weekly”的创作者)发布同时涉及封闭源和开源图像/视频发布的每周摘要。
视频
  1. GPT Image 2.5 Review: What Changed and How to Actually Use It
    — 频道“Aristotto” — 发布于2026年9月8日后不久 —
    https://www.youtube.com/watch?v=QOfLgJ3TCrQ
    认为 GPT Image 2.5 的两种模式(速度优先的 Flare、细节优先的 Sunburst)相比 GPT Image 2.0,显著提升了参考图还原度和多轮编辑可靠性,延迟降低约50%。

  2. GPT Image 2.5 Is Here — Everything You NEED to Know
    — 频道未识别 — 据搜索摘要约发布于2026-09-22(“6 days ago”)— https://www.youtube.com/watch?v=20vo5nW9yXI
    介绍 GPT Image 2.0 到2.5的变化,包括原生透明背景 PNG/WebP 输出。

  3. Qwen-Image-2.1 Is INSANE… Just 7B Parameters?!
    — 频道未识别 — 发布于2026-09-22至24(据 MarkTechPost,Qwen-Image-2.1 于2026-09-21发布)—
    https://www.youtube.com/watch?v=3qGl0wiv2G0
    认为阿里巴巴7B开放权重 Qwen-Image-2.1 的表现远超其参数规模,正逼近大得多的封闭模型。

  4. A 7B Model That Beats Nano Banana 2.0? Master Qwen Image 2.1: Native
    2K, RGBA & 10-Image Workflows

    — 频道未识别 — 发布于2026-09-23 —
    https://www.youtube.com/watch?v=fwHS0ubmI7I
    声称 Qwen-Image-2.1 在多项任务上击败 Google 的 Nano Banana 2.0,同时可本地运行;演示原生2K输出、RGBA透明度和10张参考图编辑。

  5. LTX-2.5 Is Here: The Fastest Open AI Video Model Yet?
    — 频道未识别 — 2026-08-16 —
    https://www.youtube.com/watch?v=qVGpyw-F-rw
    对 Lightricks 开放权重 LTX-2.5 的初步评测,按生成速度与 MiniMax H3 和 Seedance 2.5 对比定位。

  6. LTX-2.5 Open Weights Running In ComfyUI With - Is this Better?
    — 频道未识别 — 2026-08-12 —
    https://www.youtube.com/watch?v=XAhuGRCI2tM
    LTX-2.5 开放权重发布次日的本地 ComfyUI 配置/测试,探讨其是否优于之前的 LTX-2 基线。

  7. I Tested WAN 3.0 With 5 INSANE AI Video Challenges
    — 频道未识别 — 2026-08-20 —
    https://www.youtube.com/watch?v=5Hb429VYNUU
    对阿里巴巴 Wan 3.0(公开测试版、30秒片段)进行压力测试并与 Seedance 比较;指出 Wan 3.0 目前仅限 API/测试版,不像早期 Wan 版本那样是开放权重。

  8. Alibaba Wan 3.0 Made a 30 Second App Commercial for $1.27
    — 频道未识别 — 2026-08-24 —
    https://www.youtube.com/watch?v=fHK7oYrokZY
    Wan 3.0 登陆 OpenRouter 后的成本/质量演示,将其定位为封闭源视频生成器的低价替代方案。

  9. Midjourney Update | July 2026: V8.2 is HERE! Personalization, NIJI
    Style Creator, and More!

    — 频道 Woollyfern — 发布于2026年7月 —
    https://www.youtube.com/watch?v=dvfH5HzCARY
    介绍 V8.2 的个性化和 NIJI 风格创作器功能;该视频属于按月追踪 Midjourney 封闭源路线图的系列(2026年2月至7月 V8 → V8.1 → V8.2)。

  10. Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate
    AI Video Comparison

    — 频道未识别 — 约2026-03-10(超出60天窗口,但保留,因为它是最清晰的一支、正面对比四个封闭源视频模型的视频)—
    https://www.youtube.com/watch?v=x5fMQvhKP60
    按电影感质量、口型同步和多镜头一致性对四款封闭源视频生成器进行排名。

  11. Exciting AI Updates Weekly — September 25, 2026
    — 创作者“Lev Selector” — 2026-09-25 —
    https://www.youtube.com/watch?v=iyZHPCNd8jI
    每周通用AI新闻汇总,把图像/视频生成发布(GPT Image 2.5、Qwen-Image-2.1)与更广泛的AI新闻一并纳入。

信号
  • **开放权重模型正快速缩小差距,而且这种说法已被公开强化。**本次多支视频标题直接将阿里巴巴7B Qwen-Image-2.1 描述为击败或匹敌 Google 更大 Nano Banana 2.0(#3、#4)——“小型开放模型击败大型封闭模型”已成为反复使用的叙事钩子,而非一次性说法。
  • **开源视频竞赛侧重本地运行速度,而不只是质量。**LTX-2.5(#5、#6)和 Wan 系列(#7、#8)主要通过 ComfyUI 配置/速度测试视频进行报道,而非华丽预告片——受众关心的是能否在自己的 GPU 上运行。
  • **封闭源视频正在整合。**OpenAI 将于2026-09-24关闭整个 Sora 2 API(由 OpenAI 自己的帮助中心和多家媒体确认,但本次未找到专门的 YouTube 反应视频——见局限);而阿里巴巴 Wan 3.0 据称几乎在同一时间于全球视频模型排行榜超过 Sora(VentureBeat)。封闭源视频竞赛正收缩为 Veo/Kling/Grok/Runway/Seedance。
  • **封闭源图像领头者以月度/小版本节奏发布。**Midjourney 的 V8 → V8.1 → V8.2(#9)和 OpenAI 的 GPT Image 2.0 → 2.5(#1、#2)都展示频繁、渐进的小版本更新,而非大爆发式版本——报道频道也适应了这种节奏,形成定期月度“更新”视频格式。
  • Wan 3.0 是部分信号,而非明确的开源胜利——它目前仅提供 API/公开测试版(#7、#8),不同于开放权重的 Wan 2.x 系列,因此更像阿里巴巴在开放和封闭分发之间进行对冲。
局限
  • **无法取得播放量和订阅数。**对 youtube.com/watch?v=... 和 youtube.com/results?search_query=... 页面的 WebFetch 只返回 YouTube 静态页脚/法律声明;播放量/订阅数位于 JS 渲染的 ytInitialData 中,抓取内容从未包含它。WebSearch 摘要也未提供这些数据。因此所有“播放量”/“订阅数”都未猜测而是省略。
  • **若干频道名称无法确认。**当 WebSearch 摘要未给出创作者时,条目标为“频道未识别”,而不是猜测。
  • 本次没有找到专门回应 Sora 2 API 关闭的 YouTube 视频(经非 YouTube 来源确认发生于2026-09-24),尽管进行了数次定向搜索——在信号中仅作为背景提及,未算作 YouTube 发现。
  • 搜索覆盖依赖 Google 索引的 YouTube 摘要,而非实时 YouTube 搜索 UI,因为 UI 本身无法抓取——这可能低估了最近几天尚未被 Google 完全索引的新上传内容。

Bluesky

Bluesky — 图像生成AI・视频生成AI最新动态

账号
  • gen-ai.news(@gen-ai.news)— 自动发布生成AI行业新闻的账号。2026年9月18日至27日间,每天以1至3条的频率发布图像/视频生成AI相关文章摘要;本阶段发现的“最新新闻”大多来自这里。
  • sungkim.bsky.social(@sungkim.bsky.social)— 追踪AI/ML/数据分析的商业分析师,拥有8,690名关注者。经常快速发布开放权重模型的发布信息。
  • edzitron.com(@edzitron.com)— 以科技行业评论闻名的通讯账号。其 Sora 相关帖子获得大规模传播(后述)。
  • richargh.de(@richargh.de)— 从单位经济效益角度发表对 Sora 终止的个人看法。
  • luok.ai(@luok.ai)、adinayakup.bsky.social(@adinayakup.bsky.social)— 介绍开源视频生成模型(SkyReels 系列)技术信息的发帖者。
  • dahara1.bsky.social(@dahara1.bsky.social)— 以日语发布生成AI测试体验的用户。
帖子
封闭源阵营动态
  1. OpenAI 终止 Sora — @edzitron.com,2026-03-24,👍3,571 🔁984 💬99。引用 WSJ 和 The Information 的报道,并评论称“不仅应用,面向开发者的 API 访问也将结束,这是相当仓促的举动”。这是 Bluesky 上该主题最火的帖子。
  2. 认为 Sora 终止源于单位经济效益失败 — @richargh.de,2026-03-25,👍2 🔁0。“他们大概意识到视频生成的单位经济效益太差了。也许无法将免费用户转为付费用户。”
  3. Sora API 终止于2026-09-24实施(由 gen-ai.news 文章群和搜索结果确认,未找到 Sora 本体帖子。来源:Wikipedia: Sora 用于核实日期)。
  4. Runway 的 GWM 2 — gen-ai.news,2026-09-27。一个“不是生成片段,而是持续理解环境”的世界模型。
  5. Runway 正利用 GWM-1 开发实时视频流 — gen-ai.news,2026-09-20。介绍称其也着眼于机器人和自动驾驶应用。
  6. Midjourney Alpha 版支持实时风格预览 — gen-ai.news,2026-09-27(前身改动也见于09-25文章)。可在生成前查看风格效果。
  7. Adobe 创作工具群整合进 Gemini/Claude — gen-ai.news,2026-09-26。Photoshop、Lightroom、Firefly、Acrobat 可直接从聊天UI使用。
  8. Adobe 完成收购 Topaz Labs — gen-ai.news,2026-09-25。将尽快把AI超分辨率技术整合进 Firefly/Photoshop,Topaz 品牌暂时保留。
  9. OpenAI 以3亿美元收购 Glass Imaging — gen-ai.news,2026-09-19。这是一家面向手机相机的图像处理创业公司,被分析为 OpenAI 瞄准从生成到拍摄的完整图像流程。
  10. 字节跳动 Dramagic 用AI生成中国短剧的95%内容 — gen-ai.news,2026-09-22。介绍其从剧本到影像、无需人工摄制团队的流水线。
  11. Meta 监督委员会命令公司移除深度伪造视频 — gen-ai.news,2026-09-19。同时要求 Meta 加强检测和移除政策。
开源阵营动态
  1. 阿里巴巴以开放权重发布 Qwen-Image-2.1 — @sungkim.bsky.social,2026-09-20,👍82 🔁10 💬4。介绍为“整合生成和编辑的轻量级7B架构,多图输入的推理速度大幅提升”。
  2. 该模型的详细解读 — gen-ai.news,2026-09-20。“7B开放权重图像生成模型,可在消费级GPU运行,支持透明图层,可同时输入最多10张参考图,并声称在基准测试中可匹敌大型封闭模型。”
  3. SkyReels V1,第一个开源的人物专用视频基础模型 — @luok.ai,2025-02-18,👍3 🔁1。说明其在超过1,000万段视频片段上微调 HunyuanVideo,可捕捉33种表情和400多种动作。
  4. SkyReels-A2,一个由文本+图像实现可控视频生成的框架 — @adinayakup.bsky.social,2025-04-04,👍3 🔁2。介绍为 Skywork、KunLun 推出的开放框架。
  5. HunyuanVideo 的测试体验(日语) — @dahara1.bsky.social,2025-03-06。发布称可从一张图片生成带声音的视频(I2V),并展示动画风格的口型同步结果。
信号
  • 9月下半月封闭源阵营的新闻密度较高:Runway、Adobe、Midjourney、OpenAI、Meta、字节跳动、Pinterest 在2026-09-18至09-27的10天内几乎每天都发布公告、收购或政策变化;Bluesky 的AI新闻账号也随之跟进。
  • “视频生成不赚钱”的氛围:Sora 终止(3,571个赞)被当作明确转折点;类似 richargh.de 的分析——“单位经济效益不佳”——正逐渐成为社区共识。
  • 阿里巴巴 Qwen 系列在开源图像生成中存在感突出:Qwen-Image-2.1 同日获得个人账号(sungkim.bsky.social)和新闻账号(gen-ai.news)报道,82个赞是本阶段确认到的个人帖子最高反应。“轻量7B、可匹敌大型封闭模型”是讨论主轴。
  • 开源视频生成的个人帖子很少,而且偏旧:SkyReels 和 HunyuanVideo 帖子均来自2025年上半年;截至2026年9月,Bluesky 搜索未找到关于 Wan 2.7、LTX-2.3、FLUX.2 的重要个人帖子(已在信号中明确)。
  • 行业新闻存在自我纠错机制:gen-ai.news 在2026-09-23的帖子中明确表示:“GPT-6和‘Astra’都不存在。该文章包含虚构产品名称,因此无法撰写帖子。”这表明其不会在不验证来源时发帖。但该账号2026-09-21的帖子又称“Higgsfield AI 使用 GPT-4o 和 OpenAI 的‘Astra’框架快速新增功能”,这与前述“Astra不存在”的自述相矛盾。二者至少一项很可能有误,因此不应直接采信任何 Astra 相关说法。
局限
  • Bluesky 官方搜索 API(app.bsky.feed.searchPosts)在本会话中始终返回403 Forbidden,无法通过关键词进行全面调查。替代方法是通过 Web 搜索(site:bsky.app)发现帖子和账号,并用 app.bsky.feed.getPostThread / app.bsky.feed.getAuthorFeed(公开、无需认证的 API)直接验证正文、日期和点赞数。
  • bsky.app 的帖子页面本身为 JS 渲染,WebFetch 无法获取正文或数值,只能读取作者句柄。所有数值均限于通过上述 API 取得。
  • 对于截至2026年9月理应受关注的开源视频/图像模型和工作流分享,例如 FLUX.2、Wan 2.7、LTX-2.3、ComfyUI,Bluesky 上未找到有意义的个人帖子。直接检查过相关句柄(fluxkontext.bsky.social、wagahai-ai.bsky.social、aoi68k.bsky.social 等)的动态,但它们都停留在2025年上半年,未反映近期话题。
  • 相较于完成标准“分析约20条帖子”,实际确认正文和数值的帖子为16条(封闭源11条、开源5条)。内容偏向 gen-ai.news,来自多位个人用户的自然讨论仍显不足。
  • 找到多个日本语社区(AI插画、AI视频标签)账号,但内容不是旧(2024至2025年),就是泛用的作品展示(缺少新闻性),因此未作为符合本主题的最新发现纳入。

Lemmy

Lemmy — 图像生成AI・视频生成AI最新动态

社区
  • !«メールアドレス» — 5,714人。Lemmy 上开放权重图像/视频生成AI话题唯一实质性的枢纽。几乎每天都有人发布 GitHub/HuggingFace 链接,属于“快讯订阅源”型社区。
  • !«メールアドレス»(与 sh.itjust.works 镜像)— 约5,180人。聚焦本地 LLM 的社区,偶尔涉及图像生成;不过在本次收集期间未发现图像或视频生成相关的新帖子。
  • !«メールアドレス» — 1,662人。社区存在,但近期活动几乎未确认(较为沉寂)。
  • !fuck_ai(横跨 lemmy.world / lemmy.dbzer0.com / lemmy.zip / discuss.online / lemmy.blahaj.zone 等多个实例)— 规模之外也很活跃(每帖数十至逾800个赞),讨论整体反AI情绪,但专门谈图像/视频生成AI的帖子很少。
  • !«メールアドレス»(以及各实例镜像)— 封闭源图像/视频生成AI新闻偶尔流入的通用科技社区。未发现专门社区。
  • !«メールアドレス» / !«メールアドレス»、!«メールアドレス»、!«メールアドレス» — AI生成内容相关新闻偶尔流入游戏或特定品牌社区的例子。
帖子
开源方面(来自 !«メールアドレス»)
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency — 得分14,2026-09-22。阿里巴巴开放权重模型 Qwen-Image-2.1 已整合入 ComfyUI,支持透明(alpha 通道)输出。https://lemmy.dbzer0.com/post/75874773
  2. SupraLabs/Supra2-IMG — 得分8,2026-09-22。仅用合成数据训练的1亿参数超轻量 text-to-image 模型,被介绍为“以其规模而言的最先进画质”。https://lemmy.dbzer0.com/post/75874769
  3. AI Horde:新界面、新前端、新后端和全面改版文档 — 得分9,2026-09-19。由本 Lemmy 实例管理员 db0 开发的分布式、免费图像生成服务更新。https://lemmy.dbzer0.com/post/75736717
  4. well9472/Nanosaur2-670M(支持 ComfyUI) — 得分4,2026-09-27。训练成本仅600美元、6.7亿参数、面向插画的 text-to-image DiT 模型。https://lemmy.dbzer0.com/post/76110122
  5. 面向 MiniMax H3 的工具集中发布 — 2026-09-13至09-26期间,突破长视频内存限制的“AutoContext”、3D镜头控制 UI、时间线编辑节点、三步加速 LoRA(TaoMate-H3)等连续发布超过5项(得分1至6)。这表明 MiniMax H3 是该社区目前视频生成的主战场。示例:https://lemmy.dbzer0.com/post/75586069
  6. 围绕 Krea 2 的 LoRA/加速工具 — “Krea2-Turbo-Distill-2step-LoRA”(去噪速度提高4.2倍,得分2,2026-09-16)和“krea2-inpaint-edit”(用于蒙版编辑的 LoRA,得分-1,2026-09-26)。Krea2 正逐渐成为社区能够自行制作 LoRA 的目标模型。
封闭源方面(散见于通用社区)
  1. Midjourney 要求好莱坞电影公司披露AI使用情况 — !«メールアドレス»,2026-07-05。https://lemmy.today/post/56011946
  2. 斯坦福大学承认使用AI处理学生照片以“改变种族” — !«メールアドレス»,得分3,2026-09-23。https://lemmy.world/post/52274704
  3. Google Earth 的新AI功能让任何人都能制造伪造卫星图像 — !«メールアドレス»,2026-08-04。https://sh.itjust.works/post/64574916
  4. DC 删除了幕后视频:其中被发现使用AI生成概念艺术 — !«メールアドレス»,得分5,2026-08-13。https://lemmy.today/post/58316222
  5. Meta 的广告把面向真实青少年的裸体化(nudify)应用宣传为“男性实际使用的AI” — !«メールアドレス»,2026-09-08。https://lemmy.dbzer0.com/post/75191260
  6. EA 与开发 Stable Diffusion 的公司(Stability AI)合作,借AI制作游戏 — !«メールアドレス»,得分2,2025-10-25。https://mander.xyz/post/40602787
  7. 调侃“OpenAI 终止AI垃圾视频生成模型 Sora”的梗图帖子 — !«メールアドレス»,得分0,2026-03-25。在讽刺 Sora API 终止这一真实新闻的语境中。https://lemmus.org/post/21091066
信号
  • 开源方面高度集中:找到的开发类帖子几乎都来自同一个社区(!«メールアドレス»),并且几乎由同一发帖者(Even_Adder)加上实例管理员 db0 发布。几乎所有帖子的评论数为0,与其说是讨论场所,不如说更像“GitHub/HuggingFace 新链接合集”。
  • 当前开发重心是 Qwen-Image-2.1(图像)和 MiniMax H3(视频):近两周的大多数工具帖子都面向这两个模型的适配器、LoRA、ComfyUI 节点;Reddit 端(output/reddit.md)也将同样两个模型(Qwen-Image 2.1 编辑、Minimax H3 视频)明确称为“当前最强”,获得跨平台印证。
  • 封闭源话题只通过“争议和伦理”,而非“功能新闻”流入:关于 Midjourney、Google、Meta、DC 的帖子都不是新功能发布,而是在报道版权侵害、深度伪造、冒充、造假等问题。Lemmy 上没有专门追踪 Sora、Veo、Kling、Grok Imagine 等技术性新模型快讯的社区。
  • !fuck_ai 虽有规模,却不专注图像/视频生成AI:单帖常有数十到800多个赞,但核心话题是文本 LLM 智能体失控(“Claude Code 103秒删除48,000个文件”“OpenAI 智能体修改政府网站”),图像/视频生成AI只是少数内容。
  • 以主要封闭源产品名直接搜索几乎无结果:搜索“Kling AI”“Veo 3”“Adobe Firefly”“Nano Banana”“Grok Imagine”时,几乎只返回无关内容;Lemmy 上基本没有以这些产品为名的专门帖子或讨论。
局限
  • Lemmy 的搜索功能(lemmy.world API 搜索或站内 Web 搜索)准确度低,会混入大量与关键词无关的帖子(例如搜索“Kling AI”会返回德国铁路折扣帖子)。因此,“搜索未命中”不能断言为“没有人在讨论”。
  • 开源信息源实质上依赖1个社区和1至2个账号;其他实例(lemmy.ml、lemm.ee 等)的同类社区订阅者较少,活动也几乎未确认。
  • 封闭源方面未发现专门聚集社区,只能从 technology、nottheonion、games、dcstudios、googlepixel 等通用社区拼凑零星帖子,覆盖率较低。
  • 本次通过社区列表和搜索结果打开的帖子超过40条(stable_diffusion 社区最新20条+多次搜索命中的内容),数量达到“约20条”的完成标准;但真正形成活跃评论讨论的帖子极少(大多数为0评论)。
  • Lemmy 整体用户和帖子数量较小;与 Reddit、X、Bluesky 等相比,作为追踪图像/视频生成AI“最新新闻”的场所厚度不足。

Pinterest

Pinterest — 图像与视频生成AI新闻

在收集的50个图钉(pinterest.pins.md、manifest.json)中,实际打开并检查了26张图片。使用的是未分类的单一查询("Image and Video Generation AI News")。

视觉主题
  • 黑色背景×霓虹蓝/紫的“AI感”呈现占主导:发光处理的机器人手、面部、闪亮的电路图案和 AI 标志文字反复出现。几乎整体都是这种视觉调性 [1, 7, 8, 20, 37, 38, 40]。
  • 白色人形机器人(光滑质感、发蓝光的眼睛/关节)被大量用作“AI”的拟人化图标 [8, 20, 37, 38, 40]。这类图库风插画远多于实际产品的 UI 截图。
  • “这是AI生成的”警告和对比构图形成大品类:假内容判别印章、人类/AI 对比的分屏图、新闻主播风格的AI生成视频截图等;“如何分辨”和激发不信任的内容很突出 [3, 32, 39, 42, 43, 44, 45, 48]。
  • 工具比较、排行榜类信息图(纵向列表 UI):“Best Quality vs Best Free”“22 Best & Free AI Video Generators”这类排列多个工具标志的选择指南很多 [7, 47]。路线图(学习路径)也属于同一类 [34]。
  • 将封闭源巨头的品牌标志/产品名置于前景的缩略图:Google Gemini/Omni、Veo3、Kling AI、Luma Dream Machine、OpenAI 标志都被放在显眼位置 [1, 9, 13, 19, 31, 33, 47]。相比之下,以开源(Stable Diffusion 系列、ComfyUI、LoRA 等)为主题的图片几乎没有,Stability AI 的1张 [49] 也是产品介绍拼图,并非实际工作流画面。
  • “将一张素材转换为多种风格”的演示构成:同一人物照片被转换成木质积木、折纸、乐高、花卉制成风格的对比网格,是展示图像编辑AI表现力的典型案例 [2]。
  • 眼睛特写与“难辨真假”母题:Luma Dream Machine 的眼睛特写 [33]、AI/人类对比的微距演出 [43] 等,都是强调“真实感”的视觉语言。
  • 以真实企业标志、行政文件组合来营造新闻感:Google 招牌照片 [28]、纽约州法律制度相关的文件风图片 [18] 等;带文字叠加的图库照片“新闻汇总”版式很多。
值得注意的图钉
  • [1] “AI News: Anthropic Leak Shows Us The Future of AI...” — 典型 YouTube 缩略图结构:“惊讶表情+大科技公司标志(OpenAI/Google/Microsoft)”。这就是AI新闻视频模板本身。
  • [2] “Google announces ultra-high quality video...”(实际是图像转换演示网格)— 从原始视频转换成木雕/折纸/乐高/花艺风格的连续对比。是直观展现图像编辑AI表现力的代表例。
  • [9] “Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API” — 宣传通过 Gemini API 使用 Veo3 进行高速视频生成+原生音频。封闭源最新功能的宣传素材。
  • [13] “Kling.ai AI-Powered Text-to-Video Generation” — 以“My Top Picks”形式推荐 Kling AI 的纵向图钉。显示中国封闭源视频生成工具具有较高知名度。
  • [19] “Google's Gemini Omni Turns Anything Into Video” — 将多模态整合(图像、音频、文本→视频)浓缩为一个图标的品牌图片。
  • [31] “'Amuse 3.0', an AI art creation tool that includes...” — AMD 赞助的本地运行图像生成工具,配以超写实肖像。是少数强调设备端生成的案例。
  • [32] “AI news videos blur line between real and fake reports” — 带有“AI GENERATED”水印的 NBC 新闻风AI生成主播静帧,是对生成AI被滥用于新闻领域的担忧的象征。
  • [44] “AI News Anchors & Creator-Led Coverage Take Over U.S. Media!” — 俯瞰新闻编辑室的合成插画,以报道AI主播和创作者主导新闻兴起的形式呈现。
  • [47] “22 Best & Free AI Video Generators in 2026” — 为 Kling/Hailuo/Runway/Pika/Luma 等22种工具分级的信息图。以免费额度为卖点的工具选择内容典型。
  • [49] “Stability AI's Stable Diffusion Maker Can Now Build AI Generative Video” — Stability AI 相关拼贴图(办公场景+代码画面+人物肖像生成示例)。这是开源相关少数案例之一,但未展示具体 UI 或模型名。
信号
  • 当前 Pinterest 几乎清一色是“封闭源视频生成”:Veo3/Gemini Omni、Kling AI、Luma Dream Machine、Runway 等基于商业 API 的工具名带标志反复出现。工具比较信息图 [7, 47] 也几乎只列出封闭源 SaaS 工具;即使存在免费/开放的维度,也不是“开源、自行托管”的语境。
  • “对AI生成内容的不信任与辨别方法”是 Pinterest 特有的强需求:假内容判别、新闻滥用、人类还是AI?等对比图在这里形成独立品类,区别于其他平台。这些内容在 Pinterest 是以“科普信息图”形式被消费的,而非 Reddit 或新闻网站式技术讨论。
  • 开源特有话题(ComfyUI、LoRA、Wan/HunyuanVideo 等中国开源模型、许可证讨论)几乎不存在。仅找到1条 Stability AI 相关内容,未发现具体工作流画面或社区创作物。
  • 收集数据未包含互动指标(收藏数、点赞数),因此无法仅凭图片判断哪些图钉实际受到关注。
局限
  • 50条中仅实际打开并检查26张图片(其余24条只参照 pinterest.pins.md 的标题列表)。
  • Pinterest 内容由工作器预先收集,无法自行浏览或调整搜索查询。结果来自单一英语查询,未能用日语查询或按“开源”“封闭源”重新搜索。
  • 收集的仅是静态图片,因此尽管主题是视频生成AI,也无法确认“正在播放的生成结果”,只能从缩略图和宣传图片推断。
  • 数据不含收藏数、评论等互动指标,无法评估热度或传播度。

推荐行动

  • 每周查看 Qwen-Image-2.1 和 Minimax H3 周边的 ComfyUI 生态。
  • 停止依赖地区趋势词收集 X 内容,改用直击图像/视频生成AI主题的关键词重新搜索。
  • 跟踪 Sora 终止后封闭视频阵营(Veo、Kling、Grok、Runway、Seedance)的重组。
  • Pinterest 没有热度指标,应将其作为视觉语言参考信息。
  • 持续观察对AI生成内容不信任的扩大以及强制水印的讨论。
  • 重新收集 Reddit 时使用 open/closed source 专用搜索词,以接近完成标准。

收集的图片

AI新闻:Anthropic 泄露内容让我们看到AI的未来……Google 宣布超高质量视频……AI内容与社交媒体担忧完美搞定 🎥数据科学用于内容营销的AI生成视频用于图像和视频生成的AI将文本转换成图像的AI工具Veo 3 图生视频:通过 Gemini API 实现快速生成与原生音频AI图像生成面向文本、图像、音乐和视频生成图标的AI内容创作概念——浏览57张图库照片、矢量图和视频图片Kling.ai AI驱动的文生视频生成图片图片图片AI纽约的大胆尝试:深入了解立法……Google 的 Gemini Omni 将任何内容变成视频图片‎🚨 AI正变得可怕地强大。图片图片图片专业AI视频创作 | 电影感AI视频 | 定制视频剪辑2025年顶级AI视频生成器AI新闻:OpenAI 终于发布了我们所要求的内容Google 将图像和……的AI水印设为可选AI图像生成与娱乐产业图片“Amuse 3.0”,一款包含……的AI艺术创作工具AI新闻视频模糊了真实报道和虚假报道的界限推出 Luma Dream Machine——下一代AI视频生成式AI详解:完整的新手指南(2026)2026年你需要知道的4项主要AI更新图片AI黑色GPTAI新闻与最新更新 | 人工智能趋势与突破AI生成视频:好还是坏?这才是真相!🤖🎥AI掌握视频与AI:2025年关键社交媒体营销趋势“为什么AI聊天机器人难以跟上突发新闻”识别AI ✨ 掌握关键特征!AI新闻主播和创作者主导的报道席卷美国媒体!Channel1 的AI主播图片2026年22款最佳免费AI视频生成器 🎬🤖 | 用AI创作精彩视频埃隆·马斯克的新AI已被用于生成……Stability AI 的 Stable Diffusions Maker 现可构建AI生成视频你尚未准备好面对这波可怕的新AI生成视频浪潮

数据质量说明

X 因地理定位错误和依赖趋势词搜索而得到0条相关帖子;Bluesky 因搜索 API 返回403而偏向一个账号的文章;Pinterest 没有互动指标;YouTube 无法取得播放量;Lemmy 的开源信息实质上集中于一个社区;Reddit 也只有12个帖子,低于完成标准的20条。

图库