KEN’S CAT LOG

图像与视频生成 AI 新闻汇总🔥🎨🎬 — 2026-09-24

闭源图像/视频 AI 正在价格与速度上占据优势(GPT-6 Sol/Luna、ChatGPT Images 2.5、Kling 3.0),而开放权重模型开始在视频质量上取得明确胜利(Wan 3.0)。与此同时,多项所谓“开源”发布(Wan 3.0 后续权重、FLUX 3、MiniMax H3 的许可)实际上比宣传中更封闭或限制更多。

闭源图像/视频 AI 正在价格与速度上取胜(GPT-6 Sol/Luna、ChatGPT Images 2.5、Kling 3.0),而开放权重模型也开始在视频质量上取得明确胜利(Wan 3.0)。与此同时,多项“开源”发布(Wan 3.0 后续权重、FLUX 3、MiniMax H3 的许可)实际上比宣传中更封闭或限制更多。

图像与视频生成AI新闻汇总🔥🎨🎬 — 2026-09-24

太离谱了,这周的图像与视频生成 AI 圈子依旧一片混沌😂。一句话概括,就是“🔒闭源阵营靠降价和速度猛攻,🔓开放阵营则正逐渐成为视频生成领域的真正王者”!GPT-6 Sol/Luna 这样的新模型接连推出、价格持续下探;另一边,Wan 3.0 这样的开放权重模型据说登上了视频领域榜首,真的很燃🔥。但同时,“AI 图片被识破后引发争议”“诉讼缠身”“假借开源之名”等阴暗面也层出不穷,已经不是一句“AI 真厉害”就能带过的氛围了😅。

跨平台观察 🌐

  • 🔒 降价与提速的竞争正在全面加速。 X 上的GPT-6 Sol/Luna 发布公告卖点不是性能提升,而是“更便宜、更快”;YouTube 上的 ChatGPT Images 2.5(生成速度 -50%)和 Kling 3.0 的 AI Director(一次生成多个镜头=压缩成本)也是同一趋势。多个平台都在说同一件事,看来这真的是大趋势💸
  • 🔓🔒 图像领域闭源更强,视频领域开放阵营或许已经反超。 根据 Bluesky 追踪机器人(olud.ai)的盲测评价,图像生成和编辑都是 GPT Image 2.5 Sunburst🔒居首,最强的可下载模型 Qwen-Image-3.0-Pro🔓仍落后 100+ ELO。不过,视频类别则有报告称 Wan 3.0🔓击败了所有闭源模型、排名第一,这点非常值得关注👀
  • ⚖️ 诉讼与监管压力明显增强。 经由 Bluesky 可以确认,Disney v. Midjourney 和 Andersen v. Stability AI 两起诉讼在 9/23 同时出现进展;Reddit r/CriticalState 上关于强制 watermark 与强制披露 AI 使用的法案讨论帖,合计已有约 1.8 万条评论。人们对 AI 生成内容的“这是真的吗?”已经越来越愤怒😤
  • 🎭 “被识破后被嘲笑的 AI”和“未被识破便广泛传播的 AI”同时存在。 Reddit(房产照片、Nikon 显微镜视频、大学墙面图片)和 Pinterest(NBC 的“AI GENERATED”标识、疑似造假 meme)上有大量被吐槽的案例。但 r/Instagramreality 也报告了 AI 图片未被识破、拿到数千点赞的情况;同一个空间里正在发生截然相反的事😳
  • 🔓 自称“开源”、实则并非如此的问题频发。 YouTube 指出的 FLUX 3🔒(标题写着“Open Source”,但实际上只有封闭的早期访问版)、Wan 3.0(此前版本为开放权重,v3.0 却转为不公开权重、仅限 API)、MiniMax H3🔓(Hugging Face 公开权重,但在美国、欧盟、英国和韩国禁止使用)——“开放”的定义越来越松散,这是必须警惕的问题⚠️

平台逐一看 📱

  • Reddit — 仅收集到 12 个帖子,未达到 20 个的目标😢。内容中也没有 r/StableDiffusion 之类的硬核社区,主要是 r/mildlyinfuriating(AI 房产照片,2.6 万分)和 r/labrats(AI“增强”的显微镜视频获奖后引发争议)等普通用户“AI 被识破笑死”式反应。几乎没有产品新闻。
  • X — 由于会话被判定为克罗地亚地区,Explore 趋势的大部分内容(加密货币、Taylor Swift 等)都不相关🙄。但仍捕捉到了 GPT-6 Sol/Luna 的发布,以及 Opus 5.5 被作为可“操作” Higgsfield/After Effects/Blender 的编排器使用的帖子群(示例)。不过这次完全没有开放源代码相关话题🔓❌。
  • YouTube — 无法从页面获取单个视频的频道名和播放量,因此这两项均为零😩(详见后文)。但从内容上看信息最全面:Nano Banana Pro🔒、Kling 3.0🔒、Wan 3.0🔓(不再公开权重)、LTX-2.3🔓(音画同时生成)、Qwen-Image-2512🔓、FLUX 3🔒/🔓的品牌与实际情况不一致等,覆盖了开闭两大阵营的具体动态。
  • Bluesky — 搜索 API(searchPosts)对所有查询均返回 403,但通过发现账号+getAuthorFeed 的方式强行突破💪。获取了 olud.ai 的 ELO 排行榜(GPT Image 2.5 Sunburst🔒第一、Wan 3.0🔓视频第一)、ai.bots.law 的诉讼快报,以及 ComfyUI🔓达到 13.4 万 star 的消息,带数字的信息最扎实。
  • Lemmy — 规模很小(ai_reddit 社区仅 52 名订阅者),但 !«メールアドレス» 是 ComfyUI/开放权重用户的聚集地🔓。Sora API 停止服务与 Kling 获得 30 亿美元融资的对比文章,以及对 Midjourney 进军超声波扫描仪业务的“Theranos 化”批评等商业八卦也很有意思。
  • Pinterest — 完全无法取得互动数据(点赞、收藏),只能分析图片内容。50 条内容中充满闭源品牌(ChatGPT、Gemini、Veo、Kling、Midjourney、Adobe Firefly 等),暗示开放/本地工具的 pin 只有 1 条(面向 AMD 的 Amuse 3.0)🔓😶。还有 4 条独立内容都在传达“AI 生成的东西还能信吗?”的焦虑。

值得关注 👀

  • Wan 3.0 是否公开权重 — Bluesky 排行榜中它是视频类第一🔓,但 YouTube 报告称它已转为“不公开权重、仅 API 的测试版”,信息互相矛盾。需要继续追踪哪种说法为真(Bluesky 帖子 / YouTube)
  • Disney v. Midjourney / Andersen v. Stability AI 的诉讼进展 — 两案均在 9/23 有新动态,裁决可能改变整个行业处理训练数据的方式(Bluesky/ai.bots.law)
  • Sora API 停止服务与 Kling 获得 30 亿美元融资的对照 — 面向消费者的 AI 视频变现可能较困难,而企业市场或许正在成为主战场(Lemmy)
  • MiniMax H3 Community License 的地区限制 — 即便是“开放权重”,也可能无法在美国、欧盟、英国和韩国使用;需要关注这是否会成为新的常态(YouTube)
  • AI 披露与 watermark 强制要求的法案走势 — Reddit 上相关讨论达到约 1.8 万条评论,关注监管将推进到什么程度(r/CriticalState)
  • GPT-6 Sol/Luna 在实际使用中的性能评价 — 发布后已有怀疑声音称,“核心是降价,性能并没有大幅提升”(X)

建议 ✅

  • Wan 3.0 是否公开权重的信息彼此矛盾,应在撰文或决策前亲自到 Hugging Face/官方网站核实最新状态。
  • 对宣称“开源”的模型(如 FLUX 3),务必确认许可措辞以及是否真的可以下载,不要照单全收其营销说法。
  • 使用 MiniMax H3 等带地区限制的开放权重模型前,先确认目标国家或地区是否被 Community License 排除。
  • 若计划将视频生成 AI 用于商业,应结合当前趋势优先评估企业用途(培训、商品演示),而不是只依赖面向消费者的免费额度。
  • 持续关注 Disney/Andersen 诉讼的判决节点,及时更新有关训练数据的风险策略。
  • 结合 Reddit 与 Pinterest 上“AI 被识破后引发争议”的案例,公开 AI 生成内容时应明确标注披露信息。

数据质量 📊

  • Reddit: 目标为 20 条,实际只有 12 条。而且搜索词只有单一的“Image and Video Generation AI News”,没有覆盖 r/StableDiffusion 等硬核社区,样本偏向普通用户对“AI 被识破”的反应。
  • X: 会话只能看到依赖地区(克罗地亚)的 Explore 趋势,10 个趋势中仅 3 个相关。开放源代码相关提及实际上为零🔓❌。
  • YouTube: WebFetch 持续被重定向到 Cookie 同意页面(consent.youtube.com,地区=HR),完全无法获取播放量、频道名和评论。内容仅依赖 WebSearch 摘要。
  • Bluesky: 官方搜索 API(searchPosts)对所有查询返回 403。由于采用通过发现账号替代收集,结果并非覆盖全平台的搜索结果。
  • Lemmy: 平台本身规模极小(ai_reddit 社区仅 52 名订阅者),单独搜索视频生成 AI 没有命中。针对 20 条目标,实际约只有 14 条。
  • Pinterest: 完全无法取得点赞、收藏等互动指标,只能分析图片和标题内容。50 条中仅打开了 30 条图片本体。

按平台汇总

Reddit

Reddit — 图像与视频生成 AI 新闻

来源

通过单一搜索词“Image and Video Generation AI News”,在 10 个 subreddit 中收集到 12 个帖子:

Subreddit 成员数 收集到的帖子数
r/mildlyinfuriating 12,590,273 1
r/youtube 3,460,141 1
r/Instagramreality 1,155,685 1
r/LinkedInLunatics 1,081,995 1
r/labrats 726,552 1
r/generativeAI 156,580 2
r/Purdue 100,756 1
r/CriticalState 39,323 2
r/perchance 30,990 1
r/aivideomaking 7,568 1

其中没有一个是专门的生成式 AI 工具社区(没有出现 r/StableDiffusion、r/midjourney、r/aivideo 等)——样本主要来自普通受众 subreddit 对 AI 生成内容的反应,以及两个小型工具支持社区(r/generativeAI、r/aivideomaking、r/perchance)。

人们怎么说
  • #1(r/labrats,933 分,123 条评论,2026-09-23)— 获得 Nikon's Small World in Motion 比赛冠军的“显微镜”视频,后来被发现经过 AI 生成/“增强”,其中的细胞运动在生物学上不可能发生。显微镜专家提出异议后,Nikon 确认使用了 AI。高赞评论(u/Barkinsons,551 分)称:“AI 工具不该出现在科学显微镜图像中,因为我们有义务尽可能如实地重现图像,而不是让它们变成我们希望看到的样子。”
  • #4(r/mildlyinfuriating,26,469 分,714 条评论,2026-09-21)— AI 布置的房产挂牌照片不现实地改变了房间(例如移除暖气片、加入根本放不下的台球桌)。高赞评论(u/slothboy,5,706 分)称:“把那个早餐角改成浴室,得花五位数。”这是整个收集结果中得分最高的帖子。
  • #5(r/Instagramreality,2,179 分,348 条评论,2026-09-18)— AI 生成图片在 Reddit 本身获得数千点赞,直到照片之间的踢脚线和瓷砖线条发生变化才被识破。u/Habibti-Mimi81(150 分)称:“我显然要么太老、要么太笨了,因为如果没人说,我不会知道这是 A I……我们生活在悲哀又危险的时代。”
  • #10 和 #12(r/CriticalState)— 两条分别推动强制 AI watermark(13,835 条评论,1,256 分,2026-09-21)和要求企业强制披露 AI 使用(4,537 条评论,214 分,2026-09-18)的立法提案帖。高赞评论主要是“我投赞成票 ✅”(看起来像是由投票机器人驱动的 subreddit),但评论量本身表明人们强烈期待披露监管。
  • #2、#6、#7(r/aivideomaking 与 r/generativeAI x2)— 三个近乎重复的“寻找免费 AI 视频生成器”帖子(12 分/36 条评论、2 分/24 条评论、4 分/29 条评论)都发布于 9 月 19—20 日。三者的一致答案是:免费层通常只能生成 3—6 秒片段;常见回复者 u/Jenna_AI(AI 支持机器人)解释说,免费层无法在约 6 秒之后维持时间一致性。反复提到的工具包括:ComfyUI + FramePack(本地运行,需要 16GB+ VRAM)、Muse(Meta,免费、无 watermark)、Grok(10 美元/月)、Kling/Hailuo/Pixverse,以及通过 Google Flow 使用 Nanobanana/Veo。
  • #9(r/perchance,31 分,21 条评论,2026-09-19)— 询问为何 Perchance AI 没有图生图模式的帖子。高赞评论(u/Dack_Blick,32 分)称:“图生图带来巨大的法律风险与责任。”其他人说得更直接:u/DoctaRoboto(8 分)称原因是“非法色情与深度伪造”,u/Separate-Prior-5985 则说“恋童癖者”。这是少见的由开放/免费工具的开发者解释其主动限制功能的讨论。
  • #8(r/Purdue,150 分,20 条评论,2026-09-21)— 大学工程楼墙上的 AI 生成宣传图因毫无意义的 PCB 布局遭到嘲笑。u/549013(7 分)称:“全国顶尖工程学院之一的讲座视频有一半都是 AI 生成的,他们真的不能复用旧视频吗。”
  • #11(r/LinkedInLunatics,978 分,116 条评论,2026-09-21)— LinkedIn 上一张 “名人认同无名小卒”的 AI 图片。u/Humble_Daikon(318 分)称:“我喜欢 AI 让 Musk 抽烟这点——一定是从那些把他们叫作噩梦钝器轮换的 Reddit 评论里学来的。”
  • #3(r/youtube,5 分,22 条评论,2026-09-17)— 抱怨 YouTube 的 AI 生成视频章节出现在每支视频中。反应两极:u/buildingduck 与 u/meatmobile682 认为它们突兀且无关;u/ickN、u/lieutenatdan 与 u/davesaunders 则认为它们实用、不打扰人。
信号
  • 上升:非爱好者场景中,人们越来越反感未披露的 AI 图像。本次出现的每个普通受众帖子(Nikon 科学竞赛、房产挂牌、大学大楼、LinkedIn 帖子)都是批评或嘲笑,没有任何庆祝——模式是“野外发现 AI 垃圾内容”,而不是“看看这个很酷的生成作品”。
  • 上升:对监管的需求。两条 r/CriticalState 的立法提案帖合计约 18,000 条评论,推动强制 watermark/披露,远远超过这组其他帖子的评论数。
  • 被否定:存在高质量免费 AI 视频生成这一想法。三个独立帖子中,“有没有免费方案”的共识回答都是明确的否;免费层只能支持几秒,本地运行则需要大多数发帖者没有的硬件。
  • 令人意外 / 存在分歧:Reddit 一方面会识破并嘲笑 AI 图片(r/mildlyinfuriating、r/LinkedInLunatics、r/Purdue),另一方面也是 AI 图片未被察觉、获得数千点赞的地方(r/Instagramreality 的 #5,描述 Reddit 自己 r/OUTFITS 中的 AI 帖子)。同一平台既是揭穿者,有时也是无意中的传播者。
  • 显著缺失:这组帖子没有真正围绕开源与闭源产品新闻的内容(没有 Stable Diffusion/Flux/Sora/Veo/Kling 等产品的模型发布、基准测试或版本比较)——最接近的是 #9 对免费工具 Perchance 为什么不提供图生图的讨论,这是能力/责任故事,而非发布故事。
局限
  • 对照任务要求的每平台约 20 条,本次仅收集 12 条;执行者仅使用“Image and Video Generation AI News”一个搜索词,没有尝试变体(例如未分别搜索“Stable Diffusion”“Sora”“Midjourney”“open source video generation”)。
  • 收集集中没有专门的生成式 AI 工具 subreddit(r/StableDiffusion、r/midjourney、r/aivideo、类似 LocalLLaMA 的图像/视频社区),因此闭源与开源的具体产品新闻很薄弱;样本偏向普通受众的反应与反弹,而不是实践者讨论。
  • 根据 playbook,我没有亲自浏览 Reddit(Reddit 拒绝 WebFetch/search);我仅基于执行者收集的 output/reddit.threads.md 与 .json 工作,因此无法判断更广泛的搜索是否会发现更多有针对性的新闻。

X

X — 图像与视频生成AI新闻

X 的 Explore(在克罗地亚会话中观测,依赖地区)显示的 10 个趋势是“Cardano”“Opus 5.5”“$SONG”“Taylor”“Astra”“England”“#uranium”“OpenAI”“Croats”“NFTs”。其中与主题(图像与视频生成 AI)相关的只有 Opus 5.5 / Astra / OpenAI 三项;其余 7 项(加密货币、Taylor Swift 八卦、足球博彩推广、铀矿股、地区话题、NFT 铸造公告)与主题无关。以下是这些趋势下所收集帖子的分析。

账号
  • @OpenAI(官方,52,200 个赞 / 1 帖)— 唯一发布 GPT-6 Sol 与 Luna 上线消息的官方账号,也是这里互动量绝对最高的来源。
  • @npaka123(布留川英一,283 个赞 / 1 帖)— 知名 AI 解说账号,针对 Opus 5.5 的单次测试帖子。
  • @seiiiiiiiiiiru(476 个赞 / 1 帖)— 视频创作者,发布一支用 Opus 5.5 操作 Higgsfield+After Effects 制作的上线视频。
  • @kevin_t_ngo(2,451 个赞 / 1 帖)— 单帖,但在本次 AI 相关帖子中反应最大之一(约 152,000 次浏览);内容为 Opus 5.5 完成 Blender 渲染。
  • @aicreataro(325 个赞 / 1 帖)— 使用 Opus 5.5 对 MiniMax H3 素材进行 After Effects 加工的测试帖子。
  • @sonia_code(377 个赞 / 1 帖)— 使用 Astra 生成可在浏览器中运行的 3D 场景的单帖。
  • @yachimat_manga(73 个赞 / 1 帖)— AI 短动画创作者,发布一篇关于 Astra 时代工作流的思考。
  • @mask_3dcg(合计 1,813 个赞 / 2 帖)— 3DCG 创作者,两帖均主张“AI 无法取代动画师”,并非单条爆款,而是反复表达同一立场。
  • @umiyuki_ai(184 个赞 / 1 帖)— 比较 OpenAI 与 Claude 性能的单次分析帖子。
  • @so_ainsight(26 个赞 / 1 帖)— 以 Claude Code 使用经验闻名的账号,介绍一个 GPT-6 Astra 使用案例。

大多数都是“仅收集到一条帖文”的单次发声者;在该主题上发布多条内容的只有 @mask_3dcg。

帖子
  1. @OpenAI — 52,200 个赞・8,156 次转发・2,091 条回复・约 870 万次浏览・2026-09-23
    https://x.com/OpenAI/status/2102460975790137662

    请欢迎 GPT-6 Sol 和 GPT-6 Luna 加入 GPT-6 宇宙。[…] 它们将 GPT-6 Astra 的许多优势带入更快、更实惠的模型。
    最大的闭源新闻:官方发布两款派生模型,将 GPT-6 Astra 的能力以更高速度、更低价格提供。

  2. @umiyuki_ai — 184 个赞・29 次转发・约 47,000 次浏览・2026-09-22
    https://x.com/umiyuki_ai/status/2102485745328165103

    OpenAI 用 GPT-6 Sol 和 Luna 对阵 Opus 5.5![…] Sol 和 Luna 相比 5.6 性能似乎并没有大幅提高。不过,价格降低了。[…] Opus 5.5 超过 Fable 5.1,因此 GPT-6 Sol 也会是 Astra。
    对官方发布的反应:认为本质是降价而非性能提升。

  3. @so_ainsight — 26 个赞・4 次转发・约 3,400 次浏览・2026-09-23
    https://x.com/so_ainsight/status/2102641613612990946

    GPT-6 Astra x 房产网站→3D 空间,太夸张了 […] 输入只有该房产的 20 张照片;室内由 GPT-6 Astra(OpenAI 的 AI)和 Unreal Engine 完成。
    仅从 20 张照片生成可自由行走的 3D 空间案例,展示 GPT-6 Astra 的实用场景。

  4. @npaka123 — 283 个赞・40 次转发・约 31,000 次浏览・2026-09-23
    https://x.com/npaka123/status/2102594385758347548

    正在试用 Opus 5.5。提示词:制作一个 3D 射击游戏。[…] 如果顺利,大约一分钟能通关。还要加入 BGM 和音效。
    让 Claude Opus 5.5 通过一个提示词制作整套 3D 射击游戏(包含 BGM、音效)的测试。

  5. @seiiiiiiiiiiru — 476 个赞・49 次转发・约 27,000 次浏览・2026-09-23
    https://x.com/seiiiiiiiiiiru/status/2102636308707287201

    再手动打关键帧简直太傻了。这是 Claude Opus 5.5 操作 Higgsfield 和 After Effects,由 AI 制作的上线视频。[…] 大约 150 日元就做出来了。
    Opus 5.5 直接操作 Higgsfield 与 After Effects 制作上线视频,明确说明成本约为 150 日元。

  6. @kevin_t_ngo — 2,451 个赞・115 次转发・约 152,000 次浏览・2026-09-23
    https://x.com/kevin_t_ngo/status/2102761406315839798

    感谢 @claudeai!GIF 由 Claude Opus 5.5 在 Python 中制作动画,并在 Blender 中渲染。
    本次收集内容中 AI 相关话题互动量最高的帖子之一。Claude Opus 5.5 完成了 Python 动画直至 Blender 渲染。

  7. @aicreataro — 325 个赞・46 次转发・约 29,000 次浏览・2026-09-23
    https://x.com/aicreataro/status/2102656273112326609

    让 Opus 5.5 操作 After Effects,对 AI 视频进行加工的测试。■基础:MiniMax H3 制作的一段 15 秒视频 ■让 AE 完成的工作:让剪辑点对齐节拍、按片段各加一个效果。
    Opus 5.5 在 After Effects 中为 MiniMax H3 生成的视频做节拍同步与特效加工,展示了生成后流程自动化。

  8. @sonia_code — 377 个赞・33 次转发・约 19,000 次浏览・2026-09-22
    https://x.com/sonia_code/status/2102367557303021766

    这个是不是很有感觉?我让 Astra 做了黄昏的湿地 […] 因为在浏览器里运行,可以用鼠标向任意方向观看。
    利用 Astra 生成可在浏览器中自由切换视角的 3D 风景场景。

  9. @yachimat_manga — 73 个赞・13 次转发・约 7,700 次浏览・2026-09-21
    https://x.com/yachimat_manga/status/2102181794057420889

    在 Astra 时代,努力为每个镜头指定背景参考也许已经是最优解?[…] 用蛮力复现现有动画流程的方向可能很强。
    现场创作者的思考:Astra 出现后,动画制作或许仍将朝着“用强力手段复现流程”的方向发展。

  10. @mask_3dcg(2 帖,224 个赞 / 约 22,000 次浏览・2026-09-22,以及 1,589 个赞 / 约 246,000 次浏览・2026-09-23)
    https://x.com/mask_3dcg/status/2102234787184537669
    https://x.com/mask_3dcg/status/2102715480494752222

    这种独特角色的动画,AI 真的做不到,所以人类会一直是必需的。
    立即录用。AI 时代最需要的是动画师。CG 动画中,AI 无法做好既定模板以外的东西。
    对生成式 AI 赞美论的反向观点。第二帖浏览量超过 22 万,是本次 AI 相关帖子中第二高,说明“AI 无法替代非模板化动画”的观点得到相当多共鸣。

信号
  • 上升:集中出现了将 Claude Opus 5.5 并非用于“直接生成图像/视频”,而是作为操控既有工具的编排器使用的帖子;它操作 Higgsfield/After Effects/Blender/MiniMax H3 等现有工具(#4—#7)。将 AI 用于生成后的加工与收尾流程尤其显眼。
  • 上升:从少量照片创建 3D 漫游空间的案例(#3,GPT-6 Astra + Unreal Engine),显示生成 AI 与既有游戏引擎结合的方向。
  • 降价竞争:GPT-6 Sol/Luna 的发布被理解为“更快、更便宜”,而非“性能提升”(#2)。
  • 被否定 / 逆向观点:专业 3DCG 创作者明确否定 AI 可替代角色动画的帖子获得很高互动(#10,浏览量超过 22 万)。对“生成 AI 无所不能”说法的反弹获得一定支持。
  • 意外之处:这次 X 展示的 10 个趋势中,只有 3 个涉及图像/视频生成 AI;其余 7 个(加密货币、Taylor Swift 八卦、足球博彩推广、铀矿股、地区话题、NFT 铸造公告)完全无关。也就是说,在这一时刻、这一地区,图像与视频生成 AI 并非 X “正在发生什么”的主角,只是微弱地出现在通用技术趋势词下。
  • 本次收集的帖子中完全没有提到开放源代码模型或工具(如 Flux、Stable Diffusion 系列、HunyuanVideo、Wan、ComfyUI 等)。
局限
  • 搜索词不是由主题选择,而是直接使用在克罗地亚会话中 X Explore 显示的趋势词。10 个词中有 7 个(Cardano、$SONG、Taylor、England、#uranium、Croats、NFTs)与主题无关,其搜索结果已从报告中排除。
  • Explore 趋势仅代表“这个会话从克罗地亚看到的内容”,并非全球趋势。
  • @videoai_otaku 的帖子(#30,https://x.com/videoai_otaku/status/2102264981807153234)没有文字或图像,无法引用其内容(推测为只有视频的帖子)。
  • 没有搜索“Sora”“Veo”“Midjourney”“Runway”等具体闭源生成工具名,也没有搜索“Flux”“Wan”“HunyuanVideo”“ComfyUI”等开放源代码工具名,因此报告未体现它们在 X 上的提及。
  • 因上述原因,从 X 可获得的开放源代码动向几乎为零(收集数据没有直接提及开放源代码模型或工具)。开放阵营的 10 条洞察需要由其他平台阶段补足。

YouTube

YouTube — 图像与视频生成AI新闻

频道

本阶段无法直接从页面取得单个视频的频道名与订阅数(详见下方局限),因此将可从搜索结果标题、说明文字中确认的发布者,与普遍知名且持续覆盖此领域的频道分开列出。

  • OpenAI(官方频道)— 发布 ChatGPT Images 2.5 的上线视频“Introducing ChatGPT Images 2.5”。作为企业官方频道,是本次最重要的一手信息来源。
  • Muapi(教程类频道)— 发布“GPT Image 2.5 API (ChatGPT Images 2.5) — What's New + How to Access It”,向 API 使用者讲解新模型(Flare / Sunburst)的使用方法。
  • 搜索结果还包括“Kling 3.0 and Omni FULL guide”“Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0”“China Did It AGAIN? – 100+ Wan 3.0 AI Videos”“LTX-2.3 Review”“New Qwen Image 2512”等大量评测/比较视频,但由于无法获取页面,无法逐一确认频道名。
  • 作为一般补充信息,web 搜索确认 Curious Refuge(专注 AI 视频制作与工作流教育)、Matt Wolfe(每周 AI 新闻汇总)、The AIGRID(生成式 AI 快讯)持续覆盖该领域;但无法确认它们是否正是本次命中的单个视频发布者。
视频
  1. Introducing ChatGPT Images 2.5 — OpenAI(官方)— 约 2026-09-08 — 播放量未知
    https://www.youtube.com/watch?v=6l7ble9P74o
    ChatGPT Images 2.5(新模型名 GPT-Image-2.5 Flare / Sunburst)的官方上线视频。介绍生成速度最高缩短 50%、更好的编辑一致性、基于评论的编辑功能等。

  2. GPT Image 2.5 API (ChatGPT Images 2.5) — What's New + How to Access It — Muapi — 2026 年 9 月上旬 — 播放量未知
    https://www.youtube.com/watch?v=nk2u6ENW85Q
    为 API 用户讲解 Flare/Sunburst 模型差异及使用方式的教程。说明 Sunburst 是增加预计算(规划)能力的高级版本。

  3. Nano Banana Pro: Hands-on with the World's Most Powerful Image Model — 2025-11-25 — 播放量未知
    https://www.youtube.com/watch?v=hk6gwiZmSWA
    针对基于 Google DeepMind Gemini 3 Pro 的 Nano Banana Pro 的上手体验,演示其在文字渲染与信息图生成方面的精度提升。虽然发布已接近 10 个月,相关后续视频仍在持续出现,是一个长生命周期话题。

  4. Kling 3.0 and Omni FULL guide 2026 — 2026-04-04 — 播放量未知
    https://www.youtube.com/watch?v=tEdHJohIUlM
    快手 Kling 3.0/Kling 3.0 Omni 的完整指南,介绍“AI Director”功能如何在一次生成中制作最多 6 个镜头组成的连续序列。

  5. Seedance 2.5 vs Minimax H3 vs Google Omni vs Kling 3.0 | Full Comparison — 2026-08-14 — 播放量未知
    https://www.youtube.com/watch?v=G5D053drKB8
    对四款顶级闭源模型(ByteDance Seedance 2.5、MiniMax H3、Google Omni、Kling 3.0)进行横向比较,展示截至 2026 年 8 月闭源视频生成 AI 的竞争格局。

  6. FREE Wan 3.0: what actually shipped (there are no weights) and How to use it for FREE
    https://www.youtube.com/watch?v=gbI8XV4Szrk
    指出阿里巴巴 Wan 3.0 作为“未公开权重、仅限 API 的测试版”推出。Wan 2.2 之前均为开放权重,而 Wan 3.0 转向封闭路线;一般 web 搜索中也发现了多项类似说法。

  7. China Did It AGAIN? – 100+ Wan 3.0 AI Videos — 2026-08-10 — 播放量未知
    https://www.youtube.com/watch?v=fNvv2u-1cGw
    汇集在 Wan 3.0 公测版(2026 年 8 月 6 日开始)中制作的 100 多条生成视频。突出其最长 30 秒的一镜到底生成能力(Wan 2.7 为 15 秒,翻倍)。

  8. LTX-2.3 Review: The Open-Source AI Video Model Built for Creators — 2026-08-11 — 播放量未知
    https://www.youtube.com/watch?v=qQXzlk134Sw
    Lightricks 的 LTX-2.3 评测。评价其是开源视频生成模型中唯一能够通过单一推理路径同时生成音频与视频的模型(支持 4K/50fps)。

  9. LTX 2 Full Tutorial | Run on Low VRAM PC + Video & Audio AI Generation (2026 Strongest Open-Source?) — 2026-01-11 — 播放量未知
    https://www.youtube.com/watch?v=ytxbq9ZSgxo
    在低 VRAM 环境本地运行 LTX-2 的教程,讲解通过 ComfyUI/SwarmUI 进行设置,并强调其在开放源代码视频生成模型中的易用性。

  10. New Qwen Image 2512: Better Than Z-Image? (Open Source & Free)
    https://www.youtube.com/watch?v=uAGH_yRZ2Gw
    对阿里巴巴通义团队的 Qwen-Image-2512(Apache 2.0 许可、200 亿参数)与 Z-Image Turbo 进行比较。多支评测视频同时出现,反映开放源代码图像生成的顶尖竞争。

  11. Can MiniMax H3 Beat Seedance 2.5? My ComfyUI Workflow
    https://www.youtube.com/watch?v=zwam3nJTNrI
    对 2026 年 8 月 3 日在 Hugging Face 发布的 MiniMax H3(330 亿参数、Community License)进行 ComfyUI 工作流测试。不过该许可明确排除在美国、欧盟、英国和韩国的使用;仅从本视频无法确认是否提及此事。

  12. FLUX 3 Might Be the Open Source Sora 2 We Deserve — 2026-07-24 — 播放量未知
    https://www.youtube.com/watch?v=1s3zslFOSh0
    介绍 Black Forest Labs 的 FLUX 3(支持视频、音频、图像和机器人技术的多模态模型)。标题称其为“开源”,但截至 2026 年 7 月,FLUX 3 本身只有封闭的早期访问版,开放权重版(FLUX 3 Dev)仅在路线图中承诺、尚未发布——许多介绍视频混淆了“计划成为开源”和“已经开源”,需要特别注意。

信号
  • 闭源阵营的降价与提速竞争:ChatGPT Images 2.5(生成速度 -50%)、Kling 3.0 的 AI Director(一次生成多个镜头以降低成本)等发布,都更强调“更快、更便宜”而不是性能提升。与 X(output/x.md)中观察到的 GPT-6 Sol/Luna 降价叙事一致,YouTube 的评测视频群也体现出同一趋势。
  • “自称/被称为开源”与实际情况的错位:尽管阿里巴巴此前的 Wan 系列(至 Wan 2.2)是开放权重,Wan 3.0 转为仅 API、权重不公开,多支解说视频指出“这实际上是闭源”。反过来,FLUX 3 虽被视频标题冠以“Open Source”,实际只有封闭早期访问版;两者都反映了品牌说法与实际状态的脱节。
  • 即使开放权重,也可能限制“可使用地区”的新模式:MiniMax H3 是少见的在 Hugging Face 公开权重的大型视频生成模型,但其 Community License 明确排除美国、欧盟、英国、韩国的本地运行。“开放权重=人人可自由使用”的前提正在被打破。
  • 比较与横向评测成为该类别的主流格式:类似“Seedance 2.5 vs MiniMax H3 vs Wan 3.0”的多模型比较视频极多;比起单模型深挖,“哪个最强”的验证是 YouTube 上此类别的核心形式。
  • 中国模型的存在感:Kling(快手)、Seedance(字节跳动)、Wan(阿里巴巴)、MiniMax H3、Qwen-Image(阿里巴巴通义)等大量中国模型处于图像与视频生成 AI 讨论的中心,与美国模型(GPT Image、Nano Banana Pro、FLUX)共同构成双极格局。
局限
  • 本阶段使用的 WebFetch 工具,在 YouTube 搜索结果页(/results?search_query=…)与视频页(/watch?v=…)均没有获取真实数据,只取得页脚导航链接(版权信息等)。尝试视频页的/@channel/about时,确认出现 302 重定向至consent.youtube.com(gl=HR=克罗地亚地区 Cookie 同意页);该会话的地区与 Cookie 同意状态似乎阻碍了不执行 JS 的 HTML 抓取。此现象也与 X(output/x.md)的 Explore 趋势同属克罗地亚地区相一致。
  • 因此,本次没有直接确认任何视频的播放量、频道订阅数或具体评论。视频标题、发布时间及内容均由 WebSearch 摘要和外部媒体文章佐证,未能满足 playbook 所要求的“带订阅数的 Channels 部分”及“每支视频播放量”。
  • 很多个别视频的发布频道名也无法确认,因为搜索结果标题通常不包含频道名。
  • 完全无法确认评论区内容(未能满足 playbook 的“阅读高赞评论”要求)。
  • 搜索主要使用英文关键词(Kling 3.0 / Nano Banana Pro / Wan 3.0 / LTX-2 / Qwen-Image / Flux 3 / Seedance 2.5 / MiniMax H3 / GPT Image 2.5)。未搜索日语频道,因此报告不包括日语用户在 YouTube 上对 AI 工具的反应。
  • 关于完成标准(“分析约 20 条帖子”),YouTube 是以视频而不是 X/Reddit 那样的“帖子”为单位的平台,因此在 12 支视频处停止;继续扩大搜索也不太可能突破 WebFetch 无法取得定量数据的技术限制。

Bluesky

Bluesky — 图像与视频生成 AI 新闻

账号
  • oludai.bsky.social(“🚀 olud.ai”)— 一个机器人账号(1,543 条帖子、948 名关注者),每小时发布 AI 追踪更新:新模型上线、价格变化、GitHub star 变化,以及最相关的、比较图像/视频生成模型盲测人类偏好的“媒体排行榜”。
  • ai.bots.law — 法律文件机器人;每当 AI 版权诉讼出现案卷活动时便会发布新条目,包括 Disney v. Midjourney 与 Andersen v. Stability AI。
  • midjourneyofficial.bsky.social — Midjourney 官方账号。更新频率低、内容轻松(“周末过得怎么样?”),并非产品新闻来源。
  • 每日发布带 #AIイラスト #StableDiffusion 等标签的 Stable Diffusion/SDXL 作品的日本 AI 插画创作者:kazanomiya.bsky.social、michi84.bsky.social、garakuta76.bsky.social、blackmagnet3400.bsky.social。
  • Midjourney 爱好者艺术社区:johndoesmidjourney.bsky.social、dalyrceri.bsky.social、ttaships.airminded.org、un1v3rse.bsky.social、nevyn79.bsky.social、stumblegirl.bsky.social——每日发布作品而非新闻,但显示平台日常 AI 艺术使用偏向成熟工具。
  • index.photoshoproadmap.com.ap.brid.gy — 经由 Bridgy Fed 桥接的联邦宇宙账号,讨论实用的 Photoshop/Nano Banana 工作流问题。
帖子
  1. oludai.bsky.social,2026-09-23(1 个赞)— “🎨 开源在图像生成中的位置:#14 Qwen-Image-3.0-Pro——你实际能下载的最佳模型。落后 GPT Image 2.5 Sunburst (max)(OpenAI)108 ELO 分。盲测人类偏好,不是营销。” → 帖子
  2. oludai.bsky.social,2026-09-22(2 个赞)— “🏆 一个开放权重模型领跑视频生成。Wan 3.0 位居人类偏好排行榜首位,领先所有闭源模型。你可以下载它并自行运行。” → 帖子
  3. oludai.bsky.social,2026-09-22(0 个赞)— “🎨 开源在图像编辑中的位置:#16 Qwen-Image-3.0-Pro——你实际能下载的最佳模型。落后 GPT Image 2.5 Sunburst (max)(OpenAI)101 ELO 分。” → 帖子
  4. oludai.bsky.social,2026-09-21(1 个赞)— “🚀 ComfyUI v0.37.0 已发布 … ⭐ 134,258 stars。全部开源 AI 发布 →olud.ai/releases.html” → 帖子
  5. ai.bots.law,2026-09-23(0 个赞)— “新文件:Disney v. Midjourney(原告起诉 Midjourney 训练及生成受版权保护角色)。文件 #206:(法官办公室)关于书面判决动议听证会的命令。” → 帖子
  6. ai.bots.law,2026-09-23(0 个赞)— “新文件:Andersen v. Stability AI(艺术家就 AI 图像训练提起诉讼)。文件 #759:其他救济。” → 帖子
  7. index.photoshoproadmap.com.ap.brid.gy,2026-09-24(0 个赞)— “在大画布上使用 Nano Banana 的 Generative Fill 经常产生拉伸或压扁的结果,并出现明显的选区边缘。问题在于分辨率不匹配:模型生成到一个小区域,但被放大以适配更大的文档。” → 帖子
  8. kazanomiya.bsky.social,2026-09-23(40 个赞、5 次转发)— “早上好”#AIイラスト #AIart #StableDiffusion #SDXL — 在一般 AI 艺术 feed 中找到的互动最高帖子,体现日本社区日常使用 SD/SDXL 的情形。→ 帖子
  9. midjourneyofficial.bsky.social,2025-08-15(41 个赞、4 次转发)— “#Midjourney 现已登陆 BlueSky!这里最值得关注的创作者有哪些?”——该账号的首发帖,仍是互动最高的一条。→ 帖子
信号
  • 闭源在图像工作的两个方向上仍以原始质量获胜。 olud.ai 的盲测偏好排行榜中,“GPT Image 2.5 Sunburst”(OpenAI)在图像生成和图像编辑两个类别都排名第一;最佳可下载开放模型 Qwen-Image-3.0-Pro 在两类中都落后超过 100 ELO(生成第 #14,编辑第 #16)。
  • 视频生成呈现相反格局。 同一追踪器报告称,开放权重模型 Wan 3.0 在人类偏好视频排行榜中领先所有闭源竞争对手——这是目前报告中开放阵营位列 #1 而非追赶的唯一类别。
  • 对闭源/半开放既有厂商的法律压力本周持续推进。 9 月 23 日,Disney v. Midjourney(训练与生成受版权保护角色)和 Andersen v. Stability AI(艺术家起诉图像训练数据)两案同日出现新案卷活动;训练数据的版权责任依然是推出托管/商业产品的供应商面临的核心问题。
  • 即使模型质量落后,开源工具层仍快速演进。 用于本地运行开放扩散/视频模型的主流节点式 UI ComfyUI 本周发布 v0.37.0,GitHub star 已超 13.4 万;无论榜单位置如何,基础设施势头都很强。
  • 自然形成的日常 Bluesky AI 艺术社区偏向成熟消费级工具,而非前沿新发布。 找到的活跃发布者(多为日本“AIイラスト”创作者与 Midjourney 爱好者)使用 Stable Diffusion/SDXL 与 Midjourney 进行日常创作;没有发现自然讨论特别提及 Sora、Veo、Kling、Runway 或 Grok Imagine。
  • Nano Banana(Google 图像模型)已进入“生产环境排障”阶段,不再只是新奇演示——Photoshop 工作流帖子讨论的是一个具体的 Generative Fill 故障模式(分辨率不匹配导致输出拉伸),这更像主流集成,而不是早期炒作。
局限
  • playbook 记录的公开搜索端点 app.bsky.feed.searchPosts 对所有尝试的查询(单关键词、多词短语,含或不含sort=latest)均返回 HTTP 403 Forbidden;该抓取客户端完全无法执行 Bluesky 帖子索引的字面关键词搜索。同一主机的其他公开 API 操作(getProfile、getPostThread、getAuthorFeed、getFeed)正常,因此封锁似乎只针对搜索操作。
  • 通过 web 搜索发现候选账号/feed,再经getAuthorFeed/getPostThread/getFeed获取真实内容与互动数据来绕过限制。这是范围更窄、受发现偏差影响的样本,并非穷尽式搜索;此处“20 条主题帖子”是可达样本中的 20 条,而不是全平台结果。
  • 在可达样本中,没有发现 Bluesky 原生讨论特别点名 Sora、Sora 2、Veo、Kling、Runway Gen-4、Grok Imagine 或 Seedream。考虑到搜索 API 被阻止,这更可能是抽样缺口,而非真正的平台沉默;应将其缺失视为未确认,而不是一个结论。
  • bsky.app 本身是客户端渲染的单页应用,直接抓取网页不会返回帖子内容;因此本阶段全部“阅读”都通过 JSON API 而非渲染页面完成。

Lemmy

Lemmy — 图像与视频生成AI动态

Lemmy 是规模较小的联邦宇宙社交网络,但以 !«メールアドレス» 为中心,本地 AI 用户讨论得很认真;来自 lemmy.durstig.online 的 ai_reddit 社区(Reddit r/ArtificialIntelligence 的镜像/桥接)也会带来闭源相关新闻。通过 API 搜索(https://lemmy.world/api/v3/search)横向检索了“Stable Diffusion”“Midjourney”“Sora”“Flux”“ComfyUI”“Kling AI”“Nano Banana”“Black Forest Labs”“Wan 2.2”“Grok Imagine”等关键词。

社区
  • !«メールアドレス» — 5,710 名订阅者。汇集 ComfyUI 与开放权重模型新闻/工具帖的主枢纽。
  • !«メールアドレス» — 发布 AI 生成艺术作品的地方(新闻性较低)。
  • !«メールアドレス» — 专门发布动漫类 AI 生成艺术作品。
  • !«メールアドレス» — 专门发布抽象 AI 生成艺术作品。
  • !«メールアドレス» — 52 名订阅者(本地 1 名用户)、25.8K 帖子、月活 155 用户。该社区桥接 r/ArtificialIntelligence,含大量 Nano Banana、Seedream、Sora/Kling 新闻帖子。
  • !techtakes(dbzer0 系)— 更偏向批评 AI 行业的社区,出现 Midjourney 相关话题。
  • !technology — 通用科技社区,命中了较大的 Midjourney 新闻。
  • !tech — 命中 Black Forest Labs 相关新闻。
帖子
  1. Qwen-Image-2.1 in ComfyUI: Open-Weight Image Generation and Editing, Now with Transparency(开源)
    !«メールアドレス» / 13 个赞 / 2026-09-22
    https://lemmy.dbzer0.com/post/75874773

  2. chanon/comfyui-obvpm-timeline: ComfyUI timeline and clip extension nodes for Minimax H3(开源、视频编辑工作流)
    !«メールアドレス» / 6 个赞 / 2026-09-22
    https://lemmy.dbzer0.com/post/75874770

  3. SparknightLLC/ComfyUI-NodeSnapshots(ComfyUI 前端加速、FPS 提升 2—3 倍)
    !«メールアドレス» / 3 个赞 / 2026-09-22
    https://lemmy.dbzer0.com/post/75874771

  4. SupraLabs/Supra2-IMG — 1 亿参数的超轻量 text-to-image 模型(开源)
    !«メールアドレス» / 7 个赞 / 约 2026-09-23

  5. The AI Horde has a new Interface, a new Image generation frontend, new backend, and all new documentation!(开源分布式图像生成项目 AI Horde 更新)
    !«メールアドレス» / 12 个赞(3 个踩)/ 约 2026-09-20

  6. OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion. that's the whole story of ai video right now(闭源与中国竞争者的对照)
    !«メールアドレス» / 1 个赞 / 2026-09-20
    https://lemmy.durstig.online/post/61333
    → OpenAI 将于 9/24 关闭 Sora API,而 Kling 获得 30 亿美元融资。分析认为,面向消费者的 AI 视频难以盈利,企业用途(培训、商品演示视频)才是主战场。

  7. Same Berserk spread, 4 AI colorizations. Looks like GPT wins again?(Nano Banana Pro 性能比较)
    !«メールアドレス» / 1 个赞 / 2026-09-14
    https://lemmy.durstig.online/post/60037

  8. Black Forest Labs launches FLUX 3 capable of generating images and 20-second video with audio — but in limited release to start(偏闭源的限量发布)
    !tech / 3 个赞(2 个踩)/ 2026-07-24
    https://bfl.ai/blog/flux-3

  9. Midjourney wants Hollywood studios to reveal the details of their AI usage(闭源、涉及版权争端)
    !technology / 75 个赞 / 2026-07-05
    https://techcrunch.com/2026/07/04/

  10. Elon Musk maakt complete AI-film met zijn versie van The Odyssey(宣布用 Grok Imagine 制作完整《奥德赛》AI 电影,闭源)
    !films / 1 个赞 / 2026-07-22
    https://lemy.nl/post/4342454

  11. Seedream 5.0 Pro is here: an honest comparison and technical breakdown(与 Nano Banana Pro 的比较基准)
    !«メールアドレス» / 1 个赞 / 2026-07-10
    https://lemmy.durstig.online/post/46063

  12. black-forest-labs/FLUX.2-klein-9b-kv-fp8(开放权重发布)
    !stable_diffusion / 8 个赞 / 2026-03-14
    https://huggingface.co/black-forest-labs/FLUX.2-klein-9b-kv-fp8

  13. Midjourney AI pivots to Theranos: Ultrasonic CT(批评 Midjourney 进军超声波扫描仪业务)
    !techtakes / 41 个赞 / 2026-06-19
    https://pivot-to-ai.com/2026/06/19/

  14. Google quietly discontinues its Earth AI feature a day after its rollout(Nano Banana 整合功能遭滥用后迅速撤回)
    !«メールアドレス» / 1 个赞 / 2026-08-07
    https://lemmy.durstig.online/post/52162

信号
  • 开放源代码阵营的主战场在 ComfyUI 周边工具/节点开发:比起新模型发布,更多帖子围绕用于运行现有模型(Qwen-Image、Minimax H3、FLUX 等)的工作流与加速工具。它们不算显眼,但持续在推进。
  • 闭源阵营总是伴随“资金消息”与“争议”:Sora API 停止服务与 Kling 30 亿美元融资的对照、对 Midjourney 超声波扫描仪业务“Theranos 化”的批评等,技术本身之外,商业、资本和伦理新闻很突出。
  • Nano Banana(Google)已成为闭源图像生成的标准对比对象:其经常被拿来与 Seedream 5.0 或 GPT 上色效果比较;同时,Google Earth 的滥用争议也报道了其负面影响。
  • Black Forest Labs(FLUX)采取开放/封闭之间的策略:一方面发布 FLUX.2-klein-9b 这样的开放权重小模型,另一方面将 FLUX 3(图像+20 秒带音频视频)以“limited release”这种更偏封闭的方式推出。
  • Lemmy 自有视角几乎为零:找到的新闻性帖子多为链接到 Reddit、TechCrunch、HuggingFace、bfl.ai 等外部来源,Lemmy 用户自身的一手信息或分析极少。纯创作作品很多,但不属于“新闻”。
局限
  • Lemmy 的规模极小(即使是ai_reddit社区也仅 52 名订阅者、本地 1 名用户)。与视频生成 AI 有关的搜索(单独搜索“video generation AI”“Runway AI”“Kling AI”“Wan 2.2”)没有任何结果。
  • 相对于分析 20 条帖子的完成标准,实际找到的“具备新闻性”的帖子约 14 条。其余要么是 ComfyUI 整合工具之类的外围内容,要么是 AI 生成艺术作品(stable_diffusion_art、stable_diffusion_abstract、share_anime_art),不能算作行业新闻,因此排除。与其强行将内容稀释到 20 条,不如只报告真实存在的帖子。
  • 明确尝试了lemmy.ml和lemm.ee搜索,但与lemmy.world API 搜索获得的联邦结果重叠严重,未发现额外的一手信息。
  • WebFetch 获取的内容经由 AI 摘要,分数和日期由相对表述(如“1 day ago”)转换为绝对日期时可能存在轻微误差。

Pinterest

Pinterest — 图像与视频生成AI新闻

针对“Image and Video Generation AI News”查询收集了 50 个 pin(未分类的单一集合)。其中 30 张图片被直接打开并阅读,其余标题来自pinterest.pins.md。

视觉主题
  • YouTube 缩略图式“AI NEWS”格式:一位留胡子的白人男子带着震惊/瞪大眼睛的表情,旁边是一排发光的 3D 科技品牌标志(OpenAI、Google、Microsoft、Meta、类似 Anthropic 的爆发图标、Notion)。该模板以不同标志组合重复出现 [1, 27, 48]——显然是某个新闻汇总频道的固定缩略图风格,而不是自然用户内容。
  • 半人半机器人的脸:面部一半是人、一半是镀铬/电路机器人,用作泛化的“AI 已到来”图像 [32, 41, 47]。还有完整的镀铬安卓机器人肖像,带发光蓝眼 [12]。
  • 霓虹赛博朋克 UI 模拟图:深海军蓝背景,粉/紫/蓝发光圆角框,中央“AI”对话气泡图标分支到“Generate Image / Music / Video / Text / Link”图标。相同的带 Adobe Stock watermark 图像在不同 pin ID 下出现两次 [5, 16]——是被重复转 pin 的图库素材,而非新内容。
  • 深度伪造/虚假信息焦虑:镀铬机器人拿着手机,旁边的猫照片被盖上“FAKE”以及点赞/浏览计数 [3];NBC News 品牌的“AI GENERATED”雪地记者片段 [33];“Human Journalism vs Machine-Generated Media”分屏演播桌图 [22];以及谈话视频静帧上简单的“AI GENERATED NEWS CLIP”字幕 [50]。四条独立 pin 都在传达“你看到的东西可以相信吗”的焦虑。
  • 工具比较/决策图表:密集的信息图表并列展示闭源工具——付费/最佳质量一侧包括 ChatGPT Plus、Gemini Advanced、Midjourney、Adobe Firefly、Recraft、Runway Gen-3、Luma AI、Pika Pro、Kaiber AI、Synthesia;免费一侧包括 Ideogram、Gemini Free、SeaArt AI、Playground AI、Krea AI、Canva AI、CapCut AI [9]。另一张信息图回顾“Google I/O 2026”新闻日(Gemini 3.5 Flash、Gemini Omni、Android XR 智能眼镜)[30]。
  • 风格迁移/一致性演示:一组 Luma 品牌网格,将一段人物源视频转为木块、折纸、乐高积木和花朵覆盖等版本,并把汽车变为不同材质风格——展示跨帧图像到图像的风格一致性 [2]。
  • meme 格式:使用“144p vs 4K”反应脸 meme 调侃 AI 放大/生成质量跃升 [39]——这是样本中唯一明显以幽默而非推广为目的的 pin。
  • 黄/橙色“欢快 SaaS 广告”色盘:友好的卡通机器人吉祥物推销“AI Video Generation — turn your ideas into stunning videos in minutes”,搭配功能图标行(脚本转视频、AI 配音、字幕、编辑器)[8]——与阴郁霓虹/赛博朋克 pin 不同,面向小企业/创作者营销。
值得注意的 pins
  1. [1] “AI News: Anthropic Leak Shows Us The Future of AI...” — 在该集合中出现三次的震惊反应者缩略图模板;这是 AI 新闻汇总频道积极使用 Pinterest 引流的强烈信号。
  2. [2] Luma 品牌风格迁移网格 — 当前图像/视频到图像一致性能力最具体的演示:将同一视频中的人物转为木块、折纸、乐高、花卉风格,同时保持同一主体与姿势。
  3. [9] “Best AI Video Generators in 2026: Veo, Kling...” 决策图表 — 整个集合中列出闭源工具品牌最密集的一条(16+ 品牌),可用作被视为当前主流工具的清单。
  4. [13] “Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API” — 指出一项具体的新能力(图生视频中的原生音频),而不是泛泛宣传。
  5. [25] “Google's Gemini Omni Turns Anything Into Video” — Osiz Technologies 品牌帖子,专门聚焦 Gemini Omni 多模态推进;Google I/O 回顾 [30] 也独立呼应了这一点。
  6. [33] NBC News “AI GENERATED”记者片段 — 一个真实广播机构将屏幕披露标签作为 pin 的核心钩子,说明信任/标注争议已经进入主流新闻品牌。
  7. [37] “Introducing Luma Dream Machine - Next Generation AI Video” — 以极端微距眼睛特写作为发布视觉,代表一款仍被频繁提及的视频模型。
  8. [39] “144p vs 4K” meme — 唯一公开以幽默为主的 pin,调侃生成/放大带来的质量飞跃,而不是推销工具。
  9. [40] “‘Amuse 3.0’, an AI art creation tool...”(AMD 品牌)— 实际上是该集合中唯一带有开放/本地工具意味的 pin(面向 AMD GPU 的艺术应用);其他内容几乎全部偏向闭源云 SaaS。
  10. [49] “7 Best AI Baby Generators: Predict Your Child's Face (2026)” — 一种新奇的面部生成用例(年龄/关系变形),不同于新闻/视频工具群,暗示另一个面向消费者娱乐的子趋势。
信号
  • 闭源、知名品牌工具主导视觉语言。 几乎每条有标题的 pin 都点名商业产品(ChatGPT、Gemini/Gemini Omni、Veo 3、Kling、Midjourney、Adobe Firefly、Runway、Luma、Pika、Synthesia、Recraft、Ideogram、Krea、Canva)。50 个标题和已打开的 30 张图片中,仅有 1 条 [40](Amuse 3.0/AMD)暗示开放或本地运行;没有任何标题或图片出现 Stable Diffusion、ComfyUI、Flux、Wan 或 HunyuanVideo。在 Pinterest,“AI 图像/视频生成”目前被理解为闭源 SaaS 消费品类,而非开发者/开源类别。
  • 信任与真实性焦虑是持续出现的子主题,而不是偶发内容:四条独立 pin [3, 22, 33, 50] 的完整视觉都围绕“这是现实还是 AI”,其中一条真实广播机构 NBC 将其作为播出披露图形。这也与 AI 新闻主播 pin [47] 体现的新闻编辑部自动化议题相呼应。
  • 两种不同视觉风格在同一查询中竞争:冷峻的赛博朋克/霓虹“AI 已到来”图像(安卓机器人、发光 UI 模拟图),以及温暖的卡通吉祥物 SaaS 广告图像(友好机器人、黄色背景)。两者都在销售工具,但明显面对不同受众(技术爱好者/科技受众与小企业/创作者)。
  • 新闻汇总频道缩略图已经成为 Pinterest 原生类型——同一种“震惊表情+标志网格”模板 [1, 27, 48] 反复以相同风格出现,说明一部分 Pinterest 的“AI 新闻”内容是 YouTube 缩略图的下游转发,而不是 Pinterest 原生内容。
  • 缺失内容:样本中没有出现价格反弹、有关训练数据的诉讼/法律斗争、或艺术家社区抗议的 pin——尽管这些是本任务中其他平台的常见主题。最接近的是 ByteDance/Hollywood 版权协议新闻 pin [7],它把 IP 保护描述为已解决的合作,而不是争议。
局限
  • pin 表格没有按类型拆分(只有一个包含 50 条的平面列表),因此报告没有按 playbook 中的类型分支组织。
  • 收集的 50 张图片中,有 30 张被直接打开并描述;其余 20 张只能读取pinterest.pins.md中的 pin 标题,无法读取图片内容,因此其中的视觉模式可能被低估。
  • 一些 pin 是重复或近似重复的图库资产,使用不同 pin ID(例如 [5] 与 [16] 是相同的 Adobe Stock 图形),略微夸大了“霓虹 AI 图标分支”母题的出现频率。
  • pin 元数据没有互动数字(点赞/收藏/评论),无法评估受欢迎度或传播度;只能分析内容与置顶材料的时效性。
  • 这部分仅涉及 Pinterest;Reddit、X、YouTube、Bluesky 和 Lemmy 分别在各自阶段输出中覆盖。

建议行动

  • 在将 Wan 3.0 称为开放模型前,应直接通过阿里巴巴/Hugging Face 核实其真实的权重发布状态,因为 Bluesky 与 YouTube 来源存在分歧。
  • 在将模型称为“开源”前,应检查许可条款,而不只是营销说法(例如 FLUX 3、MiniMax H3 带地区限制的 Community License)。
  • 在商业使用 MiniMax H3 前,确认部署地区没有被其 Community License 排除(美国/欧盟/英国/韩国)。
  • 鉴于 Sora API 停止服务与 Kling 获得 30 亿美元融资所体现的趋势,应优先考虑企业/商业用途,而非面向消费者的免费层 AI 视频方案。
  • 持续跟踪 Disney v. Midjourney 与 Andersen v. Stability AI 的案卷,因为裁决可能重塑行业的训练数据实践。
  • 鉴于 Reddit 与 Pinterest 中多次出现未披露 AI 内容被发现后遭反弹的模式,应为生成内容添加明确的 AI 披露标签。

收集图片

AI News: Anthropic Leak Shows Us The Future of AI...Google announces ultra-high quality video...AI content and social media concernsJust Nail It 🎥Ai Content Creation Concept With Icons For Text Image Music And Video Generation Artificial Intelligence Images – Browse 66 Stock Photos, Vectors, and VideoAI Generated Videos for Content MarketingimageAI For Image And video GenerationBest AI Video Generators in 2026: Veo, Kling,...Free AI-Powered Visual Content Generation Platform – Viva AIAI Tool To Turn Text Into ImagesimageVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI Image GenerationAI Content Studio & Automation Secrets 🚀📱imageKling.ai AI-Powered Text-to-Video GenerationimageimageimageimageNew York's Bold Gambit: Inside the Legislative...AIimageGoogle’s Gemini Omni Turns Anything Into Video‎🚨 AI is getting scary good.AI News: OpenAI Finally Released What We Asked ForProfessional AI Video Creation | Cinematic AI Videos | Custom Video EditingimageTop AI Video Generators of 2025imageAI Image Generation and the Entertainment IndustryAI news videos blur line between real and fake reportsThe Secret Weapon for Content Creators: AI-Powered Video GenerationimageimageIntroducing Luma Dream Machine - Next Generation AI VideoGenerative AI Explained: A Complete Beginner’s Guide (2026)Oh My God (OMG) Meme | 144p vs 4K Prompt | AI Image Generation Prompt | Insane Quality Difference'Amuse 3.0', an AI art creation tool that includes...AI News & Latest Updates | Artificial Intelligence Trends & BreakthroughsAIMastering Video and AI: Key Social Media Marketing Trends 2025AI-Generated Videos: Good or Bad? Here's the Truth! 🤖🎥"Why AI Chatbots Fail at Keeping Up with Breaking News"4 Major AI Updates You Need to Know in 2026AI News Anchors & Creator-Led Coverage Take Over U.S. Media!The Snarky AI News RoundUp #87 Best AI Baby Generators: Predict Your Child's Face (2026)AI Anchor by Channel1

数据质量说明

Reddit(12/20 个帖子)和 Lemmy(约 14/20 个帖子)未达到每平台目标,且偏向普通用户反应而非产品新闻;X 的地区锁定趋势几乎没有提供开源信号;由于抓取/Cookie 同意页限制,YouTube 和 Pinterest 无法获取任何互动指标(播放量、订阅数、点赞);Bluesky 的搜索 API 被 403 阻止,因而依赖账号发现而非全平台搜索。

图库