KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-09-16

讨厌审查的用户正流向 MiniMax H3、Wan、LTX-2 等中国开源权重视频模型;与此同时,Google、OpenAI、ByteDance 等闭源阵营仍通过 Replicate 以每月 1~2 款新模型的节奏持续发布。Sora 的 API 缩减(2026-09-24)及版权诉讼也正在成为其脚下不断累积的风险。

图像与视频生成 AI 新闻综述 — 2026-09-16

闭源阵营仍由 Google、OpenAI、ByteDance、Kuaishou 等以每月 1~2 款新模型的频率持续推进,Nano Banana Pro、Veo 3.1、Seedance 2.0、Kling 3.0 是近期主角。另一方面,MiniMax H3、Wan、LTX-2、HunyuanVideo 等来自中国的本地视频模型,正承接那些厌倦云端平台审查与过滤的用户,ComfyUI 周边的教程生态也在持续运转。不过,Sora 实质性缩减(独立应用已关闭,API 也计划于 2026-09-24 停止)以及 Disney v. Midjourney 一类诉讼,也明显给闭源阵营的势头投下阴影。本次 X(Twitter)因以与主题无关的热门词收集内容,实际获得 0 条有效结果;Reddit 和 Pinterest 也未达到“分析 20 条内容”的完成标准,收集覆盖度仍有问题。

跨平台观察

  • 对审查与限制的不满正在推动开源/本地生成。 Reddit(#1、#5、#9)中,用户因“被 Google Flow 或 Gemini 的过滤器拦截”而讨论转向 Minimax H3、Wan、LTX Video、Seedance 2.5;Lemmy(!stable_diffusion)中,MiniMax H3 周边工具的帖子在 2026-09-08 至 13 日期间几乎每天都有。YouTube 上的 ComfyUI 教程也持续涵盖这批模型。
  • 中国模型(ByteDance Seedance/Seedream、Alibaba Wan/Qwen、Tencent Hunyuan、Kuaishou Kling、MiniMax)正在开源和闭源两端都增强存在感。 YouTube、Bluesky(经 Replicate)和 Pinterest(Vidu/ShengShu)都反复呈现中美对比格局。
  • 关注点正从“生成”转向“编辑与一致性控制”。 Reddit(#7、#8)讨论了“角色一致性”以及修正“已经完成 90% 的图像剩余 10%”的价值;YouTube 也在介绍 Qwen Image Edit 等编辑型模型。
  • 闭源阵营的“暗线新闻”是诉讼与缩减。 Sora 实质关闭(Lemmy)、Disney v. Midjourney(Bluesky、Lemmy)、Midjourney 要求好莱坞披露 AI 使用情况的诉讼(Lemmy)等,法庭战与撤退新闻比新功能发布更突出。
  • “开源”标签存在混乱。 ByteDance 的 Seedream 系视频被宣传为“开源”,但实际主要是闭源 API,这一落差在 YouTube 和 Bluesky 都受到指出。

按平台

Reddit — 从 r/generativeAI、r/aivideomaking、r/aifilmmaking 等 7 个子版块收集了 11 个帖子。可确认本地生成用户流入、对免费/低价工具的强烈需求、“AI 垃圾内容”争论,以及 Gemini 与 OpenAI 图像生成对比等话题,并附有具体用户引文。不过,收集仅使用单一搜索词,未达到目标的约 20 条规模。

X — 收集的 40 条帖子和 37 个账号中,没有一条涉及图像或视频生成 AI。原因是搜索词并非来自主题,而是直接使用 X 的热门列表(#Uranium、Clarity Act 等);唯一接近的 4 条“Dario”相关内容也是 AI 安全与政策话题,偏离主题。实质上属于收集失败。

YouTube — 从 TheAIGRID、Matt Wolfe、Theoretically Media 等主要频道确认 12 条视频,梳理了闭源(Nano Banana Pro、Veo 3.1、Runway Gen-4.5、Seedance 2.0 vs Kling 3.0)与开源(HunyuanImage 3.0、FLUX.2、LTX-2、Wan2.2/2.7、MiniMax H3、Ideogram 4)两端的具体发布信息。不过,近 60 天内的全新模型发布较少,许多视频早于目标时间段。

Bluesky — 以 Replicate 官方、TestingCatalog、Simon Willison 的信息流为主确认了 14 条帖子。闭源阵营(Nano Banana Pro、Gemini 3 Pro、Veo 3.1、ChatGPT Images 2.5、Muse Video、Orbis)发布居多;开源侧仅有 FLUX.2 和 Wan 2.2 Animate,Stability AI 自 2025 年 11 月后保持沉默。搜索 API 频繁出现 403 错误,导致收集偏向已知账号的信息流。

Lemmy — !stable_diffusion 系社区实质上已成为“开源专用新闻流”;机器人 Even_Adder 几乎每天发布 MiniMax H3、LTX-2 相关的新模型/LoRA 帖子。闭源侧在 !technology 等泛科技社区每月只有 1~2 条,且多为 Sora 关闭、Midjourney 诉讼等“争议/撤退”新闻。开源侧确认超过 10 条,闭源侧仅 5~6 条,未达到目标。

Pinterest — 对以单一查询收集的 50 张图钉全部进行了确认。闭源阵营(Veo 2 宣传、工具排行信息图、AI 女演员 Tilly Norwood 相关内容)在视觉上占优;开源仅在工具清单中出现一条“Stable Video Diffusion”,几乎缺席。未做类别划分、模板复用内容很多,疑似存在为 SEO 而进行的内容注水。

除 X 外的 5 个平台都确认到帖子或作品;但 X 的收集本身依赖与主题无关的词汇,这一缺口在本次运行中无法补齐,特此明确说明。

后续关注点

建议行动

  • 重新收集 X 时,使用主题相关搜索词(例如 “Nano Banana”、“Seedance”、“Wan 2.2”、“Sora”),停止依赖热门列表。
  • 持续关注 Lemmy 的 !stable_diffusion 系信息流,将其作为开源视频模型的先行指标。
  • 追踪 Nano Banana 2 的正式发布与 Sora 2 API 停止(2026-09-24),作为闭源阵营近期转折点。
  • 监控 Disney v. Midjourney 等进行中的诉讼,将其视为可能影响闭源公司未来策略的因素。
  • 重新收集 Reddit 与 Pinterest 时使用多个主题查询,而非单一查询,以满足约 20 条内容的完成标准。
  • 对声称“开源”的模型,在引用前应通过 Hugging Face、官方博客等一手资料核实实际情况。

数据质量

X 的搜索词依赖与主题无关的热门列表,实际仅获得 0 条图像/视频生成 AI 相关帖子,是本次最大的缺失。Reddit 仅使用单一搜索词,停留在 11 个帖子;Pinterest 也仅用单一查询收集了未分类的 50 张图钉,两者都未达到“分析 20 条内容”的完成标准。Lemmy 中闭源相关直接提及仅 5~6 条,反映了平台规模限制。YouTube 与 Bluesky 相对充实,但 YouTube 在 60 天内的全新发布较少,很多视频早于目标周期;Bluesky 则因搜索 API 403 错误而依赖已知账号的信息流。

按平台汇总

Reddit

Reddit — 图像与视频生成 AI 新闻

来源
子版块 成员数 收集帖子数
r/generativeAI 153,596 3 条(#1、#7、#9)
r/AIToolTalks 6,131 2 条(#2、#8)
r/aivideomaking 7,038 2 条(#4、#5)
r/aifilmmaking 7,833 1 条(#3)
r/GeminiAI 373,910 1 条(#6)
r/AIDangers 53,008 1 条(#11)
r/politicalstress 14 1 条(#10)

图像与视频生成 AI 的实用话题集中在 r/generativeAI、r/aivideomaking、r/aifilmmaking 与 r/AIToolTalks;r/AIDangers 和 r/politicalstress 的两条内容则是围绕 AI 整体焦虑与监管的周边话题。

用户怎么说
  • 厌恶云端审查而转向本地生成的趋势 — 帖子 #1「Need a good video generation AI for image to video of people」(r/generativeAI、2pt、2026-09-15、https://www.reddit.com/r/generativeAI/comments/1wh1y9d/)。发帖人报告,Google Flow 的 Nano Banana Pro 生成图连续 60 次被过滤器拦截。u/f5alcon 称“Minimax H3 is the best local generator”,u/Liberation2020 推荐“Wan, mini max H3 and LTX Video”;拥有 RTX 5090 的用户支持搭配 ComfyUI 进行本地运行。

  • 对 Google Flow 免费额度的评价两极:大方,但物理模拟较弱 — 帖子 #3「Google Flow is giving creators a surprisingly generous amount of free AI video generation right now」(r/aifilmmaking、8pt、2026-09-14、https://www.reddit.com/r/aifilmmaking/comments/1wg7izt/)。u/Sea-Temporary-6995 表示“It's weak at physics and logic. Even Minimax is far better IME.”,而 u/Rollertoaster7 则认为“for a free tool it's pretty good”。

  • 对免费/低价工具的需求极高 — 帖子 #4(r/aivideomaking、0pt、9 条评论、2026-09-15、https://www.reddit.com/r/aivideomaking/comments/1wh80z3/)以及帖子 #5「Looking for free/credit-based AI tools for highly realistic image & video generation」(r/aivideomaking、5pt、31 条评论、2026-09-09、https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/)。u/Fluffybabyyoda 表示“google flow gives you 50 credits daily sometimes 2 times a day. Google gemini i think gives you 3 videos a day”。

  • 对无审查模型的需求被具体品牌化讨论 — 在帖子 #5 中,u/zeroludesigner 表示“You should try cyberbara. ... the Seedance 2.5 on it is uncensored and supports real face.”;u/senorfavela 甚至解释了通过 reRAW.ai 推荐计划获取免费积分的方法。

  • Gemini 与 OpenAI 的图像生成比较中,Gemini 处于下风 — 帖子 #6「Image generation Gemini vs OpenAI」(r/GeminiAI、9pt、2026-09-14、https://www.reddit.com/r/GeminiAI/comments/1wgjjco/)。u/damaged_terror 说“The gemini one looks like it gave up halfway through and just slapped some text on there.”

  • “AI 垃圾内容”批评的核心不是技术质量,而是缺乏故事 — 帖子 #7「Is there a way to make AI video that does not look like AI slop?」(r/generativeAI、0pt、24 条评论、2026-09-14、https://www.reddit.com/r/generativeAI/comments/1wgjjzu/)。发帖人报告称,改成“4 part thing with the same character + voice”后,观看时长约提升为原来的 9 倍。工具比较中,argil(主持人脸部一致性强)、kling(几段镜头后角色会崩)、runway(镜头运动最易操控)受到如此评价。u/RioNReedus 表示“AI Slop is now a term people who don't like AI use for anything AI - no matter how good it is. It means nothing anymore”。

  • 兴趣从“生成”转向“编辑” — 帖子 #8「AI image editing is becoming more interesting than image generation」(r/AIToolTalks、10pt、2026-09-14、https://www.reddit.com/r/AIToolTalks/comments/1wgbie5/)。u/SethWorks20 表示“being able to take an image that's already 90% right and fix the other 10% is probably way more useful day-to-day”。

  • 仅靠单一提示词与参考图也能制作爆款视频的时代 — 帖子 #9「HOW IS THIS MADE?!」(r/generativeAI、0pt、31 条评论、2026-09-10、https://www.reddit.com/r/generativeAI/comments/1wced4g/)。u/lagbit_original 表示“Use you preferable image model for creating the character Seedance 2.5 and a single prompt and the right references”。

  • 对 AI 整体的焦虑也蔓延至生成 AI 子版块 — 帖子 #2「Are all of you also anxious about recent news about AI?」(r/AIToolTalks、13pt、35 条评论、2026-09-13、https://www.reddit.com/r/AIToolTalks/comments/1wfhbnv/)。围绕水资源消耗和就业担忧,u/Big-Pops78 反驳称“A car takes 13-20,000 gallons. A pair of Jeans takes 3,000 gallons.”,意见分歧明显。

  • AGI 与人类灭绝风险的讨论已渗入普通用户群体 — 帖子 #10「AI news is really hard right now」(r/politicalstress、4pt、15 条评论、2026-09-12、https://www.reddit.com/r/politicalstress/comments/1wecrrc/)。u/Fil_77 引用“AI 2027”预测情景,呼吁紧急监管。

  • “AI 不会改善业绩”的怀疑论也在兴起 — 帖子 #11「Biggest AI news of 2026: AI is not a necessary tool...」(r/AIDangers、23pt、30 条评论、2026-09-14、https://www.reddit.com/r/AIDangers/comments/1wg5y17/)。u/presentofai 反驳称“most of these "AI made it worse" numbers are measuring clumsy rollouts, not the models.”

信号
  • 上升中:在对闭源云工具(Google Flow/Veo、Gemini)的审查与限制不满推动下,帖子 #1、#5、#9 持续表现出对 Minimax H3、Wan、LTX Video、Seedance 2.5、ComfyUI 等本地/开放工作流的支持。重视“编辑与一致性控制”而非单纯“生成”的声音(#7、#8)也形成明确趋势。
  • 被轻视/遭遇反弹:一次性、单提示词的 text-to-video 很容易被嘲为“垃圾内容”(#7);Gemini 单独的图像生成能力也在同一讨论中被明确认为不如 OpenAI(#6)。
  • 存在分歧之处(disagreement):对 Google Flow 免费额度的评价截然相反:一方认为“很大方”(#3 的 u/Rollertoaster7),另一方认为“在实际工作中没法用”(#3 的 u/Sea-Temporary-6995)。对于“AI 垃圾内容”这一说法本身,#7 内也存在“指出技术粗糙”派与“AI 反对者使用的无意义标签”派(u/RioNReedus、u/Myg0t_0)之间的对立。
  • 意外之处:尽管搜索目标是图像与视频生成 AI,收集到的 11 个帖子中有 2 条(#10、#11)却流向了 AGI 与人类灭绝风险这一完全不同的议题,表明寻找图像/视频生成新闻的用户行为,与针对 AI 整体的焦虑叙事彼此相连。
局限
  • 搜索词仅为“Image and Video Generation AI News”,从 7 个子版块仅收集到 11 个帖子,未达到简报要求的“每个社交网络约 20 条”,单一搜索词很可能造成遗漏(尚未使用额外搜索词进行抓取)。
  • 帖子 #4 与 #11 的正文没有记录在文件中,只能依据标题和评论判断。
  • r/politicalstress(成员仅 14 人)是过于小众的社区,且其内容不是图像/视频生成 AI 特有话题,而是一般性的 AI 焦虑,需注意这一点。

X

X — 图像与视频生成 AI 新闻

账号

在收集到的 40 条帖子、37 个账号中,没有任何账号发布图像或视频生成 AI 内容。以下仅列出收集数据中互动较高的账号,供参考。

账号 帖子数 总点赞数 内容
@tonypraysick 1 36,091 Ed Sheeran 的政治立场(音乐八卦)
@Omolomo_o 2 9,157 尼日利亚宗教与政治八卦
@TheSirRobotto 2 10,608 足球/英国权力下放讨论
@SenLummis 1 8,909 美国参议员,关于加密货币 Clarity Act
@realwangjyunhao 1 7,671 台湾恋爱类网红的纪念日帖子
@RippleXrpie 1 7,513 加密货币(XRP)社区,Clarity Act
@AshCrypto 1 2,508 加密货币网红,Clarity Act
@NFT_Chen / @wquguru / @bluetouff / @BPIV400 各 1~2 条 75~1,106 Dario Amodei(Anthropic CEO)对华立场/AI 政策讨论

没有账号大量连续发布内容,都是单条到少数几条帖子走红的类型。仅 @Omolomo_o 的两条帖子都获得数千点赞,但这是一个讨论宗教冲突的账号,与生成 AI 无关。

帖子

已检查收集到的全部 40 条内容,图像生成 AI 或视频生成 AI 相关帖子为 0 条。最接近的是以“Dario”搜索到的 4 条,它们提到了 Anthropic CEO Dario Amodei,但内容是 AI 安全政策与对华政策,和图像/视频生成模型的开源、闭源趋势无关。记录如下以供参考。

  1. @bluetouff(153 个点赞、35 次转发、19 条回复、约 7,300 次浏览、2026-09-14)
    https://x.com/bluetouff/status/2099399733127078156

    The interesting thing about Dario, Sam, and Elon's sudden love affair with the handbrake might not even be the extinction of humanity. It's that AI cybersecurity is turning into a U.S. industrial policy...
    → AI 安全与产业政策讨论,未涉及图像/视频生成。

  2. @BPIV400(1,106 个点赞、46 次转发、9 条回复、约 78,000 次浏览、2026-09-14)
    https://x.com/BPIV400/status/2099336990478958724

    Dario complaining that AI research is progressing dangerously fast
    → 对 AI 进展速度的担忧,不是生成 AI 模型本身的话题。

  3. @NFT_Chen(75 个点赞、21 次转发、55 条回复、约 85,000 次浏览、2026-09-14)
    https://x.com/NFT_Chen/status/2099348095612109306

    Anthropic CEO Dario Amodei openly admits to being a hawk on China, pushing to treat Chinese AI like Soviet nuclear missiles...
    → 中美 AI 霸权讨论,与图像/视频生成无关。

  4. @wquguru(176 个点赞、22 次转发、22 条回复、约 84,000 次浏览、2026-09-14)
    https://x.com/wquguru/status/2099340572519460928

    Dario Amodei's relationship with China in this lifetime is truly a tangled mess...
    → 同上,Dario Amodei 的经历话题。

其他 36 条内容(以 #Uranium、#sweepstakes、Clarity Act、LMEOW、#chance、Serbia、Ed Sheeran、England、Church 搜索)涉及铀矿股、抽奖活动、美国加密货币监管法案、迷因币、恋爱/追星、足球与英国权力下放、Ed Sheeran 巡演退出争议、尼日利亚宗教冲突等,与主题完全无关。

信号
  • 上升中/受到关注:无法根据收集数据判断。没有任何材料可显示图像或视频生成 AI 在 X 上的动态。
  • 被轻视:不适用(因为根本没有涉及主题的帖子)。
  • 意外之处:10 个搜索词(#Uranium、#sweepstakes、Clarity Act、LMEOW、#chance、Dario、Serbia、Ed Sheeran、England、Church)几乎都与“What's happening”中显示的 Explore 热门项目(来自克罗地亚会话)一致。也就是说,这次收集看起来并没有搜索简报主题词,而是直接把 X 的热门列表当作搜索词。“Dario”偶然被作为 AI 相关热门词捕捉到,但也不是图像/视频生成 AI,而是 AI 安全政策语境。
局限
  • 本次会话中搜索的 10 个词(#Uranium、#sweepstakes、Clarity Act、LMEOW、#chance、Dario、Serbia、Ed Sheeran、England、Church)都与研究简报主题“闭源/开源图像生成与视频生成 AI”没有直接关联。结果是收集到的 40 条帖子中,没有一条提及图像生成 AI 或视频生成 AI 的新闻与趋势。
  • 因为依赖 Explore 栏(克罗地亚会话可见的趋势)进行搜索,本次没有使用主题相关词(例如 “image generation AI”、“Nano Banana”、“Seedance”、“Sora”、“Midjourney”、“Stable Diffusion”、“open source video model” 等)。简报的完成标准“每个社交网络分析约 20 条帖子”,对于 X 上的图像/视频生成 AI 内容来说并未达成
  • 因此,本报告中的 Posts/Signals 并不是“关于主题的发现”,而是报告“关于主题的发现实质上为零”。要掌握 X 上闭源/开源图像与视频生成 AI 的趋势,需要使用符合主题的搜索词重新收集。

YouTube

YouTube — 图像与视频生成 AI(闭源/开源)最新新闻

频道
  • TheAIGRID(@TheAiGrid)— 以每周“AI News”形式汇总闭源和开源图像/视频模型的快讯频道。youtube.com/@TheAiGrid
  • Matt Wolfe(@mreflow)— 订阅者约 100 万。涵盖各类 AI 工具,频繁讲解 Sora、Veo、Nano Banana 相关内容。youtube.com/@mreflow
  • Theoretically Media(@TheoreticallyMedia)— 现役影视创作者从实际制作角度评测 AI 视频工具,持续覆盖开源模型(LTX-2、Wan、Hunyuan)。youtube.com/@TheoreticallyMedia
  • ComfyUI 教程频道群(多个频道名称未能从搜索结果中确定)— 几乎每周都会发布 MiniMax H3、FLUX.2、Wan2.2、LTX-2 的本地部署教程。
视频
  1. 「VEO 3.1 Camera Controls, Nano Banana 2 Leaks, Open-Source QWEN Image Edit & Sora 2 Update」
    2025-11-10 / youtube.com/watch?v=SJvnEvOvEYk
    同时覆盖闭源与开源。介绍 Veo 3.1 新增镜头控制、未经确认的 Nano Banana 2 泄露(“temporal coherence mapping”备忘录暗示可应用于视频 diffusion)、开源 Qwen Image Edit 的进展,以及 Sora 2 更新。

  2. 「Google won image generation (it's not even close) NANO BANANA PRO BREAKDOWN」
    2025-11-26 / youtube.com/watch?v=UV9GqinedQ8
    讲解基于 Gemini 3 Pro 的 Nano Banana Pro。强调其从前代 Nano Banana 的 1024×1024 上限,进化到 2K/4K 生成与高精度文本渲染,并称“Google 赢得了图像生成”。

  3. 「Ultimate Runway Gen 4.5 Tutorial For New Users in 2026」
    2026-03-29 / youtube.com/watch?v=IUge3u4ZrqQ
    面向闭源 Runway Gen-4.5(旧代号 Whisper Thunder/David)的教程。将其描述为“已达到无法分辨实拍与 AI 影像的程度”,并讨论了对素材影像行业的影响。

  4. 「Seedance 2.0 vs Kling AI 3.0」类对比视频群(多个频道于同一时期发布)
    2026 年初 / 例如多个 YouTube 讲解视频链接至的中国闭源模型对比文章
    ByteDance Seedance 2.0(2K、支持 12 路输入、单次生成音频)与 Kuaishou Kling 3.0(4K/60fps、专注口型同步)几乎同期发布,加速了中国与美国(OpenAI/Google)闭源阵营的竞争格局。

  5. 「HunyuanImage 3.0 : Open Source Text To Image Model (Forget Nano Banana & Seedream 4)」
    2025-09-28 / youtube.com/watch?v=32lhiZKhgOY
    报道腾讯发布超过 800 亿参数的开源图像 MoE 模型,并称其性能可与闭源 Nano Banana/Seedream 抗衡。

  6. 「China's Seedream 4.0 Just Outperformed Google's Nano Banana (And It's Open Source)」
    2025-09-24 / youtube.com/watch?v=3Hmj05sE1V8
    涵盖 ByteDance Seedream 4.0;不过视频标题声称其“开源”,而实际 Seedream 主要以闭源 API 提供,信息存在混乱,需注意(已在 Limits 中说明)。

  7. 「Is FLUX 2.0 The New Open Source King?」/「FLUX 2 Dev Released -GGUF 16GB Vram...」
    2025-11-25~27 / youtube.com/watch?v=YQuTkPVkCS8 , youtube.com/watch?v=yR6TYLlPP-s
    Black Forest Labs 发布 FLUX.2(32B、开放权重)后的一批即时评测。通过 GGUF 量化可在 16GB VRAM 消费级 GPU 上运行成为讨论焦点。

  8. 「LTX-2 by Lightricks: Open-Source 4K Video Generation With Audio (50 FPS)」
    约 2026-01-10 / youtube.com/watch?v=t5X5JR_CAv4
    介绍 Lightricks 的开源视频基础模型 LTX-2。其原生 4K、50fps、音频同步生成,以及连同训练代码一并公开,被评价为“开源视频 AI 的里程碑”;随即接入 ComfyUI/Fal/Replicate。

  9. 「Wan2.2 AI Video Tutorial & Demo | The best open-source video generation model to date just dropped!」
    2025-07-28 / youtube.com/watch?v=Tqf8OIrImPw
    将 Alibaba 的开源 Wan 2.2 介绍为 Runway/Pika 的完全免费替代方案,后续延展至将其与 Qwen Image、FLUX 组合的流水线视频(youtube.com/watch?v=qMda40fB_m0)。

  10. 「HunyuanVideo 1.5 vs Wan 2.7 Comparison: Which is The Best Free Local Video AI Generation Model?」
    2026-06-25 / youtube.com/watch?v=4GNT4-QYekg
    对两种开源视频模型(Tencent HunyuanVideo 1.5 vs Alibaba Wan 2.7)进行直接比较,以完全本地运行、免费为核心维度评估双方。

  11. 「How To Use MiniMax H3 in ComfyUI: Best FREE AI Video Model of 2026!」
    2026 年 8 月 / youtube.com/watch?v=d_wEd-fZcdg
    介绍在 ComfyUI 本地运行 Hailuo AI 的开放权重视频模型 MiniMax H3 的方法,强调无需订阅、可在个人电脑上完成;该模型也催生了许多“Multi-Keyframes”“Video-to-Video”等衍生教程。

  12. 「Ideogram 4 in ComfyUI: The Best Open-Source AI Image Model for Text, Logos & Design?」
    约 2026-06-05 / youtube.com/watch?v=rRiQDMZTPiQ
    介绍此前闭源的 Ideogram 在 Ideogram 4 中转向开放权重。其被评价为“性能可比肩闭源前沿模型”,并为文本、Logo 生成增加了强有力的开源选项。

信号
  • 闭源阵营对“快讯→即时对比视频”的响应极快。 Nano Banana Pro、Veo 3.1、Sora 2、Runway Gen-4.5、Seedance 2.0、Kling 3.0 都在发布数日内出现多个频道的横向比较视频,TheAIGRID 这类每周新闻频道成为枢纽。
  • 开源侧的 ComfyUI 教程生态很强。 Wan 2.2/2.7、Qwen-Image(-Edit)、FLUX.2、LTX-2、HunyuanVideo 1.5、MiniMax H3 在模型发布后立即出现大量“如何在 ComfyUI 使用”的视频,VRAM 要求(16GB/24GB 档)成为标题和评论中的主要关注点。
  • 中国模型(Alibaba Wan/Qwen、Tencent Hunyuan、ByteDance Seedance/Seedream、Kuaishou Kling、MiniMax)在视频和图像生成领域的开源/闭源两端均快速崛起,与美国系(OpenAI/Google/Runway/Black Forest Labs/Lightricks)的对比被反复讨论。
  • 存在“开源”标记混乱。 Seedream 相关视频标题称其为“开源”,但实际以闭源 API 为主,信息相互矛盾,评论中也有人指出。写入报告前需要通过官方博客/Hugging Face 等一手信息确认。
  • Sora 2 处于缩减阶段。 有信息称独立应用/网页版已于 2026-04-26 结束,API 计划于 2026-09-24 停止;“Sora 2 Update”类视频的语气已逐渐变成“面向结束的总结”。
局限
  • YouTube 搜索结果页(youtube.com/results)与视频页(youtube.com/watch)通过 JavaScript 渲染,WebFetch 只能取得 footer 导航链接,无法直接确认频道名、订阅数、播放量。因此依赖 WebSearch 摘要,部分视频(#4、#6、#7、#8、#11、#12)未能确认准确频道名、订阅数与播放数。
  • 对“优先近 60 天上传”这一要求,Sora 2、Nano Banana Pro、HunyuanImage 3.0、Seedream 4.0、FLUX.2、LTX-2 等大型发布首报多在 2025 年 9 月至 2026 年 6 月,超出目标时段(2026-07-18 以后)。近 60 天确认到的较新话题仅有 2026 年 8 月的 MiniMax H3、2026-07-24 默认化的 Midjourney V8.2、以及 2026-06-25 的 HunyuanVideo 1.5 vs Wan 2.7 比较;未找到 7~9 月的完整全新模型发布。
  • 无法取得单个视频的评论区正文(观看页无法渲染),因此无法直接引用观众反馈。
  • Nano Banana 2 仅处于“泄露”信息阶段,正式发布尚未确认,需要继续跟踪。

Bluesky

Bluesky — 图像生成 AI 与视频生成 AI 的最新趋势

账号
  • @replicate.com — 模型托管公司 Replicate 的官方账号。每当新的图像/视频生成模型接入 API,无论闭源还是开源都会发帖,是本次研究中信息密度最高的账号。
  • @testingcatalog.com(🚨 AI News | TestingCatalog)— 专注泄露与新功能的 AI 新闻账号,几乎每日发帖,频繁报道图像/视频生成新模型。
  • @simonwillison.net — 知名 AI 实验者。每次有新模型都会用“鹈鹕图像生成测试”进行验证,互动量显著更高。
  • @stabilityai.bsky.social — Stable Diffusion 开发商 Stability AI 的官方账号。自 2025-11-19 后停止发帖,且近一年几乎都在讨论音频模型(Stable Audio),几乎没有图像生成内容。
  • @ai.bots.law(AI Cases Bot)— 自动发布 AI 相关诉讼新提交文件的机器人,可用于追踪 Disney v. Midjourney 等图像生成 AI 版权诉讼。
  • @mjsrefs.bsky.social@un1v3rse.bsky.social 等 — 每天发布 Midjourney 作品的艺术账号群,更多体现社区热度而非新闻。
帖子
  1. Nano Banana Pro(Google) — Replicate 官方发布试玩 24 小时的报告:“pushing Nano Banana Pro to its limit”。2025-11-21、♥2 🔁0。链接
  2. Gemini 3 Pro — Replicate 宣布以“Google's most advanced multi-modal reasoning model”形式提供 API。2025-11-19、♥2。链接
  3. Veo 3.1(Google DeepMind) — Replicate 发布测试结果:“We've spent some time testing Veo 3.1”。2025-10-17、♥3。链接
  4. FLUX.2 [klein] 9b(Black Forest Labs) — 开放权重的 4 步蒸馏模型接入 Replicate,据称具备“delivers outstanding”性能。2026-01-23、♥1。链接
  5. Wan 2.2 Animate(Alibaba,开源) — Replace 功能更新后,运行时间从 7 分钟缩短至不足 2 分钟,附带嵌入视频。2026-01-29、♥2。链接
  6. Kling 3.0(Kuaishou) — Replicate 介绍为“Multi-shot 4K generation with synchronized audio”。2026-02-17、♥2。链接
  7. Runway Gen-4.5 — Replicate 宣布“Create stunning cinematic videos”。2026-02-18、♥2。链接
  8. Seedream 4.5(ByteDance) — Replicate 介绍其“Rich world knowledge, stronger spatial understanding”。2025-12-03、♥2。链接
  9. ChatGPT Images 2.5(OpenAI) — TestingCatalog 快讯称其具备“faster image generation, sharper output, tighter edit control”,并报道 API 新增 Flare/Sunburst 模型。2026-09-09、♥2 🔁1。链接
  10. Muse Video(Meta) — TestingCatalog 发布独家早期访问报告,称支持“high-quality 10-second video generation, native audio support”,计划通过 Instagram/Facebook 推出。2026-08-19、♥2。链接
  11. Orbis(Visko,实时视频模型) — TestingCatalog 介绍该初创公司新模型,称支持“4K/24fps with sub-second updates”,在提示词遵循测试中排名第一。2026-09-01、♥0(知名度仍低)。链接
  12. 使用 GPT-6 Astra 制作的 Blender 作品(Simon Willison) — 介绍“先用 ChatGPT Images 2.5 生成概念图,再交给 Codex 制作为 Blender 文件”的制作流程。2026-09-05、♥405 🔁30,是本次收集帖子中互动量压倒性最高的一条。链接
  13. Disney v. Midjourney(诉讼) — AI Cases Bot 自动发布最新提交文件(Doc #195:送达证明)。迪士尼正在就版权侵权及角色生成起诉 Midjourney。2026-09-16、♥0(法庭快讯机器人)。链接
  14. Midjourney 社区帖子示例 — 个人账号发布“Personal post with AI-generated imagery”,获得 ♥15 🔁5,在本次看到的个人艺术帖子中较高。虽非新闻,但表明 Midjourney 社区的活跃度。2026-09-16。链接
信号
  • 闭源阵营的主战场是通过 Replicate 进行整合发布:Google(Nano Banana Pro、Veo 3.1、Gemini 3 Pro)、OpenAI(ChatGPT Images 2.5、GPT Image 2)、ByteDance(Seedream/Seedance)、Kuaishou(Kling)、Runway、xAI(Grok Imagine Image)在 2025 年 10 月至 2026 年 4 月期间,几乎以每月 1~2 次的频率通过 Replicate 账号发布公告。中国模型(ByteDance、Kuaishou、Alibaba)的视频模型发帖频率尤其高。
  • 开源侧由 Black Forest Labs(FLUX.2)与 Alibaba(Wan 2.2)推动,但在 Bluesky 上自然形成的话题度较弱。老牌 Stability AI 自 2025-11-19 后停止发帖,且近一年以音频(Stable Audio)为主;其作为开源图像生成引领者的影响力在 Bluesky 上几乎消失。
  • 版权诉讼是闭源阵营的重要阴影新闻:Disney v. Midjourney 与 Alcon Entertainment v. Tesla(涉嫌未经授权生成《Blade Runner 2049》内容)持续审理,AI Cases Bot 几乎每天报告新的提交文件。
  • 点赞数整体偏低(数个至数百),未见 Twitter 或 Reddit 式病毒传播热度。唯一例外是 Simon Willison 的个人验证帖(♥405);实际动手测试的一手信息在 Bluesky 上获得最多反应。
  • Bluesky 搜索 API 实时搜索命中的普通用户帖子,多为“每天分享用 Midjourney 制作的作品”的个人账号(#midjourney、#AIart、#AIイラスト),技术话题不如作品展示常见。
局限
  • Bluesky 官方帖子搜索 API(app.bsky.feed.searchPosts)间歇性返回 403 错误,“Sora”“Nano Banana”“Flux.2”“Runway AI”等查询均频繁报错,“Midjourney”仅成功一次。因此改以 Replicate、TestingCatalog、Stability AI、Simon Willison 等已知相关账号的信息流(getAuthorFeed)为主要调查来源。
  • bsky.app 本身通过 JavaScript 渲染,WebFetch 直接打开时无法取得帖子正文,只能经公开 API 获取。
  • 由于 Wan 2.2、FLUX.2 等单独模型关键词搜索不可用,无法测量 Bluesky 全站的自然话题量(搜索命中数),结果可能偏向 Replicate/TestingCatalog 这些“发布源”。
  • Qwen-Image、HunyuanImage、Ideogram 等部分热门开源模型,在本次执行时间内未找到可验证的 Bluesky 实际帖子,故未纳入报告。
  • 检查了 gigazine.net、aitry.bsky.social 等日语圈 Bluesky 账号的信息流,但近期未找到图像/视频生成 AI 相关帖子。

Lemmy

Lemmy — 图像与视频生成 AI 最新新闻

社区
  • !«メールアドレス» — 5,711 人,创建于 2023 年,是 Lemmy 上 AI 图像生成讨论的核心社区。
  • !«メールアドレス» — 2,361 人,以作品投稿为主。机器人 Even_Adder 几乎每天自动转载 Hugging Face / GitHub 的新模型与 LoRA,实质上已成为开源图像/视频生成模型新闻流。
  • !«メールアドレス»(50 人)、!«メールアドレス»(104 人)、!«メールアドレス»(52 人)、!«メールアドレス»(97 人)— 按主题划分的小众衍生社区,规模都很小。
  • !«メールアドレス» — 51 人,自动镜像 Reddit /r/ArtificialInteligence 等 RSS 的机器人社区。
  • !«メールアドレス»,以及联邦实例中的 lemmy.ziplemmy.todayawful.systems(!techtakes)lemmy.bestiver.se(!hackernews) 等泛科技社区 — 闭源公司相关 AI 新闻几乎都集中于此。订阅者数分散于各实例,无法取得准确总和。
  • !«メールアドレス»(在 piefed.social 等处镜像)— 专门反 AI 的社区,适合观察对生成 AI 的反感程度。
帖子
开源类
  1. MiniMax H3 衍生工具连续发布(2026-09-08~09-13、!«メールアドレス»、发帖人 Even_Adder)
    • circlestone-labs/MiniMax-H3-Image-Training-Adapter(评分 5、2026-09-12)https://lemmy.dbzer0.com/post/75382765
    • Speach1sdef178/ComfyUI-VDN-H3-24GB(适用于 24GB VRAM 的加速实现、评分 6、2026-09-12)https://lemmy.dbzer0.com/post/75382764
    • F16/krea2-turbo-sda(评分 2、2026-09-10)与 lvladikov/Krea2-Turbo-Distill-4step-LoRA(评分 2、2026-09-08)https://lemmy.dbzer0.com/post/75284619 / https://lemmy.dbzer0.com/post/75150626
    • MiniMax H3 是一个 330 亿参数的开放权重视频生成模型:2026-07-31 以仅 API 方式发布,08-03 在 Hugging Face 发布权重,支持 2K/24fps、最长 15 秒、同步生成音频,并在 Artificial Analysis 视频编辑榜单排名第一。Lemmy 上的连续帖子表明,该模型的周边工具开发在 9 月依然活跃。
  2. Lightricks/LTX-2.5-22b-IC-LoRA-Ingredients(评分 3、2026-09-12、!stable_diffusion)https://lemmy.dbzer0.com/post/75382763 — 用于 Lightricks 开源视频模型 LTX 的参考图控制 LoRA。lemmy.world 也有镜像帖(https://lemmy.world/post/51841873)。
  3. “Uncertainty DMD”论文介绍(SIGGRAPH Asia 2026、评分 3、2026-09-12、!stable_diffusion)https://lemmy.dbzer0.com/post/75382766 — 关于少步数自回归视频生成中恢复多样性的研究。
  4. !stable_diffusion_art 的每日作品帖子(2026-09-11~09-16、评分 1~21)例如:“Watch at the Burning Falls”(评分 16、09-15)https://lemmy.dbzer0.com/post/75490978、“Shining Bay Steps”(评分 21、09-13)https://lemmy.dbzer0.com/post/75414322 — 从帖子说明可见,Krea2、Flux 系模型使用频繁。
闭源类
  1. Midjourney 从图像生成 AI 转型为“全身扫描医疗水疗”业务(评分 66/DL3、10 条评论、约 2026-06-18、!technology、The Register 文章)https://lemmy.zip/post/66397234 — 开始提供沉浸于“金色光芒”中的全身扫描诊断服务,在未获 FDA 批准的情况下展开,引发评论区将其与 Theranos 相提并论的批评。相关镜像:https://lemmy.bestiver.se/post/1175129
  2. Midjourney 要求好莱坞巨头披露 AI 使用情况(评分 76/DL2、2 条评论、2026-07-05、!technology、TechCrunch 文章)https://lemmy.today/post/56011946 — 在与制片厂的诉讼攻防中,Midjourney 要求对方披露“你们自己也在使用 AI 吧”。
  3. OpenAI 实质关闭 Sora(多条帖子、2026-03~05)
    • 「How OpenAI scrapping Sora video-generation app points to one of the biggest problems facing technology companies」(评分 2、!openai)https://lemmy.world/post/45568787
    • 「Sora losing $1 million daily」(评分 1、2026-03-30、!kotaku)https://ibbit.at/post/214890 — 报道称每日 100 万美元亏损是关闭原因之一。
    • 「OpenAI shutting down Sora just killed a $30M AI movie」(评分 1、2026-05-27、!ai_reddit)https://lemmy.durstig.online/post/34669 — 报道称一个在 Sora 上进行、规模达 3,000 万美元的 AI 电影项目受到牵连。
  4. Adobe 在 Photoshop/Premiere 中加入 AI 聊天机器人与 Firefly 生成音频(评分 22、2025-10-29、!boycottus)https://alternativeto.net/news/2025/10/adobe-adds-ai-chatbots-to-photoshop-premiere-ai-masking-and-generative-audio-in-firefly/ — 虽较旧,但仍作为闭源阵营“应用整合”路线的背景被提及。
信号
  • Lemmy 的生成 AI 社区实质上接近“开源专用”。核心是 lemmy.dbzer0.com 的 !stable_diffusion 系列,内容不是新闻文章,而是每日生成作品与机器人 Even_Adder 自动转载的 Hugging Face / GitHub 新模型、LoRA。
  • 仅最近一周(09-08~09-16),与 MiniMax H3(开放权重视频模型,07-31 发布、08-03 公开权重)相关的周边工具帖子便连续出现,是开源视频生成阵营最受关注的话题。Krea2 Turbo 加速 LoRA 群也同步活跃。
  • 闭源阵营(OpenAI、Midjourney、Adobe、Google、xAI)的内容在 Lemmy 主体中几乎不出现,只会以每月 1~2 条的频率流入 !technology 等泛新闻社区;而且内容偏向“失败、争议、诉讼”,而非新功能发布(Sora 实质关闭、Midjourney 转向医疗设备、Midjourney 与好莱坞的诉讼)。
  • Lemmy 全站对 AI 生成物的反弹也较强,存在独立的 !fuck_ai 反 AI 社区,也可见多起因 AI 相关帖子而被其他社区封禁的报告,显示对生成 AI 整体的警惕。
局限
  • Lemmy 规模较小,即便主要 AI 社区也只有数千订阅者,不具备 Reddit/X 那样的时效性和覆盖度。
  • 搜索 API 间歇性返回 503/500 错误,部分查询(Midjourney、“Nano Banana”、“Veo 3” OR “Sora 2”、直接搜索 !stable_diffusion_art 等)首次请求为空或报错,需要重试。
  • 对“Nano Banana”“Seedream”“Grok Imagine”“Kling”“Veo 3.1”等 2026 年主要闭源模型名,未找到 Lemmy 中直接提及的帖子;命中的只是外部 AI 工具介绍网站。可判断这些话题在 Lemmy 上几乎没有流通。
  • 找到一条链接荷兰语文章的帖子,称 Elon Musk / xAI 的 Grok Imagine 制作了《奥德赛》AI 电影,但因文章正文(ad.nl)无法获取而无法进行事实核查,故未写入正文。
  • 相比“每个社交网络分析约 20 条帖子”的完成标准,Lemmy 上直接符合主题的帖子总数也未达到 20 条。开源(dbzer0 模型/LoRA 帖子)确认超过 10 条,闭源直接提及仅约 5~6 条,这直接反映了平台规模较小。

Pinterest

Pinterest — 图像与视频生成 AI 新闻

未按类别分组,以单一查询“Image and Video Generation AI News”收集的 50 张图钉平铺展示(output/pinterest.pins.md)。逐张目视确认后的结果如下。

视觉主题
  • 深色×霓虹的科幻科技背景占压倒性多数 — 深蓝至黑色背景、蓝紫色电路图案、发光全息元素与“AI”发光字样叠加的构图,占近半数 [1, 3, 4, 7, 13, 14, 17, 23, 24, 25, 26, 27, 32, 34, 37, 38, 40, 42, 44, 46, 50]。新闻类与宣传类图钉都偏向这种风格。
  • 白色拟人机器人/赛博格面孔反复作为 AI 本身的符号 — 坐在新闻台前、穿西装的机器人主播 [27],侧脸特写的女性型机器人 [32, 37],沉思的机器人 [26],看手机的机器人 [3] 等,“像人类的 AI”视觉已模板化。
  • “哪个是 AI?”竞猜格式 — 山景照片 A/B 对比 [11],瞳孔特写的 REAL vs AI [35],带有“FAKE”印章的猫图 [3] 等,辨别 AI 生成物真伪已成为常见内容格式。
  • 大量直接混入 YouTube 缩略图的“AI 新闻”视频 — 惊讶/困惑的胡须男性,加上 OpenAI、Google、Microsoft、Meta、Anthropic、Notion 标志的构图 [4, 18, 41],以及戏剧化标题“MIND BLOWING AI NEWS”“TOP 5 AI NEWS”[19, 40]。许多案例并非 Pinterest 原生帖子,而是直接转载 YouTube 缩略图。
  • “推荐 AI 工具”排行信息图 — 将 Runway、Pika、Kling AI、Luma(Dream Machine)、Canva、Hailuo 排为 1~6 名的几乎相同内容出现两张 [9, 28](模板复用)。另有按功能整理 20 种付费工具的大型图表 [36],以及付费 vs 免费对比图 [12]
  • 实际生成作品展示 — Google Veo 2 宣传图(穿黄色雨衣的女性、游泳池中的狗、火烈鸟、动画风格少女)以几乎相同构图出现两次 [6, 8];Vidu S1 的实时交互生成演示 [39];将人物视频批量转换为“木质积木”“折纸”“乐高”“花朵”的 Lumiere 风格多材质转换演示 [10]
  • 警示虚假/错误信息的图像 — 带有“AI-GENERATED IMAGES”横幅的 Facebook 截图,将巨猫漫步于斯普林菲尔德街头的合成图和使用猫的反移民示威合成图并列,作为 AI 生成内容实例进行警示 [45]。还包括音频检测仪表“97% likely AI generated”[37] 与优缺点对比信息图 [26]
  • 提及合成新闻主播/AI 演员 — Hollywood Reporter 在电视节目《The View》中讨论 AI 女演员“Tilly Norwood”的截图 [2],Wondershare Virbo 的合成新闻主播直播风广告 [22],以及宣传“AI Lip Sync”的新闻频道生成工具广告 [48]
值得注意的图钉
  • [10] (无标题)— 将人物视频转换成木质积木、折纸、乐高、花朵的网格图。作为将同一视频一致地转换到多种材质的技术演示,视觉冲击力很强。
  • [45] AI creations give life to harmful Springfield,... — 让人联想到 2024 年斯普林菲尔德“吃猫”谣言,以巨猫与 AI 合成反移民示威图为例,对 AI 生成内容提出警示。
  • [2] Hollywood Reporter Interviews the First AI Actress... — AI 女演员 Tilly Norwood 登上电视谈话节目时的截图,证明 AI 人才问题已进入大众新闻议程。
  • [39] ShengShu Technology Unveils Vidu S1... — 宣传“实时交互生成”的中国模型视觉内容,表明闭源势力图谱并非只有美国公司。
  • [47] Transform your ideas into stunning visuals! — 一尊大理石雕塑拉着大提琴的超写实 AI 艺术,展现照片级真实感的当前高度。
  • [36] AI Tools for Video Editing — 涵盖从生成、编辑、音频到发布的 20 种工具速查信息图,有助于把握当前工具栈。
  • [31] Today's AI News (May 20 2026) — 将 Google I/O 2026 的 Gemini 3.5 Flash/Omni、AI 智能眼镜、Apple 无障碍功能汇总于一张图的快讯型信息图。
  • [33] This Week in AI News - Aug 15 2026 — 复古报纸布局罗列 Sovereign AI、Agent Harness 等流行词标题。标题本身缺乏具体性,象征 AI 新闻内容的模板化与注水。
  • [6]/[8] Veo 2 宣传图(几乎相同的两张)— Google 视频生成模型示例素材(游泳的狗、火烈鸟、动画风格少女)在 Pinterest 上反复传播。
  • [9]/[28] “Best AI Video Generation Websites”(几乎相同模板两张)— Runway/Pika/Kling AI/Luma/Canva/Hailuo 排名内容被重复使用,显示以联盟营销为目的的列表文章大量涌入 Pinterest。
信号
  • 闭源阵营(Google Veo 2/3、Gemini、OpenAI、Nvidia、Vidu/ShengShu)的产品发布与对比文章占图钉大多数,Pinterest 擅长服务“工具选择”与“使用方法总结”导向的实用搜索。
  • 开源只在大型工具清单 [36] 中出现一条“Stable Video Diffusion”,几乎没有点名提及。Reddit 与 X 上关于 Wan、HunyuanVideo、ComfyUI 等开源/本地生成社区的氛围,在 Pinterest 几乎不存在。
  • “辨别真实还是 AI”格式 [3, 11, 35]、错误信息警示 [45]、音频检测 [37] 等内容占一定比例,说明平台并非单一赞美 AI。
  • 对合成 AI 主播/AI 人才(Tilly Norwood、Virbo 新闻主播、AI Lip Sync 类工具)的关注跨越多个图钉,“无人表演的视频内容”正在成为趋势词。
  • 可见几乎完全复制的信息图(Veo 2 宣传 [6][8]、工具排行 [9][28]);Pinterest 特有的转图/模板复用会放大 SEO 导向内容,需要折扣解读。
  • 未看到任何日语或日本本土话题,收集结果全部来自英语圈内容,主要是美国。
局限
  • 工作器使用单一查询一次收集 50 条,未按类别(如闭源/开源)分组。因此本文无法采用剧本预期的“按类别分节”结构,只能汇总描述整体。
  • 约 8 条图钉的标题为空或仅为“AI”等信息量很低,例如 [6, 11, 15, 19, 31(实际可读), 38, 46],部分判断只能依据图像内容。
  • 未逐一打开 Pinterest 页面确认保存数、评论和目标文章;仅逐张查看已收集图像。互动数值及源文章 URL 的真实性未经核实。
  • 未进行浏览器直接搜索(按剧本要求,仅使用工作器已收集的图像)。

建议行动

  • 重新收集 X 时,不要依赖热门列表,而应使用主题相关词(Nano Banana、Seedance、Wan 2.2、Sora 等)。
  • 持续关注 Lemmy 的 stableDiffusion 系信息流,作为开源视频模型的先行指标。
  • 将 Nano Banana 2 的正式发布和 Sora 2 API 停止(2026-09-24)作为闭源阵营转折点进行追踪。
  • 监控 Disney v. Midjourney 等进行中的诉讼,作为可能影响闭源公司策略变化的因素。
  • 重新收集 Reddit 与 Pinterest 时使用多个主题查询,以满足约 20 条内容的完成标准。
  • 对声称“开源”的模型,在发布前通过 Hugging Face 等一手资料核实实际情况。

收集图像

🎨 AI 图像与视频创作Hollywood Reporter 采访首位 AI 女演员……AI 内容与社交媒体担忧AI 新闻:Anthropic 泄露展示 AI 的未来……🤯 生成式 AI 详解!🤖✨ AI 如何生成文本、图像、视频及更多内容!图像用于内容营销的 AI 生成视频Google 发布 Veo 2:具有增强真实感和电影化功能的先进 AI 视频生成工具做到极致 🎥Google 宣布超高质量视频……图像用于图像和视频生成的 AI纽约的大胆博弈:深入立法……Veo 3 图像转视频:通过 Gemini API 快速生成并支持原生音频图像什么是 Imagvio AI,以及它如何帮助创作者……含有文本、图像、音乐和视频生成功能图标的 AI 内容创作概念图片——浏览 57 张库存照片、矢量图和视频AI 新闻:OpenAI 终于发布了我们想要的内容图像AI 视频创作软件2025 年顶级 AI 视频生成器TotalYmage 革新交互式视频……内容创作者的秘密武器:AI 驱动的视频生成AI 驱动的图像与视频分析AI 如何改变视频编辑AI 生成视频:好还是坏?这里是真相!🤖🎥探索 Grok 如何革新视频……2026 年 5+ 个最佳 AI 视频生成网站|Runway、Pika、Kling AI、Canva 等AI 图像生成OpenAI 的秘密图像生成工具即将推出图像专业 AI 视频创作|电影化 AI 视频|定制视频编辑本周 AI 新闻 - 2026 年 8 月 15 日掌握视频与 AI:2025 年关键社交媒体营销趋势你能找出假的吗?AI 视频与真实生活挑战!AI 视频编辑工具——2026 年创作者实际用来制作内容的工具‎🚨 AI 正变得惊人地逼真。AI 新闻ShengShu Technology 发布 Vidu S1,为 AI 视频带来实时交互式生成人工智能:让我们保持……Nvidia #全新 AI 工具 🤯 #新闻 #ai #openai #chatgpt #精彩内容 #短视频“用个性化 AI 驱动的 4K 视频改变你的愿景 🎥✨”Klarna 在意识到实际程度后回调……CEO 的惊人披露:30% 的 Microsoft 代码……AI 创作让有害的斯普林菲尔德内容成真……AI将你的想法转化为惊艳视觉!🎥如何用 AI 创建新闻频道|AI 新闻视频生成器|AI 口型同步如今超过 20% 的 YouTube 内容由 AI 生成相互连接的人工智能生态系统

数据质量说明

X 因依赖热门列表搜索,图像与视频生成 AI 相关帖子实质为 0 条;Reddit(11 条)、Pinterest(单一查询 50 条)以及 Lemmy 的闭源侧(5~6 条)也未达到 20 条的完成标准。YouTube 在 60 天内的新发布较少;Bluesky 则因搜索 API 故障而依赖已知账号的信息流。

图库