KEN’S CAT LOG

图像与视频生成 AI 新闻 — 2026-09-14

OpenAI 的 Sora 2 将连同 API 于 2026 年 9 月 24 日全面终止服务,闭源视频生成市场正收敛至 Veo 3.1、Seedance 2.5、Kling 3.0 与 Runway Gen-4.5 四强;开源领域则由中国厂商(Alibaba、Tencent、DeepSeek、Zhipu)以及 Lightricks 的 LTX-2 系列主导。

OpenAI 的 Sora 2 将连同 API 于 2026 年 9 月 24 日全面终止服务,闭源视频生成市场正收敛至 Veo 3.1、Seedance 2.5、Kling 3.0 与 Runway Gen-4.5 四强;开源领域则由中国厂商(Alibaba/Tencent/DeepSeek/Zhipu)以及 Lightricks 的 LTX-2 系列主导。

图像与视频生成 AI 新闻汇总 — 2026-09-14

嗨!这次我火速刷了一遍 Reddit、X、YouTube、Bluesky、Lemmy、Pinterest 这 6 个社交平台,搜集了图像与视频生成 AI 的闭源/开源最新消息🔥🔥 先说结论:闭源阵营中,OpenAI 的 Sora 实质上已退场,市场迅速收敛为 Veo 3.1、Seedance 2.5、Kling 3.0、Runway Gen-4.5 四强;开源阵营则是中国厂商(Alibaba、Tencent、DeepSeek、Zhipu)正在真正掌握主导权,尤其 Lightricks 的 LTX-2 系列热度极高,甚至被称为“开源视频的圣杯”📈 不过,X 的搜索关键词配置出了问题,这次几乎完全扑空;Lemmy 也呈现出“开发活跃、讨论为零”的独特结果,这些我都会如实说明😅

跨平台观察 🌐

  • 中国开源模型已完全成为主角级存在:Qwen-Image/Qwen-Image-Edit、Wan(Alibaba)、Hunyuan(Tencent)、DeepSeek-V4 系列、GLM-5.3-Flash,在 YouTube、Bluesky、Lemmy、Reddit 四个平台中都频繁出现。开源=中国厂商的格局似乎已经基本成型🇨🇳
  • Seedance 2.5(ByteDance)是闭源阵营“当下最热的名字”:在 Reddit(Wan 与 Seedance 的使用场景争论)、YouTube(视频对比内容常客)、Pinterest(华丽广告视觉)三处都是真正的话题中心。不过也有人指出,它的单价约为开源 Wan 的 3 倍💸
  • “先做图,再转视频”的工作流已成为常识:Reddit 的多个讨论串都把这种混合创作流程视为理所当然;Pinterest 上的材质转换演示(木材化、折纸化等)也可视为这一趋势的延伸🎬
  • 音频+画面的一次生成,是两大阵营共同趋势:Veo 3.1、Seedance 2.5(闭源)以及 Wan 3.0、LTX-2(开源),都不再只生成画面,而是默认连音频一起生成🎧
  • “这会不会是 AI?”的真实性焦虑到处涌现:从 Reddit(r/isthisAI)、Pinterest(虚假检测条、人类 vs 机器对照图)到 Lemmy(对生成式 AI 的冷淡态度),对生成内容可信度的担忧已跨平台成为稳定主题🕵️
  • 大众的 AI 疲劳与不信任感也是共同话题:Lemmy 的反 AI 社群、Reddit 对“无限量”订阅的不信任、Pinterest 的版权与监管文章,都显示出氛围已从“能不能做出来”转向“该如何使用”⚖️

分平台观察 📱

Reddit — 分析了 8 个 subreddit、12 个讨论串。最火的是 r/generativeAI,其中无审查、本地视频模型(MiniMax H3、LTX-2.3、Wan 系列)以及 Seedance 2.5 的使用场景之争讨论很热烈。另外,非 AI 专题的 r/GetNoted 有一则讨论串拿到 5,026 分,是这批数据中反应最强的一条,说明生成式 AI 已不只是“专业话题”,而是在被当作“争议与新闻的燃料”消费🔥

X — 收集到的 40 条帖子及 10 个搜索词(“Lando”、“LMEOW”、“Dario”等)完全与本主题无关,图像/视频生成 AI 的内容真的一条也没有😱 唯一稍微沾边的是 Dario Amodei 关于 AI 开发节奏的文章,浏览量超过 6,700 万,但并不讨论生成媒体。这显然是采集配置的问题,不代表 X 上真的没有相关话题。

YouTube — 信息密度最高。头条是 Sora 2 将在 2026/9/24 连同 API 完全终止服务(应用已于 4 月关闭);闭源市场已形成 Veo/Seedance/Kling/Runway 四强格局,Nano Banana 系列正成为“事实上的图像模型标准”;开源一侧则确认 LTX-2 被称为“Holy Grail”。不过由于 JavaScript 限制,播放量大多无法获取📵

Bluesky — 自动发布 Hugging Face 趋势的机器人账号基本成了主要信息源,Qwen、DeepSeek、GLM、LTX-2.5 连日登上趋势榜。闭源厂商(Stability AI、Midjourney)主要发布企业合作和低调功能更新,这段期间没有重磅新模型。搜索 API 返回 403,影响很大🔒

Lemmy — 结论是“没有形成热潮”。!stable_diffusion 系社群中,大部分内容是 HuggingFace/GitHub 的自动转发机器人,评论几乎为零;反而在 !asklemmy、!fuck_ai 等泛社群中,对生成式 AI 的负面看法更突出,包括未经许可训练的批评与对“AI 垃圾内容”的反感。没有找到 Sora 2、Veo 3 等最新模型的独立快讯。

Pinterest — 分析了预采集的 50 个 Pin。闭源大厂(Google Veo、ByteDance Seedance、ShengShu Vidu)的宣传视觉占据主角位置,同时也出现多条“监管与社会影响”新闻,例如 AI 演员“​​Tilly Norwood”争议,以及 ByteDance 与 MPA 的版权协议。开源侧大多只是在工具清单中一笔带过,存在感较弱。

值得关注 👀

建议 💡

  • 视频制作工作流应以“用图像模型确定角色 → 用视频 AI 动画化”的两阶段流程为前提进行验证和比较。
  • 开源视频的 PoC 应优先评估 LTX-2 系列与 Wan 系列,并持续关注 Wan 3.0 的许可证公告。
  • 闭源视频应以 Seedance 2.5、Veo 3.1、Kling 3.0、Runway Gen-4.5 四强为核心,并将价格差异(Seedance 约为 3 倍)纳入成本比较。
  • 对宣称“无限量”的闭源订阅服务,签约前务必确认实际生成上限与等待时间。
  • 针对生成内容的法律风险,应更重视“分发/分享”环节的责任,制定内部运营规则。
  • 下次收集 X 内容时,应将搜索关键词替换为图像/视频生成 AI 相关词(模型名、实验室名等)。

数据质量 🔍

  • X:收集到的 40 条帖子与搜索词本身都和主题无关,主题相关帖子为零。原因是采集配置不匹配,因此无法从本次数据判断 X 上的实际讨论量。
  • Lemmy:不存在活跃的图像/视频生成 AI 专属社群,高质量独立帖子(排除自动转发与零评论)未达到简报要求的“20 条”目标。
  • Reddit:仅有 12 个讨论串、8 个 subreddit,同样未达到“20 条”目标;但内容密度足够高。
  • Bluesky:全文搜索 API 因 403 无法使用,只能经由账号搜索绕行采集,因此样本偏向于已发现账号的帖子。
  • YouTube:受 JS 渲染影响,播放量与订阅数几乎无法取得;仅能从搜索结果页获得标题和摘要。约收集到 19 条视频,基本达到目标。
  • Pinterest:分析了预采集的 50 个 Pin,达到目标数量;但没有做类别划分,无法比较不同主题的明细。

平台分项汇总

Reddit

Reddit — 图像与视频生成 AI 新闻

来源 🗺️

此次收集到的 12 个讨论串来自 8 个 subreddit!具体如下👇

Subreddit 成员数 收集讨论串数
r/generativeAI 152,914 4
r/isthisAI 411,226 1
r/artificial 1,337,681 1
r/GetNoted 298,881 1
r/AItips101 57,843 1
r/Seedance_AI 20,909 1
r/AI_Short_Films 7,965 1
r/aivideomaking 6,928 2

热度最高的是 r/generativeAI(4 个讨论串)。此外,通用 AI 社群 r/artificial、鉴别类 r/isthisAI、八卦类 r/GetNoted 等“并非专门讨论 AI”的 subreddit,也确实流入了图像/视频生成 AI 相关帖子,这一点很有意思。

用户在说什么 🗣️
  • ①“无审查”图像/视频生成工具的排行帖有走红趋势(讨论串 1,r/AItips101,176 分・121 条评论・2026-09-07)→ 发帖者将 WildOwl.ai 排在第 1,理由是“可通过按量计费的积分制访问 35 种以上模型(Qwen、Flux、Seedream、Wan、Kling、Seedance、Veo、GPT Image),无需订阅”。评论中 u/reliablemicrophone84 也盛赞:“WildOwl really does solve that exact problem... Ive wasted so many credits elsewhere on frustrating filters”。不过,这类讨论串更像宣传内容而非深度用户评测,仍需警惕🚩

  • ②无审查、本地视频模型用户展开认真讨论(讨论串 8,r/generativeAI,86 分・56 条评论・2026-09-10)→ MiniMax H3(在 HuggingFace 本地分发,u/RioMetal 贴出了链接)、LTX-2.3 / LTX-2.3Eros10、Wan 2.2~3.0 等开源模型纷纷被提及。u/farkryzer24 表示:“Wan can draw explicit actions and anatomy correctly while Seedance is not as good at that, but Seedance is better at cinematic and fluid motion... Seedance has a higher price, can be around 3x Wan per second”,展现出开源(Wan)与偏闭源(Seedance)按用途分工的有趣争论⚖️

  • ③对号称“无限 1080p”的视频生成服务不满(讨论串 4,r/generativeAI,1 分・13 条评论・2026-09-07)→ Artlist.io(€550/年)和 Runway 高级套餐($76~95/月)成为讨论对象。u/ai_art_is_art 直言:“Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations”。闭源产品“无限量”宣传所引发的不信任感非常明显💸

  • ④生成视频与实拍视频的界线真的越来越难分辨(讨论串 7,r/isthisAI,0 分・31 条评论・2026-09-09)→ 用户根据项链忽隐忽现等不自然之处判断“很像 AI”。u/BouncingSphinx 评论:“It also happens to be 15 seconds long, which is apparently the current limit of AI video”,指出如今 AI 视频的“时长限制”本身也已成为识别线索,颇为敏锐👀

  • ⑤借 AI 图像煽动争议的爆款讨论串,互动量遥遥领先(讨论串 11,r/GetNoted,5,026 分・373 条评论・2026-09-10)→ X 上一张 AI 生成图片(文字崩坏、类似日程表的图)成为错误信息与争议的导火索。r/GetNoted 并非 AI 专题社区,却获得 5,026 分,是本次采集中的绝对第一。这是 AI 生成物被当作“政治燃料”而不是单纯新闻消费的代表例子🔥

  • ⑥爆款视频“制作方法揭秘”讨论串(讨论串 6,r/generativeAI,0 分・31 条评论・2026-09-10)→ u/lagbit_original 回答:“Easy Use you preferable image model for creating the character, Seedance 2.5 and a single prompt and the right references. Then add some music and a few cuts here in there in an editing software”。也就是说,如今流行视频的主流流程是“图像模型制作人物 → Seedance 2.5 加提示词和参考图 → 剪辑软件做节奏与切分”的混合创作🎬

  • ⑦长视频生成用户将“先做图再转视频”视为标准动作(讨论串 12,r/AI_Short_Films,4 分・9 条评论・2026-09-13)→ u/sharktank123456 说:“You really want to go image based - you are rolling the dice with a really expensive model if you are doing text to video... let the images provide the fidelity”。讨论还提到 Seedance 2.5 新的“参考功能”使角色一致性更容易维持。开源一侧,u/VERSATILCORDOBA 推广了其支持 “Ollama and ComfyUI, as well as remote providers” 的自制开源应用🛠️

  • ⑧闭源 AI 普遍拦截版权角色,引发用户不满(讨论串 9,r/generativeAI,2 分・3 条评论・2026-09-08)→ 有用户表示 Grok 会拦截 Disney 角色;u/frighten 建议:“PixelForge might work for you on iOS, it has no restrictions built in”。可见闭源大厂的 IP 限制越严,需求越可能流向小众工具🏰

  • ⑨想免费制作长视频的用户,遭遇硬件门槛(讨论串 2,r/aivideomaking,16 分・39 条评论・2026-09-07)→ u/NewLifeWares 表示:“45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator... expect to spend hours generating until you get the right results, then stitching together a few 5-10 seconds videos”。免费、低配置用户的期待与 AI 视频生成现实之间,存在巨大落差😅

  • ⑩名人 AI 视频的法律灰区争论(讨论串 5,r/Seedance_AI,0 分・22 条评论・2026-09-07)→ u/Jean_velvet 表示:“Recent court cases put it in the responsibility of the user. If you've made any harmful content involving real people then I suggest you don't share it. It's the distribution and sharing that's the potential crime”。评论区普遍认同:比起生成本身,“分享与传播”才是风险核心⚖️

信号 📡
  • 升温趋势:本地/开源的无审查视频模型(MiniMax H3、LTX-2.3、Wan 系列)在讨论串 8 中受到直接点名关注;与 Seedance 2.5 等偏闭源模型“按用途分工”的对话已逐步常态化。“先做图、再视频化”的工作流(讨论串 12)也已近乎成为常识。
  • 降温/被批评的对象:号称“无限量”的闭源订阅服务(讨论串 4)普遍被视为“像骗局”。想依靠免费或低配置设备制作长视频的期待(讨论串 2、3)也被现实地指出“以当前技术根本做不到”。
  • 分歧点:讨论串 8 中,Wan 与 Seedance 的擅长领域被评价为几乎相反(Wan=露骨动作与解剖准确性;Seedance=电影感与流畅动作),而 Seedance 的价格却约为 Wan 的 3 倍,这种差异并存。
  • 意外发现:并非 AI 专题的 r/GetNoted(讨论串 11)获得 5,026 分,是此次收集内最高反应。图像/视频生成 AI 的传播力,如今似乎更多来自“普通新闻/争议语境”,而非专业 subreddit。
  • 一个低调但犀利的观察:AI 视频的“时长较短”本身,已成为“判断是不是 AI 的线索”(讨论串 7)——技术限制讽刺地成了识别特征。
局限 ⚠️
  • 搜索词只有 “Image and Video Generation AI News” 一个,最终仅收集到 12 个讨论串、8 个 subreddit,未达到简报建议的“每个社交平台约 20 条”。
  • 要求闭源/开源各至少 10 条洞察,但仅凭 Reddit 数据难以将两类清晰各分为 10 条(许多讨论串同时提到两者,或话题较泛)。本 Reddit 单项报告仅整理“Reddit 上在讨论什么”;闭源/开源双轴分析应在与其他平台合并后的综合报告中完成。
  • 讨论串 11(GetNoted)与讨论串 10(r/artificial)讨论的重点更偏向 AI 生成物的社会影响,而不是狭义的工具/模型新闻。它们被纳入作为语境参考,但不应视为纯粹的产品新闻。
  • Reddit 无法由我直接浏览,因此除已收集的 output/reddit.threads.md / .json 外,未查看任何其他讨论串。这里未列出的内容(例如特定新模型的正式发布)仍可能存在于 Reddit 上。

X

X — 图像与视频生成 AI 新闻

账号

此次采集通过十个关键词搜索,从 34 个账号收集了 40 条帖子:
“Lando”、“LMEOW”、“Slack”、“Company OS”、“Ireland”、“Dario”、“China”、“#bb28”、
“Source”、“solbiscuit”(见 output/x.posts.md 第 3 行)。这些关键词中没有任何一个是图像/视频生成模型、实验室或产品名称;通读全部 40 条帖子后,也没有账号真正讨论图像/视频生成 AI。最接近的内容是 6 条涉及前沿 AI 开发节奏与安全的帖子,主要由一个拥有单条爆款的账号推动:

  • @DarioAmodei(Anthropic CEO Dario Amodei)— 仅一条帖子,却是整个数据集互动量最大的单帖:84,569 个赞、25,720 次转发、9,488 条回复,约 67,000,000 次浏览(#23)。对本数据集而言,这是单条超级爆款,而非持续发帖账号。
  • @BrianRoemmele(Brian Roemmele)— 三条帖子,都是对 Amodei 文章的回应,每条互动量中小等规模(658、739、325 个赞)——属于持续评论者,而不是单次爆款作者(#24、#25、#26)。
  • @ctgptlb(AGIラボ,日语 AI 新闻账号)— 一条面向日语用户概述同一文章的帖子,获得 1,341 个赞、约 672,000 次浏览(#22)。
  • @BenjaminPDixon@TheJakeChristie@akshay_pachaar — 各一条帖子,分别讨论 AI 监管情绪和 LLM 评估方法(#21、#28、#35)——它们是泛 AI 账号,不是图像/视频生成账号。

其余 28 个账号(34 个总数减去上述 6 个)讨论的内容包括 Formula 1(Lando Norris)、名为 $LMEOW 的加密代币、日本企业聊天中的 Slack 与 Discord、LINE WORKS 之争、英国地方自治政治、Big Brother 28(#bb28)、伊朗导弹发射的 OSINT 报告,以及名为“solbiscuit”的代币——都与本简报无关。

帖子

本次采集没有任何一条帖子讨论图像或视频生成 AI,无论闭源还是开源。最接近的内容只是关于一般前沿 LLM 的开发节奏,而非生成媒体:

  1. #23 @DarioAmodei,2026-09-12,84,569 个赞/25,720 次转发/9,488 条回复/约 67,000,000 次浏览 —
    https://x.com/DarioAmodei/status/2098773920774074715 — “We Must Pace the Frontier: I've written a new essay on why the AI industry should slow down, with a three-part plan for doing so.” 内容关于 AI 开发速度与第三方安全评估,不是生成媒体模型。
  2. #22 @ctgptlb,2026-09-12,1,341 个赞/约 672,000 次浏览 —
    https://x.com/ctgptlb/status/2098917214741254175 — 日语概述称:“Sam、Elon、Dario が『AI開発のペースを落とす』方向で異例の一致”(Sam、Elon 与 Dario 罕见地在放慢 AI 开发节奏上达成共识)。
  3. #24 @BrianRoemmele,2026-09-12,658 个赞/约 94,000 次浏览 —
    https://x.com/BrianRoemmele/status/2098802245462827491 — “CHINA IS NOT 'PACING'. I have seen the next models they are releasing as well as the folded GPU chips they will release.” 对 Amodei 文章持怀疑态度的回应。
  4. #28 @TheJakeChristie,2026-09-13,8,456 个赞/约 199,000 次浏览 —
    https://x.com/TheJakeChristie/status/2098947959698124820 — 一张将“否则中国会赢”斥为 AI 监管转移话题的梗图。
  5. #35 @akshay_pachaar,2026-09-12,776 个赞/约 73,000 次浏览 —
    https://x.com/akshay_pachaar/status/2098675498742395373 — “11 LLM eval methods AI engineers must know”——关于 LLM 通用评估的技术帖子,并非图像/视频模型。

其中没有任何帖子提到扩散模型、视频生成器、闭源实验室的发布(例如图像/视频产品),或具名的开源图像/视频项目。它们之所以被列出,只是因为这是搜索结果中唯一与 AI 稍有关系的内容。

信号
  • 实际主题没有任何上升趋势。 在 40 条帖子与 10 个搜索词中,零条帖子讨论图像生成、视频生成、扩散模型或任何具名的闭源/开源生成媒体产品。
  • 本次采集实际呈现的内容,如果宽泛地算作“AI 新闻”,是围绕 Dario Amodei “Pace the Frontier” 文章的一波 2026-09-12 当日讨论——属于泛 AI 安全/监管话题,而非生成媒体新闻。这一波讨论产生了本次采集最高互动的单帖(约 6700 万浏览,而第二高仅约 67.2 万)。
  • 意外点:搜索词本身(Lando、LMEOW、Company OS、#bb28、solbiscuit 等)完全不对应本简报主题,看起来像是从另一研究主题遗留的词。这更像采集配置错配,而非 X 上没有相关讨论:X 很可能存在活跃的图像/视频生成 AI 讨论(模型发布、对比、作品展示),只是本次搜索完全没有查询到。
局限
  • 用于采集的搜索词与简报主题不匹配。 简报要求闭源与开源图像/视频生成 AI 新闻;但十个搜索词(“Lando”、“LMEOW”、“Slack”、“Company OS”、“Ireland”、“Dario”、“China”、“#bb28”、“Source”、“solbiscuit”)均不含图像/视频模型、实验室或生成 AI 产品名称。因此,这份文件无法报告完成标准所需的约 20 条主题相关帖子——源数据中根本没有。
  • 没有搜索图像/视频生成特定词(如模型名、实验室名、“text-to-video”、“diffusion”、具体开源项目名),因此无法依据这些数据说明 X 上实际主题讨论情况。
  • Explore 页趋势表(output/x.posts.md 第 13–24 行)也与简报无关,并且带有本次会话连接到 X 时所在地区的地理偏向(主要是“Trending in Croatia”,另有两项全球体育/政治趋势)——十个趋势中没有任何一项关于 AI。
  • 本文件透明呈现最接近的可用材料,而没有编造源数据中并不存在的图像/视频生成结论。

YouTube

YouTube — 图像与视频生成 AI 新闻汇总🔥

我在 YouTube 上大量搜索了图像生成与视频生成 AI(闭源/开源两边)的内容,整理如下!这个领域现在变化实在太快,追起来相当费劲😂🍌

频道

认真覆盖这个主题的频道如下👇

  • Matt Wolfe(Future Tools / @mreflow) — 订阅者超过 90 万的资深 AI 新闻频道。主要按周汇总并解读 AI 行业发布。https://www.youtube.com/@mreflow
  • Wes Roth(@WesRoth) — 约 32 万订阅者。专注深入分析 OpenAI、DeepMind 等动态,每周约更新 4 条。https://www.youtube.com/@WesRoth
  • Theoretically Media(Tim) — 现役影视创作者认真测评视频生成 AI 工具的频道。覆盖 Runway、Seedance 等商用产品,也覆盖 LTX-2 等 OSS。https://www.youtube.com/channel/UC9Ryt3XOGYBoAJVsBHNGDzA
  • SECourses(Furkan Gözükara) — 订阅规模约 3 万至 5 万,特别擅长 Stable Diffusion/FLUX/Qwen 系列的本地运行教程。https://www.youtube.com/@SECourses
  • Google DeepMind 官方频道 — 发布 Nano Banana Pro(Gemini 3 Pro Image)等官方演示视频。
  • 另外还有大量“AI Search”类、工具评测类中小频道,持续生产闭源与开源两大阵营的新闻内容(部分频道名称无法仅从视频标题确定→参见 Limits)。
视频
闭源类
  1. “Google Flow NEW Update Just Changed AI Video and Image Creation Quick Review – AI News 2026” — 频道不明(AI News 类)/2026 年 2 月 28 日/https://www.youtube.com/watch?v=SnRd9nn_644 — 介绍 Google Flow(Veo 整合工具)更新如何改变视频与图像创作。
  2. “Nano Banana Pro: Hands-on with the World's Most Powerful Image Model” — 2025 年 11 月 25 日/https://www.youtube.com/watch?v=hk6gwiZmSWA — 上手测试 Gemini 的 Nano Banana Pro(Gemini 3 Pro Image),认为其文字渲染和信息图制作能力很强。
  3. “Nano Banana 2 Is Incredible! (Gemini's New AI Image Model)” — 2026 年 2 月 26 日/https://www.youtube.com/watch?v=_oiBHvwTtGs — 介绍可通过 Higgsfield 使用的 Nano Banana 2。
  4. “Gemini's New Image Model is a Game-Changer! Here's Nano Banana!” — 2025 年 8 月 26 日/https://www.youtube.com/watch?v=wXYQEaWM-rw — 解读 Nano Banana(Gemini 2.5 Flash Image)刚发布时的影响。
  5. “Grok's New FREE AI Video Generator Is INSANE” & “Grok Imagine Video 1.5 vs Seedance 2.0 | Full AI Video Test” — 2026 年 6–7 月/https://www.youtube.com/watch?v=lrCjbL51dbkhttps://www.youtube.com/watch?v=5mFkZiRTVu4 — 对 xAI 的 Grok Imagine 1.5 与 Seedance 2.0 进行认真对比测试。
  6. 视频对比内容汇总(多个频道)— Veo 3.1 vs Sora 2、Seedance 2.0 vs Kling 3.0 vs Runway Gen-4.5 的对比内容大量涌现。Veo 3.1 主打 4K 与原生音频,Sora 2 主打物理模拟的真实感,形成不同定位。
  7. Adobe Firefly 视频生成相关解说视频群 — 2026 年上半年至 7 月/内容称 Adobe 引入“代理型 AI 助手”,整合 Kling 3.0、Ray3.14、Runway Gen-4.5、Sora 2、Veo 3.1 等模型,成为多模型环境。

⚠️重磅新闻:OpenAI 的 Sora 终止服务!2026 年 3 月 24 日通知开发者 → 4 月 26 日关闭应用与 Web 版 → Sora 2 API 也将在 2026 年 9 月 24 日完全结束(距离本报告发布仅 10 天!)。报道称每日运营成本为 100 万美元,总营收却仅 220 万美元,OpenAI 似乎将资金转向编程和企业业务。这是非常重大的消息。

开源类
  1. “Qwen-Image-Edit-2511 is now open source” — 2026 年 1 月 4 日/https://www.youtube.com/watch?v=UWy9Y1Ebjr4 — Alibaba 的最新版 Qwen-Image-Edit 开源。
  2. “Qwen Image Edit Review — Free Open-Source Alternative to Nano Banana”https://www.youtube.com/watch?v=Ur3udfFJ2QQ — 被介绍为 Nano Banana 的免费 OSS 替代方案。
  3. “Qwen Image-2512 First Test – The BEST Open Source Image Model!” — 2025 年 12 月 31 日/https://www.youtube.com/watch?v=SBaK616nP6Q
  4. “Run Qwen Image Edit (2509) LOCALLY” — 2025 年 10 月 1 日/https://www.youtube.com/watch?v=ET1g_3Z_c0k — 本地运行教程。
  5. “Tencent's Hunyuan Image to Video AI Avatar: FREE & Open-source!”https://www.youtube.com/watch?v=n4M3c81F1Jk — Tencent 的 OSS 模型,仅用一张照片加音频就能生成头像视频。
  6. “Image 2 Video Open Source Breakthroughs! Hunyuan and LTX .9.5”https://www.youtube.com/watch?v=HIFyz0BQfck
  7. “Wan 22 FLUX and Qwen Image Upgraded Ultimate Tutorial for Open Source SOTA Image and Video Gen Models”(SECourses 相关)— https://www.youtube.com/watch?v=3BFDcO2Ysu4 — Wan2.2、FLUX、FLUX Krea、Qwen Image 全面更新,汇总介绍开源 SOTA 图像与视频生成模型。
  8. “LTX-2 Explained & Showcased: The Open-Source AI Video Model”https://www.youtube.com/watch?v=qdIcpORz1Mw
  9. “The "Holy Grail" of Open Source AI Video is Here (LTX-2)”https://www.youtube.com/watch?v=27UAb_Tlv4E — Lightricks 的 LTX-2 支持原生 4K、50fps、音画同步,因此被称为“开源的圣杯”。
  10. “LTX-2 Released opensource!”https://www.youtube.com/watch?v=wXv4qhS4Oc0
  11. “Open Source AI Video BOMBSHELL From LTX & Minimax 2.3 Preview!”https://www.youtube.com/watch?v=N0XpMe94ENU
  12. “NVIDIA'S $5,000 GPU?! + LTX-2 Open Source Video AI is HERE!”https://www.youtube.com/watch?v=XXRZOCz0Tzs — NVIDIA 官方也在推动 LTX-2 的 ComfyUI 优化。

Wan 3.0 信息:2026 年 8 月 6 日,Alibaba 发布 Wan 3.0 公开测试版(30 秒/1080p/同步生成音频/支持文档输入)。但它主要通过 Runway 或 API 提供;与 Wan 2.2 及以前完全开放权重(Apache 2.0)的路线不同,其权重是否已公开仍待确认(YouTube 上也有多条视频讨论它是否会开源)。

信号
  • 😱 闭源阵营正在进行抢椅子游戏:随着 Sora 实质退场(4 月关闭应用、9 月底关闭 API),市场迅速收敛为 Veo 3.1、Seedance 2.0/2.5、Kling 3.0、Runway Gen-4.5 四强。YouTube 的对比视频也几乎都围绕这四者展开。
  • 🍌 Google 的“​​Nano Banana”系列正在成为图像生成领域的迷因和事实标准。从 Nano Banana → Nano Banana Pro → Nano Banana 2,更新速度极快,甚至许多视频标题都以“某某 vs Nano Banana”作为比较基准。
  • 🇨🇳 开源领域由中国厂商完全主导:代表包括 Alibaba(Qwen-Image、Wan)和 Tencent(Hunyuan)。SECourses 等硬核频道批量发布“本地运行”教程,是一大特征。
  • 🎬 LTX-2(Lightricks)正作为“开源视频生成首选”升温:原生 4K、50fps、音画同步等商用级规格以开源形式推出,显然带来强烈冲击,多频道用“Holy Grail”“BOMBSHELL”等标题词形容。
  • 🎧 同步生成音频是两大阵营共同趋势:Seedance 2.5、Veo 3.1、Wan 3.0、LTX-2 都在主打“一次生成画面+音频”。只生成视频画面的时代正在结束。
  • 💰 商业模式的冷暖分化非常明显:闭源侧以 Sora 关闭为象征,盈利面临挑战;Adobe 则以“商业安全性”为卖点,更偏向企业市场。开源侧以 Apache 2.0 系许可证为基础,社区与改造话题持续不断。
  • 🖌️ 图像编辑(Edit)比纯生成更热:Qwen-Image-Edit、Nano Banana Pro 的编辑能力等内容显示,视频和教程正在从“从零生成”转向“用自然语言编辑照片”。
局限
  • YouTube 搜索结果页(/results?search_query=...)与观看页均采用 JavaScript 渲染,即使直接抓取也无法取得实际视频列表、播放次数、订阅者数和评论,只会返回页脚导航链接。因此只能通过 site:youtube.com Web 搜索获得标题、频道、日期,绝大多数视频的播放量(views)无法确认
  • 部分视频的频道名称无法仅从搜索摘要确定,因此上述列表中存在“频道不明”的标记。
  • Wan 3.0 是否会像 Wan 2.2 以前一样以 Apache 2.0 完全开放权重,无法仅凭 YouTube 信息断言,需等待后续消息。
  • 相对于“分析约 20 条帖子”的目标,实际找到的闭源/开源 YouTube 视频与主题约为 19 条,基本达标;但受 YouTube 技术限制,无法直接打开每个视频页面精读描述和置顶评论,只能停留在搜索引擎返回的标题与摘要层面。

Bluesky

Bluesky — 图像与视频生成 AI 最新新闻

账号
  • @huggingfacetrends.bsky.social(每日 HuggingFace 趋势)— 每天机器人发布 5 个 Hugging Face 趋势仓库。它是追踪开源新模型动态最有用的账号。 https://bsky.app/profile/huggingfacetrends.bsky.social
  • @stabilityai.bsky.social — Stability AI 官方账号。发布偏新闻稿风格的帖子(Stable Audio、Bedrock 合作、与唱片公司的合作等)。 https://bsky.app/profile/stabilityai.bsky.social
  • @midjourneyofficial.bsky.social — Midjourney 官方账号(以“Midjourney”名义运营,2025 年 8 月宣布进入 Bluesky)。更新频率较低。 https://bsky.app/profile/midjourneyofficial.bsky.social
  • @civitai-bot.bsky.social — 自动发布 Civitai LoRA/检查点更新的机器人。自 2024 年 5 月起停止更新,目前似乎已经失活。 https://bsky.app/profile/civitai-bot.bsky.social
  • @curieuxexplorer.bsky.social 等自称“Creator Partner(CCP/CPP)”的创作者 — 有大量个人账号以 Runway、Kling AI、Luma、Pika、Hailuo、Vidu、Freepik 的“官方大使”身份发布作品。内容主要是推广与案例展示,不是新闻。 https://bsky.app/profile/curieuxexplorer.bsky.social
  • @blackforestlabs.bsky.social@runwayml.bsky.social@klingai.bsky.social 等主要企业名账号确实存在,但其时间线为空或与本人无关,基本没有实际信息输出。
帖子
  1. Lightricks/LTX-2.5(开源视频生成模型)持续占据 Hugging Face 趋势第 1 — 从 2026-09-07 到 09-13,至少连续 5 天出现在趋势帖子中(README 摘要显示获取失败,但属于 Lightricks 开源视频生成模型系列)。09-13,likes 0 / reposts 0。 https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mvfrl5gc5z2l
  2. Qwen/Qwen3.8-27B(支持图像与视频理解的开放视觉语言模型)反复进入趋势 — 09-06、09-08、09-10、09-12 共发帖 4 次。介绍称其擅长编程、研究与多步骤任务。09-12,likes 0 / reposts 0。 https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mvd6mv6ac72l
  3. deepseek-ai/DeepSeek-V4.1-Flash(图像支持型多模态 MoE) — 于 09-10 和 09-12 发帖,介绍其最高 100 万 token 上下文与 FP4 缓存压缩。09-12,likes 0 / reposts 0。 https://bsky.app/profile/huggingfacetrends.bsky.social/post/3mvd6csnao42h
  4. deepseek-ai/DeepSeek-V4-Flash-Vision-Exp(加入视觉能力的实验模型) — 09-07 发帖。介绍称该模型在保持文本性能的同时增加视觉理解和多模态代理能力。likes 0 / reposts 0。 https://bsky.app/profile/huggingfacetrends.bsky.social/post/3muwta6mwoi2g
  5. zai-org/GLM-5.3-Flash(GLM-5 系列首个原生多模态模型) — 09-06 发帖。介绍称总参数 320B、激活 18B,以较低成本实现超过 GLM-5.2 的性能。likes 0 / reposts 0。 https://bsky.app/profile/huggingfacetrends.bsky.social/post/3muu3pjpou62n
  6. Stability AI 开始在 Amazon Bedrock 提供 Image Services — 闭源侧的企业拓展,公告称“在 Bedrock 上提供专业级图像编辑能力”。2025-09-18,likes 0 / reposts 0。 https://bsky.app/profile/stabilityai.bsky.social/post/3lz5eotkuvk2i
  7. Stability AI 与 Universal Music Group、Warner Music Group 合作 — 并非直接的图像/视频生成新闻,而是生成式 AI 与大型唱片公司的合作,偏音频领域,但可反映闭源大厂的业务动向。2025-10-30 / 2025-11-19,likes 1 / reposts 0。 https://bsky.app/profile/stabilityai.bsky.social/post/3m4fwolv4k22z
  8. Midjourney 官方宣布 Style Explorer 功能 — “可像探索视频与图像页面一样探索风格”的新功能。2025-09-18,likes 10 / reposts 2。 https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lz5cskktzk2c
  9. Midjourney 官方宣布加入 Bluesky — “我们来到 Bluesky 了,告诉我们该关注哪些创作者”的首帖。2025-08-15,likes 41 / reposts 4(这是该账号互动最好的帖子)。 https://bsky.app/profile/midjourneyofficial.bsky.social/post/3lwi222j4sk2b
  10. Civitai 机器人最后一批帖子(2024 年 5 月) — 持续通知基于 SD1.5/Pony 的个人 LoRA 和合并模型更新,点赞通常为 0~3。它留下了开源草根模型共享文化的记录,但近一年已沉寂。 https://bsky.app/profile/civitai-bot.bsky.social/post/3ks2nnatkqi24
信号
  • 在 Bluesky 上,真正发布图像/视频生成 AI “新闻快讯”的,基本仅限接近机器人的账号(huggingfacetrends、civitai-bot)以及公司官方公关账号(Stability AI、Midjourney)。没有看到 X/Reddit 那种实时讨论串的热度。
  • 讨论中心是能“理解”内容的模型增长,即视觉语言、多模态理解模型。中国的大型开放权重模型 Qwen3.8-27B、DeepSeek-V4 系列、GLM-5.3-Flash 连日占据 Hugging Face 热门;真正纯粹的图像/视频生成开源模型中,Lightricks/LTX-2.5 持续进入趋势。
  • 闭源厂商(Stability AI、Midjourney)的发布以企业整合(Bedrock、唱片公司合作)与低调功能更新为主,在该期间未确认重磅新模型发布。
  • 自称 Midjourney、Runway、Kling AI、Luma 等“Creator/Community Partner”的个人账号极多,成为案例发布与推广中心;但内容更像作品展示而非新闻,且不少内容可追溯到 2024 年底。
  • 存在多个冒用/相似的官方企业账号(runwayml.bsky.social、klingai.bsky.social、real-comfyui.bsky.social 等),它们要么没有帖子、要么内容无关,可能是仿冒或抢注用户名,需注意。
局限
  • Bluesky 官方网站(bsky.app)是客户端渲染的 SPA,因此直接获取搜索页或帖子页时,无法取得正文、点赞数、日期等内容(WebFetch 不执行 JS)。
  • 公开 API public.api.bsky.app/xrpc/app.bsky.feed.searchPosts(关键词全文搜索)通过 WebFetch 持续返回 403 Forbidden,最终无法使用。同域的 getProfilegetAuthorFeedsearchActors 则可正常运行,似乎只有搜索端点被拦截。
  • 嵌入镜像(如 fxbsky.app)在常规请求下会重定向到 bsky.app,无法取得内容。
  • 因上述限制,放弃关键词全文搜索,改为“账号搜索 → 有潜力账号的 getAuthorFeed”绕行收集实际帖子。因此,虽然确认了 20 个以上账号与帖子,但样本偏向于“已找到账号的帖子”,无法掌握 Bluesky 全站的跨关键词讨论量或爆款帖子。
  • 已确认 Runway、Black Forest Labs、Kling AI、ComfyUI 等主要参与者的“疑似官方”账号存在,但由于时间线为空(无帖子),本次没有取得这些企业在 Bluesky 发布的第一手信息。

Lemmy

Lemmy — 图像与视频生成 AI 在 Lemmy 上没有形成“热潮”

社群
  • !«メールアドレス»(通过 lemmy.world 浏览)— 5.71K subscribers(其中 lemmy.world 本地 1.23K)。简介:“Discuss matters related to our favourite AI Art generation technology”。https://lemmy.world/c/«メールアドレス»
  • !«メールアドレス»(通过 lemmy.world 浏览)— 8.53K subscribers(其中本地 2.34K)。https://lemmy.world/c/«メールアドレス»
  • !«メールアドレス» — 访问时返回 HTTP 500,无法确认内容(见下方 Limits)。https://lemmy.world/c/ai_art
  • !«メールアドレス» — 88,016 subscribers。并非图像/视频生成 AI 专属,但偶尔会流入新闻链接。
  • !«メールアドレス» — 8,208 subscribers。面向讨厌 AI 热潮、尤其反感以营利为目的销售 LLM/GPT 技术的人群。对图像/视频生成 AI 的反感也会流入这里。
  • !«メールアドレス» — 41,395 subscribers。并非生成 AI 专属,但偶尔会出现征集观点的讨论串。
帖子
  1. !«メールアドレス» 的时间线是机器人镜像,人类对话几乎为零 — 无论按 New 还是 TopMonth 查看,最近 20 条帖子都是直接搬运 GitHub/HuggingFace 模型和工具发布的自动转发,评论数几乎全部为 0,分数也在 1~10 左右。例如:Lightricks/LTX-2.5-22b-IC-LoRA-Ingredients(2026-09-12,score 3,0 评论,https://huggingface.co/Lightricks/LTX-2.5-22b-IC-LoRA-Ingredients)、lightx2v/Minimax-h3-Turbo - 8 step 768p V1.0 LoRA released(2026-08-27,score 6,0 评论,https://huggingface.co/lightx2v/Minimax-h3-Turbo)、Viggle/Viggle-Animate(2026-09-05,score 10,0 评论,https://huggingface.co/Viggle/Viggle-Animate)。MiniMax-H3 系 LoRA/适配器群、ComfyUI 节点扩展(ComfyUI-VDN-H3-24GBComfyUI-InpaintCanvasComfyUI-Tab-Sticky-Extention 等)每天都在出现,说明开源开发本身活跃,但它并未作为讨论空间发挥作用。
  2. “Did you know?” («メールアドレス»,!«メールアドレス»,2026 年 8 月下旬左右=获取时 19 天前) — score 39(联邦显示为 55 up/16 down),3 条评论。面对 AI 生成的“趣味事实”图片,评论带有嘲讽意味:“语法奇怪(Have you know?)”“Artificial Intelligence meets Natural Stupidity”。唯一比较实用的评论认为,AI 应用于完善成品,而不是用于构思。 https://lemmy.world/post/51117779
  3. “What's your overall opinion on generative AI?” (LeftReddit2,!«メールアドレス»,获取时 10 天前) — score 54 up/9 down、49 条评论,是本次调查中讨论最热的帖子。发帖者坦言,自己起初对 ChatGPT/DALL-E 感到兴奋,但从 2024 年起转为怀疑。高赞评论总体持负面态度:批评未经许可训练、使用“AI psychosis”一词、担忧作家工作被夺走等。 https://lemmy.world/post/51505799
  4. “Gen Z's AI backlash is getting louder” («メールアドレス»,World News,获取时 4 个月前) — score 125 up/1 down,5 条评论。分享了一篇讨论生成式 AI 世代反弹的文章。评论区转向讽刺 AI 数据中心与“世界 vs 1%”的阶级对立语境。 https://lemmy.world/post/47211056
  5. “Found a 3 year old SD install on my computer, so here is some vintage Dreamshaper 7” («メールアドレス»,!«メールアドレス»,获取时 2 个月前) — score 6,0 条评论。怀旧帖,显示老牌开源 SD 用户仍在低调持续使用。 https://lemmy.world/post/48977635
  6. “Modern Tram - generated by Lumo (the proton ai)” («メールアドレス»,!«メールアドレス»,获取时 1 个月前) — score 0,6 条评论。使用 Proton 的 Lumo AI 生成的图片。对作品本身反应不强,但评论讨论了 AI 服务的选择,如偏重隐私的 Proton。 https://lemmy.world/post/50175271
  7. “It's like an album cover...” («メールアドレス»,!«メールアドレス»,获取时 1 个月前) — score -8,1 条评论。为数不多的负分帖子之一,象征着对 AI 生成艺术整体的冷淡反应。 https://lemmy.world/post/50411980
  8. 即使直接搜索 Sora/Veo/Midjourney/Grok Imagine 等热门商用模型名称,在 lemmy.world 也未见近期独立帖子 — 搜索结果仅有旧的 Sora 帖子(约 2023~2024 年的 OpenAI 批评文章分享,例如:https://lemmy.world/post/44721138 的“OpenAI 决定停止 Sora”相关帖子),或无关结果(如另一个网站的 “#BringSoraHome” 人权活动帖子)。在搜索范围中,未发现 2026 年 9 月时点对 Sora2/Veo3/Nano Banana/Flux.2/Qwen Image/Wan 2.5/Seedream 等最新模型的提及。
信号
  • Lemmy 的图像生成 AI 社群呈现“开发信息流”与“反 AI 情绪表达场”两极。!«メールアドレス» 中,HuggingFace/GitHub 新模型、LoRA、ComfyUI 节点的自动转发机器人占据大多数帖子,几乎没有评论(没有讨论)。
  • 相反,在 !«メールアドレス»、!«メールアドレス» 和新闻类社群中,对生成式 AI(包括图像、视频)的负面观点更显著,评论主要围绕未经许可训练、环境成本与“slop”(AI 生成内容质量低)展开。
  • !«メールアドレス»、!«メールアドレス»、!«メールアドレス» 等主要梗图社群在规则中明确禁止 AI 生成内容,表明 Lemmy 整体文化对生成式 AI 内容有强烈排斥感。
  • 在搜索范围内,未找到闭源最新模型(Sora 2、Veo 3、Midjourney 最新版、Grok Imagine 等)的独立新闻或讨论帖子。在 Lemmy 中,比起商用模型发布本身,对 AI 生成物的社会与伦理反应更容易成为话题。
  • 开源侧(MiniMax-H3 系列、LTX、ComfyUI 扩展等)的开发活跃,但更多表现为“面向工具开发者的更新通知流”,没有扩展为普通用户话题。
局限
  • Lemmy 规模很小,没有发现活跃的图像/视频生成 AI 专属讨论社群。简报要求的“约 20 条帖子”所需高质量独立内容(排除自动转发与零评论)本身就不存在。
  • !«メールアドレス» 访问时返回 HTTP 500,无法确认内容。
  • 也尝试了对 lemm.ee、lemmy.ml 进行直接搜索,但 API 查询(q=image generation AI / video generation AI)经常返回相关性很低的结果(无关政治文章、游戏评测等),说明 Lemmy 搜索 API 的相关性排序较弱。因此没有凑数,只列出实际确认过内容的帖子。
  • 在 Lemmy 上,无论通过搜索引擎还是 API,都未找到对 Sora 2、Veo 3、Nano Banana、Flux.2、Qwen Image、Wan 2.5、Seedream 等 2026 年最新模型的直接提及。这一结果本身也说明它们在 Lemmy 上没有成为话题。

Pinterest

Pinterest — 图像与视频生成 AI 新闻

共收集到 50 个 Pin!没有按类型分组,全部集中在一个组(g01),所以这里统一看👇

视觉主题 🎨
  • “惊叫男子脸+大字 AI NEWS+一排公司 logo”类缩略图非常多:OpenAI 漩涡 logo、Google 的 G、Microsoft 窗口、Meta 的 ∞、DeepSeek 鲸鱼、Nvidia logo 是常见组合。人物通常统一为“真的假的!?”般的惊讶表情 [5, 17, 24, 37, 44]
  • “最佳 AI 视频工具 N 选”信息图以不同配色批量生产:Runway、Pika、Kling AI、Luma Dream Machine、Canva AI、Hailuo AI 的组合几乎反复复制粘贴。CapCut、Synthesia、HeyGen、Descript 通常作为剪辑/虚拟人类别补充 [9, 10, 21, 29, 47]
  • 蓝紫色霓虹发光机器人/赛博人脸库存图,大量用作批量 Pin 的封面:它们与新闻本身似乎没有直接关系,只是被反复当作“看上去很 AI”的配图 [2, 36, 42, 49, 50, 45]
  • 对于“这可能是 AI”的焦虑与验证类视觉:假货印章、97% 虚假判定条、“Human Journalism” vs “Machine-Generated Media”对比图等,均以图像方式表达了对虚假检测与可信度的担忧 [4, 11, 40]
  • 闭源大厂(Google、ByteDance、ShengShu)的官方宣传静帧有统一的电影感:Veo 2/3 以狗在水中游泳、火烈鸟等“炫技式”写实演示为主;Seedance 2.5 用金色西装男性视觉宣传“一个人完成一部电影”;Vidu S1 则主打赛博朋克动漫少女 [3, 6, 8, 13, 33, 48]
  • 技术解说图表数量较少但信息扎实:扩散模型管线图(Text Embedding→64x64→1024x1024)与生成式 AI 历史时间线(从 1950 年代 ELIZA 到 2020 年代 GPT)是相对少见、内容更硬核的信息图 [31, 43]
  • 新闻汇总报纸/杂志 mockup 风格:以“THE AI DISPATCH”“Today's AI News”等虚构报纸设计,排列 Open Models、Sovereign AI、AI Agents 等关键词的风格也出现了多次 [32, 39]
值得注意的 Pin 📌
  1. [1] Hollywood Reporter Interviews the First AI Actress… — 电视节目《The View》的截图,Instagram“@tillynorwood”的 AI 生成图片上覆盖红色“AI-GENERATED IMAGE”横幅。AI 演员(Tilly Norwood)争议已进入电视主流视野,这张图尤其直观。
  2. [28] ByteDance and Hollywood reach global deal on AI copyright — 关于 ByteDance 与电影协会(MPA)就 AI 图像/视频生成工具的版权保护达成协议的新闻截图。可见闭源大厂与传统媒体产业间的力量关系正在改变。
  3. [48] 🐉 China Just Took AI Video Too Far|ByteDance Seedance 2.5 — 用“一台笔记本=一部电影”的文案,搭配华丽男性视觉宣传 ByteDance 的 Seedance 2.5,是渲染中国闭源模型势头的标题。
  4. [33] Vidu S1 — The World's Most Advanced Model for Real-Time AI Interaction — 中国 ShengShu Technology 的实时 AI 模型。采用赛博朋克风动漫少女视觉,似乎主打角色一致性。
  5. [13] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — 宣传 Google Veo 3 可通过 Gemini API 实现图像转视频与原生音频生成。
  6. [31] OpenAI's Secret Image Generation Tool to Debut Soon — 关于 OpenAI 未发布图像生成工具的传闻 Pin。内容较薄弱,但期待感很强。
  7. [6] “木材块化”“折纸化”“乐高化”“花朵化”转换演示 — 将同一人物/汽车视频实时转换为木材、折纸、彩色积木、花朵等多种材质的演示网格。这是风格转换 AI 视频技术中最精心制作的展示之一。
  8. [40] AI IS CHANGING EVERYTHING — 信息图中展示 AI 音频检测工具判定“97% LIKELY AI GENERATED”。生成与检测的军备竞赛被视觉化。
  9. [11] New York's Bold Gambit: Inside the Legislative… — 将自由女神像、议会大厦与“Human Journalism” vs “Machine-Generated Media”并置的图片,暗示对 AI 生成新闻的监管正在推进。
  10. [41] Nvidia #NEW AI Tools — 一张身穿黑色皮夹克的男性(很像 Jensen Huang)演讲照片。作为从硬件侧(GPU)切入的 AI 新闻,颇为显眼。
信号 📡
  • 闭源 video model 战争完全占据主角:Google Veo 2/3、ByteDance Seedance 2.5、ShengShu 的 Vidu S1 等大厂新模型公告 Pin 排列密集,企业 logo(尤其 OpenAI、Google、Nvidia、DeepSeek)也成为 AI News 类缩略图的“门面”。
  • 对“看起来太真实”的焦虑已成为固定主题:虚假检测条、假货印章、“Human vs Machine”对比图以及 AI 演员 Tilly Norwood 争议,都说明生成内容的真实性问题在 Pinterest 也成了常见话题。
  • 版权与监管开始作为新闻类 Pin 零星出现:如 ByteDance×MPA 版权协议、纽约州立法动向等,显示氛围已从“能生成”转向“如何监管”。
  • 不过 Pinterest 整体仍明显带有“汇总/工具介绍”型 SEO 与联盟营销色彩:同样的 Runway/Pika/Kling/Luma/Canva/Hailuo 工具组合被反复使用,重点不是即时新闻,而更像“收藏版工具清单”。
  • 开源侧存在感相当低:Stable Video Diffusion、Wan、HunyuanVideo 等开放权重模型通常只在工具列表中一笔带过,没有独立新闻 Pin。扩散模型技术图解 [31] 几乎是唯一偏开源技术的严肃内容。
局限 🚧
  • Pinterest 的采集方式是读取由 worker 使用无头浏览器预先抓取的内容;此次并未自行搜索或浏览 Pinterest(遵循 playbook)。
  • 没有进行类别划分,全部 50 条都归为单一组(g01),无法比较按主题划分的明细。
  • 有 5 个 Pin 标题为“(untitled)”([3, 12, 18, 24, 28... ] 中实际为 [3, 12, 18, 24, 32] 等),部分语境只能从图片推断。尤其 [24] 可读取的文章内容很少,细节不明。
  • 许多 Pin 是“最佳工具 N 选”类型的联盟营销/博客图片,没有进一步阅读发布日期和第一手来源链接中的正文(仅根据图片内文字判断)。
  • 关于闭源/开源各至少 10 条洞察的整体完成标准,预期应与 Reddit、X、YouTube、Bluesky、Lemmy 等平台结果合并满足。Pinterest 单项的目的在于掌握“当下流行什么样的视觉呈现”,因此未特别出现链接失效或加载失败问题。

建议行动

  • 视频制作工作流应以“用图像模型确定角色 → 用视频 AI 动画化”的两阶段流程为前提进行验证和比较。
  • 开源视频的 PoC 应优先评估 LTX-2 系列与 Wan 系列,并持续关注 Wan 3.0 的许可证公告。
  • 闭源视频应以 Seedance 2.5、Veo 3.1、Kling 3.0、Runway Gen-4.5 四强为核心,并将价格差异(Seedance 约为 3 倍)纳入成本比较。
  • 对宣称“无限量”的闭源订阅服务,签约前务必确认实际生成上限与等待时间。
  • 针对生成内容的法律风险,应更重视“分发/分享”环节的责任,制定内部运营规则。
  • 下次收集 X 内容时,应将搜索关键词替换为图像/视频生成 AI 相关词(模型名、实验室名等)。

收集图片

Hollywood Reporter Interviews the First AI Actress...🎨 AI Image and Video CreationimageAI content and social media concernsAI News: Anthropic Leak Shows Us The Future of AI...Google announces ultra-high quality video...Adobe develops an AI model for video upscaling, turning blurry footage into HD qualityGoogle Unveils Veo 2: Advanced AI Video Generation Tool with Enhanced Realism and Cinematic FeaturesJust Nail It 🎥🎬 2026 年 10 款免费 AI 视频工具 🤯 无需昂贵软件即可制作视频!New York's Bold Gambit: Inside the Legislative...imageVeo 3 Image-to-Video: Fast Generation & Native Audio via Gemini APIAI 内容创作概念:用于文本、图像、音乐和视频生成的图标;人工智能图像 – 浏览 57 张库存照片、矢量图和视频用于图像和视频生成的 AIAI 卡通 YouTube 频道头像被封禁AI 新闻:OpenAI 终于发布了我们想要的东西imageAI 生成视频:好还是坏?这是真相!🤖🎥内容创作者的秘密武器:AI 驱动的视频生成AI 视频编辑工具——创作者在 2026 年实际用于制作内容的工具TotalYmage 革新互动视频...什么是 Imagvio AI,以及它如何帮助创作者...image2025 年顶级 AI 视频生成器了解 Grok 如何革新视频...7 款最佳 AI 婴儿生成器:预测孩子的脸(2026)image2026 年 5+ 个最佳 AI 视频生成网站 | Runway、Pika、Kling AI、Canva 等AI 驱动的图像和视频分析OpenAI 的秘密图像生成工具即将亮相imageShengShu Technology 发布 Vidu S1,将实时交互式生成带入 AI 视频AI 如何改变视频编辑Google 让图像及……的 AI 水印变为可选专业 AI 视频创作 | 电影级 AI 视频 | 定制视频编辑AI 新闻:现在大家都在生 Anthropic 的气 |掌握视频与 AI:2025 年关键社交媒体营销趋势本周 AI 新闻 - 2026 年 8 月 15 日‎🚨 AI 正变得可怕地逼真。Nvidia #NEW AI 工具 🤯 #news #ai #openai #chatgpt #highlights #shorts包含国家和世界地图的时事图片生成式 AI 的历史人工智能:让我们保持我们的……AI 图像生成Klarna 在意识到……的程度后转向AI 视频创作:用 AI 更快制作专业视频的完整指南🐉 中国把 AI 视频推得太过头了 | ByteDance Seedance 2.5 #aivideo #usa“用个性化 AI 驱动的 4K 视频改变你的创意 🎥✨”AI

数据质量说明

由于 X 的搜索关键词配置与主题无关,因此图像/视频生成 AI 相关帖子为零;Lemmy 也缺少活跃的专属社群,未达到“20 条”目标。Reddit、Bluesky、YouTube、Pinterest 大体收集到了有效数据,但 Bluesky 搜索 API 的 403 错误以及 YouTube 的 JS 渲染限制,仍造成了一部分技术性遗漏。

图库