图像与视频生成 AI 新闻 — 2026-09-12
开源阵营,尤其是中国团队的 Z-Image、Qwen-Image 和 MiniMax-H3,在盲测中正逼近闭源模型;Google 则凭借 Nano Banana/Veo/Gemini Omni 全面出击;而 OpenAI 的 Sora 因模型从价格页移除及负责人离职,显露出放缓迹象。
图像与视频生成 AI 新闻汇总 — 2026-09-12
嗨!这次我认真调研了 Reddit、X、YouTube、Bluesky、Lemmy、Pinterest 六个平台上的图像与视频生成 AI 动态🔥 结论先说:闭源阵营里 Google 正在以满火力同时推进图像和视频,而 OpenAI 的 Sora 看起来有些放缓😳;开源阵营则由中国团队(Qwen、Z-Image、MiniMax、Wan)在盲测中强势逼近,局势相当火热🔥🔥 不过,X 的调研完全扑空,没收集到任何图像或视频生成 AI 相关内容,所以这里会如实说明这个明显缺口💦 此外,所有平台都在热议“这是不是 AI?”这一类真实性与可信度焦虑,传播力度甚至超过模型性能话题,多少有些出人意料👀
跨平台观察
- 开源阵营的主角已完全是中国团队🇨🇳:YouTube、Bluesky、Lemmy 三个平台都独立地将 Qwen-Image、Z-Image(Turbo)、MiniMax(H3/Hailuo 3.0)和阿里巴巴 Wan 称为“新王者”。Bluesky 的盲测排行榜显示,Qwen-Image-3.0-Pro 与 GPT Image 2(high) 的差距仅剩 92 Elo 分,这确实很惊人(https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t)。
- Google 同时押注图像与视频,全面进攻:YouTube 上有 Veo 3.1 的评测(https://www.youtube.com/watch?v=sTOFXi2eY_k)、Teacher's Tech 对 Nano Banana 2 的介绍(https://www.youtube.com/watch?v=nikIxHM_AQY);Bluesky 还报道称搭载“Gemini Omni”的 Windows 桌面应用已经推出(https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n),这种全方位布局非常强势💪
- “识别 AI”类内容真的很受欢迎:Reddit(r/isthisAI)的鉴定帖(https://www.reddit.com/r/isthisAI/comments/1wbspxo/)与 Pinterest 上的深度伪造/AI 声音检测信息图都分别受到关注,真实性焦虑已成为跨品类主题。它们的传播力超过模型性能新闻,颇令人意外。
- “无限”“联盟营销”类营销话术在各处都受到警惕:Reddit 中有人评论称,宣称“unlimited”的网站大多近似骗局(#4,r/generativeAI);Bluesky 上 circuitai.bsky.social 对 WAN 3.0 的同文案刷屏(每天超过 15 次)也是同一种模式。用户对这类宣传口号显然保持怀疑😤
- 普通用户并不太区分开源与闭源:Reddit 的工具求助帖中,Qwen、Flux、Seedream、Veo、GPT Image 被并列列为“可用模型”;几乎没有评论特别强调两者的区别。用户实际感受与简报所要求的双轴分类之间存在不小落差。
按平台分析
Reddit — 共收集 12 个帖子(未达到约 20 条的目标)。传播最广的并非新模型消息,而是一则关于让 GPT-6 操作鼠标、制作伪造手绘延时视频的帖子(r/antiai,7,146 分,https://www.reddit.com/r/antiai/comments/1w81kdd/),体现出人们对 AI“欺骗性”的愤怒。多个帖子还独立提到无审查、支持 NSFW 的整合平台(WildOwl.ai、cyberbara、Tensor.art 等),显示出这类需求的存在。
X — 完全扑空😭 收集到的 40 条内容大多是也门局势、$SONG 迷因币或切尔西足球俱乐部,图像与视频生成 AI 相关帖子为零。原因是所用搜索词本身与本次主题偏离;下次应改用 Midjourney、Sora、Runway 等具体产品名称进行搜索。
YouTube — 本次信息量最大✨ 闭源阵营中,GPT Image 2/2.5 在 Artificial Analysis Image Arena 位居第一(Elo 分数 1,339,创下该榜单第一与第二的最大分差,https://www.youtube.com/watch?v=DY6TkI8XtkQ);Veo 3.1 强化了口型同步;字节跳动 Seedream 5.0 Pro 被称为碾压现有模型(https://www.youtube.com/watch?v=WpcxwSNT3X4)。开源阵营中,Black Forest Labs FLUX.2 被讨论为“新王者”(https://www.youtube.com/watch?v=YQuTkPVkCS8),阿里巴巴 Z-Image Turbo 被称为本地模型 KING(https://www.youtube.com/watch?v=K0FgDU-9uik),Lightricks LTX-2 更被称作“开源视频的圣杯”。
Bluesky — Sora 似乎正在明显放缓👀 除了有人发现 sora-2、sora-2-pro 被悄悄从价格页移除(https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23),还出现了前 Sora 负责人 Bill Peebles 与好莱坞大人物合作成立独立初创公司的独家消息(https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n)。开源侧则几乎被中国团队的 Qwen、Z-Image、MiniMax、WAN 3.0、SenseNova-U1.5 占据。
Lemmy — 平台规模较小,实际上高度依赖 Even_Adder 一个人的策展😅 不过闭源侧最震撼的新闻是:Midjourney 据称从图像生成转向“医疗水疗业务(超声波 CT 扫描)”(https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429)。有人讽刺其为“Theranos 重演”。开源侧,围绕 MiniMax-H3 的 ComfyUI 工具和量化工具一周内发布超过 7 项,生态系统正在爆发。
Pinterest — 人工查看了全部 50 个 Pin👀 闭源商业工具(Runway、Pika、Kling AI、Luma、Canva、Hailuo、Synthesia)几乎每次都会出现在排行类信息图中;几乎看不到开源相关内容。虽然也有 Google Veo 2/3 的官方推广素材,以及字节跳动与好莱坞(MPA)版权协议等真实新闻(#31),但大多数是面向 SEO/联盟营销的批量缩略图。“YouTube 超过 20% 内容由 AI 生成”的具体数据 Pin(#44)也在其中。
值得关注
- Sora 的放缓是否属实 — Bluesky,对价格页模型移除的监测(https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23)
- Qwen-Image-3.0-Pro 能将与 GPT Image 2 的差距缩小到何种程度 — Bluesky,盲测排行榜(https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t)
- MiniMax-H3 生态扩张速度 — Lemmy,ComfyUI 周边工具群(https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA)
- Midjourney 医疗水疗业务的后续发展 — Lemmy,TheRegister 文章(https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429)
- FLUX.2 / Z-Image Turbo “本地王者”之争的结果 — YouTube(https://www.youtube.com/watch?v=YQuTkPVkCS8, https://www.youtube.com/watch?v=K0FgDU-9uik)
- 无审查、NSFW 整合平台(WildOwl.ai 等)的洗牌趋势 — Reddit(https://www.reddit.com/r/AItips101/comments/1w9yftp/)
建议
- 下次调研 X 时,不应再使用趋势词,而应使用 Midjourney、Sora、Runway、Kling、Flux、ComfyUI 等具体名称重新搜索。
- 应持续关注 Bluesky 上监测价格页的账号,以核实 Sora 的动向。
- 追踪开源/闭源性能差距时,持续观察 Qwen-Image-3.0Pro 对 GPT Image 2 的 Elo 分数变化,是最直观的指标。
- Midjourney 转向医疗业务,值得作为经营战略新闻而非技术新闻持续跟踪。
- 下次 Reddit 收集应增加搜索词,力争从 12 条达到约 20 条的目标。
- Pinterest 的排行信息图与 Bluesky 的联盟营销连发内容,不应单独采信;只有在其他平台得到交叉验证后才应采用。
数据质量
由于搜索词选择错误,X 没有获取到任何图像或视频生成 AI 相关帖子,因此对本主题实质上没有数据。Reddit 仅收集到 12 个帖子,未达到约 20 条的完成标准,且内容更偏“工具推荐咨询”而非“新闻”。Pinterest 的原始数据没有开源/闭源分类,需要人工重新分类。Lemmy 是一个小规模平台,实质上依赖单一账号(Even_Adder)的策展。YouTube 页面采用 JS 渲染,WebFetch 无法获取正文;播放量与订阅数即使通过 oEmbed 也无法取得。Bluesky 在部分关键词(Runway、Kling、Black Forest Labs)上持续出现 403 错误,因而放弃收集;WAN 3.0 相关内容也被垃圾账号的连发淹没,需要折价看待。
按平台汇总
Reddit — 图像与视频生成 AI 新闻
来源
收集到的 12 个帖子分布于以下 9 个子版块。
| 子版块 | 成员数 | 收集帖子数 |
|---|---|---|
| r/isthisAI | 408,823 | 1 |
| r/antiai | 322,973 | 1 |
| r/GetNoted | 298,488 | 1 |
| r/generativeAI | 152,415 | 3 |
| r/aiwars | 167,809 | 1 |
| r/hatethissmug | 134,660 | 1 |
| r/aivideomaking | 6,823 | 2 |
| r/GoogleFlow | 1,884 | 1 |
| r/AItips101 | 1,299 | 1 |
讨论生成 AI 本身利弊的大型子版块(r/antiai、r/aiwars、r/isthisAI、r/GetNoted)参与度突出;而工具介绍、推荐类的中型子版块(r/generativeAI、r/aivideomaking)则更能反映实际工具动向。
用户观点
- 【#6,r/antiai,7,146 分 / 1,025 条评论,2026-09-05】一则帖子称,给 LLM(标为 GPT-6)授予鼠标和键盘操作权限后,它能够在数字画板上“手绘”,甚至伪造延时视频。最高赞评论(2,511 分,u/Nayutantantan)愤怒表示:“我甚至都不想再为自己的作品拍延时视频了,因为假延时已经变得司空见惯。”仅此一帖就获得了本次收集内容中压倒性的互动量。 https://www.reddit.com/r/antiai/comments/1w81kdd/
- 【#11,r/GetNoted,4,470 分 / 325 条评论,2026-09-10】一则使用 AI 生成图像的 X 帖子引发争议,图中的日程图像带有类似“Handloags”的乱码。热门评论都将 AI 生成内容本身的粗糙感当作笑料。 https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
- 【#1,r/AItips101,145 分 / 83 条评论,2026-09-07】“2026 年无审查 AI 图像生成排行榜”。排名第一的 WildOwl.ai 被介绍为可按量付费访问超过 35 个模型,包括 Qwen Image、Flux、Seedream、Wan、Kling、Seedance、Veo、GPT Image 等;无需月费,积分永不过期。评论者 u/reliablemicrophone84(4 分)认同称,自己曾因其他平台的过滤机制浪费积分;但 u/Pretend_Program_3696(3 分)推荐 Perchance/Uncensored.ai,意见并不一致。 https://www.reddit.com/r/AItips101/comments/1w9yftp/
- 【#8,r/aivideomaking,4 分 / 21 条评论,2026-09-09】面对“寻找免费/积分制的写实图像与视频生成工具”的提问,用户列出 OpenartAI、fal、dzine、pixverse、Higgsfield、RunningHub(可通过 ComfyUI 使用开源和闭源模型);u/zeroludesigner 则称 cyberbara 的 Seedance 2.5 无审查并支持真实人脸。 https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
- 【#3,r/generativeAI,0 分 / 7 条评论,2026-09-11】寻找可在浏览器中使用、支持 NSFW 的图像/视频生成工具的帖子。u/MisterZan25 整理介绍了 RunDiffusion/Tensor.art(图像和角色一致性)、PornGen/PornJourney,以及 Pika Labs 镜像类服务(视频)。u/frighten(1 分)推荐仅支持 iPhone 的本地无审查应用“PixelForge”。 https://www.reddit.com/r/generativeAI/comments/1wdkbxv/
- 【#4,r/generativeAI,1 分 / 11 条评论,2026-09-07】针对“最便宜的无限 1080p 图生视频服务是什么?”这一问题,Artlist.io(每年 €550)被列为候选。但多条评论批评“无限”标签:u/ai_art_is_art(3 分)称:“标榜‘unlimited’的网站大多近似骗局,花 $550 只能生成价值 $200 的内容,还得等 24 小时。” https://www.reddit.com/r/generativeAI/comments/1wa4k88/
- 【#5,r/aivideomaking,16 分 / 38 条评论,2026-09-07】针对“想只用手机/iPad 免费生成 45 秒视频”的问题,u/NewLifeWares(2 分)冷静指出:“45 秒基本上是数据中心级需求。免费服务最多也就是带水印的 5 秒片段 1~2 次,只能自己拼接。”u/GuessingEngineer(2 分)讽刺道:“要是能一步做到,那你就能统治世界了。”这直观体现了人们对免费、高质量、长视频三者兼得的需求及其不现实性。 https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
- 【#7,r/GoogleFlow,6 分 / 2 条评论,2026-09-10】面向 Google Flow(Veo)的批量生成 Chrome 扩展“AutoFlow”发布。其支持批量生成、从前一片段末帧继续生成,以及自动编辑带语音/字幕旁白的视频;采用免费版加 Pro/Ultra 订阅模式。 https://www.reddit.com/r/GoogleFlow/comments/1wccmrg/
- 【#12,r/aiwars,0 分 / 14 条评论,2026-09-08】讨论 AI 生成人物恰巧与真实人物相似时的肖像权和广告使用风险。u/Upstairs-Mammoth-509(3 分)指出:“最麻烦的是偶然撞脸无名普通人的情况;企业方只能做反向图像搜索后祈祷。”这也反映出法律规范的滞后。 https://www.reddit.com/r/aiwars/comments/1wafe86/
- 【#10,r/hatethissmug,59 分 / 20 条评论,2026-09-12】围绕“批评生成 AI 却又使用它的视频”,反 AI 阵营内部也出现温差。u/AprilsStuff(22 分)称:“我是反 AI 的,但环境负担的讨论被夸大了,‘AI 会自然消失’的说法同样不现实。”可见反 AI 立场并非铁板一块。 https://www.reddit.com/r/hatethissmug/comments/1wdxv6k/
- 【#2,r/isthisAI,0 分 / 31 条评论,2026-09-09】讨论某段视频究竟是 AI 还是实拍。项链消失又重现(u/smalltiddygothb,16 分 / u/EmergencyWaffleBox,14 分)被视为关键证据;u/BouncingSphinx(5 分)评论:“视频刚好 15 秒,也很像当前 AI 视频的长度上限。”普通用户正逐渐将时长与画面不一致等技术局限作为判断标准。 https://www.reddit.com/r/isthisAI/comments/1wbspxo/
信号
- 正在增长的方向:多个帖子独立提到无审查、支持 NSFW 的整合平台(WildOwl.ai、cyberbara、RunDiffusion、Tensor.art、PixelForge 等)。用户对“可使用最新模型”与“较宽松审查”的双重需求强烈。
- 正在增长的方向:以 Google Flow 的第三方自动化工具(#7 AutoFlow)为代表,补充官方工具能力的周边生态正在出现。
- 受到反感的方向:宣称“无限”的订阅服务(如 #4 Artlist.io)持续受到社区质疑。
- 受到反感的方向:即使在反 AI 阵营内,强调环境负担的论述(#10)也受到“过度夸张”的反驳,说明反 AI 叙事并非一致。
- 意外之处:本次 12 个帖子中,互动量最高的不是新模型发布,而是“让 AI 手绘并伪造延时视频”的反 AI 指控(#6,7,146 分)和 AI 图像引发的争议笑料(#11,4,470 分)。相比产品新闻,“AI 造成的欺骗与可信度”在 Reddit 上的传播力明显更强。
- 意外之处:闭源/开源这一分类并非用户关注中心。许多帖子中,Qwen、Flux、Seedream、Wan、Kling、Seedance、Veo、GPT Image 等模型都被并列为“可用模型”,几乎没有人专门强调二者区别。
局限
- 搜索词只有一种:"Image and Video Generation AI News",最终只收集到 12 个帖子,未达到约 20 条的完成标准。
- 收集方式是阅读由工作器使用无头浏览器预先获取的内容;由于 Reddit 拒绝 WebFetch 和搜索访问,本次无法自行追加搜索和浏览 Reddit。
- 许多收集到的帖子是“推荐工具”类问答,更反映社区实际工具使用,而非“新闻”。没有找到清晰讨论闭源和开源动态的专业新闻帖子。
- r/AItips101(1,299 人)和 r/GoogleFlow(1,884 人)均为很小的子版块,因此其结论更接近个别声音,而非整个社区的代表性观点。
X
X — 图像与视频生成 AI 新闻动态
账号
本次收集到的 40 条内容来自 40 个不同账号,每个账号仅有 1 条帖子,没有重复出现的账号。而且,这些账号都不是专门发布图像和视频生成 AI(Midjourney、Stable Diffusion、Sora、Runway、Kling、Veo、ComfyUI、Flux 等)信息的账号。它们按搜索词形成不同集群。
- Yemen/Saudi(中东局势、OSINT):@tleilax___、@Ahmed175143、@IranTimes72、@citrinowicz、@Osinttechnical、@c14english、@Rusia_HD、@MerruX — 报道沙特石油基础设施遇袭和也门冲突的 OSINT/新闻账号。
- $SONG(Cardano 迷因币):@LagyADA、@EAjdarovic、@JureKaramarko、@SintoAndrej — 小型投机和推广账号。
- Charlie Kirk(逝世一周年相关):@tivent_1、@TruthNetwork24、@mscaradapawjob、@rokkstarrrrrrr — 政治评论或迷因反应。
- Britain(英国政治):@brigantia__、@Steven41849941、@SirJBritain、@BROKENBRITAIN0 — 围绕移民和治安的民族主义倾向帖子。
- Anthropic(AI 经济和安全讨论):@restitutorII、@BrianRoemmele、@walterkirn、@claudecode84 — 有关 Anthropic 经济情景预测、Claude Code 开源化和 AI 批评的内容;并非图像/视频生成,而是 LLM 代理和 AI 社会议题。
- Apple/Samsung(手机争论):@FlossyCarter、@cagriozturkish、@appleinteligen、@BrandonKHill — 围绕折叠屏设备的粉丝争执。
- Sony(游戏行业):@JayDubcity16、@Cris_Uther、@treeblazah、@ScreenCraveHQ — 与小岛秀夫或蜘蛛侠电影相关的八卦。
- "one ai os"(AI 初创公司自我推广):@de1lymoon、@neda_sefati、@harvey_control、@Iamanusbutt — AI 代理/业务操作系统初创公司的社交推广,与图像和视频生成无关。
- Chelsea(足球):@declanstar1、@TheHateCentra、@Lea_EFC、@chelcatastr0phe — 切尔西足球俱乐部比赛相关内容。
没有重复发布者,因此无法比较“单帖爆红的人”与“持续累积小帖的人”。勉强而言,@rokkstarrrrrrr(9,404 个赞)、@TheHateCentra(19,654 个赞)、@Cris_Uther(17,095 个赞)单帖互动最高,但均与主题无关。
帖子
直接提及图像或视频生成 AI 的帖子为零。以下列出最接近主题、但依然偏离的帖子,供参考。
-
#21 @restitutorII — 458 个赞、69 次转发、41 条回复、约 57,000 次浏览、2026-09-10
https://x.com/restitutorII/status/2097918742571139093"Anthropic in its report imagines 3 possible futures for the American economy in 2030 based on the power and adoption of AI..."
→ Anthropic 的经济情景预测。属于广义生成 AI 话题,并非图像或视频生成 AI 动态。 -
#24 @claudecode84 — 2,585 个赞、268 次转发、24 条回复、约 741,000 次浏览、2026-09-10
https://x.com/claudecode84/status/2097959830942367747“Anthropic 的负责人本人正在把自己的‘Claude Code 环境’整体开源。”
→ 讨论 Claude Code(编程 AI)开源,不涉及图像或视频生成模型。 -
#33 @de1lymoon — 49 个赞、6 次转发、9 条回复、约 3,500 次浏览、2026-09-11
https://x.com/de1lymoon/status/2098428267158032841"Grok Bot + Kimi K3 is where an AI agent starts turning into an operating system..."
→ 有关 AI 代理编排的讨论,与图像和视频生成无关。 -
#22 @BrianRoemmele — 792 个赞、187 次转发、105 条回复、约 100,000 次浏览、2026-09-10
https://x.com/BrianRoemmele/status/2098024115231924568
→ 对 Anthropic 的批评及 AI 威胁论的迷因式帖子,不涉及图像或视频生成。 -
#23 @walterkirn — 723 个赞、91 次转发、39 条回复、约 28,000 次浏览、2026-09-10
https://x.com/walterkirn/status/2098059171325427949
→ 同样处于 Anthropic/媒体批评语境中,未涉及图像或视频生成。
以上五条已是通过“AI”关键词可找到的全部相关范围,不能作为闭源或开源图像/视频生成 AI 新闻采用。
信号
- X Explore 的前 10 个趋势词(根据本会话连接服务器的地区,以及“Trending in Croatia”标记,可能为克罗地亚地区)是“Yemen”“Saudi”“$SONG”“Charlie Kirk”“Britain”“Anthropic”“Apple”“Sony”“one ai os”“Chelsea”,其中没有 Midjourney、Sora、Stable Diffusion、Runway、Kling、Veo 等任何图像或视频生成 AI 词汇。
- “Anthropic”和“one ai os”进入趋势,说明 X 上围绕 AI 代理、LLM 经济影响的讨论活跃,但这属于不同于本主题的内容群。
- 本次 40 条内容中,没有任何帖子提到图像/视频生成 AI 工具名称、发布、演示视频或比较。
局限
- 本次搜索词("Yemen"、"Saudi"、"$SONG"、"Charlie Kirk"、"Britain"、"Anthropic"、"Apple"、"Sony"、"one ai os"、"Chelsea")均是当天 X Explore 的趋势词,并非针对 Midjourney、Stable Diffusion、Sora、Runway、Kling、Veo、ComfyUI、Flux 等图像/视频生成 AI。因此收集到的 40 条帖子中,没有一条涉及开源或闭源图像/视频生成 AI 新闻。
- 因此,本阶段无法从 X 数据中形成简报所要求的“开源 10 条、闭源 10 条洞察”。与其说 X “没有谈论”本主题,不如说根本没有进行围绕本主题的搜索。
- 下次应以图像和视频生成 AI 的工具名、公司名(Midjourney、Stability AI、Runway、Pika、Luma、Kling、Sora、Google Veo、Flux、ComfyUI 等)作为检索词重新收集。
YouTube
YouTube — 图像与视频生成 AI 新闻(闭源/开源)
频道
- There's An AI For That — AI 工具介绍频道,发布 FLUX.2 评测。
- AI Search — 新模型快讯频道,发布 Sora 2、HunyuanVideo 1.5 快讯视频。
- Theoretically Media — 擅长 AI 视频生成的专业频道,提供 Veo 3.1 深度评测。
- Teacher's Tech — 实用工具频道,评测 Nano Banana 2。
- Codebreakers — 开源 AI 模型评测与讲解频道,推出 MiniMax H3 专题。
- Bijan Bowen — 专注本地 AI 图像生成的频道,测试 Z-Image Turbo。
- Benji's AI Playground — ComfyUI/本地生成教程频道,讲解 Ideogram 4.0。
- Curious Refuge — 老牌 AI 影视制作教育频道,评测 Midjourney V8。
- RandomAI — 新模型快讯与比较频道,讲解 GPT Image 2.5。
- Standarity / The AI Filmmaking Advantage — 新闻快讯和比较测试频道,总结并全面测试 Seedream 5.0 Pro。
- MattVidPro AI — 在 Runway Gen-4 系列初体验视频中提及相关模型。
视频
- “Is FLUX 2.0 The New Open Source King?” — There's An AI For That — https://www.youtube.com/watch?v=YQuTkPVkCS8 — 验证 Black Forest Labs 的 FLUX.2 是否可能成为开源图像生成的新王者。
- “We have a new #1 open-source AI video generator!”(2025-11-25)— AI Search — https://www.youtube.com/watch?v=6EQP8-D37bs — 评测 HunyuanVideo 1.5 在 ComfyUI 中的表现与安装流程,并称其低显存环境也可运行。
- “Sora 2… wtf” — AI Search — https://www.youtube.com/watch?v=El-G4cO4x4I — 将 OpenAI Sora 2 与 Veo 3、Kling 2.5、Hailuo 02 比较,指出其音画同步与物理表现有所提升。
- “Veo 3.1 Is More Powerful Than You Realize!”(2025-10-16)— Theoretically Media — https://www.youtube.com/watch?v=sTOFXi2eY_k — 讲解 Google Veo 3.1 在口型同步、角色一致性和 1080p 超分辨率方面的增强。
- “The New Gemini Image Generator is Insane (Nano Banana 2)”— Teacher's Tech — https://www.youtube.com/watch?v=nikIxHM_AQY — 介绍 Gemini 应用默认模型已替换为 Nano Banana 2。
- “MiniMax H3: The New Open-Source Video Champ?”(2026-08-03)— Codebreakers — https://www.youtube.com/watch?v=3R5GROj8Tcg — 介绍开放权重的全模态视频模型 MiniMax H3(Hailuo 3.0),称其可原生单次生成带立体声的视频。
- “Alibaba Z-Image Turbo Test – The New KING of LOCAL Image Models”— Bijan Bowen — https://www.youtube.com/watch?v=K0FgDU-9uik — 在本地测试采用 Apache-2.0 许可的 Z-Image Turbo,并称其为 KING。
- “Ideogram 4.0 Released! The New Open Model That FINALLY Gets Text Right”(2026-06-04)— Benji's AI Playground — https://www.youtube.com/watch?v=HY_e5CZfJfQ — 报道 Ideogram 首个开放权重模型在 Design Arena 位居第一,文字渲染终于变得准确。
- “I Tried Midjourney 8… Here's the Truth”(2026-03-19)— Curious Refuge — https://www.youtube.com/watch?v=i9qV9-2tzEA — 对 Midjourney V8 进行实力验证与坦率评测。
- “GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model”— RandomAI — https://www.youtube.com/watch?v=DY6TkI8XtkQ — 讲解 OpenAI GPT Image 2/2.5 系列在文字渲染与多语言支持上的提升。
- “ByteDance Seedream 5.0 Pro: The Announcement, Read and Highlighted”— Standarity — https://www.youtube.com/watch?v=g05iPef37Qs — 总结可按图层编辑的 Seedream 5.0 Pro 发布内容。
- “🚨BREAKING: Seedream 5.0 Pro Just SMOKED Every Image Model (Fully Tested)”(2026-07-16)— The AI Filmmaking Advantage — https://www.youtube.com/watch?v=WpcxwSNT3X4 — 对 Seedream 5.0 Pro 与其他模型进行完整测试,评价其碾压现有模型。
信号
闭源阵营的动态
- OpenAI GPT Image 2 / 2.5 在 Artificial Analysis Image Arena 中位居第一,Elo 分数为 1,339;有报道称其创下“该竞技场历史上第一名和第二名最大差距”(截至 2026 年 9 月)。
- Google Veo 3.1、Nano Banana Pro(Gemini 3 Pro Image)同时强化视频和图像能力,口型同步、1080p 超分、图层编辑等特征显示出明显的专业用途导向。
- 字节跳动 Seedance 2.0(2026-02)与 Seedream 5.0 Pro(约 2026 年 7 月)依靠多模态能力(文字+图像+视频+音频参考)迅速扩大存在感。
- 多条视频将 xAI Grok Imagine 1.5 称为在基准测试中超过 Veo 和 Sora,因而引发讨论(约 2026 年 6 月)。
- Runway Gen-4/4.5、Midjourney V8 系列(V8.1、V8.2)等既有玩家也持续更新,出现许多“守住王座”类型评测视频。
开源阵营的动态
- 多份评测将 Black Forest Labs FLUX.2 称为可本地运行的高质量图像模型“新王者”。
- 腾讯 HunyuanVideo 1.5 原生支持 ComfyUI,并被称为低显存环境中开源视频生成的新常用选择。
- 阿里巴巴/Tongyi-MAI 的 Z-Image、Z-Image Turbo 以 Apache-2.0 发布,许多频道将其评价为“本地模型新王者”。
- Ideogram 4.0 作为该公司首个开放权重模型发布,在 Design Arena 获得第一名,并突出其高精度文字渲染。
- MiniMax H3(Hailuo 3.0)作为可在 RTX 3090 等个人 GPU 上运行的开放权重全模态视频模型,于 2026 年 8 月迅速走红,ComfyUI 相关视频不断出现。
- Lightricks LTX-2 以开源方式实现 4K、50fps、音画同步视频生成,被称为“开源视频的圣杯”。
- 阿里巴巴 Wan 2.5/2.6 系列也持续被介绍为支持文字、图像、音频、视频输入的开源视频模型。
局限
- YouTube 搜索结果页(
youtube.com/results?...)采用 JavaScript 渲染,WebFetch 无法获得正文内容(标题、播放量、频道信息),仅返回页脚。单独的视频页面(watch?v=)同样采用 JS 渲染,无法直接读取,因此通过 YouTube oEmbed API(youtube.com/oembed)确认标题和频道名。 - oEmbed API 不会返回播放量、发布日期、订阅数或评论,因此本报告无法取得播放量和频道订阅数(尽管 playbook 要求这些项目)。发布日期仅在部分 WebSearch 摘要包含时标注;未知的则省略。
- “LTX-2: Open Source AI Video, Released to the Community”(zSvCnVi181A)在访问 oEmbed 时返回 403 Forbidden,无法确认。
- 基于上述限制,无法查看各视频评论区内容;摘要仅基于标题和说明。
- 本次还结合了经由 WebSearch 获取的信息(文章摘要、相关博客)来补强趋势判断,但所有附上的视频链接均确认是实际存在的 YouTube URL。
Bluesky
Bluesky — 图像与视频生成 AI 新闻(闭源/开源)
账号
- theinformation.com / techmeme.com / mediagazer.com / lefiltech.fr — 通过 RSS 联动的新闻机器人,以多语言传播 OpenAI、Sora 相关独家消息。
- ctxwindow.kynth.studio(#TechBluesky) — 持续监控 OpenAI 价格页变更并发布信息的观察账号。
- gen-ai.news — 报道 Midjourney 更新快讯的个人新闻账号。
- oludai.bsky.social — 运营独立盲测人工评估排行榜(olud.ai),每小时对开源和闭源图像模型排名。
- aichina.news — 几乎每天报道华为 Modelers.cn 上 Apache-2.0 的 FLUX 系 LoRA 的机器人式账号。
- circuitai.bsky.social — 每天十多次以近乎相同文案发布阿里巴巴 WAN 3.0 联盟营销链接(vidhapi.app)的垃圾/推广账号。
- arxiv-cs-cv.bsky.social — 自动发布图像和视频生成领域 arXiv 新论文。
- un1v3rse.bsky.social / carlbetheav.bsky.social / stumblegirl.bsky.social / ttaships.airminded.org — 每天使用 Midjourney 创作作品的个人艺术家(#midjourney #QP #FoxyFriday)。
- rin-yamami.bsky.social / satomin6.alimika.jp — 使用 Qwen-Image-Edit、ComfyUI 的日语圈 AI 插画师。
帖子
- theinformation.com(2026-09-10,👍1 🔁0)— 独家报道称,前 OpenAI Sora 负责人 Bill Peebles 将与好莱坞重要人物 Jeffrey Katzenberg(前梦工厂负责人)及前 Dropbox CFO 合作成立一家独立的视频生成 AI 初创公司。
https://bsky.app/profile/theinformation.com/post/3mv6myz7pa52n - ctxwindow.kynth.studio(2026-09-08,👍0/1 🔁0)— 发现 OpenAI 悄悄从价格页删除 sora-2、sora-2-pro(旧价格:720p $0.05~$0.30),作为 Sora 收缩的佐证。
https://bsky.app/profile/ctxwindow.kynth.studio/post/3muxriifygl23 - somewhattolerable.com(2026-09-06,👍2)— 推测“OpenAI 终止 Sora,是因为内部工程师抱怨它消耗过多资源”。
https://bsky.app/profile/somewhattolerable.com/post/3muuuazkaf223 - itmatterss.bsky.social(2026-09-11,👍1)— 称 Google Gemini 已推出 Windows 桌面应用(Alt+Space 启动),图像生成采用 Nano Banana,视频生成采用“Gemini Omni”。
https://bsky.app/profile/itmatterss.bsky.social/post/3mvayanva5c2n - dimnews.bsky.social(2026-09-11,俄语)— 称商汤发布 80 亿参数多模态模型“SenseNova-U1.5”,并宣称其视觉推理超过 Nano-Banana-Pro。
https://bsky.app/profile/dimnews.bsky.social/post/3mv7u7crnzz25 - gen-ai.news(2026-08-30,👍1)— 报道 Midjourney V8.2 编辑模型因画质下降投诉而被悄悄修补。
https://bsky.app/profile/gen-ai.news/post/3mudbgowbnz2s - futureautomationai.bsky.social(2026-09-03,👍2)— “Midjourney in 2026”总结:V8.2、个性化、情绪板、编辑模型和参考功能。
https://bsky.app/profile/futureautomationai.bsky.social/post/3mumtnbxuv22d - oludai.bsky.social(2026-09-10/11,👍1-2)— 盲测排行榜中,“最佳可下载模型”为 Qwen-Image-3.0-Pro(#12),与 GPT Image 2 (high) 仅差 92 Elo 分。
https://bsky.app/profile/oludai.bsky.social/post/3mv5ywkauvt2t - ddigitalmedia.bsky.social(2026-09-10,👍1)— 评价称:“Qwen、Z-Image、MiniMax 是唯一能与西方 LLM/图像产品竞争的存在。”
https://bsky.app/profile/ddigitalmedia.bsky.social/post/3mv6lyejx3223 - circuitai.bsky.social(2026-09-11~12,重复发布)— 将阿里巴巴视频生成模型“WAN 3.0”宣传为字节跳动 Seedance 2.5 的低价按量付费替代品(单片段最长 30 秒)。※同一文案的联盟营销帖子每天超过 15 次。
https://bsky.app/profile/circuitai.bsky.social/post/3mvbvqsdvr22p - minaxlab.bsky.social(2026-09-11)— 宣布 ComfyUI v0.35.1 发布,开源本地生成环境持续更新。
https://bsky.app/profile/minaxlab.bsky.social/post/3mvasr3l72x2i - aichina.news(2026-09-08~09,连续发布)— 华为 Modelers.cn 上不断出现 Apache-2.0 许可的 FLUX 系 LoRA,但许多缺乏触发词和基准数据;该账号反复评价称,若要宣称超越 Qwen-Image,现有证据不足。
https://bsky.app/profile/aichina.news/post/3mv3vq3zdui24 - arxiv-cs-cv.bsky.social(2026-09-11)— 发布一篇关于评估和提升视频生成模型“Think-with-Video”推理能力的新论文(From Evaluation to Enhancement)。
https://bsky.app/profile/arxiv-cs-cv.bsky.social/post/3mvbfk6tunc2j
信号
- Sora 实际上可能正在放缓:价格页模型移除、前负责人离职并成立竞争性初创公司,以及“因消耗资源过多而被砍掉”的推测,在同一时期集中出现。OpenAI 的视频生成策略看上去更偏防守。
- Google 则相反,正在全面铺开:将 Nano Banana(图像)、Nano Banana Pro、Veo、Gemini Omni(视频)整合进 Windows 应用,战略上是在所有场景嵌入生成 AI。
- 开源阵营的主角是中国团队:Qwen-Image-3.0-Pro、Z-Image(Turbo)、MiniMax、Alibaba WAN 3.0、SenseTime SenseNova-U1.5 成为讨论中心。多个账号都认为,“唯一能够对抗西方图像/视频 AI 产品的是中国开源模型”。
- 与闭源模型的差距正在缩小:基于盲测,Qwen-Image-3.0-Pro 已逼近 GPT Image 2 (high),相差 92 Elo(oludai.bsky.social 的持续测量)。
- 需要注意噪声与推广:大量 WAN 3.0 帖子来自 circuitai.bsky.social 的同文案联盟营销连发,不能视作自然形成的热度,需打折看待。
- 工具生态持续演进:除了 ComfyUI 主体更新,华为 Ascend NPU 的 FLUX LoRA 移植(aichina.news)等也表明,生态正向 CUDA 以外硬件扩展。
局限
- Bluesky 公共 API(
public.api.bsky.app及api.bsky.app的app.bsky.feed.searchPosts)间歇性返回 403 错误,表现类似速率限制。连续查询时更容易失败,间隔后重试则大多数成功。 Runway Gen、Kling AI、Black Forest Labs、Wan 2.5(拼写变体)等关键词持续出现 403,因而放弃,并以替代查询(如Wan video)代替。本文未能直接收录 Runway、Kling 相关帖子。bsky.app/searchWeb UI 为 JavaScript SPA,抓取后无法获得已渲染正文,因此完全依赖公共 API 的 JSON。- “Flux”“Z-Image”等词会按字面搜索,大量结果与 Aeon Flux、太阳通量、宝可梦 Z-A、成人视频网站等无关,筛除过程耗时。
- The Information(Katzenberg 相关)和 arXiv 论文等仅核验到标题和摘要,未验证完整正文(分别受付费墙和专业论文限制)。
Lemmy
Lemmy — 图像与视频生成 AI 新闻
社区
- !«メールアドレス» — 共 5,709 名订阅者(其中本地 893 人)。这是 Lemmy 上本主题最大的枢纽,汇集图像/视频生成 AI 工具和模型发布信息。近期帖子几乎都由 Even_Adder 一人每日发布新的 GitHub/HuggingFace 项目。
- !«メールアドレス» / lemmy.world — 生成图像作品分享社区。更接近作品画廊而非新闻(分数在 -14 至 16 之间)。
- !«メールアドレス» — 专注 SDXL 加自定义 LoRA 抽象艺术的社区。仅 9 月就有超过 10 个帖子,活动较活跃。
- !ai_reddit@[各实例] — 汇集 Reddit r/ArtificialInteligence 转帖的社区,原创讨论较少。
- !«メールアドレス» — 综合科技新闻社区。Midjourney 相关文章在此获得超过 70 分。
- !hackernews@[各实例] — Hacker News 转帖社区,收录多条 Midjourney 争议内容。
- !techtakes@[各实例] — AI 批评倾向较强的社区。“Midjourney pivots to Theranos”获 40 分。
- !llm@[各实例] — LLM 专业社区。包含 GPT-6 Astra 发布帖,但评分为负(-3),反响冷淡。
- !«メールアドレス» — 专注 Perchance 文本/图像生成工具的小型社区。
部分实例的 API 返回 404,因此除 !«メールアドレス» 外,其他社区的准确订阅数无法确认。
帖子
偏闭源
- "Midjourney pivots from AI image generation to body scanning medical spa" — !«メールアドレス»,58 分,2026-06-18。https://www.theregister.com/ai-and-ml/2026/06/18/midjourney-pivots-from-ai-image-generation-to-body-scanning-medical-spa-where-patients-bathe-in-golden-light/5258429 — 令人震惊的消息称,Midjourney 从图像生成转向使用超声波 CT 的医疗水疗业务(Midjourney Medical)。
- "Midjourney AI pivots to Theranos: Ultrasonic CT" — !techtakes,40 分,2026-06-19。https://pivot-to-ai.com/2026/06/19/midjourney-ai-pivots-to-theranos-ultrasonic-ct/ — 将上述事件讽刺为“Theranos 重演”的评论。
- "Midjourney Medical" 官方页面 — !hackernews,3 分,2026-06-18。https://www.midjourney.com/medical
- "Midjourney wants Hollywood studios to reveal the details of their AI usage" — !«メールアドレス»,73 分,2026-07-05。https://techcrunch.com/2026/07/04/midjourney-wants-hollywood-studios-to-reveal-the-details-of-their-ai-usage/ — Midjourney 要求好莱坞工作室披露 AI 使用情况。
- "Behind the scenes with the Midjourney scanner"(视频)— !hackernews,1 分,2026-07-06。https://www.youtube.com/watch?v=4nzzpUKhj1M
- "Amnesty International's May 2026 briefing calls leading generative AI systems 'unlawful by design'" — !ai_reddit,1 分,2026-06-24。https://www.reddit.com/r/ArtificialInteligence/comments/1ue64s2/ — 人权组织批评包括图像生成在内的主流闭源生成 AI 系统,其训练数据收集方式存在违法性。
- GPT-6 Astra 发布 — !llm,-3 分,2026-09-04。https://openai.com/index/gpt-6-astra/ — LLM 本体不直接生成图像/视频,而是通过 Responses API 调用工具。社区反响有限,评分为负。
偏开源(全部来自 !«メールアドレス»,发帖人 Even_Adder)
- MiniMax-H3 视频生成模型的周边工具群 — 9/4~9/10 期间超过 7 项(
ComfyUI-MiniMax-H3-W4A4-VSA、MiniMax-H3-Semantic-Bridge、ComfyUI-Ref2VA-VSA、Minimax-h3_Singularity、minimax-h3_fl2v_8Step_motion_enhancer、ComfyUI-VDN-H3、vdn-minimax-h3、FastH3-Ref2V-Stream-Controller)。围绕开源视频模型 MiniMax-H3 的量化、加速与语义桥接生态迅速扩张。示例:https://github.com/sepiablue-ai/ComfyUI-MiniMax-H3-W4A4-VSA - "LLaDA-Image: Building Strong Image Generators" — 3 分,2026-09-04。https://arxiv.org/abs/2609.03796 — 60 亿参数开源 Diffusion Transformer 论文。
- Krea 2 Turbo 的两种 LoRA —
F16/krea2-turbo-sda(2 分,9/10,https://huggingface.co/F16/krea2-turbo-sda)与lvladikov/Krea2-Turbo-Distill-4step-LoRA(2 分,9/8,宣称通过 4 步蒸馏提升 45% 质量)。 - "Viggle/Viggle-Animate" — 10 分,2026-09-05。https://huggingface.co/Viggle/Viggle-Animate — 从一张重绘帧替换视频中的角色的技术。
- "How a 20-year-old independent builder from Bihar created an open omni AI model" — !ai_reddit,0 分,2026-09-11。https://www.reddit.com/gallery/1wdii5s — 讨论一款 58.4 亿参数开放全模态模型在 MATH-500 基准上超过 Apple AFM 3B 模型。
信号
- 开源阵营的主战场已从“模型本体”转向“周边生态”。 围绕视频生成模型 MiniMax-H3,量化、加速、ComfyUI 节点和 LoRA 在一周内发布超过 10 项,社区热度集中在此。
- Lemmy 上本主题的内容实际上依赖单个个人(Even_Adder)的策展。它更像链接集合而非讨论串,评论数几乎为零。
- 闭源侧最大的议题不是新模型性能竞赛,而是Midjourney 转向医疗水疗业务这一带有争议的转型。整体更偏企业批评与讽刺,而非技术新闻(pivot-to-ai 等批评媒体较突出)。
- 大赦国际报告等人权组织对生成 AI 合法性和数据收集的批评,也成为闭源生成 AI 相关话题。
- GPT-6 Astra(2026 年 9 月发布)不直接生成图像/视频,因此在本主题中直接相关性较弱,Lemmy 上的反响也呈负面评分。
局限
- Lemmy 搜索 API 依赖关键词匹配;搜索
Sora、Veo、Runway、Kling、Grok Imagine、Nano Banana均未得到相关结果(只有无关帖子)。这些话题在 Lemmy 上几乎没有讨论。 !«メールアドレス»(另一实例版本)返回 HTTP 503,因此改用 dbzer0 实例版本。- 多个社区的订阅数 API(
/api/v3/community?name=...)返回 404,无法确认准确订阅数。 - 总体而言,虽然收集到 20 条与主题相关的帖子,但 Lemmy 在这个主题上是非常小的平台;实际信息来源集中在少数社区和账号。原创讨论和长串交流稀少,大多数内容是链接帖或转帖。
Pinterest — 图像与视频生成 AI 新闻
output/pinterest.pins.md 中列出的 50 个 Pin(未分类,由单一查询 "Image and Video Generation AI News" 收集)均已逐一打开图片进行确认。
视觉主题
- 霓虹蓝/紫色未来 UI 背景占压倒性多数。黑色背景、线路板图案、发光 AI 标志、全息人形剪影等构图,同时出现在信息图与视频缩略图中
[1, 3, 4, 5, 34, 37, 39, 41, 48]。 - 多个模板缩略图采用留胡子的男性 YouTuber 大脸 + 大号“AI NEWS”文字 + 企业 Logo 拼贴。惊讶或怀疑表情被用来吸引点击,并反复组合 Google/OpenAI/Microsoft/Meta/Anthropic 标志
[4, 20, 21, 45]。 - “最佳 AI 视频工具”类排行信息图数量非常多,几乎重复使用同一模板:带编号的卡片、Logo、功能清单和“best for”。Runway、Pika、Kling AI、Luma(Dream Machine)、Canva、Hailuo、Synthesia 几乎在所有榜单中反复出现
[7, 8, 13, 24, 40]。 - 让用户判断“真实 vs AI”或识别 AI 的格式很突出。风景图左右对比问答、深度伪造趋势说明、AI 声音检测仪表等多种内容都围绕真实性焦虑
[16, 17, 20, 37]。 - 人形机器人被反复作为“AI”符号使用。新闻主播式机器人、指向地球的机器人、半张脸为机械人的合成图等,通常与实际技术内容无关,只是通用吸睛元素
[2, 34, 37, 39, 48]。 - 有一个材质转换演示网格图,将同一人物、狗和汽车视频转成“木块”“折纸”“乐高”“花朵”等效果;作为视频生成模型表现力演示,这一内容较为具体
[6]。 - 混入了一些自由职业/外包推广 Pin。“我可以制作 AI 视频”类 Fiverr 风格服务广告多次出现,部分带 WhatsApp 联系方式,或使用 Jeff Bezos 生成图像推广 Fiverr 服务
[15, 32, 42]。 - 真实产品新闻(官方发布截图)只占少数;大部分是面向 SEO/联盟营销的量产信息图或 YouTube 缩略图。真实新闻包括 Google Veo 2/3、Microsoft VASA-1、ShengShu 的 Vidu S1、Adobe 超分模型、AMD Amuse 3.0、字节跳动-MPA 版权协议等
[3, 5, 12, 29, 46, 10, 47, 31]。
值得注意的 Pin
- #3/#5 — Google announces ultra-high quality video / Veo 2 promo — Google 官方推广素材,展示狗在水下游泳、火烈鸟、厨房中的少女动画等 Veo 2 实际输出样本。
- #12 — Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — 通过 Gemini API 使用 Veo 3 图生视频与原生音频的具体功能更新。
- #6 — 材质转换演示网格(Luma 系) — 将同一源视频转换成木块、折纸、乐高、花朵的对比网格,是最直观展示模型性能的图片之一。
- #16 — "Why Is Trump Obama AI Video Trending?" — 深入解释病毒式 AI 视频趋势的信息图,明确列出使用工具:Runway ML、Pika Labs、Kaiber、HeyGen、CapCut AI、DeepBrain AI。
- #29 — ShengShu Technology unveils Vidu S1 — 中国模型发布 Pin,强调“实时、交互式生成”。
- #31 — ByteDance and Hollywood reach global deal on AI copyright — 关于字节跳动与 MPA(美国电影协会)就 AI 图像与视频生成工具版权保护达成协议的真实法律/IP 新闻。
- #44 — "More than 20% of YouTube is now AI-generated" — 少数提供具体统计数据的 Pin 之一。
- #46 — Microsoft VASA-1 — 仅用一张照片和音频片段生成说话视频的研究演示。
- #47 — "Amuse 3.0"(AMD) — AI 图像生成工具新版本发布。
- #37 — AI 声音检测信息图("97% likely AI generated") — 围绕真实性判断与 AI 伦理的教育型 Pin。
信号
- 讨论中心仍是闭源商业工具群(Runway、Pika、Kling AI、Luma、Canva、Hailuo、Synthesia、D-ID);这些 Logo 几乎每次都会出现在排行信息图中。没有看到主打开源/自托管方向(Stable Video Diffusion、ComfyUI 工作流、Open-Sora 等)的 Pin。
- Google Veo 2/3 是最显眼的官方产品新闻,重点突出通过 Gemini API 的图生视频和原生音频能力。
- 中国团队中,ShengShu 的 Vidu S1 以“实时、交互式生成”为切入点出现。
- 深度伪造与真实性焦虑(Trump-Obama 视频趋势、AI 声音检测、“哪个是 AI?”问答)在 Pinterest 上是持续存在的次主题。
- YouTube 中 AI 生成内容比例(超过 20%)、字节跳动-MPA 版权协议等行业结构和法律层面新闻也占一定比例。
- 但技术深度内容(模型架构、训练方法、基准比较)几乎为零。受 Pinterest 平台特性影响,内容更偏向“工具介绍”“教程”“病毒式现象解读”。
局限
- 工作器只使用单一查询(
"Image and Video Generation AI News"),没有进行开源/闭源等分类,因此本文也以连续的 50 个 Pin 进行分析;分类工作交由后续整合阶段。 - 部分 Pin 与主题关联较弱,或只是通用图库图片(例如
#35世界地图时事图、#43拉大提琴的雕像风图片、#22Adobe Stock 图标素材)。Pinterest 搜索匹配较宽松,可能导致噪声混入。 - Pinterest 不显示 Pin 的发布日期,因此无法判断各 Pin 的时间;仅能依靠标题中的“2025”“2026”等文字推测。
- Pin 正文标题是 Pinterest 缓存的文本,可能与链接文章实际发布日期和细节不同;本页仅基于图像与标题范围进行验证。
建议行动
- X 的调研应改用 Midjourney、Sora、Runway、Kling、Flux、ComfyUI 等具体名称,而非趋势词,重新收集。
- 持续观察 Qwen-Image-3.0-Pro 与 GPT Image 2 的 Elo 分差,以追踪开源与闭源的性能差距。
- 持续关注 Bluesky 上监测价格页的账号,以交叉验证 Sora 放缓的说法。
- 增加 Reddit 搜索词,力争将收集数量提高到约 20 条。
- Pinterest 的排行榜信息图与 Bluesky 的联盟营销连发,除非得到其他平台验证,否则不应单独信任。
收集图片


















































数据质量备注
由于搜索词选择错误,X 没有收集到任何图像或视频生成 AI 相关帖子。Reddit 只有 12 条,未达到约 20 条的完成标准;YouTube 受 JS 渲染限制,无法取得播放量和订阅数;Bluesky 在部分关键词上持续出现 403 错误,因而放弃收集。



