图像与视频生成 AI 新闻 — 2026-09-22
Sora API 将于 2026-09-24 关闭,是当下闭源领域最具决定性的新闻;与此同时,MiniMax H3 以及中国开放权重实验室(Alibaba/Qwen、ByteDance、Baidu、Tencent)正推动以 ComfyUI 为核心、增长最快的开源生态系统。
图像与视频生成 AI 新闻 — 2026-09-22
闭源领域最大的新闻是 OpenAI 的 Sora 视频生成 API 将于 2026-09-24(即本报告两天后)彻底停止服务——其应用已于 4 月关闭,背后原因是运营成本约为每天 100 万美元,而累计营收仅约 210 万美元,盈利状况恶化。另一方面,GPT Image 2.5 与 Google DeepMind 的 Nano Banana Pro/2 正在速度和写实度上展开竞争,闭源阵营的开发竞赛因数周一次的更新而愈发激烈。开源方面,以 MiniMax H3 为核心的 ComfyUI 生态仍在持续增长,Alibaba(Qwen)、ByteDance、Baidu、Tencent 等中国实验室密集发布新模型。多个平台也出现了这样的声音:闭源与开源模型在主观体验上的质量差距正在缩小。
跨平台观察
- Sora API 于 2026-09-24 关闭,是闭源领域最广泛的共同话题。 Bluesky 上 Ed Zitron 的帖子(3,572 个赞,为本次收集最高互动量)首先报道了这一消息;YouTube 的 State of AI Video 总结视频和 Lemmy 的 !ai_reddit 帖子也讨论了同一事件。三个平台都独立地将其视为最重要的新闻,营收与成本失衡被用作说明“闭源并非赢家通吃”的案例。
- MiniMax H3 是开源视频生成领域的共同关键词。 Reddit 具体讨论了免费使用 Wan、Minimax H3 的方法;Bluesky 上的 Adina Yakup 介绍了 MiniMax H3 的 8 步高速蒸馏版“HyperFlow”;Lemmy 上在 2026 年 8 月至 9 月期间出现了至少 5 个面向 ComfyUI 的 MiniMax H3 相关节点。三个平台独立出现同一模型名称,说明它可谓当前势头最强的开放权重视频模型。
- GPT Image 2.5 作为闭源图像生成代表,在三个平台均被提及。 Reddit(r/ImagineAiArt,92 分帖子)中既有高度赞赏,也有人认为“与 KREA2 的主观差异不大”;YouTube 介绍了生成延迟减少 50% 和 Sketch 功能;Bluesky 上的 Simon Willison 也实际使用该模型生成概念图。
- 中国实验室在开源阵营中的存在感格外突出。 在 Bluesky(Adina Yakup)、YouTube、Lemmy 三方,Alibaba(Qwen-Image-2.1)、ByteDance(Lance、Seedance)、Baidu(ERNIE-Image)、Tencent(HunyuanVideo 1.5)等中国公司的 Apache-2.0 类开放权重模型被反复提及。多个平台共同印证,开源趋势的主角几乎都是中国团队。
- ComfyUI 已成为事实上的共同基础设施。 YouTube 的评测视频几乎全部提及在 ComfyUI 上的实现和工作流,而 Lemmy 的 !«メールアドレス» 大部分帖子也与 ComfyUI 有关;开源工具的实际使用正逐渐向 ComfyUI 汇聚。
- 闭源与开源的主观质量差距正在缩小。 Reddit 中有评论认为“GPT Image 2.5 和 KREA2 的结果看起来一样”;Pinterest 则呈现出闭源营销压倒性占优、几乎完全不提开源的非对称局面——这更可能说明开源在面向普通消费者的可见性上较弱,而不是其能力较弱。
按平台分析
Reddit:从 7 个子版块收集了 12 个帖子。对免费 AI 视频生成的需求,与“该认清现实了”的排斥性氛围形成对立;引导用户转向 Wan、Minimax H3 等开放权重模型的评论自然大量出现。DeepSeek 用户快速增长(+66.7%)与算力不足之间的缺口,也被报告为明确信号。相同推荐码的宣传评论横跨多个帖子出现,因此需警惕广告混入自然讨论。
X:收集到的 32 条帖子、31 个账号中,没有一条提及图像或视频生成 AI。所用搜索词(Bitcoin、Zelensky、Zagreb 等)直接沿用了 X 标准 Explore 热门趋势(推测为克罗地亚周边地区热点),因而与主题无关。X 未能为本主题提供实质洞见。
YouTube:通过 WebSearch 找到 30 多个标题,选取 13 条具有代表性的视频。闭源方面,GPT Image 2.5、Nano Banana Pro/2、Sora 2、Veo 3.1、Kling 3.0 的多方比较已成为常见格式。开源方面,Z-Image Turbo、Qwen-Image-2.1、LTX-2、HunyuanVideo 1.5 等继续引领“性能不降、模型更轻”的趋势。由于页面由 JS 渲染,播放量和精确日期无法取得,仅按近似值处理。
Bluesky:搜索 API(searchPosts)始终返回 403、无法使用,因此改为直接读取相关账号的信息流。Ed Zitron 关于 Sora 关闭的帖子获得了最高互动量。开源新闻几乎完全依赖 Hugging Face 的 Adina Yakup 一人;Civitai、ComfyUI、Stability AI 的官方账号大多沉默或休眠。
Lemmy:分析了 8 个社区、16 条帖子。闭源新闻几乎全部是经由 Reddit 镜像(!ai_reddit)或 Hacker News 镜像(!hackernews)转述,得分也很低。唯一传播开来的事件是 Midjourney 从“图像生成”转向“医疗超声 CT 扫描仪”的业务新闻(score 40)。开源方面,8 月至 9 月间持续出现 MiniMax H3 的 ComfyUI 节点帖子。
Pinterest:分析了 50 个 Pin。绝大多数是“Best AI Video Generator”类清单文章图片与泛用 AI 机器人素材,可看出 Kling AI、Hailuo AI 已与 Runway、Pika、Luma 一同跻身头部。50 条中几乎没有开源相关内容,只有一条出现“Open Models. Open weights.”这一标题语——这本身就是重要发现:在消费者平台上,开源几乎不可见。
在简报指定的 6 个平台中,X(因搜索词选择失误,实质为 0 条)和 Reddit(目标 20 条、实际 12 个帖子)未达到“分析约 20 条帖子”的完成标准。这些将明确列为缺口;简报未指定的其他平台缺失不在范围内。
值得关注
- Sora API 关闭(2026-09-24)后的迁移目的地之争 — Bluesky,Ed Zitron 帖子: https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
- Qwen-Image-2.1 的“非商业研究许可”问题 — 关于它能否称为开源的争论。YouTube: https://www.youtube.com/watch?v=tP_gGGJzEqg
- MiniMax H3 × ComfyUI 生态扩张速度 — Lemmy: https://lemmy.dbzer0.com/post/74279236
- LTX-2 是否会成为开源视频的新基准 — YouTube: https://www.youtube.com/watch?v=27UAb_Tlv4E
- DeepSeek 需求激增(+66.7%)与算力不足的后果 — Reddit: https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- Midjourney 转向医疗设备业务的后续进展 — Lemmy: https://awful.systems/post/8731127
建议
- 在下次研究中追踪 Sora API 关闭后,迁移流量会流向 Seedance 2.5、MiniMax H3 还是 Kling v3。
- 持续关注 Hugging Face/Alibaba 官方公告,观察 Qwen-Image-2.1 的许可政策是否变化。
- 将 MiniMax H3 相关 ComfyUI 节点帖子的发布频率作为观察开源视频生成热度的领先指标。
- 下次收集 X 内容时,不再依赖地区趋势,改用 "AI image generation"、"Sora"、"Midjourney" 等主题专属搜索词。
- Reddit 收集也应从单一搜索词改为按具体模型名称进行多次搜索,以达到 20 条的完成标准。
- 对 Midjourney 转向医疗超声 CT 的消息,应通过一手来源(midjourney.com/medical)核实,并与已传播的二手信息区分开来。
数据质量
X 因搜索词选择错误,在收集的 32 条内容中主题相关内容为 0,未能为本主题提供实质性洞见。Reddit 仅使用单一搜索词,最终只有 12 个帖子,未达到约 20 条的目标。Bluesky 的官方搜索 API 始终返回 403、无法使用,改为直接读取账号信息流,因此不是完整的关键词搜索。YouTube 页面由 JS 渲染,无法取得播放量和准确发布日期,日期均为近似值。Lemmy 由于实例分布式架构而无法跨实例搜索,核查范围限于 6 个主要实例。Pinterest 虽分析了 50 条内容,但几乎没有开源相关提及,因此数据偏向闭源视角。
各平台详细总结
Reddit — 图像与视频生成 AI 新闻
来源分布
收集到的 12 个帖子来自 7 个子版块。
| 子版块 | 成员数 | 收集帖子数 |
|---|---|---|
| r/generativeAI | 155,851 | 5 |
| r/ImagineAiArt | 19,415 | 1 |
| r/aivideomaking | 7,414 | 2 |
| r/DeepSeek | 140,403 | 1 |
| r/Purdue | 100,714 | 1 |
| r/aivideos | 123,539 | 1 |
| r/Instagramreality | 1,155,229 | 1 |
r/generativeAI 的帖子最多,话题核心是“想免费制作 AI 视频”这一需求本身。专业类子版块(r/aivideomaking、r/aivideos、r/ImagineAiArt)讨论具体工具与技术;r/DeepSeek 是单一模型新闻;r/Purdue 和成员逾 115 万的大型社区 r/Instagramreality,则是 AI 生成物混入现实场景而引发争议的案例。
用户在说什么
- 对免费 AI 视频生成的需求依然强烈,但社区氛围正转向“该认清现实了”。 帖子 #2 “Why do so many people expect to find a free AI video generator?”(39 分、79 条评论、2026-09-21、https://www.reddit.com/r/generativeAI/comments/1wm2csy/)中,发帖者自己指出:“Sora 2 免费公开后吸引了大量用户,但 OpenAI 最终仍然终止了它”,并得出结论:"AI video generation is just expensive, and free is not a sustainable model"。
- 同帖评论中,u/buttchuckjones(4 分)表示自己已从 10GB VRAM 升级至 5080(16GB)进行本地生成,并称:"I very much wish that people on this subreddit would be more inclined to do local generation",鼓励本地/开源路线。
- 帖子 #1 “Which AI video generator can still be used for free?”(20 分、68 条评论、2026-09-16、https://www.reddit.com/r/generativeAI/comments/1whtesl/)中,u/RioMetal(4 分)推荐开放权重模型 Wan、Minimax H3:"If you can go local you have plenty of them, like Wan or Minimax"。u/tuckken2(3 分)则分享了具体用法:"Wan 2.2 and Minimax H3 are free on cnaps studio, credit resets every 5 hours"。
- 闭源方面,GPT Image 2.5 Flare 是讨论中心。 帖子 #3 “GPT Image 2.5 Flare — is this actually the best AI image generating model right now?”(92 分、62 条评论、2026-09-16、https://www.reddit.com/r/ImagineAiArt/comments/1wi79wi/)中,u/oldboi777(4 分)盛赞:"its really good, its an incredible upgrade I think";但 u/Dependent_Quit_3730(3 分)认为:"É um modelo perfeito... mas eu ainda fico com o KREA 2"(模型很出色,但自己仍会继续用 KREA 2)。u/SeaworthinessFresh16(2 分)还称:"The result in Comfyui with Krea2 looks the same",认为与开源工具的结果没有主观差异。
- DeepSeek(开放权重)同时经历快速增长与供应不足。 帖子 #6 “some deepseek news, if you care”(206 分、36 条评论、2026-09-21、https://www.reddit.com/r/DeepSeek/comments/1wmcgex/)报告称,日活用户从 1.2 亿骤增至 2 亿(+66.7%),但算力仅增长 8.3%,这导致质量下降和重新生成失败。为应对该问题,据称已向 Huawei 订购 16 万台 Ascend 960DT。u/Equivalent-Grass-527(6 分)评论:"The demand vs. compute mismatch is probably the most important part here",认为供需缺口才是问题本质。
- 对于消除“AI 感”的技巧,评价存在分歧。 帖子 #8 “I stopped prompting for clean shots and my AI video finally stopped looking like AI”(63 分、56 条评论、2026-09-20、https://www.reddit.com/r/aivideos/comments/1wl6op9/,使用 Seedance 2.5)分享了详细提示词技巧,但评论区较为怀疑。u/TCristatus(9 分)称:"What a load of waffle, and the video is still obviously AI";u/Biscuits4u2(6 分)则表示:"You need 5 percent uglier people to make it look realistic. Faces are too perfect.",指出正是“过于完美”让内容显得不真实。
- AI 生成图像混入现实空间的案例引发争议。 帖子 #7 “AI generated image on MSEE wall”(61 分、13 条评论、2026-09-21、r/Purdue、https://www.reddit.com/r/Purdue/comments/1wmq43f/)中,大学内悬挂的 AI 图像因电路板布局明显荒谬而遭批评。u/j909m(11 分)说:"Whoever did the PCBA layout for that IC gets an F."
- 即便在成员超过 115 万的大型子版块中,人们也热衷于辨认 AI 生成图像。 帖子 #12 “AI generated images on Reddit with thousands of upvotes and comments”(2,109 分、341 条评论、2026-09-18、r/Instagramreality、https://www.reddit.com/r/Instagramreality/comments/1wk0euk/)是本次收集中互动量最高的 Reddit 内容。u/Smart-Membership-117(405 分)指出:"The trim on the baseboard by her knee in pictures 2 and 3 is different and the greenery outside the window completely changes as well.";u/Negative-Raise-8286(275 分)则抱怨自己无法在原帖中发布这些指摘。
- 也有多人认为“免费额度很慷慨”,并非一味悲观。 帖子 #9(r/aivideomaking、3 分、26 条评论、2026-09-15、https://www.reddit.com/r/aivideomaking/comments/1wh80z3/)中,u/Chance-Business(2 分)肯定 Google Flow(Veo)的免费额度:"google flow you get 50 free credits per day, each vid is 6-12 credits. I have most days not hit 50." 帖子 #4(https://www.reddit.com/r/aivideomaking/comments/1wled0f/)中,u/MrBoondoggles(1 分)也称:"You can use Nanobanana and Veo in Google flow. They have very generous daily free credit allowance."
- 同一推荐码的推广跨多个帖子反复出现。 u/MeatStickMcFapperton 在帖子 #2(4 分)和 #5(1 分)均使用 Meta “Muse” 推荐码 "42JB8K" 宣传“免费 10 亿 token”,评论措辞几乎完全一致。
信号
- 上升趋势:在大部分“想要免费生成视频”的帖子中,本地/开放权重视频生成(Wan、Minimax H3、FramePack、ComfyUI)都会自然出现。DeepSeek 用户数量激增(+66.7%)同样是明确的增长信号。
- 怀疑与排斥:对“想免费获得 AI 视频”的诉求本身,反感非常强烈。帖子 #4 的 u/activematrix99(2 分)尖锐地说:"Imagine showing up at a restaurant and demanding to eat for free... what makes YOU so important that they should just give it to you for free?" 多个帖子中,批评“理所当然要求免费生成视频”的评论都获得了较高评价,表明社区风气正在变化。
- 意外发现:相同推荐码("42JB8K")与近似的营销文案在不同帖子多次出现,说明自然讨论中很可能混入了推广/自导自演评论。解读相关数字时需要谨慎。
- 对立:认为“免费视频生成已是幻想”的一方(在帖子 #2、#9、#10 中有多条高分评论得出相同结论),与认为 Google Flow/Veo/Muse/Nanobanana 的免费额度“其实相当慷慨”的一方(帖子 #4、#5、#9),在同一批子版块中正面冲突。双方都基于实际体验,无法简单判定哪一方正确。
- 也有人认为闭源与开源的实际感受差距很小:帖子 #3 将闭源 GPT Image 2.5 Flare 与使用开源工具的 KREA 2 评价为“结果看起来一样”,暗示从用户角度看,图像生成的两方质量差距已大幅缩小。
局限
- 收集工具仅使用了一个搜索词:"Image and Video Generation AI News"。相对简报的完成标准(每个社交网络分析约 20 条帖子),实际仅收集到来自 7 个子版块的 12 个帖子,未达到目标 20 条。若追加使用 "Sora"、"Veo"、"Kling"、"Stable Diffusion"、"Flux"、"open source" / "closed source" 等具体词汇搜索,可能会找到更多、更聚焦的帖子。
- 帖子 #9 的正文未包含在收集数据中,只能根据评论判断其内容。
- 根据本阶段 playbook 的指示,Reddit 未进行自主浏览或搜索,仅能在已有的
output/reddit.threads.md/.json范围内交叉核查。因此,未被纳入其中的讨论(例如特定图像/视频模型的专门帖子)不属于本报告范围。
X
X — 图像与视频生成 AI 新闻
账号
检查了 output/x.posts.md 中收集的 32 条帖子和 31 个账号,没有一个账号涉及图像/视频生成 AI。具体如下,内容明显偏向与主题无关的领域。
| 类别 | 相关账号 |
|---|---|
| 加密货币/股票($SDOG、$AMD、Bitcoin) | @SDOGWITHSNAP, @DeItaone, @AJM_web, @S500ALERTS, @blackwidowbtc, @0xSweep, @USronaldcarter, @TedPillows |
| 乌克兰与俄罗斯局势 | @dystoman, @sentdefender, @Polymarket, @Alex_Oloyede2, @bayraktar_1love, @AlaskanTzar, @SomaliSasuke, @gmanredux, @idkmypronouns, @Katauroraaa, @AbotGrenfield, @jaccocharite |
| 娱乐/政治八卦(Lauren 相关) | @Rach_delauren, @fvslaurs, @LimeriTweets, @karignejauregui |
| 体育/格斗(Muhammad 相关) | @CylinderAnalyst, @bullyb170(2 条帖子) |
| 宗教 | @TaymiFawaid |
| 与萨格勒布地区趋势相关的个人账号 | @slimey34, @AlphaGainer, @enafriedric2372, @Earldormancy |
有些账号依靠单条高互动帖子获得大量传播(例如 @AlaskanTzar 一条帖子获 34,704 个赞),也有账号靠多条小型帖子累积互动;但无论哪种,均没有账号发布图像或视频生成 AI 新闻、工具内容。
帖子
由于收集数据中没有符合主题的帖子,无法就图像与视频生成 AI 报告通常所需的“5 至 12 项洞见”。以下仅展示收集到的内容示例:
- #8 @TedPillows(2,829 个赞、293 次转发、约 486,000 次浏览、2026-09-20、https://x.com/TedPillows/status/2101642897535762562)— "If Bitcoin breaks $83,000, the cycle bottom will be confirmed..." 是比特币市场分析,与 AI 无关。
- #30 @AlaskanTzar(34,704 个赞、1,083 次转发、约 1,500,000 次浏览、2026-09-20、https://x.com/AlaskanTzar/status/2101819330703032636)— "Back in 2017 Russia and Ukraine were ratioing each other on twitter"。这是本次收集互动量最高的内容,但只是与俄乌相关的梗图帖子。
- #22 @Katauroraaa(2,840 个赞、约 309,000 次浏览、2026-09-20、https://x.com/Katauroraaa/status/2101716186132087180)— 嘲讽俄罗斯/波罗的海国家的玩笑帖子。
这些帖子都没有任何关于图像生成或视频生成 AI(无论闭源或开源)的提及。
信号
- 从收集数据中唯一可读出的“信号”是,本阶段使用的搜索词与主题无关。直接将 X 的 Explore 热门趋势(见下方局限)用作搜索词,导致内容始终围绕加密货币、地缘政治、娱乐八卦和体育。
- 此次数据中没有观察到任何关于图像或视频生成 AI 的“增长”“怀疑”等实质讨论。
局限
-
搜索词与主题无关:正如
output/x.posts.md开头所示,实际使用的 10 个搜索词是"$SDOG", "Bitcoin", "Zelensky", "Lauren", "Muhammad", "Russians", "Zagreb", "Ukraine", "Weeknd", "USSR"。这些词直接来自 “X's own Explore list”(下表),没有一个围绕“图像生成 AI”“视频生成 AI”“Sora”“Midjourney”“Stable Diffusion”等主题词。# 趋势 地点(X 的标记) 1 $SDOG Trending in Croatia 2 Bitcoin Business & finance · Trending 3 Zelensky Politics · Trending 4 Lauren Trending in Croatia 5 Muhammad Politics · Trending 6 Russians Politics · Trending 7 Zagreb Trending in Croatia 8 Ukraine Politics · Trending 9 Weeknd Trending in Croatia 10 USSR Politics · Trending 该 Explore 列表与本次会话访问服务器所在位置(推测位于克罗地亚附近)具有地理关联,并非全球趋势。
-
未达到完成标准:
brief.md的完成标准为“每个社交网络分析约 20 条帖子并汇总”,但虽然收集了 32 条帖子,相关内容为 0。因此,本报告无法为 X 提供与本主题有关的实质洞见。 -
会话本身有效(能够收集登录状态下的内容,且未出现 "no posts were collected" 等缺失消息),并非 X 的搜索或浏览功能发生故障。问题在于收集阶段选择了错误的搜索词。
-
下次执行这一阶段时,应使用 "AI image generation"、"AI video generation"、"Sora 2"、"Midjourney"、"Stable Diffusion"、"Nano Banana"、"Veo" 等与主题直接相关的搜索词重新收集。
YouTube
YouTube — 图像与视频生成 AI 新闻(闭源/开源)
频道
- Matt Wolfe (@mreflow) — 订阅者超过 925,000 的 AI 新闻频道,持续发布 Nano Banana Pro / Nano Banana 2 等闭源工具的快速评测。 (https://www.youtube.com/@mreflow)
- Theoretically Media — 专注评测与实际测试开源 AI 视频工具(LTX-2 / LTX-2.3、HunyuanVideo 系列)的频道。(https://theoreticallymedia.com/videos/)
- Aitrepreneur — 强项是 ComfyUI 工作流讲解,覆盖 LTX-2.3 等最新开源视频模型的本地部署。(含 Patreon 联动:https://www.patreon.com/aitrepreneur)
- 其他多个中型 AI 工具评测频道,涵盖 Z-Image Turbo / Flux.2 / HunyuanVideo 1.5 等;仅确认了视频标题,未确认频道名与订阅数——见局限。
视频
-
Google won image generation (it's not even close) — NANO BANANA PRO BREAKDOWN
日期:2025-11-26 | 播放量:未确认 | https://www.youtube.com/watch?v=UV9GqinedQ8
该评测认为 Google DeepMind 的 Nano Banana Pro(Gemini 3 Pro Image)在文本渲染精度和写实度上以“已无可比性”的程度领先既有图像生成 AI,是闭源阵营的代表性评测。 -
Google's Nano Banana Pro is raising concerns over realistic AI image generation
日期:2025 年 11 月下旬 | 播放量:未确认 | https://www.youtube.com/watch?v=RmmrVCUGYp8
一条新闻类视频,讨论写实性过度提升所带来的深度伪造与虚假信息风险。 -
GPT Image 2.5 Is AMAZING: Full Breakdown of OpenAI's New Image Model
日期:约 2026-09-08(发布于两周前) | 播放量:未确认 | https://www.youtube.com/watch?v=DY6TkI8XtkQ
全面介绍 OpenAI GPT Image 2.5(生成延迟降低 50%,可通过 Sketch 功能将手绘图转为 AI 图像)的功能,是闭源阵营的最新更新。 -
Sketch with ChatGPT Images 2.5
日期:2026 年 9 月上旬 | 播放量:未确认 | https://www.youtube.com/watch?v=imPtIEAEHSU
演示在 ChatGPT 中输入“@Sketch”,将手绘内容直接转换成 AI 图像的新功能。 -
State of AI Video in 2026: Sora 2, Veo 3.1, Kling 3.0 & Cinematic Prompting Workflows
日期:2026-03-20 | 播放量:未确认 | https://www.youtube.com/watch?v=vtJzDgmWVWc
对 Sora 2、Veo 3.1、Kling 3.0 三大闭源视频生成模型进行比较,并总结电影感提示词技巧。 -
Seedance 2.5 REVIEW: ByteDance's New AI Video Model Explained
日期:2026-08-01 | 播放量:未确认 | https://www.youtube.com/watch?v=LTAOvsH6cjM
ByteDance 的 Seedance 2.5 支持生成 30 秒一镜到底视频,并可输入最多 50 张参考图片;因其持续时长超过 Sora 2 和 Veo 3.1 而受到关注。属于闭源模型。 -
Kling 2.6 Pro DESTROYS Competition - Veo 3.1 & Sora 2 Pro
日期:2025-12-19 | 播放量:未确认 | https://www.youtube.com/watch?v=-vRsjX9seUU
基准视频认为,在 Kling 3.0 出现前,Kling 2.6 Pro 已领先于 Veo 3.1 和 Sora 2 Pro。随后 Kling 3.0 于 2026-02-05 发布,并以 1,243 的 ELO 分数登顶,延续了这一势头。 -
Z Image Turbo (FREE): This Open-Source AI Changed Image Generation Forever! (Like nano banana pro)
日期:2025-11-27 | 播放量:未确认 | https://www.youtube.com/watch?v=sPQQPpQ9X4E
Alibaba 的 Tongyi-MAI 团队发布的 6B 参数 Apache-2.0 许可模型。在消费级 16GB GPU 上实现 8 步高速推理,被称为“可与 Nano Banana Pro 媲美”的开源阵营重点模型。 -
New Open-Source Model DESTROYS Flux 2 — Z-Image + Promptus Tutorial
日期:2025-12-11 | 播放量:未确认 | https://www.youtube.com/watch?v=JF4Q5hXh-_Q
对比与教程视频,认为 Z-Image 超过 Flux.2。 -
FLUX.2 EL MEJOR MODELO OPEN SOURCE, EN LOCAL Y GGUF
日期:约 2025 年 11 至 12 月 | 播放量:未确认 | https://www.youtube.com/watch?v=t4eVxZPP0b0
指南视频讲解如何在 ComfyUI 中本地运行 Black Forest Labs 的 FLUX.2(包括 Pro/Flex/Dev,以及 Apache-2.0 的 Klein 系列)。其优势包括最高 4MP 输出和最多 10 张参考图的一致性。 -
The "Holy Grail" of Open Source AI Video is Here (LTX-2)
日期:2026 年 1 月上旬 | 播放量:未确认 | https://www.youtube.com/watch?v=27UAb_Tlv4E
Lightricks 于 2026-01-06 发布的 LTX-2,因同时公开原生 4K、音频同步、完整开放权重和训练代码,被高度赞誉为首个“生产级”的开源视频模型。 -
Tencent HunyuanVideo 1.5 has been officially open-sourced!
日期:2026 年上半年 | 播放量:未确认 | https://www.youtube.com/watch?v=MJShdc8tkkA
Tencent 发布 HunyuanVideo 1.5,在保持性能的同时将参数量从 13B 降至 8.3B。其可在消费级 GPU 上运行的特点受到认可。 -
Qwen-Image 2.1 | Early Access Showcase
日期:约 2026-09-20(发布于两天前) | 播放量:未确认 | https://www.youtube.com/watch?v=tP_gGGJzEqg
Alibaba Qwen 于 2026-09-20 发布的 Qwen-Image-2.1 先行体验演示:视觉生成器压缩至 7B,整合生成和编辑,并支持透明 RGBA 输出。但其许可为非商业研究专用许可。
信号
- 闭源正展开激烈的“速度与写实性”竞争:GPT Image 2.5(2026-09-08,生成延迟减少 50%)、Nano Banana Pro→Nano Banana 2(2026 年,速度翻倍)表明 OpenAI 与 Google 以数周一次的节奏竞相更新。视频方面,Sora 2、Veo 3.1、Kling 3.0 的三方比较已成为固定内容形式。
- Sora 将连同 API 一并结束服务:Sora Web/应用已于 2026-04-26 关闭,API 也计划于 2026-09-24(本报告撰写两天后)彻底关闭。据称原因为运营成本约每天 100 万美元、累计营收仅约 210 万美元,显示闭源视频生成并非“赢家通吃”。
- 开源阵营转向轻量化、高速模型:Z-Image Turbo(6B、Apache-2.0)、Qwen-Image-2.1(视觉生成器压缩至 7B)、HunyuanVideo 1.5(13B→8.3B)均沿着“性能不降、削减参数、可在消费级 GPU 上运行”的方向发展。
- 开放权重与商业许可的界线成为争议点:Flux.2 的部分版本(Klein)以 Apache 2.0 完全开放,而 Qwen-Image-2.1 虽公开权重,却明确采用“非商业研究专用许可”;评论区和评测视频均出现“它能否称为开源”的讨论。
- LTX-2 成为开源视频的基准:它首次同时提供“原生 4K + 音频同步 + 训练代码公开”,多个频道将其与 Wan 2.2 / HunyuanVideo 1.5 共同列为本地视频生成三强。
- ComfyUI 是事实上的共同基础设施:Flux.2、Z-Image、LTX-2、Wan、HunyuanVideo 均在首日获得 ComfyUI 支持,并出现大量工作流讲解视频;几乎所有开源评测都包含在 ComfyUI 中的实际测试。
局限
- YouTube 搜索结果页(
/results?search_query=...)和视频页(/watch?v=...)均由 JavaScript 渲染,WebFetch 只能取得页脚导航链接,无法直接获取准确播放量、频道名、发布日期及字幕/评论正文。因此,本报告中的日期来自搜索结果摘要或相关文章的推测值,所有播放量均标为“未确认”。 - 受上述限制,无法执行 playbook 理想中的“逐一打开并分析约 20 个帖子”流程,改为通过 WebSearch 收集标题、频道线索和发布时间。实际发现的 YouTube 视频标题超过 30 条(每个搜索词命中 5 至 10 条),其中选取上述 13 条作为代表。
- Qwen-Image-2.1 相关视频发布仅两天,评测总量仍然较少,未来数周可能增加。
Bluesky
Bluesky — 图像与视频生成 AI 新闻
账号
- Ed Zitron (
edzitron.com) — 科技/AI 行业评论者(Where's Your Ed At);其在 Bluesky 首发 Sora 关闭消息,互动量显著飙升。 - Simon Willison (
simonwillison.net) — 独立 AI 研究者;经常以“鹈鹕”测试评估新模型,包括图像生成器,并发布由此生成的概念艺术图。 - Adina Yakup (
adinayakup.bsky.social) — Hugging Face 开源 ML 倡导者;是 Bluesky 上活跃度最高的开放权重图像/视频模型发布记录者,几乎每周都发帖。 - useapi.net (
useapi.bsky.social) — 为 Veo、Kling、Seedance、Runway、MiniMax 等 AI 视频/图像/音乐生成提供 REST API 转售服务;经常发布模型横向比较。 - GPT Image Prompt (
gptimageprompt.bsky.social) — 围绕 OpenAI ChatGPT/GPT Image 工具分享提示词的账号。 - Stable Diffusion online AI (
stablediffusion.bsky.social) — 长期运营的 Stable Diffusion 社群账号,分享提示词与 AI 艺术挑战。 - Stability AI(官方)— 自约 2025 年 11 月起几乎不再发布图像/视频内容;近期帖子几乎都是 Stable Audio 和与音乐厂牌(Warner、Universal)的合作,而非 Stable Diffusion。
帖子
-
Ed Zitron — OpenAI 终止 Sora(2026-03-24,👍 3,572 · 🔁 984)
“Both the Wall Street Journal and The Information confirming that OpenAI is killing Sora - both the app and access to its video-generating model for developers. This is a huge move that suggests things are a bit desperate.”
https://bsky.app/profile/edzitron.com/post/3mhtesqgwxk2k
(这与相关报道一致:Sora 应用将于 2026-04-26 关闭,API 本身计划于 2026-09-24 下线——即本次研究两天后。) -
Simon Willison — 使用 ChatGPT Images 2.5 创作(2026-09-10,👍 56 · 🔁 5)
“Here's a Blender model of a Pluribus themed Fabergé egg I had GPT-6 Astra build - I generated the concept image using ChatGPT Images 2.5”
https://bsky.app/profile/simonwillison.net/post/3mv4su6pfzk24 -
Adina Yakup — HyperFlow(开放视频蒸馏)(2026-09-19,👍 6 · 🔁 1)
“HyperFlow⚡ New MiniMax-H3 variant from Video Rebirth — Open weight 8 step LoRA — 3× faster with data free self distillation — Video + stereo audio intact”
https://bsky.app/profile/adinayakup.bsky.social/post/3mvunely5222b -
Adina Yakup — ByteDance 的 Lance(2026-05-19,👍 48 · 🔁 5)
“ByteDance dropped Lance👀 — This 3B model can generate images + edit images + generate videos + edit videos, and understand both images/videos.”
https://bsky.app/profile/adinayakup.bsky.social/post/3mm6xqsryf22b -
Adina Yakup — Baidu 的 ERNIE-Image(2026-04-14,👍 1)
“Baidu just released ERNIE-Image on Hugging Face🔥 — 8B DiT - Image/Image Turbo — Apache 2.0”
https://bsky.app/profile/adinayakup.bsky.social/post/3mjhrc3y7u22i -
Adina Yakup — Skywork 的 Matrix-Game 3.0(2026-03-27,👍 13 · 🔁 2)
“Matrix-Game 3.0🔥 real-time interactive world models from Skywork — ✨ 720p @ 40FPS with a 5B model”
https://bsky.app/profile/adinayakup.bsky.social/post/3mi2efsyp7k2x -
Adina Yakup — LongCat-Video-Avatar 1.5(2026-05-22,👍 16 · 🔁 3)
“LongCat-Video-Avatar 1.5🐱 an audio driven avatar video generation [model]”
https://bsky.app/profile/adinayakup.bsky.social/post/3mmglm72zn22i -
Adina Yakup — HiDream-O1-Image(2026-05-19,👍 10 · 🔁 2)
“HiDream-O1-Image is getting a lot of attention🔥”
https://bsky.app/profile/adinayakup.bsky.social/post/3mm73u27jek26 -
useapi.net — Sora 2 API 替代方案(2026-09-21,👍 0)
“Sora 2 API Alternatives Compared, With Code: Seedance 2.5, Omni Flash, MiniMax H3, Kling v3 #sora2 #seedance #kling #aivideo”
https://bsky.app/profile/useapi.bsky.social/post/3mvyugq6wgz27 -
useapi.net — MiniMax H3 对比 Seedance 2.0(2026-07-31,👍 0)
“MiniMax H3 head to head with Seedance 2.0 on identical omni references #minimax #seedance #ai #api”
https://bsky.app/profile/useapi.bsky.social/post/3mrw5xyd4zk2x -
GPT Image Prompt — 表情包提示词分享(2026-05-07,👍 0)
“Theme: Text to Meme — Prompt put on comment — Welcome to our website:gptimageprompt.io #Chatgpt2 #GPTImagePropmt #AIPrompts”
https://bsky.app/profile/gptimageprompt.bsky.social/post/3mlaa6swzc226
信号
- Sora 关闭是 Bluesky 真正在讨论的闭源故事。 Ed Zitron 的帖子是整个搜索中互动量最高的内容(3,500 余赞),远远超过任何新模型发布消息。这里的 Bluesky AI 用户群更偏向关注行业戏剧与批评,而不是实验室自身营销。
- Bluesky 上的开源新闻几乎是一个人的专线。 所发现的几乎所有具体开放权重发布(Baidu ERNIE-Image、ByteDance Lance、Skywork Matrix-Game 3.0、LongCat-Video-Avatar、HyperFlow、HiDream-O1-Image)都来自 Hugging Face 的 Adina Yakup 一人;模式上也明显由中国实验室驱动(Baidu、ByteDance、Alibaba/Qwen、Ant Group、Skywork、Tencent),并采用 Apache-2.0 类许可。
- 主要闭源实验室没有活跃经营图像/视频发布的 Bluesky 账号。 未发现 OpenAI、Google DeepMind、Adobe、Midjourney 的官方账号;闭源覆盖主要来自独立测试者(Simon Willison)或进行对比帖的第三方 API 转售商(useapi.net)。
- 工具导向的技术帖子互动极低:useapi.net 的比较,以及 Adina Yakup 的大部分发布仅有 0 至 13 个赞;相比之下,关于公司命运的宏大叙事(Sora 新闻数千赞)互动极高——该平台的互动更追随行业叙事,而非技术新颖度。
- 多个显而易见的 AI 艺术枢纽在 Bluesky 上已死亡或休眠:Civitai 的官方与机器人账号、ComfyUI 账号,以及 Stability AI 自身账号(已转向 Stable Audio/音乐厂牌内容,且自 2025 年中以来未发 Stable Diffusion 图像模型内容)。
局限
- 公共关键词搜索 API 被封锁。 通过 WebFetch 尝试多词查询、单词查询和不同表述时,
app.bsky.feed.searchPosts均返回HTTP 403 Forbidden;bsky.app/search的网页 UI 完全为客户端 JavaScript 渲染,也不会返回帖子内容。因此无法真正“搜索当前主题”——以上内容是通过(a)使用site:bsky.app网页搜索查找相关账号句柄,再(b)通过可正常工作的公共 AT Protocol API 直接读取其getAuthorFeed历史来整理的。 - 多个看似有潜力的账号经直接检查后发现为空或休眠:
civitai.bsky.social(信息流为空)、civitai-bot.bsky.social(最后一帖为 2024 年 5 月)、real-comfyui.bsky.social(信息流为空)、runwayml.bsky.social(解析至无关个人账号,仅有一条 2024 年帖子)、midjourney-api.bsky.social(非官方转售商,最后一帖为 2024 年 11 月)、qwen1.bsky.social(粉丝账号,仅有一条 2025 年 2 月帖子)。 - Alibaba 的 Qwen-Image-2.1(据外部报道,2026-09-20 发布的 7B 开放权重统一图像生成/编辑模型)在本次找到的任何 Bluesky 帖子中都未出现——可能尚未被所跟踪账号报道,也可能处于被封锁搜索 API 本应覆盖的范围之外。
- Ethan Mollick(
emollick.bsky.social)和 Tanishq Abraham(iscienceluvr.bsky.social)看似都是潜在来源,但检查后发现前者主要关注通用/文本 LLM 新闻,后者主要关注旧学术论文,而非当下图像/视频生成新闻;这是已核查并排除的结果,并非主观假设。 - 由于搜索受阻,约 20 条的抽样目标是通过读取完整作者信息流历史实现的——包括 Adina Yakup 约 30 帖、useapi.net 约 15 帖、Stable Diffusion 约 20 帖,以及 Simon Willison 和 Ed Zitron 的近期信息流——而非单一排序搜索。因此,这是面向特定账号的样本,不是穷尽性的关键词扫描。
Lemmy
Lemmy — 图像与视频生成 AI 最新动态
社区
- !«メールアドレス»(5,713 人)— 开源 AI 图像与视频生成技术的主要讨论社区。GitHub/HuggingFace 工具更新几乎每天都有。
- !«メールアドレス»(2,361 人)— 用 Stable Diffusion 和其他开放权重模型创作作品的分享区。
- !«メールアドレス»(1,599 人)— 专门分享动漫风格 AI 艺术,仅限 SFW。
- !«メールアドレス»(52 人、月活 157 人)— 直接镜像 Reddit 的 AI 相关帖子。Sora、Midjourney 等闭源新闻多由此流入。
- !«メールアドレス»(204 人,亦混有 lemmy.bestiver.se 实例的帖子)— Hacker News 镜像。Qwen-Image、Nano Banana 等模型发布新闻会流入该处。
- !«メールアドレス» — 讽刺 AI 行业的社区。关于 Midjourney 迷航的新闻以此为源头。
- !«メールアドレス»(8,265 人)— 大型生成式 AI 批评社区。虽非新闻来源,但可作为观察 Lemmy 整体情绪的参考。
- !stable_diffusion_furry / _witches / _mycology / «メールアドレス» — 面向小众题材的 Stable Diffusion 作品社区。均有帖子,但得分普遍为个位数甚至负分。
帖子
闭源相关
- OpenAI is shutting down Sora's API next week while a chinese competitor just raised $3 billion — !«メールアドレス»、2026-09-20、score 1。将 Sora API 关闭与中国竞争对手巨额融资并列的帖子。
- Midjourney AI pivots to Theranos: Ultrasonic CT — !«メールアドレス»、2026-06-19、score 40。讨论 Midjourney 从 AI 图像生成急转向超声 CT 医疗设备业务,是 Lemmy 上传播最广的 Midjourney 相关帖子。
- Midjourney Ultrasonic CT Scanner — !hackernews、2026-06-18、score 2。上述一手来源(midjourney.com/medical)的 HN 镜像。
- Midjourney wants Hollywood studios to reveal AI usage details 经由的帖子 — !«メールアドレス»、2026-07-05、score 73。介绍 TechCrunch 文章的帖子,在技术社区中得分相对较高。
- Google quietly discontinues its Earth AI feature a day after its rollout after users made no-no images — !ai_reddit、2026-08-07、score 1。
- Seedream 5.0 Pro is here: an honest comparison and technical breakdown — !ai_reddit、2026-07-10、score 1。对 ByteDance 闭源图像模型的测试。
- Nano Banana 2 Lite — !hackernews、2026-06-30、score 1。Google DeepMind 轻量版图像生成模型发布。
- Microsoft's MAI-Image-2.5 Pulls Even With Google's Nano Banana 2 on Benchmarks — !ai_reddit、2026-05-28、score 1。
开源相关
- Qwen-Image-2.1: Compact, efficient, and unified image creation — !hackernews、2026-09-20、score 1。Alibaba Qwen 最新开放权重图像生成模型。
- supElement/ComfyUI_MinimaxH3_AutoContext — !«メールアドレス»、2026-09-16、score 1。用于 MiniMax H3 长视频生成(突破内存限制)的节点。
- Adudeguyman/ComfyUI-Fantastic-MiniMaxH3-PromptBuilder — 同一社区、2026-09-16、score 3。MiniMax H3 提示词构建器。
- nazgut/ComfyUI-MiniMaxH3-CLSS — 同一社区、2026-09-01、score 0。在 16GB VRAM 上生成任意长度、带音频视频的工具。
- filliptm/ComfyUI-FL-MiniMaxH3 — 同一社区、2026-08-30、score 5。
- Luisacaotica/ComfyUI-MiniMaxH3Mod — 同一社区、2026-08-20、score 7。无需训练的参考图像/视频压缩适配器。
- I've been testing Wan for AI video generation — !«メールアドレス»、2026-09-10、score -9(反响不佳/争议较大)。对开放权重 Wan 视频生成模型的评测。
- Boogu-Image-0.1 — Efficient Image Generation Foundation Model — !«メールアドレス»、2026-06-17、score 5。新的开放图像基础模型。
信号
- 围绕 MiniMax H3 的 ComfyUI 生态在 8 月至 9 月持续增长。 自 2026-08-07 至 09-16,!«メールアドレス» 至少出现了 5 个相关节点/工具,发帖频率未中断。在这个社区中,“MiniMax H3”是开源视频生成势头最强的关键词。
- 闭源新闻在 Lemmy 原生环境中的讨论很少,几乎全部是来自 Reddit 镜像(!ai_reddit)或 Hacker News 镜像(!hackernews)的转述,得分也多为 1 至 3。几乎不存在 Lemmy 原生的一手讨论。
- 唯一明显扩散的闭源话题是 Midjourney 从“图像生成”转向“医疗超声 CT 扫描仪”的业务转型(!techtakes、score 40),并在具有强烈讽刺色彩的社区中走红。
- 作品分享社区(stable_diffusion_art、share_anime_art 等)发帖频率很高(几乎每天多条),但得分仅个位数至十几分,重点是作品分享而非新闻性。
- !«メールアドレス»(8,265 人) 这类 AI 批评社区的规模超过正向的 AI 生成社区(stable_diffusion,5,713 人),说明 Lemmy 整体的社区构成对生成式 AI 较为敌视。
局限
- Lemmy 的搜索 API 仅支持关键词全文检索,相关性排序较弱。搜索 "Sora"、"Veo" 等常见词时,会混入大量无关政治新闻(latam、pravda_news 等)。为按相关性筛选,实际查看了每个关键词 15 至 20 条、总计超过 100 条搜索结果,但最终符合主题的帖子仅十余条。
- Lemmy 的实例是分布式的,无法跨所有实例搜索。虽主要检索了 lemmy.world、lemmy.dbzer0.com、lemmy.durstig.online、awful.systems、lemmy.bestiver.se、lemmy.today,但可能遗漏类似 Mastodon 般封闭的小型实例中的讨论。
- 对 Runway、Kling、Ideogram、Recraft、Grok Imagine、Flux.2、HunyuanImage 等在其他平台受关注的主要模型名称,未能在 Lemmy 上找到有意义的帖子(搜索结果为 0,或完全无关)。
- 总体而言,Lemmy 并不是图像/视频生成 AI “新闻快讯”的大型场所;其时效性依赖 Reddit/Hacker News 镜像,而原创内容主要集中于“帮助在 ComfyUI 中运行开放权重模型的实现工具分享”。
Pinterest — 图像与视频生成 AI 新闻
视觉主题
- 霓虹发光的 “AI” 字标 / 电路板机器人图像 是 Pinterest 对“AI”的默认视觉速记——发光芯片、全息机器人头部与手部、粒子电路等,主要被作为通用封面视觉,而不是用于说明某个具体工具或新闻
[1, 2, 8, 22, 25, 28, 29, 31, 39, 49]。 - 带编号的“Best AI Video/Image Generator”清单缩略图——醒目标题配合应用 logo 网格(Runway、Pika、Kling AI、Luma Dream Machine、Canva、Hailuo AI、Synthesia、HeyGen、D-ID、CapCut、InVideo、Adobe Firefly)——是整个样本中最常见的 Pin 格式
[7, 13, 20, 30, 32, 33, 41, 43]。 - 无脸 YouTuber 反应缩略图(惊讶的络腮胡男子、耳机、模糊的爆炸背景)搭配大科技公司 logo,用来吸引点击“AI NEWS”回顾视频
[6, 19, 40]。 - 带日期的“今日/本周 AI 新闻”汇总卡片,设计成迷你报纸头版或 Instagram 轮播,一张卡总结多条真实新闻
[17, 35, 44, 47]。 - “找出 AI”/写实性演示——标有“This is AI”的写实网球运动员、盖有“FAKE”印章的猫图——营销的是生成媒体的真实感,而非某一具体产品
[5, 23]。 - 一致角色的风格迁移演示——一条 Lumalabs Pin 将同一源视频变为四种风格(木块、折纸、玩具砖块、鲜花),是本周期其他地方也常见的“将其变为 X 材质”病毒式格式
[10]。 - 自由职业/副业服务广告,提供“为你的品牌制作 AI 视频”,并将 WhatsApp 号码和 Gmail 地址直接烙在图上
[24]。 - 面向初学者的解释性信息图,将流程拆解为提示词 → 潜空间 → 去噪 → 帧 → 输出,目标受众是完全不了解生成原理的人
[3, 36]。
值得注意的 Pin
- #9 — Veo 2 官方产品页面(“Our state-of-the-art video generation model”,提供 VideoFX 注册 CTA)。这是实际的闭源产品营销,并非清单文章。https://www.pinterest.com/pin/716705728243313502/
- #10 — Lumalabs “Made of wooden blocks / origami folded paper art / colorful toy bricks / flowers”:将一个源视频重渲染为四种一致风格。https://www.pinterest.com/pin/308144799526598925/
- #17 — “4 Major AI Updates: Real News. Real Impact.”,将 OpenAI 的 GPT-6 Astra、Gemini 在 Gmail/Drive/Docs/Slides/Chat 中更具代理能力、Adobe Premiere 时间线内生成视频/声音,以及 Cognition 以 480 亿美元估值完成 20 亿美元 E 轮融资整合在一起。https://www.pinterest.com/pin/982558843745608433/
- #20 — “AI Image Video: Best Quality vs Best Free” 决策图,是当前付费工具(ChatGPT Plus、Gemini Advanced、Midjourney、Adobe Firefly、Recraft、Runway Gen-3、Luma、Pika Pro、Kaiber、Synthesia)与免费工具(Ideogram、Gemini Free、SeaArt、Playground、Krea、Canva、Inkscape、CapCut、Pika Free、Runway Free)最清晰的单图地图。https://www.pinterest.com/pin/37295503160959330/
- #26 — 新闻卡:“ByteDance and Hollywood reach global deal on AI copyright”——ByteDance 与美国电影协会同意加强其图像/视频生成工具中的 IP 保护。https://www.pinterest.com/pin/1074530792376376121/
- #27 — AI 伦理/语音检测器信息图,标注语音分析结果“97% likely AI-generated”,旁边是“AI video generators”“AI ethics & prompt engineering”面板——反映主流用户对生成媒体可信度的焦虑。https://www.pinterest.com/pin/951104015101996491/
- #32 — “22 Best & Free AI Video Generators”,样本中规模最大的工具合集;其“Top 5 Picks”将 Kling AI 和 Hailuo AI 的写实性排在 Runway、Pika 之前。https://www.pinterest.com/pin/128493395623874987/
- #35 — “Today's AI News, May 20 2026”:Google I/O 2026 回顾——Gemini 3.5 Flash、Gemini Omni、Gemini Spark 代理以及 Android XR 智能眼镜。https://www.pinterest.com/pin/652670171044638578/
- #44 — “This Week in AI News” 仿报纸(2026 年 8 月 15 日),标题线索包括“Open Models / Open weights”“Sovereign AI”“Agent Harness”——是全样本中唯一明确提到开放权重模型的 Pin,但仅作为新闻首页中的标题提示,非演示。https://www.pinterest.com/pin/644577765463965693/
- #48 — “Amuse 3.0”,AMD 支持的本地 AI 艺术创作工具发布——是少数点名具体新产品的 Pin,而非泛用清单或新闻 logo 卡。https://www.pinterest.com/pin/4601060441986715264/
信号
- Kling AI 与 Hailuo AI 已跻身头部阵营,几乎每个收集到的清单文章都将它们与 Runway、Pika、Luma 并列(
[7, 13, 30, 32, 41, 43])——相比一年前 Runway/Pika 双强的局面,头部选择更加多元。 - Google 的 Veo/Gemini 推进是该平台上最可见的闭源故事,反复出现在独立的 AI 新闻 Pin 中(Veo 2 发布、Gemini 3.5/Omni/Spark、2026 I/O 的 Android XR 眼镜),而非依靠单一病毒式帖子。
- OpenAI 主要以 logo 拼贴的形式出现;只有一处具体提及 Sora-2(#4:模糊录屏,显示第三方工具“zeely.ai”运行在“sora-2-video-ad”模式),与其在其他平台的通常影响力相比非常单薄。
- 深度伪造/真实性焦虑是反复出现的潜台词,并非单次现象:盖有“FAKE”印章的内容 Pin、97% 的 AI 语音检测结果、以及“Human Journalism vs. Machine-Generated Media”图像分别独立出现(
[5, 16, 27])。 - 商业化/副业框架非常明显——带有联系方式的自由职业 AI 视频服务广告(#24)、“无脸频道”与“内容营销”推销(#23、#25);Pinterest 的 AI 视频受众更像希望销售服务或扩大内容生产的创作者,而非研究者。
- 开源几乎完全缺席。 在全部 50 个 Pin 中,没有任何 Stable Diffusion、Flux、ComfyUI、Wan、HunyuanVideo、LTX、Mochi 或 GitHub/HuggingFace 链接。唯一痕迹是在一张模拟 AI 新闻头版(#44)中出现“Open Models. Open weights.”字样——从未作为独立 Pin、工具 logo 或演示出现。对于这一主题,Pinterest 内容几乎完全是闭源 SaaS 营销和 SEO “最佳工具”清单;仅依赖该平台的读者甚至不会知道开源图像/视频生成已经形成一个生态。
局限
- 工作器的
pinterest.pins.md表格没有按题材分区(50 个 Pin 在一个隐含题材下的扁平列表),因此所有 Pin 被整体分析,而非按 playbook 对多题材任务的描述逐类分析。 - 多个 Pin 的标题与实际图像内容不符,而且根据 playbook,本阶段不直接浏览 Pinterest 验证,因此仅标记为未确认,未作为结论报告:#42(“Nvidia #NEW AI Tools”)只显示 Jensen Huang 演讲的通用照片,没有可见的具体工具信息;#45(“Grok 5: Elon Musk's AI Revolution”)和 #50(“Discover how Grok is revolutionizing video”)均为泛用库存/AI 新闻主播图像,没有 Grok 特定内容;#40(“GPT 5.2, realtime video editor...”)只显示泛用的“重大 AI 新闻”反应缩略图。
- 多个 Pin 是近乎重复的通用库存图,缺乏独特信息内容(
[2, 8, 22, 29, 39, 45, 49])——虽然计入 50 条,但未被视作独立信号。 - 未在 Pinterest 找到本主题的开源图像/视频生成内容。该缺席本身就是该平台的核心发现,而非研究缺口——见上方信号。
推荐行动
- 跟踪 2026-09-24 后 Sora API 流量迁移至何处——Seedance 2.5、MiniMax H3 或 Kling v3。
- 关注 Qwen-Image-2.1 的非商业研究许可是否变化,因为“它是否开源”的争论仍在持续。
- 将 Lemmy 上 MiniMax H3 ComfyUI 节点的发帖频率作为开放权重视频采用率的领先指标。
- 使用主题专属搜索词而非地区热门趋势,重新运行 X 收集阶段。
- 使用按模型划分的搜索词重新运行 Reddit 收集阶段,以达到约 20 条帖子的目标。
- 在将其视为已确认事实前,应通过一手来源核实 Midjourney 转向医疗超声 CT 的消息。
收集图片


















































数据质量说明
由于搜索词不匹配,X 在 32 条帖子中产出 0 条主题相关内容;Reddit 仅通过单一搜索词收集到目标约 20 条中的 12 个帖子;Bluesky 的搜索 API 被 403 封锁,只能通过账号信息流抽样绕过;而 YouTube 页面采用 JS 渲染,无法确认播放量和准确日期。



