图像与视频生成 AI 新闻 — 2026-09-11
封闭阵营的焦点是 GPT Image 2 与 Nano Banana Pro 的双强图像对决,以及 Runway/Kling/Veo/Seedance 的视频横向比较;开放阵营则围绕 Wan 3.0、Z-Image Turbo、FLUX.2 和 MiniMax-H3 的 ComfyUI 生态,以轻量化和高速化为核心迅速升温。
图像与视频生成 AI 最新新闻 — 2026-09-11
现在的图像、视频生成 AI 圈子简直热得离谱🔥🔥。封闭阵营里,Google 和 OpenAI 正拿 Nano Banana Pro 与 GPT Image 2 正面硬碰硬;视频方面,Runway Gen-4.5、Kling 3.0、Veo 3.1、Seedance 2.5 等模型也被频繁放在一起横评📹✨。开源阵营同样活跃:Alibaba 的 Wan 3.0 与 Z-Image Turbo、Black Forest Labs 的 FLUX.2、Tencent 的 HunyuanImage 3.0 都有不少动静;尤其每次新模型一出,ComfyUI 圈子很快就会冒出 LoRA 和加速版🛠️⚡。不过这次 X 完全没搜到相关主题(很可能是搜索词跑偏),确实形成了一个明显缺口😅。整体来看,这一期呈现出两条清晰主线:封闭模型是“整合与横评热潮”,开放模型则是“轻量化、极致加速与生态繁荣”。
跨平台总结
- Seedance 2.5(封闭/ByteDance)× Wan 3.0(开放/Alibaba)× MiniMax H3 的三方争霸是当前最火的格局。YouTube 出现了覆盖 75 个提示词的大规模对比视频(Seedance 2.5 vs 2.0 vs MiniMax H3 vs FLUX 3 vs Wan 3.0);Bluesky 上 aetherwavestudio 也发布价格快讯:“Wan 3.0 is live! 480p/1080p 为 14 credits/sec”(帖子)。Reddit 上的模型选择咨询中也频繁提到这一类工具。
- GPT Image 2(OpenAI)vs Nano Banana Pro(Google)的封闭模型双强对决同时出现在多个平台:从 YouTube 单独评测(GPT Image 2 Finally Fixed AI Image Generation)到直接对比视频(GPT Image 2 vs Nano Banana Pro)、Bluesky 上创作者账号的实际工作流分工(picatrix-picori),再到 Reddit 上“Gemini 拒绝生成,因此转投 GPT Image 2”的求助。
- 对**“免费、无限、无水印”**的怀疑,是 Reddit(r/generativeAI 的“"Unlimited is a lie"”帖子)和 Bluesky(zsky.ai 的“实际测试并排名”链接)各自独立出现的常见质疑话题。
- AI 生成内容的现实危害与审核失效也构成跨平台担忧。Reddit 有“AI 直接操作数位板伪造延时绘画”的指控(帖子),以及揭露 Facebook 放任儿童虐待 AI 视频的文章(帖子);Lemmy 转发了 Wired 关于 Meta 出现 CSAM 广告的报道(文章);Bluesky 上希望采用 AI 检测技术 SynthID 的帖子获得 213 个赞(帖子)。这些信号从不同角度印证了同一类焦虑。
按平台总结
Reddit:r/generativeAI、r/aivideomaking 中的实用工具求助,与 r/antiai 中的反弹和举报形成鲜明分化。本次反响最大的是 r/antiai 中“AI 可以伪造真实延时绘画”的指控帖(7,137 分、1,024 条评论);人们对 AI “装得像真的”这一点的警惕正在快速上升📈。
X:完全扑空😇。检查了全部 40 条帖子,没有一条与图像或视频生成 AI 有关。所用搜索词(Charlie Kirk、Apple、MAGA 等)偏离主题,只是直接抓取了 X 的趋势页。这是任务点名平台中的真实缺口;下次应以 Midjourney、Sora、Kling 等模型名重新搜索。
YouTube:信息量最大🎬。从 Runway 的 Gen-4.5 官方发布,到 Kling 3.0/Grok Imagine/Runway/Veo 横向比较,再到 Adobe Firefly 将多个封闭模型汇聚到同一平台,以及开放阵营的 Z-Image Turbo、FLUX.2、HunyuanImage 3.0 评测,覆盖相当广。不过受 JavaScript 渲染限制,未能取得播放量和订阅量。
Bluesky:官方搜索 API 返回 403,但仍通过 Feed Generator 找到了 ZSky、aetherwavestudio、picatrix-picori 等 AI 视频账号的价格竞争和实际创作工作流。平台整体的艺术信息流偏向“拒绝 AI”,但日语 #AIイラスト 标签生态独立且活跃🎨。
Lemmy:规模不大,但质量很浓。!«メールアドレス» 已成为 MiniMax-H3、Krea2 Turbo 周边 ComfyUI 节点与 LoRA 的“快讯流”,最具体地反映开放生态的动向。封闭阵营则以 Google 的 Nano Banana Earth AI 功能因问题迅速下线等版权、审核话题为主。
Pinterest:精读 50 个 Pin 中的 30 个。Google Veo 2/3 官方宣传、Gemini API 集成等封闭模型的具体数字尤其显眼,例如 Gemini 有 10 亿用户、每天生成 1.5 亿张图片;开放模型只有一条 Stable Video Diffusion 提及,明显不足。大量图片是 SEO/联盟营销导向的“汇总文章”,氛围更偏“盘点与教程”而非快讯。
值得关注的重点
- Wan 3.0 系列的价格战 — Bluesky,aetherwavestudio 的帖子。3.0、3.0 Pro、2.7 Spicy 同时发布,且明确列出积分单价;值得持续追踪开放权重阵营的定价走向。
- Seedance 2.5 vs Wan 3.0 vs MiniMax H3 三方争霸 — YouTube,75 AI Video Tests。这是当前视频生成趋势的核心结构。
- GPT Image 2 vs Nano Banana Pro — YouTube,直接对比视频。封闭图像生成双强之争的走向。
- r/antiai“伪造延时绘画”指控的扩散 — Reddit,帖子。公众对伪装“真实感”的 AI 手法的反弹会扩展到何种程度。
- Google Nano Banana Earth AI 下线风波 — Lemmy,Fortune 文章。封闭巨头的审核体系未来将如何调整。
- 对 AI 检测技术 SynthID 的支持扩大 — Bluesky,aimod.social 的帖子。人们“想分辨出来”的需求是否会转化为未来的产品功能。
推荐行动
- 下次 X 收集应改用 Midjourney、Sora、Kling 等模型名重新搜索,补上本次空缺。
- 持续观察 Wan 3.0 与 Seedance 2.5/MiniMax H3 的三方比较,并按月更新竞争格局。
- 对封闭巨头(Google、Meta、OpenAI)的审核失效新闻,持续从 Lemmy 与 Reddit 两端定点观察。
- 将 Lemmy 的 ComfyUI/LoRA 生态快讯作为开放模型动向的一手信息源持续检查。
- 只要 Bluesky 官方搜索 API 的 403 问题持续,就维持通过 Feed Generator 的收集流程。
- Pinterest 不适合获取快讯;趋势追踪应优先使用 YouTube、Lemmy、Reddit,并将 Pinterest 作为视觉趋势的辅助资料。
关于数据质量
X 没有任何符合主题的帖子,属于搜索词选择错误导致的实质性收集失败。Reddit 仅有 11 个帖子,未达到约 20 条的目标。Bluesky 官方搜索 API 被 403 全面阻断,只能依赖 Feed Generator 替代收集。YouTube 受 JavaScript 渲染限制,未能取得播放量、订阅量等定量数据。Lemmy 中直接相关的帖子实际最多约为 10~15 条。Pinterest 更像是 SEO/联盟营销导向的汇总图片,几乎没有开放模型相关内容,应注意这一点。
按平台总结
Reddit — 图像与视频生成 AI 新闻
来源
以“"Image and Video Generation AI News"”搜索,共从 7 个 subreddit 收集到 11 个帖子。
| Subreddit | 成员数 | 收集帖子数 |
|---|---|---|
| r/generativeAI | 152,155 | 3 |
| r/antiai | 321,679 | 2 |
| r/aivideomaking | 6,743 | 2 |
| r/AItips101 | 1,269 | 1 |
| r/GetNoted | 298,268 | 1 |
| r/clevercomebacks | 2,805,289 | 1 |
| r/TrueReddit | 628,575 | 1 |
生成 AI 工具的实用咨询主要集中在 r/generativeAI 和 r/aivideomaking;对 AI 生成内容的反弹和举报集中在 r/antiai;AI 图片作为病毒式迷因扩散的案例见于 r/GetNoted、r/clevercomebacks;将其作为社会议题深入讨论的文章则见于 r/TrueReddit,形成了明显分工。
人们怎么说
-
帖子 #1(r/AItips101,132 分、70 条、2026-09-07):“The best uncensored AI image generators in 2026” 将 WildOwl.ai 评为第一,称其是可使用 35 种以上模型(Qwen Image、Flux、Seedream、Wan、Kling、Seedance、Veo、GPT Image 等)的“限制较少”服务。评论中,u/reliablemicrophone84(4 分)表示“我在其他平台的令人沮丧的过滤器上浪费了太多积分”;同时也有人推荐 Mage.space、Perchance、Venice API 等竞品。 https://www.reddit.com/r/AItips101/comments/1w9yftp/
-
帖子 #2(r/antiai,7,137 分、1,024 条、2026-09-05):“Warning: There is a new form of ai generated image”。指控称,给 LLM(标为 GPT-6)配备鼠标和键盘后,它可以直接在绘图软件中作画,从而伪造“真实的延时绘画”。最高赞评论 u/Nayutantantan(2,510 分)表达强烈不满:“I hate this. So. So. MUCH ... the trends of creating fake timelapses are getting common”。 https://www.reddit.com/r/antiai/comments/1w81kdd/
-
帖子 #11(r/antiai,7 分、6 条、2026-09-08):GPT Image 2.5 发布视频中,一名女性把 AI 生成的纹身方案直接纹到真实手臂上,引发讨论。u/Realistic-Buy4975(5 分)报告现实影响:“我所在城市的一位昂贵纹身师曾想给我女友做 AI 生成的纹身,我讨厌这个时代。” https://www.reddit.com/r/antiai/comments/1waxzvf/
-
帖子 #3(r/generativeAI,1 分、10 条、2026-09-07):“Cheapest UNLIMITED 1080p Image-to-Video AI Generator?” 引发对“unlimited”说法的集中不信任。u/ai_art_is_art(3 分)称:“Unlimited is a lie. You put $550 in, you get $200 out and you have to wait 24 hours between generations”。Artlist.io(€550/年)和 Runway 的高价套餐也被拿来比较。 https://www.reddit.com/r/generativeAI/comments/1wa4k88/
-
帖子 #4(r/aivideomaking,15 分、36 条、2026-09-07):“free video ai generator” 的发帖者希望免费生成 45 秒视频。u/NewLifeWares(2 分)指出:“45 seconds is reaching data center level requirements of hardware. At best you might find a free 5 second generator ... with a watermark”,反映出社区共识:免费长视频生成并不现实。 https://www.reddit.com/r/aivideomaking/comments/1w9h5a9/
-
帖子 #5(r/aivideomaking,3 分、17 条、2026-09-09):针对写实图像、视频生成工具的咨询,评论列出了 OpenArt AI、fal、dzine、pixverse、Higgsfield、RunningHub(通过 ComfyUI 可使用开放及封闭模型)、cyberbara(“Seedance 2.5 on it is uncensored and supports real face”)等大量具体工具。 https://www.reddit.com/r/aivideomaking/comments/1wbxpdf/
-
帖子 #7(r/GetNoted,1,339 分、160 条、2026-09-10):一张 X 上的 AI 生成图片因被指意在制造“愤怒流量”而走红。图中文字崩坏,u/NegativeMammoth2137(51 分)借机嘲讽:“Today's schedule 9:00 - Room 9:00 - Handloags 10:00 - 5 pm”。AI 图片容易被识破,反而成了笑料。 https://www.reddit.com/r/GetNoted/comments/1wcw3n9/
-
帖子 #9(r/clevercomebacks,5,664 分、269 条、2026-09-09):一张标注“this AI generated image shows exactly how life really is!!!”的政治迷因图,其评论区从 AI 本身转向移民、社会福利等政治争论。这是 AI 图像被当作宣传“素材”的实例。 https://www.reddit.com/r/clevercomebacks/comments/1wbri5x/
-
帖子 #10(r/TrueReddit,1,188 分、51 条、2026-09-09):文章“Facebook Is Hosting Huge Numbers of Horrifying AI-Generated Videos of Violent Child Abuse, and Meta Is Barely Even Pretending to Care”。u/mirh(24 分)引用官方声明后指出:“Meta appears to have already deployed systems that can identify the stomach-turning videos, even if it's declining to use them to moderate”,即 Meta 似乎已有检测能力,却拒绝将其用于审核。 https://www.reddit.com/r/TrueReddit/comments/1wbnann/
-
帖子 #6(r/generativeAI,2 分、3 条、2026-09-08):一位用户想创作迪士尼角色同人图,却被 Grok 拒绝生成;评论推荐 PixelForge(iOS、无限)和 dreamfort.ai/image 作为替代。规避版权角色生成限制的需求仍在持续。 https://www.reddit.com/r/generativeAI/comments/1waapc1/
-
帖子 #8(r/generativeAI,1 分、3 条、2026-09-10):用户希望制作塔罗牌图片,但 Gemini 经常拒绝生成;GPT Image 2 和 Google Flow 被提出作为替代选择。 https://www.reddit.com/r/generativeAI/comments/1wc347t/
信号
- 上升趋势:r/antiai 对“AI 装得像真的”的警惕正在急剧上升。帖子 #2(7,137 分、1,024 条)是本次收集里反响压倒性最大的内容;“LLM 直接操作数位板伪造延时绘画”的新手法带来的恐惧最突出。帖子 #11 的纹身事件也反映了同源担忧:AI 生成内容直接混入现实决策。
- 两种对立视角:即使同样围绕“无审查、无限制”的生成 AI,r/AItips101 积极介绍并推荐 WildOwl.ai、cyberbara 一类“unrestricted”工具;r/antiai 则强烈谴责相同类别技术造成的模仿与冒充。工具导向社群与反 AI 社群的温差被直接可视化。
- 被轻视或直接驳回的主张:寻求“免费、无限、高画质视频生成”的帖子(#3、#4)都被社区立刻否定:“不存在这种东西”“unlimited 是谎言”。期待与实际成本结构之间的落差已成为常见讨论。
- 意外之处:最严重的内容——Facebook 放任儿童虐待 AI 生成视频的 TrueReddit 指控文章(帖子 #10)虽然有 1,188 分,但仅 51 条评论;明显低于政治迷因图的帖子 #9(5,664 分、269 条)和嘲笑 AI 图像文字崩坏的帖子 #7(1,339 分、160 条)。比起严重的安全议题,迷因化、娱乐化的 AI 生成内容更能获得互动。
局限
- 本次只使用了“"Image and Video Generation AI News"”这一个搜索词,并未分别搜索 “Nano Banana”“Sora”“Flux”“Wan”“Kling”“Seedream”等具体模型名,也没有明确区分封闭与开放模型。因此,对于任务要求的“开放和封闭两端各至少 10 条洞察”,相关信息略显不足。
- 收集到的帖子总数仅 11 条,未达到每个平台约分析 20 条帖子的完成标准。
- 每个帖子只收集了排名前 6 的评论,未核查后续评论及帖子中的反驳或更正。
- Reddit 仅使用无头浏览器进行了预收集;本代理未进行 WebFetch 或追加搜索(受 playbook 约束),无法访问额外搜索结果或未收集帖子。
X
X — 图像与视频生成 AI 话题为零,收集到的只有无关趋势
检查 output/x.posts.md 中收集的全部 40 条帖子后发现,没有一条涉及图像生成 AI 或视频生成 AI(无论封闭还是开放)。搜索使用的关键词为 “Charlie Kirk”“Apple”“MAGA”“Palestinian”“iPhone”“Britain”“Anthropic”“#CyberSecurity”“harvey as the ai os”“The OS”,并非针对本任务主题,而是直接使用了 X Explore 页面展示的趋势词。详情见 ## 局限。
账号
收集到的 40 个账号均只有 1 条帖子,未见与主题相关的 AI 专业账号。互动量较高的账号包括:
- @esjesjesj(evan loves worf)— 63,289 个赞。关于 Charlie Kirk 相关迷因争议的政治帖子。
- @TheAnglo_(Anglo)— 60,624 个赞。围绕英国和以色列的政治煽动帖。
- @anickytwts(Anicky)— 48,010 个赞。Apple Event 的实时反应。
- @allaboutthem3ts(sofia (she/her))— 32,919 个赞。关于 Charlie Kirk 遇刺话题的玩笑。
- @luquinha(luquinhas)— 20,828 个赞。仅带有 #AppleEvent 标签的帖子。
- @MurdoinkGS(Green Screen Videos by Murdoink)— 21,480 个赞、约 1,100 万次浏览。iPhone Duo 的绿幕素材视频,属于设备话题,与生成 AI 无关。
发布 AI 相关内容的仅有少数账号:
- @restitutorII — 介绍 Anthropic 关于经济影响的报告,属于文本 LLM 议题,不涉及图像或视频生成。
- @bcherny(Boris Cherny,Anthropic)— 内容不明的短帖 “It's the little things”。
- @krisfredrickson 等多名账号(#33–36)— 法律 AI 初创公司 Harvey 获得 5.5 亿美元融资的新闻。
- @Iziedking、@SYNEX98_36 — 使用 Binance Agent OS / MCP 的交易代理话题。
这些都是“AI 新闻”,但均未触及图像或视频生成模型,如 Midjourney、Stable Diffusion、Sora、Runway、Kling、Flux 等。
帖子
如上所述,没有符合任务主题的帖子,因此无法提供“代表性帖子”。仅供参考,以下是与 AI 有关的帖子:
- Anthropic 经济报告介绍 — @restitutorII,434 个赞、68 次转发、39 条回复、约 50,000 次浏览、2026-09-10。“Anthropic in its report imagines 3 possible futures for the American economy in 2030...”——预测 LLM 对就业和 GDP 的影响,与图像、视频生成无关。
- Harvey(法律 AI)获 5.5 亿美元融资 — @krisfredrickson 等 4 条帖子(#34、#35、#36),最高 10,474 个赞、约 252,000 次浏览、2026-09-09~10。面向法律工作的 AI 融资新闻,不涉及图像或视频生成模型。
- 使用 Agent OS / MCP 的自动交易 — @SYNEX98_36,80 个赞、71 条回复、约 2,700 次浏览、2026-09-09。“What happens when you give an AI agent access to Binance?”——关于代理型 AI 的实验,不属于图像、视频生成 AI。
这 3 条不能作为“图像与视频生成 AI 新闻”采用,因此不计入封闭或开放模型的任何洞察。
信号
- 在这 40 条收集内容中,完全没有提及图像或视频生成 AI,例如 Midjourney、Stable Diffusion、Sora、Runway、Kling、Flux、ComfyUI、Nano Banana 等。
- X 上真正活跃的话题是围绕 Charlie Kirk 遇刺一周年的政治争论、Apple 新品发布会(iPhone Duo 折叠设备)反应、英国与以色列的外交摩擦、MAGA 政策批评、巴勒斯坦相关政治帖子等,均与主题无关。
- 与 AI 有关的内容只有“Anthropic 经济影响报告”“法律 AI Harvey 的大额融资”“交易代理 OS”三类,均属于文本/代理型 AI,和图像、视频生成 AI 是不同语境。
- 因此,无论是“封闭模型动向”还是“开放模型动向”,本次 X 收集都未能提供任何洞察。
局限
- 搜索词与主题不匹配:所用搜索词并非面向图像、视频生成 AI,而是看起来直接使用了 X Explore 中的趋势话题,因此没有抵达任务要求的“图像、视频生成 AI 的封闭/开放最新新闻”。
- Explore 的区域性:收集的 10 个趋势中,有 8 个仅标示为“Politics · Trending”或“Technology · Trending”,另 2 个(#CyberSecurity、harvey as the ai os、The OS)明确显示“Trending in Croatia”。Explore 会基于本会话连接服务器所在地显示内容,因此这些并不代表全球趋势,可能与克罗地亚或连接来源的地区有关。
- 无法满足本任务完成标准:要求是每个社交平台分析约 20 条帖子,但分析全部 40 条后,符合主题的帖子为 0。因此,本阶段无法分别提供封闭和开放模型各至少 10 条洞察;应通过 Reddit、YouTube、Bluesky、Lemmy、Pinterest 的其他阶段,或以 “Midjourney”“Stable Diffusion”“Sora”“Runway”“Kling”“Flux”“ComfyUI”“Nano Banana” 等词重新采集 X 来补足。
- 会话本身有效,帖子也正常收集,没有会话过期或报错迹象;问题仅在于搜索词选择。
YouTube
YouTube — 图像与视频生成 AI 新闻(封闭/开放)
频道
YouTube 搜索结果并不总能取得视频发布者的频道名称(参见局限),但确认到以下频道较突出:
- RunwayML(官方频道)— Runway 的官方发布频道,发布 Gen-4.5 等内容。
- Innovate Futures @ Benji — 检验本地图像生成模型(如 Z-Image Turbo)的创作者频道。
- 其余多数为 AI 工具横评、测评类个人频道;由于搜索结果中频道名需要进一步点入才能显示,未能逐一确认。
视频
-
Introducing Gen-4.5 | Runway
Runway 官方 / 2025-12-01 / https://www.youtube.com/watch?v=ei2PsDpPbB4
Runway 新旗舰视频生成模型“Gen-4.5”的官方发布。宣称在 Artificial Analysis Text-to-Video 基准中排名第一(Elo 1,247)。 -
Kling 3.0 vs Grok Imagine vs Runway Gen-4.5 vs Veo 3.1: The Ultimate AI Video Comparison
2026-03-10 / https://www.youtube.com/watch?v=x5fMQvhKP60
四大封闭视频模型横向比较。结论认为 Kling 3.0 在文生视频批量产出上占优,Veo 3.1 具有电影感质量,Runway Gen-4.5 则在创作控制上更受认可。 -
I Tested Every AI Video Model in Adobe Firefly So You Don't Have To (July 2026)
2026 年 7 月 / https://www.youtube.com/watch?v=nOSYufWVdq8
在 Adobe Firefly 内一次测试 Veo 3.1、Kling 3.0、Runway 4.5、Sora 2 等共 14 个模型。显示封闭模型正逐渐被汇聚到单一平台。 -
GPT Image 2 Finally Fixed AI Image Generation
2026-04-27 / https://www.youtube.com/watch?v=VH9vxd3Uzzc
评测 OpenAI 的 GPT Image 2。重点介绍文字渲染精度提升、高密度构图及多语言文字支持。 -
OpenAI GPT Image 2 vs Gemini Nano Banana Pro
2026-04-22 / https://www.youtube.com/watch?v=RIWI82PZFNo
直接比较 GPT Image 2 与 Google Nano Banana Pro,将其定位为封闭图像生成的双强对决。 -
Best AI Video Generator for 2026 (Seedance 2.5 vs. WAN 3.0 vs. Minimax H3)
约 2026 年 8 月(显示“3 weeks ago”) / https://www.youtube.com/watch?v=0EozcQ3HMHE
比较 ByteDance 的 Seedance 2.5(封闭 API)、Alibaba 的 Wan 3.0(开放阵营)和 MiniMax H3,是近期较新的一支横评视频。 -
Seedance 2.5 vs 2.0 vs MiniMax H3 vs FLUX 3 vs Wan 3.0 | 75 AI Video Tests
约 2026 年 8 月(显示“3 weeks ago”) / https://www.youtube.com/watch?v=RM2XAhLNlxc
以 75 个提示词横向比较 5 个模型的大规模测试,展示 2026 年 8 月的竞争格局。 -
Wan 3.0 Prime Review: Can It Beat Flux 3 and Seedance 2.5?
约 2026 年 8~9 月(显示“2 weeks ago”) / https://www.youtube.com/watch?v=REZiNOWyen0
评测 Alibaba 的加速版“Wan 3.0 Prime”。指出其生成速度提高,但价格约增加 40%,体现速度与成本的取舍。 -
MiniMax H3 Max 视频生成性能测试 (2026.08.27)
2026-08-27 / https://www.youtube.com/watch?v=NT1gYHWQ_T0
日语频道对 MiniMax H3 Max 的性能测试,以写实提示词验证运行速度和画质。 -
Z-Image Turbo Released - Fast Distilled Image Model - Slap On The Face Next Day
Innovate Futures @ Benji / 2025-11-27 / https://www.youtube.com/watch?v=3mT7KnotPqk
将 Alibaba Tongyi Lab 的开放权重图像模型“Z-Image Turbo”(60 亿参数、不到 1 秒生成、可在消费级 GPU 上运行)与 FLUX.2 进行正面比较。 -
HunyuanImage 3.0 — The Most Powerful Open-Source Image Generator Yet
2025-09-30 / https://www.youtube.com/watch?v=U-8RjjU7x14
介绍 Tencent 的开源 MoE 图像模型(总参数 800 亿、推理时激活 130 亿),强调其长提示词理解能力和基于世界知识的图像补全能力。 -
FLUX.2 Review: Is This The AI Generator That Puts Midjourney To Shame? (2026)
2025-12-01 / https://www.youtube.com/watch?v=szTub67xQ4Y
评测 Black Forest Labs 的开放权重模型“FLUX.2”。通过与封闭模型 Midjourney 比较,认为开放阵营的画质正在追赶。
信号
- 封闭阵营的关键词是“整合到一个平台”:Adobe Firefly 将 Veo、Kling、Runway、Sora 集中到一个平台;相比单独宣传模型,平台内横评内容正在增加(#3)。
- 2026 年 8~9 月的视频生成热点是“三强对决”:Seedance 2.5(ByteDance、封闭 API)、Wan 3.0(Alibaba、开放阵营)、MiniMax H3 同时出现在大量横评中,构成近期讨论中心(#6、#7、#9)。
- 开放阵营主打轻量化和高速化竞争:Z-Image Turbo 以比 FLUX.2 更小的 6B 参数实现消费级 GPU 运行;Wan 3.0 Prime 增加优先速度的收费方案。“速度 vs 质量/成本”的权衡是开放侧主战场(#8、#10)。
- 图像生成的封闭双强格局已稳定为 OpenAI(GPT Image 2)vs Google(Nano Banana Pro/Gemini),横评形式也固定为“新模型发布后立即出现比较视频”(#4、#5)。
- HunyuanImage 3.0、Qwen-Image 等中国开放模型持续获得评测,并有突出超大参数规模(800 亿级)的趋势(#11)。
局限
- YouTube 搜索结果页(
youtube.com/results?...)与单支视频页(youtube.com/watch?...)均由 JavaScript 渲染,WebFetch 只能获得页脚导航链接,无法直接确认播放量、订阅数、详细简介和热门评论。上文日期与频道名基于搜索摘要和外部文章的推断、交叉核验,报告中未列出播放量。 - 虽尝试限定为从 2026-09-11 往前 60 天内(7 月中旬以后)上传的视频,搜索结果仍混入很多 2025 年 11 月至 2026 年 4 月的视频。上述 12 条中,较有把握在最近 60 天内的只有 #3、#6、#7、#8、#9。
- 关于 Seedream 5.0 Pro(ByteDance,2026-07-08 发布)虽找到不少博客文章,但未能定位单独评测的 YouTube 视频;仅在 #6 等对比视频中有提及。
Bluesky
Bluesky — 图像与视频生成 AI 新闻
账号
- @zsky.ai(主页):其 AI 视频生成服务“ZSky”的宣传账号,持续发布主打免费、无限、无水印的视频生成工具比较,以及与 ChatGPT(图像/视频系)的速度、质量基准。
- @aetherwavestudio.bsky.social(主页):AI 视频生成积分的经销/代理账号,快速发布 Wan、Grok Imagine、SUNO 等模型新版和调价消息。
- @picatrix-picori.bsky.social(主页):独立创作者,介绍如何把 Nano Banana 2、Omni 1.1 Flash、Hailuo、Nijijourney 等多个封闭工具分工用于动漫风视频、游戏素材等实际创作。
- @aimod.social(主页):Bluesky 上用于检测、标记 AI 生成图片的非官方审核服务,发帖呼吁推广 Google SynthID 等 AI 检测技术;服务停摆 10 个月后于 2026 年 7 月恢复。
- #AIイラスト 社群(如 @sheenaaiart.bsky.social、@muranarkabs.bsky.social、@modean987.bsky.social 等):日语圈 AI 图像创作者通过
#AIイラスト、#AIart标签每小时持续发布数十条内容的独立标签社群,同时使用 Midjourney、SDXL 系模型(如“MiaoMiao Harem Base”)等封闭和开放工具。 - @morisato.jp:通过 Bluesky Feed Generator 运营“AIart (worldwide)”信息流,以 StableDiffusion/Midjourney/DALLE 等关键词收集 AI 艺术帖子。
帖子
- picatrix-picori.bsky.social(2026-09-10,5 个赞):“📷 Nano Banana 2 / 🎥Omni 1.1 Flash / 🎵Omni 1.1 Flash”,附带
#anime #aivideo #solodev #gamedev标签。展示个人创作者结合最新封闭图像、视频、音频生成模型进行制作的实例。 https://bsky.app/profile/picatrix-picori.bsky.social/post/3mv6x2oxe3k2b - picatrix-picori.bsky.social(2026-09-09,10 个赞、2 次转发):讨论 MiniMax 视频生成模型“Hailuo”的性能,并与其他 AI 视频工具比较;是该账号互动较高的一类帖子。 https://bsky.app/profile/picatrix-picori.bsky.social/post/3mv3n3s7hzs2e
- aetherwavestudio.bsky.social(2026-09-10):“Wan 3.0 is live! 480p and 1080p from 14 credits/sec. Wan 3.0 Pro and Wan 2.7 Spicy landed too. Every bundle is 30% off through Sunday night. 500 credits for $3.49”。快速报道开放权重视频模型 Wan 3.0、3.0 Pro、2.7 Spicy 同时推出以及价格调整。 https://bsky.app/profile/aetherwavestudio.bsky.social/post/3mv6gtlugvo2u
- aetherwavestudio.bsky.social(2026-08-18):“Grok Imagine 1.5 won our 8-model AI video test at $0.20/clip. The $2.00 entry lost.”。其自有基准称,xAI 的封闭视频模型 Grok Imagine 1.5 在 8 模型测试中兼具价格与性能优势。 https://bsky.app/profile/aetherwavestudio.bsky.social/post/3mtdvieyai22c
- zsky.ai(2026-09-10):“Watermark-free, paywall-free AI video tools that actually exist. Tested and ranked.”。链接到一篇对无水印、免费视频生成工具进行实际测试和比较的博客。 https://bsky.app/profile/zsky.ai/post/3mv6myhip772h
- zsky.ai(2026-04-21~25,多条帖子、合计约 3~4 个赞):将自家 ZSky 与 OpenAI ChatGPT 图像生成(Images 2.0)直接比较,称“ZSky 中位耗时为 7 秒,ChatGPT 为 30~60 秒,另有 14 分钟冷却时间”“ChatGPT 擅长文字绘制,ZSky 擅长照片和电影感画面”。日期较早,但作为封闭模型间性能竞争的一手信息仍有价值。 https://bsky.app/profile/zsky.ai/post/3mkdmaxmv332i
- aimod.social(2026-08-02,213 个赞、61 次转发):“At the end of the day what people keep asking for is the ability to know when something is or is not AI... Hopefully tools like SynthID become widespread”。希望 Google 的 AI 内容电子水印技术 SynthID 得到普及,是该账号本次收集到的互动最高帖子。 https://bsky.app/profile/aimod.social/post/3ms55omd4bc2m
- sheenaaiart.bsky.social(2026-09-11,7 个赞、2 次转发):每日使用
#AIイラスト标签发布主题插画的账号当天帖子。单帖互动较小,但高频发布正是该社群特点。 https://bsky.app/profile/sheenaaiart.bsky.social/post/3mv7ehe3hdo2k - modean987.bsky.social(2026-09-11):“Lunar Fungal Reverie”作品带有
#AIイラスト #AiArt #SynthArt #Midjourney8.2标签,展示封闭模型 Midjourney 最新版 8.2 被用于实际创作。 https://bsky.app/profile/modean987.bsky.social/post/3mv7eoj33jqbo - alexip718.com(2026-09-11,8 个赞、4 次转发):指控地方报业集团 McClatchy 正用生成 AI(“Generative AI slop”)取代有工会的记者。虽不是直接关于图像、视频生成,但反映新闻业对生成 AI 引入的反弹。 https://bsky.app/profile/alexip718.com/post/3mv7eapxg5s2k
信号
- 平台整体默认偏向“拒绝 AI”:通过 Bluesky 官方 Feed Generator 搜索“AI 图片/生成 AI”相关词,排名靠前的几乎都是明确写有“no AI”“excludes generative AI”“suppresses AI and NFT”的艺术信息流,如 Queer Art、Gay Art、Animal Art、Merfolk 等几十个。与 X、Reddit 的 AI 推进社群相比,Bluesky 艺术用户群更倾向于将排除 AI 作为默认设置。
- 与此同时,存在独立的
#AIイラスト标签经济圈:与上述排除文化并行,日语#AIイラスト标签下每小时都有数十条帖子持续流动;使用 Midjourney、SDXL 系模型的创作者形成独立社群。平台主流氛围与标签内社群之间温差很大。 - 视频生成工具的“免费、无限”竞争和价格战很活跃:zsky.ai、aetherwavestudio 等经销/自营服务账号,频繁发布 Wan 3.0 的上线价格(14 积分/秒、500 积分 3.49 美元)和 Grok Imagine 1.5 的成本效率(0.20 美元/片段)等具体数据。这与 Reddit r/generativeAI 中“unlimited 是谎言”的质疑形成呼应,免费与低价竞争以直观定价数字被呈现出来。
- AI 检测与标记技术受到关注:aimod.social 支持 SynthID 的帖子获得 213 个赞,是本次收集里反应最突出的内容,表明“想知道内容是否为 AI 生成”的用户需求在 Bluesky 上也很强。
局限
- playbook 指定的 Bluesky 公共搜索 API(
https://public.api.bsky.app/xrpc/app.bsky.feed.searchPosts)在本执行环境下始终返回 HTTP 403 Forbidden;即使q=banana这类简单词也无法搜索。因此只能组合使用getAuthorFeed、getFeed、Feed Generator、getPopularFeedGenerators等公共 API 端点收集资料。 - 受此限制,直接涉及“图像与视频生成 AI”的帖子并非由关键词搜索获得,而是通过 Feed Generator 和个人账号的信息流发现。通过 AI Creators、AIart worldwide、GenAI-Links 等多个信息流及账号时间线,确认了累计 20 条以上内容,但并不是单一搜索查询的全面采集。
- zsky.ai 对 ChatGPT Images 2.0 的比较来自 2026 年 4 月,并非 9 月最新消息;已作为较早的参考数据明确标出。
- WebFetch 获取 JSON 页面时经过摘要模型,不能保证帖子正文逐字完全一致;但已核验内容大意与 URL 的对应关系。
- 未能进行明确区分封闭/开放模型的搜索;文中分类(Wan=开放权重,Nano Banana 2/Grok Imagine/Midjourney/ChatGPT Images=封闭)基于帖文内容和模型通常的公开状态判断,并非作者本人明确标示。
Lemmy
Lemmy — 图像与视频生成 AI(封闭/开放)的最新动向
社群
- !«メールアドレス»(5,712 人)— Lemmy 最大的 AI 图像、视频生成社群。GitHub/HuggingFace 新发布内容由机器人自动转发,具有“快讯流”性质。
- !«メールアドレス»(2,364 人)— 生成图作品展示区,几乎每天都有帖子,得分约 6~16,但基本没有评论。
- !«メールアドレス»(1,662 人)
- !«メールアドレス»(1,593 人)— 专注动漫 AI 生成艺术。
- !«メールアドレス»(363 人)— 访问时被 403 拒绝(Anubis 防护),本次无法查看内容。
- !«メールアドレス»(222 人)— 近期没有帖子,处于空置状态。
- !«メールアドレス»(186 人)— 自 2025 年年中后几乎停止更新。
- !«メールアドレス»(143 人)— 最新帖子停留在 2023~2024 年,事实上已休眠。
- !«メールアドレス»(136 人)
帖子
- 开放视频生成的主角是“MiniMax-H3” —
lightx2v/Minimax-h3-Turbo(8 step/768p 加速 LoRA,截至 2026-09-08 最新版为 v1.1、4-step,得分 6~7)、Smite79/MiniMax-H3-Longvideos(最长约 120 秒长视频生成,2026-08-24,得分 5)、karuvanan/MiniMax-H3-Director-Cut-Studio(Premiere 风格编辑 UI,2026-08-28,得分 5)等。!«メールアドレス» 几乎每天都有针对该模型的 ComfyUI 节点和 LoRA 帖子。
https://lemmy.dbzer0.com/post/74605337 / https://lemmy.dbzer0.com/post/74466719 - LTX-2.5 在第一天就获得 ComfyUI 支持 — Lightricks 官方博客“LTX-2.5 is now available in ComfyUI”于 2026-08-12 被发布(得分 5),显示开放权重视频模型的实现速度很快。
https://lemmy.dbzer0.com/post/73842995 - 图像生成中“Krea 2 Turbo”趋于常用 —
F16/krea2-turbo-sda(rank-32 LoRA,2026-09-10)、lvladikov/Krea2-Turbo-Distill-4step-LoRA(2026-09-08)等已发布;!«メールアドレス» 中不少作品帖,如“Red Crowned Island”(14 分)、“Giant Wire Walker”(13 分),都使用 Krea2 Turbo 生成。
https://lemmy.dbzer0.com/post/75284619 / https://lemmy.dbzer0.com/post/75284622 Viggle/Viggle-Animate— 一种在视频中用单张图片替换角色的办法。2026-09-05 的帖子获得本时段最高得分(10)。
https://lemmy.dbzer0.com/post/75036488- 研究论文“LLaDA-Image”被分享 — 关于利用扩散语言模型进行图像生成的 arXiv 论文(2026-09-04,得分 3)。
https://lemmy.dbzer0.com/post/74988021 - 【封闭模型】DC Studios 被意外发现使用 AI 生成图像作为《Supergirl》概念图 — 制作花絮视频已从 YouTube 删除。评论中有人指出画面类似 Midjourney 的生成界面。2026 年 8 月中旬,33 分/4 条评论。
https://lemmy.today/post/58316222 - 【封闭模型】Google 搭载“Nano Banana”的 Google Earth AI 功能在公开次日下线 — 因用户可以生成不当图像(“no-no images”)。2026-08-07,Fortune 文章从 r/ArtificialInteligence 交叉发布。
https://fortune.com/2026/08/07/google-quietly-discontinues-its-earth-ai-feature/ - 【封闭模型】日本政府要求 OpenAI 应对 Sora 2 的版权侵权 — technology 社群中获得 91 分、6 条评论(日期为 2025-10-15,在本次调查中偏旧)。
https://lemmy.world/post/37391040 - 【封闭模型】Wired 报道 Meta 广告中出现 AI 生成的 CSAM — 涉及生成图像审核失败。2026-08-06,得分 50。
https://www.wired.com/story/meta-ran-ads-that-contained-ai-generated-child-sexual-abuse-imagery/ - 【封闭模型】Elon Musk / xAI(Grok)制作《奥德赛》AI 电影版的荷兰语文章被发到 films 社群(2026-07-22,得分 1、0 条评论)。链接文章访问时 403,正文未验证,仅确认标题。
https://lemy.nl/post/4342454 - 普通用户围绕 AI 图像生成是否算艺术的讨论 — memes 社群中“Promting to copy is art...I swear”一帖(2026-08-24)引发典型的正反争论:通过提示词生成能否被称为“艺术”。
https://lemmy.world/post/51072174
信号
- 开放阵营的新闻重点不在“模型”,而在“生态”。 Lemmy 的特征是围绕 MiniMax-H3、Krea2 Turbo 的 ComfyUI 自定义节点、LoRA、加速(distill/turbo)版本持续大量出现,形成草根生态快讯。大多数内容得分 2~10、评论为 0,面向技术用户,目标是“分享”而非讨论。
- 封闭模型新闻零散出现在技术社群以外的一般新闻社群,如 technology、ai_reddit、films、DC Studios 等;内容大多不是功能本身,而是版权、审核失败、监管等负面议题。
- Lemmy 对生成 AI 的态度分裂。
!fuck_ai等明确反 AI 社群也有一定存在感,例如“How to get back to habits without AI?”获得 83 分、33 条评论;对于 AI 生成内容的警惕和反感较为显眼。 - 搜索 API 准确度较低。 用
type_=All&sort=TopMonth进行关键词搜索时常返回大量无关热门帖;例如搜索“Kling AI”几乎没有实质命中。实际有效的方式是直接从社群名称进入查看。
局限
- Lemmy 在此主题中的内容基数很小。若计入一般 AI 新闻,分析帖数超过完成标准;但仅限直接相关的图像、视频生成 AI 内容,实际最多约 10~15 条。
- “Kling AI”“Sora”“Grok Imagine”“ChatGPT image”等关键词搜索几乎只返回无关结果,这些模型的具体新闻在 Lemmy 上几乎找不到。
!«メールアドレス»受 Anubis 反机器人保护,返回 403,无法查看。!«メールアドレス»、!«メールアドレス»、!«メールアドレス»要么近期无帖,要么停留在 2023~2025 年,不能作为持续更新的新闻来源。- Elon Musk/Grok 的《奥德赛》AI 电影帖(#10)链接文章返回 403,未能核实正文,仅确认标题和帖子元数据。
Pinterest — 图像与视频生成 AI 新闻
工作器已收集 50 个 Pin(未分类,单一组别)。其中实际打开并确认 30 张图片内容,其余通过标题确认。
视觉主题
- “AI NEWS”类 YouTube 缩略图模板化:戴帽子、耳机、蓄胡男性做出惊讶表情,周围以环形排列 OpenAI/Google/Microsoft/Meta/Nvidia/DeepSeek(鲸鱼)等标志;这一构图在多个发布者中反复出现 [4, 18, 28]。
- “Best AI video tools”类信息图趋于同质化:带编号的清单中,Runway、Pika、Kling AI、Luma Dream Machine、Hailuo AI、Canva 几乎以相同顺序重复出现 [8, 14, 25, 32, 50]。
- AI 新闻主播/口型同步数字人:女性人脸配合语音波形、线框人脸,或“LIVE / AI NEWS VIDEO”新闻节目风格图形颇为常见 [19, 29, 43, 49]。
- 可视化“造假”焦虑的图像:机器人查看手机上盖有“FAKE”印章的猫图、怀疑蒙面人物的构图、由矩阵风格代码组成的人脸等,多个视觉元素表达对深度伪造、错误信息的警惕 [2, 30, 39, 37]。
- “state-of-the-art”发布内容的深蓝赛博拼贴:Google Veo 2/3、Gemini API 的宣传图使用暗色背景,铺满视频静帧与光束漏斗,风格相当统一 [1, 7, 10, 17]。
- 风格转换演示:将同一个源视频重新生成木块、折纸、乐高、鲜花等材质效果,是多风格一致性生成的突出展示 [9]。
- AI 机器人记者、新闻主播形象:穿西装的机器人坐在或站在“BREAKING NEWS”前的视觉,在 AI 生成新闻语境中多次出现 [13, 40, 49]。
值得关注的 Pin
- [7] Google Unveils Veo 2 — Google 官方宣传图本身。水下拍摄、动漫角色、星空舞蹈等多样输出示例集中在同一张图上,直观展示 Veo 系列的质量卖点。
- [17] Veo 3 Image-to-Video: Fast Generation & Native Audio via Gemini API — 显示通过 Gemini API 实现图生视频与原生音频生成,是封闭模型的较新功能更新。
- [9](Luma 系风格转换演示) — 将一个源视频重构为“木块”“折纸”“乐高”“鲜花”的对比网格,作为可从单个视频一致生成多种风格的技术演示很吸睛。
- [27] Breaking News: Grok 4.6, Gemini 1B users, Honor robot phone(2026-08-12) — 带日期的 AI 新闻汇总:Grok 4.6 的自主任务执行、Gemini 用户突破 10 亿(每天生成 1.5 亿张图片)、Honor 内置机械臂手机,均附有具体数字。
- [29] Microsoft VASA-1 — 用一张静态图片和一段音频片段生成具备多种表情的对话视频的视觉讲解,是 talking-head 生成技术的代表案例。
- [32] AI Video Creation Tools Changing How Content Is Made — 大型信息图,覆盖文生视频、图生视频、编辑、配音、素材、发布优化等 20 种工具,适合作为生态全景图;Stable Video Diffusion 是其中唯一出现的 OSS 项目。
- [38] A Brief History of the Rise of Generative AI & Its Applications — 从 1950 年代 ELIZA 到 2020 年代 GPT 的时间线信息图,可用于理解背景。
- [22] AI Generated Video is Good or Not? — 同时列出优点(节省时间、低成本、高质量)和缺点(缺乏人类创意、缺乏情感连接、仍需编辑)的信息图,反映普通用户的接受方式。
- [23] More than 20% of YouTube is now AI-generated — 仅标题便提出具体统计主张:YouTube 上 AI 生成内容所占比例。
- [16] Adobe udvikler AI-model til opskalering af videoer(丹麦语)— 介绍 Adobe 将模糊视频提升至 HD 的 AI 超分模型,附有前后对比图,展示视频修复、增强这一应用领域。
信号
- 封闭模型占据主角位置:Google Veo 2/3、OpenAI Sora、Gemini API、Grok 4.6、Microsoft VASA-1 等,带有明确公司和产品名的 Pin 几乎都是封闭模型。具体数字,如 Gemini 10 亿用户、每天生成 1.5 亿张图片、YouTube 超过 20% 内容由 AI 生成等,也集中于封闭阵营 [27, 23]。
- “常用工具列表”高度同质化:不同发布者、不同博客制作的“Best AI Video Tools”类信息图很多,但列出的 Runway、Pika、Kling AI、Luma、Hailuo、Canva、Sora、Veo 基本相同。它们在 Pinterest 上已经成为当前的“事实标准”工具阵容 [8, 14, 25, 32, 50]。
- 开放模型存在感很弱:50 个 Pin 中,只有 Stable Video Diffusion(信息图 [32] 的一个项目)可明确确认属于 OSS。未见 Hugging Face、ComfyUI、LoRA、模型权重公开或本地微调等话题;Pinterest 的搜索结果以联盟营销/SEO“汇总文章”图片为主,本身就缺乏开放模型社群的土壤。
- 深度伪造焦虑及对 AI 新闻的怀疑是独立主题:虽然任务简报未直接要求,但多个 Pin 出现“FAKE”印章、戴兜帽人物、验证工具等视觉内容,显示对 AI 生成内容的不信任具有存在感 [2, 30, 39, 37]。
- 混入副业与联盟营销语境:如 Fiverr 风格的“AI 视频制作代做”服务 Pin,以及“无需编程扩展高端科技代理公司”等广告。这表明 Pinterest 更偏向“教程/变现”,而不是新闻快讯平台。
局限
- Pinterest 搜索结果主要是 SEO/联盟营销导向的“汇总文章”和 YouTube 缩略图转载,而非即时新闻;包含官方发布页、研究者帖子等一手来源的链接极少。
- 工作器在单一组别收集 50 条内容,未进行类型划分,因此没有按 playbook 所设想的“按类别总结”,而是跨主题汇总。
- 50 个 Pin 中仅 30 个被作为图片精读;其余 20 个(索引 3、6、11、12、15、20、21、24、26、31、33、34、35、41、42、46、47、48 等)仅核对标题,未精读图片正文。6 个无标题 Pin 线索不足,因此优先级较低。
- Pin 图片是静态缩略图或信息图,无法验证视频本身质量或实际生成结果。
推荐行动
- 下次 X 收集应以 Midjourney、Sora、Kling 等模型名重新搜索,补足本次空缺。
- 持续跟踪 Wan 3.0 与 Seedance 2.5/MiniMax H3 的三方对比,并按月更新竞争格局。
- 从 Lemmy、Reddit 两端持续定点观察封闭巨头审核失效类新闻。
- 将 Lemmy 的 ComfyUI/LoRA 生态快讯持续作为开放模型动向的一手信息源。
- 只要 Bluesky 官方搜索 API 继续返回 403,就保持通过 Feed Generator 的收集流程。
收集图片


















































数据质量备注
X 分析了 40 条内容却没有一条符合主题(搜索词选择失误),属于实质性收集失败;Bluesky 的官方搜索 API 被 403 全面阻断,只能通过 Feed Generator 替代收集;Reddit 仅有 11 个帖子,未达到约 20 条目标;Pinterest 几乎没有开放模型相关提及。



