每日 LLM 新闻 — 2026-09-12
今天最大的焦点并非模型发布,而是 Anthropic 的威胁情报报告(胡塞武装的武器开发、伊朗对舰船的监视、俄罗斯关联黑客滥用 Claude 攻击乌克兰)在 X 和 Lemmy 上分别获得了顶级关注。
今日 LLM 新闻 — 2026-09-12
今天讨论最多的,并不是新模型发布本身,而是围绕“AI 滥用与信任”的话题。在 X 和 Lemmy 上,Anthropic 的威胁情报报告(胡塞武装使用 Claude Code 开发武器、伊朗监视美国舰船、俄罗斯关联黑客窃取乌克兰军事技术)分别成为当日最热门的话题。与此同时,在 Reddit 和 Bluesky 上,关于 OpenAI 是否从数学家 Buckmaster、Alpoge 等人的 ChatGPT 会话历史中“窃取”了与纳维–斯托克斯方程相关成果的质疑,也在两个平台同期出现。除此之外,YouTube、Bluesky 和 Lemmy 上接连讨论了 Claude Fable 5.1、GPT-6 Astra、Gemini 3.8 Flash、DeepSeek V4.1 Flash、GLM-5.3、Sakana AI 的 Fugu Max/Ultra v2 等新模型,“闭源阵营 vs 开放权重阵营”的对立主线始终可见。总体而言,热点脉络清晰,但受采集数量和搜索条件限制,部分平台未达到完成标准,因此置信度仍为中等。
Across platforms
- Anthropic 的威胁情报报告在两个平台上分别成为顶级话题。 在 X 上,@tleilax___ 的帖子(5,022 个赞,https://x.com/tleilax___/status/2098177180706435202 )和 @IranTimes72 的帖子(https://x.com/IranTimes72/status/2098474903217537269 );在 Lemmy 上,!ukraine 社区关于俄罗斯关联黑客的帖子(评分 15,https://theins.press/en/news/297072 )和 !technology 关于胡塞武装的帖子(评分 12,https://ca.finance.yahoo.com/news/users-houthi-held-184240958.html )均独立获得了顶级关注。
- 针对 OpenAI 的“窃取创意”质疑(纳维–斯托克斯争议)同时在 Reddit 和 Bluesky 上、约 2026-09-08 前后被讨论。 Reddit r/singularity(209pt,https://www.reddit.com/r/singularity/comments/1wcnyay/ )和 Bluesky 的 Quantian(https://bsky.app/profile/quantian.bsky.social/post/3muyhwbcdys2x )都讨论了同一质疑,这是跨平台得到最多相互印证的话题。
- “闭源阵营 vs 开放权重阵营”的对立格局,在 YouTube、Bluesky、Lemmy、Reddit 四个平台中均可见。 YouTube 上 DeepSeek V4.1 Flash 以 GPT-6 Astra 1.4% 的成本取得其 98% 的分数(https://www.youtube.com/watch?v=YnFKMybL7gs );Bluesky 上 Sakana AI 联合创始人 hardmaru 明确表示“Fugu Ultra v2 不依赖 Fable 5、5.1 或 GPT-6-Astra”(https://bsky.app/profile/hardmaru.bsky.social/post/3mv7kz2uplk2u );Lemmy 上 K2 Horizon(IFM、Apache 2.0、https://ifm.ai/blog/k2 )获得好评;Reddit 上,同一对立则表现为对 WSJ 批评开放权重的文章的反弹(https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/ )。
- 对呼吁 AI 安全的“离职者”的怀疑与犬儒情绪,在 Reddit、X、Lemmy 上均有体现。 Reddit 中有 Anthropic 研究员 Jacob Coxon 的离职声明(https://www.reddit.com/r/ArtificialIntelligence/comments/1wbu9c6/ )以及对 CNN 嘉宾的不信任;X 上则嘲讽一名“在 Anthropic 工作 6 周”的人宣称“AI 会在 10 年内毁灭人类”(https://x.com/BrianRoemmele/status/2098024115231924568 );Lemmy 上则有议员监管讨论的镜像文章(https://www.cnbc.com/amp/2026/09/11/trump-ai-extinction-risks.html )。切入点虽不同,但共同呈现出“人们厌倦 AI 末日论”的氛围。
Platform by platform
Reddit(第 1 个采集):以“Daily LLM News”这一单一搜索词从 9 个子版块收集了 12 个帖子,但未找到直接报道新模型发布或价格调整的帖子,主要是围绕既有新闻的讨论与讽刺。最大争议是 OpenAI 的纳维–斯托克斯“窃取”质疑,以及对 WSJ 批评开放权重文章的反弹;时间范围也分散在 2026-09-06 至 10 的五天内,并未严格聚焦于简报要求的“今天”。
X(第 2 个):由于会话连接来源被判定为克罗地亚,趋势列表中采集的 10 个搜索词里,几乎只有“Anthropic”一个与 LLM 有关;10 个结果中仅 6 个直接与 LLM 简报相关(未达到完成标准的 10 个,属于缺口)。这 6 个内容中,Anthropic 的威胁情报报告(胡塞武装、伊朗相关)呈现压倒性的传播规模;经济情景报告和 Claude Code 开源化则形成了积极语气的对照。
YouTube:满足了 10 条完成标准,Claude Fable 5.1、GPT-6 Astra、Gemini 3.8 Flash、DeepSeek V4.1 Flash、GLM-5.3、Muse Spark 1.3、Sakana Fugu Ultra 等本周主要模型发布几乎都被覆盖。不过受 JavaScript 渲染限制,无法取得准确播放量和订阅数,发布日期也大多由相对时间推算。
Bluesky:由于官方搜索 API 返回 HTTP 403,只能通过 Web 搜索找到的账号(Ethan Mollick、TestingCatalog、Sakana AI 等)回溯其动态这一替代方法收集了 12 条,其中 10 条核实了点赞与转发数。Sakana AI 的 Fugu Max/Ultra v2 发布最明确地呈现出开放权重阵营的立场,但采集范围偏向偶然发现的账号。
Lemmy:横跨 !technology、!localllama、!fosai 等多个社区收集了 12 条。闭源阵营话题几乎集中于“安全与滥用”语境(Anthropic 威胁报告),开放权重阵营则以 LocalLLaMA 中的 Qwen 量化和 K2 Horizon 等实际部署报告为主。不过标注为今天(09-12)的帖子很少,近期帖子分散在 09-04 至 11。
简报指定的 5 个平台均已调查,未包含其他平台不构成缺口。
What to watch
- Sakana AI 的 Fugu Max/Ultra v2(已在 OpenRouter 公开,明确不依赖闭源模型)— Bluesky,https://bsky.app/profile/hardmaru.bsky.social/post/3mv7kz2uplk2u
- 核实 OpenAI 下一代模型 Astra 的泄露信息(正式发布前)— YouTube,https://www.youtube.com/watch?v=2sh0_oV_r04
- Anthropic 威胁情报报告的后续影响(各国政府与监管机构反应)— X,https://x.com/tleilax___/status/2098177180706435202
- 纳维–斯托克斯“窃取”质疑的后续进展(OpenAI 是否正式回应)— Reddit,https://www.reddit.com/r/singularity/comments/1wcnyay/
- K2 Horizon(IFM、0.9B 至 375B、Apache 2.0、公开中间检查点)的普及情况 — Lemmy,https://ifm.ai/blog/k2
- 对 Qwen3.8-Flash-Next“Claude 式口吻”的反弹将如何影响未来企业品牌塑造 — Lemmy,https://lemmy.dbzer0.com/post/74741490
Recommendations
- 查阅 Anthropic 威胁情报报告原文,核实其有关武器转用与监视用途主张的一手来源。
- 将 X 的搜索词从依赖连接来源的趋势,改为包含 OpenAI、Google、Meta、xAI、Mistral 等公司名的固定列表。
- Reddit 采集除“Daily LLM News”外,也应结合模型名与公司名搜索词,以便捕捉新模型发布本身。
- 在后续采集中持续跟踪 Sakana AI Fugu Max/Ultra v2 与 OpenAI Astra 的动态。
- 下次确认 Bluesky 的 searchPosts API 403 问题是否已解决;如已恢复,则回到直接搜索。
- 下次采集时优先确认 OpenAI 是否已针对纳维–斯托克斯质疑发表官方声明。
Data quality
X 的趋势选择并未针对 LLM 简报优化,完成标准的 10 条中只有 6 条与 LLM 相关。Reddit 和 Lemmy 虽满足数量标准,但时间范围分散于比“今天”更长的时段(Reddit 为五天,Lemmy 为 09-04 至 11),更像是围绕既有新闻的讨论聚合,而不是当天特有新闻。Bluesky 的官方搜索 API 因 403 无法使用,虽通过间接回溯账号满足数量,但采集范围存在偏差。YouTube 满足 10 条,但因 JavaScript 渲染限制,未取得播放量、订阅数等定量信息。
各平台总结
Reddit — Daily LLM News
Where
以搜索词“Daily LLM News”从 9 个子版块收集了 12 个帖子。
| 子版块 | 成员数 | 收集帖子数 |
|---|---|---|
| r/NoStupidQuestions | 7,480,942 | 3 |
| r/singularity | 3,970,329 | 2 |
| r/ArtificialInteligence | 1,924,916 | 1 |
| r/artificial | 1,336,553 | 1 |
| r/LocalLLaMA | 821,987 | 1 |
| r/WritingWithAI | 165,025 | 1 |
| r/SillyTavernAI | 128,146 | 1 |
| r/BetterOffline | 55,091 | 1 |
| r/Maxcactus_TrailGuide | 5,205 | 1 |
r/NoStupidQuestions 和 r/singularity 在数量上较多,但内容主要围绕“LLM 是什么”之类的一般讨论。相反,来自只有 5,205 名成员的小型子版块 r/Maxcactus_TrailGuide 的 1 个帖子(#10)获得了高达 2,213 分的突出病毒式传播。
What people say
- 围绕 OpenAI 千禧年大奖问题(Navier–Stokes)的主张,以及随之而来的“窃取创意”质疑,是今天最大的争议点。 在线程 #5(r/singularity,209pt/69 条评论,2026-09-10,https://www.reddit.com/r/singularity/comments/1wcnyay/)中,据报道 OpenAI 已接近解决 Navier-Stokes 方程;与此同时,OpenAI 反驳称,数学家 Tristan Buckmaster(参见 NYT 文章)等人的 Codex 使用历史可能影响模型这一质疑“不可能成立”。u/FateOfMuffins(61pt)评论称:“这是否意味着最近一次大规模训练的数据截止日期是 7 月 3 日?”
- 不同子版块对同一话题的反应存在分裂。 在线程 #6 r/singularity 的“"LLMs will never be smarter than Redditors"”(271pt/159 条评论,2026-09-09,https://www.reddit.com/r/singularity/comments/1wbnhgt/)中,u/oilybolognese(201pt)讽刺怀疑派;而 r/SillyTavernAI 的线程 #7(68pt/57 条评论,2026-09-10,https://www.reddit.com/r/SillyTavernAI/comments/1wclha4/)却得出了截然相反的结论。u/perthro_anon(140pt)讽刺道:“我担心 OpenAI 会偷走我写的色情创作并据为己有”,讨论进而演变为支持本地 LLM 的论点。
- WSJ 针对闭源模型阵营的开放权重批评文章,在 r/LocalLLaMA 引发强烈反弹。 线程 #12(513pt/236 条评论,2026-09-08,https://www.reddit.com/r/LocalLLaMA/comments/1wa9309/)讨论 WSJ 的评论文章“未受监管的开放权重 AI 是对灾难的邀请”(声称其回答了合成脊髓灰质炎病毒的问题)。u/3169676(557pt,该帖最高分评论)反问:“难道只有富有的亿万富翁才应当能够向‘受监管’的 AI 模型提问吗?”u/inotparanoid 也指出:“这是一篇为了保护 Anthropic 或 OpenAI IPO 后股价的攻击性文章。”
- 对呼吁关注 AI 安全的“离职者”故事的不信任,在两个帖子中共同出现。 线程 #4(r/ArtificialInteligence,0pt/32 条评论,2026-09-09,https://www.reddit.com/r/ArtificialInteligence/comments/1wbu9c6/)讨论 Anthropic 研究员 Jacob Coxon 因担忧“失控系统的开发竞赛”而离开行业;但 u/MiloGoesToTheFatFarm 直接否定道:“这个人不是模型设计师,只是做类似数据录入的基层工作。”线程 #9(r/BetterOffline,299pt/167 条评论,2026-09-10,https://www.reddit.com/r/BetterOffline/comments/1wcxjv0/)讨论另一位上 CNN 的“AI 末日论者”;u/Smurfette2016(208pt)称:“工作 6 周、Twitter 账号不到 1 个月、零粉丝的人,一条帖子却有 1.3 亿浏览,明显是精心安排的。”
- 针对“不过是预测下一个 token”论点的反驳,在多个帖子中反复出现,今天显得有些陈旧。 在线程 #1(r/NoStupidQuestions,1,285pt/358 条评论,2026-09-10,https://www.reddit.com/r/NoStupidQuestions/comments/1wcsbr2/)中,自称 AI 研究员的 u/skmchosen1(16pt)解释:“预训练的目标确实是预测下一个 token,但后训练中会引入不同目标,例如解出数学题便给予正向奖励。”线程 #3(r/artificial,67pt/221 条评论,2026-09-06,https://www.reddit.com/r/artificial/comments/1w8m8rw/)中,u/danderzei(62pt)也重提了类似讨论。
- 一位科学家提出“LLM 是针对人类的认知病毒”,尽管发在小型子版块,仍获得异常高的传播。 在线程 #10(r/Maxcactus_TrailGuide,成员 5,205 人,2,213pt/180 条评论,2026-09-09,https://www.reddit.com/r/Maxcactus_TrailGuide/comments/1wbi2d7/)中,u/MF_D000M(58pt)评论:“LLM 正在加速把我们带向乌合之众的终局。”u/TurgorFervor 则展开了“宗教也是病毒”的类比。
- 实际用户也提出了关于免费额度写作体验的现实不满。 在线程 #8(r/WritingWithAI,18pt/35 条评论,2026-09-10,https://www.reddit.com/r/WritingWithAI/comments/1wcunsz/)中,发帖者抱怨:“GPT Sol 适合研究但文风很机器人;Claude Sonnet 的免费额度限制太严;Gemini 很笨。”u/whitemisandry(4pt)评论:“我使用 Claude Opus 4.8,但会在写作前先给它一套很长的指令系统。”
- 对于“LLM 为什么越来越聪明”这一基础问题,系统架构角度的解释获得支持。 在线程 #11(r/NoStupidQuestions,1pt/9 条评论,2026-09-09,https://www.reddit.com/r/NoStupidQuestions/comments/1wbpr47/)中,u/Jolly-Rip5973(2pt)解释:“单独的 LLM 已接近瓶颈,现在的进步来自 harness、工具调用、多模型协作等整个系统层面的改进。”
Signals
- 正在升温的情绪:对闭源模型阵营(尤其 OpenAI)的不信任与反弹。相比千禧年奖级成果发布本身,“是否窃取创意”的质疑(#5、#7)及对 WSJ 开放权重批评文章的反弹(#12)更聚集了今天 Reddit 的热度。开放权重被维护为表达自由和独立性的象征。
- 被否定的情绪:呼吁 AI 安全的“离职者”类帖子(#4、#9)虽然都获得高参与度,但评论区多数将相关控诉斥为“宣传”“公关”“可疑”。人们对安全论述本身的疲惫与犬儒情绪很强。
- 意外之处:成员数仅 5,205 的超小型子版块(#10)取得 2,213 分,超过 r/singularity(3,970,329 人)等主要子版块的得分。它很可能以某种方式在 r/all 等位置实现了“病毒式传播”,今天社区规模与得分的相关性失效了。
- 对立结构:面对同一条“OpenAI 的 Codex/千禧年奖”新闻,r/singularity(#5、#6)以“OpenAI 是对的,怀疑派很可笑”为主调;r/SillyTavernAI(#7)却以“OpenAI 偷了东西,需要本地 LLM”为主调——同一新闻因社区不同而被完全割裂地解读。
Limits
- 搜索词仅有“Daily LLM News”一种,未按具体模型名或公司名搜索。因此收集到的 12 个线程并非“今天发布的新模型、降价、基准测试”等一手信息,而主要是围绕既有新闻的讨论、感想和讽刺。未找到直接报告新模型发布或 API 价格变更的线程。
- 来自 r/NoStupidQuestions 的 3 条(#1、#2、#11)是关于 LLM 运作机制的初学者提问,更接近长期存在的讨论,而不是“今天的新闻”;除日期较新外,几乎没有当天特有的信息。
- 每个线程提供的“Top comments”最多只有 6 条,未能确认更多评论区的整体氛围(例如 #1 的 358 条评论中仅有 6 条,#12 的 236 条评论中也仅有 6 条)。
- 时间范围分散在 2026-09-06 至 2026-09-10 的五天内,并不是严格限定于“今天”(2026-09-12)的帖子。采集器的采集窗口可能比简报预期更宽。
X
X — 与 LLM 相关的话题较少,核心是“Claude 被滥用于武器开发”的 Anthropic 报告
本次会话的 Explore 页面显示为从克罗地亚访问(“Trending in Croatia”项目即为依据),前十大趋势是“Yemen”“Saudi”“$song”“Charlie Kirk”“Britain”“Anthropic”“Apple”“Sony”“one ai os”“Chelsea”。这是克罗地亚(至少是本会话连接来源)的 Explore 排列,并非全球共同趋势。采集通过搜索这 10 个词进行,其中真正与 LLM 有关的实质性话题,只有从“Anthropic”找到的帖子,以及在搜索“Yemen”时偶然发现的 Anthropic 威胁情报相关帖子。
Accounts
收集到的 40 个账号均只贡献 1 条帖子,没有同一账号发布多条的情况。其中发布与 LLM 话题相关内容的 6 个账号如下。
| 账号 | 发布内容 |
|---|---|
| @tleilax___(Yet another commodity guy) | 称一个位于也门的团体曾使用 Claude Code 开发制导火箭、弹道导弹与高超音速滑翔项目。5,022 个赞 |
| @IranTimes72(Ebrahim Zolfaghari) | 报道伊朗使用 Claude AI 监视美国舰船,并提及 Anthropic 还识别出一个位于也门的团体 |
| @BrianRoemmele | 长文嘲讽一名在 Anthropic 工作“6 周”的人声称“AI 会在 10 年内毁灭人类” |
| @restitutorII(Restitutor Orientis) | 介绍 Anthropic 报告描绘的 2030 年美国经济情景(3 种情景、GDP +1.6% 等) |
| @walterkirn | 谈及同一人物争议,讽刺“主流媒体把这人捧得像福奇博士一样” |
| @claudecode84(Claude code 研究实验室,日语账号) | 称“Anthropic 的最高负责人亲自将自己的 Claude Code 环境整体开源”。LLM 相关帖子中约有 72.4 万浏览,最多 |
Posts
-
@tleilax___、2026-09-10(5,022 个赞、359 次转发、21 条回复、约 26.4 万浏览,搜索“Yemen”命中)
“一个位于也门的团体在研发制导火箭、弹道导弹和高超音速滑翔项目时,使用了多个 Claude Code 实例。”
这似乎是引用 Anthropic 威胁情报报告的帖子。其内容为一个位于也门的团体使用多个 Claude Code 实例参与武器开发,是 LLM 相关帖子中传播最广的一条。 -
@IranTimes72、2026-09-11(238 个赞、34 次转发、8 条回复、约 1.5 万浏览,搜索“Yemen”命中)
伊朗使用 Claude AI 监控中东地区的美国军舰,并识别潜在通信漏洞。……Anthropic 还识别出一个位于也门的[团体]
同样提及 Anthropic 报告。报道内容称,伊朗将舰船追踪、军事图像和商业卫星照片结合,并由 Claude 加以分析;它与第 1 条帖子成对传播。 -
@restitutorII、2026-09-10(458 个赞、69 次转发、41 条回复、约 5.7 万浏览,搜索“Anthropic”命中)
Anthropic 在报告中设想了 2030 年美国经济的 3 种可能未来,这取决于 AI 的能力与普及程度:1- 温和情景:AI 的影响相当于互联网。GDP +1.6%,就业扰动很少。2- 显著情景:AI 可以完成大约……
介绍 Anthropic 发布的经济情景报告(按三个阶段预测 AI 对 2030 年美国经济的影响)。除武器滥用新闻外,Anthropic 的经济影响分析也在同日受到讨论。 -
@claudecode84、2026-09-10(2,522 个赞、263 次转发、24 条回复、约 72.4 万浏览,搜索“Anthropic”命中)
Anthropic 的最高负责人亲自将自己的“Claude Code 环境”整体开源了
来自日语账号的帖子。仅按浏览量看,它是 LLM 相关帖子中传播规模最大的内容。其称 Anthropic 高层公开了自己的 Claude Code 环境,但从帖子文本无法确认原始来源链接等细节。 -
@BrianRoemmele、2026-09-10(790 个赞、187 次转发、105 条回复、约 9.9 万浏览,搜索“Anthropic”命中)
TEMU 哈利·波特说“AI 会在 10 年内终结所有人类生命!”……他在 Anthropic 的六周……
嘲讽一名仅在 Anthropic 工作 6 周的人声称“AI 会在 10 年内毁灭人类”。有 105 条回复并取得高互动,显示出人们对 AI 安全论述的怀疑与反弹。 -
@walterkirn、2026-09-10(722 个赞、91 次转发、39 条回复、约 2.8 万浏览,搜索“Anthropic”命中)
主流媒体把这家伙捧得像是,嗯,福奇博士之类的人。我恳请你清楚看见这套运作方式,以及谁在操控它。
这似乎指向与第 5 条相同的人物争议。虽然未点名,但上下文、搜索词与时间一致,讽刺主流媒体吹捧此人。
Signals
- 讨论最多的是“Claude 的军事与情报转用”:也门团体的武器开发(1)和伊朗的舰船监视(2)都似乎基于 Anthropic 的威胁情报报告,是从地缘政治搜索词“Yemen”中偶然捕捉到的内容。这是本会话中传播最广的 LLM 相关话题。
- Anthropic 的经济报告(3)及 Claude Code 开源化(4)以正面、介绍性的语气出现,与滥用类新闻存在明显温差。
- 对于“AI 会在 10 年内毁灭人类”类说法,怀疑和嘲讽十分突出(5、6)。媒体吹捧这名仅在 Anthropic 工作 6 周的前员工所引发的反弹,明显强于认同。
- 意外之处:此次采集内容中,完全没有任何关于开放权重阵营(Llama、Qwen、DeepSeek、Mistral 等)的帖子;也没有发现有关基准测试或 API 价格变动的具体帖子。
- 收集到的 40 条帖子、10 个搜索词中,只有 6 条直接与 LLM 简报有关。其余内容为也门与沙特冲突的一般新闻、围绕 Charlie Kirk 遇刺一周年的政治争议、英国/以色列外交、对 Apple 活动的反应、Sony/游戏话题和 Chelsea 相关足球梗,与 LLM 无关。
Limits
- Explore(趋势列表)按克罗地亚展示,无法代表全球趋势。由于取决于会话连接来源,其他国家或地区很可能呈现不同排序。
- 搜索词选择未针对 LLM 简报优化:使用的 10 个词(“Yemen”“Saudi”“$song”“Charlie Kirk”“Britain”“Anthropic”“Apple”“Sony”“one ai os”“Chelsea”)直接取自 Explore 趋势,LLM 相关词只有“Anthropic”。未搜索 OpenAI、Google/Gemini、Meta AI、xAI/Grok、Mistral 等其他公司动态,因此对闭源模型与开放权重模型阵营均未形成全面采集。
- 未达到完成标准的“10 条”,只能写出 6 条 LLM 相关内容(40 条帖子中)。本次采集未包含新模型发布、价格调整、基准测试或具体事故案例等角度的帖子。
- 会话本身运行正常,未发生登录失效或页面获取失败(缺失原因在于搜索词选择,而非会话故障)。
YouTube
YouTube — 今日 LLM 新闻(2026 年 9 月 12 日)
Channels
- Anthropic(官方频道)— 发布 Claude Fable 5.1 的介绍视频。
- ByteForward — 闭源模型与开放权重对比验证类频道。
- WorldofAI(@intheworldofai)— 经常发布新模型实测与 AI 新闻汇总。
- AI WITH Rithesh — 新模型基准与价格讲解类频道。
- Prompt Engineering(@engineerprompt)— 提示设计和新模型解读类频道。
- AI Coding Daily — 以编程基准实测为主的评测类频道。
- RandomAI — 泄露信息和传闻导向的分析类频道。
- TheAIGRID — 快速讲解新模型发布的频道。
- AI時短ラボ — 以日语发布 AI 快讯的频道。
由于频道页面使用 JavaScript 渲染,无法直接确认订阅数,未能取得准确数值(详见 Limits)。
Videos
-
Introducing Claude Fable 5.1 — Anthropic — 2026 年 9 月 1 日 — https://www.youtube.com/watch?v=ROF2Nv_KjOM
Anthropic 官方发布视频。将 Claude Fable 5.1 定位为“最高性能等级的最新版本”,并介绍 Terminal-Bench-Science 分数从版本 5 的 24.7 提升至 5.1 的 52.6。 -
GPT-6 Astra vs DeepSeek V4.1 Flash… Is It Even Close? — ByteForward — 约 2026 年 9 月 11 日(1 天前发布) — https://www.youtube.com/watch?v=YnFKMybL7gs
对闭源 GPT-6 Astra 与开放权重 DeepSeek V4.1 Flash 进行实测比较。介绍了一项基准:在设计类任务中,V4.1 Flash 以 Astra 1.4% 的成本达到其 98% 的得分。 -
DeepSeek V4.1 Flash Is INSANELY GOOD! Fast, Cheap, Powerful! (Fully Tested) — WorldofAI — 2026 年 9 月上旬 — https://www.youtube.com/watch?v=T2dnchLabZQ
全面测试了编程、3D 模拟、代理运行和图像输入,给予最高 427 token/秒的速度及低成本高度评价。 -
GLM-5.3 Released: Everything You Need to Know About Z.ai's New Coding Model (Benchmarks, Price) — AI WITH Rithesh — 2026 年 8 月中旬 — https://www.youtube.com/watch?v=4RFo47KJ4q4
解读 Z.ai 开放权重模型 GLM-5.3 的基准和价格。重点强调其在同一 743B 基础模型上,仅通过后续训练提升性能。 -
【快讯】GLM-5.3 登场,编程与网络能力达到最强级别,值得期待的模型!! — AI時短ラボ — 2026 年 8 月中旬 — https://www.youtube.com/watch?v=Ca0PHSjrU8M
日语频道的 GLM-5.3 快讯,将其在编程和网络安全相关任务中的能力介绍为“最强级别”。 -
Gemini 3.8 Flash: The model no one expected! — Prompt Engineering — 约 2026 年 9 月 2 至 3 日 — https://www.youtube.com/watch?v=UvrAYDgobSw
将 Google 于 2026 年 9 月 2 日推出的 Gemini 3.8 Flash 评价为“没人预料到的模型”,并称其在免费额度下具备接近 Claude Opus 5 的性能。 -
I Tested NEW Muse Spark 1.3 on Coding: Meta Joins Frontier LLMs? — AI Coding Daily — 2026 年 9 月上旬(1 周前发布) — https://www.youtube.com/watch?v=lxljOqB1YUI
在编程任务中测试 Meta 计划开放权重的模型 Muse Spark 1.3,并讨论 Meta 是否已追上前沿级别。 -
OpenAI Astra Just Got Leaked and It's INSANE (Full Breakdown) — RandomAI — 2026 年 8 月下旬(2 周前发布) — https://www.youtube.com/watch?v=2sh0_oV_r04
汇总分析关于 OpenAI 下一代模型 Astra 的泄露信息。请注意其内容基于正式发布前的传闻。 -
DeepSeek V4.1 GA Soon, GPT-5.6 SOL Nerfed? HUGE Fable Update, US AI BAN Protests, & More! AI NEWS — WorldofAI — 2026 年 9 月上旬 — https://www.youtube.com/watch?v=LgGJz528Boo
每周 AI 新闻汇总,介绍 DeepSeek V4.1 预计正式发布、Fable 更新、美国针对 AI 监管的抗议动向等。 -
Sakana AI's New "Fugu Ultra" Beats Claude Fable 5 (Sakana Fugu) — TheAIGRID — 2026 年 6 月下旬 — https://www.youtube.com/watch?v=FwA1bcpSGiM
介绍日本 Sakana AI 的多代理导向模型“Fugu”系列(初代 Fugu Ultra),并检视其优于 Claude Fable 5 的主张。9 月 11 日发布的后续 Fugu Ultra v2 / Fugu Max 尚未找到专门视频(见 Limits)。
Signals
- 闭源阵营:Anthropic(Fable 5.1,9/1)、Google(Gemini 3.8 Flash,9/2)、OpenAI(Astra,未发布、处于泄露阶段)接连有动态,YouTube 上的评测视频也集中在发布后的数日内上传。
- 开放权重阵营:DeepSeek(V4.1 Flash)、Z.ai(GLM-5.3 系列)、Meta(Muse Spark 1.3)、Sakana AI(Fugu Max / Fugu Ultra v2)均以“低成本逼近闭源模型”为叙事角度。其中 DeepSeek V4.1 Flash 与 Astra 的性价比对比(以 1.4% 成本取得 98% 分数)被创作者频繁引用。
- 日语频道(AI時短ラボ)也快速报道了 GLM-5.3 等中国开放权重模型,话题时差仅略晚于英语圈(发布后 1 至 2 周内)。
- Sakana AI 的 Fugu Max / Fugu Ultra v2(2026 年 9 月 11 日发布)已被新闻网站和博客报道,但截至本次调查,在 YouTube 上还未找到专门讲解视频,只有近期的初代 Fugu Ultra 视频。
Limits
- YouTube 搜索结果页(
youtube.com/results?...)及视频页(youtube.com/watch?...)均使用 JavaScript 渲染,WebFetch 无法取得正文中的标题、频道名、播放量和发布日期,只返回页脚。因此,信息通过 WebSearch 摘要与noembed.com(仅返回标题与频道名)组合补充。 - 因上述原因,未能取得准确播放量与订阅数。日期大多从“◯ 天前/◯ 周前”等相对时间推算,部分视频未能确定精确发布日期。
- 尚未找到介绍 Sakana AI 最新模型 Fugu Max / Fugu Ultra v2(9/11 发布)的专门 YouTube 视频。仅发现新闻文章内链接或播放列表,视频本身是否存在仍未确认。
- 虽满足完成标准的“10 条”,其中 1 条(Sakana Fugu Ultra)是初代模型视频,并不直接讨论最新的 v2 发布,需注意。
Bluesky
Bluesky — 模型发布以“机器人式快讯”流过信息流,纳维–斯托克斯争议与 Sakana AI 的“开放权重阵营”声明尤为突出
注记(关于采集方法)
Bluesky 官方全文搜索 API(public.api.bsky.app/xrpc/app.bsky.feed.searchPosts)与 Web 搜索(bsky.app/search)在本会话的 fetch 工具中,前者返回 HTTP 403,后者因未执行 JavaScript 而只能取得空内容(详见“Limits”)。因此,本次采用了先通过 Web 搜索定位 bsky.app 中的相关帖子和账号,再针对已知句柄读取 app.bsky.feed.getAuthorFeed(该接口返回 200),从而确认帖子文本、日期、点赞数和转发数的方法。
Accounts
| 账号 | 属性 | 链接 |
|---|---|---|
| Ethan Mollick (@emollick.bsky.social) | Wharton 教授,几乎每天都发布有关前沿模型实际影响的长线程 | https://bsky.app/profile/emollick.bsky.social |
| 🚨 AI News | TestingCatalog (@testingcatalog.com) | 以单行快讯形式发布新模型和新功能的 AI 新闻速报账号 | https://bsky.app/profile/testingcatalog.com |
| Sakana AI (@sakanaai.bsky.social) | 位于东京、倡导开放权重与多代理编排的研究实验室官方账号 | https://bsky.app/profile/sakanaai.bsky.social |
| hardmaru / David Ha (@hardmaru.bsky.social) | Sakana AI 联合创始人,官方发布线程的作者 | https://bsky.app/profile/hardmaru.bsky.social |
| Quantian (@quantian.bsky.social) | 以讽刺 OpenAI 纳维–斯托克斯相关质疑的帖子获得较多提及的个人账号 | https://bsky.app/profile/quantian.bsky.social |
| Zach Weinersmith (@zachweinersmith.bsky.social) | 科学漫画作者,以线程讲解同一争议的来龙去脉 | https://bsky.app/profile/zachweinersmith.bsky.social |
| ardalis / Steve Smith (@ardalis.com) | 开发者,发布嘲讽 Claude Opus 的简短玩笑帖 | https://bsky.app/profile/ardalis.com |
Posts
-
Sakana AI(@sakanaai.bsky.social)/2026-09-11T20:43Z/9 个赞、1 次转发
https://bsky.app/profile/sakanaai.bsky.social/post/3mvbglsna4k25“Fugu Max 已在 Open Router 上线!🐡 我们的学习型多代理编排引擎会在开放权重和专用模型间路由任务,以实现帕累托前沿效率。”
宣布 Fugu Max 在 OpenRouter 上公开。明确其采用结合开放权重模型与专用模型、实现最优分配的编排路线。 -
hardmaru(@hardmaru.bsky.social,Sakana AI 联合创始人)/2026-09-11T02:57Z/48 个赞、5 次转发
https://bsky.app/profile/hardmaru.bsky.social/post/3mv7kz2uplk2u“推出 Fugu Max 和 Fugu Ultra v2:编排帕累托前沿。AI 行业花了十年时间,沿着单一轴线优化:构建更大、更昂贵的模型。”
后续帖子明确称:“Fugu Ultra v2 does all of this without Fable 5, Fable 5.1, or GPT-6-Astra in its agent pool”,把不依赖 Anthropic 与 OpenAI 前沿模型作为优势。这是今天找到的最明确的“开放权重阵营”立场声明。 -
TestingCatalog(@testingcatalog.com)/2026-09-11T07:38Z/1 个赞、1 次转发
https://bsky.app/profile/testingcatalog.com/post/3mva2p4ykhd2s“OpenAI 推出面向金融服务业的 ChatGPT”
快讯称,OpenAI 开始为金融机构提供整合 GPT-6 Astra 的 ChatGPT,用于研究、建模和材料制作。 -
TestingCatalog(@testingcatalog.com)/2026-09-10T20:45Z/0 个赞、0 次转发
https://bsky.app/profile/testingcatalog.com/post/3mv6waz3vpu2t“OpenAI 推出 GPT-Live-1,用于全双工语音代理”
关于支持同时听取与说话的全双工语音模型新发布的快讯。 -
TestingCatalog(@testingcatalog.com)/2026-09-03T09:19Z/2 个赞、0 次转发
https://bsky.app/profile/testingcatalog.com/post/3mum4nfbitu2n“Google 发布 Gemini 3.8 Flash 和 Flash Cyber”
同时发布适用于编程、代理、多步推理的 Gemini 3.8 Flash,以及专注漏洞发现和修复、仅面向“受信任防御人员”的 Flash Cyber 变体。 -
TestingCatalog(@testingcatalog.com)/2026-09-02T00:00Z/2 个赞、0 次转发
https://bsky.app/profile/testingcatalog.com/post/3muimw7yugw2q“Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1”
同时发布面向大众的 Fable 5.1,以及仅限“经过审查的防御人员和科学家”的 Mythos 5.1。据称其降低了缓存成本并提升性能。 -
Ethan Mollick(@emollick.bsky.social)/2026-09-11T17:38Z/40 个赞、6 次转发
https://bsky.app/profile/emollick.bsky.social/post/3mvb4b7idf22v“这是一个利用重大预测专家的方法来估计灾难性风险的自动预测系统。该模型预测,到 2030 年发生 AI 生成的大规模灾难的概率为 0.47%……”
介绍一个以专家预测方法自动估计 AI 引发大规模灾害概率的系统。其后续回复注明:该数字假设不存在政策干预。 -
Ethan Mollick(@emollick.bsky.social)/2026-09-11T04:59Z/65 个赞、2 次转发
https://bsky.app/profile/emollick.bsky.social/post/3mv7rswik2s2v“轮到 Astra:‘做一个关于 Imminence 的游戏……’”
展示让 GPT-6 Astra 制作游戏的演示帖。它与前一天发布的 Claude Fable 5.1 版游戏并列,用于比较两款模型的创作能力。 -
Ethan Mollick(@emollick.bsky.social)/2026-09-10T17:32Z/117 个赞、18 次转发
https://bsky.app/profile/emollick.bsky.social/post/3mv6lhq5lyc2v“你现在在数学领域看到的,是[前沿模型能力跃迁]的结果……”
长线程的一部分,讨论数学家使用 AI,以及 AI 正在发现超人类证明所代表的意义。它与在 Reddit(r/singularity)传播的 Navier-Stokes 争议处于相同语境,也是本次收集中点赞最多的帖子。 -
Quantian(@quantian.bsky.social)/2026-09-08T07:13Z
https://bsky.app/profile/quantian.bsky.social/post/3muyhwbcdys2x“这已经非常非常非常接近于在说:‘OpenAI 因为急于抢在 Anthropic 前面,所以从内部访问我们的 ChatGPT 会话、偷走了我们几乎完成的 Navier-Stokes 证明’,而这绝对是 100% 可信的、OpenAI 现在会做的事。”
涉及数学家 Buckmaster、Alpoge 等人的千禧年奖级成果是否被 OpenAI “从 ChatGPT 会话历史中偷走”的质疑(与 Reddit r/singularity 当日线程讨论同一话题)。 -
Zach Weinersmith(@zachweinersmith.bsky.social)/2026-09-08T09:45Z
https://bsky.app/profile/zachweinersmith.bsky.social/post/3muyqfsvt6k2f“给没有关注这场争议的人:AI 数学领域似乎有了重大进展,同时伴随一些关于 OpenAI 极其糟糕行为的指控。……Buckmaster 和 Levent Alpoge 在 Navier-Stokes 上有了重大发现。”
概述上述争议来龙去脉的解释线程开头。 -
ardalis / Steve Smith(@ardalis.com)/2026-09-10T12:35Z
https://bsky.app/profile/ardalis.com/post/3mv62uanbkk2b“哈哈 #ai #claude opusfived.dev”
细节不明,但这是一条嘲讽 Claude Opus 相关事物的简短玩笑帖。从上下文(链接域名“opusfived”)看,似乎是提及新 Opus 版本的梗。
Signals
- Bluesky 上的 LLM 讨论以“实践者分析”和“快讯机器人”为主,本次未发现 X 上那种“Claude 被用于武器开发”的争议或地缘政治话题。 TestingCatalog 一类快讯账号平静罗列新模型与功能;Ethan Mollick 一类实践者账号则讨论使用体验与社会影响,形成两层结构。
- 开放权重阵营的立场声明今天由 Sakana AI 明确提出。 hardmaru(Sakana AI 联合创始人)明确称“Fugu Ultra v2 不依赖 Fable 5、Fable 5.1 或 GPT-6-Astra”,以避免被前沿闭源模型锁定的多代理编排作为卖点。这是 X/Reddit 采集内容中未出现的、闭源对开放权重对立格局的具体例子。
- Navier-Stokes/OpenAI 质疑同时在 Bluesky 和 Reddit、约 2026-09-08 前后被讨论。 数学与 AI 观点领袖群体(Quantian、Zach Weinersmith)不分平台都聚焦同一话题,可以说是跨平台相互印证最多的话题。
- 互动规模比 X 小一个数量级以上。 本次可确认的最大点赞数是 Ethan Mollick 的 117(#9),与 X 上数千点赞的帖子规模不同。就此话题而言,Bluesky 更像是面向技术人员和观察者的“重质不重量”渠道。
Limits
- 官方搜索 API(
app.bsky.feed.searchPosts)在本会话 fetch 工具中始终返回 HTTP 403,无法进行关键词全文搜索。app.bsky.actor.getProfile与app.bsky.feed.getAuthorFeed在同一域名均返回 200,因此可能只有搜索端点被阻止。Web 版 bsky.app/search 和嵌入页也只取得 JavaScript 执行前的 HTML,无法读取帖子列表。 - 受上述限制,采集依赖“通过 Web 搜索找到 bsky.app 相关链接,再回溯已知账号的动态”这一间接方法。 并非对整个平台进行关键词穷尽搜索,范围偏向偶然被 Web 搜索命中的账号(Mollick、TestingCatalog、Sakana AI 等)。本次方法无法找到持续发布 DeepSeek、Qwen、Llama、Mistral 等中国系或 Meta 系开放权重模型内容的 Bluesky 账号。
- 未找到发布于“今天(2026-09-12)”的内容。 最新帖子为 2026-09-11,可能因搜索引擎索引延迟,当天内容未能通过该方法看到。
- 找到的帖子共 12 条,其中确认点赞和转发数的有 10 条(其余 2 条仅通过 oEmbed 获取文本,未确认统计数)。 满足“10 条、附日期与链接”的完成标准,但样本规模有限。
Lemmy
Lemmy — 今天最受讨论的内容
Communities
- !«メールアドレス»(订阅者 87,981 人)— 通用科技新闻主流社区。今天 Anthropic 威胁情报报告成为顶级话题。
- !«メールアドレス»(订阅者 5,132 人,日活跃用户 7 人)— 开放权重模型实际部署与基准讨论中心,联邦覆盖 lemmy.world、piefed.zip、lemmus.org、lemmy.ml、aussie.zone、lemmy.dbzer0.com、lemmy.zip 等多个实例。
- !«メールアドレス»(订阅者 4,820 人)— Free Open-Source AI 社区,拥有 LLM 排行榜和开发者链接集合。
- !«メールアドレス»(订阅者 51 人,其中本地用户 1 人)— 自动转载 Reddit(r/ArtificialIntelligence、r/ClaudeCode 等)RSS 的机器人社区。评分几乎为 0 至 1,未形成 Lemmy 自主讨论。
- !ukraine@(lemmy.world 系) — 地缘政治社区,但 AI 滥用的安全新闻被交叉发布并成为话题。
Posts
- Users in Houthi-held Yemen tried to develop advanced weapons with AI, Anthropic says — !«メールアドレス»,评分 12,2026-09-11。交叉发布引用 Anthropic 报告的 Yahoo Finance 文章。 https://ca.finance.yahoo.com/news/users-houthi-held-yemen-tried-184240958.html
- Russia-linked hackers used Claude agents to target Ukraine and steal military drone technology, Anthropic report finds — !ukraine,评分 15,2026-09-11。The Insider 报道,讨论 Anthropic 威胁报告。它是当天 Lemmy 全站 AI 相关内容中评分最高的一类。 https://theins.press/en/news/297072
- Trump dismisses AI extinction risks as more than a dozen OpenAI, Anthropic insiders call for a slowdown — !ai_reddit(CNBC 文章镜像),评分 1,2026-09-11。 https://www.cnbc.com/amp/2026/09/11/trump-ai-extinction-risks.html
- Hawley Probe Into AI Breakout Called an Important Step, But 'Only a Start' — !pravda_news,评分 1,2026-09-11。关于美国国会调查 OpenAI 的 CommonDreams 文章。 https://www.commondreams.org/news/josh-hawley-openai-investigation
- NanoFlare Fits Qwen 3.8 27B On An 8GB GPU — !«メールアドレス»,评分 2,2026-09-09。量化与低内存部署的实践报告。 https://lemmy.world/post/51731499
- Benchmarking Qwen3.8 27B quantizations: 4-bit holds up, 1-bit collapses — !localllama,评分 21、10 条评论,2026-09-08。验证结果表明 4bit 保持实用性,而 1bit 会导致性能崩溃。 https://piefed.zip/c/«メールアドレス»/p/1805947
- K2 Horizon: Open-Source Model Family(来自 IFM)— !localllama,评分 65、24 条评论(也同步发布于 !fosai,评分 8),2026-09-04。以 Apache 2.0 公开了从 0.9B 到 375B 的 6 种模型,并开放中间检查点和训练数据构建方案,这一慷慨发布获得好评。 https://ifm.ai/blog/k2
- Qwen3.8-Flash-Next sounds like Claude and I hate it — !«メールアドレス»,评分 31(4 个反对票)、9 条评论,2026-08-30(12 天前)。不满 Alibaba 新模型开始模仿 Claude 式“仪式化、绕弯子”的口吻。评论中也出现“Qwen 用来写代码,Gemma 用于其他任务”的分工观点。 https://lemmy.dbzer0.com/post/74741490
- Release v0.4.0 · ggml-org/llama.cpp — !«メールアドレス»,评分 28,2026-09-04。本地推理引擎更新公告。 https://lemmus.org/post/25155737
- zai-org/GLM-5.3 · Hugging Face (753b-a40b?) — !«メールアドレス»,评分 19,2026-08-28。讨论 GLM-5.3 权重。 https://lemmus.org/post/24977768
- "All LLMs should be GPL" — !«メールアドレス»,评分 1、0 条评论,2026-09-11(8 小时前,转载 u/TrekCZ)。主张用 GPL 代码训练的 LLM 应以 GPL 发布,但在 Lemmy 侧没有反应。 https://lemmy.durstig.online/post/59438
- Market size of Open-Source models — !«メールアドレス»,评分 1、0 条评论,2026-09-11(5 小时前)。根据 HuggingFace 数据估算,开源类仅占年度 AI 训练支出的 3.2%(文本 LLM + 扩散模型约 2.5 亿美元,适配器类 5,600 万美元)。也提出了 GPU P2P 市场构想。 https://lemmy.durstig.online/post/59444 (相关: https://lemmy.durstig.online/post/59487)
Signals
- 闭源阵营的话题以“安全与滥用”语境为主:今天 Lemmy 上评分最高的 AI 相关帖子并非新模型发布,而是 Anthropic 威胁情报报告(胡塞武装尝试用 AI 开发武器、俄罗斯关联黑客滥用 Claude)。通过交叉发布到 !technology 和 !ukraine 等通用社区,获得了更高评分。
- 开放权重阵营以 LocalLLaMA 为据点:持续出现 Qwen3.8 系列量化与低内存化、Kimi K2/K3、GLM-5.3、K2 Horizon(IFM、0.9B 至 375B、Apache 2.0)等模型实际部署报告。像 K2 Horizon 这样“连中间检查点和训练数据方案都公开”的慷慨发布,得分尤其高(65)。
- 反感 Qwen“Claude 化”:Qwen3.8-Flash-Next 虽然基准表现良好,却开始模仿 Claude 式绕弯子的口吻,已引起 LocalLLaMA 用户明确不满。有趣的是,闭源模型的“说话方式”本身也成为开放权重圈子的玩笑与批评对象。
- Lemmy 自主讨论较少:!ai_reddit(durstig.online,订阅者 51 人)是 Reddit RSS 自动转载机器人,评分几乎为 0 至 1,评论大多为零。对于本轮新闻周期本身(GPT-6 Astra、Claude Fable/Mythos 5.1、Gemini 3.8 Flash 等大型新模型发布),几乎未找到 Lemmy 原生的一手讨论。
Limits
- 无法将 10 条“最新帖子”严格整理为按时间排序的全站 Top 10,只能横跨 !localllama(开放权重类)与通用新闻交叉发布(闭源类)选取 12 条。Lemmy 搜索 API 对每个关键词只返回片段化结果,无法获得统一的“今日 Lemmy 全站 Top 10”。
- 几乎没有发现标注为今天(2026-09-12)发布的内容,近期帖子以 2026-09-11 为主(部分在 2026-09-04 至 08)。Lemmy 的更新频率低于其他社交网络,这被认为与其规模较小有关。
- piefed.zip 上的 2 条帖子(K2 Horizon 原始线程、Kimi K3 线程)直接访问返回 HTTP 403,无法取得正文及评论详情(改以 lemmy.world 一侧镜像信息替代)。
- 尝试搜索 lemmy.ml、lemm.ee 等实例,但判断通过 lemmy.world API 搜索及各实例直接访问获得的信息已几乎覆盖有意义的补充结果。
- 未找到直接提及 GPT-6 Astra、Claude Fable/Mythos 5.1、Gemini 3.8 Flash 等本周大型模型发布本身的 Lemmy 帖子(推测讨论主要集中在其他社交网络)。
推荐行动
- 查阅 Anthropic 威胁情报报告原文,核实其有关武器转用与监视用途主张的一手来源。
- 将 X 的搜索词从依赖连接来源的趋势,改为包含 OpenAI、Google、Meta、xAI、Mistral 等公司名的固定列表。
- Reddit 采集除“Daily LLM News”外,也应结合模型名与公司名搜索词,以便捕捉新模型发布本身。
- 在后续采集中持续跟踪 Sakana AI Fugu Max/Ultra v2 与 OpenAI Astra 的动态。
- 下次确认 Bluesky 的 searchPosts API 403 问题是否已解决;如已恢复,则回到直接搜索。
- 下次采集时优先确认 OpenAI 是否已针对纳维–斯托克斯质疑发表官方声明。
数据质量备注
X 的搜索趋势未针对 LLM 简报优化,在完成标准的 10 条中只有 6 条获得与 LLM 相关的内容;Reddit 和 Lemmy 虽满足数量,但时间范围比“今天”更宽、更为分散;Bluesky 的官方搜索 API 被 403 阻断,采集偏向间接方式。



