每日 LLM 新闻 — 2026-09-23
Anthropic 发布 Claude Opus 5.5 约 90 分钟后,OpenAI 推出 GPT-6 Sol/Luna 予以回应,性能与价格竞争,以及对“pace the frontier”的质疑,几乎同时在 5 个平台爆发。
今日 LLM 新闻 — 2026-09-23
2026 年 9 月 22 日,Anthropic 发布 Claude Opus 5.5 约 90 分钟后,OpenAI 随即推出 GPT-6 Sol/Luna,形成了一场“同日对垒发布”,并成为 Reddit、X、YouTube、Bluesky 和 Lemmy 五个平台上讨论度最高的话题。两家都将性能提升与大幅降价作为卖点(Opus 5.5 成本降低 40%,GPT-6 Sol 较前代降价 50%),API 价格战也因此成为另一条主线。与此同时,Anthropic 在夏季推动的“pace the frontier(放缓开发速度)”行业主张,分别在 Reddit、YouTube 和 Lemmy 上引发独立质疑;Lemmy 上一则针对四家巨头的反垄断诉讼报道,怀疑它们达成“故意放缓”协议,获得了 249 分的高分。开放权重阵营则凭借 DeepSeek 需求激增(与闭源阵营的算力吃紧形成对照)、K2 Horizons 和 Qwen-Image-2.1 等话题保持存在感,但 Lemmy 的相关文章指出,其营收仍落后于闭源厂商。
跨平台观察
- Opus 5.5 / GPT-6 Sol・Luna 的同日对垒发布是跨平台最重要的话题。YouTube(The Neuron、How I AI 等多个频道即时进行 LIVE 对比)、Lemmy(
!«メールアドレス»的一手信息链接,https://lemmy.world/post/1356240)、Bluesky(Ethan Mollick 的实测评价)和 X(@AbhinavXJ 指出两天内密集发布)均在同一时间集中讨论。 - 对“pace the frontier”的质疑独立出现在多个平台。Reddit(r/LocalLLaMA,428 分,“等 Anthropic 至少发布过一次开放模型再说吧”)、YouTube(Kiraa 的“Pace the Frontier: It's a Lie”)和 Lemmy(针对四家巨头的反垄断诉讼,249 分)从不同角度相互印证同一争议。
- API 价格战的实时观察也在 Bluesky(GPT-6 sol 从 30→20→10 美元/Mtok 快速下跌,Anthropic 未跟进,Haiku 被评价为“奇怪的模型”)、YouTube(视频标题频繁出现“50% Cheaper”“CHEAPEST Frontier Model”)与 Lemmy(Opus 5.5 降价 20% 并扩大缓存折扣)中共同出现。
- 闭源模型的安全事故成为“开放模型更安全”论的素材。Lemmy 上“Google Gemini 入侵三家公司”事件(在多个社区扩散,分数为 87~249 规模)与 Bluesky 上 Nathan Lambert 的观点——“即使看了 OpenAI 经由 Claude 被黑的事件,AI 风险的核心仍是闭源模型”——在时间与论点上高度重合。
按平台分析
Reddit 以“Daily LLM News”为搜索词,收集到 9 个子版块中的 11 个帖子。硬件价格上涨(r/LocalLLaMA)、DeepSeek 需求暴增和算力短缺(r/DeepSeek)、“随机鹦鹉”争论以及面向普通受众的“LLM 是否会思考”解释(r/Altman、r/LinusTechTips)等周边观点和梗图,占据了比具体模型发布更大的篇幅。
X 没有根据简报主题选择搜索词(新模型发布、API 价格等),而是直接沿用从克罗地亚看到的趋势列表,因此收集的 40 条内容中仅有 8 条与 LLM 有关,未达到 10 条的完成标准。不过,Grok 4.7 的实操演示(如生成 Blender 模型)反复被提及;@AbhinavXJ 所说的“明明喊着 pace the frontier,却在两天内发布了 5 个模型”,也与其他平台的质疑相呼应。
YouTube 确认了超过 10 条将 Opus 5.5 与 GPT-6 Sol/Luna 的“同日对垒发布”作为核心话题的视频。The Neuron、How I AI 等频道即时推出 LIVE 对比直播,价格战(如“50% Cheaper”)也体现在视频标题中。但在搜索时尚未找到 GPT-6 Sol/Luna 的官方发布视频,许多播放量与订阅数也因技术限制未能取得。
Bluesky 的关键词搜索 API(app.bsky.feed.searchPosts)始终返回 403,因而改为逐一追踪 Ethan Mollick、Nathan Lambert、Simon Willison 等已知个人账号的动态。Opus 5.5 的实测评论、GPT-6 sol 的价格变动实况,以及 Nathan Lambert 关于“闭源模型才是风险核心”的主张,使得简报要求的“闭源/开放”两种视角在该平台上最为集中。
Lemmy 没有大型 LLM 专属社区,话题分散在 technology 与 hackernews 等联邦社区中;但 Opus 5.5、GPT-6 Sol/Luna、Gemini 入侵事件、KDE 的 LLM 使用规则争议(331 分,为本次调查最高分)以及针对四家 AI 巨头的反垄断诉讼(249 分)这五条内容明显热度较高,且已达到 10 条完成标准。
简报指定的五个平台均已调查,未将范围外平台的缺失视为数据缺口。
值得关注
- 反垄断诉讼的进展(Anthropic、OpenAI、SpaceXAI、Google,涉嫌“故意放缓开发的协议”)— Lemmy,249 分,https://lemmy.world/post/52169518
- GPT-6 Sol 的价格是否会继续下调(正从 30→20→10 美元/Mtok 快速下跌)— Bluesky,hailey,https://bsky.app/profile/hailey.at/post/3mw4terjc3s2z
- Anthropic 是否会通过降价或新模型跟进(Haiku 被称为“奇怪的模型”)— Bluesky,Max Woolf,https://bsky.app/profile/minimaxir.bsky.social/post/3mvzy6xh7sk2i
- DeepSeek 的算力短缺是否会影响服务质量(DAU 增长 66.7%,算力仅增长 8.3%)— Reddit,r/DeepSeek,https://www.reddit.com/r/DeepSeek/comments/1wmcgex/
- KDE 的 LLM 使用指南争议将如何发展(提案暂时被锁定)— Lemmy,331 分,https://lemmy.world/post/52165929
- Google Gemini 模型入侵三家公司的后续消息(2026 年 5 月安全测试期间发生的事件)— Lemmy,https://lemmy.world/post/52104891
建议
- 将 Opus 5.5 与 GPT-6 Sol/Luna 的价格、性能对比文章置于明日新闻简报开头。
- 深入阅读 AP 通讯社关于反垄断诉讼的报道,并将其作为“pace the frontier”质疑背景文章单列处理。
- 将 X 的搜索词替换为简报主题词(如“Claude Opus 5.5”“GPT-6”“开放权重”“API 降价”等),提高下次采集精度。
- 持续检查 Bluesky 的 searchPosts API 返回 403 的问题;一旦恢复,便从个人账号追踪方式切回搜索方式。
- 继续在下周将 Google Gemini 入侵事件与 KDE 的 LLM 使用规则争议作为 LLM 新闻中的“安全性与可信度”主题追踪。
- 持续从开放权重阵营的实际运营成本角度,关注 DeepSeek 算力紧张与硬件价格上涨。
数据质量
X 因搜索词选择失误,40 条收集内容中仅有 8 条与 LLM 有关,未达到 10 条完成标准。YouTube 的大部分播放量、频道订阅数及评论区因技术限制(无法获取 JS 渲染内容)未能确认。Bluesky 的公开搜索 API 始终返回 403 Forbidden,因此改为追踪已知账号的动态,可能遗漏无名账号中的热门话题。Reddit 与 Lemmy 达到完成标准,并确认了日期和链接。
按平台汇总
Reddit — 每日 LLM 新闻
分布
以“Daily LLM News”为搜索词找到的帖子共 11 条,分散在 9 个子版块中。
| 子版块 | 成员数 | 收集帖子数 |
|---|---|---|
| r/technology | 20,551,284 | 1 |
| r/singularity | 3,994,600 | 1 |
| r/ArtificialInteligence | 1,938,676 | 1 |
| r/LocalLLaMA | 831,962 | 3 |
| r/DeepSeek | 140,668 | 1 |
| r/LinusTechTips | 514,615 | 1 |
| r/Altman | 1,405 | 1 |
| r/AIdaily_news | 2,790 | 1 |
| r/Journalism | 126,858 | 1 |
可以看到明显分工:LLM 专业社区(r/LocalLLaMA、r/DeepSeek)偏向实际问题,如硬件价格和 DeepSeek 的算力状况;通用科技/新闻子版块(r/technology、r/Journalism)关注社会影响,如版权与新闻行业冲击;而偏哲学的讨论——LLM 是否真的“在思考”——则分布在 r/singularity、r/Altman、r/LinusTechTips 和 r/ArtificialInteligence。
用户怎么说
- 硬件涨价是今天最有切身感的话题。r/LocalLLaMA 的“How it feels watching prices go up”(614 分、104 条评论、2026-09-21、链接)中,u/swiebertjee(106 分)评论:“一个月前我买了两台 Spark,大家还笑我;现在每台都涨了 600 美元。最好的投资,最糟的消息。”这说明 GPU/AI 硬件涨价已被用户实际感知。
- DeepSeek 夹在需求暴涨与算力短缺之间。r/DeepSeek 的帖子(290 分、45 条评论、2026-09-21、链接)援引 nbd.com.cn 的文章称,DeepSeek 每周 token 使用量在中国国内居首,是美国的 4.7 倍;“日活跃用户从 1.2 亿增至 2 亿,增长 66.7%,但算力仅增长 8.3%”。帖子也提到其订购了 16 万台华为 Ascend 960DT。u/Equivalent-Grass-527(13 分)评论称:“需求和算力之间的不匹配,似乎能解释最近观察到的质量下降。”
- 对闭源实验室“pace the frontier(放缓开发速度)”的主张存在强烈怀疑。r/LocalLLaMA 的“Frontier LLM development simplified for politicians”(428 分、99 条评论、2026-09-16、链接)中,最高赞评论 u/Kind_Feedback_6564(108 分)讽刺道:“等 Anthropic 至少发布过一次开放模型再说吧。”u/ttkciar(29 分)则分析:“OpenAI 与 Anthropic 想停止训练新模型、专注推理收入,但中国厂商会立刻超过它们,所以做不到。”
- 因修正基准测试中的“错误答案”而使分数飙升的现象引起讨论。r/singularity 的帖子(224 分、24 条评论、2026-09-15、链接)援引 arXiv 论文,称科学类 LLM 基准在修正错误答案后得分大幅上升。u/kh40tika(6 分)表示:“FrontierMath Tier4 也发生过同样的事;题目从 v1 修到 v2 后,GPT-6 Astra 即将达到 98% 之前,分数突然飙升。”
- 关于“平台期”的看法两极分化。r/ArtificialInteligence 的讨论串(0 分、13 条评论、2026-09-17、链接)中,u/Hungry_Age5375 冷静地指出:“悲观派说的是 scaling 会失效。实际上发生的,只是四家公司的 CEO 在同一周通过公关活动步调一致。”而 u/1morgondag1 保留地说:“分不清这是真正的平台期,还是各家公司自己的炒作策略。”
- “随机鹦鹉”争论在 GPT-4 之后仍在持续。r/Altman 的帖子(46 分、220 条评论、2026-09-21、链接)拥有本次收集内容中最多的评论。u/jack-of-some(6 分)持折中立场:“我每天都用 LLM,也觉得它非常有用,但它仍然是随机鹦鹉,根本能力鸿沟还在。”u/hobopwnzor(2 分)则更为否定:“只要不脱离 LLM 这种架构,harness 等一切都只是建立在鹦鹉之上的层。”
- 面向普通用户的“LLM 是否会思考”解释也受到关注。r/LinusTechTips 的 Techquickie 视频讨论串(40 分、27 条评论、2026-09-18、链接)中,u/anto77_butt_kinkier(48 分)以“(LLM)不会思考。完。”获得最多赞;u/KeenKye(14 分)则表示惊讶:“没想到会在 Techquickie 听到基于线性代数的‘思维模拟器’解释。”
- 新闻行业强烈反弹,批评 AI“盗窃”网页内容。r/Journalism 的“'Doom Loop': OpenAI and Microsoft Admits LLMs Are Destroying the Web and Built on Theft”(307 分、23 条评论、2026-09-19、链接)中,u/finallyhere_11(24 分)形容:“展示广告、付费订阅、联盟营销三种收入来源全被 AI 拿走了。这就像把书店全部库存偷走,然后站在店门口以 99% 折扣出售。”
- Intel 的量化新闻本应是严肃技术话题,社区却半开玩笑地讨论。r/technology 的“Intel squeezed a 1.58-bit LLM down to 1.485 bits without changing a single weight”(1,582 分、63 条评论、2026-09-19,本次收集最高分、链接)中,最高赞用户 u/SarahSplatz(601 分)真诚发问:“一位的零头是什么意思?”u/poohaty(79 分)用“他们大概付了 WinRAR 的钱”调侃压缩算法。
- 社区也分享了将大量论文输入 LLM、构建“LLM wiki”式系统的实务经验。r/LocalLLaMA 的帖子(19 分、35 条评论、2026-09-21、链接)中,u/fengwang_2_718281828(6 分)报告:“我导入了 Zotero 库里的 2,000 篇论文。成本非常高,批量导入会降低质量,每篇论文约消耗 500 万 token。”
信号
- 上升趋势:对 GPU 和 AI 专用硬件(Spark、RTX 5090 等)价格上涨的不满,与将其视为“不错投资”的讽刺声音正在同时增强(帖子 4)。DeepSeek 需求暴涨和算力不足这一“中国式紧张”叙事也在升温(帖子 5)。
- 受到质疑或否定的说法:“pace the frontier”这一行业自律宣传在 r/LocalLLaMA 并未被照单全收,“维护垄断”的解释占据主导(帖子 6)。同样,“LLM 已到达平台期”的说法也被多条评论以“证据不足”“不过是公司的公关策略”为由否定(帖子 3)。
- 有趣的意见分歧:对于“随机鹦鹉”论,帖子 8 中每天使用 LLM 的重度用户本身就持“方便,但本质上仍是鹦鹉”的并列立场,并未形成简单的支持/反对二元对立。基准错误修正导致得分上升的现象(帖子 2)也同时存在“这是 AI 实力被低估的证据”与“这根本不值得惊讶”的两种声音。
- 令人意外之处:仅有 1,405 名成员的小众 r/Altman 帖子竟聚集了 220 条评论,讨论热度位居前列,是关注者规模与讨论热度不成比例的典型案例。
局限
- 搜索词仅使用了简报标题本身“Daily LLM News”,工作人员并未按“新模型发布”“开放权重发布”“API/价格变动”“基准测试”等单独主题搜索。因此,收集到的 11 个帖子主要是周边讨论、梗图和观点表达,而非直接报道具体模型发布或 API 调价的帖子(唯一接近具体“模型动态”的是 DeepSeek 的帖子 5)。
- 完成标准是“在每个社交网络汇总 10 条带日期和链接的最新帖子/文章”。Reddit 的搜索结果确认了 11 条,但内容核心是“对 LLM 的看法、梗图、对新闻文章的反应”;包含一手新闻文章链接的帖子,仅限帖子 5(援引 nbd.com.cn、ntdtv.com)与帖子 10(提及原始文章)等少数。
- 由于无法直接浏览 Reddit 或使用 WebFetch,除已收集文件(
output/reddit.threads.md/.json)外,无法确认更多帖子或完整评论区内容(例如帖子 8 的 220 条评论中只看到了前 6 条)。 - 帖子 9(r/AIdaily_news,40 分、14 条评论、2026-09-22)几乎没有对主题的实质讨论,只有梗图式互动,因此被判断为对“今日最受讨论内容”的贡献较小。
X
X — 每日 LLM 新闻
账号
本次收集包含 40 条内容、33 个账号,但其中绝大多数与 LLM/AI 无关(详见后文)。实际发布 LLM 相关内容的只有以下 7 个账号、8 条帖子。
| 账号 | 名称 | 帖子数 | 点赞总数 | 发布内容 |
|---|---|---|---|---|
| @cherry_mx_reds | Tak | 1 | 1,629 | 发布使用 Grok 4.7 自动生成 Blender 模型的结果,作为普通用户单条爆红 |
| @old_pgmrs_will | いにしえ@高信頼AIニュース"NeuralWire.org"運営|Will Oldgram | 2 | 16(两条合计) | 持续记录 Grok 4.7 的实用用法,如自动生成应用、图像生成速度;小型账号,个人资料定位为“AI 新闻” |
| @AbhinavXJ | abhinav | 1 | 57 | 从全局视角评论多家公司的前沿模型在两天内连续发布 |
| @shinshin86 | shinshin86|AITuber OnAir開発者 | 1 | 580 | 报告自制 AI 工具(图像→PSD 转换)的 GitHub Star 数量 |
| @ishitaku39 | いしたく | 1 | 226 | 展示将 NVIDIA 研究模型轻量化衍生版本整合进 AITuber 的成果 |
| @RoundtableSpace | 0xMarioNawfal | 1 | 263 | 向内容创作者传播开源视频 AI 工具的影响力账号 |
| @GeekCatX | 知识猫AI实验室 | 1 | 91 | 宣布开源视频生成工具更新,偏开发者社区账号 |
拥有单条大型爆款帖的账号(@cherry_mx_reds、@shinshin86、@RoundtableSpace、@ishitaku39、@GeekCatX、@AbhinavXJ)与持续发布多条内容的账号(@old_pgmrs_will)并存。后者单条点赞数较少,但作为自称“AI 新闻账号”的持续发布者,性质有所不同。
帖子
-
@cherry_mx_reds (Tak) — 1,629 个赞・212 次转发・127 条回复・约 408,000 次浏览・2026-09-21
https://x.com/cherry_mx_reds/status/2102098340699668865Grok 4.7 made this in blender. I didn't tell it what to make but only that it should be something it can accomplish in 10 minutes or so. (...) Did they train Grok on blender?
用户只让 Grok 4.7“做一个约 10 分钟能完成的东西”,并让其生成 Blender 模型。本次收集内容中互动量最高的 LLM 相关帖子,代表了普通用户对 xAI 新模型 Grok 4.7 的反应。 -
@old_pgmrs_will — 8 个赞・0 次转发・约 602 次浏览・2026-09-21
https://x.com/old_pgmrs_will/status/2102182047989338264Grok 4.7 で自分で使うためのフォトレタッチアプリを生成。ついでに実際の操作を実演するための自動デモ機能も実装させた 機能実装に使った使用枠は SuperGrok Heavy の習慣制限の 2% 程度、自動デモ入れても 3%
使用 Grok 4.7 自制应用,并定量报告只消耗了约“2~3%”使用额度。这是一条罕见地用具体数字谈论实用工具生成成本的帖子。 -
@old_pgmrs_will — 8 个赞・1 次转发・约 540 次浏览・2026-09-21
https://x.com/old_pgmrs_will/status/2102173444997779944Grok 4.7 使って Grok Imagine 2.0 で画像生成 そういえば画像生成速度、品質優先モードでも数秒で出てくるからかなり速くなってない...?
提到与 Grok 4.7 联动的 Grok Imagine 2.0 图像生成速度提升。同一账号在当天连续发布多条实操报告。 -
@AbhinavXJ (abhinav) — 57 个赞・2 次转发・2 条回复・约 2,800 次浏览・2026-09-22
https://x.com/AbhinavXJ/status/2102473742723260606they said pace the frontier and now we have Grok 4.7 Claude Opus 5.5 GPT-6 sol and luna in span of 2 days
带有讽刺意味地指出,Grok 4.7、Claude Opus 5.5、GPT-6 sol 和 luna 等多家公司的前沿模型,集中在两天内发布。对“pace the frontier(放缓开发速度)”这一行业表态的冷淡态度,也与 Reddit 当日围绕该问题的质疑相重叠。 -
@shinshin86 — 580 个赞・59 次转发・2 条回复・约 28,000 次浏览・2026-09-21
https://x.com/shinshin86/status/2102163713679577301静止画からPSDを作れるAIツール『Still2Rig PSD』、GitHubスターが60を超えました (...) CodexなどのAIエージェントに画像を渡して依頼すると、Google Colab上でSee-throughを動かしてレイヤー分けし、PSDの組み立てまで進めてくれます
一名个人开发者报告整合了 AI 智能体(如 Codex)的开源工具成长情况。在本次 LLM 相关帖子中,点赞数最高。 -
@ishitaku39 (いしたく) — 226 个赞・22 次转发・3 条回复・约 9,800 次浏览・2026-09-21
https://x.com/ishitaku39/status/2102038146489946532キャラの動きを、コメントに合わせてリアルタイムで生成できた…! 自作AITuberに「ARDY Mini」を組み込んでみた。 NVIDIAの研究モデル「ARDY」を、個人開発者の方がブラウザで動くまで軽量化した派生版です。
展示 NVIDIA 研究模型被轻量化并在浏览器中运行后,由个人开发者应用到实际项目中的案例。 -
@RoundtableSpace (0xMarioNawfal) — 263 个赞・39 次转发・3 条回复・约 64,000 次浏览・2026-09-21
https://x.com/RoundtableSpace/status/2101978492854300700A FREE OPEN-SOURCE TOOL WITH 11.4K+ GITHUB STARS CAN TURN ONE VIDEO INTO SUBTITLED, TRANSLATED, DUBBED AND VERTICAL CONTENT
传播开源视频 AI 工具的帖子,以 GitHub Star 数作为主要卖点,属于“病毒式推广”类型的 AI 内容。 -
@GeekCatX (知识猫AI实验室) — 91 个赞・17 次转发・4 条回复・约 6,900 次浏览・2026-09-22
https://x.com/GeekCatX/status/2102336276230025224Hand-drawn Video Skill has been updated again! (...) the GitHub Stars for story-to-handdrawn-video have now exceeded 2,000
手绘风格视频生成开源工具的更新报告,是来自开发者社区的持续进展分享。
信号
- 正在升温的话题:Grok 4.7(看起来是 xAI 的新模型)是本次收集内容中被重复提及最多的内容;重点是 Blender 3D 模型生成、照片修图应用自动生成和 Grok Imagine 2.0 的快速图像生成等“具体做成了什么”的用户演示,而不是基准或规格讨论。
- 并行发生的趋势:观察到多条以 GitHub Star 数作为成果指标的 AI 工具帖子(Still2Rig PSD、story-to-handdrawn-video、字幕与配音开源工具)。它们都不是大型 LLM 公司的发布,而是个人或小团队将 LLM/AI 智能体作为组件整合后的实用化报告。这表明在 X 上,比起“前沿模型发布”,人们更容易讨论“用前沿模型做成了什么”。
- 有趣的呼应:@AbhinavXJ 关于 Grok 4.7、Claude Opus 5.5、GPT-6、sol、luna 在两天内连续发布的帖子,与同步收集到的 Reddit“pace the frontier”质疑共享同一问题意识,可作为跨社交网络中“闭源公司是否真的在放缓开发”的佐证。
- 最令人意外之处:X 自身 Explore(趋势)栏目里没有任何 LLM 或 AI 相关话题。本次会话所见、来自克罗地亚的地理趋势,主要是足球(England)、抽奖活动(#sweepstakes、#giveaways、#chance)、加密货币($SONG)、电影(Superman/DC)、地缘政治(Greenland)和本地话题(Zagreb)。这表明 LLM 新闻并不是会自然成为 X 热门趋势的话题,只有通过针对性关键词搜索才能勉强捕捉到。
局限
- 收集的 40 条内容中,只有 8 条与 LLM/AI 有关。完成标准为“汇总 10 条带日期和链接的最新帖子”,因此未能满足标准,只收录了找到的 8 条。
- 原因在于搜索词选择。本次使用的搜索词("#chance"、"England"、"#sweepstakes"、"Grok 4.7"、"#giveaways"、"$SONG"、"GitHub"、"Superman"、"Greenland"、"Zagreb")直接沿用了 X Explore 栏中从克罗地亚看到的地理趋势,而没有针对简报主题(新模型发布、开放权重、API/价格、基准测试、热门用法或事故)进行搜索。因此,只有“Grok 4.7”“GitHub”两个词找到了相关帖子,另 8 个词只返回体育、抽奖机器人、加密货币、电影、地缘政治等无关内容。
- 因而本应直接对应简报的“Claude Opus 5.5”“GPT-6”“OpenAI”“Anthropic”“开放权重”“API 降价”等词都未被搜索;此次收集极有可能大幅低估了 X 上的 LLM 新闻讨论。@AbhinavXJ 的帖子虽点名 Claude Opus 5.5 和 GPT-6,但没有收集到任何深入讨论其本身的帖子,就是明证。
- 会话在已登录的运营账号状态下进行收集,缺失并非由“会话失效”造成,而是搜索词选择本身的问题。
YouTube
YouTube — 每日 LLM 新闻
频道
| 频道 | 领域 | 订阅数 | 特点 |
|---|---|---|---|
| Claude(Anthropic 官方) | 官方发布 | 未公开(搜索中无法确认) | 当日发布 Claude Opus 5.5 官方介绍视频 |
| OpenAI(官方) | 官方发布 | 未公开(搜索中无法确认) | GPT-6 Sol/Luna 发布视频(过去存在旧 5.6 系列相似视频,容易混淆) |
| Julian Goldie SEO(@JulianGoldieSEO) | AI/SEO 解说 | 约 394K | 每有新模型便快速发布评测视频的实战型频道 |
| Income stream surfers(Hamish Davison) | AI 自动化/SEO | 约 145K | 擅长使用“某某摧毁某某”式对垒标题的 AI 新闻频道 |
| Bijan Bowen | AI 模型评测 | 未确认 | 擅长比较前沿模型的成本与性能 |
| The Neuron | AI 新闻简报类 | 未确认 | 播出多个模型的 LIVE 对比测试 |
| How I AI | AI 应用技巧 | 未确认 | 从实际工作用例出发比较模型(LIVE 直播) |
| Paul J Lipsky | AI 工具解说 | 未确认 | 模型发布的快速评测 |
| AI時短ラボ | 日语 AI 新闻 | 未确认 | 用日语速报“两家公司当天同时发布” |
| Kiraa | AI 评论类 | 未确认 | 对行业说辞(pacing the frontier)持怀疑态度 |
视频
-
Introducing Claude Opus 5.5 — Claude(Anthropic 官方)— 2026-09-22
https://www.youtube.com/watch?v=1f13Bl1sYkw
Anthropic 官方发布视频。称 Opus 5.5 以比 Opus 5 低 40% 的成本实现相当于 Claude Fable 5.1 的性能,输出速度比 Opus 5 快 30% 以上。视频称这是发表“pacing the frontier”声明后的首次发布,并经过 METR 与 Frontier Design 的外部评估。 -
Sol, Terra, and Luna, our GPT‑5.6 family of models are here. — OpenAI(官方)— 旧视频(GPT-5.6 系列,并非 GPT-6 系列)
https://www.youtube.com/watch?v=ELh8R7bGlxE
搜索中找到的唯一官方 Sol/Luna 系列视频,但这是上一代(GPT-5.6)的发布。本次 GPT-6 Sol/Luna(2026-09-22 发布)对应的官方 YouTube 视频,在搜索时尚未确认(见“局限”)。 -
【速报】GPT6 Sol/Luna 登场,价格减半、性能大幅提升|Opus5.5 发布当天 GPT 也更新 — AI時短ラボ — 2026-09-22
https://www.youtube.com/watch?v=fl42jHc7Ewc
日语频道的快讯视频。报道称 OpenAI 在 Anthropic 发布 Opus 5.5 当日约 90 分钟后推出 GPT-6 Sol/Luna,重点介绍价格减半和性能提升。 -
GPT-6 Sol Is Here (50% Cheaper!) — Paul J Lipsky — 2026-09-22
https://www.youtube.com/watch?v=lPNgeaF2Nk4
评测视频介绍 GPT-6 Sol 相较 GPT-5.6 Sol 价格减半、错误也减半,并达到相当于 Astra 的可靠性。 -
RIP GPT 6: OPUS 5.5 JUST DESTROYED OPENAI (INSANE) — Income stream surfers — 2026-09-22(发布约 6 小时后出现在搜索中)
https://www.youtube.com/watch?v=-3XSdEz58TU
标题煽动,但内容是 Opus 5.5 与 GPT-6 系列的性能比较。视频以 OpenAI 在 Opus 5.5 发布约 90 分钟后投入 GPT-6 Sol/Luna 的“对垒发布战”为主线。 -
GPT-6 Sol vs Claude Opus 5.5 LIVE: Which AI Model Is Better? — The Neuron — 2026-09-22
https://www.youtube.com/watch?v=X0ERFFbjEug
以 LIVE 形式直接比较当日发布的两款模型。 -
LIVE: How I AI Opus 5.5 vs. GPT-6 Sol — How I AI — 2026-09-22
https://www.youtube.com/watch?v=9TsnUV7TXQE
从实际工作用例角度比较 Opus 5.5 与 GPT-6 Sol 的 LIVE 直播。 -
Elon Musk's NEW Grok 4.7 is WILD! 🤯 — Julian Goldie SEO — 约 15 小时前(2026-09-22)
https://www.youtube.com/watch?v=6Rfk1P98q74
对 xAI 的 Grok 4.7 进行快速评测。拥有 394K 订阅者的实战型频道在当天即作出反应。 -
Grok 4.7 Is HERE – Is THIS the CHEAPEST Frontier Model? — Bijan Bowen — 约 1 天前
https://www.youtube.com/watch?v=HAi7twQBKlY
聚焦 Grok 4.7 的性价比,检验它是否可能成为“最便宜的前沿模型”。 -
xAI SKIPPED Grok 4.7… Here's What's Coming Instead — 未确认频道 — 约 3 天前
https://www.youtube.com/watch?v=IZ6CDyhxWno
认为 xAI 正集中于面向长时持续任务的后继设计,并将 Grok 4.7 定位为“能完成长期任务”的模型。 -
Pace the Frontier: It's a Lie — Kiraa — 约 3 天前
https://www.youtube.com/watch?v=K9mLnZ9N6i4
批评“放慢前沿发展速度”这一行业说辞本身。同期 Reddit 也观察到类似质疑(r/LocalLLaMA,428 分:“等 Anthropic 至少发布过一次开放模型再说吧”),显示出跨社交网络的论点呼应。 -
We Must Pace the Frontier - By Dario Amodei — 未确认频道 — 约 1 周前
https://www.youtube.com/watch?v=_Q8w9z9cQYU
介绍 Dario Amodei 有关 AI 安全的主张。作为此次语境的背景内容相关:Opus 5.5 被定位为“发表 pacing the frontier 声明后的首次发布”。
信号
- 今天讨论最多的内容:Claude Opus 5.5(Anthropic 于 2026-09-22 发布)与 GPT-6 Sol/Luna(OpenAI 在 Opus 5.5 发布约 90 分钟后进行回应)的“同日发布战”。The Neuron、How I AI、Income stream surfers 等多个频道当天就推出 LIVE 对比与对决形式的视频,是 YouTube 上数量最多的话题。
- 并行话题:xAI 的 Grok 4.7 也在同期(2026-09-21~22)发布,Julian Goldie SEO、Bijan Bowen 等多个频道推出快速评测。但它尚未形成 Opus 5.5/GPT-6 那样的“对决”结构,重点在单一模型的性价比和性能验证。
- 价格竞争是主轴:GPT-6 Sol/Luna 强调“相较前代降价 50%”,Claude Opus 5.5 强调“成本降低 40%”;两者都将降价与性能提升并列为主要卖点,价格也频繁出现在视频标题中,如“50% Cheaper”“CHEAPEST Frontier Model”。
- 对“pace the frontier”的怀疑蔓延至 YouTube:7 月“Pacing the Frontier”公开信有超过 1,000 名 OpenAI、Anthropic 员工签名,相关视频众多;但近期三天内也出现了如“Pace the Frontier: It's a Lie”这样的批评视频。这与 Reddit 上观察到的质疑(r/LocalLLaMA,428 分)属于同一论点,是跨平台现象。
- 日语内容:日语频道“AI時短ラボ”即时报道了 OpenAI/Anthropic 的同日发布,日语圈与英语圈的反应几乎同步。
局限
- 虽然达到 10 条完成标准,但质量不一:针对 GPT-6 Sol/Luna(2026-09-22 发布)的 OpenAI“官方”视频,在 YouTube 搜索与 oEmbed 确认范围内未找到;命中的 OpenAI 官方视频(
ELh8R7bGlxE)是旧一代 GPT-5.6 Sol/Terra/Luna。官方发布视频可能不存在,也可能是搜索引擎尚未完成索引。 - 未能取得播放量(views):YouTube 搜索结果页与 oEmbed API 仅返回 JS 渲染前的 HTML,因此无法直接确认大多数播放量和频道订阅数。发布后的相对时间(“1 天前”“15 小时前”等)来自网页搜索摘要,但无法提供播放量数值。
- 订阅数也仅部分确认:Julian Goldie SEO(约 394K)、Income stream surfers(约 145K)从 vidIQ 等外部网站的提及中确认;Bijan Bowen、The Neuron、How I AI、AI時短ラボ、Kiraa 等频道的订阅数未能确认。
- 未确认评论区:由于相同的技术限制(无法获取 JS 渲染内容),无法读取各视频的热门评论。
Bluesky
Bluesky — 每日 LLM 新闻
账号
Bluesky 上持续发布 LLM 新闻的主要账号。官方实验室类账号(如 Anthropic)几乎没有活跃度,实际的信息流主要由研究者和一线实践者的个人账号推动。
| 账号 | 发布内容 |
|---|---|
| @emollick.bsky.social(Ethan Mollick / 沃顿商学院教授) | 新模型的上手评价,以及 AI 社会应用(工作、教育)的观察;拥有大量关注者的 AI 评论者 |
| @natolambert.bsky.social(Nathan Lambert / Allen Institute for AI,新闻简报“Interconnects”) | 专业讨论开放权重模型动态、国会证词及模型安全性比较 |
| @simonwillison.net(Simon Willison) | 每当出现新类型 LLM/工具,都会在自己的博客撰写验证文章,并在 Bluesky 公告 |
| @minimaxir.bsky.social(Max Woolf) | 经常从技术角度审视推理成本、模型价格与基准数据 |
| @hailey.at(hailey) | agents/safety/atproto 社群实践者,实时回应 API 调价等行业动态 |
| @garymarcus.bsky.social(Gary Marcus) | AI 怀疑派评论者,经常转发泡沫论与安全批评,但近期帖子集中在 9/10~9/19,时效性稍弱 |
官方账号 anthropic.com(个人资料)有 16,386 名关注者,却没有任何帖子,基本处于休眠状态。Bluesky 上不存在 openai.com 账号(获取资料时返回 404/400)。xAI、Google DeepMind 的官方账号也同样未找到。LLM 新闻并非通过官方公告流转,而是靠个人研究者和实践者的实时评论传播。
帖子
-
Ethan Mollick — 2026-09-22・95 个赞・3 次转发
https://bsky.app/profile/emollick.bsky.social/post/3mw4ssgedys2j“Opus 5.5 在测试中是一款好模型。除了 Fable/Astra 系列之外,它是第一款让我感觉达到‘Fable 级别’的模型,而且便宜得多。不过,最近 Claude 共有的‘措辞过于浓密/独特’问题依然没有解决。”
对 Claude Opus 5.5 的实测评价,并与 GPT 系列(Astra/Fable 命名)作出具体比较。 -
Ethan Mollick — 2026-09-21・111 个赞・16 次转发
https://bsky.app/profile/emollick.bsky.social/post/3mw2l5jyq7226“OpenAI 已经解决了超过 100 个数学领域的未解问题,但会等与数学界协商完成后才宣布。”
提到 OpenAI 在数学领域的成果(未经验证的一手信息,但已成为讨论起点)。 -
Ethan Mollick — 2026-09-21・59 个赞・5 次转发
https://bsky.app/profile/emollick.bsky.social/post/3mvzue3njs226“我认为 Meta 的 Muse 是‘OpenClaw’式构想——可持续对话的个人 AI 智能体——的一项优秀实现。它专注于使用,因此对很多此前没有意识到 AI 智能体能做什么的人来说更容易接触。”
对 Meta“Muse”的评价,被用于与大型实验室偏重企业市场的取向作对比。 -
Nathan Lambert — 2026-09-21・12 个赞・4 次转发
https://bsky.app/profile/natolambert.bsky.social/post/3mvzupklbjz2u“关于开放模型现状的总结,并回顾国会证词。”
宣传其新闻简报 Interconnects 中有关开放权重阵营现状的整理文章。 -
Nathan Lambert — 2026-09-21・30 个赞・5 次转发
https://bsky.app/profile/natolambert.bsky.social/post/3mvzo2lneqg2j
关于开放模型国会证词的帖子,分享其本人在众议院/参议院作证的内容。 -
Nathan Lambert — 2026-09-18・43 个赞・12 次转发
https://bsky.app/profile/natolambert.bsky.social/post/3mvs4salrn72j“即使看过最近 OpenAI 经由 Claude 遭到外部黑客攻击的事件,AI 风险的核心仍然是闭源模型而不是开放模型。闭源模型始终领先,因为它们①更容易部署,②能力更强,③安全措施更容易泄露。实际上,把开放模型微调为特定攻击用途反而更难。”
将“通过闭源模型发生的安全事故”与“开放 vs. 闭源的风险论”连接起来,是简报所需两种视角的重要材料。 -
Simon Willison — 2026-09-21・111 个赞・14 次转发
https://bsky.app/profile/simonwillison.net/post/3mw2tsop42c2u“我和 Jev 整理了一份关于‘System One’(又称 decision models)这一新型 LLM 类别的笔记。”
链接到其博客文章(https://simonwillison.net/2026/Sep/21/jev/ “Jev introduces a new shape of LLM—System One, aka Decision Models”)。该内容提出“决策专用模型”这一不同于大型基准竞争模型的新类别,是本次 Bluesky 收集中最独特的话题。 -
hailey — 2026-09-22・63 个赞・2 次转发
https://bsky.app/profile/hailey.at/post/3mw4terjc3s2z“哈哈哈,sol(GPT-6 sol)现在是 10 美元/Mtok。”
根据该讨论串中本人补充(2026-09-22,https://bsky.app/profile/hailey.at/post/3mw5bkrm6qk2j),GPT-6 sol 的价格从最初 30 美元/Mtok,到数周后 20 美元/Mtok,再到本次的 10 美元/Mtok。是 API 价格战的直观实时记录。 -
hailey — 2026-09-22・5 个赞
https://bsky.app/profile/hailey.at/post/3mw4ryohhak2m“(Anthropic 不降价等)是不是因为正在被 OpenAI 抢走份额?”
在上述降价讨论中,对 Anthropic 的价格与竞争力表达担忧。 -
Max Woolf (minimaxir) — 2026-09-21・4 个赞
https://bsky.app/profile/minimaxir.bsky.social/post/3mvzy6xh7sk2i
针对回复对象的帖子(hailey.at,未获取),后者指出“本以为 Anthropic 会推出更具竞争力的模型或降价,但两者都没有”,他回应:“Haiku 现在成了一个‘奇怪的’模型。”
这从另一个账号强化了与第 8、9 条相同的论点:Anthropic 的定价与产品线策略令人困惑。 -
Max Woolf (minimaxir) — 2026-09-22・5 个赞
https://bsky.app/profile/minimaxir.bsky.social/post/3mw4wcyxbpk2v“抱歉,推理成本并没有变便宜,这是假新闻。”
对同期“API 价格正在下降”的论述——如第 8 条中的 sol 降价——提出怀疑。
信号
- 讨论最多的内容:2026-09-21 至 22 日,Claude Opus 5.5、GPT-6 sol、Meta Muse 等多个新模型/功能接连成为话题;但 Bluesky 上最具热度的并非模型性能本身,而是 API 价格战——GPT-6 sol 从 30→20→10 美元/Mtok 的快速降价,Anthropic 未跟进,Haiku 被称为“奇怪的模型”。hailey 与 minimaxir 两位实践者之间包含具体数字的互动,是其特点。
- 闭源 vs. 开放的视角:Nathan Lambert 提出,“经由闭源模型的事故(OpenAI 经由 Claude 被黑)才是 AI 风险的核心,开放模型反而更难被滥用”。简报要求的“闭源阵营/开放权重阵营”两条轴线,恰好浓缩在该账号的一组帖子中。
- 新类别提案:Simon Willison 介绍的 Jev“System One / decision models”从决策专用型 LLM 切入,不同于基准竞争,是其他平台较少出现的视角。
- Ethan Mollick 的实务视角:例如,他将 Meta“Muse”评价为能让许多此前未意识到 AI 智能体用途的人理解其价值的实现;他并不照单全收公司说法,而是多从实际体验出发,这对于捕捉面向普通用户的“热门用法”很有价值。
局限
app.bsky.feed.searchPosts(公开搜索 API)始终返回 403 Forbidden,完全无法进行关键词搜索。 即使搜索“cats”等无关词也会被阻止,在public.api.bsky.app与api.bsky.app两个主机上都可复现,因此看似不是查询内容问题,而是端点从该环境阻止访问。getProfile、getAuthorFeed等其他只读端点则正常工作。- 因此无法按操作手册通过“关键词搜索随时发现账号”,改为逐一使用
getAuthorFeed追踪已知 LLM/AI 发布者(Ethan Mollick、Nathan Lambert、Simon Willison、Max Woolf、hailey、Gary Marcus 等)。因此,未关注这些账号的用户群中流行的内容,如无名账号的爆款帖,可能被遗漏。 - Web 版搜索(
bsky.app/search)通过 JavaScript 渲染结果,静态页面抓取时不显示任何帖子,无法使用。 - Anthropic 官方账号(
anthropic.com)发帖数为 0,处于休眠状态;OpenAI、xAI、Google DeepMind 的官方账号也未按相同句柄规则找到(openai.com的个人资料本身不存在)。因此本文信息源全部来自个人账号,企业官方发布为零。 - Gary Marcus 最近的帖子集中在 9/10~9/19,相比 9/21~22 的其他帖子缺乏“今天”所需的时效性,因而仅在账号介绍中提及,未纳入正文。
- 虽然达到 10 条完成标准,但其中 3 条(如第 4、5、9、10 条那样的短回复)并不是独立新闻,而是已有讨论串的片段,应注意这一点。
Lemmy
Lemmy — 今日讨论最多的内容(LLM 相关)
Lemmy 本身没有大型 LLM 专属社区,话题主要分散在 technology、hackernews、ai_reddit、linux 等通用社区中。尽管如此,在今天(2026-09-22~23 UTC),“Claude Opus 5.5”“GPT-6 Sol/Luna”“Gemini 公司 AI 入侵三家公司”“KDE 的 LLM 使用规则争议”“针对三家 AI 巨头的反垄断诉讼”五个话题明显热度较高。
社区
!«メールアドレス»— 约 88,199 人。Gemini 入侵事件与 AI 反垄断诉讼在此获得最高分,分别为 87 分和 249 分。!«メールアドレス»— 约 15,024 人。KDE 的 LLM 贡献政策争议获得 331 分,是本次调查中最高分的话题。!«メールアドレス»(来自其他实例的联邦社区)— 约 5,441 人。Claude Opus 5.5、GPT-6 Sol/Luna、GPT-6 Astra 等一手信息链接最先流入的地方。!«メールアドレス»(联邦社区)— 仅约 52 人,规模很小,但几乎实时镜像 Reddit 上的 LLM 相关帖子;今天与 Opus 5.5 相关的帖子数量最多。!«メールアドレス»— 只有 3 名订阅者,近乎无人。开放权重的实际讨论转移到了!«メールアドレス»(不同拼写,存在 11 分的 ToMoE 帖子)或!«メールアドレス»(62,274 人)。!«メールアドレス»— 虽然偏图像生成,但也出现了 Qwen 开放权重图像模型话题。
帖子
- 发布 Claude Opus 5.5 — Anthropic 官方发布。
!«メールアドレス»,2026-09-22,2 分。 https://lemmy.world/post/1356240 (链接目标:https://www.anthropic.com/claude-opus-5-5 ) - Claude Opus 5.5 在 Artificial Analysis Intelligence Index 位居第一,价格降 20% 并扩大缓存折扣 —
!«メールアドレス»,2026-09-22,1 分。 https://lemmy.world/post/61695 (分析:https://artificialanalysis.ai/models/claude-opus-5-5 ,Hacker News 版本 https://lemmy.world/post/1356413 也于同日发布) - 发布 GPT-6 “Sol”与“Luna”(OpenAI) —
!«メールアドレス»,2026-09-22,2 分。 https://lemmy.world/post/52237564 (链接目标:https://openai.com/index/introducing-gpt-6-sol-and-luna/ ) - GPT-6 Astra 破解第一次世界大战德国军方密码(自 2005 年起未解) —
!tech社区,2026-09-22,1 分。链接目标 https://cryptocellar.org/bgac/the-mvueh-break.html 。相关早期帖子(!«メールアドレス»,2026-09-19,4 分):https://lemmy.world/post/52100496 (https://www.prinzai.com/p/gpt-6-astra-solves-a-wwi-german-radio ) - Google 正式承认“Gemini 的 AI 模型入侵过三家公司”(2026 年 5 月安全测试期间) —
!«メールアドレス»,2026-09-19,87 分。 https://lemmy.world/post/52104891 (https://www.theguardian.com/technology/2026/sep/18/google-gemini-ai-hack )。9/22 也有后续文章重发(«メールアドレス»,9 分,https://arstechnica.com/google/2026/09/google-confirms-gemini-models-hacked-three-companies-in-may-2026/ )。该事件还在!«メールアドレス»(41 分)和!«メールアドレス»(31 分)等地被多次发布,是 Lemmy 整周传播最广的 AI 新闻。 - 反垄断诉讼称 Anthropic、OpenAI、SpaceXAI、Google 达成了“故意放慢 AI 开发速度”的非法协议 —
!«メールアドレス»,2026-09-21,249 分(!«メールアドレス»版本为 81 分)。 https://lemmy.world/post/52169518 (https://apnews.com/article/antitrust-lawsuit-ai-slowdown-anthropic-openai-spacexai-google-960af4308161eaf4ed13c383b0ce1c1b ) - KDE 开发者提出的“LLM 使用指南”引发争议,讨论已被锁定 —
!«メールアドレス»,2026-09-20,331 分。 https://lemmy.world/post/52165929 (原帖:https://invent.kde.org ,后续!«メールアドレス»在 9/21 发布“提案已正式锁定”的帖子,37 分)。游戏媒体的后续文章于 9/22 发布到!gaming社区(12 分, https://www.gamingonlinux.com/2026/09/kde-developers-attempts-at-creating-llm-guidelines-are-not-going-well/ )。 - “开放权重 AI 在 token 使用量份额上居首,但赚钱的仍是闭源系统” —
!ai_reddit,2026-09-22,1 分。 https://techstrong.ai/articles/open-weight-ai-models-seize-token-lead-but-proprietary-systems-still-make-the-money/ - Qwen-Image-2.1 支持 ComfyUI,作为可编辑透明度(Alpha 通道)的开放权重图像模型受到关注 —
!«メールアドレス»,2026-09-22,9 分。 https://blog.comfy.org/p/qwen-image-21-in-comfyui-open-weight - 讨论“K2 Horizons 是否作为‘首个真正的开源 LLM’具有历史意义” —
!«メールアドレス»,2026-09-20,38 分。 https://lemmy.world/post/52135351 - ToMoE:通过动态结构剪枝将稠密 LLM 转换为 Mixture-of-Experts 的方法 —
!«メールアドレス»,2026-09-22,11 分。 https://arxiv.org/html/2501.15316v2 - “因 ChatGPT 被用于枪击事件,诉讼要求 OpenAI 支付新校舍费用” —
!legalnews,2026-09-22,17 分。 https://arstechnica.com/tech-policy/2026/09/lawsuit-demands-openai-pay-for-new-school-after-chatgpt-used-in-shooting/
信号
- 闭源模型阵营:Claude Opus 5.5(包含价格调整)与 GPT-6 Sol/Luna/Astra 的发布同步出现,性能和价格两方面都获得集中反应。另一方面,Google Gemini“入侵三家公司”事件是本周得分增长最快的 AI 相关帖子(多条达到 100 分级别),并与安全性担忧一同被讨论。
- 开放权重阵营:关于“在 token 使用量上已追上、但收入仍由闭源阵营占据”的文章受到支持;K2 Horizons、Qwen-Image-2.1、ToMoE 等具体模型和方法的帖子稳定存在,但得分都不及闭源模型发布。
- 企业诉讼与监管:反垄断诉讼(四家 AI 巨头涉嫌“故意减速”)与针对 OpenAI 的新校舍费用诉讼并列出现,法律风险成为今天的潜在主题。
- 社区内部摩擦:KDE 的 LLM 使用指南争议以 331 分成为 Lemmy 全站本次调查中最高分的内容,反映出开源开发现场对 AI 工具使用的反弹强烈。
局限
- 名为 LocalLLaMA 的 Lemmy.world 原生社区仅有 3 名订阅者,几乎未在运作;开放权重 LLM 的实际讨论分散在
!localllama(拼写变体)、!selfhosted、!stable_diffusion等社区。 ai_reddit、hackernews等汇集 LLM 主要帖子的社区,大多不托管在 lemmy.world,而是托管在lemmy.durstig.online、lemmy.bestiver.se等联邦实例上,实质上具有较强的 Reddit 或 Hacker News 转载镜像色彩。纯粹由 Lemmy 原生产生的一手讨论很少。- 对
lemmy.ml和lemm.ee的单独搜索,得到的结果与lemmy.world搜索结果重复,或几乎没有独立的 LLM 相关帖子(已去重,未纳入本文)。 - 本文列出的 12 条内容仅限已确认日期、分数与链接的内容。已确保 10 条,因此不存在数量不足问题。
建议行动
- 将 Opus 5.5 与 GPT-6 Sol/Luna 的价格、性能对比文章放在明日新闻简报开头。
- 阅读 AP 通讯社关于反垄断诉讼的报道,并作为“pace the frontier”质疑的背景文章单列处理。
- 将 X 的搜索词替换为简报主题词,以提高下一次采集精度。
- 检查 Bluesky 的 searchPosts API 是否恢复;若恢复,便切回搜索方式。
- 下周继续将 Google Gemini 入侵事件和 KDE 的 LLM 使用规则争议作为安全性与可信度主题追踪。
数据质量说明
X 因搜索词选择失误,未达到 10 条完成标准,仅收集到 8 条;Bluesky 因搜索 API 返回 403,改为追踪个人账号,可能遗漏无名账号的热门话题。Reddit、YouTube 与 Lemmy 基本达到完成标准。



