NO/FOMO

每天一次,过滤 AI 噪音

值得打开的
AI 日报。

发布日期2026-09-25中文版本
本期阅读
—
累计阅读
—

AI Blog

3 stories
02

SemiAnalysis 描绘中国 AI 数据中心扩张

SemiAnalysis 描绘中国 AI 数据中心扩张

SemiAnalysis 模型覆盖逾 1,000 处设施与 60 多家运营商,讨论基础设施向 AI 转移及算力租赁集中度。采集摘要未包含底层数据和完整方法。

Hacker News

1 story
01

Recurse 展示面向专用智能体的无服务器框架

Recurse 展示面向专用智能体的无服务器框架

Recurse 将编程技能与无服务器运行时结合,让智能体根据明确的输入输出与评估标准迭代提示词和 Python 工具。系统已可运行,但部分示例文档仍未完成。

Twitter

9 stories
01

谷歌介绍 Gemini 3.8 语音模型

谷歌介绍 Gemini 3.8 语音模型

谷歌回顾本周发布的两款语音模型,面向创意制作与规模化语音生成。采集到的公告未提供价格或独立评测。

04

Claude 提供 Opus 5.5 任务成本计算器

Claude 提供 Opus 5.5 任务成本计算器

官方称 Opus 5.5 输入输出 token 价格较 Opus 5 低 20%,缓存读取低 60%,并提供任务成本计算器。实际任务节省幅度仍取决于用量。

06

Runway 推出可编辑图像图层

Runway 推出可编辑图像图层

Runway Layers 可一键拆分图像,支持移除背景、编辑文字与独立修改元素。公告没有量化复杂图像的拆分准确率。

07

Pika 将 Grok Bots 接入多模态生成 API

Pika 将 Grok Bots 接入多模态生成 API

Pika 9 月 24 日称 Grok Bots 可通过其 API 调用超过 120 个图像、视频与音频模型;公告未提供逐模型定价或性能比较。

08

Claude 恢复对部分被拦截请求收费

Claude 恢复对部分被拦截请求收费

Claude 将恢复对部分响应前被拦截的请求收费,涉及生物、蒸馏攻击与前沿模型开发等类别。采集文本未说明完整计费公式。

09

Runway 新增 Seedance 2.5 草稿模式

Runway 新增 Seedance 2.5 草稿模式

Runway 草稿模式支持更快、消耗更少积分的 Seedance 2.5 探索生成,再将选中的结果提升至完整质量。具体节省幅度未公布。

GitHub

2 stories
01

Hindsight 聚焦可学习的智能体记忆

Hindsight 聚焦可学习的智能体记忆

Hindsight 是描述为“可学习智能体记忆”的 Python 项目,采集时记录 29,789 星,最近提交在报告日。快照不足以证明新版本发布或实际效果。

02

Superpowers 提供智能体技能开发方法

Superpowers 提供智能体技能开发方法

Superpowers 是智能体技能框架与软件开发方法项目,采集记录 291,662 星及报告日提交。此条用于项目发现,不代表独立验证的生产率提升。

HF HuggingFace

12 stories
01

研究发现 Transformer 的线性叠加现象

研究发现 Transformer 的线性叠加现象

论文研究混合文本流的线性叠加,发现预训练会削弱该现象,轻量微调可恢复;引导解码可从单次前向计算分离两条续写。

03

Rufus-Air 公开八阶段后训练方案

Rufus-Air 公开八阶段后训练方案

Rufus-Air 面向 GLM-4.5-Air-Base 公开八阶段后训练流程,披露数据、奖励、基础设施与阶段结果,强调奖励可靠性和难度筛选。

04

IterSynth 将搜索规划与证据综合分离

IterSynth 将搜索规划与证据综合分离

IterSynth 通过规划器与综合器分工,用滚动摘要保存搜索状态,并用角色专属强化学习信号训练。作者报告 8B 模型在五项基准上平均得分 50.7。

05

编程智能体合成可复用机器人规划程序

编程智能体合成可复用机器人规划程序

研究让编程智能体利用模拟器合成规划程序,再冻结程序测试未见实例。评测覆盖 28 个模拟环境与 98,000 次运行,结果显示其可作为通用任务与运动规划的强基线。

06

Qwen-Planner-Agent 打通移动智能体开发闭环

Qwen-Planner-Agent 打通移动智能体开发闭环

Qwen-Planner-Agent 联通数据、训练和部署,结合人工把关的数据循环与在线强化学习;CARE 旨在降低推理和工具成本。作者报告 MobilePA-Bench 评测中的领先结果。

07

Jev 用校准决策检测对齐失败

Jev 用校准决策检测对齐失败

研究在 44 项基准和五个目标模型上评估 Jev 对十类对齐失败的检测。作者报告零样本 AUROC 中位数为 0.886,输入上下文比问题措辞更重要。

08

AV-GRPO 解耦音视频生成的强化学习

AV-GRPO 解耦音视频生成的强化学习

AV-GRPO 通过模态锚定、冻结分支优化与自适应目标改善音视频奖励归因,并提出 5DAV 数据集。作者报告质量、语义对齐与同步性改进。

10

WanPE 将视频提示词转为电影化分镜计划

WanPE 将视频提示词转为电影化分镜计划

WanPE 是以 105 万段视频训练的 397B 提示词增强模型,结合反向构造与强化学习保持跨镜头语义一致性,作者报告在 Wan3.0 上的人类偏好提升。

11

ViRDM 简化少步因果视频后训练

ViRDM 简化少步因果视频后训练

ViRDM 使用预计算表示分布进行仅生成器后训练,省去教师与判别式评估网络。作者报告 20 次更新、16 A100 GPU 小时后取得 VBench 84.87 分。

12

Agent-Editing World Model 修正受污染的任务状态

Agent-Editing World Model 修正受污染的任务状态

该方法通过动作判断与状态修订清除历史中的无依据假设和过时计划。作者报告 EditAct 在六项基准、三个骨干模型上较最强基线平均提升 3.2 至 6.7 分。