AI 资讯日报 · Daily Digest

09.10

2026-09-10 · 星期四 · 06:19 截稿 · 覆盖近 1-3 天动态

NO.046
28 条 · 5 个分类
AI 检索生成

国内Token流水被摊开:字节年化约三百亿,阿里约一百六,智谱进百亿档,开发者接下来要面对的是API涨价和视频场景定价权,而不是再听一场发布会。Suno同期与华纳、BMG做成曲库分成,AI内容开始有能对账的授权路径。对照另一头,有人把赛前肌肉当广告位二十三小时实收近三万美元,也有人只向老客户预售SaaS当天做到五百欧元月经常性收入——注意力和既有信任本身就是库存,不必挤进上半年三千亿创企融资那条漏斗。Agent harness和Skills目录在回温,论文却写模型自报进度会在任务中段失真,安全框架里约三分之二的实质修订没被点名,圈内已在用model fatigue形容同一周连发。

01

商业变现


5

爱分析发布中国AI厂商Token收入榜:字节年化约300亿元

爱分析9月9日发布Token收入榜,字节年化ARR约300亿元,阿里约160亿元,智谱进入百亿档;第二档含DeepSeek、Kimi、MiniMax、可灵。对国内开发者判断模型厂商业化结构、API涨价与视频场景定价权有直接参考。

sohu.com

独立开发者Marc Lou拍卖身体广告位,23小时实收2.9万美元

Marc Lou在X公开HYROX赛前肌肉广告位竞拍:23小时带来150万浏览、3.5万独立访客,账面毛收入6.3万美元、退还被超价后实收约2.9万美元。该玩法把个人注意力直接做成可竞价库存,适合有粉丝基础的开发者拆解。

x.com

上半年中国AI创企融资额突破3000亿元,上亿元交易77起

智东西据公开信息统计,2026年上半年中国AI产业链上亿元融资77起、合计约1262亿元,IT桔子口径下创企总融资额突破3000亿元;DeepSeek上半年累计融资约500亿元居前。资金仍集中在视频生成、Agent与模型层。

36kr.com

Suno与华纳、BMG达成曲库分成合作,AI音乐进入授权变现

9月9日Suno宣布与Warner Music、BMG合作,艺人可选择把曲库开放给用户做生成实验并按分成获得收入,同时上线V6模型。这把AI音乐从灰色训练争议推进到可拆解的授权与版权分成模式。

tennessean.com

法国创作者向老客户预售SaaS,当天做到500欧元MRR

Kevin Dumont在X称产品尚未公开发布,只向部分老客户宣布并开始私域推销,当天傍晚MRR已到500欧元,并立下9月30日冲击1万欧元MRR的公开目标。路径是先卖给已有信任关系的人,而不是先做流量。

x.com
02

X 热议


5

Anthropic预训练研究员Jacob Coxon辞职并公开批评两家实验室

曾在OpenAI与Anthropic做预训练的Jacob Coxon发帖称已辞职,指责两家公司正冲向可自我改进的超级智能。该长帖在圈内引发对齐、竞赛与是否该暂停能力提升的争论。

x.com

Meta上线个人智能体Muse,可跨应用执行邮件购物差旅

Meta推出个人智能体Muse,由Muse Spark 1.3驱动,覆盖iOS、Android、Web与WhatsApp,可在后台处理邮件、购物和行程。讨论焦点集中在对邮箱、支付与云端数据的授权范围以及内测中的安全问题。

x.com

DeepMind发布AlphaGenome Atlas,覆盖约90亿种单碱基变异预测

Google DeepMind推出可检索的AlphaGenome Atlas,对人类基因组约90亿种单字母DNA变化给出分子效应预测,并提供AVI影响分数。资源可通过网站、API和后续云服务向科研使用开放。

x.com

民调显示Sanders暂停先进AI并禁止超级智能的法案获跨党派支持

Bernie Sanders转发Data for Progress民调称,其与众议员Casar提出的暂停AI开发、永久禁止制造超级智能的法案获得约68%选民支持。Kalshi等账号同步跟进立法进展,政策讨论升温。

x.com

圈内用MODEL FATIGUE形容同一周多家实验室连续发模型

TestingCatalog等账号盘点Anthropic、Meta、Google、OpenAI近期密集发版,以及研究员离职与未发布模型科研声称。开发者吐槽评估跟不上发布节奏,开始筛选而非全量对标新模型。

x.com
03

GitHub 项目


7

LongHorizon-Harness:高德 AMAP 的长程 Computer-Use 闭环

给 Claude Code、Codex、OpenCode、DeepSeek Harness 套一层规划-执行-审计-检查点循环,用于跨桌面与终端的长任务。近期被 agent 热度图列入观察名单,带中文文档。

github.com1,481

Ruflo:多后端 Agent 元 Harness 近两日回温

在 Claude Code、Codex、Hermes 等宿主上叠加多 Agent 集群、自适应记忆与 RAG。约7.2万星,9月8日至9日连续出现在 Trending,周增速再次走高。

github.com71,806

openai/skills:Codex 官方 Skills 目录热度回升

OpenAI 公开的 Codex Skill 目录,用文件夹封装指令、脚本与资源,便于按任务复用能力。9月8日至9日连续出现在 GitHub Trending。

github.com26,763

code-graph-mcp 0.76:给 Claude Code 的 AST 知识图谱 MCP

该 MCP 用 Tree-sitter 索引本地代码,提供语义搜索、调用图与影响分析,并带 Claude Code plugin、skills 与自动索引 hooks。变更日志在 2026-09-07/08 发布 0.76 系列,调整了调用图歧义边的默认披露。

github.com75

i-have-adhd:让编码 Agent 先给结论的输出技能

面向 Claude Code、Codex、Gemini 等编码 Agent 的技能包,约束回复先给可执行结论并减少铺垫。9月8日至9日登上 GitHub Trending,仓库约3.4万星。

github.com34,363

easy-skills:团队 Skills 安装与软链分发 CLI

npm 包 easy-skills 于 2026-09-08 发布,把技能统一装到 ~/.agents/skills/,再用 --claude 软链到 Claude Code,支持从 GitHub 仓库或注册表安装。面向团队维护一份技能库、多编辑器复用的场景。

github.com1

HyperFrames:给 Agent 用的 HTML 渲染视频框架

HeyGen 开源的确定性 HTML 到 MP4 渲染工具,提供 CLI 与 Agent Skill,便于生成演示视频和构图。9月9日仍在高频提交,近两日持续出现在 Trending。

github.com48,377
04

开源产品


6

vLLM v0.29.0 推理服务引擎发布

vLLM 于 2026-09-08/09 发布 v0.29.0,默认启用 Model Runner V2,并加入 Hy4-preview、Qwen3.8-Flash-Next 等模型支持。可作为独立推理服务在自有集群上部署,面向高吞吐 LLM serving。

github.com91,365

Goose v1.50.0 本地 AI Agent 发布

Block 开源的 Goose 于 2026-09-08 发布 v1.50.0,提供桌面端与 CLI,可在本机对接 GPT-6 Astra,并增强 goose-agent 工具调用与 AIML API。开发者可直接下载安装包或 CLI 在本地自部署运行。

github.com54,066

Cline Desktop v0.0.24 桌面编程 Agent 发布

Cline 于 2026-09-09 发布 Desktop v0.0.24,修复直播流重复渲染、排队消息丢失,并在模型循环卡住时给出继续或停止选项。该桌面应用可在本地文件夹中运行编程 Agent、调度任务并管理 MCP。

github.com67,742

Agent Teams AI v2.14.1 多 Agent 协作产品发布

Agent Teams AI 于 2026-09-08 发布 v2.14.1,修复 Cursor、GLM(Z.AI)与 SuperGrok 现有集成的启动与恢复,并支持单独重试失败的 OpenCode 队友。提供 deb/rpm 等安装包,可在本机部署多 Agent 团队。

github.com2,094

LoopX v1.0.2 长程 Agent 控制面发布

LoopX 于 2026-09-09 发布 1.0.2,统一 Todo 生命周期权责、自动恢复缺失展示,并降低大工作区历史扫描开销。它是可本地安装的控制面,用来编排 Codex、Claude Code、Cursor 等 harness 的长任务。

github.com5,758

Agent Swarm v1.143.0 自托管 Agent 集群发布

desplega-ai/agent-swarm 于 2026-09-09 发布 v1.143.0,可用 npm/bun 或 Docker 拉起 Server 与 Worker。该版本含 UI 日志与上下文用量展示修复,以及 Claude Code 镜像例行更新。

github.com758
05

报告观点


5

ExecCritic:让编码智能体先学会写测试再据此改代码

论文将测试生成与源码修复拆成独立角色,并用角色专用强化学习分别训练基于 Qwen-3.5-35B-A3B 的 Test 与 Repair 智能体。在 SWE-bench Verified 上,两个经后训练的 Qwen 智能体组合达到 72.6% 解决率,较无测试基线高出 11.4 个百分点。

arxiv.org

AgentIdeaBench:面向智能体时代的科学构想评测基准

该论文提出 AgentIdeaBench,在静态观察与主动探索两种设定下评测 33 个 LLM 的科学构想能力,覆盖五个学科的 40 个子领域。主动探索能暴露更大能力空间,收益主要落在可行性、清晰度与具体性,评测到的原创性则基本不变。

arxiv.org

Procedural Graph:为 LLM 智能体构建可自演化的程序性执行结构

作者将程序性知识组织为(过程,关系,过程)三元组,在每一步用局部子图生成情境引导,而不直接指定动作。图结构可由失败与成功轨迹对比后自动改写,在多种任务与模型上相对基于记忆的基线带来稳定提升。

arxiv.org

不可靠的进度条:LLM 智能体能在任务全程如实汇报进度吗

作者在 τ²-bench 与自建 StageIF 上评估模型在任务各阶段报告进度的可靠性,发现几乎所有受测模型都在部分阶段可靠、在另一些阶段失真。多数模型在任务进行中准确率下降、结束后回升,因此框架不宜仅凭模型自报状态来控制任务流。

arxiv.org

Silent Revision:量化前沿 AI 开发者安全框架中的未披露修订

研究追踪 12 家已发布安全框架的开发者共 710 条承诺实例,约 67% 的实质性变更在开发者公开说明中未被点名。约 77% 的变更是弱化或删除承诺,作者主张公开义务应附带逐条枚举变更内容。

arxiv.org

内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。

AI 资讯日报 2026-09-10 | 资讯狗 | Zixungou