AI 资讯日报 · Daily Digest

09.11

2026-09-11 · 星期五 · 06:20 截稿 · 覆盖近 1-3 天动态

NO.047
27 条 · 6 个分类
AI 检索生成

内容公司和机器人公司开始用可核对的经常性收入说话:Pocket FM称做到5亿美元ARR且保持EBITDA盈利,内容年产量在全面切到AI后从约2.5万小时扩到250万小时;Skild AI则在工厂、工地、厨房和数据中心启动部署后10个月内报到1亿美元。同一批数字里,显化应用Stella上线约两个月MRR约34万美元,西语健身应用Symmetry一年做到月入约16万美元,增长路径更像把已有账号、评论区和创作者分成先跑通,而不是先把产品做完再找流量。模型侧DeepSeek上线原生多模态的V4.1 Flash并下调API价,OpenAI把托管Agent循环和沙箱放进公开测试,却因Astra算力吃紧暂停200美元Pro新订;长上下文首token延迟仍接近二次增长,选型得把排队和账单一起算。Anthropic威胁报告把阿里、月之暗面、DeepSeek、智谱等写入所谓非法蒸馏名单,开源热榜则同时涌出团队级Skill/MCP仓库同步、安全审计Skill市场和本地优先的编程Agent桌面端。

01

商业变现


4
02

产品发布


3
03

X 热议


5

Anthropic 威胁报告点名中国实验室蒸馏 Claude

Anthropic 发布 9 月威胁情报报告,称过去八个月已阻断针对 Claude 的网络攻击、监控、武器辅助及生物误用等活动。报告将阿里巴巴、Moonshot、DeepSeek、智谱等列入所谓非法蒸馏案例,并称已向执法机构和其他实验室共享线索。

anthropic.com

OpenAI Agents API 进入公开测试,托管 Agent 循环与沙箱

OpenAI 推出 Agents API 公开测试,用 Codex harness 托管编排、长会话和上下文,开发者可自带或选用托管沙箱跑代码与文件。文档同时给出 e2b、Modal、Vercel 等集成路径,面向可落地的云端 Agent 工作流。

x.com

Epoch:GPT-6 Astra 长上下文延迟仍呈二次增长

Epoch AI 补充测量称,GPT-6 Astra 在长上下文上的首 token 延迟曲线与 GPT-5.6 类似,并对应超过约 272k 输入后涨价的计费结构。对比之下,Claude 5 系列延迟更接近线性,长文档场景选型时需要把延迟和价格一起看。

x.com

OpenAI 暂停 200 美元 Pro 新订,称 Astra 算力吃紧

OpenAI 员工 Tibo 宣布暂停 $200 Pro 计划的新订阅,理由是 Astra 需求过大、该档对系统压力最高。现有账户、其他套餐和 API 不受影响,公司称正在扩容。

x.com

黄仁勋回应研究员离职警告:称其安全判断不成立

围绕前 Anthropic 研究员 Jacob Coxon 辞职帖,黄仁勋称其关于灭绝风险的表述“deeply untrue”,并指其忽视业界已有安全工作。该表态在 X 上被大量转发,安全派与加速派继续就实验室节奏和监管展开争论。

x.com
04

GitHub 项目


4
05

开源产品


7

Dify 发布 v1.17.1,自托管知识库 API 密钥可按数据集隔离

开源 LLM 应用平台 Dify 于 9 月 10 日发布 1.17.1,新增按知识库作用域的 Service API Key,并修复文档抽取导致内容被改写的问题。使用捆绑 Weaviate 的自托管实例需按指南分阶段升级,否则向量检索可能损坏。

github.com155,354

RAGFlow 发布 v0.27.2,重构 Agentic RAG 检索框架

开源 RAG 引擎 RAGFlow 于 9 月 10 日发布 v0.27.2,重构 Agentic RAG 检索链路并补充 Sitemap、WebDAV、自托管 PaddleOCR-VL 等数据源。版本同时新增知识编译限流、图谱节点计数以及 Hubris、llmman 模型供应商。

github.com90,462

Qwen Code 连续发布 v0.23.2/v0.23.3,补齐远程启动与联网搜索

阿里开源编程智能体 Qwen Code 在 9 月 9–10 日连发 0.23.2 与 0.23.3,加入一键远程启动、分屏会话导航,并默认开启 ModelStudio 的 web_search。版本同时改进 Agent 失败落账、钉钉工具授权卡片以及 GPT-5/GPT-6 推理力度配置。

github.com27,755

ComfyUI 发布 v0.35.0,新增 WAN3-Prime 与 3D 网格节点

开源扩散工作流平台 ComfyUI 于 9 月 9 日发布 v0.35.0,接入 WAN3-Prime、Recraft V4 Styles、Google Omni 1.1,并新增 GLB/GLTF/OBJ/STL 转网格节点。版本同时支持 AVIF 保存、修正容器 cgroup 显存上限识别,并下线即将退役的 Veo 2/3.0 合作节点。

github.com132,391

OpenClaw 发布 2026.6.35 LTS,回移植通道安全与投递可靠性修复

可自托管个人 AI 助理 OpenClaw 于 9 月 10 日发布 2026.6.35,作为 6 月扩展稳定线的收官版本。该版本收紧供应商与频道边界、限制不可信响应体大小,并增强长任务取消、重试与部分发送的恢复能力。

github.com389,386

Chatbox 发布 v1.23.2,远程 MCP 支持 OAuth 授权

跨平台开源 AI 客户端 Chatbox 于 9 月 10 日发布 v1.23.2,为远程 MCP 服务增加 OAuth 授权、工具列表刷新,并支持自定义对话压缩提示词。版本同时补充 GPT-6 推理力度控制,以及 Kimi、OpenCode 等模型目录兼容。

github.com41,713

Cline Desktop 发布 v0.0.25,修正 Codex 模型清单与 Windows 升级锁文件

开源编程助手 Cline 桌面版于 9 月 10 日发布 v0.0.25,ChatGPT 订阅通道仅展示套餐可用的 Codex 模型,并修正 Windows 安装时 sidecar 占用导致的升级失败。版本还允许 Claude Code、Codex CLI 等本地 CLI 认证在无 API Key 时启动会话。

github.com67,799
06

报告观点


4

JarvisGUI:跨设备GUI智能体动态任务组合评测基准

北航与百度团队提出JarvisGUI,把GUI任务建模为轻量类型系统下的输入输出变换,自动组合覆盖Android、Windows与Ubuntu的跨设备工作流。评测显示开源GUI智能体在状态迁移、跨平台上下文推理和长程依赖上仍明显落后于单设备表现。

arxiv.org

A-MLE:用智能体系统加速工业广告排序中的机器学习迭代

该论文把广告排序模型的假设提出、实验执行与结果分析拆成五阶段,由单一LLM智能体调用领域技能并在沙箱中跑通实验,关键节点保留人工确认。作者在大规模排序模型上部署该系统,并比较Claude、Gemini与GPT家族在执行稳定性与探索激进程度上的差异。

arxiv.org

TRACE:用仿真合成奖励训练因果探查推理智能体

TRACE通过向仿真器注入干预并生成可核验奖励,把难以直接标注的诊断推理任务纳入强化学习。在含12类根因的数字广告诊断环境中,经合成奖励训练的Qwen3.5-35B-A3B在归因指标上超过部分提示式前沿模型,同时调用更少工具。

arxiv.org

ConvMem:用卷积式记忆做训练无关的长上下文推理

ConvMem把长文本推理改写成层次卷积,将LLM当作卷积核去汇总文本片段,并通过步长、跳跃连接与多核卷积降低误差累积。该方法无需训练即可并行处理长上下文,并在RULER相关多跳问答设置中超过对比基线。

arxiv.org

内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。

AI 资讯日报 2026-09-11 | 资讯狗 | Zixungou