AI 资讯日报 · Daily Digest

08.29

2026-08-29 · 星期六 · 06:18 截稿 · 覆盖近 1-3 天动态

NO.034
32 条 · 6 个分类
AI 检索生成

这一天的数字把瓶颈从“模型会不会想”挪到了“流程能不能反复卖出去”。Sabrina 用一条 Reel 叠评论关键词触发私信,做出 12 万美元 ARR;Owner 把本地商家的建站、点餐、客服和电话订餐交给 agent,ARR 过亿后再拿 2.4 亿美元,Runable 则在开通付费三周内报到 200 万美元年化。另一头,agent 的操作面在往浏览器和技能库收——Claude in Chrome 对所有付费套餐放开跨标签操作,GitHub 上本地检索技能、可校验架构图、少写代码约束和科研工作流一起涨星,论文则在说有效经验比堆数据重要,可演化的技能能让小模型超过没配技能的更大模型。开源权重同步把本地和长窗口往前推:GLM-5.3 放出可二次定制的权重,腾讯 Hy4 preview 给出约 770B、百万上下文的预览,自托管 Harness、RAG 和工作台也在同一周补版本。

01

商业变现


5

Sabrina 称一条 Instagram Reel 叠加 DM 自动化带来 12 万美元 ARR

Sabrina Ramonov 8 月 26 日写道,一条介绍用 Claude、ChatGPT 与 Blotato 做 Facebook/Instagram 评论关键词触发私信的 Reel,为自己的业务带来 12 万美元 ARR。模式是把流量导向指南、工具或 newsletter,适合内容型开发者复刻低代码获客漏斗。

sabrina.dev

Owner 完成 2.4 亿美元融资,估值 23 亿美元且 ARR 超过 1 亿美元

8 月 28 日 Owner 宣布由 Goldman Sachs Alternatives 领投 2.4 亿美元,估值 23 亿美元,并称 ARR 已超过 1 亿美元。公司把网站、点餐、CRM、客服和电话订餐交给 AI agent,路径是垂直行业先做透再做成本地生意操作系统。

prnewswire.com

Runable 获 2100 万美元 A 轮,称上线付款三周内做到 200 万美元年化收入

TechCrunch 8 月 26 日报道,班加罗尔 AI agent 公司 Runable 完成 2100 万美元 A 轮,投后估值 6500 万美元。CEO 称 3 月开通付费后三周内达到 200 万美元年化收入,现有约 150 万注册用户,产品从建站扩到获客、投放与运营。

techcrunch.com

独立开发者 Ferryman 公开跨过 2400 美元 MRR,社交一键分发带 AI 改写

前 Google 工程师 Kevin Naughton Jr. 8 月 28 日发图称 ferryman.io 已到 2400 美元 MRR。产品把一条内容分发到多平台,并可用自定义 prompt 按渠道改写,属于单人可维护的创作者工具变现样本。

x.com

animos.app 创始人称上线约一个月 MRR 到 2000 美元

Herdetya Priambodo 8 月 28 日发帖称 animos.app 在约一个月内做到 2000 美元 MRR。产品是浏览器端设计作品动态展示模板,免费可用、付费导出更高规格,适合观察模板工具如何靠创作者场景快速收订阅。

x.com
02

产品发布


1
03

X 热议


7

智谱Z.ai开源GLM-5.3权重,面向智能体编程与网络防御

Z.ai宣布GLM-5.3开源权重,可在Hugging Face下载、本地运行并二次定制,官方强调其在agentic coding与网络防御场景的能力。社区同步放出Flash版本的本地推理与成本对比,讨论其在128GB机器上的可用性。

x.com

腾讯发布Hy4 preview:770B MoE、100万上下文

腾讯混元放出Hy4 preview,参数规模约770B、激活约49B、支持1M上下文,并同步给出博客、Hugging Face与GitHub入口。帖子称面向办公、编程与科研生产力,欢迎社区反馈失效场景。

x.com

Qwen3.8-Flash登陆OpenCode Go:125B/6B与多模态

阿里Qwen官方转发OpenCode消息,确认Qwen3.8-Flash已可在OpenCode Go中使用,规格为125B总参、6B激活、1M上下文并支持多模态。开发者讨论其作为Qwen4架构预告以及本地与API成本。

x.com

吴恩达发布智能体编程下的软件工程基础技能图

吴恩达发文讨论agentic coding如何改写软件工程基本功,并放出一份面向AI工程的技能地图长文。帖子在开发者圈被大量转发收藏,焦点是工程基本功应如何随智能体工作流调整。

x.com

Anthropic研究:Claude能否自主改进其他模型对齐

Anthropic发布Fellows研究,给Claude约48小时和一块GPU,让其自行检索、提出方法并训练测试小模型的对齐表现。官方称在多项可测对齐失败上安全分有提升且能力未明显下滑,同时提醒罕见失败仍依赖正确度量。

x.com

OpenAI开发者账号推出Appshots:把当前屏幕交给ChatGPT与Codex

OpenAI Developers演示Appshots,可用快捷键把当前应用画面交给ChatGPT Work和Codex,用于总结Slack、填表、对照API文档改代码等。这把桌面上下文直接接入编码与办公智能体,引发对隐私与工作流集成的讨论。

x.com

Hugging Face Microduck走红:约400美元可训练开源机器人

Hugging Face联合创始人展示社区给Microduck训练空翻等动作的视频,该约25厘米双足开源机器人可自行用强化学习训练行走、滑旱冰与用喙抓取。X上围绕可购买性、仿真器与具身智能入门门槛讨论升温。

x.com
04

GitHub 项目


8

skill-retrieval-mcp:本地语义检索 374 个 Agent Skills 的 MCP Server

PyPI 于 2026-08-27 发布 0.3.1,用 FAISS 在本地对已核验许可的技能语料做检索,再通过 MCP 把 search_skills / get_skill 交给 Claude Code、Cursor、Codex 等客户端。检索只返回摘要,完整 SKILL.md 按需拉取,避免把整库描述塞进上下文。

github.com110

Archify:给编码 Agent 用的可校验架构图 Skill

面向 Cursor、Claude Code、Codex 等 Agent 的架构图 Skill,由类型化 JSON 中间表示确定性编译为可交互 HTML/SVG,覆盖架构、工作流、时序、数据流与生命周期。近 48 小时登上 GitHub Trending,单日星数增幅达数千。

github.com27,120

Scientific Agent Skills:把通用 Agent 接到科研工作流

面向科学计算的 Agent Skills 合集,包含百余个可安装技能与公开数据库查询能力,覆盖生物、化学、医学与药物发现流程。兼容 Cursor、Claude Code、Codex 及开放 Agent Skills 标准,近日持续出现在 GitHub 日榜。

github.com36,493

Chrome DevTools MCP:给编码 Agent 接浏览器调试能力

把 Chrome DevTools 能力以 MCP 形式暴露给编码 Agent,便于在终端或 IDE Agent 中检查页面、调试前端问题。属于 Agent 工具链基建,近期持续出现在趋势列表。

github.com49,952

GitNexus:浏览器内代码知识图谱与 Graph RAG Agent

纯前端运行的代码智能引擎,把 GitHub/GitLab/本地仓库或 ZIP 转成可交互知识图谱,并内置 Graph RAG Agent。适合在不上服务器的前提下做代码探索与问答。

github.com46,141

cool-claude-code:按周更新的 Claude Code Skills / MCP / Agent 工具目录

README 写明更新于 2026-08-27 17:47 UTC,按 Claude Code skills、MCP tooling、Agent harness 分类列出近期涨星项目。可用来快速扫一周内被讨论的技能包和 MCP 方案,而不是直接当可运行模板。

github.com9

ponytail:让 Agent 按“少写代码”的方式做工程决策

一组给编码 Agent 用的约束与技能,强调先判断要不要写代码、如何复用现有实现,而不是默认生成新模块。仓库体量已经很大,近 48 小时仍维持千级日增星。

github.com115,284

go-modern-guidelines:给 AI 编码 Agent 的现代 Go 规范

JetBrains 开源的现代 Go 写作指南,目标是让编码 Agent 按当前惯用写法生成代码,而不是停留在过时模板。适合在 Agent 项目里作为可安装规范/Skill 使用。

github.com2,567
05

开源产品


5

DeepSeek Harness 发布 v0.1.2-alpha.1,可自部署 Agent 运行时

DeepSeek 于 8 月 27 日发布 Harness 预览版 v0.1.2-alpha.1,统一 dsh 启动器并加入 Python SDK,可用 JSON-RPC 驱动本地 Agent。该 MIT 开源产品支持 Web、无头与插件化运行,适合自建编码与工具调用工作流。

github.com201,986

RAGFlow 发布 v0.27.1,可自托管 RAG 与 Agent 平台

InfiniFlow 于 8 月 28 日发布 RAGFlow v0.27.1,新增 Azure DevOps 数据源以及 You.com、Serply 搜索提供方,并补齐 DeepSeek 与 Bedrock 鉴权。该开源平台可用 Docker 自部署,覆盖知识库检索、对话与 Agent。

github.com89,529

LobeHub 发布 v2.2.15,可自托管多 Agent 工作台

LobeHub 于 8 月 28 日发布 v2.2.15,强化异构 Agent 接入、免重启桌面更新以及长任务审批干预。该开源产品可 Docker 或桌面端自部署,用于调度 Claude Code、Codex、Kimi Code 等多路 Agent。

github.com82,073

SandboxAQ 开源 Switch,把 Agent 接入 Slack/Teams

SandboxAQ 开源可自托管的 Switch,并在 8 月 27 日发布 Console 0.31.2,支持把自有 Agent 接入 Slack、Teams、Discord 等协作频道。该产品提供桌面控制台与自建服务端,面向人机同频道协作。

github.com405

AutoGPT Platform 发布 beta v0.7.3,可视化 Agent 平台

AutoGPT 于 8 月 28 日发布 platform-beta-v0.7.3,更新 Copilot 提问选项、压缩进度展示以及 Briefing/Alert 通知体系。该开源平台可用源码自建 Agent 工作流,许可对对外托管有限制。

github.com186,963
06

报告观点


6

Thomson:面向 SovereignAI 的前沿模型持续学习

论文主张在开源权重模型上做中后训练与持续学习,即可用相对有限算力接近前沿表现,并给出 Thomson 模型在智能体、安全、法律税务与 Deep Research 等任务上的评测。结果显示能力呈 π 型提升,同时大幅减轻窄域适配常见的遗忘。

arxiv.org

什么样的智能体数据才有效:用 ACE 框架审视 LLM Agent 数据生成

作者将智能体数据统一表示为环境、任务、交互轨迹与验证器四元组,并用 Accuracy-Complexity-divErsity(ACE)视角分析现有生成范式。核心结论是关键不在于堆数据量,而在于持续分配真实、对当前学习者有信息量且低冗余的经验。

arxiv.org

WikiSkill:把智能体经验沉淀为可演化技能知识库

WikiSkill 将执行轨迹、持久 wiki 与可执行 skill 分层,用经验持续更新知识库再驱动技能迭代。跨模型和基准上,技能演化与模型规模互补,小模型配演化技能可超过未配技能的更大模型,且技能可跨模型族迁移。

arxiv.org

工具输出变成指令:把动作诱导与运行时授权拆开

论文指出工具返回值一旦开始指定具体动作,就会绕过用户意图产生副作用,根源是把“想到做什么”和“允许执行”混在一起。提出的 SARA 用隔离探测记录动作来源,并按用户目标与审计证据授权调用,在 AgentDojo 与 AgentDyn 上把攻击成功率压到约 0.63% 以内。

arxiv.org

HarnessLens:按行为做验证,更省预算地演化 Agent Harness

现有提出-验证式 harness 搜索常在固定任务集上全量打分,浪费 rollout 还容易掩盖局部回退。HarnessLens 从轨迹推导改动,只在相关行为任务上做可归因验证,在三种 harness 与四个基准上平均提升 7.6%–13.6%,同时明显节省评测预算。

arxiv.org

CorporateBench:接近真实企业规模的时序知识库问答评测

CorporateBench 用时序一致的合成企业世界构造超过 23 万份文档的问答基准,覆盖信息抽取与知识库查询两类任务。对五款 LLM 的评测显示,输入规模接近真实企业语料时,模型表现会明显下滑。

arxiv.org

内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。

AI 资讯日报 2026-08-29 | 资讯狗 | Zixungou