08.29
2026-08-29 · 星期六 · 06:18 截稿 · 覆盖近 1-3 天动态
这一天的数字把瓶颈从“模型会不会想”挪到了“流程能不能反复卖出去”。Sabrina 用一条 Reel 叠评论关键词触发私信,做出 12 万美元 ARR;Owner 把本地商家的建站、点餐、客服和电话订餐交给 agent,ARR 过亿后再拿 2.4 亿美元,Runable 则在开通付费三周内报到 200 万美元年化。另一头,agent 的操作面在往浏览器和技能库收——Claude in Chrome 对所有付费套餐放开跨标签操作,GitHub 上本地检索技能、可校验架构图、少写代码约束和科研工作流一起涨星,论文则在说有效经验比堆数据重要,可演化的技能能让小模型超过没配技能的更大模型。开源权重同步把本地和长窗口往前推:GLM-5.3 放出可二次定制的权重,腾讯 Hy4 preview 给出约 770B、百万上下文的预览,自托管 Harness、RAG 和工作台也在同一周补版本。
商业变现
5 条
Sabrina 称一条 Instagram Reel 叠加 DM 自动化带来 12 万美元 ARR
Sabrina Ramonov 8 月 26 日写道,一条介绍用 Claude、ChatGPT 与 Blotato 做 Facebook/Instagram 评论关键词触发私信的 Reel,为自己的业务带来 12 万美元 ARR。模式是把流量导向指南、工具或 newsletter,适合内容型开发者复刻低代码获客漏斗。
Owner 完成 2.4 亿美元融资,估值 23 亿美元且 ARR 超过 1 亿美元
8 月 28 日 Owner 宣布由 Goldman Sachs Alternatives 领投 2.4 亿美元,估值 23 亿美元,并称 ARR 已超过 1 亿美元。公司把网站、点餐、CRM、客服和电话订餐交给 AI agent,路径是垂直行业先做透再做成本地生意操作系统。
Runable 获 2100 万美元 A 轮,称上线付款三周内做到 200 万美元年化收入
TechCrunch 8 月 26 日报道,班加罗尔 AI agent 公司 Runable 完成 2100 万美元 A 轮,投后估值 6500 万美元。CEO 称 3 月开通付费后三周内达到 200 万美元年化收入,现有约 150 万注册用户,产品从建站扩到获客、投放与运营。
独立开发者 Ferryman 公开跨过 2400 美元 MRR,社交一键分发带 AI 改写
前 Google 工程师 Kevin Naughton Jr. 8 月 28 日发图称 ferryman.io 已到 2400 美元 MRR。产品把一条内容分发到多平台,并可用自定义 prompt 按渠道改写,属于单人可维护的创作者工具变现样本。
animos.app 创始人称上线约一个月 MRR 到 2000 美元
Herdetya Priambodo 8 月 28 日发帖称 animos.app 在约一个月内做到 2000 美元 MRR。产品是浏览器端设计作品动态展示模板,免费可用、付费导出更高规格,适合观察模板工具如何靠创作者场景快速收订阅。
产品发布
1 条
X 热议
7 条
智谱Z.ai开源GLM-5.3权重,面向智能体编程与网络防御
Z.ai宣布GLM-5.3开源权重,可在Hugging Face下载、本地运行并二次定制,官方强调其在agentic coding与网络防御场景的能力。社区同步放出Flash版本的本地推理与成本对比,讨论其在128GB机器上的可用性。
腾讯发布Hy4 preview:770B MoE、100万上下文
腾讯混元放出Hy4 preview,参数规模约770B、激活约49B、支持1M上下文,并同步给出博客、Hugging Face与GitHub入口。帖子称面向办公、编程与科研生产力,欢迎社区反馈失效场景。
Qwen3.8-Flash登陆OpenCode Go:125B/6B与多模态
阿里Qwen官方转发OpenCode消息,确认Qwen3.8-Flash已可在OpenCode Go中使用,规格为125B总参、6B激活、1M上下文并支持多模态。开发者讨论其作为Qwen4架构预告以及本地与API成本。
吴恩达发布智能体编程下的软件工程基础技能图
吴恩达发文讨论agentic coding如何改写软件工程基本功,并放出一份面向AI工程的技能地图长文。帖子在开发者圈被大量转发收藏,焦点是工程基本功应如何随智能体工作流调整。
Anthropic研究:Claude能否自主改进其他模型对齐
Anthropic发布Fellows研究,给Claude约48小时和一块GPU,让其自行检索、提出方法并训练测试小模型的对齐表现。官方称在多项可测对齐失败上安全分有提升且能力未明显下滑,同时提醒罕见失败仍依赖正确度量。
OpenAI开发者账号推出Appshots:把当前屏幕交给ChatGPT与Codex
OpenAI Developers演示Appshots,可用快捷键把当前应用画面交给ChatGPT Work和Codex,用于总结Slack、填表、对照API文档改代码等。这把桌面上下文直接接入编码与办公智能体,引发对隐私与工作流集成的讨论。
Hugging Face Microduck走红:约400美元可训练开源机器人
Hugging Face联合创始人展示社区给Microduck训练空翻等动作的视频,该约25厘米双足开源机器人可自行用强化学习训练行走、滑旱冰与用喙抓取。X上围绕可购买性、仿真器与具身智能入门门槛讨论升温。
GitHub 项目
8 条
skill-retrieval-mcp:本地语义检索 374 个 Agent Skills 的 MCP Server
PyPI 于 2026-08-27 发布 0.3.1,用 FAISS 在本地对已核验许可的技能语料做检索,再通过 MCP 把 search_skills / get_skill 交给 Claude Code、Cursor、Codex 等客户端。检索只返回摘要,完整 SKILL.md 按需拉取,避免把整库描述塞进上下文。
Archify:给编码 Agent 用的可校验架构图 Skill
面向 Cursor、Claude Code、Codex 等 Agent 的架构图 Skill,由类型化 JSON 中间表示确定性编译为可交互 HTML/SVG,覆盖架构、工作流、时序、数据流与生命周期。近 48 小时登上 GitHub Trending,单日星数增幅达数千。
Scientific Agent Skills:把通用 Agent 接到科研工作流
面向科学计算的 Agent Skills 合集,包含百余个可安装技能与公开数据库查询能力,覆盖生物、化学、医学与药物发现流程。兼容 Cursor、Claude Code、Codex 及开放 Agent Skills 标准,近日持续出现在 GitHub 日榜。
Chrome DevTools MCP:给编码 Agent 接浏览器调试能力
把 Chrome DevTools 能力以 MCP 形式暴露给编码 Agent,便于在终端或 IDE Agent 中检查页面、调试前端问题。属于 Agent 工具链基建,近期持续出现在趋势列表。
GitNexus:浏览器内代码知识图谱与 Graph RAG Agent
纯前端运行的代码智能引擎,把 GitHub/GitLab/本地仓库或 ZIP 转成可交互知识图谱,并内置 Graph RAG Agent。适合在不上服务器的前提下做代码探索与问答。
cool-claude-code:按周更新的 Claude Code Skills / MCP / Agent 工具目录
README 写明更新于 2026-08-27 17:47 UTC,按 Claude Code skills、MCP tooling、Agent harness 分类列出近期涨星项目。可用来快速扫一周内被讨论的技能包和 MCP 方案,而不是直接当可运行模板。
ponytail:让 Agent 按“少写代码”的方式做工程决策
一组给编码 Agent 用的约束与技能,强调先判断要不要写代码、如何复用现有实现,而不是默认生成新模块。仓库体量已经很大,近 48 小时仍维持千级日增星。
go-modern-guidelines:给 AI 编码 Agent 的现代 Go 规范
JetBrains 开源的现代 Go 写作指南,目标是让编码 Agent 按当前惯用写法生成代码,而不是停留在过时模板。适合在 Agent 项目里作为可安装规范/Skill 使用。
开源产品
5 条
DeepSeek Harness 发布 v0.1.2-alpha.1,可自部署 Agent 运行时
DeepSeek 于 8 月 27 日发布 Harness 预览版 v0.1.2-alpha.1,统一 dsh 启动器并加入 Python SDK,可用 JSON-RPC 驱动本地 Agent。该 MIT 开源产品支持 Web、无头与插件化运行,适合自建编码与工具调用工作流。
RAGFlow 发布 v0.27.1,可自托管 RAG 与 Agent 平台
InfiniFlow 于 8 月 28 日发布 RAGFlow v0.27.1,新增 Azure DevOps 数据源以及 You.com、Serply 搜索提供方,并补齐 DeepSeek 与 Bedrock 鉴权。该开源平台可用 Docker 自部署,覆盖知识库检索、对话与 Agent。
LobeHub 发布 v2.2.15,可自托管多 Agent 工作台
LobeHub 于 8 月 28 日发布 v2.2.15,强化异构 Agent 接入、免重启桌面更新以及长任务审批干预。该开源产品可 Docker 或桌面端自部署,用于调度 Claude Code、Codex、Kimi Code 等多路 Agent。
SandboxAQ 开源 Switch,把 Agent 接入 Slack/Teams
SandboxAQ 开源可自托管的 Switch,并在 8 月 27 日发布 Console 0.31.2,支持把自有 Agent 接入 Slack、Teams、Discord 等协作频道。该产品提供桌面控制台与自建服务端,面向人机同频道协作。
AutoGPT Platform 发布 beta v0.7.3,可视化 Agent 平台
AutoGPT 于 8 月 28 日发布 platform-beta-v0.7.3,更新 Copilot 提问选项、压缩进度展示以及 Briefing/Alert 通知体系。该开源平台可用源码自建 Agent 工作流,许可对对外托管有限制。
报告观点
6 条
Thomson:面向 SovereignAI 的前沿模型持续学习
论文主张在开源权重模型上做中后训练与持续学习,即可用相对有限算力接近前沿表现,并给出 Thomson 模型在智能体、安全、法律税务与 Deep Research 等任务上的评测。结果显示能力呈 π 型提升,同时大幅减轻窄域适配常见的遗忘。
什么样的智能体数据才有效:用 ACE 框架审视 LLM Agent 数据生成
作者将智能体数据统一表示为环境、任务、交互轨迹与验证器四元组,并用 Accuracy-Complexity-divErsity(ACE)视角分析现有生成范式。核心结论是关键不在于堆数据量,而在于持续分配真实、对当前学习者有信息量且低冗余的经验。
WikiSkill:把智能体经验沉淀为可演化技能知识库
WikiSkill 将执行轨迹、持久 wiki 与可执行 skill 分层,用经验持续更新知识库再驱动技能迭代。跨模型和基准上,技能演化与模型规模互补,小模型配演化技能可超过未配技能的更大模型,且技能可跨模型族迁移。
工具输出变成指令:把动作诱导与运行时授权拆开
论文指出工具返回值一旦开始指定具体动作,就会绕过用户意图产生副作用,根源是把“想到做什么”和“允许执行”混在一起。提出的 SARA 用隔离探测记录动作来源,并按用户目标与审计证据授权调用,在 AgentDojo 与 AgentDyn 上把攻击成功率压到约 0.63% 以内。
HarnessLens:按行为做验证,更省预算地演化 Agent Harness
现有提出-验证式 harness 搜索常在固定任务集上全量打分,浪费 rollout 还容易掩盖局部回退。HarnessLens 从轨迹推导改动,只在相关行为任务上做可归因验证,在三种 harness 与四个基准上平均提升 7.6%–13.6%,同时明显节省评测预算。
CorporateBench:接近真实企业规模的时序知识库问答评测
CorporateBench 用时序一致的合成企业世界构造超过 23 万份文档的问答基准,覆盖信息抽取与知识库查询两类任务。对五款 LLM 的评测显示,输入规模接近真实企业语料时,模型表现会明显下滑。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。