08.27
2026-08-27 · 星期四 · 06:18 截稿 · 覆盖近 1-3 天动态
今天几条收入数字把市场分层摊开了。MiniMax在中期会上称8月ARR已超过8亿美元、To B约占八成;同一天也能看到BiliNote Pro三个月实收约2.4万元,以及一个AI写签文的小程序15天广告入账10.53元。夹在中间的是「品牌在ChatGPT等回答里露不露脸」这条新生意,有团队报出6.6万美元月经常性收入,也有人上线约三个月做到1.1万美元。模型侧智谱上线更便宜的原生多模态GLM-5.3-Flash,阿里开源Qwen3.8-Flash并预告下一档架构;落地侧字节把办公Agent收成「豆包工作」并打通飞书,ChatGPT Work则开始代用户登录第三方网站办事,Google Cloud也给企业Agent加了弹性计费和支出封顶。
商业变现
5 条
开源项目BiliNote上线付费版Bilinote Pro并披露三个月收入
开发者jefferyH在V2EX披露,Bilinote Pro自5月12日上线至8月26日累计注册5402人、付费602人、实收24264.30元,有效订阅282人。开源版继续维护,付费版走月费19.9元、年费199元的订阅,覆盖转写与模型调用成本。
AI Peekaboo创始人公开产品MRR达到66815美元
独立开发者John于8月26日在X发帖称,AI搜索可见度产品AI Peekaboo当前MRR为66815美元,并配有收入截图。产品面向品牌监测其在ChatGPT等模型中的露出,团队称仍在早期迭代。
MiniMax披露8月ARR超过8亿美元且To B占比升至约八成
证券时报8月26日报道,MiniMax中期业绩会上称8月ARR已超过8亿美元,To B业务在ARR中约占80%。上半年总收入1.17亿美元,B端收入同比增长703.1%至7390万美元,7月Token消耗量为1月的20倍。
开发者称AI可见度平台上线约三个月做到1.1万美元MRR
James Jara于8月26日在X表示,其团队打造的代运营式AI可见度平台筹备约一年、上线约三个月,当前MRR为1.1万美元。该模式与品牌监测自身在大模型回答中的露出有关,数字来自创始人自述帖。
一人用AI做「签小签」小程序上线15天广告收入10.53元
开发者在掘金公布微信小程序与公众号流量主明细:8月10日至23日合计收入10.53元,其中8月19日单日2.66元为高峰。项目用AI辅助库表、前端和签文草稿,从想法到上线约35天,属于可核对的小额广告变现样本。
产品发布
3 条
智谱上线并开源 GLM-5.3-Flash 原生多模态模型
智谱 8 月 26 日发布 GLM-5 系列原生多模态模型 GLM-5.3-Flash,总参 320B、激活 18B,采用稀疏与线性注意力混合架构,面向编码、Agent 与办公交付。官方文档显示 API 模型名为 glm-5.3-flash,定价约为 GLM-5.3 的十分之一,并已接入 ZCode 与 Coding Plan。
字节跳动上线办公 Agent「豆包工作」并打通飞书
8 月 25 日,字节将生产力 Agent 统一为独立产品「豆包工作」,支持本地/云电脑操作、文档表格 PPT 交付,并可用飞书账号继承企业上下文与权限。电脑版已开放下载,新用户可领取 30 天订阅权益,个人套餐约 68 至 500 元档。
Google Cloud 为 Agent 工作负载推出弹性计费与成本封顶
8 月 26 日,Google Cloud 在 Gemini Enterprise 增加按量与席位混用、月度支出封顶,以及承诺月消费可获约 10%–20% Token 折扣的 Flexible Savings Plans。Antigravity 与 Android Studio AI 用量将并入同一企业订阅与账单视图,减少配额中断。
X 热议
5 条
阿里Qwen开源Qwen3.8-Flash,预告Qwen4架构
Qwen官方发布多模态MoE模型Qwen3.8-Flash并开源Qwen3.8-Flash-Next权重,125B总参、每token激活6B,原生262K上下文、YaRN可扩至1M。训练成本约为Qwen3.7-Plus的九分之一,vLLM与SGLang已提供Day-0支持。
Google发布Gemini 3.5 Transcribe语音转写模型
Sundar Pichai宣布Gemini 3.5 Transcribe上线,支持85种以上语言自动检测、自定义词表与多说话人场景。开发者可在Google AI Studio与Gemini API使用流式/批量接口,面向语音Agent与实时字幕。
ChatGPT Work可代用户登录网站完成操作
Sam Altman转发官方说明:ChatGPT Work的电脑与浏览器可在Web/移动端登录第三方网站,且声称不读取账号密码。能力覆盖预约、报销、投保对比、发票入账等代理式任务,引发对Agent权限与安全边界的讨论。
Anthropic为SDK与ant CLI加入Admin API
ClaudeDevs宣布Admin API已接入官方SDK和ant命令行,可管理成员、工作区、API Key并读取组织速率限制。对需要批量治理Claude企业账号与生产配额的团队更直接可用。
Salesforce宣布Claudeforce,Claude接入CRM工作流
Marc Benioff称通过AIforce与Headless 360,Claude可在Salesforce内直接访问Data 360、Tableau、Slack并触发业务动作。卖点是把推理模型接到受治理的企业数据与确定性流程上,而非只做聊天摘要。
GitHub 项目
4 条
FreeLLMAPI:聚合免费 LLM 的 OpenAI 兼容网关
把多家免费 LLM 供应商与数百个端点聚合到一个 /v1 接口,支持智能路由、自动故障转移,并可对接 Claude Code、Codex、Cursor 等客户端。适合低成本试验与本地开发。
anbeime/skill:中文 Skills 商店持续收录可安装技能包
面向中文开发者的 Skills 合集仓库,收录文档处理、内容创作、编程与自动化工作流等可直接安装的 SKILL.md 包,并索引 GitHub 上的大量 Skills 项目。topics 页显示 8 月 26 日仍在更新,含 mcp-builder、agent-team 等条目。
sf-skills 1.42.0:Salesforce Agent Skills 可在 Claude Code 使用
Salesforce 官方 Agent Skills 库于 8 月 25 日发布 1.42.0,遵循 agentskills.io 规范,兼容 Claude Code、Codex、Cursor。覆盖 Apex、LWC、Flow、SOQL 等应用构建流程,适合接 Salesforce 栈的 agent 工作流。
SkillCorpus:把散落的 SKILL.md 做成可检索的 Agent 技能语料
开源基础设施把分散的 SKILL.md 整理成可检索语料,并带检索与评测工具,用于按任务向 agent 注入流程知识。GitHub topics 显示 8 月 26 日有更新,适合做 skill 路由和评测,而不是单一业务 skill。
开源产品
3 条
ComfyUI v0.34.0:3D 生成与 HDR 视频保存
节点式图像生成套件 ComfyUI 于 2026-08-26 发布 v0.34.0,接入 Pixal3D、TRELLIS2、SAM 3D Body,并支持 HDR/AV1/MKV/WebM 视频保存及 MiniMax-H3 引导节点。可本地部署完整文生图、视频与 3D 工作流。
llama.cpp v0.3.0:Web UI 与多模态模型接入
本地推理项目 llama.cpp 于 2026-08-25 发布大版本 v0.3.0,加入 dots3-note 多模态、DeepSeek 4 张量切分,以及带标签页导航的 Web UI。可用内置 server 在本机部署对话与多模态推理服务。
Cline CLI v3.0.60:长会话内存泄漏修复与模型目录更新
开源编程智能体 Cline 于 2026-08-26 发布 CLI v3.0.60,修复长任务中 hub 进程因广播完整对话而内存膨胀的问题,并刷新模型目录、默认模型调整为 GLM 5.3 等。可用 CLI 或桌面端在本地连接自有模型完成编码任务。
报告观点
5 条
从惯性到客观:用噪声隔离改进 Deep Research Agent
论文指出深度研究智能体会对自身先前查询与结论产生惯性偏差,并据此提出 IBIS 评测与 NIS-Agent,在网页筛选和最终答案校验处做上下文隔离。方法在 GAIA、WebWalkerQA、BrowseComp 与 BrowseComp-zh 上保持竞争力,同时相对基线降低约 33% token 消耗。
带可验证奖励的 On-policy Distillation(OPDVR)
清华等机构提出将 on-policy 蒸馏与 RLVR 结合的后训练方法,用轨迹正确性改写隐式奖励并用 ReLU 门控对齐任务成败,且不新增超参。它可接入 GRPO 等策略梯度算法,在六个推理基准上稳定优于标准 OPD。
TRACE:面向大推理模型全链路的证据型安全评测基准
该基准覆盖提示、推理轨迹与最终回复,标注九类风险与十种攻击策略,并为安全判断提供文本证据。对 18 个护栏模型的评估显示,推理轨迹上的安全判定明显难于提示或最终回复,且模型难以准确抽取支撑证据。
ReproAgent:契约引导的论文到代码复现智能体
系统把论文片段转为实现义务,并从相关仓库检索结构与实现证据,形成可跨生成与修复阶段复用的实现契约。在 PaperBench Code-Dev 上,同一骨干下相对其他脚手架取得更高均分,代码与实验产物已公开。
SPO++:面向异步智能体强化学习的流式策略优化
针对长程工具调用轨迹中组内同步代价高的问题,SPO++ 在单流策略优化上按动作 token 测度标准化终点优势,并按策略事件而非到达顺序组织证据。在 ALFWorld 两个模型规模以及 Math-TIR 上,在线学习效率相对 SPO 有提升。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。