AI 资讯
每天一轮 AI 检索:GitHub 项目、开源产品、X 热议、报告观点——条条带源链接,死链不上桌。
NO.048
09.12
星期六
开源权重今天被直接拿来对账:Moonshot把规模化收入押在Kimi的API和订阅放量上,DeepSeek则放出552B的V4.1-Flash,用非对称激活去压KV cache和agent缓存成本。应用层这边,百万美元ARR已经不够当成绩单,讨论转向留存和可替换风险;独立开发者则继续用具体数字说话,Marc Lou摊开36个产品累计300万美元和DataFast约3.08万美元MRR,glasa用提前养好的名单换来首周1.3万美元。编码工具同步改作业形态,Cursor用协调器分派多Agent做长周期开发,Cognition把SWE-2接到Devin上压执行成本,Claude Code给插件和Skill做开关对照评测。
25 条
阿里Qwen开源Qwen3.8-Flash,预告Qwen4架构
Qwen官方发布多模态MoE模型Qwen3.8-Flash并开源Qwen3.8-Flash-Next权重,125B总参、每token激活6B,原生262K上下文、YaRN可扩至1M。训练成本约为Qwen3.7-Plus的九分之一,vLLM与SGLang已提供Day-0支持。
智谱上线并开源 GLM-5.3-Flash 原生多模态模型
智谱 8 月 26 日发布 GLM-5 系列原生多模态模型 GLM-5.3-Flash,总参 320B、激活 18B,采用稀疏与线性注意力混合架构,面向编码、Agent 与办公交付。官方文档显示 API 模型名为 glm-5.3-flash,定价约为 GLM-5.3 的十分之一,并已接入 ZCode 与 Coding Plan。
开源项目BiliNote上线付费版Bilinote Pro并披露三个月收入
开发者jefferyH在V2EX披露,Bilinote Pro自5月12日上线至8月26日累计注册5402人、付费602人、实收24264.30元,有效订阅282人。开源版继续维护,付费版走月费19.9元、年费199元的订阅,覆盖转写与模型调用成本。
FreeLLMAPI:聚合免费 LLM 的 OpenAI 兼容网关
把多家免费 LLM 供应商与数百个端点聚合到一个 /v1 接口,支持智能路由、自动故障转移,并可对接 Claude Code、Codex、Cursor 等客户端。适合低成本试验与本地开发。
字节跳动上线办公 Agent「豆包工作」并打通飞书
8 月 25 日,字节将生产力 Agent 统一为独立产品「豆包工作」,支持本地/云电脑操作、文档表格 PPT 交付,并可用飞书账号继承企业上下文与权限。电脑版已开放下载,新用户可领取 30 天订阅权益,个人套餐约 68 至 500 元档。
ComfyUI v0.34.0:3D 生成与 HDR 视频保存
节点式图像生成套件 ComfyUI 于 2026-08-26 发布 v0.34.0,接入 Pixal3D、TRELLIS2、SAM 3D Body,并支持 HDR/AV1/MKV/WebM 视频保存及 MiniMax-H3 引导节点。可本地部署完整文生图、视频与 3D 工作流。
AI Peekaboo创始人公开产品MRR达到66815美元
独立开发者John于8月26日在X发帖称,AI搜索可见度产品AI Peekaboo当前MRR为66815美元,并配有收入截图。产品面向品牌监测其在ChatGPT等模型中的露出,团队称仍在早期迭代。
从惯性到客观:用噪声隔离改进 Deep Research Agent
论文指出深度研究智能体会对自身先前查询与结论产生惯性偏差,并据此提出 IBIS 评测与 NIS-Agent,在网页筛选和最终答案校验处做上下文隔离。方法在 GAIA、WebWalkerQA、BrowseComp 与 BrowseComp-zh 上保持竞争力,同时相对基线降低约 33% token 消耗。
llama.cpp v0.3.0:Web UI 与多模态模型接入
本地推理项目 llama.cpp 于 2026-08-25 发布大版本 v0.3.0,加入 dots3-note 多模态、DeepSeek 4 张量切分,以及带标签页导航的 Web UI。可用内置 server 在本机部署对话与多模态推理服务。
Google发布Gemini 3.5 Transcribe语音转写模型
Sundar Pichai宣布Gemini 3.5 Transcribe上线,支持85种以上语言自动检测、自定义词表与多说话人场景。开发者可在Google AI Studio与Gemini API使用流式/批量接口,面向语音Agent与实时字幕。
带可验证奖励的 On-policy Distillation(OPDVR)
清华等机构提出将 on-policy 蒸馏与 RLVR 结合的后训练方法,用轨迹正确性改写隐式奖励并用 ReLU 门控对齐任务成败,且不新增超参。它可接入 GRPO 等策略梯度算法,在六个推理基准上稳定优于标准 OPD。
MiniMax披露8月ARR超过8亿美元且To B占比升至约八成
证券时报8月26日报道,MiniMax中期业绩会上称8月ARR已超过8亿美元,To B业务在ARR中约占80%。上半年总收入1.17亿美元,B端收入同比增长703.1%至7390万美元,7月Token消耗量为1月的20倍。
TRACE:面向大推理模型全链路的证据型安全评测基准
该基准覆盖提示、推理轨迹与最终回复,标注九类风险与十种攻击策略,并为安全判断提供文本证据。对 18 个护栏模型的评估显示,推理轨迹上的安全判定明显难于提示或最终回复,且模型难以准确抽取支撑证据。
anbeime/skill:中文 Skills 商店持续收录可安装技能包
面向中文开发者的 Skills 合集仓库,收录文档处理、内容创作、编程与自动化工作流等可直接安装的 SKILL.md 包,并索引 GitHub 上的大量 Skills 项目。topics 页显示 8 月 26 日仍在更新,含 mcp-builder、agent-team 等条目。
ChatGPT Work可代用户登录网站完成操作
Sam Altman转发官方说明:ChatGPT Work的电脑与浏览器可在Web/移动端登录第三方网站,且声称不读取账号密码。能力覆盖预约、报销、投保对比、发票入账等代理式任务,引发对Agent权限与安全边界的讨论。
ReproAgent:契约引导的论文到代码复现智能体
系统把论文片段转为实现义务,并从相关仓库检索结构与实现证据,形成可跨生成与修复阶段复用的实现契约。在 PaperBench Code-Dev 上,同一骨干下相对其他脚手架取得更高均分,代码与实验产物已公开。
Cline CLI v3.0.60:长会话内存泄漏修复与模型目录更新
开源编程智能体 Cline 于 2026-08-26 发布 CLI v3.0.60,修复长任务中 hub 进程因广播完整对话而内存膨胀的问题,并刷新模型目录、默认模型调整为 GLM 5.3 等。可用 CLI 或桌面端在本地连接自有模型完成编码任务。
SPO++:面向异步智能体强化学习的流式策略优化
针对长程工具调用轨迹中组内同步代价高的问题,SPO++ 在单流策略优化上按动作 token 测度标准化终点优势,并按策略事件而非到达顺序组织证据。在 ALFWorld 两个模型规模以及 Math-TIR 上,在线学习效率相对 SPO 有提升。
Anthropic为SDK与ant CLI加入Admin API
ClaudeDevs宣布Admin API已接入官方SDK和ant命令行,可管理成员、工作区、API Key并读取组织速率限制。对需要批量治理Claude企业账号与生产配额的团队更直接可用。
sf-skills 1.42.0:Salesforce Agent Skills 可在 Claude Code 使用
Salesforce 官方 Agent Skills 库于 8 月 25 日发布 1.42.0,遵循 agentskills.io 规范,兼容 Claude Code、Codex、Cursor。覆盖 Apex、LWC、Flow、SOQL 等应用构建流程,适合接 Salesforce 栈的 agent 工作流。
Google Cloud 为 Agent 工作负载推出弹性计费与成本封顶
8 月 26 日,Google Cloud 在 Gemini Enterprise 增加按量与席位混用、月度支出封顶,以及承诺月消费可获约 10%–20% Token 折扣的 Flexible Savings Plans。Antigravity 与 Android Studio AI 用量将并入同一企业订阅与账单视图,减少配额中断。
SkillCorpus:把散落的 SKILL.md 做成可检索的 Agent 技能语料
开源基础设施把分散的 SKILL.md 整理成可检索语料,并带检索与评测工具,用于按任务向 agent 注入流程知识。GitHub topics 显示 8 月 26 日有更新,适合做 skill 路由和评测,而不是单一业务 skill。
Salesforce宣布Claudeforce,Claude接入CRM工作流
Marc Benioff称通过AIforce与Headless 360,Claude可在Salesforce内直接访问Data 360、Tableau、Slack并触发业务动作。卖点是把推理模型接到受治理的企业数据与确定性流程上,而非只做聊天摘要。
开发者称AI可见度平台上线约三个月做到1.1万美元MRR
James Jara于8月26日在X表示,其团队打造的代运营式AI可见度平台筹备约一年、上线约三个月,当前MRR为1.1万美元。该模式与品牌监测自身在大模型回答中的露出有关,数字来自创始人自述帖。
一人用AI做「签小签」小程序上线15天广告收入10.53元
开发者在掘金公布微信小程序与公众号流量主明细:8月10日至23日合计收入10.53元,其中8月19日单日2.66元为高峰。项目用AI辅助库表、前端和签文草稿,从想法到上线约35天,属于可核对的小额广告变现样本。
35 条
OpenAI公布自研推理芯片Jalapeño实测数据
OpenAI在Hot Chips放出Jalapeño系统结果:在GPT-OSS 120B、DeepSeek R1、Kimi K2.5 1T上,峰值每瓦吞吐约为对照系统的1.5–1.9倍,端到端延迟约为其1.7–3.6分之一。公司称年底小规模上线、2027年放量,并同步推进Gen 2与Gen 3。
Dify 发布 1.17.0:Agent 沙箱、Skill 与工作流增强
可自托管的 LLM 应用平台 Dify 于 2026-08-25 发布 1.17.0,Agent 可选用 E2B 沙箱,并加入 Home Snapshots 与工作区级 Skill 管理。同期补充上下文压缩、工作流可复用环境变量、循环内人工输入,以及 Turnstile 与 Azure Key Vault 等部署能力。
Prime Agent:面向长程评测与编程Agent的自改进RLM Harness
Prime Intellect与Princeton等团队在8月24日提交技术报告,开源一套基于持久IPython REPL与Continual Harness的长程Agent运行时。该框架将ARC-AGI-3 RHAE Best@1从30%提升至95.5%,并在长上下文编程、GPU kernel生成与nanoGPT加速跑中与主流Harness持平或更好。
Acquire挂牌:AI LinkedIn获客工具5个月做到5.6万美元MRR并寻求出售
Acquire.com创始人Andrew Gazdecki于8月23日公布一款面向机构和销售团队的AI LinkedIn外联工具:零广告投放、5个月做到约5.6万美元MRR,挂牌数据显示TTM营收约62万美元、利润约40万美元、500余个B2B付费席位、按账户59美元订阅。卖家同时给出约129万美元ARR口径和约100万–199万美元要价,适合对照获客自动化产品的定价与退出倍数。
Perplexity推出Portable Computer:Agent运行时全部本地化
Perplexity在NVIDIA DGX Spark上线Portable Computer,编排模型、子Agent与harness都在本地跑,默认不依赖云端推理。当前可选PPLX 27B与Qwen 3.8 27B,面向Pro/Max用户,强调私有文档不出机、本地任务不计云端token。
Apodex 1.1:沿环境与协同两条轴扩展复杂工作的Agent能力
论文提出用Environment Scaling与Agentic Coordination Scaling训练可验证、可长期推进任务的working capability,并由AgentOS维护跨工具状态。35B的Apodex 1.1 Mini在职业、金融与科研任务上接近部分前沿系统,且可本地部署。
Open WebUI 发布 v0.11.1:工具审批与模型提问
可离线自托管的 AI 对话平台 Open WebUI 于 2026-08-25 发布 v0.11.1,管理员可开启 Human-in-the-loop,让模型调用工具前逐条等待允许或拒绝。模型也可暂停并向用户提出最多三个选择题,终端产物可在回复中直接预览下载。
匿名模型Ox Alpha持续刷屏,社区怀疑与智谱GLM同源
OpenRouter上线的stealth/Ox Alpha提供百万级上下文和视频输入,编码测评被拿来对标闭源旗舰且目前免费。有开发者从错误栈与分词器对齐指向智谱内部命名,同时有人提醒流量与数据归属仍不透明。
字节跳动上线办公 Agent 产品「豆包工作」
8月25日,字节跳动发布面向生产力场景的 Agent 产品「豆包工作」,可拆解任务、调用浏览器与电脑完成文档表格等流程,并与飞书账号及权限体系打通。电脑版已开放下载,登录或升级可领取30天订阅权益。
Marc Lou公开:9个月用vibe coding做出约30万美元收入
独立开发者Marc Lou于8月24日发帖称用vibe coding在9个月内做出约30万美元收入,另有约3万美元收购中介费;其账号同步标注TrustMRR约4.4万美元/月、DataFast约2.6万美元/月等组合产品流水。对想用AI编程批量做小产品、再靠目录与分析工具叠加变现的开发者,这条路径可直接对照拆解。
ChatGPT Work上线网站登录能力,凭证不经过模型
官方称Work现可用自带电脑与浏览器登录网站,且ChatGPT看不到用户名和密码,覆盖预约、报销、保单核对、招聘触达等流程。该能力今日向Plus、Pro与Business的网页和移动端滚动放出。
阿里云视频模型 Wan3.0 正式上线,单次可生成30秒
8月24日,阿里云宣布 Wan3.0 正式上线,支持最长30秒视频生成,并可直接输入 DOC、XLS、PPT、PDF、MD 等文档。480P/720P/1080P API 报价为每秒0.3/0.6/1.2元,百炼与千问平台至9月23日提供7折。
DataFast单日收入约4000美元,TrustMRR核验MRR约2.9万美元
Marc Lou 8月24日发布的vlog称分析产品DataFast刚到约2.7万美元MRR,并出现约4000美元的单日收入;TrustMRR页面于8月25日更新的Stripe核验数据显示DataFast MRR为29437美元、30日收入27048美元、1360个活跃订阅。这是可核验的分析向SaaS增长样本,而不是口头估算。
ReWorld:在固定KV预算下同时做动作跟随与长程记忆的交互世界模型
港科大广州与阿里团队将控制与记忆在训练期拆开,推理时用有界KV缓存加姿态索引地标库召回历史场景。模型可实时生成704×1280视频,并在64秒往返轨迹上仍能重建起点视角。
OpenAI联合多家平台发起WebMCP黑客松,桌面端将原生接入
OpenAI Dev宣布WebMCP Challenge,与Chrome、Cloudflare、Shopify、Vercel等合作,10天赛程奖金3.5万美元。同期称ChatGPT桌面内置浏览器与Sites将支持WebMCP,页面可直接向Agent暴露工具。
EarthVerse:面向动态地球系统与自然灾害的科学Agent基准
基准包含405个可复现任务,覆盖199个记录事件与19类灾害,要求Agent在异构资料包上选证据、做计算并保留出处。25套模型与Agent系统中,最佳平均答题单元准确率为84.65%,但Strict@95仅34.81%。
JetBrains 推出 Junie Local,可在 Mac 本地跑编码 Agent
JetBrains 发布 Junie Local,在会话中执行 /local 即可下载并切换到本机推理,代码不离开设备且不消耗云端额度。当前打包 Qwen3.6-27B 4bit,需 M5 及至少64GB 内存,安装体积约20GB。
Claude Cowork 与聊天共用记忆,可按主题编辑
Anthropic 于8月25日更新 Claude:聊天与云端 Cowork 共用同一套记忆,用户可按主题查看、编辑或删除条目。健康、信念等敏感主题默认不写入记忆,可在设置中单独开启。
Marin:开源基础模型研发框架
面向基础模型研究与训练的开源框架,仓库体量仍小但已进入当日 GitHub Trending。适合关注训练与实验管线的开发者。
Paperclip 发布 v2026.824.0:对话式任务成为默认界面
开源 Agent 编排应用 Paperclip 于 2026-08-24 发布稳定版 v2026.824.0,对话式任务界面成为默认体验,并走完 canary 到 stable 发布通道。产品内可登录 Claude 与 Codex,沙箱执行增加能力校验,也支持经 Tailscale HTTPS 访问托管运行时预览。
claude-plugins-community:Claude Code 社区插件市场
Anthropic 镜像的 Claude Code / Cowork 社区插件目录,仓库规模尚小但已进入当日热榜。便于跟踪可插拔 Agent 插件生态。
Cline Desktop 发布 v0.0.17:统一 Customize 中心
开源编程助手桌面端 Cline Desktop 于 2026-08-25 发布 v0.0.17,将 Plugins、MCP、Skills、Rules、Hooks 与 Tools 收进带分页和实时计数的 Customize 中心。目录安装项会立刻出现在已装列表中,原先独立的 Marketplace 页面已移除。
prepr:把 Agent 计划文档当成代码开 Draft PR 做评审
作者在 2026-08-25 公开这套面向 Claude Code 与 Codex 的 3 个 Skill:prepr-open、prepr-review、prepr-close。用 gh/git/jq 把 plan-mode 产出推成草稿 PR,让团队像审代码一样审计划。
ai-job-search:本机运行的求职 Agent 框架
基于 Claude Code 的求职工作流,可评估岗位、改简历、写求职信并准备面试。今日 GitHub Trending 日增星过千。
a16z分享最新LP材料:模型是否商品化与Agent形态分化
Anish Acharya公开上周五给LP的幻灯片,覆盖技术扩散、护城河是发现而非设计、模型商品化争议,以及编码Agent与个人Agent的分流。对做应用层的团队,材料把“智能原语如何变成收入循环”写进了可对照的框架。
Curiouser.AI创始人披露订阅业务接近10万美元ARR
Curiouser.AI创始人Stephen Klein于8月25日发帖称,面向个人创业者的订阅产品Alice在约两年内接近10万美元ARR,试用转订阅约60%,咨询业务另有约8万美元收入,并同步推进Wefunder融资。收费试用、不做免费层的转化结构,对做面向个人用户的AI订阅产品有对照价值。
Langfuse 发布 v4.19.0:评测与成本追踪小步迭代
可自托管的 LLM 工程平台 Langfuse 于 2026-08-25 发布 v4.19.0,同窗口内还连续放出 v4.17.0 与 v4.18.0。本次加入组织级功能开关默认值、模型定义 upsert 接口,并在 Trace 表中拆分缓存与推理成本统计。
claude-obsidian:Obsidian + Claude Code 知识库 Agent
把资料丢进仓库后由 Claude 阅读、链接并归档为自有 Markdown 知识图。近 48 小时热度上升,偏向个人知识管理场景。
ChatGPT Plus 恢复 Codex 与 Work 的5小时用量上限
OpenAI 宣布自8月25日起,Plus 账户在 ChatGPT Work 与 Codex 重新启用5小时滚动限额,达到限额后需等待重置或购买额外积分。Pro 的100美元与200美元档在接下来数月暂不启用该限制。
Marc Lou盘点.lol竞价目录站:单站核验收入最高约5200美元
Marc Lou于8月24–25日连续披露一组用.lol域名做的竞价排名目录:30个站点合计核验收入约6100美元,其中warmap.lol约5200美元(2.1万访问)、premierdelaclasse.lol约1700美元、rankbid.lol约1600美元。这是低内容成本、靠付费占位变现的目录玩法,可对照国内工具导航和付费排名站。
openwiki-cc:从源码与 git 历史生成并增量更新仓库 Wiki
2026-08-25 有开发者基于 OpenWiki 思路放出 Claude Code 插件与 Codex Skill。通过 /openwiki:wiki 按变更增量维护 openwiki/ 文档,强调以源码和提交记录为根据,避免整库重写。
Epoch AI:美国GDP统计漏计Nvidia等无晶圆厂芯片商的增加值
报告指出,因设计在美国、制造与销售在海外,官方GDP几乎不记录Nvidia等公司的增加值,近一年美国GDP增速大约被低估0.3个百分点。若按当前经营利润增速外推,该缺口到2028年可能接近每年2个百分点。
AI安全公司Alice完成1.4亿美元融资,ARR接近1亿美元
Pulse2于8月25日报道,原ActiveFence更名后的Alice由Apax Digital领投1.4亿美元,累计融资约2.8亿美元,公司称AI安全业务ARR接近1亿美元、两年增长超过5倍,并服务多家前沿模型实验室。对关注企业级AI安全、内容审核和模型护栏方向商业化的开发者,这是近期可引用的融资与收入事件。
Thomson Reuters 发布自研模型 Thomson,并接入 CoCounsel Legal
8月24日,Thomson Reuters 发布自研大模型 Thomson,称以约4000万美元完成训练并用于法律产品 CoCounsel Legal。外媒报道其底座对齐自阿里 Qwen 开源模型,目前只用了公司自有语料的一小部分。
claude-code-mcp 于 2026-08-25 归档并停止维护
该 MCP server 通过本地 claude 命令对外提供 explain_code、review_code、fix_code 等工具,使其他 MCP 客户端能调用本机 Claude Code。仓库在 2026-08-25 归档,npm 包标记 deprecated,后续安全补丁不再保证。
列表只回溯近 14 期,更早的资讯仍可通过单期页访问。
内容由 AI 检索生成,每日自动更新,可能存在错漏;事实与数据以源链接为准。资讯狗不对第三方链接内容负责。